Google DeepMind 成立新研究所,旨在公开探讨通用人工智能(AGI)的重大问题,推动更广泛的社会辩论。对 AI 研究者、政策制定者及关注 AGI 治理的公众有参考价值。
一篇立场论文指出,基于语言模型的开放式战略兵棋推演存在决策洗白、裁决不透明、角色崩塌、裁决升级、战略想象力失效五类风险,认为在缺乏可审计安全论证前,不应让此类模型影响规划、条令、政策或危机应对,其当前正确用途是作为压力测试工具。
该论文探索零样本LLM智能体管理长周期物理任务的可行性,设计融合规划、工具调用、观察与验证的多智能体框架,在农业任务中与强化学习智能体对比。结果显示,同天气下LLM智能体管理效果相当,环境变化时自适应能力更强。
Meta推出WhatsApp Business MCP服务器,开发者可用Claude、Cursor、Codex、ChatGPT等AI编码代理完成商业账号设置、消息模板、测试与故障排查,降低配置门槛。