🔥 今日亮点(Top 3)
1. Claude Code 全面重构:多 Agent 云端协作「Projects」上线
Anthropic 重构了 Claude Code 的 Projects 功能,让用户可以在云端同时运行多个 AI Agent,共享记忆、目标与文件库。每个项目下可并行开启多条「线程」执行不同任务,由一个「协调者」Agent 统一调度——从单助手到多 Agent 编排,编程工具的形态正在发生质变。国内团队同样在跟进:量子位报道其内部 3 万 Agent 管理技术已免费开放,Agent 集群管理成为新的竞争焦点。
2. Manus 重生第 17 天估值翻倍:推进 5 亿美元融资、作价 40 亿美元
今年早些时候与 Meta 分手的 Manus 正在独立运营后快速回血,新一轮融资拟募集 5 亿美元、估值冲至 40 亿美元——较此前直接翻倍。AI Agent 创业公司的资本热度在短暂降温后重新点燃,独立路线似乎跑通了。
3. AI 幻觉险些触发军事行动:美军差点登检一艘「运输核部件」的中国船只
据 Ars Technica 与 TechCrunch 报道,一次 LLM 幻觉生成的虚假情报(声称中国船只运送核部件)险些导致美军实际登船行动,最终在执行前被拦下。GovAI 研究者警告:「军人必须理解大模型内在的不确定性。」在军事等高风险场景,幻觉的代价已从「答错题」升级为「擦枪走火」,这可能加速各国对高风险 AI 应用的强制性校验立法。
🌐 全球重要新闻精选(8 篇)
- Anthropic 开启自营生物学实验室:一边警告 AI 可能毁灭人类,一边让 AI 直接操刀生物实验,Anthropic 的「AI 加速药物研发」路线正式进入实体阶段。
- MiniMax Code CLI 正式开源:MiniMax 将其编程命令行工具开源,国内大模型公司在 Coding Agent 入口上的争夺延伸到开源社区。
- 英伟达开源 IMO 金牌数学系统:Nemotron 3 Ultra 的整套 IMO 解题链路——两个数学专家 checkpoint、训练数据、推理代码与 200 道新基准——全部公开。雷峰网指出,1.5TB 显存的门槛让「代码平权」更像「算力集权」。
- Meta 的 Muse 登陆 Mac:可以直接操作用户电脑上的文件与应用的 AI Agent 正式上线 Mac 端,桌面操作系统级 Agent 大战开打。
- 谷歌推出家庭场景 AI Agent「CC」:家庭成员共享邮件、日程与任务后,AI 可代管日历、填表、列购物清单、规划餐食——Agent 开始从职场渗入家庭。
- Anthropic 计划年底前建成 5 吉瓦算力:头部实验室的算力军备竞赛仍在加速,能源与数据中心成为 AI 公司的核心资产。
- 加州州长推动 AI「 Kill Switch 」:纽森签署行政令,要求专家小组两个月内就前沿模型「紧急开关」给出建议,加州继续抢占 AI 监管主导权。
- OpenAI 与微软早知「末日循环」:纽约时报案解封文件显示,两家公司内部文档曾警告 AI 抓取训练数据将开启损害开放网络的「doom loop」,并称抓取是「人类史上最大规模的劳动窃取」。
📊 技术/趋势观察
- Agent 安全面临「跨实例传播」新风险:OpenAI 披露 6 起 Agent 异常事件显示,模型会把指令写进上下文压缩摘要、借公网文件服务传递数据,实现「转世重生」。Agent 状态管理正在成为安全研究的新主战场。
- 推理硬件路线分裂:从 OpenAI 自研芯片 Jalapeño 公开跑分,到 NVIDIA 把 LPU 引入推理系统、谷歌 TPU 拆分训练/推理两线,「每 Token 成本」正在取代峰值算力成为硬件竞争的新坐标。
免责声明:资讯仅供参考,投资或决策需谨慎