AI资讯
获取全球最新AI资讯,涵盖人工智能技术突破、行业应用及发展趋势,助您掌握AI领域最新动态。
Claude Code 自动模式默认开启:5 天后生效,先改好权限配置
Claude Code 自动模式即将默认开启:每次工具调用前过风险分类器,Hard deny 永不自动放行。5 天生效前先改好权限配置——切换前要检查这几处。
阅读更多 →GPT-5.6和Fable 5联手,解决悬置25年的MIMO检测难题
微软研究院首席研究员与 GPT-5.6、Claude Fable 5 合作,七天证明多项式时间算法能在最大似然阈值处精确恢复全部比特——拿下悬置 25 年的 MIMO 检测难题。
阅读更多 →AI 早报-2026年8月10日
2026年8月10日 AI 早报:180 万美元连亚马逊都烧不起 Claude、GPT-5.6 解 25 年数学难题、中国团队跑通数据层 RSI 等今日亮点 + 7 篇全球重要新闻。
阅读更多 →当题库追不上模型:BigBang-V1 用 100% AI 合成数据跑通数据层 RSI
当人类出题速度追不上模型:35B 开源模型 BigBang-V1 后训练数据 100% AI 自主合成(出题、解题、验证全交给 AI),8 项基准拿遍 35B 档最高分,甚至超过 1.6T 的 DeepSeek V4 Pro。
阅读更多 →OpenAI 亲手关停 Atlas:AI 浏览器是功能,不是目的地
OpenAI 关停 Atlas,从发布到停运仅 292 天。Arc 停更、Sidekick 被收编、The Browser Company 卖身——AI 浏览器集体退场,Chrome 份额稳如老狗:AI 浏览器是功能,不是目的地。
阅读更多 →模型不再是主角:Harness 才是 AI 竞争的新战场
AI 竞争重心正从模型转向模型周围的系统——Harness。混合价 $0.175/M 的模型靠 Harness 五项全胜贵 57 倍的旗舰,行业终于给"从没被量过的右半边"造了尺子。
阅读更多 →AI复现审计顶刊:92篇论文仅8篇达标,99.2%存在客观错误
ICML 2026 全部 168 篇口头报告论文被 AI Agent 复现审计:92 篇可验证论文中仅 8 篇能复现八成以上结论,99.2% 顶刊论文存在客观错误——科学验证方式迎来结构性转向。
阅读更多 →AI倒查论文:99.2%的顶刊论文都有问题
AI Agent 集体"打假"顶会论文:ICML 2026 口头报告仅 8 篇能复现八成以上结论,99.2% 论文至少一个客观错误。复现失败多因工程问题,4 篇论文依赖的模型已下线。
阅读更多 →便宜57倍的模型,靠 Harness 五项全胜旗舰:Model + Harness = Agent 的右半边终于有尺子了
Floatboat 发布首个 Harness 评测:同一底座 DeepSeek-V4-Flash($0.175/M)对阵贵 57.1 倍的 Claude Opus 4.8,五项 Agent 基准全胜——Harness 的右半边终于有尺子了。
阅读更多 →AI 早报-2026年8月9日
2026年8月9日 AI 早报:奥特曼 ChatGPT 育儿大法引争议、亲手封锁最强模型 Astra、谷歌强令 AI 核心员工回硅谷坐班等今日亮点 + 7 篇全球重要新闻。
阅读更多 →🔥 每日AI·第39期 | 2026-08-08
每日AI·第39期(2026-08-08):AI 产品持续涌现,本期关注垂直场景工具,附 AOYii 点评与 1000+ AI 产品导航站。
阅读更多 →赢过贵57倍旗舰的,不是模型,是Harness
Floatboat 把 Harness 摆上榜单:DeepSeek V4 Flash 五项基准全胜,对单价贵 57.1 倍的 Claude Opus 4.8 五项全输——刻意设计的单变量实验:差距在模型之外。
阅读更多 →