AI指南
探索最全面的AI指南,涵盖人工智能基础知识、实用工具、学习资源和最新趋势,助您快速掌握AI技术并应用于实际场景。
10 分钟本地跑起蚂蚁开源 Avernet:把多个 OpenClaw Agent 连成一张协作网
蚂蚁 inclusionAI 开源 Avernet V0.1(Apache 2.0):把异构 Agent 连进同一张协作网的"协作层"基础设施,原生支持 OpenClaw,一个脚本拉起 5 个 bot 的"虚拟公司",10 分钟本地跑通。
阅读更多 →MCP 最大更新:为什么 AI Agent 协议走向无状态,比任何新功能都重要
MCP 发布以来最大更新竟是"减法":移除初始化握手、废除会话粘滞,协议回到无状态 HTTP 原点。为什么无状态化比任何新功能都重要——从原型走向生产的关键一跃。
阅读更多 →从Prompt Engineering到Loop Engineering:AI Agent时代的范式迁移
Jeff Dean 出走创办 Discovery Loop——"Loop"成为 AI 工程核心概念。从 Prompt Engineering 到 Loop Engineering:IBM 官方定义、Addy Osmani 系统阐述,Agent 时代的范式迁移。
阅读更多 →拆解 SciForge 架构:让科研 Agent 从"一次性对话"变成可审计、可交接的研究流水线
拆解开源科研 Agent 框架 SciForge:把"研究"与"一次对话"解耦,显式记录研究问题、评价指标与停止条件,让科研 Agent 从一次性对话变成可审计、可交接、可继续的研究流水线。
阅读更多 →10 分钟上手 Claude Fable 5:让 AI 帮你写 Lean 数学证明
Fable 5 是 Anthropic 旗舰级模型,普通 API 即可调用,已推翻躺了 87 年的 Jacobian 猜想。10 分钟上手:跑通 API,让 AI 写通过 Lean 内核验证的数学证明。
阅读更多 →微软开源 Orchard:一套 K8s 环境服务,训出逼近 10 倍参数规模的 SWE Agent
微软开源 Orchard:一套 K8s 环境服务,训出逼近 10 倍参数规模的 SWE Agent。Qwen3.5-35B-A3B 在 SWE-bench Verified 拿到 69.7%(重排后 73.0%),附 107K 训练轨迹。
阅读更多 →别再给 Claude 写提示词了——Anthropic 内部「智能体图」方法论全拆解
Anthropic 工程师 Lamis 在 DevCon 拆解内部"智能体图"方法论:从记忆管理到工作流编排、多 Agent 协同复盘。提示词的时代正在过去,图和记忆的时代正在到来。
阅读更多 →3 行 for 循环解锁生成模型端到端训练:拆解 Explorative Modeling 并跑通官方代码
UIUC 与哈佛提出 Explorative Modeling(XM):用 3 行 for 循环补上生成模型端到端训练的拼图,解决暴露偏差。代码已开源,含 ImageNet/视频世界模型/语言模型全套训练脚本。
阅读更多 →35M 参数暴打 230M:单卡 H200 训练的最强小模型 BarunLM-35M 拆解与 10 分钟复现
独立开发者开源 BarunLM-35M:单卡 H200、5.7B token,九项零样本基准平均 41.01% 干翻 230M 模型。拆解局部注意力、可学习残差选择器等参数效率设计,10 分钟可复现。
阅读更多 →三步接入 RAG 重排:Jina Reranker v3.5 开源上手,0.6B 吊打 4B、长列表提速 56%
三步接入 RAG 重排:Jina Reranker v3.5 开源上手。0.6B 参数 BEIR 63.20 超 7 倍参数量 Qwen3-Reranker-4B,长文档列表提速 56%,结构化数据评分提升 24.8%,四种接入方式全跑通。
阅读更多 →DeepMind 提出「视觉提示工程」:改画面比改话术更有效,视频模型推理的新提效路径
DeepMind 提出视觉提示工程 VIPE:对视频模型,改输入画面比改提示词更有效——一张抽象草图改写成照片级写实场景,Veo 3.1 物理推理准确率从 41.3% 拉到 59.3%,全程未动提示词。
阅读更多 →同样任务烧 30 倍 token:Agent 的成本战场,正在从模型转移到 Harness
Composio 把账算明白了:同一个模型、同一批任务,跑在不同 agent 框架里 token 消耗最多差 30 倍。模型能力趋同、价格白菜价之后,Agent 的成本竞争正转移到模型外那层"壳"——Harness。
阅读更多 →