三步接入 RAG 重排:Jina Reranker v3.5 开源上手,0.6B 吊打 4B、长列表提速 56%
三步接入 RAG 重排:Jina Reranker v3.5 开源上手。0.6B 参数 BEIR 63.20 超 7 倍参数量 Qwen3-Reranker-4B,长文档列表提速 56%,结构化数据评分提升 24.8%,四种接入方式全跑通。
探索人工智能(AI)的核心技术、行业应用场景及未来发展方向,了解机器学习、深度学习如何改变世界。
三步接入 RAG 重排:Jina Reranker v3.5 开源上手。0.6B 参数 BEIR 63.20 超 7 倍参数量 Qwen3-Reranker-4B,长文档列表提速 56%,结构化数据评分提升 24.8%,四种接入方式全跑通。
DeepMind 提出视觉提示工程 VIPE:对视频模型,改输入画面比改提示词更有效——一张抽象草图改写成照片级写实场景,Veo 3.1 物理推理准确率从 41.3% 拉到 59.3%,全程未动提示词。
2026年8月1日 AI 早报:SIGGRAPH 时间检验奖押中物理 AI、MiniMax H3 手绘即特效、米哈游蔡浩宇 AI 创业生变等今日亮点 + 7 篇全球重要新闻。
Composio 把账算明白了:同一个模型、同一批任务,跑在不同 agent 框架里 token 消耗最多差 30 倍。模型能力趋同、价格白菜价之后,Agent 的成本竞争正转移到模型外那层"壳"——Harness。
GPT-5.6 Luna 降价 80%($1→$0.2 输入),DeepSeek-V4-Flash 同日发布维持低价。两件事合在一起:前沿模型定价权正从"能力溢价"转向"效用溢价",AI 服务加速商品化。
GPT-5.6 全线调价、入门款 Luna 降 80%。三个细节说明这不是价格战:Sol 自己重写 GPU Kernel 让服务成本降 20%、自己设计推测解码实验提效 15%——模型自己优化自己的"左脚踩右脚"飞轮。
OpenAI 开源 Codex Security CLI:应用安全智能体自动发现→验证→修复漏洞,三行命令跑起来。上线 30 天扫 120 万次提交、捞出 792 个严重级别发现,验证不了的漏洞不往外报。
Google 推出 GKE Agent Sandbox 并公开 Agent Substrate:Agent 不是微服务,K8s 的 API Server 与 Scheduler 是为长期运行服务设计的。容器时代属于 Kubernetes,Agent 控制平面之争刚刚开始。
2026年7月31日 AI 早报:Claude Code 之父称 Harness 保质期只有半年、高通押注个人 AI、GPT-5.6 自己优化自己实锤等今日亮点 + 7 篇全球重要新闻。
谷歌发布 GKE Agent Sandbox + Agent Substrate 项目:智能体像操作系统里的进程(大部分时间休眠、事件唤醒),而 K8s 为固定长期运行服务设计——架构层面根本错配,智能体需要自己的运行时。
2026年5月谷歌宣布 GKE Agent Sandbox GA + 披露 Agent Substrate:Kubernetes 不适合作为 AI 智能体控制平面。把智能体想象成进程而非服务,就明白"容器思维"错在哪。
GPT-5.6 Sol 通过 Codex 接入生产推理栈:自己分析流量、重写 GPU 内核、跑几百次实验,让对外服务成本降 20%、Token 生成效率提升 15%+。AI 从"被优化的对象"变成"做优化的主体"。