MiniMax H3 发布解析:多模态视频生成的“任务统一”拐点到了吗?
MiniMax H3 解析:用"语言作为统一接口"的 Omni-Transformer 架构把视频生成推向"通用多模态生成",2K 仅 $0.13/秒 + 即将开放权重——多模态的"任务统一"拐点到了吗?
MiniMax H3 解析:用"语言作为统一接口"的 Omni-Transformer 架构把视频生成推向"通用多模态生成",2K 仅 $0.13/秒 + 即将开放权重——多模态的"任务统一"拐点到了吗?
MiniMax H3 发布:视频编辑全球第一、2K 定价 0.8 元/秒砍到 1/3、8月3日开源权重。三重信号指向同一方向:视频生成从"能出片"走向"能商用",任务泛化时代来了。
MiniMax H3 与字节 Seedance 2.5 同日发布:H3 不再把图/视频/音频当独立任务,而用一个模型统一理解创作意图——"参考 Video 1 运镜 + 图 2 人物 + 音频 3 声线"一次推理出片。
OpenAI 新模型系列 Astra 曝光:Altman 先向华盛顿闭门演示。定位"让多个 Agent 长时间协同工作",据称攻克 80 年 Erdős 猜想——从单打独斗到多 Agent 协作,产业静默转折。
三步接入 RAG 重排:Jina Reranker v3.5 开源上手。0.6B 参数 BEIR 63.20 超 7 倍参数量 Qwen3-Reranker-4B,长文档列表提速 56%,结构化数据评分提升 24.8%,四种接入方式全跑通。
DeepMind 提出视觉提示工程 VIPE:对视频模型,改输入画面比改提示词更有效——一张抽象草图改写成照片级写实场景,Veo 3.1 物理推理准确率从 41.3% 拉到 59.3%,全程未动提示词。
2026年8月1日 AI 早报:SIGGRAPH 时间检验奖押中物理 AI、MiniMax H3 手绘即特效、米哈游蔡浩宇 AI 创业生变等今日亮点 + 7 篇全球重要新闻。
每日AI·第36期(2026-07-31):本期推荐无代码 AI 建站平台 HeyBoss AI——几分钟把创意变成网站或应用,附 AOYii 点评与 1000+ AI 产品导航站。
Composio 把账算明白了:同一个模型、同一批任务,跑在不同 agent 框架里 token 消耗最多差 30 倍。模型能力趋同、价格白菜价之后,Agent 的成本竞争正转移到模型外那层"壳"——Harness。
GPT-5.6 Luna 降价 80%($1→$0.2 输入),DeepSeek-V4-Flash 同日发布维持低价。两件事合在一起:前沿模型定价权正从"能力溢价"转向"效用溢价",AI 服务加速商品化。
GPT-5.6 全线调价、入门款 Luna 降 80%。三个细节说明这不是价格战:Sol 自己重写 GPU Kernel 让服务成本降 20%、自己设计推测解码实验提效 15%——模型自己优化自己的"左脚踩右脚"飞轮。