How the 4 New Models Released This Week Will Change How You Work
The AI Daily Brief · 2026-07-11

Grok 4.5 在企业级代码和自动化任务上跑赢中国开源模型,成本只要 Fable 5 的十分之一,GPT 5.6 则成了最靠谱的日常工作"劳模"。
这周 4 个新模型,工作方式正在被重塑
- OpenAI 推出 GPT Live,主打"全双工"语音对话——能边听边说,像真人一样随时插话、打断、补充,不用等你说完才回应。
- Grok 4.5 是 SpaceX AI 和 Cursor 合作后的首款模型,专为大规模代码库和自动化任务设计,强调工程和代理(agent)能力。
- Cognition SUI 1.7 走"应用层模型"路线,速度极快,主打用更低成本做接近前沿模型的活,基于 Kimmy K 2.7 微调。
- GPT 5.6 Soul 被大量一线用户评价为"最值得信赖的日常工作搭档",写作、查资料、产品输出都比前代快且稳。
GPT Live:语音交互终于像真人,背后架构大变样
- GPT Live 分两款:标准版和 Mini 版,核心是"全双工架构"——能同时听和说,像真人一样随时插话、暂停、继续。
- 之前的语音模型 都是"你说完我再说",中间靠静音判断是否轮到 AI 回应,导致经常误判、打断、体验生硬。
- 现在变成连续流式处理:AI 能每秒多次判断要不要说话、暂停或调用工具,像真人对话一样自然。
- GPT Live 只负责交互,遇到复杂推理、搜索等任务时,会后台调用更强的 GPT 5.5/5.6 这些大模型,边聊边干活。
- 实时翻译和语言学习体验大幅提升:能边听边译,不用等你说完,像真人同声传译一样顺畅。
- 用户反馈:多语言(如土耳其语方言)表现自然,能抓住语调和本地特色;但深度推理和复杂讨论仍不如顶级文本模型。
- 典型用例:个人助理(查天气、订会议、查股票等),比 Siri 更聪明,能处理以往语音助手搞不定的任务。
Grok 4.5:企业级代码和自动化的性价比之王
- Grok 4.5 专为工程和代理场景打造,能处理跨多个代码库、长流程、多工具协作的复杂任务。
- 和 Opus 48、GPT-5.5 性能相当,但成本只要 31 美分/任务(Opus 48 要 1.8 美元,Fable 5 要 2.75 美元)。
- 自动化能力突出:在模拟 Excel、Gmail、Slack 等真实 SaaS 环境下,自动化测试得分 51.4%,超过 Fable 5(48.6%),且用的 token 和交互轮数更少。
- Cursor 团队强调:Grok 4.5 和 Composer 2.5 是不同量级,后者会继续更新,满足不同成本/性能需求。
- 企业客户青睐:Grok 4.5 性能比中国开源模型更强,价格接近但没有数据合规/地缘风险,被称为"西方企业友好型中国价模型"。
- 真实开发者反馈:Theo 测试后称其为"奇怪地好用的默认代码模型",大任务能高效分解、回合流畅,虽不及 Fable 5 智能,但速度和体验极佳。
Cognition SUI 1.7:极致速度带来的新交互模式
- SUI 1.7 基于 Kimmy K 2.7 微调,在标准基准上略优于 GLM 5.2 和 Composer 2.5,成本仅为前沿模型的 1/2 到 1/3。
- 速度极快:"Lightning" 版快到人眼跟不上,适合那些"本来要走开等结果"的任务,现在变成"还没走神就算完了"。
- 团队自研多区域训练、自压缩等技术,让模型在效率和行为上都和底层 Kimmy K 2.7 拉开差距。
- 行业趋势:应用层公司用自有 UX 数据微调模型,专攻特定任务,做到接近封闭大模型的效果,但速度和成本更优。
- 新交互体验:任务异步但极快,用户不用等太久也不用完全放下手头事,形成"快到你还没反应过来"的工作流。
GPT 5.6 Soul:日常工作里的"劳模",但不是最聪明的
- 写作、查资料、产品输出一把抓:被 Dan Shipper、Peter Gostev 等一线用户称为"最值得信赖的日常模型",写营销邮件、做法律检索、产品文档都比 Fable 5 更稳更快。
- 和 Fable 5 的区别:Fable 5 更像"智者",推理深、语言优美;GPT 5.6 Soul 更像"罗威纳犬",抓住任务死磕到底,执行力极强。
- 速度改变工作方式:Soul 是最快的"主力模型",改稿、试错、切换方向都能在思路还没断时完成,极大提升工作流效率。
- 适合"有人盯着、需要频繁反馈"的任务,而 Fable 5 更适合"放手让它慢慢做"的大型项目。
- 法律等高精度领域表现突出:能替代初级律师做公开资料检索,搜索能力优于 Anthropic 系列。
- 用户建议:Soul 最适合"你要随时引导、补充资料、给例子"的场景,Fable 5 适合"放飞让它自由发挥"。
未来展望:GPT-6 和 Fable 5.1 即将上线,模型大战加速
- GPT-6 预计 1 个月内发布,比预期提前,采用更大规模的预训练,OpenAI 内部信心很高。
- Fable 5.1 也在路上,Anthropic 计划几周内发布,模型迭代速度全面加快。
- Elon Musk 旗下 Grok 也在训练 10 万亿参数新模型,行业整体进入"无上限"竞赛阶段。
带走一句话
"Fable 5 更像智者,GPT 5.6 Soul 像罗威纳犬——一个深思熟虑,一个死磕到底,工作里最好两者都用。"
- 企业选模型别只看智能,还要看成本和合规:Grok 4.5 把"中国价"和"西方企业友好"结合,适合对数据合规有要求、又想省钱的大公司。
- 语音交互正成为新主流:GPT Live 的全双工体验让 AI 更像"人",做个人助理、实时翻译、陪练语言都比以前自然,未来办公/生活场景会大量迁移到语音驱动。
- 速度正在重塑工作流:SUI 1.7、GPT 5.6 Soul 这类极快模型,让"边做边改、随时反馈"成为可能,产品和团队可以大胆尝试把更多任务交给 AI 快速试错。
- 模型组合用法成趋势:不是"谁最强用谁",而是用 Fable 5 做深度推理、GPT 5.6 Soul 做高频执行、Grok 4.5 做高性价比自动化——AI 工具箱正在变成"多模协作"。
