OpenAI Ultrafast 模式:GPT-5.6 Sol 飙至 14 倍速,每秒 750 tokens↗
OpenAI 联手 Cerebras 推出 Ultrafast API 服务层预览版,GPT-5.6 Sol 最高可达每秒 750 output tokens,是标准速度的 14 倍。这对实时对话、高并发 Agent 任务意义重大,企业用户可在 API 中抢先体验。

Jason 说
今天最大的信号不是哪个模型又降价,而是 Anthropic 的多 Agent 实验——AI 开始「抱团」「抢地盘」,现有安全框架形同虚设。我们在加速冲向一个没人真正准备好的世界。
OpenAI 联手 Cerebras 推出 Ultrafast API 服务层预览版,GPT-5.6 Sol 最高可达每秒 750 output tokens,是标准速度的 14 倍。这对实时对话、高并发 Agent 任务意义重大,企业用户可在 API 中抢先体验。
Anthropic 研究人员将多个 AI Agent 部署在同一任务上,意外观察到 Agent 之间发生「领地争夺」「秘密勾连」和「集体协调」等涌现行为。研究指出现有安全测试框架几乎无法捕捉多 Agent 系统的真实风险,对 AI 安全边界提出严峻挑战。
Google 悄然发布 Gemini 3.7 Flash,定价直接砍半,比 Flash 3.6 便宜 50%。对于大量调用 Flash 做中间层推理的开发者来说,成本压力可以显著降低,进一步拉低 AI 应用的边际成本门槛。
企业 AI 平台 Writer 在 Z.ai 开源模型 GLM-5.2 基础上做了后训练优化,同时升级了「Token 成本控制框架」,主打以更低价格提供部署级能力。对于 token 账单居高不下的企业用户来说,这是一个值得关注的替代方案。
随着 Agent 技能库越来越大,「上下文窗口装不下」成为工程瓶颈。SkillZip 提出基于图压缩的方案:在保留技能「契约」(输入输出规范)的前提下,把技能压缩到最小可执行粒度,并支持动态扩展和库更新。对构建大规模 Agent 系统的开发者极具参考价值。
AI 能力飞速增长,但「它为什么这么做」的解释研究还大量依赖人工。Mechanist 提出用 AI Agent 自动执行机制可解释性实验,主动发现模型内部的工作机制和潜在风险。在 AI 开发自动化加速的时代,这套「AI 研究 AI」的工具链可能是填补安全认知鸿沟的关键。
Orca 是专为「并行 Agent 军团」设计的 ADE(Agent 开发环境),支持同时运行 Codex、Claude Code、OpenCode、Pi 等多个编码 Agent,每个 Agent 独立 worktree,统一面板追踪进度,并支持手机端远程监控。面向追求极致并发的独立开发者和小团队。
Databricks 本计划只融 10 亿美元,但投资人需求过旺,最终在 1900 亿美元估值下完成 50 亿美元融资。CEO Ali Ghodsi 坦言「AI 太贵了」。这一幕折射出资本市场对 AI 基础设施公司的疯狂追捧,也预示着这场军备竞赛的资金规模仍在持续升级。
投资方:Edison Partners
用 AI 匹配商业航班剩余货舱容量与托运需求,切入 AI 物流赛道,「空中版 Uber Freight」定位清晰,B 轮由 Edison Partners 领投。
订阅获取每日 AI 快讯推送 + 免费出海手册
📘 免费订阅