aiminute. ← 全部AI新闻
新模型 2026-08-14

OpenAI 最快的模型不是更小的模型——是同一个模型,跑在对手的芯片上

OpenAI 最快的模型不是更小的模型——是同一个模型,跑在对手的芯片上

8 月 13 日,OpenAI 开放了 Ultrafast 模式的限量预览:GPT-5.6 Sol 在 API 中的输出速度最高可达每秒 750 个 token,公司称这最高相当于标准速度的 14 倍。速度并非来自蒸馏或裁剪过的模型,而是来自 Cerebras 的硬件,因此输出应当与客户已在使用的 Sol 完全一致。在产能扩充期间,访问权限仅限一小批 API 客户,OpenAI 也尚未公布定价。公司列举的适用场景是延迟而非能力构成瓶颈的工作负载:事件响应、客户支持、金融分析和电商。

为什么重要?在此之前,想要快速回答就意味着接受较差的回答:更小的模型、更短的上下文、专用的微调版本。把速度与能力拆开,改变了哪些产品可以被做出来——一个必须先完成二十次工具调用才开口的智能体,在标准速度下无法使用,在每秒 750 token 下则平平无奇。这则公告里还有一层更安静的承认:OpenAI 速度最快的前沿模型服务跑在竞争对手的芯片上,既不是英伟达的,也不是公司正投入数千亿美元自建的那套基础设施。

✓ 已核实 · 3个来源

▶ 相关视频: Why OpenAI Chose Cerebras Over NVIDIA for GPT-5.6 Sol
WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

DeepSeek 的廉价主力模型现在能"看"了——在需要视觉的智能体任务上,它自称已接近 Anthropic 最强模型
2026-08-21
给机器人演示一次——三到十二秒——它就能在完全不训练的情况下把活儿做对 59 次
2026-08-21
模型自己出题、自己搭测试台,再拿结果训练自己——DeepReinforce 还把权重免费放了出来
2026-08-20
一块显卡就能跑的免费模型拿到 52 分——然后为了画一张图花掉 22276 个思考 token
2026-08-18
智谱没有造新模型,只是继续训练旧的——并称编程能力提升了 50%
2026-08-17