

钱包还没缓过来,AI圈又炸了!
就在刚刚,OpenAI一口气端出GPT-6全家桶——Sol和Luna双模型同时上线。
而几小时前,Opus 5.5才刚刚发布。这一晚,堪称神仙打架现场!
OpenAI这次思路特别清晰:不搞一个模型包打天下,而是拆成两个方向,精准打击不同场景。
Sol的定位是处理极其困难、需要深度思考和逻辑推理的任务。
复杂代码重构?长逻辑链商业决策?需要多步规划的Agent工作流?统统交给它。
一句话总结:那种「难啃的硬骨头」,找Sol就对了。
Luna则是为高吞吐量、极其专注的任务而生。
瞬间从几百页PDF里提取发票数据,实时翻译海量聊天记录——速度快到飞起,成本低到几乎可以忽略不计。
专为企业级批量处理打造,妥妥的「赛博流水线工人」。
这才是最让人心跳加速的部分。
得益于缓存和推理底座架构的巨大改进,OpenAI成功把成本打下来了,而且没有中间商赚差价。
相比上一代促销价,API价格整整降低50%!
GPT-6 Sol(对标复杂推理):
输入价格从4美元降至2美元;输出价格从20美元降至10美元。
GPT-6 Luna(对标高频吞吐):
输入价格从0.20美元降至0.10美元;输出价格从1.20美元降至0.50美元。
Tibo特意强调:这次是永久降价,原来的限时价再打对折!
官方博客里的跑分,几乎每一项都拿Claude做对照,而且横轴都是「每任务成本」。
OpenAI想说的是:同样的分,花多少钱?
在AutomationBench商业工作流测试中,Sol拿到33.2%,每任务成本仅0.27美元,比对手成本低了约88%。
Claude Opus 5最高分26.9%,成本却是Sol的11.1倍。
在智能体终极考试中,Sol最高强度拿到56.4%,高于Opus 5最好成绩,每任务成本低60%。
事实准确性上,Sol犯的错误比上一代少了一半左右,接近Astra水平;Luna在高强度档追平GPT-5.6 Sol,成本只有后者的约百分之一。
编程场景更夸张——DeepSWE测试中,Sol的max级别得分68.8%,与对手最高分仅差1.1个百分点,但每项任务成本低了约80%!
Luna更是以对手约4%到7%的成本打平成绩,性价比拉满。
OpenAI这次在底层细节上下了狠功夫。
GPT-6 Sol和Luna极其清晰,没有废话;拒绝生僻术语和奇怪句式;回答更短,但干货满满。
问网站结构?直奔主题,用词精准,不含糊其辞。
过去AI每次都要把前置上下文重新读一遍,而GPT-6缓存命中率大幅提高。
更疯狂的是:命中的缓存输入Token,直接打1折!
开发者还能随时调整推理力度、开关工具、手动设置断点,全程不打断缓存。
GitHub报告称:数十亿次API请求监控中,需要重新处理的提示词Token占比暴降50%以上。
同一天撞上Opus 5.5,网友们怎么可能放过这场「世纪对决」?
在Bridgebench测试中,四大模型同台生成火箭发射台:
GPT-6 Luna仅用65秒,成本0.01美元;GPT-6 Sol用时1分钟,成本0.11美元;另两个对手分别耗时11分钟和12分钟,成本最高达1.52美元。
开发者Flavio Adamo提前上手Sol,输入《塞尔达传说:时之笛》预告片后,Sol直接手搓一个可玩版游戏。
他的第一感受是:「模型效率极高,速度和Token用量都很惊人。」
还有开发者把两款模型扔去管火星基地——100名殖民者、90秒生死倒计时、0人类介入。
结果出人意料:双方都稳稳保住了所有人。
好消息是,两大模型今天就可以上手!
ChatGPT平台:Sol和Luna将在ChatGPT Work中向Plus、Pro、Business、Enterprise和Edu用户全量推送。
Codex平台:两大模型同步上线,Free和Go用户也能在桌面端抢先体验Luna。
开发者API:模型已开放,名称分别为gpt-6-sol和gpt-6-luna。
这一晚,AI圈的竞争激烈程度又上了一个台阶。
技术的进步从来不是独舞,而是你追我赶的接力赛,最终受益的,永远是每一个愿意拥抱变化的人。
你最想用GPT-6 Sol还是Luna做点什么?评论区聊聊!
觉得有用的话,点个赞再分享给身边的技术搭子吧!