GPT5.6凌晨刚上线:三档模型怎么选,别把额度烧在Sol上

简介: GPT5.6上线,推出Sol/Terra/Luna三档模型:Sol专攻复杂任务,Terra适配日常办公,Luna专注快速批量处理。搭配GPT-Live全双工语音、桌面端Work/Codex整合及限额透明化,强调“按需选模”而非盲目用强。工具越智能,越需人精准定义目标与分工。(239字)

GPT5.6在北京时间7月10日凌晨开始推送。


很多人第一眼看到Sol,就把所有活都塞过去。写一段文案、改一张表、扫一遍资料,也要开最高推理。结果等了很久,额度掉得比结果快。


我把官方说明和首日开发者反馈放在一起看了下,发现本次更新应该更关注怎么把活分开。


会拆分活了,你今天就能少掉一次来回切模型,也能少踩一次额度突然见底的坑。


先给结论。


大多数日常任务从Terra开始,重复小活交给Luna(但这里老金实验的时候发现好像Terra的最低做的好像更快更好),只有错一次代价高、又需要它自己反复检查的任务,才值得叫Sol上场。


前端审美依旧差,不过发现问题更加细致了,比如之前它可能只会修改前端,现在在前端修改后,还会同时调整后端。


还是老金对Claude和Chatgpt以往的印象,Claude适合前端,跨文件系统,多线程任务。Chatgpt适合垂直任务,如修复BUG,创建数据库等。在肥波5和Gpt5.6上,依旧是相同的感受。


太阳、地球、月亮,三个模型的说明

GPT5.6把模型分成Sol、Terra、Luna三档。名字挺花,其实是在替你把复杂度、速度和成本拆开。


Sol是难题档。复杂代码、长资料研究、重要方案和需要反复核对的任务,都可以给它更多推理时间。

Terra是日常档,写作、整理资料、解释代码和普通办公先从这里开始。

Luna跑得更快,适合格式整理、批量摘要、分类和标题备选。



三档的价格梯度也拉得很开。API定价每百万token,Sol输入5美元、输出30美元,Terra是2.5和15,Luna是1和6。


Sol和Luna相差5倍。普通人在ChatGPT套餐里不直接按这个付钱,套餐额度也不会照API价格1比1扣减。任务复杂度、模型和运行方式都会影响实际消耗。选模型,还是在选你愿意为这一次任务花多少额度。


官方还加了两个容易被漏掉的档位。max是给单个模型更多时间去想,ultra则会把复杂任务拆给多个子代理并行处理。


官方说明里,ultra默认协调4个智能体一起跑。你打开ultra时,接受的是这套默认并行配置,不是一个让你手动挑几个小助手的界面。

这能缩短难题的完成时间,也会把消耗放大,和我的Meta_Kim同原理,这回我发现我的Meta_Kim在Codex中也变得好用了。GitHub上直接搜Meta_Kim就行。

几个子智能体同时读材料、调用工具、写中间结果,token 不会按一个人慢慢烧。它不一定每次都刚好按某个整数倍放大,但额度掉得更快是正常现象。别急着把开关全开。先问一句,这件事错了以后,到底要不要返工半天。


模型越强,越要把目标、资料和验收标准讲清楚。否则它只是更贵地替你猜。


论坛里已经吵起来了,看起来BUG还不少

首日社区反馈很有意思。有人觉得Sol对复杂问题抓得更深,来回补提示词的次数少了。也有人拿同一段任务去跑,发现Terra或Sol比旧模型慢得多,5小时额度掉得很快,任务还没结束。


还有一批人遇到的是更现实的问题,菜单里一会儿只有Terra和Luna,一会儿Sol又消失。官方已经说明这次是全球逐步推送,套餐、工作区和客户端版本都会影响你眼前的列表。论坛帖子不是测评,也不能代表所有人,但它把这次升级的真问题提前暴露出来了,模型选择已经和额度管理绑在一起。


所以第一周别急着用最重要的项目做赌注。找一件你熟悉、结果好坏也看得出来的任务,用Terra跑一遍,再用Sol跑一遍。比较三件事就行,少改了几轮,花了多久,额度掉了多少。这个答案比任何跑分都更像你的答案。


GPT-Live:OpenAI的新一代语音,能边听边说

今天还同期上线了新的GPT-Live,分GPT-Live-1和GPT-Live-1 mini两个版本。它成了消费者版ChatGPT Voice的新默认语音,原来的Advanced Voice仍保留给需要视频和屏幕共享的人。


更新移动端就能使用。

最大的更新是全双工。旧的高级语音是轮替式,你说完,它再说,一来一回。GPT-Live能同时听和说,你讲话时它会用简短回应表示在听,你也能随时打断它,不用等它把一长段讲完。对话更接近真人打电话。OpenAI在5到10分钟的配对对话评测中称,GPT-Live-1和mini都被明显更偏好,但没有公开75.7%这个数字。


另一件事是后台委派。你问到要联网搜、要深推理的难题,GPT-Live不会卡在那儿干想,而是把这部分活交给后台模型处理,自己留在对话里继续跟你聊。首发后台用的是GPT-5.5,之后会跟着前沿模型一起迭代。它和GPT5.6同一周出现,但底层不是同一个模型——一个管语音对话,一个管复杂任务。


代价也有。这次GPT-Live砍掉了视频和屏幕共享,原来高级语音能看你的画面,现在不行。Business、Enterprise和Edu工作区首发也没有,目前只推消费者版的网页、iOS和Android。你要让它看屏幕,眼下还得退回Advanced Voice。


对做内容、会后整理、练外语的人,这个更新最直接。你不用先把脑子里一团乱线头整理成一段完美问题,边说边改就行。


这次真正变大的,是ChatGPT开始接整段工作

7月9日,OpenAI把Work和Codex收进了新的桌面应用。

Work接住长任务和成品,Codex处理代码和本地项目。以前切入口时要重复交代背景。现在可以在一个桌面工作台里继续往下做。


模型菜单也终于把三个维度拆开了。选Sol、Terra、Luna是在选模型,推理强度是在决定让它想多久,速度是在决定你愿不愿意多等一会儿,快速是消耗x1.5倍。不过要注意,最贵的组合,不一定最适合你手里的活。


限额重置能看过期时间了

GPT5.6上线后,使用量页面里多了一个很实用的细节。这次能看到失效日期了,灰常的贴心。


再然后,还有个重要信息。Tibo在已验证的公开帖里说,为庆祝GPT5.6 Sol上线,ChatGPT Work和Codex会在接下来24小时内再次进行两次速率限制重置。


Chrome里的Codex插件也更新了

你在Chrome里打开网页时,点击插件后,左侧现在可以出现Codex任务栏。你可以在正在看的页面旁边发起任务,让它复现网页问题、核对表单流程,或者帮你定位前端哪里出了错。很像Gemini的那个。


这波更新,老金我的感受

GPT5.6当然更强,GPT-Live更会听,ChatGPT也开始把聊天、做事、写代码和浏览网页往一条线上收。

但工具越像一个能自己往前跑的同事,人越要留在目标、权限和验收的位置。

别把最强模型当成答案,它越来越考验你对事情的理解程度,更考验你清楚应该对什么模型分发什么事情。

先把你最烦的那一步交出去,再看它替你省下了什么。


相关文章
|
1月前
|
人工智能 缓存 JSON
刚刚 GPT-5.6 发布,吊打 Claude 5 和 Grok 4.5?一手实测来啦!
GPT-5.6 刚发布,跑分号称超越 Fable 5,真的假的?附一手实测,让 3 个最强 AI 编程模型 GPT-5.6 Sol、Claude Fable 5、Grok 4.5 在 Cursor 里同时一把梭开发网页游戏,看看最新模型到底谁更能打。
637 0
|
1月前
|
人工智能 API 数据库
Kimi深夜突袭K3,2.8万亿参数超大水桶!直接跨入世界第一梯队!
老金我昨儿在网上瞎逛的时候,突然看到了Kimi K3的消息。 合计先打开官网看看开发者文档有没有啥信儿,结果刚打开官网,好家伙。。就看到已经上线了! ![Image](https://ucc.alicdn.com/pic/developer-ecology/p3shvhj26rigq_0488c34b2827443e9b77df8ee1e3a066.png) Kimi官网Chat窗口里已
|
Linux 数据安全/隐私保护 iOS开发
如何使用 Xcode 打包导出 IPA 文件并进行 iOS 应用内测,无需支付苹果开发者账号费用?
如何使用 Xcode 打包导出 IPA 文件并进行 iOS 应用内测,无需支付苹果开发者账号费用?
|
1月前
|
传感器 边缘计算 文字识别
车位与车牌目标检测数据集:4类别 | 目标检测
本数据集含5000张真实停车场图像,标注4类目标(空位、已占用、违规停车、车牌),支持YOLO等主流模型训练,适用于智慧停车、违停检测等场景,助力无人值守停车场落地。(239字)
201 6
车位与车牌目标检测数据集:4类别 | 目标检测
|
1月前
|
存储 数据采集 人工智能
下水管道损坏检测:基于YOLO11的云上视觉AI训练实践
本文介绍基于YOLO11的下水管道损坏智能检测实践,涵盖7类典型缺陷识别,演示云上数据管理、标注、训练、评估到部署全流程,助力城市地下管网高效、安全、自动化巡检。(239字)
下水管道损坏检测:基于YOLO11的云上视觉AI训练实践
|
2月前
|
Linux 程序员 数据格式
【2026最新】Notepad++下载、安装和使用一篇搞定(附中文版安装包)
Notepad++ 是一款免费开源、轻量高效的 Windows 文本编辑器,支持 C/Python/HTML 等 80+ 语言语法高亮、代码折叠、正则替换、编码转换及插件扩展,专为程序员与文本处理用户打造,完美替代系统记事本。(239字)
24891 9
|
1月前
|
存储 弹性计算 负载均衡
阿里云服务器地域选哪个?6点考虑因素,看完就知道怎么选了!
阿里云ECS地域选择需综合6大因素:用户位置(就近降延迟)、内网互通(同地域才内网连)、备案合规(如北京/广东需指定地域)、价格差异、新功能支持、海外业务适配(如新加坡、法兰克福)。选错不可修改,务必创建前审慎决策。阿里云官方活动:https://t.aliyun.com/U/OTnSAH
178 3
|
1月前
|
SQL 监控 Serverless
阿里云国际版:函数计算FC超时怎么办?依赖、内存与日志排查指南
函数计算FC超时的本质,是函数在用户设定的最大执行时间内没能返回结果。这个时间理论上最长可以配到300秒甚至更久,但很多业务场景里,即便把上限拉满,一次冷启动配合模型推理依然会让函数撞线。
200 2
|
4月前
|
人工智能 JavaScript 调度
一文看懂:Hermes Agent与OpenClaw区别对比,AI Agent双雄对决,谁才是2026最佳选择
Hermes Agent是轻量Python智能体,主打“自进化+持久记忆”,越用越懂你;OpenClaw是TypeScript控制中枢,强在多通道、多智能体编排与成熟插件生态。免费领阿里云Tokens:https://t.aliyun.com/U/fPVHqY 选Hermes重深度成长,选OpenClaw重广度调度。
2397 1