GPT5.6凌晨刚上线:三档模型怎么选,别把额度烧在Sol上

简介: GPT5.6上线,推出Sol/Terra/Luna三档模型:Sol专攻复杂任务,Terra适配日常办公,Luna专注快速批量处理。搭配GPT-Live全双工语音、桌面端Work/Codex整合及限额透明化,强调“按需选模”而非盲目用强。工具越智能,越需人精准定义目标与分工。(239字)

GPT5.6在北京时间7月10日凌晨开始推送。


很多人第一眼看到Sol,就把所有活都塞过去。写一段文案、改一张表、扫一遍资料,也要开最高推理。结果等了很久,额度掉得比结果快。


我把官方说明和首日开发者反馈放在一起看了下,发现本次更新应该更关注怎么把活分开。


会拆分活了,你今天就能少掉一次来回切模型,也能少踩一次额度突然见底的坑。


先给结论。


大多数日常任务从Terra开始,重复小活交给Luna(但这里老金实验的时候发现好像Terra的最低做的好像更快更好),只有错一次代价高、又需要它自己反复检查的任务,才值得叫Sol上场。


前端审美依旧差,不过发现问题更加细致了,比如之前它可能只会修改前端,现在在前端修改后,还会同时调整后端。


还是老金对Claude和Chatgpt以往的印象,Claude适合前端,跨文件系统,多线程任务。Chatgpt适合垂直任务,如修复BUG,创建数据库等。在肥波5和Gpt5.6上,依旧是相同的感受。


太阳、地球、月亮,三个模型的说明

GPT5.6把模型分成Sol、Terra、Luna三档。名字挺花,其实是在替你把复杂度、速度和成本拆开。


Sol是难题档。复杂代码、长资料研究、重要方案和需要反复核对的任务,都可以给它更多推理时间。

Terra是日常档,写作、整理资料、解释代码和普通办公先从这里开始。

Luna跑得更快,适合格式整理、批量摘要、分类和标题备选。



三档的价格梯度也拉得很开。API定价每百万token,Sol输入5美元、输出30美元,Terra是2.5和15,Luna是1和6。


Sol和Luna相差5倍。普通人在ChatGPT套餐里不直接按这个付钱,套餐额度也不会照API价格1比1扣减。任务复杂度、模型和运行方式都会影响实际消耗。选模型,还是在选你愿意为这一次任务花多少额度。


官方还加了两个容易被漏掉的档位。max是给单个模型更多时间去想,ultra则会把复杂任务拆给多个子代理并行处理。


官方说明里,ultra默认协调4个智能体一起跑。你打开ultra时,接受的是这套默认并行配置,不是一个让你手动挑几个小助手的界面。

这能缩短难题的完成时间,也会把消耗放大,和我的Meta_Kim同原理,这回我发现我的Meta_Kim在Codex中也变得好用了。GitHub上直接搜Meta_Kim就行。

几个子智能体同时读材料、调用工具、写中间结果,token 不会按一个人慢慢烧。它不一定每次都刚好按某个整数倍放大,但额度掉得更快是正常现象。别急着把开关全开。先问一句,这件事错了以后,到底要不要返工半天。


模型越强,越要把目标、资料和验收标准讲清楚。否则它只是更贵地替你猜。


论坛里已经吵起来了,看起来BUG还不少

首日社区反馈很有意思。有人觉得Sol对复杂问题抓得更深,来回补提示词的次数少了。也有人拿同一段任务去跑,发现Terra或Sol比旧模型慢得多,5小时额度掉得很快,任务还没结束。


还有一批人遇到的是更现实的问题,菜单里一会儿只有Terra和Luna,一会儿Sol又消失。官方已经说明这次是全球逐步推送,套餐、工作区和客户端版本都会影响你眼前的列表。论坛帖子不是测评,也不能代表所有人,但它把这次升级的真问题提前暴露出来了,模型选择已经和额度管理绑在一起。


所以第一周别急着用最重要的项目做赌注。找一件你熟悉、结果好坏也看得出来的任务,用Terra跑一遍,再用Sol跑一遍。比较三件事就行,少改了几轮,花了多久,额度掉了多少。这个答案比任何跑分都更像你的答案。


GPT-Live:OpenAI的新一代语音,能边听边说

今天还同期上线了新的GPT-Live,分GPT-Live-1和GPT-Live-1 mini两个版本。它成了消费者版ChatGPT Voice的新默认语音,原来的Advanced Voice仍保留给需要视频和屏幕共享的人。


更新移动端就能使用。

最大的更新是全双工。旧的高级语音是轮替式,你说完,它再说,一来一回。GPT-Live能同时听和说,你讲话时它会用简短回应表示在听,你也能随时打断它,不用等它把一长段讲完。对话更接近真人打电话。OpenAI在5到10分钟的配对对话评测中称,GPT-Live-1和mini都被明显更偏好,但没有公开75.7%这个数字。


另一件事是后台委派。你问到要联网搜、要深推理的难题,GPT-Live不会卡在那儿干想,而是把这部分活交给后台模型处理,自己留在对话里继续跟你聊。首发后台用的是GPT-5.5,之后会跟着前沿模型一起迭代。它和GPT5.6同一周出现,但底层不是同一个模型——一个管语音对话,一个管复杂任务。


代价也有。这次GPT-Live砍掉了视频和屏幕共享,原来高级语音能看你的画面,现在不行。Business、Enterprise和Edu工作区首发也没有,目前只推消费者版的网页、iOS和Android。你要让它看屏幕,眼下还得退回Advanced Voice。


对做内容、会后整理、练外语的人,这个更新最直接。你不用先把脑子里一团乱线头整理成一段完美问题,边说边改就行。


这次真正变大的,是ChatGPT开始接整段工作

7月9日,OpenAI把Work和Codex收进了新的桌面应用。

Work接住长任务和成品,Codex处理代码和本地项目。以前切入口时要重复交代背景。现在可以在一个桌面工作台里继续往下做。


模型菜单也终于把三个维度拆开了。选Sol、Terra、Luna是在选模型,推理强度是在决定让它想多久,速度是在决定你愿不愿意多等一会儿,快速是消耗x1.5倍。不过要注意,最贵的组合,不一定最适合你手里的活。


限额重置能看过期时间了

GPT5.6上线后,使用量页面里多了一个很实用的细节。这次能看到失效日期了,灰常的贴心。


再然后,还有个重要信息。Tibo在已验证的公开帖里说,为庆祝GPT5.6 Sol上线,ChatGPT Work和Codex会在接下来24小时内再次进行两次速率限制重置。


Chrome里的Codex插件也更新了

你在Chrome里打开网页时,点击插件后,左侧现在可以出现Codex任务栏。你可以在正在看的页面旁边发起任务,让它复现网页问题、核对表单流程,或者帮你定位前端哪里出了错。很像Gemini的那个。


这波更新,老金我的感受

GPT5.6当然更强,GPT-Live更会听,ChatGPT也开始把聊天、做事、写代码和浏览网页往一条线上收。

但工具越像一个能自己往前跑的同事,人越要留在目标、权限和验收的位置。

别把最强模型当成答案,它越来越考验你对事情的理解程度,更考验你清楚应该对什么模型分发什么事情。

先把你最烦的那一步交出去,再看它替你省下了什么。


相关文章
|
2月前
|
人工智能 缓存 JSON
刚刚 GPT-5.6 发布,吊打 Claude 5 和 Grok 4.5?一手实测来啦!
GPT-5.6 刚发布,跑分号称超越 Fable 5,真的假的?附一手实测,让 3 个最强 AI 编程模型 GPT-5.6 Sol、Claude Fable 5、Grok 4.5 在 Cursor 里同时一把梭开发网页游戏,看看最新模型到底谁更能打。
766 0
|
2月前
|
人工智能 API 数据库
Kimi深夜突袭K3,2.8万亿参数超大水桶!直接跨入世界第一梯队!
老金我昨儿在网上瞎逛的时候,突然看到了Kimi K3的消息。 合计先打开官网看看开发者文档有没有啥信儿,结果刚打开官网,好家伙。。就看到已经上线了! ![Image](https://ucc.alicdn.com/pic/developer-ecology/p3shvhj26rigq_0488c34b2827443e9b77df8ee1e3a066.png) Kimi官网Chat窗口里已
|
开发工具 git
【Cron表达式】基于Vue2及Element的Cron时间表达式生成器
首先感谢两位开源作者的奉献(ldang264),(1615450788)以下代码功能项,全部基于这两个开源库所做的合集。并增加了部分功能项,删减了中英切换等
【Cron表达式】基于Vue2及Element的Cron时间表达式生成器
|
6月前
|
运维 监控 Cloud Native
巨人网络《超自然行动组》携手阿里云打造云原生游戏新范式
通过 ACK(容器服务)、ESS(弹性伸缩)、网络型负载均衡 NLB、OpenKruiseGame(OKG)、SLS(日志服务)、ARMS(应用实时监控服务)、阿里云原生防护(Native Protection),以及云原生数据库 polardb 和 Redis 的深度协同,巨人网络构建了一套高弹性、高可用、低成本、智能化、高安全且高性能数据处理能力的新一代游戏基础设施,为行业树立了云原生落地的标杆。如今,随着日活跃用户(DAU)突破千万大关,这套技术体系,已经成为游戏行业“云原生转型”的标杆案例。
950 50
|
3月前
|
Linux 程序员 数据格式
【2026最新】Notepad++下载、安装和使用一篇搞定(附中文版安装包)
Notepad++ 是一款免费开源、轻量高效的 Windows 文本编辑器,支持 C/Python/HTML 等 80+ 语言语法高亮、代码折叠、正则替换、编码转换及插件扩展,专为程序员与文本处理用户打造,完美替代系统记事本。(239字)
34546 9
|
2月前
|
SQL 监控 Serverless
阿里云国际版:函数计算FC超时怎么办?依赖、内存与日志排查指南
函数计算FC超时的本质,是函数在用户设定的最大执行时间内没能返回结果。这个时间理论上最长可以配到300秒甚至更久,但很多业务场景里,即便把上限拉满,一次冷启动配合模型推理依然会让函数撞线。
252 2
|
6月前
|
人工智能 数据挖掘 语音技术
智眸:基于 Rokid Glasses的房产经纪人带看辅助应用
智眸是贝壳找房为房产经纪人打造的AI眼镜应用,基于Rokid Glasses实现“镜在眼前,智慧搭伴”。通过双端协同,实时投送小区信息、智能提词、全场拾音录制,解放双手、提升专业形象与带看效率,助力经纪人专注服务、沉淀数据。
616 1
|
7月前
|
人工智能 运维 前端开发
GLM-5深夜官宣:Pony Alpha身份揭晓,编程能力逼近Claude Opus
刚发完DeepSeek V4,智谱又来搞事情。 今天是老金我写的 第三篇文章,手都快敲断了。 但这个消息不写不行——GLM-5 正式(偷摸地)发布了。 2月11日深夜,智谱AI官宣新一代旗舰大模型GLM-5。 之前在OpenRouter上神秘出现的"Pony Alpha",身份终于揭晓。 据DoNews报道:Pony Alpha就是GLM-5的低调测试版。 ![Image](https://u
882 25
|
人工智能 自然语言处理 安全
大模型备案材料—《安全评估报告》撰写指南
本文详解大模型备案中的关键材料——《安全评估报告》的撰写要点,涵盖报告框架、必备内容、注意事项及基础信息,助你高效通过备案。
|
安全 BI API
WhatsApp的名词都是什么意思?从个人账号到商业平台全解析
WhatsApp、WhatsApp Business API、WhatsApp Business 、Meta 蓝标、这些分别都是什么意思,有哪些区别?
3211 0