Luna降价80%,老金教你20美元Plus当100美元Pro用

简介: ![Image](https://ucc.alicdn.com/pic/developer-ecology/p3shvhj26rigq_cfb66ec429e24ad3b3040b2007a76397.png)先说结论。如果你正在用20美元的Codex Plus,这次先别急着掏100美元升级Pro。你账户里已经有的GPT-5.6 Luna,刚刚降价80%。把它的Max推理打开,再让Sol

Image

先说结论。如果你正在用20美元的Codex Plus,这次先别急着掏100美元升级Pro。

你账户里已经有的GPT-5.6 Luna,刚刚降价80%。把它的Max推理打开,再让Sol只负责那些必须动脑、必须拍板的部分,20美元的使用体验,真的会往100美元那一档靠。

我不是说Luna突然把Sol干掉了。真这么用,十有八九要返工。我把官方价格、公开跑分和社区里的正反实测放到一起,最后只留下一个有点儿慢、但特别省钱的分法:

Sol想清楚,Luna干重活。先把这事为什么省钱讲明白,后面我直接给你一段能复制的提示词。

Luna便宜80%以后,Plus最浪费的用法就是还让Sol包办一切

8月1日,Codex负责人Tibo做了一件很疯的事。他重置了Codex和ChatGPT Work的使用额度,还让大家周末去跑10万个Luna任务。

Image

10万个任务当然有点夸张。Tibo真正想说的是,OpenAI把Luna的API价格砍掉了80%,在Codex订阅里跑Luna,额度也能省下一大截。

这时候还让Sol从读资料、搜代码一路干到写测试,很多额度其实都花在了重复执行上。Sol当然干得了,只是每一步都用它,太贵。

先去把Luna的Max打开。Codex默认不会把所有推理强度都摆在模型选择器里,你要进入设置 → 配置 → 模型功能,在可用推理强度里勾选Max。想在模型选择器里看到Ultra,再打开下面的Ultra开关。

Image

打开以后也别见任务就上Max。查一段代码、整理资料,用High或X High就够了。只有任务已经说清楚,又需要它长时间读文件、改代码、跑测试时,Max才划算。

Dan McAteer给了个更直观的实测结论:Luna Max大约能到Sol Medium或Opus 5 Medium的水平,成本只有六分之一。

Image

先别急着把这句话理解成Luna已经能替代所有贵模型。Artificial Analysis的Coding Agent Index里,Luna Max大约75分,确实已经贴近Sol Medium。图里对比的Claude是Opus 4.8 Medium,不是Opus 5,注意别看错了。

Image

社区实测也没有一边倒。Evan Reiser跑了大约10个并行任务,Luna Max成功率约70%,成本低约70%。Sol完成同类任务更快,耗时和轮次大约少一半。

Image

我反而觉得这组结果最有用。

Luna不是拿来赌最难的那一题,它适合接住那些已经讲清楚、做错了也能靠测试发现的活。

老金现在只让Sol做判断,剩下的尽量交给Luna

比如你让Codex给一个老项目加新功能。以前最省事的做法,是把整件事扔给Sol,然后等它从头干到尾。确实稳,但额度也下得快。

我现在会先让Sol把项目读明白。它只需要告诉我:真正要改哪几块,哪些工作互不影响,最后跑什么测试才算完成。

路铺好以后,Luna再进场。一个Luna去查相关代码和文档,一个Luna改边界清楚的文件,另一个Luna补测试。它们各做各的,不抢同一批文件。最后还是Sol回来读改动、跑测试、收口。

社区里也有人这样用。TheHBrand把Luna放在编码、测试和小任务执行的位置,让Sol负责架构、规划和代码审查。Sol发现问题,再把已经说清楚的修改丢回给Luna。这套用法跟我现在的分工很接近。

Image

这样分工,Luna做错也不可怕。

测试没过,主任务能马上看到。连续两轮还修不好,就别再跟便宜模型死磕,直接把问题收回给Sol。

哪些活可以先给Luna?搜代码、读文档、整理资料、翻译、批量改格式、补测试、跑测试,这些边界清楚的活儿都合适。

那什么还得留给Sol?需求本身没说清、要跨模块找根因、涉及架构取舍,或者前面已经失败过两轮,这些没想清楚、又不能随便试错的烂事儿。发布、付款、删除和生产环境操作也留在主任务,不要交给后台任务自己决定。

说到底,省钱不是每次都选最便宜的模型。省钱是别让最贵的模型一直做便宜的活。

复制这段提示词就能跑

先把主任务切到Sol,再找一个边界清楚、最后能跑测试的小活,把真实任务填进下面这段提示词:

请按下面的模型分工完成任务:
[把你的真实任务写在这里]

当前主任务负责读取需求、拆分工作、划分文件所有权,并写清最后怎样验证。
把边界清楚、可以并行的执行工作创建为独立后台任务,优先指定 gpt-5.6-luna,推理强度默认使用 xhigh,确实需要长时间读文件、改代码和跑测试时再使用 max。
最多同时创建3个后台任务,每个任务负责不同的文件或主题,不要互相覆盖。
后台任务完成后,由主任务检查改动并运行测试。
如果Luna连续两次没解决同一个问题,把它收回给Sol处理。
发布、发送、付款、删除、账户和生产环境操作不要交给后台任务。
如果当前环境不能创建可指定模型与推理强度的后台任务,直接说明限制,不要假装已经创建。

提交以后,先看它有没有真的创建后台任务,每个任务负责什么、用了哪个模型。最后别只看它说完成了,要让主任务检查文件、跑测试。测试真的通过,这次分工才算省到了钱。

同类任务做多了,再把Luna固化成全局代理

这段提示词解决的是眼前这一次。要是你已经拿它跑过几个真实任务,发现每次都在做同类的拆分、验证和汇报,就别再把整段提示词复制来复制去了。真正值得保存的,是已经跑顺的工作边界。

Codex现在支持把个人级自定义代理单独放在~/.codex/agents/里。文件名可以叫luna-worker.toml,但真正的调用名以name字段为准。我的建议是,先把Luna定义成一个只接边界清楚任务的执行位,别把它写成什么都能干的万能Agent:

name = "luna_worker"
description = "Fast worker for clear, narrowly scoped, and repeatable tasks."
model = "gpt-5.6-luna"
model_reasoning_effort = "xhigh"

developer_instructions = """
Work only within the assigned task scope.
Do not modify unrelated files or take external, destructive, financial, account, or production actions.
Work independently, verify the result when practical, and report changed files and verification.
If the task boundary or acceptance criteria are unclear, stop and report the missing information.
"""

写入之前,先读同名文件,别上来就覆盖。写入以后,新开或刷新一次Codex会话,再拿一个最小任务试跑。文件存在只是第一步,主任务真的能叫到它、它有没有按边界工作,才算配置完成。

调用时直接说:

请使用 luna_worker 子代理完成以下任务:[填写任务]。
等待它完成后,检查文件改动并运行对应测试,再汇总结果。

如果只是查代码、整理资料和补测试,没必要把所有任务都固定在Max。只有长时间读文件、改代码和跑测试时,才把model_reasoning_effort改成max。这样配,Luna负责执行,Sol负责判断,省下来的才是额度,而不是把便宜模型也用成贵模型。

等提示词和自定义代理都跑顺以后,再把它和实际踩过的坑交给我开源的Meta Skill Creator,做成自己的可复用Skill。

Meta Skill Creator会先问清谁来用、最后交什么、怎样才算真的能用,再决定哪些内容放进SKILL.md,哪些变成资料、脚本和测试。下次再遇到同类任务,直接调用Skill就行,不用重新复制一整段提示词。

这一步别搞反了。先用提示词跑通,再做Skill。否则你只是把一段还没验证过的提示词永久保存了下来。

在GitHub搜索KimYx0207/Kim_Service,如图,是这个。进入仓库的skills目录,就能看到meta-skill-creator。

Image

如果你是Plus用户,今晚就做两件事。去设置里把Luna Max打开,再把一个真实任务填进上面的提示词。

下一个复杂任务别一股脑全塞给Sol。先让它把路想清楚,只放一个Luna出去。文件改对了,测试跑绿了,再开第二个。

写到这里,我又回头看了Tibo那句让大家去跑10万个Luna任务。

一开始我只觉得这很疯。后来才意识到,Tibo其实是在提醒所有人:AI开始变便宜了,我们用它的方式也得跟着变。多跑几个任务只是表面,真正的变化是普通人终于敢把工作铺开了。

以前一个想法冒出来,要先算时间、算人手、算额度。算到最后,很多想法根本走不到失败那一步。还没开始,人就先告诉自己算了。太贵、太慢,一个人做不完。

现在Sol可以把混乱理成一条路,Luna沿着这条路去搜代码、改文件、跑测试。一个不够,就再开一个。方向仍然握在你手里,最后那一下判断也还是你的。但那些曾经会把一个人拖垮的重复劳动,终于能被交出去。

这才是Luna降价80%最让我兴奋的地方。

20美元不会凭空变成100美元套餐。可一个只有20美元预算的人,第一次有机会像一支小团队那样工作。人还是那个人,手里却多了一支不会累的小队。他把有限的聪明留给判断,把大量的执行交出去。

再往后,人与人之间会在另一个地方拉开差距。

有人仍在追最贵的模型,等一个更聪明的答案。

有人已经开始安排一群不同价格的智能,把一个原本做不起的想法,慢慢做成真的。

Luna价格降了80%。

跟着降下来的,还有一个普通人把想法变成现实的门槛。


谢谢你读我的文章。
如果觉得不错,随手点个赞、在看、转发三连吧🙂
如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章。

飞书开源知识库(实时更新 交流群):
https://tffyvtlai4.feishu.cn/wiki/OhQ8wqntFihcI1kWVDlcNdpznFf

相关文章
|
1月前
|
Web App开发 人工智能 网络协议
Claude 6月封号潮:145万账号祭天,三个充值号没了,给你一份真实自救包
这两天打开朋友圈和几个AI群,满屏都是同一种哀嚎。有人充了200刀的Max,睡一觉起来号没了。有人团队几十个号整组织被封,想申诉只能填一个Google表单。 我看着这些消息,没太惊讶。因为我自己三个Claude充值号,早就没了。 不是这波封的,是很早以前。A社的封号一直就狠,只不过这波又狠了一截,把更多人卷了进来。 说起来挺矛盾,就在我写这篇的时候,A社刚在6月30日发了Sonnet 5,介
|
弹性计算
2024年阿里云免费云服务器及学生云服务器申请教程参考
2024年阿里云继续推出免费学生云服务器与免费试用云服务器,其中学生云服务器最长可免费7个月(1个月首次领用+6个月免费续领),免费试用云服务器分为个人免费云服务器和企业免费云服务器,最长免费试用时长是3个月。下面小编来介绍一下阿里云免费云服务器及学生云服务器的申请教程。
|
1月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
2859 134
|
API 开发者
工作日和节假日api
节假日api核心服务托管在阿里云之上,API天然分布式、高可用。
开发工具 Swift git
1507 2
|
8月前
|
人工智能 Rust 运维
这个神器让你白嫖ClaudeOpus 4.5,Gemini 3!还能接Claude Code等任意平台
加我进AI讨论学习群,公众号右下角“联系方式”文末有老金的 开源知识库地址·全免费
10959 22
|
2月前
|
缓存 人工智能
阿里千问Qwen3.7-Max模型费用价格表及5折费率表(一目了然)
阿里云百炼推出面向智能体的Qwen3.7-Max大模型,现享5折优惠!输入6元/百万tokens、输出18元/百万tokens,并免费赠送100万tokens试用额度。该模型在Arena全球盲测中位列国产第一,性能领先Kimi、DeepSeek等竞品。速至阿里云百炼平台领取优惠券并体验:https://t.aliyun.com/U/fPVHqY
人工智能 JSON 安全
38 2
|
6月前
|
存储 人工智能 开发工具
Claude Code自动记忆来了!配合老金三层记忆系统全开源!加强Plus!
昨天晚上,老金我照例打开 Claude Code 准备写代码。 随便聊了几句项目架构,Claude突然冒出一句: "Based on our previous discussions, this project uses pnpm and TypeScript strict mode." 老金我愣了一下。 上次提到pnpm是三天前的事了,这中间重启了好几次。 打开 ~/.claude/p

热门文章

最新文章