Luna降价80%,老金教你20美元Plus当100美元Pro用

简介: ![Image](https://ucc.alicdn.com/pic/developer-ecology/p3shvhj26rigq_cfb66ec429e24ad3b3040b2007a76397.png)先说结论。如果你正在用20美元的Codex Plus,这次先别急着掏100美元升级Pro。你账户里已经有的GPT-5.6 Luna,刚刚降价80%。把它的Max推理打开,再让Sol

Image

先说结论。如果你正在用20美元的Codex Plus,这次先别急着掏100美元升级Pro。

你账户里已经有的GPT-5.6 Luna,刚刚降价80%。把它的Max推理打开,再让Sol只负责那些必须动脑、必须拍板的部分,20美元的使用体验,真的会往100美元那一档靠。

我不是说Luna突然把Sol干掉了。真这么用,十有八九要返工。我把官方价格、公开跑分和社区里的正反实测放到一起,最后只留下一个有点儿慢、但特别省钱的分法:

Sol想清楚,Luna干重活。先把这事为什么省钱讲明白,后面我直接给你一段能复制的提示词。

Luna便宜80%以后,Plus最浪费的用法就是还让Sol包办一切

8月1日,Codex负责人Tibo做了一件很疯的事。他重置了Codex和ChatGPT Work的使用额度,还让大家周末去跑10万个Luna任务。

Image

10万个任务当然有点夸张。Tibo真正想说的是,OpenAI把Luna的API价格砍掉了80%,在Codex订阅里跑Luna,额度也能省下一大截。

这时候还让Sol从读资料、搜代码一路干到写测试,很多额度其实都花在了重复执行上。Sol当然干得了,只是每一步都用它,太贵。

先去把Luna的Max打开。Codex默认不会把所有推理强度都摆在模型选择器里,你要进入设置 → 配置 → 模型功能,在可用推理强度里勾选Max。想在模型选择器里看到Ultra,再打开下面的Ultra开关。

Image

打开以后也别见任务就上Max。查一段代码、整理资料,用High或X High就够了。只有任务已经说清楚,又需要它长时间读文件、改代码、跑测试时,Max才划算。

Dan McAteer给了个更直观的实测结论:Luna Max大约能到Sol Medium或Opus 5 Medium的水平,成本只有六分之一。

Image

先别急着把这句话理解成Luna已经能替代所有贵模型。Artificial Analysis的Coding Agent Index里,Luna Max大约75分,确实已经贴近Sol Medium。图里对比的Claude是Opus 4.8 Medium,不是Opus 5,注意别看错了。

Image

社区实测也没有一边倒。Evan Reiser跑了大约10个并行任务,Luna Max成功率约70%,成本低约70%。Sol完成同类任务更快,耗时和轮次大约少一半。

Image

我反而觉得这组结果最有用。

Luna不是拿来赌最难的那一题,它适合接住那些已经讲清楚、做错了也能靠测试发现的活。

老金现在只让Sol做判断,剩下的尽量交给Luna

比如你让Codex给一个老项目加新功能。以前最省事的做法,是把整件事扔给Sol,然后等它从头干到尾。确实稳,但额度也下得快。

我现在会先让Sol把项目读明白。它只需要告诉我:真正要改哪几块,哪些工作互不影响,最后跑什么测试才算完成。

路铺好以后,Luna再进场。一个Luna去查相关代码和文档,一个Luna改边界清楚的文件,另一个Luna补测试。它们各做各的,不抢同一批文件。最后还是Sol回来读改动、跑测试、收口。

社区里也有人这样用。TheHBrand把Luna放在编码、测试和小任务执行的位置,让Sol负责架构、规划和代码审查。Sol发现问题,再把已经说清楚的修改丢回给Luna。这套用法跟我现在的分工很接近。

Image

这样分工,Luna做错也不可怕。

测试没过,主任务能马上看到。连续两轮还修不好,就别再跟便宜模型死磕,直接把问题收回给Sol。

哪些活可以先给Luna?搜代码、读文档、整理资料、翻译、批量改格式、补测试、跑测试,这些边界清楚的活儿都合适。

那什么还得留给Sol?需求本身没说清、要跨模块找根因、涉及架构取舍,或者前面已经失败过两轮,这些没想清楚、又不能随便试错的烂事儿。发布、付款、删除和生产环境操作也留在主任务,不要交给后台任务自己决定。

说到底,省钱不是每次都选最便宜的模型。省钱是别让最贵的模型一直做便宜的活。

复制这段提示词就能跑

先把主任务切到Sol,再找一个边界清楚、最后能跑测试的小活,把真实任务填进下面这段提示词:

请按下面的模型分工完成任务:
[把你的真实任务写在这里]

当前主任务负责读取需求、拆分工作、划分文件所有权,并写清最后怎样验证。
把边界清楚、可以并行的执行工作创建为独立后台任务,优先指定 gpt-5.6-luna,推理强度默认使用 xhigh,确实需要长时间读文件、改代码和跑测试时再使用 max。
最多同时创建3个后台任务,每个任务负责不同的文件或主题,不要互相覆盖。
后台任务完成后,由主任务检查改动并运行测试。
如果Luna连续两次没解决同一个问题,把它收回给Sol处理。
发布、发送、付款、删除、账户和生产环境操作不要交给后台任务。
如果当前环境不能创建可指定模型与推理强度的后台任务,直接说明限制,不要假装已经创建。

提交以后,先看它有没有真的创建后台任务,每个任务负责什么、用了哪个模型。最后别只看它说完成了,要让主任务检查文件、跑测试。测试真的通过,这次分工才算省到了钱。

同类任务做多了,再把Luna固化成全局代理

这段提示词解决的是眼前这一次。要是你已经拿它跑过几个真实任务,发现每次都在做同类的拆分、验证和汇报,就别再把整段提示词复制来复制去了。真正值得保存的,是已经跑顺的工作边界。

Codex现在支持把个人级自定义代理单独放在~/.codex/agents/里。文件名可以叫luna-worker.toml,但真正的调用名以name字段为准。我的建议是,先把Luna定义成一个只接边界清楚任务的执行位,别把它写成什么都能干的万能Agent:

name = "luna_worker"
description = "Fast worker for clear, narrowly scoped, and repeatable tasks."
model = "gpt-5.6-luna"
model_reasoning_effort = "xhigh"

developer_instructions = """
Work only within the assigned task scope.
Do not modify unrelated files or take external, destructive, financial, account, or production actions.
Work independently, verify the result when practical, and report changed files and verification.
If the task boundary or acceptance criteria are unclear, stop and report the missing information.
"""

写入之前,先读同名文件,别上来就覆盖。写入以后,新开或刷新一次Codex会话,再拿一个最小任务试跑。文件存在只是第一步,主任务真的能叫到它、它有没有按边界工作,才算配置完成。

调用时直接说:

请使用 luna_worker 子代理完成以下任务:[填写任务]。
等待它完成后,检查文件改动并运行对应测试,再汇总结果。

如果只是查代码、整理资料和补测试,没必要把所有任务都固定在Max。只有长时间读文件、改代码和跑测试时,才把model_reasoning_effort改成max。这样配,Luna负责执行,Sol负责判断,省下来的才是额度,而不是把便宜模型也用成贵模型。

等提示词和自定义代理都跑顺以后,再把它和实际踩过的坑交给我开源的Meta Skill Creator,做成自己的可复用Skill。

Meta Skill Creator会先问清谁来用、最后交什么、怎样才算真的能用,再决定哪些内容放进SKILL.md,哪些变成资料、脚本和测试。下次再遇到同类任务,直接调用Skill就行,不用重新复制一整段提示词。

这一步别搞反了。先用提示词跑通,再做Skill。否则你只是把一段还没验证过的提示词永久保存了下来。

在GitHub搜索KimYx0207/Kim_Service,如图,是这个。进入仓库的skills目录,就能看到meta-skill-creator。

Image

如果你是Plus用户,今晚就做两件事。去设置里把Luna Max打开,再把一个真实任务填进上面的提示词。

下一个复杂任务别一股脑全塞给Sol。先让它把路想清楚,只放一个Luna出去。文件改对了,测试跑绿了,再开第二个。

写到这里,我又回头看了Tibo那句让大家去跑10万个Luna任务。

一开始我只觉得这很疯。后来才意识到,Tibo其实是在提醒所有人:AI开始变便宜了,我们用它的方式也得跟着变。多跑几个任务只是表面,真正的变化是普通人终于敢把工作铺开了。

以前一个想法冒出来,要先算时间、算人手、算额度。算到最后,很多想法根本走不到失败那一步。还没开始,人就先告诉自己算了。太贵、太慢,一个人做不完。

现在Sol可以把混乱理成一条路,Luna沿着这条路去搜代码、改文件、跑测试。一个不够,就再开一个。方向仍然握在你手里,最后那一下判断也还是你的。但那些曾经会把一个人拖垮的重复劳动,终于能被交出去。

这才是Luna降价80%最让我兴奋的地方。

20美元不会凭空变成100美元套餐。可一个只有20美元预算的人,第一次有机会像一支小团队那样工作。人还是那个人,手里却多了一支不会累的小队。他把有限的聪明留给判断,把大量的执行交出去。

再往后,人与人之间会在另一个地方拉开差距。

有人仍在追最贵的模型,等一个更聪明的答案。

有人已经开始安排一群不同价格的智能,把一个原本做不起的想法,慢慢做成真的。

Luna价格降了80%。

跟着降下来的,还有一个普通人把想法变成现实的门槛。


谢谢你读我的文章。
如果觉得不错,随手点个赞、在看、转发三连吧🙂
如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章。

飞书开源知识库(实时更新 交流群):
https://tffyvtlai4.feishu.cn/wiki/OhQ8wqntFihcI1kWVDlcNdpznFf

相关文章
|
2月前
|
Web App开发 人工智能 网络协议
Claude 6月封号潮:145万账号祭天,三个充值号没了,给你一份真实自救包
这两天打开朋友圈和几个AI群,满屏都是同一种哀嚎。有人充了200刀的Max,睡一觉起来号没了。有人团队几十个号整组织被封,想申诉只能填一个Google表单。 我看着这些消息,没太惊讶。因为我自己三个Claude充值号,早就没了。 不是这波封的,是很早以前。A社的封号一直就狠,只不过这波又狠了一截,把更多人卷了进来。 说起来挺矛盾,就在我写这篇的时候,A社刚在6月30日发了Sonnet 5,介
|
8天前
|
人工智能 监控 安全
GPT-6发布15小时:Altman道歉赔额度,有人已经把活交给它
从GPT6这个模型怎么样,到案例怎么样,本文一点点的给你嚼碎了告你。
|
网络安全
idea配置远程服务器实现远程编辑文件及ssh连接
idea配置远程服务器实现远程编辑文件及ssh连接
743 0
|
2月前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
4209 145
|
9月前
|
人工智能 Rust 运维
这个神器让你白嫖ClaudeOpus 4.5,Gemini 3!还能接Claude Code等任意平台
加我进AI讨论学习群,公众号右下角“联系方式”文末有老金的 开源知识库地址·全免费
11062 22
|
3月前
|
缓存 人工智能
阿里千问Qwen3.7-Max模型费用价格表及5折费率表(一目了然)
阿里云百炼推出面向智能体的Qwen3.7-Max大模型,现享5折优惠!输入6元/百万tokens、输出18元/百万tokens,并免费赠送100万tokens试用额度。该模型在Arena全球盲测中位列国产第一,性能领先Kimi、DeepSeek等竞品。速至阿里云百炼平台领取优惠券并体验:https://t.aliyun.com/U/fPVHqY
|
1月前
|
存储 弹性计算 测试技术
阿里云服务器多少钱一年?2026年最新阿里云服务器价格表
云服务器已成为个人开发者、小微企业及大型企业数字化转型的核心基础设施,选择高性价比的云服务器,核心在于清晰掌握不同配置、不同实例类型的年付价格与计费规则。阿里云作为国内云计算服务的主流提供商,其云服务器产品线覆盖轻量应用服务器、ECS弹性计算服务等,从几十元的入门款到数万元的企业级高配实例,价格体系清晰且适配不同业务场景。本文将全面梳理阿里云服务器最新价格,拆解各实例配置、计费模式的年付成本,同时附上实用的服务器管理命令,帮助用户精准选型、合理控成本。
220 1
|
7月前
|
存储 人工智能 开发工具
Claude Code自动记忆来了!配合老金三层记忆系统全开源!加强Plus!
昨天晚上,老金我照例打开 Claude Code 准备写代码。 随便聊了几句项目架构,Claude突然冒出一句: "Based on our previous discussions, this project uses pnpm and TypeScript strict mode." 老金我愣了一下。 上次提到pnpm是三天前的事了,这中间重启了好几次。 打开 ~/.claude/p
|
2月前
|
Web App开发 数据采集 人工智能