这期的「周一上线」,一边是模型继续往更长上下文、更小体积和本地 Agent 方向推进,一边是 AI 编程工具背后的训练、资本和公司整合也越来越热闹。
Liquid AI 发布了可以完全跑在端侧的 LFM2.5-2.6B,Pokee-Isaac 把上下文拉到 1000 万 Token;Qwen3.8-Max 主攻 Coding 和 Cowork,Cursor 则把训练 Composer 用的 MoE Megakernel 开源了。OpenAI 这边也继续扩大 GPT-5.6 的使用范围,Free 和 Go 用户将获得不限量文本聊天。
另一边,OpenAI 和 Apple 围绕商业机密诉讼公开交锋;SpaceX 对 Cursor 的 600 亿美元收购据报已接近交割,连 Cursor 这个品牌名都可能逐步淡出。
下面,开始一周回顾。
有点新鲜
「有点新鲜」收录本周 AI / 开发者圈里那些不算大新闻,但挺值得看一眼的新鲜事。
桌面党,又有东西可以买了
@bitejoi 给 mac mini 装配了外置显示器,你看它像不像是个小台灯:

Jeff Dean 的程序员传说合集
这就是 Jeff Dean 的传说,密码是圆周率的后四位、简历为了简洁,只罗列自己没做过的事情…

梁氏滑动变祖器

按照作者自己的说法:“梁神啊梁神,再涨价可就要变梁子了。”
防作弊神器
OpenAI 的 Jason Liu 本周也晒了一个新玩具,有人表示现在面试要证明自己没有偷偷开着 AI 作弊的话,可以整一个这个:

我和 Claude 一起工作的真实写照
我和 Claude 的分工非常合理,各有各的忙碌:

神仙打架,Codex 用户喜提额度重置
一名用户按照 OpenAI Tibo 的方法在 Claude Code 里通过代理运行其他模型后遭遇封号,Tibo 表示不在 Anthropic 上班。随后 Anthropic 的 Boris Cherny 回应称这种用法本身受到支持,并半开玩笑向 Tibo 发出加入 A 家的邀请:

周五发版
「周五发版」是一个程序梗:一旦版本上线,我们就要开始祈祷一切如期运行。这个模块寓意,所有模型、产品版本更新,都能大吉大利。
LFM2.5-2.6B:把 Agent 塞进本地设备
Liquid AI 发布 LFM2.5-2.6B,一个专门面向 Agent 工作负载训练的 2.6B 参数模型。

模型可以完全运行在本地设备上,在手机、笔记本和 PC 上完成规划、工具调用和多步骤任务,无需经过云端 API。它支持 128K 上下文,运行时内存占用不到 2.5GB;Liquid AI 测得其在 M5 Max 上的 CPU 解码速度达到 220 Token/s,在手机上也能达到约 30 Token/s。
模型已经开放权重,并支持 llama.cpp、MLX、vLLM、SGLang 和 ONNX,也可以直接接入 Hermes Agent、OpenClaw、Pi 等 Agent Harness。
FFmpeg 9.0:继续补硬件加速
开源音视频工具 FFmpeg 9.0 正式发布。

这一版继续增加 Vulkan 和硬件加速能力,包括 APV Vulkan 解码、Apple ProRes RAW Vulkan 加速和 v360 Vulkan Filter,同时加入 Animated WebP 解码与 Demux、CUDA transpose Filter,以及更多 AMD AMF 和 AVX-512 优化。
此外,新版本还加入 HE-AAC 960 解码、ONNX Runtime DNN GPU Provider 等能力。
Pokee-Isaac 28B:1000 万 Token 上下文塞进一张 GPU
Pokee AI 发布 Pokee-Isaac 28B,把一个很夸张的数字摆到了台面上:1000 万 Token 上下文。

Pokee 将它定位为面向长时间 Agent 任务的模型,可以持续进行规划、执行和检查。官方数据显示,模型拥有 28B 参数,最大上下文为 10M Token,并可以部署在单张 RTX 4090 上。
Pokee 公布的内部受控测试中,Isaac 在 10M 上下文的 RULER 得分为 93.3;这些性能数据目前主要来自 Pokee 自身评测。
Mixture-of-Kittens:Cursor 把 MoE 训练内核开源了
Cursor 开源 Mixture-of-Kittens(MoK),一个专门为 NVIDIA NVL72 设计的 MoE 训练 Megakernel。

Cursor 在训练自己的 Coding Agent 模型 Composer 时发现,MoE 层已经成为主要瓶颈,在部分配置下甚至占到一半以上的训练时间。MoK 的做法是把 MoE 中的通信与计算融合进一个确定性的 Kernel,尽量减少 GPU 等待通信和 CPU 同步的时间。
Cursor 表示,在 GB300 NVL72 上,MoK 的 MXFP8 Forward Throughput 最高达到公开基线的 2.37 倍;放进实际生产训练栈后,端到端 Token 吞吐提升到原来的 1.41 倍。目前 MoK 已用于数万张 GPU 上的 Composer 训练。
Qwen3.8-Max:2.4T 参数,继续主攻 Coding 和 Cowork
Qwen 发布 Qwen3.8-Max,官方将这一代的重点直接放在 Coding 和 Cowork 上。

模型总参数达到 2.4T,每次激活约 95B 参数,并在代码、日常工作、Research 和长任务等方向进行了整体升级。Qwen 还在 QwenWork、Claude Code、Codex、OpenClaw 和 Hermes 等不同 Harness 中测试了它的 Agent 能力。
官方同时预告 Qwen3.8-Max 将开放模型权重。
ChatGPT:免费用户文本聊天将不限量
OpenAI 更新了 ChatGPT 中的 GPT-5.6 系列。

Free 和 Go 用户的默认模型将切换到 GPT-5.6 Luna,同时开放不限量文本聊天和新的 Think 按钮;文件上传、图片以及其他工具仍然保留使用限制。
Plus 和 Pro 用户则获得更新后的 GPT-5.6 Sol。新版本重点改善事实可靠性和回答聚焦度,还增加了一个“思考强度”滑杆,可以自己决定回答要思考到什么程度。此次更新只针对 ChatGPT 对话体验,Work 和 Codex 中使用的 GPT-5.6 Sol 暂不变化。
开源雷达
周榜速递
周榜主要根据新增 Star 数进行排名,下面的单项目讲解则偏向新晋项目、实用老项目,标星并非单项目讲解的唯一指标。

i-have-adhd:让 Coding Agent 先说重点
i-have-adhd 是一个专门调整 Coding Agent 输出方式的 Skill。

它做的事情很简单:让 Agent 别再把真正的答案埋在一大段铺垫里。安装后,回答会优先给出下一步行动,多步骤任务用编号拆开,并在结尾留下一个明确的下一步。
项目一共设计了 10 条输出规则,包括减少跑题、限制列表长度、明确当前进度,以及错误发生时直接说明位置、原因和修复方式。除了 Claude Code,它也提供 Codex、Gemini、Cursor、OpenCode、Hermes、Pi 等工具的接入方式。
Kage:用 Three.js 做一场京都山寺夜游
Kage 是一个基于 Three.js 制作的交互式网页实验,把一场虚构的京都山寺夜游拆成五个章节。

当用户向下滚动页面时,WebGL 摄像机会跟着穿过山寺场景。整个页面加入了鸟居、灯笼、雾、雨、飘落的树叶和朱红色月亮等动态元素,再配合章节切换、模糊和渐隐效果完成叙事。
项目主体只有一个静态 HTML 页面,不需要构建流程;其中部分场景图和前景素材由 GPT Image 2 生成,再与实时 Three.js 场景组合。对于想研究网页 3D、滚动叙事和生成式视觉如何结合的人来说,它是个很完整的 Demo。
Sol Advisor:给 Coding Agent 加一层架构师编排
Sol Advisor 是一个面向 Agent Plugins v1 客户端的架构优先型编排插件。
它会把需求确认、架构设计、任务拆解、Diff 检查、验证和最终验收留在主对话中,再把具体实现和 Advisor 工作分配给不同 Agent 角色。不同角色可以分别指定模型和推理强度,主编排器则继承当前会话所选择的模型。
项目还提供 MCP Server 和客户端适配层,目前包含 Codex 与 Cursor 的配置方式,并在安装和生成客户端文件前提供 Preview 和确认流程。
diagram-design:让 Claude Code 画出能直接用的图
diagram-design 是一个专门生成编辑级图表的 Claude Code Skill,同时也提供 Codex 的安装方式。

项目内置 27 种图表类型,包括架构图、流程图、时序图、状态机、ER 图、时间线、泳道图、象限图、组织架构、漏斗和数据流等,每种又提供浅色、深色和完整 Editorial 三套样式。
它还有一个很实用的能力:可以读取你的网站,提取配色和字体,然后把品牌视觉应用到之后生成的所有图里。输出结果是独立 HTML,SVG 和 CSS 都内联其中,不需要构建,也可以继续导出成 SVG 或 PNG。
这周有事
「这周有事」收录本周值得记一下的行业动态、事故、融资、人员流动和基础设施变化。
OpenAI 和 Apple 的商业机密诉讼公开开打
OpenAI 本周直接发了一篇题为 《Apple is getting this wrong》 的文章,公开回应 Apple 提起的商业机密诉讼。
Apple 指控前员工 Chang Liu、Tang Tan 等人在加入 OpenAI 后涉及 Apple 机密信息,并申请初步禁令,希望限制 OpenAI 基于相关技术继续推进 AI 硬件。OpenAI 对此否认,并公开了部分短信和邮件记录,称其中一些访问来自 Apple 自身离职权限未及时关闭,而且 Apple 律师早期还曾因混淆姓氏联系错人。
8 月 6 日,OpenAI 已提交驳回诉讼的动议。目前双方对核心事实仍各执一词,案件还没有最终结论。
Airtable 12.85 亿美元卖给 Bending Spoons
Bending Spoons 宣布以 12.85 亿美元企业价值全现金收购 Airtable;算上 Airtable 手中的净现金,这笔交易对应的股权价值约为 22.5 亿美元。
Airtable 在 2021 年的估值曾达到 117 亿美元,如今对应股权价值较峰值缩水约八成。它目前的年度经常性收入约 4.8 亿美元,同比增长超过 20%,服务超过 50 万家组织。
交易预计今年晚些时候完成。Airtable 表示,加入 Bending Spoons 后将继续推进自己的 AI-native 平台。
Cursor 品牌可能要消失了
SpaceX 早在 6 月已经同意以 600 亿美元全股票交易收购 Cursor 母公司 Anysphere,交易原计划在第三季度完成。
本周 The Information 的最新报道称,Cursor 已在内部 All-hands 上告知员工,这笔收购最快可能在下周完成。与此同时,Cursor 团队预计会被进一步整合进 SpaceXAI,Cursor 这个品牌名也可能逐步淡出。
目前品牌调整仍属于媒体基于内部消息的报道,最终安排还需要等待公司正式公布。
Spotify 推荐系统原班人马做电商,融资 1000 万美元
三名前 Spotify 员工 Sidd Motwani、Ian Anderson 和 Shivaditya Sinha 创办了 AI 电商公司 Malachyte,并完成 1000 万美元种子轮融资。
三人此前参与构建 Spotify 的 Vector AI 推荐基础设施。现在 Malachyte 想把类似思路搬到电商:根据用户当前的点击、搜索、滚动和加购等行为,实时判断购买意图,并动态调整商品推荐,而无需等到积累大量历史购买记录。
本轮融资由 Bessemer Venture Partners 和 Gradient 联合领投。
SpaceX 今年已经买了 3.29 亿美元 Tesla Megapack
SpaceX 今年明显加大了对 Tesla 大型储能电池 Megapack 的采购。
根据公司披露的数据,仅第二季度采购额就达到 2.95 亿美元,今年累计达到 3.29 亿美元。
TechCrunch 推测,这些 Megapack 很可能会用于 SpaceX 旗下 xAI 的数据中心。AI 数据中心的 GPU 负载会频繁波动,大型电池既可以提供备用电力,也可以在功耗突然升高时补充供电、削平用电峰值。