ChatGPT 免费文本聊天将不限量,1000 万上下文来了,Cursor 品牌可能要消失

简介: 本期「周一上线」聚焦AI工程化新动向:端侧轻量Agent(LFM2.5)、千万级超长上下文(Pokee-Isaac)、2.4万亿参数Coding旗舰(Qwen3.8-Max)密集发布;Cursor开源MoE训练内核,OpenAI向免费用户开放GPT-5.6不限量文本聊天。

这期的「周一上线」,一边是模型继续往更长上下文、更小体积和本地 Agent 方向推进,一边是 AI 编程工具背后的训练、资本和公司整合也越来越热闹。

Liquid AI 发布了可以完全跑在端侧的 LFM2.5-2.6B,Pokee-Isaac 把上下文拉到 1000 万 Token;Qwen3.8-Max 主攻 Coding 和 Cowork,Cursor 则把训练 Composer 用的 MoE Megakernel 开源了。OpenAI 这边也继续扩大 GPT-5.6 的使用范围,Free 和 Go 用户将获得不限量文本聊天。

另一边,OpenAI 和 Apple 围绕商业机密诉讼公开交锋;SpaceX 对 Cursor 的 600 亿美元收购据报已接近交割,连 Cursor 这个品牌名都可能逐步淡出。

下面,开始一周回顾。

有点新鲜

「有点新鲜」收录本周 AI / 开发者圈里那些不算大新闻,但挺值得看一眼的新鲜事。

桌面党,又有东西可以买了

@bitejoi 给 mac mini 装配了外置显示器,你看它像不像是个小台灯:

Jeff Dean 的程序员传说合集

这就是 Jeff Dean 的传说,密码是圆周率的后四位、简历为了简洁,只罗列自己没做过的事情…

梁氏滑动变祖器

按照作者自己的说法:“梁神啊梁神,再涨价可就要变梁子了。”

防作弊神器

OpenAI 的 Jason Liu 本周也晒了一个新玩具,有人表示现在面试要证明自己没有偷偷开着 AI 作弊的话,可以整一个这个:

我和 Claude 一起工作的真实写照

我和 Claude 的分工非常合理,各有各的忙碌:

神仙打架,Codex 用户喜提额度重置

一名用户按照 OpenAI Tibo 的方法在 Claude Code 里通过代理运行其他模型后遭遇封号,Tibo 表示不在 Anthropic 上班。随后 Anthropic 的 Boris Cherny 回应称这种用法本身受到支持,并半开玩笑向 Tibo 发出加入 A 家的邀请:

周五发版

「周五发版」是一个程序梗:一旦版本上线,我们就要开始祈祷一切如期运行。这个模块寓意,所有模型、产品版本更新,都能大吉大利。

LFM2.5-2.6B:把 Agent 塞进本地设备

Liquid AI 发布 LFM2.5-2.6B,一个专门面向 Agent 工作负载训练的 2.6B 参数模型。

模型可以完全运行在本地设备上,在手机、笔记本和 PC 上完成规划、工具调用和多步骤任务,无需经过云端 API。它支持 128K 上下文,运行时内存占用不到 2.5GB;Liquid AI 测得其在 M5 Max 上的 CPU 解码速度达到 220 Token/s,在手机上也能达到约 30 Token/s。

模型已经开放权重,并支持 llama.cpp、MLX、vLLM、SGLang 和 ONNX,也可以直接接入 Hermes Agent、OpenClaw、Pi 等 Agent Harness。

FFmpeg 9.0:继续补硬件加速

开源音视频工具 FFmpeg 9.0 正式发布。

这一版继续增加 Vulkan 和硬件加速能力,包括 APV Vulkan 解码、Apple ProRes RAW Vulkan 加速和 v360 Vulkan Filter,同时加入 Animated WebP 解码与 Demux、CUDA transpose Filter,以及更多 AMD AMF 和 AVX-512 优化。

此外,新版本还加入 HE-AAC 960 解码、ONNX Runtime DNN GPU Provider 等能力。

Pokee-Isaac 28B:1000 万 Token 上下文塞进一张 GPU

Pokee AI 发布 Pokee-Isaac 28B,把一个很夸张的数字摆到了台面上:1000 万 Token 上下文

Pokee 将它定位为面向长时间 Agent 任务的模型,可以持续进行规划、执行和检查。官方数据显示,模型拥有 28B 参数,最大上下文为 10M Token,并可以部署在单张 RTX 4090 上。

Pokee 公布的内部受控测试中,Isaac 在 10M 上下文的 RULER 得分为 93.3;这些性能数据目前主要来自 Pokee 自身评测。

Mixture-of-Kittens:Cursor 把 MoE 训练内核开源了

Cursor 开源 Mixture-of-Kittens(MoK),一个专门为 NVIDIA NVL72 设计的 MoE 训练 Megakernel。

Cursor 在训练自己的 Coding Agent 模型 Composer 时发现,MoE 层已经成为主要瓶颈,在部分配置下甚至占到一半以上的训练时间。MoK 的做法是把 MoE 中的通信与计算融合进一个确定性的 Kernel,尽量减少 GPU 等待通信和 CPU 同步的时间。

Cursor 表示,在 GB300 NVL72 上,MoK 的 MXFP8 Forward Throughput 最高达到公开基线的 2.37 倍;放进实际生产训练栈后,端到端 Token 吞吐提升到原来的 1.41 倍。目前 MoK 已用于数万张 GPU 上的 Composer 训练。

Qwen3.8-Max:2.4T 参数,继续主攻 Coding 和 Cowork

Qwen 发布 Qwen3.8-Max,官方将这一代的重点直接放在 Coding 和 Cowork 上。

模型总参数达到 2.4T,每次激活约 95B 参数,并在代码、日常工作、Research 和长任务等方向进行了整体升级。Qwen 还在 QwenWork、Claude Code、Codex、OpenClaw 和 Hermes 等不同 Harness 中测试了它的 Agent 能力。

官方同时预告 Qwen3.8-Max 将开放模型权重。

ChatGPT:免费用户文本聊天将不限量

OpenAI 更新了 ChatGPT 中的 GPT-5.6 系列。

Free 和 Go 用户的默认模型将切换到 GPT-5.6 Luna,同时开放不限量文本聊天和新的 Think 按钮;文件上传、图片以及其他工具仍然保留使用限制。

Plus 和 Pro 用户则获得更新后的 GPT-5.6 Sol。新版本重点改善事实可靠性和回答聚焦度,还增加了一个“思考强度”滑杆,可以自己决定回答要思考到什么程度。此次更新只针对 ChatGPT 对话体验,Work 和 Codex 中使用的 GPT-5.6 Sol 暂不变化。

开源雷达

周榜速递

周榜主要根据新增 Star 数进行排名,下面的单项目讲解则偏向新晋项目、实用老项目,标星并非单项目讲解的唯一指标。

i-have-adhd:让 Coding Agent 先说重点

i-have-adhd 是一个专门调整 Coding Agent 输出方式的 Skill。

它做的事情很简单:让 Agent 别再把真正的答案埋在一大段铺垫里。安装后,回答会优先给出下一步行动,多步骤任务用编号拆开,并在结尾留下一个明确的下一步。

项目一共设计了 10 条输出规则,包括减少跑题、限制列表长度、明确当前进度,以及错误发生时直接说明位置、原因和修复方式。除了 Claude Code,它也提供 Codex、Gemini、Cursor、OpenCode、Hermes、Pi 等工具的接入方式。

Kage:用 Three.js 做一场京都山寺夜游

Kage 是一个基于 Three.js 制作的交互式网页实验,把一场虚构的京都山寺夜游拆成五个章节。

当用户向下滚动页面时,WebGL 摄像机会跟着穿过山寺场景。整个页面加入了鸟居、灯笼、雾、雨、飘落的树叶和朱红色月亮等动态元素,再配合章节切换、模糊和渐隐效果完成叙事。

项目主体只有一个静态 HTML 页面,不需要构建流程;其中部分场景图和前景素材由 GPT Image 2 生成,再与实时 Three.js 场景组合。对于想研究网页 3D、滚动叙事和生成式视觉如何结合的人来说,它是个很完整的 Demo。

Sol Advisor:给 Coding Agent 加一层架构师编排

Sol Advisor 是一个面向 Agent Plugins v1 客户端的架构优先型编排插件。

它会把需求确认、架构设计、任务拆解、Diff 检查、验证和最终验收留在主对话中,再把具体实现和 Advisor 工作分配给不同 Agent 角色。不同角色可以分别指定模型和推理强度,主编排器则继承当前会话所选择的模型。

项目还提供 MCP Server 和客户端适配层,目前包含 Codex 与 Cursor 的配置方式,并在安装和生成客户端文件前提供 Preview 和确认流程。

diagram-design:让 Claude Code 画出能直接用的图

diagram-design 是一个专门生成编辑级图表的 Claude Code Skill,同时也提供 Codex 的安装方式。

项目内置 27 种图表类型,包括架构图、流程图、时序图、状态机、ER 图、时间线、泳道图、象限图、组织架构、漏斗和数据流等,每种又提供浅色、深色和完整 Editorial 三套样式。

它还有一个很实用的能力:可以读取你的网站,提取配色和字体,然后把品牌视觉应用到之后生成的所有图里。输出结果是独立 HTML,SVG 和 CSS 都内联其中,不需要构建,也可以继续导出成 SVG 或 PNG。

这周有事

「这周有事」收录本周值得记一下的行业动态、事故、融资、人员流动和基础设施变化。

OpenAI 和 Apple 的商业机密诉讼公开开打

OpenAI 本周直接发了一篇题为 《Apple is getting this wrong》 的文章,公开回应 Apple 提起的商业机密诉讼。

Apple 指控前员工 Chang Liu、Tang Tan 等人在加入 OpenAI 后涉及 Apple 机密信息,并申请初步禁令,希望限制 OpenAI 基于相关技术继续推进 AI 硬件。OpenAI 对此否认,并公开了部分短信和邮件记录,称其中一些访问来自 Apple 自身离职权限未及时关闭,而且 Apple 律师早期还曾因混淆姓氏联系错人。

8 月 6 日,OpenAI 已提交驳回诉讼的动议。目前双方对核心事实仍各执一词,案件还没有最终结论。

Airtable 12.85 亿美元卖给 Bending Spoons

Bending Spoons 宣布以 12.85 亿美元企业价值全现金收购 Airtable;算上 Airtable 手中的净现金,这笔交易对应的股权价值约为 22.5 亿美元

Airtable 在 2021 年的估值曾达到 117 亿美元,如今对应股权价值较峰值缩水约八成。它目前的年度经常性收入约 4.8 亿美元,同比增长超过 20%,服务超过 50 万家组织。

交易预计今年晚些时候完成。Airtable 表示,加入 Bending Spoons 后将继续推进自己的 AI-native 平台。

Cursor 品牌可能要消失了

SpaceX 早在 6 月已经同意以 600 亿美元全股票交易收购 Cursor 母公司 Anysphere,交易原计划在第三季度完成。

本周 The Information 的最新报道称,Cursor 已在内部 All-hands 上告知员工,这笔收购最快可能在下周完成。与此同时,Cursor 团队预计会被进一步整合进 SpaceXAI,Cursor 这个品牌名也可能逐步淡出

目前品牌调整仍属于媒体基于内部消息的报道,最终安排还需要等待公司正式公布。

Spotify 推荐系统原班人马做电商,融资 1000 万美元

三名前 Spotify 员工 Sidd Motwani、Ian Anderson 和 Shivaditya Sinha 创办了 AI 电商公司 Malachyte,并完成 1000 万美元种子轮融资。

三人此前参与构建 Spotify 的 Vector AI 推荐基础设施。现在 Malachyte 想把类似思路搬到电商:根据用户当前的点击、搜索、滚动和加购等行为,实时判断购买意图,并动态调整商品推荐,而无需等到积累大量历史购买记录。

本轮融资由 Bessemer Venture Partners 和 Gradient 联合领投。

SpaceX 今年已经买了 3.29 亿美元 Tesla Megapack

SpaceX 今年明显加大了对 Tesla 大型储能电池 Megapack 的采购。

根据公司披露的数据,仅第二季度采购额就达到 2.95 亿美元,今年累计达到 3.29 亿美元

TechCrunch 推测,这些 Megapack 很可能会用于 SpaceX 旗下 xAI 的数据中心。AI 数据中心的 GPU 负载会频繁波动,大型电池既可以提供备用电力,也可以在功耗突然升高时补充供电、削平用电峰值。

相关文章
|
7天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1746 117
|
8天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1251 9
|
14天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1956 9
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
8天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
543 112
缓存 安全 IDE
961 2
|
20天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2942 4
|
8天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
5天前
|
编解码 弹性计算 云计算
MiniMax-H3 视频生成模型 — 一键部署与使用指南
MiniMax-H3是MiniMax开源的33B全模态视频生成模型,支持文生视频、图生视频、参考生视频三种模式,原生输出2K/15秒带立体声音频视频,已原生适配ComfyUI,并可通过阿里云计算巢一键部署。(239字)
|
12天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
748 111