Cursor 会自己选模型,OpenAI 全系产品宕机近 2 小时,百川联合创始团队离场

简介: 本期「周一上线」聚焦AI前沿动态:Qwen发布图像/语音3.0模型,Claude Opus 5强化任务推进能力,Cursor Router实现智能模型路由,ACP v2支持长时Agent会话;同时直面安全挑战——Hugging Face披露自主Agent入侵事件,OpenAI遭遇31组件大规模故障。技术跃进与风险并存。

这期的「周一上线」,一边是继续上新模型和开发工具,一边是 Agent 背后的协议、算力与安全问题开始集中冒头。

Qwen 更新了 3.0 版本的图像、语音模型,Anthropic 带来 Claude Opus 5,Cursor 把模型选择权交给 Router,ACP v2 则让 Agent 会话可以跑得更久,持续处理后台任务。

另一边,Hugging Face 复盘了一场由自主 Agent 推进的安全入侵。与此同时,上周末 OpenAI 经历了一次波及 ChatGPT、API 和 Codex 的大面积故障。

下面,开始一周回顾。

有点新鲜

「有点新鲜」收录本周 AI / 开发者圈里那些不算大新闻,但挺值得看一眼的新鲜事。

Codex 重置的专属日历

不少人在意 Codex 的使用额度什么时候重置?距离上次重置过去多久了?@hzlzh 做了一个 Codex 重置日历:

日历板上最长的 reset 的时间一目了然,当然,还有热心群众,发现 Codex 24 小时没重置了,跑去关心官方人员的情况:

DeepSeek:我先去吃饭,测完告诉我

连 DeepSeek 这种硅基生物都知道要吃饭,身为碳基生物的我们,平时工作再忙,也得好好吃饭才行。

Claude 和 ChatGPT 的增长曲线重叠了

本周 ChatGPT 发了一张图庆祝周活过千万:

随后有才的 @quanruzhuoxiu 发现了 Claude 封号增长曲线也类似。虽然是类似的增长曲线,一个令人欢喜一个让人愁(狗头

让 Agent 7x24 小时打工的神器

有了这个 199 刀的神之托举,你的 Agent 就能 7x24 小时打工了。虽说如此,这神之手似乎和怡宝瓶盖差距不大?

做个能撕的贴纸

本周社媒上掀起了一股帖子特效风,就是用代码来实现如下这种撕下贴纸的效果:

周五发版

「周五发版」是一个程序梗:一旦版本上线,我们就要开始祈祷一切如期运行。这个模块寓意,所有模型、产品版本更新,都能大吉大利。

Qwen-Image-3.0、Qwen-Audio-3.0-TTS 发布

阿里发布第三代图像生成基础模型 Qwen-Image-3.0,重点在于提升复杂内容的组织、真实细节和知识表达能力。

模型最高支持约 4.5K Token 输入,可以处理报纸、故事板、试卷和信息图等多元素版式。官方还特别强调了小字生成能力,即便生成的图片采用 10px 左右的文字,它依旧保持着可读性之余,还原生支持 12 种语言的文字渲染。

同时,阿里还发布了 Qwen-Audio-3.0-TTS,并提供 Flash 和 Plus 两个版本。

Flash 面向实时交互,首个音频包延迟约为 300 毫秒;Plus 更侧重自然度、情绪表现和音色还原。Qwen-Audio-3.0-TTS 模型支持 16 种语言,可以用自然语言控制语速、语气和表达风格,也支持 [gasp][giggles][angry] 等非语言标签,来为语言增加细节。

Ling-3.0-flash:面向生产环境的混合推理模型

蚂蚁发布 Ling-3.0-flash。这是一个 124B 参数的混合推理 MoE 模型,主要面向生产级 Agent、多步骤任务和工具调用场景。

模型可以根据任务需要切换推理方式,并提供面向主流 Agent 框架的接入能力。官方 API 目前处于限时免费开放阶段

Cursor Router:让 Cursor 自动选择模型

Cursor 推出模型智能路由功能 Cursor Router。用户提交任务后,Router 会根据请求内容自动选择更合适的模型,来减少手动切换模型的步骤。

Cursor 表示,这套方案基于超过 60 万条真实请求训练,并在数百万次请求中进行了在线测试。在测试结果中,自动路由可以维持接近前沿模型的效果,同时将成本降低约 60%。

目前,该功能覆盖桌面端、Web、iOS、CLI 和 SDK,并已默认向团队版用户开放。

Claude Opus 5:更主动,也更重视工作验证

Anthropic 发布 Claude Opus 5。新模型继续强化编码和知识工作能力,同时更强调主动推进任务、检查工作结果和根据反馈持续修正。

Anthropic 表示,Opus 5 的能力接近此前的 Fable 5,价格约为后者的一半。标准 API 价格为每百万输入 Token 5 美元、每百万输出 Token 25 美元,这和 Opus 4.8 保持一致。Claude Max 用户会默认使用 Opus 5,Pro 用户也可以将其作为当前最高能力模型使用。

ACP v2:Agent 会话开始跨越单轮对话

Agent Client Protocol 发布 ACP v2 Draft,开始公开征求开发者测试和反馈。

新版本的重要变化是将 Agent 会话扩展到单轮请求之外。Agent 可以在会话中持续更新状态,执行更长时间的任务或后台工作;消息、工具调用和文件修改也获得了稳定 ID,方便客户端持续更新同一项内容。

ACP v2 还增加了结构化文件变更、流式工具调用和更灵活的权限请求机制。当前版本仍处于草案阶段,官方建议开发者同时保留 v1 支持,暂时不要将 v2 作为生产环境的默认协议。

开源雷达

周榜速递

周榜主要根据新增 star 数进行排名,下面的单项目讲解则偏向新晋项目、实用老项目,标星并非单项目讲解的唯一指标:

oMLX:让 Mac 变成本地 AI 推理平台

oMLX 是一个面向 Apple Silicon Mac 的本地大模型推理工具。

它针对 M 系列芯片进行了优化,可以直接在 Mac 上运行语言模型、视觉语言模型、OCR、Embedding 和重排序模型。

除了模型运行,它还提供了连续批处理、KV Cache 管理以及兼容 OpenAI / Anthropic API 的接口,可以接入现有的 AI 客户端和 Agent 工作流。

img2threejs:把图片转换成可编辑的 3D 场景

img2threejs 是一个面向 Three.js 的 AI 生成工具。

它可以根据一张参考图片,生成对应的 Three.js 场景代码,将图片中的物体、布局和视觉效果转换成可以继续编辑的 3D 页面。

生成后的代码可以继续交给 Claude Code、Codex 等编程 Agent 修改,也可以加入动画、交互效果,直接用于网页项目。

对于想快速制作 3D 展示页面、产品 Demo 或交互作品的开发者来说,它提供了一条从图片到代码的路径。

OpenWorker:运行在桌面上的 AI 工作助手

OpenWorker 是一个开源桌面 AI Agent,目标是让 AI 直接参与日常工作流程。

它可以连接邮件、日历、文档等外部服务,帮助用户完成信息整理、任务执行和重复性工作。

项目支持接入自己的模型 API,也可以使用本地模型运行。当涉及发送消息、修改日程等操作时,OpenWorker 会请求用户确认,避免 Agent 直接执行敏感操作。

除了聊天,它更接近一个可以持续工作的桌面助手,适合用来探索 AI Agent 在办公自动化中的实际应用。

Bento:一个 HTML 文件里的完整演示工具

Bento 是一个轻量级的单文件演示文稿工具。

它把内容、编辑器、播放器和演讲模式全部集成到一个 HTML 文件中,不需要安装软件,打开浏览器即可编辑和展示。

相比传统演示工具,Bento 更强调文件独立和本地控制,一个文件就可以保存完整演示内容,方便分享、归档和部署。

它还支持图表、动画效果以及协作能力,适合制作技术分享、项目展示和快速 Demo。

这周有事

「这周有事」收录本周值得记一下的行业动态、事故、融资、人员流动和基础设施变化。

Hugging Face:Agent 攻防进入实战

Hugging Face 披露了一场由自主 Agent 推进的安全事件。攻击方通过恶意数据集利用漏洞,完成代码执行、权限提升和内部横向移动。后续调查显示,相关攻击测试涉及 OpenAI 的 GPT-5.6 Sol 等模型。

在防守阶段,Hugging Face 使用 AI Agent 分析超过 1.7 万条日志,但部分商业模型因安全限制无法处理真实攻击载荷,团队随后切换到自部署的开源模型 GLM-5.2 完成分析。

这次事件显示,Agent 能力提升后,攻击和防守都会进入机器速度,模型权限、运行隔离和本地部署能力也成为安全体系的重要组成部分。

百川智能联合创始人茹立云离职

近日,多家媒体报道称,百川智能联合创始人、前搜狗 COO 茹立云已离职,并出任慧辰股份总裁,负责 AI 应用落地与算力资源布局。茹立云曾与王小川共同创办百川智能,是公司早期核心管理成员之一。

随着茹立云离开,百川智能最初的联合创始团队已基本退出。此前,商业化负责人洪涛、模型研发负责人陈炜鹏、技术联合创始人谢剑等多位核心成员也先后离职。

百川智能曾是国内大模型创业公司的第一梯队之一,在 2023 年成立后快速推出 Baichuan 系列模型,并完成多轮融资。不过随着通义、豆包、DeepSeek、智谱等模型厂商持续推进,通用大模型竞争进入规模化阶段,百川的市场声量逐渐下降。

过去一年,百川开始调整方向,将更多资源投入医疗 AI。王小川曾表示,公司未来会减少多线探索,聚焦 AI 医生和精准医疗,并推出相关模型与产品。

Etched 完成 3 亿美元融资

AI 芯片公司 Etched 宣布完成 3 亿美元融资,估值达到 103 亿美元。本轮融资由红杉资本领投,a16z、Jane Street、Diffusion、Argo 和 SK 海力士等机构参与。

Etched 正在建设面向大规模推理的芯片和集群,并已经在办公地点附近搭建一座 10MW 实验设施,用于测试第一代硬件和整套推理系统。

AMD 与 Anthropic 签下最高 2GW 算力合作

AMD 与 Anthropic 宣布建立战略合作关系,计划部署最高 2GW 的 AMD Instinct MI450 系列 GPU。

首个 1GW 部署预计在 2027 年上半年启动,整套系统将采用 MI455X GPU、EPYC Venice 处理器、Pensando 网络技术和 ROCm 软件栈。双方还会利用 Claude 协助优化工作负载和 ROCm 开发。

作为合作的一部分,AMD 还计划向 Anthropic 进行最高 50 亿美元的战略股权投资。

Stripe 据称正在洽购 OpenRouter

据知情人士透露,Stripe 正在与 OpenRouter 洽谈收购事宜,交易估值接近 100 亿美元,并可能在一个月内公布。

目前谈判仍可能发生变化,Stripe 拒绝对此置评,OpenRouter 也尚未正式确认。

OpenAI 31 个组件同时出现故障

7 月25 日,OpenAI 的 API、ChatGPT 和 Codex 同时出现服务异常。

OpenAI 状态页面显示,这次事故从调查到完全恢复持续约 1 小时 51 分钟,共涉及 12 个 API 组件、15 个 ChatGPT 组件和 4 个 Codex 组件,合计 31 个组件。

相关文章
|
30天前
|
自然语言处理 安全 API
Agent Graph Engineering:从线性 Workflow 到可扩展 Agent 系统
本文介绍Agent图编排(Agent Graph Engineering)的核心思想:摒弃简单串行流程,以数据依赖关系构建节点(Agent/代码)与边(数据流)组成的有向图。强调清晰输入输出约定、并行执行、故障隔离、验证机制与动态循环设计,提升系统可组合性、稳定性与成本效率。
222 0
Agent Graph Engineering:从线性 Workflow 到可扩展 Agent 系统
|
25天前
|
开发工具 git 开发者
电脑写代码,手机管任务:Codex 远程开发工作流
Codex手机端不仅是任务查看器,更是移动工程指挥中心:可启动任务、选环境、补上下文、审代码、发意见。电脑负责执行,手机专注决策——无需装开发环境,轻松掌控关键环节。
211 0
电脑写代码,手机管任务:Codex 远程开发工作流
|
25天前
|
人工智能 BI API
阿里云Qwen3.8-Max-Preview介绍:核心能力、适用场景、支持订阅计划与最新活动
阿里云于2026年7月19日发布Qwen3.8-Max-Preview,为通义千问首个2.4T参数原生多模态旗舰模型,采用第三代MoE架构,支持百万Token上下文、全栈代码工程、原生多模态处理及多智能体协作,较Qwen3.7-Max全面跃升。模型处于"日更进化"预览阶段,现推出限时优惠:常规时段1折、夜间0.2折(22:00-次日08:00),适用于Qoder CN全系产品。个人版Token Plan低至39元/月,团队版150元/席位/月起,配合新用户25元体验包及14天Pro Trial,是开发者与企业低成本体验顶级大模型的绝佳窗口。
|
25天前
|
人工智能 数据挖掘 开发者
阿里云通义千问Qwen3.8-Max-Preview限时1折与夜间限时0.2折介绍:个企双版本优惠
通义千问Qwen3.8-Max-Preview是阿里云最新旗舰基座模型,参数量达2.4T,在代码工程、专业办公、数据分析等领域显著提升。Qoder CN推出限时优惠:常规时段(08:00-22:00)享1折,夜间时段(22:00-08:00)享0.2折,计费系数从0.5x降至0.05x/0.01x。活动自2026年7月19日起,覆盖Qoder全系产品及各档位用户,更新至最新版本并选择该模型即可自动生效。需注意专家团模式及子Agent调用不参与折扣。配合阿里云百炼Token Plan、轻量服务器等多项优惠,为开发者和企业提供低成本体验顶级AI模型的机会。
micropython esp8266+ssd1306(OLED) 显示中文(示例)
1.Adafruit_SSD1306 OLED显示库使用Adafruit_SSD1306:https://github.com/adafruit/Adafruit_SSD1306 连接示例: 库使用示例: >>> from ...
8028 0
|
3月前
|
负载均衡 安全 调度
香港服务器访问海外网站快吗?和大陆服务器怎么选?
很多企业在搭建跨境业务时,都会遇到一个核心问题:网站既要兼顾大陆用户访问,又希望海外用户打开速度稳定。那么,香港服务器到底适不适合全球业务?相比大陆服务器又该怎么选? 实际上,影响网站体验的关键,不只是带宽大小,更重要的是服务器访问速度、线路质量以及节点布局。如果服务器选择不合理,即便配置再高,也可能出现海外访问卡顿、国内延迟高等问题。
433 0
|
4月前
|
数据采集 弹性计算 人工智能
续费不涨价!阿里云99元服务器:2核vCPU、2GB内存、3Mbps固定带宽、40GiB系统盘(真香机)
阿里云推年度“真香机”:ECS经济型e实例(2核2G+3M固定带宽+40G ESSD系统盘),仅99元/年,官网活动链接:https://t.aliyun.com/U/FzmsXA 新老用户同享,续费不涨价!适用建站、开发、轻量AI等场景,活动延至2027年3月31日。
665 0
|
5月前
|
JSON 算法 API
调用拼多多开放平台API获取店铺所有商品列表
本文详解拼多多开放平台商品列表API(pdd.goods.list.get)调用方法,涵盖授权流程、签名生成、关键参数、分页处理及响应解析,助力商家/开发者高效获取全量商品数据,适用于商品管理、数据分析等场景。(239字)
1025 1
|
11月前
|
数据采集 JSON 自然语言处理
超越传统XPath:用LLM理解复杂网页信息
本文深入探讨网页信息抽取技术的演进,从传统 XPath/CSS 结构匹配,到结合 LLM(大语言模型)的语义理解方法。分析了旧技术在动态渲染、结构变化和语义识别方面的局限,并通过架构图、实验数据和示例代码展示 LLM 在新闻、电商、社交等复杂场景中的高效应用。同时强调爬虫代理等基础设施的重要性,为信息抓取提供稳定网络环境。
516 1
超越传统XPath:用LLM理解复杂网页信息
|
人工智能 前端开发 安全
构建现代交互式平台:CodeBuddy如何简化复杂系统开发
文章探讨了构建交互式平台的复杂架构挑战,涵盖前后端分离的五层架构设计。重点介绍了AI编程助手CodeBuddy在简化开发中的作用,包括智能代码生成、架构优化建议、跨技术栈支持、安全实践集成及文档生成等功能。通过实战案例展示,CodeBuddy显著提升开发效率与代码质量,助力团队应对复杂系统开发挑战,成为开发者不可或缺的工具。下载链接:腾讯云代码助手 CodeBuddy - AI 时代的智能编程伙伴。
668 10