七牛开发者_个人页

七牛开发者
个人头像照片
0
0
0

个人介绍

每一个想法都值得被实现~

擅长的技术

获得更多能力
通用技术能力:

暂时未有相关通用技术能力~

云产品技术能力:

暂时未有相关云产品技术能力~

阿里云技能认证

详细说明
暂无更多信息

2026年07月

  • 07.17 14:45:59
    发表了文章 2026-07-17 14:45:59

    专访 NetsGo 作者张硕:把内网穿透从配置文件搬进一个控制台

    NetsGo 是张硕开发的轻量级内网穿透与节点管理平台,专注解决多设备(NAS、树莓派、PVE等)场景下的配置分散、状态难查、变更难管问题。单文件二进制+Web控制台,不替代frp,而是补足其管理短板。v0.1.11已支持P2P隧道与AI驱动的真实环境测试。
  • 07.17 14:12:02
    发表了文章 2026-07-17 14:12:02

    Dario 常驻 Codex|从生图到安装,手把手带你换一套 Codex 皮肤

    本文为 macOS 用户提供的 Codex Desktop 换肤实践指南,基于开源项目 Codex Dream Skin,教你用 ChatGPT 生成像素风“Dario”主题背景图,并完成一键定制与还原。非官方教程,适配 Windows 可参考流程。需 ChatGPT 会员及基础操作经验。
  • 07.16 13:59:45
    发表了文章 2026-07-16 13:59:45

    Agent 小知识|上下文预算:让 Agent 知道该看什么

    本文详解Agent系统中关键的“上下文预算”概念:区别于Chatbot的静态对话,Agent需动态管理有限上下文窗口,科学分配目标、规则、工具、记忆与历史等信息。通过固定保留、最近保留、压缩摘要、按需加载四类策略,平衡信息完整性与模型效率,保障长任务稳定执行。
  • 07.15 14:46:27
    发表了文章 2026-07-15 14:46:27

    从 Fable 案例看 Coding Agent 的未知项管理

    Anthropic 提出的“unknowns”概念,精准揭示了Coding Agent协作中的核心挑战:任务中未明说、未察觉或未意识到的潜在问题。本文系统解析四类unknowns(已知/可知/隐性/未知),并提供实战方法——盲区排查、原型脑暴、反向提问、参考投喂、动态记录与通关测验,助开发者与Claude高效协同。
  • 07.15 14:24:29
    发表了文章 2026-07-15 14:24:29

    RAG 工程里的上下文剪枝:如何减少 68% 的上下文

    Kapa提出“上下文剪枝”新范式:在Reranker与Generator间插入轻量小模型(Pruner),基于五档评分(Essential至Unrelated)全局评估候选chunk,兼顾互补性与必要性。实测剪枝68%冗余内容,保留96%关键召回,单次查询成本降34%,特别适配Agent等多步推理场景。
  • 07.14 14:38:29
    发表了文章 2026-07-14 14:38:29

    LLM 如何批量且精准地实现电商海量标签标注与验证?拆解 Amazon 的 SynthAVE 工业级多模型质检方案

    Amazon提出SynthAVE方案,用7个LLM+3类Prompt构建21种评审配置,通过多数投票形成机器共识,仅对原始标签与共识冲突的样本触发人工复核,在可控成本下将电商合成标签准确率从92.6%提升至95.0%,破解大规模标签质检瓶颈。
  • 07.14 14:14:14
    发表了文章 2026-07-14 14:14:14

    Harness 效应:编排设计如何影响企业级 Agent 的 Token 成本

    论文《The Harness Effect》指出:企业级Agent成本主要由编排层(Harness)决定,而非模型单价。Harness通过优化上下文组织、历史压缩、工具调用与重试机制,将单任务Token消耗降低38%(14.2k→8.8k),成本下降33%–61%,CPM提升68%。优化本质是将成本问题从“选模型”转向“精设计”。
  • 07.13 15:22:52
    发表了文章 2026-07-13 15:22:52

    Codex 实践系列 Vol.03:Codex 那些好用的 slash command

    本文是Codex系列第三篇,聚焦真实项目协作:以AI志愿填报Demo为案例,详解`/status`、`/goal`、`/plan`等核心slash命令的实战用法——从确认环境、设定目标、规划修改,到聚焦文件、审查diff、复查逻辑、压缩长对话,系统提升AI编程的可控性与工程规范性。
  • 07.13 14:57:32
    发表了文章 2026-07-13 14:57:32

    别再手调 RAG 了,让 Loop 自己找配置

    本文介绍如何用工程化 Loop 自动调优 RAG 参数:通过定义搜索空间、构建自动评估函数(recall@k)、设置最小提升阈值与 train/holdout 拆分防过拟合,并集成运行次数与预算双熔断机制,实现目标驱动、可复现、可审计的智能调参闭环。
  • 07.13 13:49:12
    发表了文章 2026-07-13 13:49:12

    AI Slop 图鉴来了,TypeScript 7 快了 10 倍,MiniMax 市值蒸发近 四分之三

    本期「周一上线」聚焦AI圈新鲜事:社区创意频出——AI slop图鉴、反AI字体Ghost Font、桌面AI小电视;大厂密集发版——GPT-Live语音模型、Grok 4.5、SWE-1.7、Muse Spark 1.1、TypeScript 7;开源新锐涌现,涵盖多Agent工作站、安全技能路由、3D建模插件等。
  • 07.10 14:06:02
    发表了文章 2026-07-10 14:06:02

    专访 DeepChat 作者们:聊聊本地优先、MCP 与 Agent Memory

    DeepChat 是一款本地优先的开源 AI Agent 桌面客户端,支持 MCP、Computer Use、Skills 与 Agent Memory 等前沿能力。它从轻量 Chatbot 演进而来,坚持数据留本地、端到端加密,兼顾隐私与强大功能,是探索下一代 AI 工作台的理想开源平台。
  • 07.09 13:52:25
    发表了文章 2026-07-09 13:52:25

    loop 最佳实践:从 /goal 到 /loop,让 Agent 工作流循环起来

    本文详解Coding Agent的四种核心循环模式:基于轮次(人工驱动)、目标导向(/goal)、时间触发(/loop与/schedule)及主动循环,强调Agent工程的关键在于明确“谁触发、何时停、如何验”,而非仅优化Prompt。
  • 07.09 13:51:10
    发表了文章 2026-07-09 13:51:10

    Agent 小知识|为什么大家都在聊 Agent?

    本文深入剖析AI从Chatbot到Agent的范式跃迁:不再停留于“请求-响应”,而是转向“目标驱动的自主控制循环”(ReAct)。通过对比交互逻辑、系统架构五大演进(任务编排、环境反馈、结构化动作、状态记忆、安全边界),揭示Agent作为可控智能体的工程本质——聊天框只是入口,背后是复杂后端系统的硬核支撑。
  • 07.08 13:37:44
    发表了文章 2026-07-08 13:37:44

    从一次修复到长期记忆:Agent 工作流里的知识沉淀

    Thinkroom 提出“知识复用”替代传统“代码复用”,将每次问题解决沉淀为结构化、机器可读的 `Learning`(Markdown 文档),嵌入研发全流程:调试后自动捕获、规划前智能检索、编码时强制遵循、审查中实时校验。知识按持久性分级存储,辅以防腐机制与毫秒级 Grep-First 检索,让历史经验真正驱动下一次开发——知识不再沉睡于 Wiki,而活在工作流中。
  • 07.07 13:59:34
    发表了文章 2026-07-07 13:59:34

    论文解读:Codex 写代码,Claude 做 review,中间谁来传话?拆解基于文件的异构 Agent 协作协议 tap

    tap论文提出轻量级文件协议,解决多厂商、异构LLM Agent协作难题:以本地文件系统与Git为基座,通过“消息即文件、仓库即现场”实现可靠通信;双层机制(落盘存证+事件通知)兼顾鲁棒性与实时性;借助worktree隔离、配置自动化与外部记忆体(Operational Artifacts),支撑跨代接力开发。让AI专注分工,人回归决策。
  • 07.07 13:58:08
    发表了文章 2026-07-07 13:58:08

    AutoMem:把 Agent Memory 变成可训练的记忆管理技能

    AutoMem是斯坦福提出的创新框架,将记忆管理视为可学习的认知技能:通过双层外循环(结构优化+能力训练),让LLM自主决定“记什么、何时记、如何组织”,显著提升长任务表现与记忆效率。
  • 07.06 14:21:53
    发表了文章 2026-07-06 14:21:53

    周一上线:被 Claude 封号算工伤吗?贾扬清据报离开 NVIDIA,Cursor 推出 iOS 版

    本周AI圈动态纷呈:Cursor推iOS版实现移动端接管AI编程任务;Git 2.55优化体验;Claude Sonnet 5、LongCat-2.0等新模型强化Agent能力;开源工具如CodexBar、agents-cli降低AI编码门槛;Meta试水算力云,Together AI获8亿美元融资。
  • 07.06 14:12:31
    发表了文章 2026-07-06 14:12:31

    Agent 也需要一个“调度员”吗?

    Addy Osmani提出“Agent自主等级”框架,从agency(单Agent行动力)与orchestration(多Agent编排力)双维度,系统划分0–5级自主性。
  • 07.03 17:32:58
    发表了文章 2026-07-03 17:32:58

    不仅听懂,更能干活:看张之阳如何让 Agent 安全接管智能家居

    本文介绍七牛云工程师张之阳基于OpenClaw+Home Assistant打造的智能家居Agent实践:让AI理解“朋友来家调灯光”等模糊指令,通过统一API层、状态回查与安全边界设计,实现从对话到真实系统执行的完整闭环,探索AI落地生产力的关键工程路径。
  • 07.02 14:06:35
    发表了文章 2026-07-02 14:06:35

    理解 Prefill Decode:AI 回答慢,慢在输入还是输出?

    讲解大模型推理中的 Prefill 与 Decode 两个阶段,分析 AI 回答变慢的根源
  • 07.02 14:00:52
    发表了文章 2026-07-02 14:00:52

    记一次高性能 I/O 调试:Agent 给出满分优化,却说错了底层原理

    系统真正的瓶颈不是 I/O,而是CPU 在扫内存时的地址翻译成本
  • 07.01 13:57:39
    发表了文章 2026-07-01 13:57:39

    Coding Agent 规则管理:CLAUDE.md、Skills、Hooks、Subagents 到底怎么选?

    Claude Code 用分层设计把 Coding Agent 的规则拆成多种机制,让约束在合适的时机生效
  • 07.01 13:49:27
    发表了文章 2026-07-01 13:49:27

    MCP Server 怎么安全接给 AI Agent?以 OpenAI Secure MCP Tunnel 为例

    OpenAI 让 Agent 能安全调用企业内网 MCP Server,同时不暴露任何公网入口。

2026年06月

  • 06.30 14:03:58
    发表了文章 2026-06-30 14:03:58

    论文解读:DeepSeek DSpark 在真实高并发推理服务中,如何保证 Token 生成又好又快?

    DSpark 通过半自回归生成和置信度调度,加速 speculative decoding。
  • 06.30 13:41:44
    发表了文章 2026-06-30 13:41:44

    论文解读:LLM 不直接改代码,也能让程序跑快 3 倍?

    一篇关于 LLM 参与编译器优化循环的研究
  • 06.29 15:05:52
    发表了文章 2026-06-29 15:05:52

    端侧 AI 的推理加速:手机端大模型怎么提速?

    Google 给 Pixel 上的 Gemini Nano 装了个“先猜后验”的加速器
  • 06.29 14:21:02
    发表了文章 2026-06-29 14:21:02

    猫猫版 Pokémon GO 火了,GitHub 账号被毒舌审判,OpenAI、DeepSeek 发布新品

    回顾 AI 与开发者生态动态,涵盖产品更新、社区创意玩法与工具发布
  • 06.26 10:17:35
    发表了文章 2026-06-26 10:17:35

    MCP 到底是什么?为什么 Agent 都想接上它

    让 Agent 连接外部世界的那个技术
  • 06.25 14:09:15
    发表了文章 2026-06-25 14:09:15
  • 06.24 18:38:40
    发表了文章 2026-06-24 18:38:40

    SkillOpt 让你的 Skill 实现自进化

    SkillOpt是微软开源的文本空间优化器,专为优化Agent的自然语言技能文档(如Markdown格式的skill.md)而设计。它不修改模型参数,而是通过“执行-反思-更新-验证”闭环,自动迭代出更鲁棒的`best_skill.md`,让技能持续适配真实任务,提升Agent在复杂流程、多源判断、跨项目迁移等场景中的稳定性与准确性。
  • 06.24 17:35:17
    发表了文章 2026-06-24 17:35:17

    工程实践|Warp 的 Loop Engineering:Agent 如何自己改进 Skill?

    Warp 团队提出“双循环驱动”AI Agent进化:内循环(Inner Loop)自动分诊GitHub Issue;外循环(Outer Loop)从人类反馈中提炼规则,生成PR更新技能文件(SKILL.md)。技能即SOP,可审查、可回滚、持续迭代,让Agent越用越懂团队。
  • 06.24 17:10:14
    发表了文章 2026-06-24 17:10:14

    TokenPilot:让 LLM Agent 长会话成本降 60%+ 的上下文管理

    《TokenPilot》提出缓存感知的上下文管理新范式,针对LLM Agent长任务中token膨胀与prompt cache失效的矛盾,创新性地融合入口压缩(稳定动态字段、精简噪声)与生命周期感知清理(保留残余价值历史),显著降低推理成本(连续任务成本最高降74%),同时提升缓存命中率与任务表现。
  • 06.23 08:30:49
    发表了文章 2026-06-23 08:30:49

    旧手机如何组建集群,跑点云计算?

    UC San Diego 与 Google 合作推进“手机集群计算”:拆解退役手机主板,组建低碳小型计算集群。首期将部署 2000 台 Pixel 手机主板,替代传统服务器,为教学科研提供低成本云资源,兼顾环保与算力复用。
  • 06.23 08:00:24
    发表了文章 2026-06-23 08:00:24

    周一上线 | SpaceX 收购 Cursor、支付宝进入 AI 时代、DeepSeek 完成 500 亿元融资

    本期「周一上线」聚焦AI从“聊天框”走向真实行动:Cursor、Copilot深化AI编程,支付宝“阿宝”;墨水屏跑Claude Code、树莓派入Docker、GLM-5.2开源支持1M上下文,展现AI落地的多元创新。
  • 06.17 18:02:57
    发表了文章 2026-06-17 18:02:57

    世界杯进球那一刻,体育 App 怎么扛住流量高峰?

    本文以世界杯进球瞬间的流量高峰为切入点,剖析体育App背后的高并发工程体系:通过流量分层(静态/热点/动态/互动)、事件驱动、多模式数据更新(WebSocket/SSE/轮询)、分层缓存、消息队列削峰解耦、视频智能分发及精细化降级限流等策略,系统性保障核心体验。240字
  • 06.17 08:09:15
    发表了文章 2026-06-17 08:09:15

    世界杯一粒进球被吹掉,背后可能有多少 AI?

    世界杯进球被吹?背后是VAR+AI的精密协作:摄像机追踪29个身体点、球内传感器锁定传球瞬间、AI自动生成越位线与3D动画,再经VAR复核、主裁终裁。AI负责“测得准”,裁判负责“判得明”——技术让判罚更透明,却未消除规则语境下的争议。
  • 06.16 08:27:46
    发表了文章 2026-06-16 08:27:46

    周一上线|瑞幸把咖啡做进 CLI,Fable 5 短暂登场,Stonk Rider 骑上 K 线图

    一边,模型和开发者工具还在继续往真实工作流里走:Gemini 3.5 Live Translate 开始做近实时语音翻译,Kimi-K2.7-Code 开源,DiffusionGemma 探索更快的文本生成,Codex 和 Chrome DevTools 也在继续给 Agent 补浏览器能力。 另一边,社区里照样很会玩:有人把咖啡下单做成 CLI,有人把股票走势变成摩托赛道,有人给终端塞进会吞文字的黑洞,还有一张“前端兄弟快回来吧”的梗图讲完了全栈开发的精神状态。
  • 06.15 18:03:12
    发表了文章 2026-06-15 18:03:12

    面向 DeepSeek-V4 的 FlashMemory:长上下文 KV Cache 如何压到约 1/10

    FlashMemory-DeepSeek-V4 最值得关注的地方,是它把长上下文推理里的 KV Cache 管理,从“尽量塞进显存”推进到了“按需调度记忆”。 这条路线的意义在于,长上下文能力继续往前走,瓶颈不会只来自模型能读多长,也会来自系统能不能便宜、稳定地保存和调用这些历史信息。窗口变大只是第一步,真正难的是让模型知道哪些内容值得保留、什么时候该被召回。
  • 06.12 19:22:11
    发表了文章 2026-06-12 19:22:11

    Codex 实践系列 Vol.02:让 Codex 读懂开源项目 Typer

    这次用 Codex 读 Typer,最重要的一点是:面对一个新项目,第一步先别急着让它写代码。比较稳妥的做法,是先让 Codex 读目录、找入口、解释核心文件,再沿着一个具体功能追下去,最后通过测试理解项目如何验证行为。
  • 06.12 17:51:08
    发表了文章 2026-06-12 17:51:08

    世界杯开幕了,手把手教你做个看球小工具

    先把数据结构化,再用程序处理确定性的查询和计算。 这样做出来的工具,功能不一定复杂,但结果会更可靠。世界杯只是一个入口,真正值得练的是这种处理数据和时间的基本思路。
  • 06.11 16:54:03
    发表了文章 2026-06-11 16:54:03

    Skills 是什么?Claude 官方教你做一个好用的 Skill

    Skills 可以理解成 Claude Code 给 Agent 准备的任务经验包。它把一类任务里反复出现的说明、脚本、模板、配置、坑点和历史记录放在一起,让 Claude 下次遇到类似任务时,可以直接复用已有经验。
  • 06.11 15:46:07
    发表了文章 2026-06-11 15:46:07

    AI Agent 的 4 个工程关键词:Prompt、Context、Loop、Harness 到底是什么?

    Prompt、Context、Loop、Harness 这四个词,可以看成 AI Agent 工作流里的四个关注点:怎么问、给它看什么、怎么持续推进,以及在哪里安全运行。 其中,Loop Engineering,重点关注“持续推进”这一环节。它关心的是,如何把原本由人一轮轮推动的“提示—执行—检查—修正”过程,设计成一个清晰、可控、容易沉淀经验的循环。 这也是 AI Agent 从“能回答问题”,走向“能完成任务”时,一个很关键的变化。
  • 06.10 15:33:04
    发表了文章 2026-06-10 15:33:04

    为什么Analytics Agent 总答错?来自 Anthropic 的数据分析最佳实践

    数据分析 Agent 的核心瓶颈,不是 SQL 生成能力,而是业务上下文。不要指望 Agent 在混乱的数据体系里自动找出标准答案。你需要先把数据环境整理成 Agent 能导航、能理解、能验证的结构。
  • 06.10 15:03:02
    发表了文章 2026-06-10 15:03:02

    从 Claude Code 动态工作流看 Agent Harness 设计

    Claude Code 动态工作流的特点是,让 Agent 不只是在一个对话里完成任务,而是可以为当前任务临时搭出一套执行框架。当我们理解了这套执行框架,也就能更好地理解 Agent Harness 是什么,它到底在解决什么问题。
  • 06.10 14:32:34
    发表了文章 2026-06-10 14:32:34

    本地模型为什么能跑起来?从 llama.cpp 量化说起

    大模型不再只存在于云端,也开始进入普通电脑。你打开 Ollama、LM Studio,或者直接用 llama.cpp,下载一个量化版本,就有机会在本地跑起一个还不错的大模型。
  • 06.08 17:03:19
    发表了文章 2026-06-08 17:03:19

    这 3 个开源小工具,帮你让 Coding Agent 少吃点 Token

    今天我们就来分享 3 个有用的开源项目,专门帮你的 Coding Agent 整理“上下文”:让它少翻无关代码,少吞冗长日志,把 token 留给更关键的信息。
  • 06.08 16:39:48
    发表了文章 2026-06-08 16:39:48

    给在校生的一份 AI 使用小指南

    今天这篇文章主要面向在校同学,聊聊怎么选 AI 工具,以及怎么把它们用在学习、写代码和做项目里。 我们先从最基础的地方开始。它不算复杂教程,也不会要求你马上学会一堆工具。先把常见 AI 工具分分类,再聊聊学生开发者可以怎么更有效地使用它们。
  • 06.08 16:22:12
    发表了文章 2026-06-08 16:22:12

    专访 Mainline 作者们:聊聊从代码协作到意图协作

    在 AI Coding 越来越普遍之后,代码生成会变得更快,也更多。团队成员如果还只靠逐行看代码、看 diff 来理解彼此,成本会越来越高。 Mainline 的做法是让 Agent 在开发过程中自动总结 Intent(意图),并把它和 commit 关联起来。这样团队在 Review 时,可以先看这次改动的目标、原因和关键决策,再决定是否需要深入看代码。
  • 发表了文章 2026-07-17

    专访 NetsGo 作者张硕:把内网穿透从配置文件搬进一个控制台

  • 发表了文章 2026-07-17

    Dario 常驻 Codex|从生图到安装,手把手带你换一套 Codex 皮肤

  • 发表了文章 2026-07-16

    Agent 小知识|上下文预算:让 Agent 知道该看什么

  • 发表了文章 2026-07-15

    从 Fable 案例看 Coding Agent 的未知项管理

  • 发表了文章 2026-07-15

    RAG 工程里的上下文剪枝:如何减少 68% 的上下文

  • 发表了文章 2026-07-14

    LLM 如何批量且精准地实现电商海量标签标注与验证?拆解 Amazon 的 SynthAVE 工业级多模型质检方案

  • 发表了文章 2026-07-14

    Harness 效应:编排设计如何影响企业级 Agent 的 Token 成本

  • 发表了文章 2026-07-13

    Codex 实践系列 Vol.03:Codex 那些好用的 slash command

  • 发表了文章 2026-07-13

    别再手调 RAG 了,让 Loop 自己找配置

  • 发表了文章 2026-07-13

    AI Slop 图鉴来了,TypeScript 7 快了 10 倍,MiniMax 市值蒸发近 四分之三

  • 发表了文章 2026-07-10

    专访 DeepChat 作者们:聊聊本地优先、MCP 与 Agent Memory

  • 发表了文章 2026-07-09

    Agent 小知识|为什么大家都在聊 Agent?

  • 发表了文章 2026-07-09

    loop 最佳实践:从 /goal 到 /loop,让 Agent 工作流循环起来

  • 发表了文章 2026-07-08

    从一次修复到长期记忆:Agent 工作流里的知识沉淀

  • 发表了文章 2026-07-07

    论文解读:Codex 写代码,Claude 做 review,中间谁来传话?拆解基于文件的异构 Agent 协作协议 tap

  • 发表了文章 2026-07-07

    AutoMem:把 Agent Memory 变成可训练的记忆管理技能

  • 发表了文章 2026-07-06

    周一上线:被 Claude 封号算工伤吗?贾扬清据报离开 NVIDIA,Cursor 推出 iOS 版

  • 发表了文章 2026-07-06

    Agent 也需要一个“调度员”吗?

  • 发表了文章 2026-07-03

    不仅听懂,更能干活:看张之阳如何让 Agent 安全接管智能家居

  • 发表了文章 2026-07-02

    记一次高性能 I/O 调试:Agent 给出满分优化,却说错了底层原理

正在加载, 请稍后...
滑动查看更多
正在加载, 请稍后...
暂无更多信息
正在加载, 请稍后...
暂无更多信息