1518817963889824_个人页

1518817963889824
个人头像照片
0
0
0

个人介绍

暂无个人介绍

擅长的技术

获得更多能力
通用技术能力:

暂时未有相关通用技术能力~

云产品技术能力:

阿里云技能认证

详细说明
暂无更多信息

2026年08月

2026年07月

  • 07.31 15:40:28
    发表了文章 2026-07-31 15:40:28

    把视频换脸放进浏览器:一次 WebGPU 推理链路的工程化实践

    本文详解浏览器端视频换脸的WebGPU工程实践,涵盖数据转换优化、ROI裁剪、串行Session初始化、Transferable内存管理、双向光流校验、时序目标匹配、遮罩后处理、模型版本控制、主动内存释放及深度任务取消等11项关键挑战,揭示“能运行”到“可持续使用”的真实路径。
  • 07.30 15:33:02
    发表了文章 2026-07-30 15:33:02

    纯前端 AI 视频特效实践:在浏览器中完成实物识别与动态描边

    在Timeline Studio中,我实现了纯浏览器端的实物描边功能:基于目标检测+提示式分割生成Alpha蒙版,结合WebGPU/WASM推理、光流传播与稀疏锚点优化,全程离线处理,保障隐私与性能。(239字)
  • 07.29 17:34:35
    发表了文章 2026-07-29 17:34:35

    浏览器端 AI 视频人物描边实践:MODNet、SlimSAM、MediaPipe 与光流融合方案

    Timeline Studio 实现浏览器端AI视频人物描边:融合YOLOS检测、MODNet抠像、MediaPipe清理、SlimSAM修复与Farneback光流传播,在WebGPU/WASM下本地运行,无需上传隐私视频,支持移动端与实时材质渲染。
  • 07.28 14:45:34
    发表了文章 2026-07-28 14:45:34

    在浏览器中实现视频四倍高清修复:NanoVSR 与 WebGPU 实战

    本项目基于WebGPU与ONNX Runtime Web,在浏览器中实现端到端视频四倍超分修复。采用NanoVSR 644K模型,支持五帧时序推理、自动宽高比适配、Worker异步处理及FFmpeg.wasm音视频合成,全程无需服务端参与。
  • 07.27 16:27:53
    发表了文章 2026-07-27 16:27:53

    从模型 Demo 到剪辑产品:基于 MI-GAN、ONNX 与 WebGPU 实现浏览器本地视频去水印

    本项目在浏览器中实现本地AI视频去水印,基于MI-GAN ONNX模型与WebGPU加速,支持多区域框选、时间范围设定及动态水印关键帧插值。全程无需上传视频,保障隐私,降低服务端成本,修复结果实时预览并保留原始音轨。(239字)
  • 07.24 16:03:47
    发表了文章 2026-07-24 16:03:47

    浏览器视频编辑器如何兼容 MKV?LibAV.js、WebCodecs 与 FFmpeg.wasm 实践

    本项目打造浏览器端AI视频编辑器,支持MKV/MOV等多格式智能兼容:优先调用原生能力,次选LibAV.js+WebCodecs解封装解码,FFmpeg.wasm仅作兜底转码;结合离线渲染与统一媒体模型,兼顾性能、精度与隐私。(239字)
  • 07.23 13:00:35
    发表了文章 2026-07-23 13:00:35

    从 ffmpeg.wasm 到 WebCodecs:浏览器视频编辑器导出架构的演进与实践

    本文介绍了一种混合架构的浏览器视频编辑器导出方案:以Canvas+WebCodecs逐帧合成与编码、OfflineAudioContext混音为核心,ffmpeg.wasm仅负责音频提取、格式标准化及MP4转码等专项任务,兼顾预览一致性、性能与容错性。(239字)
  • 07.21 22:47:37
    发表了文章 2026-07-21 22:47:37

    为浏览器音视频编辑器开发 Agent Skill,实现 AI 自动化剪辑自测

    本文介绍基于离线AI剪辑工具Timeline Studio构建的Agent Skill规范体系,通过开源技能库`edit-timeline-studio`,实现AI对前端编辑器的标准化UI操作、异常处理与全链路自动化测试,推动产品鲁棒性提升
  • 07.21 14:46:55
    发表了文章 2026-07-21 14:46:55

    把 AI 视频剪辑搬进浏览器:Timeline Studio 的本地优先架构与工程实践

    视频剪辑、语音合成、自动字幕和 AI 视觉处理,过去往往意味着桌面客户端、服务端转码集群以及漫长的素材上传。Timeline Studio 尝试了另一条路线:以浏览器为完整运行环境,把多轨时间线、ONNX 端侧推理、Canvas 合成、离线音频混音和 WebCodecs 编码连接成一个可用的 AI 视频编辑器。本文结合项目实践,拆解这套架构为何成立、最难的三个工程问题,以及我们如何处理预览与导出一致性、模型缓存、时间线精度和兼容回退
  • 发表了文章 2026-08-07

    如何用 Agent Skill 构建一套可编辑、可验证的 AI 视频生产流水线

  • 发表了文章 2026-08-06

    浏览器端多语言音色迁移工程实践:OpenVoice V2 FP16 ONNX、WebGPU 与 ModelScope 模型分发

  • 发表了文章 2026-08-05

    Timeline Studio 重大升级:安装一个 Skill,让 AI 在一杯咖啡的时间里完成视频剪辑,并交付可编辑工程

  • 发表了文章 2026-08-05

    在浏览器中实现电影级景深:Depth Anything V2 Small、WebGPU 与本地视频编辑实践

  • 发表了文章 2026-08-04

    浏览器端多语种 AI 配音卡在 86%?从 WebGPU、WASM 到模型缓存治理的完整修复实践

  • 发表了文章 2026-08-03

    浏览器端 AI 视频实验:结合目标检测与光流实现群体运动追踪

  • 发表了文章 2026-07-31

    把视频换脸放进浏览器:一次 WebGPU 推理链路的工程化实践

  • 发表了文章 2026-07-30

    纯前端 AI 视频特效实践:在浏览器中完成实物识别与动态描边

  • 发表了文章 2026-07-29

    浏览器端 AI 视频人物描边实践:MODNet、SlimSAM、MediaPipe 与光流融合方案

  • 发表了文章 2026-07-28

    在浏览器中实现视频四倍高清修复:NanoVSR 与 WebGPU 实战

  • 发表了文章 2026-07-27

    从模型 Demo 到剪辑产品:基于 MI-GAN、ONNX 与 WebGPU 实现浏览器本地视频去水印

  • 发表了文章 2026-07-24

    浏览器视频编辑器如何兼容 MKV?LibAV.js、WebCodecs 与 FFmpeg.wasm 实践

  • 发表了文章 2026-07-23

    从 ffmpeg.wasm 到 WebCodecs:浏览器视频编辑器导出架构的演进与实践

  • 发表了文章 2026-07-21

    为浏览器音视频编辑器开发 Agent Skill,实现 AI 自动化剪辑自测

  • 发表了文章 2026-07-21

    把 AI 视频剪辑搬进浏览器:Timeline Studio 的本地优先架构与工程实践

正在加载, 请稍后...
滑动查看更多
正在加载, 请稍后...
暂无更多信息
正在加载, 请稍后...
暂无更多信息