视觉智能开放平台

首页 标签 视觉智能开放平台
|
1天前
| |
来自: 视觉智能
大空间AR地图更新怎么避免现场错版:一份发布清单与校验脚本
用一份不含密钥的发布清单绑定Block、定位库、客户端、内容包和回滚目标,并提供可放入CI的Python校验脚本。
|
1天前
| |
来自: 视觉智能
Unity接入EasyAR Mega的发布前自检:用Editor脚本排查五类配置问题
提供一个可直接放入Unity项目的Editor自检脚本,排查EasyAR Mega接入中的插件包、Android构建配置、License与包名、服务权限及Block层级问题。
|
3天前
| |
来自: 视觉智能
企业Agent进入投标协作:如何设计可追溯、可恢复的人工交接点
企业Agent进入投标长任务后,需要记录输入版本、原文依据、当前产出、风险、责任人与人工放行状态,才能实现可追溯、可恢复的协作。
|
3天前
| |
来自: 视觉智能
AR眼镜进入餐饮服务现场:如何设计一套可复现的场景测试
基于澳门旅游大学AR智慧餐饮研究,拆解技术可靠性、任务表现、人因和运营四层测试方法。
|
4天前
| |
来自: 视觉智能
大空间AR导航如何落地:VPS定位、地图更新与AR眼镜端的工程闭环
本文从地图生产、VPS首次定位、终端连续跟踪、路线与内容锚定、AR眼镜端约束以及地图更新运营等方面,拆解大空间AR导航的完整工程链路。
|
4天前
| |
来自: 视觉智能
VPS定位系统的离线评测设计:从首次定位到地图更新回归
本文给出一套VPS定位系统的离线评测方法,涵盖版本化输入、分层样本、指标矩阵、失败分类、地图更新回归以及线上观测闭环。
AI 帮你改了 20 个文件,最后 3 个忘了改——长任务为什么总是"差一口气"?
AI长任务常因“失忆”、误删、静默跳过、截断编造等问题翻车。UseIO通过Plan驱动拆解、检查点回滚、三级安全门控、结构化错误处理与交付前四点复查,构建工程级可靠性防护链,显著提升多文件重构等复杂任务的完成率与稳定性。(239字)
|
10天前
| |
来自: 视觉智能
从 3.94 亿页书里捞出 2262 万个视觉元素
本研究提出轻量级视觉元素提取管线,面向哈佛图书馆数亿页古籍扫描,实现插图、乐谱、图表等五类非文本元素的检测、分类、去重与可选描述,最终释放2262万高质量视觉crop,兼顾精度、效率与可审计性。(239字)
|
12天前
| |
来自: 视觉智能
把 8300 万个报纸版面单元变成可查询对象
该管线首创“crop-first”范式,将历史报纸页图切分为结构化单元,每个crop附带OCR文本、类型、语言、实体、主题、阅读顺序及向量,支持精准过滤、重建与审计,大幅提升数字人文研究可用性。(239字)
|
13天前
| |
来自: 视觉智能
ArmorOCR:模型读出了隐藏文字,但它知道自己在读哪里吗?
ArmorOCR提出“接地式对抗视觉感知”,首创AdvSpot基准,要求模型同步定位文本区域并准确识别内容。通过两阶段训练(特权观察自蒸馏+组内强化学习),将8B模型AdvSpot准确率从31.2%提升至55.7%,推动对抗OCR从“能否读出”迈向“能否证真”。
免费试用