文字识别

首页 标签 文字识别
# 文字识别 #
关注
6225内容
阿里云AI产品免费试用活动:超30款AI产品免费试用,开通百炼享1亿+大模型 tokens 限免体验
阿里云AI产品免费试用活动汇聚超30款AI产品及1亿+大模型Tokens,面向个人开发者与企业用户开放。核心权益包括:免费开通百炼平台即享1亿+Tokens及100+Agent模板,通义千问-Image免费体验100张;PAI平台支持Qwen全系列模型一键部署,无需写代码;GPU云服务器提供96GB显存、900GB/s NVLink高性能算力,支持vLLM快速部署大模型;另有10+款NLP产品和13款视觉智能产品免费试用,最长12个月,覆盖文本分析、OCR、人脸识别等场景。
|
2月前
|
多语言交通标识目标检测数据集:34类别 | 目标检测
本数据集含5000张真实道路图像,覆盖英文/阿拉伯语双语种、34类交通标识与信号灯(含20档细粒度限速标识),支持YOLO等主流模型,专为自动驾驶多语种感知与高精度检测研发设计。(239字)
|
2月前
| |
离谱!我以为 OCR 还在一页页抠字,结果百度 1.2 万 Star Unlimited-OCR 直接把长文档一口气读完
百度开源 Unlimited-OCR,把图片、长文档、多页 PDF 这类非结构化资料推进到 Markdown、表格和可检索文本,适合 RAG、知识库和 Agent 文档入口。
|
2月前
| |
离谱!我以为 OCR 还在一页页抠字,结果百度 1.2 万 Star Unlimited-OCR 直接把长文档一口气读完
百度开源 Unlimited-OCR,把图片、长文档、多页 PDF 这类非结构化资料推进到 Markdown、表格和可检索文本,适合 RAG、知识库和 Agent 文档入口。
大模型训练语料和知识库内容安全治理实践:企业落地要看哪些环节?
企业做大模型训练语料和知识库内容安全治理,建议把安全能力前置到数据入库、知识切片、检索召回、模型生成和运营复盘全流程。重点治理版权、隐私、违规内容、知识库投毒、Prompt Injection、过期口径和审计留痕问题,避免模型在生产环境中输出不合规、不准确或不可追溯的答案。
终端敏感内容实时检测与静态文件审查的技术架构研究——基于互成软件内容安全审计引擎的深度解析
互成软件内容安全审计引擎,融合实时行为检测(窗口标题、邮件、聊天等7类通道)与静态文件扫描,支持精确/模糊/语义三级敏感词识别,覆盖200+文件格式,具备OCR、GPU加速、断点续扫等能力,并通过审查任务闭环实现从发现到处置的全周期治理。(239字)
|
2月前
|
阿里云OCR文字识别!Java代码实现票据、证件高精度识别
阿里云OCR识别精度高、场景广,支持身份证、票据、文档等多类型文字提取,准确率远超开源模型。文末附Java完整对接代码,含AK/SK配置与URL识别示例,开箱即用,助力企业办公自动化与智能录入。(239字)
阿里云百炼Qwen3.7模型怎么选?Qwen3.7-Max、Qwen3.7-Plus、Qwen3.7-Flash、Qwen-VL区别与选择参考
本文针对阿里云百炼平台四款核心千问3.7系列模型,提供了清晰的选型指南与优惠解读。旗舰款Qwen3.7-Max主打长链路推理与复杂代码任务,限时5折;均衡款Qwen3.7-Plus为全能多模态选手,限时8折;轻量款Qwen3.6-Flash适配高并发低延迟场景,成本最低;Qwen-VL系列则聚焦纯视觉理解与工业质检等专用场景。用户可通过Token Plan包季订阅叠加折扣,全模型通用抵扣最低至4.5折,结合错峰调用进一步压缩成本,实现不同业务场景下的最优AI投入产出比。
|
3月前
| |
阿里云千问Qwen 3.7 Plus与Max全面测评:从参数、能力到性价比的深度分析
阿里云Qwen 3.7系列包含Plus与Max两款核心模型,二者共享百万级上下文窗口与长时自治执行能力,但在模态支持、底层架构、推理性能与计费标准上存在本质差异,分别面向纯文本极致推理与多模态通用场景。通过实测对比两款模型的基础参数、文本能力、多模态能力、推理速度与成本效益,可清晰区分其适用边界,帮助用户根据业务需求精准选型,在保障性能的同时实现成本最优。以下从核心定位、基础参数、能力实测、性价比分析、场景选型五大维度,全面解析两款模型的差异与选型逻辑。
|
3月前
|
RPA 怎么对接 AI 大模型?2026 年企业级实战方案全解析
RPA专注执行却缺乏理解力,AI大模型补足语义理解、图像识别与智能决策短板。本文详解API直连、本地嵌入、Agent智能体三大对接方案,覆盖安全、成本、易用性与落地路径,助力企业迈向认知自动化。
免费试用