Python调用万能识别接口,英文数字、点选和问答

简介: 同一套接口做万能识别。英文数字、问答、点选分别对应三种 question。图片转成 base64 后 POST JSON,errCode 为 0 才算成功,文本或坐标在 msg。

同一套接口就能做万能识别,不用换地址。

英文和数字用 question「识别图中文本」,返回的 msg 是图里的字母或数字。问答用「回答图中问题」,msg 是答案。点选用「框出正确位置」,msg 是坐标。本地图片先转成 base64,不要带 data:image 前缀,再 POST JSON。keyCode 从控制台复制。免费模型用来先测通,正式调用换成普通模型。

import base64
import requests

API = "http://ai.xinyuocr.xyz/api/qrcode/predict"
# question:
# 识别图中文本  英文和数字
# 回答图中问题  问答
# 框出正确位置  点选,坐标在 msg
# modelName: 免费模型先测,普通模型正式用
# base64 不要带 data:image/...;base64, 前缀
# 控制台:ai.xinyuocr.xyz 登录后复制 keyCode

def predict(image_path, key_code, question="识别图中文本", model_name="普通模型"):
    with open(image_path, "rb") as f:
        image_b64 = base64.b64encode(f.read()).decode()
    payload = {
   
        "base64Image": image_b64,
        "modelName": model_name,
        "keyCode": key_code,
        "question": question,
    }
    data = requests.post(API, json=payload, timeout=60).json()
    if data.get("errCode") != 0:
        return data.get("err")
    return data.get("msg")

if __name__ == "__main__":
    print(predict("demo.png", "YOUR_KEYCODE"))

errCode 为 0 才算成功,文本或坐标都在 msg,失败原因在 err。返回 2003 时先等一会再请求,不要立刻重试。查余额走同一主机的 /api/qrcode/balance?keyCode=YOUR_KEYCODE,用 success 判断,付费余额看 money,积分看 freeMoney。

相关文章
|
1天前
|
人工智能 开发者
阿里云Token Plan个人版:四个版本区别对比、费用价格、Credits计费用量及问题解答FAQ
阿里云Token Plan个人版含Lite/ Essential/Standard/Pro四档:Lite(¥39,1.15万Credits)适合轻量使用;Essential(¥79)用量翻倍;Standard(¥139,推荐)起赠Harness权益;Pro(¥499)适配高并发与海量调用。权益、额度、并发数逐级提升,详见官网。
|
1天前
|
人工智能 自然语言处理 文字识别
盘点阿里云自研模型|Qwen、通义万相、HappyHorse 等AI模型清单
阿里云自研AI模型涵盖文本、图像、视频、语音及全模态,以通义千问Qwen系列为核心,包括Qwen3.8-Max、Qwen-VL-Plus、通义万相、CosyVoice等数十款专业模型,统一通过百炼平台提供API服务。(239字)
61 1
|
1天前
|
缓存 C语言 C++
0.8MB 跑通 Qwen|第 9-3 篇:推理引擎的 q8 KV 精度对照——量化进注意力,输出差多少
本系列《0.8MB跑通Qwen》手搓零依赖纯C推理引擎,适配Qwen3-VL多尺寸模型,在RK3588上实测q8 KV量化:输出误差仅≈0.01,端到端PPL损失<1%,带宽降为52%,精度与效率达成教科书级平衡。(239字)
|
1天前
|
NoSQL 调度 C++
0.8MB 跑通 Qwen|第 14-3 篇:推理引擎的批处理正确性边界——margin 0.71 vs 0.032
本篇精读Qwen3-VL系列推理引擎的“位级一致性”本质:批量与串行输出大多逐字节一致,但因浮点累加顺序差异,在near-tie(近平局)场景下存在翻盘风险——margin(如0.71 vs 0.032)决定是否一致。这是工程结果,非数学承诺。
|
1天前
0.8MB 跑通 Qwen|第 13-1 篇:推理引擎的 decode 为什么慢——逐词、带宽、不可并行
本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型,在RK3588上实测decode瓶颈——逐词生成、内存带宽受限、无法并行。直击每词92ms硬地板,为推测解码(speculative decode)铺路,实现“一次前向多产出”。
|
1天前
|
缓存 安全 API
0.8MB 跑通 Qwen|第 11-2 篇:大模型推理的前缀缓存键——怎么知道"两轮一样"?
本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,实测RK3588上高效运行Qwen3-VL多模态模型。本文详解前缀缓存核心机制:以token序列最长公共前缀(LCP)为键,实现KV复用;并揭示“完全相同反不复用”的安全设计——确保prefill刷新logits,杜绝空响应。
|
1天前
|
弹性计算 人工智能 安全
阿里云 ECS 上部署 HelloAGENTS:Node 版本、出网与多宿主接入
HelloAGENTS 是面向 AI 编程 CLI 的工作流增强工具,支持 Claude、Gemini 等主流引擎,提供技能管理、项目知识持久化、安全配置写入与可恢复执行。基于 Node.js 22 LTS,需 ECS 环境部署,强调快照回滚与严格安全管控。(239字)
20 0
|
1天前
|
弹性计算 人工智能 Java
2026年10月最新!阿里云10款热门服务器配置排行榜:含价格、带宽、适用场景全解析
2026年10月阿里云服务器最新排行榜,涵盖轻量应用、ECS及GPU机型,按预算分三梯队(百元入门至万元AI算力),详解10款高性价比配置,含价格、适用场景与避坑指南,助你精准选型。
47 0
|
1天前
|
缓存 调度
聊天记录越长越贵:我的上下文压缩分了七层
Agent 对话越长 token 越贵、模型越迷糊,但压缩本身也有成本。本文附我开源项目 codeAgent 的真实源码:compress_if_needed 分层压缩总调度——从免费的时间清理、L1 裁中间、L2 单条折叠,到最贵的 L4 LLM 摘要,共七层流水线各管一档;L4 还带四套保命机制(9 段式结构化 prompt、PTL 重试、熔断器、预提取记忆替代),摘要请求本身还设计成能命中前缀缓存。
29 0
|
7天前
|
人工智能 缓存 API
阿里云Qwen3.8-Flash大模型详细介绍:模型能力、功能、收费标准、内置工具及使用教程参考
本文将从模型定位、核心能力、适用场景、收费标准、内置工具、调用教程、API参考以及最新活动与优惠等方面,对Qwen3.8-Flash进行系统性介绍。需要说明的是,模型版本、上下文长度、速率限制、价格策略和工具支持情况可能随阿里云百炼平台持续更新而调整,最终应以百炼控制台、模型详情页、API返回结果和官方计费页面实时展示为准。

热门文章

最新文章