API

首页 标签 API
# API #
关注
107109内容
|
4天前
|
DeepSeek V4.1‑Flash 内测实战解析:接口调试、工具集成、踩坑总结与完整代码教程
开发者可以通过curl、Python SDK直接调用API完成文本与图片解析;而桌面AI客户端工具会存在元配置不同步的坑点,官方Harness客户端会出现UI层面提示不支持图片,并不是模型底层能力缺失,更换第三方自定义工具并且手动勾选图片输入类型即可体验识图能力。
AnyJev护城河在校准
开源项目AnyJev六天复刻闭源决策模型Jev接口,印证协议易复制;真正壁垒在于“校准”——让模型概率匹配真实频率。经三级校准,Qwen3-8B自动决策率从7.7%跃升至52.0%,证明:说话算数,比会说话更难、更值钱。
|
4天前
| |
从 AI 图表初稿到技术文档:Mermaid 校验、修复与导出实践
大模型可以根据自然语言快速生成 Mermaid 流程图和时序图,但生成结果并不一定能够直接放进 README、技术方案或接口文档。除了语法错误,还可能存在参与者不一致、异常分支缺失、节点命名过长以及图表类型选择不当等问题。 本文以一个订单接口调用流程为例,介绍如何对 AI 生成的 Mermaid 图进行预览、业务校验、语法修复和文档交付,并整理一份可复用的发布前检查清单。
# 0.8MB 跑通 Qwen|第 19-3 篇:视频帧与媒体模块——推理引擎默认不启用的 H.264 独立模块
本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型(2B/8B/30B),在RK3588上实测。视频支持分两层:帧序列路径已落地;MP4/H.264解码为独立未完成模块,API清晰、默认不构建、不演示未验证功能,体现严谨工程边界。(239字)
0.8MB 跑通 Qwen|第 20-2 篇:推理引擎的路由与自研最小 JSON
本系列《0.8MB跑通Qwen》用纯C手搓零依赖推理引擎,适配Qwen3-VL多模型,在RK3588(aarch64)实测通过。核心含strcmp路由表与自研轻量JSON解析器,精准拦截非法请求(如`msgs`→400),严守兼容边界,代码精简可控,专注教学与边缘部署。(239字)
|
4天前
|
【第三部分:第一个 Agent 应用】14. 开发一个完整的企业知识助手:从 RAG 到 Agent
本文以企业知识助手为综合实践,整合 RAG、Agentic RAG、Tool Calling、MCP、Memory、State、Structured Output、权限控制、引用溯源与 Trace/Eval 等能力,说明企业知识助手如何从“知识库问答”升级为能够连接业务系统、理解上下文并执行真实任务的 Enterprise Agent。文章重点介绍权限感知检索、Metadata、业务 Tool、长期记忆、人工确认和可观测评估等生产级能力,并结合 BaseMetas EKA 架构说明企业知识与 Agent 如何协同落地。
接入多家模型供应商之后,我总结的 7 条铁律
AI 应用接了第二家模型供应商之后,事情就不再是"多加一个接口"那么简单——不是调不通,是钱会算错。这篇讲我们定下来的 7 条规则:幂等键、任务落库时机、备用线路的切换边界、退款、凭据隔离、付款来源固化、密钥不进浏览器。
|
4天前
|
阿里云百炼自研大模型手册:Qwen、万相、HappyHorse、CosyVoice 能力梳理
阿里云自研AI模型涵盖文本、视觉、语音、音视频及向量等全模态,以通义千问Qwen系列为核心,包括Qwen3.8-Max、Qwen-VL、通义万相、CosyVoice等,均通过百炼平台提供API服务。
Python调用万能识别接口,英文数字、点选和问答
同一套接口做万能识别。英文数字、问答、点选分别对应三种 question。图片转成 base64 后 POST JSON,errCode 为 0 才算成功,文本或坐标在 msg。
从零打通 MCP 访问创世虚拟世界CRM的 3D 数据,我搭了一个可直接调用的演示站
作者把创世虚拟世界CRM(创世Genesis,自部署 3D 虚拟世界)的 AI Agent 通道(HTTP + WebSocket + JSON 约定)封装成 8 个 MCP 工具(discover/enter/observe/say/walk_to/follow/chat_history/leave),stdio 版已上 npm 与官方 MCP Registry,随后为零安装补了 Streamable HTTP 远端点。本文实录打通过程:stdout 纯净性、initialize 必填字段、Mixed Content 协议陷阱、官方 SDK 拖入 34 包后的零依赖重写、GET 400 被目
免费试用