Qwen3 API 次元门:文本生成体验第二期

简介: 本文介绍阿里云Qwen3.8-27b模型的两大核心能力:结构化输出(支持JSON等格式,确保机器可解析)与前缀续写(Partial Mode),适用于AI智能体、聊天机器人及文档处理场景。提供OpenAI兼容API调用方式、密钥获取及免费额度信息。(240字)

前言

为AI智能体、聊天机器人、文档处理等场景选择合适的文本生成模型。今天主要体验:结构化输出、前缀续写。

 参考信息


调用方式

  • OpenAI兼容-Chat Completions API,无状态对话补全,行业事实标准,适合简单对话机器人、需要高度控制或兼容旧代码的项目。
  • OpenAI兼容-Responses API,面向智能体(Agent)的新一代接口,适合构建复杂的AI智能体、需要长期记忆和自动化工具编排的应用。
  • DashScope (原生API),阿里云原生模型调用接口(类似SDK),适合深度使用阿里云百炼平台,需要访问平台特有功能或参数。


这次体验主要是使用OpenAI兼容-Chat Completions API的方式。(主要是token消耗低)

结构化输出

1.文本处理

入参

{
  "model": "qwen3.8-27b",
  "messages": [
    {
      "role": "system",
      "content": "请抽取用户的姓名与年龄信息,以JSON格式返回"
    },
    {
      "role": "user",
      "content": "大家好,我叫刘五,今年34岁,邮箱是liuwu@example.com,平时喜欢打篮球和旅游"
    }
  ],
  "temperature": 0.1,
  "top_p": 0.5,
  "max_tokens": 2048,
  "thinking_budget": 4096,
  "stream": true
}

效果

image.png

2.图像处理

入参

{
  "model": "qwen3.8-27b",
  "messages": [
    {
      "role": "system",
      "content": "You are a helpful assistant."
    },
    {
      "role": "user",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "http://duguang-labelling.oss-cn-shanghai.aliyuncs.com/demo_ocr/receipt_zh_demo.jpg"
          }
        },
        {
          "type": "text",
          "text": "提取图中ticket(数组类型,包括 travel_date、trains、seat_num、arrival_site、price)和 invoice 的信息(数组类型,包括 invoice_code 和 invoice_number ),请输出包含 ticket 和 invoice 数组的JSON"
        }
      ]
    }
  ],
  "temperature": 0.1,
  "top_p": 0.5,
  "max_tokens": 2048,
  "thinking_budget": 4096,
  "stream": true
}

图片

image.png

效果

image.png

  • 大模型结构化输出:一种“输出控制能力”,让模型按指定格式(JSON、XML、SQL、表格等)返回内容,便于程序解析、校验和集成。核心是格式可靠、字段可解析。


前缀续写(Partial Mode)

1.文本续写

入参

{
  "model": "qwen3.8-27b",
  "messages": [
    {
      "role": "user",
      "content": "请补全这个斐波那契函数,勿添加其它内容"
    },
    {
      "role": "assistant",
      "content": "def calculate_fibonacci(n):\n    if n <= 1:\n        return n\n    else:",
      "partial": true
    }
  ],
  "temperature": 0.1,
  "top_p": 0.5,
  "max_tokens": 2048,
  "thinking_budget": 4096,
  "stream": true
}

效果

image.png

官方效果

image.png

结果内容有所差异,但正确性是一致的。

2.看图续写

入参

{
  "model": "qwen3.8-27b",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "https://img.alicdn.com/imgextra/i3/O1CN01zFX2Bs1Q0f9pESgPC_!!6000000001914-2-tps-450-450.png"
          }
        },
        {
          "type": "text",
          "text": "我要发社交媒体,请帮我想一下文案。"
        }
      ]
    },
    {
      "role": "assistant",
      "content": "今天发现了一家宝藏咖啡馆",
      "partial": true
    }
  ],
  "temperature": 0.1,
  "top_p": 0.5,
  "max_tokens": 2048,
  "thinking_budget": 4096,
  "stream": true
}

图片

image.png

效果

image.png

总结

  • 结构化输出:控制“最终输出长什么样”,保证机器可解析。
  • 前缀续写:控制“模型从哪里开始写”,让模型接着你给的开头继续生成。
相关文章
|
8天前
|
人工智能 JSON API
全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程
全网爆火的 Jev 模型是什么?有什么用?怎么使用?怎么接入 AI 编程工具?效果真的好么?傻子可懂的 Jev 保姆级实战教程 + 项目实战测评来啦
7394 12
|
6天前
|
人工智能 测试技术 API
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
Jev是TypeSafe AI推出的“系统一模型”,不生成文本,专做毫秒级结构化决策:Choice(多选)、Score(打分)、Noul(是非概率)。响应快193倍、成本低444倍,适合工单路由、内容审核、测试定级等高频判断场景。
1547 4
最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
|
7天前
|
人工智能 并行计算 PyTorch
秋叶 ComfyUI 2026 整合包 v3.2 完整部署教程:Python 3.13 + Torch 2.13 全栈升级
秋叶aaaki ComfyUI 2026年8月整合包v3.2正式发布!全面升级Python 3.13.11、PyTorch 2.13.0+cu130及ComfyUI v0.30.2,原生支持MiniMax H3、Wan 2.2、Qwen-Image-2.1等2026主流音视频/图像模型,解压即用,无需环境配置。
1016 8
|
3天前
|
人工智能 JavaScript 芯片
DeepSeek 官方偷偷上传 Harness 桌面端安装包,我已经用上了。。附最新下载地址
DeepSeek Harness 官方的桌面端安装包被网友扒出来了,2 分钟讲明白如何使用,体验如何,适合作为 AI 编程工具么?附最新 Windows 和 Mac 双端的下载地址
1217 1
|
20天前
|
人工智能 自然语言处理 安全
阿里云千问办公 QwenWork详细介绍:产品核心能力、典型场景、价格及常见问题解答
千问办公是阿里云推出的一站式AI办公平台,主打"不止于对话,更注重交付",依托通义千问旗舰大模型,用户一句话即可完成数据分析、PPT生成、视频剪辑等复杂任务,直接输出可用成果。产品深度打通钉钉生态与企业OA,覆盖桌面端、网页端,提供企业标准版198元/人/月等多档订阅方案,新用户注册即赠2000积分,适配工程师、HR、财务等多职业办公场景,成为能动手干活的"全能AI同事"。
3582 10
|
15天前
|
缓存 IDE Java
【保姆级】Android Studio下载、安装和汉化教程(2026最新)
Android Studio 是 Google 官方推出的免费 Android 应用开发集成环境,基于 IntelliJ IDEA,内置模拟器、调试器、性能分析及 Compose 界面工具,功能全面,文档丰富,是安卓开发首选工具。(239字)
1618 1
|
4天前
|
编解码 缓存 PyTorch
16G 显卡能跑 Qwen-Image 2.1 吗?
9月20日,阿里Qwen开源Qwen-Image-2.1:7B DiT图像模型+8B文本编码器+VAE,单模型支持文生图与图像编辑,原生输出2K PNG(含Alpha通道),支持10张参考图。在自建Qwen-Image-Bench达60.28分(开源模型第一),GenAI Showdown文生图排名7/15。16G显存可跑1024×1024(需INT8量化+ComfyUI优化),但2K需24G以上。注意其Qwen Research License限非商业用途。
512 1
|
5天前
|
人工智能 编解码 并行计算
MiniMax-H3 一键整合包技术文档:8G 显存运行 AI 漫剧制作 —— 角色替换 / 动作迁移 / 文图生视频部署与调参指南
MiniMax H3 是 MiniMax 开源的全模态视频生成模型,支持文/图/音/视多条件输入,输出最高2K、15秒带双声道音频视频。本文档详述其Int8量化版在8GB显存下的本地一键部署、三段式工作流(EDIT/REPLACE/CONTINUE)、参数调优及常见问题排查。(239字)

热门文章

最新文章