内存技术

首页 标签 内存技术
# 内存技术 #
关注
11005内容
|
13天前
|
阿里云灵骏 GP9A 超节点详解:自研真武 M890 芯片、万亿参数 MoE 推理规格对比
阿里云灵骏GP9A超节点实例,基于自研真武M890P芯片,64卡全互联架构,提供9216GB显存、1024核CPU与18.4TB内存,支持MXFP4/FP8/BF16等多精度,原生兼容主流AI框架,专为万亿参数MoE模型训推、自动驾驶、搜推广及多模态场景优化。阿里云智能计算灵骏官网:https://t.aliyun.com/U/WjA3cK
|
13天前
|
DeepSeek-V4全解析:Flash与Pro双版本核心差异、计费规则及API实战调用指南
DeepSeek-V4作为新一代大语言模型,推出Flash与Pro两大核心版本,以差异化定位覆盖从轻量化高频交互到复杂深度推理的全场景需求。两大版本均标配百万级上下文能力,在架构设计、性能表现、成本计费上形成清晰互补,同时提供兼容主流格式的API接口,大幅降低开发者接入门槛。本文将从核心架构、性能差异、计费规则、API实战调用四大维度,全面解析DeepSeek-V4双版本,助力开发者精准选型与高效落地。
|
14天前
| |
来自: Qoder CN
浏览器端多语言音色迁移工程实践:OpenVoice V2 FP16 ONNX、WebGPU 与 ModelScope 模型分发
Timeline Studio 是一款浏览器端多语言声音克隆与音色迁移工具,基于 OpenVoice V2 FP16 ONNX 模型,集成 ONNX Runtime Web、WebGPU/WASM 加速、双源模型分发(ModelScope/HF)、Cache Storage 缓存及 IndexedDB 声音档案。支持中文等11种语言,实现TTS语音生成+音色独立迁移,全程本地处理,无需服务器依赖。(239字)
|
14天前
|
阿里云百炼AI模型前缀续写是什么?Partial Mode工作原理及支持模型全解析
前缀续写(Partial Mode)指模型基于指定前缀无缝续生成内容。需将messages末条消息role设为assistant、content填前缀,并设"partial":true。支持Qwen-Max/Plus/Flash/Coder/VL/Turbo及Qwen3.5等系列(非思考模式)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
阿里云千问模型前缀续写是什么?Partial Mode工作原理介绍
前缀续写(Partial Mode)指模型基于指定前缀无缝续生成内容。需将messages中最后一条设为assistant角色,content填前缀,并置"partial":true。支持Qwen-Max、Plus、Flash、Coder、VL、Turbo及Qwen3.5等系列(非思考模式)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
15天前
|
买了 Codex Max 20 Pro,我的主力却换成了 DeepSeek-V4-Flash——因为它快得不可思议
花大价钱订阅的顶级编码服务,最终输给了一个"快"字。两张真实截图,说明白这个选择![封面:AI 芯片闪电冲刺,甩开沉重的旧时代](https://oscimg.oschina.net/oscnet/upb32a147db61bdd588f9a17318139cf97237.png)我买了 Code
|
16天前
|
合肥国资“封神”的长鑫故事,其他城市能复制吗?答案可能在两把“钥匙”里
张顾问,创新顾问,专注 bridging 老板与研发团队。本文以长鑫科技万亿浮盈为引,剖析“合肥模式”本质——非豪赌,而在“懂行”与“赋能”。提出设计思考(找准真需求)与TRIZ(突破技术瓶颈)两大方法论,助力国资基金从财务投资者升级为产业合伙人。(239字)
|
16天前
|
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
16天前
| |
做文档解析的人该看看 Infinity-Parser2:一个模型把版面、表格、公式、图表全端了
Infinity-Parser2 是一款端到端多模态文档解析大模型,融合可控数据合成与多任务联合强化学习(GRPO),开源500万双语数据及Flash/Pro双版本模型,支持精准解析文本、表格、公式、图表等,显著提升RAG与文档智能效果。(239字)
免费试用