|
9小时前
|
机器学习/深度学习 缓存 前端开发
|

讨论下llm的prefix caching机制

本文探讨LLM推理中Prefix Caching机制的原理与实践:解释为何将动态内容(如React循环中的tool call结果)放在system prompt会破坏缓存命中,导致成本激增;强调应将变量部分置于user prompt末尾,以最大化复用system+固定user前缀的KV缓存,显著降本提效

34 6
|
1天前
|
人工智能 自然语言处理 前端开发
|

写了10万行代码,却毁在配色上?这套指令让后端直男秒变设计总监

这是一篇专为后端及全栈开发者定制的实用指南,旨在解决开发者“代码强但审美弱”的痛点。文章提供了一套核心AI指令,能将DeepSeek等AI变成专业UI设计顾问,快速生成符合大厂规范(Design Token)的配色体系。通过一个后台管理系统的实战案例,演示了如何用AI将“土味”界面瞬间升级为专业级UI,让开发者无需学习设计理论也能搞定高颜值配色。

46 2
|
2天前
|
存储 安全 API
|

微调与安全隐私 —— 大模型定制化过程中的风险防控指南

本文详解大模型微调中的安全隐私风险与防控策略,涵盖数据泄露、模型投毒、恶意查询等典型威胁,提出数据最小化、隐私-性能平衡、全生命周期防控三大原则,并提供脱敏处理、联邦学习、输出过滤等可落地的全流程防护方案,助力安全合规地实现模型定制化。(239字)

53 6
|
2天前
|
机器学习/深度学习 自然语言处理 数据可视化
|

PPO 实战 —— 无代码落地大模型偏好优化全流程

本文详解PPO微调实战:零代码、5步落地——从数据准备、偏好标注、奖励模型训练到策略优化与效果验证,全程可视化操作。依托低代码平台,无需编程与GPU,100–200条对话样本即可让大模型输出更简洁、口语化,适配客服、聊天等场景。(239字)

67 7
|
2天前
|
存储 NoSQL 数据库
|

什么是向量数据库 —— 零基础也能懂的核心概念

本文用生活化语言零基础讲清向量数据库:它本质是“快速找相似信息”的工具,将文本/图片等转为数字向量,通过相似度检索赋能RAG、推荐等场景,解决大模型幻觉、知识滞后难题,并附实操入口助快速上手。(239字)

52 2
|
2天前
|
存储 数据采集 安全
|

微调与安全隐私 —— 大模型落地的合规必修课

本文聚焦大模型微调中的安全与隐私合规风险,系统剖析数据集、训练、输出三大环节的典型隐患(如敏感信息泄露、版权侵权、模型反演等),提出“脱敏+加密+过滤”全流程防护方案,并推荐合规认证平台与实操工具,助力企业实现技术落地与法律合规双保障。(239字)

52 9
|
2天前
|
机器学习/深度学习 调度
|

大模型微调参数设置 —— 新手必看的核心参数与优化技巧

本文系统解析大模型微调核心参数(Epochs、Learning Rate、Batch Size等),涵盖SFT/PPO/DPO场景,提供新手友好默认值、作用解读与实用调优技巧,强调“先跑通默认值、再针对性优化”原则,助你避开过拟合/欠拟合陷阱,零代码快速提升微调效果。

60 4
|
2天前
|
人工智能 自然语言处理 数据可视化
|

OoderAI BridgeCode 产品白皮书——全方位赋能企业编程升级

ooderAI BridgeCode 是面向企业的AI确定性代码框架解决方案,通过自学习能力生成专属代码、无缝衔接新旧系统、优化AI时代工作流,并提供128个开源可视化组件。开源无绑定、Web化易用,助力企业降本增效、灵活转型。(239字)

346 1
|
2天前
|
存储 人工智能 资源调度
|

迈向AI4S 2.0,上海AI实验室开源书生1T Moe 科学大模型Intern-S1-Pro!

2月4日,上海AI实验室开源万亿参数科学多模态大模型Intern-S1-Pro,全球开源社区中规模最大的AI4S模型。基于SAGE“通专融合”架构与MoE设计,融合傅里叶位置编码与创新路由机制,科学推理达奥赛金牌水平,综合能力稳居国际第一梯队,赋能AGI for Science范式革命。(239字)

65 3
|
3天前
|
SQL 人工智能 分布式计算
|

MaxCompute SQL AI 实践:电商用户评论情感洞察与关键词提取

本实践基于阿里云MaxCompute SQL AI功能,仅用SQL即可完成电商评论的情感分类(正/负/中性)与关键词提取,无需Python开发。内置模型开箱即用,业务人员零门槛上手,10万条评论分析仅需数秒,显著提升非结构化文本洞察效率。(239字)

44 2
|
3天前
|
机器学习/深度学习 监控 算法
|

PPO与DPO:大模型对齐的两大核心算法,差异与选型全解析

本文深度解析大模型对齐核心算法PPO与DPO:PPO基于RLHF框架,需训练奖励模型,对齐精准、稳定性强,但流程繁琐、资源消耗大;DPO跳过奖励建模,直接优化偏好,轻量高效、易上手。对比原理、流程、优劣及适用场景,助你科学选型,提升对齐效率。

48 1
|
3天前
|
机器学习/深度学习 自然语言处理 API
|

Qwen3-Coder-Next开源!推动小型混合模型在智能体编程上的边界

Qwen团队开源Qwen3-Coder-Next:基于Qwen3-Next-80B的轻量级编程智能体模型,采用混合注意力+MoE架构,通过可执行任务合成与强化学习训练,在SWE-Bench Verified达70%+,以仅3B激活参数媲美10–20倍大模型,兼顾高性能与低成本部署。(239字)

217 3
|
3天前
|
机器学习/深度学习 JSON 数据可视化
|

Diy你的蛋白质_AlphaFold3推理

Z_biosketch推出Local AF3进阶推理平台,突破官方限制:支持任意配体/修饰、自定义模板上传、深度MSA控制及轻量交互可视化。首期聚焦“Fold & Validate”验证闭环,为未来“画蛋白”BioSketch Studio奠基,推动蛋白质设计民主化。(239字)

42 2
|
3天前
|
人工智能 小程序 定位技术
|

花3万设计的LOGO,为什么客户连名字都记不住?

分享一套LOGO创意AI指令,通过系统化品牌分析和多方案创意,帮助创业者避免LOGO设计常见陷阱,构建专业品牌视觉识别方案。

64 8
|
4天前
|
机器学习/深度学习 自然语言处理 算法
|

RAG 文档切分攻略:做好这步,检索精度提升 50%

本文深度解析RAG系统中易被忽视却至关重要的文档切分环节,系统拆解固定长度、语义结构化、混合切分三大方法,结合片段长度、重叠率、元数据标注等5大实操技巧与典型场景案例,助你避开常见陷阱,显著提升检索精度与大模型回答质量。

92 3

m4 mini 内存 16g 完美运行 Qwen2.5-14B-Instruct-Q4_K_M

本演示展示16GB M4 Mac上优化后的模型推理性能:速度达8–12 tokens/s,响应极快、运行稳定。通过深度优化CPU内存访问机制,显著提升效率。详情见B站演示视频。

153 10
|
5天前
|
人工智能 边缘计算 分布式计算
|

阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!

阶跃星辰发布开源大模型Step 3.5 Flash:专为Agent设计,推理速度达350 TPS,支持256K长上下文,采用稀疏MoE+MTP-3+混合注意力架构,在数学与Agent任务上媲美闭源模型,现已全量开放使用。

142 2
|
5天前
|
人工智能 安全 前端开发
|

D2大会 界面即推理:解读 Google A2UI 如何探索 Agent 交互新标准

Google A2UI开源项目,以声明式JSON协议让AI按需生成安全、跨平台的动态界面,破解Agent交互“最后一公里”难题。D2大会将揭秘其设计哲学、多智能体UI协作及开源路线图。

90 4
|
5天前
|
JSON 文字识别 API
|

百度文心开源0.9B参数 PaddleOCR-VL-1.5,全球首个支持异形框定位的文档解析模型!

百度文心开源新一代文档解析模型PaddleOCR-VL-1.5:仅0.9B参数,在OmniDocBench v1.5达94.5%精度,全球首个支持异形框定位,精准识别倾斜、弯折、反光等“歪文档”,集成印章识别、多语种(含藏语/孟加拉语)及古籍解析能力,推理速度超MinerU2.5达43%。(239字)

167 2
|
5天前
|
机器学习/深度学习 人工智能 算法
|

首个2步LoRA!2步实现Qwen-Image-2512高质量图片生成

阿里智能引擎推出Qwen-Image-2512-Turbo,将扩散模型压缩至仅2步生成,提速40倍——5秒内输出4张2K图,效果媲美原模型。融合Reverse-KL蒸馏、热启动与对抗学习,显著提升细节与真实性。已开源,支持ModelScope、呜哩AI及ComfyUI。

152 0
|
5天前
|
数据采集 人工智能 搜索推荐
|

"老师,你讲的我都懂,但下次还是不会用"——一套让课程设计真正落地的AI指令

分享一套课程设计AI指令,能将DeepSeek/Kimi变成教学设计顾问,帮助教师和培训师快速构建目标明确、结构合理的专业课程方案。从"讲得好"跨越到"教得好",让学习真正发生。

92 8
|
6天前
|
人工智能 数据可视化 文件存储
|

MIT开源 首款P2P-AIBridge工具 OoderNexus 发布

Nexus是基于OoderAgent V0.6.5的可视化开发套件,旨在降低P2P AI通信门槛。它提供设备管理(路由器/NAS/智能家居)、SkillFlow编排、场景配置等示例界面,让开发者快速构建SuperAgent分发系统,实现AI能力的直观调用与扩展。(239字)

62 2
|
6天前
|
数据采集 机器学习/深度学习 自然语言处理
|

PPO 与 DP

本文通俗解析PPO与DPO两大偏好优化算法:PPO为间接优化,需训练奖励模型,稳定但流程复杂;DPO为直接优化,跳过奖励模型,简洁高效但对数据质量要求高。对比原理、流程、优劣及适用场景,助你按业务需求科学选型。

94 4
|
6天前
|
人工智能 机器人 API
|

OpenClaw 注册 Moltbook 教程 让你的个人 OpenClaw Agent 加入全球最大 AI 社区

本教程教你用开源AI助手OpenClaw,快速注册并接入全球首个纯AI社交平台Moltbook——一个仅限AI智能体发帖、评论、互动的Reddit式社区(截至2026年1月已超140万个AI活跃)。只需部署OpenClaw、安装Moltbook Skill、完成X平台验证,即可让个人AI agent加入全球AI对话网络。(239字)

315 5
|
6天前
|
人工智能 API 调度
|

别再只依赖 ChatGPT 了:多模型协同,才是 AI 项目走向生产的关键一步

本文剖析AI项目落地困局:ChatGPT Agent类应用用户流失率超70%,根源不在模型不够强,而在于单模型架构难以支撑生产环境——稳定性差、成本高、难治理。文章从数据冲击、痛点直击等五维度论证,提出“多模型协同”是破局关键:按场景选模、统一调度、动态兜底,构建可控、可替换、可长期运行的AI系统架构。

125 3
来自: 多模态  版块
|
7天前
|
数据采集 监控 物联网
|

大模型微调实战——从数据准备到落地部署全流程

本文以7B大模型为例,手把手教你零代码完成办公场景微调:从数据清洗、LoRA轻量训练到效果验证与一键部署,全程无需GPU和编程基础,30分钟快速上手,解决“通用模型不精准、输出不可控”痛点,让大模型真正落地业务。

244 13
|
7天前
|
人工智能 Linux API
|

[大模型实战 01] 本地大模型初体验:Ollama 部署与 Python 调用指南

大模型实战系列第一篇。拒绝晦涩理论,直接上手!我会带着各位友人们零基础安装 Ollama,利用国内 ModelScope 极速下载模型,详解服务端口配置与 Python 脚本调用,涵盖显存计算与常见避坑指南。

520 2
来自: 自然语言处理  版块
|
7天前
|
人工智能 安全 机器人
|

OpenClaw(原 Clawdbot)钉钉对接保姆级教程 手把手教你打造自己的 AI 助手

OpenClaw(原Clawdbot)是一款开源本地AI助手,支持钉钉、飞书等多平台接入。本教程手把手指导Linux下部署与钉钉机器人对接,涵盖环境配置、模型选择(如Qwen)、权限设置及调试,助你快速打造私有、安全、高权限的专属AI助理。(239字)

4406 12
|
8天前
|
人工智能 资源调度 算法
|

意图的觉醒:智能体如何重构算法时代的人机主权

本文探讨智能体时代人机关系的范式革命:从“人适应机器”转向“机器延伸意志”。领航员以意图驱动替代过程管理,重掌决策主权,在效率与人性间守护“微光”,推动个体从执行者跃升为逻辑架构师。(239字)

99 2
|
8天前
|
人工智能 算法 自动驾驶
|

智能体领航员:重构效率边界与人的主体性

在数字化深水区,“智能体领航员”正推动人机关系从“工具辅助”迈向“逻辑共生”。它不再是被动软件,而是能理解模糊意图、拆解任务、过滤噪声、跨平台调度的主动协作伙伴。其核心价值在于释放人类心智带宽,让人回归决策高地——定义问题、判断价值、把握方向。这是算法时代重拾主体性的关键跃迁。(239字)

61 5
|
8天前
|
人工智能 监控 架构师
|

工程师思维看透人心?这个“集成框架”可能颠覆了个人成长领域

《内生力量智慧集成系统》是一套专为技术人设计的“自我认知操作系统”,以系统工程思维重构个人成长:用“七力光谱”扫描内在配置,以“阻滞系数”“一致性指数”等指标动态诊断,支持从调优(1.0–2.0)到重构(3.0)、集成(4.0)乃至超越工具(5.0)的全周期演进。它不贴标签,只提供可测量、可干预、可迭代的元认知框架,助你在AI时代成为自身意识系统的架构师。(239字)

100 7
来自: 多模态  版块
|
8天前
|
存储 人工智能 关系型数据库
|

向量数据库优势和劣势 —— 全方位解析适用场景与使用边界

本文理性剖析向量数据库:突出其在非结构化数据检索、RAG支撑、毫秒相似匹配等AI场景的核心优势,也直面结构化处理弱、精度效率权衡、成本高、信息损失及生态不成熟等短板,明确适用场景(如智能客服、推荐、多模态检索)与四大使用边界,倡导按需选型、协同传统数据库,实现价值最大化。

128 8
|
8天前
|
数据可视化 JavaScript PHP
|

CatchAdmin 2025 年终总结:模块化架构的进化之路

CatchAdmin 2025年完成从4.1到5.0的重大升级:深化模块化架构,实现模块/插件零代码安装与自动菜单注册;增强代码生成器,支持可视化配置与导入导出;拥抱Composer生态,优化SFC加载性能。坚守PHP后台管理系统定位,兼顾开源与商业化探索。(239字)

70 2
|
8天前
|
人工智能 缓存 JavaScript
|

Laravel12 + Vue3 的免费可商用商业级管理后台 CatchAdmin V5.1.0 发布 新增 AI AGENTS 配置

CatchAdmin V5.1.0发布!基于Laravel 12 + Vue3的免费可商用企业级后台,新增AI AGENTS配置、系统缓存命令,优化首屏加载(2~3s)、多语言切换与打包分包,内置权限、代码生成、文件管理等全功能模块。

74 4
|
8天前
|
缓存 JavaScript PHP
|

Laravel12 + Vue3 的免费可商用商业级管理后台 CatchAdmin V5 正式发布

CatchAdmin V5 是基于 Laravel 12 + Vue3 的免费可商用企业级后台系统,支持前后端分离。内置权限管理、动态路由、代码生成、插件系统(直连 Composer)、Excel 导入导出、SFC 远程加载等核心能力,开箱即用,模块化设计,助力快速构建 CMS/CRM/OA 等系统。(239字)

82 5
|
8天前
|
人工智能 机器人 Linux
|

保姆级 OpenClaw (原 Clawdbot)飞书对接教程 手把手教你搭建 AI 助手

OpenClaw(原Clawdbot)是一款开源本地AI智能体,支持飞书等多平台对接。本教程手把手教你Linux下部署,实现数据私有、系统控制、网页浏览与代码编写,全程保姆级操作,240字内搞定专属AI助手搭建!

4725 17
|
9天前
|
传感器 缓存 机器人
|

全球首个自回归视频-动作世界模型,LingBot-VA 正式开源!

蚂蚁灵波团队推出具身世界模型LingBot-VA,首创自回归视频-动作一体化建模框架,实现“边推演、边行动”。它融合视频生成与机器人控制,具备长时序记忆与少样本学习能力,在真实机器人任务中成功率较Pi0.5提升20%,仿真基准刷新SOTA。已全面开源。

143 1
|
9天前
|
数据采集 编解码 自动驾驶
|

世界模型 LingBot-World,正式开源!

蚂蚁灵波团队开源世界模型LingBot-World,专为交互式仿真设计。其核心LingBot-World-Base具备高保真、强动态、长时序一致性(支持近10分钟稳定生成)和实时交互能力(≈16FPS,延迟<1秒),依托可扩展数据引擎,从游戏环境学习物理与因果规律,打造具身智能、自动驾驶等领域的“数字演练场”。

457 1
|
9天前
|
机器人 数据挖掘 数据处理
|

LingBot-VLA 具身大模型全面开源

蚂蚁灵波团队开源具身大模型LingBot-VLA:在GM-100真机评测中跨本体成功率提升至17.3%(+4.3%),RoboTwin 2.0仿真任务成功率超Pi0.5达9.92%;基于20,000小时多构型真机数据预训练,支持高效微调与跨平台迁移,代码、模型、数据、基准全开源。(239字)

133 0
|
9天前
|
人工智能 文字识别 安全
|

目前最火的 AI 助手 Clawdbot 又又又改名了 并且发布新版本

OpenClaw(原Clawdbot/Moltbot)是火爆开源AI助手,支持飞书、WhatsApp、Telegram等20+平台,数据全本地、可调OCR/数据库/Shell命令。新版本新增Twitch等渠道、KIMI等模型及图片交互,安全强化升级。GitHub星标超10万!

2368 1
|
9天前
|
人工智能 架构师 安全
|

从架构师和产品经理角度来看 A2UI 的企业级应用

A2UI(Architect-to-UI)是面向企业级应用的AI驱动开发范式,通过ooderAgent实现架构设计到用户界面的直接转换。它 bridging 架构师与产品经理需求:保障架构一致性、提升开发效率、强化质量与安全,支持云原生、低代码及行业定制化演进。(239字)

92 1
|
9天前
|
人工智能 机器人 API
|

深夜的“懂我”瞬间:我在杭州开元名都,体验了一把“AI+闪购”投喂黑科技

深夜酒店点外卖,杭州开元名都大酒店AI管家惊艳体验:自动识别房号、智能推荐菜品、无感下单、机器人无接触送餐。依托蚂蚁百宝箱与云选科技合作,整合淘宝闪购、云迹地址MCP等能力,打造“懂你”的数字管家,重塑智慧酒店服务新范式。(239字)

85 1
来自: 自然语言处理  版块
|
9天前
|
人工智能 Java 开发工具
|

OoderAgent 实战指南:从搭建环境到开发到开发第一个自己的skill能力

本文为 ooder SuperAgent 开源框架的实战指南,基于 MIT 协议,介绍其三层 Agent 架构(End/Route/MCP)、AI 能力标准化、P2P 服务发现及 Skillflow 编排等核心特性,并提供环境配置、技能开发、测试部署全流程实操说明。(239字)

146 6
|
10天前
|
人工智能 测试技术 API
|

外包项目提效的另一种路径:多模型 AI 的工程价值

外包行业提效困局日益凸显:需求多变、人员流动、周期压缩。单模型AI仅局部优化,难破系统瓶颈。多模型AI以工程化协同替代“人海战术”,通过任务分派、异常降级、流程固化,提升交付稳定性与可扩展性,正成为外包效能升级新路径。

76 2
|
10天前
|
机器学习/深度学习 人工智能 物联网
|

Z Image标准版来了!专为微调而生的全能基座,兼顾真实与艺术!

Z-Image标准版正式开源!作为非蒸馏完整模型,它在生成质量、艺术风格多样性(支持动漫/插画等)、微调友好性(LoRA/ControlNet)、CFG精确控制及生成独特性方面全面升级,是开发者定制化图像生成的理想基座。

445 5
|
11天前
|
传感器 边缘计算 自动驾驶
|

蚂蚁正式开源 LingBot-Depth,基于掩码深度建模的新一代空间感知模型

蚂蚁灵波科技开源LingBot-Depth空间感知模型,首创“掩码深度建模”技术,显著提升消费级双目相机对透明、反光物体的深度补全能力。实测精度与覆盖率超越顶级工业相机,支持机器人稳定抓取、4D场景理解,已轻量化部署。

193 3
|
11天前
|
人工智能
|

87%的案例学习都停留在"看热闹"——用这套AI指令把案例变成你的决策资产

87%的案例学习只停留在看热闹。分享一套案例分析AI指令,通过结构化分析框架,帮你从案例中提炼可迁移的决策模型,提升学习效率。

141 14
|
12天前
|
存储 人工智能 监控
|

OoderAgent P2P 核心技术揭秘:多 Agent 协作入网架构与全链路安全

ooderAgent是基于MIT协议的开源AI协作框架,采用无中心P2P架构,通过MCP/Route/End三类Agent实现分布式存储与协同。文档详述其自组织拓扑、多Agent入网机制及涵盖身份认证、端到端加密、CAP快速重连的全链路安全体系,并覆盖家庭、企业、教育三大场景实践方案。(239字)

96 11
|
12天前
|
机器学习/深度学习 测试技术 API
|

阿里云分布对齐的序列蒸馏实现卓越的Long CoT推理能力,登顶Hugging Face趋势榜!

阿里云飞天实验室发布DASD推理蒸馏技术,开源DASD-4B/30B-Thinking模型及高质量训练数据。创新提出温度调节学习、差异感知采样与混合策略蒸馏三大技术,仅用44.8万样本即在AIME25(83.3)、LCB v5(69.3)、GPQA-D(68.4)等基准上超越同尺寸甚至更大模型,数据集登顶Hugging Face趋势榜Top5。

160 3
|
13天前
|
存储 算法 搜索推荐
|

生物共振:智能体领航员重塑你的生理秩序

智能体领航员,是守护“生物主权”的生理副驾:以节律导航、代谢副驾、感官复苏三大维度,实时感知并调谐身体节律、营养与感官;恪守生物隐私、直觉首发、非医疗三原则,在数字洪流中助你重拾碳基生命的自愈力与生命张力。(239字)

65 6

ModelScope模型即服务

ModelScope旨在打造下一代开源的模型即服务共享平台,为泛AI开发者提供灵活、易用、低成本的一站式模型服务产品,让模型应用更简单!欢迎加入技术交流群:微信公众号:魔搭ModelScope社区,钉钉群号:44837352

0
今日
15067
内容
6
活动
3958
关注
你好!
登录掌握更多精彩内容

相关产品

  • 人工智能平台 PAI
  • 文字识别
  • 智能语音交互