魔搭社区模型速递(6.8-6.14)

简介: 魔搭ModelScope本期社区进展:1173个模型,143个数据集,76个创新应用,10 篇内容

image.gif 编辑

🙋魔搭ModelScope本期社区进展:

📟1173个模型:Magistral-Small-2506、dots.llm1、MonkeyOCR等;

📁143个数据集:saisdata、OpenThoughts3-1.2M、MMVU等;

🎨76个创新应用:BMMR-Leaderboard-detailed、RedNoob、openaudio-s1-mini等;

📄 10 篇内容:

  • 告别‘人海战术’!基于EvalScope 的文生图模型智能评测新方案
  • UGPhysics:本科物理推理评估基准发布,助力AI+Physics交叉研究
  • 支持自主创建MCP啦!一文带你玩转魔搭MCP广场,从idea到部署自己的MCP到魔搭
  • One-to-Normal Anomaly Personalization:少样本异常识别新突破,扩散模型助力精准检测
  • 从种草生活到种草AI,小红书发布首个开源大模型dots.llm1
  • 趣丸千音MCP首发上线魔搭社区,多重技术引擎,解锁AI语音无限可能
  • 想一年不如实实在在干两天 | 52小时创业森林开启报名
  • AgentScope 与 MCP:实践、思考与展望
  • “一丹一世界”三等奖 | 蓝色幻想 经验分享-AIGC商业海报落地
  • 十万奖金等你来战!第二届“隐语杯”数据挑战赛报名正式启动!

 

01.模型推荐

Magistral-Small-2506

Magistral-Small-2506是基于Mistral Small 3.1(2503版本)的升级模型,通过融合Magistral Medium轨迹的监督微调(SFT)与强化学习(RL)训练,显著增强推理能力。这款高效的小型推理模型参数量达240亿,量化后可在单张RTX 4090显卡或32GB内存的MacBook本地部署。

 

Magistral-Small-2506具备长推理链能力,支持英语、法语、中文等数十种语言,采用Apache 2.0开源许可(允许商业及非商业使用)。其128k上下文窗口实际建议设为40k,超过此范围性能可能下降。

模型链接:

https://modelscope.cn/models/mistralai/Magistral-Small-2506

 

示例代码:

推荐使用vLLM,按如下方式启动模型:

VLLM_USE_MODELSCOPE=true vllm serve mistralai/Magistral-Small-2506 --tokenizer_mode mistral --config_format mistral --load_format mistral --tool-call-parser mistral --enable-auto-tool-choice --tensor-parallel-size 2

image.gif

 

dots.llm1

dots.llm1 模型是小红书Hi lab团队(Humane Intelligence Lab)推出的一个大规模的 MoE 模型,从总共 142B 参数中激活了 14B 参数,性能与当前最先进的开源模型相当。 通过rednote-hilab研究团队精心设计和高效的数据处理流水线,dots.llm1 在没有合成数据的情况下,在高质量语料库上预训练后,达到了与 Qwen2.5-72B 相当的性能。为了进一步促进研究,研究团队开源了整个训练过程中的中间训练Checkpoint,并提供了对大型语言模型学习动态的宝贵见解。

模型链接:

https://modelscope.cn/organization/rednote-hilab

 

示例代码:

推荐使用Docker 进行模型推理,Docker 镜像可在 Docker Hub(https://hub.docker.com/repository/docker/rednotehilab/dots1/tags) 上找到。

 

可以通过 vllm 启动一个服务器

docker run --gpus all \
    -v ~/.cache/huggingface:/root/.cache/huggingface \
    -p 8000:8000 \
    --ipc=host \
    rednotehilab/dots1:vllm-openai-v0.9.0.1 \
    --model rednote-hilab/dots.llm1.inst \
    --tensor-parallel-size 8 \
    --trust-remote-code \
    --served-model-name dots1

image.gif

然后可以通过以下方式验证模型是否成功运行

curl http://localhost:8000/v1/chat/completions \
    -H "Content-Type: application/json" \
    -d '{
        "model": "dots1",
        "messages": [
            {"role": "system", "content": "You are a helpful assistant."},
            {"role": "user", "content": "Who won the world series in 2020?"}
        ],
        "max_tokens": 32,
        "temperature": 0
    }'

image.gif

更多推理实战教程详见:

从种草生活到种草AI,小红书发布首个开源大模型dots.llm1

MonkeyOCR

MonkeyOCR是由华中科技大学联合金山办公推出的一款文档解析模型,具备高精度和强泛化能力。该模型支持多语言、多场景的文字检测与识别,适用于文档数字化、内容审核、信息提取等多种应用场合。与传统方法相比,MonkeyOCR在处理复杂文档时,平均性能提升5.1%,在公式和表格解析上分别提升15%、8.6%。

模型链接:

https://modelscope.cn/models/AI-ModelScope/MonkeyOCR

示例代码:

安装 MonkeyOCR

conda create -n MonkeyOCR python=3.10conda activate MonkeyOCRgit clone https://github.com/Yuliang-Liu/MonkeyOCR.gitcd MonkeyOCR# Install pytorch, see https://pytorch.org/get-started/previous-versions/ for your cuda versionpip install torch==2.5.1 torchvision==0.20.1 torchaudio==2.5.1 --index-url https://download.pytorch.org/whl/cu124 pip install -e .

image.gif

下载模型权重

pip install modelscope
python tools/download_model.py -t modelscope

image.gif

推理

# Make sure in MonkeyOCR directory
python parse.py path/to/your.pdf
# or with image as input
pyhton parse.py path/to/your/image
# Specify output path and model configs path
python parse.py path/to/your.pdf -o ./output -c config.yaml

image.gif

02.数据集推荐

Saisdata

 

saisdata是一款面向特定领域应用的高质量文本数据集,适用于自然语言处理、文本分类等相关任务的研究与开发。该数据集包含丰富的文本内容及相应标注信息,能够有效支持模型训练、评估与优化等环节。作为开放共享的数据资源,saisdata致力于为算法研发和实际应用提供坚实的数据支撑。

数据集链接:

 

https://modelscope.cn/datasets/wpixiu/saisdata

 

 

OpenThoughts3-1.2M

OpenThoughts3-1.2M是大型中文多任务指令数据集,包含超过120万条高质量的指令与响应对,覆盖多种自然语言处理任务。该数据集旨在推动大模型在中文场景下的多任务学习与泛化能力研究,适用于模型训练、评估及微调等应用场景。

 

数据集链接:

https://modelscope.cn/datasets/open-thoughts/OpenThoughts3-1.2M

 

 

MMVU

MMVU是多模态视频理解评估数据集,专注于测试和提升模型在视频内容理解、跨模态推理等方面的能力。该数据集包含丰富的真实场景视频样本及多维度标注信息,覆盖多种复杂语义理解和推理任务。

数据集链接:

https://modelscope.cn/datasets/AI-ModelScope/MMVU

 

03.创空间

BMMR-Leaderboard-detailed

用于呈现多模态检索(如图文检索、视频检索等)任务中各类模型的性能排名与详细评测结果。基于BMMR(Benchmark for Multimodal Retrieval)评测体系,提供了全面、客观的模型对比数据。

体验链接:

https://modelscope.cn/studios/guanyuli615/BMMR-Leaderboard-detailed

 

RedNoob

输入笔记的标题和内容,模型将预测其受欢迎程度分数 (WLAES)。

 

体验链接:

https://modelscope.cn/studios/Hamiglet/RedNoob

 

openaudio-s1-mini

OpenAudio-S1-Mini是一款轻量级音频理解模型,支持多种音频任务如语音识别、语种检测和关键词提取,适用于资源受限场景下的高效部署。

 

体验链接:

https://modelscope.cn/studios/Hamiglet/RedNoob

 

04.社区精选文章

告别‘人海战术’!基于EvalScope 的文生图模型智能评测新方案

UGPhysics:本科物理推理评估基准发布,助力AI+Physics交叉研究

支持自主创建MCP啦!一文带你玩转魔搭MCP广场,从idea到部署自己的MCP到魔搭

One-to-Normal Anomaly Personalization:少样本异常识别新突破,扩散模型助力精准检测

从种草生活到种草AI,小红书发布首个开源大模型dots.llm1

“一丹一世界”三等奖 | 蓝色幻想 经验分享-AIGC商业海报落地

趣丸千音MCP首发上线魔搭社区,多重技术引擎,解锁AI语音无限可能

想一年不如实实在在干两天 | 52小时创业森林开启报名

AgentScope 与 MCP:实践、思考与展望

十万奖金等你来战!第二届“隐语杯”数据挑战赛报名正式启动!

 

 


目录
相关文章
|
5天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1571 112
|
12天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1939 8
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
6天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
6天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
526 112
|
18天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2558 4
|
10天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
720 111
|
20天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2634 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
6天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
7天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
445 1

热门文章

最新文章