魔搭中文开源模型社区:模型即服务-大模型驱动的自然语言开放生态(下)

本文涉及的产品
模型在线服务 PAI-EAS,A10/V100等 500元 1个月
模型训练 PAI-DLC,100CU*H 3个月
交互式建模 PAI-DSW,每月250计算时 3个月
简介: 魔搭中文开源模型社区:模型即服务-

二、 丰富的自然语言算法模型和应用

 

image.png

 

如上图所示,命名实体识别任务(NER)的目的是识别出文本中的核心短语,如新闻领域中的人名、地名、组织名等。在解决实体识别问题中,其核心问题是引入新的信息或知识。

 

阿里云通过获取文本相关的额外知识,来补齐文本中的缺失信息,以此来提升NER的性能。

 

从2021年开始,阿里云提出隐式增强技术,通过动态融合不同预训练模型的知识,NER在六大词法分析任务中,横跨了24个公开数据集,超过业界所有SOTA。

 

在此基础之上,阿里云进一步提出显式上下增强技术,通过检索搜索引擎、相关文本、去躁文本等操作,来进一步提升原始模型的能力。相关工作发表在ACL 2021。

 

在2022年,阿里云再此基础上进行推广,提出的“知识检索技术”在全球规模最大的语义评测SemEval 2022大赛多语言NER的13个赛道中,取得10个第一,并斩获唯一的最佳系统论文奖。

 

image.png

 

在文本分类方面,阿里云基于预训练模型,构建了多维感知器,进行文本分类。多维感知器能够无监督的学习文本中的关键信息,使分类结果更具有可解释性。

 

阿里云多维感知器不仅在中文的自然语言理解任务中,取得了三榜第一。而且把它应用在外呼意图识别、司法分类等环节。目前,ModelScope上相关模型有情感分类、外呼意图识别、零样本分类等等。

 

image.png 

 

如上图所示,阿里云基于对话问答Space序列,上线了意图分类模型。大家可以通过数据扫描,进行意图分类、回复生成、任务推理,代码可复现等等。

 

在表格问答方面,阿里云预制了一些表格问答的预算模型,大家可以直接在ModelScope社区体验。

 

image.png

 

OCR是文字光学字符识别,文档理解非常重要的技术。阿里云将视觉和语言联合建模,通过视觉的二维信息和语言的上下文信息,更好的理解文档或表格中的文字边界,进一步识别文字。

 

image.png

 

与此同时,阿里云对表格结构进行检测与重建,上线了一些基础模型,包括文字检测识别、表格检测识别、中英文表格识别等等。

 

image.png

 

在机器翻译方面,阿里云最新自研的连续语义增强机器翻译模型。获得了自然语言处理顶ACL 2022的最佳论文奖。目前,该模型已开源部署在ModelScope社区。

 

image.png

 

目前,在ModelScope社区上线的机器翻译主要是中英、英中、英法、法英的双向模型。开源模型包含5.7亿参数,翻译质量达到业内第一梯队训练数据包括UN、WMT21、OPUS等,规模达到3亿以上。

 

image.png

 

自然语言理解是从感知智能进化到认知智能的重要阶段,也是形成决策智能的重要基石。阿里云在ModelScope上提供了structBertPALMmPLUG中文基础模型等预训练模型底座,共计100+NLP应用模型。

 

这些模型涵盖了分词,词性,命名实体识别等基础技术,以及文本分类,情感分类,对话问答,OCR机器翻译等应用技术。涵盖了通用,新闻,电商,医疗等多领域。支持中,英,法,西等10多种语言模型。阿里云达摩院为大量的应用场景,提供了丰富易用,性能领先的模型库。

 

相关文章
|
3月前
|
自然语言处理 API C++
阿里通义推出SmartVscode插件,自然语言控制VS Code,轻松开发应用,核心技术开源!
SmartVscode插件深度解析:自然语言控制VS Code的革命性工具及其开源框架App-Controller
|
3天前
|
人工智能 自然语言处理 数据可视化
Data Formulator:微软开源的数据可视化 AI 工具,通过自然语言交互快速创建复杂的数据图表
Data Formulator 是微软研究院推出的开源 AI 数据可视化工具,结合图形化界面和自然语言输入,帮助用户快速创建复杂的可视化图表。
140 9
Data Formulator:微软开源的数据可视化 AI 工具,通过自然语言交互快速创建复杂的数据图表
|
24天前
|
人工智能 自然语言处理 API
用自然语言控制电脑,字节跳动开源 UI-TARS 的桌面版应用!内附详细的安装和配置教程
UI-TARS Desktop 是一款基于视觉语言模型的 GUI 代理应用,支持通过自然语言控制电脑操作,提供跨平台支持、实时反馈和精准的鼠标键盘控制。
490 17
用自然语言控制电脑,字节跳动开源 UI-TARS 的桌面版应用!内附详细的安装和配置教程
|
5天前
|
存储 人工智能 自然语言处理
ACE++:输入想法就能完成图像创作和编辑!阿里通义推出新版自然语言驱动的图像生成与编辑工具
ACE++ 是阿里巴巴通义实验室推出的升级版图像生成与编辑工具,支持多种任务,如高质量人物肖像生成、主题一致性保持和局部图像编辑。
41 8
|
2月前
|
人工智能 自然语言处理 Java
FastExcel:开源的 JAVA 解析 Excel 工具,集成 AI 通过自然语言处理 Excel 文件,完全兼容 EasyExcel
FastExcel 是一款基于 Java 的高性能 Excel 处理工具,专注于优化大规模数据处理,提供简洁易用的 API 和流式操作能力,支持从 EasyExcel 无缝迁移。
218 9
FastExcel:开源的 JAVA 解析 Excel 工具,集成 AI 通过自然语言处理 Excel 文件,完全兼容 EasyExcel
|
2月前
|
数据采集 人工智能 自然语言处理
Midscene.js:AI 驱动的 UI 自动化测试框架,支持自然语言交互,生成可视化报告
Midscene.js 是一款基于 AI 技术的 UI 自动化测试框架,通过自然语言交互简化测试流程,支持动作执行、数据查询和页面断言,提供可视化报告,适用于多种应用场景。
501 1
Midscene.js:AI 驱动的 UI 自动化测试框架,支持自然语言交互,生成可视化报告
|
2月前
|
人工智能 自然语言处理
Promptriever:信息检索模型,支持自然语言提示响应用户搜索需求
Promptriever 是一种新型信息检索模型,由约翰斯·霍普金斯大学和 Samaya AI 联合推出。该模型能够接受自然语言提示,并以直观的方式响应用户的搜索需求。通过在 MS MARCO 数据集上的训练,Promptriever 在标准检索任务上表现出色,能够更有效地遵循详细指令,提高查询的鲁棒性和检索性能。
76 6
Promptriever:信息检索模型,支持自然语言提示响应用户搜索需求
|
3月前
|
人工智能 自然语言处理 PyTorch
AutoVFX:自然语言驱动的视频特效编辑框架
AutoVFX是一个先进的自然语言驱动的视频特效编辑框架,由伊利诺伊大学香槟分校的研究团队开发。该框架能够根据自然语言指令自动创建真实感和动态的视觉特效(VFX)视频,集成了神经场景建模、基于大型语言模型(LLM)的代码生成和物理模拟技术。本文详细介绍了AutoVFX的主要功能、技术原理以及如何运行该框架。
78 1
AutoVFX:自然语言驱动的视频特效编辑框架
|
3月前
|
机器学习/深度学习 自然语言处理 语音技术
探索深度学习中的Transformer模型及其在自然语言处理中的应用
探索深度学习中的Transformer模型及其在自然语言处理中的应用
101 5
|
3月前
|
机器学习/深度学习 人工智能 自然语言处理
探索深度学习与自然语言处理的前沿技术:Transformer模型的深度解析
探索深度学习与自然语言处理的前沿技术:Transformer模型的深度解析
213 0

热门文章

最新文章

相关产品

  • 自然语言处理