AI公开课:19.03.06何晓冬博士《自然语言与多模态交互前沿技术》课堂笔记以及个人感悟

简介: AI公开课:19.03.06何晓冬博士《自然语言与多模态交互前沿技术》课堂笔记以及个人感悟

演讲内容(部分)


AI与产业界结合,算法还是很重要的。

计算机能不能思考?会不会思考?把哲学问题转为科学问题。

AI生态  IOT+交互+个性化+服务


关于AI中美之间差异

      美国一般都研究比较偏的题目,可能会带来一个新的领域。而中国一般都比较深入,比如人脸识别。其实,中美结合会更好!


关于无意识的生成和有意识的生成

      有意识的生成,这个方向,还需要更多的突破,让意识能够受控。


关于情感交流

      其实可以理解为机器人助理是否有意识。现在的机器人助理的交互,其实就是算法形成的反馈,但是有时候也无妨碍,就像小孩子玩玩具一样,那是一个需求。


      人工智能领域,CV推进的更加快一些,NLP虽然很慢,但这也是未来的一个机会。

      何晓东博士说道,2012年那时候,全世界大概不到10个人可以训练RNN,但是现在,AI领域的大部分人基本都会了。

希望人工智能带给人的生活更好更方便,体现在即时服务等方面,让人们过的更加有幸福感!


关于认知

      认知是一个多模态,人工智能是否能够模拟认知,这是一个哲学问题,要先定义为科学问题,即真伪问题,所以,这需要一个清晰的定义,什么是认知?


感知→认知

从感知到认知的问题,到底有多少复杂程度。



博主额外补充

     人脑有100亿个神经细胞,每日可记录8600万次信息,在1秒钟之内,可产生10万次化学反应,人的五官时刻都在捕捉各种情报,但经过大脑处理的,仅占实际情报的1%,其余的99%均比打入“冷宫”。


 


相关文章
|
7月前
|
存储 人工智能 NoSQL
AI大模型应用实践 八:如何通过RAG数据库实现大模型的私有化定制与优化
RAG技术通过融合外部知识库与大模型,实现知识动态更新与私有化定制,解决大模型知识固化、幻觉及数据安全难题。本文详解RAG原理、数据库选型(向量库、图库、知识图谱、混合架构)及应用场景,助力企业高效构建安全、可解释的智能系统。
|
7月前
|
机器学习/深度学习 人工智能 人机交互
当AI学会“看”和“听”:多模态大模型如何重塑人机交互
当AI学会“看”和“听”:多模态大模型如何重塑人机交互
624 121
|
7月前
|
人工智能 人机交互 知识图谱
当AI学会“融会贯通”:多模态大模型如何重塑未来
当AI学会“融会贯通”:多模态大模型如何重塑未来
437 114
|
7月前
|
人工智能 搜索推荐 程序员
当AI学会“跨界思考”:多模态模型如何重塑人工智能
当AI学会“跨界思考”:多模态模型如何重塑人工智能
1032 120
|
7月前
|
人工智能 安全 搜索推荐
当AI学会“看”和“听”:多模态大模型如何重塑人机交互
当AI学会“看”和“听”:多模态大模型如何重塑人机交互
715 117
|
7月前
|
人工智能 机器人 人机交互
当AI学会“看、听、懂”:多模态技术的现在与未来
当AI学会“看、听、懂”:多模态技术的现在与未来
460 117
|
7月前
|
人工智能 API 开发工具
构建AI智能体:一、初识AI大模型与API调用
本文介绍大模型基础知识及API调用方法,涵盖阿里云百炼平台密钥申请、DashScope SDK使用、Python调用示例(如文本情感分析、图像文字识别),助力开发者快速上手大模型应用开发。
2693 18
构建AI智能体:一、初识AI大模型与API调用
|
7月前
|
人工智能 自然语言处理 安全
AI助教系统:基于大模型与智能体架构的新一代教育技术引擎
AI助教系统融合大语言模型、教育知识图谱、多模态交互与智能体架构,实现精准学情诊断、个性化辅导与主动教学。支持图文语音输入,本地化部署保障隐私,重构“教、学、评、辅”全链路,推动因材施教落地,助力教育数字化转型。(238字)
1222 23

热门文章

最新文章