OpenAI发布新AI模型GPT-4o和桌面版ChatGPT

简介: OpenAI发布新AI模型GPT-4o和桌面版ChatGPT

本文来自 企业网D1net公众号

OpenAI于周一发布了新的AI模型和桌面版ChatGPT,以及更新后的用户界面,这是公司扩展其受欢迎的聊天机器人的最新举措。


OpenAI新的更新将GPT-4带给所有人,包括OpenAI的免费用户,技术主管Mira Murati在直播活动中表示。她补充说,新的模型GPT-4o"快得多",并在文本、视频和音频方面有了改进的能力。OpenAI表示,最终计划使用户能够通过视频与ChatGPT进行聊天。


"这是我们在易用性方面迈出的第一大步",Murati 说道。


由微软支持的 OpenAI 目前估值超过 800 亿美元,这家公司成立于 2015 年,面临保持在GenAI市场领先地位的压力,同时在投入大量资金用于构建和训练模型的处理器和基础设施的同时,寻找赚钱的方法。


GPT-4o 中的 "o" 代表 "omni"(全能)。新的模型允许 ChatGPT 以更快的速度和更高的质量处理 50 种不同的语言,并且还将通过 OpenAI 的 API 提供,使开发人员可以从今天开始使用新模型构建应用程序,Murati 说道。


她还补充说,GPT-4o 的速度是 GPT-4 Turbo 的两倍,成本只有一半。


OpenAI 的团队成员展示了新模型的音频功能,例如,要求它在公共演讲前帮助安抚某人的情绪。OpenAI 研究员 Mark Chen 表示,该模型能够 "感知你的情绪",并补充说该模型还能够处理用户的打断。团队还要求它分析用户的面部表情,以评论这个人可能正在经历的情绪。


“嘿,你好啊?今天我能怎么让你高兴起来呢?” 当用户打招呼时,ChatGPT 的音频模式这样回答道。


根据博客文章,公司计划在未来几周内测试语音模式,并为 ChatGPT Plus 的付费订阅用户提供早期访问权限。OpenAI 还表示,新模型可以在短至 232 毫秒、平均 320 毫秒内响应用户的音频提示,这与人类在对话中的反应时间相似。


Chen 演示了该模型讲述睡前故事的能力,并要求它改变声音的语调,使其更加戏剧化或机器人化。他甚至要求它唱出这个故事。


此外,OpenAI 表示,新模型甚至可以在音频模式下作为翻译器使用。Chen 演示了这个工具在他用英语讲话的同时,能够听懂 Murati 说意大利语,并在他们对话时将语言翻译成各自的语言。


团队成员还展示了该模型解决数学方程和帮助编写代码的能力,使其成为微软自己的 GitHub Copilot 的一个更强有力的竞争者。


对于 OpenAI 来说,这次发布是自今年 8 月推出 ChatGPT Enterprise(AI 聊天机器人的商业版本)以来,公司最大的一次宣布。据 OpenAI 首席运营官 Brad Lightcap 告诉记者,这个工具的开发时间不到一年,并得到了 20 多家不同规模和行业公司的帮助。


OpenAI、微软和谷歌在GenAI的热潮中处于领先地位,因为几乎每个行业的公司都在竞相将 AI 驱动的聊天机器人和代理添加到关键服务中,以避免被竞争对手甩在后面。本月早些时候,OpenAI 的竞争对手 Anthropic 宣布了其首个企业产品和一个免费的 iPhone 应用程序。


根据 PitchBook 的数据,2023 年有近 700 笔GenAI交易,总投资创纪录达到 291 亿美元,比前一年增长了 260% 以上。预计市场在十年内的收入将超过 1 万亿美元。


业内一些人士对未经测试的新服务快速上市表示担忧,学者和伦理学家对这项技术传播偏见的倾向感到不安。


自 2022 年 11 月 ChatGPT 推出以来,它当时创下了历史上消费者应用程序增长最快的记录,现在大约有 1 亿活跃用户。OpenAI 表示,超过 92% 的财富 500 强公司正在使用该平台。


Murati 在周一的活动中表示,OpenAI 希望“消除一些技术的神秘感”。


“在接下来的几周内,我们将向所有人推出这些功能,”她说。


根据周一的一篇博客文章,新模型将首先在周二向 ChatGPT Plus 和 Team 的客户推出,之后再向 Enterprise 客户推出。从周一开始,ChatGPT 的免费用户也可以使用新模型,但有使用限制。ChatGPT Plus 的用户将拥有比免费用户多五倍的消息容量,而 ChatGPT Team 和 Enterprise 的客户将有更高的使用限制。


Murati 在直播活动的最后感谢了 Nvidia 的首席执行官 Jensen Huang 及其公司提供了必要的图形处理单元 (GPU) 来支持 OpenAI 的技术。


“我只想感谢不可思议的 OpenAI 团队,同时也感谢 Jensen 和 Nvidia 团队为我们带来了最先进的 GPU,使今天的演示成为可能,”她说。

相关文章
|
28天前
|
机器学习/深度学习 人工智能 并行计算
"震撼!CLIP模型:OpenAI的跨模态奇迹,让图像与文字共舞,解锁AI理解新纪元!"
【10月更文挑战第14天】CLIP是由OpenAI在2021年推出的一种图像和文本联合表示学习模型,通过对比学习方法预训练,能有效理解图像与文本的关系。该模型由图像编码器和文本编码器组成,分别处理图像和文本数据,通过共享向量空间实现信息融合。CLIP利用大规模图像-文本对数据集进行训练,能够实现zero-shot图像分类、文本-图像检索等多种任务,展现出强大的跨模态理解能力。
77 2
|
1月前
|
机器学习/深度学习 人工智能 自然语言处理
当语言遇见智慧火花:GPT家族历代模型大起底,带你见证从平凡到卓越的AI进化奇迹!
【10月更文挑战第6天】随着自然语言处理技术的进步,GPT系列模型(Generative Pre-trained Transformers)成为该领域的明星。从GPT-1的开创性工作,到GPT-2在规模与性能上的突破,再到拥有1750亿参数的GPT-3及其无需微调即可执行多种NLP任务的能力,以及社区驱动的GPT-NeoX,这些模型不断进化。虽然它们展现出强大的语言理解和生成能力,但也存在如生成错误信息或偏见等问题。本文将对比分析各代GPT模型的特点,并通过示例代码展示其部分功能。
105 2
|
26天前
|
人工智能 安全 决策智能
OpenAI推出实验性“Swarm”框架,引发关于AI驱动自动化的争论
OpenAI推出实验性“Swarm”框架,引发关于AI驱动自动化的争论
|
20天前
|
人工智能
AI科学家太多,谁靠谱一试便知!普林斯顿新基准CORE-Bench:最强模型仅有21%准确率
【10月更文挑战第21天】普林斯顿大学研究人员提出了CORE-Bench,一个基于计算可重复性的AI代理基准,涵盖计算机科学、社会科学和医学领域的270个任务。该基准旨在评估AI代理在科学研究中的准确性,具有多样性、难度级别和现实相关性等特点,有助于推动AI代理的发展并提高计算可重复性。
39 4
|
21天前
|
机器学习/深度学习 人工智能 自然语言处理
开源版GPT-4o来了,AI大神Karpathy盛赞!67页技术报告全公开
【10月更文挑战第20天】近日,开源版GPT-4o的发布成为AI领域的焦点。作为GPT系列的最新成员,GPT-4o在性能和多模态数据处理方面实现了显著提升,得到了知名AI专家Andrej Karpathy的高度评价。该模型的开源特性将进一步促进AI研究的进展。
40 3
|
20天前
|
人工智能 自然语言处理 算法
【通义】AI视界|OpenAI最新发布!ChatGPT搜索功能强势来了,挑战谷歌?
本文由【通义】自动生成,精选24小时内的重要资讯:OpenAI推出ChatGPT搜索功能挑战谷歌,微软披露130亿美元投资OpenAI,Reddit首次盈利股价暴涨20%,软银CEO孙正义看好英伟达及“超级AI”前景,谷歌云与沙特PIF共建全球AI中心。更多内容请访问通通知道。
|
26天前
|
机器学习/深度学习 人工智能 安全
AI真的能与人类数据科学家竞争吗?OpenAI的新基准对其进行了测试
AI真的能与人类数据科学家竞争吗?OpenAI的新基准对其进行了测试
|
29天前
|
人工智能 自然语言处理
从迷茫到精通:揭秘模型微调如何助你轻松驾驭AI新热点,解锁预训练模型的无限潜能!
【10月更文挑战第13天】本文通过简单的问题解答形式,结合示例代码,详细介绍了模型微调的全流程。从选择预训练模型、准备新任务数据集、设置微调参数,到进行微调训练和评估调优,帮助读者全面理解模型微调的技术细节和应用场景。
67 6
|
1月前
|
人工智能 自然语言处理 安全
【通义】AI视界|Adobe推出文生视频AI模型,迎战OpenAI和Meta
本文精选了过去24小时内的重要科技新闻,包括微软人工智能副总裁跳槽至OpenAI、Adobe推出文本生成视频的AI模型、Meta取消高端头显转而开发超轻量设备、谷歌与核能公司合作为数据中心供电,以及英伟达股价创下新高,市值接近3.4万亿美元。这些动态展示了科技行业的快速发展和激烈竞争。点击链接或扫描二维码获取更多资讯。
|
1月前
|
机器学习/深度学习 人工智能 TensorFlow
解锁AI潜力:让开源模型在私有环境绽放——手把手教你搭建专属智能服务,保障数据安全与性能优化的秘密攻略
【10月更文挑战第8天】本文介绍了如何将开源的机器学习模型(如TensorFlow下的MobileNet)进行私有化部署,包括环境准备、模型获取与转换、启动TensorFlow Serving服务及验证部署效果等步骤,适用于希望保护用户数据并优化服务性能的企业。
50 4