您现在的位置是：首页 > 人工智能人工智能

ChatGPT重磅更新：新增语音和图像功能可以看、听、说

cc博主2023-09-26【人工智能】236人已围观

【CC博客】9月26日消息，据外媒报道，当地时间周一，美国人工智能研究公司OpenAI宣布，其AI聊天机器人工具ChatGPT现在可以“看、听、说”，这暗指这款广受欢迎的聊天机器人可以同时接收图像和语音输入，并通过语音进行回复。

ChatGPT重磅更新：新增语音和图像功能可以看、听、说第1张

ChatGPT是OpenAI于2022年11月30日推出的一种新型AI聊天机器人工具，可根据用户的要求快速生成文章、故事、歌词、散文、笑话，甚至代码，并回答各类疑问。

当地时间周一，OpenAI表示，将开始在ChatGPT中推出新的语音和图像功能，新功能将于未来两周内面向Plus和企业用户推出。

该公司表示，新功能允许用户进行语音对话或向ChatGPT展示其正在谈论的内容。其中，语音功能将在iOS和Android平台上推出，而图像功能将在所有平台上推出。不过，该公司将逐步部署语音和图像功能。

在语音方面，新功能允许用户进行语音对话，提供更直观的交互方式。该功能由一个新的文本转语音模型提供支持，能够通过文本和几秒钟的语音样本生成类似人类的音频，且与专业配音演员合作，提供5种可供用户自行选择的声音。此外，该功能还能使用开源语音识别系统Whisper，将用户说的话转录成文本。

外媒报道称，语音输入和输出功能使ChatGPT具有与亚马逊Alexa等语音助手相同的功能。

在图像方面，新功能允许用户上传图像与ChatGPT交互，且支持上传多张图像。如果要聚焦图像的特定部分，可以使用移动应用中的绘图工具。

OpenAI表示，图像理解由多模态GPT-3.5和GPT-4提供支持。这些模型将语言推理能力应用于各种图像，如照片、屏幕截图以及包含文字和图像的文档。

据悉，GPT-4是OpenAI在今年3月14日推出的最新一代大型语言模型。它是一个多模态大型语言模型，支持图像和文本输入，以文本形式输出；扩写能力增强，能处理超过25000个单词的文本；更具创造力，并且能够处理更细微的指令。（小狐狸）

Tags：

文章评论

取消回复

加入组织

热评文章

JHU 陈杰能：世界模型+心智模型，让具身智能体拥有「想象力」

谷歌计划打造由AI驱动的全新搜索引擎挑战微软和OpenAI

华为智慧屏S3 Pro系列正式发布：4K投屏、5999元起

张朝阳谈ChatGPT：人类智慧可控制AI

三星考虑将默认搜索引擎换Bing：谷歌30亿美元收入恐泡汤紧急开发AI搜索

网游《天下3》赠送周杰伦专辑遭杰威尔巨额索赔205万

破天荒！苹果迫于欧盟法规：将在iOS 17上首次允许第三方应用商店

微软Azure OpenAI国际版发布三大行业场景

苹果在印度年销售额达到近60亿美元同比增长50%

五一放一天不调休：能接受吗？

载孕妇Model 3方向盘突然抱死！特斯拉回应：组件故障可退车

您现在的位置是：首页 > 人工智能人工智能

ChatGPT重磅更新：新增语音和图像功能可以看、听、说

相关文章

文章评论

CC博主

加入组织

广告

热门文章

热评文章

标签列表

您现在的位置是：首页 > 人工智能人工智能

ChatGPT重磅更新：新增语音和图像功能 可以看、听、说

相关文章

文章评论

CC博主

加入组织

广告

热门文章

热评文章

标签列表

ChatGPT重磅更新：新增语音和图像功能可以看、听、说