您现在的位置是:首页 > 人工智能人工智能
ChatGPT重磅更新:新增语音和图像功能 可以看、听、说
cc博主2023-09-26【人工智能】217人已围观
【CC博客】9月26日消息,据外媒报道,当地时间周一,美国人工智能研究公司OpenAI宣布,其AI聊天机器人工具ChatGPT现在可以“看、听、说”,这暗指这款广受欢迎的聊天机器人可以同时接收图像和语音输入,并通过语音进行回复。
ChatGPT是OpenAI于2022年11月30日推出的一种新型AI聊天机器人工具,可根据用户的要求快速生成文章、故事、歌词、散文、笑话,甚至代码,并回答各类疑问。
当地时间周一,OpenAI表示,将开始在ChatGPT中推出新的语音和图像功能,新功能将于未来两周内面向Plus和企业用户推出。
该公司表示,新功能允许用户进行语音对话或向ChatGPT展示其正在谈论的内容。其中,语音功能将在iOS和Android平台上推出,而图像功能将在所有平台上推出。不过,该公司将逐步部署语音和图像功能。
在语音方面,新功能允许用户进行语音对话,提供更直观的交互方式。该功能由一个新的文本转语音模型提供支持,能够通过文本和几秒钟的语音样本生成类似人类的音频,且与专业配音演员合作,提供5种可供用户自行选择的声音。此外,该功能还能使用开源语音识别系统Whisper,将用户说的话转录成文本。
外媒报道称,语音输入和输出功能使ChatGPT具有与亚马逊Alexa等语音助手相同的功能。
在图像方面,新功能允许用户上传图像与ChatGPT交互,且支持上传多张图像。如果要聚焦图像的特定部分,可以使用移动应用中的绘图工具。
OpenAI表示,图像理解由多模态GPT-3.5和GPT-4提供支持。这些模型将语言推理能力应用于各种图像,如照片、屏幕截图以及包含文字和图像的文档。
据悉,GPT-4是OpenAI在今年3月14日推出的最新一代大型语言模型。它是一个多模态大型语言模型,支持图像和文本输入,以文本形式输出;扩写能力增强,能处理超过25000个单词的文本;更具创造力,并且能够处理更细微的指令。(小狐狸)
Tags:
相关文章
- 承德程序员被没收境外工作收入105万元
- 最新免费ss机场账号分享-永久v2ray链接地址福利(2023/9/25)
- 安卓手机怎么添加小火箭订阅节点,2023年保姆级v2rayNG安卓新手下载使用配置教程
- Coherent已吸引四家日本企业投资碳化硅业务 交易资金达50亿美元
- 因违反反垄断法 欧盟重新对英特尔处以4亿美元罚款
- 航拍人士:特斯拉得克萨斯超级工厂可能停产至月底
- 捷豹宣布从2025年起采用特斯拉北美充电标准
- 特斯拉的5个百万辆电动汽车 至少有两辆是Model Y
- 放弃博通供应自研AI芯片?谷歌:与博通的合作不会发生改变
- iPhone 15系列首发日 现货被加价500+,首批用户大都会好奇的找牛牛们聊聊…
热评文章
稳定好用的SSR节点梯子推荐分享,2024最新v2ray节点免费更新(10/29)
免费公益SSR/V2ray/Shadowrocket/Clash节点/小火箭订阅链接分享(2024/10/27)
纸飞机免费ssr节点小火箭分享,V2ray最新点订阅地址-每日更新(2024/11/1)
CNCC 落幕:国产大模型已经进化到能在横店给我们点咖啡
telegreat怎么转中文_telegreat怎么设置中文
天行vapn官网2023的简单介绍
telegreat中文版下载苹果_国内怎么注册telegeram苹果
AI + 影视,学会「避坑」再「吟诗 」|CNCC 2024
独家丨字节招兵买马,拟在欧洲设立AI研发中心
第一个走入全面AI化的行业,正在经历一次「系统升级」