ChatGPT重磅更新:新增语音和图像功能 可以看、听、说
【TechWeb】9月26日消息,据外媒报道,当地时间周一,美国人工智能研究公司OpenAI宣布,其AI聊天机器人工具ChatGPT现在可以“看、听、说”,这暗指这款广受欢迎的聊天机器人可以同时接收图像和语音输入,并通过语音进行回复。

ChatGPT是OpenAI于2022年11月30日推出的一种新型AI聊天机器人工具,可根据用户的要求快速生成文章、故事、歌词、散文、笑话,甚至代码,并回答各类疑问。
当地时间周一,OpenAI表示,将开始在ChatGPT中推出新的语音和图像功能,新功能将于未来两周内面向Plus和企业用户推出。
该公司表示,新功能允许用户进行语音对话或向ChatGPT展示其正在谈论的内容。其中,语音功能将在iOS和Android平台上推出,而图像功能将在所有平台上推出。不过,该公司将逐步部署语音和图像功能。
在语音方面,新功能允许用户进行语音对话,提供更直观的交互方式。该功能由一个新的文本转语音模型提供支持,能够通过文本和几秒钟的语音样本生成类似人类的音频,且与专业配音演员合作,提供5种可供用户自行选择的声音。此外,该功能还能使用开源语音识别系统Whisper,将用户说的话转录成文本。
外媒报道称,语音输入和输出功能使ChatGPT具有与亚马逊Alexa等语音助手相同的功能。
在图像方面,新功能允许用户上传图像与ChatGPT交互,且支持上传多张图像。如果要聚焦图像的特定部分,可以使用移动应用中的绘图工具。
OpenAI表示,图像理解由多模态GPT-3.5和GPT-4提供支持。这些模型将语言推理能力应用于各种图像,如照片、屏幕截图以及包含文字和图像的文档。
据悉,GPT-4是OpenAI在今年3月14日推出的最新一代大型语言模型。它是一个多模态大型语言模型,支持图像和文本输入,以文本形式输出;扩写能力增强,能处理超过25000个单词的文本;更具创造力,并且能够处理更细微的指令。(小狐狸)
您可能也感兴趣:
官方微博/微信

每日头条、业界资讯、热点资讯、八卦爆料,全天跟踪微博播报。各种爆料、内幕、花边、资讯一网打尽。百万互联网粉丝互动参与,TechWeb官方微博期待您的关注。

想在手机上看科技资讯和科技八卦吗?
想第一时间看独家爆料和深度报道吗?
请关注TechWeb官方微信公众帐号:
1.用手机扫左侧二维码;
2.在添加朋友里,搜索关注TechWeb。
为您推荐
特斯拉中国MODEL Y长续航版售价涨至30.64万元
消息称快时尚在线零售商Shein已在美秘密申请IPO 最早2024年上市
滴滴:网约车等服务已恢复 骑车等服务陆续修复中
字节跳动官宣剥离游戏业务 快手网易等开始抢人
外媒:特斯拉或在英国面临自动驾驶技术销售禁令
三星电子宣布维持双CEO制度 并成立新部门负责规划未来业务
商标申请证实三星Galaxy S24将是一款人工智能手机
赛力斯回应华为成立智能汽车新公司:不影响与华为关系 已收到投资邀约
马云公司成立马家厨房食品公司
更多
- 三星电子已注册“AI Phone”和“AI Smartphone”商标
- FF宣布在中东战略发布会后72小时内收到超300台FF 91 2.0限量版免订金预订
- 特斯拉Model Y今年已有6个月在欧洲市场销量居首
- Canalys:2023年Q3欧洲智能手机出货量同比下降6% 至3200万部
- 德国电动飞行出租车初创公司Lilium获欧盟“运营许可证”
- 泰国总理:特斯拉代表将前往泰国考察工厂选址
- SK海力士与三星电子DRAM市场份额差距在Q3已缩小至4.4个百分点
- 消息称快时尚在线零售商Shein已在美秘密申请IPO 最早2024年上市
- 特斯拉电动皮卡交付仪式将在当地时间下午1点开始 不在晚间
- 马斯克旗下脑机接口公司Neuralink又获得4300万美元风险投资