ChatGPT重磅更新:新增语音和图像功能 可以看、听、说
9月26日消息,据外媒报道,当地时间周一,美国人工智能研究公司OpenAI宣布,其AI聊天机器人工具ChatGPT现在可以“看、听、说”,这暗指这款广受欢迎的聊天机器人可以同时接收图像和语音输入,并通过语音进行回复。
ChatGPT是OpenAI于2022年11月30日推出的一种新型AI聊天机器人工具,可根据用户的要求快速生成文章、故事、歌词、散文、笑话,甚至代码,并回答各类疑问。
当地时间周一,OpenAI表示,将开始在ChatGPT中推出新的语音和图像功能,新功能将于未来两周内面向Plus和企业用户推出。
该公司表示,新功能允许用户进行语音对话或向ChatGPT展示其正在谈论的内容。其中,语音功能将在iOS和Android平台上推出,而图像功能将在所有平台上推出。不过,该公司将逐步部署语音和图像功能。
在语音方面,新功能允许用户进行语音对话,提供更直观的交互方式。该功能由一个新的文本转语音模型提供支持,能够通过文本和几秒钟的语音样本生成类似人类的音频,且与专业配音演员合作,提供5种可供用户自行选择的声音。此外,该功能还能使用开源语音识别系统Whisper,将用户说的话转录成文本。
外媒报道称,语音输入和输出功能使ChatGPT具有与亚马逊Alexa等语音助手相同的功能。
在图像方面,新功能允许用户上传图像与ChatGPT交互,且支持上传多张图像。如果要聚焦图像的特定部分,可以使用移动应用中的绘图工具。
OpenAI表示,图像理解由多模态GPT-3.5和GPT-4提供支持。这些模型将语言推理能力应用于各种图像,如照片、屏幕截图以及包含文字和图像的文档。
据悉,GPT-4是OpenAI在今年3月14日推出的最新一代大型语言模型。它是一个多模态大型语言模型,支持图像和文本输入,以文本形式输出;扩写能力增强,能处理超过25000个单词的文本;更具创造力,并且能够处理更细微的指令。(小狐狸)
谷歌在印度、日本推出生成式AI搜索服务,用户需加入Search Labs才可体验8月31日消息,据路透社今日报道,谷歌于当地时间周三宣布,旗下生成式AI搜索服务SGE将首次登陆美国以外的国家,首先将在印度和日本推广。据介绍,日本和印度的用户需先加入SearchLabs,才可使用这一新功能。语言方面...
马斯克带火的人形机器人,在中国发展的怎么样了7月逛过世界人工智能大会后,一直对人形机器人念念不忘。特斯拉的人形机器人擎天柱只是在大会上展出了1:1的模型,展台已经足以被挤到水泄不通。一个不会动的人形机器人能够引起这么多关注,我是有些不解的。同一场的...
百度:未来竞争在于做出多少 AI 原生应用 而不是做出多少大模型近日,百度集团资深副总裁、百度移动生态事业群组总经理何俊杰表示,未来竞争的关键在于做出多少AI原生应用,而不是做出多少大模型。据何俊杰公布数据,8月31日,百度文心一言对社会放开,首日回答用户3342万问题,...
微软发布统一版AI助手Copilot 即将登陆Windows 11、必应等平台9月22日消息,据外媒报道,当地时间周四,微软宣布发布“统一的”人工智能助手Copilot。这款新的“日常人工智能伴侣”将在Windows11、必应搜索、Edge浏览器和微软365软件套件中使用。微软表示,从9月26日开始,Copil...
亚马逊将向美国人工智能企业Anthropic投资多达40亿美元9月25日消息,据外媒报道,当地时间周一,亚马逊宣布,将向美国人工智能企业Anthropic投资多达40亿美元,以巩固其在蓬勃发展的人工智能技术领域的地位。亚马逊的初始投资将为12.5亿美元,以获得Anthropic的少数股权...
苹果招募生成式AI人才 提供数十个大模型岗位
根据最新的招聘信息,苹果正在扩大其生成式人工智能领域的专业团队,并计划将这项技术应用于iPhone和iPad等...
软银正在开发日本版ChatGPT 计划明年推出
软银公司正在积极投入到AI相关技术的研发中,其CEO孙正义曾豪言,“如果不能拥抱AI便是失去未来”。目前,...
研究人员发布了针对ChatGPT和其他LLM的攻击算法
卡内基梅隆大学(CMU)的研究人员发表了LLMAttacks,这是一种用于构建针对各种大型语言模型(LLM)的对抗攻击...
昆仑万维旗下Opera生成式AI服务海外用户数突破100万
昆仑万维旗下Opera宣布,生成式AI服务Aria海外用户数突破100万。2023年5月24日,Opera正式推出生成式AI助理...