最新新闻
为您推荐

ChatGPT 凭借语音、视觉等先进 AI 功能提升体验

作者Aamir SheikhAamir Sheikh 3 分钟阅读
AI功能
  • OpenAI 为 ChatGPT 推出语音功能,支持以多种人设进行音频回复。
  • 该公司旨在服务移动用户,并应对个人助理领域的竞争。
  • 用户还可上传图片并提出问题,进一步拓展 ChatGPT 的能力边界。

在一次重大更新中,人工智能 (AI) 初创公司 OpenAI 为其 ChatGPT 应用添加了突破性的 AI 功能,使聊天机器人能够听和说,并分析图像。在接下来的两周里,用户将可以选择五种不同的聊天机器人角色,例如“Juniper”、“Breeze”和“Ember”,每种角色都提供独特的语音以进行音频回复。这一发展标志着 OpenAI 的最新努力,旨在使与 AI 驱动聊天机器人的对话更加逼真和引人入胜,服务于其 ChatGPT Plus 服务的订阅者和企业用户。

AI 聊天机器人对话变得更加人性化

OpenAI 的 ChatGPT 于 5 月首次推出时,已经支持将语音转换为文本与聊天机器人进行交互。现在,用户可以选择语音角色,使对话更加动态和自然。这一音频回复功能旨在弥合人类与 AI 交互之间的差距,在与聊天机器人的对话中培养一种真实感。OpenAI 希望这一增强功能能吸引寻求随时随地的帮助的用户,使 ChatGPT 直接与 Google 的 Assistant、Apple 的 Siri 和 Amazon.com 的 Alexa 等成熟的个人助理产品竞争。

用户可以利用此功能执行各种任务,例如在开车前往主题公园时请求了解迪士尼乐园的历史,或在厨房 multitasking 时询问鸡尾酒配方。在测试中,ChatGPT 展示了其讲故事的能力,讲述了一个涉及海星和瑞典人的奇幻故事。但值得注意的是,虽然 ChatGPT 可以生成歌词,但它不会用声音唱歌,突显了该应用在声乐表演领域的局限性。

ChatGPT 提供的声音可能听起来相对像人,尽管带有微妙的机器人音调。OpenAI 与配音演员合作开发了驱动此功能的文本转语音 AI 模型,旨在提供更引人入胜和令人信服的对话体验。

通过图像识别扩展功能

除了语音更新外,OpenAI 还宣布了 GPT-4 的即将推出的功能,GPT-4 是 ChatGPT 背后的先进 AI 模型之一。在接下来的几周里,付费用户和企业用户将在 ChatGPT 应用和网站中获得图像识别功能的访问权限。此功能允许用户提交图像以及相关问题或请求,将 ChatGPT 的功能扩展到基于文本的交互之外。

例如,用户可以上传粉色太阳镜的图片,并请求聊天机器人提供时尚建议或搭配该配饰的服装建议。或者,他们可以提交一张具有挑战性的数学问题的图片,并请求协助解决。这一图像识别功能为 ChatGPT 的实用性增添了新的维度,增强了其在各个领域的用户多功能性。这一增强标志着在弥合基于文本的 AI 与视觉信息之间差距方面迈出的重要一步,为广泛的交互和应用开启了令人兴奋的可能性。

庆祝 ChatGPT 增强的 AI 功能

OpenAI 对 ChatGPT 的最新增强标志着 AI 驱动 对话界面持续演进中的重要一步。语音功能的加入,包括独特的角色设定,以及功能扩展到图像分析,证明了 OpenAI 致力于为用户提供深度参与且多面的对话环境。虽然它可能还无法用悦耳的歌声为用户献唱,但 ChatGPT 参与动态且极其逼真的对话的能力,以及熟练处理图像相关问题的能力, firmly 巩固了它作为虚拟助手和对话式人工智能领域不断壮大的领域中极其强大且不可或缺的工具的地位。

最聪明的加密领域人士已经在阅读我们的通讯。想加入吗?加入他们。

分享本文

免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。

Aamir Sheikh

Aamir Sheikh

Aamir 是一位科技记者,在加密货币和科技行业拥有近六年的经验。他毕业于 MAJ 大学,获得金融与市场营销 MBA 学位。目前他在 Cryptopolitan 工作,报道加密货币市场的最新发展和价格预测。

更多新闻…