最新新闻
为您推荐

生成式 Roblox AI 正在改变 Roblox 上的创作方式

作者Shummas HumayunShummas Humayun 5 分钟阅读
Roblox AI
  • Roblox 整合了生成式 AI 工具以支持直观的内容创作,其中包括一款独特的对话式 AI“助手”。
  • 该平台旨在通过创新的图像转化身形技术为用户提供个性化虚拟形象,预计将于 2024 年推出。
  • Roblox 的新语音功能对实时语音内容的审核提出了挑战,促使行业从传统方法转向新的模式。
  • 公司已开发内置语音检测系统,利用自动语音识别(ASR)确保音频流实时符合政策要求。
  • 实时用户通知会提醒用户潜在的违规行为,旨在打造更安全的平台体验。
  • 随着 Roblox 的持续发展,在创新与维持安全社区之间保持平衡至关重要。


今年早些时候,Roblox 公布了其雄心勃勃的计划,旨在将其平台加入生成式 Roblox AI,以使所有用户的内容创作更加 streamlined。生成式 AI 的最新发展,特别是大型语言模型(LLM),为增强沉浸式体验带来了新的前景。这些进步不仅加快了创作过程,还确保了更安全的环境,同时保持计算需求在可控范围内。

AI 领域的一个显著趋势是多模态模型的兴起。这些模型擅长处理各种形式的内容,从图像和文本到 3D 模型和音频,正在重新定义创作工具。它们能够产生结合多种模式的输出——例如,文本与相应的视觉效果——这一能力是一项重大创新。对于 Roblox 来说,这代表了双重优势:

  • 它提高了资深内容创作者的生产力。
  • 它使创作过程民主化,使更广泛的用户能够在平台上实现他们的想法。

在最近的 Roblox 开发者大会(RDC)上,该公司宣布推出几款将生成式 AI 整合到 Roblox Studio 中的工具。这些工具旨在促进项目的快速扩展,加速迭代过程,并增强用户的创作能力,确保生成顶级内容。

Roblox AI 助手

Roblox 一直为其创作者提供必要的资源,以打造详细的 3D 体验。然而,许多创作者转向第三方生成式和对话式 AI 工具寻求帮助。虽然这些工具在减轻一些负担方面有益,但这些通用版本并未针对 Roblox 独特的工作流程或其独特的代码、术语和行话进行定制。因此,创作者在尝试将这些工具与 Roblox 内容集成时遇到了重大挑战。认识到这一差距,Roblox 在 RDC 上宣布将其工具的好处直接整合到 Roblox Studio 中,推出了其工具的早期版本,称为“Assistant”。

“Assistant”是 Roblox 内部开发的对话式 AI,旨在简化创作者的创作过程,无论其经验水平如何。它旨在最大限度地减少花在常规任务上的时间,让创作者专注于故事情节、游戏玩法和整体设计等领域。凭借庞大的公共 3D 模型库以及与平台 API 合并模型的能力,Roblox 成为开发这种用于复杂 3D 宇宙 AI 模型的首选。借助 Assistant,创作者可以使用自然语言提示来设计场景、修改 3D 模型,并为对象注入交互特性。该工具涵盖三个关键创作阶段:理解、编程和构建:

理解:无论是新手还是 Roblox 专家,Roblox AI 助手都能使用自然语言解答各种查询。编程:在现有的“Code Assist”功能基础上,Assistant 可以增强编码,解释某些代码段,并提供调试解决方案。构建:创作者可以迅速将概念转化为实体模型。通过输入诸如“用路灯照亮这条小路”或“建造一片多样的森林并装饰灌木和花朵”等命令,整个场景即可呈现。与 Assistant 的互动被设想为一种动态的双向过程,允许创作者提供反馈并完善结果。这就像与一位经验丰富的联合创作者合作,促进头脑风暴和想法优化。

在 RDC 期间,Roblox 就其新 Roblox AI 工具 Assistant 发布了另一项公告。开发者有机会贡献其匿名的 Luau 脚本数据,以提高 Roblox AI 工具(如 Code Assist 和 Assistant)的效率和能力。通过这样做,他们不仅有助于 Roblox 开发者社区,而且如果他们选择将贡献扩展到 Roblox 之外,还将帮助更广泛的 Luau 开发者社区。这是因为共享的脚本数据将被纳入第三方可访问的数据集中,旨在完善他们的 AI 聊天工具,以提供更好的 Luau 代码建议。

简化头像设计

Roblox 的愿景是让每位令人印象深刻的 6550 万日活跃用户都拥有一个真正反映和传达其身份的头像。虽然最近,UGC 计划成员被赋予了设计和营销头像身体和独立头部的能力,但当前的设计过程涉及导航 Studio 或 UGC 计划。加上所需的高级技能水平和数天的时间才能集成面部表情和 3D 绑定等功能,头像创作变得漫长。因此,头像选项仍然有限。然而,Roblox 设想超越这些限制。

为了帮助所有 Roblox 用户获得独特的动态头像,该公司旨在简化头像创建过程。在 RDC 上,宣布了一项将于 2024 年推出的革命性工具。这项创新将允许将一张或多张图片转换为自定义头像。任何与 Studio 或 UGC 计划相关的创作者都可以使用此工具,上传一张图片,然后个性化生成的头像。Roblox 的长期愿景包括将这些 Roblox AI 功能直接嵌入 Roblox 体验中。

为了实现这一目标,Roblox 正在致力于 AI 模型,这些模型受到平台头像设计和一系列 Roblox 特定 3D 头像模型的启发。正在考虑的技术包括从 2D 视觉生成 3D 头像,通过 2D 生成策略加强有限的 3D 数据,以及使用生成对抗网络(GAN)进行 3D 生成。此外,ControlNet 技术正被用于叠加预设姿势,以增强多角度的头像视觉效果。

在创建 3D 头像结构之后,利用基于头像姿势的高级 3D 语义分割。此过程完善初始 3D 设计,融入独特的面部元素、结构和纹理,最终将基本 3D 形式转化为真实的 Roblox 头像。随后,用户可以使用网格编辑工具进行进一步定制,使头像符合其设想的概念。值得注意的是,Roblox AI 允许在短短几分钟内完成此过程,使头像能够立即集成到 Roblox 体验中。

审核语音通信

Roblox AI 不仅仅局限于内容创作;它还作为一种强大的机制,在大规模上促进多样化、安全和尊重的社区。随着新语音功能的引入,如语音聊天、Roblox Connect 以及在 RDC 上宣布的新 API,审核实时口语内容成为一个新的挑战。行业中普遍采用的解决方案是自动语音识别(ASR),它通过将音频文件转换为文本,然后审查是否存在潜在的不当内容或特定关键词来发挥作用。

虽然对于小规模实体有效,但为 Roblox 庞大的用户群部署 ASR 暴露了其低效性。它不仅错过了捕捉语气和音量等细微差别,而且每天大量的对话跨越多种语言,使其变得笨拙。认识到这些挑战,Roblox AI 开创了一种更简化的程序,直接从实时音频中识别政策违规行为。

这种最先进的语音检测机制是内部开发的。Roblox AI 使用 ASR 对其专有语音数据集进行分类,随后利用分类数据进行系统训练。训练过程始于将音频转换为转录本,然后由 Roblox 的文本过滤系统进行评估,该系统已经擅长识别 Roblox 特定的术语和潜在违规行为。因此,Roblox 现在拥有一个能够直接从音频流中实时检测政策违规的模型。

Roblox AI 系统虽然擅长识别显式关键词,但认识到政策违规往往取决于更广泛的背景。在一个环境中令人反感的词在另一个环境中可能是无害的。为了提高上下文理解,Roblox 整合了一种基于 Transformer 的架构,擅长序列分析。该框架保留扩展的音频序列,使系统能够辨别单词、上下文和语调。结果是一个基于政策合规性对音频进行分类的系统,考虑到关键词、语气、情感和整体上下文。令人印象深刻的是,这种创新系统比传统的 ASR 需要显著更少的计算能力,符合 Roblox 大规模扩展的愿景。

如果您正在阅读这篇文章,说明您已经领先一步。请继续通过我们的通讯保持关注。

分享本文

免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。

Shummas Humayun

Shummas Humayun

Shummas 曾是一名技术内容撰稿人和研究员。

更多新闻…