华为昇腾联手阶跃星辰推出开源多模态模型，开启 AI 新篇章

日前，魔乐社区（Modelers）正式发布了由阶跃星辰研发的两款开源多模态大模型——Step-Video 和 Step-Audio。这两款模型分别致力于视频生成与语音交互，旨在为开发者和企业用户提供更强大的人工智能工具。

Step-Video 模型的全称为 Step-Video-T2V，作为全球参数量最高的开源视频生成模型，其参数量高达300亿。该模型具备直接生成204帧、540P分辨率高质量视频的能力，并在指令遵循、运动流畅性、物理合理性及视觉美感等方面，超越了市场上现有的顶尖开源视频模型。同时，Step-Audio 则是业界首款能够生成多种情感、方言、语言、唱腔及个性化风格的语音的大模型，该技术的问世标志着人工智能语音交互领域的一次重要突破。

值得注意的是，这些模型基于华为昇腾 CANN 异构计算架构和昇腾服务器进行了优化，开发者和企业用户能够在魔乐社区中便捷地下载和体验这些模型。为了进一步降低使用门槛，魔乐社区还提供免费的算力支持，使用户能够在线进行模型推理，而无需复杂的环境搭建，快速验证他们的人工智能解决方案。

此外，阶跃星辰的开源模型已引起众多行业标杆企业的关注，包括天数智芯、阿里云、火山引擎、TCL等各行各业的公司均已接入这一开源生态。展望未来，阶跃星辰计划在明年3月份推出新的图生视频模型，进一步丰富其产品线。

华为昇腾与阶跃星辰的合作不仅拓宽了多模态人工智能模型的应用场景，也为开发者提供了更为高效的工具，从而推动整个行业的技术进步。