RecodeX 重构消息,阿里巴巴TaoLive AIGC团队基于MiniMax H3研发出音视频联合流式生成模型TaoMate-H3,将三步LoRA推理与自回归生成结合,以小片段为单位推进生成,无需等待整段视频完成。该模型支持根据文本描述生成含对白、歌声或环境音的视频,可实现分钟级连续续写,并提供多档横竖屏分辨率输出。目前其推理代码与LoRA权重已在GitHub和Hugging Face开放,开发者可下载体验。团队表示后续将持续优化速度,并陆续开源更多流式音视频生成模型。