RecodeX 重构消息,开发者展示在配备 48GB 存储的 Mac 上运行 104GB 版 Qwen3.8-Flash-Next 模型,实测吞吐量约为每秒 12 个 token。该演示展示了在有限内存环境下运行大型语言模型的可能性,但未提供具体技术细节或性能对比。

订阅 RecodeX 创投情报 每日融资动态与原创深度报道,直达邮箱