RecodeX 重构消息,K-Search进化内核搜索框架结合CUDA-to-MLX翻译层,在Apple Silicon上实现近专家级内核性能,Attention内核达0.97倍原生速度,Mamba SSM预填加速20倍。
K-Search进化内核搜索框架结合CUDA-to-MLX翻译层,在Apple Silicon上实现近专家级内核性能,Attention内核达0.97倍原生速度,Mamba SSM预填加速20倍。
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源Berkeleybair.berkeley.edu
查看原文 ↗