2026/8/7 21:37:13 NemotronLabs-VoiceChat-11B-mlx-8bit性能实测:M4 Max上8bit量化如何节省43%内存并提升42%速度
NemotronLabs-VoiceChat-11B-mlx-8bit性能实测:M4 Max上8bit量化如何节省43%内存并提升42%速度 【免费下载链接】NemotronLabs-VoiceChat-11B-mlx-8bit 项目地址: https://ai.gitcode.com/hf_mirrors/mlx-community/NemotronLabs-VoiceChat-11B-mlx-8bit
Ne…