Rapid-MLX:Apple Silicon 专属AI推理引擎,高速本地大模型运行与OpenAI API兼容
Rapid-MLX 是一款基于苹果官方 MLX 机器学习框架二次封装优化的开源高性能本地大语言模型(LLM)推理服务引擎,专为Apple Silicon 全系列芯片(M1~M4)Mac 设备深度定制开发...
Rapid-MLX 是一款基于苹果官方 MLX 机器学习框架二次封装优化的开源高性能本地大语言模型(LLM)推理服务引擎,专为Apple Silicon 全系列芯片(M1~M4)Mac 设备深度定制开发...
HPC-Ops是腾讯混元AI团队开源的生产级大模型推理算子库,针对NVIDIA H20 GPU深度优化核心CUDA内核,在Attention、MoE、GEMM等算子上实现顶尖性能。项目集成简单,原生支持B...