Hugging Face Blog·· 2023-12-11精选AI 评分89
Mixtral 8x7b 发布:开源 MoE 模型性能比肩 GPT-3.5
Welcome Mixtral - a SOTA Mixture of Experts on Hugging Face
AI 导读
Mistral 发布 Mixtral 8x7b 大语言模型,提供 Apache 2.0 许可。该模型采用 Mixture of Experts 架构,在 MT-Bench 等测试中表现优于 Llama 2 70B,性能接近 GPT-3.5,支持 32k tokens 上下文窗口。
推荐理由
结合基准数据与工程化落地方案,呈现 Mixtral 8x7b 在开放权重模型中的能力层级与部署路径。
来源:Hugging Face Blog · huggingface.co