Meta 发布 Llama 4:开源模型正式超越 GPT-4

Meta 发布了 Llama 4,开源社区炸了。

模型规格

  • 参数规模:405B(还有 70B、8B 版本)
  • 训练数据:20T tokens
  • 上下文窗口:512K
  • 多模态:支持图像理解
  • 开源协议:Llama 4 Community License

评测结果

在 MMLU、HumanEval、GSM8K 等标准评测上,Llama 4 405B 超越了 GPT-5 12B 版本。虽然在复杂推理和长文写作上还有差距,但已经非常接近了。

为什么重要

这是第一次开源模型在综合能力上追平了最强的闭源模型。

意味着: - 中小企业可以用自己的 GPU 集群部署接近 GPT-5 的模型 - 垂直领域微调的门槛大幅降低 - 数据隐私问题(不用把数据发到 OpenAI 的服务器)

对开发者

可以开始关注 LangChain + Llama 4 的本地部署方案了。8B 版本可以在消费级 GPU(4080 16GB)上运行,性能接近 GPT-4 mini。


参考来源:

关于 Zihao Zhang

后端开发工程师。关注 Java/Spring Boot/Redis/MySQL 技术栈,分布式系统,OLAP 数据库,AI Agent 开发与应用。

评论

评论已关闭。