Meta发布Llama 3.1 405B:号称首个对标顶级闭源模型的开源模型
Meta于2024年7月23日发布Llama 3.1系列,旗舰版405B参数号称是全球最大、能力最强的开放可获取基础模型,上下文扩大到128k、支持8种语言,并同步升级8B与70B版本,权重全面开放Hugging Face下载。
Meta于2024年7月23日正式发布Llama 3.1系列模型,最受关注的是全新的405B(4050亿参数)旗舰版本,同时8B与70B两个既有版本也同步升级。新系列上下文窗口从原本的8k大幅扩大到128k token,并新增对8种语言的支持,能力涵盖通用知识、可控性、数学运算、工具调用(tool calling)与多语言翻译。Meta官方宣称,405B是目前全球最大、能力最强的“开放可获取”基础模型,也是首个在上述关键能力上足以与顶级闭源模型正面竞争的开源模型。所有模型权重同步上架Hugging Face供社区免费下载,并可通过Meta庞大的合作伙伴平台生态系统(包括各大云服务商)立即部署使用。
技术意义:闭源与开源的能力差距首次被正式叫板
过去业界普遍认为,像GPT-4、Claude等闭源旗舰模型的能力领先开源模型一个世代。Llama 3.1 405B的发布是Meta首次公开宣称自家开源模型在多项指标上可与顶级闭源模型“正面竞争”。128k的上下文窗口与工具调用能力,意味着开源模型也能支撑长文档分析、多步骤推理与外部系统对接等进阶应用场景,而不再只是聊天机器人级别的能力。
与前代及市场的比较:规模与开放策略的双重押注
相较于今年4月才发布的Llama 3(仅8B与70B两级),Llama 3.1新增405B等级,参数规模直接跳进当时业界最顶尖模型的量级。Meta选择将如此大规模的模型完全开源、权重公开下载,这与OpenAI、Anthropic、Google将旗舰模型闭源、仅提供API的策略形成鲜明对比,也持续巩固Meta在“开源阵营旗手”的市场定位。
业界反应:开发者生态系统的即时放大器
由于模型权重直接上架Hugging Face,加上Meta既有的合作伙伴平台生态系统(云服务商、推理服务商等)同步支持部署,开发者几乎可在发布当天就获取并自行部署、微调或私有化运行这一顶级能力的模型,而不必受限于单一供应商的API定价与数据政策。
对管理者而言,这则新闻的意义在于:企业未来若考虑引入生成式AI,除了订阅付费API外,“自建、自控”的顶级能力模型也已成为可行选项,值得在评估总成本、数据主权与定制化需求时一并纳入比较。