Meta發表Llama 3.1 405B:號稱首個對標頂級閉源模型的開源模型
Meta於2024年7月23日發表Llama 3.1系列,旗艦版405B參數號稱是全球最大、能力最強的開放可取得基礎模型,上下文擴大到128k、支援8種語言,並同步升級8B與70B版本,權重全面開放Hugging Face下載。
Meta於2024年7月23日正式發表Llama 3.1系列模型,最受矚目的是全新的405B(4050億參數)旗艦版本,同時8B與70B兩個既有版本也同步升級。新系列上下文窗口從原本的8k大幅擴大到128k token,並新增對8種語言的支援,能力涵蓋一般知識、可控性、數學運算、工具調用(tool calling)與多語言翻譯。Meta官方宣稱,405B是目前全球最大、能力最強的「開放可取得」基礎模型,也是首個在上述關鍵能力上足以與頂尖閉源模型正面競爭的開源模型。所有模型權重同步上架Hugging Face供社群免費下載,且可透過Meta廣大的合作夥伴平台生態系(包括各大雲端服務商)立即部署使用。
技術意義:閉源與開源的能力差距首次被正式叫板
過去業界普遍認為,像GPT-4、Claude等閉源旗艦模型的能力領先開源模型一個世代。Llama 3.1 405B的發表是Meta首次公開宣稱自家開源模型在多項指標上可與頂級閉源模型「正面競爭」。128k的上下文窗口與工具調用能力,代表開源模型也能支撐長文件分析、多步驟推理與外部系統串接等進階應用場景,而不再只是聊天機器人等級的能力。
與前代及市場的比較:規模與開放策略的雙重賭注
相較於今年4月才發表的Llama 3(僅8B與70B兩級),Llama 3.1新增405B等級,參數規模直接跳進當時業界最頂尖模型的量級。Meta選擇將如此大規模的模型完全開源、權重公開下載,這與OpenAI、Anthropic、Google將旗艦模型閉源、僅提供API的策略形成鮮明對比,也持續鞏固Meta在「開源陣營旗手」的市場定位。
業界反應:開發者生態系統的即時放大器
由於模型權重直接上架Hugging Face,加上Meta既有的合作夥伴平台生態系(雲端業者、推論服務商等)同步支援部署,開發者幾乎可在發表當天就取得並自行部署、微調或私有化運行這個頂級能力的模型,而不必受限於單一供應商的API定價與資料政策。
對管理者而言,這則新聞的意義在於:企業未來若考慮導入生成式AI,除了訂閱付費API外,「自建、自控」的頂級能力模型也已成為可行選項,值得在評估總成本、資料主權與客製化需求時一併納入比較。