通義千問開源數學模型Qwen2-Math 測評得分超GPT-4o

《科創板日報》9日訊,阿里通義團隊開源新一代數學模型Qwen2-Math,包含1.5B、7B、72B三個參數的基礎模型和指令微調模型。Qwen2-Math基於通義千問開源大語言模型Qwen2研發,旗艦模型 Qwen2-Math-72B-Instruct在權威測評集MATH上的得分超越GPT-4o、Claude-3.5-Sonnet、Gemini-1.5-Pro、Llama-3.1-405B等,以84%的準確率處理了代數、幾何、計數與概率、數論等多種數學問題。(記者 黃心怡)