【今年會(huì)官網(wǎng)科技消息】近日,AI模型評(píng)測(cè)平臺(tái)ARENA.AI的研究顯示,Gemini-3.6 Flash在前端代碼競(jìng)技場(chǎng)中以1537分的成績(jī)排第12名,掉出全球前十。而Kimi K3以1677分的成績(jī)位居榜首。
谷歌Gemini
本次進(jìn)入前十的模型按排名依次為:Kimi K3、Claude Fable 5、GPT-5.6 Sol(xHigh)、GLM-5.2(Max)、Claude Opus 4.8(Thinking)、Claude Opus 4.7(Thinking)、Grok-4.5、Claude Opus 4.7、Claude Sonnet 5(High)、Claude Opus 4.6(Thinking)。其中,Kimi K3、Claude Fable 5、GPT-5.6 Sol(xHigh)分別以1677分、1636分、1633分占據(jù)前三名,與后幾名拉開(kāi)較大差距。

谷歌DeepMind此前發(fā)布了三款輕量的新模型。Gemini-3.6 Flash是主力模型,與上一代相比能使用更少的Token,在相同成本下提供更高質(zhì)量的工作;而Gemini 3.5 Flash-Lite則是快速、成本效益高的選項(xiàng),適用于日常任務(wù);Gemini 3.5 Flash Cyber是一種網(wǎng)絡(luò)安全模型,專(zhuān)為發(fā)現(xiàn)和修補(bǔ)關(guān)鍵軟件漏洞而構(gòu)建。
從排行榜來(lái)看,谷歌的模型已經(jīng)排在十名開(kāi)外,在智能上表現(xiàn)并不出色。
版權(quán)所有,未經(jīng)許可不得轉(zhuǎn)載
-今年會(huì)官網(wǎng)