Kimi K2 Thinking hat bei Benchmark-Tests zur Bewertung von Schlussfolgerungs-, Codierungs- und Agentenfähigkeiten neue Rekorde aufgestellt

GateNews
金十数据 8. November: Laut der offiziellen Website von Moon's Dark Side hat Kimi K2 Thinking bei Benchmark-Tests zur Bewertung von Schlussfolgerungs-, Codierungs- und Agentenfähigkeiten neue Rekorde aufgestellt. K2 Thinking erreichte im HLE-Benchmark eine SOTA-Note von 44,9 %, im BrowseComp-Test 60,2 % und im SWE-Bench Verified-Test 71,3 %, was die starke Generalisierungsfähigkeit als fortschrittlichstes Denk-Agenturmodell zeigt.
Disclaimer: The information on this page may come from third-party sources and is for reference only. It does not represent the views or opinions of Gate and does not constitute any financial, investment, or legal advice. Virtual asset trading involves high risk. Please do not rely solely on the information on this page when making decisions. For details, see the Disclaimer.
Kommentieren
0/400
Keine Kommentare