OpenClaw Pendiri berbagi peringkat kecocokan model AI, minimax-m2.1 dan kimi-k2.5 buatan dalam negeri menempati posisi 2 dan 3

Gate News berita, 8 Maret, pendiri OpenClaw (kerangka kerja pengembangan proxy AI) Peter Steinberger membagikan hasil pengujian benchmark dari lembaga pihak ketiga PinchBench yang mengevaluasi kinerja model bahasa besar AI dalam tugas proxy OpenClaw. Hasilnya menunjukkan bahwa Gemini 3 Flash dengan tingkat keberhasilan 95,1% menduduki posisi pertama, model domestik minimax-m2.1 dan kimi-k2.5 masing-masing dengan 93,6% dan 93,4% menempati posisi kedua dan ketiga. Claude Sonnet 4.5 memiliki tingkat keberhasilan 92,7%, dan GPT-4o sebesar 85,2%.
Penafian: Informasi di halaman ini mungkin berasal dari sumber pihak ketiga dan hanya untuk referensi. Ini tidak mewakili pandangan atau pendapat Gate dan bukan merupakan nasihat keuangan, investasi, atau hukum. Perdagangan aset virtual melibatkan risiko tinggi. Mohon jangan hanya mengandalkan informasi di halaman ini saat membuat keputusan. Untuk detailnya, lihat Penafian.
Komentar
0/400
Tidak ada komentar