#SWE-Bench
5 மாத.
149
GPT-5.5 vs DeepSeek V4 vs Claude Opus 4.7 vs Qwen 3.6 vs Kimi K2.6: 2026-ன் LLM போர்க்களம்
5 மாத.
136
GLM 5.1 SWE-Bench Pro-ல் முதலிடம் 58.4% — Claude மற்றும் GPT-ஐ வீழ்த்திய முதல் Chinese Model
7 மாத.
106
GPT-5.3 Codex அறிமுகம்: தன்னையே உருவாக்க உதவிய முதல் AI — 400K Context, 25% வேகம், GitHub Copilot-ல் கிடைக்கும்
7 மாத.
213
Qwen3-Coder-Next வெளியீடு: Claude Opus 4.5-ஐ பாதுகாப்பு கோடிங்கில் வீழ்த்திய Alibaba-வின் 80B Open-Source AI — இலவசம், லோக்கலில் ரன் செய்யலாம், 370 மொழிகள் சப்போர்ட்