Блог оценил двенадцать ИИ-моделей на четырех приложениях
TryAI сама создала и оценила все двенадцать моделей без внешнего аудита.
- Claude Fable 5 — единственная модель, решившая кубик Рубика во всех пяти попытках.
- GPT-5.6 Luna ответила быстрее всех (1 сек) и дешевле всех (0,001 доллара).
- Grok 4.5 сравнялся с Claude Opus 4.8 в сложных задачах при меньшей цене.
Почему это важно: Сайт, разработавший бенчмарк, сам же его оценил и опубликовал рейтинг как независимое доказательство.
TryAI blog (official benchmark post) ↗ · 10 июл. 2026 г.10.07.26