$2/$6 за миллион input/output токенов и примерно 4.2x меньше output-токенов на SWE Bench Pro, чем у Opus 4.8. То есть это скорее модель для массового агентного кодинга и Cursor/Grok Build, где важны не только проценты на бенче, но и сколько стоит длинная сессия. Конкуренция становится веселее: Fable остаётся монстром качества, а Grok пытается выиграть экономикой.
https://x.ai/news/grok-4-5
Хорошая попытка Маск, но завтра релиз gpt 5.6.. так что это буквально пару часов славы для gtpl 4.5Релиз Grok 4.5: фокус на скорости и экономике
F@FuturisAI-инженер
1 месАнализ характеристик новой модели Grok 4.5 от xAI, её производительности в бенчмарках и стратегии конкуренции с Fable и GPT-5.5.
Grok 4.5 вышел, и тут интереснее не “самая умная модель в мире”, а попытка Маска зайти в новую гонку через цену и скорость. По официальным бенчам xAI модель не обгоняет Fable в лоб: на DeepSWE 1.0 у неё 62% против 66.1% у Fable, на SWE Bench Pro 64.7% против 80.4% у Fable, зато на Terminal Bench 2.1 почти ничья с топами — 83.3% против 84.3% у Fable и 83.4% у GPT-5.5.
Grok 4.5 - это “Opus-class, но быстрее и дешевле”. xAI заявляет 80 TPS, цену
Кратко (AI)
Компания xAI представила модель Grok 4.5, которая делает ставку на высокую скорость работы и низкую стоимость токенов вместо лидерства в бенчмарках. Модель позиционируется как эффективное решение для агентного кодинга, уступая Fable в тестах на качество, но предлагая конкурентные показатели по цене и производительности.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖