Илон Маск признал: Grok 4.5 уступает ИИ-флагману от Anthropic — Claude Fable 5
24 июля 2026 года. Глава Tesla и xAI Илон Маск публично назвал нейросеть, которая превзошла его Grok 4.5. В неожиданном признании на платформе X предприниматель заявил, что флагманская модель Claude Fable 5 от компании Anthropic демонстрирует значительно более высокие показатели в тестах на креативность и аналитику. «Мы проигрываем этому ИИ в двух ключевых параметрах из трех», — написал Маск, подчеркнув, что это лишь временное отставание и следующая версия Grok 5 должна сократить разрыв уже в четвертом квартале 2026 года.
Что именно сказал Маск и почему это важно
Маск заявил о превосходстве Fable над Grok 4.5. При этом он добавил, что большинству повседневных задач подобный высокий уровень не требуется. Ранее Маск писал, что на некоторых программных тестах Grok 4.5 все же обходит сильную модель конкурентов.
Открытое признание отставания от соперника — крайне редкий шаг для главы крупной компании. Реакция рынка на эти заявления оказалась довольно сдержанной.
Сравниваем Grok 4.5
Разработчики SpaceXAI сделали ставку на стоимость и скорость обработки данных. Модель Grok 4.5 стоит $2 за миллион входных токенов и $6 за миллион выходных. Для сравнения, тарифы конкурентов выглядят существенно выше.
| Модель ИИ | Вход за 1M токенов | Выход за 1M токенов |
| Grok 4.5 | $2 | $6 |
| Claude Opus 4.8 | $5 | $25 |
| GPT-5.6 Sol | $5 | $30 |
Независимые тесты подтверждают выигрыш в цене при некотором отставании в качестве. В индексе оценки интеллекта Artificial Analysis модель Grok 4.5 заняла четвертое место с 54 баллами. Лидерами списка остаются Fable 5 с 60 баллами, Opus 4.8 с 56 и GPT-5.5 с 55 баллами. В прикладных испытаниях результаты тоже разделились. На SWE Marathon Grok 4.5 обошел всех с результатом 29%, однако на SWE Bench Pro набрал 64,7%, уступив Claude Opus 4.8 (69,2%) и Claude Fable 5 (80,4%).
- На агентском тесте AutomationBench-AA модель Grok 4.5 набрала 51,4%, обогнав Claude Fable 5 (48,6%) и Claude Opus 4.8 (48,5%).
- Стоимость решения задачи у Grok 4.5 составила всего $0,34 против $1,35 у Fable 5 и $1,46 у Opus 4.8.
- Именно это первенство по продуктивности Маск ранее использовал как главное доказательство силы своей сети.
Однако у такой эффективности есть и обратная сторона. Слабым местом модели эксперты называют более высокую частоту нарушения правил. Это создает дополнительные риски при корпоративном внедрении ИИ-агентов. Главный смысл этого релиза сводится к простой экономике. Разработчики показывают результаты, где сильная разница в цене перевешивает небольшое отставание в тестах.
Напомним, ранее редакция BeInCrypto писала о том, что ИИ Grok Imagine снимет полнометражную «Одиссею» до конца 2026 года.
Войдите, чтобы ответить
Войдите, чтобы поделиться своим мнениемКомментарии
Связанные статьи