Компанія xAI офіційно представила нову флагманську модель штучного інтелекту Grok 4.6.
Зазначається, що ключовою особливістю оновлення стало суттєве покращення можливостей виконання тривалих багатокрокових завдань без втрати контексту, а також робота з інтерактивними та візуальними проектами. Модель уже стала доступною через API, середовище розробки Cursor, власну платформу Grok Build, а також сервіси OpenRouter, Vercel та Cloudflare.
У межах незалежного агрегованого бенчмарку Artificial Analysis Intelligence Index нова модель здобула 61 бал, зрівнявшись із показником GPT-5.6 Sol та випередивши попередню версію Grok 4.5 High (56 балів). Модель показала високі результати в спеціалізованих тестах на програмування та аналітику, зокрема в CursorBench v3.2 (69,9%) та DeepSWE v1.1 (65,9%). Процес тренування Grok 4.6 включав подовжений фазовий прогін із використанням синтетичних даних для покращення логічного мислення, а також навчання підкріпленням (RL) у спеціалізованих середовищах для оптимізації ядер, веб-розробки та систем автоматизованого проектування (CAD).
Завдяки вдосконаленим алгоритмам Grok 4.6 здатна самостійно проводити тестування та перевірку власного коду на довгих дистанціях виконання, виправляючи помилки до завершення генерації. Під час створення графічних додатків чи сайтів модель з першої спроби формує структуровану візуальну мову та базову логіку взаємодії, що дозволяє швидко переходити від абстрактної ідеї продукту до працюючого прототипу.
Базова вартість використання Grok 4.6 через API становить 2 дол. за мільйон вхідних токенів та 6 дол. за мільйон вихідних токенів. Також компанія запропонувала прискорену версію (fast variant), ціна якої є вдвічі вищою за стандартну. Для розробників у системах Grok Build та Cursor у перший тиждень після релізу діє подвоєний ліміт запитів.
«Наша система захисту розроблена для максимальної користі та безпеки в легітимних сценаріях використання, дозволяючи Grok 4.6 бути ефективним помічником у виправленні вразливостей, прискоренні інженерного проектування та проведенні наукових досліджень», зазначає команда розробників у супровідній документації релізу.
Випуск Grok 4.6 демонструє ключовий вектор розвитку сучасної АІ-індустрії - перехід від стандартних одноразових текстових відповідей до повноцінних агентських систем (Agentic AI), здатних брати на себе виконання складних проектів від концепту до фінального коду. Здатність системи перевіряти власний код і коригувати дії в процесі багатокрокових завдань вирішує одну з головних проблем попередніх поколінь моделей — так зване «накопичення помилок» під час тривалої генерації.
Для xAI цей реліз є важливим кроком у зміцненні позицій на ринку інструментів для розробників та корпоративних клієнтів. Доступність у популярних середовищах розробки на кшталт Cursor разом із конкурентною ціновою політикою створює безпосередню загрозу для позицій OpenAI та Anthropic, змушуючи ринок змагатися не лише в сирих бенчмарках ерудиції, а й у практичній придатності моделей до реальної інженерної роботи.
Стратегія охолодження ЦОД для епохи AI