xAI представила Grok 4.3 для бизнеса

xAI выпустила Grok 4.3 — более дешёвую и, по заявлению компании, более сильную модель для практических задач. Вместе с ней компания представила новый инструмент для генерации изображений на базе агентного режима.

Разработчик xAI Эрик Цзян сообщил, что Grok 4.3 рассчитана на разработчиков и бизнес. В фокусе — скорость, низкая цена и вызовы внешних инструментов. Модель сама выполняет веб-поиск, поиск по X, запуск Python-кода и поиск по файлам через RAG, а также умеет создавать Excel-файлы, PDF и презентации PowerPoint.

Скорость Grok 4.3 составляет 100 токенов в секунду, а размер контекстного окна — 1 млн токенов. Цена — $1,25 за 1 млн входных токенов и $2,50 за 1 млн выходных. Срез знаний датирован декабрём 2025 года. Режим рассуждения теперь включён по умолчанию: перед каждым ответом модель «думает», а токены рассуждения тарифицируются так же, как обычные выходные токены.

Модель доступна через OpenRouter, API xAI и агент Hermes.

По данным независимого сервиса Artificial Analysis, Grok 4.3 набрала 53 балла в Intelligence Index. Это немного выше, чем у Muse Spark и Claude Sonnet 4.6, на четыре балла выше Grok 4.20, но заметно ниже флагманских моделей OpenAI и Anthropic.

По сравнению с Grok 4.20 стоимость входа снизилась примерно на 40%, а выхода — примерно на 60%. По оценке Artificial Analysis, это выводит модель на так называемую границу Парето, где лучше всего сочетаются цена и качество. Полный прогон бенчмарков для Grok 4.3 обходится в $395 против $3,959 для GPT-5.5 и $4,811 для Claude Opus 4.7.

В тесте GDPval-AA, который пытается измерить качество ИИ в реальных офисных задачах, Elo-рейтинг Grok 4.3 вырос на 321 пункт, до 1500. Это выше, чем у Gemini 3.1 от Google, хотя GPT-5.5 от OpenAI всё ещё впереди на 276 пунктов Elo.

Часть других тестов оказалась для модели менее успешной. Andon Labs, где ИИ-модели управляют автоматом по продаже снеков, сообщила о проблемах в автономных агентных задачах: модель иногда бездействует вместо того, чтобы выполнять действия. В компании написали: «Похоже, у неё проблемы с нарколепсией: она предпочитает спать по несколько дней подряд вместо того, чтобы действовать».

Сервис Val’s AI поставил Grok 4.3 на первое место в тестах CaseLaw и CorpFin. При этом в общих бенчмарках по программированию и в более трудных математических задачах модель показала слабее результаты и заняла 13-е место.

xAI также выпустила Agent Mode для Grok Imagine. Сейчас функция доступна в бета-версии веб-интерфейса Grok. В отличие от работы по одному запросу, новый режим рассчитан на более длинные творческие проекты. ИИ-агент планирует, создаёт, редактирует и дорабатывает контент в открытом рабочем пространстве. По словам xAI, режим подходит, например, для одноминутного фильма, набора манги или продуктовых историй.

Agent Mode доступен через веб-интерфейс Grok. Его можно включить в поле ввода внизу слева, а для доступа нужен платный аккаунт.

Источник: The Decoder, Artificial Analysis, Andon Labs, Val’s AI, xAI.

Читать новости ИИ и технологий в Telegram.


Оцените статью
Gimal-Ai