CodeWithLLM-Updates
-

Нарешті відповідь на Claude Code і Codex від команди Елона Маска.

Grok 4.5 — швидше й дешевше за Opus-клас
https://x.ai/news/grok-4-5
https://cursor.com/blog/grok-4-5
8 липня 2026 SpaceXAI презентувала модель Grok 4.5 — зроблена під генерацію коду, автономну роботу з інструментами й «офісні» задачі. Тренували разом із Cursor на десятках тисяч GPU. У даних — трильйони токенів реальних Cursor-сесій: як люди працюють з репозиторіями, агентами й інструментами, плюс STEM і знання, не лише «чистий» кодинг як у Composer 2.5. Модель бачила як реально виглядає робота в Cursor людей, які у налаштування дозволили це.

У бенчмарках модель не перша скрізь — між GPT 5.5 (а 5.6 вже не за горами) і Opus/Fable — ставка саме на розумність за свою вартість. В порівняні з GLM-5.2 у Grok є можливість приймати на вхід зображення.

На SWE Bench Pro модель витрачає приблизно в 4 рази менше вихідних токенів, ніж Opus 4.8 на максимальних налаштуваннях, і видає близько 80 токенів на секунду. На довгих задачах Grok менше ускладнює відповіді, ніж Sonnet 5 чи Opus, і через це реальний рахунок часто виходить вигіднішим, ніж підказує порівняння цін за токен. API коштує $2/$6 за млн вхідних/вихідних токенів; якщо контекст перевищує 200k (максимум 500k) — ціна подвоюється.

Grok Build CLI для всіх
https://x.ai/cli
https://x.ai/news/grok-build-cli
Тепер дефолтом встановили Grok 4.5 з вікном 500k. Grok Build — terminal-native coding agent (CLI на Rust, з травня 2026 у beta). Це не чат у браузері, а агент у командному рядку. Є все що потрібно - паралельні subagents (у т.ч. у окремих git worktree), skills / plugins / hooks / MCP / AGENTS.md. На старті свідомо підхоплює налаштування з Claude Code (skills з ~/.claude/, частина permissions). Є headless (grok -p) для скриптів і CI, voice, image/video tools, /goal для довгих цілей.

Grok Build робить ставку на швидкість та паралельність (кілька агентів одночасно). Зараз в нього гарний чистий terminal UX, сумісність зі форкфлоу з Claude-екосистеми. Плюс на обмежений час безкоштовний ліміт у Grok Build і Cursor (у Cursor — на всіх планах, перший тиждень з double usage). В ЄС 4.5 поки немає (обіцяють середину липня).

Зараз в інтерфейсі багато нагадувань "заплати за підписку". За замовчуванням після встановлення збір даних для тренування включений - треба заходити в налаштування та відмовлятися. В моєму порівняльному тестуванні ZCode (теж порівняно недорога GLM-5.2) vs Grok Build мені більше сподобалися результати від Grok.

https://www.youtube.com/watch?v=RGXRUH3oK6U

На думку автора відео Grok створив гарнішу версію (краща кольорова палітра, зручніший дизайн) презентації. Grok створив набагато кращий результат симуляція Сонячної системи. Для створення веб-сторінки з фото результати приблизно однакові. Головна перевага — ціна, вона в 5–6 разів дешевше за Claude Code.

Обговорення
https://news.ycombinator.com/item?id=48835111
На HN дискусія крутиться навколо ціни, швидкості й того, скільки токенів реально з’їдає задача. Перші відгуки: дуже швидка, рівень близько нижньої частини Opus / GLM 5.2, і якщо платити за API — часто дешевше за GPT і Opus. Інтерфейс Grok Build хвалять — «зроблено добре», особливо на тлі все більшого погіршення Claude Code.

Скепсис теж є. Перестає виглядати дешево, коли контекст >200k; хтось лишає лише для коротких review. Є скарги, що на простих правках (inline helpers) модель переписує пів модуля замість десяти рядків. Репутація Grok (старі скандали з safety) досі згадують як причину не використовувати модель.

Дані Cursor і тренування на важких середовищах — сильна сторона; Grok 4.5 + Grok Build виглядають як гарний кандидат спробувати на різних свої завдання якщо репозиторії не великі.