Kimi K3 стала настільки популярна, що компанія закрила реєстрацію нових користувачів на підписні плани. Довго було написано просто "Sold Out", а зараз список очікування.
Opus 5 часто помиляється
https://www.anthropic.com/news/claude-opus-5
https://news.ycombinator.com/item?id=49038433
24 липня Anthropic випустила Claude Opus 5 — близька до Fable 5 за показниками на тестах, але дешевше. У демо Anthropic модель без доступу до «перегляду» креслення сама пише CV-пайплайн з пікселів і збирає 3D FreeCAD-модель; чинить root cause у package manager, який інші моделі «латають» лише на поверхні.
На практиці вийшла проблема саме в цій надмірній агентності. Забули пароль до Postgres — замість питання піднімає Kind-кластер. Попросили не чіпати sandbox — ламає правила. Пише specs/docs/research гірше, бо йде «робити», а не уточнювати. На code review бувають хибні спрацьовування. Часто спалює токени на винахідливі, але непотрібні обходи.
Ефект Kimi K3
https://stephen.bochinski.dev/blog/2026/07/18/the-kimi-k3-moment/
Stephen Bochinski описує те, що багато хто відчуває зараз: на звичайному кодингу K3 і Claude Fable майже не відрізнити бо та сама якість, схожа кількість токенів. Але ціна ні! Ширший сюжет блогу — провал США ШІ регулювання: Fable різали й гатили safeguard’ами, а китайська open frontier-модель без цих обмежень у відкритому доступі. Висновок автора жорсткий: тепер немає причини платити за Claude, якщо K3 тримає якість.
Kimi K3 на 256k дешевше
https://news.ycombinator.com/item?id=49101852
https://www.kimi.com/code/docs/en/kimi-code/models
Moonshot випустила k3-256k у Kimi Code: та сама якість у межах 256k, але у 2 рази менше ціна/квоти, ніж з 1M контекстом. Але тримає це для поточних підписників, щоб не повторити Anthropic-сценарій «приймаємо всіх і тихо ріжемо ліміти».
Локально K3 усе одно не про «ноут»: 1.5TB VRAM на MXFP4. Тому 256k-скидка важлива саме в cloud/subscription, не в self-host. Логіка та сама, що в OpenAI з порогом 272k — довгий KV-cache дорогий, тож окремий SKU з меншим max context дешевше обслуговувати. Перехід 256k → 1M не збиває кеш (за їхньою докою) — можна стартувати дешево й підняти вікно, коли реально треба.
Kimi K3 виклали
https://huggingface.co/moonshotai/Kimi-K3
https://news.ycombinator.com/item?id=49065752
https://huggingface.co/chat/models/moonshotai/Kimi-K3
Обіцянку з анонсу виконали: повні ваги на Hugging Face під Kimi K3 License. 2.8T MoE (активує 16 з 896 experts, 104B active), 1M context, нативне vision (MoonViT-V2), KDA + AttnRes, native MXFP4. Є chat на HuggingChat. Локально зараз мало кто зможе таке запустити, але вже підтягнулися великі GPU хмарні провайдери.
Поєднання Kimi K3 + Fable
https://fireworks.ai/blog/kimik3-fable
Fireworks прогнали 1030 agentic задач (SWE, terminal, algo, multi-lang, legal) через K3 і Fable 5 в одному harness. Вийшо, що на SWE майже нічия (K3 92.4% vs Fable 92.6%), але спеціалізація різна — K3 сильніший на symbolic math, dev tooling, long terminal (security/crypto/sysadmin); Fable — web, data viz, ширший multi-lang.
Висновок статті: краще не коли одна SoTA модель робить все. Open (K3) — запускає, premium (Fable) — дороблює; роутер це все перемикає. Oracle routing (обрати дешевшу правильну модель) дає до 93% точність і до 50× нижчу вартість за Fable на довгих завданнях.
Не модель Fugu
https://sakana.ai/fugu/
Sakana Fugu — це не одна LLM, а мульті-агента система як модель назовні: один OpenAI-compatible API, всередині динамічна оркестрація пулу чужих frontier-моделей. Які саме моделі і як роутить тут закрита інформація. Це інший полюс того самого тренду, що й Fireworks routing.
#kimi #anthropic #fable #fireworks #fugu #agenticcoding #openweights