LLM
MiniMax M3: открытая модель бьёт GPT-5.5 в кодинге
MiniMax выпустила M3 — первую открытую модель с контекстом 1M, мультимодальностью и агентным кодингом. На SWE-Bench Pro она обходит GPT-5.5, а стоит в разы дешевле фронтира.
LLM
MiniMax выпустила M3 — первую открытую модель с контекстом 1M, мультимодальностью и агентным кодингом. На SWE-Bench Pro она обходит GPT-5.5, а стоит в разы дешевле фронтира.
LLM
Moonshot выпустила открытую модель для агентного кодинга дешевле Claude в 5 раз. Разобрал бенчмарки, цену и стоит ли переходить на неё.
LLM
Китайская GLM-5.2 встаёт в Claude Code вместо Claude: 1 млн токенов контекста и фиксированная цена вместо подписки Anthropic. Разобрал, стоит ли менять.
Claude Code
Anthropic добавил /goal в Claude Code: команда задаёт условие, а маленькая модель проверяет каждый ход и продолжает работу до результата. Разбираю, что это меняет на практике.
AI
Telegram превратил мессенджер в рантайм для AI-агентов: вызывай бота через @ в любом чате, боты общаются между собой, ответы стримятся.
LLM
Google выпустил Multi-Token Prediction drafters для Gemma 4. Та же модель, та же точность, в три раза быстрее на одном железе.
OpenAI
OpenAI выпустила GPT-5.5 и GPT-5.5 Pro. Обгоняет Claude Opus 4.7 на Terminal-Bench (82,7% vs 69,4%), 400K контекст в Codex. Что реально изменилось.
ChatGPT
OpenAI показала ChatGPT Images 2.0 — генератор картинок, который «думает» перед рисованием, аккуратно пишет текст на русском и собирает сложные журнальные композиции.
AI
Nous Research выкатили Hermes Agent — open-source агент на сервер с памятью между сессиями, субагентами и каналами в Telegram/Slack/Discord. Разбираю фичи и сравниваю с OpenClaw.
LLM
Бенчмарк KillBench от White Circle протестировал 15 топовых LLM на 1,35 млн сценариев «кого спасти». Bias нашли у каждой модели, а структурированный вывод почти обнуляет safety.
Claude
Разбираемся в Claude Design — новом продукте Anthropic Labs. Как промпт превращается в прототип, что такое handoff в Claude Code и почему акции Figma просели на 7% после анонса.
Claude Code
Forrest Chang собрал в один CLAUDE.md файл 4 принципа Карпатого против переусложнения, додумывания и drive-by-правок. 48к звёзд за пару месяцев.