LLM
MiniMax M3 vs Kimi K2.7 vs GLM-5.2: что выбрать
Три открытые модели для кодинга вышли за две недели июня. Разобрал, чем MiniMax M3, Kimi K2.7 и GLM-5.2 отличаются по контексту, цене и бенчмаркам и кому какая подойдёт.
LLM
Три открытые модели для кодинга вышли за две недели июня. Разобрал, чем MiniMax M3, Kimi K2.7 и GLM-5.2 отличаются по контексту, цене и бенчмаркам и кому какая подойдёт.
LLM
MiniMax выпустила M3 — первую открытую модель с контекстом 1M, мультимодальностью и агентным кодингом. На SWE-Bench Pro она обходит GPT-5.5, а стоит в разы дешевле фронтира.
LLM
Moonshot выпустила открытую модель для агентного кодинга дешевле Claude в 5 раз. Разобрал бенчмарки, цену и стоит ли переходить на неё.
LLM
Китайская GLM-5.2 встаёт в Claude Code вместо Claude: 1 млн токенов контекста и фиксированная цена вместо подписки Anthropic. Разобрал, стоит ли менять.
Claude
Anthropic выкатила Claude Fable 5, старшую модель нового семейства Claude 5. Разбираю, что умеет, сколько стоит и как получить доступ через API и подписку.
Claude
Чем Claude Opus 4.8 отличается от 4.7: бенчмарки, честность модели, dynamic workflows в Claude Code и контроль усилий. Разбираемся, стоит ли переключаться.
Google переосмысляет ноутбуки после 15 лет с Chromebook: новая категория Googlebook на Android и ChromeOS с Gemini внутри. Релиз осенью 2026.
LLM
Google выпустил Multi-Token Prediction drafters для Gemma 4. Та же модель, та же точность, в три раза быстрее на одном железе.
Claude
Anthropic подписал партнёрство со SpaceX и забирает весь compute дата-центра Colossus 1: это 300 МВт мощности и 220 000 NVIDIA GPU. Параллельно компания удвоила лимиты Claude Code и подняла rate limits API для Opus.
OpenAI
OpenAI выпустила GPT-5.5 и GPT-5.5 Pro. Обгоняет Claude Opus 4.7 на Terminal-Bench (82,7% vs 69,4%), 400K контекст в Codex. Что реально изменилось.
LLM
Бенчмарк KillBench от White Circle протестировал 15 топовых LLM на 1,35 млн сценариев «кого спасти». Bias нашли у каждой модели, а структурированный вывод почти обнуляет safety.
Claude
Новый флагман Anthropic: сильнее в сложных задачах, лучше видит картинки, появились xhigh и /ultrareview. Разбираю, что поменялось.