AI
GLM-5.3 от Z.ai: обзор модели
Z.ai выпустила GLM-5.3 — лучшую открытую модель для кодинга. Разбираю бенчмарки, находки по безопасности и цены GLM Coding Plan.
AI
Z.ai выпустила GLM-5.3 — лучшую открытую модель для кодинга. Разбираю бенчмарки, находки по безопасности и цены GLM Coding Plan.
AI
Команда ветеранов Tenstorrent и AMD впаяла нейросеть в кремний. Чип HC1 выдаёт до 17 000 токенов в секунду, но так ли это полезно?
AI
OpenAI Privacy Filter ставится в пару команд и маскирует личные данные прямо на твоей машине. Показываю, как запустить его через CLI и Python, разобрать вывод и докрутить под свои тексты.
Dev Tools
Open-source инструмент, который сам выпускает, продлевает и раскладывает SSL-сертификаты по серверам, CDN и Kubernetes. Поставил в Docker и забыл про certbot.
LLM
Moonshot AI выпустила первую открытую модель класса 3T. Что показывают бенчмарки против Claude Fable 5 и GPT-5.6 Sol и сколько стоит API.
AI
OpenAI тихо выложила открытую модель, которая находит и прячет личные данные прямо у тебя на ноутбуке. Разбираемся, насколько она хороша на реальных данных и кому пригодится.
LLM
Китайский DeepSeek V4 Pro это крупнейшая открытая модель на 1.6 трлн параметров с контекстом в миллион токенов. Разбираю архитектуру, реальные бенчмарки и цены, которыми уже заинтересовался Microsoft.
LLM
Три открытые модели для кодинга вышли за две недели июня. Разобрал, чем MiniMax M3, Kimi K2.7 и GLM-5.2 отличаются по контексту, цене и бенчмаркам и кому какая подойдёт.
LLM
MiniMax выпустила M3 — первую открытую модель с контекстом 1M, мультимодальностью и агентным кодингом. На SWE-Bench Pro она обходит GPT-5.5, а стоит в разы дешевле фронтира.
LLM
Moonshot выпустила открытую модель для агентного кодинга дешевле Claude в 5 раз. Разобрал бенчмарки, цену и стоит ли переходить на неё.
LLM
Китайская GLM-5.2 встаёт в Claude Code вместо Claude: 1 млн токенов контекста и фиксированная цена вместо подписки Anthropic. Разобрал, стоит ли менять.
LLM
Google выпустил Multi-Token Prediction drafters для Gemma 4. Та же модель, та же точность, в три раза быстрее на одном железе.