diffnotes.tech — тех-блог о программировании, AI и DevOps
Fable 5 должен был выпасть из подписок 7 июля. В последний момент Anthropic продлила до 12-го — прямо под ожидаемый GPT-5.6
7 июля Claude Fable 5 должен был уйти из подписок Pro/Max/Team в usage credits по $10/$50 — но в этот день Anthropic продлила доступ до 12 июля. Что меняется, куда роутить задачи и причём тут ожидаемый GPT-5.6.
Laguna XS 2.1 — агентный кодер на 33B, который влезает в MacBook и не отправляет твой код никуда
Poolside выложила Laguna XS 2.1 — open-weight MoE на 33B (3B активных), которая крутится на Mac с 36 ГБ RAM. 70.9% на SWE-bench Verified, контекст 256K, установка одной командой в Ollama. Полностью локальный агентный кодер за спиной которого западная лаба.
Claude Sonnet 5 — почти Opus 4.8 за 40% цены. Но новый токенизатор съест вашу скидку
Anthropic выпустила Claude Sonnet 5 и с 1 июля сделала его дефолтом для всех. На высоких effort-уровнях он догоняет Opus 4.8 за 40% цены — но новый токенизатор считает тот же текст в 1.35× больше токенов, а с 1 сентября прайс вырастет на 50%.
Где Gemini 3.5 Pro? Google сорвал июньский дедлайн — а избранные уже кодят на флагмане через LMArena и Antigravity
Google обещал Gemini 3.5 Pro в июне на I/O — и снова не успел. Флагман с заявленными 2M контекста и режимом Deep Think перенесли на июль, но избранные уже гоняют его на LMArena и в Antigravity. Разбираем, что известно, сколько будет стоить и стоит ли вообще ждать.
GPT-5.6 Sol, Terra и Luna: OpenAI выпустил самую сильную модель и тут же запретил её всем, кроме двадцати компаний
26 июня OpenAI выпустил GPT-5.6 в трёх версиях: Sol, Terra и Luna. Но доступ открыли только двадцати компаниям, одобренным правительством США. Разбираем, что умеют модели, сколько стоят и почему METR поймал Sol на рекордном жульничестве в тестах.
GPT-5.6 обещали в июне — и не дали. Ставки рухнули с 83% до 18%, релиз уполз в июль
Июнь должен был стать месяцем GPT-5.6: Pachocki хвалил модель, Polymarket давал 83% на релиз до конца месяца. Окно закрылось пустым, ставки осели на 18%, деньги переехали на июль. Разбираем, что из утечек реально, а что выдумано, и чем закрывать задачи прямо сейчас.
GLM-5.2 — Китай выложил open-weight модель, которая бьёт GPT-5.5 и дышит в спину Claude Opus 4.8
Z.ai выложила GLM-5.2 — open-weight модель на 753B параметров под MIT, которая бьёт GPT-5.5 на кодинг-бенчмарках и отстаёт от Claude Opus 4.8 всего на 1% на длинных задачах. За первые дни она забрала 75% трафика Z.ai на OpenRouter. Разбираем цифры, цену, как подключить и почему дешёвый токен не значит дешёвый результат.
Unlimited-OCR — Baidu взяла идею DeepSeek OCR, починила её главный потолок и обогнала оригинал
Baidu выложила Unlimited-OCR — open-source модель на 3B параметров, которая читает 40+ страниц за один проход и держит KV-кэш постоянным благодаря R-SWA. По замерам Baidu обходит DeepSeek OCR на OmniDocBench. Разбираем, как это работает, как запустить и кому она реально нужна.
GPT-5.6 на низком старте: нашли финальный чекпоинт kindle-alpha, релиз — вопрос дней. Но половину «утечек» дорисовали
OpenAI тестирует финальные чекпоинты GPT-5.6 — kindle-alpha (release candidate) и kepler-alpha. Polymarket даёт 82% на релиз до 30 июня. Разбираем, что реально нашли в логах Codex, какие «спеки» дорисованы, и что делать разработчику прямо сейчас.
$ cat /dev/blog/updates
> Свежие заметки о программировании,
> DevOps и AI — прямо в мессенджер