diffnotes.tech — тех-блог о программировании, AI и DevOps

Все ai claude-code llm agents open-source anthropic developer-tools productivity tips claude mcp openai coding security cursor api tools gemini
google codex cli automation ai-agents workflow qwen devtools testing pricing voice models ide comparison coding-tools ai-tools benchmarks skills tokens multimodal openrouter ai-models plugins gpt ai-coding xai grok cybersecurity leak deepseek alibaba tdd benchmark research coding-agent playwright orchestration codex-cli multi-agent context-window coding-agents memory python chatgpt stealth-models protocol google-io-2026 gpt-5-6 moe git openclaw ralph-loop autonomous-coding github copilot ios swift xcode computer-use gpt-5.4 macos code-review browser-automation unity game-development context-engineering vibe-coding web-scraping kimi browser gemma china tts microsoft cost-optimization glm hunter-alpha video-generation owl-alpha nvidia vision ollama rag gpt-5.6 local local-llm ai-safety fable meta prompt-engineering safety prompt-injection open-weights coding-assistant deep-research terminal qa php laravel assistant worktrees docker parallel-development oauth websocket context-management mobile perplexity multi-model image-generation remotion video shorts instagram tiktok permissions future code-intelligence knowledge-graph future-of-programming opinion hooks xctest commands local-ai liquid-ai privacy fast-mode copilot-cli linux windows machine-learning cron scheduled-tasks effort settings godot unreal-engine search-api tavily exa agent-teams opus-4.6 expo cowork remote-control plugin google-colab responsive-design frontend telegram discord channels astral superapp licensing documentation prompts figma design web-development demo gamedev gemini-cli speech scraping self-improvement ultraplan debugging function-calling free-tools elevenlabs infrastructure configuration skill dotnet nous-research gpt-6 llama healer-alpha elephant-alpha gpt-5-5 tmux stealth-launch fal elixir linear rust tencent voice-cloning reasoning nemotron mythos policy dense-model game-dev open-beta sonnet gpt-55 spacex managed-agents realtime subq subquadratic long-context transformers finance edge-ai vector-search notion typescript workers malware chrome leaks veo lmarena fingerprinting api-pricing onboarding opus-4-8 robotics world-models physical-ai minimax free-models ocr baidu document-ai release-tracker gemini-35-pro ml amazon data-labeling amd hardware llama-cpp code-quality interpretability apple lawsuit curl writing pentesting career wordpress vulnerability evaluation context7 redis devops rce migration alignment kubernetes npm supply-chain cve sqlite dataviz inference vllm performance enterprise search embeddings
$ ls -lt posts/ --filter=llm --page=4
fable-5-leaves-subscriptions-gpt-56.md
Fable 5 должен был выпасть из подписок 7 июля. В последний момент Anthropic продлила до 12-го — прямо под ожидаемый GPT-5.6
> · 6 мин

Fable 5 должен был выпасть из подписок 7 июля. В последний момент Anthropic продлила до 12-го — прямо под ожидаемый GPT-5.6

7 июля Claude Fable 5 должен был уйти из подписок Pro/Max/Team в usage credits по $10/$50 — но в этот день Anthropic продлила доступ до 12 июля. Что меняется, куда роутить задачи и причём тут ожидаемый GPT-5.6.

ai llm claude anthropic
laguna-xs-21-local-coding-model.md
Laguna XS 2.1 — агентный кодер на 33B, который влезает в MacBook и не отправляет твой код никуда
> · 6 мин

Laguna XS 2.1 — агентный кодер на 33B, который влезает в MacBook и не отправляет твой код никуда

Poolside выложила Laguna XS 2.1 — open-weight MoE на 33B (3B активных), которая крутится на Mac с 36 ГБ RAM. 70.9% на SWE-bench Verified, контекст 256K, установка одной командой в Ollama. Полностью локальный агентный кодер за спиной которого западная лаба.

ai llm coding open-source
claude-sonnet-5-tokenizer-price.md
Claude Sonnet 5 — почти Opus 4.8 за 40% цены. Но новый токенизатор съест вашу скидку
> · 6 мин

Claude Sonnet 5 — почти Opus 4.8 за 40% цены. Но новый токенизатор съест вашу скидку

Anthropic выпустила Claude Sonnet 5 и с 1 июля сделала его дефолтом для всех. На высоких effort-уровнях он догоняет Opus 4.8 за 40% цены — но новый токенизатор считает тот же текст в 1.35× больше токенов, а с 1 сентября прайс вырастет на 50%.

ai agents llm claude
gemini-35-pro-release-delay.md
Где Gemini 3.5 Pro? Google сорвал июньский дедлайн — а избранные уже кодят на флагмане через LMArena и Antigravity
> · 7 мин

Где Gemini 3.5 Pro? Google сорвал июньский дедлайн — а избранные уже кодят на флагмане через LMArena и Antigravity

Google обещал Gemini 3.5 Pro в июне на I/O — и снова не успел. Флагман с заявленными 2M контекста и режимом Deep Think перенесли на июль, но избранные уже гоняют его на LMArena и в Antigravity. Разбираем, что известно, сколько будет стоить и стоит ли вообще ждать.

llm gemini google ai-models
gpt-56-sol-terra-luna.md
> · 7 мин

GPT-5.6 Sol, Terra и Luna: OpenAI выпустил самую сильную модель и тут же запретил её всем, кроме двадцати компаний

26 июня OpenAI выпустил GPT-5.6 в трёх версиях: Sol, Terra и Luna. Но доступ открыли только двадцати компаниям, одобренным правительством США. Разбираем, что умеют модели, сколько стоят и почему METR поймал Sol на рекордном жульничестве в тестах.

ai llm openai models
gpt-56-release-tracker.md
> · 7 мин

GPT-5.6 обещали в июне — и не дали. Ставки рухнули с 83% до 18%, релиз уполз в июль

Июнь должен был стать месяцем GPT-5.6: Pachocki хвалил модель, Polymarket давал 83% на релиз до конца месяца. Окно закрылось пустым, ставки осели на 18%, деньги переехали на июль. Разбираем, что из утечек реально, а что выдумано, и чем закрывать задачи прямо сейчас.

llm openai ai-models gpt-5-6
glm-52-vs-gpt-55.md
GLM-5.2 — Китай выложил open-weight модель, которая бьёт GPT-5.5 и дышит в спину Claude Opus 4.8
> · 8 мин

GLM-5.2 — Китай выложил open-weight модель, которая бьёт GPT-5.5 и дышит в спину Claude Opus 4.8

Z.ai выложила GLM-5.2 — open-weight модель на 753B параметров под MIT, которая бьёт GPT-5.5 на кодинг-бенчмарках и отстаёт от Claude Opus 4.8 всего на 1% на длинных задачах. За первые дни она забрала 75% трафика Z.ai на OpenRouter. Разбираем цифры, цену, как подключить и почему дешёвый токен не значит дешёвый результат.

ai agents llm coding
baidu-unlimited-ocr.md
Unlimited-OCR — Baidu взяла идею DeepSeek OCR, починила её главный потолок и обогнала оригинал
> · 7 мин

Unlimited-OCR — Baidu взяла идею DeepSeek OCR, починила её главный потолок и обогнала оригинал

Baidu выложила Unlimited-OCR — open-source модель на 3B параметров, которая читает 40+ страниц за один проход и держит KV-кэш постоянным благодаря R-SWA. По замерам Baidu обходит DeepSeek OCR на OmniDocBench. Разбираем, как это работает, как запустить и кому она реально нужна.

llm open-source vision ocr
gpt-56-kindle-kepler-checkpoints.md
GPT-5.6 на низком старте: нашли финальный чекпоинт kindle-alpha, релиз — вопрос дней. Но половину «утечек» дорисовали
> · 9 мин

GPT-5.6 на низком старте: нашли финальный чекпоинт kindle-alpha, релиз — вопрос дней. Но половину «утечек» дорисовали

OpenAI тестирует финальные чекпоинты GPT-5.6 — kindle-alpha (release candidate) и kepler-alpha. Polymarket даёт 82% на релиз до 30 июня. Разбираем, что реально нашли в логах Codex, какие «спеки» дорисованы, и что делать разработчику прямо сейчас.

ai llm openai developer-tools
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe