$ grep -r "llm" ./posts/

# llm

Большие языковые модели — бенчмарки, архитектуры, контекстные окна, fine-tuning и практическое применение LLM в разработке.

Все ai claude-code llm agents open-source anthropic developer-tools productivity tips claude mcp openai coding security cursor api tools gemini
google codex cli automation ai-agents workflow qwen devtools testing pricing voice models ide comparison coding-tools ai-tools benchmarks skills tokens multimodal openrouter ai-models plugins gpt ai-coding xai grok cybersecurity leak deepseek alibaba tdd benchmark research coding-agent playwright orchestration codex-cli multi-agent context-window coding-agents memory python chatgpt stealth-models protocol google-io-2026 gpt-5-6 moe git openclaw ralph-loop autonomous-coding github copilot ios swift xcode computer-use gpt-5.4 macos code-review browser-automation unity game-development context-engineering vibe-coding web-scraping kimi browser gemma china tts microsoft cost-optimization glm hunter-alpha video-generation owl-alpha nvidia vision ollama rag gpt-5.6 local local-llm ai-safety fable meta prompt-engineering safety prompt-injection open-weights coding-assistant deep-research terminal qa php laravel assistant worktrees docker parallel-development oauth websocket context-management mobile perplexity multi-model image-generation remotion video shorts instagram tiktok permissions future code-intelligence knowledge-graph future-of-programming opinion hooks xctest commands local-ai liquid-ai privacy fast-mode copilot-cli linux windows machine-learning cron scheduled-tasks effort settings godot unreal-engine search-api tavily exa agent-teams opus-4.6 expo cowork remote-control plugin google-colab responsive-design frontend telegram discord channels astral superapp licensing documentation prompts figma design web-development demo gamedev gemini-cli speech scraping self-improvement ultraplan debugging function-calling free-tools elevenlabs infrastructure configuration skill dotnet nous-research gpt-6 llama healer-alpha elephant-alpha gpt-5-5 tmux stealth-launch fal elixir linear rust tencent voice-cloning reasoning nemotron mythos policy dense-model game-dev open-beta sonnet gpt-55 spacex managed-agents realtime subq subquadratic long-context transformers finance edge-ai vector-search notion typescript workers malware chrome leaks veo lmarena fingerprinting api-pricing onboarding opus-4-8 robotics world-models physical-ai minimax free-models ocr baidu document-ai release-tracker gemini-35-pro ml amazon data-labeling amd hardware llama-cpp code-quality interpretability apple lawsuit curl writing pentesting career wordpress vulnerability evaluation context7 redis devops rce migration alignment kubernetes npm supply-chain cve sqlite dataviz inference vllm performance enterprise search embeddings
open-weight-coding-models-july-2026.md
На чём кодить дёшево в июле 2026: GLM-5.2 обошёл GPT-5.5 на SWE-Pro, MiniMax M3 стоит копейки — но «open» не значит «на твоём ноуте»
> · 7 мин

На чём кодить дёшево в июле 2026: GLM-5.2 обошёл GPT-5.5 на SWE-Pro, MiniMax M3 стоит копейки — но «open» не значит «на твоём ноуте»

Открытые веса догнали закрытых: GLM-5.2 обходит GPT-5.5 на SWE-bench Pro, MiniMax M3 стоит $0.30 за миллион токенов, а DeepSeek V4-Pro кодит почти как Opus за десятую часть цены. Сравниваем цену, бенчмарки, контекст и лицензии — и почему «open-weight» не значит «влезет в твой ноут».

ai llm benchmarks coding
ai-writing-tell-negative-parallelism.md
«Это не просто фича — это философия»: главный тик AI-текстов, который никто не может объяснить. The Atlantic посчитал, Fortune 500 спалилась
> · 6 мин

«Это не просто фича — это философия»: главный тик AI-текстов, который никто не может объяснить. The Atlantic посчитал, Fortune 500 спалилась

The Atlantic разобрал негативный параллелизм — конструкцию «это не X, а Y», на которой сходятся модели всех лабораторий. Механизм никто не может объяснить, а Barron's насчитал 4-кратный рост паттерна в отчётах Fortune 500. Как вычистить тик из своих текстов и доков.

ai llm prompt-engineering writing
gemini-35-pro-cappuccino-leak.md
Gemini 3.5 Pro перенесли в третий раз. Зато утечка «Cappuccino» показала, что Google готовит: 2M контекста и Deep Thinking
> · 6 мин

Gemini 3.5 Pro перенесли в третий раз. Зато утечка «Cappuccino» показала, что Google готовит: 2M контекста и Deep Thinking

Запуск Gemini 3.5 Pro сдвинулся на конец июля — уже третий перенос. Утечки описывают модель под кодовым именем Cappuccino: 2M-токенный контекст, режим Deep Thinking и сильный фронтенд-кодинг. Разбираем, что известно и чему из этого верить.

ai llm gemini google
muse-spark-11-meta-api.md
Meta впервые в истории продаёт свою модель. Muse Spark 1.1 стоит четверть цены конкурентов — а на HN уже поймали её бенчмарки на читерстве
> · 7 мин

Meta впервые в истории продаёт свою модель. Muse Spark 1.1 стоит четверть цены конкурентов — а на HN уже поймали её бенчмарки на читерстве

Meta запустила Meta Model API — первый платный доступ к собственной модели. Muse Spark 1.1: $1.25/$4.25 за миллион, 1M контекста, победы в агентных бенчмарках и скандал с Terminal-Bench на Hacker News. $20 кредитов на старт, но только для США.

ai agents llm api
grok-45-cursor-spacexai.md
Grok 4.5 — Маск и Cursor обучили модель на чужих сессиях кодинга. Класс Opus за $2/$6, но с задержкой 14 секунд
> · 6 мин

Grok 4.5 — Маск и Cursor обучили модель на чужих сессиях кодинга. Класс Opus за $2/$6, но с задержкой 14 секунд

xAI и Cursor выпустили совместно обученную модель Grok 4.5: $2/$6 за миллион токенов, 500K контекста и обучение на триллионах токенов реальных сессий Cursor. Разбираем цены, независимые бенчмарки и главный подвох — задержку первого токена в 14 секунд.

ai cursor llm xai
gpt-56-public-launch.md
GPT-5.6 выходит для всех: Terra отдаёт уровень GPT-5.5 за полцены, а за запись кеша OpenAI теперь берёт деньги
> · 6 мин

GPT-5.6 выходит для всех: Terra отдаёт уровень GPT-5.5 за полцены, а за запись кеша OpenAI теперь берёт деньги

GPT-5.6 открывается для всех: Sol за цену GPT-5.5, Terra вдвое дешевле при том же уровне, Luna за $1. Плюс платная запись кеша и релиз, дату которого согласовали с правительством США.

llm api openai pricing
ai-coding-models-guide-july-2026.md
На чём кодить в июле 2026: расклад моделей по цене и задаче, когда флагманы дорожают каждую неделю
> · 5 мин

На чём кодить в июле 2026: расклад моделей по цене и задаче, когда флагманы дорожают каждую неделю

Sonnet 5 стал дефолтом с хитрым токенизатором, Fable 5 ушёл в кредиты по $10/$50, GPT-5.6 в превью, а локальные модели дышат в спину облачным. Практический расклад: какую модель выбрать под задачу и бюджет, без маркетинга.

ai llm coding claude
fable-5-leaves-subscriptions-gpt-56.md
Fable 5 должен был выпасть из подписок 7 июля. В последний момент Anthropic продлила до 12-го — прямо под ожидаемый GPT-5.6
> · 6 мин

Fable 5 должен был выпасть из подписок 7 июля. В последний момент Anthropic продлила до 12-го — прямо под ожидаемый GPT-5.6

7 июля Claude Fable 5 должен был уйти из подписок Pro/Max/Team в usage credits по $10/$50 — но в этот день Anthropic продлила доступ до 12 июля. Что меняется, куда роутить задачи и причём тут ожидаемый GPT-5.6.

ai llm claude anthropic
laguna-xs-21-local-coding-model.md
Laguna XS 2.1 — агентный кодер на 33B, который влезает в MacBook и не отправляет твой код никуда
> · 6 мин

Laguna XS 2.1 — агентный кодер на 33B, который влезает в MacBook и не отправляет твой код никуда

Poolside выложила Laguna XS 2.1 — open-weight MoE на 33B (3B активных), которая крутится на Mac с 36 ГБ RAM. 70.9% на SWE-bench Verified, контекст 256K, установка одной командой в Ollama. Полностью локальный агентный кодер за спиной которого западная лаба.

ai llm coding open-source
claude-sonnet-5-tokenizer-price.md
Claude Sonnet 5 — почти Opus 4.8 за 40% цены. Но новый токенизатор съест вашу скидку
> · 6 мин

Claude Sonnet 5 — почти Opus 4.8 за 40% цены. Но новый токенизатор съест вашу скидку

Anthropic выпустила Claude Sonnet 5 и с 1 июля сделала его дефолтом для всех. На высоких effort-уровнях он догоняет Opus 4.8 за 40% цены — но новый токенизатор считает тот же текст в 1.35× больше токенов, а с 1 сентября прайс вырастет на 50%.

ai agents llm claude