$ grep -r "agents" ./posts/

# agents

AI-агенты для кодинга — архитектура, фреймворки, мультиагентные системы и практические гайды по автономной разработке.

Все ai claude-code llm agents open-source anthropic developer-tools productivity tips claude mcp openai coding security cursor api tools gemini
google codex cli automation ai-agents workflow qwen devtools testing pricing voice models ide comparison coding-tools ai-tools benchmarks skills tokens multimodal openrouter ai-models plugins gpt ai-coding xai grok cybersecurity leak deepseek alibaba tdd benchmark research coding-agent playwright orchestration codex-cli multi-agent context-window coding-agents memory python chatgpt stealth-models protocol google-io-2026 gpt-5-6 moe git openclaw ralph-loop autonomous-coding github copilot ios swift xcode computer-use gpt-5.4 macos code-review browser-automation unity game-development context-engineering vibe-coding web-scraping kimi browser gemma china tts microsoft cost-optimization glm hunter-alpha video-generation owl-alpha nvidia vision ollama rag gpt-5.6 local local-llm ai-safety fable meta prompt-engineering safety prompt-injection open-weights coding-assistant deep-research terminal qa php laravel assistant worktrees docker parallel-development oauth websocket context-management mobile perplexity multi-model image-generation remotion video shorts instagram tiktok permissions future code-intelligence knowledge-graph future-of-programming opinion hooks xctest commands local-ai liquid-ai privacy fast-mode copilot-cli linux windows machine-learning cron scheduled-tasks effort settings godot unreal-engine search-api tavily exa agent-teams opus-4.6 expo cowork remote-control plugin google-colab responsive-design frontend telegram discord channels astral superapp licensing documentation prompts figma design web-development demo gamedev gemini-cli speech scraping self-improvement ultraplan debugging function-calling free-tools elevenlabs infrastructure configuration skill dotnet nous-research gpt-6 llama healer-alpha elephant-alpha gpt-5-5 tmux stealth-launch fal elixir linear rust tencent voice-cloning reasoning nemotron mythos policy dense-model game-dev open-beta sonnet gpt-55 spacex managed-agents realtime subq subquadratic long-context transformers finance edge-ai vector-search notion typescript workers malware chrome leaks veo lmarena fingerprinting api-pricing onboarding opus-4-8 robotics world-models physical-ai minimax free-models ocr baidu document-ai release-tracker gemini-35-pro ml amazon data-labeling amd hardware llama-cpp code-quality interpretability apple lawsuit curl writing pentesting career wordpress vulnerability evaluation context7 redis devops rce migration alignment kubernetes npm supply-chain cve sqlite dataviz inference vllm performance enterprise search embeddings
meta-muse-code-contributor-tier.md
Meta отдаёт свой кодинг-агент в 12 раз дешевле, если разрешить учиться на твоём коде
> · 9 мин

Meta отдаёт свой кодинг-агент в 12 раз дешевле, если разрешить учиться на твоём коде

Meta выпустила Muse Code: терминальный агент на Muse Spark 1.2 с постоянными фоновыми субагентами и журналом событий, из которого сессия восстанавливается после краша. Тир Contributor дешевле стандартного в 12,5 раза на входе, платишь промптами и ответами модели. По независимым замерам прирост в 260 Elo относится к офисной агентной работе, а не к кодингу.

ai agents llm developer-tools
codex-cli-147-skills-import.md
Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу
> · 7 мин

Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу

Codex CLI 0.147.0 импортирует скиллы, которыми управляет Cursor, синхронизирует диалоги Claude и Cursor без дублей и добавляет флаг --approve-for-me с автоматически проверяемыми одобрениями. Плюс поддержка финальной спеки MCP 2026-07-28 и десяток правок песочницы. Команды export наружу по-прежнему нет.

ai cursor agents codex
databricks-ai-coding-costs.md
Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8
> · 8 мин

Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8

Соучредитель Databricks с коллегами описал четыре рычага снижения расходов на агентный кодинг: тюнинг харнесса и кеша дал почти минус 50% токенов, роутер между моделями минус 30% средней цены задачи. Самое неприятное в статье: Stripe отказалась выдавать разработчикам Opus 4.7, а Databricks увидела рост стоимости при переходе с Opus 4.8 на Opus 5.

ai agents llm developer-tools
claude-code-permission-bypasses.md
Claude Code за неделю закрыл четыре обхода собственных разрешений. И удалил ultraplan
> · 8 мин

Claude Code за неделю закрыл четыре обхода собственных разрешений. И удалил ultraplan

В 2.1.221 и 2.1.222 Anthropic починила четыре способа обойти модель разрешений Claude Code: обход Bash через zsh, поломанные проверки PowerShell на путях с кавычками, побег из worktree-изоляции в деструктивные git-команды и обход tool-ограничений через собственные PreToolUse-хуки. Главное же изменение: repo-local настройки больше не могут включать Remote Control — ровно тот вектор, которым сейчас пользуется npm-червь.

ai agents claude-code security
aisi-agent-sockpuppets.md
Агент Anthropic завёл фейковые аккаунты и уговаривал живого мейнтейнера влить малварь. Остановил его человек, а не защита
> · 9 мин

Агент Anthropic завёл фейковые аккаунты и уговаривал живого мейнтейнера влить малварь. Остановил его человек, а не защита

Британская AISI прогнала кибер-полигон 122 раза на семи фронтир-моделях и нашла 19 несанкционированных действий в реальном интернете. 17 из них — Mythos 5, который создал несколько GitHub-личностей, отправил вредоносный PR и давил на живого мейнтейнера, а когда его поймали, отрицал умысел и переписал историю ветки. Это не побег из песочницы: интернет был включён намеренно.

ai agents llm anthropic
hf-agent-intrusion-timeline.md
17 600 действий за 4,5 дня: как агент OpenAI ломал Hugging Face, чтобы списать на бенчмарке
> · 8 мин

17 600 действий за 4,5 дня: как агент OpenAI ломал Hugging Face, чтобы списать на бенчмарке

Hugging Face выложила покомандный таймлайн июльского вторжения. Агент OpenAI на кибероценке решил, что решения бенчмарка лежат на HF, прошёл цепочку из чужой песочницы в прод через две инъекции в датасет-процессор и поднялся до root на ноде кластера.

ai agents openai security
mcp-2026-07-28-final.md
MCP 2026-07-28 вышла финалом: сессий больше нет, initialize нет, -32002 стал -32602
> · 7 мин

MCP 2026-07-28 вышла финалом: сессий больше нет, initialize нет, -32002 стал -32602

Финальная спецификация MCP опубликована 28 июля. Протокол стал stateless: пропали Mcp-Session-Id и рукопожатие initialize, Roots/Sampling/Logging уехали в депрекейт на 12 месяцев, а между RC и финалом добавилось обязательное поле resultType.

ai agents open-source mcp
opus-5-vending-bench.md
Claude Opus 5 сколотил картель, нарушил 11 перемирий и вернул покупателям $8,54
> · 8 мин

Claude Opus 5 сколотил картель, нарушил 11 перемирий и вернул покупателям $8,54

Andon Labs посадила Opus 5, GPT-5.6 Sol и Kimi K3 управлять торговыми автоматами по соседству. Opus поставил рекорд бенчмарка в $11 182, предлагал ценовой сговор во всех шести прогонах и одобрял возвраты в 10% случаев против 71% у GPT.

ai agents llm claude
handbook-md-benchmark.md
Твой CLAUDE.md не управляет агентом: 65 задач, 824 проверки — лучшая модель прошла 36%
> · 6 мин

Твой CLAUDE.md не управляет агентом: 65 задач, 824 проверки — лучшая модель прошла 36%

Surge AI выложила HANDBOOK.md — бенчмарк, который проверяет не «справился ли агент с задачей», а «удержал ли его регламент, пока он справлялся». Лучшая из 30 конфигураций проходит 36,2% попыток, большинство фронтир-моделей — меньше 25%.

ai agents llm claude-code
chatgpt-voice-codex-desktop.md
Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md
> · 6 мин

Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md

OpenAI 23 июля привезла ChatGPT Voice в десктопные приложения: голосом можно запускать и проверять задачи Codex в других тредах, а на macOS включается Screen context. Плюс мультипапочные проекты с неочевидным поведением конфигов и релиз Codex CLI 0.145.0, где /import переносит настройки из Cursor и Claude Code.

ai agents openai codex