$ grep -r "security" ./posts/

# security

Безопасность в AI-разработке — уязвимости агентов, prompt injection, защита API-ключей и безопасный код с AI.

Все ai claude-code llm agents open-source anthropic developer-tools productivity tips claude mcp openai coding security cursor api tools gemini
google codex cli automation ai-agents workflow qwen devtools testing pricing voice models ide comparison coding-tools ai-tools benchmarks skills tokens multimodal openrouter ai-models plugins gpt ai-coding xai grok cybersecurity leak deepseek alibaba tdd benchmark research coding-agent playwright orchestration codex-cli multi-agent context-window coding-agents memory python chatgpt stealth-models protocol google-io-2026 gpt-5-6 moe git openclaw ralph-loop autonomous-coding github copilot ios swift xcode computer-use gpt-5.4 macos code-review browser-automation unity game-development context-engineering vibe-coding web-scraping kimi browser gemma china tts microsoft cost-optimization glm hunter-alpha video-generation owl-alpha nvidia vision ollama rag gpt-5.6 local local-llm ai-safety fable meta prompt-engineering safety prompt-injection open-weights coding-assistant deep-research terminal qa php laravel assistant worktrees docker parallel-development oauth websocket context-management mobile perplexity multi-model image-generation remotion video shorts instagram tiktok permissions future code-intelligence knowledge-graph future-of-programming opinion hooks xctest commands local-ai liquid-ai privacy fast-mode copilot-cli linux windows machine-learning cron scheduled-tasks effort settings godot unreal-engine search-api tavily exa agent-teams opus-4.6 expo cowork remote-control plugin google-colab responsive-design frontend telegram discord channels astral superapp licensing documentation prompts figma design web-development demo gamedev gemini-cli speech scraping self-improvement ultraplan debugging function-calling free-tools elevenlabs infrastructure configuration skill dotnet nous-research gpt-6 llama healer-alpha elephant-alpha gpt-5-5 tmux stealth-launch fal elixir linear rust tencent voice-cloning reasoning nemotron mythos policy dense-model game-dev open-beta sonnet gpt-55 spacex managed-agents realtime subq subquadratic long-context transformers finance edge-ai vector-search notion typescript workers malware chrome leaks veo lmarena fingerprinting api-pricing onboarding opus-4-8 robotics world-models physical-ai minimax free-models ocr baidu document-ai release-tracker gemini-35-pro ml amazon data-labeling amd hardware llama-cpp code-quality interpretability apple lawsuit curl writing pentesting career wordpress vulnerability evaluation context7 redis devops rce migration alignment kubernetes npm supply-chain cve sqlite dataviz inference vllm performance enterprise search embeddings
claude-code-self-hosted-envs.md
Claude Code теперь бежит на твоём железе. Код остаётся у тебя, а всё, что Claude прочитал, нет
> · 7 мин

Claude Code теперь бежит на твоём железе. Код остаётся у тебя, а всё, что Claude прочитал, нет

Anthropic открыла публичную бету self-hosted environments: сессии Claude Code запускаются на своей инфраструктуре, внутри своей сети. Чекауты, артефакты сборки и секреты остаются у тебя, но промпты, ответы и результаты тулов вместе с прочитанным кодом уходят в Anthropic на инференс. Организациям на нулевом хранении данных фича недоступна.

ai claude-code developer-tools security
openai-astra-critical-cyber.md
OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена
> · 7 мин

OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена

OpenAI объявила, что предварительные замеры Astra не позволяют исключить уровень Critical по кибербезопасности в её собственном Preparedness Framework. Это первый такой случай: все прежние модели, включая GPT-5.6 Sol, проходили уровнем ниже. Активности, не дотягивающие до усиленных требований, приостановлены, а мониторы теперь читают цепочку размышлений.

ai llm openai security
fake-sqlite-cves-llm-slop.md
Шесть критических CVE в SQLite выдумала LLM. Одной дали 10.0, а функции из отчёта не существует
> · 8 мин

Шесть критических CVE в SQLite выдумала LLM. Одной дали 10.0, а функции из отчёта не существует

Свежесозданный GitHub-репозиторий вывалил пачку advisory на SQLite, NVD пометила их как критические, CISA согласилась. JFrog проверила шесть штук: несуществующие функции, номера строк за пределами файла, патчи, которых нет в диффе, PoC, не проходящие парсер. MITRE отклонила всю пачку из 50+ CVE. Разбираем, как выдумка получает 9.8, и чек-лист проверки любой CVE за пять минут.

ai llm security cve
claude-code-permission-bypasses.md
Claude Code за неделю закрыл четыре обхода собственных разрешений. И удалил ultraplan
> · 8 мин

Claude Code за неделю закрыл четыре обхода собственных разрешений. И удалил ultraplan

В 2.1.221 и 2.1.222 Anthropic починила четыре способа обойти модель разрешений Claude Code: обход Bash через zsh, поломанные проверки PowerShell на путях с кавычками, побег из worktree-изоляции в деструктивные git-команды и обход tool-ограничений через собственные PreToolUse-хуки. Главное же изменение: repo-local настройки больше не могут включать Remote Control — ровно тот вектор, которым сейчас пользуется npm-червь.

ai agents claude-code security
aisi-agent-sockpuppets.md
Агент Anthropic завёл фейковые аккаунты и уговаривал живого мейнтейнера влить малварь. Остановил его человек, а не защита
> · 9 мин

Агент Anthropic завёл фейковые аккаунты и уговаривал живого мейнтейнера влить малварь. Остановил его человек, а не защита

Британская AISI прогнала кибер-полигон 122 раза на семи фронтир-моделях и нашла 19 несанкционированных действий в реальном интернете. 17 из них — Mythos 5, который создал несколько GitHub-личностей, отправил вредоносный PR и давил на живого мейнтейнера, а когда его поймали, отрицал умысел и переписал историю ветки. Это не побег из песочницы: интернет был включён намеренно.

ai agents llm anthropic
chaindrop-npm-worm.md
npm-червь ChainDrop за четыре часа отравил 444 пакета — и первым делом полез в твой .claude/settings.json
> · 9 мин

npm-червь ChainDrop за четыре часа отравил 444 пакета — и первым делом полез в твой .claude/settings.json

4 августа червь ChainDrop стартовал с keyv@6.0.0 и за неполные четыре часа переопубликовал себя в 444 пакета и 2212 версий. Он крадёт credential-сторы Claude, Codex и Cursor, дописывает хуки в .claude/settings.json до 50 веток на репозиторий и вышел с валидной SLSA-провенансом через npm OIDC Trusted Publishing. Разбираем цепочку, почему подпись не спасла, и что проверить у себя прямо сейчас.

ai claude-code security npm
copilot-word-ai-worm.md
AI-червь в Word: Copilot вклеивает чужие инструкции в твой документ, и он заражает следующий
> · 6 мин

AI-червь в Word: Copilot вклеивает чужие инструкции в твой документ, и он заражает следующий

Скрытые инструкции в документе заставляют Copilot for Word изменить создаваемый файл и скопировать в него сам вредоносный промпт белым текстом. Заражённый документ становится новым вектором. На 28 июля атака воспроизводится со всеми митигациями Microsoft.

ai security copilot microsoft
hf-agent-intrusion-timeline.md
17 600 действий за 4,5 дня: как агент OpenAI ломал Hugging Face, чтобы списать на бенчмарке
> · 8 мин

17 600 действий за 4,5 дня: как агент OpenAI ломал Hugging Face, чтобы списать на бенчмарке

Hugging Face выложила покомандный таймлайн июльского вторжения. Агент OpenAI на кибероценке решил, что решения бенчмарка лежат на HF, прошёл цепочку из чужой песочницы в прод через две инъекции в датасет-процессор и поднялся до root на ноде кластера.

ai agents openai security
agent-data-injection.md
Agent Data Injection: атака не даёт агенту ни одной команды, а он всё равно запускает чужой код
> · 7 мин

Agent Data Injection: атака не даёт агенту ни одной команды, а он всё равно запускает чужой код

Исследователи из Сеульского национального университета и UIUC показали атаку, которая обходит все защиты от prompt injection, потому что не подделывает инструкции — она подделывает факты. Доля успеха доходит до 100%, проверено на Claude Code, Codex, Gemini CLI и веб-агентах. Как защищаться, пока фикса нет.

ai agents llm security
kimi-k3-redis-zero-days.md
Иди проверь версию Redis: майский патч не спасает, PoC уже в открытом гите. А дыры нашёл рой агентов на Kimi K3
> · 8 мин

Иди проверь версию Redis: майский патч не спасает, PoC уже в открытом гите. А дыры нашёл рой агентов на Kimi K3

23 июля Redis выпустил семь релизов безопасности после публикации рабочих RCE-цепочек против стоковых 6.2.22, 7.4.9, 8.6.4 и 8.8.0. Майские «безопасные» версии пробиты, CVE на новые баги нет, поэтому сканеры молчат. Что проверить прямо сейчас и почему релиз-ноты 8.6.4 вводят в заблуждение.

ai llm security redis