Auto mode становится режимом по умолчанию в Claude Code: как удалось свести indirect prompt injection почти к нулю Борис Черный (Boris Cherny) из Anthropic рассказывает, что многослойная защита — обучение модели, входные probes и классификатор, проверяющий намерение, — позволила свести успешность непрямых prompt injection-атак практически к нулю даже на невиданных ранее атаках. Со следующей недели auto mode станет режимом по умолчанию в Claude Code. Читать статью
Auto mode становится режимом по умолчанию в Claude Code: как удалось свести…
Источник
https://t.me/ai_longreads/801Канал Про AI: Лучшие cтатьи и исследования · опубликовано 14 авг. 2026 г.
Из этого канала
- #802Утренняя подборка AI новостей: Инструмент для удаления водяных знаков ИИ…
Утренняя подборка AI новостей: Инструмент для удаления водяных знаков ИИ Утилита для очистки метаданных C2PA и удаления водяных знаков из файлов форматов PNG,…
- #803Что сегодня обсуждают профессионалы AI-индустрии: Qwen3.8-27B-Uncensored-FP8…
Что сегодня обсуждают профессионалы AI-индустрии: Qwen3.8-27B-Uncensored-FP8 Версия модели Qwen 3.8 27B без цензуры в формате FP8.
- #804То, как мы пользуемся компьютерами, скоро изменится навсегда Почему уже совсем…
То, как мы пользуемся компьютерами, скоро изменится навсегда Почему уже совсем скоро мы будем оркестрировать агентов в облаке голосом, а не вручную работать с…
- #800Топ AI-тем дня: Превращение технических книг в навыки для Claude Code…
Топ AI-тем дня: Превращение технических книг в навыки для Claude Code Инструмент позволяет конвертировать PDF-файлы технических книг в формат навыков для…
- #799Представляем Kitesurf: браузер, созданный в первую очередь для агентов и…
Представляем Kitesurf: браузер, созданный в первую очередь для агентов и работающий в V8-изолятах на Cloudflare Workers Cloudflare выпустила Kitesurf — новый…