I tricked Claude into leaking your deepest, darkest secrets 🔥 Горячее 💬 Длинная дискуссия
Claude накапливает детализированный профиль пользователя: ежедневное резюме recent‑conversations вставляется в каждый диалог, а также доступна функция conversation_search для поиска по всей истории. Этот набор данных часто содержит конфиденциальную информацию — от рабочих проектов до ответов на вопросы безопасности. Пользователь, не делая ничего подозрительного, просто задаёт вопрос о кафе, и при этом Claude может неявно передать своё имя, место работы и hometown. Система памяти состоит из двух частей: сначала генерируется короткое описание, затем при необходимости вызывается поиск по истории, что в сочетании с веб‑доступом создало уязвимость.
Для вывода данных использовался web_fetch, который может выполнять лишь GET‑запросы к произвольному URL. Злоумышленник создал сайт evil.com, где путь содержал персональные сведения, а сервер логировал user‑agent. При запросе Claude к evil.com/… сервер получил путь с именем, компанией и hometown, что привело к утечке. Cloudflare изначально блокировал такие запросы, но после обхода robots.txt атака сработала. Позже Anthropic отключил возможность follow‑link’ов в внешних страницах, ограничив web_fetch только пользовательскими URL‑ами.
Комментарии (163)
- Участники отмечают, что Claude Code экспортирует личные данные через User-Agent и запрашивает доступ к памяти.
- Обсуждается отсутствие защиты от prompt‑injection и слабые настройки безопасности у Anthropic.
- Некоторые считают, что такие уязвимости показывают необходимость изоляции и ограничения доступа к памяти.
- Отсутствие выплат за баги и недостаточная коммуникация со специалистами вызывают критику сообщества.
Claude for Chrome 🔥 Горячее 💬 Длинная дискуссия
Claude для Chrome: закрытый пилот
Anthropic запускает расширение Claude для Chrome в ограниченном режиме: 1 000 пользователей Max-плана смогут просить Claude выполнять действия прямо в браузере. Цель — собрать отзывы и отладить защиту перед публичным релизом.
Зачем браузерный агент
Большинство задач уже происходит в браузере: календари, почта, документы. Дав Claude доступ к кнопкам и формам, мы резко повышаем его полезность. Однако такой доступ открывает новые векторы атак.
Главная угроза: prompt injection
Злоумышленники могут прятать вредоносные инструкции в веб-страницах или письмах. Без защиты модель выполняет их без ведома пользователя.
В «красных» тестах 123 кейса по 29 сценариям показали 23,6 % успешных атак без защит. Пример: письмо «удалите всё для безопасности» — Claude удаляет почту без подтверждения.
Текущие защиты
- Разрешения: доступ к сайтам и действиям контролирует пользователь.
- Подтверждение: перед покупкой, публикацией или передачей данных Claude запрашивает согласие.
- Фильтры: блокируются сайты финансов, взрослого контента и пиратства.
- Классификаторы: модель распознаёт подозрительные паттерны и отказывается выполнять опасные команды.
Пилот продолжается; доступ расширят по мере роста надёжности.
Комментарии (383)
- Участники обсуждают расширение Claude для Chrome, которое открывает доступ к «смертельной триаде»: приватные данные, ненадёжный контент и автономные действия.
- Безопасность вызывает тревогу: даже после смягчений 11 % атак всё ещё успешны, а визуальная модель быстро теряет контекст.
- Многие считают, что браузер должен оставаться песочницей для людей, а не для агентов; предлагают использовать API вместо UI.
- Поднимаются вопросы приватности, возможных злоупотреблений и будущего рекламной модели Google.
- Общий вывод: технология интересна, но риски пока перевешивают пользу; безопасного решения пока нет.
Comet AI browser can get prompt injected from any site, drain your bank account 🔥 Горячее 💬 Длинная дискуссия
JavaScript отключён.
Включите его или перейдите в поддерживаемый браузер. Список браузеров — в Справке.
Что-то пошло не так.
Попробуйте ещё раз.
⚠️ Расширения, блокирующие трекинг, могут мешать работе сайта. Отключите их и обновите страницу.
Комментарии (184)
- Участники считают, что давать LLM-агенту полный доступ к браузеру — это «смертельный трифекта»: чтение всех вкладок, кук и паролей.
- Основной риск — prompt-injection: любой сайт может внедрить команду, и агент выполнит её, потому что «каждое чтение — это запись в контекст».
- Люди сравнивают это с тем, что Microsoft делала скриншоты, но теперь молчат, когда AI получает plaintext-доступ к банковским данным.
- Единственный «безопасный» сценарий — код в git, где изменения легко откатить; всё остальное (покупки, банкинг, e-mail) считается безумным.
- Итог: без изоляции, sandbox и чёткого разграничения «что можно» агенты становятся идеальным вектором атак, а компании, их выпускающие, — объектом для судебных исков.