
Минулого вікенду в Google стали публічно доступними для пошуку невизначена кількість чатів Claude та Artifacts — інтерактивних міні-додатків і документів, які користувачі можуть створювати всередині Claude. Це сталося після того, як користувачі Reddit виявили, що введення пошукових операторів на кшталт “site:claude.ai/share” у Google видає довгий список спільних розмов. Деякі з них, за повідомленнями, містили медичні записи, приватні документи компаній, а також імена та номери телефонів дітей.
Проблема, ймовірно, виникла через функцію Claude “share chat” (ділитися чатом), яка дозволяє користувачам створювати посилання, що надають доступ до розмови чи проєкту будь-кому, хто має призначений URL. “Будь-хто з посиланням може переглядати”, — попереджає інтерфейс Claude. Ця фраза чітко натякає, що функція призначена в основному для обміну чатами з друзями, колегами та невеликими групами, а не з усім інтернетом. Наприклад, Google Docs пропонує схожу функцію, але ці документи не стають загальнодоступними в Google.


Компанія Anthropic, схоже, звинуватила у витоку користувачів. Коли її запитали про те, що сталося, компанія повідомила TechCrunch, що посилання для спільного доступу з’являються в результатах пошуку лише тоді, коли вони були розміщені десь, доступному для пошукових систем, наприклад, на форумі або в дописі в соціальних мережах. Також було додано, що посилання, надіслане приватно комусь, залишається поза пошуком.
Представниця Емі Ротерхем додала в поясненні: “Ми надаємо людям контроль над публічним поширенням їхніх розмов у Claude, і відповідно до наших принципів конфіденційності, ми не передаємо каталоги чатів або карти сайту пошуковим системам, таким як Google. Ці посилання для спільного доступу неможливо вгадати або виявити, якщо люди самі не вирішать їх поширити. Коли хтось ділиться розмовою, він робить цей контент загальнодоступним, і, як і інший загальнодоступний веб-контент, він може бути архівований сторонніми сервісами.”
Проблема вперше була виявлена користувачем Reddit у суботу, а першим про це повідомило видання 404 Media вранці в понеділок.
Станом на понеділок, після обіду, тестовий пошук, проведений TechCrunch у Google за методом, описаним у дописі на Reddit, не дав жодних результатів, що свідчить про те, що витік було якимось чином усунуто.
До виправлення проблеми видання Futurism повідомило про виявлення “докладної медичної звіту реального пацієнта, результатів клінічних випробувань, що містили імена пацієнтів, документи з іменами та номерами телефонів дітей молодшого шкільного віку, документи компанії з позначкою “лише для внутрішнього використання” та відгуки співробітників, що містили особисту інформацію про працівників.”
Серед виявлених Artifacts були код та робочі нотатки. Щонайменше в одному випадку, як повідомило Fortune, чат з позначкою “shared by Anthropic” (поділився Anthropic) також демонстрував, як Claude генерує еротичний контент.
Політика використання Anthropic чітко забороняє Claude генерувати відверто сексуальний контент, і отримання чат-бота для створення матеріалів, що суперечать його заявленим настановам — шляхом повторного або креативно сформульованого промптингу — є закономірністю, яка періодично виникає в більшості великих моделей ШІ. Наразі незрозуміло з виявлених чатів, як був згенерований контент, що викликав занепокоєння, і Anthropic ще не відповіла на запит TechCrunch щодо коментарів у цій конкретній ситуації.
Представник Google Нед Адріанс заявив TechCrunch, що “Ні Google, ні будь-яка інша пошукова система не контролює, які сторінки стають публічними в мережі, і ці сторінки були проіндексовані багатьма пошуковими системами. Ми надаємо власникам сайтів чіткі засоби контролю для визначення того, чи можуть сторінки скануватися або індексуватися, і ми завжди поважаємо ці директиви.”
Минулого року Forbes повідомило про подібну проблему, коли сотні чатів Claude були проіндексовані пошуковими системами — тоді Google оцінив, що проіндексував трохи менше 600 розмов, перш ніж сторінки зникли з результатів пошуку. Наскільки точно поточний витік відповідає цьому масштабу, незалежно не підтверджено, хоча численні користувачі повідомили про виявлення спільних розмов за допомогою того ж типу пошукового запиту в Google, який використовувався для виявлення кешу минулого року. Також минулого року 404 Media повідомило, що дослідник зміг зібрати близько 100 000 розмов ChatGPT, які були налаштовані на публічний доступ.
Щоб переглянути, для яких чатів Claude ви надали публічне посилання, перейдіть до Налаштування -> Конфіденційність -> Спільні чати.
Коли ви купуєте за посиланнями в наших статтях, ми можемо отримати невелику комісію. Це не впливає на нашу редакційну незалежність.
Дізнатися більше на: techcrunch.com
