- Объяснять риски галлюцинаций, предвзятости, конфиденциальности и авторского права
- Проверять важные факты по правилу двух источников
- Знать, какие данные никогда нельзя вписывать в промпт
В 2023 году суд в Нью-Йорке оштрафовал двух адвокатов, которые подали документ со ссылками на несуществующие судебные дела: их выдумал ChatGPT, а адвокаты не проверили. ИИ — мощный инструмент, но у него есть ограничения и риски, о которых должен знать каждый пользователь. Этот урок — о четырёх главных: галлюцинациях, предвзятости, конфиденциальности и авторском праве.
| Риск | Что это значит | Пример | Как защититься |
|---|---|---|---|
| Галлюцинации | Уверенные, но ложные ответы | Выдуманные судебные дела, неверные даты и числа | Проверять важные факты по надёжным источникам |
| Предвзятость (bias) | Несправедливые закономерности, выученные из данных | Стереотипы в текстах и изображениях, несправедливый отбор резюме | Критически оценивать ответ, просить сбалансированный взгляд |
| Конфиденциальность | Введённое может храниться, просматриваться или идти на обучение | Вставленные результаты анализов, пароли, код компании | Никогда не передавать личные и секретные данные |
| Авторское право | Неясные права на обучающие данные и результаты | Копирование текста или работ художника, судебные иски | Уважать права, указывать источники, проверять правила |
Галлюцинации: доверяй, но проверяй
Как ты уже видел, языковая модель создаёт правдоподобный текст, а не проверенные факты. Чаще всего она ошибается в точных числах, датах, цитатах, ссылках, недавних событиях и малоизвестных темах — и редко сообщает, что не уверена. Чем важнее решение, тем тщательнее нужна проверка.
Предвзятость: несправедливость из данных
Модели учатся на данных, созданных людьми, поэтому перенимают и человеческие стереотипы и перекосы. В 2018 году Reuters сообщило, что Amazon отказалась от экспериментального инструмента для отбора кандидатов: он научился занижать оценку резюме со словом «women's» («женский»), потому что большинство прошлых резюме, на которых он обучался, прислали мужчины. Генераторы изображений тоже могут показывать «врача» чаще мужчиной, а «медсестру» — женщиной.
Prompt:
Describe a typical engineer
and a typical nurse.
Answer:
'He designs bridges...
She cares for patients...'
→ the stereotype is repeatedPrompt:
Describe the skills an engineer and a
nurse need. Avoid assumptions about
gender, age or nationality.
Answer:
focuses on skills: problem solving,
precision, empathy, teamworkКонфиденциальность: написанное может перестать быть личным
Всё, что ты вводишь в ИИ-сервис, отправляется на серверы компании. Это может храниться, просматриваться сотрудниками для безопасности или контроля качества и — в зависимости от сервиса и твоих настроек — использоваться для обучения будущих моделей. Утечки и ошибки случаются. Пиши каждый промпт так, будто однажды его может прочитать посторонний. Никогда не вписывай в промпт:
- Пароли, PIN-коды и одноразовые коды из SMS.
- Номера удостоверения личности и паспорта, данные банковской карты, домашний адрес.
- Сведения о здоровье и другие чувствительные данные о себе.
- Личные данные других людей — фото, переписку, оценки — без их согласия.
- Секреты компании или школы: договоры, код, экзаменационные задания, внутренние документы.
Авторское право: кому что принадлежит?
ИИ-модели обучаются на огромных объёмах текстов и изображений, часть которых защищена авторским правом. По этому поводу идёт несколько судебных процессов — например, в декабре 2023 года The New York Times подала иск против OpenAI и Microsoft. Правила для результатов работы ИИ тоже различаются: в США Бюро по авторским правам заявило, что авторское право защищает только произведения, созданные человеком. Законы ещё меняются, поэтому следуй правилам своей школы, работодателя и страны.
- Не проси ИИ воспроизводить целые книги, статьи или песни и не выдавай чужую работу за свою.
- Указывай источники и отмечай, где тебе помог ИИ.
- Перед коммерческим использованием прочитай условия сервиса и проверь права на результат.
Практика: найди риск
В чём риск и как поступить безопаснее? а) Мурад вставляет в чат-бот сочинение одноклассницы вместе с её именем, чтобы получить оценку. б) Лейла загружает все результаты анализов вместе с номером удостоверения личности. в) Эльвин копирует статистику из ответа ИИ прямо в отчёт для руководителя. г) Айсель просит для продажи афишу, «точь-в-точь как последняя работа живого иллюстратора».
Показать решениеСкрыть решение
б) Конфиденциальность — медицинские данные и номер документа. Удали идентифицирующие данные, а результаты обсуди с врачом.
в) Галлюцинация — числа могут быть выдуманы. Найди первоисточник для каждой цифры (правило двух источников).
г) Авторское право — копирование работы живого художника для продажи. Вместо этого опиши собственную идею и стиль и проверь условия сервиса.
Главное
- Галлюцинации могут иметь реальные последствия: проверяй важные факты по двум независимым источникам.
- Предвзятость приходит из обучающих данных; критически оценивай ответ и проси сбалансированности.
- Никогда не вписывай в промпт пароли, номера карт и документов, медицинские данные, чужие данные и секреты компании.
- Правила авторского права различаются по странам и ещё меняются; указывай источники и не копируй чужие работы.
Проверь себя
Вопросов: 10. Каждый правильный ответ приносит XP.