Перевірка результатів, безпека та AI Native Workflow

Галюцинації AI

Що таке галюцинація AI, вигадані факти та джерела, неіснуючі посилання, впевнено сформульовані помилки та чому промпт не захищає від галюцинацій

Галюцинації AI

🎯 Мета розділу

  • Зрозуміти, що таке галюцинація AI та чому вона виникає.
  • Навчитися розпізнавати типові прояви галюцинацій.
  • Усвідомити, що жоден промпт не усуває ризик галюцинацій повністю.

🔑 Ключові терміни

  • Галюцинація (Hallucination): впевнене генерування AI фактично невірної інформації.
  • Конфабуляція: «заповнення прогалин» вигаданими, але правдоподібними деталями.

Loading diagram...
@startuml
skinparam style plain
skinparam backgroundColor #FFFFFF
skinparam packageBackgroundColor #F8FAFC
skinparam packageBorderColor #64748B

package "Типологія галюцинацій AI" #FEE2E2 {
  rectangle "Вигадані факти\n(Неіснуючі дати, статистика, біографії)" as H1
  rectangle "Фальшиві посилання\n(Биті URL, вигадані наукові статті)" as H2
  rectangle "Впевнений тон помилки\n(Відсутність маркерів сумніву)" as H3
  rectangle "Зсув логіки в коді\n(Виклик неіснуючих методів бібліотек)" as H4
}

package "Інженерні методи захисту (Mitigation)" #DCFCE7 {
  rectangle "1. Заземлення на контекст (Grounding / RAG)" as M1
  rectangle "2. Прямий фактчекінг першоджерел" as M2
  rectangle "3. Автоматичні тести та компіляція коду" as M3
  rectangle "4. Крос-валідація кількома моделями" as M4
}

H1 -down-> M1
H2 -down-> M2
H4 -down-> M3
H3 -down-> M4

@enduml

Що таке галюцинація AI

Галюцинація AI — це ситуація, коли AI генерує інформацію, яка виглядає правдоподібно та впевнено, але є фактично невірною. Модель не «бреше» — вона не має поняття «правда» чи «неправда». Вона генерує статистично правдоподібні послідовності слів.


Типи галюцинацій

Вигадані факти. AI може назвати дату, статистику або подію, яких не існує. Наприклад: «Згідно з дослідженням Оксфордського університету 2023 року...» — дослідження може не існувати.

Вигадані джерела. AI може «процитувати» наукову статтю з правдоподібними автором, назвою та журналом — але жодного з них не існує.

Неіснуючі посилання. URL-адреси, згенеровані AI, часто ведуть на неіснуючі сторінки.

Впевнено сформульовані помилки. AI формулює неправильну інформацію з тією ж впевненістю, що й правильну. Немає «маркерів невпевненості».

Найнебезпечніше в галюцинаціях — їх правдоподібність. Вигаданий факт може бути оточений правильною інформацією, що робить його виявлення складним. Особливо небезпечно для людей, які не мають глибоких знань у предметній області.

Чому промпт не захищає від галюцинацій

Навіть ідеальний промпт із заборонами «не вигадуй» та «будь чесним щодо невпевненості» не усуває галюцинації повністю. Модель не «вирішує» вигадувати — вона генерує токени з розподілу ймовірностей. Якщо правдоподібна, але неправильна відповідь має вищу ймовірність, модель її згенерує.

Промпт може знизити ризик (наприклад, «посилайся тільки на джерела, в яких впевнений» або «скажи, якщо не знаєш»), але не усунути його повністю.


Практичні завдання


Запитання для самоконтролю

Copyright © 2026