Галлюцинации AI
Определение
Генерация AI-моделью правдоподобной, но фактически неверной информации.
Простое объяснение
Это когда AI придумывает вещи, которых не существует, но говорит о них уверенно, как будто это правда.
Подробнее
Галлюцинации — одна из главных проблем LLM. Модель может уверенно генерировать выдуманные факты, цитаты, ссылки.
Методы борьбы: RAG (retrieval-augmented generation), fine-tuning, chain-of-thought, fact-checking.
Связанные термины
Grounding
Grounding — привязка генерации AI к фактическим данным, документам или внешним источникам для повышения точности и уменьшения галлюцинаций.
Jailbreak
Jailbreak — техники обхода встроенных ограничений AI-модели для получения запрещённых ответов или нежелательного поведения.
Constitutional AI
Constitutional AI — подход Anthropic к созданию безопасного AI, где модель обучается следовать набору принципов (конституции) через самокритику и ревизию.
Red Teaming
Red Teaming — практика систематического тестирования AI-систем на уязвимости путём симуляции атак злоумышленников.
