Відео / NeVODA / BullshitBench: як AI-моделі розпізнають хибні та абсурдні запити

BullshitBench: як AI-моделі розпізнають хибні та абсурдні запити

Тривалість: 11хв 11с Тип: Standup Плейлист: 18 із 18 у NeVODA
Огляд методики BullshitBench для оцінювання здатності моделей штучного інтелекту виявляти хибні та беззмістовні твердження. У центрі уваги — результати ChatGPT, Gemini та Claude, а також проблема галюцинацій і впевнених відповідей на некоректні запити