Guardrail проти вигаданих фактів
Додавайте цей блок у кінець важливих запитів до AI — особливо коли є гроші, реквізити, податки, договори чи рішення:
Не вигадуй факти, реквізити, ставки, норми й посилання.Для кожної цифри або висновку вкажи джерело: документ, рядок, сторінку чи фрагмент даних.
Якщо джерела нема — напиши «не знайшов». Міркуй покроково.
Приклад для бухгалтера:
Звір банківську виписку за березень з ОСВ. Знайди платежі без відповідника, різні суми й підозрілі дати. [вставити таблицю виписки] [вставити ОСВ].
Далі — guardrail вище.
Чому так: модель перестає “дописувати” впевненим тоном і змушена відділяти підтверджене від того, що треба звірити з первинкою або обліком.
Що це дає: менше ризику перенести вигадану цифру чи реквізит у звіт, лист або рішення.
Коли цей guardrail справді потрібен
AI помиляється не лише в текстах. У джерелі перелічені типові збої: вигадані факти й реквізити, помилки в розрахунках, хибне читання секції або сторінки документа, застарілі дані, згода з вашою помилкою, вигадані тренди чи висновки. Найнебезпечніше те, що відповідь може звучати впевнено.
Guardrail варто додавати там, де результат піде в зовнішній документ або рішення: цифри у звітність, ставки податків, норми закону, цитати, реквізити, висновки для декларації чи управлінського рішення. Для чернетки листа ризик нижчий. Для суми, періоду, ПДВ, ПКУ або реквізиту потрібне джерело.
- Якщо AI пише цифру, він має показати, з якого документа або фрагмента її взяв.
- Якщо AI робить висновок, він має показати, на яких даних він стоїть.
- Якщо джерела немає, правильна відповідь: не вигадка, а
не знайшов.
Ще три робочі сценарії, крім звірки виписки
Перший сценарій: перевірка чужої AI-відповіді. Це може бути текст від колеги, підрядника або іншого чат-бота. Джерело радить вставити сумнівну відповідь у новий чат і просити розділити підтверджене, те, що треба звірити, і місця можливої вигадки.
Ось відповідь AI-асистента на запит: «[вставте запит]». Відповідь: «[вставте текст]». Перевір: що підтверджено / що звірити / де можлива вигадка. Для кожної цифри, реквізиту, норми або висновку вкажи джерело. Якщо джерела нема, напиши «не знайшов».
Другий сценарій: документи, де AI може прочитати не ту секцію або сторінку. Тут guardrail має змусити модель не переказувати документ загально, а прив’язувати кожен висновок до конкретного фрагмента. Третій сценарій: податкові або облікові формулювання, де ризик живе в ПДВ, періодах Q1/Q4, сумнівній нормі ПКУ або вашому неправильному припущенні, з яким AI може погодитися.
Перевір цей документ. Для кожного висновку вкажи секцію, сторінку або фрагмент. Окремо познач місця, де даних недостатньо.Перевір відповідь щодо ПДВ, періоду та посилання на ПКУ. Не погоджуйся з моїм припущенням автоматично. Якщо норма або період не підтверджені в наданих даних, напиши «не знайшов».
Як працювати покроково, щоб не втратити вигоду від AI
У джерелі є три правила перевірки. Перше: джерело для кожного факту. Друге: критичне звіряти з першоджерелом, тобто з обліком, первинкою або нормою закону. Третє: спочатку sample, потім масштаб. Не варто запускати перевірку на 500 елементах, поки ви не подивилися руками 3–5 прикладів.
- Дайте AI конкретні дані: фрагмент документа, таблицю, відповідь, текст або витяг.
- Додайте guardrail про заборону вигадувати факти, реквізити, ставки, норми й посилання.
- Попросіть показати джерело для кожної цифри або висновку.
- Перевірте 3–5 результатів вручну: чи не переплутав період, секцію, суму, норму або припущення.
- Після цього масштабуйте на більший масив, але критичні місця все одно звіряйте з першоджерелом.
Окремий прийом — самоперевірка після відповіді. Не треба одразу копіювати результат у лист, звіт або рішення. Спершу попросіть AI пройтися по власній відповіді як ревізор: де факт, де припущення, де потрібна зовнішня звірка.
Перевір свою відповідь. Розділи її на: підтверджено джерелом / треба звірити з першоджерелом / можлива вигадка. Для кожної цифри, реквізиту, норми й висновку покажи джерело або напиши «не знайшов».
Межі прийому й типові помилки
Guardrail не робить модель базою даних. Якщо в чаті немає документа, первинки, облікових даних або актуальної норми, AI не має з чого брати підтвердження. У такій ситуації хороша відповідь повинна містити прогалину: не знайшов. Погана відповідь виглядає переконливо, але додає правдоподібний ЄДРПОУ, цитату, посилання, ставку або висновок без джерела.
Типова помилка з боку людини — перевіряти все підряд. Джерело прямо попереджає: це з’їдає вигоду. Звіряти треба критичне: гроші, звітність, рішення, норми, реквізити. Друга помилка — сприйняти впевнений тон за правильність. Третя — не додати guardrail у важливий запит, а потім переносити відповідь у документ зовні.
- Перед використанням результату запитайте: звідки ця цифра?
- Перевірте, чи не переплутано період, наприклад Q1 і Q4.
- Подивіться, чи не погодився AI з вашим помилковим припущенням.
- Звірте ПДВ, норму ПКУ, реквізит або цитату з першоджерелом.
- Якщо відповідь містить тренд або узагальнення без зовнішнього джерела, не переносіть це як факт.