AI ФАКТОР

Guardrail проти вигаданих фактів

Практика 28.07.2026
Guardrail проти вигаданих фактів

Додавайте цей блок у кінець важливих запитів до AI — особливо коли є гроші, реквізити, податки, договори чи рішення:

Не вигадуй факти, реквізити, ставки, норми й посилання.

Для кожної цифри або висновку вкажи джерело: документ, рядок, сторінку чи фрагмент даних.

Якщо джерела нема — напиши «не знайшов». Міркуй покроково.

Приклад для бухгалтера:

Звір банківську виписку за березень з ОСВ. Знайди платежі без відповідника, різні суми й підозрілі дати. [вставити таблицю виписки] [вставити ОСВ].

Далі — guardrail вище.

Чому так: модель перестає “дописувати” впевненим тоном і змушена відділяти підтверджене від того, що треба звірити з первинкою або обліком.

Що це дає: менше ризику перенести вигадану цифру чи реквізит у звіт, лист або рішення.

Коли цей guardrail справді потрібен

AI помиляється не лише в текстах. У джерелі перелічені типові збої: вигадані факти й реквізити, помилки в розрахунках, хибне читання секції або сторінки документа, застарілі дані, згода з вашою помилкою, вигадані тренди чи висновки. Найнебезпечніше те, що відповідь може звучати впевнено.

Guardrail варто додавати там, де результат піде в зовнішній документ або рішення: цифри у звітність, ставки податків, норми закону, цитати, реквізити, висновки для декларації чи управлінського рішення. Для чернетки листа ризик нижчий. Для суми, періоду, ПДВ, ПКУ або реквізиту потрібне джерело.

  • Якщо AI пише цифру, він має показати, з якого документа або фрагмента її взяв.
  • Якщо AI робить висновок, він має показати, на яких даних він стоїть.
  • Якщо джерела немає, правильна відповідь: не вигадка, а не знайшов.

Ще три робочі сценарії, крім звірки виписки

Перший сценарій: перевірка чужої AI-відповіді. Це може бути текст від колеги, підрядника або іншого чат-бота. Джерело радить вставити сумнівну відповідь у новий чат і просити розділити підтверджене, те, що треба звірити, і місця можливої вигадки.

Ось відповідь AI-асистента на запит: «[вставте запит]». Відповідь: «[вставте текст]». Перевір: що підтверджено / що звірити / де можлива вигадка. Для кожної цифри, реквізиту, норми або висновку вкажи джерело. Якщо джерела нема, напиши «не знайшов».

Другий сценарій: документи, де AI може прочитати не ту секцію або сторінку. Тут guardrail має змусити модель не переказувати документ загально, а прив’язувати кожен висновок до конкретного фрагмента. Третій сценарій: податкові або облікові формулювання, де ризик живе в ПДВ, періодах Q1/Q4, сумнівній нормі ПКУ або вашому неправильному припущенні, з яким AI може погодитися.

  • Перевір цей документ. Для кожного висновку вкажи секцію, сторінку або фрагмент. Окремо познач місця, де даних недостатньо.
  • Перевір відповідь щодо ПДВ, періоду та посилання на ПКУ. Не погоджуйся з моїм припущенням автоматично. Якщо норма або період не підтверджені в наданих даних, напиши «не знайшов».

Як працювати покроково, щоб не втратити вигоду від AI

У джерелі є три правила перевірки. Перше: джерело для кожного факту. Друге: критичне звіряти з першоджерелом, тобто з обліком, первинкою або нормою закону. Третє: спочатку sample, потім масштаб. Не варто запускати перевірку на 500 елементах, поки ви не подивилися руками 3–5 прикладів.

  • Дайте AI конкретні дані: фрагмент документа, таблицю, відповідь, текст або витяг.
  • Додайте guardrail про заборону вигадувати факти, реквізити, ставки, норми й посилання.
  • Попросіть показати джерело для кожної цифри або висновку.
  • Перевірте 3–5 результатів вручну: чи не переплутав період, секцію, суму, норму або припущення.
  • Після цього масштабуйте на більший масив, але критичні місця все одно звіряйте з першоджерелом.

Окремий прийом — самоперевірка після відповіді. Не треба одразу копіювати результат у лист, звіт або рішення. Спершу попросіть AI пройтися по власній відповіді як ревізор: де факт, де припущення, де потрібна зовнішня звірка.

Перевір свою відповідь. Розділи її на: підтверджено джерелом / треба звірити з першоджерелом / можлива вигадка. Для кожної цифри, реквізиту, норми й висновку покажи джерело або напиши «не знайшов».

Межі прийому й типові помилки

Guardrail не робить модель базою даних. Якщо в чаті немає документа, первинки, облікових даних або актуальної норми, AI не має з чого брати підтвердження. У такій ситуації хороша відповідь повинна містити прогалину: не знайшов. Погана відповідь виглядає переконливо, але додає правдоподібний ЄДРПОУ, цитату, посилання, ставку або висновок без джерела.

Типова помилка з боку людини — перевіряти все підряд. Джерело прямо попереджає: це з’їдає вигоду. Звіряти треба критичне: гроші, звітність, рішення, норми, реквізити. Друга помилка — сприйняти впевнений тон за правильність. Третя — не додати guardrail у важливий запит, а потім переносити відповідь у документ зовні.

  • Перед використанням результату запитайте: звідки ця цифра?
  • Перевірте, чи не переплутано період, наприклад Q1 і Q4.
  • Подивіться, чи не погодився AI з вашим помилковим припущенням.
  • Звірте ПДВ, норму ПКУ, реквізит або цитату з першоджерелом.
  • Якщо відповідь містить тренд або узагальнення без зовнішнього джерела, не переносіть це як факт.
Читати в ТелеграміПрактика ШІ в бізнесі — щодня, без хайпу