Claim
Розбийте відповідь на перевірні твердження. Стиль, рекомендація і факт не повинні мати один критерій приймання.
Прив’язування відповіді AI до доступних перевірних джерел, даних або спостережень із явною межею того, що докази справді підтримують.
Grounded response — не просто відповідь із посиланнями. Для кожного material claim має існувати eligible evidence, яке підтримує саме цей claim у правильному scope. Якщо доказів немає, якісний pipeline звужує твердження, показує невизначеність або відмовляється відповідати.
Автор: AI Magister Editorial Team · Технічний reviewer: AI Magister Technical Review · Перевірено: 2026-08-25
Найменша корисна одиниця grounding — не вся відповідь і не весь документ, а пара claim ↔ supporting passage. Цей рівень дозволяє знайти unsupported synthesis, неправильне число або citation, що лише тематично схожа.
Розбийте відповідь на перевірні твердження. Стиль, рекомендація і факт не повинні мати один критерій приймання.
Знайдіть дозволене, чинне й достатньо авторитетне джерело. Retrieval score сам по собі не доводить істинність.
Перевірте, чи evidence підтримує саме claim, включно з числом, датою, scope і важливими застереженнями.
Збережіть точний source locator: URL, document/version, passage або record ID, а не лише назву домену.
Підтверджений claim проходить; unsupported або contradictory claim виправляється, маркується невизначеним чи веде до abstention.
Corpus, model, prompt, retrieval і evaluator version входять у release fingerprint, щоб результат можна було відтворити.
| Concept | Що означає | Чого не гарантує |
|---|---|---|
| Grounding | Процес і властивість зв’язку output із evidence. | Не гарантує, що саме джерело правдиве, актуальне або дозволене. |
| RAG | Архітектурний спосіб знайти й передати зовнішній context моделі. | RAG може повернути релевантний, але застарілий чи суперечливий фрагмент. |
| Citation | Locator, за яким читач або verifier відкриває evidence. | Наявність citation не доводить, що вона підтримує сусідній claim. |
| Factuality | Відповідність claim фактам у визначеній системі істини. | Claim може бути grounded у помилковому джерелі й залишатися фактично неправильним. |
| Faithfulness | Відсутність тверджень, що виходять за наданий context. | Faithful відповідь може бути неповною або спиратися на нерелевантний context. |
Кожен material claim має passage, який його прямо підтримує без домисленого мосту.
Число, одиниця, період, дата та population збігаються з evidence.
Підсумок не стирає розбіжності між джерелами й позначає source-specific claims.
Effective date і superseded version перевіряються до generation, а не після скарги.
Система не перетворює відсутність support на впевнений текст і має явний abstention path.
Prompt injection, SEO spam і невидимий текст не успадковують довіру лише через retrieval.
Evaluator і citation renderer не розкривають фрагмент, якого користувач не має права бачити.
Policy assistant знаходить два документи. Старий policy має вищу semantic similarity, але новий містить effective date і supersedes marker. Eligibility stage відкидає стару версію; generator формує відповідь із section locator; evaluator перевіряє суму, валюту, роль і дату окремими claims. Якщо current policy не містить потрібного винятку, assistant ескалює питання замість синтезувати правило.
Документація описує grounding як підключення model output до web data та повернення grounding metadata для support і citations.
Evidence boundary: Це evidence про capability Google Cloud, а не незалежний benchmark точності чи універсальна гарантія factuality.
Microsoft розділяє retrieval і groundedness evaluation та оцінює, наскільки response узгоджується з наданим context.
Evidence boundary: Model-based evaluator потребує калібрування проти human judgments і не замінює deterministic checks для чисел, дат та access control.
OpenAI документує hosted retrieval через vector stores і file citations у response annotations.
Evidence boundary: Citation annotation підтверджує provenance surface, але не доводить entailment кожного generated claim.
NIST описує confabulation як впевнено поданий помилковий або хибний content і рекомендує вимірювання, provenance та human oversight у risk management.
Evidence boundary: Профіль задає risk-management guidance, а не конкретний grounding metric або acceptance threshold.
Спочатку побудуйте retrieval із permissions і freshness, потім додайте claim-level groundedness evaluation. Для consequential action grounding лише пояснює evidence; право виконати дію все одно перевіряє окремий deterministic authority gate.