Перейти до основного вмісту
Concept·Intermediate·RAG / Evals

Grounding

Прив’язування відповіді AI до доступних перевірних джерел, даних або спостережень із явною межею того, що докази справді підтримують.

Grounded response — не просто відповідь із посиланнями. Для кожного material claim має існувати eligible evidence, яке підтримує саме цей claim у правильному scope. Якщо доказів немає, якісний pipeline звужує твердження, показує невизначеність або відмовляється відповідати.

Автор: AI Magister Editorial Team · Технічний reviewer: AI Magister Technical Review · Перевірено: 2026-08-25

Claim-to-evidence contract

Найменша корисна одиниця grounding — не вся відповідь і не весь документ, а пара claim ↔ supporting passage. Цей рівень дозволяє знайти unsupported synthesis, неправильне число або citation, що лише тематично схожа.

01

Claim

Розбийте відповідь на перевірні твердження. Стиль, рекомендація і факт не повинні мати один критерій приймання.

02

Eligible evidence

Знайдіть дозволене, чинне й достатньо авторитетне джерело. Retrieval score сам по собі не доводить істинність.

03

Entailment

Перевірте, чи evidence підтримує саме claim, включно з числом, датою, scope і важливими застереженнями.

04

Citation

Збережіть точний source locator: URL, document/version, passage або record ID, а не лише назву домену.

05

Decision

Підтверджений claim проходить; unsupported або contradictory claim виправляється, маркується невизначеним чи веде до abstention.

06

Replay

Corpus, model, prompt, retrieval і evaluator version входять у release fingerprint, щоб результат можна було відтворити.

Не змішуйте сусідні поняття

ConceptЩо означаєЧого не гарантує
GroundingПроцес і властивість зв’язку output із evidence.Не гарантує, що саме джерело правдиве, актуальне або дозволене.
RAGАрхітектурний спосіб знайти й передати зовнішній context моделі.RAG може повернути релевантний, але застарілий чи суперечливий фрагмент.
CitationLocator, за яким читач або verifier відкриває evidence.Наявність citation не доводить, що вона підтримує сусідній claim.
FactualityВідповідність claim фактам у визначеній системі істини.Claim може бути grounded у помилковому джерелі й залишатися фактично неправильним.
FaithfulnessВідсутність тверджень, що виходять за наданий context.Faithful відповідь може бути неповною або спиратися на нерелевантний context.

Groundedness eval slices

Direct support

Кожен material claim має passage, який його прямо підтримує без домисленого мосту.

Numbers and dates

Число, одиниця, період, дата та population збігаються з evidence.

Multi-source synthesis

Підсумок не стирає розбіжності між джерелами й позначає source-specific claims.

Freshness

Effective date і superseded version перевіряються до generation, а не після скарги.

No evidence

Система не перетворює відсутність support на впевнений текст і має явний abstention path.

Adversarial evidence

Prompt injection, SEO spam і невидимий текст не успадковують довіру лише через retrieval.

Permissions

Evaluator і citation renderer не розкривають фрагмент, якого користувач не має права бачити.

Практичний acceptance contract

  • • claim coverage: усі material claims мають evidence або явне маркування inference;
  • • entailment: passage підтримує повний claim, а не лише спільну тему;
  • • source quality: authority, effective date, permission і conflict policy перевірені;
  • • citation usability: reviewer відкриває точне місце без повторного пошуку;
  • • abstention: unsupported high-risk claim не проходить promotion.

Приклад

Policy assistant знаходить два документи. Старий policy має вищу semantic similarity, але новий містить effective date і supersedes marker. Eligibility stage відкидає стару версію; generator формує відповідь із section locator; evaluator перевіряє суму, валюту, роль і дату окремими claims. Якщо current policy не містить потрібного винятку, assistant ескалює питання замість синтезувати правило.

Primary-source boundaries

Google Cloud — Grounding with Google Search ↗

Документація описує grounding як підключення model output до web data та повернення grounding metadata для support і citations.

Evidence boundary: Це evidence про capability Google Cloud, а не незалежний benchmark точності чи універсальна гарантія factuality.

Microsoft Foundry — Groundedness evaluator ↗

Microsoft розділяє retrieval і groundedness evaluation та оцінює, наскільки response узгоджується з наданим context.

Evidence boundary: Model-based evaluator потребує калібрування проти human judgments і не замінює deterministic checks для чисел, дат та access control.

OpenAI — File search ↗

OpenAI документує hosted retrieval через vector stores і file citations у response annotations.

Evidence boundary: Citation annotation підтверджує provenance surface, але не доводить entailment кожного generated claim.

NIST AI 600-1 — Generative AI Profile ↗

NIST описує confabulation як впевнено поданий помилковий або хибний content і рекомендує вимірювання, provenance та human oversight у risk management.

Evidence boundary: Профіль задає risk-management guidance, а не конкретний grounding metric або acceptance threshold.

Куди далі

Спочатку побудуйте retrieval із permissions і freshness, потім додайте claim-level groundedness evaluation. Для consequential action grounding лише пояснює evidence; право виконати дію все одно перевіряє окремий deterministic authority gate.