Information Gain Check
Beoordeelt content op de vraag die het patent stelt: welke informatie bevat dit document dat de lezer nog niet had uit wat er al over het onderwerp bestaat? De meting is semantisch — herformuleren telt niet — en gebeurt binnen het onderwerp, tegen het bestaande corpus.
Lees vóór het beoordelen altijd references/information-gain-criteria.md. Daar staan de letterlijke citaten uit het patent en de Google-documentatie, de beslisregels en de kalibratievoorbeelden. Elk oordeel moet herleidbaar zijn naar een criterium uit dat bestand. Houd de bronlagen uit elkaar: het patent definieert, de publieke documentatie bewijst dat Google op deze uitkomst stuurt, de leak is indicatief.
Input
Accepteer drie invoervormen:
- URL — fetch de pagina en beoordeel alleen de Main Content.
- Bestandspad — lees het bestand en beoordeel de inhoud.
- Platte tekst — beoordeel de tekst; meld dat paginacontext niet beoordeeld kon worden.
Vraag daarnaast — of leid af — wat de belangrijkste zoekintentie is waarvoor deze content moet presteren. Zonder intentie is geen corpusvergelijking mogelijk; als de gebruiker het niet meegeeft, formuleer de meest waarschijnlijke intentie zelf en benoem die aanname in het rapport.
Beoordelingsstappen
Verzamel eerst alle bevindingen, schrijf daarna pas het rapport.
Stap 1 — Claims inventariseren
Ontleed de content in zijn informatieclaims: de feiten, data, observaties, adviezen en verbanden die de pagina beweert. Negeer de verpakking (stijl, structuur, toon) — information gain gaat over informatie, niet over vorm. Maak een compacte lijst; deze is de basis voor alles hierna.
Stap 2 — Corpusvergelijking
Zoek op de belangrijkste zoekintentie en bekijk de top-resultaten (minimaal 5, bij twijfel 10). Bepaal per informatieclaim uit stap 1: staat dit al in het corpus, of is het nieuw? Wees streng op de semantiek: een claim die elders in andere woorden staat, is niet nieuw. Toets ook steekproefsgewijs andersom — plak de meest onderscheidende claims in een zoekopdracht en kijk of alleen deze pagina ze levert. Als zoeken niet beschikbaar is, meld dat expliciet en beoordeel alleen op de interne signalen (stap 3); het oordeel krijgt dan een slag om de arm.
Stap 3 — Bronnen van gain herkennen
Loop de zes categorieën uit het referentiebestand na (eigen data/metingen, original reporting, first-hand bewijs, analyse voorbij het voor de hand liggende, expertvertaling met toevoeging, vergelijkende inzichten). Noteer per gevonden categorie het concrete bewijs met citaat of locatie. Toets ook de relevantie: unieke informatie die de zoekintentie niet dient, telt niet als waarde.
Stap 4 — Vlaggen checken
- Rode vlaggen (vrijwel geen gain): alles herleidbaar tot bestaande bronnen; samenvatting zonder toevoeging; alleen algemeen bekende feiten; semantische overlap met gevestigde bronnen waarbij alleen de formulering eigen is.
- Oranje vlaggen (beperkte gain): een dun laagje eigens (mening, voorbeeld, ordening) op een hergebruikte basis; breedte toegevoegd maar geen diepte die elders ontbreekt; unieke inhoud verstopt onder bekende feiten.
- Prominentie: staat de onderscheidende informatie op een vindbare, citeerbare plek, of moet de lezer er doorheen graven? Verstopte gain is half verloren gain.
Stap 5 — Oordeel
Gebruik de vijfpuntsschaal en beslisregels uit het referentiebestand (vrijwel geen / beperkt / aanwezig / sterk / uitzonderlijk) en ijk aan het dichtstbijzijnde kalibratievoorbeeld. Weeg beide assen: hoeveel wordt toegevoegd aan het corpus, en hoe relevant is dat voor de intentie.
Rapportformaat
Schrijf het rapport in de taal van de aangeleverde content. Sla het op als [domein-of-slug]-information-gain-[YYYY-MM-DD].md en lever het aan de gebruiker.
---
title: "Information Gain Check – [domein of onderwerp]"
url: "[URL of 'tekstinput']"
date: "[DD maand YYYY]"
oordeel: "[Vrijwel geen / Beperkt / Aanwezig / Sterk / Uitzonderlijk]"
zoekintentie: "[de intentie waartegen is getoetst]"
corpus_getoetst: "[ja, N resultaten / nee — reden]"
---
# Information Gain Check – [onderwerp]
## Oordeel
**[Oordeel]** — [2–3 zinnen: het oordeel, de doorslaggevende reden, en het kalibratievoorbeeld waarmee je hebt geijkt.]
## Wat deze content toevoegt
[Per aanwijsbare toevoeging: de claim, de categorie (eigen data / reporting / first-hand / analyse / vertaling / vergelijking) en het bewijs. Wees eerlijk als de lijst leeg is.]
## Wat al bestond
[Compact: welke kernclaims van de pagina al in het corpus staan, met de sterkste overlappende bron(nen) als voorbeeld.]
## Checklist
### Rode vlaggen (vrijwel geen gain)
- [alleen aangetroffen vlaggen, elk met één zin bewijs; anders "Geen rode vlaggen aangetroffen"]
### Oranje vlaggen (beperkte gain)
- [idem]
### Prominentie
- [Staat de onderscheidende informatie vindbaar en citeerbaar, of verstopt?]
## De gebruikerstest
[Eén alinea langs Google's eigen vraag: "Does your content leave readers feeling like they need to search again to get better information from other sources?" — moet de lezer na deze pagina nog doorzoeken, en waarvoor?]
## Takenlijst
**🔴 Direct aanpakken**
1. [Concreet: welke toevoeging, waar op de pagina, uit welke categorie — verwijs naar het criterium]
**🟠 Daarna**
2. [...]
**🟢 Nice to have**
3. [...]
Regels: zinnen beginnen met een hoofdletter; Nederlandse getalnotatie (1.000,00) in Nederlandse rapporten; verzin geen corpusbevindingen — noem alleen overlappende bronnen die je daadwerkelijk hebt bekeken; presenteer het patent als definitiebron en de publieke documentatie als richtinggevend, en noem de leak alleen met de kanttekening dat weging onbekend is. Taken beschrijven altijd wélke informatie toegevoegd moet worden, niet alleen dát er iets toegevoegd moet worden.
Afbakening
Deze skill beantwoordt één vraag: voegt deze content iets toe aan wat er al bestaat? Voor de effort-dimensie uit de rater guidelines (is hier aantoonbaar aan gewerkt) is er sqrg-effort-check; voor een volledige Page Quality-beoordeling sqrg-url-assessor. De drie vullen elkaar aan: een pagina kan hoge effort en toch lage information gain hebben — hard gewerkt aan iets dat al bestond.