Skip to main content

Last updated

Straft Google AI-content af?

Nee, Google straft content niet af omdat die door AI is geschreven. Het straft content wél af, hoe die ook tot stand kwam, wanneer het patroon overeenkomt met wat het spambeleid beschrijft: veel pagina's die vooral zijn gemaakt om rankings te manipuleren in plaats van om mensen te helpen. Dat is het hele antwoord. De rest van deze pagina is het bewijs: wat Google op schrift heeft gezet, en wat metingen over een miljoen pagina's laten zien.

Wat Google werkelijk heeft geschreven

Het standpunt van Google is geen kwestie van interpretatie. Het is gepubliceerd in een Search Central-blogpost uit februari 2023, Google Search's guidance about AI-generated content, die nog steeds het geldende statement is. Er staan drie dragende punten in.

Ten eerste heet de centrale sectie van de post "Rewarding high-quality content, however it is produced." Google schrijft dat zijn "focus on the quality of content, rather than how content is produced" zijn rankingsystemen al jaren stuurt.

Ten tweede beantwoordt de FAQ van de post de vraag in één zin: "Appropriate use of AI or automation is not against our guidelines."

Ten derde trekt dezelfde post de grens. Automatisering gebruiken, inclusief AI, om content te genereren "with the primary purpose of manipulating ranking in search results is a violation of our spam policies." De overtreding is het doel, niet het gereedschap.

De post stelt ook verwachtingen bij voor de andere richting: "Using AI doesn't give content any special gains. It's just content." Is het nuttig, behulpzaam en origineel, dan kan het het goed doen in Search, en is het dat niet, dan gebeurt dat niet.

Wat een miljoen pagina's laten zien

Beleid is één ding. Handhaving is meetbaar. Een onderzoek van 1.000.000 pagina's verspreid over 100.000 zoekresultatenpagina's bekeek hoeveel door AI gegenereerde tekst er daadwerkelijk rankt. Posities in de top 10 bevatten consistent 8,4 tot 11,7 procent pagina's die voor minstens 80 procent door AI waren gegenereerd. Het gemiddelde AI-aandeel bewoog nauwelijks mee met de positie: 27,1 procent op positie 1, oplopend tot slechts 30,9 procent op positie 10. Pagina's met een hoog AI-aandeel behielden hun vertoningen ook over opeenvolgende meetvensters van zes maanden.

Lees de cijfers onomwonden. Als de systemen van Google op AI-auteurschap mikten, zouden sterk door AI gegenereerde pagina's zeldzaam zijn in de top 10, zou hun aandeel scherp dalen richting positie 1, en zouden ze in de loop van de tijd zichtbaarheid verliezen. Geen van die drie gebeurt. Door AI ondersteunde pagina's bereiken en behouden topposities in stabiele mate, dus auteurschap is niet waar Google op ingrijpt.

Wat er wél wordt afgestraft

Waar Google op ingrijpt is de overtreding die het spambeleid misbruik van grootschalig gegenereerde content noemt: veel pagina's produceren met als voornaamste doel rankings te manipuleren, ongeacht de productiemethode. Het beleid is geschreven over operaties, niet over losse artikelen. Google heeft de detectiesystemen erachter niet gepubliceerd, maar een verwant stuk onderzoek van Google Research naar gecoördineerde synthetische content laat zien welke vorm zulke systemen aannemen: het beoordeelt clusters in plaats van losse items, waarbij sjabloonmatige verhaallijnen, signalen van gedeelde infrastructuur en publiceren met hoge frequentie samen worden gewogen. Die paper beschrijft een verdediging die is gebouwd voor een videoplatform en niet voor webzoeken, dus behandel hem als illustratie van de aanpak en niet als documentatie over Search. Wat overdraagbaar is, is de eenheid van beoordeling: het patroon over een heel oeuvre, in plaats van de herkomst van één enkele pagina. Hoe die vingerafdruk ontstaat, en hoe je op volume publiceert zonder erop te lijken, komt aan bod in dunne content en het beleid tegen misbruik van grootschalig gegenereerde content.

Kan Google AI-schrijfwerk detecteren?

Het eerlijke antwoord: Google heeft nooit een AI-tekstdetector gepubliceerd, en het claimt niet individuele pagina's op auteurschap te classificeren. Zowel het geschreven beleid als de gemeten handhaving mikken op patronen van schaal en intentie, dus detectie van auteurschap per pagina is niet wat het systeem nodig heeft. Detectietools van derden bestaan wel, maar hun claims over nauwkeurigheid zijn niet onafhankelijk geverifieerd, en geen ervan heeft zicht op hoe Google pagina's beoordeelt. De gids over AI-functies van Google stelt dat geen enkele tool van derden toegang heeft tot zijn interne ranking- of AI-systemen.

Wat dit in de praktijk betekent

De productieve vraag over een pagina is niet wie hem schreef, maar of hij een toetsing zou doorstaan. Uit het bewijs hierboven volgen vier standaarden:

  • Een substantieondergrens per artikel. Elke pagina heeft iets nodig dat niet uit de trainingsdata van een model kwam: data uit de eerste hand, eigen observaties en genoemde primaire bronnen. Datzelfde materiaal maakt een pagina het citeren waard voor AI-antwoordmachines.
  • Menselijke redactionele verantwoordelijkheid. Iemand met een naam controleert de beweringen, corrigeert de fouten en beslist of de pagina mag bestaan. Modeloutput ongelezen publiceren is hoe het spampatroon begint.
  • Gevarieerde structuur. Laat de structuur van elke pagina het onderwerp volgen. Een site waarvan de artikelen één skelet delen met verwisselde zelfstandige naamwoorden, bouwt de sjabloonvingerafdruk op, wie de tekst ook schreef.
  • Zichtbaar kwaliteitsbewijs. Auteursvermeldingen, primaire bronnen en transparantie over de site, de waarneembare signalen die E-E-A-T beschrijft, gelden voor door AI ondersteunde pagina's precies zoals voor door mensen geschreven pagina's.

Zo gebruikt is AI een productiemethode, en Google heeft op schrift gezet dat productiemethoden niet het doelwit zijn. Vupie houdt zijn eigen pijplijn aan dezelfde standaard: er wordt niets gepubliceerd dat een citatiecontrole niet doorstaat.

Zet het op de automatische piloot

Vupie past alles uit deze gids toe, acht premium artikelen per maand.

Doe mee aan de beta