Reddit, forums en UGC in AI-antwoorden
Lees een tijdje de bronnenlijsten onder AI-antwoorden en er tekent zich een patroon af: Reddit-threads, antwoorden op Stack Exchange, posts van nicheforums. Dit is gemeten, niet anekdotisch. Een analyse van het Pew Research Center van echt surfgedrag van 900 volwassen Amerikanen vond dat Wikipedia, YouTube en Reddit de meest geciteerde bronnen waren in de AI-samenvattingen van Google, samen goed voor 15 procent van alle vermelde bronnen. Een thread geschreven door vreemden is vaak wat een machine citeert in plaats van de pagina van welk bedrijf dan ook. De redenen zijn structureel, en ze bepalen wat een merk er zinvol aan kan doen.
Waarom communitycontent zoveel geciteerd wordt
Conversationele zoekopdrachten matchen met conversationele content
Mensen stellen antwoordmachines vragen zoals ze die aan een persoon zouden stellen: of iets het waard is, wat anderen echt gebruiken, wat er bij hen misging. Een forumthread heeft die vorm al. Er staat een vraag in de titel en er staan antwoorden in de ik-vorm onder, meningsverschillen inbegrepen. Wanneer een machine passages ophaalt om een antwoord op een conversationele vraag te gronden, is een pagina die letterlijk een gesprek over die vraag is een makkelijke match. Een productpagina geschreven als een lijst met features is dat niet.
Licentiedeals
De machines crawlen deze content niet alleen. Ze betalen ervoor. Reuters berichtte in februari 2024 dat Reddit een deal sloot om zijn content beschikbaar te maken voor het trainen van de AI-modellen van Google, ter waarde van ongeveer $60 miljoen per jaar volgens een bron die bekend is met de overeenkomst. In mei 2024 kondigde OpenAI een partnerschap met Reddit aan dat het toegang geeft tot de Data API van Reddit, in de aankondiging beschreven als realtime, gestructureerde en unieke content, waarbij OpenAI ook advertentiepartner van Reddit werd. Contractuele, betaalde toegang betekent dat communitycontent een gegarandeerde route naar antwoorden heeft. Dit is geen eigenaardigheid van de huidige modellen die de volgende update wegneemt.
Actualiteit en ervaring uit de eerste hand
Forumthreads dragen recente verslagen in de ik-vorm: wat er kapotging na de laatste update, hoe de support reageerde, hoe een product bevalt na zes maanden gebruik. Systemen die aantoonbare ervaring uit de eerste hand belonen, behandeld in E-E-A-T uitgelegd, geven precies aan dit materiaal de voorkeur. Een thread van vorige week, geschreven door iemand die het product bezit, levert bewijs dat een gelikte marketingpagina niet kan leveren.
Wat dit betekent voor een merk
De vragen van je klanten worden beantwoord met de threads van anderen. Drie reacties zijn legitiem:
- Wees aanwezig waar jouw markt daadwerkelijk praat. Echte accounts, kenbaar gemaakte banden, echte antwoorden op echte vragen. Een medewerker die een nuttig, eerlijk antwoord schrijft onder een account dat het bedrijf vermeldt, doet mee. Dezelfde woorden vanaf een account dat dat verzwijgt zijn spam, en communities behandelen ze als spam.
- Publiceer wat de threads missen. Antwoorden uit een community zijn sterk in ervaring en zwak in data. Eigen cijfers, testresultaten en documentatie uit de eerste hand geven machines een reden om jou naast de threads te citeren in plaats van alleen de threads. Het draaiboek staat in hoe je geciteerd wordt door AI-machines.
- Volg welke threads geciteerd worden. Als een machine antwoorden over jouw categorie steeds grondt in drie specifieke threads, hoor je dat te weten, want die threads bepalen wat kopers te horen krijgen. Hoe je daar monsters van neemt zonder jezelf voor de gek te houden, staat in AI-zoekzichtbaarheid eerlijk meten.
Waarom gefabriceerde reacties averechts werken
Zodra citaties uit communities zichtbaar werden, verschenen er diensten die de sluiproute verkopen: geautomatiseerde of betaalde reacties die je product noemen in relevante threads. Dit faalt op zijn eigen voorwaarden. Niet-kenbaar gemaakte promotionele plaatsing schendt de regels van Reddit, die van gebruikers verlangen dat ze authentiek deelnemen in communities waar ze een persoonlijk belang hebben, en die spam en contentmanipulatie verbieden. Niet-kenbaar gemaakte reclame botst in veel rechtsgebieden ook met consumentenbeschermingsregels. In de praktijk is de volgorde voorspelbaar: moderators verwijderen de reacties, communities markeren de accounts, en een verwijderde thread neemt je vermelding mee. Reddit-karma en accountleeftijd maken geloofwaardig ogende plaatsing duur, en de betrokken discussieculturen zijn goed in het herkennen ervan. Het bredere punt, dat vermeldingen alleen helpen als anderen ze uit vrije wil maken, komt aan bod in merkvermeldingen en share of voice in AI-antwoorden.
De eerlijke samenvatting
Citaties uit communities in AI-antwoorden zijn echt en goed gedocumenteerd. De oorzaken zijn structureel: conversationele zoekopdrachten halen conversationele content op, de machines hebben voor de data betaald, en verslagen uit de eerste hand dragen bewijs dat marketingpagina's missen. De legitieme reactie is deelnemen onder je eigen naam en de substantie publiceren die de threads missen. Iemand betalen om reacties te planten koopt verwijderbare content op een plek die is gebouwd om het te detecteren.