
Bei Originality.ai glauben wir an die ethische Entwicklung (Studie darüber, wie man KI-Bots blockiert) und die ethische Nutzung generativer KI mithilfe unseres KI-Detektors, der erkennen kann, ob Text von ChatGPT oder einem anderen KI-Schreibtool erstellt wurde.
Wir berichten darüber, wie KI die Online-Welt beeinflusst, verfolgen, wie viel KI in den Suchergebnissen von Google steckt, und die folgende Studie untersucht das Update vom 5. März 2024 eingehend.
Am 5. März kündigte Google ein umfangreiches Update an, das darauf abzielen würde, nicht hilfreiche Inhalte um 40% zu reduzieren. Dieses Update begann mit einer bedeutenden Runde manueller Maßnahmen, die auf Websites angewendet wurden und dazu führten, dass diese vollständig deindexiert wurden. Diese manuellen Maßnahmen erfolgten im Zusammenhang mit diesem Update, sind jedoch getrennt vom Algorithmus-Update, das über 2 bis 4 Wochen ausgerollt werden soll.
Wir haben in den letzten 24 Stunden 2 bedeutende Studien abgeschlossen, um Menschen dabei zu helfen, diese Updates zu verstehen, und beide sind hier enthalten.
In diesem Beitrag werden wir Folgendes behandeln…
Die Methodik finden Sie in den jeweiligen Abschnitten unten.
Wenn Sie Fragen haben, Zugriff auf die Daten wünschen oder diese Forschung erweitern möchten, wenden Sie sich an jon@originality.ai
Dieses Update von Google wurde am 5. März angekündigt und zielt darauf ab, Folgendes zu bestrafen…
Es gab in den ersten Tagen mehr Kommunikation von Google zu diesem Update als bei den meisten anderen ähnlichen Updates.
Es ist wichtig, erneut festzuhalten, dass manuelle Maßnahmen nicht dasselbe sind wie die Algorithmus-Updates, die ebenfalls stattfinden werden.
Wenn Google eine Website identifiziert hat, die seinen Richtlinien nicht entspricht, kann es eine „manuelle Maßnahme“ anwenden und sie vollständig aus seinen Suchergebnissen entfernen (auch bekannt als Deindexierung der Website).
Websites erhielten ab dem 5. März in ihrem Google Search Console Manual Action-Dashboard zunehmend solche Benachrichtigungen…

Die Folge dieser manuellen Maßnahmen scheint eine vollständige Entfernung aus den Suchergebnissen von Google zu sein.

Was wissen wir nun über die betroffenen Websites…
Um das Ausmaß dieser Bemühungen um manuelle Maßnahmen besser zu verstehen, haben wir eine Studie abgeschlossen, um Content-Websites zu identifizieren, die von Google deindexiert wurden und bis vor Kurzem Google Organic-Traffic hatten.
Diese Studie konzentriert sich auf Content-first-Websites, nicht auf ECommerce oder andere Arten von Websites.





So haben wir diese Studie durchgeführt.
Zusammenfassung: Wir identifizierten eine Liste von 79k Websites, die eine überdurchschnittlich gute Abbildung des Internets darstellen, prüften, ob sie derzeit indexiert sind, und wenn sie nicht indexiert waren, prüften wir 2 Quellen (AHrefs und SImilarWeb), um zu verifizieren, ob sie kürzlich organischen Traffic hatten.
Wenn eine Website kürzlich organischen Traffic hatte (Februar), aber jetzt nicht in Google indexiert ist, gehen wir davon aus, dass eine manuelle Maßnahme des Updates vom 5. März angewendet wurde.
Wenn Sie Zugriff auf den Datensatz der deindexierten Websites einschließlich ahrefs- und similar web-Daten wünschen, wenden Sie sich bitte an Jon@originality.ai
Viele Medien waren schnell dabei, zu dem Schluss zu kommen, dass dieses Update darauf abzielt, KI-Spam in den Suchergebnissen von Google zu zerschlagen…

Viele SEOs auf X stimmen zu…

Aber mithilfe unseres KI-Checkers wollten wir eine strengere Analyse durchführen.
Wir betrachteten 100 aktuelle Artikel für jede der deindexierten Websites, die bereits öffentlich geteilt wurden, um die Verbreitung von KI-Inhalten auf den Websites zu sehen, die eine manuelle Strafe erhielten.




Die kurze Antwort lautet: ja… nach der Analyse von 200 Websites und über 40k URLs mit unserem KI-Checker ist klar, dass die überwiegende Mehrheit der Websites, die eine manuelle Maßnahme erhielten, wahrscheinlich KI-Inhalte verwendete.
Mit dem Update vom 5. März deindexierte Google fast 2% aller Websites auf beliebten Werbeplattformen wie MediaVine, Ezoic und Raptive. Einige dieser Plattformen wie MediaVine haben unmittelbar nach diesen manuellen Maßnahmen proaktiv eine No-AI-Content-Haltung eingenommen (Quelle).

https://www.mediavine.com/ai-and-our-commitment-to-a-creator-first-future/
Zum Zeitpunkt des Updates analysierten wir die 14 öffentlich bekannt gewordenen Websites und stellten fest, dass alle von ihnen eine gewisse Menge an KI-Inhalten aufwiesen. Das löste viele Diskussionen aus…

Aber… wir wollten eine gründlichere Analyse durchführen und VIEL tiefer gehen als nur die 14 Websites, die zu diesem Zeitpunkt bereits bekannt waren.
Die überwiegende Mehrheit der deindexierten Websites scheint einige KI-Inhalte veröffentlicht zu haben. Unter Verwendung des KI-Schwellenwerts als konservative 5% (die Falsch-Positiv-Rate liegt bei < 3% in fast allen getesteten Datensätzen).

Einige Websites scheinen einen gemischten Ansatz sowohl mit KI- als auch mit von Menschen geschriebenen Inhalten verfolgt zu haben, während einige der Websites eindeutig nichts außer KI-generierten Inhalten zeigten.
51 der Websites oder ~30% der Websites waren reine KI-generierte Inhalte.

Aber diese Ergebnisse könnten wahrscheinlich auf eine Stichprobenverzerrung zurückzuführen sein, da die Liste der Websites von MediaVine, Raptive und EZoic stammt (alles Werbenetzwerke, die bei Web-Publishern beliebt sind).
Diese Ergebnisse würden uns NICHT dazu veranlassen, KI-Inhalte für die Deindexierung der Websites verantwortlich zu machen, WENN diese Menge an KI-Inhalten im übrigen Google-SERPs konsistent wäre.
Wir haben eine laufende Studie, die den Inhalt einer Webseite in den Top-20-Suchergebnissen für 500 verschiedene Keywords untersucht, die 60+ Monate zurückreicht.
Das Risiko, dass KI-generierter Spam die Suchergebnisse von Google überwältigt, ist eine existenzielle Bedrohung für Google. Dies scheint ein klarer Versuch von Google zu sein, KI-generierten Spam nicht nur zu bestrafen, sondern auch ein Statement über seine Sichtweise dazu abzugeben.