Ich kann bei sowas nur einen Rat geben: Draus lernen!
Super Alex. Den Rat hast Du mir schon per Whatsapp gegeben und es hilft gleich null.
Was soll man draus lernen, wenn Google eine Seite Y im Index hat und behauptet, diese URL auf Seite X gefunden zu haben. Seite X gibt es seit 7 Jahren nicht mehr und die angeblich dort verlinkte Seite Y gab es NIE, also nicht zu dem Zeitpunkt, als Seite X da war (gab es vor 3-4 Jahren). Ist gar nicht möglich. Und Google dann auch noch meint, nee, ich ignoriere einfach mal den Canonical, ich ignoriere 301 zu "www" und SSL sowieso, also nehme ich als selbst auserwählt eine Seite Z, die es definitiv noch nie gab. Nämlich neue URL-Struktur in Verbindung mit "ohne www" und ohne SSL.
Die "neue URL-Struktur" gab es aber immer nur mit www und mit SSL.
Und was soll ich dazu sagen, dass am 17.11. ein Core-Update war und die Probleme just am 17.11. angefangen haben. Soll ich was dazu schreiben, dass das Ranking gefährdet ist, weil SSL teilweise "nicht da ist", Google das meldet, aber in der Hilfe dazu schreibt, dass sie aus technischen Gründen keine Liste mit den Seiten ohne SSL anzeigen können? Aha, können sie nicht? Was unterscheidet so eine Liste von einer anderen?
Muss ich was dazu sagen, dass auch just seitdem die Probleme sind bzw. seit dem 19.11., die Webmastertools keine neuen, brauchbaren Daten mehr liefern? Heute schon wieder, aber zwischen 19.11. und gestern fehlt alles. Oder, dass man über jeden Scheiß im Sekundentakt von Google informiert wird, aber über so was, dass plötzlich angeblich kein SSL mehr da sein soll, da kommt keine einzige Mail, nicht binnen 6 Tagen?
Muss ich verstehen, warum eine andere Domain angeblich "leere Seiten" ausliefert? Also Fehlermeldung "Seite ohne Inhalt"? Muss ich erwähnen, dass es sich dabei um statische HTML-Seiten handelt, die entweder gar nicht da sind oder mit Inhalt gefüllt? Leer gibt es die überhaupt nicht.
Sagte ich schon, dass das kein Bug in den WMT ist? Nein? Dann jetzt. Denn alles, was Google hier als Fehler bemängelt ist im Index bzw. eben alle Webseiten-Versionen, die Google da meint nutzen zu wollen / gefunden zu haben. Also Domain mit www und SSL, ohne WWW, ohne SSL, ohne beides. Alle Versionen sind im Index und das gefühlt 40 Plätze weiter hinten als vorher.
Oder sagen, dass es technisch gar nicht möglich ist, eine Seite ohne SSL abzurufen? Selbst wenn da was falsch laufen sollte, dann würde halt eine default-Seite mit falschem SSL-Zertifikat kommen, aber es kommt immer SSL, denn selbst der Default-Host leitet weiter, ausgenommen ist da nur Certbot.
So, also daraus lernen. Lernen kann man durch Fragen, also frage ich mal. Wie schafft es Google, am 24.11. eine Seite abzurufen, mit aktuellen Daten, aber ohne SSL, ohne www und alte Ordner-Struktur. Also Inhalt von vorgestern, aktuelle Layout, aber technische Umsetzung von Mitte 2014. Also ich meine mit "schafft es abzurufen", dass Google das behauptet und eben auch die Caches dieses Datum tragen. Einen Zugriff im Server-Logfile kann ich keinen einzigen finden.
Achso, sagte ich schon, dass auch wieder "Partnerwebseiten", also so Linklisten, wie es früher üblich war, wieder im Index sind? Seltsam, die sind seit 2013 gelöscht, die gibt es nicht mal mehr auf dem Server.
Und was mir so ganz nebenbei aufgefallen ist, ist aber ein anderes Thema. Seit wann sendet der Google-Bot denn einen Referrer?
66.249.65.224 - - [25/Nov/2021:15:22:14 +0100] "GET /addons/leaflet-osm/ajaxdata/osm-map-data-20210104.php?v=0.1&objekt=1 HTTP/1.1" 200 6049 "https://www.hund-und-herrchen.de/unterkuenfte/art-Ferienwohnungen/" "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Googlebot/2.1; +http://www.google.com/bot.html) Safari/537.36"
66.249.65.224 - - [25/Nov/2021:17:29:25 +0100] "GET /addons/leaflet-osm/ajaxdata/osm-map-data-20210104.php?v=0.1&id=2827&typ=100300000 HTTP/1.1" 200 15852 "https://www.hund-und-herrchen.de/unterkuenfte/land-Deutschland/bundeslan
d-Bayern/" "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Googlebot/2.1; +http://www.google.com/bot.html) Safari/537.36"
Interessant auch, dass der Referrer vollständig ist, also inkl. Domain und ebenso, dass es nur bei diesen Files ist. An sich ja nicht schlecht, aber genau so war die Erkennung, um den Bot von diversen Dingen fernzuhalten.
P.S. Habe ich erwähnt, dass eine der Domänen HSTS-zertifiziert ist. Also nicht nur den Header einbindet, sondern hardcoded in den Browsern ist? Ein Aufruf der Seite ist ohne SSL gar nicht möglich. Also sollte auch der Evergreen-Google-Bot wissen, dass es die ohne SSL nicht gibt und wenn es sie doch geben sollte, er nicht zugreifen darf.
Erwähnte ich, dass Google bzw. Chrome erst kürzlich, genaues Datum weiß ich nicht, einen neuen Header eingeführt hat, der genau das HSTS abwickelt?