So, Google holt sich sogar URL aus Scripten....
Das hier... Was auch immer das ist... muss ich mir mal näher ansehen....
*** Link veraltet ***
Da ruft Google bei mir die http://domain.de/!i auf
So, Google holt sich sogar URL aus Scripten....
Das hier... Was auch immer das ist... muss ich mir mal näher ansehen....
*** Link veraltet ***
Da ruft Google bei mir die http://domain.de/!i auf
Nein, leider nicht. Bei dieser Seite hier jetzt ja, da die über solche Feeds kommen, aber bei anderen Seiten (gleiche System) nicht.
Da gibt es alles mögliche...
.... am Ende
Einfach abgeschnitten
% am Ende, da mitten im UTF8 getrennt
und vieles mehr
auch welche, bei denen die Url hinten dran noch mal eine andere URL als Parameter hat, auch die Ruft Google bei mir auf (Kommen aus einer Pseudo-Suma wie z.B. *** Link veraltet *** )
etc...
Andere hängen an eine echte URL hinten ein /impressum an und entfernen dafür die Seitenzahl. Das alles wurde bisher abgefangen, da einfach nur falsch. Nun wird das auch alles weitergeleitet.
Grob gesagt kommen die URLs auch von allen möglichen Stellen. Webseiten, bei denen ein HTML-Link fehlerhaft eingebaut ist. Da kommt dann der Request auch mit seite.de"%20target="_blank" etc. oder von Feeds oder aus Presseportalen, die Kürzen. Andere kodieren eine UTF8-String nochmal, da kommt dann so Zeug bei raus: "ortsteil-Schuby-bei-D%C3%83%C2%B6rphof/"
Andere Kürzen in der Mitte einer URL, also als "http://seite.de/ordner/unter..../seite.html". Da ist sogar einer dabei: "unterkuenfte/...Niederrhein/seite_1_1.html" und der kommt von hier: *** Link veraltet *** << wegen so einem Scheiß hab ich hier das Chaos oder wie?
So Zeug aus Presseportalen:
/feiertage-und-brueckentage-<b>2.1</b>2.html
Das <b>xxx</b> ist aber gar nicht von mir. Die URL heißt eigentlich "brueckentage-2012.html" Kommt dort von so einer Art Contaxe-Script.
Da gibt es fast unendlich Kombinationen.
ZitatDa kann man doch neuerdings diese Häckchen setzen? Gibt es dann nicht eine "Ignore" Option oder alternativ als gelöst kennzeichnen, so dass die dann hoffentlich da rausfliegen?
Ja, gibt es . Hab ich ja auch vor 7 Tagen gemacht. Da kommt aber auch der Hinweis, dass die Meldungen wieder kommen können, wenn der Fehler nicht beseitigt wurde. Und am 2.4. kamen sie eben wieder ![]()
Ich sehe auch gerade, dass "/unterkuenfte/art_Ferienwohnungen/region_Bo" an "Ferienwohnungen" weiterleitet. Das macht er nur nicht, wenn da ein ... dahinter ist.
Und bei so was hier:
/unterkuenfte/art_Ferienwohnungen/ort_L%
läuft der sogar in einen Serverfehler. Die Url ist auch nur gekürzt, das soll eigentlich Lübeck sein und das % ist eben Bestandteil der UTF-8-Codierung.
Edit:
So, das "..." ist nun auch kein Problem mehr, lag an der htaccess.... An die ganzen anderen komme ich aber nicht ran. Und nun wird alles falsche aus dem Bereich "Unterkuenfte" an eine übergeordnete Seite weitergeleitet - da ist aber nun sehr viel dabei, was wirklich falsch ist.... also auch so Zeug wie "aslkfhkasjdhfksjfdhk"
Chris,
Ja, ein paar kann man da sicher umleiten, aber es geht dann ja über die Masse. Also nun nicht direkt auf die URLs aus dem Feed beziehen.
Du leitest also region_Bo an Bodensee weiter. Das würde gehen. Nur dann müsste man vorher prüfen, ob es a) die Region überhaupt gibt und b) es dort Ferienhäuser gibt. Und c) Es gibt zig Regionen die mit "Bo" anfangen. Also bei jedem Fehler zig extra Queries absetzen und dann dennoch nicht zu wissen, ob das auch stimmt.
Zudem gibt es schon interne Weiterleitungen, die etwa dann aktiv werden, wenn eine Region verschoben wurde. Ein Ort umbenannt wurde, zu einem Ortsteil wurde etc. Auch gibt es echte und gewollte 404 Fehler für Orte / Regionen, die es bei mir gar nicht gibt. Diese "Allgemeinen" Weiterleitungen würden mit denen aber wohl sicherlich irgendwo kollidieren.
Und dann kommt da noch der Punkt mit der Menge. Das in dem Feed sind ja echte URLs die nur gekürzt sind. Aber es gibt auch frei erfundene...
Wenn ich so was weiterleite
.../unterkuenfte/art_Ferien... leitet auf
dann leite ich da ja auch die frei erfundenen weiter.
Ich weiß schon was Du aber im Grunde meinst, nur ich bezweifle, dass das technisch umsetzbar ist bzw. kombinierbar mit dem, was schon da ist.
"Ignorieren". Das habe ich bisher ja auch. Nur nachdem nun nur noch 1000 angezeigt werden geht das nicht mehr wirklich. Wenn die voll sind, dann sehe ich die echten Fehler ja womöglich nicht mehr.
Und wie gesagt, das war hier jetzt ein Beispiel mit den URLs aus den Feeds. Da gibt es auch ganz andere, bei denen kein Ordner mit dabei ist, an dem man überhaupt irgendwas erkennen könnte.
Nachtrag: Bei "/unterkuenfte/region_Bod/seite_1_1.html" könnte ich durchaus eine Weiterleitung integrieren, auf /unterkuenfte/, denn der fehlerhafte Zugriff startet ohnehin die Klasse.
Aber bei "/unterkuenfte/region_Bod..." komme ich dort erst gar nicht hin. Also entweder htaccess umbauen und dann auch die Scripte oder die Klasse in die Fehlerseite integrieren. Das ist aus Sicht der Performance aber nicht sonderlich gut. Und die anderen Fehler, ohne gekürzte URLs wären noch immer da.
Hi zusammen,
also bei mir ist über Nacht irgendwie ein Wunder geschehen und von den ehemals 140.000 404-Fehlern sind nun nur noch 300 da ![]()
So, nun aber ein ganz anderes Problem an der Sache. Diese 300 hatte ich vor etwa 7 Tagen schon gelöscht. Nun stehen sie wieder da als erkannt am 2.4.
Das sind alles Seiten, die nicht existieren und nie existierten. Ebenso sind die Seiten nirgends wirklich verlinkt. Das ist das gleiche wie schon mal ein einem anderen Thread geschrieben - die URL steht nur irgendwo als Text auf der Seite.
Dumm dabei, dass viele die URL kürzten, da wohl zu lang zur Anzeige. Google folgt denen aber und meldet dann den Fehler. Um es zu verdeutlichen. Einige der "Links" kommen von hier: *** Link veraltet *** . Die gekürzten sind alles nur normaler Text.
Wie soll man mit denen denn nun umgehen?
Ignorieren? Dann läuft das Log aber irgendwann wieder voll.
Löschen? Hab ich ja schon, die kommen wieder.
Weiterleiten? Nur wie und wohin, denn die haben kein Muster. Da müsste ich also alle Fehlerseiten weiterleiten und genau das soll man ja nicht machen und habe ich auch nicht vor.
Irgendwie drehe ich mich da nun gerade im Kreis. Was macht man denn mit denen?
Zitatich kann dazu nur sagen dass ich mit schwach verlinkten seiten sehr profitiert habe. die seite steigt und steigt und überholt seiten die 10mal so viel links haben und ich mache seit fast 2 jahren keinen aktiven linkaufbau mehr.
Genau das sehe ich bei mir auch.
"Wir stochern nur herum."
Korrekt. Dann wäre es wohl besser das Thema zu beenden, bis Google es schriftlich gibt was genau geändert wurde ![]()
Wobei, das mit dem "unnatürlich" schon irgendwie passt.
Classifier... Ein Klassifikator... Für was? Was wurde durch Ankertexte klassifiziert? Ich würde mal sagen, das Thema der Seite, oder? Sprich, da ranken Seiten zu Suchbegriffen, die eigentlich vom Inhalt her damit nichts zu tun haben. Das kam nur über die Links. Das war auch das aus den "QR-Richtlinien".
genau mit dem hatte ich das verwechselt ![]()
ZitatWe have changed the way in which we evaluate links; in particular, we are turning off a method of link analysis that we used for several years.
Ok, aber bleiben wir doch mal rein beim Link, da ist der Ankertext ja mit dabei. Gibt je viele Spekulationen und ich weiß auch nichts genaues - spekuliere auch nur... Nur, was gibt es bei einem Link denn überhaupt - mal zusammengefasst:
url: kann nicht sein
alt: auch auszuschließen, denn der war für Text nie vorgesehen. Warum sollte der also bisher gewertet worden sein??
rel: möglich aber unlogisch. Oder meinen die damit das doch, also das "nofollow" ??
title: nee, der wurde bisher nicht gewertet
ankertext: eigentlich auch unlogisch, aber auch möglich
target: nee
onclick etc: hm, nee, oder?
So, was habe ich vergessen? Was wäre möglich?
Aber genau das hier habe ich schon mal so in der Art gelesen:
"how relevant a given anchor might be for a given query and website. "
Damals in den veröffentlichten Richtlinien für Quality Rater...
Da gab es ja Beispiele dafür und die waren schon sinnig. Also welche Links als "gut" anzusehen sind, welche einen "Flag" bekommen und welche als "Spam" einzustufen sind. Vielleicht wurde das nun automatisiert. Würde auch zum Thema "SEO-Links" passen - oder?
Nee, nicht mehr zählt nicht... Wie gesagt, ich habe das mit dem vom Februar verwechselt. Da ging es ja um die Links und nicht explizit um die Ankertexte. Und irgendwo in einem anderen Text ging es um Links die von SEO unter anderen in Social-Diensten aufgebaut werden. Grob gesagt ging es dort um "unnatürliche" Links bzw. Linktexte. Möglich, dass die Linktexte einfach nicht mehr zählen. Der Link als solcher ja, aber der Text nicht.
Ich glaube da irgendwie auch nicht dran, aber irgendwas muss es ja sein. Im anderen Teich ist aktuell sehr viel los in Sachen "Seite abgeraucht". Auch ein Bekannter von mir ist seit 4-5 Wochen einfach Weg und das bei allen unnatürlichen Linktexten. Bei dem ging es schleichend von P3 auf >50
"das bedeutet für mich dass sie eine Komponente die den Ankertext betrifft abgedreht haben"
Gut, das hätte ich das wohl mal genauer lesen sollen, dachte eigentlich das wäre der Bericht vom Februar... Dennoch sagt das nichts anderes aus, denn das wichtigste ist da nun dabei. Nicht "eine Komponente von ..." sondern "eine, die ... betrifft".
Und was ist im Algo, das den Linktext betrifft? Ich würde mal sagen dessen Wertung.
Nicht eine Komponente bei den Ankertexten, sondern eine Komponente bei dem Link. Und bei dem Link ist eine Komponente eben der Ankertext ![]()
Viele Möglichkeiten gibt es da ja nicht. Ankertext, URL, Title, Umgebungstext... was noch? Title zählte sowieso nicht... URL kann man schlecht "entwerten", Text drum rum kann man auch nicht wirklich entfernen, also bleibt da eigentlich nur der Ankertext übrig.
Unbedingt... Wenn Wordpress schon ein eigenes hat, dass sollte das Social-Zeug auch eines gaben. Da wird langfristig mehr los sein als bei Wordpress. Wobei das Social-Zeug auch ein Stück weit direkt und indirekt zu SEO gehört, Wordpress aber nur ein CMS ist wie alle anderen auch.
Margin
Ich habe keine Ahnung wie das Guppy dachte, aber mir würde eines reichen Google+ Facebook Twitter und co.
catcat
Wie ich oben schon versuchte zu sagen. Das wird wohl über die breite Masse laufen. Texte, die vielfach vorhanden sind und nicht aktualisiert werden sind alt, aber nicht veraltet. Dazu gehören neben Geschichte auch Bücher, Gedichte etc.
Erst wenn ein Artikel in der breiten Masse geändert wird, dann wird man da auch merken, dass es eine Neuerung / Aktualisierung gibt.
Und mit breiter Masse meine ich nicht 10 oder hundert. Sondern eher tausende und dann auch bei ganz bestimmten Quellen und nicht jeden 0815-Blog.
Also viele Datenquellen. Google weiß auch, was wann wo und wie neu geschrieben wurde und wann es in den Index kam etc. Dazu damals die "Timeline", nun das "Trends" oder auch Dinge wie Ngram Viewer für Bücher... Google weiß also sehr genau was aktuell angesagt ist, was es mal war und nicht mehr verändert wurde etc. Gerade bei den ngram gibt es sogar einen Hinweis, wie es gemacht wird, zumindest ein Teil davon:
Zitatthere is only one triplet of values (match_count, page_count, volume_count) per year.
guppy
Das müsste man aber erkennen können. Das Beispiel ist da recht gut sogar. Zum Thema gibt es viele Webseiten. Wenn nun der Großteil (und damit meine ich nicht eine Hand voll) den Inhalt aktualisiert, dann scheint es wohl was neues zu geben. Der der das dann nicht macht zählt als veraltet. Aber genau so eine Seite wird normalerweise nicht aktualisiert, da sich an der Geschichte nichts ändert. Also ist die zwar alt, aber nicht veraltet.
Daher finde ich auch die Übersetzung mehr als schlecht. alt und veraltet sind zwei gänzlich unterschiedliche Dinge.
Wobei man das wohl auch nicht auf jede Seite reproduzieren kann / darf. Da wird es welche geben, bei denen ist es eindeutig. Andere sind in der Grauzone und da wird nichts passieren.
Also ich denke da schon veraltet im Sinne von veraltet. Google erkennt ja durchaus den Inhalt einer Seite, also nicht wortwörtlich, aber den Bereich / die Thematik.
Eine Newsseite etwa, die nichts neues mehr bringt ist veraltet. Ältere News sind veraltet. Ein Blog, bei dem eigentlich auch regelmäßig neu Beiträge kommen ist nach einer Zeit x veraltet.
Oder Seiten mit statistischen Daten. Da kann man auch erkennen, was veraltet ist und was nicht, wenn man es mit der Masse der anderen Seiten aus dem Themenbereich vergleicht.
ZitatInstinkt und Selbsterhaltungstrieb
da könnte was Wahres dran sein ![]()
*** Link veraltet ***
*** Link veraltet ***
*** Link veraltet ***
*** Link veraltet ***
Was ich da gerade so merke... Es geht vom Thema her fast ausschließlich um G+... FB wird hier gar nicht so oft erwähnt, zumindest nicht in dem Zusammenhang.