Beiträge von Synonym

    Nee unmittelbar nicht, das meinte ich ja auch. Bei mir im Bereich waren es aber Seiten, die zumindest aus Keys bestanden und diese Sysnonyme oder eben andere Schreibweisen für den Begriff waren. Und die stürzten ab. Die, die stiegen, hatten gar keine entsprechenden Keys im Namen oder eben andere Kombinationen...

    z.B. Key "Ferienwohnung Berlin"

    Gestiegene Seiten:
    -> wimdu
    -> dieser Hosteurope-Host
    -> mietferien
    -> feriendomizile-online
    -> tolle-wohnungen
    -> bellmundo
    -> waytostay
    -> apollo-apartments

    Gefallene Seiten:
    -> ferienwohnungberlin
    -> ferienunterkunft-berlin
    -> berliner-ferienwohnungen
    -> ferienwohnungen-in-berlin

    Ähnlich beim Key "Ferienwohnung". Am meisten gestiegen sind:
    -> interchalet
    -> expedia
    -> interhome
    -> mein-ferienhaus-in
    -> bellmundo
    -> 9flats
    -> wikipedia

    Sagt mal, gibt es eine Möglichkeit, dieses "Automatically retrieve titles from external links" bei einem Account global abzustellen? Mich nervt das ehrlich gesagt tierisch. Da will ich immer wieder was schreiben, URLs posten und das Mistding wandelt die URL um. Sinn ist aber, die URL zu sehen. Klar, das geht im erweiterten Editor, aber warum? Das ist umständlich. Erst den erweiterten öffnen, der auch noch langsamer ist, das Häkchen entfernen... Sehr umständlich. Und wenn man nachträglich editiert, dann ist die Option wieder aktiv und muss neu deaktiviert werden. Mich stört das ehrlich gesagt fürchterlich. Den Post eben musste ich 4 mal nachbearbeiten, weil jedes Mal die URL durch den Titel ersetzt wurde.

    Ok, dann gehen wir da mal noch einen weiteren Schritt zurück.

    1. Entferne die Weiterleitung für "ohne www" aus der HTACCESS, so dass die ohne www-Version aufgerufen werden kann und diese nicht weiterleitet! Die Seite *** Link veraltet *** muss also direkt aufrufbar sein.

    2. Dann gehe her und melde in den WMT die Version ohne www auch an und bestätige diese (per HTML-Datei).

    3. Wenn das erfolgreich war, dann hast Du in den WMT beide Seiten stehen, die mit und die ohne www.

    4. Versuche dann, bei der www-Domain die bevorzugte Domain festzulegen

    5. Wenn das funktioniert hat, dann die Weiterleitung in der htaccess wieder aktivieren.

    Kann schon sein, dass das damit zusammen hängt. Jede Domain, egal ob Hauptdomain oder Sub hat einen eigenen Code. Der muss exaxt der sein, den Google vorgibt, sonst geht das nicht und die Bestätigung schlägt fehl.

    Also jetzt ging es ja. Angemeldet ist die bei WMT ist die *** Link veraltet ***

    Konntest Du die Option "URLs im Format *** Link veraltet *** anzeigen" jetzt auch auswählen? Wenn ja, dann ist das Problem gelöst. Die nicht-www wirst Du so nicht bestätigen können / auswählen können, denn die leitet vom System her ja automatisch weiter.

    se0815
    Das mit dem doppelt drinnen ist was anderes und zu viel auf einmal, um es jetzt direkt zu machen. Die doppelten kommen noch vom alten System oder vielleicht auch vom neuen. Du hast da Statuscodes von 200, 301 und 303, durch die www-Weiterleitung, Systemumstellung und die Sprachversionen und das teils wild durcheinander. Da werden bestimmte Seitenzugriffe gleich zwei / drei mal in Folge gewechselt, bis endlich mal die richtige da ist. Kann schon sein, dass Google das nicht mag. So gesehen gibt es sogar en-Seiten mit teilweise deutschen Inhalten.

    Fakt ist hier aktuell nur, dass die /fr und die /en im Index ist, die /de aber nicht. Alles drei sind Startseiten, je nach Land. Die eigentliche Root / gibt es aber auch noch.

    Zitat

    und mit der Suchfreundlichen URL´s wären die --> ?lang= nicht vorhanden.


    Genau das ist mal wieder so ein Problem mit den CMS-Dinger.... Du hast zwar suchmaschinenfreundliche URLs, aber die Parameter ?lang oder auch fiktive andere lässt das System dran und liefert dennoch die Seite. Da wirste sowieso zukünftig Probleme bekommen, denn sehr viele andere Dienste (FB, Ads etc) setzen Parameter zum Tracking ein. Diese sollte Dein System filtern und entfernen oder per Canonical reagieren. Dein System ignoriert die aber und liefert die Seite ganz normal aus. Nur, das ist was für Alex, der kennt sich mit Joomla besser aus als ich, der es das letzte mal vor 2 Jahren benutzt hat.

    z.B. *** Link veraltet *** leitet weiter an die *** Link veraltet *** was es nicht tun sollte, denn die URL ist falsch. Wobei das jetzt auch wieder seltsam ist, denn vorhin wurde ich an die /de geschickt und jetzt an die /fr ???

    Daher am Boden anfangen und das ist erst mal www mit oder ohne.

    Das erste ist also:
    Welche Domain ist in den WMT direkt angemeldet, also hier *** Link veraltet ***

    So, wie gesagt, Stück für Stück...

    Festlegen der mit oder ohne www-Version, das ist für mich wichtig, da beides im Index ist.

    Allerdings verwundert es mich nun etwas, dass da keine von beiden auswählbar ist, denn die Seite musstest Du in den WMT ja auch anmelden und bestätigen. Das war dann ja quasi schon eine von beiden.

    Welche Seite ist in den WMT denn angemeldet worden? Die mit oder die ohne www?

    Zitat

    ich wollte es in Format mit "www" umstellen dann erhalte ich diese Meldung dessen ich nicht Anklicken oder Bestätigen kann:
    Im Verlauf der Festlegung einer bevorzugten Domain wird zunächst überprüft, ob Sie der Eigentümer von *** Link veraltet *** sind. Bestätigen Sie *** Link veraltet ***.
    Diese Meldung erhalte ich auch wenn ich auf "ohne www" umstellen möchte.


    Nutzt Du die Variante mit der Bestätigung per Meta-Tag? Ich gehe davon aus, da ein entsprechender Wert in der Webseite eingebaut ist. Stimmt der denn überhaupt?

    Analog dazu, versuche mal die Bestätigung per Datei zu machen, also mit der html-Datei, die Google die vorgibt und die Du dann ins Root per FTP kopieren musst.

    Ist halt schon seltsam, dass beides nicht geht, wo doch die Domain bei der Anmeldung in den WMT auch bestätigt werden musste.

    Also mal langsam und Stück für Stück...

    "Bestätigung".

    Welche Version ist schon bestätigt? mit www oder ohne?
    Welche willst Du verwenden?
    Welche lässt sich nicht bestätigen? mit www oder ohne?

    Ach ja. Und nenne mal das Bestätigungsfile, das Du von Google bekommen hast, also dieses Ding mit den Buchstaben und Zahlen, das ins Root geladen werden soll. Ist ohne das etwas schwer zu testen.

    Edit: Das mit dem File hat sich erledigt. Sehe gerade, Du machst das per Head:

    Code
    <meta name="google-site-verification" content="q9IcA5wb8LQffdKQmbRgErmAf9gxBO8_3U_bDzY1X80" />

    Edit 2: Rein als Anmerkung, da die Infos noch fehlen.
    Wenn Du die Seite mit www verwendest, also *** Link veraltet *** , dann kann die madame-noble.com so nicht bestätigt werden. Der Grund ist auch ganz einfach. Google greift auf die Version ohne www zu und wird direkt an die mit www weitergeleitet, somit ist die ohne www nicht erreichbar und kann nicht bestätigt werden.

    Das mit dem nicht gefunden werden ist ein ganz anderer Punkt und derzeit recht unübersichtlich. Da sind wohl noch einige alte Seiten im Index, einiges dadurch wohl auch doppelt und dreifach

    *** Link veraltet *** Auf der Domain
    *** Link veraltet *** Bei Google
    *** Link veraltet *** Auf der Domain
    Das sind aber alles drei die gleichen Seiten.

    Dazu kommt noch, dass sowohl Seiten mit als auch ohne www im Index sind. Das sollte also erst mal wirklich Stück für Stück bereinigt werden. So ist das gerade etwas zu viel auf einmal und die Umstellung zu neu.

    Zitat

    Bei mir stehts auch überall so: "User-agent: *" und funktioniert seit Jahr und Tag.


    Und bei mir überall User-Agent :) Daran sollte es aber nicht liegen, denn Google erkennt solche Dinge selbst. Richtige Fehler sehen anders aus, da bringt Google dann auch eine Parser-Warnung.

    Von wem ist die Meldung wegen der Groß-/Kleinschreibung? Von Google? Wenn nicht, dann vergiss es. Du willst bei Google gefunden werden, also halte Dich an das, was Google empfiehlt oder eben auch bemängelt.

    So, dann wären da noch die Punkte mit der "Bestätigung" und das "nicht zu finden sein"

    Ich muss mich mich hier auch berichtigen. "agent" klein sollte doch stimmen. *** Link veraltet *** Aber wie gesagt, das ist nicht das Problem!

    Zitat

    Unter Blockierten URL´s bekomme ich unter robots.txt 7 Blockierungen angezeigt kann diese aber nicht auswählen oder sichtbar machen, ist dies normal?


    Ja, das ist normal, bei mir stehen da über 2.000. Das sind eben Seiten, die durch die robots.txt blockiert wurden. Wenn da aber ganz unten auf der Seite, nach dem Test, keine Fehler angezeigt werden, dann ist alles in Ordnung.

    Alles das gleiche. Ich kämpfe hier auch schon seit 3 Wochen mit dem Gas-Anbieter-Wechsel rum. Hab ein neues Unternehmen, Gas udn Strom beantragt und vor 3 Wochen ein Schreiben von denen, dass der Wechsel vom alten Anbieter abgelehnt wurde. Begründung: Mein Umzug war nicht gemeldet. Also beim alten angerufen, was das soll. Die dann, dass alles normal sei, ich sei gemeldet und der Antrag auf Wechsel wurde auch nicht abgelehnt, da es gar keinen Antrag gab. Also wieder beim neuen angerufen. Doch, den Antrag gab es, zusammen mit dem Strom. Dass der Antrag nicht vorhanden wäre könne nicht sein, denn er wurde ja abgelehnt.

    So, nun stehe ich da und schüttel nur den Kopf. Strom wurde vor 3 Wochen genehmigt, Gas wurde abgelehnt laut neuem Anbieter, laut Altem gab es gar keinen Antrag und keine Ablehnung.

    Ich glaube hier fast, dass der Antrag da war und sich der alte Anbieter nur rausreden oder mich länger halten will. Ist ja schließlich Winter, der Gasverbrauch hoch und ich in der teuren Grundversorgung. :knueppel:

    Also bei meinen beobachteten Seiten könnte es ein EMD sein, wobei ich aber schon eher auf Panda tippen würde, denn "exact match" sind die abgerauchten Seiten nicht. Die gestiegenen sind jedenfalls weit weg von EMD.

    In den WMT gibt es den Bereich "Status". In dem Bereich findest Du zwei Punkte die interessant sind.

    Zum einen den Punkt "Blockierte URLs". Unter diesem Punkt zeigt Dir das WMT oben im Feld die aktuell geladene robots.txt an. Unten drunter ist ein Feld mit der Überschrift "URLs Geben Sie die URLs und User-Agents für den Test an. ". Dort kannst Du eigene URLs Deiner Seite eintragen. Unten dann auf den Button "Test" klicken. Das WMT zeigt Dir dann, ob die abgefragten URLs von der robots.txt gesperrt sind oder nicht. Wenn die robots.txt Fehler hat, dann zeigt Google die unten als Ergebnis auch an. Könnte z.B. so aussehen:

    Code
    URL: https://beispiel.rocks/beispiel.rocks/www.domain.de/
    Googlebot: Zugelassen. Als Verzeichnis erkannt; bestimmte Dateien weisen eventuell unterschiedliche Einschränkungen auf.

    Und der zweite Punkt ist der "Abruf wie durch Google" (nicht Google-Bot, hatte mich da vertippt, ist aber das gleiche). Oben in der Adressleiste einfach den Pfad eingeben, in Deinem Fall z.B. die robots.txt. Dann auf "Abrufen" klicken und warten. Unten in der Liste erscheint dann der Abruf, wenn er fertig ist. Rechts bei "Abrufstatus" kannst Du dann die Details ansehen.

    Als Ergebnis müsste was in der Art kommen:

    Das mit dem "User-agent" ist in der robots.txt selbst. Ganz oben die erste Zeile nach den Kommentaren (User-agent: *). Das müsste "User-Agent" heißen, also "User-Agent: *".

    Schau aber erst mal in den Blockierte URLs, ob dort die richtige und aktuelle robots.txt angezeigt wird. Kann sein, dass Google eine alte hat.

    Aber wie gesagt, es kann auch ein Fehler bei Google sein, denn ich bekam gestern auch einen, heute jedoch nicht mehr und meine robots.txt ist identisch, die wurde schon Monate nichts mehr geändert.

    Allerdings möchte ich nun auch einen Fehler bei Google nicht ausschließen, denn eben habe ich meine eigene getestet und bekomme als Antwort:

    Zitat

    Die Seite konnte nicht gecrawlt werden, da sie durch die neueste vom Googlebot heruntergeladene "robots.txt"-Datei blockiert wird. Falls Sie die "robots.txt"-Datei vor Kurzem aktualisiert haben, beachten Sie, dass es bis zu zwei Tage dauern kann, bis die Aktualisierung wirksam wird. Weitere Informationen finden Sie im Hilfeartikel zu "robots.txt".

    Der Test unter "Blockierte URLs" sagt dann aber wieder "erfolgreich".

    Äm ja. Ich meinte mit dem "Abruf wie durch Google-Bot" den Abruf der robots.txt. Das was Du da nun hast ist die Startseite, oder?

    Zitat

    kann es sein daß Google ein Problem mit der lang=de-de auf einer Französischen Seite hat?


    Könnte eventuell ein ganz kleines Problem sein, aber hat mit der jetzigen Geschichte gar nichts zu tun. Im Gegenteil. Bei der robots.txt kommen diese ganzen Angaben gar nicht.

    HTML
    <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "https://beispiel.rocks/beispiel.rocks/www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd">
    <html xmlns="https://beispiel.rocks/beispiel.rocks/www.w3.org/1999/xhtml" xml:lang="de-de" lang="de-de" dir="ltr" >

    Daher: Das ist keine robots.txt die Du da abfragst, sondern eine html-Seite.