Beiträge von Synonym

    "Der google Bot hat bei mir in den letzten Tagen täglich abnormale 400% der Seitenanzahl gecrawled"

    Das Verhalten habe ich witzigerweise auch. Wobei ich mir da auch nicht sicher bin, ob das stimmt. Da werden viel mehr Seiten angeblich abgerufen, als es überhaupt gibt. z:b. eine winzige Seite, 689 Abrufe laut Google am 8.9, aber die Domain besteht inkl. Favicon und Robots.txt nur aus 21 Dateien.

    Vielleicht bestehen die Probleme aber auch nur darin, dass die nun die neue Search-Console "ausbauen". Gibt da nun ja einiges neue.

    Wenn Dein Provider allerdings den Bot sperrt, dann gibt es nur eine Lösung -> wechseln

    Aber rufe doch mal die Dateien ab, die angeblich nicht erreichbar waren. Geht ja, musst ja keine Webseite vom Bot abrufen lassen, kann ja auch ein CSS oder Bild sein. Bei mir geht das dann komischerweise fehlerfrei.

    Passe mit der event-Config auf, da stimmt wohl was nicht oder Du hast es per Hand geändert.

    maxrequestworkers = serverlimit * threadsperchild

    Serverlimit ist per Default 16, wenn Du das nicht geändert hast. Ergibt also per Rechnung 16 * 25 = 400. Du erlaubst dem Apache also (wenn Serverlimit nicht geändert wurde) 400 Threads. Sagst dann aber gleichzeitig, bei 150 (maxrequestworkers) ist Schluss. Das führt dann, wenn ordentlich Traffik drauf ist und die 150 erreicht wurden nur zu: "scoreboard is full"

    Und das Serverlimit zu reduzieren macht gar keinen Sinn, denn Deine 16 Cores sind mit max. 16 Servern gut bedient. Weniger würde keinen Sinn ergeben.

    Ich weiß zwar nicht, warum Du das alles hier postest, aber egal ;) Wenns geht bitte die mpm_event.conf noch, gehört ja dazu.

    max_children von 10 ist zu klein, wenn da auch das Forum mit drauf soll. Da gibt es aber nicht viel zu testen, das kannste nur beobachten und anpassen. Schmeiß doch einfach "status" an, dann siehste was los ist und vor allem los war.

    Max_requests würde ich auf um die 500 setzen.

    Als Anmerkung: mpm_worker kann auch HTTP2. Der Unterschied ist nur die Art, wie Kind-Prozesse aufgebaut werden. Bei "Worker" bleiben sie offen, auch wenn sie nicht benutzt werden. Bei Event werden sie erst erstellt, wenn eine Anforderung da ist und dann auch wieder gelöscht. Zudem verarbeitet Event "kept-alive" anders. Dort hat das einen eigenen Prozess zur Steuerung, bei Worker macht das jeder selbst.

    Ich glaube nicht, dass das irgendwas mit SSL zu tun hat, vielmehr mit einem Problem bei Google. Ich kann nur für mich sprechen, aber alle "angeblich nicht erreichbaren" Ressourcen werden von Google abgerufen. Das Server-Log ist ja der Beweis dafür. Nur Google behauptet dann, es würde nicht gehen.

    Fraglich ist nur, daher macht mich das auch kirre, ob der normale Bot das Problem vielleicht auch hat und der dann quasi eine "zerschossene" Seite sieht.

    Wenn ja, wann hast du zuletzt die Search Console rendern lassen? (ist das das erste Rendering nach https-Umstellung?)

    Nein, das ist sicherlich schon über ein Jahr her. Aber ja, das Problem mit dem Abruf habe ich nun immer noch und die bemängelten Files gehen alle, wenn man die selbst abrufen lässt, also nicht die ganze URL, sondern nur das CSS z.B.

    "Wenn ja, wann hast du zuletzt die Search Console rendern lassen? (ist das das erste Rendering nach https-Umstellung?)"

    Nein, das mache ich bei bestimmten Domänen mehrmals wöchentlich, in der Regel immer, wenn ich an einer Seite was ändere. Abrufen -> Rendern -> an den Index senden.

    "Rendern" immer nur, damit ich auch sehe, was Google so sieht

    "Irgendwie dachte ich vorhin kurz, als ich das schrieb: Das wird jetzt wohl der Zeitpunkt sein, an dem Syno sich zu Wort meldet. ^^"

    Nun ja, unterschätze mich nicht. Stelle gerade meine Server um und zu http2 gehören auch Push-Nachrichten. Der sendet sie aber nicht nur per Nachricht im Browser, sondern auch spirituell :hurra:

    "Könnte jemand, der mein Surfverhalten auf meinem Rechner mitschneidet erkennen, welche Site ich aus meinen Bookmarks heraus ansteuere?"

    Ja und nein. Ja ist dann aber nur eine Vermutung. Bookmark = direkter Aufruf (kein Referer). Das geht aber auch per direkter Domain-Eingabe oder auch per Link, wenn der Referer blockiert wurde. Habe ich hier aktuell immer öfter und ich will ja zu Testzwecken wissen, wo die her kommen (Eigene Seite oder Hot-Link?). Aber ne, die kommen ohne Referer und das war definitiv kein Direktaufruf meiner OSM-Karten. Also kann ich es nicht sagen. Entweder habe die das Bild in den Bookmarks, oder rufen es per URL direkt auf oder löschen den Referer. Genauigkeit also eher nutzlos.

    Mitschneiden: Wenn Du einen Trojaner drauf hast, dann 100% ja, aber das ist eher ein anderes Thema. Eine Suma mit noch so vielen Profilen kann das nicht.

    Reine Fiktion: Android ist nun bekannt dafür, dass es GPS-Daten sendet, auch wenn GPS aus ist. Wer garantiert, dass Android, was ja von Google ist, oder Chrome für den Desktop, nicht auch verschlüsselte Meta-Daten schickt, wo ein Klick her kommt? Paranoid, ich weiß, aber möglich ist es.

    Ja, wenn man die Bookmarks der Leute kennen würde, dann wäre das eine "klare" Sache (Aber wie gesagt, man kann auch einfach so Bookmarks setzen). Aber: Datenschutz? Willst Du, dass mir Dein Browser mitteilt, dass Du ein Bookmark zu einer xxx-Seite hast? Oder zu einer Firmen-internen Seite aus dem Intranet?

    Die Dienste kannst knicken. Die waren mal "in", auch für Google. Sind es aber nicht mehr, weil fast nur Spam.

    Und ja, ich bin der Meinung, dass direkte Zugriffe (die von G gemessen werden können (Adsense und co)) positiv sind. Warum sollte Google eine Seite schlecht bewerten, wenn sie viel Type-In hat. Sie scheint ja also bekannt und beliebt zu sein. Oder eben wenn sie viral geht. G wertet auch FB aus und andere SM-Dienste.

    Ich gehe davon aus, dass "Direct Requests" schon jetzt im Algo mit einfließen. Und ja, das ist ein guter Indikator aber auch einer, der nicht genutzt werden kann, um eine Suma aufzubauen, weil man an die Werte schlicht nicht ran kommt. Das geht nur indirekt über andere Dienste wie Adsense / Analytics auf den jeweiligen Seiten. Und manipulieren kann man das auch. Nicht alles ohne Referer ist ein Direct Request. Aber an die Bookmarks selbst kommt man nicht ran und letztendlich wäre es ganz leicht manipulierbar. Dann kauft man halt keine Links, sondern Bookmarks. Was stört mich denn ein Link mehr in der Liste, sind doch eh schon 2000 drinnen ;) Oder eben per Script. Muss ja nicht "wollen Sie ein Bookmark setzen?" heißen, sondern anders. Nimm den Cookie-Hinweis. Jeder der da auf "ok" klickt, bekommt auch gleich ein Bookmark dazu. Ja, das geht, der Browser meldet es nur kurz, aber 99% können mit der Meldung eh nix anfangen.

    Wie erkennt man eine gute Webseite? Ich denke mal, technisch gar nicht. Ich kenne gute, aber das auch nur, weil ich die Quellen und Querverweise / Empfehlungen kenne und die eben nicht aus 0815 kommen, sondern auch von welchen, die Ahnung haben. Die würden "Mist" nicht empfehlen.

    Alleine schon, wenn ich da an einen LED-Händler denke. Der ist top, kaufe dort gerne ein. Super klasse Support, faire Preise, immer aktuelle Ware und keine Serien aus dem Vorjahr. Aber findet man die bei Google? Nee, nicht auf den ersten 8 Seiten, wenn man den Namen von denen nicht kennt. Gut, die Webseite ist angestaubt. In der Art fast wie Deine, aber nur "fast". Da merkt man aber auch, die legen keinen großen Wert auf Webseite, sondern die Firma, das lokale Geschäft, die Produkte und den Support. Alleine schon der Hochglanz-Katalog, der jedes Jahr kommt. Hätte die Webseite nur 2% davon, dann wäre das wohl ein recht chices Teil.

    "Hast du dir schonmal die Entwicklung angesehen was so webseites heute erfordern?"

    Was meinst Du damit? Klar habe ich mir das angesehen und die meisten CMS sind nicht kompatibel mit h2. Normale Websites, wo keine Optimierung war aber sehr wohl. Daher verstehe ich die Frage nicht. "Angesehen", was genau? Ich sehe mir täglich alles mögliche an.

    Anmerkung: Schade, dass das hier im Feedback ist und nicht allgemein, aber egal.

    PHP7.x ist nicht unbedingt schneller. Dafür muss die Software explizit auf PHP7 zugeschnitten sein und nur auf die. Hat die einen Fallback zu 5.x, dann ist der Vorteil nur noch marginal.

    Http2: Das ist schneller als http1.1, keine Frage. Aber auch hier, die Software muss es können und beachten. 5 CSS-Files zusammenfassen zu einer Monsterdatei nimmt h2 z.B. übel. Viel besser sind 5 einzelne Dateien. Was ich sagen will. Wer http1.1 nutzte und nichts optimiert hat, der hat mit h2 einen klaren Vorteil. Wer aber optimiert hat, also zusammenfassen, Sprites etc, der hat mit h2 einen Nachteil, es wird langsamer.

    h2 lebt von vielen Request, aber kleinen Datenmengen
    h1 lebt von wenigen Request, aber auch größeren Datenmangen

    Ok, dann habe ich da mal wieder geschlafen. Finde es nur erschreckend. Wenn man den Reiseführer nun noch damit koppelt, dann hat Google sein eigenes Unterkunftsportal :( Und Suchanfragen landen dann natürlich direkt dort und nicht in der organischen Suche....

    Ja, siehst Du richtig. Bilder kommen von denen und ich denke, dass die Texte letztendlich auch von denen sind. Anfangs von Wiki, dann wohl selbst geschrieben. Auch dieses "Vorgeschlagene Pläne für den Tag" kommt wohl so oder zumindest halbautomatisch. Die Map mit den Punkten kommt mir sehr bekannt vor. Habe ich auch von Bertingen und Umgebung, wenn ich mit GPS rumlaufe und "besuchte Orte" markiere.

    Nur zur Info: Es geht hier nicht um das "Ganze", sondern wie schnell das "Eine" antwortet, also zuerst HTML. Wenn dann der Rest länger dauert, dann ist das egal, denn alles ist ein neuer Request für sich und jeder Request = 15 Sekunden. Wenn Dein Bild also binnen 15 Sek lädt, also ein einzelnes, dann ist das kein Problem für den Test-Bot.

    Sagt mal, geht das bei euch noch? Ich kann hier nichts mehr abrufen (inkl. rendern). Entweder kommt als Antwort "teilweise" oder "vorübergehend nicht erreichbar". Wenn "teilweise" kommt, dann fehlen JS oder CSS Dateien. Bin schon erschrocken, dass am Server was nicht stimmt, aber der rennt.

    Und das Kuriose. Die bemängelten Daten, die angeblich nicht erreichbar sind, wurde sehr wohl ausgeliefert. z.B.

    Code
    66.102.8.168 - - [02/Sep/2018:19:11:09 +0200] "GET /css/nordsee-ferienunterkuenfte-20161216.css HTTP/1.1" 200 15921 "https://beispiel.rocks/www.nordsee-ferienunterk
    uenfte.de/" "Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/41.0.2272.96 Mobile Safari/537.3
    6 (compatible; Google Search Console)"

    Einer das gleiche Problem?