Beiträge von Synonym

    Daher meinte ich ja, es ist möglich, manuell einrichten. Das bei mir war nur ein Beispiel, da ist es da, ob ich will oder nicht ;)

    Das ist da mit den Profilen besser gelöst eigentlich. Einmal auswählen, Pin eingeben, fertig. Aber das wollten die bei VF nicht. Wie gesagt, es könnte ein Kind den TV anmachen oder eben, wenn man eingeloggt ist, weg geht, dann ein Kind kommen. Daher ist das hier so, dass man den immer wieder eingeben muss. Nervt vor allem beim Timeshift, weil man da schon den Pin für die Folgesendung eingeben muss, obwohl man die aktuelle gerade noch zeitversetzt schaut ;)

    Naja, wäre ja zu einfach, den Zugang einfach zu limitieren. Keine Ahnung warum das bei Netflix so ist, dass man das manuell einrichten muss. Bei meinem Premium VF samt SmartCard geht nix über FSK12, ohne eine Pin einzugeben. Mich selbst nervt das aber schon, weil man da noch nicht mal durchzappen kann. Immer wieder die Pin, dann weiter, Pin, weiter.

    Hatte da sogar mal nachgefragt, warum das so ist. Antwort war sinngemäß.... Es könnte ja auch ein Kind den TV einschalten. Deaktivierung nicht vorgesehen.

    Andererseits verstehe ich aber auch die Medien nicht. Erst seit dem so viel darüber berichtet wird ist die Serie überhaupt ständig steigend in den angesagten Filmen. Genauso wie dieses "Cuties".

    Ja vielleicht. Wenn ich mal wüsste wie man "nicht fertig gesehene" Filme aus der Liste "als xxx weitersehen" weg bekommt, dann vielleicht.

    Aber wegen nicht abgeschlossenen Filmen, ok war ne Serie: Ich fand Colony ganz gut. Leider hört die aber wirklich mitten in der Handlung auf :(

    Wenn ich schon so was da lese:

    "Im obigen Beispiel wird eine Abfrage für /rewriteme/hello zunächst vom ersten Standortblock verarbeitet. Sie wird in /hello umgeschrieben und ein Standort gesucht. In diesem Fall stimmt sie wieder mit dem ersten Standort überein und wird wie gewohnt von den try_files verarbeitet. Wenn nichts gefunden wird, kehren Sie möglicherweise zu /fallback/index.html zurück (mithilfe der oben beschriebenen internen Umleitung try_files)."

    Was bitte bedeutet "möglicherweise" bei einer Konfiguration???

    Oder

    "Wenn wir beispielsweise das letzte Beispiel so ändern, dass es ein Umschreiben enthält, können wir feststellen, dass die Abfrage manchmal direkt an den zweiten Standort übergeben wird, ohne sich auf die Direktive try_files zu verlassen:"

    Aha, manchmal. Geht wohl nach Lust und Laune, oder Tageszeit oder wie?

    Eigentlich war ich ja froh, dass die Erstinstallation erfolgreich war und auch so weit ging. Dachte eigentlich die Anbindung an PHP und SSL wäre das Komplizierteste, aber nein, das ist das EINFACHSTE! Gut, an "rewrite" habe ich mich noch nicht versucht, wie auch, scheitere ja schon vorher, bei statischen Dingen.

    Irgendwie scheitere ich hier an den einfachsten Dingen, also Dingen wie in Ordner A Etag abschalten, in Ordner B ein anderes Expire setzen. Global Vorgaben machen für Bilder wie JPG oder PNG.... Beim Apache ist das ganz einfach. Da wird von oben nach unten abgearbeitet bzw. in der Order, wie die Vorgaben sind. Kommen mehrere Bereiche für eine URL in Frage, wird "gemerged" bzw. überschrieben. Aber NGINX? Was haben die denn für eine Struktur bzw. Abarbeitung???? Dokus gibt es viele. Lese die nun auch schon seit fast 48 Stunden hoch und runter. Ergebnis: Es geht nicht so wie es soll.

    Offizielle Doku und Beispiele:

    location = / { [ configuration A ] }

    location / { [ configuration B ] }

    location /documents/ { [ configuration C ] }

    location ^~ /images/ { [ configuration D ] }

    location ~* \.(gif|jpg|jpeg)$ { [ configuration E ] }

    "The “/” request will match configuration A, the “/index.html” request will match configuration B, the “/documents/document.html” request will match configuration C, the “/images/1.gif” request will match configuration D, and the “/documents/1.jpg” request will match configuration E."

    Aha, ok, so weit ist das zu verstehen, also die Erklärung für genau dieses Beispiel, mehr aber auch nicht. Dabei ist das teilweise genau das, was ich brauche und suche.

    Also Anweisungen für Bilder (egal wo die sind). Hier im Beispiel wäre das "configuration E".

    Nehmen wir nun mal an, was bei mir wirklich der Fall ist, es gibt die Ordner "folder-1", "folder-2" und "folder-3" und die entsprechenden "locations" dazu. In allen liegen alle möglichen Daten, PHP, HTML und auch Bilder. Alle Ordner bekommen andere Vorgaben. Expire, Zugriffsrechte, benötigte Header. Geht auch so weit alles.... ABER..... Wenn man einfach aufruft: domain-de/folder-1/img.jpg

    Diese "configuration E" hat dann Vorrang und die "locations" für die drei Ordner werden entsprechend ignoriert. Also alle Vorgaben für die Ordner werden ignoriert. Lass ich "configuration E" weg, dann greifen wieder die von den Ordnern, aber dann haben ALLE Bilder keine Vorgaben mir.

    Ich verzweifel da echt. Kennt sich einer aus?

    Oder eben die anderen Optionen nutzen, die für genau solche Sonderfälle da sind, und die neuen Seiten, wenn sie denn nur alle paar Wochen entstehen, selbst melden.

    Und zu bedenken wäre natürlich auch, ob für solche Themen, wo nur alle paar Wochen was kommt, ein Forum überhaupt das richtige System ist. Der Sinn von einem Forum ist ja eigentlich ein anderer.

    D-Schlauch? Ein Schlauch der Feuerwehr. Sollte der Vergleich sein, dass die Leitung für den Einsatzzweck dann viel zu groß ist. Die Rosen wären in 1 Sek gegossen oder weggeschwemmt, den Rest des Tages ist der Schlauch nutzlos. Das ist in etwa so, wie die Kapazitäten noch weiter hoch fahren, damit öfter abgerufen wird.

    Klar gibt es teils gravierende Unterschiede. Aber eben wie gesagt, daran kann man selbst arbeiten. Es ist auch nicht sinnvoll, dass das die Suma macht. Ist es einfach nicht. Das ist kein Schönreden für Sumas, das ist einfach nur overkill. Überleg doch mal, wie viele nutzlose und sinnlose Webseiten es gibt, wie viele, bei denen sich seit Jahren nichts änderte. Die werden alle immer wieder mal gespidert, aber eben sehr seltener als andere. Das ist aber genau das, was Du meinst. Klar kann man das erhöhen, aber bei den Seiten, die einfach nur brach rumliegen, ist das nutzlos und Verschwendung. Die Zeit, wo der Bot für eine brachliegende Domain braucht, die könnte er auch für eine aktuellere verwenden. Und brach rumligen, Spam oder nicht mehr verwaltet werden sehr viele Webseiten. Und da reden wir nicht nur von Seiten wie Deinen, sondern auch von so automatischen Generatoren etc, mit Millionen von Unterseiten, anderen Hobby-Seiten etc. Die sind einfach da, ändern sich aber nicht mehr. Würde mal sagen, 50% vom Netz liegt nur brach rum bzw. wie Cloudflare schrieb, nur 8% aller Botzugriffe sind auf geänderte oder neue Seiten. Also sind die anderen 92% nutzlos. Diese 92% sind aber die, die dann auch langsamer werden, aber dennoch stattfinden, denn es könnte ja sein, dass sich doch mal was ändert. Aber die Kombination "aktuelle News" und "geringe Post-Frequenz", das passt nicht zusammen. Was meinst Du, warum auch die Medien immer wieder irgendwas Nutzloses posten, also so Zeug wie, "wie rum hängt man Klopapier auf?" Klar, damit die Frequenz hoch bleibt.

    Und das Problem ist eben, dass man das "brachliegend" erst erkennt, wenn man drauf zugegriffen hat. Das weiß man ja nicht vorher. Aber jeder Zugriff ist dann im Nachhinein gesehen unnötig gewesen. Also wird das limitiert, um die "Verluste" kleinzuhalten. Und genau dafür gibt es eben die anderen Möglichkeiten, etwas an Sumas zu melden.

    Diese Briefkästen in den USA finde ich geil, also die mit dem Fähnchen. Da rennt man nur raus und schaut, ob was Neues da ist, wenn das Fähnchen das signalisiert. Was meinst Du wie oft ich hier umsonst 5 Stockwerke runter zum Kasten renne. Das sind die 92% vom Bot. Also auch das Buch, "der Weg war umsonst".

    "Könnte Google nicht einfach schlicht die Kapazitäten erhöhen, um dem Anspruch, den sie in die Köpfe der User implantiert haben, gerecht zu werden?"

    NEIN! Um alles irgendwie in Echtzeit zu haben nicht, nein und nimmer. Selbst wenn Google und andere da Serverfarmen in der Größe von Ländern hinstellen, das könnte die Infrastruktur bis hin zu den kleinen popligen Servern der Webmastern gar nicht.

    Es geht doch nicht nur um Google. Google hängt auch nur am "Netz". Oder hat Google zu Deinen Webseiten eine eigene Leitung gelegt? Also so wie die Überseekabel, die quasi von Google alleine genutzt werden?

    Unser Knotenpunkt in Frankfurt ging schon in die Knie, als zu viel Traffik kam, Wasserversorgungen brachen zusammen, weil alle zur Halbzeit beim Fußball aufs Klo rennen, Handys gehen nicht mehr, weil alle Silvester um 0 Uhr Nachrichten schicken und telefonieren.

    Kann man das erweitern, also wäre es technisch möglich? Ja, wäre es. Man kann sich auch einen D-Schlauch in den Garten legen, um seine Rosen zu gießen. Wäre das sinnvoll? Nein.

    Lasst doch mal dieses hin und her sein. User_X ist nicht beteiligt, also hat sein Name hier gar nix zu suchen. Und wo "Abakus Forumsfossil" ist oder nicht ist, wer er ist oder nicht, das kann man ihn auch selbst fragen.

    Cura: Keine Ahnung, ob er auf FB ist, aber wenn, dann kann er Deine Kommentare ja sehen / lesen. Reicht ja schon ein gemeinsamer Freund, den beide haben. Und zu wissen, wer Du auf FB bist, ist ja nicht sonderlich schwer. Zaunpfahl: Steht in Deinem Bild von oben.

    Die Frage mit Semrush ist nicht rhetorisch. Wollte schon was zu schreiben, hatte es dann aber gelassen. Das ist schlicht was ganz anderes. Die Spidern eine Site, rufen den Quelltext ab, suchen darin Links und speichern die. Das machen sie immer wieder um zu prüfen, ob er noch da ist, ein neuer da ist, oder eine neue Seite gefunden wurde.

    Das macht Google auch. Daher sagte ich schon mal, Du müsstest als aller erstes herausfinden, wie oft Google überhaupt auf Deiner Seite ist. Als Anmerkung, Pagespeed.de von Alex kann das auch. Eine Seite oder eine Hand voll vorgeben und dann lass ihn drauf los. Suche alle Links die da sind, folge allen, suche wieder, folge, suche etc.

    So, Semrush ist permanent bei Dir, bei mir auch. Also nicht immer, aber wenn, dann gerne mal Tage und dann wieder Tage nicht. Warum? Weil die Seiten schon bekannt sind, da werden also bekannte abgesucht und deren Links gefolgt. Stellst Du eine komplett neue Seite ein, dann werden die da nicht kommen, denn sie kennen sie nicht. Sie lernen sie irgendwann kennen, wenn verlinkt und Link gefunden, aber auch das dauert. Oder warum meinst Du, warum selbst die besten Linkchecker auch nur einen Bruchteil der Links finden oder eben nur ein Bruchteil davon überhaupt stimmt? Weil auch dort die Daten "alt" sind. Es kann nicht alles jetzt sofort geprüft werden. Diverse Tools zeigen mir hier noch Links an, die gibt es schon 5 Jahre oder länger nicht mehr.

    So, und weil Du immer sagst, alles wäre nur eine Vermutung.... Klar ist es das, wie vieles im Leben. Es ist auch nur eine Vermutung, dass ich sterbe, wenn ich aus dem 20ten Stock springe. Kann mir schließlich vorher keiner beweisen, dass dem so ist.

    So, die Bots.... Semrush haben wir nun. Google und alle anderen machen erst mal in Phase 1 das Gleiche. Nur dass Googles Datenbasis wohl um Faktor 1000 Mio größer sein dürfte, aber egal. Dieser Step 1 ist der einfachste, aber auch der ist limitiert. Alles gleichzeitig geht nicht, man kann keine mehrere Milliarden Webseiten zur gleichen Zeit abrufen. Selbst wenn das gehen würde wären das ja nur die bekannten und nicht die neuen. So oder so, die neuen Seiten muss man suchen. Wie oft will man denn suchen? Eben war ich da, es war nichts neu. Jetzt, 2 Min später vielleicht? Also noch mal schauen. Wieder nicht. Soll ich gleich noch mal?

    Du gehst zu Lidl um zu sehen, ob was neues im Sortiment ist. Nee, ist nicht. Gehst Du dann 10 Min später gleich noch mal hin um nachzusehen?

    So, immer noch Step 1. Der einfachste, aber limitiert, auch bei Semrush und Co.

    Google hat aber noch Step 2, 3 und 4 und da kommt nun noch mehr Last. Step 1 war nur Quelltext abrufen und auswerten. Das ist Traffik für den Quelltext und Rechenleistung für die Auswertung. Also Step 1b... Sonstige Inhalte abrufen. Bilder, CSS, JS, Video etc. Jetzt haste schon mal richtige Datenlast, die z.B. Semrush nicht hat. Dann haste also die Rohdaten. Also Step 2, rendern ist angesagt, also die Webseite so zusammenbauen, wie sie im Browser ist. Nun ist fast nur Rechenleistung gefragt. Deine Domain hat wie viele Seiten inkl. Forum? Also alle URLs, die es irgendwie gibt und erzeugt werden? Ich würde mal grob schätzen 1500. Wenn Du alles zeitgleich willst, dann mach doch mal im Browser 1500 Tabs auf und lass den rendern ;)

    So, Step 3 und 4 (Seite auswerten und Cache) lass ich nun mal weg.

    Alleine schon der Gedanke, zeitgleich von jeder Webseite auch nur ein Bild zu laden ist unmöglich. Unmöglich im Sinne von "nicht sinnvoll". Alle Seiten einer Domain laden.... Das wird lustig. Wenn Google das machen würde, dann wärst Du sicherlich auch einer der Ersten, der fragen würde, warum stürzt mein Server ständig ab. Naja, weil Google halt die ganzen Ressourcen braucht, die Dein Server so hergeben kann.

    Also sind wir wieder an dem Punkt "Ressourcenverteilung" und "priorisiert einsetzen". Eine Ampelschaltung an einer Kreuzung ist auch unterschiedlich und abhängig davon, ob es eine Haupt- oder eine Seitenstraße ist.

    So, neue Seiten, die muss man erst finden. Dafür gibt es z.B. auch so was wie Sitemaps, damit es einfacher ist. Man muss dann halt nicht die ganze Domain absuchen, sondern nur die Datei lesen. Aber wie oft? Auch hier, es wird priorisiert. Davon gibt es ja auch nicht nur eine oder 10, das sind Milliarden. daher auch der Ansatz mit "IndexNow". Das spart im Grunde (oder könnte) alle Zugriffe sparen, denn die erfolgen nur, wenn was Neues gemeldet wird. Also geht man auch nur in den Lidl, wenn das neue Prospekt da ist, in dem die Neuheiten drinnen stehen.

    Ja, so ist das nunmal, das stimmt. Sumas sehen das aber nunmal anders ;) Auch wenn ein Thema hochaktuell ist bringt das nix, wenn das veröffentlichende Medium das nicht ist - nicht aus Sicht der Suma. Das wäre als wenn man einen brandaktuellen Artikel in einer Zeitschrift veröffentlicht, die nur einmal im Monat gedruckt wird und der letzte Druck gestern war.

    Und ich finde es nicht normal, dass manche Sites im 10minutentakt gespidert und aktualisiert werden und bei anderen monatelang kein Bot vorbeischaut. Das ist reine Willkür.

    Das ist keine Willkür. Was sollen sie denn anders machen? Du hattest doch auch was von Huhn und Ei geschrieben. Kommt hier auch bei raus. Jeder einzelnen Seite einen Intervall geben, z.B. von 12 Stunden und dann neu abrufen? Ja, dann wären alle gleich. Nee stopp, doch nicht, denn wie findet man dann neue Seiten? Also muss man alles neu abgrasen. Jede Domain jederzeit komplett abklappern? Nicht sinnvoll, denn es macht schon einen Unterschied, ob da im Minutentakt was kommt oder alle paar Wochen. Wobei, auch das geht nicht, noch nicht mal das mit den 12 Stunden. Sollen alle weltweit zum gleichen Zeitpunkt abgerufen werden? Müsste man, sonst hat man ja dennoch ein Zeitfenster von 12 Stunden. Der eine kommt vielleicht schon in 2 Min dran, der andere war erst, kommt erst wieder in 11 Stunden 59 Minuten.

    Liest Du Zeitungen jeden Tag, wo nur alle 3 Wochen mal ein neuer Artikel kommt? Anfangs vielleicht, dann wirst Du Dich auch auf andere konzentrieren, die schneller sind, wo jeden Tag was Neues ist. Und wenn Dich die Zeitung gar nicht interessiert, auch wenn sie jeden Tag was Neues hat, dann liest Du sie gar nicht mehr. Das sind bei Sumas z.B. erkannt Spamseiten.

    Nix anderes machen Sumas. Suchen wo es was Neues gibt und priorisieren, wo sie öfters Erfolg haben und wo nicht.

    Das Forum hier: Dein Thread wegen dem "scrollen ab Seite 4 bei Google", obwohl da auch von mir extra noch Posts dabei waren, dauerte 3 Tage, bis er im Index war. Dein Post wegen Facebook, 4 Tage alt, nicht im Index. Dein "Neues vom Vulkan", ist vom Samstag, nicht im Index. "Betriebssystem zurücksetzen", von letzter Woche Mittwoch, fast 7 Tage alt, nicht im Index. Dein Post bezüglich Cookie-Banner im "Alles bestens" vom 18.10., nicht im Index. Die anderen vom 17.10. und älter sind es.

    Wegen Startseite: Dann schau Dir mal SEO NW (seo-nw.de) an. Da sind die letzten Aktivitäten als auch die letzten Beiträge drauf. Aber das ist noch kein Garant für eine Aufnahme, denn das ist nur ein Ausschnitt der letzten. Kommen zu viele neue auf einen Schlag, dann rattern die eventuell durch und keiner hat es bemerkt. Auch hier ist es also die Frage, wie oft der Bot kommt. Beispiel von meiner FN. Habe 7 Unterkünfte aktiviert, die neuesten drei davon stehen als "Neuzugänge" auf der Startseite, die anderen 4 wurden durchgereicht. Im Index sind die neuen drei. Die anderen neuen 4 fehlen komplett. Ein Lastminute-Angebot vom 19.10. fehlt auch. Bis das im Index ist, ist es wohl schon zeitlich beendet.

    Da siehste mal wieder die Datencenter-Unterschiede. Das Ergebnis bei Google war schon gestern da, der Cache auch. Datiert auf den "22. Okt. 2021 17:57:13 GMT".

    Vergiss doch mal dieses topaktuell in Bezug auf Dein Forum. So funktioniert das Internet nicht, auch keine Suchmaschinen oder Bots. Für so was gibt es notfalls RSS-Feeds oder Push-Nachrichten. Wenn es topaktuell sein soll, dann muss auch das Umfeld passen. Die Frage wäre alleine schon, warum ist das "Topaktuelle" in einem Forum, in einem Unterordner versteckt, aber auf der eigentlichen Domain ist von den topaktuellen Infos nix zu finden.

    Deine Domain fängt nicht auf der Startseite vom Forum an oder beim ersten Post eines neuen Threads, sondern auf der Startseite der Domain.

    Um was schnell in den Index zu bekommen, muss die Seite auch entsprechen oft hochwertigen neuen Inhalt liefern, am besten mehrfach täglich. Hat sie das nicht, dann kann der Content vom Inhalt her noch so aktuell sein, die Suma wird das nicht merken, weil sie schlicht nicht auf der Seite war.