Vývoj knih a vyhledávačů

Vývoj vyhledávačů a AI zahrnující psaní a ilustrace od Hello Charlie.
Podíl:

Poznámka: Napsal jsem to dříve v 5:00. Jsem neranní, ranní člověk. Což znamená, že jsem oba nešťastní a přitom vzhůru. Takyvšimněte si prosím, toto je pravděpodobně opravdu nudný technický článekpokud se tedy z nějakého zvláštního důvodu opravdu nezajímáte o optimalizaci webových stránek pro vyhledávače (zejménaomalovánky pro dospělé,) pravděpodobně budete chtít tento článek přeskočit. Neříkejte, že jste nebyli varováni…

V těchto dnech se stále snažím zjistit techniky optimalizace pro vyhledávače a jak se vyvíjely v průběhu 20 let. Začal jsem již dávno ručně kódovat webové stránky, nakonec jsem přešel na CMS nebo systémy pro správu obsahu, jako je WordPress, jednoduše proto, že bylo stále obtížnější držet krok se všemi měnícími se standardy. Nejprve jsem se začal velmi zajímat o vývoj webových stránek a stránek, dokonce jsem zašel tak daleko, že jsem vymyslel jednu z největších webových stránek na internetu, která funguje dodnes. Ale rychle jsem odložil myšlenku navrhování webových stránek pro živobytí, protože se rychle stala další zlatou horečkou a do této oblasti vstoupilo příliš mnoho lidí.

Jednou z hlavních výhod používání CMS bylo, že jste mohli rychle přidávat obsah, například diskutovat o nových nápadech nebo sdílet obrázky s ostatními, než se objevily webové stránky jako Facebook a zjednodušily proces odesílání. V podstatě každý, kdo dnes používá FB, používá něco podobného jako blogovací systém nebo CMS z minulosti, ale místo toho, aby byl široce dostupný veřejnosti a prohledávatelný na obecném internetu, je většinou uzavřen za naším vlastním nastavením soukromí na nejintimnější přátel a rodiny.

Dobře navržené a udržované blogování nebo CMS má však stále hluboké výhody. Pokud se podíváme za „blog“ nebo zprávy, asi 1/3 všech webových stránek je nyní postavena na tomto typu systému. Dávno pryč je většina ručních kodérů, jako jsem já, protože tyto systémy obvykle používáme kvůli jednoduchosti. Také lidé s malou nebo žádnou zkušeností s ručním kódováním se mohou teoreticky rychle učit a zveřejňovat obsah, aniž by si museli pamatovat opakující se (a novou) syntaxi.

S tímto novým webemAhoj Charlie, musel jsem oprášit dovednosti, které jsem většinou opustil asi před 12 lety. Možná právě zde se odchyluji od mluvících omalovánek na tomto webu a dostávám se k techničtější stránce věci. V případě, že vás zajímá, proč jste si sem přišli pro omalovánky a místo toho čtete toto,Navrhuji, abyste se zastavili právě zde, pokud se opravdu podivně nezajímáte o vývoj svých vlastních webových stránek nebo o fungování vyhledávačů včetně těchto webových stránek.Možná to také slouží jako historická připomínka designérům webových stránek a skriptovacím dětem, proč věci (tj. tady se na vás dívámDobrý den, Charlie Google Feedburner) byla někdy věc (předtím jsem četl příspěvky od ostatních, kteří se ptali, k čemu to bylo, kvůli čemuž jsem se cítil starý.)

S mnoha dalšími povyky se prostředí vyhledávačů změnilo následujícími způsoby:

  1. Větší důraz na vývoj různých velikostí obrazovek, jako jsou vhodné pro mobily a tablety.
  2. Snížená pokuta za duplicitní obsah na webu.
  3. Snížená váha týkající se zpětných odkazů neboli spamu zpětných odkazů, což zjednodušeně řečeno znamenalo propojení z jiné webové stránky zpět na vaši vlastní, často ve fóru zanechání podpisů webových stránek v komentářích.
  4. Větší důraz na místní výsledky vyhledávání. To je jistě oblast, ve které mám spoustu zmatků a musím ji dále prozkoumat. I když mohu lokálně ohodnotit web velmi vysoko, motory jako Google nyní ztěžují sledování toho, jak si web vede v mezinárodním měřítku. Také jsem byl schopen zařadit webové stránky na přední místa po celém světě, ale Google tyto statistiky rozmazal. Pokud má někdo, kdo to čte, návrh, jak tyto dva odlišit bez použití placené služby, dejte mi prosím vědět.
  5. Větší spoléhání se na standardy schémat, což je upřímně řečeno stejně matoucí jako před 8 lety. Zdá se, že kategorie se opravdu nevyvíjely a webová stránka schémat stále připomíná nelegitimní stylizované dítě ze staré školy DMOZ ze staré školy DMOZ spárované s W3C a poté geneticky spojené s horkou kaší Wikipedie. Schéma je zákulisní označení, které zadáte a které vyhledávačům sdělí, o čem jsou vaše stránky nebo webové stránky, aby mohly lépe kategorizovat věci. Správné označení schématu má mnoho dalších výhod, ale to je na dlouhé téma.
  6. DMOZ. Už žádná věc. To byla ta věc. Byl to adresář lidských běhů, který obsahoval seznam kdo je kdo z celého webu. Problém byl v tom, že ještě v ten den se snažila dostat tam vaše webové stránky. Často jste odeslali webovou stránku, a protože kategorie byly často provozovány nepřítomnými moderátory, kteří často nacpali své vlastní weby do kategorií, které chtěli, jen velmi málo lidí skutečně umožnilo vstup. Několik mých webových stránek se tam nakonec dostalo díky nalezení obskurnějších způsobů kategorizace, což výrazně zvýšilo jejich cenu.
  7. Adresář Google. Ne tak skvělé jako DMOZ a podobné povahy, ale také hotovo. Finito. Kompletní.
  8. IndexNow nahrazuje kdysi komplikovanější a výpočetně náročný proces čekání na roboty vyhledávačů, kteří náhodně vyhledávají odkazy na vašem webu.
  9. Řekl jsem větší důraz na nový obsah? No, to se stalo před více než deseti lety, když Google dostatečně moudře určil, že většina webových stránek byly prostě statické (neměnné) stránky, které fungovaly jako oslavované vizitky. Vzhledem k tomu, že se věci vyvíjejí, Google se rozhodl, že bude klást větší váhu na hodnocení webů (ukázkovým příkladem jsou blogy), které poskytují jedinečný a čerstvý obsah.
  10. O hodnocení PageRank se v dnešní době mluví jen zřídka, ale stále tiše existuje ve stínu. Weby s nejvyšším hodnocením PageRanks 10 jsou obvykle univerzity, vlády a velké korporace, jako jsou Google a IBM. Pokud byste mohli přimět jednoho z nich, aby vám ukázal nějakou lásku ke „zpětnému odkazu“ na váš vlastní web, bylo by to jako trefit do loterie. Naprostá většina webových stránek je na 0. Jeden z mých předchozích webů byl na svém vrcholu asi 9 a moje předchozí podnikání se pravděpodobně pohybovalo kolem 5, abyste měli představu. Nyní, v 5 letech, jsem měl asi 100 hledaných výrazů, jako jsou „3D“ a „3D ilustrace“, na prvním místě na celém světě na Googlu. Takže 5 taky nebylo nic k smíchu. Je opravdu nejasné, jak v těchto dnech stále používají PageRank jako faktor. Společnost Google pravděpodobně tento výraz zavrhla a interně používá výraz „autorita“ nebo „autoritativní“, aby zdůraznil nejvyšší hodnocení domén nebo TLD (doména nejvyšší úrovně).
  11. PR Juice nebo Bleeding (viz 10 výše) se mění. Dříve platilo, že weby, které odkazovaly na ty vaše, poskytovaly více „PR šťávy“, což stále dělá. Čím více stránek na vás odkazuje, tím výše se vaše stránky objevují ve vyhledávačích. Opačná situace by nastala také v tom, že pokud byste svůj web propojili s příliš mnoha jinými, „vyčerpali“ byste své hodnocení, což by vedlo k poklesu ve vyhledávačích. Takže lidé jako já hromadili odkazy na externí weby, často zapouzdřením URL na jiné weby se značkami „nofollow“ v kódu. Takže byste stále viděli odkazy jako pozorovatel, ale záludným způsobem (skutečně z nutnosti) jste ostatním nepřipisovali tolik uznání, kolik by si jinak zasloužili.
  12. Alternativní doménová jména a nádivka doménových jmen. Hotovo. Dříve bylo možné teoreticky koupit alternativní názvy domén, jako například 'coloring-book-pages dot com' a 'coloring-page-books dot com' a poté 301 trvale přesměrovat tyto domény zpět na váš hlavní web. Google a další nástroje (což jsem si jistý, že některé stále používají) používají název domény nejvyšší úrovně pro upřednostnění těchto klíčových slov. V tomto příkladu by vás „omalovánky, kniha, knihy a stránky“ spolu s kombinacemi automaticky zařadily téměř na vrchol těchto hledaných výrazů. No, Google v tom konečně začíná být chytrý a už nedává důraz na tyto alternativní názvy domén. Doufejme, že to nejen vyrovná podmínky pro jiné webové stránky, ale také uvolní domény od doménových squatterů (k nimž jediným předchozím způsobem odstranění doménového squattera bylo a je poskytnutí důkazu o ochranné známce – k tomu se pustím později protože samozřejmě před pár dny opět něco přišlo s Amazonem.)
  13. YouTube se stává druhým největším vyhledávačem. Často o tom takhle nepřemýšlíme. Kdysi byla YouTube velmi zábavná, myslím, že nebyla vlastněna společností Google. Google je Pac-Man, zhltnul to a neohlédl se. Takže lidé jako já nyní nejen optimalizují stránky pro vyhledávače, ale v YT jsou i některé háčky, o kterých někteří z nás uvažují.
  14. Podcasty jsou teď věc. Těžko si vzpomenout na dobu, kdy podcasty byly jen dalším běžně používaným pojmem. "Co je to podcast?" Bohužel jsem asi tak starý? Čas letí. Podcasty jsou zajímavějším bratrancem blogů, aniž by potřebovaly správnou gramatiku. A říkám to proto, že gramatika je něco, co vyhledávače používají k hodnocení vašeho webu. Pokud bude obsahovat překlepy nebo špatnou syntaxi, bude vaše webové stránky hodnotit níže. Snažím se také vymyslet způsob, jak převést aktuální příspěvky na blogu automaticky na hlasový zvuk, částečně proto, že je to praštěné, ale také kvůli usnadnění.
  15. Přístupnost. Je to stále důležitější. Ach ano. Před životem jsem se snažil přijít na způsob, jak by lidé se zrakovými potížemi mohli číst webovou stránku – nějaký druh dotykové mechanické čtečky Braillova písma. Uvědomil jsem si, že každý návrhář webových stránek ignoroval, že je slepý, a dlouho a usilovně přemýšlel o tom, jak věci zpřístupnit širším vrstvám. Přidejte k tomu, že naše populace stárne a lidé, kteří vynalezli internet (myslím Al Gore), musí být upřímní, stárnou. Což řadí přibližně 1/3 (něco, co jsem četl na internetu, ale zní to skvěle) všech uživatelů do kategorie se ztrátou zraku a sluchu. Vývojáři to nyní konečně berou v úvahu částečně z nutnosti, kde to před 20 lety nebylo tak naléhavé. Motory jako Google (podívejte se na Google Lighthouse) konečně začínají klást důraz na čitelnost – položky jako kontrast písma versus kontrast pozadí, velikost písma atd. A začíná se u těchto položek hodnotit, což je částečně důvod, proč mám ikonu usnadnění na levé straně mé obrazovky (kromě toho, že jsem prostě ohleduplný.)
  16. Soulad s GDPR, zejména v EU s konečným datem, které mohlo uplynout před několika dny? V podstatě nutí kohokoli v EU (a USA poskytující stránky do EU), aby informovali návštěvníky, že webová stránka poskytuje soubory cookie. Buď souhlasíte, nebo nesouhlasíte. Soubor cookie v podstatě ukládá některé velmi základní údaje, jako je poloha, ze kterých webových stránek jste mohli cestovat, abyste se sem dostali, typ používaného počítače, jako jsou mobilní zařízení, čas na webu, které stránky navštěvujete, věci ve vašem počítači, jako je zapamatování si jste na webu, takže nemusíte znovu zadávat přihlašovací údaje atd. Je to vlastně velmi užitečná informace pro někoho, jako jsem já, protože mám tento nový web a chci sledovat, jak dobře funguje, ze kterých zemí lidé přicházejí, a co je zajímá číst. Odmítnutím souborů cookie odstraní všechny tyto informace a nechá mě poněkud v nevědomosti. Není to používáno k ničemu škodlivému na mě. Inzerenti však tyto informace považují za velmi užitečné. Rozhodnutí GDPR stanovilo, že automatickým ukládáním některých dat do počítače koncového uživatele musí koncový uživatel přijmout tyto podmínky. Což si upřímně myslím, že rozsudek je naprosto hloupý, ale napůl prozíravý. Například pouze při používání prohlížeče by mělo být povinností vývojáře prohlížeče, aby byl tím, kdo bude informovat své uživatele buď předem, nebo individuálně. Říkám to jen proto, že naprostá většina lidí nemá ponětí, co je cookie, a my všichni musíme klikat/mashovat další tlačítka pokaždé, když navštívíme nový web. Chytré televizory sledují naše zvyky při sledování, ale představte si, že byste museli zvolit tlačítko „přijmout“ pokaždé, když listujete pořadem na Netflixu? Ale co, politici, že? Ani mě nenuťte začít.
  17. Ach co ještě. AI. Nedávno Google v kódovaném jazyce oznámil, že bude penalizovat (nebo spíše nebude hodnotit) obsah, který není jedinečný. V historii webových stránek a herních vyhledávačů byla jednou z tradičních metod dávno před umělou inteligencí a dokonce i grafickými procesory „přehrávač článků“. Zkoušel jsem to i na blogu krátce jako experiment. Udělalo by to automatické načítání článků z jiných blogů a webů prostřednictvím jejich kanálů RSS (Really Simple Syndication) a automaticky je vložilo na váš vlastní web jako „nový“ článek. Takže jste v podstatě shromažďovali webové stránky a zprávy jiných lidí a prosazovali je sami, čímž jste snížili nutnost další práce a zvyšovali svůj faktor lenosti o mnoho. Otázka duplicitního a podobného obsahu je tématem, o kterém Google dlouho diskutuje, toto novější oznámení zní téměř podobně, ale přichází v příznivou dobu. Namísto dřívějších točených článků nyní lidé používají AI k úplnému generování článků téměř z ničeho. Lhal bych, kdybych řekl, že jsem to na několika místech svých jiných blogů nezkusil, ale dokonce i proto, abych pomohl při psaní popisů knih a metadat. Rozdíl je v tom, že vždy skončím tak, že spoustu textového obsahu generovaného umělou inteligencí odstraním a hlídám děti, protože pokud jste poněkud vzdáleně zodpovědní, musíte sledovat aktuální stav umělé inteligence. I když je umělá inteligence úžasná, je prostě nespolehlivá, a pokud si nedáte pozor, znovu používá určitá slova, zamíchá obsah a „halucinuje“. Někteří lidé však používají AI pro moderní verzi spřádání obsahu, která, abych byla upřímná, byla konzistentní ještě před AI. Až na to, že AI je mnohem, mnohem rychlejší. Google doufejme používá Barda (nebo jak to dnes nazývají) k zachycení a zabití těchto článků AI. Používá AI k boji proti AI. Není to také jediná společnost, která používá podobnou taktiku. Dokonce i Amazon se zapojil v létě 2023, aby použil AI k boji proti recenznímu spamu a kdo ví, co by ještě mohl mít v rukávu (i když vzhledem k mé historii s nimi začínám být zvědavý.)
  18. RSS. RSS neboInformační kanály RSS, jako je například kanál Hello Charlieje metoda, kterou mnoho blogů a webů automaticky používá k informování jiného webu (nebo například iTunes), že jste napsali nebo nahráli nový obsah. Tenkrát bylo RSS všude kolem. Byly dokonce součástí některých vašich aplikací pro torrentování, aby našli nové vysoce legální věci! Byl to způsob, jak napojit a zbavit svůj web všeho masa a brambor a pak ho vytlačit někam na druhou stranu. To vám pomohlo ve vašem žebříčku. Je to stále věc a mnoho lidí z nějakého zvláštního důvodu doporučuje ji zakázat, ale já nesouhlasím. Říkám to, protože sleduji svou službu Search Console na Googlu a neustále hledá RSS kanál, který jsem musel znovu povolit. Také jsem nyní založil blog na webu Hello Charlie, abych také zasílal novinky do Zpráv Google, což je další gigantický srovnávač článků na webových stránkách, který pomáhá zviditelnit vyhledávač (ačkoli tento příspěvek může být úplně prvním testem.)

 

Možná k tomuto příspěvku přidám později, ale začínám trpět (a dost možná ať to ještě čte ať to šílené publikum čte) tím, že se o všem tom technologickém žargonu brzy ráno stáhne kofein. Lidé sem pravděpodobně přišli hledat omalovánky a místo toho si četli o vývoji a optimalizaci webových vyhledávačů.

Ale jako každý umělec, který trpí (nebo má prospěch) z ADD nebo ADHD, možná pochopíte, že jsme mnohotvární a naše mozky fungují tangenciálním způsobem a odmítáme se nechat zaškatulkovat (teď budu muset vyhledat etymologii zaškatulkování .) Jednu minutu jsme u keramiky, další to mohou být omalovánky, další může být Fortnite (což je velmi lákavé na opravu, ale netroufám si), zahradničení a tak dále a tak dále. Bla bla bla. Co bylo smyslem tohoto článku? Ach jo – napište článek a spusťte některé vyhledávače, které pomohou zvýšit jeho hodnocení, takže snad budu moci prodávat víceomalovánky. Ano, o to šlo.

Hej, podívej, veverko!

Dostupné omalovánky