Livros e desenvolvimentos em mecanismos de pesquisa

Desenvolvimentos de mecanismos de busca e IA envolvendo escrita e ilustrações de Hello Charlie.
Compartilhar:

Observação: escrevi Isso mais cedo, às 5h. Eu sou Uma pessoa matinal e não matinal. o Que significa Que estou infeliz, mas acordado. Tambémobserve que este é provavelmente um artigo de tecnologia muito chatoentão, a menos que por algum motivo estranho você esteja realmente interessado em otimizações de mecanismos de pesquisa para sites (em particularlivros de colorir para adultos,) você provavelmente desejará pular este artigo completamente. Não diga que você não foi avisado...

Atualmente, ainda estou tentando descobrir as técnicas de otimização de mecanismos de pesquisa e como elas evoluíram ao longo de 20 anos. Comecei há muito tempo codificando sites manualmente, eventualmente mudando para CMS ou sistemas de gerenciamento de conteúdo como o WordPress, simplesmente porque estava se tornando cada vez mais difícil acompanhar todas as mudanças nos padrões. No início comecei a ter muito interesse em desenvolver sites e páginas, chegando até a inventar um dos maiores sites da Internet que ainda hoje funciona. Mas rapidamente abandonei a ideia de criar sites para ganhar a vida, pois rapidamente se tornou a próxima corrida do ouro e muitas pessoas entraram nessa área.

Um dos principais benefícios de usar um CMS era que você poderia adicionar conteúdo rapidamente, como discutir novas ideias ou compartilhar imagens com outras pessoas, antes que sites como o Facebook surgissem e simplificassem o processo de postagem. Em essência, todo mundo que usa o FB hoje está usando algo semelhante a um sistema de blog ou CMS do passado, mas em vez de estar amplamente disponível ao público e pesquisável na Internet em geral, está praticamente fechado atrás de nossas próprias configurações de privacidade para o mais íntimo. de amigos e familiares.

No entanto, um blog ou CMS bem projetado e mantido ainda traz benefícios profundos. Se olharmos além do “blog” ou das notícias, cerca de 1/3 de todos os sites são agora construídos neste tipo de sistema. Já se foram a maioria dos codificadores manuais como eu, pois tendemos a usar esses sistemas devido à simplicidade. Além disso, pessoas com pouca ou nenhuma experiência em codificação manual podem, em teoria, aprender e postar conteúdo rapidamente, sem ter que se lembrar de sintaxe repetitiva (e nova).

Com este novo siteOlá Charlie, tive que aprimorar habilidades que abandonei há cerca de 12 anos. Talvez seja aqui que eu diverjo de falar sobre livros para colorir neste site e entro no lado mais técnico das coisas. Caso você esteja se perguntando por que veio aqui para comprar livros para colorir e, em vez disso, está lendo isto,Eu sugiro que você pare por aqui, a menos que esteja realmente interessado em desenvolver seu próprio site ou em como funcionam os mecanismos de pesquisa, incluindo este site.Talvez também sirva como um lembrete histórico para novatos em design de sites e script kiddies por que as coisas (ou seja, aqui está olhando para vocêOlá Charlie Google Feedburner) já existiu (eu estava lendo postagens anteriores de outras pessoas perguntando por que isso me fazia sentir velho).

Com muito mais delongas, o cenário dos mecanismos de pesquisa mudou das seguintes maneiras:

  1. Maior ênfase no desenvolvimento de diferentes tamanhos de tela, como mobile-friendly e tablets.
  2. Penalidade reduzida em relação a conteúdo duplicado na web.
  3. Peso reduzido em relação aos backlinks, também conhecidos como spam de backlink, que em termos simples significava vincular de outro site ao seu, geralmente no fórum para deixar assinaturas de sites nos comentários.
  4. Maior ênfase nos resultados de pesquisa Local. esta é reconhecidamente uma Área sobre a qual tenho muita confusão e preciso investigar mais a Fundo. Embora eu possa classificar um site localmente em Uma posição muito Alta, mecanismos como o google agora tornam mais difícil rastrear o desempenho de Um site internacionalmente. eu também costumava classificar sites nas primeiras posições em todo o mundo, mas o Google confundiu essas estatísticas. se Alguém que estiver lendo isso tiver alguma sugestão de como diferenciar os dois sem usar um serviço pago, por favor me avise.
  5. Maior dependência de padrões de esquema, que, para ser honesto, são tão confusos quanto há 8 anos. Parece que as categorias realmente não evoluíram, e o site do esquema ainda se assemelha a um casamento ilegítimo, filho estilizado do DMOZ da velha escola, acasalado com o W3C e depois geneticamente fundido com a bagunça quente de back-end da Wikipedia. Esquema é uma marcação de bastidores inserida que informa aos mecanismos de pesquisa sobre o que trata o seu site ou páginas do site, a fim de ajudá-los a categorizar melhor as coisas. Há muitos outros benefícios na marcação de esquema adequada, mas esse é um tópico longo.
  6. DMOZ. Não é mais uma coisa. Foi A coisa. Era um diretório executado por humanos que listava quem é quem em toda a web. O problema era que, mesmo antigamente, eu tentava listar seu site lá. Freqüentemente, você enviava um site e, como as categorias eram frequentemente administradas por moderadores ausentes, que muitas vezes colocavam seus próprios sites nas categorias desejadas, muito poucas pessoas permitiam a entrada. Alguns de meus sites acabaram chegando lá por encontrar meios de categorização mais obscuros, o que aumentou muito seu preço.
  7. Diretório do Google. Não tão bom quanto DMOZ e de natureza semelhante, mas também feito. Finito. Completo.
  8. IndexNow substituindo o processo antes mais confuso e computacionalmente desgastante de esperar que os bots dos mecanismos de pesquisa vasculhem aleatoriamente o seu site em busca de links.
  9. Eu disse uma ênfase maior em novos conteúdos? Bem, isso estava acontecendo há mais de uma década, quando o Google sabiamente determinou que a maioria dos sites eram simplesmente sites estáticos (imutáveis) que funcionavam como cartões de visita glorificados. À medida que as coisas evoluem, o Google determinou que daria maior peso à classificação em sites (os blogs são um excelente exemplo) que fornecem conteúdo exclusivo e novo.
  10. Raramente se fala sobre PageRank hoje em dia, mas ainda existe silenciosamente nas sombras. Os sites com PageRanks de 10 primeiros são normalmente universidades, governos e grandes corporações, como Google e IBM. Se você conseguisse que um deles lhe mostrasse algum amor de “backlink” para o seu próprio site, seria como ganhar na loteria. A grande maioria dos sites tem classificação 0. Um dos meus sites anteriores foi classificado em torno de 9 em seu pico, e meu negócio anterior provavelmente ficou em torno de 5 para se ter uma ideia. Agora, aos 5 anos, eu tinha cerca de 100 termos de pesquisa como “3D” e “Ilustrações 3D” no primeiro lugar mundial no Google. Portanto, um 5 também não era motivo de riso. Não está claro como eles ainda usam o PageRank como fator atualmente. Talvez o Google tenha descontinuado o termo e usado internamente o termo “autoridade” ou “autoritário” para enfatizar os domínios de melhor classificação ou TLD (domínio de nível superior).
  11. PR Juice ou Bleeding (veja 10 acima) muda. Antigamente, os sites vinculados ao seu forneciam mais “suco de relações públicas”, o que ainda acontece. Quanto mais sites tiverem links para você, mais alto será o seu site nos motores de busca. O inverso também aconteceria: se você vinculasse seu site a muitos outros, você “sangraria” sua classificação, fazendo com que você caísse nos motores de busca. Assim, pessoas como eu acumulavam links para sites externos, muitas vezes encapsulando URLS para outros sites com tags “nofollow” no código. Portanto, você ainda veria os links como um observador, mas de uma forma sorrateira (na verdade, por necessidade), você não estava dando aos outros tanto crédito quanto eles poderiam merecer.
  12. Nomes de domínio alternativos e preenchimento de nomes de domínio. Feito. Antigamente, você poderia, teoricamente, comprar nomes de domínio alternativos, como 'páginas de livro para colorir ponto com' e 'livros de páginas para colorir ponto com' e, em seguida, redirecionar 301 permanentemente esses domínios de volta ao seu site principal. O Google e outros mecanismos (que tenho certeza que alguns ainda fazem) usam o nome de domínio de nível superior para dar prioridade a essas palavras-chave. Neste exemplo, “colorir, livro, livros e páginas” junto com as combinações classificariam você automaticamente quase no topo desses termos de pesquisa. Bem, o Google finalmente está ficando esperto quanto a isso e não está mais dando ênfase a esses nomes de domínio alternativos. Esperamos que isso não apenas nivele o campo de jogo para outros sites, mas também libere domínios de invasores de domínio (para os quais a única maneira anterior de remover um invasor de domínio era e continua fornecendo prova de marca registrada - falarei disso mais tarde porque é claro que algo aconteceu novamente com a Amazon há alguns dias.)
  13. YouTube se tornando o segundo maior mecanismo de busca. Muitas vezes não pensamos assim. Era uma vez o YouTube que era muito divertido, quero dizer, não era propriedade do Google. O Google sendo Pac-Man, engoliu tudo e não olhou para trás. Portanto, agora não apenas pessoas como eu estão otimizando sites para mecanismos de pesquisa, mas também existem alguns ganchos no YT que alguns de nós consideram.
  14. Podcasts agora são uma coisa. É difícil lembrar uma época em que podcasts era apenas mais um termo comumente usado. “O que é um podcast?” Infelizmente, estou meio velho, suponho? O tempo voa. Os podcasts são primos mais interessantes dos blogs, sem a necessidade de gramática adequada. E digo isso porque gramática é algo que os motores de busca usam para classificar o seu site. Se estiver cheio de erros de digitação ou sintaxe inadequada, as páginas do seu site serão classificadas em uma posição inferior. Também estou tentando descobrir uma maneira de converter automaticamente as postagens atuais do blog em áudio de voz, em parte porque é nerd, mas também por questão de acessibilidade.
  15. Acessibilidade. É cada vez mais importante. Oh sim. Há muito tempo, eu estava tentando descobrir uma maneira de pessoas com dificuldades de visão conseguirem ler um site – algum tipo de leitor braille mecânico e tátil. Percebi que todo designer de site estava ignorando que era cego e havia pensado muito em como tornar as coisas mais amplamente disponíveis. Acrescente a isso o fato de que nossa população está envelhecendo e as pessoas que inventaram a Internet (pense em Al Gore) estão, para ser franco, envelhecendo. O que coloca aproximadamente 1/3 (algo que li na Internet, mas parece ótimo) de todos os usuários em uma categoria com perda visual e auditiva. Os desenvolvedores estão finalmente levando isso em consideração parcialmente por necessidade, onde não era tão urgente há 20 anos. Mecanismos como o Google (confira o Google Lighthouse) estão finalmente começando a colocar ênfase na legibilidade - itens como contraste da fonte versus contraste do fundo, tamanho da fonte, etc. no lado esquerdo da minha tela (além de ser simplesmente atencioso).
  16. Conformidade com o GDPR, especialmente na UE com uma data limite que pode ter passado há alguns dias? Essencialmente, força qualquer pessoa na UE (e nos EUA que sirva páginas para a UE) a informar os visitantes de que um site serve cookies. Ou você concorda ou discorda. Um cookie armazena essencialmente alguns dados muito básicos, como localização, de qual site você viajou para chegar até aqui, tipo de computador usado, como dispositivos móveis, tempo no site, quais páginas você visita, coisas em seu computador, como lembrar você em um site para que não precise inserir informações de login novamente, etc. Na verdade, são informações muito úteis para alguém como eu, pois tenho este novo site e quero acompanhar seu desempenho, de quais países as pessoas vêm, e o que eles estão interessados em ler. Ao recusar os cookies, ele remove todas essas informações e me deixa um pouco no escuro. Não está sendo usado para nada malicioso da minha parte. No entanto, os anunciantes consideram esta informação extremamente útil. A decisão do GDPR determinou que, ao armazenar automaticamente alguns dados no computador de um usuário final, o usuário final deve aceitar esses termos. O que, francamente, acho que a decisão é totalmente estúpida, mas semi-perspicaz. Por exemplo, apenas usando um navegador, deve ser responsabilidade do desenvolvedor do navegador informar seus usuários, seja como uma política geral, antecipadamente ou individualmente. Só digo isso porque a grande maioria das pessoas não tem ideia do que é um cookie e todos nós temos que clicar/apertar botões extras sempre que visitamos um novo site. As Smart TVs estão rastreando nossos hábitos de visualização, mas imagine se você tivesse que escolher um botão “aceitar” toda vez que folheasse um programa na Netflix? Mas ei, políticos, certo? Nem me faça começar.
  17. Ah, o que mais. IA. Recentemente, o Google anunciou em linguagem codificada que iria penalizar (ou melhor, não classificar) conteúdo que não fosse exclusivo. Na história dos sites e mecanismos de busca de jogos, um método tradicional muito antes da IA e até mesmo das GPUs era o “girador de artigos”. Eu até tentei em um blog brevemente como um experimento. O que ele faria seria recuperar automaticamente artigos de outros blogs e sites por meio de seus feeds RSS (Really Simple Syndication) e inseri-los automaticamente em seu próprio site como um “novo” artigo. Então, você estava essencialmente coletando sites e notícias de outras pessoas e divulgando-os por conta própria, reduzindo a necessidade de trabalho adicional e aumentando seu fator de preguiça em magnitudes. Sendo a questão do conteúdo duplicado e semelhante um tópico há muito discutido pelo Google, este anúncio mais recente quase parece semelhante, mas chega em um momento auspicioso. Em vez dos criadores de artigos de antigamente, as pessoas agora estão usando IA para gerar artigos completamente, quase do nada. Eu estaria mentindo ao dizer que não tentei isso em alguns lugares de meus outros blogs, mas também para ajudar a escrever descrições de livros e metadados. A diferença é que eu sempre acabo eliminando e cuidando de muito conteúdo de texto gerado pela IA, porque se você for remotamente responsável, terá que lidar com o estado atual da IA. Embora a IA seja incrível, ela simplesmente não é confiável e, se você não tomar cuidado, ela reutiliza certas palavras, confunde o conteúdo e “alucina”. Mas algumas pessoas estão usando IA para a versão moderna de conteúdo giratório que, para ser franco, tem sido consistente mesmo antes da IA. Exceto que a IA é muito, muito mais rápida. Esperançosamente, o Google está usando Bard (ou como o chamam hoje) para capturar e eliminar esses artigos fiados por IA. Está usando IA para combater a IA. Também não é a única empresa que emprega táticas semelhantes. Até a Amazon se envolveu no verão de 2023 para usar IA para ajudar a combater spam de avaliações e quem sabe o que mais eles podem ter na manga (embora, dada minha história com eles, eu esteja começando a me perguntar).
  18. RSS. RSS ouFeeds RSS, como o feed Hello Charlieé um método que muitos blogs e sites empregam automaticamente para informar outro site (ou mesmo o iTunes, por exemplo) que você escreveu ou gravou novo conteúdo. Antigamente, o RSS estava em todo lugar. Eles até fizeram parte de alguns de seus aplicativos de torrent para encontrar novos itens altamente legais! Era uma forma de canalizar e retirar do seu site toda a carne e batatas e, em seguida, empurrá-lo para algum lugar do outro lado. Isso ajudou em sua classificação. Ainda é uma coisa e muitas pessoas, por algum motivo estranho, estão recomendando desativá-lo, mas discordo. Digo isso porque estou monitorando meu Search Console no Google e ele fica procurando o feed RSS que tive que reativar. Além disso, agora configurei o blog do site Hello Charlie para também enviar notícias para o Google Notícias, que é outro compilador gigantesco de artigos de sites que ajuda na visibilidade do mecanismo de pesquisa (embora esta postagem possa ser seu primeiro teste).

 

Posso acrescentar algo a este post mais tarde, mas estou começando a sofrer (e muito possivelmente qualquer público insano que ainda esteja lendo isso) por causa da abstinência matinal de cafeína ao falar sobre todo esse jargão tecnológico. As pessoas vieram aqui provavelmente em busca de livros para colorir e, em vez disso, acabaram lendo sobre o desenvolvimento e a otimização de mecanismos de busca de sites.

Mas, como qualquer artista que sofre (ou se beneficia) de DDA ou TDAH, você pode entender que somos multifacetados e que nossos cérebros operam de maneira tangencial, recusando-se a ser rotulados (terei que procurar a etimologia de classificação agora .) Num minuto estamos em cerâmica, no próximo podem ser livros para colorir, no próximo pode ser Fortnite (que é muito tentador para conseguir uma solução, mas não me atrevo), jardinagem e assim por diante. Blá blá blá. Qual foi o objetivo deste artigo? Ah, sim, escreva um artigo e acione alguns mecanismos de pesquisa para ajudar a aumentar sua classificação para que eu possa vender maislivros para colorir. Sim, esse era o ponto.

Ei, olhe, esquilo!

Livros para colorir disponíveis