Některé updaty jen projdou kolem, jiné zcela mění pravidla SEO. Nasazení významových vektorů patřila k těm druhým. Seznam se v ten moment mnohem více přiblížil chápání významu v intencích sémantického vyhledávání.
Seznam implementoval největší změnu do vyhledávání za posledních deset let. Jde o hledání pomocí významových vektorů. Díky vektorové reprezentaci slov by tak měl najít i odpověď i na těch webech, na nichž konkrétní slova z vyhledávacího dotazu chybí. Co všechno významové vektory ovlivní?
„počítač vidí slova tak, že si nejdříve spočítá slovník a každé slovo se převede na číslo, což je pozice v tom slovníku. Tím pádem je věta zakódovaná jako sekvence čísel a každé slovo je vlastně unikátní. Stačí udělat jeden překlep a počítač slovo vidí jako naprosto jiné slovo…
Pokud jsou slova podobná, tak to tento slovníkový přístup nedokáže zohlednit a systém si zpětně musí dohledat, že třeba „český“ a „česká“ jsou si podobná slova a že by se tam měly sdílet parametry.“
„dotaz od uživatele jsme opravili, analyzovali a přidali k němu další slova, která by mohla pomoci najít to, co uživatel hledal. Takovými slovy mohly být skloňované tvary zadaných slov, synonyma, rozvinuté zkratky apod. Tato slova jsme pak hledali v zaindexovaných webových stránkách, nalezené stránky řadili a předkládali uživatelům.
Vždy tedy zatím bylo potřeba na webové stránce (nebo ve zpětných odkazech) najít nějaký textový ekvivalent toho, co uživatel napsal do dotazu.“
Vyhledávání Seznamu se takto dostalo do úzkých, kdy na něj uživatelé zkoušeli mluvit přirozeným jazykem – nebo když použili příliš mnoho slov v dotazu. Vyhledávač se pak marně snažil vyhledat odpověď, která by obsahovala všechna slova dotazu – a to i ta, která se vyskytují jen v přirozeném jazyce, nikoliv však v odpovědích na ně.
jméno klavíristka jirečková – Záměr uživatele je zřejmý, chtěl znát křestní jméno klavíristky (asi do křížovky), jenže na stránkách, kde se o Noemi Jirečkové píše, přirozeně chybí slovo ‚jméno‘.
Jak se nazýval dokument z roku 1212, který mj. zaručoval českým panovníkům dědičný královský titul? – Taková otázka se možná hodí do písemky nebo AZ-kvízu, ale nalezení wikipedické stránky Zlatá bula sicilská brání to, že na ní nenajdeme nic jako ‚nazýval‘, ‚mj.‘ ani ‚zaručoval‘.
Ani předlouhé otázky by Seznam.cz už neměl odbývat lakonickým Bohužel jsem nic nenašel.
V čem spočívá implementace významových vektorů?
Implementaci významových vektorů trochu popisuje Pomikálková kapku nespecificky:
Ke stávajícím výsledkům jsme přidali vyhledávání pomocí významových vektorů. Z dotazů i webových stránek vyrábíme sadu vektorů, které reprezentují, co daný kus textu znamená. Vektory počítáme embeddingovým modelem, který je naučený přiřazovat podobné vektory textům, které se obvykle vyskytují v podobných kontextech. K vektorům dotazu pak hledáme nejpodobnější vektory stránek v mnohorozměrném vektorovém prostoru.
To ovšem neodpovídá na zásadní otázku:
Co je významový vektor?
Významový vektor se liší od diskrétního slovníkového slova s přesně vymezenou pozicí v rámci slovníku. Jde o spojitý vektor, jehož orientace je schopna vyjádřit, že slova dobrý, skvělý a vynikající mají stejnou významovou orientaci. Že patří téhož významového vektoru.
A vektorová reprezentace slov nestaví jen na jednoduchých vektorech, jako je ten uvedený v příkladu. Je schopna navektorovat i celý kus textu dotazu a stejně tak do těchto vektorů dosadit z naindexovaných výsledků. Těch tak masivně přibude a opět se ukáže důležitost rankingu – algoritmu, který upřednostňuje odpovědi relevantní dotazu.
Co významové vektory udělají s vyhledáváním a řazením výsledků?
Díky vektorové reprezentaci dotazu bude vyhledávání Seznamu schopno poskytnout celou řadu výsledků i tam, kde dříve jen konstatoval Bohužel jsem nic nenašel. To dokládají i slova Pomikálkové: Navenek se změna projeví tím, že teď pro téměř každý dotaz vydáme SERP plný výsledků. I pro hodně těžké a nesmyslné dotazy… V první řadě řešíme, aby uživatel i na těžké dotazy našel, co hledal. Až později budeme chtít omezit to, co nehledal.
Významové vektory ovšem neovlivní jen množství odpovědí na dotaz, ale i jejich řazení. Podobnost významových vektorů je současně důležitým signálem pro řazení výsledků. Vedle nalezení nových stránek tak dojde i ke změnám pozic těch stávajících, upřesňuje Pomikálková.
Aby nebylo srandy dost, ani tým Vyhledávání Seznamu netuší, s čím vším významové vektory zamíchají: Po této změně je i pro nás vyhledávání zase o krok větším blackboxem. Bude teď ještě těžší přijít na to, proč se která webová stránka ve vyhledávání objevila nebo neobjevila. Všechna měření před nasazením však slibují takové zlepšení přirozeného hledání, že nám to stojí za to.
Expert na výkonově orientované SEO, Local Business SEO, datový a technický copywriting a budování brandu.
Mám za sebou tvrdou školu vlastního retailu, roky v online byznysu a dvě magisterská studia: psychologie a žurnalistiky.
Vím, co zákazník řeší váhaje nad peněženkou, a umím to přetavit v pozice a texty, které konvertují. Žádné teoretické poučky, ale postupy vybojované přímo v zákopech trhu.
Żywy dokument, uzupełniany stopniowo i zwięźle… Digital Identity Optimization (DIO) to dyscyplina koncentrująca się na zarządzaniu i optymalizacji tożsamości cyfrowej. Jej celem jest zapewnienie, by…
WP-Hosting, silně zaměřený na WordPress, nově nabízí webservery LiteSpeed zdarma přímo v rámci svých tarifů - a to OpenLiteSpeed pro sdílený wehosting a LiteSpeed Enterprise…
Seznam Lištička asi neuzajme omladinu a internetově zběhlé - nicméně dobře poslouží seniorům, anglofobům i těm, kteří stejně nejdříve míří na Seznam, jeho Email a…
Google testuje novou osobní vizitku, zatím jen obecně komunitou označovanou Add me to search. Objeví se při vyhledávání jména osoba přímo ve vyhledávání na Googlu…
Un documento vivo, aggiornato gradualmente e in modo conciso… La Digital Identity Optimization (DIO) è una disciplina incentrata sulla gestione e l’ottimizzazione dell’identità digitale. Il…
Freelancer Daniel Beránek, specialista na SEO a copywriting, oznamuje implementaci nejnovějších technologií umělé inteligence a velkých jazykových modelů do svých služeb.
V oboru, kde zákazník hledá pomoc v nouzi a rozhoduje se během minut, je viditelnost ve vyhledávačích kritická. Cílem projektu bylo obnovit důvěru vyhledávačů, vrátit…
एक जीवंत दस्तावेज़, जिसे धीरे-धीरे और संक्षेप में अद्यतित किया जा रहा है… Digital Identity Optimization (DIO) एक ऐसा अनुशासन (discipline) है जो डिजिटल पहचान…
Konverze a její problémy. Řešení v podobě okamžité dostupnosti 24/7, personalizované asistence, porozumění záměru a konzistentní komunikace. Mechanismy zvyšování konverzí a strategie maximalizace konverzí +…
Kliknete na odkaz a čekáte... a čekáte... pakárna, co? A web ztrácí návštěvníky, konverze, padají mu pozice na spirále vedoucí ke zkáze. A přitom rychlost…
Technické uložení nebo přístup je nezbytně nutný pro legitimní účel umožnění použití konkrétní služby, kterou si odběratel nebo uživatel výslovně vyžádal, nebo pouze za účelem provedení přenosu sdělení prostřednictvím sítě elektronických komunikací.
PředvolbyPředvolby
Technické uložení nebo přístup je nezbytný pro legitimní účel ukládání preferencí, které nejsou požadovány odběratelem nebo uživatelem.
StatistikyStatistiky
Technické uložení nebo přístup, který se používá výhradně pro statistické účely.Technické uložení nebo přístup, který se používá výhradně pro anonymní statistické účely. Bez předvolání, dobrovolného plnění ze strany vašeho Poskytovatele internetových služeb nebo dalších záznamů od třetí strany nelze informace, uložené nebo získané pouze pro tento účel, obvykle použít k vaší identifikaci.
MarketingMarketing
Technické uložení nebo přístup je nutný k vytvoření uživatelských profilů za účelem zasílání reklamy nebo sledování uživatele na webových stránkách nebo několika webových stránkách pro podobné marketingové účely.