Preskočiť na obsah
4.6Expert9 min

X (Twitter) algoritmus: Čo prezrádza open-source kód

Blck Alpaca
Zhrnúť pomocou AIChatGPTClaudePerplexity

Otvorí chat s pripraveným promptom.

Definition

Twitter algoritmus (dnes X) rozhoduje o For You timeline v štyroch krokoch: pozbierať kandidátov, hrubo ich predtriediť, ohodnotiť neurónovým heavy rankerom a nakoniec premiešať. X zverejnil tento kód v roku 2023 na GitHube spolu s tabuľkou váh, v ktorej odpovede a konverzácie vážia násobok lajku a negatívne signály ako nahlásenia prevážia všetko ostatné.

Key Takeaways

  • X 31. marca 2023 zverejnil zdrojový kód For You timeline v dvoch GitHub repozitároch a je tak jedinou veľkou platformou, ktorej ranking logika sa dá prečítať, nie iba interpretovať.
  • Podľa engineering blogu z roku 2023 vyberá For You na každú požiadavku približne 1 500 kandidátov zo zásobníka stoviek miliónov príspevkov, zhruba po polovici z vlastnej siete a spoza nej.
  • V zverejnenej tabuľke váh má odpoveď hodnotu 13,5, teda 27-násobok lajku (0,5), a odpoveď, na ktorú zareaguje sám autor, dokonca hodnotu 75,0, teda 150-násobok.
  • Negatívne signály dominujú celému výpočtu: nahlásenie stojí v kóde s -369,0, negatívna spätná väzba s -74,0, obe hodnoty ležia ďaleko nad každou kladnou váhou tabuľky.
  • Premium boost je v kóde z roku 2023 doložený (multiplikátor 4,0 vo vlastnej sieti, 2,0 mimo nej, len na originálne príspevky), penalizácia odkazov a okno 30 až 60 minút doložené nie sú.
  • Hlavná vetva dostala v septembri 2025 veľký update s Grok komponentmi na kategorizáciu, filtrovanie a slop score a s novým scorerom Phoenix, novú tabuľku váh však nie.
  • Pre plánovanie dosahu je otvorený kód modelom, nie živým obrazom: váhy majú stav apríl 2023 a README samo upozorňuje, že sa dajú kedykoľvek upraviť.

Jediná platforma, ktorej ranking sa dá prečítať

31. marca 2023 zverejnil X zdrojový kód For You timeline v dvoch GitHub repozitároch. Odvtedy sa dajú ranking pravidlá presne jednej veľkej sociálnej platformy čítať v origináli. Instagram, TikTok, LinkedIn a YouTube dodávajú vyjadrenia, blogové príspevky a občas architektonické papers, konkrétne váhy zostávajú interné. Pri X stáli ako čísla v súbore.

To robí kód cenným, ale len vtedy, ak rozlíšite dve veci: čo v repozitári naozaj stojí a čo sa v rokoch potom navyše tvrdilo. Dobrá časť populárnych tipov na dosah na X tam nie je. Ako odporúčacie systémy principiálne pracujú (candidate generation, light ranking, heavy ranking, re-ranking), opisuje Odporúčací algoritmus: Ako radia algoritmy sociálnych sietí. Tu ide o doložené detaily jedného konkrétneho systému.

Jedna výhrada hneď na úvod: zverejnená tabuľka váh má stav apríl 2023, príslušný ML repozitár sa odvtedy nemenil. Hlavná vetva naproti tomu dostala v septembri 2025 veľký update. Otvorený kód je tak modelom systému, nie živým obrazom. Stav tohto článku: august 2026.

Twitter algoritmus: Ako For You spraví z miliónov príspevkov 1 500

Podľa engineering blogu z roku 2023 vyberie X na každú požiadavku približne 1 500 kandidátov zo zásobníka stoviek miliónov príspevkov a hodnotí ich neurónovou sieťou s približne 48 miliónmi parametrov, ktorá sa priebežne dotrénováva na interakciách s príspevkami. Zhruba polovica doručeného obsahu pochádzala vtedy z vlastnej siete, druhá polovica spoza nej. V repozitári sa ranking komponent volá heavy-ranker.

Kandidáti pochádzajú z viacerých zdrojov, ktoré pomenúva README hlavného repozitára:

  • search-index: nájde a zoradí príspevky z vlastnej siete, podľa README približne 50 percent doručeného obsahu.
  • tweet-mixer: zbiera out-of-network kandidátov, teda obsah z účtov, ktoré používateľ nesleduje.
  • UTEG na GraphJete: prechádza graf interakcií, ťahá teda príspevky, s ktorými interagovali ľudia, s ktorými interagujete vy.
  • SimClusters a TwHIN: rozpoznávanie komunít cez riedke embeddingy, respektíve husté embeddingy znalostného grafu pre používateľov a príspevky. Oboje priraďuje účty a obsah do záujmových klastrov, úplne bez vzťahu sledovania.

README okrem toho uvádza komponenty, ktoré nastupujú až po hľadaní kandidátov: real-graph predikuje, ako pravdepodobne bude používateľ interagovať s určitým iným používateľom, trust-and-safety-models dodávajú filtre viditeľnosti a heavy-ranker na konci ohodnotí všetko, čo prejde.

Toto rozdelenie rozhoduje o dosahu viac než ktorákoľvek váha v rankingu. Príspevok, ktorý sa nedostane do žiadneho zoznamu kandidátov, nikto nikdy neohodnotí. Kto píše len do vlastnej siete, hrá o polovicu dostupných doručení, druhá polovica beží cez embeddingy a prechádzanie grafu.

Pre prax z toho vyplývajú dve veci. Po prvé, zdroje postavené na embeddingoch sú odkázané na zaraditeľnosť: SimClusters a TwHIN dokážu účet priradiť do záujmového klastra len vtedy, ak je jeho obsah tematicky rozpoznateľný. Profil, ktorého príspevky obsahovo lietajú, dodáva týmto zdrojom rozmazaný signál. Po druhé, graf interakcií je cez UTEG samostatný zdroj kandidátov. Odpovede tak pôsobia dvakrát: ako vysoko vážený signál v rankingu a ako hrana v grafe, cez ktorú sa vaše neskoršie príspevky vôbec dostanú do cudzích timeline.

Váš počet followerov je preto horným ohraničením časti doručenia, nie distribučným zoznamom. Ako orientačné pravidlo pre plánovanie: distribúcia sa posúva od otázky, koho niekto sleduje, k otázke, čo zaujíma používateľov s podobným správaním. Každý príspevok sa prakticky nanovo testuje proti celému zásobníku.

Váhy: odpovede porážajú lajky faktorom 27

Najzaujímavejšia časť stojí v README ML repozitára, stav apríl 2023: v tabuľke váh heavy rankera má odpoveď hodnotu 13,5 a lajk 0,5. Skóre príspevku je tam vážený súčet predikovaných pravdepodobností interakcie. Model pri každom kandidátovi odhaduje, aká pravdepodobná je ktorá akcia, a tieto pravdepodobnosti násobí pevnými faktormi.

Signál (názov v kóde)

Váha

Faktor oproti lajku

report

-369,0

738-násobne negatívne

reply_engaged_by_author

75,0

150-násobok

negative_feedback_v2

-74,0

148-násobne negatívne

reply

13,5

27-násobok

good_profile_click

12,0

24-násobok

good_click

11,0

22-násobok

good_click_v2

10,0

20-násobok

retweet

1,0

2-násobok

fav (lajk)

0,5

1-násobok

video_playback50

0,005

0,01-násobok

Tri veci na tom zaujmú. Po prvé, konverzácia vyhráva nad konzumáciou, a to výrazne. Najvyššiu kladnú váhu nesie reply_engaged_by_author: odpoveď, na ktorú pôvodný autor zase zareaguje. Modeluje sa tým pravdepodobnosť dialógu. Špičková hodnota tabuľky teda visí na správaní samotného autora a kto odpovedá na odpovede, vytvára najdrahší signál celého zoznamu.

Po druhé, negatívne signály sú najdrahšou položkou celého výpočtu. Nahlásenie stojí v tabuľke s -369,0, negatívna spätná väzba s -74,0, obe hodnoty ležia ďaleko nad každou kladnou váhou. Kto vedome vyhrocuje, zvyšuje naraz dve predikcie: tú na odpovede aj tú na negatívne reakcie. O výsledku rozhoduje, ktorú z nich model pre konkrétne publikum nastaví vyššie.

Po tretie, video bolo v roku 2023 v rankingu prakticky bezvýznamné: video_playback50 stojí na 0,005. Či to platí aj dnes, doložiť nemožno, pretože tabuľka sa po apríli 2023 už neaktualizovala. README samo uvádza, že presné váhy sa dajú kedykoľvek upraviť. Tabuľka tak opisuje stav, ktorý X už tri roky nepotvrdil.

To, že interakčné signály vôbec pôsobia ako ranking faktor, mimochodom nie je špecifikum sociálnych sietí. Vo webovom vyhľadávaní je s NavBoostom potvrdený porovnateľný systém.

Čo v kóde stojí a čo sa iba tvrdí

Okolo X algoritmu sa vinú pravidlá, ktoré znejú ako vyčítané z kódu a v kóde sa nenachádzajú. Kontrola dopadá zmiešane.

Rozšírené tvrdenie

Doložené v kóde z roku 2023?

Čo sa dá preukázať

Odpovede vážia oveľa viac než lajky

Áno

reply 13,5 oproti fav 0,5

X Premium prináša boost dosahu

Áno

multiplikátor 4,0 vo vlastnej sieti, 2,0 mimo nej, len na originálne príspevky

Externé odkazy sú penalizované

Nie

v kóde existuje len zoznam parametrov pre URL konkurencie, žiadna penalizácia odkazov

Rozhoduje prvých 30 až 60 minút

Nie

také časové okno sa v kóde nevyskytuje

Premium boost je najjasnejšie doložený bod: multiplikátor 4,0 pre overených autorov vo vlastnej sieti a 2,0 mimo nej stojí v kóde ako parameter, aplikovaný výlučne na originálne príspevky, nie na odpovede. V prepracovanej hlavnej vetve zo septembra 2025 tento parameter pod týmto názvom už neexistuje.

Pri odkazoch je situácia iná, než tvrdí väčšina príručiek. To, že príspevky s externým odkazom dostanú menší dosah, sa hlási zoširoka a komunikuje to aj samotná platforma, v zverejnenom kóde to nestojí. Rovnako sa tam nenájde golden hour s pevnými prahmi. Cold start test na malých publikách existuje pri všetkých odporúčacích systémoch, kolportované pevné hraničné hodnoty patria k folklóru. Ako sa dá odlíšiť skutočné zníženie dosahu od bežného cold start rozptylu, stojí v Čo je shadowban? Link penalty, cold start a mýty.

Kód z roku 2025: Grok, Phoenix a slop score

Dňa 3. septembra 2025 pristál v hlavnom repozitári commit s vyše 65 000 pridanými riadkami. Prináša celý rad komponentov postavených na Groku do home-mixera a tweet-mixera.

  • Kategorizácia: GrokAnnotationsFeatureHydrator, UserEngagedGrokCategoriesFeatureHydrator a GrokTopics priraďujú príspevky aj pozorovaný engagement používateľov do Grok kategórií.
  • Zdroj kandidátov: PopGrokTopicTweetsCandidateSource ťahá kandidátov pozdĺž týchto tém.
  • Filtrovanie: GrokSpamFilter, GrokNsfwFilter, GrokGoreFilter a GrokViolentFilter vyraďujú obsah ešte pred rankingom.
  • Tlmenie kvality: GrokSlopScoreRescorer s vlastným decay parametrom znižuje skóre obsahu, ktorý je klasifikovaný ako masový tovar.
  • Nový scorer: model označený ako Phoenix s vlastným aktivačným parametrom.

SimClusters sú v kóde naďalej, okrem iného pri boostovaní studených príspevkov v content exploration. Rozšírené tvrdenie, že priraďovanie do klastrov prevzal jazykový model, sa tým podoprieť nedá. Doložené je niečo iné a operatívne relevantnejšie: medzi príspevkom a rankingom teraz sedí strojové posúdenie kvality a témy. Generické sériové príspevky sú teda klasifikované skôr, než začnú súťažiť o pozornosť.

Slop score je pritom časť s najnepríjemnejšími vedľajšími účinkami na plánovanie. Je postavený ako rescorer, nastupuje teda po candidate generation a tlmí skóre namiesto toho, aby príspevok odstránil. Výsledok vyzerá zvonku ako technická chyba: príspevok je dostupný, analytika ukazuje impresie, distribúcia napriek tomu zostáva plochá. Keďže klasifikácia sedí v modeli a nie v pravidle, neexistuje na ňu ani upozornenie, ani overiteľné zdôvodnenie.

Ako skúsenosť z praxe pre zaobchádzanie s tým: sériové formáty so zameniteľnou stavbou, automaticky generované varianty toho istého príspevku a vlákna, ktoré vytvárajú iba objem, pracujú presne proti tejto klasifikácii. Ako silno sú Grok komponenty vážené v produkcii, z kódu nevyplýva, nová tabuľka váh zverejnená nebola.

Čo sa z toho dá preniesť na iné platformy

X sa hodí ako referenčný model, pretože sa tu dá doložiť to, čo je inde iba pravdepodobné. Preniesť sa dajú tri vzorce.

  • Vážená úžitková funkcia: ranking je súčtom vážených predikcií, nie jediným faktorom. Paper „Choosing the Right Weights“ na arXiv od Milli, Piersona a Garga berie presne tieto zverejnené Twitter váhy ako východiskový príklad a skúma dôsledky empiricky na približne 70 miliónoch Facebook URL. Každá veľká platforma pracuje podľa tohto princípu, len bez zverejnených čísel.
  • Negatívne signály: pri X sú vyčíslené. Pri Instagrame, TikToku a LinkedIne je štruktúra porovnateľná, pretože sa nasadzuje rovnaký druh modelu, ktorý predikuje pozitívne aj negatívne reakcie používateľov spoločne. Ktoré signály tam vstupujú s akou váhou, verejné nie je.
  • Konverzačné signály: odpovede, preposlania a saves sa vytvárajú ťažšie než lajky, a preto majú vyššiu výpovednú hodnotu.

A jedna hranica, ktorú netreba obchádzať: kód zverejnil iba X. Všetko, čo koluje ako váženie pre Instagram, TikTok, LinkedIn alebo YouTube, je vyjadrenie platformy alebo sekundárna analýza. Kto prenesie čísla z X jedna k jednej na Instagram, počíta s vymyslenými hodnotami.

Realistické očakávanie od engagementu na X

Benchmarky pre X ležia ďaleko od seba, podľa vzťažnej veličiny. Hootsuite uvádza k 17. júnu 2026 naprieč odvetviami a globálne engagement rate 1,8 % pre X, meranú ako interakcie na príspevok delené followermi, oproti 3,5 % na Instagrame, 3,4 % na LinkedIne, 1,5 % na TikToku a 1,3 % na Facebooku. Štúdia Metricool o X z roku 2024 dospela na medzinárodnej vzorke podľa veľkosti účtu k 1,3 % až 2,21 %. Socialinsider vykazuje vo svojich medzinárodných benchmarkoch pre rok 2026 na báze followerov 0,10 % od štvrtého kvartálu 2025. Hodnoty špecifické pre DACH pre X k dispozícii nie sú.

Tieto hodnoty sú priemery z rôzne zložených vzoriek s rôznymi vzorcami, nie výroky o príčine a následku. Na stanovenie cieľov sú príliš hrubé, na kontrolu vierohodnosti stačia: kto pre X hlási hodnoty výrazne nad týmto rozpätím, meria pravdepodobne voči reachu namiesto voči followerom. Ako si postavíte nosnú vlastnú baseline, stojí v Čo je dobrá engagement rate? Social media benchmarky 2026.

Čo zverejnenie kódu nedodáva

Otvorený kód odpovedá na otázku štruktúry. Ukazuje, ktoré signály odporúčací systém vôbec hodnotí, v akom poradí vznikajú kandidáti a ako ťažko váži negatívna spätná väzba. Otázka prevádzky zostáva otvorená: neukazuje, s akými váhami beží For You timeline dnes, ako silno zasahujú Grok komponenty v produkcii a či Premium boost pretrváva v inej podobe. Presne v tejto medzere vzniká väčšina príručkovej literatúry o X. Držať sa doložiteľného stojí pár pohodlných istôt a pre X aj tak zostáva viac tvrdej substancie než pre ktorúkoľvek inú platformu.

Údaje a štatistiky

For You zieht pro Anfrage rund 1.500 Kandidaten aus einem Pool von hunderten Millionen Posts, etwa je zur Hälfte In-Network und Out-of-Network; das Ranking-Modell hat rund 48 Millionen Parameter.

X/Twitter Engineering Blog, "Twitter's Recommendation Algorithm" (31. März 2023), Archivfassung (2023)

Komponenten laut README (Kandidatenquellen, Modelle, Filter): search-index (rund 50 Prozent der Posts, In-Network), tweet-mixer (Out-of-Network), UTEG auf GraphJet, SimClusters, TwHIN, real-graph (Vorhersage der Nutzer-Nutzer-Interaktion), trust-and-safety-models (Sichtbarkeitsfilter), heavy-ranker (Ranking-Modell).

X/Twitter the-algorithm, GitHub-README (2023)

Heavy-Ranker-Gewichte (Stand April 2023): report -369,0; reply_engaged_by_author 75,0; negative_feedback_v2 -74,0; reply 13,5; good_profile_click 12,0; good_click 11,0; good_click_v2 10,0; retweet 1,0; fav 0,5; video_playback50 0,005.

X/Twitter the-algorithm-ml, Heavy-Ranker-README (2023)

Premium-Boost im Code-Stand 2023: Multiplikator 4,0 für verifizierte Autoren In-Network und 2,0 Out-of-Network, nur auf Original-Posts angewendet.

X/Twitter the-algorithm, ScoredTweetsParam.scala (2023)

Commit vom 3. September 2025 mit über 65.000 hinzugefügten Zeilen bringt Grok-Komponenten (Annotations, Topics, Spam-/NSFW-Filter, Slop-Score-Rescorer) und einen Phoenix-Scorer in home-mixer und tweet-mixer.

X the-algorithm, Commit "update for-you recommendations code" (2025)

X veröffentlichte am 31. März 2023 zwei Repositories mit dem Code der For-You-Empfehlung; das ML-Repository wurde zuletzt am 5. April 2023 geändert.

X Blog, "A new era of transparency for Twitter" (2023)

Das Paper "Choosing the Right Weights" nutzt die offengelegten Twitter-Gewichte als Ausgangsbeispiel und untersucht lineare Engagement-Gewichtung empirisch an rund 70 Millionen Facebook-URLs.

arXiv 2305.17428, Milli, Pierson, Garg (2023)

Durchschnittliche Engagement-Rate auf Follower-Basis, branchenübergreifend und global: X 1,8 %, Instagram 3,5 %, LinkedIn 3,4 %, TikTok 1,5 %, Facebook 1,3 %.

Hootsuite, Average Engagement Rate (Stand 17. Juni 2026) (2026)

X-Engagement-Rate je nach Accountgröße 1,3 % bis 2,21 % (internationale Stichprobe).

Metricool X-Studie 2024 (2024)

X-Engagement-Rate auf Follower-Basis 0,10 % seit dem vierten Quartal 2025 (internationale Stichprobe).

Socialinsider, Social Media Benchmarks 2026 (2026)

Často kladené otázky

Je Twitter algoritmus naozaj open source?
Čiastočne. X zverejnil 31. marca 2023 dva repozitáre s kódom odporúčania For You, medzi nimi heavy ranker a jeho tabuľku váh. Čo v repozitári nie je, sa zvonku overiť nedá. Kód ukazuje štruktúru systému, nie jeho aktuálny prevádzkový stav.
Ktoré signály vážia v rankingu X najviac?
Podľa tabuľky váh zverejnenej v roku 2023: odpoveď, na ktorú zareaguje sám autor (75,0), odpovede vo všeobecnosti (13,5) a kvalifikované kliknutia na profil (12,0). Lajk má hodnotu 0,5, repost 1,0. Negatívne sa zapíšu nahlásenia s -369,0 a negatívna spätná väzba s -74,0. Skóre je vážený súčet predikovaných pravdepodobností interakcie, nie súčet skutočných interakcií.
Sú externé odkazy na X naozaj penalizované?
V kóde z roku 2023 nestojí žiadna penalizácia odkazov, len zoznam parametrov pre URL konkurencie. Pozorovanie, že príspevky s externým odkazom dostanú menší dosah, je rozšírené, opiera sa však o vyjadrenia platformy a skúsenosti z praxe, nie o zdrojový kód. Dať odkaz do prvej odpovede je lacný test, nie doložené pravidlo.
Prinesie predplatné X Premium väčší dosah?
V stave kódu z roku 2023 áno, a to výslovne: multiplikátor 4,0 pre príspevky vo vlastnej sieti a 2,0 mimo nej, aplikovaný len na originálne príspevky. V prepracovanej hlavnej vetve zo septembra 2025 tento parameter pod týmto názvom už neexistuje. Či a v akej podobe boost pretrváva, doložiť nemožno.
Platí kód zverejnený v roku 2023 ešte v roku 2026?
Len obmedzene. ML repozitár s váhami sa naposledy menil 5. apríla 2023. Hlavná vetva dostala 3. septembra 2025 rozsiahly update. Architektúra (candidate generation, ranking, re-ranking, filtre) je stabilná, konkrétne čísla sú stavom z roku 2023 a tak s nimi treba narábať.
Ako silno ovplyvňuje Grok ranking na X?
Commit z 3. septembra 2025 prináša komponenty postavené na Groku pre kategorizáciu, výber kandidátov, filtrovanie spamu a NSFW obsahu a tiež slop score, ktorý znižuje hodnotenie obsahu s nízkou kvalitatívnou klasifikáciou. Ako silno sú tieto komponenty vážené v produkčnej prevádzke, z kódu nevyplýva. To, že by Grok prevzal priraďovanie do SimClusters, tam nestojí.
Aká je realistická engagement rate na X?
Hootsuite uvádza k 17. júnu 2026 naprieč odvetviami a globálne 1,8 % na báze followerov, Instagram je tam na 3,5 %, LinkedIn na 3,4 %. Štúdia Metricool o X z roku 2024 dospela na medzinárodnej vzorke podľa veľkosti účtu k 1,3 % až 2,21 %, Socialinsider pre rok 2026 k 0,10 %. Rozpätie vzniká rozdielnymi vzťažnými veličinami a vzorkami, preto je vlastná baseline výpovednejšia než akákoľvek odvetvová hodnota.

Ísť hlbšie?

Získajte nové analýzy priamo do schránky, alebo sa pozrite, ako tieto poznatky nasadzujeme pre firmy.