← Späť na blog Príbeh vzniku

Z Devs k ITHKOR a ITHZ: ako sa zo sci-fi otázky stal výskumný program

Začalo sa to seriálom Devs, otázkou o slobodnej vôli a zvláštnym spôsobom práce s AI modelmi. Najdôležitejšie však neboli pekné odpovede, ale chvíle, keď sa pôvodná predstava rozbila.

Presklený výskumný pavilón so zlatým svetlom v hmlistom lese
Ilustračný obrázok vytvorený pomocou AI.

Nevzniklo to ako hotová fyzikálna teória. Začalo sa to seriálom, otázkou o slobodnej vôli a zvláštnym spôsobom práce, pri ktorom som presúval myšlienky medzi AI modelmi a nechával Codex, aby ich premieňal na kód.

Najzaujímavejšie na celej ceste však neboli odpovede. Boli to chvíle, keď sa pôvodná predstava rozbila.

Veľká otázka projekt odštartovala. Až testy, ktoré jej dokázali povedať nie, z nej začali robiť výskumný program.

Od veľkej otázky cez oponentúru a zlyhania až k praktickému nástroju.

Všetko sa začalo jednou otázkou pri seriáli

Nebolo za tým laboratórium, grant ani roky štúdia teoretickej fyziky. Pozeral som seriál Devs.

Jeho svet stojí na nepríjemnej predstave: čo ak je vesmír dokonale deterministický? Čo ak je každý náš pohyb iba ďalšou dominovou kockou v reťazci, ktorý sa začal pri Veľkom tresku? A čo ak by dostatočne výkonný počítač vedel z dnešného stavu vypočítať minulosť aj budúcnosť?

Pri sledovaní som si položil pomerne jednoduchú otázku:

Nemôže byť svet naopak stochastický systém?

Tým sa otvorila diera, do ktorej sa veľmi ľahko spadne. Ak je svet fundamentálne pravdepodobnostný, čo presne znamená kvantová neurčitosť? Prečo existuje maximálna rýchlosť šírenia informácie? Ako sa z kvantového sveta možností stáva stabilný makroskopický svet stolov, áut a ľudí?

A keď sa na tieto otázky pozerá programátor, začne ich formulovať trochu inak.

Nie iba: Z čoho je svet vyrobený?

Ale aj: Aký minimálny stav musí svet uchovávať, aby zostal konzistentný?

A to bola oveľa zaujímavejšia otázka.

Prvá verzia bola až príliš pekná

Keď sa na fyziku pozeráte očami softvérového inžiniera, analógie sa ponúkajú samy. Rýchlosť svetla začne pripomínať limit priepustnosti siete. Planckova škála minimálne rozlíšenie. Vesmír zasa obrovský distribuovaný systém.

Problém je, že pekná analógia ešte nie je fyzikálny mechanizmus.

Prvá formulácia bola odvážna, intuitívna a na prvé prečítanie pôsobila elegantne. Dostala názov Informačno-Teoretická Hypotéza Kvantovo Optimalizovanej Reality, skrátene ITHKOR.

Lenže názov ešte z myšlienky neurobí vedu. Planckova dĺžka nie je dôkaz, že realita pozostáva z pixelov. Rýchlosť svetla nemožno jednoducho premenovať na frekvenciu procesora. Kvantové meranie nepotrebuje vedomého človeka, ktorý sa na časticu pozerá. A zvláštna štruktúra vo vesmíre nie je automaticky chyba generátora náhodných čísel.

Najväčší problém bol jednoduchší: takmer všetko sa dalo spätne vysvetliť, ale nič konkrétne sa nedalo vyvrátiť.

To je pre fyzikálnu hypotézu veľmi zlá vlastnosť.

Najlepší krok bol nechať vlastný nápad rozbiť

Namiesto ďalšieho prikrášľovania som prvý dokument poslal inému modelu ako oponentovi. Výsledok nebol príjemný, ale bol užitočný.

Oponentúra v zásade povedala, že text zamieňa tri odlišné vrstvy:

  1. fakty, ktoré fyzika reálne meria;
  2. informačnú interpretáciu týchto faktov;
  3. špekulatívnu hypotézu o hlbšej informačnej architektúre.

V pôvodnom texte tieto vrstvy splývali. Od tej chvíle sa ITHKOR začala meniť. Vedomý pozorovateľ zmizol z mechanizmu merania. Namiesto jedného kozmického procesora s globálnymi hodinami prišla predstava asynchrónnej siete lokálnych udalostí.

A najmä vzniklo pravidlo, ktoré neskôr ovplyvnilo celý projekt:

Najprv presne definuj mechanizmus. Potom z neho odvoď očakávaný výsledok. A až potom hľadaj dáta. Nie opačne.

Namiesto vesmíru som začal kompresiou

Bolo lákavé pustiť sa rovno do gravitácie, čiernych dier alebo kozmológie. To by však znamenalo stavať strechu skôr než základy.

Oveľa menšia otázka znela: čo ak majú oblasti modelu obmedzenú efektívnu informačnú kapacitu?

Nie v zmysle, že „vesmíru dochádza RAM“. Matematicky. Stav má určitú informačnú zložitosť, región určitú kapacitu a model môže sledovať pomer medzi tým, čo sa snaží reprezentovať, a tým, čo dokáže zachovať.

Vznikol pracovný pojem kompresné napätie. Ak je zložitosť ďaleko pod kapacitou, nič zvláštne sa nedeje. Pri hranici začnú byť relevantné aproximácie. Po jej prekročení musí model nájsť jednoduchší opis.

To už nebola iba filozofia. Dalo sa to naprogramovať.

The Kernel: malý model namiesto celého vesmíru

Nasledoval prvý minimálny model. Namiesto celého vesmíru malý reťazec qubitov. Namiesto všeobecnej gravitácie lokálne interakcie. Namiesto neurčitého „optimalizovania reality“ konkrétna kapacita a konkrétna kompresná operácia.

Cieľ bol zámerne skromný: overiť, či sa dá vytvoriť model s tromi režimami:

  • jednoduchý stav, ktorý sa vyvíja takmer bez obmedzenia;
  • rast korelácií pri interakcii;
  • strata detailu po prekročení nastavenej kapacity.

Dôležitý bol aj nulový model. Nestačilo vytvoriť zložitejší kvantový obvod a tešiť sa, že produkuje väčšiu chybu. Viac operácií prirodzene znamená viac príležitostí na chybu. Preto vznikli kontroly s podobným množstvom práce, ale odlišnou vnútornou štruktúrou.

Otázka sa tým zmenila z „Dáva táto predstava zmysel?“ na „Dokážeme navrhnúť kontrolu, ktorá ju môže zhodiť?“

Potom prišli pekné čísla

Prvé simulácie vyzerali povzbudivo. Zložitejšie triedy stavov narážali na nastavený limit výraznejšie než kontroly. Pri zvyšovaní kapacity zásahov ubúdalo. V jednej lokálnej vetve zostávala no-signalling diagnostika na úrovni numerickej presnosti.

Na tomto mieste by bolo ľahké povedať: funguje to, máme dôkaz.

Lenže ak do programu vložíte informačný limit a kompresnú projekciu, nie je prekvapením, že program následne vykazuje informačný limit a kompresnú projekciu. Malý model môže ukázať, že mechanizmus je matematicky životaschopný. Nemôže sám dokázať, že rovnako funguje príroda.

Toto rozlíšenie sa stalo jednou z najdôležitejších hraníc ITHKOR.

Potom model zlyhal

A práve tu sa príbeh stal zaujímavejším.

Jednoduchý jednorozmerný model vyzeral stabilne. Keď pribudla komplikovanejšia topológia, udalosti sa dali spracovať vo viacerých prípustných poradiach. Výsledok sa pokazil.

Kompresný mechanizmus začal byť citlivý na poradie spracovania. Dve cesty cez ten istý kauzálny problém mohli viesť k odlišnému výsledku. Pre model bez privilegovaného globálneho času je to vážny problém.

Vetva smerujúca k silnejším fyzikálnym tvrdeniam sa preto zastavila. Nie napriek tomu, že výsledok nevyzeral pekne. Práve preto, že nevyzeral.

Model dostal hranicu.

Checkpoint namiesto náhodného okamihu

Nasledovala otázka, kedy sa má informačný zásah vykonať. Pôvodný systém reagoval priebežne počas spracovania udalostí, a tým si vytváral závislosť od ich poradia.

Lepšie sa začali správať pravidlá založené na stabilnej štruktúre problému: kanonických podporách, hraniciach a kontrolných bodoch. Priebežné lokálne rozhodovanie mohlo zostať aktívne, ale nestabilné. Rozhodnutie na kanonickej hranici vrstvy dokázalo zostať aktívne a zároveň stabilnejšie voči poradiu.

Checkpoint tak prestal byť iba technickým detailom experimentu. Začal vyzerať ako všeobecnejší princíp:

Ak môže systém tú istú prácu vykonať viacerými cestami, nerozhoduj podľa náhodného okamihu behu. Rozhoduj na stabilnom a overiteľnom kontrolnom bode.

Táto myšlienka neskôr presiakla oveľa ďalej než do fyzikálneho modelu.

Keď teória začne vyrábať nástroje

V určitom momente som si položil pragmatickú otázku: ak sú tieto princípy matematicky zaujímavé, dajú sa použiť na niečo, čo nemusí čakať na novú fyziku?

Jedným smerom bolo video. Obsahuje obrovské množstvo dát, redundancie, pohybu a štruktúry. Ak sa celý čas pýtam, čo treba zachovať a čo možno opísať jednoduchšie, obraz bol prirodzený test.

Experimentálna kodeková vetva však rýchlo ukázala, ako ďaleko je matematická elegancia od produkčnej reality. Metóda mohla vyzerať dobre na jednoduchých dátach a zlyhať pri pohybe. Dynamická geometria mala metadátovú cenu. Filter mohol zlepšiť jednu metriku a pokaziť inú. Náhodná textúra sa stala povinnou negatívnou kontrolou, pretože „výhra“ na nej mohla znamenať iba vyhladenie detailu.

A napokon nestačilo hovoriť o teoretickej veľkosti reprezentácie. Musel vzniknúť skutočný súbor. Prvé fyzické bitstreamy ukázali, že samotná réžia kontajnera môže zjesť matematickú výhodu kompresie.

Teória hovorila jedno. Disk povedal druhé. A disk mal pravdu.

Z kompresie sa stala otázka pamäte

Kompresia nie je iba otázka, ako urobiť súbor menší. Je aj otázkou: čo musím zachovať, aby sa systém dal neskôr presne obnoviť, overiť a pochopiť?

Pri vývoji s AI agentmi bol tento problém veľmi praktický. Agent môže mať dokumentáciu, Markdown súbory a aktuálny zdrojový kód, no stále mu môže chýbať dôvod, prečo systém vyzerá práve takto. Môže vidieť výsledok bez histórie rozhodnutí. Môže mať stav bez dôkazovej stopy.

Tu sa začal smer, z ktorého neskôr vyrástlo ITHZ, Informačno-Teoretická Hashovacia Zóna.

ITHZ nie je dôkaz ITHKOR. Je to inžinierska odpoveď na problém, ktorý sa počas výskumu vracal:

  • potrebujem stabilný stav;
  • potrebujem vedieť, z čoho vznikol;
  • potrebujem overiteľný checkpoint;
  • potrebujem deterministický plán;
  • potrebujem overiť, že som obnovil presne to, čo som uložil;
  • potrebujem pomenovať hranicu medzi tým, čo možno zahodiť, a tým, čo musí zostať.

Z filozofickej otázky o informačnej realite tak vznikla praktická otázka: ako má vyzerať dôveryhodná pamäť systému?

Zvláštny spôsob výskumu

Celý projekt vznikal netradične. Veľkú časť kódu som osobne nepísal riadok po riadku. Presúval som otázky medzi rôznymi jazykovými modelmi. Jeden navrhol smer, druhý ho kritizoval. Codex dostal presnú úlohu, implementoval experiment, spustil testy a vrátil výsledky. Tie sa stali vstupom do ďalšej oponentúry.

Bolo to niečo medzi výskumným tímom a veľmi rýchlou spätnoväzbovou slučkou. Dalo sa rýchlo prejsť od myšlienky k fungujúcemu experimentu. Malo to však aj riziko: jazykový model veľmi ľahko povie „to je prelom“ alebo „dokázali ste hypotézu“, najmä keď má pred sebou peknú tabuľku.

Najdôležitejšou úlohou človeka preto nie je písať každý riadok kódu. Je ňou rozhodovať, čomu ešte neveriť:

  • Aká kontrola chýba?
  • Čo by výsledok mohlo napodobniť?
  • Čo experiment naozaj meria?
  • Čo z neho vôbec nevyplýva?
  • A čo urobíme, keď zlyhá?

To je možno najzaujímavejší dôsledok AI-native vývoja. Človek môže tráviť menej času syntaxou a viac času architektúrou, experimentálnym dizajnom a kritikou vlastných nápadov.

Čo teda ITHKOR dnes je?

Určite nie hotová „teória všetkého“. A už vôbec nie dôkaz, že žijeme v počítačovej simulácii.

Dnes je ITHKOR výskumný program o informačnej odozve v malých, presne ohraničených modeloch. Pýta sa, kde sa určité vzorce objavia, či prežijú zmenu topológie, inú implementáciu a tvrdšie kontroly, a kde prestanú fungovať.

Pozitívne aj negatívne výsledky sú rovnako dôležité. Niektoré vetvy vytvoria ostrov, na ktorom diagnostika drží. Iné skončia na pobreží. Niektoré sa zatvoria úplne. Predstava, že z informačných pravidiel možno raz odvodiť hlbšiu fyzikálnu architektúru reality, zostáva otvorenou hypotézou.

Tak je to správne.

A čo ITHZ?

ITHZ je druhá strana toho istého príbehu.

ITHKOR sa pýta, či má práca s informáciou hlbší význam pre fyziku. ITHZ nič také dokazovať nepotrebuje. Pýta sa praktickejšie: ak sú pôvod informácie, kontrolné body a stabilný stav dôležité pre dôveryhodný systém, vieme túto myšlienku postaviť ako reálny nástroj?

Tu odpoveď nemusí čakať na kozmológiu. Dá sa zabaliť priečinok, overiť manifest, obnoviť súbor, porovnať hash a skontrolovať, či rovnaké vstupy vytvoria rovnaký plán. Dá sa vytvoriť projektová pamäť a dôkazová vrstva pre agentov. A keď niečo zlyhá, dá sa pomenovať kde.

To je pre mňa zaujímavejšie než tvrdenie, že som našiel zdrojový kód vesmíru.

Odpoveď, ktorú som nakoniec našiel

Na začiatku boli veľké otázky. Je svet deterministický? Je stochastický? Je informácia fundamentálnejšia než hmota? Je realita niečo ako výpočet?

Po množstve experimentov sa odpoveď paradoxne zmenšila:

Neviem.

A dnes mi to pripadá ako lepší výsledok než pôvodná istota. Mám však spôsob, ako sa pýtať ďalej:

  1. Zober veľkú myšlienku.
  2. Zmenši ju na testovateľný model.
  3. Definuj hranice.
  4. Pridaj kontrolu, ktorá sa ju pokúsi zabiť.
  5. Spusti experiment.
  6. Ak zlyhá, nezakrývaj ho, ale zisti prečo.
  7. Ak prejde, ešte mu never a skús tvrdší test.
  8. Ak z toho vznikne užitočný algoritmus, archív alebo spôsob, ako dať agentom pamäť a dôkazovú stopu, postav ho.

Možno práve toto bola najzaujímavejšia odpoveď na otázku života, vesmíru a všetkého.

Nie 42. Ani „žijeme v simulácii“.

Ale jednoduché:

Pýtaj sa tak, aby ti realita mohla povedať nie.


Ďalšou kapitolou je príbeh Hľadal som odpoveď na všetko. Našiel som mapu otázok. Pokračovať môžete aj jednoduchým úvodom do teórie alebo mapou experimentov.

Reakcia

Ako na vás úvaha pôsobila?

Krátka reakcia mi príde e-mailom. Ak chcete rozvinúť myšlienku verejne, pridajte komentár nižšie.

Diskusia

Komentáre sa zobrazia až po schválení autorom. Pri každom novom komentári príde moderátorovi e-mail.

Zatiaľ tu nie je žiadny schválený komentár.

Pridať komentár

Váš e-mail sa nezverejní. Komentár sa zobrazí až po schválení.