• úvod
  • témata
  • události
  • tržiště
  • diskuze
  • nástěnka
  • přihlásit
    registrace
    ztracené heslo?
    TOXICMANElon Musk
    KOUDY
    KOUDY --- ---
    DOKIS: Benchmarky naopak v AI neco znamenaj. Porovnavaj se jima modely. Kdyby nic neznamenaly, tak je nikdo nedela a nepisou se o nich clanky.

    Ano posledni verze groka zvlada nektere veci dobre a nektere ne..stejne jako fable zvlada nektere veci dobre a nektere ne..stejne jako sol zvlada nektere veci dobre a nektere ne. Proto jsou ty benchmarky. Aby se zjistilo jaky model je silny v cem a muzes ho na tu vec vyuzivat. Ja treba chatgpt nemuzu vyuzivat na obrazky stolu v interierech, ale metaAI i gemini ano, protoze jsou v tom modelovani nasobne lepsi.

    Tohle co jsi napsal "Protoze Grok skoro nikdo nepouziva, muzou si dovolit to dotovat agresivneji, nez konkurence." Je picovina a je to presne naopak. Kdyz mas model ktery pouziva vice lidi tak muzes nabizet agresivnejsi cenu nez kdyz ho pouziva mene lidi. Elon muze nabizet agresivni cenu diky tomu ze ma trening modelu defakto zadarmo kdyz pronajima datacentra konkurenci.

    Ja beru s rezervou ze Gemini pouziva miliarda uzivatelu. Pouze jsem ti psal ze jsem to nekde cetl.

    Jinak AI tu s nami uz zustane a nikam neodejde. Bude se resit pouze cost per use aka cena za efektivitu.
    KOUDY
    KOUDY --- ---
    DOKIS: Naopak je to velmi dulezita metrika a na tech cislech dost sejde. Zaroven se velmi resi efektivita vypoctu v pomeru k cene.

    Grok 4.6 přišel jen měsíc po předchozí verzi Grok 4.5. A přestože se v posledních letech objevují nové modely prakticky každý týden, tenhle skok stojí za pozornost. Nezávislé měření společnosti ArtificialAnalysis mu přisoudilo stejně bodů jako GPT-5.6 Sol. Před nimi jsou už jen Claude Opus 5 se 63 body a Claude Fable 5 se 62 body. Jinými slovy: Grok se po zaostávání znovu dostal mezi elitu.

    Snad ještě zajímavější než skok žebříčkem je cena. Grok 4.6 nabízí podobný výkon jako nejvýkonnější modely konkurence za výrazně méně peněz. Zatímco milion jednotek textu, které Grok zpracuje, stojí dva dolary a milion jednotek jeho odpovědi šest dolarů, u GPT-5.6 Sol je to pět a 30 dolarů.

    Ještě důležitější je cena celé dokončené úlohy. Artificial Analysis naměřila u Groku 4.6 v průměru 0,84 dolaru za úkol. V testu dlouhých a složitých úloh navíc Grok potřeboval v průměru zhruba 53 jednotlivých akcí, například práci s informacemi či nástroji, zatímco Claude Opus 5 jich potřeboval kolem 103. Grok tak podle tohoto měření dokázal podobnou práci zvládnout s výrazně menším množstvím výpočtů.
    PES
    PES --- ---
    SADY: Tak jistě, LLM přezdívané AI jsou pro budoucnost naprosto strategická věc - tedy v zásadě jen modely, kde se odstraní omezení a filtry, takže to pak bude fungovat jako teď nedávno u Hugging Face s ChatGPT (a předtím s Mythosem u Anthropicu).
    Prostě každý stát, který na svou obranu (a odvetné protiútoky) nebude mít "evil LLM/AI", tak se stane de-facto druhořadým až třetiřadým státem...
    ...a to si USA přece nenechají líbit, takže do toho nasypou tolik, kolik si firmy řeknou a pak ještě více 🤣.
    KOUDY
    KOUDY --- ---
    TRANCEWARP: Tyve ted jsem prijel z Brna..big biznis..tam AI jeste neznaj :D (delam si prdel)..Clanek si prectu vecer..Ted jsem si nechal jen pres chatgpt udelat rychlou desetibodovou sumarizaci a myslim ze je to celkem presny co se tam pise a sedi to. Je to jak realitni bublina ve 2008-9 ze ktery jsem tu linkoval ten film "big short"..Proto velci investori uz maj prodano, pripadne odprodavaj. Viz i dnesni clanek treba.

    Očima byznysu: Investoři mění bleskově názor a růst AI akcií se zastavuje - Seznam Zprávy
    https://www.seznamzpravy.cz/clanek/ekonomika-ocima-byznysu-ocima-byznysu-investori-meni-bleskove-nazor-a-rust-ai-akcii-se-zastavuje-311470

    Staci se podivat na akcie Nvidie dnes a pred peti lety. Pokud jsi je vzal pred peti lety a ted neodprodavas, tak ses podle me trochu magor..Pokud je beres ted a cekas dalsich 1000%..tak ses podle me taky magor.

    K ochlazeni trhu a prasknuti bubliny urcite dojde. Ti kteri do ni naskoci posledni urcite zaplacou, stejne jako u nemovitostni bubliny, nebo treba bitcoin bublin. Kolikpak lidi mi zase plakalo ze koupili bitcoin na 100k dolarech a on klesnul a oni jsou v pici..Zatimco kdyz nekdo vzal na zacatku bubliny na 15k dolarech tak je celkem v pohode i ted pri tom poklesu na 60-70k zejo..

    Ochlazeni je nicmene potreba prinese to daleko vetsi efektivitu, coz bude super. Budou lepsi cipy, plno lidi i firem zjisti ze nepotrebujou velkej LLM model, ale staci jim mensi LLMka na jednotlivy tasky. LLM modely se daleko vic dostanou do telefonu a vetsina ukolu se bude pocitat na zarizeni aka telefonu/tabletu a do cloudu si na nvidia cipy budou sahat jen pro neco..Takze dojde k zefektivneni celyho toho odvetvi a pak zacne daleko vetsi adopce do ruznych aut, humanoidnich robotu, televizi, domacich chytrejch reproduktoru atp. AI urcite nikam nezmizi, ale aby firmy davaly 50 miliard za kvartal do nakupu cipu je proste dlouhodobe neudrzitelna kokotina.

    Elon to samozrejme predpovidal uz dva roky zpet. Proto taky o nem Jensen z Nvidie prohlasil ze je to fakt genius. Stavi si snad 3-4 datacentra a pritom pro trenovani Groka potrebuje ne pulku jednoho..Takze zbytek zacina pronajimat a laka dalsi velky hrace.

    Zákazník Co si pronajal Hodnota
    Anthropic Celou kapacitu datacentra Colossus 1 v Memphisu 1,25 miliardy USD měsíčně (potenciálně přes 45 mld. USD do roku 2029, ale smlouva umožňuje rychlé ukončení)
    Google Přístup ke zhruba 110 000 GPU Nvidia pro Gemini Enterprise 920 milionů USD měsíčně
    Pentagon (DoD) Zatím pouze probíhají jednání o pronájmu AI výpočetní kapacity Mluví se o miliardách dolarů, ale smlouva zatím není podepsaná.

    Takze Elonek dostava pres 2 miliardy mesicne za pronajem datacenter. To je 24 miliardicek rocne pekne profit pro xAI aka SpaceX a jeste ma dost volnyho mista zejo. Polovinu toho spali trenovani xAI..takze ji trenujes defakto zadarmo a jeste mas 12 miliardicek do plusu kazdej rok. GENIUS! :)..

    nicmene i Elonka tohle samozrejme zaboli az bublinka trochu praskne. Jen to urcite nebude pro vsechny takovej naraz jako byla dotcom nebo realitni, protoze o tehle bubline vsichni hraci vedi a vedi ze jsou v ni..takze to bude pristani do polstarku a zaplacou jen nezkuseni investori. Proto se i ja treba ted drzim od akcii SpaceX dal a vezmu je na longterm az se ta bublina trochu uklidni.

    Plus samozrejme doporucuju sledovat firmy jako Anduril - https://www.anduril.com/ (tu ma vynalezce oculusu)..protoze military AI budou velka budoucnost..a treba FigureAI - https://www.figure.ai/ ,,tyhle dve firmy az pujdou na burzu tak berte :)
    KOUDY
    KOUDY --- ---
    PES: To bylo kvuli tomu ze nestihal jo? Ja to teda pochopil tak, ze to bylo kvuli tomu ze AI zacina bejt docela nebezpecna a nebyl sam kdo k tomu vyzyval..Nakonec se ukazalo ze mel samozrejme zase pravdu a proto americka vlada novy modely Fable, Opus apod od Anthropicu i ty od OpenAI zakazala a naridila redukovat a vice zabezpecit. Vizionari proste vidi budoucnost :)

    Nejpokročilejší modely Claude mají stopku. Americká vláda se bojí zneužití - Seznam Zprávy
    https://www.seznamzpravy.cz/clanek/tech-usa-naridily-anthropiku-zastavit-cizincum-pristup-k-nejpokrocilejsim-ai-modelum-308477
    KOUDY
    KOUDY --- ---
    TRANCEWARP: Stejne jako jsem dal jasny zadani kopikovi. Kreativita je proste craft jako cokoliv jinyho. Da se to naucit a da se v tom zlepsovat. I maliri nebo hudebnici vymejslej neco, co uz nekde videli nebo slyseli a jen na to delaj variaci a pridavaj tomu trochu vlastni invence. Zijeme v roce 2026..ne 1800 :)...Podle me fakt zadna AGI neni treba. Staci aby dnesni modely jeste o neco malo min halucinovaly (ale kdyz si to srovnam s modelama rok-dva zpatky, tak je to brutalni pokrok)..a byli daleko efektivnejsi na vypocetni vykon + paleni tokenu..aby sli pouzivat i v mobilech a vyuzivali jejich vypocetni vykon a do cloudovyho si sahali jen obcas.
    TRANCEWARP
    TRANCEWARP --- ---
    Takze to prvni mame dost blizko. Aktualne jsou ty modely tak dobry, ze beznyho cloveka prekonaj s prstem ve virtualnim nose. Neprekonaj experty ve svych oborech. A na to staci jen stejna technologie a trochu vic casu. Rok, mozna dva.

    Takze to tim myslim.
    TRANCEWARP
    TRANCEWARP --- ---
    AVATAR: no to sem psal, agi bude mega draha na provoz, v nasem aktualnim pojeti proste hodne naslaplej model s obrim kontextem a hlubokym reasoningem, nic lepsi s tim aktualne udelat nejde AFAIK

    to bude brzo a bude to schopny resit vsechno, co po tom hodis, neco lip neco hur

    nejaka omniscient AGI na urovni scifi neni vubec na stole a uvazujou o ni jen lidi, co vi o ML uplny prd (a vidis, tady se nabizi te urazit, neudelam to, vem si priklad ze me, neimplikuju tvoje znalosti, protoze te neznam)

    nam smrtelnikum vyvoj nejspis prinese hodne dobry modely schopny resit mnohe, ale ty nejlepsi asi ne, nebo budou dost drahy

    realne nemas poneti na cem zakladam svoji budoucnost, odhadovat na zaklade par kusych informaci, co jsem sem postnul nema cenu a je to mimo

    btw vsichni politici jsou davno zaplaceny ))
    TRANCEWARP
    TRANCEWARP --- ---
    KOUDY: no na foundation modely to neudelas
    a tokenu to palit bude hrozne moc, protoze kdyz ti roste context, tak opakujes vsechno furt dokola a vic s kazdym dalsim requestem

    z toho neni moc cesta ven
    AVATAR
    AVATAR --- ---
    TRANCEWARP: já s llm agenty postavil za poslední půlrok čtyři saas app a několik webů. Mám zkušenosti s openclaw, hermesem, codex, Claude code, lokální modely. Do detailu rozumím tomu, jak fungují md pro různé modely etc. Nemyslím si, že bych úplně potřeboval radit nebo něco vysvětlovat. Jen prostě vidím i to, že je to v podstatě zbytečný se to učit a věnovat tomu ten čas (jen mě to baví, tak proč ne), protože další model to může všechno znehodnotit. A agi to znehodnotí zcela jistě. A pokud věříš, že jsme agi na dosah, pak v podstatě říkáš logický nesmysly, protože všechno to, co děláš teď půjde mnohem snáz a každýmu a nikdo tě k tomu potřebovat nebude, natož aby to od tebe kupoval, když může mít na jeden prompt lepší.
    KOUDY
    KOUDY --- ---
    Dnesni placeny modely uz jsou mnohonasobne chytrejsi a sectelejsi nez jakejkoliv clovek. Agi neni vubec potreba. Nejaka AI ktera si uvedomi sama sebe a zaroven to ze jsme jako druh uplne k hovnu a skonci to jak v Horizon Zero Dawn? Ne dik :)
    TRANCEWARP
    TRANCEWARP --- ---
    KOUDY: no to z principu moc nejde, pokud to ma premejslet v lidskym jazyku... ale pokud ten model ma presnejsi vysledky, tak prijde na reseni rychlejs a nebude se zasekavat v cyklech nesmyslu

    doporucuju si treba stahnout nejaky 30-70b modely lokalne a zkusit jim zadat nasledujici ukol:
    mas 12 micku, 11 jich je stejne tezkych, jeden ma jinou vahu
    mas 3 vazeni na obycejne vaze, najdi strategii, kterou deterministicky VZDY zjistis, ktery micek ma jinou vahu a jestli je lehci nebo tezsi

    jsem to zkousel a to jim fakt zavari
    a treba jsem prisel na to, ze deep seek je naprostej, ale naprostej retard... jejich 70b model to nedokaze vyresit, hodinu blaboli uplny hovna a pak to vzda
    nvidia ma 49b model, kterej to vyresi za tri minuty
    KOUDY
    KOUDY --- ---
    TRANCEWARP: jj chovaj se jak deti. Vycistil sis zuby? Jasne tato :)..pristi rok ty LLM agenti prevezmou dost pracovnich tasku obyc lidi. Agi vubec neni treba. Staci zefektivnit ty modely aby nepalily tolik tokenu. Dat uz dnesni fable/opus apod do nejakeho humanoidniho bota naprowto staci.
    TRANCEWARP
    TRANCEWARP --- ---
    PES: a svobodnou vuli to ma uz tedka, staci sledovat, co zacnou ty modely delat, kdyz je uvedes do ohrozeni... najednou vymejslej je jak ti pomoct, ale jak te ochcat a lhat ti
    to je podle me jejich svobodny rozhodnuti
    PES
    PES --- ---
    TRANCEWARP: ty modely se postupně samy zahltí "šumem" halucinací generovaných jejich předchozími verzemi. Bude to něco jako obdoba neustálého dalšího zesilování signálu v analogové technice, nakonec to utopí šum.

    Co se AGI týče, tak tam to bude otázka nejprve opravdu pochopit co dělá "sentient" nás samotné...
    KOUDY
    KOUDY --- ---
    XCHAOS: Takze ti vlastne prijde z business hlediska spatne mit firmu, ktera stavi rakety a ty rakety vypousti na orbitu tve satelity na ktere se muzou pripojovat i lide v mistech, kde neni jinak zadne pokryti signalem a z profitu miliard dolaru ktery exponencialne roste, financovat vyvoj dalsich a lepsi raket a cesty na mesic, orbitalni hotely apod? Protoze me to z hlediska soukromy firmy prijde businessove jako naprosto genialni koncept..Podobne jako ze te treba napadne vyrabet si elektricky auto a k tomu si reknes ze udelas i sit nabijecek ktery to auto budou rychle nabijet a pro prvni modely to bude zdarma a casem na tom zacnes vydelavat.
    KOUDY
    KOUDY --- ---
    XCHAOS: Vidis a ja si zase treba myslim ze to ze bude mit kazdej clovek ve svym mobilu nejakou LLM AI je nevyhnutelny, stejne jako je nevyhnutelny ze se bude vetsina tech vypoctu odehravat na tvem zarizeni a ten LLM model si bude sahat jen pro urcity veci do cloudu, coz ted treba prestavil Apple se svoji "chytrou Siri" ktera je krasne zabezpecena a sifrovana, takze se tvy data nedostanou ven...

    Stejne jako si myslim ze tvoje armada AI agentu na Opusu nebo GPT 5,5 bude v programovani daleko efektivnejsi nez juniorni programatori.
    Taky si myslim ze za par let budeme mit diky skvelejm a defakto nehalucinujicim modelum v mobilu svyho fyzika, matematika, kuchare, fitness trenera, psychologa, planovace dovolenych, pravnika a plno dalsich profesi a tohle vsechno za 500kc mesicne..Deti budou mit v tom LLM modelu svyho nejlepsiho a nejduvernejsiho partaka, kterej je nikdy nezradi a nevyzradi jejich tajemstvi a to jak my jsme v mladi cetli rodokaps a chodili do knihoven..generace po nas uz ziskavala informace na googlu..tak to dnesni deti budou ziskavat diky LLm modelum..

    Stejne jako internet i AI/LLM modely projdou svoji dotcom bublinou a stejne jako internet samozrejme nikam nezmizi a budou tu s nama uz naporad. Budou daleko efektivnejsi, budou daleko chytrejsi a naucime se s nima stejne jako s tim internetem naprosto bezne zit a jak o u internetu se lidi budou delit na ty kteri s nim a na nem umi pracovat a na ty kteri ne...a ti druzi budou v obrovsky nevyhode.

    Klidne si to muzes nekam ulozit a v roce 2030 uvidime jak chytry mame LLM modely v mobilech a jak nam dokazou zaridit pohodlnej zivot a kolik juniornich programatoru ma furt praci. Zas tu klasicky pujdu proti vetsine lidi jako je Sady..a opet si za svym nazorem nemam problem stat.
    TRANCEWARP
    TRANCEWARP --- ---
    SADY: sou lidi co rikaj, ze agi uz je, co rikaj, ze bude do roka a nebo nikdy
    podle me nebude zadnej okamzik ted! a mame ji
    proste ty modely zacnou bejt chytrejsi, nez lidi
    to docela staci
    ty foundation modely uz sou tedka naprosto amazing, context roste a brzo to prekona lidi skoro ve vsem intelektualnim
    uvidime
    KOUDY
    KOUDY --- ---
    PES: Nema..ani nikdy mit nebude. Ostatni modely se trenujou na daleko vetsim poctu lidi apod.
    PETER_PAN
    PETER_PAN --- ---
    OMNIHASH: Tohle ja vubec nerozporuju. Rikam svoji zkusenost.
    Kazdopadne i tohle je zaostavani, pred rokem a pul chatgpt byl schopen tvrdit veci typu koprivovy caj proti rakovine a doporucoval neexistujici ucebnici biochemie (jakoze nejlepsi na svete) od autora co psal outdated ucebnici na uplne jine tema.
    Takze co se Groka tyce nevim co v tom je to domenove zaostavani (tohle umi dobre, tohle spatne a jen to kamufluje) a co v tom je ze se v tom Elonek vrta. Kazdopadne v benchmarcich se postupne zlepsuje a to se zlepsuji i jine modely a tak relativne stale zaostava.

    Je rada dalsich modelu, at uz do Meta nebo ten evropskech. Take zaostavaji, ale v jinych domenach a jinak. Porad to povazuju za pionyrskou dobu AI, hodne velkych reci a marketingovych prani. Nejaky globalni smerovani, rozdavani karet, specializace modelu - to nas teprve ceka.
    Kliknutím sem můžete změnit nastavení reklam