• úvod
  • témata
  • události
  • tržiště
  • diskuze
  • nástěnka
  • přihlásit
    registrace
    ztracené heslo?
    HNIZDOnVIDIA - grafické karty, technologie, aplikace, hry
    HNIZDO
    HNIZDO --- ---
    LAUNCHER: Přesně tak, CPU i GPU na 48V, všechny problémy vyřešeny. Napájet kilowatty z 12V je v mnoha ohledech rizikové, drahé a energeticky málo účinné.
    HNIZDO
    HNIZDO --- ---
    Nvidia poskytne až 105 miliard dolarů pro obří AI datacentrum | PCTuning.cz
    https://pctuning.cz/article/nvidia-poskytne-az-105-miliard-dolaru-pro-obri-ai-datacentrum
    LAUNCHER
    LAUNCHER --- ---
    OTAVA: Tohle by mělo být u každého konektoru s hodně Watty, ostatně jako je to na příčetných USBC nabíječkách.

    Druhá věc je, že v PC už dávno měly být zdroje s 48V a odpovídající konektory.

    OTAVA
    OTAVA --- ---
    LAUNCHER: možná že kdyby nebyl návrh toho konektoru tak zmrsenej, nemusel by se pak vynalézat rovnak na vohejbak.
    LAUNCHER
    LAUNCHER --- ---
    LAUNCHER: Tahle feature se mi líbí:

    LAUNCHER
    LAUNCHER --- ---
    5090 Asus Astral, právě přišla.

    LAUNCHER
    LAUNCHER --- ---
    LAUNCHER: Strašně se těším na generaci 2, tzn N2X.
    LAUNCHER
    LAUNCHER --- ---
    ASUS says its first RTX Spark allocation is already fully pre-ordered by channel partners - VideoCardz.com
    https://videocardz.com/newz/asus-says-its-first-rtx-spark-allocation-is-already-fully-pre-ordered-by-channel-partners
    LAUNCHER
    LAUNCHER --- ---
    Night in the shop of a video card technician - 48GB 4090
    https://www.youtube.com/watch?v=M8HGgJqpsGo
    HNIZDO
    HNIZDO --- ---
    Lepší hardware pro AI, než má Nvidia? AMD uvádí Helios a první 2nm GPU Instinct MI455X - Cnews.cz
    https://www.cnews.cz/clanky/lepsi-hardware-pro-ai-nez-ma-nvidia-amd-uvadi-helios-a-prvni-2nm-gpu-instinct-mi455x/

    není to sice nvidia ale srovnání je zajímavé (Gemini):

    ### Přehled a nová architektura

    * **Nová generace AI hardwaru:** AMD představit serverové procesory Epyc 9006 „Venice“ (Zen 6) a akcelerátory Instinct MI455X v kompletním řešení racků Helios.
    * **Architektura CDNA 5 (UDNA):** Sjednocuje koncepci výpočetních a herních GPU (odvozeno od RDNA). Software využívá zavedený stack ROCm.
    * **První 2nm AI GPU:** Výpočetní čiplety XCD jsou vyráběny 2nm procesem TSMC, základová dlaždice 3nm procesem. Čip obsahuje celkem 320 miliard tranzistorů.

    ### Parametry akcelerátoru Instinct MI455X

    * **Paměť:** 432 GB HBM4 (12 pouzder po 36 GB), 12 288bitové rozhraní, propustnost 23,3 TB/s a 192 MB L2 cache.
    * **Výkon:** Při špičkovém taktu 2,4 GHz dosahuje až 40,3 PFLOPS (MXFP4), 20,1 PFLOPS (MXFP6/MXFP8) a 10,1 PFLOPS (FP16/BFloat16) při započtení Structured Sparsity. Výkon obecných výpočtů činí 315 TFLOPS.
    * **Konektivita:** Využívá otevřený standard UALink over Ethernet s přenosovou kapacitou až 3,6 TB/s (duplexně).

    ### Serverové racky AMD Helios a srovnání s Nvidií

    * **Konfigurace racku:** Kapalinou chlazený Helios obsahuje 18 serverových pozic – celkem 72 GPU MI455X a 36 procesorů Epyc 9006 (přes 4 600 CPU jader a 18 000 GPU jednotek).
    * **Celkový výkon racku:** Přes 31 TB HBM4 paměti a celkový výkon 2,9 EFLOPS (FP4).
    * **Výhody oproti Nvidia Rubin (NVL72):**
    * O 50 % širší paměťové rozhraní a vyšší kapacita paměti HBM4 (432 GB vs. 288 GB na GPU).
    * O 10–15 % vyšší výkon při stejném limitu spotřeby (lepší energetická efektivita).
    * Až o 30 % více vygenerovaných AI tokenů na dolar.



    ### Dostupnost a zákazníci

    * **Zákazníci:** Mezi prvními odběrateli jsou OpenAI, Anthropic, Microsoft, Meta a Oracle.
    * **Termín:** Sériová výroba probíhá, dodávky zákazníkům začínají koncem září 2026 s nárůstem objemu během Q4 2026.
    LAUNCHER
    LAUNCHER --- ---
    This was a data center a year ago… Now it's on my desk
    https://www.youtube.com/watch?v=qV_K0nTF6gY
    HNIZDO
    HNIZDO --- ---
    Intel Foundry Securing Packaging & Wafer Deal With NVIDIA To Make Next-Gen Feynman GPUs Could Be Its Biggest Customer Win Yet
    https://wccftech.com/intel-foundry-nvidia-feynman-gpu-wafer-packaging-deal/

    nvidia bude pouzdřit Feynmana u Intelu (datacentrové čipy)
    HNIZDO
    HNIZDO --- ---
    Názory k článku Další zdražení kvůli AI: Nvidia zvedne ceny všech grafických karet GeForce, nových i starších - Cnews.cz
    https://www.cnews.cz/clanky/dalsi-zdrazeni-kvuli-ai-nvidia-zvedne-ceny-vsech-grafickych-karet-geforce-novych-i-starsich/nazory/

    není tam o kolik, ale bude to drahý

    HNIZDO
    HNIZDO --- ---
    GPU Rubin od Nvidie detailně odhaleno: Čtyři čiplety s téměř tisícem tensor jader mají výkon 50 PFLOPS - Cnews.cz
    https://www.cnews.cz/clanky/gpu-rubin-od-nvidie-detailne-odhaleno-ctyri-ciplety-s-temer-tisicem-tensor-jader-maji-vykon-50-pflops/

    Výkon a parametry

    Paměť: Celkově 288 GB HBM4 (144 GB na čip) s celkovou propustností 22 TB/s.

    Výkon v AI (NVFP4): * Až 25 PFLOPS (s využitím sparsity ekvivalent 50 PFLOPS pro inferenci; 35 PFLOPS pro trénování).

    Tradiční výpočty:

    Obecný výkon FP32: 130 TFLOPS (400 TFLOPS na Tensor jádrech).

    Vědecké výpočty FP64: 33 TFLOPS (nižší než u starší generace Hopper, softwarově na Tensor jádrech až 200 TFLOPS).

    Spotřeba: Přesný údaj nebyl uveden, TDP však přesáhne 1000 W.
    LAUNCHER
    LAUNCHER --- ---
    NVIDIA and Japan: Building the Next Industrial Revolution
    https://youtu.be/vXWs3Xq-ke0?is=M5KnAuF9uUo3Vdws


    Poetické video o historických úspěších tech v JP, moc hezky uděláno.

    ...

    Home to leading manufacturers, robotics pioneers, infrastructure builders and iconic gaming companies, of course, Japan is one of the world’s centers of AI — building across the full stack with NVIDIA technologies. This week NVIDIA and its partners in Japan are showcasing the AI ecosystem’s latest advancements.
    HNIZDO
    HNIZDO --- ---
    Nové grafické karty Nvidia jsou u ledu. GeForce RTX 5000 Super odloženy kvůli cenám pamětí - Cnews.cz
    https://www.cnews.cz/clanky/nove-graficke-karty-nvidia-jsou-u-ledu-geforce-rtx-5000-super-odlozeny-kvuli-cenam-pameti/
    LAUNCHER
    LAUNCHER --- ---
    LAUNCHER: Mmch niz nez na 400W ta 5090 nejde limitovat, alespon ne pres nvidia-smi v shellu. To me prekvapilo. GPT 5.5 High:

    ..
    Stability/validation: RTX 5090 is validated as a high-power board. At very low caps, boost behavior, transient spikes, VRM behavior, memory power, and driver timeouts become harder to guarantee.
    Power limit is coarse: It controls the total ceiling, not a clean voltage/frequency operating point. For a huge GPU, “300 W max” may require very aggressive clock bouncing under load.
    Consumer GeForce policy: On GeForce cards, NVIDIA tends to expose a safe power-limit range, not full datacenter-style power capping. The real low-power controls are clocks, voltage curve, and workload behavior.

    Board partner VBIOS: Your MSI Suprim’s BIOS defines the allowed power range. nvidia-smi is just obeying it.
    ..
    LAUNCHER
    LAUNCHER --- ---
    Nejspis mi umrela 5090, prestalo to byt stabilni. Zkousel jsem restrikci power limit na 400W (nvidia-smi -pl 400), ale nepomohlo. Pri start FurMark2 ztrata obrazu.

    No nic, vytahl jsem zalozni 3090, predelal si to tu nouzove na 24GB + Amper (mel jsem ONNX kompilaci konkretne na GB202) a jedu dal. Neni to uplne prijemny, prisel jsem o par features - jak kvuli mensi pameti, tak kvuli vyrazne slabsimu compute.

    Nezlobim se. Snazim se to vnimat jako relativne pratelske pripomenuti, ze redundancy je dulezita.

    Preji vsem krasny vikend a hlavne pevne zdravi (to je ten nejdulezitejsi HW, co mame).
    HNIZDO
    HNIZDO --- ---
    NVIDIA's Next-Gen Rosa CPU To Feature Rigel "Arm v9.2" Cores With Larger L2 Cache & Higher Per-Core Performance In The Same Silicon Footprint
    https://wccftech.com/nvidia-next-gen-rosa-cpu-rigel-arm-v9-2-cores-larger-l2-cache-higher-per-core-performance/

    Představení CPU NVIDIA Rosa

    Nová generace: NVIDIA odhalila první informace o datacentrovém procesoru „Rosa“, který je navržen pro éru agentní AI (Agentic AI).

    Uvedení na trh: Očekává se v roce 2028 po boku GPU architektury Feynman. Do datových center dorazí v roce 2029 a do PC variant (RTX Spark) v roce 2030.

    Architektura: Využívá zcela nové vlastní jádro „Rigel“ postavené na instrukční sadě Arm v9.2.

    Klíčová vylepšení a specifikace

    Výkon na jádro: Zaměřuje se na maximální jednovláknový výkon (single-threaded) ve velkém měřítku. Nabídne vyšší IPC (počet instrukcí za cyklus) než předchozí jádro Olympus (z procesoru Vera), a to při zachování stejné plochy křemíku (silicon footprint).

    Vylepšení architektury: Přináší lepší doručování instrukcí, efektivnější správu paměti a větší L2 cache na jedno jádro (Vera má 2 MB, Rosa bude mít ještě více).

    Podpora pamětí: Předpokládá se nasazení pamětí typu LPDDR6 / LPDDR6X (v rámci RTX Spark).

    Počet jader: Přesný počet jader prozatím nebyl specifikován (předchůdce Vera disponuje 88 jádry Olympus).
    HNIZDO
    HNIZDO --- ---
    Perplexity Bets on NVIDIA's Vera CPU, Calling The Max Single-Threaded Chip a "Dead-On" Fit After It Ran 1.5x Faster in Agentic Coding
    https://wccftech.com/perplexity-bets-on-nvidia-vera-cpu-calling-max-single-threaded-chip-a-dead-on-fit/

    AI:

    ### Hlavní sdělení

    Společnost Perplexity je další významnou AI firmou (vedle OpenAI, xAI, Oracle či Anthropic), která nasazuje nový procesor **NVIDIA Vera**. Tento čip je navržen speciálně pro AI inferenci a agentní AI (Agentic AI) a pro letošní rok má NVIDII zajistit pozici předního dodavatele CPU s tržbami 20 miliard dolarů.

    ### Proč agentní AI vyžaduje procesor Vera

    * **Limitace tradičních CPU:** Agentní AI pracuje v neustálých smyčkách (akce – výsledek – rozhodnutí). Běžná vícejádrová procesorová architektura nedokáže tyto kroky zrychlit a procesory s vysokým počtem jader často ztrácejí výkon kvůli boji o sdílené prostředky.
    * **Strategie NVIDIE:** Místo honby za co nejvyšším počtem jader vsadila NVIDIA na menší počet jader (88 jader) s maximálním jednovláknovým výkonem na jádro a optimalizovanou architekturou.

    ### Klíčové vlastnosti procesoru NVIDIA Vera

    * **Koncept „Max Single-Threaded“:** Poskytuje vysoký výkon jader pod zátěží, dostatečnou paměťovou propustnost pro aktivní jádra a předvídatelnou latenci.
    * **Architektura:** Využívá vlastní jádra *Olympus*, která přinášejí o 50 % vyšší IPC (počet instrukcí za takt) oproti předchozí generaci *Grace*.
    * **Monolitická matrice (Die):** Zajišťuje vnitřní propustnost mezi jádry 3,4 TB/s (více než 3× rychlejší než konkurence), což eliminuje úzká hrdla.
    * **Paměť a spotřeba:** Disponuje propustností paměti LPDDR5X až 1,2 TB/s při spotřebě paměťového subsystému pod 40 W.

    ### Reálné přínosy v praxi

    * **Perplexity:** Dosahuje o 50 % vyšší rychlosti v agentních AI workflows (při kódování) oproti tradičním x86 procesorům a až o 90 % vyššího výkonu v souběžných sandboxech.
    * **Analytika a databáze:** Partneři naměřili 3× vyšší rychlost ve velkokapacitní SQL analytice (Starburst) a až 6× nižší latenci při real-time streamování (Redpanda) ve srovnání s x86 platformou.

    ### Výhled do budoucna

    NVIDIA již nyní láká na příští generaci datacentrových CPU s kódovým označením **Rosa**, která bude postavena na aktualizované architektuře jader *Rigel*.

    ### Hlavní sdělení

    Společnost Perplexity je další významnou AI firmou (vedle OpenAI, xAI, Oracle či Anthropic), která nasazuje nový procesor **NVIDIA Vera**. Tento čip je navržen speciálně pro AI inferenci a agentní AI (Agentic AI) a pro letošní rok má NVIDII zajistit pozici předního dodavatele CPU s tržbami 20 miliard dolarů.

    ### Proč agentní AI vyžaduje procesor Vera

    * **Limitace tradičních CPU:** Agentní AI pracuje v neustálých smyčkách (akce – výsledek – rozhodnutí). Běžná vícejádrová procesorová architektura nedokáže tyto kroky zrychlit a procesory s vysokým počtem jader často ztrácejí výkon kvůli boji o sdílené prostředky.
    * **Strategie NVIDIE:** Místo honby za co nejvyšším počtem jader vsadila NVIDIA na menší počet jader (88 jader) s maximálním jednovláknovým výkonem na jádro a optimalizovanou architekturou.

    ### Klíčové vlastnosti procesoru NVIDIA Vera

    * **Koncept „Max Single-Threaded“:** Poskytuje vysoký výkon jader pod zátěží, dostatečnou paměťovou propustnost pro aktivní jádra a předvídatelnou latenci.
    * **Architektura:** Využívá vlastní jádra *Olympus*, která přinášejí o 50 % vyšší IPC (počet instrukcí za takt) oproti předchozí generaci *Grace*.
    * **Monolitická matrice (Die):** Zajišťuje vnitřní propustnost mezi jádry 3,4 TB/s (více než 3× rychlejší než konkurence), což eliminuje úzká hrdla.
    * **Paměť a spotřeba:** Disponuje propustností paměti LPDDR5X až 1,2 TB/s při spotřebě paměťového subsystému pod 40 W.

    ### Reálné přínosy v praxi

    * **Perplexity:** Dosahuje o 50 % vyšší rychlosti v agentních AI workflows (při kódování) oproti tradičním x86 procesorům a až o 90 % vyššího výkonu v souběžných sandboxech.
    * **Analytika a databáze:** Partneři naměřili 3× vyšší rychlost ve velkokapacitní SQL analytice (Starburst) a až 6× nižší latenci při real-time streamování (Redpanda) ve srovnání s x86 platformou.

    ### Výhled do budoucna

    NVIDIA již nyní láká na příští generaci datacentrových CPU s kódovým označením **Rosa**, která bude postavena na aktualizované architektuře jader *Rigel*.
    Kliknutím sem můžete změnit nastavení reklam