AI umelá inteligencia
Pravidlá fóra
Nezabudnite, prosím, že svojou prítomnosťou a diskutovaním na tomto fóre vyjadrujete svoj súhlas s vždy aktuálnymi Podmienkami používania tohto fóra. Predovšetkým prosím dbajte na slušnosť komunikácie a rešpektovanie sa navzájom. Celé Podmienky používania tohto fóra si môžte prečítať tu.
Nezabudnite, prosím, že svojou prítomnosťou a diskutovaním na tomto fóre vyjadrujete svoj súhlas s vždy aktuálnymi Podmienkami používania tohto fóra. Predovšetkým prosím dbajte na slušnosť komunikácie a rešpektovanie sa navzájom. Celé Podmienky používania tohto fóra si môžte prečítať tu.
- Trumpeta1978
- VETERAN MEMBER *****
- Príspevky: 6435
- Dátum registrácie: Ut 28 03, 2017 9:05 pm
- Has thanked: 1082 times
- Been thanked: 563 times
- JUGGLER
- VETERAN MEMBER *****
- Príspevky: 20790
- Dátum registrácie: Št 17 04, 2008 8:39 pm
- Has thanked: 2562 times
- Been thanked: 2909 times
Re: AI umelá inteligencia
Riaditeľ Úradu pre vedu a technológiu Bieleho domu Michael Kratsios uvádza:
„Máme informácie, že spoločnosť Moonshot AI využila model Fable od spoločnosti Anthropic na vývoj svojho modelu K3“ :
„Na tento účel vyvinuli sofistikovanú internú platformu na vykonávanie destilácie vo veľkom meradle na amerických modeloch, čo im umožňuje rýchlo prechádzať medzi viacerými spôsobmi prístupu, aby sa vyhli odhaleniu.
Spoločnosť Moonshot AI tiež získala servery vybavené modelmi GB300 a získala prístup k modelom GB300 v Thajsku, pravdepodobne na účely trénovania svojich modelov umelej inteligencie.
Spojené štáty dôrazne podporujú slobodný a spravodlivý rozvoj umelej inteligencie, vrátane prosperujúceho konkurenčného ekosystému, ktorý zahŕňa priekopnícke modely, špecializované systémy, rámce s otvoreným zdrojovým kódom a modely s otvorenou váhou.
Legitímna destilácia umelej inteligencie používaná na vytváranie menších a efektívnejších modelov zohráva v tomto otvorenom inovačnom ekosystéme kľúčovú úlohu.
Veľkoplošná, skrytá priemyselná destilácia zameraná na krádež proprietárnych technológií USA a podkopávanie amerického výskumu je však neprijateľná.“
„Máme informácie, že spoločnosť Moonshot AI využila model Fable od spoločnosti Anthropic na vývoj svojho modelu K3“ :
„Na tento účel vyvinuli sofistikovanú internú platformu na vykonávanie destilácie vo veľkom meradle na amerických modeloch, čo im umožňuje rýchlo prechádzať medzi viacerými spôsobmi prístupu, aby sa vyhli odhaleniu.
Spoločnosť Moonshot AI tiež získala servery vybavené modelmi GB300 a získala prístup k modelom GB300 v Thajsku, pravdepodobne na účely trénovania svojich modelov umelej inteligencie.
Spojené štáty dôrazne podporujú slobodný a spravodlivý rozvoj umelej inteligencie, vrátane prosperujúceho konkurenčného ekosystému, ktorý zahŕňa priekopnícke modely, špecializované systémy, rámce s otvoreným zdrojovým kódom a modely s otvorenou váhou.
Legitímna destilácia umelej inteligencie používaná na vytváranie menších a efektívnejších modelov zohráva v tomto otvorenom inovačnom ekosystéme kľúčovú úlohu.
Veľkoplošná, skrytá priemyselná destilácia zameraná na krádež proprietárnych technológií USA a podkopávanie amerického výskumu je však neprijateľná.“
- Trumpeta1978
- VETERAN MEMBER *****
- Príspevky: 6435
- Dátum registrácie: Ut 28 03, 2017 9:05 pm
- Has thanked: 1082 times
- Been thanked: 563 times
Re: AI umelá inteligencia
AI za deset let nahradí lidi a peníze ztratí smysl, řekl Musk. Čína převezme vedení v technologiích
https://www.echo24.cz/a/HuUzE/zpravy-sv ... .sznhp.box
https://www.echo24.cz/a/HuUzE/zpravy-sv ... .sznhp.box
-
nesta
- Active Member
- Príspevky: 99
- Dátum registrácie: Pi 17 09, 2021 12:09 pm
- Has thanked: 43 times
- Been thanked: 10 times
Re: AI umelá inteligencia
Zaujimalo by ma, akym sposobom v takom prostredi bude rozhodovane o veciach, ktore ani ultra efektivna AI nenamnozi ako napr pozemky na Zemi. Na zaklade coho sa rozhodne, kto z X zaujemcov o kus pozemku ho realne dostane a bude si na nom moct napr postavit dom?Trumpeta1978 napísal: ↑So 25 07, 2026 4:26 pm AI za deset let nahradí lidi a peníze ztratí smysl, řekl Musk. Čína převezme vedení v technologiích
https://www.echo24.cz/a/HuUzE/zpravy-sv ... .sznhp.box
-
jaroslav80
- VETERAN MEMBER *****
- Príspevky: 5956
- Dátum registrácie: Št 24 03, 2011 5:19 pm
- Has thanked: 334 times
- Been thanked: 219 times
Re: AI umelá inteligencia
Musk blabolil aj ze v 2040 bude milionove mesto na Marse. Realne budu radi, ak tam v 2040 prinajlepsom doleti piata raketa s ludskou posadkou vystriedat piaty turnus malej skupinky astronautov.nesta napísal: ↑Ne 26 07, 2026 8:35 amZaujimalo by ma, akym sposobom v takom prostredi bude rozhodovane o veciach, ktore ani ultra efektivna AI nenamnozi ako napr pozemky na Zemi. Na zaklade coho sa rozhodne, kto z X zaujemcov o kus pozemku ho realne dostane a bude si na nom moct napr postavit dom?Trumpeta1978 napísal: ↑So 25 07, 2026 4:26 pm AI za deset let nahradí lidi a peníze ztratí smysl, řekl Musk. Čína převezme vedení v technologiích
https://www.echo24.cz/a/HuUzE/zpravy-sv ... .sznhp.box
Skor by mal fantazirovat, ci v 2040 si v USA nebudu musiet pytat povolenie od Pekingu, ci smu alebo nesmu vystrelit raketu.
-
Myk
- Platinum Member ***
- Príspevky: 730
- Dátum registrácie: Ne 29 11, 2009 8:05 am
- Has thanked: 5 times
- Been thanked: 97 times
Re: AI umelá inteligencia
Čínský startup DeepSeek podle aktuálních informací z července 2026 nezrušil, ale dočasně pozastavil své druhé kolo financování. K tomuto kroku došlo jen několik týdnů poté, co společnost v červnu úspěšně uzavřela rekordní první investiční kolo, ve kterém získala přes 7 miliard dolarů.
Hlavní důvody a detaily pozastavení
Únik informací z interního jednání: Hlavním spouštěčem byla frustrace zakladatele firmy Lianga Wenfenga. Na internet a sociální sítě totiž unikl přepis z jeho čtyřhodinového setkání s investory.
Citlivé výroky o čipech a USA: V uniklém textu Liang otevřeně mluvil o tom, že Čína v oblasti AI stále zaostává za USA a že DeepSeek je nadále silně závislý na čipech od americké společnosti Nvidia. Tyto výroky vyvolaly velký rozruch v době napjatého technologického soupeření mezi USA a Čínou.
Strategická stopka: Společnost ústně informovala potenciální investory, že očekávané investiční smlouvy se v nejbližších dnech podepisovat nebudou. Jednání se však mohou později znovu rozběhnout, jakmile se situace kolem úniku informací uklidní.
Hlavní důvody a detaily pozastavení
Únik informací z interního jednání: Hlavním spouštěčem byla frustrace zakladatele firmy Lianga Wenfenga. Na internet a sociální sítě totiž unikl přepis z jeho čtyřhodinového setkání s investory.
Citlivé výroky o čipech a USA: V uniklém textu Liang otevřeně mluvil o tom, že Čína v oblasti AI stále zaostává za USA a že DeepSeek je nadále silně závislý na čipech od americké společnosti Nvidia. Tyto výroky vyvolaly velký rozruch v době napjatého technologického soupeření mezi USA a Čínou.
Strategická stopka: Společnost ústně informovala potenciální investory, že očekávané investiční smlouvy se v nejbližších dnech podepisovat nebudou. Jednání se však mohou později znovu rozběhnout, jakmile se situace kolem úniku informací uklidní.
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: AI umelá inteligencia
Naskytá sa otázka, na čom trénovali v Antropic-u ten svoj model. Antropic ukradne dáta všetkých užívateľov, publicistov, vedcov a prevádzkovateľov webových stránok internetu, vlastne zdarmo ukradne všetky svetové texty a "múdrejší" číňania si to vytiahnu od nich. Kto je zlodej ? Zlodej okradol zlodeja ?JUGGLER napísal: ↑St 22 07, 2026 9:48 pm Riaditeľ Úradu pre vedu a technológiu Bieleho domu Michael Kratsios uvádza:
„Máme informácie, že spoločnosť Moonshot AI využila model Fable od spoločnosti Anthropic na vývoj svojho modelu K3“ :
„Na tento účel vyvinuli sofistikovanú internú platformu na vykonávanie destilácie vo veľkom meradle na amerických modeloch, čo im umožňuje rýchlo prechádzať medzi viacerými spôsobmi prístupu, aby sa vyhli odhaleniu.
Spoločnosť Moonshot AI tiež získala servery vybavené modelmi GB300 a získala prístup k modelom GB300 v Thajsku, pravdepodobne na účely trénovania svojich modelov umelej inteligencie.
Spojené štáty dôrazne podporujú slobodný a spravodlivý rozvoj umelej inteligencie, vrátane prosperujúceho konkurenčného ekosystému, ktorý zahŕňa priekopnícke modely, špecializované systémy, rámce s otvoreným zdrojovým kódom a modely s otvorenou váhou.
Legitímna destilácia umelej inteligencie používaná na vytváranie menších a efektívnejších modelov zohráva v tomto otvorenom inovačnom ekosystéme kľúčovú úlohu.
Veľkoplošná, skrytá priemyselná destilácia zameraná na krádež proprietárnych technológií USA a podkopávanie amerického výskumu je však neprijateľná.“
Kimi K3 má byť oddnes zadarmo k stiahnutiu. Antropic k Fable 5 zakázal ešte aj platený prístup v počiatkoch pre európu, tak kto je ten zlodej ? https://huggingface.co/audnai/penclaw-K ... rated-GGUF
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: FACEBOOK - META
2-3 roky je určite chybný odhad, ktorému z vlastnej skúsenosti neverím. Prevádzkoval som ťažbu kryptomien so stovkami GPU (pre retail, teda menej kvalitné ako pre datacentrá), čo už môže nejakú štatistickú vzorku vytvoriť a chybovosť do 3 rokov bola 1% (pokryla záruka) a po záruke som väčšinou predával. Nejaké GPU mi bežia doteraz, pár strojov som mal aj s 5 ročnými GPU a tam sa pokazili zo 70 ks dve do tých 5 rokov, kedy som ich odpredal.Glogol napísal: ↑Št 31 07, 2025 10:49 pm Zdá sa, že odpisovateľná životnosť kapitálovej základne spoločnosti $META (210 miliárd dolárov k 30. 6. 2025) bola k 2. štvrťroku 11 – 12 rokov. Ak je skutočná ekonomická životnosť jej grafických procesorov 2 – 3 roky, väčšina jej „ziskov“ je podstatne nadhodnotená.
https://x.com/realjimchanos/status/1950690540095418561?
Keď niekto predpokladá 2-3 roky, teda v priemere 2,5 roka, tak je to len podľa mojich skúseností o 95% väčší odpis ako je moja skúsenosť a to neviem, či naozaj nevydržia aj 10 rokov.
Áno, môžeme hovoriť o technologickej zastaralosti ale výkon GPU sa generáciami zvyšuje v priemere v 10%. Ak prinesie nejaká generácia 15-20% nárast výkonu, potom ďaľšie dve generácie sú ozaj kozmetické. Súčasné GPU sa robia na 4 alebo 3nm technológiou, kde sa to už tiež nemá kam až tak posunúť (rozdiel bol keď sa išlo 15nm a každoročne sa to zlepšovalo). 2nm technológia prichádza (ak sa podarí) po 6 rokoch od 3nm a prinesie lepšiu energetickú účinnosť ale to sa v datacentrách dá nahradiť kompenzovať aj efektívnejšími zdrojmi energie, nielen výmenou za nové GPU.
Takže by som nebol až taký skeptik a netvrdil, že je ziskovosť nadhodnotená.
-
Murosik
- Gold Member **
- Príspevky: 349
- Dátum registrácie: So 20 11, 2021 8:44 pm
- Has thanked: 78 times
- Been thanked: 70 times
Re: FACEBOOK - META
Problém je, že AI síce využíva-je vyvynutá najma na GPU, ale nie je pre ne ideálna.
Aktuáne sa vyvýjajú výpočtové jadrá výslovne pre AI a tam je teda ten nalrast výkonu a energetickej úspory rozhodne výraznejší ako tých 10%.
Raz sa isto dostaneme do doby kedy aj nalrast výkonu v AI bjde tých 10% ale to nie je dnes. Dnes to byva aj o 100%.
Dnes naozaj cipy pre AI sú po 3 rokoch technologycky zastarané a ne nevyhodne ich prevadzkovat (aj kvoli energetickej narocnosti) oproti nakupu novych.
Aktuáne sa vyvýjajú výpočtové jadrá výslovne pre AI a tam je teda ten nalrast výkonu a energetickej úspory rozhodne výraznejší ako tých 10%.
Raz sa isto dostaneme do doby kedy aj nalrast výkonu v AI bjde tých 10% ale to nie je dnes. Dnes to byva aj o 100%.
Dnes naozaj cipy pre AI sú po 3 rokoch technologycky zastarané a ne nevyhodne ich prevadzkovat (aj kvoli energetickej narocnosti) oproti nakupu novych.
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: FACEBOOK - META
Nesúhlasím, 100% je nereálne. Napríklad "staršia" nVidia A100 sa predáva už 6 rokov a stále je o ňu obrovský záujem. Ak cena novšej a výkonnejšej veci je vyššia o viac ako jej výkonnostný prínos ušetrí energie, nie je dôvod priplácať a meniť.Murosik napísal: ↑Ne 16 08, 2026 5:10 pm Problém je, že AI síce využíva-je vyvynutá najma na GPU, ale nie je pre ne ideálna.
Aktuáne sa vyvýjajú výpočtové jadrá výslovne pre AI a tam je teda ten nalrast výkonu a energetickej úspory rozhodne výraznejší ako tých 10%.
Raz sa isto dostaneme do doby kedy aj nalrast výkonu v AI bjde tých 10% ale to nie je dnes. Dnes to byva aj o 100%.
Dnes naozaj cipy pre AI sú po 3 rokoch technologycky zastarané a ne nevyhodne ich prevadzkovat (aj kvoli energetickej narocnosti) oproti nakupu novych.
-
Murosik
- Gold Member **
- Príspevky: 349
- Dátum registrácie: So 20 11, 2021 8:44 pm
- Has thanked: 78 times
- Been thanked: 70 times
Re: FACEBOOK - META
https://openmetal.io/resources/blog/nvi ... 0expensive.
Nvidia A100 (2020) vs. Nvidia H100 (2022)
Pri trénovaní veľkých jazykových modelov (LLM) je H100 teoreticky až 9-krát rýchlejší (nárast o 800 %) ako jeho predchodca A100. Prakticky v praktických úlohách bol nárast výkonu viac ako dvojnásobný.
Jedna karta H100 zvládne rovnaký objem inferenčných úloh ako dve karty A100. H100 zvláda podstatne viac paralelných dopytov v reálnom čase s nižšou odozvou
https://www.lightly.ai/blog/nvidia-b200 ... 3%2C000%20(our%20cost%20for%20colocation%20space%2C%20power%2C,(H100)%3A%20%2417%2C000%2Fmonth%20(Nebius)%20to%20%2470%2C000%2B%2Fmonth%20(AWS%2FGCP%20on%2Ddemand).
Nvidia H100 (2022) vs. Nvidia Blackwell B200 (2024)
Nový procesor NVIDIA Blackwell B200 prináša v reálnych testoch spoločnosti Lightly.ai o 33 % až 57 % vyšší výkon pri trénovaní AI a 2,4-násobne väčšiu kapacitu pamäte v porovnaní s modelom H100. Čas na trénovanie veľkých jazykových modelov skracuje na polovicu (100% nárast)
Treba aby som dal príklady iných procesorov mimo Nvidie? Napríklad TPU od Googlu?
Ešte zo srandy doplnim apple procesory M4 vs M5. Nejde o procesor primárne pre datacentrá.
Napríklad:
https://www.youtube.com/watch?v=h8_4G2Zs_z8
Spracovanie promptu – skok o 274 %. Generácia odpovede je rýchlejšia len o viac ako 30%.
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: FACEBOOK - META
Používam M4 aj M5, z M4 (MacMini) mám urobený cluster so 16 strojmi (256GB RAM celkovej) a rozdiel medzi M4 a M5 je minimálny pri normálnych použiteľných modeloch. Test od Alexa som videl predvčerom ale testoval 4B modely - hádam nemyslíš, že v datacentrách pre LLM bežia 4B parametrové QWEN-y ? 4B model je použiteľný na úplne najjednoduchšie úlohy (napríklad mne osobne akurát tak vytvára názvy sessions podľa obsahu pre agenta).Murosik napísal: ↑Ne 16 08, 2026 6:01 pm
Ešte zo srandy doplnim apple procesory M4 vs M5. Nejde o procesor primárne pre datacentrá.
Napríklad:
https://www.youtube.com/watch?v=h8_4G2Zs_z8
Spracovanie promptu – skok o 274 %. Generácia odpovede je rýchlejšia len o viac ako 30%.
Aktuálne používané modely majú 1,5T alebo viac parametrov. Na coding (kde ide čisto o programovací jazyk, čo je tá najjednoduchšia disciplína LLM, lebo programovacie jzyky majú pevné pravidlá), používam modely od 80B do 150B (miliárd parametrov), čo s pamäťou pre kontext potrebuje 128 až 256GB RAM v GPU. Pamäť je podstatná a preto napríklad v A100 sa po dvoch rokoch zdvojnásobila a predáva sa do dnes, čo som uvádzal príklad.
-
Murosik
- Gold Member **
- Príspevky: 349
- Dátum registrácie: So 20 11, 2021 8:44 pm
- Has thanked: 78 times
- Been thanked: 70 times
Re: FACEBOOK - META
V čom presne som to klamal/zavádzal?miror napísal: ↑Ne 16 08, 2026 6:43 pmPoužívam M4 aj M5, z M4 (MacMini) mám urobený cluster so 16 strojmi (256GB RAM celkovej) a rozdiel medzi M4 a M5 je minimálny pri normálnych použiteľných modeloch. Test od Alexa som videl predvčerom ale testoval 4B modely - hádam nemyslíš, že v datacentrách pre LLM bežia 4B parametrové QWEN-y ? 4B model je použiteľný na úplne najjednoduchšie úlohy (napríklad mne osobne akurát tak vytvára názvy sessions podľa obsahu pre agenta).Murosik napísal: ↑Ne 16 08, 2026 6:01 pm
Ešte zo srandy doplnim apple procesory M4 vs M5. Nejde o procesor primárne pre datacentrá.
Napríklad:
https://www.youtube.com/watch?v=h8_4G2Zs_z8
Spracovanie promptu – skok o 274 %. Generácia odpovede je rýchlejšia len o viac ako 30%.
Aktuálne používané modely majú 1,5T alebo viac parametrov. Na coding (kde ide čisto o programovací jazyk, čo je tá najjednoduchšia disciplína LLM, lebo programovacie jzyky majú pevné pravidlá), používam modely od 80B do 150B (miliárd parametrov), čo s pamäťou pre kontext potrebuje 128 až 256GB RAM v GPU. Pamäť je podstatná a preto napríklad v A100 sa po dvoch rokoch zdvojnásobila a predáva sa do dnes, čo som uvádzal príklad.
- JUGGLER
- VETERAN MEMBER *****
- Príspevky: 20790
- Dátum registrácie: Št 17 04, 2008 8:39 pm
- Has thanked: 2562 times
- Been thanked: 2909 times
Re: FACEBOOK - META
Zaujímavá debata. Presuniem pozdejšie do vlákna o AI.
Hoci sa cítim ako analfabet Dežko, ktorý vstúpil do triedy kde už vedia čítať a písať,
považujem príspevky oboch sa prínosné. Preto ma mrzí ten ,,ad hominem,, kontext.
Murosik: Nenašiel som nikde, že by ťa Miror obvinil, že klameš a zavádzaš...
Ja by som pridal môj postreh v tom ako Číňania vytreli kocúra Američanom použitím starších čípov.
Prečo by teda americkí giganti za každú cenu vyhadzovali každé 2-3 roky miliardy a kupovali len najnovšie modely?
Ako my to definovalo AI:
DeepSeek ukázal, že špičkový výkon LLM sa dá dosiahnuť s oveľa vyššou výpočtovou efektivitou, než sa predpokladalo.
Porazil predstavu, že „Ak chceme lepší AI model, musíme ho trénovať na čoraz väčšom počte najdrahších GPU.“
Čína nemala prístup k najnovším americkým čipom → preto bola nútená maximalizovať efektivitu → a zistila, že algoritmická a softvérová optimalizácia môže časť hardvérového náskoku kompenzovať.
To isté KIMI:
Model Kimi K3 (od čínskeho startupu Moonshot AI, ktorý podporujú giganti ako Alibaba a Tencent) predstavuje prelomový míľnik v oblasti otvoreného softvéru a AI architektúry.
Ide o model „3T triedy“ (2,8 bilióna parametrov) s architektúrou Mixture-of-Experts (MoE) s 896 špecializovanými expertmi.
Fascinujúce na ňom nie je len to, že sa výkonom vyrovná najlepším uzavretým modelom, ale najmä spôsob, akým to čínski inžinieri dosiahli:
1. Prelomová architektúra (Kimi Delta Attention)
Namiesto spoliehania sa výhradne na hrubú výpočtovú silu a najnovšie čipy vyvinul Moonshot AI vlastné mechanizmy – Kimi Delta Attention a Attention Residuals.
Tento prístup dramaticky zvyšuje efektivitu škálovania (až 2,5-násobne oproti predošlým generáciám).
Model spracováva obrovské množstvá dát a 1-miliónový kontextový okno tak, že sa dynamicky sústredí len na najdôležitejšie informácie bez preťažovania pamäte.
2. Najväčší open-weights model na svete
Na rozdiel od amerických firiem (OpenAI, Google, Anthropic), ktoré svoje najlepšie modely úzkostlivo chránia ako komerčné tajomstvo, Moonshot AI vydal váhy Kimi K3 ako otvorený model (open-source/open-weight).
Výskumníci a vývojári po celom svete si tak môžu voľne stiahnuť kód, študovať ho a spúšťať vlastné inštancie.
3. Natívna multimodalita a autonómne agenty
Kimi K3 má od základu zabudované vizuálne vnímanie – dokáže natívne analyzovať text, obrázky aj video súčasne bez potreby dodatočných prekladových vrstiev.
Je navrhnutý na „long-horizon reasoning“ a prácu s autonómnymi agentmi, čo znamená, že zvládne vykonávať komplexné, viac-krokové úlohy pri kódovaní a výskume bez toho, aby po pár krokoch stratil kontext.
4. Zmarenie efektu amerických sankcií
Kimi K3 je živým dôkazom toho, že technologické obmedzenia prinútili čínskych výskumníkov k obrovskej softvérovej inovácii. Zatiaľ čo USA obmedzili vývoz najnovšieho hardvéru, Čína to vykompenzovala inteligentnejším algoritmickým dizajnom a kompresiou
Hoci sa cítim ako analfabet Dežko, ktorý vstúpil do triedy kde už vedia čítať a písať,
považujem príspevky oboch sa prínosné. Preto ma mrzí ten ,,ad hominem,, kontext.
Murosik: Nenašiel som nikde, že by ťa Miror obvinil, že klameš a zavádzaš...
Ja by som pridal môj postreh v tom ako Číňania vytreli kocúra Američanom použitím starších čípov.
Prečo by teda americkí giganti za každú cenu vyhadzovali každé 2-3 roky miliardy a kupovali len najnovšie modely?
Ako my to definovalo AI:
DeepSeek ukázal, že špičkový výkon LLM sa dá dosiahnuť s oveľa vyššou výpočtovou efektivitou, než sa predpokladalo.
Porazil predstavu, že „Ak chceme lepší AI model, musíme ho trénovať na čoraz väčšom počte najdrahších GPU.“
Čína nemala prístup k najnovším americkým čipom → preto bola nútená maximalizovať efektivitu → a zistila, že algoritmická a softvérová optimalizácia môže časť hardvérového náskoku kompenzovať.
To isté KIMI:
Model Kimi K3 (od čínskeho startupu Moonshot AI, ktorý podporujú giganti ako Alibaba a Tencent) predstavuje prelomový míľnik v oblasti otvoreného softvéru a AI architektúry.
Ide o model „3T triedy“ (2,8 bilióna parametrov) s architektúrou Mixture-of-Experts (MoE) s 896 špecializovanými expertmi.
Fascinujúce na ňom nie je len to, že sa výkonom vyrovná najlepším uzavretým modelom, ale najmä spôsob, akým to čínski inžinieri dosiahli:
1. Prelomová architektúra (Kimi Delta Attention)
Namiesto spoliehania sa výhradne na hrubú výpočtovú silu a najnovšie čipy vyvinul Moonshot AI vlastné mechanizmy – Kimi Delta Attention a Attention Residuals.
Tento prístup dramaticky zvyšuje efektivitu škálovania (až 2,5-násobne oproti predošlým generáciám).
Model spracováva obrovské množstvá dát a 1-miliónový kontextový okno tak, že sa dynamicky sústredí len na najdôležitejšie informácie bez preťažovania pamäte.
2. Najväčší open-weights model na svete
Na rozdiel od amerických firiem (OpenAI, Google, Anthropic), ktoré svoje najlepšie modely úzkostlivo chránia ako komerčné tajomstvo, Moonshot AI vydal váhy Kimi K3 ako otvorený model (open-source/open-weight).
Výskumníci a vývojári po celom svete si tak môžu voľne stiahnuť kód, študovať ho a spúšťať vlastné inštancie.
3. Natívna multimodalita a autonómne agenty
Kimi K3 má od základu zabudované vizuálne vnímanie – dokáže natívne analyzovať text, obrázky aj video súčasne bez potreby dodatočných prekladových vrstiev.
Je navrhnutý na „long-horizon reasoning“ a prácu s autonómnymi agentmi, čo znamená, že zvládne vykonávať komplexné, viac-krokové úlohy pri kódovaní a výskume bez toho, aby po pár krokoch stratil kontext.
4. Zmarenie efektu amerických sankcií
Kimi K3 je živým dôkazom toho, že technologické obmedzenia prinútili čínskych výskumníkov k obrovskej softvérovej inovácii. Zatiaľ čo USA obmedzili vývoz najnovšieho hardvéru, Čína to vykompenzovala inteligentnejším algoritmickým dizajnom a kompresiou
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: FACEBOOK - META
Zavádzal si vlastne vo všetkom o M4 M5, lebo debata bola o GPU kartách pre AI a ty si uviedol príklad na zrýchlení na počítačových procesoroch M4 a M5 a to je blbosť. Vysvetlím - Apple Silicon (procesory Mx) je navrhnutý ako všeobecný procesor pre počítače, ktorý ma integrovaú grafiku (grafické výpočtové jadrá). Takže je to nie špeciálny procesor na AI ale všeobecný viacúčelový procesor, ktorý vďaka integrovanej pamäti s rýchlosťou ako pamäte GPU má lepšiu pamäťovú priepustnosť (okrem ďalších vecí ako napr. ARM architektúra). Ak pridáme ďalšie jadrá GPU, tak samozrejme výkon stúpne ale to nie je vývoj - lepšia efektívnosť ale pridanie ďalších jadier za ceny vyššej spotreby.Murosik napísal: ↑Ne 16 08, 2026 6:58 pmV čom presne som to klamal/zavádzal?miror napísal: ↑Ne 16 08, 2026 6:43 pmPoužívam M4 aj M5, z M4 (MacMini) mám urobený cluster so 16 strojmi (256GB RAM celkovej) a rozdiel medzi M4 a M5 je minimálny pri normálnych použiteľných modeloch. Test od Alexa som videl predvčerom ale testoval 4B modely - hádam nemyslíš, že v datacentrách pre LLM bežia 4B parametrové QWEN-y ? 4B model je použiteľný na úplne najjednoduchšie úlohy (napríklad mne osobne akurát tak vytvára názvy sessions podľa obsahu pre agenta).Murosik napísal: ↑Ne 16 08, 2026 6:01 pm
Ešte zo srandy doplnim apple procesory M4 vs M5. Nejde o procesor primárne pre datacentrá.
Napríklad:
https://www.youtube.com/watch?v=h8_4G2Zs_z8
Spracovanie promptu – skok o 274 %. Generácia odpovede je rýchlejšia len o viac ako 30%.
Aktuálne používané modely majú 1,5T alebo viac parametrov. Na coding (kde ide čisto o programovací jazyk, čo je tá najjednoduchšia disciplína LLM, lebo programovacie jzyky majú pevné pravidlá), používam modely od 80B do 150B (miliárd parametrov), čo s pamäťou pre kontext potrebuje 128 až 256GB RAM v GPU. Pamäť je podstatná a preto napríklad v A100 sa po dvoch rokoch zdvojnásobila a predáva sa do dnes, čo som uvádzal príklad.
To ako keby si povedal, že zvýšil sa výkon GPU karty, lebo som kúpil druhú a teda dve mi dávajú raz taký výkon ako tá jedna, čo som mal. Čo je síce pravda, že dve sú rýchlejšie ako jedna, ale samozrejme dve majú raz takú spotrebu ako jedna a teda nejedná sa o žiadnu inováciu hardvéru ale len o pridanie počtu kariet. A tak si 100% pokrok v čipoch nepredstavujem, lebo nie je žiadny.
-
Murosik
- Gold Member **
- Príspevky: 349
- Dátum registrácie: So 20 11, 2021 8:44 pm
- Has thanked: 78 times
- Been thanked: 70 times
Re: FACEBOOK - META
To vlastne dost klames.miror napísal: ↑Po 17 08, 2026 7:23 am
Zavádzal si vlastne vo všetkom o M4 M5, lebo debata bola o GPU kartách pre AI a ty si uviedol príklad na zrýchlení na počítačových procesoroch M4 a M5 a to je blbosť. Vysvetlím - Apple Silicon (procesory Mx) je navrhnutý ako všeobecný procesor pre počítače, ktorý ma integrovaú grafiku (grafické výpočtové jadrá). Takže je to nie špeciálny procesor na AI ale všeobecný viacúčelový procesor, ktorý vďaka integrovanej pamäti s rýchlosťou ako pamäte GPU má lepšiu pamäťovú priepustnosť (okrem ďalších vecí ako napr. ARM architektúra). Ak pridáme ďalšie jadrá GPU, tak samozrejme výkon stúpne ale to nie je vývoj - lepšia efektívnosť ale pridanie ďalších jadier za ceny vyššej spotreby.
To ako keby si povedal, že zvýšil sa výkon GPU karty, lebo som kúpil druhú a teda dve mi dávajú raz taký výkon ako tá jedna, čo som mal. Čo je síce pravda, že dve sú rýchlejšie ako jedna, ale samozrejme dve majú raz takú spotrebu ako jedna a teda nejedná sa o žiadnu inováciu hardvéru ale len o pridanie počtu kariet. A tak si 100% pokrok v čipoch nepredstavujem, lebo nie je žiadny.
Vratme sa o par prispevkov vyssie. Cize tam, kde som vymenoval niekolko vypoctovych jednotiek urcenych od nvidie, jtore si sam spominal a ich profesionalne testy. Logycky a stylyticky, celkom zroumitelne som svoj prispevok ukoncil. Az neskor som tam doplnil jedno youtibe video (co asi sotva niekto povazuje za odborny zdroj) a to s popisom
Ak si to napriek tomu nepochopil. Vyberies si len jednu poslednu (dodatocne doplnenu cast) ktoru este aj skomolis. Nie je o com. Asi nie sme na jednej mentálnej vlne.Ešte zo srandy doplnim apple procesory M4 vs M5. Nejde o procesor primárne pre datacentrá.
Napríklad:
Mimochodom. Klames aj o tom, ze M procesory nie su pre AI datcentra. Lebo Apple ich tam vo veľkom nasadil. Ak sa pamatam, tak konkretne M2 procerory. To len ako dodatok. Ale teraz dost podstatny.
No a aby som nemal len velkohube tvrdenia, ktore nicim nepodlozim, tak ostanem pri svojom dobrom zvyku a aj toto svoje tvrdenie podporim nepriamim zdrojom (kto ma zaujem najde si ich desiatky priamych).
https://finance.yahoo.com/technology/ai ... KOAdnh2JIH
-
miror
- Platinum Member ***
- Príspevky: 907
- Dátum registrácie: Ut 06 04, 2021 9:13 pm
- Has thanked: 69 times
- Been thanked: 292 times
Re: FACEBOOK - META
Áno, nie sme na jednej vlne, keďže som do tejto problematiky ponorený hlbšie a len neprechádzam okolo čítaním správ.Murosik napísal: ↑Po 17 08, 2026 11:14 am
Mimochodom. Klames aj o tom, ze M procesory nie su pre AI datcentra. Lebo Apple ich tam vo veľkom nasadil. Ak sa pamatam, tak konkretne M2 procerory. To len ako dodatok. Ale teraz dost podstatny.
No a aby som nemal len velkohube tvrdenia, ktore nicim nepodlozim, tak ostanem pri svojom dobrom zvyku a aj toto svoje tvrdenie podporim nepriamim zdrojom (kto ma zaujem najde si ich desiatky priamych).
https://finance.yahoo.com/technology/ai ... KOAdnh2JIH
Apple nemá žiadnu AI, nemá žiadne svoje modely. Už niekoľko rokov sa na WWDC vyhýba tejto otázke, lebo nemá čo ponúknuť a predbehol ho aj google, ktorý nasadil svoju AI Gemini do svojich telefónov. Apple ich doteraz nemal. Až teraz po dvoch rokoch od google nasadenia do android má svoju "vylepšenú" Siri AI, ktorá ale na prekvapenie pracuje s čím ? S Gemini - modelom Google. Takže to že Apple dáva svoje čipy do svojich datacentier je pekné, ale pre datacentrá inak nie sú. A sú to vôbec datacentá pre AI ? Lebo Apple má hlavne datacentrá na svoje iné služby, nie AI, tých je zatiaľ minimálne.
M-kové čipy Apple Silicon sú skvelé pre retail a domácich používateľov AI, kedy je všetko v jednom (CPU,GPU,RAM,SSD) ale pre datacentrá sú drahé - neefektívne, lebo v cene M čipu kupuješ aj klasické procesorové jadrá, ktoré nepotrebuješ. Preto ich nasádzajú len u seba, lebo majú veľkú zásobu pokazených čipov, ktoré nemôžu predať (niektoré jadrá sú chybné) - mimochodom to je aj dôvod, prečo uviedli na jar superlacný (na Apple) notebook NEO, ktorý používa "čipy z iPhone", čo sú vlastne pokazené iPhonové čipy s menším počtom jadier. Keď sa čip nepodarí, pokazené jadrá deaktivujú a dajú do lacnejších produktov alebo použijú u seba v datacentre.
