Hejto.pl
Dodaj post

Wpisz coś do wyszukania (minimum 2 znaki)

#nvidia

Autorytet

w Technologia

12piorunów

Wklejam tekst mireczka, bo ciekawy.

https://wykop.pl/wpis/79949463/o-co-chodzi-z-deepseek-juz-tlumacze-najpierw-troch

O co chodzi z #deepseek ? Już tłumaczę!

Najpierw trochę kontekstu: Obecnie trenowanie najlepszych modeli AI jest NIEWYOBRAŻALNIE drogie. OpenAI, Anthropic i inne firmy wydają ponad 100 milionów dolarów tylko na moc obliczeniową. Potrzebują ogromnych centrów danych z tysiącami kart GPU wartych po 40 tysięcy dolarów każda. To jak posiadanie całej elektrowni tylko po to, aby zasilić fabrykę.
DeepSeek właśnie się pojawił i powiedział: „LOL, a co jeśli zrobimy to za 5 milionów dolarów zamiast tego?”. I nie tylko o tym mówili – oni to naprawdę ZROBILI. Ich modele dorównują GPT-4 i Claude'owi lub przewyższają je w wielu zadaniach
Jak? Przemyśleli wszystko od podstaw. Tradycyjne AI jest jak zapisywanie każdej liczby z dokładnością do 32 miejsc po przecinku. DeepSeek stwierdził: „A co, jeśli użyjemy tylko 8? Wciąż będzie wystarczająco dokładne!”. Bum – o 75% mniej pamięci potrzebne.
A potem jest ich system „multi-token”. Normalne AI czyta jak pierwszoklasista: „Kot... siedzi... na...”. DeepSeek czyta całe frazy naraz. Dwa razy szybciej, 90% tej samej dokładności. Przy przetwarzaniu miliardów słów to MA ZNACZENIE.
Rezultaty są oszałamiające:
- Koszt treningu: 100 mln $ → 5 mln $
- Liczba potrzebnych GPU: 100 000 → 2 000
- Koszty API: 95% taniej
- Może działać na gamingowych GPU zamiast sprzętu z centrów danych
„Ale zaraz,” możesz powiedzieć, „musi być jakiś haczyk!”. I tu jest ta niesamowita część – wszystko jest open source. Każdy może sprawdzić ich pracę. Kod jest publiczny. Dokumenty techniczne wyjaśniają wszystko. To nie magia, tylko niezwykle sprytna inżynieria.
Dlaczego to ma znaczenie? Bo łamie model, w którym „tylko wielkie firmy technologiczne mogą działać w AI”. Nie potrzebujesz już centrum danych wartego miliardy dolarów. Wystarczy kilka dobrych GPU.
Dla Nvidii to przerażające. Cały ich model biznesowy opiera się na sprzedaży superdrogich GPU z marżą na poziomie 90%. Jeśli nagle każdy będzie mógł robić AI na zwykłych gamingowych GPU... no cóż, widać, gdzie leży problem.
To klasyczna historia o disruptorach: obecni liderzy optymalizują istniejące procesy, podczas gdy disruptorzy przemyślają fundamentalne podejście. DeepSeek zadał pytanie: „A co, jeśli po prostu zrobimy to mądrzej, zamiast rzucać w to więcej sprzętu?”.
Konsekwencje są ogromne:
- Rozwój AI staje się bardziej dostępny
- Konkurencja rośnie dramatycznie
- „Fosy” dużych firm technologicznych zaczynają wyglądać jak kałuże
- Wymagania sprzętowe (i koszty) gwałtownie spadają

Ostatnia myśl: To wygląda na jeden z tych momentów, do których będziemy wracać jako punkt zwrotny. Jak wtedy, gdy komputery osobiste uczyniły mainframe'y mniej istotnymi, czy kiedy chmurowe obliczenia zmieniły wszystko.
AI zaraz stanie się o wiele bardziej dostępne i znacznie tańsze. Pytanie nie brzmi, czy to zakłóci rynek, ale jak szybko.

Gruba ryba7piorunów

Mam wrażenie że to już czytałem, i to nie na wypoku

GURU2piorunów

Czyli w sumie to że USA ma nas w 2 kategorii nie ma takiego znaczenia?

Pokaż więcej komentarzy (12)

GURU

w Hydepark

203piorunów

DeepSeek – firma, która zrewolucjonizowała proces trenowania modeli AI, redukując koszty o ponad 95%, a jednocześnie osiągając wyniki porównywalne z najlepszymi modelami, takimi jak GPT-4 czy Claude.

Jak to zrobili? Przez całkowite przemyślenie dotychczasowych założeń i procesów.
Tradycyjne trenowanie modeli AI to koszmar pod względem kosztów. OpenAI czy Anthropic wydają ponad 100 milionów dolarów tylko na moc obliczeniową, wykorzystując ogromne centra danych z tysiącami drogich procesorów graficznych (GPU).
Tymczasem DeepSeek udowodnił, że można to zrobić za jedyne 5 milionów dolarów.

Kluczowe innowacje DeepSeek:
- Efektywne zarządzanie pamięcią:
   Tradycyjne modele AI przechowują dane na 32bitach, co wymaga ogromnych zasobów pamięci. DeepSeek zapytał: "Ale dlaczego 32? W zupełności wystarczy 8", pozwoliło to na zmniejszenie wymagań pamięci o 75%.
- System „multi-token”:
   Zamiast przetwarzać tekst słowo po słowie jak klasyczne LLM "Wróbel... siedział... na...", DeepSeek analizuje całe frazy na raz. To sprawia, że proces jest dwa razy szybszy przy zachowaniu 90% dokładności.
- System ekspertów (MoE - Mixture of Experts):
   Zamiast jednego ogromnego modelu uruchomionego CAŁY CZAS, DeepSeek wprowadził system wyspecjalizowanych modeli. Każdy z nich uruchamiany jest tylko wtedy, gdy jest potrzebny, co drastycznie zmniejsza ilość aktywnych parametrów (671 miliardów ale tylko 37 miliardów aktywnych na raz). Nie jest po pomysł nowy (używany wcześniej między innymi w modelach Mixtral) ale pierwszy raz zastosowany w tej skali

Rezultaty?
- Koszt trenowania spadł z 100 milionów do 5 milionów dolarów.
- Liczba potrzebnych GPU zmniejszyła się z 100 000 do 2 000.
- Koszty API są niższe o 95%.
- Modele mogą być uruchamiane na standardowych GPU dla graczy zamiast drogich GPU serwerowych.

Co ważne, DeepSeek postawił na otwartość. Kod i dokumentacja są publicznie dostępne, co otwiera drzwi dla mniejszych firm i indywidualnych innowatorów.

Dlaczego to ma znaczenie?
Demokratyzacja AI
   Dotychczas tylko najwięksi gracze z ogromnymi budżetami mogli trenować zaawansowane modele. Teraz proces ten staje się dostępny dla mniejszych podmiotów.

Zagrożenie dla dużych firm
Nvidia, dominujący dostawca GPU, może odczuć konsekwencje, gdyż ich model biznesowy opiera się na sprzedaży drogich procesorów z ogromną marżą.

Nowa fala innowacji
Mniejsze wymagania sprzętowe i finansowe oznaczają większą konkurencję, co może przyspieszyć rozwój całej branży.

Podsumowując, DeepSeek zadał pytanie: „Co, jeśli zamiast rzucać coraz więcej sprzętu, po prostu zoptymalizujemy proces?”
Odpowiedzią są przełomowe wyniki, spadek kursu NVIDIA na giełdzie i PANIKA w meta i OpenAI

Fanatyk1piorunów

@entropy_ nigdy nie jest tak że ma się cudowne dziecko. O wadach tu nic nie ma. Natomiast tak. Będzie dochodzić do optymalizacji kosztów.

Nie ma żadnej paniki. Bez przesady. Większość spółek na gieldzie jest przeszacownych i to mocno. Szczególnie aktualnie nvidia

Pokaż więcej komentarzy (76)

Gruba ryba

w Komputery

4piorunów


Muszę Wam powiedzieć, że jestem pod dużym wrażeniem co Ngreedia zrobiła z tym nowym DLSS4 transformacyjnym. Niebo a ziemia gdzie w DLSS3 1080p + skalowanie na quality wyglądało jak gówno a teraz koła mi siadły, no rewelacja. Jest kilka niedoróbek jak na przykład mocny shimmering np. drzew i liści ale jak się ten ich superkomputer podszkoli to może być niemal idealnie. Spadek wydajności to tak z 10% u mnie na RTX 3060 12gb ale poprawa jakości obrazu i ostrości w ruchu to tak z 99%. Mowa oczywiście o Cyberbugu 2077 bo to pierwsza gierka w której to dali.

Fanatyk0piorunów

@Jim_Morrison myślałem, że dlss4 miało być ekskluzywne tylko dla serii rtx5000. Fajnie, że dziala ze starszymi generacjami.

Pokaż więcej komentarzy (2)

Gruba ryba

w Hydepark

15piorunów

Uuuuuuuuuu :upside_down_face:
Bantustan i kraj pośledni drugiej kategorii. To juz oficjalne. :melting_face:
Tu dla Ciebie pomarancza! :peach:
To tylko pokazuje, ze ciagle gramy w innej lidze sojusznikow USA, jesli komus zdawalo sie kiedykolwiek inaczej :upside_down_face:

Gruba ryba3piorunów

Szwajcaria tier 2? XD wtf

Gruba ryba0piorunów

Jest nawet artykuł w reutersie

Pokaż więcej komentarzy (12)

Fanatyk

w Komputery

12piorunów

https://www.zdnet.com/article/thanks-to-nvidia-theres-a-new-generation-of-pcs-coming-and-theyll-be-running-linux/

GURU3piorunów

Oho widac boja sie, steam os za rogiem à tam weszystko gotowe pod amd, ha tfu korporacyjne swinie z nvidi, za pozno, o wiele za pozno. Niech wrwcaja do sprzedawania srednich kart za krocie gigantom od ai, ja umre jak zylem: czerwony!

Autorytet0piorunów

Rok Linuxa!

Pokaż więcej komentarzy (6)

Gruba ryba

w AI

5piorunów

Wyciekły zdjęcia kolejnej generacji kart RTX 6090. Mnie przekonali tymi wiatraczkami odpuszczam serie 50xx.

Gruba ryba10piorunów

@Spider z dalszych informacji:

* wymagane podpięcie pod gniazdko 3-fazowe
* zalecany proszkowy system gaśniczy
* wymagana mechaniczna wentylacja pomieszczenia

xD

GURU2piorunów

kurde kiedyś to były komputery jeden wiatraczek nie licząc tego w zasilaczu i wszystko śmigało

Pokaż więcej komentarzy (11)

Fanatyk

w Hydepark

11piorunów

Gruba ryba4piorunów

You can't polish a turd.
Nie, 120fps interpolowane z 30fps nie mają takiej responsywności jak prawdziwe 120fps tylko jak właśnie 30fps. Jedyna różnica to płynność ale wtedy tworzy się dysproporcja pomiędzy tym co widzimy a tym co czujemy. W czystej wydajności RTX5070 = 4070 super.

Pokaż więcej komentarzy (2)

Gruba ryba

w Komputery

11piorunów

No to mamy nowe RTX 5000,

Ceny sugerowane:
RTX 5090 - Od 10 299 złotych
RTX 5080 - Od 5199 złotych
RTX 5070 Ti - od 3899 złotych
RTX 5070 - od 2849 złotych

Co w paczce?
Delikatnie zwiększona rasteryzacja,
2x większa wydajność dla RT,
Multi frame generator,
Reflex 2.0,
Nowy DLSS4.0 który z wyjątkiem multi frame generatora będzie dostępny też dla starszych RTX,
Cena kosmos,
Niemal ten sam proces technologiczny co poprzednia generacja,
Nowe złącze zasilające 12V-2x6 (do 600W na jednej wtyczce),
Topowy model 5090 o poborze mocy 575W ༼ ͡° ͜ʖ ͡° ༽
Pierwsze testy po 21 stycznia.

Osobistość2piorunów

@Marchew po co dwa złącza zasilania, skoro jedynie pół kilowat ciągnie? I ta cena... no prawie darmowe ogrzewanie do domu

Gruba ryba1piorunów

Z tymi 26fps zwiększonymi do ponad 200 to oni tak na serio? Ultra performance dlss nawet przy 4k wygląda słabo a interpolacja z 26 do 235fps moim zdaniem nie będzie mogła zwyczajnie dać poczucia większej responsywności. Co mi po płynnośći 235fps kiedy input lag pozostanie na poziomie 26fps? To będzie imo uczucie jakby człowiek był na⁎⁎⁎⁎ny a do tego płynął łodzią. No jest płynnie ale kontrola, jaka k⁎⁎wa kontrola? Sam czasem korzystam z framegen ale to nie ma zbyt wiele wspólnego z prawdziwym wysokim fps. Dysproporcja pomiędzy płynnością a responsywnością jest po prostu duża i czuć to mocno., nie ma się co czarować. NVIDIA reflex? Srefleks, k⁎⁎wa bo to było dostępne od lat i zwyczajnie polegało na zmniejszeniu ilości pre renderowanych klatek a jak ustawiało się to na 0 to efektem często był micro stutter i inne takie co właśnie miało miejsce kiedy ostatnio grałem w Horizon FW. Cuda nie istnieją i zawsze jest coś za coś i żadne bajki opowiadane przez pana w kurteczce tego nie zmienią. Tak, framegen i DLSS są fajne ale zawsze będą gorsze niż zwyczajnie wysoki fps i wysoka natywna rozdzielczość z za⁎⁎⁎⁎stym anti aliasingiem (tutaj przyznam, że dlaa robi robotę choć niestety też rozmywa obraz za bardzo w ruchu). Także nie, ficzery fajne ale brutalna moc zawsze będzie lepsza.

Pokaż więcej komentarzy (16)

Osobistość

w PC Master Race

6piorunów

Jak tam hejterzy, hajs już nazykowany na RTX 5090? ( ͡° ͜ʖ ͡°) Myślę że bez minimum 10k się nie obejdzie.

Może w końcu da się odpalić pathtracing w 1440p z sensownym FPS bez skalowania.

Fanatyk0piorunów

Panie za tyle to mam trzy stimdeki

GURU0piorunów

@NrmvY 32gb vram i 680tensorcores to się opłaca kupić za 10k

Pokaż więcej komentarzy (8)

Fanatyk

w Hydepark

5piorunów

Pamiętacie jak w 2020 roku wyszła seria RTX 30XX, ceny były po⁎⁎⁎⁎ne a dostępność znikoma? Kumpel zamówił 3080, zapłacił, czekał 6 czy 8 miesięcy i w końcu mu anulowali zamówienie xD

Gruba ryba3piorunów

Produkcja modeli 4080 oraz 4090 zostanie zakończona przed grudniem 2024. Obecnie modelu 4090 już praktycznie nie ma w sprzedaży. W styczniu 2025 ruszy sprzedaż serii 5080 oraz 5090.

Kosmonauta0piorunów

@GucciSlav odczekałem swoje i kupiłem 3070 za 1700zł rok temu. W czasie pandemii cena dochodziła do 10k...

Pokaż więcej komentarzy (5)

Gwiazdor

w Hydepark

3piorunów

Robię sobie pod górkę (tj. tłok), ale co mi tam. Niech się dzieje wola nieba. Zawiadamiam wszem i wobec, że 26 października jest planowana warszawska edycja warsztatów "czarodzieje kodu":
https://www.czarodziejekodu.pl/warszawa2024/
Jest to nowa inicjatywa, która pozwala na naukę programowania najmłodszym. Grupy od 6 do 14 roku życia.

Dla tych, którzy nie wierzą deklaracjom prezesa i chcą żeby ich dzieciaki (podobnie jak dzieciaki prezesa nvidii) liznęły coś z programowania.
W szkole córki informatyka to głównie granie w jakieś robobloki, a scratch idzie jedynie jak siedzę z młodą. Na warsztatach nie będzie już zmiłuj, ani roboloka. ( ͡° ͜ʖ ͡°)

Fanatyk1piorunów

@splatch - Scratcha też nie powinno być - to już lepiej pokazać im GDevelop.

Osobistość

w PC Master Race

37piorunów

Po 9 latach spełniłem swoje marzenie ze studiów i kupiłem GTX Titan X xD

Osobistość2piorunów

Fabryczne karty nVidii są świetne od strony estetycznej. Jakbym mógł, to miałbym kolekcję ich kart tylko po to, by postawić je na regale.

Ile PLN za Titana?

Fanatyk2piorunów

@NrmvY potrzymaj to teraz 15 lat, będzie retro ( ͡° ͜ʖ ͡°)

Pokaż więcej komentarzy (29)

Gruba ryba

w PCMasterRace

11piorunów

Kurteczka powiedział "frame generation działa tylko na serii rtx4xxx bo ta technologia wymaga dedykowanych rdzeni w gpu". Inaczej się, k⁎⁎wa, nie da. I teraz przychodzi takie AMD, które tego nie wiedziało i robi to dla większości kart graficznych. Początki co prawda były trudne bo w Forspoken i Aveum działało to mocno średnio ale odpalam niedawno na mojej upośledzonej RTX 3060 12gb Ghost Of Tsushima w której mamy już Fsr 3.1 i z miejsca pojawia mi się banan na twarzy. Framegen? Działa. VRR? Działa a synchronizacja fps z odświeżaniem monitora idealna. Artefakty? Nie więcej niż na DLSS framegen które to jakiś czas temu testowałem, czyli rzecz w ruchu niemal niedostrzegalna. Input lag? Jestem na niego jeszcze bardziej wyczulony niż na artefakty i grając na padzie nie widzę znaczącej różnicy w porównaniu do framegen na off. Wczoraj Horizon dostało łatkę i tam działa to jeszcze lepiej. Nie da się, panie Jensen, nie da się więc zaraz lecę po kastrata RTX 4060 z 8gb vram które to już od dłuższego czasu nie wystarcza do 1080p w 3/4 nowych gier a moją 3060 wypierdalam do kosza. Konkurencja - coś, czego wielu fanboyów nie lubi i jednocześnie najkorzystniejsza sytuacja dla nich samych.

Fanatyk1piorunów

@Jim_Morrison skórzany chłop powiedział, że się nie da, uwierzył mu nikt, ale to nieważne bo w świat poszedł komunikat "Chcesz DLSS w nowych grach? Kup RTX4xxx bo staroci nie wspieramy"

I poszli ludzie i kupili (ja w sumie też xD).

Osobistość1piorunów

@Jim_Morrison to wszystko jest tym bardziej komiczne biorąc pod uwagę fakt, że w takim cyberpunku ghosting przy DLSS jest tragiczny, a w wiedźminie 3 przy DX12 to w ogóle gra mi się wysypuje i muszę grać na DX11 pomimo, że powinienem się cieszyć z RT (który jest prawie niezauważalny xD)
dziękuję pan kurteczka.
marketing NoVideo to jest majstersztyk, a przy pomocy paru aktywnych trolli i oddanych fanów to już można niemal wszystko

Pokaż więcej komentarzy (5)

Lider

w Programowanie

14piorunów

:green_book:
>Pracownicy, którzy dołączyli do Nvidia 5 lat temu, są teraz milionerami i prowadzą życie na "półemeryturze"
>Nvidia (NASDAQ: NVDA) odnotowała niesamowity wzrost w ostatnich latach. Od początku 2024 roku akcje firmy wzrosły o 167%. W ciągu ostatnich pięciu lat wzrosły o imponujące 3,450%.
https://finance.yahoo.com/news/employees-joined-nvidia-5-years-160012281.html

W sumie ciekawy problem.

Źródło: https://www.tiktok.com/@trading101/video/7384254329965792555

Kosmonauta1piorunów

W sumie ciekawe ilu jest takich pracowników co mają te ponad 10 000 000 $ w akcjach. Załóżmy że jakieś 10% wszystkich tam pracujących. Jak sprzedaż takiej ilości akcji wpłynie na cenę Nvidii na giełdzie oraz co się stanie jęzeli te osoby powiedzą: pi⁎⁎⁎⁎le nie robię na tego prywaciarza złodzieja i pójdzie leżeć na trawkę pindolem do góry.

Pokaż więcej komentarzy (3)