Gpu co to jest i jak funkcjonuje nowoczesny procesor graficzny

GPU czyli jednostka przetwarzania graficznego

Kompendium wiedzy o procesorach graficznych, ich architekturze, ewolucji od prostych akceleratorów po fundamenty systemów sztucznej inteligencji i zaawansowanych symulacji naukowych.

Istota i definicja procesora graficznego

GPU (Graphics Processing Unit) to wysoce wyspecjalizowany układ scalony zaprojektowany w celu szybkiej manipulacji i zmiany pamięci, aby przyspieszyć tworzenie obrazów w buforze ramki przeznaczonym do wyświetlenia na urządzeniu wyjściowym. Choć pierwotnie ich rola ograniczała się do generowania grafiki komputerowej, dzisiejsze jednostki stanowią kręgosłup obliczeń równoległych.

Współczesna technologia procesorów graficznych opiera się na zdolności do jednoczesnego wykonywania tysięcy wątków, co odróżnia je od klasycznych procesorów centralnych. Dzięki tej charakterystyce jednostki te znajdują zastosowanie w:

Renderowaniu fotorealistycznym w czasie rzeczywistym
Trenowaniu złożonych sieci neuronowych
Przetwarzaniu ogromnych zbiorów danych (Big Data)
Kryptografii i zabezpieczeniach sieciowych

Architektura rdzeni i moc obliczeniowa

Główną różnicą między CPU a GPU jest filozofia projektowania. CPU jest zoptymalizowane pod kątem szeregowego wykonywania zadań z naciskiem na minimalizację opóźnień pojedynczego wątku. GPU natomiast stawia na przepustowość, poświęcając wydajność pojedynczego rdzenia na rzecz ich ogromnej liczby.

Przewaga skali

Podczas gdy nowoczesny procesor centralny dysponuje kilkunastoma potężnymi rdzeniami, procesor graficzny może posiadać ich tysiące. Pozwala to na dzielenie problemu matematycznego na maleńkie fragmenty i rozwiązywanie ich równolegle.

„GPU nie jest szybsze od CPU w każdym zadaniu, jest po prostu znacznie szersze.”

Hierarchia przepływu danych w modelu SIMT

Zadanie obliczeniowe (Grid)
Blok wątków
Blok wątków
Wątek
Wątek
Wątek
Wątek

Model Single Instruction Multiple Threads (SIMT) pozwala na wykonywanie tej samej operacji na różnych danych przez wiele jednostek wykonawczych jednocześnie.

Pamięć wideo i jej znaczenie

VRAM (Video Random Access Memory) to dedykowana pamięć procesora graficznego. W przeciwieństwie do systemowego RAM-u, musi ona cechować się ekstremalnie wysoką przepustowością, aby nadążyć za zapotrzebowaniem tysięcy rdzeni na dane.

Na wykresie przedstawiono korelację między przepustowością a efektywnością nowoczesnych standardów pamięci. Pamięci typu HBM wykorzystują pionowe układanie stosów krzemowych, co pozwala na osiągnięcie niespotykanych dotąd prędkości transferu przy zachowaniu kompaktowych rozmiarów układu.

Metody generowania obrazu

Rasteryzacja tradycyjna

Proces przekształcania grafiki wektorowej w obrazy rastrowe (piksele). Jest to metoda niezwykle szybka, oparta na rzutowaniu wielokątów na płaszczyznę ekranu. Idealnie sprawdza się w aplikacjach wymagających wysokiej responsywności.

Śledzenie promieni (Ray tracing)

Zaawansowana technika symulująca fizyczne zachowanie światła. Pozwala na generowanie realistycznych cieni, odbić i załamań światła. Wymaga dedykowanych jednostek obliczeniowych ze względu na ogromną liczbę obliczeń matematycznych na sekundę.

Obszerne pytania i odpowiedzi

Jaka jest kluczowa różnica między GPU a kartą graficzną?

Terminy te są często używane zamiennie, jednak technicznie GPU to sam układ scalony (procesor), który znajduje się na płytce drukowanej karty graficznej. Karta graficzna to kompletne urządzenie, które obejmuje GPU, pamięć VRAM, system zasilania oraz układ chłodzenia. GPU jest „mózgiem”, a karta graficzna „ciałem” całego systemu.

Czy do pracy biurowej potrzebne jest dedykowane GPU?

W przypadku standardowych zadań biurowych, takich jak przeglądanie internetu czy edycja dokumentów, w zupełności wystarcza zintegrowany procesor graficzny. Jest on wbudowany bezpośrednio w CPU i korzysta z systemowej pamięci RAM. Dedykowane jednostki są niezbędne dopiero przy pracy z wideo, projektowaniem 3D lub grami.

Jaką rolę odgrywa GPU w rozwoju sztucznej inteligencji?

Sztuczna inteligencja, a w szczególności głębokie uczenie, opiera się na operacjach na macierzach. GPU dzięki swojej równoległej naturze potrafi wykonywać miliony takich operacji jednocześnie, co skraca czas trenowania modeli z miesięcy do dni. Bez mocy obliczeniowej procesorów graficznych obecny postęp w dziedzinie AI nie byłby możliwy.

Czym jest zjawisko throttlingu w procesorach graficznych?

Throttling to mechanizm zabezpieczający, który obniża taktowanie zegara GPU w momencie osiągnięcia krytycznej temperatury. Ma to na celu zapobieganie trwałemu uszkodzeniu układu. Aby go unikać, kluczowe jest zapewnienie odpowiedniego przepływu powietrza w obudowie oraz regularna konserwacja systemu chłodzenia.

Dlaczego przepustowość pamięci jest ważniejsza od jej ilości?

Ilość pamięci (np. 12 GB) określa, jak duże zbiory danych GPU może przechowywać „pod ręką”. Przepustowość natomiast decyduje o tym, jak szybko te dane mogą być przesyłane do rdzeni obliczeniowych. Nawet ogromna ilość pamięci nie pomoże, jeśli wąska szyna danych spowoduje, że rdzenie będą bezczynnie czekać na instrukcje.

Jakie są perspektywy rozwoju technologii GPGPU?

GPGPU (General-Purpose computing on Graphics Processing Units) to trend wykorzystywania mocy karty graficznej do zadań ogólnych. W przyszłości spodziewamy się jeszcze ściślejszej integracji oprogramowania ze sprzętem, gdzie algorytmy będą automatycznie decydować, która część kodu powinna zostać wykonana na CPU, a która na GPU, optymalizując zużycie energii.

Czy ray tracing wpływa na żywotność sprzętu?

Używanie zaawansowanych technik takich jak śledzenie promieni w żaden sposób nie skraca życia procesora graficznego, o ile temperatury pozostają w normie. Jest to po prostu intensywne zadanie obliczeniowe, do którego nowoczesne jednostki zostały w pełni przystosowane.

GPU co to i dlaczego jest kluczowe w nowoczesnej informatyce. Wszelkie dane techniczne mają charakter edukacyjny i opierają się na standardach branżowych.

Analizując specyfikacje współczesnych urządzeń elektronicznych, od smartfonów po zaawansowane stacje robocze, użytkownicy często napotykają na terminy techniczne, które mogą wydawać się skomplikowane. Jednym z najczęstszych pytań w kontekście sprzętu komputerowego brzmi: gpu co to właściwie oznacza i jaka jest jego rola w architekturze systemu? Skrót GPU (Graphics Processing Unit) określa procesor graficzny, czyli wyspecjalizowaną jednostkę obliczeniową, której pierwotnym celem było przyspieszenie procesu renderowania i wyświetlania obrazu na ekranie monitora1. Wraz z postępem technologicznym, rola tego układu ewoluowała w sposób bezprecedensowy. Współczesne układy graficzne przestały być wyłącznie narzędziami do rysowania wielokątów, stając się potężnymi silnikami obliczeniowymi, które napędzają rozwój sztucznej inteligencji, uczenia maszynowego oraz skomplikowanych symulacji naukowych3.

Rozwój ten wynika bezpośrednio ze specyficznej budowy procesorów graficznych, która została zoptymalizowana pod kątem masowego przetwarzania równoległego. W przeciwieństwie do tradycyjnych procesorów ogólnego przeznaczenia, które doskonale radzą sobie z wykonywaniem złożonych sekwencji instrukcji, procesory graficzne potrafią przetwarzać ogromne zbiory danych w tym samym czasie, rozwiązując tysiące niezależnych od siebie problemów matematycznych w ułamku sekundy5.

Zasadnicza różnica między cpu a gpu

Aby w pełni zrozumieć architekturę i przeznaczenie procesora graficznego, niezbędne jest zestawienie go z procesorem centralnym, czyli CPU (Central Processing Unit). Obie te jednostki są niezbędne do prawidłowego funkcjonowania komputera, jednak reprezentują dwa zupełnie odmienne paradygmaty inżynieryjne. Procesor centralny jest zaprojektowany do minimalizowania opóźnień (latency) w wykonywaniu pojedynczych zadań7. Posiada on relatywnie niewielką liczbę niezwykle wydajnych i rozbudowanych rdzeni (zazwyczaj od kilku do kilkudziesięciu), które potrafią szybko przełączać się między różnorodnymi zadaniami systemu operacyjnego, zarządzać bazami danych i obsługiwać zaawansowaną logikę warunkową6.

Z kolei architektura GPU jest zorientowana na maksymalizację przepustowości (throughput). Procesor graficzny składa się z setek, a nawet tysięcy mniejszych i prostszych rdzeni obliczeniowych1. Dobrą analogią jest wyobrażenie sobie procesora centralnego jako elitarnego zespołu inżynierów, z których każdy potrafi zbudować cały samochód od podstaw, podczas gdy procesor graficzny przypomina ogromną linię montażową, na której tysiące robotników wykonują jednocześnie proste, powtarzalne czynności, co w efekcie pozwala na masową produkcję w niezwykle krótkim czasie4.

Cecha charakterystycznaProcesor centralny (CPU)Procesor graficzny (GPU)
Model przetwarzania danychprzetwarzanie sekwencyjne o niskim opóźnieniumasowe przetwarzanie równoległe (wysoka przepustowość)
Architektura rdzeniod kilku do kilkudziesięciu bardzo złożonych rdzenisetki do kilkunastu tysięcy uproszczonych rdzeni
Zastosowanie sprzętowelogika systemowa, bazy danych, zróżnicowane instrukcjerendering grafiki, uczenie maszynowe, obliczenia macierzowe
Zarządzanie pamięciąwspółdzielona pamięć systemowa, duże bufory cache L3dedykowana pamięć o gigantycznej przepustowości

W systemach komputerowych obie te jednostki ściśle ze sobą współpracują. Procesor centralny inicjuje zadania, zarządza pamięcią systemową i wydaje instrukcje, podczas gdy procesor graficzny odbiera te polecenia i wykonuje najcięższe, zrównoleglone obliczenia matematyczne8. Jeżeli dany program polega głównie na logice liniowej i nie wykazuje cech niezależności danych, jego wykonanie na GPU będzie nieefektywne, a głównym obciążeniem zostanie obarczony procesor centralny8.

Architektura procesorów graficznych i model obliczeń równoległych

Skuteczność procesorów graficznych w operacjach wielowątkowych opiera się na hierarchicznej, głęboko przemyślanej architekturze. Kluczowym blokiem konstrukcyjnym każdego nowoczesnego układu graficznego są multiprocesory strumieniowe (określane często skrótem SM). Pojedynczy procesor graficzny zawiera dziesiątki takich multiprocesorów, z których każdy dysponuje własnymi jednostkami wykonawczymi, rejestrami oraz lokalną pamięcią podręczną12. Wewnątrz nich znajdują się najmniejsze jednostki obliczeniowe – często nazywane rdzeniami CUDA lub procesorami strumieniowymi – wyposażone w jednostki arytmetyczno-logiczne (ALU) potrafiące wykonywać operacje na liczbach stałoprzecinkowych i zmiennoprzecinkowych5.

Tajemnica potęgi obliczeniowej GPU leży w modelu wykonywania instrukcji określanym jako SIMT (Single Instruction, Multiple Threads). Model ten ewoluował ze starszego podejścia SIMD (Single Instruction, Multiple Data), stosowanego wcześniej w wektorowych rozszerzeniach procesorów CPU14. W architekturze SIMT tysiące niezależnych wątków jest grupowanych w pakiety (tzw. wiązki lub warpy). Kiedy multiprocesor pobiera instrukcję, wysyła ją do wszystkich rdzeni przypisanych do danej wiązki, co sprawia, że wykonują one ten sam rozkaz matematyczny jednocześnie, ale na różnych zestawach danych7.

  • Zaletą modelu SIMT jest możliwość zachowania przez każdy wątek własnego kontekstu, co oznacza, że w przypadku natrafienia na instrukcję warunkową, wątki mogą podążyć różnymi ścieżkami, choć wiąże się to ze zjawiskiem tzw. dywergencji i chwilowym spadkiem wydajności12.
  • Sprzętowe harmonogramowanie wątków pozwala na bezkosztowe maskowanie opóźnień (latency hiding) – gdy jedna grupa wątków czeka na pobranie danych z pamięci, multiprocesor natychmiast przełącza się na inną gotową do pracy grupę, dzięki czemu jednostki obliczeniowe nigdy nie pozostają bezczynne7.

Hierarchia pamięci odgrywa tu kluczową rolę. Rdzenie współdzielą ultraszybką pamięć podręczną L1 oraz pamięć współdzieloną w obrębie danego bloku, a następnie komunikują się z globalną pamięcią podręczną L2, która z kolei jest połączona szeroką szyną z kontrolerami pamięci wideo5.

Pamięć vram oraz różnice między standardem gddr i hbm

Bez odpowiednio szybkiej pamięci, nawet najpotężniejsze rdzenie graficzne pozostawałyby bezczynne w oczekiwaniu na dane. Pamięć operacyjna karty graficznej, znana jako VRAM (Video Random Access Memory), różni się znacznie od systemowej pamięci RAM5. Jej priorytetem jest dostarczanie gigantycznych pakietów danych, takich jak wysokiej rozdzielczości tekstury, bufory głębi czy macierze sieci neuronowych, w możliwie najkrótszym czasie. Zapewnienie tak wielkiej przepustowości wymusiło rozwój wyspecjalizowanych technologii.

Na współczesnym rynku stosuje się głównie dwa podejścia do projektowania pamięci VRAM:

  1. Standard GDDR (Graphics Double Data Rate) – jest to dominujące rozwiązanie w konsumenckich urządzeniach i konsolach. Opiera się na płaskich kościach lutowanych bezpośrednio na laminacie płyty wokół układu graficznego. Kolejne generacje tej pamięci osiągają coraz wyższe częstotliwości taktowania i szersze interfejsy wymiany danych, wykorzystując także techniki bezstratnej kompresji, aby zmniejszyć zapotrzebowanie na przesył informacji13. Jest to technologia relatywnie tania i powszechna, lecz jej fizyczne ograniczenia zaczynają stanowić barierę w najbardziej zaawansowanych obliczeniach.
  2. Standard HBM (High Bandwidth Memory) – stworzony z myślą o profesjonalnych akceleratorach i superkomputerach. Zamiast umieszczać kości obok procesora, technologia HBM polega na układaniu warstw pamięci jedna na drugiej (wertykalnie) i łączeniu ich z rdzeniem za pomocą specjalnego interposera krzemowego18. Komunikacja przebiega przez mikroskopijne połączenia przelotowe (TSV), co pozwala na stworzenie magistrali o szerokości sięgającej kilku tysięcy bitów. Choć koszty produkcji układów HBM są bardzo wysokie, oferują one bezprecedensową przepustowość, redukcję opóźnień oraz zużywają znacznie mniej energii niż tradycyjne pamięci17.

Prognozy na nadchodzące lata sugerują dalszą rewolucję w architekturze pamięci warstwowej. Przyszłe iteracje standardu HBM mają nie tylko zwiększać pojemność i prędkość, ale także integrować logikę obliczeniową bezpośrednio w strukturze pamięci. Zjawisko to, polegające na przeniesieniu części obliczeń na poziom kości VRAM, pozwoli na odciążenie procesora centralnego i zminimalizowanie opóźnień w obsłudze gargantuicznych zestawów danych potrzebnych w nowoczesnych systemach uczenia głębokiego20.

Zintegrowana a dedykowana karta graficzna w zastosowaniach praktycznych

Wiedząc już, jak działa procesor graficzny, należy przyjrzeć się dwóm głównym formom, w jakich występuje on w urządzeniach elektroniki użytkowej. Architektury dzieli się powszechnie na rozwiązania zintegrowane oraz dedykowane, z których każde posiada odrębny zbiór wad, zalet i docelowych obszarów zastosowań.

Zintegrowana karta graficzna (często określana skrótem iGPU) to układ wbudowany bezpośrednio w krzem procesora centralnego lub umieszczony z nim w jednym fizycznym opakowaniu21. Najważniejszą cechą tego rozwiązania jest brak własnej, dedykowanej pamięci VRAM. Układ ten rezerwuje i współdzieli pamięć systemową RAM z procesorem, co stanowi naturalne ograniczenie dla jego wydajności21. Do niewątpliwych zalet układów zintegrowanych należy ekstremalnie niski pobór energii elektrycznej, marginalna emisja ciepła oraz niska cena końcowa urządzenia. Sprawia to, że stanowią one idealny wybór do cienkich, mobilnych ultrabooków, komputerów biurowych służących do przeglądania internetu i obsługi multimediów, a także prostszych gier22.

Dedykowana karta graficzna (dGPU) jest z kolei niezależnym, potężnym komponentem, montowanym zazwyczaj na płycie głównej za pośrednictwem złącza PCI Express23. Można ją traktować jako osobny podsystem komputerowy. Posiada ona własną, zaawansowaną sekcję zasilania, autorski system zarządzania termicznego (wentylatory, radiatory, a niekiedy bloki wodne) oraz własną pamięć VRAM (GDDR lub HBM)21. Dzięki całkowitej fizycznej niezależności, dedykowane jednostki dysponują wielokrotnie wyższą mocą obliczeniową, bez której niemożliwa byłaby płynna praca w zaawansowanych programach do montażu wideo, obsługa fotorealistycznej grafiki 3D z wykorzystaniem algorytmów sztucznej inteligencji, czy też modelowanie obiektów inżynieryjnych22. Skutkiem ubocznym tej potęgi są wyższe wymagania dotyczące przestrzeni w obudowie, wyższy pobór mocy i związana z nim konieczność odprowadzania dużych ilości ciepła, a także znacznie wyższa cena samego sprzętu21.

Ewolucja od potoku graficznego do środowiska gpgpu

Historia rozwoju procesorów graficznych jest dowodem na niezwykłą elastyczność i innowacyjność inżynierii komputerowej. Na początku swojego istnienia, karty graficzne działały w oparciu o tzw. stały potok graficzny (fixed-function pipeline)28. Proces renderowania obrazu był z góry ustalony sprzętowo – koprocesor przyjmował wierzchołki geometrii i przekształcał je w piksele, a programiści mogli jedynie w minimalnym stopniu modyfikować określone flagi systemowe, bez możliwości swobodnego sterowania przepływem danych29.

Kluczowym punktem zwrotnym było wprowadzenie programowalnych jednostek cieniujących (tzw. shaderów). Otworzyło to przed programistami drzwi do manipulowania wyglądem obiektów, światłem i materiałami przy użyciu dedykowanych języków programowania28. Niedługo później środowisko akademickie i technologiczne dostrzegło ogromny, niewykorzystany potencjał ukryty w tysiącach równolegle pracujących rdzeni graficznych. Skoro układ GPU potrafi przetworzyć miliony punktów w przestrzeni, to z powodzeniem może operować na wektorach i macierzach używanych w fizyce kwantowej czy biologii molekularnej3.

Zjawisko to zostało ustrukturyzowane w postaci idei GPGPU (General-Purpose Computing on Graphics Processing Units). Ewolucja ta umożliwiła wykonywanie obliczeń ogólnego przeznaczenia na urządzeniach, które do tej pory służyły wyłącznie rozrywce wizualnej3. Dzięki wdrożeniu otwartych i zamkniętych frameworków programistycznych (takich jak CUDA czy OpenCL), możliwe stało się tworzenie kodu w językach zbliżonych do C++, który kompilator tłumaczył bezpośrednio na instrukcje zrozumiałe dla tysięcy rdzeni SIMT30. Współcześnie techniki GPGPU stanowią absolutny fundament superkomputerów, uczenia głębokiego (deep learning) z wykorzystaniem ogromnych modeli językowych, modelowania zjawisk meteorologicznych czy mechaniki płynów, sprawiając, że GPU jest równie krytyczne dla nauki, co procesor centralny3.

Rasteryzacja i ray tracing jako metody generowania obrazu

Podczas gdy rynek stacji roboczych docenia moc obliczeniową GPGPU, tradycyjna i najważniejsza funkcja układów graficznych w urządzeniach powszechnego użytku to wciąż generowanie obrazu trójwymiarowego w czasie rzeczywistym. Do renderowania dynamicznych scen wykorzystuje się współcześnie dwa fundamentalnie różne podejścia: rasteryzację oraz sprzętowe śledzenie promieni świetlnych (ray tracing).

Przez długie dziesięciolecia niekwestionowanym królem renderowania pozostawała rasteryzacja. Technika ta polega na wirtualnym rzutowaniu modeli 3D, zbudowanych z setek tysięcy wielokątów (najczęściej trójkątów), bezpośrednio na płaską, pikselową siatkę monitora34. Mechanizm ten sprawdza, które elementy znajdują się w zasięgu wirtualnej kamery, i pomija (za pomocą tzw. culling’u i bufora Z) obiekty zasłonięte lub niewidoczne34. Główną zaletą rasteryzacji jest niezwykła prędkość działania i efektywne wykorzystanie zasobów sprzętowych. Jej największą słabością jest jednak brak wiedzy o świetle wykraczającym poza wyznaczoną scenę. Zjawiska takie jak złożone odbicia na tafli wody, miękkie cienie przenikających się obiektów czy załamania światła na szkle, w przypadku rasteryzacji muszą być sztucznie symulowane, co z czasem przestało gwarantować pełny fotorealizm34.

Odpowiedzią przemysłu na te ograniczenia było przeniesienie technologii znanej ze studiów filmowych na domowe urządzenia. Ray tracing, czyli śledzenie promieni, odwraca proces generowania obrazu. Układ graficzny wysyła z wirtualnej kamery (z perspektywy oczu widza) wyimaginowane promienie w głąb sceny, które natrafiając na przedmioty, wchodzą w fizyczne interakcje: odbijają się, rozpraszają lub załamują w materiałach przezroczystych, poszukując ostatecznie źródła światła34. Ponieważ nowoczesne środowiska 3D wymagają uwzględnienia takich efektów jak Global Illumination (pośrednie oświetlenie rozproszone) czy precyzyjny Ambient Occlusion (zacienienie szczelin), każdy piksel ekranu wymaga przetworzenia gigantycznej ilości danych, co w całości pochłania dedykowane struktury krzemowe odpowiedzialne za te operacje36.

Technika renderowaniaRasteryzacja obrazuRay tracing i Path tracing
Podstawowy mechanizm działaniaprojekcja wektorowych wielokątów na siatkę rastrowąśledzenie ścieżek fizycznych promieni świetlnych i ich odbić
Symulacja oświetleniaemulacja za pomocą gotowych, wypalanych tekstur i shaderówprecyzyjne odzwierciedlenie praw fizyki i optyki
Zapotrzebowanie sprzętoweniskie do średniego, gwarantuje dużą płynność animacjiekstremalnie wysokie, wymaga wyspecjalizowanych akceleratorów
Osiągany realizm scenypoprawny, utrudnione symulowanie luster i przezroczystościabsolutny realizm z pełnym uwzględnieniem otoczenia

Ekstremalną i najbardziej zaawansowaną formą tej techniki jest path tracing. Generuje on tysiące zróżnicowanych promieni dla każdego piksela z osobna, co prowadzi do uzyskania niemal fotograficznej precyzji w dystrybucji cieni i odbić. Ponieważ wygenerowanie takiego obrazu w czasie rzeczywistym jest procesem obarczonym powstawaniem szumów cyfrowych (brakiem wystarczającej liczby próbek światła), wykorzystuje się dedykowane rdzenie wspomagane sztuczną inteligencją do inteligentnego „odszumiania” klatek, co zaciera granicę między grafiką komputerową a rejestrowaną rzeczywistością38.

Zrozumienie, czym jest i jak operuje układ GPU, ukazuje skalę złożoności dzisiejszej inżynierii komputerowej. To właśnie te zminiaturyzowane, potężne klastry równoległych rdzeni obliczeniowych zmieniły sposób, w jaki symulujemy świat fizyczny i przetwarzamy informacje w epoce sztucznej inteligencji. Przeobrażenie prymitywnego układu do rysowania w pełni programowalny mikro-superkomputer stanowi jedną z najważniejszych gałęzi rozwoju całego świata technologii cyfrowych.

Źródła

  1. What is GPU Parallel Computing? | OpenMetal IaaS, https://openmetal.io/docs/product-guides/private-cloud/gpu-parallel-computing/
  2. ELI5 – jaka jest różnica między CPU a GPU (komputery)? – Reddit, https://www.reddit.com/r/explainlikeimfive/comments/1es4duk/eli5_whats_the_difference_between_cpu_vs_gpu/?tl=pl
  3. GPGPU – Wikipedia, wolna encyklopedia, https://pl.wikipedia.org/wiki/GPGPU
  4. GPU — Co To Jest Procesor Graficzny? Przewodnik [2026] – KluczeSoft, https://kluczesoft.pl/gpu-procesor-graficzny.htm
  5. GPU Architecture Explained: Structure, Layers & Performance – Scale Computing, https://www.scalecomputing.com/resources/understanding-gpu-architecture
  6. GPU a CPU – jakie są różnice i podobieństwa? – Bizserver, https://bizserver.eu/pl/blog/22-gpu-a-cpu-jakie-sa-roznice-i-podobienstwa
  7. Procesory kart graficznych i CUDA, https://www.cs.put.poznan.pl/rwalkowiak/pliki/2016/pr/gpu_cuda_2016_pr.pdf
  8. Różnice między CPU a GPU – co jest ważniejsze w komputerze? – Poland IT Hub, https://polandithub.pl/roznice-miedzy-cpu-a-gpu-co-jest-wazniejsze-w-komputerze/
  9. Różnice między MCU, CPU, GPU, APU i MPU – Wonderful PCB, https://www.wonderfulpcb.com/pl/blog/differences-mcu-cpu-gpu-apu-mpu/
  10. GPU Architecture Explained: Why Graphics Cards Are Parallel Beasts – YouTube, https://www.youtube.com/watch?v=cfDbHbHabmA
  11. Introduction to GPU architecture — OpenMP for GPU offloading documentation, https://enccs.github.io/openmp-gpu/gpu-architecture/
  12. From Parallel Computing Principles to Programming for CPU and GPU Architectures, https://towardsdatascience.com/from-parallel-computing-principles-to-programming-for-cpu-and-gpu-architectures-dd06e1f30586/
  13. Podręcznik: Budowa karty graficznej – eSezam – Politechnika Warszawska, https://esezam.okno.pw.edu.pl/mod/book/view.php?id=54&chapterid=1145
  14. SIMT vs SIMD: Second Edition – Benjamin H Glick, https://www.glick.cloud/blog/simt-vs-simd-second-edition
  15. SIMD vs SIMT vs SMT: What’s the Difference Between these CPU Execution Models? : r/hardware – Reddit, https://www.reddit.com/r/hardware/comments/f0uv36/simd_vs_simt_vs_smt_whats_the_difference_between/
  16. Ile mam pamięci VRAM? | CORSAIR, https://www.corsair.com/pl/pl/explorer/gamer/gaming-pcs/how-much-vram-do-i-have/
  17. High Bandwidth Memory – co to jest i dlaczego AI inżynierowie ją kochają?, https://hardwaredirect.pl/high-bandwidth-memory-co-to-jest-i-dlaczego-ai-inzynierowie-to-kochaja
  18. HBM – co to jest? Czy interfejs HBM zastąpi DDR? – Morele.net, https://www.morele.net/wiadomosc/hbm-co-to-jest-czy-interfejs-hbm-zastapi-ddr/1399/
  19. High Bandwidth Memory – Wikipedia, wolna encyklopedia, https://pl.wikipedia.org/wiki/High_Bandwidth_Memory
  20. Ta pamięć może całkowicie zmienić AI – poznaj przyszłość dzięki HBM5, HBM6 i HBM8!, https://www.mediaexpert.pl/poradniki/newsy/ta-pamiec-moze-calkowicie-zmienic-ai-poznaj-przyszlosc-dzieki-hbm5-hbm6-i-hbm8
  21. Zintegrowana karta graficzna czy dedykowana? Którą wybrać?, https://www.euro.com.pl/artykuly/wszystkie/artykul-zintegrowana-karta-graficzna-co-to-znaczy-wady-i-zalety.bhtml
  22. Zintegrowana karta graficzna – plusy i minusy takiego rozwiązania – No Fluff Jobs., https://nofluffjobs.com/pl/etc/rankingi/zintegrowana-karta-graficzna-co-to-jest/
  23. Karta graficzna zintegrowana czy dedykowana? Podpowiadamy – Komputronik, https://www.komputronik.pl/informacje/karta-graficzna-zintegrowana-czy-dedykowana/
  24. Jaka jest różnica między CPU a GPU? | CORSAIR, https://www.corsair.com/pl/pl/explorer/diy-builder/blogs/whats-the-difference-between-a-cpu-and-a-gpu/
  25. Wyjaśnij to 5-latkowi: Dlaczego procesory (CPU) i karty graficzne (GPU) mają różne formy?, https://www.reddit.com/r/explainlikeimfive/comments/11wv0qg/eli5_why_do_cpus_and_gpus_come_in_different_form/?tl=pl
  26. Zintegrowana a dedykowana karta graficzna – różnice, https://premiumstation.pl/artykul/zintegrowana-a-dedykowana-karta-graficzna-roznice
  27. https://dellowo.pl/artykul/Zintegrowane_a_dedykowane_karty_graficzne_co_wybra%C4%87_i_czym_si%C4%99_r%C3%B3%C5%BCni%C4%85
  28. Współczesne architektury procesorów graficznych – Kielce, https://achilles.tu.kielce.pl/portal/Members/ppieta/studia-stacjonarne/wspolczesne-architektury-procesorow-graficznych/laboratorium/instrukcje/wapg-lab01.pdf
  29. Vulkan a OpenGL porównanie wydajności na przykładach – Uniwersytet Wrocławski, https://ii.uni.wroc.pl/~anl/MGR/dyndo.pdf
  30. gpgpu.pdf – mimuw, https://www.mimuw.edu.pl/~przemek/przemek1_files/gpgpu.pdf
  31. CUDA Unleashed: How GPUs Are Revolutionising Parallel Computing | by Aditya Grover, https://medium.com/@nitin.aditya231/cuda-unleashed-how-gpus-are-revolutionising-parallel-computing-8cdf095d2cfb
  32. Obliczenia równoległe – Wikipedia, wolna encyklopedia, https://pl.wikipedia.org/wiki/Obliczenia_r%C3%B3wnoleg%C5%82e
  33. Superkomputery – Delta, https://www.deltami.edu.pl/media/articles/2017/07/delta-2017-07-superkomputery.pdf
  34. Rasteryzacja. Czym jest ray tracing? – GRYOnline.pl, https://www.gry-online.pl/opinie/czym-jest-ray-tracing-sledzenie-promieni-a-rasteryzacja/rasteryzacja/za6c1
  35. Co to jest Ray Tracing? | Gamer-Zone.pl – Internetowy sklep komputerowy, https://gamer-zone.pl/co-to-jest-ray-tracing/
  36. Co to jest ray tracing? Wyjaśnienie śledzenia promieni w grach i grafice 3D – Gigaserwer, https://www.gigaserwer.pl/b479,co-to-jest-ray-tracing–wyjanienie-ledzenia-promieni-w-grach-i-grafice-3d
  37. Czym jest śledzenie promieni w grach – Corsair, https://www.corsair.com/pl/pl/explorer/gamer/gaming-pcs/what-is-ray-tracing-in-games/
  38. Path Tracing: co to jest i czym się różni od Ray Tracingu? – Komputronik, https://www.komputronik.pl/informacje/path-tracing-co-to-jest/

Komentarze

Dodaj komentarz

Twój adres email nie zostanie opublikowany. Wymagane pola są oznaczone *