Lækkede specifikationer for de næste Nvidia-grafikkort viser åbenbart 7936 CUDA-kerner

Tekst: Kim Olsen
Publiceret 2020-03-07

Vi så for nylig rygter omkring AMD's Big Navi med nogle vanvittige specifikationer, men de er måske mere ægte end først antaget, da nye lækager har afsløret at også Nvidias kommende GPU'er kommer med mildest talt imponerende specifikationer.

På Twitter har både _rogame og w_at_ar_u fremvist både specifikationer og benchmark-resultater fra Geekbench, og særligt _rogame er kendt for at lave solide leaks på elektronik.

Omend at Nvidias kommende Ampere-platform ikke er ny, så er det forbløffende lidt der konkret vides på nuværende tidspunkt, andet end et par udtalelser hist og her fra universiteter der står til at skulle bruge Ampere-platformen til supercomputere og Deep Learning.

Hvis de lækkede oplysninger viser sig at være korrekte, så står vi overfor et voldsomt hop i ydelse GPU-mæssigt, og måske også på et niveau hvor det faktisk er CPU'en der ender med at være flaskehalsen i systemet, den voldsomme konkurrence der lige nu er imellem Intel og AMD løser forhåbentlig det problem over de næste par år.

Tallene er vanvittige. Eftersom at hver Streaming Multiprocessor har 64 CUDA-kerner, så kan vi med 124 Streaming Multiprocessorer vide at der er 7936 CUDA-kerner. Det er 55% mere end Tesla-platformens V100 der har 5120 CUDA-kerner, så det er ikke urealistisk. Med en Clock-hastighed på 1.1GHz burde vi få en regnekraft på 18 teraflops, hvilket er meget, men ikke urealistisk.

Geekbench 5's OpenCL-score på 222377 er opnået med 32GB HBM2e-hukommelse, der kører 1200MHz med en 4096-bit businterface, er ligesom den største Big Navi GPU der er blevet lækket. Herudover er der intet mindre end 32MB L2 cache, mere end fem gange hvad der sidder i et Volta GV100. Og nej, det er ikke konsumprodukter, men vi får en god indikation af RTX 30-serien.

En anden Ampere GPU får 118 Streaming Multiprocessors, altså 7552 CUDA-kerner, 24MB L2 cache, og 24GB of HBM2e-hukommelse, der burger 3072-bit bus med 1200MHz clock, svarendet til cirka 16.7 teraflops regnekraft, og med en score på a 184096 i OpenGL i Geekbench 5. Det er dog lidt mærkeligt at regne på, da der næppe har været optimerede drivere tilgængelig.

En tredje variant er også interessant, 46.8 GB HBM2e, men kun med 108 Streaming Multiprocessor Units (6912 CUDA-kerner) og kun 1.01 GHz clock. Geekbench-scoren denne gang er kun 141654.

Det spændende bliver Nvidias keynote til GTC - Vi regner stærkt med at de kommer med en afsløring her da de er ved at være godt presset af AMD på konsumområdet.

<bild></bild>

Læs mere og se screenshots på Gamereactor.dk

Tilbage