NVIDIA-வின் Blackwell GPU குடும்பம் 208 பில்லியன் டிரான்சிஸ்டர்களைக் கொண்டுள்ளது மற்றும் 72-GPU கொண்ட ஒரு களத்தில் (domain) 130 TB/s வரையிலான அலைக்கற்றை வேகத்தை (bandwidth) வழங்க முடியும். இந்த நகர்வு, உருவாக்கும் AI (generative-AI) போட்டியில் ஆதிக்கம் செலுத்தும் டிரில்லியன் அளவிலான அளவுருக்களைக் (trillion-parameter) கொண்ட மொழி மாதிரிகளைக் குறிவைக்கிறது; மேலும், இந்த வேகப் பலன்களைப் பெறுவதற்கு முன்னதாக, தரவு மையச் செயல்பாட்டாளர்கள் மின்சாரம், குளிர்விப்பு மற்றும் சேஸிஸ் (chassis) தேர்வுகளை மறுபரிசீலனை செய்ய வேண்டிய கட்டாயத்தையும் இது ஏற்படுத்துகிறது.

வன்பொருள் முன்னேற்றம்

Blackwell, சிறந்த ஆற்றல் திறனுக்காக (energy efficiency) நேரடி கடிகார வேகத்தை (raw clock speed) குறைக்கும் வகையில் ஒரு தனிப்பயனாக்கப்பட்ட TSMC 4NP செயல்முறையைப் பயன்படுத்துகிறது. ஒவ்வொரு GPU-வும் 10 TB/s உள் இணைப்பால் (internal link) இணைக்கப்பட்ட இரண்டு dies-களால் ஆனது, இது அந்த ஜோடியை ஒரே தர்க்கரீதியான செயலியாக (single logical processor) செயல்பட அனுமதிக்கிறது. இந்த ஆர்க்கிடெக்சர் (architecture), இரண்டாம் தலைமுறை Transformer Engine, ஐந்தாம் தலைமுறை NVLink மற்றும் NVLink Switch, அத்துடன் confidential computing எனப்படும் பாதுகாப்பு சார்ந்த தொகுதிகள், ஒரு Decompression Engine மற்றும் RAS (Reliability, Availability, Serviceability) ஆகியவற்றைச் சேர்க்கிறது.

மிகவும் வெளிப்படையான மாற்றம் துல்லியத்தைக் கையாளுதல் (precision handling) ஆகும். Hopper-ன் H100, கலப்பு-துல்லிய (mixed-precision) AI பணிகளுக்காக FP8-ஐ நம்பிய