RTX 4070-இல் Qwen 3.6, Qwen 3.5-க்கு இணையான டோக்கன் வேகத்தையே (token throughput) எட்டுகிறது—வினாடிக்கு 38.76 டோக்கன்கள் மற்றும் 36.7 t/s—ஆனால் இது தன்னாட்சி முகவர்கள் (autonomous agents) மற்றும் கோடிங் உதவியை (coding assistance) குறிப்பிடத்தக்க அளவில் சிறப்பாகக் கையாள்கிறது. நுகர்வோர் தரத்திலான வன்பொருளில் (consumer-grade hardware) AI சார்ந்த கருவிகளை உருவாக்குபவர்களுக்கு இது மிகவும் முக்கியமானது.

இந்த எண்கள் ஏன் முக்கியம்

இரண்டு மாடல்களும் ஒரே அளவிலான ஆக்டிவ்-பாராமீட்டர் (active-parameter) எண்ணிக்கையைக் கொண்டுள்ளன, எனவே அவற்றின் வேகம் சமமாகவே இருக்க வேண்டும். ஆரம்பகட்ட சோதனையில் 3.6 மாடலில் வேகம் பெருமளவு குறைந்ததாகத் தெரிந்தது, ஆனால் ஒரு தேவையற்ற செயல்முறை (stray process) 11 GB VRAM-ஐப் பயன்படுத்தியதால், மாடல் சிஸ்டம் RAM-க்கு மாற்றப்பட்டது. அந்தச் செயல்முறையை நிறுத்திய பிறகு, வேகம் எதிர்பார்த்த நிலைக்குத் திரும்பியது. இதன் மூலம், 12 GB VRAM வசதியுடன் இரண்டு பதிப்புகளும் அடிப்படையில் ஒரே வேகத்தில் இயங்குவது உறுதி செய்யப்பட்டது.

உண்மையில் என்ன மாற்றம் உள்ளது

இந்த மேம்பாடு டோக்கன் உருவாக்கத்தில் (token generation) இல்லை, மாறாக அதன் திறனில் (capability) உள்ளது. டெவலப்பர்களின் பெஞ்ச்மார்க் (benchmarks) அறிக்கையின்படி:

  • Front-end உருவாக்கும் பணிகள் 43% முன்னேற்றம் கண்டுள்ளன
  • Terminal-operation பணிகள் 27% முன்னேற்றம் கண்டுள்ளன
  • கோடிங் தொடர்பான பணிகள் 11% முன்னேற்றம் கண்டுள்ளன

இவை மூன்றும் கருவிகளைப் பயன்படுத்துதல் (invoke tools), நீண்ட சூழல் சாளரங்களை (long context windows) பராமரித்தல் மற்றும் பல தர்க்க ரீதியான படிநிலைகளை (reasoning steps) இணைத்தல் போன்ற மாடலின் திறன்களைச் சார்ந்தே உள்ளன. நடைமுறையில், 3.6 பிழைகளை மிகவும் நம்பகமான முறையில் சரிசெய்கிறது, சிக்கலான வழிமுறைகளைப் பின்பற்றுகிறது மற்றும் ஒரு shell அல்லது IDE சம்பந்தப்பட்ட பல படிநிலை பணிப்பாய்வுகளை (multi-step workflows) திறம்படக் கையாள்கிறது.

யாருக்குப் பயன் தரும்

  • ஏஜென்ட்களை உருவாக்கும் டெவலப்பர்கள் (Developers building agents) – AI கட்டளைகளை இயக்கும்போது, கோப்புகளைத் திருத்தும்போது அல்லது சேவைகளை ஒருங்கிணைக்கும்போது (orchestrates services), புதிய மாடல் தோல்வியடையும் முயற்சிகளைக் குறைத்து, கைமுறைத் திருத்தங்களின் தேவையைத் தவிர்க்கிறது.
  • கோடிங் உதவியாளர்கள் (Coding assistants) – கோடிங் பணிகளில் ஏற்பட்டுள்ள இந்த மிதமான முன்னேற்றம், தவறான குறியீட்டுத் துண்டுகள் (hallucinated snippets) உருவாவதைக் குறைத்து, மென்மையான ரீஃபாக்டரிங் (refactoring) பரிந்துரைகளை வழங்குகிறது.
  • குறைந்த பட்ஜெட்டில் ஆராய்ச்சி செய்பவர்கள் (Researchers on a budget) – ஒரே ஒரு RTX 4070-இல் புதிய மாடலை அதே வேகத்தில் இயக்குவதன் மூலம், கூடுதல் GPU-களை வாங்காமலேயே குழுக்கள் தங்களை மேம்படுத்திக் கொள்ள முடியும்.

யாருக்குத் தேவையில்லை

உங்கள் பணி பெரும்பாலும் நேரடியான கேள்வி-பதில் அல்லது குறுகிய வடிவிலான உரை உருவாக்கமாக (short-form text generation) இருந்தால், செயல்திறன் இடைவெளியை நீங்கள் உணர முடியாது. வினாடிக்கு டோக்கன்களின் எண்ணிக்கை மாறாமல் அப்படியே இருக்கும், மேலும் VRAM பயன்பாடும் அதிகரிக்காது, எனவே மாற்றியமைப்பதில் எந்தச் செலவும் இல்லை.

சுருக்கமாகச் சொன்னால்: Qwen 3.6 என்பது வேகத்திற்கான மேம்பாடு அல்ல; அது திறனுக்கான மேம்பாடு. அதே நுகர்வோர் GPU-வில், இது வன்பொருள் செலவுகளை அதிகரிக்காமல், டெவலப்பர்களுக்கு மிகவும் நம்பகமான மற்றும் தற்சார்பு கொண்ட ஒரு AI கூட்டாளியை வழங்குகிறது.