GSK, பிரிட்டிஷ் பயோடெக் நிறுவனமான Relation Therapeutics உடன் $110 மில்லியன் மதிப்பிலான ஆராய்ச்சி ஒத்துழைப்பு ஒப்பந்தத்தில் கையெழுத்திட்டுள்ளது. இந்த கூட்டாண்மை, மரபணு மாற்றங்கள் மற்றும் மருந்து சிகிச்சைகளுக்கு மனித செல்கள் எவ்வாறு எதிர்வினையாற்றுகின்றன என்பதைக் கண்காணிக்கும் பிரம்மாண்டமான, உயர்-தெளிவுத்தன்மை கொண்ட தரவுத் தொகுப்புகளை (datasets) உருவாக்கும். இது AI மூலம் இயக்கப்படும் மருந்து கண்டுபிடிப்புத் துறையைத் தாமதப்படுத்திய தரவுத் தடையை (data bottleneck) போக்கும் மற்றும் மூலக்கூறிலிருந்து மருந்து வரையிலான பாதையில் பல ஆண்டுகளைக் குறைக்க உதவும்.

AI-ஐத் தடுத்து நிறுத்திய தரவுப் பிரச்சனை

கடந்த தசாப்தத்தின் பெரும்பகுதியில், மருந்துத் துறையில் AI-ன் வெற்றி அதன் மாதிரியின் (model) அளவைக் கொண்டே தீர்மானிக்கப்பட்டது, உள்ளீட்டின் (input) பொருத்தத்தைக் கொண்டு அல்ல. இணைய உரைகளைக் கொண்டு பயிற்சியளிக்கப்பட்ட பெரிய மொழி மாதிரிகள் (Large language models) வடிவங்களை அடையாளம் காண்பதில் சிறந்து விளங்கினாலும், ஒரு சேர்மம் (compound) ஒரு உயிருள்ள செல்லுக்குள் எவ்வாறு பரவுகிறது என்பதைக் கணிக்கக் கூறும்போது அவை தடுமாறுகின்றன. இதில் விடுபட்ட பகுதி "wet lab" தரவு ஆகும்—அதாவது ஒரு மரபணு ஆன் அல்லது ஆஃப் செய்யப்பட்ட பிறகு அல்லது ஒரு மருந்து பயன்படுத்தப்பட்ட பிறகு ஏற்படும் உயிரியல் விளைவுகளின் தொடர்ச்சியைக் கண்டறியும் உண்மையான சோதனைகளிலிருந்து பெறப்படும் அளவீடுகள்.

Relation Therapeutics அந்த இடைவெளியை நிரப்பும். இந்த ஒப்பந்தத்தின் கீழ், மரபணு மாற்றங்கள் மற்றும் மருந்து தலையீடுகள் ஆகிய இரண்டு மாறிகளுக்கு (variables) மனித செல்கள் எவ்வாறு பதிலளிக்கின்றன என்பதைத் துல்லியமாக அளவிடும் பெரிய அளவிலான தரவுகளை அது உருவாக்கும். செல்லின் நடத்தையின் இந்த நுணுக்கமான பார்வையை AI அமைப்புகளுக்கு வழங்குவதன் மூலம், மாதிரிகளை வெறும் பிணைப்பு கணிப்புகளிலிருந்து (binding predictions) முழுமையான பாதைகளின் உருவகப்படுத்துதல்களாக (simulations of entire pathways) மாற்ற இந்த கூட்டாண்மை இலக்கு கொண்டுள்ளது.

Black-box கணிப்புகளிலிருந்து செல்லுலார் துல்லியம் வரை

பாரம்பரிய AI வழிமுறைகள் (pipelines) பெரும்பாலும் ஒரு எண்ணையே வெளியீடாகத் தருகின்றன: அதாவது ஒரு மூலக்கூறு இலக்கு புரதத்துடன் (target protein) பிணைக்கப்படுவதற்கான சாத்தியக்கூறு. அந்த பிணைப்பு ஒரு சிகிச்சை விளைவாக மாறுகிறதா என்பதைச் சோதிக்க ஆராய்ச்சியாளர்கள் பல மாதங்கள் அல்லது ஆண்டுகள் செலவிடுகிறார்கள். இந்த புதிய அணுகுமுறை, அந்த ஒற்றைப் புள்ளி மதிப்பீட்டிற்குப் பதிலாக, அடுத்தடுத்த விளைவுகளின் (downstream outcomes) பல பரிமாண வரைபடத்தை வழங்குகிறது. ஒரு மரபணு X-ஐ நீக்குவது பாதை Y-ஐத் தூண்டும் என்பதையும், ஒரு மருந்து அதே பாதையைக் குறைக்கிறது என்பதையும் ஒரு AI மாதிரி அறிந்திருக்கும்போது, அது மருந்தின் செயல்திறனை மிக விரைவாகக் கணிக்க முடியும்.

இதன் பலன், செலவு மிகுந்த சோதனை மற்றும் பிழை (trial-and-error) பரிசோதனைகளைக் குறைப்பதாகும். ஒரு சேர்மம் விரும்பத்தக்க செல்லுலார் எதிர்வினையைத் தூண்டும் என்று ஒரு மாதிரி நம்பகமான முறையில் முன்னறிவித்தால், குறைவான சேர்மங்களையே தொகுக்க (synthesize), திரட்ட (screen) மற்றும் நீக்க வேண்டியிருக்கும். இது ஆராய்ச்சி மற்றும் மேம்பாட்டு (R&D) செலவைக் குறைத்து கால அளவைக் குறைக்கிறது—இந்த நன்மைகள் ஒரு மருந்தின் சந்தை பிரத்யேக கால window மற்றும் மருந்து நிறுவனங்களின் லாபத்தை நேரடியாகப் பாதிக்கின்றன.

"சரியான தரவு" ஒரு பாதுகாப்பு அரணாகிறது

இந்த கூட்டாண்மை "பெரிய தரவு" (big data) என்பதிலிருந்து "சரியான தரவு" (right data) நோக்கிய மாற்றத்தை முன்னிலைப்படுத்துகிறது. பொதுவான மாதிரிகள் அதிக அளவிலான தரவுகளைக் கொண்டு செழிக்கின்றன, ஆனால் மருந்து கண்டுபிடிப்பு என்பது மிகவும் குறிப்பிட்ட மற்றும் பெறுவதற்கு கடினமான தரவுகளைக் கோருகிறது. நம்பகமான செல்லுலார் பதில் விவரக்குறிப்புகளை (cellular response profiles) உருவாக்க அதிநவீன கருவிகள், திறமையான பணியாளர்கள் மற்றும் கடுமையான தரக் கட்டுப்பாடுகள் தேவை—இவை போதுமான நிதி வசதி கொண்ட நிறுவனங்களால் மட்டுமே செய்யக்கூடிய முதலீடுகள் ஆகும்.

மரபணு குறியீட்டை அளவிடக்கூடிய செல்லுலார் விளைவுகளுடன் இணைக்கும் வழிமுறையைத் தமவசம் வைத்திருக்கும் நிறுவனங்கள், மிகவும் மதிப்புமிக்க அறிவுசார் சொத்துக்களைக் (intellectual property) கொண்டிருக்கும். இத்தகைய தரவுத் தொகுப்புகளின் பிரத்யேகத்தன்மை, ஒரு புதிய நரம்பியல் வலைப்பின்னல் கட்டமைப்பை (neural network architecture) விட நகலெடுப்பதற்கு கடினமான ஒரு பாதுகாப்புத் தடையை உருவாக்குகிறது. பயோடெக் நிறுவனத் தொடங்குபவர்களுக்கு செய்தி தெளிவானது: அடுத்தடுத்த அல்காரிதமிக் முன்னேற்றங்களைத் தேடுவதை விட, ஒரு தரவு இயந்திரத்தை (data engine) உருவாக்குவது அதிக மூலோபாய முக்கியத்துவம் வாய்ந்தது.

எதிர்முனை: தரவு மட்டுமே அனைத்தையும் தீர்க்காது

சரியான தரவு கூட AI மாதிரிகளைத் தவறாக வழிநடத்தக்கூடும் என்று விமர்சகர்கள் குறிப்பிடுகின்றனர். திசு வகைகள், நோய் நிலைகள் மற்றும் நோயாளிகளின் மக்கள்தொகை அடிப்படையில் செல்கள் மாறுபடுகின்றன; ஒரு சூழலில் பெறப்பட்ட தரவுத் தொகுப்பு மற்ற சூழல்களுக்குப் பொருந்தாமல் போகலாம். பிரம்மாண்டமான, உயர்தர தரவுத் தொகுப்புகளை உருவாக்குவதற்கும் பராமரிப்பதற்கும் ஆகும் செலவு, மாதிரிகளுக்குப் பயிற்சியளிக்கும் செலவை விட அதிகமாக இருக்கலாம், இது சிறிய நிறுவனங்களுக்கு அளவிடுதல் (scalability) குறித்த கேள்விகளை எழுப்புகிறது.

ஒழுங்குமுறை அமைப்புகளும் (Regulators) முக்கியம். மனித உயிரியலை உருவகப்படுத்துவதாகக் கூறும் மு

முக்கியக் கருத்து

உயர்தர செல் தரவு மீதான GSK-ன் $110 மில்லியன் முதலீடு ஒரு முக்கியமான மாற்றத்தைக் குறிக்கிறது: AI மருந்து கண்டுபிடிப்பில், அல்காரிதம்களின் அளவை விட, மாதிரிகளுக்குப் பயிற்சியளிக்கும் உயிரியல் சமிக்ஞைகளின் தரம் மற்றும் தனித்துவமே மிக முக்கியமான சாதகமாகப் பெருகி வரும்.