செய்தி என்ன?
OpenAI‑யை முதலில் நிறுவிய, Tesla‑இல் AI குழுவை தலைமைத்துவம் செய்த அண்ட்ரே கார்பதி, இப்போது Anthropic‑இல் சேர்ந்தார். அவரின் பணி: Claude மாதிரியைப் பயன்படுத்தி, பெரிய மொழி மாதிரியின் ப்ரி‑ட்ரெய்னிங் (pre‑training) வேகத்தை அதிகரிக்கும் ஒரு சிறப்பு குழுவை அமைத்தல். எளிதில் சொல்வதானால், பில்லியன்‑பராமீட்டர் மாதிரிகளைப் பயிற்சி செய்ய தேவையான "கணினி‑நேரம்"‑ஐ குறைத்துவிடுவது.
அண்ட்ரே கார்பதி யார்?
அவரின் பெயர் AI‑உலகில் மின்சாரத்தைப் போன்றது. OpenAI‑யை இணை‑நிறுவினார், CS231n‑ன் ஆழமான குறிப்புகள் (deep‑learning notes) எழுதினார், Tesla‑இல் AI தலைவராக Autopilot‑ன் நியூரல் நெட்வொர்க்குகளைப் பயனுள்ளதாக உருவாக்கினார். ஆராய்ச்சி, கல்வி, தயாரிப்பு‑நிறுவல் ஆகிய மூன்று துறைகளிலும் சரியான சமநிலையை வைத்தவர்.
Anthropic‑ஏன்?
Anthropic, OpenAI‑யின் முன்னாள் நிர்வாகிகள் ஆரம்பித்த "பொறுப்பான AI" ஆய்வு மையம். அவர்களின் Claude மாதிரி, GPT‑4‑க்கு இணையான திறன்களைப் பெற்றுள்ளது – குறியீடு எழுதுதல், காரணம் கண்டறிதல், ஆலோசனை வழங்குதல் போன்றவை. கார்பதி சேர்ந்து, Anthropic‑ன் "ஆராய்ச்சி‑முதல்‑தயாரிப்பு" அணுகுமுறையை வேகமாக்க விரும்புகிறது.
Claude‑ஆல் ப்ரி‑ட்ரெய்னிங் எப்படி வேகமாகும்?
பிரச்சினை எளிது: ஒரு 175 billion‑parameter மாதிரியைப் பயிற்சி செய்ய 2‑3 மாதங்கள், ஆயிரக்கணக்கான GPU‑கள் தேவை. கார்பதி தலைமையிலான குழு மூன்று முக்கிய வழிகளில் இதை குறைக்க திட்டமிட்டுள்ளது:
- தரவு‑நுணுக்கமான கட்டமைப்பு: குறைந்த தரவிலிருந்து அதிகம் கற்றுக்கொள்ள token‑mixing தொழில்நுட்பம்.
- ஹார்ட்வேர்‑அறிவு ஆப்டிமைசேஷன்: NVIDIA H100, AMD Instinct GPU‑களில் training‑loop‑களை முழுமையாக சீரமைத்தல்.
- கரிகுலம் லெர்னிங் (curriculum learning): எளியது முதல் சிக்கலானது வரை தரவைக் கற்றுக்கொடுக்க, மீண்டும் மீண்டும் பயிற்சி வீணை குறைத்தல்.
இது 175B மாதிரியை 2 மாதங்களில் இருந்து 2 வாரங்களுக்கு குறைக்க நோக்கமாக உள்ளது.
இந்த மாறுபாடு இந்தியாவை எப்படி பாதிக்கும்?
இந்தியா AI‑talent, data‑center capacity இரண்டிலும் வேகமாக வளர்ச்சியடைந்து கொண்டிருக்கிறது. Jio, Flipkart, Tata போன்ற நிறுவனங்கள் ஏற்கனவே தங்கள் சொந்த LLM‑களை உருவாக்க முயல்கின்றன – தேடல், பரிந்துரை, வாடிக்கையாளர் சேவை ஆகியவற்றிற்காக. பயிற்சி நேரம் குறையும்வழி, அவர்கள் அதிகம் பரிசோதனைகள் செய்து, போட்டியாளர்களை மீற முடியும்.
மேலும், கார்பதி போன்ற உலகத் தலைவரின் அனுபவம், இந்திய ஸ்டார்ட்‑அப்‑களை "ஆராய்ச்சி‑இலிருந்து‑வருவாய்" முறைமையில் மாற்ற உதவும்.
TamilTech‑ஓட கருத்து
இது வெறும் "நியூஸ்" மட்டும் அல்ல, ஒரு கண்கவர் வாய்ப்பு. Anthropic‑ன் Claude‑ஐ வேகமாகப் பயிற்சி செய்ய முடிந்தால், இந்தியா தன் மொழிகளில் (தமிழ், ஹிந்தி, பெங்காலி) அதிகம் செயல்திறன் கொண்ட மாதிரிகளை உருவாக்க முடியும் – வெளிநாட்டு சர்வர்களுக்கு latency‑ஐ தவிர்த்து, உள்ளூர் data‑center‑ல் தான் everything நடக்கும்.
ஆனால், Anthropic research‑ஐ "கிளோஸ்‑சோர்ஸ்"‑ஆக வைத்தால், இந்திய டெவலப்பர்கள் அதிகம் செலவுத்தொகைச் சுமையிலே சிக்குவார்கள். எங்களுக்குத் தேவையானது, Meta‑யின் LLaMA‑வின் போல் "ஓப்பன்‑சோர்ஸ்‑ஃப்ரெண்ட்லி" மாடல் ஆக வேண்டும்.
என்ன எதிர்பார்க்கலாம்?
அடுத்த 3‑6 மாதங்களில்:
- Claude‑அடிப்படையிலான புதிய pre‑training framework அறிவிப்பு.
- இந்திய கிளவுட் பங்குதாரர்கள் (Netmagic, CtrlS) உடன் GPU‑cluster கூட்டாண்மை.
- கார்பதி குழுவின் curriculum‑learning தந்திரம் பற்றிய ஆழமான blog‑post அல்லது white‑paper.
சென்னை, பெங்களூர், ஹைதராபாத் AI‑மீட்டப்புகள் கவனமாகக் கேளுங்கள் – அவருக்காக ஒரு virtual AMA (Ask Me Anything) ஏற்பாடு செய்யலாம்.
முடிவு
அண்ட்ரே கார்பதி Anthropic‑இல் சேர்ந்தது, AI‑உலகில் புதிய போட்டியைக் குறிக்கிறது. இந்திய AI‑இயக்குனர்களுக்கு இது வேகமான, குறைந்த செலவுள்ள LLM‑களை உருவாக்கும் வாய்ப்பு. இந்த மாற்றம் எங்கேயும் நிற்காது – அடுத்த பெரிய breakthrough, இந்தியா தான் உருவாக்கலாம்.




கருத்துகள் (0)
Be the first to comment!