‹ முகப்புக்கு திரும்ப

அன்ட்ரே கார்பதி Anthropic‑இல் Claude‑ஆல் ப்ரி‑ட்ரெய்னிங் வேகத்தை விரைவாக்குகிறார்

OpenAI‑யை நிறுவிய அண்ட்ரே கார்பதி, Anthropic‑இல் சேர்ந்து Claude‑ஐப் பயன்படுத்தி பெரிய மொழி மாதிரியின் ப்ரி‑ட்ரெய்னிங்கை வேகமாக்கப் போகிறார். இந்திய AI‑க்கு இது எதைக் குறிக்கிறது?

Keerthika 6 min read
Google-ல் Follow
அப்டேட் 1 மாதம் முன்
Company News அன்ட்ரே கார்பதி Anthropic‑இல் Claude‑ஆல் ப்ரி‑ட்ரெய்னிங் வேகத்தை விரைவாக்குகிறார் 6 நிமிடம் மீதம் Google-ல் Follow
அன்ட்ரே கார்பதி Anthropic‑இல் Claude‑ஆல் ப்ரி‑ட்ரெய்னிங் வேகத்தை விரைவாக்குகிறார்

தமிழ்டெக் AI சுருக்கம்

அன்ட்ரே கார்பதி இப்போது Anthropic-இல் சேர்ந்து, Claude மாதிரியை வைத்து பெரிய language models-இன் pre-training வேகத்தை உயர்த்த ஒரு சிறப்பு குழுவை அமைக்கிறார். அவர் OpenAI-ஐ இணை-நிறுவி Tesla-இல் Autopilot neural networks-ஐ வளர்த்தவர் என்பதால் இது AI உலகில் பெரிய மாற்றத்தைக் குறிக்கிறது. அவர்கள் data-efficient techniques, GPU optimization மற்றும் curriculum learning மூலம் 175 billion-parameter மாதிரி பயிற்சியை மாதங்களில் இருந்து வாரங்களுக்கு குறைக்க திட்டமிட்டுள்ளார்கள். இதனால் இந்திய நிறுவனங்கள் தங்கள் LLM-களை வேகமாகவும் குறைந்த செலவிலும் உருவாக்கி தமிழ் உள்ளிட்ட உள்ளூர் மொழிகளில் சிறப்பாக வேலை செய்ய முடியும். அடுத்த 3-6 மாதங்களில் புதிய pre-training frameworks வரலாம் என்பதால் developers கவனமாகக் கவனித்து, open-source friendly அணுகுமுறைகளையும் எதிர்பார்க்கலாம்.

  • அண்ட்ரே கார்பதி Anthropic‑இல் சேர்ந்து Claude‑ஆல் LLM ப்ரி‑ட்ரெய்னிங் வேகத்தை அதிகரிக்கிறார்.
  • நோக்கம்: 175 billion‑parameter மாதிரியின் பயிற்சி நேரத்தை மாதங்களிலிருந்து வாரங்களுக்கு குறைத்தல்.
  • இந்திய AI‑உலகில் செலவுக் குறைப்பு, வேகமான மாதிரி உருவாக்கம், மற்றும் உள்ளூர் மொழி ஆதரவு அதிகரிப்பு.

AI உதவியுடன் தயாரான சுருக்கம் — தமிழ்டெக் எடிட்டர்ஸ் சரிபார்த்தது.

0:00
0:00
🔒 Listen வசதி subscribers-க்கு மட்டும். Subscribe செய்யுங்கள்

செய்தி என்ன?

OpenAI‑யை முதலில் நிறுவிய, Tesla‑இல் AI குழுவை தலைமைத்துவம் செய்த அண்ட்ரே கார்பதி, இப்போது Anthropic‑இல் சேர்ந்தார். அவரின் பணி: Claude மாதிரியைப் பயன்படுத்தி, பெரிய மொழி மாதிரியின் ப்ரி‑ட்ரெய்னிங் (pre‑training) வேகத்தை அதிகரிக்கும் ஒரு சிறப்பு குழுவை அமைத்தல். எளிதில் சொல்வதானால், பில்லியன்‑பராமீட்டர் மாதிரிகளைப் பயிற்சி செய்ய தேவையான "கணினி‑நேரம்"‑ஐ குறைத்துவிடுவது.

அண்ட்ரே கார்பதி யார்?

அவரின் பெயர் AI‑உலகில் மின்சாரத்தைப் போன்றது. OpenAI‑யை இணை‑நிறுவினார், CS231n‑ன் ஆழமான குறிப்புகள் (deep‑learning notes) எழுதினார், Tesla‑இல் AI தலைவராக Autopilot‑ன் நியூரல் நெட்வொர்க்குகளைப் பயனுள்ளதாக உருவாக்கினார். ஆராய்ச்சி, கல்வி, தயாரிப்பு‑நிறுவல் ஆகிய மூன்று துறைகளிலும் சரியான சமநிலையை வைத்தவர்.

Anthropic‑ஏன்?

Anthropic, OpenAI‑யின் முன்னாள் நிர்வாகிகள் ஆரம்பித்த "பொறுப்பான AI" ஆய்வு மையம். அவர்களின் Claude மாதிரி, GPT‑4‑க்கு இணையான திறன்களைப் பெற்றுள்ளது – குறியீடு எழுதுதல், காரணம் கண்டறிதல், ஆலோசனை வழங்குதல் போன்றவை. கார்பதி சேர்ந்து, Anthropic‑ன் "ஆராய்ச்சி‑முதல்‑தயாரிப்பு" அணுகுமுறையை வேகமாக்க விரும்புகிறது.

Claude‑ஆல் ப்ரி‑ட்ரெய்னிங் எப்படி வேகமாகும்?

பிரச்சினை எளிது: ஒரு 175 billion‑parameter மாதிரியைப் பயிற்சி செய்ய 2‑3 மாதங்கள், ஆயிரக்கணக்கான GPU‑கள் தேவை. கார்பதி தலைமையிலான குழு மூன்று முக்கிய வழிகளில் இதை குறைக்க திட்டமிட்டுள்ளது:

  1. தரவு‑நுணுக்கமான கட்டமைப்பு: குறைந்த தரவிலிருந்து அதிகம் கற்றுக்கொள்ள token‑mixing தொழில்நுட்பம்.
  2. ஹார்ட்வேர்‑அறிவு ஆப்டிமைசேஷன்: NVIDIA H100, AMD Instinct GPU‑களில் training‑loop‑களை முழுமையாக சீரமைத்தல்.
  3. கரிகுலம் லெர்னிங் (curriculum learning): எளியது முதல் சிக்கலானது வரை தரவைக் கற்றுக்கொடுக்க, மீண்டும் மீண்டும் பயிற்சி வீணை குறைத்தல்.

இது 175B மாதிரியை 2 மாதங்களில் இருந்து 2 வாரங்களுக்கு குறைக்க நோக்கமாக உள்ளது.

இந்த மாறுபாடு இந்தியாவை எப்படி பாதிக்கும்?

இந்தியா AI‑talent, data‑center capacity இரண்டிலும் வேகமாக வளர்ச்சியடைந்து கொண்டிருக்கிறது. Jio, Flipkart, Tata போன்ற நிறுவனங்கள் ஏற்கனவே தங்கள் சொந்த LLM‑களை உருவாக்க முயல்கின்றன – தேடல், பரிந்துரை, வாடிக்கையாளர் சேவை ஆகியவற்றிற்காக. பயிற்சி நேரம் குறையும்வழி, அவர்கள் அதிகம் பரிசோதனைகள் செய்து, போட்டியாளர்களை மீற முடியும்.

மேலும், கார்பதி போன்ற உலகத் தலைவரின் அனுபவம், இந்திய ஸ்டார்ட்‑அப்‑களை "ஆராய்ச்சி‑இலிருந்து‑வருவாய்" முறைமையில் மாற்ற உதவும்.

TamilTech‑ஓட கருத்து

இது வெறும் "நியூஸ்" மட்டும் அல்ல, ஒரு கண்கவர் வாய்ப்பு. Anthropic‑ன் Claude‑ஐ வேகமாகப் பயிற்சி செய்ய முடிந்தால், இந்தியா தன் மொழிகளில் (தமிழ், ஹிந்தி, பெங்காலி) அதிகம் செயல்திறன் கொண்ட மாதிரிகளை உருவாக்க முடியும் – வெளிநாட்டு சர்வர்களுக்கு latency‑ஐ தவிர்த்து, உள்ளூர் data‑center‑ல் தான் everything நடக்கும்.

ஆனால், Anthropic research‑ஐ "கிளோஸ்‑சோர்ஸ்"‑ஆக வைத்தால், இந்திய டெவலப்பர்கள் அதிகம் செலவுத்தொகைச் சுமையிலே சிக்குவார்கள். எங்களுக்குத் தேவையானது, Meta‑யின் LLaMA‑வின் போல் "ஓப்பன்‑சோர்ஸ்‑ஃப்ரெண்ட்லி" மாடல் ஆக வேண்டும்.

என்ன எதிர்பார்க்கலாம்?

அடுத்த 3‑6 மாதங்களில்:

  • Claude‑அடிப்படையிலான புதிய pre‑training framework அறிவிப்பு.
  • இந்திய கிளவுட் பங்குதாரர்கள் (Netmagic, CtrlS) உடன் GPU‑cluster கூட்டாண்மை.
  • கார்பதி குழுவின் curriculum‑learning தந்திரம் பற்றிய ஆழமான blog‑post அல்லது white‑paper.

சென்னை, பெங்களூர், ஹைதராபாத் AI‑மீட்டப்புகள் கவனமாகக் கேளுங்கள் – அவருக்காக ஒரு virtual AMA (Ask Me Anything) ஏற்பாடு செய்யலாம்.

முடிவு

அண்ட்ரே கார்பதி Anthropic‑இல் சேர்ந்தது, AI‑உலகில் புதிய போட்டியைக் குறிக்கிறது. இந்திய AI‑இயக்குனர்களுக்கு இது வேகமான, குறைந்த செலவுள்ள LLM‑களை உருவாக்கும் வாய்ப்பு. இந்த மாற்றம் எங்கேயும் நிற்காது – அடுத்த பெரிய breakthrough, இந்தியா தான் உருவாக்கலாம்.

நாளைய டெக் செய்திகள் உங்க WhatsApp-க்கே

தினமும் ஒரு சின்ன update, இலவசம். TamilTech channel-ஐ follow பண்ணுங்க.

What do you think?

people reacted

Keerthika

தமிழ்டெக் எடிட்டோரியல் டீம் · 3,344 கட்டுரைகள்

Keerthika is an editor at TamilTech, the Tamil and English technology publication founded by Praveen Kumar S. She covers AI, smartphones, gadgets, EVs, startups and cybersecurity i...

மேலும் Keerthika

WhatsApp-ல் TamilTech-ஐக் கேளுங்க

டெக் சந்தேகமா? தமிழிலோ ஆங்கிலத்திலோ கேளுங்க — எங்க WhatsApp அசிஸ்டன்ட் TamilTech கட்டுரைகளில் இருந்து சில நொடிகளில் பதில் சொல்லும்.

தொடர்புடைய செய்திகள்

கருத்துகள் (0)

| Supports **bold**, *italic*, `code`

Be the first to comment!

அடுத்த செய்தி Anthropic IPO: Claude நிறுவனத்துல இருக்குற Public Benefit Corporation-னா என்ன? எளிமையா புரிஞ்சுக்குவோம்
Tamiltech

Tamiltech

Install app for faster access

Earn XP 🏆
WhatsApp
Notifications