சரியா, என்ன நடந்தது?
DeepSeek, AI-யில் புது பவுன்ஸ் கொண்டு வந்த ஸ்டார்ட்அப், இப்போது V4 Pro, V4 Flash இரு மாத்ரிகளை வெளியிட்டது. V4 Pro‑யில் 1.6 டிரில்லியன் பாறாமீட்டர்கள் – இதுவரை மொத்த பாறாமீட்டர் அடிப்படையில் மிகப் பெரிய மாதிரி. V4 Flash‑ல் 284 பில்லியன் பாறாமீட்டர்கள். இரண்டுமே 1 மில்லியன் டோக்கன் கன்டெக்ஸ்ட், இது GPT‑4‑ன் 8 K டோக்கன் வரம்பை விட 100‑க்கும் அதிகம்.
எண்களை ஆழமாக பார்ப்போம்
முக்கிய விபரங்கள்:
- V4 Pro – 1.6 T பாறாமீட்டர்கள், 1 M டோக்கன் கன்டெக்ஸ்ட்.
- V4 Flash – 284 B பாறாமீட்டர்கள், 1 M டோக்கன் கன்டெக்ஸ்ட்.
- DeepSeek‑ன் சொந்த சிப்‑ல் low‑latency inference‑க்கு ட்யூனிங்.
பாறாமீட்டர் என்பது மாடல் கற்றுக்கொண்ட எடை. அதிக பாறாமீட்டர் = அதிக நுணுக்கம், ஆனால் அதிக கணினி சக்தி தேவை.
1 M டோக்கன் கன்டெக்ஸ்ட் இந்தியனுக்கு என்ன?
இந்தியா பலர் LLM‑களை chat‑bot, code‑assistant, content‑generator மாதிரியில் தான் பயன்படுத்துறேன். 8 K டோக்கன் வரம்பு ஒரு 30‑பேஜ் சட்ட ஆவணம் அல்லது 10 K வார்த்தை ரிசர்ச் பேப்பரை கீறி விடும். 1 M டோக்கன் கன்டெக்ஸ்ட் இருந்தால்:
- முழு PDF‑களை (GST விதிகள், RBI அறிவிப்புகள்) ஒரு முறை மட்டும் போடலாம்.
- மல்டி‑லாங் பேச்சில் பிராந்திய மொழிகளுக்கு சீராக புரியும்.
- முழு கோடு‑பேஸ்களை துண்டுகள் இல்லாமல் ரிவ்யூ செய்யலாம்.
இந்தியாவில் என்ன தாக்கம்?
DeepSeek ஹைதராபாத்‑ல் இந்தியா‑முதல் டேட்டா சென்டர் திறக்கப் போகுது. இதனால் இந்திய ISP‑களுக்கு லேட்டன்சி குறையும், inference‑ன் விலை குறையும். ஆரம்ப விலை ₹0.03 per 1 K டோக்கன்கள் – OpenAI‑யின் ரேட் கிட்டத்தட்ட சமம், ஆனால் 1 M கன்டெக்ஸ்ட் உடன்.
Jio‑AI, Swiggy‑ன் order‑assistant, அல்லது banking‑ல் compliance‑check போன்ற ஸ்டார்ட்அப்‑கள் இந்த கன்டெக்ஸ்ட் பவர்‑ஐப் பயன்படுத்தி, நீண்ட transaction logs‑ஐ ஒரு முறை மட்டும் analyse செய்யலாம்.
TamilTech‑ஓட கருத்து
“பெரியது நல்லது” என்று சொல்லப்படும், ஆனா பயன்குறி முக்கியம். V4 Pro‑ன் 1.6 T பாறாமீட்டர்கள் பறவையா, ஆனா 1 M டோக்கன் கன்டெக்ஸ்ட் தான் இந்தியப் பயனர்களுக்கு real value. 10 K‑line logs-னை copy‑paste செய்து chat‑ல் போடுறீங்கன்னா, இப்போ ஒரே request‑ல் முடியும்.
ஆனால் hardware‑கள் இன்னும் விலையுயர்ந்தது. V4 Pro-ஐ full‑capacity‑ல் ரன் செய்ய A100‑class GPU cluster தேவை. பெரும்பாலான freelancers‑க்கு V4 Flash தான் sweet spot – 284 B பாறாமீட்டர்கள் பல high‑quality code suggestion, multilingual output-க்கு போதுது, விலை ₹0.05 per 1 K டோக்கன்கள் வரை இருக்கும்.
என்ன எதிர்பார்க்கலாம்?
DeepSeek இந்திய மொழிக்காக fine‑tune செய்யும் roadmap‑ஐ அறிவித்துள்ளது – Tamil, Hindi, Bengali மாதிரி மொழிகளுக்காக தனி மாடல்கள் வரும். Hyderabad data‑centre launch‑ஆகும் போது, Bangalore, Chennai‑ல் latency 120 ms‑இல் இருந்து 50 ms-க்கு கீழே வரும்.
சுருக்கமாக: Legal, academic, code‑heavy வேலைகள் இருந்தால் V4 Pro-ஐ keep an eye on. தினசரி AI assistant-க்கு V4 Flash-ஐ try பண்ணுங்க – size, speed, price எல்லாம் சமநிலை.




கருத்துகள் (0)
Be the first to comment!