செய்தி என்ன?
Google, Gemini 3.5 Flash மாடலின் விலையை உயர்த்திட்டது. இப்போது 1 M input‑டோக்கனுக்கு $1.50 மற்றும் 1 M output‑டோக்கனுக்கு $9 ஆகும். இது Gemini 3 Flash preview‑இன் 3 மடங்கு, Gemini 3.1 Flash‑Lite‑இன் 6 மடங்கு விலை.
எண்‑விளக்கம்
1 M டோக்கன் என்பது சுமார் 750 KB உரை, 150 பக்க புத்தகம். இந்த விலையில் நீங்கள் செலுத்த வேண்டியது:
- $1.50 – ஒவ்வொரு மில்லியன் input‑டோக்கனுக்காக.
- $9 – ஒவ்வொரு மில்லியன் output‑டோக்கனுக்காக.
₹83/USD என்ற நடப்பு மாற்று விகிதத்தில், இது ₹125 input‑க்கு, ₹750 output‑க்கு. 200‑டோக்கன் பதில் தரும் ஒரு chatbot‑க்கு ஒவ்வொரு முறை சுமார் ₹0.15 தான், ஆனா அளவு அதிகரித்தால் செலவு வேகமாக உயரும்.
இந்த உயர்வு ஏன்?
Google சொல்றது, Gemini 3.5 Flash‑இல் அதிக compute, நீண்ட context (100k டோக்கன்) மற்றும் குறைந்த latency உள்ளது. அதற்காக தான் விலை அதிகரித்தது – performance‑இன் premium version போல.
இந்த news‑ன் இந்தியா பாதிப்பு
இந்த விலை மாற்றம் இந்தியா டெவலப்பர்களுக்கு எப்படி பாதிக்கும்? சில புள்ளிகள்:
- ஸ்டார்ட்‑அப் MVP‑கள்: Google‑ன் free quota (500k input + 200k output) இன்னும் போதுமானது. ஆனா அதுக்கு மேலே போனால் புதிய விலை கணக்கில் வரும்.
- என்டர்பிரைஸ்‑ஸ்கேல் bot‑கள்: Swiggy, IRCTC போன்ற பெரிய கஸ்டமர்‑சர்வீஸ் bot‑கள் 1 M கேள்வி/மாதம் (ஒவ்வொரு 100‑டோக்கன் பதில்) பயன்படுத்தினால், மாத செலவு சுமார் ₹75,000 ஆகும்.
- அறிவியல் & கல்வி: பல்கலைக்கழகங்கள் Gemini‑ஐ ரிசர்ச்‑க்கு பயன்படுத்தும் போது, அதிக cloud‑cost‑ஐ எதிர்கொள்ள வேண்டி வரும். OpenAI‑யின் gpt‑3.5‑turbo அல்லது open‑source மாடல்களைப் பார்க்கலாம்.
உள்ளூரில் ஒப்பிடல்
முக்கிய போட்டியாளர்களை ஒரு ஆட்டம் பார்ப்போம்:
| மாடல் | Input‑விலை (₹/1M) | Output‑விலை (₹/1M) | சிறந்த பயன்பாடு |
|---|---|---|---|
| Gemini 3.5 Flash | ₹125 | ₹750 | அதிக context, குறைந்த latency |
| Gemini 3.1 Flash‑Lite | ₹20 | ₹125 | எளிய Q&A, சுருக்கம் |
| OpenAI gpt‑3.5‑turbo | ₹150 | ₹600 | பொது chat |
| Claude 3 Haiku | ₹180 | ₹720 | சிருஷ்டி எழுது, brainstorming |
Gemini 3.5 Flash-க்கு performance‑இல் முன்னிலை உள்ளது, ஆனா விலை வேறுபாடு கணக்கில் எடுக்கவேண்டும்.
TamilTech‑ஓட கருத்து
நாங்க என்ன நினைக்கிறோம்? இந்தியா விலை‑சன்ஸிட்டிவ் மா. இந்த உயர்வு சில நிறுவனங்களுக்கு ‘overpriced’ போலத் தெரியும். Boot‑strapped startup-கள் Gemini 3.1 Flash‑Lite அல்லது Mistral‑7B‑ஐ self‑host செய்து பார்க்கலாம்.
ஆனால், legal‑doc analysis, multi‑turn tutoring போன்ற 100k‑டோக்கன் context‑தேவைப்படும் வேலைகளுக்கு Gemini 3.5 Flash-ன் performance‑ஐத் தேர்வு செய்வது ஞாயிற்றுக்கிழமை நட்பு.
செலவைக் குறைக்க 4 வழிகள்
- சரியாக chunk‑செய்: பெரிய உள்ளீட்டை சிறிய பகுதிகளாகப் பிரித்து, தேவையான context‑ஐ மட்டும் அனுப்பு.
- Cache‑செய்: ஒரே FAQ‑க்கு மாடல் பதிலை சேமித்து, மீண்டும் API‑call செய்யாதே.
- Streaming‑output: பதில் கிடைக்கும் போது நீங்க stop‑செய்யலாம், இதனால் output‑டோக்கன் குறையும்.
- Usage‑monitor: Google Cloud Console‑ல் 70% free‑quota‑க்கு alert அமைக்கவும்.
என்ன எதிர்பார்க்கலாம்?
Google, “Gemini 3.5 Flash Pro” என்று புதிய tier‑ஐ வரவிருக்கும் மாதங்களில் வெளியிடலாம் – latency‑இல் மேலும் மேம்பாடு, விலை‑இலும் உயர்வு. இந்தியா ஸ்டார்ட்‑அப் க்கு GCP credits‑ஐ வழங்கும் திட்டம் மீண்டும் வரும் வாய்ப்பு.
முடிவாக, Gemini 3.5 Flash வலிமையானது, ஆனா புதிய விலை காரணம் அதிகமாக கவனமாகப் பயன்படுத்த வேண்டும். உங்கள் பயன்பாட்டுக்கு real value‑ஐ கணக்கிட்டு, token‑usage‑ஐ optimise செய்து, வேண்டிய performance‑ஐப் பெறுங்கள்.




கருத்துகள் (0)
Be the first to comment!