LLMs

105 Din Baad Gemini Ka Price Double: 3 Cheezein Dekhiye

Gemini 3.8 Flash aaj $0.75 per million input token hai, aur 1 January 2027 se $1.50. Ye Google ke apne pricing page par likha hai. Us din aapke bill ki 3 lines double hongi, aur ek wo hai jise koi dekhta hi nahi.

AAICreatorHub Team18 Sept 2026 7 min read
LLMs
105Din
aicreatorhub.netAI News
105 Din Baad Gemini Ka Price Double: 3 Cheezein Dekhiye
Aaj jo sabse sasta model hai, uska price introductory hai — aur uski expiry date likhi hui hai. Gemini 3.8 Flash 31 December 2026 tak $0.75 in / $3.75 out per million token hai, aur 1 January 2027 se $1.50 / $7.50. Ye Google ke apne pricing page ke apne shabd hain, koi afwah nahi.

Agar aap bulk traffic Gemini Flash par bhej rahe hain kyunki wo flagship se kai guna sasta hai, to ye tareekh calendar me daal lijiye. 1 January 2027 ko us model ka har rate double ho jata hai, aur Google ne ye date khud batayi thi jab 2 September 2026 ko Gemini 3.8 Flash aaya.

Farak dekhiye, tabhi baat samajh aayegi. Claude Fable 5.1 aur GPT-6 Astra dono $10 per million input token lete hain. Gemini 3.8 Flash leta hai $0.75 — lagbhag terahwa hissa. Isi liye itna production traffic Flash par baitha hai, aur isi liye double hona pehle se planning maangta hai.

1. Introductory price 31 December ko khatam

Ye koi discount nahi hai jo koi Google ke price ke upar de raha ho. Ye Google ka apna price schedule hai, aur khatam hone ki tareekh launch announcement aur public pricing page dono par likhi hai.

$0.75 ho jayega $1.50 per million input token, aur $3.75 ho jayega $7.50 per million output. Dono par saaf 100 percent badhotari, ek hi din, aur beech me koi tier nahi jo ise halka kare.
Rate31 Dec 2026 tak1 Jan 2027 se
Input / 1M token$0.75$1.50
Output / 1M token (thinking samet)$3.75$7.50
Cached input / 1M$0.075$0.15
Cache storage / 1M / ghanta$0.50$1.00
Batch input / output$0.375 / $1.875$0.75 / $3.75

Gemini 3.6 Flash aur 3.7 Flash bhi usi din double hote hain. Purani generation par jaakar bachne ka raasta kaam nahi karega — ye baat migration plan banane se pehle jaan lena behtar hai, warna mehnat karke bachat zero milegi.

2. Jo line zyadatar log bhool jate hain, wo cache hai

Input aur output sab dekhte hain. Cached read bahut kam log dekhte hain, aur agentic kaam me — jahan assistant har turn par wahi system prompt, wahi documents, wahi badhti hui baat-cheet dobara padhta hai — bill ka sabse bada hissa wahi hota hai.

Cached input $0.075 se $0.15 ho jayega, aur cache storage $0.50 se $1.00 per million token per ghanta. Agar aapka kaam ek bade sthir prefix par tika hai, to wo storage wali line ghante ke hisaab se lagti hai — chahe koi request bheje ya na bheje.

Tulna ke liye: Claude Fable 5.1 cached context $0.25 per million me padhta hai aur Sonnet 5 $0.20 me. January ke baad bhi Gemini Flash ka $0.15 in sabse sasta rahega — lekin faasla ghat jayega, aur aaj ke numbers par liya gaya routing ka faisla us badlaav ke baad shayad theek na rahe.

3. Wahi per-token price, phir bhi bada bill

Gemini 3.8 Flash bilkul usi rate par aaya jo 3.7 aur 3.6 Flash pehle se le rahe the — teen generation, ek price card. Padhne me ye muft upgrade lagta hai. Per task, hamesha nahi hota.

Artificial Analysis ne naapa: 3.8 Flash par high effort par $0.58 per index task, jabki 3.7 Flash par $0.40 — lagbhag 45 percent zyada per task — kyunki 3.8 Flash takreeban 30 percent zyada output token banata hai. Output ke daam me thinking tokens bhi ginte hain, to jo model zyada sochta hai wo usi rate par mehnga padta hai.

Har per-token tulna me yahi jaal hai, aur ye dono taraf chalta hai: jo model ek baar me kaam khatam kar de wo us saste model se sasta pad sakta hai jise teen baar chalana pade. Kharcha per token nahi, per poora hua kaam naapiye. Bill wahi number bharta hai.

January se pehle kya kar lena chahiye

  • Apne asli workload ka hisaab January wale rate par lagaiye, aaj wale par nahi. Pichhle mahine ka token usage lijiye, Gemini wali lines double kar dijiye, aur dekhiye faisla tab bhi tikta hai ya nahi.
  • Dekhiye aapke input ka kitna hissa cached hai. Agar zyada hai, to cache-read aur storage wali line aapke liye headline input price se zyada maayne rakhti hai.
  • Apne hi kaam par per completed task naapiye, usi effort setting par jo aap sach me use karte hain. Benchmarks aksar us setting par chalte hain jo aap chala hi nahi rahe.
  • Mid-December ka reminder laga lijiye. Daam bina bataye badalte hain, aur samajhdari ye hai ki tab Google ka pricing page khud padh lein, is article ke chaar mahine purane numbers par bharosa na karein.
Ek routing niyam jo badlaav ke baad bhi chalega: bulk traffic saste model par, ek flagship sirf un kaamon ke liye jo uske bina sach me fail hote hain, aur jab bhi koi price hile tab ye batwara dobara dekh lena. Labs apna rate card utni baar badalte hain jitni baar zyadatar teams apni routing dekhti bhi nahi.

Is pandrah din me do aur cheezein

Gemini 3.8 Live aur 3.8 Live Extended Thinking 15 September 2026 ko aaye — voice agents ke liye bane live dialogue models, jo beech me toka jana sambhal lete hain aur baat karte-karte bhasha badal sakte hain; Extended Thinking wala version multi-step kaam ke liye hai. Developers ke liye Gemini API aur AI Studio me, aur baaki sabke liye Search Live aur Gemini Live me. Indian audience ke liye bhasha badalne wali baat sabse dilchasp hai — hum ise khud test karke likhenge, launch wali copy dohrayenge nahi.

GPT-6 Astra OpenAI ka pehla model ban gaya jise cybersecurity me Critical level par rakha gaya — unke Preparedness Framework ke tahat, 17 September ko report hua. Usi din Microsoft ne ise Foundry Models me generally available kar diya. Isi classification ki wajah se rollout pehle sirf vetted organisations ko mila tha, sabko nahi.

Yahan ke aankde 18 September 2026 ko Google ke public pricing page aur companies ke apne announcements se liye gaye hain. AI ke daam bina bataye badalte hain — budget banane se pehle source khud dekh lijiye.
📊 At a glance

Save this summary as an image or share it.

AAICreatorHubLLMs105 Din Baad Gemini Ka PriceDouble: 3 Cheezein Dekhiye1Apne asli workload ka hisaab January wale ratepar lagaiye, aaj wale par nahi. Pichhle mahineka token usage lijiye, Gemini wali lines…2Dekhiye aapke input ka kitna hissa cached hai.Agar zyada hai, to cache-read aur storage waliline aapke liye headline input price se zyada…3Apne hi kaam par per completed task naapiye,usi effort setting par jo aap sach me usekarte hain. Benchmarks aksar us setting par…4Mid-December ka reminder laga lijiye. Daambina bataye badalte hain, aur samajhdari yehai ki tab Google ka pricing page khud padh…aicreatorhub.netSave & share
Share:
A

AICreatorHub Team

The AICreatorHub editorial team is a group of hands-on AI practitioners, writers and developers based in India. We test AI tools and models ourselves, track official releases from OpenAI, Anthropic, Google, Meta and xAI, and translate them into simple, India-first guides in English and Hindi. Every article is written for real Indian use cases — pricing in rupees, free-tier tips and practical, tested steps — so you get accurate, up-to-date and genuinely useful AI information.

Related news

View all
LLMs

फ्री और ओपन AI मॉडल 2026: Mistral, Qwen, Kimi — अपने कंप्यूटर पर चलाएँ

aicreatorhub.netAI News
LLMs

फ्री और ओपन AI मॉडल 2026: Mistral, Qwen, Kimi — अपने कंप्यूटर पर चलाएँ

Mistral Large 3, Qwen 4 और Kimi K3 — ऐसे AI मॉडल जो पूरी तरह फ्री हैं और आप अपने सर्वर पर चला सकते हैं। कौन-सा किसके लिए सही है।

AICreatorHub Team17 Aug 2026· 7 min
LLMs

ChatGPT बनाम Gemini बनाम Claude: 2026 में भारतीयों के लिए सबसे अच्छा AI

aicreatorhub.netAI News
LLMs

ChatGPT बनाम Gemini बनाम Claude: 2026 में भारतीयों के लिए सबसे अच्छा AI

तीन सबसे बड़े AI असिस्टेंट की एक प्रैक्टिकल, इंडिया-फर्स्ट तुलना — हिंदी, ₹ में कीमत, कोडिंग, पढ़ाई और रोज़मर्रा के काम के लिए।

AICreatorHub Team6 Jul 2026· 10 min