فهرست مطالب
گوگل در ۲ سپتامبر ۲۰۲۶ (۱۱ شهریور ۱۴۰۵) مدل Gemini 3.8 Flash را معرفی کرد: سریعترین و — به گفتهٔ خود شرکت — هوشمندترین مدل خانوادهٔ «فلش»، مخصوص کدنویسی و عاملهای هوش مصنوعی که خودشان چند مرحله کار میکنند. قیمت APIاش تا پایان ۲۰۲۶ همان قیمت نسل قبل است (۰٫۷۵ دلار ورودی و ۳٫۷۵ دلار خروجی بهازای هر میلیون توکن)، اما دو نکتهٔ مهم پشت این عدد قشنگ پنهان است: مدل پرحرفتر شده و هزینهٔ واقعی هر تسک را ۴۵٪ بالا برده، و قیمت فعلی تبلیغاتی است و از ۱۱ دی ۱۴۰۵ دو برابر میشود.
اگر «فلش» برایت فقط یک اسم است، اول خیلی ساده میگوییم این خانواده چیست و چرا گوگل هر چند هفته یک نسخهٔ تازه میدهد؛ بعد میبینیم 3.8 دقیقاً چه چیزی آورده، در بنچمارکها کجا جلو و کجا عقب است، سه نقطهٔ قوت و سه نقطهٔ ضعف واقعیش چیست، و در آخر میگوییم برای چه کسی میارزد و چه کسی بهتر است صبر کند.
پاسخ کوتاه
Gemini 3.8 Flash سومین مدل فلش گوگل در شش هفته است که ۲ سپتامبر ۲۰۲۶ معرفی شد؛ طراحیشده برای کدنویسی و ایجنتهای چندمرحلهای، نه چت ساده. (به گفتهٔ گوگل، در پست مشترک Tulsee Doshi و Raluca Ada Popa)
مشخصات کلیدی: پنجرهٔ ورودی یک میلیون توکن (یعنی حدود چند هزار صفحه متن در یک درخواست)، سقف خروجی ۶۵ هزار توکن، ورودی بومی متن، تصویر، ویدیو، صوت و PDF، و سه سطح «تفکر» کم/متوسط/زیاد که خودت انتخاب میکنی.
در بنچمارکهای گوگل از نسل قبل جلوتر است: DeepSWE ٪۷۳٫۷ در برابر ٪۶۵٫۳، و در تست مستقل LiveCodeBench ٪۸۹٫۴۸. اما در برابر GPT-5.6 Terra در چند بنچمارک کدنویسی دیگر عقب است — جزئیات در جدول.
تلهٔ اول: مدل «بیشتر فکر میکند» یعنی توکن خروجی بیشتری مصرف میکند؛ به اندازهگیری Artificial Analysis، هزینهٔ واقعی هر تسک ۴۵٪ بیشتر از 3.7 Flash است، با وجود قیمت یکسان هر توکن.
تلهٔ دوم: قیمت ۰٫۷۵/۳٫۷۵ دلاری تبلیغاتی است و از ۱ ژانویهٔ ۲۰۲۷ (۱۱ دی ۱۴۰۵) دو برابر میشود. خود گوگل هم میگوید اگر «کارایی» برایت مهمتر از «هوش» است، روی 3.7 Flash بمان.
اول زمینه: «فلش» گوگل دقیقاً چیست؟
فلش یعنی سریع و ارزان، پرو یعنی قوی و گران
گوگل مدلهایش را در دو خانواده میفروشد: Pro سنگین و گران برای کارهای پیچیده، Flash سبک و ارزان برای حجم بالا و سرعت. فلش از اول قرار نبوده «بهترین» باشد؛ قرار بوده ارزانترین گزینهٔ قابلاستفاده باشد — مثل 2.5 Flash-Lite با ۰٫۰۷۵ دلار ورودی که سالهاست کف قیمت بازار است.
چرا گوگل هر چند هفته یک فلش تازه میدهد؟
چون بازار مدلهای ارزانقیمت در ۲۰۲۶ به جنگ قیمت تبدیل شده است. فقط در پنج هفتهٔ تابستان، قیمت مدلهای کوچک تا ۸۰٪ افتاد: اوپنایآی قیمت GPT-5.6 Luna را ۸۰٪ کم کرد و انثروپیک افزایش قیمت برنامهریزیشدهٔ Claude Sonnet 5 را لغو کرد. در چنین بازاری، هر آزمایشگاه باید هر چند هفته نشان دهد هنوز «ارزان و بهروز» است. 3.8 Flash سومین فلش گوگل در شش هفته است — سرعتی که در تاریخ این خانواده سابقه نداشته.
«عامل» یعنی چه؟ چرا 3.8 برای عاملها ساخته شده؟
عامل (agent) یعنی مدلی که فقط جواب نمیدهد؛ خودش ابزار میگیرد، فایل را باز میکند، کد را عوض میکند، دستور اجرا میکند، نتیجه را میسنجد و دوباره تلاش میکند. گوگل 3.8 Flash را دقیقاً برای همین گردشکار طولانی طراحی کرده: مدلی که «سختتر کار میکند» — قدمهای استدلال بیشتر برمیدارد و ابزارها را پشت سر هم صدا میزند. این فلسفه، هم منشأ قوتش است و هم منشأ ضعفش؛ جلوتر میبینی چرا.
خانوادهٔ 3.8 دقیقاً چه چیزی عرضه کرد؟
«Gemini 3.8» فقط یک مدل نیست؛ یک خانواده است که در شهریور و مهر ۱۴۰۵ تکهتکه عرضه شد:
۲ سپتامبر (۱۱ شهریور): Gemini 3.8 Flash — مدل اصلی، عمومی و در API.
۲ سپتامبر: Gemini 3.8 Flash Cyber — نسخهٔ امنیتمحور، فقط برای «مدافعان تأییدشده» (نهادهای دولتی، زیرساخت حیاتی، نگهدارندگان نرمافزار) از طریق برنامهٔ Fairwind گوگل.
۱۵ سپتامبر (۲۴ شهریور): Gemini 3.8 Live و Live Extended Thinking — مدلهای صوتبهصوت (یعنی صدا را مستقیم میشنوند و مستقیم جواب صوتی میدهند، بدون تبدیل واسطه به متن) برای توسعهدهندگان در API و AI Studio؛ معرفی گستردهتر ۷ اکتبر.
۲۳ سپتامبر (۱ مهر): Gemini 3.8 Flash TTS — مدل تبدیل متن به گفتار خلاقانه؛ میتوانی با توصیف متنی، صدای تازه بسازی و لحن و لهجه را خطبهخط هدایت کنی.
این بررسی روی Flash متمرکز است — مدلی که تو بهعنوان توسعهدهنده یا کاربر اپ جمینای با آن سروکار داری — و هرجا لازم شد، سراغ Live و Cyber هم میرویم.
مشخصات کلیدی Gemini 3.8 Flash
جدول زیر مهمترین عددهایی است که گوگل رسماً اعلام کرده؛ هر عدد را با مقیاسش بخوان تا گول بزرگیاش را نخوری:
مشخصه | مقدار (به گفتهٔ گوگل) | یعنی چه؟ |
|---|---|---|
پنجرهٔ ورودی | ۱٬۰۴۸٬۵۷۶ توکن | حدود چند هزار صفحه متن یا یک کدبیس متوسط، در یک درخواست |
سقف خروجی | ۶۵٬۵۳۶ توکن | حدود ۵۰ هزار کلمه؛ برای جوابهای خیلی بلند کافی است |
ورودیها | متن، تصویر، ویدیو، صوت، PDF | ویدیو را مستقیم میفهمد؛ رقیبها (کلود، GPT) ویدیو ورودی ندارند |
سطوح تفکر | کم / متوسط / زیاد | خودت انتخاب میکنی: سرعت بیشتر یا فکر عمیقتر |
قیمت ورودی (تا ۱۰ دی ۱۴۰۵) | ۰٫۷۵ دلار بهازای هر میلیون توکن | قیمت تبلیغاتی؛ از ۱۱ دی دو برابر میشود |
قیمت خروجی (تا ۱۰ دی ۱۴۰۵) | ۳٫۷۵ دلار بهازای هر میلیون توکن | توکنهای «فکر کردن» هم جزو خروجی حساب میشوند |
ورودی کششده | ۰٫۰۷۵ دلار بهازای هر میلیون توکن | اگر همان متن را تکرار کنی، ۹۰٪ ارزانتر |
دسترسی توسعهدهنده | Gemini API، AI Studio، Antigravity، Android Studio، Stitch | Antigravity سطح کاری ایجنتمحور تازهٔ گوگل است |
نکتهای که جدول نشان نمیدهد: توکنهای تفکر (thinking tokens) — یعنی همان فکر کردن اضافهای که مدل میکند — با تعرفهٔ خروجی حساب میشوند. پس هرچه مدل «بیشتر فکر کند»، صورتحسابت بیشتر میشود. این را نگه دار؛ در بخش ضعفها برمیگردیم سراغش.
بنچمارکها: کجا واقعاً جلو است؟
گوگل در جدول اعلام رسمیاش، 3.8 Flash را با نسل قبل (3.7 Flash) مقایسه کرد. اینها ادعای خود گوگل است، نه آزمون مستقل ما:
بنچمارک (یعنی چه؟) | Gemini 3.8 Flash | Gemini 3.7 Flash | نتیجه |
|---|---|---|---|
DeepSWE v1.1 (حل مسئلهٔ مهندسی نرمافزار سرتاسری) | ٪۷۳٫۷ | ٪۶۵٫۳ | جهش ۸٫۴ واحدی — قویترین رشد |
Terminal-bench 2.1 (کار با ترمینال و ابزار) | ٪۸۹٫۴ | ٪۸۵٫۸ | بهبود محسوس |
OSWorld-2.0 (کار با کامپیوتر مثل انسان) | ٪۵۹٫۰ | ٪۵۰٫۶ | بهبود محسوس |
HLE-Verified (پرسشهای سخت چندرشتهای) | ٪۵۴٫۹ | اعلام نشده | مبنای مقایسه نیست |
اما بنچمارک مستقل هم داریم. در گزارش راستیآزماییشدهٔ یک رسانهٔ تحلیلی، 3.8 Flash این نمرهها را گرفت: GPQA Diamond ٪۹۵٫۳، Humanity's Last Exam ٪۴۷٫۸، SciCode ٪۵۶٫۶، LiveCodeBench ٪۸۹٫۴۸ و MMMU-Pro ٪۸۹٫۰۸. گوگل هم میگوید در بنچمارک مالی Vals Finance Agent و بنچمارک حقوقی Harvey از «دیگر مدلهای فرانتیر» جلوتر است.
روی دیگر سکه: در همان گزارش مستقل، GPT-5.6 Terra در سه بنچمارک از 3.8 Flash جلو زد — Terminal-Bench نسخهٔ ۴ (٪۳۵ در برابر ٪۱۹٫۷)، CritPt و GDP.pdf. بنچمارک سرنوشت نیست؛ نوع کارت تعیین میکند کدام مدل به دردت میخورد.
نقاط قوت واقعی (با منبع)
۱. برای کدنویسی و ایجنتها ساخته شده، نه برای چت
بزرگترین تفاوت 3.8 با نسلهای قبل، جهتگیری است: برای «گردشکار طولانی» طراحی شده — برنامهریزی کند، چند قدم بردارد، از ابزار خارجی استفاده کند، کار خودش را تست کند و تکرار کند. به گزارش یک رسانهٔ تحلیلی، مدل میتواند فایلها را بازبینی کند، کد را تغییر دهد، دستور اجرا کند و نتیجه را ارزیابی کند؛ یعنی همان حلقهای که یک توسعهدهندهٔ واقعی طی میکند.
اگر با ابزارهایی مثل Claude Code یا Cursor کار کردهای، دقیقاً میدانی این یعنی چه: مدل دیگر فقط «تکهکد» پیشنهاد نمیدهد؛ یک تسک را از اول تا آخر جلو میبرد. سه سطح تفکر کم/متوسط/زیاد هم به تو اجازه میدهد برای هر درخواست، بین سرعت و عمق یکی را انتخاب کنی — چیزی که در مدلهای قبلی فلش، تکحالته بود.
۲. ویدیو و صوت را واقعاً میفهمد
اینجا گوگل برتری دارد که رقیبها ندارند. جمینای تنها مدل بزرگ جدی است که ویدیو و صوت را بهصورت بومی ورودی میگیرد — یعنی لازم نیست اول ویدیو را به متن تبدیل کنی. میتوانی یک کلیپ را بدهی و بپرسی «اینجا چه اتفاقی افتاد؟» یا یک فایل صوتی جلسه را بدهی و خلاصه بخواهی.
نسخهٔ Live همین خانواده یک قدم جلوتر است: صدا را مستقیم میشنود و مستقیم جواب صوتی میدهد — بدون زنجیرهٔ «صوت→متن→مدل→صوت» که تأخیر میساخت. نسخهٔ Extended Thinking در شاخص کیفیت صوتبهصوت Artificial Analysis رتبهٔ اول را گرفت (امتیاز ۸۲٫۶) و با ۰٫۸۴ دلار بهازای هر ساعت ورودی صوتی، ارزانترین گزینهٔ آن شاخص هم هست. جزئیات مدلهای صوتی را در مطلب گفتوگوی صوتی جمینای 3.8 پوشش دادهایم.
۳. در برابر «تزریق پرامپت» مقاومتر شده
تزریق پرامپت (prompt injection) یعنی دستور مخفیای که مهاجم داخل یک متن، ایمیل یا صفحهٔ وب قایم میکند تا مدلِ قربانی آن را اجرا کند. برای ایجنتهایی که وب میگردند و ایمیل خلاصه میکنند، این بزرگترین ریسک امنیتی است. به گزارش Gray Swan (شرکت تخصصی تست امنیت مدلها)، مدلهای 3.8 در مقاومت در برابر تزریق جهش قابلتوجهی داشتهاند.
این را بگذار کنار نسخهٔ Cyber — که در مطلب معرفی Flash و Cyber جمینای 3.8 جداگانه پوشش دادهایم — مدلی است مخصوص امنیت سایبری که ادعا میشود وصلهزنی آسیبپذیریها را ۲٫۶ برابر سریعتر میکند. سایبر فقط به «مدافعان تأییدشده» داده میشود (نهادهای دولتی، اپراتورهای زیرساخت حیاتی)، پس تو احتمالاً مستقیم به آن دسترسی نداری؛ اما پیامش روشن است: گوگل دارد امنیت را به یک خط تولید جدا تبدیل میکند، نه یک ویژگی فرعی.
نقاط ضعف واقعی (با منبع)
۱. پرحرف است و پرحرفیاش پول است
حالا برسیم به تلهٔ اصلی. فلسفهٔ «بیشتر فکر کن» یک هزینهٔ پنهان دارد: هر قدم فکر اضافه، توکن خروجی مصرف میکند و توکن خروجی ۵ برابر توکن ورودی قیمت دارد. شرکت مستقل Artificial Analysis اندازه گرفت که 3.8 Flash در حالت تفکر بالا برای تکمیل یک سوئیت ارزیابی استاندارد، ۱۲۰ میلیون توکن خروجی سوزاند — در برابر میانهٔ ۷۱ میلیون برای مدلهای مشابه. یعنی ۷۰٪ پرحرفی بیشتر.
نتیجه به زبان پول: هزینهٔ واقعی هر تسک برای 3.8 Flash ۰٫۵۸ دلار شد در برابر ۰٫۴۰ دلار برای 3.7 Flash — ۴۵٪ گرانتر، با وجود اینکه قیمت هر توکن دقیقاً یکی است. پس اگر داری حجم بالا کار میکنی (مثلاً هزاران تیکت پشتیبانی در شب)، «قیمت ارزان هر توکن» فریبنده است؛ باید هزینهٔ هر تسک تمامشده را حساب کنی. خود گوگل هم صریح گفته: اگر «کارایی» برایت اولویت است، روی 3.7 Flash بمان — «کاملاً پشتیبانی میشود».
۲. در حالت فکر عمیق، کُند است
همان اندازهگیری Artificial Analysis یک عدد دیگر هم دارد: زمان رسیدن به اولین توکن (یعنی فاصلهٔ بین فرستادن درخواست تا شروع جواب) در حالت تفکر بالا ۱۳٫۳ ثانیه است؛ میانهٔ مدلهای مشابه ۲٫۹۹ ثانیه. سیزده ثانیه برای یک چتبات یعنی مرگ — هیچ کاربری منتظر نمیماند.
پس 3.8 Flash در حالت قویاش برای اپهای تعاملی (چتبات پشتیبانی، دستیار صوتی زنده) گزینهٔ بدی است، مگر اینکه سطح تفکر را پایین بیاوری — که آنوقت بخشی از همان برتری بنچمارکی را از دست میدهی. این یک معاملهٔ واقعی است، نه یک باگ: عمیق فکر کردن زمان میبرد، و گوگل این را پنهان نکرده.
۳. قیمت امروز، قیمت فردا نیست
قیمت ۰٫۷۵/۳٫۷۵ دلاری که همهجا تبلیغ میشود، مقدماتی است و فقط تا ۳۱ دسامبر ۲۰۲۶ (۱۰ دی ۱۴۰۵) اعتبار دارد. از ۱ ژانویهٔ ۲۰۲۷: ورودی ۱٫۵۰ و خروجی ۷٫۵۰ دلار — دقیقاً دو برابر. اگر داری معماری محصولت را روی این مدل میبندی، باید با قیمت دوبرابری حساب کنی، نه قیمت امروز.
و یک نکتهٔ ظریفتر: در تست مقایسهای یک رسانه، 3.8 Flash جوابهایی حدود دو برابر طولانیتر از GPT-5.6 Sol و GPT-6 Astra نوشت. برای جزوه و خلاصهٔ تحقیق شاید خوب باشد؛ برای جواب آمادهٔ کپی، خستهکننده است. اگر از آن دستهای هستی که از مدل «جواب کوتاه و دقیق» میخواهی، باید در پرامپت صریحاً کوتاهی را تحمیل کنی.
مقایسه با رقبا: جدول صادقانه
جدول زیر 3.8 Flash را کنار نزدیکترین رقیبهایش میگذارد. قیمتها از مستندات رسمی و ردیابهای مستقلاند (اکتبر ۲۰۲۶):
مدل (شرکت) | قیمت ورودی/خروجی (دلار/میلیون توکن) | پنجرهٔ ورودی | نقطهٔ قوت شاخص | نقطهٔ ضعف شاخص |
|---|---|---|---|---|
Gemini 3.8 Flash (گوگل) | ۰٫۷۵ / ۳٫۷۵ (تا ۱۰ دی؛ بعد ۱٫۵۰ / ۷٫۵۰) | ۱ میلیون | ورودی بومی ویدیو/صوت؛ قیمت پایین | پرحرفی ۷۰٪؛ تأخیر ۱۳ ثانیهای در تفکر بالا |
GPT-5.6 Terra (اوپنایآی) | ۲ / ۱۲ | ۱ میلیون | در چند بنچمارک کدنویسی ترمینال جلوتر | گرانتر؛ ورودی ویدیو/صوت ندارد |
Claude Opus 5.5 (انثروپیک) | حدود ۴ / ۲۰ (۲۰٪ کمتر از Opus 5) | ۱ میلیون | اعتماد توسعهدهندهها در کدنویسی؛ کیفیت ابزار | چند برابر گرانتر از فلش |
Gemini 3.1 Pro (گوگل) | ۲ / ۱۲ | ۱ میلیون | استدلال عمیقتر از فلش | قیمت بالاتر؛ همان اکوسیستم گوگل |
GPT-6 Sol (اوپنایآی) | حدود ۵ / ۳۰ (خط Sol نصف شده) | ۱ میلیون | پرچمدار کدنویسی اوپنایآی | گران؛ برای حجم بالا مناسب نیست |
جدول را اینطور بخوان: 3.8 Flash در قیمت بهازای هر توکن بیرقیبِ ارزان است، اما در هزینهٔ هر تسک واقعی فاصلهاش با 3.7 Flash کمتر از چیزی است که تبلیغ میشود؛ و در اعتماد اکوسیستم توسعهدهنده هنوز پشت کلود و GPT است — از جمله Claude Opus 5.5 انثروپیک که همزمان با همین نسل عرضه شد. به تحلیل یک رسانه، مشکل جمینای قیمت نیست؛ قفل اکوسیستم است: توسعهدهندهای که سالها روی GPT و کلود ساخته، برای مهاجرت باید پرامپتها را بازنویسی و تستها را دوباره بگذراند — و این هزینهٔ جابهجایی، بنچمارک خوب را خنثی میکند.
دسترسی و قیمت: از کجا شروع کنی؟
سه مسیر داری، بسته به اینکه کی هستی:
توسعهدهنده: از Google AI Studio یا Gemini API شروع کن؛ سطح رایگان برای تست کافی است. اگر ایجنت میسازی، Antigravity همان جایی است که گوگل دموهای 3.8 را در آن نشان داد. برای ساختن رابط کاربری، Stitch هست.
کاربر عادی: در اپ جمینای برای مشترکان Google AI Pro (۱۹٫۹۹ دلار در ماه) و Ultra؛ در جستوجوی گوگل (AI Mode) و Sheets هم هست. نسخهٔ رایگان، مدل سبکتر و پنجرهٔ کوچکتر (۳۲ هزار توکن) میدهد.
تیم امنیتی: نسخهٔ Cyber فقط از مسیر Fairwind Program و برای مدافعان تأییدشده است.
یک توصیهٔ عملی از خود گوگل که حیف است نادیده بگیری: سطح تفکر را برای هر کار جدا تنظیم کن. برای خلاصهسازی ایمیل، «کم» کافی است و سریع و ارزان تمام میشود؛ «زیاد» را فقط برای مسئلههای واقعاً سخت نگه دار. این یک درجهبندی ساده، همان تلهٔ پرحرفی را تا حد زیادی خنثی میکند.
نکتهای برای خوانندهٔ فارسیزبان
دو چیز را رک بگویم. اول: گوگل وضعیت دسترسی منطقهای این مدل — از جمله ایران — را جداگانه اعلام نکرده؛ همان قاعدهٔ کلی سرویسهای گوگل برقرار است: حساب گوگل لازم است و بعضی قابلیتها فقط در «کشورهای منتخب» عرضه شدهاند. دوم: بنچمارک فارسیِ خاصی برای 3.8 منتشر نشده؛ همهٔ عددهایی که خواندی انگلیسیمحورند. اگر کارت متن فارسی است، قبل از هر تصمیمی خودت با چند نمونهٔ واقعی فارسی تست بگیر — عدد انگلیسی، تضمین فارسی نیست.
از نظر قیمت دلاری هم واقعبین باش: ۰٫۷۵ دلار بهازای هر میلیون توکن برای توسعهدهندهٔ فردی عدد بزرگی نیست، اما اگر محصولت را روی قیمت تبلیغاتیِ تا ۱۰ دی ببندی و از ۱۱ دی دو برابر شود، حاشیهات بههم میریزد. رقم تومان را اینجا اختراع نمیکنیم؛ ولی قاعدهاش ساده است: همیشه با قیمتِ بعد از اتمام تخفیف حساب کن.
برای چه کسی میارزد؟ (بدون نمره، فقط توصیه)
قول داده بودیم نمره ندهیم؛ پس بهجای ستاره، سه دسته میگوییم:
امتحانش کن، اگر: ایجنت کدنویسی یا ابزار چندمرحلهای میسازی و حجم توکنت بالاست؛ با ویدیو یا صوت بهعنوان ورودی کار داری (اینجا رقیب جدی ندارد)؛ یا میخواهی با قیمت امروز، قبل از ۱۰ دی، یک پروژه را جلو ببری.
صبر کن، اگر: کارت «کاراییمحور» است و تأخیر برایت مهم است — خود گوگل میگوید روی 3.7 Flash بمان؛ یا میخواهی ببینی قیمت ژانویه واقعاً دو برابر میشود یا گوگل تمدیدش میکند.
سراغش نرو، اگر: چتبات تعاملی یا دستیار صوتی زنده میسازی و نمیتوانی ۱۳ ثانیه تأخیر را تحمل کنی؛ یا قبلاً روی کلود/ GPT سرمایهگذاری سنگین کردهای و هزینهٔ جابهجاییات از سود قیمت بیشتر است.
چیزهایی که هنوز روشن نیست
قیمت جداگانهٔ نسخهٔ Cyber اعلام نشده است.
مشخص نیست گوگل قیمت تبلیغاتی را بعد از ۱۰ دی تمدید میکند یا نه؛ سابقه نشان میدهد در جنگ قیمت، تمدیدها بعید نیستند.
بنچمارک فارسی و وضعیت دقیق دسترسی از ایران اعلام نشده است.
زمان عرضهٔ پرچمدار بعدی (که در گزارشها «Gemini 4 Argon» خوانده میشود) معلوم نیست؛ اگر 3.8 برایت «کافی» نیست، شاید ارزش صبر کردن داشته باشد.
جمعبندی
Gemini 3.8 Flash بهترین «فلش»ی است که گوگل تا امروز ساخته: در کدنویسی و کار ایجنتی از نسل قبل جلوتر است، ویدیو و صوت را بومی میفهمد، و در برابر تزریق پرامپت مقاومتر شده. اما «بهترین فلش» بودن، آن را به «بهترین انتخاب برای همه» تبدیل نمیکند: پرحرفیاش هزینهٔ واقعی هر تسک را ۴۵٪ بالا برده، در حالت فکر عمیق ۱۳ ثانیه تأخیر دارد، و قیمت امروزش تا ۱۰ دی بیشتر اعتبار ندارد.
پس تصمیم ساده است: اگر حجم بالا کار میکنی و سطح تفکر را خودت مدیریت میکنی، 3.8 یک معاملهٔ خوب است — بهشرطی که با قیمتِ بعد از تخفیف حساب کنی. اگر نه، 3.7 Flash همانجا منتظر توست؛ و خود گوگل هم همین را میگوید.
سؤالات پرتکرار
Gemini 3.8 Flash دقیقاً کی عرضه شد؟
۲ سپتامبر ۲۰۲۶ (۱۱ شهریور ۱۴۰۵)، در پست مشترک دو مدیر گوگل: Tulsee Doshi و Raluca Ada Popa. همان روز نسخهٔ امنیتی Cyber هم معرفی شد.
فرق Flash با Pro در چیست؟
فلش سبکتر، سریعتر و ارزانتر است برای حجم بالا؛ پرو سنگینتر و گرانتر است برای استدلال عمیق. 3.8 Flash حدود یکسیام قیمت خروجی پرچمدارهای رقیب را دارد، اما پرچمدار نیست.
قیمتش واقعاً چقدر است؟
تا ۱۰ دی ۱۴۰۵: ۰٫۷۵ دلار ورودی و ۳٫۷۵ دلار خروجی بهازای هر میلیون توکن. از ۱۱ دی ۱۴۰۵: دو برابر — ۱٫۵۰ و ۷٫۵۰ دلار. توکنهای «فکر کردن» هم با تعرفهٔ خروجی حساب میشوند.
چرا میگویید هزینهٔ واقعیاش بیشتر از قیمت هر توکن است؟
چون مدل پرحرفتر شده: به اندازهگیری مستقل Artificial Analysis، برای یک تسک استاندارد ۷۰٪ توکن خروجی بیشتر از میانهٔ بازار مصرف میکند و هزینهٔ هر تسک ۴۵٪ بالاتر از 3.7 Flash درمیآید، با وجود قیمت یکسان هر توکن.
برای چتبات فارسی مناسب است؟
برای چت تعاملی، نه چندان: در حالت تفکر بالا ۱۳٫۳ ثانیه تا شروع جواب طول میکشد. برای کارهای غیرتعاملی (خلاصهسازی، تحلیل ویدیو/صوت، ایجنت پسزمینه) گزینهٔ خوبی است. بنچمارک فارسی هم منتشر نشده؛ خودت تست بگیر.
نسخهٔ Cyber را چطور میشود گرفت؟
فقط از مسیر Fairwind Program گوگل و برای «مدافعان تأییدشده» — نهادهای دولتی، اپراتورهای زیرساخت حیاتی و نگهدارندگان نرمافزار. کاربر عادی و توسعهدهندهٔ معمولی به آن دسترسی ندارد.
بهجای 3.8 Flash از چه مدلی استفاده کنم؟
اگر «کارایی و سرعت» مهمتر است: همان 3.7 Flash که گوگل میگوید کاملاً پشتیبانی میشود. اگر «کیفیت کدنویسی» مهمتر است و بودجه داری: Claude Opus 5.5 یا GPT-5.6 Terra را هم تست کن؛ در بعضی بنچمارکها جلوترند. اگر «استدلال عمیقتر گوگلی» میخواهی: 3.1 Pro.
منابع
VentureBeat — Google's Gemini 3.8 Flash is built for agents, while its Cyber twin hunts vulnerabilities
GCN — Google ships Gemini 3.8 Flash with stronger agentic coding
TechTimes — Google Launches Gemini 3.8 Flash Cyber
MarkTechPost — Google Releases Gemini 3.8 Live and 3.8 Live Extended Thinking
Intelligent Living — Gemini 3.8 Flash: Benchmarks, Pricing & Reasoning Tradeoff
Tech Insider — Gemini 3.8 Flash Confirmed as 80% AI Price Cuts Hold
Promptslove — Gemini vs ChatGPT 2026: Models, Pricing, Privacy, Winners
Memeburn — Gemini 3.8 Live: Google Still Trails OpenAI, Anthropic
Google Blog — Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS
TechnologyBlog — Google Gemini Latest Features: September 2026



