پرش به محتوای اصلی
بررسی و نقد

بررسی Gemini 3.8؛ فلشِ گوگل که «بیشتر فکر می‌کند»

جمینای 3.8 Flash قوی‌ترین فلش گوگل برای کدنویسی و ایجنت‌هاست؛ اما پرحرفی‌اش هزینهٔ هر تسک را ۴۵٪ بالا برده و قیمتش از ۱۱ دی دو برابر می‌شود.

۱۸ دقیقه مطالعه
اشتراک‌گذاری:
فهرست مطالب

گوگل در ۲ سپتامبر ۲۰۲۶ (۱۱ شهریور ۱۴۰۵) مدل Gemini 3.8 Flash را معرفی کرد: سریع‌ترین و — به گفتهٔ خود شرکت — هوشمندترین مدل خانوادهٔ «فلش»، مخصوص کدنویسی و عامل‌های هوش مصنوعی که خودشان چند مرحله کار می‌کنند. قیمت APIاش تا پایان ۲۰۲۶ همان قیمت نسل قبل است (۰٫۷۵ دلار ورودی و ۳٫۷۵ دلار خروجی به‌ازای هر میلیون توکن)، اما دو نکتهٔ مهم پشت این عدد قشنگ پنهان است: مدل پرحرف‌تر شده و هزینهٔ واقعی هر تسک را ۴۵٪ بالا برده، و قیمت فعلی تبلیغاتی است و از ۱۱ دی ۱۴۰۵ دو برابر می‌شود.

اگر «فلش» برایت فقط یک اسم است، اول خیلی ساده می‌گوییم این خانواده چیست و چرا گوگل هر چند هفته یک نسخهٔ تازه می‌دهد؛ بعد می‌بینیم 3.8 دقیقاً چه چیزی آورده، در بنچمارک‌ها کجا جلو و کجا عقب است، سه نقطهٔ قوت و سه نقطهٔ ضعف واقعیش چیست، و در آخر می‌گوییم برای چه کسی می‌ارزد و چه کسی بهتر است صبر کند.

پاسخ کوتاه

  • Gemini 3.8 Flash سومین مدل فلش گوگل در شش هفته است که ۲ سپتامبر ۲۰۲۶ معرفی شد؛ طراحی‌شده برای کدنویسی و ایجنت‌های چندمرحله‌ای، نه چت ساده. (به گفتهٔ گوگل، در پست مشترک Tulsee Doshi و Raluca Ada Popa)

  • مشخصات کلیدی: پنجرهٔ ورودی یک میلیون توکن (یعنی حدود چند هزار صفحه متن در یک درخواست)، سقف خروجی ۶۵ هزار توکن، ورودی بومی متن، تصویر، ویدیو، صوت و PDF، و سه سطح «تفکر» کم/متوسط/زیاد که خودت انتخاب می‌کنی.

  • در بنچمارک‌های گوگل از نسل قبل جلوتر است: DeepSWE ٪۷۳٫۷ در برابر ٪۶۵٫۳، و در تست مستقل LiveCodeBench ٪۸۹٫۴۸. اما در برابر GPT-5.6 Terra در چند بنچمارک کدنویسی دیگر عقب است — جزئیات در جدول.

  • تلهٔ اول: مدل «بیشتر فکر می‌کند» یعنی توکن خروجی بیشتری مصرف می‌کند؛ به اندازه‌گیری Artificial Analysis، هزینهٔ واقعی هر تسک ۴۵٪ بیشتر از 3.7 Flash است، با وجود قیمت یکسان هر توکن.

  • تلهٔ دوم: قیمت ۰٫۷۵/۳٫۷۵ دلاری تبلیغاتی است و از ۱ ژانویهٔ ۲۰۲۷ (۱۱ دی ۱۴۰۵) دو برابر می‌شود. خود گوگل هم می‌گوید اگر «کارایی» برایت مهم‌تر از «هوش» است، روی 3.7 Flash بمان.

اول زمینه: «فلش» گوگل دقیقاً چیست؟

فلش یعنی سریع و ارزان، پرو یعنی قوی و گران

گوگل مدل‌هایش را در دو خانواده می‌فروشد: Pro سنگین و گران برای کارهای پیچیده، Flash سبک و ارزان برای حجم بالا و سرعت. فلش از اول قرار نبوده «بهترین» باشد؛ قرار بوده ارزان‌ترین گزینهٔ قابل‌استفاده باشد — مثل 2.5 Flash-Lite با ۰٫۰۷۵ دلار ورودی که سال‌هاست کف قیمت بازار است.

چرا گوگل هر چند هفته یک فلش تازه می‌دهد؟

چون بازار مدل‌های ارزان‌قیمت در ۲۰۲۶ به جنگ قیمت تبدیل شده است. فقط در پنج هفتهٔ تابستان، قیمت مدل‌های کوچک تا ۸۰٪ افتاد: اوپن‌ای‌آی قیمت GPT-5.6 Luna را ۸۰٪ کم کرد و انثروپیک افزایش قیمت برنامه‌ریزی‌شدهٔ Claude Sonnet 5 را لغو کرد. در چنین بازاری، هر آزمایشگاه باید هر چند هفته نشان دهد هنوز «ارزان و به‌روز» است. 3.8 Flash سومین فلش گوگل در شش هفته است — سرعتی که در تاریخ این خانواده سابقه نداشته.

«عامل» یعنی چه؟ چرا 3.8 برای عامل‌ها ساخته شده؟

عامل (agent) یعنی مدلی که فقط جواب نمی‌دهد؛ خودش ابزار می‌گیرد، فایل را باز می‌کند، کد را عوض می‌کند، دستور اجرا می‌کند، نتیجه را می‌سنجد و دوباره تلاش می‌کند. گوگل 3.8 Flash را دقیقاً برای همین گردش‌کار طولانی طراحی کرده: مدلی که «سخت‌تر کار می‌کند» — قدم‌های استدلال بیشتر برمی‌دارد و ابزارها را پشت سر هم صدا می‌زند. این فلسفه، هم منشأ قوتش است و هم منشأ ضعفش؛ جلوتر می‌بینی چرا.

خانوادهٔ 3.8 دقیقاً چه چیزی عرضه کرد؟

«Gemini 3.8» فقط یک مدل نیست؛ یک خانواده است که در شهریور و مهر ۱۴۰۵ تکه‌تکه عرضه شد:

  • ۲ سپتامبر (۱۱ شهریور): Gemini 3.8 Flash — مدل اصلی، عمومی و در API.

  • ۲ سپتامبر: Gemini 3.8 Flash Cyber — نسخهٔ امنیت‌محور، فقط برای «مدافعان تأییدشده» (نهادهای دولتی، زیرساخت حیاتی، نگه‌دارندگان نرم‌افزار) از طریق برنامهٔ Fairwind گوگل.

  • ۱۵ سپتامبر (۲۴ شهریور): Gemini 3.8 Live و Live Extended Thinking — مدل‌های صوت‌به‌صوت (یعنی صدا را مستقیم می‌شنوند و مستقیم جواب صوتی می‌دهند، بدون تبدیل واسطه به متن) برای توسعه‌دهندگان در API و AI Studio؛ معرفی گسترده‌تر ۷ اکتبر.

  • ۲۳ سپتامبر (۱ مهر): Gemini 3.8 Flash TTS — مدل تبدیل متن به گفتار خلاقانه؛ می‌توانی با توصیف متنی، صدای تازه بسازی و لحن و لهجه را خط‌به‌خط هدایت کنی.

این بررسی روی Flash متمرکز است — مدلی که تو به‌عنوان توسعه‌دهنده یا کاربر اپ جمینای با آن سروکار داری — و هرجا لازم شد، سراغ Live و Cyber هم می‌رویم.

مشخصات کلیدی Gemini 3.8 Flash

جدول زیر مهم‌ترین عددهایی است که گوگل رسماً اعلام کرده؛ هر عدد را با مقیاسش بخوان تا گول بزرگی‌اش را نخوری:

مشخصه

مقدار (به گفتهٔ گوگل)

یعنی چه؟

پنجرهٔ ورودی

۱٬۰۴۸٬۵۷۶ توکن

حدود چند هزار صفحه متن یا یک کدبیس متوسط، در یک درخواست

سقف خروجی

۶۵٬۵۳۶ توکن

حدود ۵۰ هزار کلمه؛ برای جواب‌های خیلی بلند کافی است

ورودی‌ها

متن، تصویر، ویدیو، صوت، PDF

ویدیو را مستقیم می‌فهمد؛ رقیب‌ها (کلود، GPT) ویدیو ورودی ندارند

سطوح تفکر

کم / متوسط / زیاد

خودت انتخاب می‌کنی: سرعت بیشتر یا فکر عمیق‌تر

قیمت ورودی (تا ۱۰ دی ۱۴۰۵)

۰٫۷۵ دلار به‌ازای هر میلیون توکن

قیمت تبلیغاتی؛ از ۱۱ دی دو برابر می‌شود

قیمت خروجی (تا ۱۰ دی ۱۴۰۵)

۳٫۷۵ دلار به‌ازای هر میلیون توکن

توکن‌های «فکر کردن» هم جزو خروجی حساب می‌شوند

ورودی کش‌شده

۰٫۰۷۵ دلار به‌ازای هر میلیون توکن

اگر همان متن را تکرار کنی، ۹۰٪ ارزان‌تر

دسترسی توسعه‌دهنده

Gemini API، AI Studio، Antigravity، Android Studio، Stitch

Antigravity سطح کاری ایجنت‌محور تازهٔ گوگل است

نکته‌ای که جدول نشان نمی‌دهد: توکن‌های تفکر (thinking tokens) — یعنی همان فکر کردن اضافه‌ای که مدل می‌کند — با تعرفهٔ خروجی حساب می‌شوند. پس هرچه مدل «بیشتر فکر کند»، صورت‌حسابت بیشتر می‌شود. این را نگه دار؛ در بخش ضعف‌ها برمی‌گردیم سراغش.

بنچمارک‌ها: کجا واقعاً جلو است؟

گوگل در جدول اعلام رسمی‌اش، 3.8 Flash را با نسل قبل (3.7 Flash) مقایسه کرد. این‌ها ادعای خود گوگل است، نه آزمون مستقل ما:

بنچمارک (یعنی چه؟)

Gemini 3.8 Flash

Gemini 3.7 Flash

نتیجه

DeepSWE v1.1 (حل مسئلهٔ مهندسی نرم‌افزار سرتاسری)

٪۷۳٫۷

٪۶۵٫۳

جهش ۸٫۴ واحدی — قوی‌ترین رشد

Terminal-bench 2.1 (کار با ترمینال و ابزار)

٪۸۹٫۴

٪۸۵٫۸

بهبود محسوس

OSWorld-2.0 (کار با کامپیوتر مثل انسان)

٪۵۹٫۰

٪۵۰٫۶

بهبود محسوس

HLE-Verified (پرسش‌های سخت چندرشته‌ای)

٪۵۴٫۹

اعلام نشده

مبنای مقایسه نیست

اما بنچمارک مستقل هم داریم. در گزارش راستی‌آزمایی‌شدهٔ یک رسانهٔ تحلیلی، 3.8 Flash این نمره‌ها را گرفت: GPQA Diamond ٪۹۵٫۳، Humanity's Last Exam ٪۴۷٫۸، SciCode ٪۵۶٫۶، LiveCodeBench ٪۸۹٫۴۸ و MMMU-Pro ٪۸۹٫۰۸. گوگل هم می‌گوید در بنچمارک مالی Vals Finance Agent و بنچمارک حقوقی Harvey از «دیگر مدل‌های فرانتیر» جلوتر است.

روی دیگر سکه: در همان گزارش مستقل، GPT-5.6 Terra در سه بنچمارک از 3.8 Flash جلو زد — Terminal-Bench نسخهٔ ۴ (٪۳۵ در برابر ٪۱۹٫۷)، CritPt و GDP.pdf. بنچمارک سرنوشت نیست؛ نوع کارت تعیین می‌کند کدام مدل به دردت می‌خورد.

نقاط قوت واقعی (با منبع)

۱. برای کدنویسی و ایجنت‌ها ساخته شده، نه برای چت

بزرگ‌ترین تفاوت 3.8 با نسل‌های قبل، جهت‌گیری است: برای «گردش‌کار طولانی» طراحی شده — برنامه‌ریزی کند، چند قدم بردارد، از ابزار خارجی استفاده کند، کار خودش را تست کند و تکرار کند. به گزارش یک رسانهٔ تحلیلی، مدل می‌تواند فایل‌ها را بازبینی کند، کد را تغییر دهد، دستور اجرا کند و نتیجه را ارزیابی کند؛ یعنی همان حلقه‌ای که یک توسعه‌دهندهٔ واقعی طی می‌کند.

اگر با ابزارهایی مثل Claude Code یا Cursor کار کرده‌ای، دقیقاً می‌دانی این یعنی چه: مدل دیگر فقط «تکه‌کد» پیشنهاد نمی‌دهد؛ یک تسک را از اول تا آخر جلو می‌برد. سه سطح تفکر کم/متوسط/زیاد هم به تو اجازه می‌دهد برای هر درخواست، بین سرعت و عمق یکی را انتخاب کنی — چیزی که در مدل‌های قبلی فلش، تک‌حالته بود.

۲. ویدیو و صوت را واقعاً می‌فهمد

اینجا گوگل برتری دارد که رقیب‌ها ندارند. جمینای تنها مدل بزرگ جدی است که ویدیو و صوت را به‌صورت بومی ورودی می‌گیرد — یعنی لازم نیست اول ویدیو را به متن تبدیل کنی. می‌توانی یک کلیپ را بدهی و بپرسی «اینجا چه اتفاقی افتاد؟» یا یک فایل صوتی جلسه را بدهی و خلاصه بخواهی.

نسخهٔ Live همین خانواده یک قدم جلوتر است: صدا را مستقیم می‌شنود و مستقیم جواب صوتی می‌دهد — بدون زنجیرهٔ «صوت→متن→مدل→صوت» که تأخیر می‌ساخت. نسخهٔ Extended Thinking در شاخص کیفیت صوت‌به‌صوت Artificial Analysis رتبهٔ اول را گرفت (امتیاز ۸۲٫۶) و با ۰٫۸۴ دلار به‌ازای هر ساعت ورودی صوتی، ارزان‌ترین گزینهٔ آن شاخص هم هست. جزئیات مدل‌های صوتی را در مطلب گفت‌وگوی صوتی جمینای 3.8 پوشش داده‌ایم.

۳. در برابر «تزریق پرامپت» مقاوم‌تر شده

تزریق پرامپت (prompt injection) یعنی دستور مخفی‌ای که مهاجم داخل یک متن، ایمیل یا صفحهٔ وب قایم می‌کند تا مدلِ قربانی آن را اجرا کند. برای ایجنت‌هایی که وب می‌گردند و ایمیل خلاصه می‌کنند، این بزرگ‌ترین ریسک امنیتی است. به گزارش Gray Swan (شرکت تخصصی تست امنیت مدل‌ها)، مدل‌های 3.8 در مقاومت در برابر تزریق جهش قابل‌توجهی داشته‌اند.

این را بگذار کنار نسخهٔ Cyber — که در مطلب معرفی Flash و Cyber جمینای 3.8 جداگانه پوشش داده‌ایم — مدلی است مخصوص امنیت سایبری که ادعا می‌شود وصله‌زنی آسیب‌پذیری‌ها را ۲٫۶ برابر سریع‌تر می‌کند. سایبر فقط به «مدافعان تأییدشده» داده می‌شود (نهادهای دولتی، اپراتورهای زیرساخت حیاتی)، پس تو احتمالاً مستقیم به آن دسترسی نداری؛ اما پیامش روشن است: گوگل دارد امنیت را به یک خط تولید جدا تبدیل می‌کند، نه یک ویژگی فرعی.

نقاط ضعف واقعی (با منبع)

۱. پرحرف است و پرحرفی‌اش پول است

حالا برسیم به تلهٔ اصلی. فلسفهٔ «بیشتر فکر کن» یک هزینهٔ پنهان دارد: هر قدم فکر اضافه، توکن خروجی مصرف می‌کند و توکن خروجی ۵ برابر توکن ورودی قیمت دارد. شرکت مستقل Artificial Analysis اندازه گرفت که 3.8 Flash در حالت تفکر بالا برای تکمیل یک سوئیت ارزیابی استاندارد، ۱۲۰ میلیون توکن خروجی سوزاند — در برابر میانهٔ ۷۱ میلیون برای مدل‌های مشابه. یعنی ۷۰٪ پرحرفی بیشتر.

نتیجه به زبان پول: هزینهٔ واقعی هر تسک برای 3.8 Flash ۰٫۵۸ دلار شد در برابر ۰٫۴۰ دلار برای 3.7 Flash — ۴۵٪ گران‌تر، با وجود اینکه قیمت هر توکن دقیقاً یکی است. پس اگر داری حجم بالا کار می‌کنی (مثلاً هزاران تیکت پشتیبانی در شب)، «قیمت ارزان هر توکن» فریبنده است؛ باید هزینهٔ هر تسک تمام‌شده را حساب کنی. خود گوگل هم صریح گفته: اگر «کارایی» برایت اولویت است، روی 3.7 Flash بمان — «کاملاً پشتیبانی می‌شود».

۲. در حالت فکر عمیق، کُند است

همان اندازه‌گیری Artificial Analysis یک عدد دیگر هم دارد: زمان رسیدن به اولین توکن (یعنی فاصلهٔ بین فرستادن درخواست تا شروع جواب) در حالت تفکر بالا ۱۳٫۳ ثانیه است؛ میانهٔ مدل‌های مشابه ۲٫۹۹ ثانیه. سیزده ثانیه برای یک چت‌بات یعنی مرگ — هیچ کاربری منتظر نمی‌ماند.

تبلیغات
آکادمی پرامپت علی در یوتیوب

پس 3.8 Flash در حالت قوی‌اش برای اپ‌های تعاملی (چت‌بات پشتیبانی، دستیار صوتی زنده) گزینهٔ بدی است، مگر اینکه سطح تفکر را پایین بیاوری — که آن‌وقت بخشی از همان برتری بنچمارکی را از دست می‌دهی. این یک معاملهٔ واقعی است، نه یک باگ: عمیق فکر کردن زمان می‌برد، و گوگل این را پنهان نکرده.

۳. قیمت امروز، قیمت فردا نیست

قیمت ۰٫۷۵/۳٫۷۵ دلاری که همه‌جا تبلیغ می‌شود، مقدماتی است و فقط تا ۳۱ دسامبر ۲۰۲۶ (۱۰ دی ۱۴۰۵) اعتبار دارد. از ۱ ژانویهٔ ۲۰۲۷: ورودی ۱٫۵۰ و خروجی ۷٫۵۰ دلار — دقیقاً دو برابر. اگر داری معماری محصولت را روی این مدل می‌بندی، باید با قیمت دوبرابری حساب کنی، نه قیمت امروز.

و یک نکتهٔ ظریف‌تر: در تست مقایسه‌ای یک رسانه، 3.8 Flash جواب‌هایی حدود دو برابر طولانی‌تر از GPT-5.6 Sol و GPT-6 Astra نوشت. برای جزوه و خلاصهٔ تحقیق شاید خوب باشد؛ برای جواب آمادهٔ کپی، خسته‌کننده است. اگر از آن دسته‌ای هستی که از مدل «جواب کوتاه و دقیق» می‌خواهی، باید در پرامپت صریحاً کوتاهی را تحمیل کنی.

مقایسه با رقبا: جدول صادقانه

جدول زیر 3.8 Flash را کنار نزدیک‌ترین رقیب‌هایش می‌گذارد. قیمت‌ها از مستندات رسمی و ردیاب‌های مستقل‌اند (اکتبر ۲۰۲۶):

مدل (شرکت)

قیمت ورودی/خروجی (دلار/میلیون توکن)

پنجرهٔ ورودی

نقطهٔ قوت شاخص

نقطهٔ ضعف شاخص

Gemini 3.8 Flash (گوگل)

۰٫۷۵ / ۳٫۷۵ (تا ۱۰ دی؛ بعد ۱٫۵۰ / ۷٫۵۰)

۱ میلیون

ورودی بومی ویدیو/صوت؛ قیمت پایین

پرحرفی ۷۰٪؛ تأخیر ۱۳ ثانیه‌ای در تفکر بالا

GPT-5.6 Terra (اوپن‌ای‌آی)

۲ / ۱۲

۱ میلیون

در چند بنچمارک کدنویسی ترمینال جلوتر

گران‌تر؛ ورودی ویدیو/صوت ندارد

Claude Opus 5.5 (انثروپیک)

حدود ۴ / ۲۰ (۲۰٪ کمتر از Opus 5)

۱ میلیون

اعتماد توسعه‌دهنده‌ها در کدنویسی؛ کیفیت ابزار

چند برابر گران‌تر از فلش

Gemini 3.1 Pro (گوگل)

۲ / ۱۲

۱ میلیون

استدلال عمیق‌تر از فلش

قیمت بالاتر؛ همان اکوسیستم گوگل

GPT-6 Sol (اوپن‌ای‌آی)

حدود ۵ / ۳۰ (خط Sol نصف شده)

۱ میلیون

پرچم‌دار کدنویسی اوپن‌ای‌آی

گران؛ برای حجم بالا مناسب نیست

جدول را این‌طور بخوان: 3.8 Flash در قیمت به‌ازای هر توکن بی‌رقیبِ ارزان است، اما در هزینهٔ هر تسک واقعی فاصله‌اش با 3.7 Flash کمتر از چیزی است که تبلیغ می‌شود؛ و در اعتماد اکوسیستم توسعه‌دهنده هنوز پشت کلود و GPT است — از جمله Claude Opus 5.5 انثروپیک که هم‌زمان با همین نسل عرضه شد. به تحلیل یک رسانه، مشکل جمینای قیمت نیست؛ قفل اکوسیستم است: توسعه‌دهنده‌ای که سال‌ها روی GPT و کلود ساخته، برای مهاجرت باید پرامپت‌ها را بازنویسی و تست‌ها را دوباره بگذراند — و این هزینهٔ جابه‌جایی، بنچمارک خوب را خنثی می‌کند.

دسترسی و قیمت: از کجا شروع کنی؟

سه مسیر داری، بسته به اینکه کی هستی:

  • توسعه‌دهنده: از Google AI Studio یا Gemini API شروع کن؛ سطح رایگان برای تست کافی است. اگر ایجنت می‌سازی، Antigravity همان جایی است که گوگل دموهای 3.8 را در آن نشان داد. برای ساختن رابط کاربری، Stitch هست.

  • کاربر عادی: در اپ جمینای برای مشترکان Google AI Pro (۱۹٫۹۹ دلار در ماه) و Ultra؛ در جست‌وجوی گوگل (AI Mode) و Sheets هم هست. نسخهٔ رایگان، مدل سبک‌تر و پنجرهٔ کوچک‌تر (۳۲ هزار توکن) می‌دهد.

  • تیم امنیتی: نسخهٔ Cyber فقط از مسیر Fairwind Program و برای مدافعان تأییدشده است.

یک توصیهٔ عملی از خود گوگل که حیف است نادیده بگیری: سطح تفکر را برای هر کار جدا تنظیم کن. برای خلاصه‌سازی ایمیل، «کم» کافی است و سریع و ارزان تمام می‌شود؛ «زیاد» را فقط برای مسئله‌های واقعاً سخت نگه دار. این یک درجه‌بندی ساده، همان تلهٔ پرحرفی را تا حد زیادی خنثی می‌کند.

نکته‌ای برای خوانندهٔ فارسی‌زبان

دو چیز را رک بگویم. اول: گوگل وضعیت دسترسی منطقه‌ای این مدل — از جمله ایران — را جداگانه اعلام نکرده؛ همان قاعدهٔ کلی سرویس‌های گوگل برقرار است: حساب گوگل لازم است و بعضی قابلیت‌ها فقط در «کشورهای منتخب» عرضه شده‌اند. دوم: بنچمارک فارسیِ خاصی برای 3.8 منتشر نشده؛ همهٔ عددهایی که خواندی انگلیسی‌محورند. اگر کارت متن فارسی است، قبل از هر تصمیمی خودت با چند نمونهٔ واقعی فارسی تست بگیر — عدد انگلیسی، تضمین فارسی نیست.

از نظر قیمت دلاری هم واقع‌بین باش: ۰٫۷۵ دلار به‌ازای هر میلیون توکن برای توسعه‌دهندهٔ فردی عدد بزرگی نیست، اما اگر محصولت را روی قیمت تبلیغاتیِ تا ۱۰ دی ببندی و از ۱۱ دی دو برابر شود، حاشیه‌ات به‌هم می‌ریزد. رقم تومان را اینجا اختراع نمی‌کنیم؛ ولی قاعده‌اش ساده است: همیشه با قیمتِ بعد از اتمام تخفیف حساب کن.

برای چه کسی می‌ارزد؟ (بدون نمره، فقط توصیه)

قول داده بودیم نمره ندهیم؛ پس به‌جای ستاره، سه دسته می‌گوییم:

  • امتحانش کن، اگر: ایجنت کدنویسی یا ابزار چندمرحله‌ای می‌سازی و حجم توکنت بالاست؛ با ویدیو یا صوت به‌عنوان ورودی کار داری (اینجا رقیب جدی ندارد)؛ یا می‌خواهی با قیمت امروز، قبل از ۱۰ دی، یک پروژه را جلو ببری.

  • صبر کن، اگر: کارت «کارایی‌محور» است و تأخیر برایت مهم است — خود گوگل می‌گوید روی 3.7 Flash بمان؛ یا می‌خواهی ببینی قیمت ژانویه واقعاً دو برابر می‌شود یا گوگل تمدیدش می‌کند.

  • سراغش نرو، اگر: چت‌بات تعاملی یا دستیار صوتی زنده می‌سازی و نمی‌توانی ۱۳ ثانیه تأخیر را تحمل کنی؛ یا قبلاً روی کلود/ GPT سرمایه‌گذاری سنگین کرده‌ای و هزینهٔ جابه‌جایی‌ات از سود قیمت بیشتر است.

چیزهایی که هنوز روشن نیست

  • قیمت جداگانهٔ نسخهٔ Cyber اعلام نشده است.

  • مشخص نیست گوگل قیمت تبلیغاتی را بعد از ۱۰ دی تمدید می‌کند یا نه؛ سابقه نشان می‌دهد در جنگ قیمت، تمدیدها بعید نیستند.

  • بنچمارک فارسی و وضعیت دقیق دسترسی از ایران اعلام نشده است.

  • زمان عرضهٔ پرچم‌دار بعدی (که در گزارش‌ها «Gemini 4 Argon» خوانده می‌شود) معلوم نیست؛ اگر 3.8 برایت «کافی» نیست، شاید ارزش صبر کردن داشته باشد.

جمع‌بندی

Gemini 3.8 Flash بهترین «فلش»ی است که گوگل تا امروز ساخته: در کدنویسی و کار ایجنتی از نسل قبل جلوتر است، ویدیو و صوت را بومی می‌فهمد، و در برابر تزریق پرامپت مقاوم‌تر شده. اما «بهترین فلش» بودن، آن را به «بهترین انتخاب برای همه» تبدیل نمی‌کند: پرحرفی‌اش هزینهٔ واقعی هر تسک را ۴۵٪ بالا برده، در حالت فکر عمیق ۱۳ ثانیه تأخیر دارد، و قیمت امروزش تا ۱۰ دی بیشتر اعتبار ندارد.

پس تصمیم ساده است: اگر حجم بالا کار می‌کنی و سطح تفکر را خودت مدیریت می‌کنی، 3.8 یک معاملهٔ خوب است — به‌شرطی که با قیمتِ بعد از تخفیف حساب کنی. اگر نه، 3.7 Flash همان‌جا منتظر توست؛ و خود گوگل هم همین را می‌گوید.

سؤالات پرتکرار

Gemini 3.8 Flash دقیقاً کی عرضه شد؟

۲ سپتامبر ۲۰۲۶ (۱۱ شهریور ۱۴۰۵)، در پست مشترک دو مدیر گوگل: Tulsee Doshi و Raluca Ada Popa. همان روز نسخهٔ امنیتی Cyber هم معرفی شد.

فرق Flash با Pro در چیست؟

فلش سبک‌تر، سریع‌تر و ارزان‌تر است برای حجم بالا؛ پرو سنگین‌تر و گران‌تر است برای استدلال عمیق. 3.8 Flash حدود یک‌سی‌ام قیمت خروجی پرچم‌دارهای رقیب را دارد، اما پرچم‌دار نیست.

قیمتش واقعاً چقدر است؟

تا ۱۰ دی ۱۴۰۵: ۰٫۷۵ دلار ورودی و ۳٫۷۵ دلار خروجی به‌ازای هر میلیون توکن. از ۱۱ دی ۱۴۰۵: دو برابر — ۱٫۵۰ و ۷٫۵۰ دلار. توکن‌های «فکر کردن» هم با تعرفهٔ خروجی حساب می‌شوند.

چرا می‌گویید هزینهٔ واقعی‌اش بیشتر از قیمت هر توکن است؟

چون مدل پرحرف‌تر شده: به اندازه‌گیری مستقل Artificial Analysis، برای یک تسک استاندارد ۷۰٪ توکن خروجی بیشتر از میانهٔ بازار مصرف می‌کند و هزینهٔ هر تسک ۴۵٪ بالاتر از 3.7 Flash درمی‌آید، با وجود قیمت یکسان هر توکن.

برای چت‌بات فارسی مناسب است؟

برای چت تعاملی، نه چندان: در حالت تفکر بالا ۱۳٫۳ ثانیه تا شروع جواب طول می‌کشد. برای کارهای غیرتعاملی (خلاصه‌سازی، تحلیل ویدیو/صوت، ایجنت پس‌زمینه) گزینهٔ خوبی است. بنچمارک فارسی هم منتشر نشده؛ خودت تست بگیر.

نسخهٔ Cyber را چطور می‌شود گرفت؟

فقط از مسیر Fairwind Program گوگل و برای «مدافعان تأییدشده» — نهادهای دولتی، اپراتورهای زیرساخت حیاتی و نگه‌دارندگان نرم‌افزار. کاربر عادی و توسعه‌دهندهٔ معمولی به آن دسترسی ندارد.

به‌جای 3.8 Flash از چه مدلی استفاده کنم؟

اگر «کارایی و سرعت» مهم‌تر است: همان 3.7 Flash که گوگل می‌گوید کاملاً پشتیبانی می‌شود. اگر «کیفیت کدنویسی» مهم‌تر است و بودجه داری: Claude Opus 5.5 یا GPT-5.6 Terra را هم تست کن؛ در بعضی بنچمارک‌ها جلوترند. اگر «استدلال عمیق‌تر گوگلی» می‌خواهی: 3.1 Pro.

منابع

برچسب‌ها:هوش مصنوعیگوگلهوش مصنوعی مولدبرنامه‌نویسی
اشتراک‌گذاری:

مطالب مرتبط

عضویت در خبرنامه

آخرین اخبار هوش مصنوعی و فناوری را در ایمیل خود دریافت کنید.

پس از عضویت یک ایمیل تأیید برایتان ارسال می‌شود. هر زمان می‌توانید اشتراک خود را لغو کنید و ایمیل شما با شخص ثالثی به اشتراک گذاشته نمی‌شود.