پرش به محتوای اصلی
اخبار هوش مصنوعی

Claude Haiku 5.5 چیست؟ مدل سریع و ارزان تازهٔ آنتروپیک با قیمت ۹۰٪ کمتر

آنتروپیک Claude Haiku 5.5 را منتشر کرد؛ سریع‌ترین و ارزان‌ترین مدل خانوادهٔ Claude که حدود ۷۵ درصد کم‌هزینه‌تر از Haiku 4.5 است، پنجرهٔ زمینهٔ یک میلیون توکنی دارد و حتی در پلن رایگان Claude قابل انتخاب است.

۱۲ دقیقه مطالعه
اشتراک‌گذاری:
تصویر رسمی آنتروپیک برای معرفی Claude Haiku 5.5، مدل کوچک و سریع خانوادهٔ Claude
تصویر رسمی آنتروپیک برای معرفی Claude Haiku 5.5، مدل کوچک و سریع خانوادهٔ Claude
فهرست مطالب

آنتروپیک، سازندهٔ چت‌بات Claude، روز ۷ اکتبر ۲۰۲۶ مدل Claude Haiku 5.5 را منتشر کرد: کوچک‌ترین، سریع‌ترین و ارزان‌ترین عضو خانوادهٔ Claude 5.5. به گفتهٔ خود شرکت، هزینهٔ اجرای این مدل به‌طور میانگین حدود ۷۵ درصد کمتر از نسل قبل یعنی Haiku 4.5 است و در بیشتر آزمون‌ها هم چند پله از آن جلوتر است. Haiku 5.5 همین حالا هم در اپ و سایت Claude (حتی برای حساب رایگان) قابل انتخاب است و هم از طریق API در اختیار برنامه‌نویس‌ها قرار گرفته.

اگر تا حالا با مدل‌های Claude کار نکرده‌اید، تصویر ساده‌اش این است: آنتروپیک چند مدل با اندازه‌های مختلف دارد. مدل‌های بزرگ مثل Opus برای کارهای سخت و طولانی ساخته شده‌اند و گران‌ترند. Haiku کوچک‌ترین آن‌هاست؛ قرار نیست باهوش‌ترین باشد، قرار است سریع و ارزان باشد تا بشود آن را میلیون‌ها بار در روز صدا زد. حالا نسخهٔ تازه‌اش هم ارزان‌تر شده و هم آن‌قدر قوی‌تر که خیلی از کارهای روزمره را بدون نیاز به مدل بزرگ‌تر انجام می‌دهد.

Claude Haiku 5.5 چیست و برای چه کاری ساخته شده؟

Haiku 5.5 مدل زبانی کوچک آنتروپیک برای کارهای پرتکرار و کم‌هزینه است. آنتروپیک خودش چند نمونه را مثال می‌زند: خلاصه‌کردن متن، دسته‌بندی درخواست‌ها، جست‌وجو در پایگاه داده، کوتاه‌کردن گفت‌وگوهای طولانی برای ادامهٔ کار (که به آن «فشرده‌سازی» یا compaction می‌گویند) و پشتیبانی زندهٔ مشتری.

کاربرد مهم دیگرش نقش «زیرایجنت» است. ایجنت یعنی هوش مصنوعی‌ای که فقط جواب نمی‌دهد و خودش چند قدم کار را پشت سر هم انجام می‌دهد. در سیستم‌های ایجنتی، معمولاً یک مدل بزرگ مثل Opus 5.5 نقشه را می‌کشد و تکه‌های ساده‌تر کار را به مدل‌های کوچک‌تر می‌سپارد. Haiku 5.5 دقیقاً برای همین نقش کمکی طراحی شده است: سریع جواب می‌دهد و چون ارزان است، می‌شود چندتا از آن را هم‌زمان اجرا کرد.

آنتروپیک می‌گوید Haiku 5.5 سریع‌ترین مدلی است که تا امروز ساخته؛ البته با سرعت استاندارد هر مدل. یعنی فقط مدل‌های Opus در «حالت سریع» (Fast Mode) از آن تندترند.

قیمت Haiku 5.5 چقدر است و چرا این‌قدر ارزان شد؟

قیمت مدل‌های زبانی بر اساس «توکن» حساب می‌شود. توکن تکه‌ای از متن است؛ چیزی حدود یک کلمه یا بخشی از یک کلمه. قیمت‌ها هم معمولاً برای هر یک میلیون توکن اعلام می‌شوند. نکتهٔ تازهٔ Haiku 5.5 این است که قیمتش به طول درخواست بستگی دارد:

  • برای درخواست‌های تا ۱۰۰ هزار توکن: ورودی ۰٫۱۰ دلار و خروجی ۰٫۵۰ دلار برای هر میلیون توکن

  • برای درخواست‌های بیشتر از ۱۰۰ هزار توکن: ورودی ۰٫۵۰ دلار و خروجی ۲٫۵۰ دلار برای هر میلیون توکن

برای مقایسه، Haiku 4.5 برای هر میلیون توکن ورودی ۱ دلار و برای خروجی ۵ دلار می‌گرفت. پس در درخواست‌های کوتاه، قیمت ۹۰ درصد و در درخواست‌های بلند ۵۰ درصد پایین آمده است. آنتروپیک می‌گوید حدود ۹۰ درصد درخواست‌هایی که به Haiku قبلی می‌رسید زیر ۱۰۰ هزار توکن بود؛ برای همین بیشتر کاربران از تخفیف بزرگ‌تر سود می‌برند.

اما چرا رقم نهایی «۷۵ درصد» است و نه ۹۰ درصد؟ چون Haiku 5.5 از یک توکن‌ساز (ابزاری که متن را به توکن تبدیل می‌کند) تازه استفاده می‌کند. طبق مستندات آنتروپیک، همان متن در این مدل حدود ۳۰ درصد توکن بیشتری نسبت به Haiku 4.5 می‌شود. آنتروپیک این تفاوت را هم حساب کرده و به عدد میانگین ۷۵ درصد رسیده است. ذخیره‌سازی پرامپت (prompt caching) تا ۹۰ درصد و پردازش دسته‌ای (Batch) ۵۰ درصد دیگر هم از هزینه کم می‌کند.

مقایسهٔ قیمت با Haiku 4.5 و Sonnet 5.5

جدول زیر بر اساس جدول رسمی آنتروپیک است و همهٔ قیمت‌ها به دلار و برای هر یک میلیون توکن‌اند:

نوع هزینه

Haiku 5.5 (تا ۱۰۰ هزار / بیشتر)

Haiku 4.5

Sonnet 5.5

توکن ورودی

۰٫۱۰ / ۰٫۵۰

۱٫۰۰

۲٫۰۰

توکن خروجی

۰٫۵۰ / ۲٫۵۰

۵٫۰۰

۱۰٫۰۰

نوشتن در حافظهٔ موقت (کش)

۰٫۱۲۵ / ۰٫۶۲۵

۱٫۲۵

۲٫۵۰

خواندن از کش

۰٫۰۱ / ۰٫۰۵

۰٫۱۰

۰٫۱۰

طبق گزارش VentureBeat، قیمت پایهٔ Haiku 5.5 دقیقاً هم‌اندازهٔ مدل GPT-6 Luna از OpenAI است؛ یعنی آنتروپیک با این قیمت مستقیم وارد رقابت با ارزان‌ترین مدل OpenAI شده، نه اینکه لزوماً ارزان‌ترین گزینهٔ کل بازار باشد.

عملکرد در آزمون‌ها: چقدر از نسل قبل بهتر است؟

آنتروپیک نتایج Haiku 5.5 را کنار Haiku 4.5، مدل GPT-6 Luna و Sonnet 5.5 (برای مرجع) منتشر کرده است. چند عدد مهم:

آزمون

Haiku 5.5

Haiku 4.5

GPT-6 Luna

Sonnet 5.5

OSWorld 2.1 (کار با کامپیوتر، زیرمجموعهٔ آفلاین)

۷۲٫۴٪

۱۵٫۷٪

۴۸٫۹٪

۸۳٫۹٪

Terminal-Bench 4.0 (برنامه‌نویسی ایجنتی در ترمینال)

۳۹٫۲٪

۰٪

۱۶٫۴٪

۷۰٫۶٪

Humanity’s Last Exam بدون ابزار (استدلال تخصصی)

۴۵٫۹٪

۱۰٫۲٪

اعلام نشده

۵۶٫۹٪

GDPval-AA v2.1 (کارهای واقعی حرفه‌ای، امتیاز Elo)

۱۶۲۰

۷۳۵

۱۴۳۷

۱۸۴۰

خلاصهٔ این جدول ساده است: Haiku 5.5 در همهٔ این آزمون‌ها با فاصلهٔ زیاد از Haiku 4.5 و در این چند مورد از GPT-6 Luna هم جلوتر است، ولی هنوز به Sonnet 5.5 نمی‌رسد. این اعداد را خود آنتروپیک منتشر کرده و جزئیات روش اجرا در «کارت سیستم» مدل آمده است؛ پس بهتر است آن‌ها را نشانهٔ کلی ببینید، نه حکم قطعی برای کار شما.

خود آنتروپیک هم صادقانه گفته که برای کارهای پیچیدهٔ برنامه‌نویسی، Sonnet 5.5 و Claude Opus 5.5 هنوز انتخاب بهتری‌اند و Haiku 5.5 برای کارهای محدود و مشخص مناسب است.

تنظیم «میزان تلاش»؛ ویژگی تازه برای اولین بار در Haiku

Haiku 5.5 اولین مدل خانوادهٔ Haiku است که تنظیم میزان تلاش (effort) دارد. یعنی می‌توانید تعیین کنید مدل قبل از جواب دادن چقدر «فکر» کند. سطح‌ها از کم تا خیلی زیاد و حداکثر هستند. تلاش کمتر یعنی جواب سریع‌تر و ارزان‌تر؛ تلاش بیشتر یعنی دقت بالاتر با هزینهٔ بیشتر.

در مستندات آنتروپیک آمده که «تفکر تطبیقی» (adaptive thinking) در این مدل به‌طور پیش‌فرض روشن است و سطح پیش‌فرض تلاش «متوسط» است. یعنی مدل خودش تصمیم می‌گیرد کجا و چقدر فکر کند و شما فقط با تنظیم تلاش، جهتش را عوض می‌کنید.

مشخصات فنی به زبان ساده

  • پنجرهٔ زمینه یک میلیون توکن: یعنی مدل می‌تواند متنی بسیار طولانی، مثلاً چند کتاب یا یک پروژهٔ بزرگ کد را یک‌جا ببیند. Haiku 4.5 حدود ۲۰۰ هزار توکن جا داشت.

  • خروجی تا ۱۲۸ هزار توکن در هر پاسخ؛ و در API دسته‌ای به‌صورت آزمایشی تا ۳۰۰ هزار توکن.

  • ورودی متن و تصویر، خروجی متن: می‌تواند عکس و نمودار را بخواند، ولی عکس نمی‌سازد.

  • دانش تا ژوئن ۲۰۲۶: از اتفاق‌های بعد از آن خبر ندارد، مگر اینکه به جست‌وجو وصل باشد.

  • شناسهٔ مدل در API: claude-haiku-5-5؛ و آنتروپیک می‌گوید زودتر از ۷ اکتبر ۲۰۲۷ بازنشسته نمی‌شود.

یک نکتهٔ فنی برای برنامه‌نویس‌ها: طبق مستندات، اگر برای پارامترهای temperature، top_p یا top_k مقداری غیر از پیش‌فرض بفرستید، درخواست با خطای ۴۰۰ برمی‌گردد. پس هنگام جابه‌جایی از مدل قبلی، این پارامترها را از کدتان حذف کنید.

کار با مرورگر و دسکتاپ

آنتروپیک Haiku 5.5 را برای «کار با کامپیوتر» هم مناسب می‌داند؛ یعنی مدلی که صفحه را می‌بیند و خودش کلیک می‌کند و فرم پر می‌کند. هم‌زمان با این مدل، کیت‌های توسعهٔ پایتون و تایپ‌اسکریپت Claude هم پشتیبانی آزمایشی از کار با کامپیوتر و مرورگر را اضافه کردند. برای کارهای تکراری مثل ورود داده یا جابه‌جا کردن اطلاعات بین برنامه‌ها، ترکیب سرعت و قیمت پایین Haiku معنا پیدا می‌کند.

Haiku 5.5 کجا در دسترس است؟

برای کاربر عادی، خبر خوب این است که Haiku 5.5 در خود Claude برای همهٔ پلن‌ها، یعنی Free، Pro، Max، Team و Enterprise قابل انتخاب است؛ هم در وب و هم در اپ‌های iOS و اندروید. Haiku 5.5 در Claude Code، ابزار برنامه‌نویسی آنتروپیک، هم در دسترس است.

برای برنامه‌نویس‌ها، مدل روی پلتفرم Claude و همچنین Amazon Bedrock، گوگل کلود و Microsoft Foundry ارائه شده است. شناسهٔ مدل در بیشتر این سرویس‌ها claude-haiku-5-5 است و در Bedrock با پیشوند anthropic. می‌آید.

تبلیغات
آکادمی پرامپت علی در یوتیوب

چطور در Claude امتحانش کنم؟

  1. وارد سایت claude.ai یا اپ Claude شوید.

  2. در پنجرهٔ گفت‌وگو، منوی انتخاب مدل را باز کنید.

  3. Haiku 5.5 را انتخاب کنید و سؤال یا متن‌تان را بفرستید.

اگر کارتان خلاصه‌کردن، ترجمهٔ ساده یا پاسخ کوتاه است، تفاوت سرعت را احتمالاً همان اول حس می‌کنید. برای تحلیل‌های پیچیده یا نوشتن کد جدی، مدل‌های بزرگ‌تر هنوز گزینهٔ مطمئن‌تری‌اند.

تغییرات همراه: Sonnet 5.5 ارزان‌تر و اعتبار ماهانهٔ API

آنتروپیک در همان اعلامیه دو تغییر دیگر هم داد:

  • کاهش قیمت خواندن از کش در Sonnet 5.5: از ۰٫۲۰ به ۰٫۱۰ دلار برای هر میلیون توکن. کش یعنی بخشی از متن که قبلاً به مدل داده شده و دوباره پردازش کامل نمی‌شود. چون در کارهای ایجنتی بخش بزرگی از مصرف همین کش است، آنتروپیک می‌گوید Sonnet 5.5 در بیشتر این کارها حدود ۲۰ درصد ارزان‌تر تمام می‌شود.

  • اعتبار ماهانهٔ API برای مشترکان Max و Team: از همین هفته، مشترکان Max 5x ماهی ۱۰۰ دلار، Max 20x ماهی ۲۰۰ دلار و تیم‌ها تا ۵۰۰ دلار (مشترک بین اعضا) اعتبار می‌گیرند تا ابزار و ایجنت‌های خودشان را روی API بسازند. این اعتبار برای همهٔ مدل‌ها قابل استفاده است.

ایمنی و محدودیت‌ها

به گفتهٔ آنتروپیک، Haiku 5.5 در آزمون‌های هم‌راستایی (یعنی اینکه مدل طبق خواستهٔ درست انسان رفتار کند) نسبت به Haiku 4.5 پیشرفت زیادی داشته و کمتر حاضر به همکاری در سوءاستفاده است. محدودیت‌های امنیت سایبری‌اش سخت‌گیرانه‌تر از Haiku 4.5 است، ولی کمی بازتر از مدل‌های بزرگ‌تر اخیر؛ کارهای دفاعی را راحت‌تر انجام می‌دهد، اما تست نفوذ و تکنیک‌هایی را که بیشتر به کار مهاجم می‌آیند مسدود می‌کند. در زیست‌شناسی هم همان قواعد Sonnet 5.5 و Opus 5 اعمال شده است.

محدودیت مهم‌تر برای کاربر عادی این است که Haiku مدل کوچک است. در کارهای چندمرحله‌ای سخت، استدلال طولانی یا برنامه‌نویسی بزرگ، فاصله‌اش با Sonnet و Opus هنوز محسوس است. همچنین قیمت درخواست‌های بالای ۱۰۰ هزار توکن پنج برابر می‌شود؛ پس اگر مدام اسناد خیلی بلند می‌فرستید، صرفه‌جویی کمتر از تبلیغ اصلی خواهد بود.

این خبر برای کاربران و کسب‌وکارها چه معنایی دارد؟

برای شرکت‌هایی که هر روز میلیون‌ها درخواست کوچک به هوش مصنوعی می‌فرستند، کاهش ۹۰ درصدی قیمت پایه یعنی کارهایی که قبلاً گران تمام می‌شد حالا به‌صرفه است. نمونه‌هایش در اعلامیه هم آمده: AlphaSense که هفته‌ای حدود ۸ میلیون درخواست «پرسش از سند» دارد، می‌گوید امتیاز دقتش از ۰٫۷۶ با Haiku 4.5 به ۰٫۸۴ با Haiku 5.5 رسیده است. Box هم از ۱۱ امتیاز بهبود با حدود نصف تأخیر گزارش داده است.

از نگاه بازار، این حرکت ادامهٔ رقابت قیمتی بین آزمایشگاه‌های بزرگ است. OpenAI با GPT-6 Luna (که در مطلب GPT-6 و Intelligent UI دربارهٔ آن نوشتیم) و گوگل با مدل‌های Flash-Lite همین بخش ارزان بازار را هدف گرفته‌اند. برای کاربر نهایی، نتیجه معمولاً اپ‌ها و دستیارهایی است که سریع‌تر جواب می‌دهند و ویژگی‌های هوشمند بیشتری را بدون افزایش قیمت ارائه می‌کنند.

جمع‌بندی

Claude Haiku 5.5 مدل کوچک و سریع آنتروپیک است که با قیمت پایهٔ ۰٫۱۰ دلار ورودی و ۰٫۵۰ دلار خروجی برای هر میلیون توکن، حدود ۷۵ درصد ارزان‌تر از نسل قبل کار می‌کند و در آزمون‌ها فاصلهٔ زیادی با Haiku 4.5 گرفته است. پنجرهٔ زمینهٔ یک میلیون توکنی، تنظیم میزان تلاش و توانایی کار با کامپیوتر آن را برای کارهای پرتکرار و نقش زیرایجنت مناسب کرده است. اگر کاربر Claude هستید، می‌توانید همین امروز آن را حتی با حساب رایگان امتحان کنید؛ فقط یادتان باشد برای کارهای خیلی پیچیده، مدل‌های بزرگ‌تر هنوز جلوترند.

سؤال‌های پرتکرار

Claude Haiku 5.5 رایگان است؟

در اپ و سایت Claude، کاربران پلن رایگان هم می‌توانند Haiku 5.5 را انتخاب کنند؛ البته با همان محدودیت‌های استفادهٔ پلن رایگان. استفاده از طریق API پولی است و بر اساس توکن حساب می‌شود.

فرق Haiku 5.5 با Sonnet 5.5 و Opus 5.5 چیست؟

Haiku کوچک‌ترین، سریع‌ترین و ارزان‌ترین است و برای کارهای ساده و پرتکرار مناسب است. Sonnet برای کارهای مشخص اما سنگین‌تر و Opus برای کارهای پیچیده و طولانی، به‌خصوص برنامه‌نویسی جدی، ساخته شده‌اند.

چرا گفته می‌شود ۷۵ درصد ارزان‌تر، در حالی که قیمت ۹۰ درصد کم شده؟

چون توکن‌ساز تازهٔ Haiku 5.5 همان متن را حدود ۳۰ درصد توکن بیشتر حساب می‌کند و قیمت درخواست‌های بلند هم فقط ۵۰ درصد کم شده است. آنتروپیک با حساب این دو، میانگین صرفه‌جویی را حدود ۷۵ درصد اعلام کرده است.

Haiku 5.5 فارسی می‌فهمد؟

مدل‌های Claude چندزبانه‌اند و فارسی را می‌فهمند. آنتروپیک در اعلامیهٔ Haiku 5.5 عدد جداگانه‌ای برای کیفیت فارسی منتشر نکرده است؛ پس بهتر است با متن‌های خودتان امتحانش کنید.

آیا Haiku 5.5 می‌تواند عکس بسازد؟

نه. ورودی آن می‌تواند متن و تصویر باشد، اما خروجی‌اش فقط متن است.

شناسهٔ مدل در API چیست؟

در API آنتروپیک، گوگل کلود و Microsoft Foundry شناسه claude-haiku-5-5 است و در Amazon Bedrock با پیشوند anthropic. نوشته می‌شود.

اعتبار ماهانهٔ API به چه کسانی می‌رسد؟

به مشترکان Max و Team: ماهی ۱۰۰ دلار برای Max 5x، ۲۰۰ دلار برای Max 20x و تا ۵۰۰ دلار مشترک برای تیم‌ها. آنتروپیک گفته این اعتبار در طول همین هفته فعال می‌شود.

منابع

برچسب‌ها:هوش مصنوعیکلودهوش مصنوعی مولدمدل زبانی بزرگ
اشتراک‌گذاری:

مطالب مرتبط

تصویر رسمی گوگل کلود برای معرفی Gemini agent؛ ایجنت کاری یکپارچه در رویداد Gemini at Work 2026
اخبار هوش مصنوعی

Gemini agent گوگل چیست؟ ایجنت کاری سازمانی با ایمیل و حافظهٔ خودش

گوگل کلود در Gemini at Work 2026 از Gemini agent رونمایی کرد: یک ایجنت کاری واحد برای سازمان‌ها که هدف می‌گیرد، داخل Workspace و اسلک کار می‌کند و حتی می‌تواند ایمیل و هویت خودش را داشته باشد. فعلاً پیش‌نمایش خصوصی است.

کارت رسمی OpenAI با عنوان GPT-6 with Intelligent UI؛ نمودار تعاملی دوچرخه و زمین فوتبال در جواب‌های ChatGPT
اخبار هوش مصنوعی

GPT-6 برای همه آمد؛ «رابط کاربری هوشمند» ChatGPT جواب‌ها را تصویری و تعاملی می‌کند

OpenAI مدل GPT-6 را برای همهٔ کاربران ChatGPT، از جمله کاربران رایگان، منتشر می‌کند و همراه آن Intelligent UI را آورده است: جواب‌هایی با تصویر، نمودار، دکمه و ابزارهای کوچک. چه کسی کدام مدل را می‌گیرد، کجا کار نمی‌کند و چطور کمرنگش کنیم.

صفحهٔ نتیجهٔ SynthID Detector گوگل که پیدا شدن واترمارک SynthID را در ویدیوی ساخته‌شده با هوش مصنوعی گوگل نشان می‌دهد
اخبار هوش مصنوعی

SynthID Detector گوگل برای همه باز شد؛ حالا هر کسی می‌تواند عکس، ویدیو و صدای ساخت هوش مصنوعی را بررسی کند

گوگل ابزار SynthID Detector را در سایت synthid.com برای همهٔ دنیا باز کرد تا هر کسی بتواند واترمارک نامرئی محتوای ساخته‌شده با هوش مصنوعی گوگل، OpenAI، انویدیا و کاکائو را در عکس، ویدیو و صدا بررسی کند؛ طرز کار، معنای نتیجه و محدودیت‌ها به زبان ساده.

عضویت در خبرنامه

آخرین اخبار هوش مصنوعی و فناوری را در ایمیل خود دریافت کنید.

پس از عضویت یک ایمیل تأیید برایتان ارسال می‌شود. هر زمان می‌توانید اشتراک خود را لغو کنید و ایمیل شما با شخص ثالثی به اشتراک گذاشته نمی‌شود.