فهرست مطالب
Cloudflare AI Search از ۱ اکتبر ۲۰۲۶ بهصورت عمومی (Generally Available یا همان GA) در دسترس است: یک سرویس مدیریتشده برای ایندکس و جستوجو روی دادههای خودتان که ترکیب Workers AI، Vectorize، R2 و رندر مرورگر Cloudflare را پشت یک خط لولهٔ آماده میگذارد. در همین GA، شرکت پشتیبانی چندرسانهای را جدیتر کرده (embedding مستقیم تصویر، نه فقط کپشن)، OCR برای PDFهای اسکنشده را برای همهٔ حسابها باز کرده، سقف بعضی فایلها را بالا برده، و اعلام کرده صورتحساب استفادهمحور از ۱ نوامبر ۲۰۲۶ شروع میشود — با سهمیهٔ رایگان ماهانه روی همهٔ پلنهای Workers.
در این مطلب به زبان ساده میگوییم AI Search چیست، با جستوجوی معمولی چه فرقی دارد، در GA چه چیزهایی عوض شده، قیمت اعلامی شرکت چطور خوانده میشود، و برای چه تیمهایی منطقی است. اگر دنبال ابزار جستوجوی دادهمحور برای ایجنتها هم هستید، دربارهٔ Exa Agent Ultra جدا نوشتهایم؛ اینجا تمرکز روی محصول جستوجوی مدیریتشدهٔ خود Cloudflare است.
پاسخ کوتاه: Cloudflare AI Search چیست؟
طبق نوشتهٔ رسمی Cloudflare، AI Search یک خط لولهٔ ایندکس و بازیابی آماده است: فایل یا سایت را میدهید، محتوا تکهتکه (chunk) و به بردار تبدیل میشود، بعد میتوانید با معنا (semantic)، کلیدواژه، یا ترکیبی از هر دو جستوجو کنید و در صورت نیاز جواب تولیدشده بگیرید. شرکت میگوید خودش هم جستوجوی بلاگ و مستندات توسعهدهندگانش را با همین محصول راه انداخته — این ادعای خود Cloudflare است، نه یک بنچمارک مستقل که ما بازبینی کرده باشیم.
چرا این موضوع برای غیرمتخصصها هم مهم است؟
جستوجوی کلاسیک معمولاً روی کلمات دقیق کار میکند: اگر کاربر «صورتحساب» بنویسد و سند شما «فاکتور» گفته باشد، ممکن است چیزی پیدا نشود. در مسیرهای جدیدتر — که گاهی زیر چتر RAG (بازیابی تقویتشده برای تولید جواب) میآیند — متن به embedding تبدیل میشود: یعنی یک نمایش عددی از معنا، تا جملههای شبیه هم نزدیک هم قرار بگیرند حتی اگر واژهها یکی نباشند.
ساخت این سیستم از صفر سخت است: باید پارس، تکهبندی، مدل embedding، دیتابیس برداری، جستوجوی کلیدواژه، گاهی رتبهبندی مجدد (rerank)، و اتصال به مدل تولید جواب را خودتان بچینید. روایت Cloudflare این است که AI Search همان قطعات را داخل اکوسیستم Workers مدیریت میکند تا تیم محصول یا سایت، کمتر زیرساخت سرهم کند. این وعدهٔ فروشنده است؛ پیچیدگی واقعی پروژهٔ شما به کیفیت داده، سطح دسترسی، و نیاز امنیتیتان بستگی دارد.
چه چیزهایی با GA عوض شده؟
محصول قبلاً در پیشنمایش/بتا بود. از ۱ اکتبر ۲۰۲۶ وضعیت GA اعلام شده و این موارد در پست بلاگ و changelog رسمی برجسته شدهاند:
Embedding چندرسانهای بومی برای تصویر (علاوه بر فهم متنی از کپشن)
OCR برای PDFهای اسکنشده، در دسترس همهٔ حسابها
سقف بزرگتر فایل برای بعضی انواع محتوا (جزئیات دقیق پایینتر)
قیمتگذاری و صورتحساب از ۱ نوامبر ۲۰۲۶، با سهمیهٔ رایگان ماهانه
Hybrid search بهصورت پیشفرض برای نمونههای جدید (ترکیب برداری + متن کامل)
فراخوانی embedding و rerank مدلهای منتخب Workers AI داخل قیمت AI Search حساب میشود (دیگر خط جدا روی قبض Workers AI برای همان کارها)
جستوجوی تصویر: کپشن در برابر پیکسل
قبلاً — به روایت خود شرکت — تصویر بیشتر اینطور قابل جستوجو میشد: تشخیص شیء، ساخت یک کپشن (جملهٔ توصیفی)، بعد embedding همان متن. مشکل این است که کپشن خلاصه است؛ بافت محصول، جزئیات نمودار، یا حالت یک اسکرینشات ممکن است از دست برود.
در GA، AI Search ادعا میکند خود پیکسلهای تصویر را هم embed میکند و کپشن را برای فهم متنی نگه میدارد. برای فشردهماندن این بردارهای غنیتر به Matryoshka Representation Learning (MRL) اشاره شده: تکنیکی که اجازه میدهد embedding کوتاهتر هم هنوز مفید بماند. مدل چندرسانهای که در بلاگ نام برده شده Qwen3-VL-Embedding است؛ changelog هم مدلهایی مثل @cf/qwen/qwen3-vl-embedding-2b و google-ai-studio/gemini-embedding-2 را فهرست کرده است.
اگر مدل embedding شما فقط متنی باشد، باز هم میتوانید با تصویر جستوجو کنید: AI Search تصویر را با ToMarkdown به متن تبدیل میکند و با کپشن جلو میرود — پشتیبانی پایه برای همه، و سیگنال بصری کامل فقط وقتی مدل واقعاً چندرسانهای باشد. کاربردهایی که شرکت مثال زده: کشف محصول، تطبیق اسکرینشات، نمودار، دیاگرام، اسناد اسکنشده.
مسیر یک کوئری (به روایت Cloudflare)
بلاگ رسمی مسیر را اینطور خلاصه کرده: کوئری اختیاری بازنویسی میشود؛ بعد embed میشود (تصویر یا مستقیم با مدل چندرسانهای، یا اول کپشن برای مدل متنی)؛ جستوجوی برداری و کلیدواژه موازی اجرا میشوند؛ نتایج ادغام و در صورت نیاز rerank میشوند؛ تکههای برتر برمیگردند یا به مدل تولید برای نوشتن جواب پاس داده میشوند. این معماری اعلامی شرکت است؛ تنظیمات دقیق هر instance را از داشبورد و مستندات روز چک کنید.
فایل بزرگتر و OCR برای PDF اسکنشده
خیلی از PDFها در واقع تصویر اسکنشدهاند و متن قابل استخراج ندارند. با روشن کردن OCR، AI Search متن هر صفحه را میخواند، بعد chunk و embed میکند. OCR برای همهٔ حسابها اعلام شده و هزینهٔش زیر توکنهای پردازش تصویر در قیمت جدید میآید.
دربارهٔ سقف حجم، changelog دقیقتر از خلاصهٔ بلاگ است:
فایلهای متنی/کد و PDF با OCR روشن: تا حدود ۱۰ MiB
PDF بدون OCR و سایر فرمتهای پشتیبانیشده: همچنان حدود ۴ MiB
اگر فقط جملهٔ بلاگ («متن و PDF تا ۱۰ MiB») را ببینید ممکن است گمراه شوید؛ برای تصمیم فنی همان جدول Data source و Limits را در مستندات بخوانید.
قیمت و سهمیه رایگان (اعلام شرکت — از ۱ نوامبر ۲۰۲۶)
در Agents Week اوت ۲۰۲۶ قیمت پیشنمایش اعلام شده بود؛ با GA، صورتحساب از ۱ نوامبر ۲۰۲۶ فعال میشود و Cloudflare گفته حدود یک هفته قبل ایمیل یادآوری میفرستد. روایت شرکت: سه چیز میپردازید — محتوایی که ingest میکنید، دادهای که نگه میدارید، و کوئریهایی که میزنید. کار میانی مثل پارس، chunk، embedding با مدلهای Workers AI منتخب، ایندکس کلیدواژه و rerank داخل همان قیمت آمده؛ بدون «ساعت instance» یا حداقل ماهانهٔ اجباری در توضیح بلاگ.
تغییر کوچک نسبت به پیشنمایش: سهمیهٔ رایگان ماهانه دیگر یک استخر مشترک ۲۰۰۰ کوئری نیست؛ جداگانه ۱۰۰۰ کوئری معنایی و ۱۰۰۰ کوئری متن کامل است.
آیتم | نرخ اعلامی | سهمیه رایگان ماهانه (همه پلنهای Workers) |
|---|---|---|
Ingest پایه | ۰٫۷۵ دلار / ۱ میلیون توکن | ۵ میلیون توکن (استخر مشترک متن و تصویر) |
پردازش تصویر (اضافه) | +۰٫۵۰ دلار / ۱ میلیون توکن | همان استخر ۵ میلیون |
ذخیره | ۲٫۰۰ دلار / گیگابایت-ماه | ۱۰ گیگابایت-ماه |
کوئری معنایی / برداری / هیبرید | ۰٫۷۵ دلار / ۱۰۰۰ کوئری | ۱۰۰۰ کوئری |
کوئری متن کامل | ۰٫۱۰ دلار / ۱۰۰۰ کوئری | ۱۰۰۰ کوئری |
نکتههای حسابداری که مستندات گفتهاند: توکنها روی chunk نهایی بعد از پارس شمرده میشوند؛ همپوشانی chunk ممکن است متن تکراری را چندبار بشمارد؛ tokenizer اعلامی cl100k_base است. تولید جواب، بازنویسی کوئری، و ارائهدهندهٔ خارجی همچنان روی حساب/Gateway شما میمانند. قیمتها ادعای منتشرشدهٔ Cloudflare در تاریخ GA است؛ قبل از بودجهٔ جدی، صفحهٔ Limits & pricing روز را دوباره چک کنید.
برای چه کسی مناسب است؟
تیمهایی که سایت یا اپشان از قبل روی Cloudflare/Workers است و میخواهند جستوجوی اسناد داخلی، دانشنامه، یا بلاگ را سریع بالا بیاورند
محصولاتی که به جستوجوی اسکرینشات، کاتالوگ تصویری، یا PDF اسکنشده نیاز دارند و نمیخواهند pipeline embedding تصویر را از صفر بسازند
پروژههای کوچک که داخل سهمیهٔ رایگان ماهانه جا میشوند و میخواهند قبل از ۱ نوامبر هزینه را برآورد کنند
اگر به مارکتپلیس اکستنشن و ابزارهای Claude علاقه دارید، مسیر جداگانهای است — بازارچهٔ Claude را جدا بررسی کردهایم؛ AI Search بیشتر لایهٔ بازیابی داده است تا مارکت افزونه.
محدودیتها و احتیاطها
کیفیت بازیابی به تمیزی منبع، تنظیم chunk، و انتخاب مدل embedding وابسته است؛ GA بودن یعنی محصول عمومی شده، نه اینکه برای هر دیتاستی جادو کند.
نقشهٔ راه شرکت (ویدیو/صدا، بازطراحی موتور کلیدواژه، فعالسازی سادهتر برای سایتهای روی Cloudflare) هنوز وعده است؛ تاریخ تحویل عمومی در پست GA قفل نشده.
برای دادهٔ حساس، قبل از ingest سیاست نگهداری، منطقه، و دسترسی را با تیم امنیت خودتان و اسناد روز Cloudflare مرور کنید — ما اینجا جایگزین مشاورهٔ حقوقی نیستیم.
اعداد قیمت و سهمیه را از روی اعلام رسمی نقل کردیم؛ تغییر بعدی صفحهٔ docs اولویت دارد.
جمعبندی
Cloudflare AI Search از ۱ اکتبر ۲۰۲۶ عمومی شده: جستوجوی مدیریتشده روی دادهٔ خودتان، با تمرکز تازه روی embedding تصویر بومی، OCR برای PDF اسکنشده، سقف فایل بالاتر در بعضی حالتها، hybrid پیشفرض، و صورتحساب از ۱ نوامبر همراه سهمیه رایگان. اگر از قبل روی Workers هستید و میخواهید لایهٔ بازیابی را کمتر خودتان نگه دارید، الان زمان مناسبی برای آزمایش و برآورد هزینه است — با خواندن مستندات Limits و تست روی دادهٔ واقعی، نه فقط روی وعدهٔ بلاگ.
سوالات پرتکرار
Cloudflare AI Search دقیقاً چه کاری میکند؟
محتوای شما را ایندکس میکند و امکان جستوجوی معنایی، کلیدواژهای یا هیبرید میدهد؛ در صورت نیاز تکهها را به مدل تولید جواب میسپارد. زیرساخت را Cloudflare بهصورت مدیریتشده روی Workers AI، Vectorize و R2 توصیف کرده است.
GA از چه تاریخی است و کی پول میگیریم؟
GA از ۱ اکتبر ۲۰۲۶ اعلام شده؛ صورتحساب استفادهمحور از ۱ نوامبر ۲۰۲۶. شرکت گفته حدود یک هفته قبل ایمیل یادآوری میفرستد.
آیا بدون پرداخت میشود استفاده کرد؟
بله در حد سهمیهٔ رایگان ماهانه اعلامشده روی همهٔ پلنهای Workers (۵ میلیون توکن ingest، ۱۰ گیگابایت-ماه ذخیره، ۱۰۰۰ کوئری معنایی و ۱۰۰۰ کوئری متن کامل). مصرف بیشتر طبق نرخهای جدول بالا محاسبه میشود.
جستوجو با تصویر چطور کار میکند؟
اگر مدل embedding چندرسانهای باشد، تصویر مستقیم embed میشود. اگر مدل فقط متنی باشد، تصویر اول به کپشن متنی تبدیل میشود و همان جستوجو میشود.
OCR برای همه هست؟
طبق changelog رسمی، OCR برای PDF اسکنشده روی هر حساب در دسترس است و هزینهٔش بهصورت توکن پردازش تصویر شمرده میشود.
سقف فایل ۱۰ مگابایت برای همهٔ فرمتهاست؟
نه لزوماً. متن/کد و PDF با OCR روشن تا حدود ۱۰ MiB؛ PDF بدون OCR و بعضی فرمتهای دیگر همچنان حدود ۴ MiB. جزئیات را از docs روز بگیرید.
Hybrid search یعنی چه؟
ترکیب جستوجوی برداری (معنا) با تطبیق متن کامل. برای نمونههای جدید، changelog گفته hybrid پیشفرض است و موقع ساخت instance میتوانید روش دیگری انتخاب کنید.
آیا embedding جدا روی قبض Workers AI میآید؟
برای فراخوانی embedding و rerank مدلهای منتخب که خود AI Search میزند، شرکت گفته داخل قیمت AI Search است و دیگر روی خط Workers AI/Gateway برای همان کار ظاهر نمیشود. تولید جواب و ارائهدهندهٔ خارجی جدا میمانند.



