پرش به محتوای اصلی
ابزارهای هوش مصنوعی

Cloudflare AI Search چیست؟ جست‌وجوی چندرسانه‌ای GA

Cloudflare AI Search از ۱ اکتبر ۲۰۲۶ عمومی شد؛ embedding تصویر بومی، OCR برای PDF اسکن‌شده، سقف فایل بالاتر، hybrid پیش‌فرض و صورتحساب از ۱ نوامبر با سهمیه رایگان.

۱۰ دقیقه مطالعه
اشتراک‌گذاری:
بنر رسمی بلاگ Cloudflare برای اعلام عمومی شدن AI Search
بنر رسمی بلاگ Cloudflare برای اعلام عمومی شدن AI Search
فهرست مطالب

Cloudflare AI Search از ۱ اکتبر ۲۰۲۶ به‌صورت عمومی (Generally Available یا همان GA) در دسترس است: یک سرویس مدیریت‌شده برای ایندکس و جست‌وجو روی داده‌های خودتان که ترکیب Workers AI، Vectorize، R2 و رندر مرورگر Cloudflare را پشت یک خط لولهٔ آماده می‌گذارد. در همین GA، شرکت پشتیبانی چندرسانه‌ای را جدی‌تر کرده (embedding مستقیم تصویر، نه فقط کپشن)، OCR برای PDFهای اسکن‌شده را برای همهٔ حساب‌ها باز کرده، سقف بعضی فایل‌ها را بالا برده، و اعلام کرده صورتحساب استفاده‌محور از ۱ نوامبر ۲۰۲۶ شروع می‌شود — با سهمیهٔ رایگان ماهانه روی همهٔ پلن‌های Workers.

در این مطلب به زبان ساده می‌گوییم AI Search چیست، با جست‌وجوی معمولی چه فرقی دارد، در GA چه چیزهایی عوض شده، قیمت اعلامی شرکت چطور خوانده می‌شود، و برای چه تیم‌هایی منطقی است. اگر دنبال ابزار جست‌وجوی داده‌محور برای ایجنت‌ها هم هستید، دربارهٔ Exa Agent Ultra جدا نوشته‌ایم؛ اینجا تمرکز روی محصول جست‌وجوی مدیریت‌شدهٔ خود Cloudflare است.

پاسخ کوتاه: Cloudflare AI Search چیست؟

طبق نوشتهٔ رسمی Cloudflare، AI Search یک خط لولهٔ ایندکس و بازیابی آماده است: فایل یا سایت را می‌دهید، محتوا تکه‌تکه (chunk) و به بردار تبدیل می‌شود، بعد می‌توانید با معنا (semantic)، کلیدواژه، یا ترکیبی از هر دو جست‌وجو کنید و در صورت نیاز جواب تولیدشده بگیرید. شرکت می‌گوید خودش هم جست‌وجوی بلاگ و مستندات توسعه‌دهندگانش را با همین محصول راه انداخته — این ادعای خود Cloudflare است، نه یک بنچمارک مستقل که ما بازبینی کرده باشیم.

چرا این موضوع برای غیرمتخصص‌ها هم مهم است؟

جست‌وجوی کلاسیک معمولاً روی کلمات دقیق کار می‌کند: اگر کاربر «صورتحساب» بنویسد و سند شما «فاکتور» گفته باشد، ممکن است چیزی پیدا نشود. در مسیرهای جدیدتر — که گاهی زیر چتر RAG (بازیابی تقویت‌شده برای تولید جواب) می‌آیند — متن به embedding تبدیل می‌شود: یعنی یک نمایش عددی از معنا، تا جمله‌های شبیه هم نزدیک هم قرار بگیرند حتی اگر واژه‌ها یکی نباشند.

ساخت این سیستم از صفر سخت است: باید پارس، تکه‌بندی، مدل embedding، دیتابیس برداری، جست‌وجوی کلیدواژه، گاهی رتبه‌بندی مجدد (rerank)، و اتصال به مدل تولید جواب را خودتان بچینید. روایت Cloudflare این است که AI Search همان قطعات را داخل اکوسیستم Workers مدیریت می‌کند تا تیم محصول یا سایت، کمتر زیرساخت سرهم کند. این وعدهٔ فروشنده است؛ پیچیدگی واقعی پروژهٔ شما به کیفیت داده، سطح دسترسی، و نیاز امنیتی‌تان بستگی دارد.

چه چیزهایی با GA عوض شده؟

محصول قبلاً در پیش‌نمایش/بتا بود. از ۱ اکتبر ۲۰۲۶ وضعیت GA اعلام شده و این موارد در پست بلاگ و changelog رسمی برجسته شده‌اند:

  • Embedding چندرسانه‌ای بومی برای تصویر (علاوه بر فهم متنی از کپشن)

  • OCR برای PDFهای اسکن‌شده، در دسترس همهٔ حساب‌ها

  • سقف بزرگ‌تر فایل برای بعضی انواع محتوا (جزئیات دقیق پایین‌تر)

  • قیمت‌گذاری و صورتحساب از ۱ نوامبر ۲۰۲۶، با سهمیهٔ رایگان ماهانه

  • Hybrid search به‌صورت پیش‌فرض برای نمونه‌های جدید (ترکیب برداری + متن کامل)

  • فراخوانی embedding و rerank مدل‌های منتخب Workers AI داخل قیمت AI Search حساب می‌شود (دیگر خط جدا روی قبض Workers AI برای همان کارها)

جست‌وجوی تصویر: کپشن در برابر پیکسل

قبلاً — به روایت خود شرکت — تصویر بیشتر این‌طور قابل جست‌وجو می‌شد: تشخیص شیء، ساخت یک کپشن (جملهٔ توصیفی)، بعد embedding همان متن. مشکل این است که کپشن خلاصه است؛ بافت محصول، جزئیات نمودار، یا حالت یک اسکرین‌شات ممکن است از دست برود.

در GA، AI Search ادعا می‌کند خود پیکسل‌های تصویر را هم embed می‌کند و کپشن را برای فهم متنی نگه می‌دارد. برای فشرده‌ماندن این بردارهای غنی‌تر به Matryoshka Representation Learning (MRL) اشاره شده: تکنیکی که اجازه می‌دهد embedding کوتاه‌تر هم هنوز مفید بماند. مدل چندرسانه‌ای که در بلاگ نام برده شده Qwen3-VL-Embedding است؛ changelog هم مدل‌هایی مثل @cf/qwen/qwen3-vl-embedding-2b و google-ai-studio/gemini-embedding-2 را فهرست کرده است.

اگر مدل embedding شما فقط متنی باشد، باز هم می‌توانید با تصویر جست‌وجو کنید: AI Search تصویر را با ToMarkdown به متن تبدیل می‌کند و با کپشن جلو می‌رود — پشتیبانی پایه برای همه، و سیگنال بصری کامل فقط وقتی مدل واقعاً چندرسانه‌ای باشد. کاربردهایی که شرکت مثال زده: کشف محصول، تطبیق اسکرین‌شات، نمودار، دیاگرام، اسناد اسکن‌شده.

مسیر یک کوئری (به روایت Cloudflare)

بلاگ رسمی مسیر را این‌طور خلاصه کرده: کوئری اختیاری بازنویسی می‌شود؛ بعد embed می‌شود (تصویر یا مستقیم با مدل چندرسانه‌ای، یا اول کپشن برای مدل متنی)؛ جست‌وجوی برداری و کلیدواژه موازی اجرا می‌شوند؛ نتایج ادغام و در صورت نیاز rerank می‌شوند؛ تکه‌های برتر برمی‌گردند یا به مدل تولید برای نوشتن جواب پاس داده می‌شوند. این معماری اعلامی شرکت است؛ تنظیمات دقیق هر instance را از داشبورد و مستندات روز چک کنید.

فایل بزرگ‌تر و OCR برای PDF اسکن‌شده

خیلی از PDFها در واقع تصویر اسکن‌شده‌اند و متن قابل استخراج ندارند. با روشن کردن OCR، AI Search متن هر صفحه را می‌خواند، بعد chunk و embed می‌کند. OCR برای همهٔ حساب‌ها اعلام شده و هزینهٔش زیر توکن‌های پردازش تصویر در قیمت جدید می‌آید.

دربارهٔ سقف حجم، changelog دقیق‌تر از خلاصهٔ بلاگ است:

  • فایل‌های متنی/کد و PDF با OCR روشن: تا حدود ۱۰ MiB

  • PDF بدون OCR و سایر فرمت‌های پشتیبانی‌شده: همچنان حدود ۴ MiB

اگر فقط جملهٔ بلاگ («متن و PDF تا ۱۰ MiB») را ببینید ممکن است گمراه شوید؛ برای تصمیم فنی همان جدول Data source و Limits را در مستندات بخوانید.

قیمت و سهمیه رایگان (اعلام شرکت — از ۱ نوامبر ۲۰۲۶)

در Agents Week اوت ۲۰۲۶ قیمت پیش‌نمایش اعلام شده بود؛ با GA، صورتحساب از ۱ نوامبر ۲۰۲۶ فعال می‌شود و Cloudflare گفته حدود یک هفته قبل ایمیل یادآوری می‌فرستد. روایت شرکت: سه چیز می‌پردازید — محتوایی که ingest می‌کنید، داده‌ای که نگه می‌دارید، و کوئری‌هایی که می‌زنید. کار میانی مثل پارس، chunk، embedding با مدل‌های Workers AI منتخب، ایندکس کلیدواژه و rerank داخل همان قیمت آمده؛ بدون «ساعت instance» یا حداقل ماهانهٔ اجباری در توضیح بلاگ.

تغییر کوچک نسبت به پیش‌نمایش: سهمیهٔ رایگان ماهانه دیگر یک استخر مشترک ۲۰۰۰ کوئری نیست؛ جداگانه ۱۰۰۰ کوئری معنایی و ۱۰۰۰ کوئری متن کامل است.

آیتم

نرخ اعلامی

سهمیه رایگان ماهانه (همه پلن‌های Workers)

Ingest پایه

۰٫۷۵ دلار / ۱ میلیون توکن

۵ میلیون توکن (استخر مشترک متن و تصویر)

پردازش تصویر (اضافه)

+۰٫۵۰ دلار / ۱ میلیون توکن

همان استخر ۵ میلیون

ذخیره

۲٫۰۰ دلار / گیگابایت-ماه

۱۰ گیگابایت-ماه

کوئری معنایی / برداری / هیبرید

۰٫۷۵ دلار / ۱۰۰۰ کوئری

۱۰۰۰ کوئری

کوئری متن کامل

۰٫۱۰ دلار / ۱۰۰۰ کوئری

۱۰۰۰ کوئری

نکته‌های حسابداری که مستندات گفته‌اند: توکن‌ها روی chunk نهایی بعد از پارس شمرده می‌شوند؛ هم‌پوشانی chunk ممکن است متن تکراری را چندبار بشمارد؛ tokenizer اعلامی cl100k_base است. تولید جواب، بازنویسی کوئری، و ارائه‌دهندهٔ خارجی همچنان روی حساب/Gateway شما می‌مانند. قیمت‌ها ادعای منتشرشدهٔ Cloudflare در تاریخ GA است؛ قبل از بودجهٔ جدی، صفحهٔ Limits & pricing روز را دوباره چک کنید.

برای چه کسی مناسب است؟

  • تیم‌هایی که سایت یا اپشان از قبل روی Cloudflare/Workers است و می‌خواهند جست‌وجوی اسناد داخلی، دانش‌نامه، یا بلاگ را سریع بالا بیاورند

  • محصولاتی که به جست‌وجوی اسکرین‌شات، کاتالوگ تصویری، یا PDF اسکن‌شده نیاز دارند و نمی‌خواهند pipeline embedding تصویر را از صفر بسازند

  • پروژه‌های کوچک که داخل سهمیهٔ رایگان ماهانه جا می‌شوند و می‌خواهند قبل از ۱ نوامبر هزینه را برآورد کنند

اگر به مارکت‌پلیس اکستنشن و ابزارهای Claude علاقه دارید، مسیر جداگانه‌ای است — بازارچهٔ Claude را جدا بررسی کرده‌ایم؛ AI Search بیشتر لایهٔ بازیابی داده است تا مارکت افزونه.

محدودیت‌ها و احتیاط‌ها

  • کیفیت بازیابی به تمیزی منبع، تنظیم chunk، و انتخاب مدل embedding وابسته است؛ GA بودن یعنی محصول عمومی شده، نه اینکه برای هر دیتاستی جادو کند.

  • نقشهٔ راه شرکت (ویدیو/صدا، بازطراحی موتور کلیدواژه، فعال‌سازی ساده‌تر برای سایت‌های روی Cloudflare) هنوز وعده است؛ تاریخ تحویل عمومی در پست GA قفل نشده.

  • برای دادهٔ حساس، قبل از ingest سیاست نگهداری، منطقه، و دسترسی را با تیم امنیت خودتان و اسناد روز Cloudflare مرور کنید — ما اینجا جایگزین مشاورهٔ حقوقی نیستیم.

  • اعداد قیمت و سهمیه را از روی اعلام رسمی نقل کردیم؛ تغییر بعدی صفحهٔ docs اولویت دارد.

جمع‌بندی

Cloudflare AI Search از ۱ اکتبر ۲۰۲۶ عمومی شده: جست‌وجوی مدیریت‌شده روی دادهٔ خودتان، با تمرکز تازه روی embedding تصویر بومی، OCR برای PDF اسکن‌شده، سقف فایل بالاتر در بعضی حالت‌ها، hybrid پیش‌فرض، و صورتحساب از ۱ نوامبر همراه سهمیه رایگان. اگر از قبل روی Workers هستید و می‌خواهید لایهٔ بازیابی را کمتر خودتان نگه دارید، الان زمان مناسبی برای آزمایش و برآورد هزینه است — با خواندن مستندات Limits و تست روی دادهٔ واقعی، نه فقط روی وعدهٔ بلاگ.

سوالات پرتکرار

Cloudflare AI Search دقیقاً چه کاری می‌کند؟

محتوای شما را ایندکس می‌کند و امکان جست‌وجوی معنایی، کلیدواژه‌ای یا هیبرید می‌دهد؛ در صورت نیاز تکه‌ها را به مدل تولید جواب می‌سپارد. زیرساخت را Cloudflare به‌صورت مدیریت‌شده روی Workers AI، Vectorize و R2 توصیف کرده است.

GA از چه تاریخی است و کی پول می‌گیریم؟

GA از ۱ اکتبر ۲۰۲۶ اعلام شده؛ صورتحساب استفاده‌محور از ۱ نوامبر ۲۰۲۶. شرکت گفته حدود یک هفته قبل ایمیل یادآوری می‌فرستد.

آیا بدون پرداخت می‌شود استفاده کرد؟

بله در حد سهمیهٔ رایگان ماهانه اعلام‌شده روی همهٔ پلن‌های Workers (۵ میلیون توکن ingest، ۱۰ گیگابایت-ماه ذخیره، ۱۰۰۰ کوئری معنایی و ۱۰۰۰ کوئری متن کامل). مصرف بیشتر طبق نرخ‌های جدول بالا محاسبه می‌شود.

جست‌وجو با تصویر چطور کار می‌کند؟

اگر مدل embedding چندرسانه‌ای باشد، تصویر مستقیم embed می‌شود. اگر مدل فقط متنی باشد، تصویر اول به کپشن متنی تبدیل می‌شود و همان جست‌وجو می‌شود.

OCR برای همه هست؟

طبق changelog رسمی، OCR برای PDF اسکن‌شده روی هر حساب در دسترس است و هزینهٔش به‌صورت توکن پردازش تصویر شمرده می‌شود.

سقف فایل ۱۰ مگابایت برای همهٔ فرمت‌هاست؟

نه لزوماً. متن/کد و PDF با OCR روشن تا حدود ۱۰ MiB؛ PDF بدون OCR و بعضی فرمت‌های دیگر همچنان حدود ۴ MiB. جزئیات را از docs روز بگیرید.

Hybrid search یعنی چه؟

ترکیب جست‌وجوی برداری (معنا) با تطبیق متن کامل. برای نمونه‌های جدید، changelog گفته hybrid پیش‌فرض است و موقع ساخت instance می‌توانید روش دیگری انتخاب کنید.

آیا embedding جدا روی قبض Workers AI می‌آید؟

برای فراخوانی embedding و rerank مدل‌های منتخب که خود AI Search می‌زند، شرکت گفته داخل قیمت AI Search است و دیگر روی خط Workers AI/Gateway برای همان کار ظاهر نمی‌شود. تولید جواب و ارائه‌دهندهٔ خارجی جدا می‌مانند.

منابع

برچسب‌ها:هوش مصنوعیهوش مصنوعی مولدتوسعه وب
اشتراک‌گذاری:

مطالب مرتبط

عضویت در خبرنامه

آخرین اخبار هوش مصنوعی و فناوری را در ایمیل خود دریافت کنید.

پس از عضویت یک ایمیل تأیید برایتان ارسال می‌شود. هر زمان می‌توانید اشتراک خود را لغو کنید و ایمیل شما با شخص ثالثی به اشتراک گذاشته نمی‌شود.