ابزار هوش مصنوعی AI Search کلودفلر عمومی شد

ابزار AI Search کلودفلر به صورت عمومی عرضه شد و قابلیت‌های جدیدی مانند امبدینگ چندوجهی، پشتیبانی از فایل‌های بزرگ‌تر و OCR را ارائه می‌دهد.

تتیم تحریریه۶ دقیقه مطالعه۰ بازدید۲ ساعت پیش
ابزار هوش مصنوعی AI Search کلودفلر عمومی شد

سرویس AI Search شرکت کلودفلر (Cloudflare) قابلیت‌های Workers AI، Vectorize، R2 و Browser Run را در یک پایپ‌لاین فهرست‌بندی و بازیابی کاملاً مدیریت‌شده ترکیب می‌کند. از زمان عرضه اولیه AI Search در بیش از یک سال پیش، دیده‌ایم که توسعه‌دهندگان از آن برای پشتیبانی از طیف گسترده‌ای از موارد استفاده جستجو، از جستجوی مستندات داخلی گرفته تا راه‌اندازی جستجو برای وب‌سایت‌های خود استفاده می‌کنند. ما خودمان از AI Search برای راه‌اندازی جستجو در وبلاگ و مستندات توسعه‌دهندگان خود استفاده می‌کنیم.

از امروز، ابزار AI Search به صورت عمومی (GA) در دسترس است. و به عنوان بخشی از آن، پشتیبانی خود را برای فرمت‌های چندوجهی فراتر از متن گسترش داده و بهبود بخشیده‌ایم؛ امبدینگ‌های تصویر بومی، تشخیص نوری کاراکتر (OCR) برای فایل‌های PDF و پشتیبانی از فایل‌های بزرگ‌تر اضافه شده‌اند.

به عنوان بخشی از عرضه عمومی، صورت‌حساب‌دهی برای AI Search را در تاریخ 1 نوامبر 2026 آغاز خواهیم کرد و همچنان یک ردیف رایگان سخاوتمندانه را در تمامی پلن‌های Workers ارائه می‌کنیم.

جدید: امبدینگ و بازیابی چندوجهی

یک تصویر فراتر از جمله‌ای است که برای توصیف آن استفاده می‌شود. بافت محصول، وضعیت اسکرین‌شات، روابط نمودار، طرح‌بندی سند و جزئیات دقیق بصری همگی می‌توانند هنگام فشرده‌سازی پیکسل‌ها در یک زیرنویس (Caption) از بین بروند.

ابزار AI Search اکنون هر دو سیگنال را حفظ می‌کند: پیکسل‌های تصویر را مستقیماً برای بازیابی بصری امبد می‌کند و در عین حال زیرنویس‌ها را برای درک متنی نگه می‌دارد. برای حفظ کارآمدی این بازنمایی‌های غنی‌تر، AI Search از یادگیری بازنمایی ماتریوشکا (MRL) بهره می‌برد و به امبدینگ‌های کوچک‌تر اجازه می‌دهد اطلاعات مفید را حفظ کنند در حالی که ذخیره‌سازی قابل مدیریت و جستجوی سریع باقی بماند.

اگرچه ما در ابتدا از بازیابی روی تصاویر پشتیبانی می‌کردیم، اما پیاده‌سازی آن ساده لوحانه بود: تشخیص شیء را انجام می‌دادیم، یک زیرنویس تولید می‌کردیم و سپس آن متن را امبد می‌کردیم. این کار باعث می‌شد تصاویر قابل جستجو باشند، اما فقط از طریق جزئیات ثبت شده در زیرنویس. اکنون، ما هر دو کار را انجام می‌دهیم — درک مبتنی بر زیرنویس و بازیابی بومی تصویر.

بازیابی چندوجهی بومی امروز با مدل Qwen3-VL-Embedding در دسترس است. در زمان پرس‌وجو، AI Search بررسی می‌کند که آیا مدل امبدینگ نمونه شما از تصاویر پشتیبانی می‌کند یا خیر. اگر چنین باشد، تصویر پرس‌وجو مستقیماً توسط آن مدل امبد می‌شود و در همان فضای برداری تصاویر و متن فهرست‌شده شما قرار می‌گیرد.

اگر مدل امبدینگ شما فقط متنی است، باز هم می‌توانید با یک تصویر پرس‌وجو کنید. ابزار AI Search تصویر پرس‌وجو را با ToMarkdown به متن تبدیل می‌کند و با استفاده از زیرنویس حاصل جستجو می‌کند. این امر به هر مدلی پشتیبانی پایه چندوجهی می‌دهد، در حالی که مدل‌هایی با پشتیبانی بومی از تصویر، سیگنال بصری کامل را دریافت می‌کنند.

زیرنویس یک تفسیر فشرده از تصویر است. ثبت تمام جزئیات بالقوه مفید نیازمند زیرنویس‌های طولانی یا تخصصی است که با در نظر گرفتن پرس‌وجوی جستجوی نهایی نوشته شده‌اند. امبدینگ‌های بومی تصویر ویژگی‌های بصری را بدون نیاز به پیش‌بینی جزئیات مهم توسط زیرنویس حفظ می‌کنند.

این امر جستجوهایی را امکان‌پذیر می‌کند که بیان دقیق آن‌ها با کلمات دشوار است. شما می‌توانید تصویری را که می‌خواهید پیدا کنید توصیف کنید، تصویر دیگری را برای یافتن نتایج مشابه بصری ارائه دهید، یا هر دو را ترکیب کنید، مانند «پرنده‌ای با نشان‌های مشابه» یا «پرنده‌ای نشسته روی شاخه‌ای پربرگ با آلو». این قابلیت برای کشف محصول، تطبیق اسکرین‌شات، نمودارها، دیاگرام‌ها، اسناد اسکن شده و سایر مجموعه‌هایی که رنگ، بافت، ترکیب‌بندی یا روابط فضایی در آن‌ها اهمیت دارد، مفید است.

نحوه حرکت یک پرس‌وجو در AI Search به این صورت است: ابتدا پرس‌وجو به صورت اختیاری بازنویسی می‌شود، سپس امبد می‌شود (پرس‌وجوهای تصویری مستقیماً توسط مدل‌های چندوجهی امبد می‌شوند یا ابتدا توسط مدل‌های فقط متنی زیرنویس می‌شوند). جستجوی برداری و کلیدواژه به صورت موازی اجرا می‌شوند و نتایج ترکیب شده و به صورت اختیاری رتبه‌بندی مجدد می‌شوند. تکه‌های برتر بازگردانده می‌شوند یا برای نوشتن پاسخ به یک مدل تولیدی منتقل می‌شوند.

فایل‌های بزرگ‌تر و OCR برای اسناد اسکن شده

ابزار AI Search اکنون فایل‌های متنی شما (Markdown، HTML، CSV، JSON و موارد مشابه) و PDFهای تا حجم 10 مگابایت را می‌پذیرد که از 4 مگابایت افزایش یافته است. بسیاری از PDFها در واقع تصاویر اسکن شده‌ای هستند که هیچ متن قابل استخراجی ندارند. برای آن‌ها، OCR را روشن کنید و AI Search متن را از هر صفحه قبل از قطعه‌بندی و امبد کردن می‌خواند. OCR برای هر حسابی در دسترس است و تحت قیمت‌گذاری جدید AI Search به عنوان توکن‌های جذب پردازش تصویر صورت‌حساب می‌شود.

اکنون در نسخه عمومی: صورت‌حساب و قیمت‌گذاری برای AI Search

در طول هفته عوامل اوت 2026، ما قیمت‌گذاری پیش‌نمایش را برای AI Search اعلام کردیم. با عمومی شدن این محصول امروز، ما صورت‌حساب‌دهی برای AI Search را اعلام می‌کنیم که در تاریخ 1 نوامبر 2026 فعال می‌شود. ما قبل از فعال شدن صورت‌حساب، یک ایمیل یادآوری ارسال خواهیم کرد.

قیمت‌گذاری AI Search به گونه‌ای طراحی شده است که بتوانید قبل از فهرست کردن حتی یک فایل، صورت‌حساب خود را تخمین بزنید. شما برای سه چیز هزینه پرداخت می‌کنید: محتوایی که جذب می‌کنید، داده‌هایی که ذخیره می‌کنید و پرس‌وجوهایی که اجرا می‌کنید. کار بین آن‌ها (تجزیه، قطعه‌بندی، امبد کردن با مدل‌های Workers AI، فهرست‌بندی کلمات کلیدی و رتبه‌بندی مجدد) گنجانده شده است. هیچ ساعت نمونه، واحد ظرفیت یا حداقل ماهانه وجود ندارد که از قبل اندازه گیری شود و پروژه‌های کوچک در سهمیه رایگان ماهانه جای می‌گیرند.

قیمت‌گذاری جذب بر اساس یک نرخ به ازای هر توکن با هر مدل امبدینگ Workers AI که انتخاب می‌کنید است و توکن‌ها برای هر مدل به یک شکل شمارش می‌شوند. تغییر از یک مدل امبدینگ فقط متنی به یک مدل چندوجهی هزینه‌ای را که برای جذب پرداخت می‌کنید تغییر نمی‌دهد، مگر اینکه در حال پردازش تصاویر نیز باشید (هزینه افزودنی). ذخیره‌سازی بر اساس حجم داده‌ها در نمایه‌های شما قیمت‌گذاری می‌شود. پرس‌وجو بر اساس نوع پرس‌وجو (معنایی در برابر متن کامل) و تعداد پرس‌وجوهایی که ارسال می‌کنید قیمت‌گذاری می‌شود.

تخمین هزینه شما به این بستگی دارد که چقدر محتوا فهرست می‌کنید، چقدر ذخیره می‌کنید و چه تعداد پرس‌وجو انتظار دارید. در اینجا قیمت‌گذاری است که در پیش‌نمایش اعلام کردیم، با یک تغییر که در حال انجام آن هستیم: در سهمیه رایگان ماهانه، شما 1000 پرس‌وجوی معنایی و 1000 پرس‌وجوی متن کامل دریافت خواهید کرد (به جای یک استخر مشترک 2000 پرس‌وجویی).

گام‌های بعدی

پشتیبانی از امبدینگ چندوجهی تنها اولین قدم است؛ ما در حال ساخت یک پایپ‌لاین جذب برای پشتیبانی از پردازش کامل ویدیو و صوت هستیم تا به مشتریان خود اجازه دهیم دارایی‌های رسانه‌ای غنی خود را جستجو کنند.

ما همچنین در حال بازسازی موتور جستجوی کلمات کلیدی هستیم تا با نیازمندی‌های محتوای شما مقیاس‌پذیری بهتری داشته باشد، به‌ویژه برای زمانی که انبارهای داده بزرگی دارید که پیاده‌سازی فعلی در آن‌ها محدودیت‌هایی دارد.

در نهایت، ما در حال توسعه راه‌های بهتر و ساده‌تری برای فعال کردن AI Search و ایجاد نمایه‌ها برای وب‌سایت‌هایی هستیم که از قبل روی کلودفلر اجرا می‌شوند. این تضمین می‌کند که عوامل هوش مصنوعی می‌توانند محتوا را راحت‌تر و کارآمدتر کشف، بررسی و مصرف کنند.

منتظر این اعلامیه‌های بعدی و موارد دیگر باشید.

ابزار AI Search اکنون برای فعال‌سازی و استفاده عمومی در دسترس است. کار خود را با امبدینگ‌های چندوجهی جدید، فایل‌های بزرگ‌تر، قابلیت‌های OCR و قیمت‌گذاری جدید نمونه مدیریت‌شده آغاز کنید. برای اطلاعات بیشتر، مستندات توسعه‌دهنده AI Search را بررسی کنید.


منبع: blog.cloudflare.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.