داینامو دیبی حالا جستوجوی برداری داره
خلاصهٔ کاملتر
آمازون اعلام کرده جستوجوی برداری تو DynamoDB بهصورت عمومی در دسترسه. تو این اعلان اومده که حالا میتونی امبدینگها رو همونجایی که دادههای عملیاتیت هستن نگه داری و مستقیم روشون جستوجوی شباهت بزنی، بدون اینکه مجبور باشی داده رو به یه دیتابیس برداری جدا کپی کنی. تأخیر تکرقمی میلیثانیه با recall بالای ۹۹٪ و مقیاسپذیری تا تریلیونها بردار چیزیه که AWS براش وعده داده.
منطق کار سادهست. امبدینگ رو با هر مدلی که دوست داری میسازی — مثلاً Titan Text Embeddings یا Cohere یا مدلهای OpenAI — و بهشکل یه لیست از عددها با همون PutItem معمولی تو جدول ذخیره میکنی. DynamoDB از همون نوع دادهٔ List استفاده میکنه، پس نه نوع دادهٔ جدیدی لازمه نه تغییر اسکیما. بعدش روی اون فیلد یه ایندکس برداری میسازی و تعداد ابعاد، تابع فاصله و فیلدهای فیلتر رو مشخص میکنی.
برای جستوجو یه API تازه به اسم SearchVectors هست که بردار پرسوجو، تعداد نتیجه (حداکثر ۱۰۰) و شرطهای فیلتر رو میگیره و نتایج رو مرتبشده بر اساس شباهت برمیگردونه. تا ۴۰۹۶ بعد پشتیبانی میشه و سه تابع فاصله داری: Cosine، Euclidean و Dot product. فیلترها فقط تطابق دقیق رو قبول میکنن و شرطهای بازهای پشتیبانی نمیشن.
کلید پارتیشن ایندکس هم نکتهٔ مهمیه: هر جستوجو به یه مقدار کلید پارتیشن محدود میشه، برای همین یه کاتالوگ محصول که چند بازار مختلف رو سرو میکنه میتونه فقط توی موجودی یه بازار بگرده بهجای اسکن کل ایندکس. معنی امتیاز شباهت هم به تابع فاصله بستگی داره؛ برای Cosine و Euclidean عدد کمتر یعنی شباهت بیشتر. این قابلیت تو همهٔ ریجنهای تجاری AWS و GovCloud در دسترسه.
نکات کلیدی:
- جستوجوی برداری بومی تو DynamoDB با تأخیر تکرقمی میلیثانیه و recall بالای ۹۹٪
- امبدینگها با نوع دادهٔ List ذخیره میشن؛ نه اسکیمای جدید لازمه نه نوع دادهٔ تازه
- API تازهٔ SearchVectors با حداکثر ۱۰۰ نتیجه و فیلتر درونخطی از نوع تطابق دقیق
- پشتیبانی تا ۴۰۹۶ بعد و سه تابع فاصلهٔ Cosine، Euclidean و Dot product
- بردارها و دادههای عملیاتی روی همون زیرساخت سرورلس و همون مدل قیمتگذاری پرداختبهازایدرخواست




