ما هي التضمينات Embeddings؟ التضمينات Embeddings هي تمثيل عددي للنصوص أو الصور أو الأصوات على شكل متجهات Vectors. الفكرة الجوهرية هي أن الحاسوب لا “يفهم” الجمل بصيغتها البشرية، بل يحتاج إلى تحويلها إلى أرقام يمكن مقارنتها وقياس المسافة بينها. عندما نحول عبارة مثل “تعلم الآلة” وعبارة “Machine Learning” إلى تضمينات جيدة، نجد أن المتجهين الناتجين…
حفظ واسترجاع ذاكرة المحادثات من قاعدة بيانات SQLite / Redis عند بناء تطبيق محادثة يعتمد على نماذج اللغة الكبيرة LLMs، فإن النموذج نفسه لا “يتذكر” شيئاً بين الطلبات إلا إذا قمت أنت بتمرير السياق السابق في كل استدعاء. هذه الفكرة ناقشناها سابقاً في مقال الذاكرة في الذكاء الاصطناعي: لماذا ينسى الـ API المحادثات السابقة وكيف…
ما هي Summary Memory ولماذا نحتاجها؟ عند بناء تطبيقات محادثية تعتمد على نماذج اللغة الكبيرة، تظهر مشكلة عملية مع ازدياد طول الحوار: كل رسالة جديدة تتطلب إعادة إرسال جزء كبير من السجل إلى LLM حتى يحافظ على السياق. هذا يرفع التكلفة، يزيد زمن الاستجابة، ويقرّبنا من حدود context window. هنا تأتي فكرة Summary Memory: بدلاً…
ما هي Buffer Memory ولماذا نحتاجها؟ عند بناء تطبيق محادثة يعتمد على نماذج اللغة الكبيرة LLMs، تظهر مشكلة هندسية أساسية: واجهات API لا “تتذكر” ما قيل سابقاً بشكل طبيعي، بل تحتاج في كل طلب جديد إلى إعادة تمرير السياق السابق ضمن الرسالة. هنا يأتي دور Buffer Memory بوصفها طبقة برمجية مؤقتة تحتفظ بتاريخ المحادثة القصير…
ما المقصود بذاكرة النماذج اللغوية ولماذا تبدو وكأنها “تنسى”؟ عند بناء تطبيق يعتمد على LLM API يظن كثير من المطورين أن النموذج يحتفظ تلقائياً بكل ما قيل سابقاً، لكن هذا غير صحيح في أغلب واجهات البرمجة. النموذج لا يملك “ذاكرة دائمة” داخلية لكل مستخدم، بل يستقبل في كل طلب حزمة نصية جديدة تحتوي على التعليمات…