2026-10-10
(تم التعديل في:
2026-10-10)
— المؤلف:
SimeonOnSecurity
— 9 دقيقة واحدة للقراءة تتبّع المطالبات وملفات النماذج والأدوات والسجلات والتعرض الشبكي وتكاليف الطاقة قبل اختيار الاستدلال المحلي أو خدمة ذكاء اصطناعي مستضافة.
رسم توضيحي لمسارات بيانات الذكاء الاصطناعي المحلي والمستضاف #llama.cpp
2026-10-07
(تم التعديل في:
2026-10-10)
— المؤلف:
SimeonOnSecurity
— 9 دقيقة واحدة للقراءة حدّد حجم إعداد LLM محلي بسعة 16GB وفق أوزان النموذج وذاكرة KV ومعالجة المطالبات. قارن ميزانيات ذاكرة Qwen3.8 27B وعرض نطاق GPU وتكاليف التملك.
رسم توضيحي، وليس ناتج اختبار أداء #التكميم
#نافذة السياق
#llama.cpp
#وكلاء البرمجة
#الذاكرة الموحدة
2026-10-06
(تم التعديل في:
2026-10-10)
— المؤلف:
SimeonOnSecurity
— 10 دقيقة واحدة للقراءة دليل عملي لشهر أكتوبر 2026 لاختيار نماذج الذكاء الاصطناعي المحلية لوكلاء البرمجة. قارن ذاكرة GPU، ونمو KV-cache، وحجم السياق، وجودة التكميم، ومعالجة المطالبات، وإعدادات الاستدلال، وتكاليف الاستئجار السحابي.
#وكلاء البرمجة
#VRAM
#نافذة السياق
#التكميم
#llama.cpp
2026-10-06
(تم التعديل في:
2026-10-10)
— المؤلف:
SimeonOnSecurity
— 10 دقيقة واحدة للقراءة كيف تعدل نماذج لغة السياق ذاكرة الوكيل، وما الذي تثبته المعايير، وكيف تؤثر تكاليف التخزين المؤقت وقدرة النموذج والملاحظات غير الموثوقة في الاعتمادية.
رسم توضيحي مفاهيمي لذاكرة الوكيل القابلة للتحرير. #نافذة السياق
#llama.cpp
2026-10-03
(تم التعديل في:
2026-10-10)
— المؤلف:
SimeonOnSecurity
— 10 دقيقة واحدة للقراءة دليل عملي لشهر أكتوبر 2026 لتشغيل نموذج Qwen 27B مع 32GB من ذاكرة المسرّع القابلة للاستخدام. قارن بين وحدات GPU المنفردة، وبُنى البطاقتين، والذاكرة الموحدة، وبطاقات مراكز البيانات المستعملة، والحوسبة المستأجرة، ودعم البرمجيات، وحدود السياق الكامل.
#VRAM
#llama.cpp
#الذاكرة الموحدة