آموزشی 📅 8 مهر 1405 Quantization مدلهای هوش مصنوعی: تفاوت INT4، INT8، FP8 و BF16 در مصرف منابع سرور اجرای مدلهای زبانی بزرگ روی سرور شخصی، یکی از جذابترین روشها برای ساخت سرویسهای AI خصوصی، چتبات، RAG و API...
آموزشی 📅 6 مهر 1405 راهاندازی سرور Embedding شخصی روی VPS؛ زیرساخت خصوصی RAG بدون وابستگی به APIهای خارجی اگر روی پروژههای هوش مصنوعی، دستیار سازمانی یا چتبات مبتنی بر اسناد داخلی کار میکنید، حتماً با چالش Embedding مواجه...
آموزشی 📅 6 مهر 1405 آموزش راهاندازی و اجرای SGLang روی سرور مجازی؛ ساخت API هوش مصنوعی اختصاصی اگر بهدنبال راهی برای اجرای مدلهای زبانی بزرگ (LLM) روی زیرساخت شخصی خودتان هستید و میخواهید یک API مشابه سرویسهای...
دستهبندی نشده 📅 4 مهر 1405 آموزش ساخت هوش مصنوعی آفلاین روی فلش با llama.cpp + مدل GGUF آموزش ساخت هوش مصنوعی آفلاین روی فلش با llama.cpp و مدل GGUF؛ یک AI پرتابل واقعی برای داشتن یک هوش...