Local LLM چیست و چه زمانی به آن نیاز داریم؟

Local LLM یعنی مدل زبانی روی سخت‌افزار و شبکه شما اجرا شود، نه از طریق API یک ارائه‌دهنده عمومی. ورودی و خروجی مکالمه داخل همان محیط باقی می‌ماند.

چه زمانی Local منطقی است؟

  • داده حساس، محرمانه یا مشمول محدودیت داخلی است.
  • می‌خواهید هزینه inference را کنترل کنید، نه به‌ازای هر توکن به سرویس خارجی.
  • نیاز به SLA، audit و کنترل دسترسی داخل سازمان دارید.

چه زمانی کلاد عمومی کافی است؟

برای نمونه اولیه، حجم کم، یا داده‌ای که اجازه خروج دارد، API عمومی سریع‌تر است. مسیر XCR9 معمولاً با ارزیابی شروع می‌شود، نه اجبار به local.

پشته رایج

مدل (Qwen / Llama / Mistral) + موتور inference (vLLM یا Ollama) + GPU + در صورت نیاز RAG. جزئیات سخت‌افزار را در ماشین‌حساب LLM ببینید.

خدمات Local LLM XCR9

بازگشت به دانشنامه