اجرای هوش مصنوعی بدون نیاز به اینترنت با Ollama

امروزه هوش مصنوعی یا همان مدلهای زبانی بزرگ (LLM) در بسیاری از کارهای روزمره ما نقش دارند؛ از برنامهنویسی و مشاوره پزشکی گرفته تا آموزش و پاسخ به سوالات مختلف. اما چه میشود اگر به اینترنت دسترسی نداشته باشیم و نتوانیم از ابزارهایی مانند ChatGPT یا Gemini استفاده کنیم؟ در چنین شرایطی، میتوانیم با اجرای مدلهای هوش مصنوعی متنباز روی کامپیوتر شخصی خود، یک ابزار هوش مصنوعی قابل قبول و آفلاین داشته باشیم.
معرفی Ollama
Ollama یک پلتفرم متنباز و سبک است که به شما امکان میدهد مدلهای زبانی بزرگ (LLM) را به صورت محلی و بدون نیاز به اتصال به اینترنت اجرا کنید. با استفاده از Ollama، میتوانید مدلهای محبوبی مانند Llama 2 و Llama 3 از Meta، Mistral و Mixtral، Phi-3 از مایکروسافت، Gemma از گوگل و حتی مدلهای سفارشی خود را به صورت آفلاین روی سیستم شخصیتان اجرا کنید. این ویژگی تضمین میکند که دادههای شما کاملاً خصوصی و امن باقی میمانند.
Ollama به دلیل نصب آسان، سرعت بالا و حفظ امنیت دادهها، در بین توسعهدهندگان و محققان حوزه هوش مصنوعی محبوبیت زیادی پیدا کرده است.
نصب و راهاندازی Ollama
🔴 بروزرسانی شده در 17 فروردین 1405
💻 دانلود Ollama برای ویندوز
برای کاربران ویندوز، نسخه نصبی آماده موجود است:
دانلود نرم افزار Ollama نسخه ویندوز (1.6GB)
🍎 دانلود Ollama برای مک (MacOS)
کاربران مک میتوانند نسخه DMG را به راحتی نصب کنند:
دانلود نرم افزار Ollama نسخه مک (104MB)
🐧 دانلود و راهاندازی Ollama در لینوکس
🔹 نسخه CPU (Intel / AMD): مناسب برای اکثر سیستمهای لینوکسی بدون نیاز به کارت گرافیک قدرتمند.
دانلود Ollama لینوکس x86_64 (CPU)
🔹 نسخه ARM64: مناسب برای دستگاههایی مانند Raspberry Pi و سرورهای ARM.
دانلود Ollama لینوکس ARM64
🔹 نسخه AMD GPU (ROCm): مخصوص کارتهای گرافیک AMD که از فناوری ROCm پشتیبانی میکنند.
دانلود Ollama لینوکس با رادیو آهنگ پشتیبانی AMD GPU
📦 منابع توسعه و کتابخانهها
ریپازیتوری گیت هاب Ollama
کتابخانه جاوااسکریپت Ollama
کتابخانه پایتون Ollama
فایل مانیفست تمامی مدلها که باید دانلود کرده و در کنار مدلها قرار دهید (بروزرسانی 4 فروردین 1405):
دانلود فایل manifests (آپدیت 4 فروردین 1405)
این فایل را در مسیر زیر اکسترکت کنید:
%HOMEPATH%.ollamamodels
پس از آن، مدلهای مورد نیاز خود را از فهرست زیر انتخاب و دانلود کنید. به یاد داشته باشید که هرچه پارامترهای مدل بیشتر باشد، دقت آن بالاتر بوده و در نتیجه نیازمندیهای سختافزاری بیشتری نیز خواهد داشت. در ادامه، توضیحات بیشتری درباره مدلها و کاربردهایشان ارائه خواهیم داد.
مدلها را دانلود کرده و در این مسیر اکسترکت کنید:
%HOMEPATH%.ollamamodelsblobs
بروزرسانی 3 فروردین 1405:
حدود 30 مدل جدید و بروز اضافه شد. فایل مانیفست اصلاح و مشکل مدل gpt oss 120b برطرف گردید. تمامی مدلها بدون اشکال کار میکنند.
(نکته: برای اجرای مدلهایی که با علامت * مشخص شدهاند، حتماً باید برنامه Ollama را به آخرین نسخه بروزرسانی کنید.)
راهنمای انتخاب مدلهای متنباز
در لیست زیر، تعدادی مدل متنباز قابل دانلود ارائه شده است که میتوانید با توجه به قدرت سختافزاری و نیازهای خود، یک یا چند مدل را انتخاب و استفاده کنید.
مشاهده توضیحات کامل مدلها
✅ DeepSeek-R1 8B
این مدل استدلالمحور، عملکرد بسیار قوی در حل مسائل پیچیده، تحلیل منطقی، ریاضیات، تولید محتوا و کدنویسی دارد.
- کاربردها: حل مسئله، تحلیل داده، تولید متن دقیق، کمک برنامهنویسی
- ویژگیها: قدرت استدلال بالا، پاسخهای ساختارمند، مناسب برای کارهای تحلیلی
- سیستم پیشنهادی:
- RAM: حداقل 16GB
- VRAM: حداقل 8GB (بهتر: 10GB+)
- CPU-only: حداقل 32GB RAM
✅ DeepSeek-R1 1.5B
نسخهای سبکتر برای اجرای سریعتر با حفظ بخشی از توان استدلالی.
- کاربردها: کارهای روزمره، تحلیل سبک، چت
- ویژگیها: سبک، سریع، مناسب برای سیستمهای ضعیفتر
- سیستم پیشنهادی:
- RAM: 8GB
- VRAM: 4GB
✅ Gemma 3 – 1B
مدلی بسیار سبک برای استفادههای ساده.
- کاربردها: چت ساده، تولید متن کوتاه، تست و توسعه
- ویژگیها: سرعت بالا، مصرف پایین
- سیستم پیشنهادی:
- RAM: 4GB
- VRAM: بدون GPU هم قابل اجرا
✅ Gemma 3 – 4B
مدلی متعادل برای استفاده عمومی.
- کاربردها: تولید محتوا، ترجمه، چت
- ویژگیها: کیفیت مناسب در کنار سرعت خوب
- سیستم پیشنهادی:
- RAM: 8GB
- VRAM: 6GB
✅ Gemma 3 – 12B
مدلی نیمهحرفهای برای کارهای جدیتر.
- کاربردها: تولید محتوای باکیفیت، تحلیل متن، برنامهنویسی
- ویژگیها: دقت بالاتر نسبت به مدلهای کوچکتر
- سیستم پیشنهادی:
- RAM: 16GB
- VRAM: 12GB
✅ Gemma 3 – 27B
مدلی قدرتمند برای کاربردهای پیشرفته.
- کاربردها: پروژههای حرفهای، تحلیل سنگین، تولید محتوای سطح بالا
- ویژگیها: کیفیت بالا، نزدیک به مدلهای بزرگ
- سیستم پیشنهادی:
- RAM: 32GB
- VRAM: 24GB
✅ GPT-OSS 20B
مدلی بزرگ و همهمنظوره با عملکرد خوب در پردازش متن و کدنویسی.
- کاربردها: تولید محتوا، تحلیل، برنامهنویسی
- ویژگیها: تعادل بین قدرت و مصرف
- سیستم پیشنهادی:
- RAM: 32GB
- VRAM: 16–20GB
✅ GPT-OSS 120B
مدلی بسیار بزرگ در سطح سازمانی.
- کاربردها: تحلیل پیچیده، تولید محتوای سطح بالا، پروژههای سنگین
- ویژگیها: دقت و کیفیت بسیار بالا
- سیستم پیشنهادی:
- RAM: 128GB+
- VRAM: 48GB+ یا Multi-GPU
این مدل مناسب اجرای خانگی نیست و بیشتر برای سرورها کاربرد دارد.
✅ Qwen3 4B
مدلی سبک و سریع برای کارهای عمومی.
- کاربردها: چت، ترجمه، تولید متن
- ویژگیها: بهینه و سریع
- سیستم پیشنهادی:
- RAM: 8GB
- VRAM: 6GB
✅ Qwen3 8B
مدلی متعادل با دقت خوب.
- کاربردها: تولید محتوا، تحلیل، کدنویسی سبک
- ویژگیها: کیفیت بهتر نسبت به نسخه 4B
- سیستم پیشنهادی:
- RAM: 16GB
- VRAM: 8–10GB
✅ Qwen3 30B
مدلی قدرتمند برای کارهای حرفهای.
- کاربردها: تحلیل پیشرفته، تولید محتوای حرفهای
- ویژگیها: دقت بالا، مناسب برای پروژههای جدی
- سیستم پیشنهادی:
- RAM: 32GB
- VRAM: 24GB
✅ Qwen3-Coder 30B
مدلی تخصصی برای برنامهنویسی.
- کاربردها: تولید کد، دیباگ، تبدیل زبانهای برنامهنویسی
- ویژگیها: درک عمیق ساختار کد
- سیستم پیشنهادی:
- RAM: 32GB
- VRAM: 24GB
✅ Qwen3-VL 4B
مدلی چندرسانهای سبک (متن + تصویر).
- کاربردها: تحلیل تصویر، پاسخ به سوالات تصویری
- ویژگیها: پشتیبانی از ورودی تصویر
- سیستم پیشنهادی:
- RAM: 8GB
- VRAM: 6GB
✅ Qwen3-VL 8B
نسخه قویتر چندرسانهای.
- کاربردها: پردازش دقیقتر تصویر و متن
- ویژگیها: درک بهتر تصاویر
- سیستم پیشنهادی:
- RAM: 16GB
- VRAM: 10GB
✅ Qwen3-VL 30B
مدلی حرفهای چندرسانهای.
- کاربردها: تحلیل پیچیده تصویر، پروژههای AI Vision
- ویژگیها: دقت بالا در پردازش تصویر و متن
- سیستم پیشنهادی:
- RAM: 32GB
- VRAM: 24GB
✅ LLaMA 3 – 8B
مدلی محبوب و بهینه از Meta.
- کاربردها: چت، تولید محتوا، برنامهنویسی
- ویژگیها: پایداری و کیفیت خوب
- سیستم پیشنهادی:



