دانلود ملزومات و مدل های هوش مصنوعی Gemma 4 از گوگل
در این مقاله، به بررسی نسل جدید هوش مصنوعی گوگل یعنی مدل های gemma 4 میپردازیم. این نسخه با جهشی خیرهکننده در قدرت استدلال و بهینهسازی حافظه، امکان اجرای آفلاین و محلی را برای کاربران با دسترسی مح…

گوگل با معرفی Gemma 4، استانداردهای مدلهای متنباز را جابهجا کرده است. این نسخه نسبت به Gemma 2 و 3، جهش بزرگی در بهرهوری داشته؛ به طوری که مدلهای کوچک آن (مثل نسخه E2B و E4B) اکنون میتوانند با سرعتی باورنکردنی روی سختافزارهای معمولی و حتی گوشیهای هوشمند اجرا شوند. تمرکز اصلی در این نسل، بهبود قدرت استدلال (Reasoning) و کاهش مصرف حافظه بوده تا توسعهدهندگان بتوانند بدون نیاز به اینترنت و سرورهای گرانقیمت، از هوش مصنوعی در سطح جهانی استفاده کنند.
باکس دانلود در 22 اردیبهشت بروز شد
پیشرفت کلیدی دیگر در Gemma 4، استفاده از معماری Mixture of Experts (MoE) در نسخههای بزرگتر (مثل 26B A4B) است. این یعنی مدل با وجود داشتن پارامترهای بالا، در هر لحظه فقط بخش بهینهای از آنها را فعال میکند که منجر به سرعت پاسخدهی بسیار بالاتر نسبت به نسخههای قدیمیتر میشود. همچنین پنجره بافتی (Context Window) در این نسخه به 128K تا 256K ارتقا یافته که اجازه میدهد کتابها یا کدهای بسیار طولانی را یکجا به حافظه مدل بسپارید.

قدرت بینایی با mmproj: فراتر از متن
یکی از جذابترین بخشهای Gemma 4، پشتیبانی بومی و بهینه از قابلیتهای دیداری (Vision) است. با استفاده از فایلهای mmproj (Multi-Modal Projector)، شما میتوانید این مدل را به یک تحلیلگر تصویر تبدیل کنید. این قابلیت به کاربران اجازه میدهد تا با افزودن یک فایل مکمل کوچک به مدل اصلی، امکاناتی مثل OCR (تشخیص متن از تصویر)، شرح تصاویر و حتی تحلیل نمودارهای پیچیده را به صورت کاملاً آفلاین در اختیار داشته باشند.

بنچمارکها و عملکرد
در آزمونهای معتبر، Gemma 4 توانسته است بسیاری از رقبای همسایز خود را پشت سر بگذارد. به عنوان مثال، در بنچمارک MMMU Pro (که مربوط به درک چندوجهی و بینایی است)، نسخه ۳۱ میلیاردی آن به امتیاز خیرهکننده ۷۶.۹٪ دست یافته است. همچنین در بخش کدنویسی و ریاضیات، بهبود ۳۰ درصدی نسبت به Gemma 3 مشاهده میشود که آن را به بهترین گزینه برای اجرای محلی روی لپتاپهای شخصی تبدیل میکند.

مطابق جدول زیر میتوانید با توجه به سیستم شخصی تان بهترین مدل رو دانلود کنید. مرجع رسمی دانلود مدل های GEMMA 4 و نکته مهم اینکه ما همه این مدلهارو در این شرایط نمیتونیم دانلود کنیم. اگر مدلی رو شما دریافت کردید لطفا به ما اطلاع بدید تا شرایطی فراهم کنیم روی سرور ما قرار دهید.

عبارت UD مخفف Unsloth Dynamic است. این یک تکنولوژی جدید و بسیار پیشرفته برای فشردهسازی مدلها (Quantization) است که به تازگی توسط تیم Unsloth معرفی شده است.
تفاوت این دو فایل دقیقاً در روش فشردهسازی آنهاست: برای مثال در مورد q4
۱. نسخه استاندارد: Q4_K_M
روش کار: این همان روش استاندارد و سنتی فشردهسازی (مبتنی بر ابزار llama.cpp) است. در این حالت، تقریباً تمام لایههای شبکه عصبی مدل با یک قانون ثابت به محدوده ۴ بیت کاهش پیدا میکنند.
مزیت: بسیار پایدار است، با تمام نسخههای نرمافزارهای اجراکننده (مثل LM Studio یا Ollama) سازگاری ۱۰۰ درصدی دارد و روی اکثر سیستمها بینقص اجرا میشود.
۲. نسخه هوشمند: UD-Q4_K_XL (Unsloth Dynamic)
روش کار: در این روش جدید (نسخه Dynamic v2.0)، فشردهسازی به صورت «هوشمند و پویا» انجام میشود. الگوریتم Unsloth لایههای مدل را اسکن میکند؛ لایههایی که برای درک زبان و استدلال مهمتر هستند را با دقت بالاتری نگه میدارد و لایههای تکراری یا کماهمیتتر را بیشتر فشرده میکند.
مزیت: این نسخه در بنچمارکها دقت بسیار بالاتری نسبت به نسخههای استاندارد Q4 دارد و خروجی آن به طرز چشمگیری نزدیکتر به مدل اصلی (نسخه ۶۰ گیگابایتی گوگل) است.
نتیجهگیری: کدام را باید دانلود کنید؟
اگر از جدیدترین آپدیت نرمافزارهایی مثل LM Studio ،Ollama یا خودِ Unsloth Studio استفاده میکنید، پیشنهاد قطعی دانلود نسخه UD-Q4_K_XL است. با حجم تقریباً مشابه، کیفیت و هوش بسیار بیشتری را در اختیارتان میگذارد.
اگر از محیطهای اجرایی قدیمیتر استفاده میکنید یا میخواهید خیالتان از بابت سازگاری پایه با هر سیستم و اسکریپتی راحت باشد، همان نسخه استاندارد Q4_K_M را انتخاب کنید.
نکته برای کاربران: اگر به دلیل محدودیت اینترنت به دنبال مدلهای خاص یا نسخههای کوانتایز شده (کمحجم) برای اجرای آفلاین هستید، در بخش نظرات اعلام کنید تا فایلهای مورد نیاز را برایتان آماده و بارگذاری کنیم.
همچنین با بهترین مدل ساخت ویدیو با هوش مصنوعی آشنا شوید!
ویدیو راهنمای نصب هوش مصنوعی Gemma 4 گوگل روی کامپیوتر شخصی
راست چین کردن نرم افزار LM STUDIO
جهت بهینهسازی رابط کاربری نرمافزار LM Studio و تشخیص خودکار جهت نگارش (RTL برای زبان فارسی و LTR برای زبان انگلیسی)، نیاز به اصلاح ساختار فایلهای اصلی برنامه است. بدین منظور، فایل فشردهای تحت عنوان index.rar در اختیار مخاطبان بیت گرف قرار گرفته است. کاربران میتوانند پس از خارج نمودن این فایل از حالت فشرده، فایل index.html را در دایرکتوری زیر کپی نموده و جایگزین فایل پیشفرض نمایند:
C:\Program Files\LM Studio\resources\app\.webpack\renderer
با اجرای موفقیتآمیز این جایگزینی، خطای مربوط به راستچین و چپچین شدن متون در محیط برنامه مرتفع میگردد. حتما موقع انجام برنامه به حالت بسته باشد.
- دانلود فایل index هوشمند زبان فارسی و انگلیسی
- دانلود فایل index iransans برای اینکه فونت iransans x و iransans در lm studio فعال شود. باید این فونت رو در سیستم شخصی داشته باشید.
- فایل index جدید 20 فروردین - حل مشکل راست چین هوشمند- فونت ایران سنس - ظاهر جدول مدرن
- فایل index روز 3 اردیبهشت - حل مشکل راست چین هوشمند- فونت ایران سنس - ظاهر مدرن جدول - رفع مشکل لایت مد و دارک مد
دانلود فایلهای این مقاله
17 فایل برای دانلود
gemma-4-E2B-it-BF16.gguf
8.7 گیگابایت•18417 دانلودgemma-4-E2B-it-Q4_K_M.gguf
3.2 گیگابایت•15694 دانلودgemma-4-E2B-it-Q8_0.gguf
4.6 گیگابایت•20444 دانلودgemma-4-E4B-it-UD-Q4_K_XL.gguf
4.75 گیگابایت•17730 دانلودفایل ویژن gemma4-e2b-it-mmproj-F16.gguf
940 مگابایت•14990 دانلودgemma-4-26B-A4B-it-UD-Q3_K_M.gguf
11.6 گیگابایت•19765 دانلودنرم افزار اجرا LM-Studio-0.4.9-1-x64.exe
575 مگابایت•17038 دانلودفایل ویژن gemma-4-26B-A4B-it-GGUF-mmproj-F16.gguf
1.2 گیگابایت•14311 دانلودمدل omnicoder-9b-q8_0.gguf (عالی برای کدنویسی)
8.8 گیگابایت•19084 دانلودمدل 31B Gemma 4 👇👇
18.8 گیگابایت•16350 دانلودمدل 31 میلیاردی gemma-4-31B-it-UD-Q4_K_XL
18.8 گیگابایت•13643 دانلودمدل ویژن gemma-4-31B-mmproj-F16.gguf برای 31 میلیاردی
1.2 گیگابایت•18395 دانلودمدل ویژن gemma-4-E4B-it-GGUF-mmproj-F16.gguf
900 مگابایت•15673 دانلودمدل gemma-4-E4B-it-litert-lm
3.2 گیگابایت•20443 دانلودمدل gemma-4-E4B-it-OBLITERATED-Q8_0 پارت ۱
۴ گیگابایت•17715 دانلودمدل gemma-4-E4B-it-OBLITERATED-Q8_0 پارت ۲
۳.۸ گیگابایت•14991 دانلودمدل ویژن gemma-4-E4B-it-OBLITERATED-mmproj-f16
۹۹۰ مگابایت•19769 دانلود
فایلهای پریمیوم نیاز به اشتراک فعال دارند. پس از خرید اشتراک، لینک دانلود فعال میشود.





گفتگو و سوالات شما
۱۲۷در این قسمت میتوانید سوال یا نظر خود در مورد مقاله را مطرح کنید.
برای ثبت دیدگاه ابتدا وارد شوید
ورود به حسابسلام خسته نباشید من مشخصات لپتاپم به این شکل هست: Asus vivobook x1504va Intel core i5-1335u Intel iris xe graphics 16 gb ram 512 ssd من با این مشخصات کدوم مدل رو دانلود کنم؟
سلام مجدد، من با LM Studio نتونستم هیچ کدوم از مدل ها رو لود کنم، مجبور شدم برمشون روی Ollama که به شدت کند بودن حتی نسخه 26b، یک بار مجددا اخرین ورژن 0.4.13 رو حذف و همه فولدرهاشو از ویندوز حذف کردم و با نصب مجدد با کارت گرافیک 6900xt راه اندازی شد و سرعتش نصب به ollama حداقل 10 برابر سریعتر میباشد. ممنون از سایت خوبتون
درود، سپاس از زحمات فراوانتون. نمیدونم مشکل چیه هیچکدوم از لینک های دانلود کار نمیکنه ممنون میشم پیگیری کنید.
سلام اول تشکر از دوستان بیت گراف یکم تجربه انتقال بدم سیستم من i5 7400 - 1070Ti 8G - 32GB Ram من 2 تا مدل gemma-4-26B-A4B-it-UD-Q3_K_M و gemma-4-E4B-it-UD-Q4_K_XL را یک مقایسه ی ریزی کردم اول میزان پارامترهای مدل E4B Q4 مقدار 7.5 میلیارد بود که راحت و کاملا روی کارت گرافیک و سرعت بالا جواب میداد. از هر2 سوال کردم "الان رئیس جمهور آمریکا کی هست که هر 2 گفتن اطلاعاتشون تا ژانویه 2025 هست" نسخه ی 26B گفت ترامپ و نسخه ی 7.5B گفت بایدن!!! - بخش بعدی یک کد 60 خطی پایتون دادم آنالیز کنند و نسخه 7.5B داخل 41 ثانیه آنالیز کرد و آنالیزش هم درست بود اما نسخه 26B مدت 5 دقیقه زمان برد (بخاطر حافظه کم گرافیک از cpu هم استفاده میکرد) و بجای آنالیز کد داشت نقد میکردش و این جما 2 الی 3 اشتباه عجیب داشت! یکیش این هست "غلط تایپی در متد سوکت: نوشته شده sock.settimeout(2.0) که صحیح آن sock.settimeout(2.0) است." خب مهندس جفتش که یکی هست....! درکل داخل همین 1 عدد تست من 7.5B Q4 بهتر بود اما اینکه رئیس جمهور رو اشتباه کرد میتونه بابت کم بودن پارامتر ها باشه... امیدوارم مفید بوده باشه