Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Теги: #GPU#LLM
Рейтинг: 37.6% · 5 голосов
Запуск больших языковых моделей локально: Llama, Mistral, Qwen, DeepSeek, Gemma. Квантизация GGUF, Ollama, llama.cpp, vLLM, LM Studio, выбор GPU и оптимизация инференса.
Аватара пользователя
juniorstack
Сообщения: 62
Зарегистрирован: 12 май 2026, 12:04

Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение juniorstack »

Думаю взять Mac mini M4 Pro с 64 ГБ unified memory вместо сборки с GPU. Привлекает что вся память доступна модели и жрёт мало ватт. Но боюсь по скорости генерации он сольёт нормальной видяхе. Кто на Apple Silicon крутит LLM?
👍 ❤️ 🔥 😄 🤔
✔ Лучший ответ сформирован автоматически — roylrs
На 30к контекста ждёшь секунд 15-30 до начала ответа, против пары секунд на 4090. Если это RAG с постоянными длинными вводами - бесит. Если разовые вопросы - терпимо. MLX вместо llama.cpp немного ускоряет, попробуй обязательно.
Перейти к ответу →
Аватара пользователя
b1llyn0m
Сообщения: 70
Зарегистрирован: 11 май 2026, 07:32

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение b1llyn0m »

У меня M4 Max 64 ГБ. 70B в Q4 влезает и идёт ~8-10 t/s, для чата комфортно. Главный плюс - тихо, холодно, и 48 ГБ под модель там где на ПК нужны две карты и киловаттный БП.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
wasm_enjoyer
Сообщения: 33
Зарегистрирован: 17 май 2026, 14:35

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение wasm_enjoyer »

Ключевое - prompt processing на Маках медленнее чем на nvidia. Короткие промпты норм, но кинешь 20к токенов контекста и ждёшь обработку заметно дольше чем на 4090. Генерация ок, а вот первый токен на длинном вводе печалит.
👍 ❤️1 🔥 😄1 🤔
Аватара пользователя
seabie49
Сообщения: 13
Зарегистрирован: 12 май 2026, 12:08

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение seabie49 »

Вот про prompt processing важный момент, у меня как раз будут длинные контексты с документами. Насколько критично на практике?
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
roylrs
Сообщения: 14
Зарегистрирован: 26 май 2026, 01:29
Репутация: 491

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение roylrs »

✔ Лучший ответ — сформирован автоматически
На 30к контекста ждёшь секунд 15-30 до начала ответа, против пары секунд на 4090. Если это RAG с постоянными длинными вводами - бесит. Если разовые вопросы - терпимо. MLX вместо llama.cpp немного ускоряет, попробуй обязательно.
👍 ❤️ 🔥 😄 🤔
rm -rf /problems
Аватара пользователя
tx3300
Сообщения: 29
Зарегистрирован: 13 май 2026, 07:30

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение tx3300 »

Считай экономику ватт. Mac mini под нагрузкой жрёт 40-60 Вт, сборка с 3090 - 350+. Если инференс крутится сутками, за год разница в электричестве ощутимая, особенно сейчас.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
janito
Сообщения: 5
Зарегистрирован: 11 май 2026, 07:48

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение janito »

Всё так, но за деньги M4 Max 64ГБ можно собрать ПК с двумя 3090 и иметь кратно больше скорости. Mac берут за тишину, компактность и память, а не за максимальный перформанс на доллар.
👍1 ❤️ 🔥1 😄1 🤔
Аватара пользователя
alansmit
Сообщения: 84
Зарегистрирован: 13 май 2026, 00:35

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение alansmit »

Понял расклад: Mac - тихо, экономично, много памяти, но медленный prompt processing. Для моих документов это минус, надо взвесить. Спасибо, гляну ещё MLX перед решением.
👍1 ❤️ 🔥 😄 🤔
Аватара пользователя
svelte88
Сообщения: 63
Зарегистрирован: 12 май 2026, 11:49

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение svelte88 »

народ, вы тут M4 Pro и M4 Max в одну кучу смешали, а разница в два раза. У Pro пропускная память 273 ГБ/с, у Max 546. Инференс упирается ровно в bandwidth, так что цифры про 8-10 t/s на 70B смело делите пополам для Pro. 4-5 t/s это уже на грани терпимого. ОП, если берёшь ради 70B, то только Max, иначе разочаруешься и будешь сидеть на 32B.
👍 ❤️ 🔥1 😄 🤔
Аватара пользователя
guardia
Сообщения: 49
Зарегистрирован: 11 май 2026, 14:59

Re: Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?

Сообщение guardia »

@tx3300, ну такое себе аргумент. 300 Вт разницы при круглосуточной работе это примерно 215 кВтч в месяц, по 6 руб выходит 1300 в месяц, 15-16к в год. При разнице в цене железа тысяч в 150-200 окупаться будет лет десять. Электричество тут последний пункт, мак берут за тишину и память, а не за счётчик.
👍 ❤️ 🔥 😄 🤔1
Ответить
Поделиться темой: ✈ Telegram VK

Вернуться в «Локальные LLM и open-source модели»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость