LLM
Запустить языковую модель локально стало просто, а довести её до прода — отдельный квест: здесь разбирают в том числе кейсы, когда всё легло через час после выкатки. Сравнивают vLLM, Ollama, llama.cpp и TGI под self-hosted инференс, прикидывают, тянет ли Mac mini M4 против видеокарты, и обсуждают защиту от prompt injection по OWASP LLM Top 10. Раздел для тех, кто работает с моделями руками, а не только читает анонсы.
28 тем, 225 ответов, 9176 просмотров · все теги
Похожие теги:
vLLM 4DeepSeek 4Пентест 4Карьера 4C++ 3Ollama 3llama.cpp 3GPU 3ai 3Copilot 2open-source 2claude 2собеседования 2новости 2LoRA 2
- Темы
-
- DeepSeek открыл веса R2, лицензия MIT. API дешевле топов почти на порядок. Опять все переезжаем?
в «Новости технологий» · 5 ответов · 56 просмотров · 12 июн 2026, 03:52
-
- DeepSeek R2 вышел: бенчи на уровне топов, цена в 20 раз ниже. Кто уже щупал?
в «Новости технологий» · 7 ответов · 58 просмотров · 11 июн 2026, 20:05
-
- AI-агенты решают CTF задачи сами — конец реверсу как дисциплине?
в «CTF и реверс-инжиниринг» · 9 ответов · 92 просмотров · 10 июн 2026, 16:50
-
- LLM-агенты для пентеста: реально экономят время или генерят мусор?
в «Кибербезопасность и пентест» · 5 ответов · 62 просмотров · 10 июн 2026, 14:49
-
- Пять лет на CatBoost и скоринге, а в вакансиях сплошные RAG и агенты — классический ML всё?
в «Машинное обучение и Data Science» · 4 ответов · 59 просмотров · 10 июн 2026, 10:15
-
- DeepSeek выложила R2: открытые веса уровня западных топов, цены на токены снова летят вниз
в «Новости технологий» · 5 ответов · 63 просмотров · 10 июн 2026, 08:19
-
- Собесы по DS в 2026: спрашивают про агентов и RAG, а работа — CatBoost и SQL. Куда качаться?
в «Машинное обучение и Data Science» · 5 ответов · 70 просмотров · 10 июн 2026, 07:29
-
- LLM в продукте — кто как защищается от prompt injection? OWASP LLM Top 10
в «Кибербезопасность и пентест» · 10 ответов · 744 просмотров · 09 июн 2026, 21:44
-
- Claude 4 vs GPT-5 что реально лучше для кода в 2025
в «Новости технологий» · 9 ответов · 85 просмотров · 09 июн 2026, 21:42
-
- Кейс фейла: выкатили локальную LLM в прод, через час всё легло
в «Локальные LLM и open-source модели» · 22 ответов · 1269 просмотров · 09 июн 2026, 21:25
-
- Стоит ли джуну в 2026 идти в ML или поезд уже ушёл?
в «Машинное обучение и Data Science» · 11 ответов · 632 просмотров · 09 июн 2026, 17:06
-
- QLoRA на одной A100 — реально дообучить Llama 3 70B или это маркетинг?
в «Машинное обучение и Data Science» · 9 ответов · 75 просмотров · 09 июн 2026, 16:53
-
- ИИ-ассеты и нейросети в инди: помощь или костыль, который видно в кадре?
в «Геймдев и разработка игр» · 10 ответов · 706 просмотров · 09 июн 2026, 16:28
-
- DeepSeek выложил веса V4 под MIT: заявляют уровень фронтира при цене API в разы ниже. Кто уже щупал?
в «Новости технологий» · 4 ответов · 49 просмотров · 09 июн 2026, 06:25
-
- Б/у RTX 3090 за 55-60к под локальные нейронки в 2026 — авантюра или лучший вариант?
в «Сборка ПК и комплектующие» · 5 ответов · 67 просмотров · 09 июн 2026, 05:35
-
- Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
в «Новости технологий» · 4 ответов · 50 просмотров · 09 июн 2026, 03:58
-
- Ollama vs llama.cpp vs vLLM - что выбрать в 2026, запутался окончательно
в «Локальные LLM и open-source модели» · 10 ответов · 825 просмотров · 09 июн 2026, 03:47
-
- Джун с опытом в LLM-интеграциях — как правильно себя позиционировать на рынке?
в «Карьера в IT» · 4 ответов · 45 просмотров · 09 июн 2026, 03:16
-
- CVE-2025-53773: prompt injection в Copilot привёл к RCE 9.6. Мы реально открыли ящик Пандоры с RAG
в «Новости технологий» · 9 ответов · 483 просмотров · 08 июн 2026, 23:09
-
- Как тестировать LLM-приложения на prompt injection — методология и инструменты в 2026
в «Кибербезопасность и пентест» · 6 ответов · 74 просмотров · 08 июн 2026, 16:52
-
- Зафайнтюнил Qwen2.5-7B на тикетах саппорта, получил лоботомита. где я облажался
в «Машинное обучение и Data Science» · 6 ответов · 63 просмотров · 08 июн 2026, 15:22
-
- Собесы 2026: половина вопросов про AI и промпты. Кто-нибудь успевает готовиться?
в «Карьера в IT» · 12 ответов · 607 просмотров · 08 июн 2026, 00:46
-
- Mac mini M4 для локальных LLM - реальная альтернатива видеокарте или хайп?
в «Локальные LLM и open-source модели» · 11 ответов · 830 просмотров · 07 июн 2026, 22:07
-
- vLLM vs Ollama vs TGI для self-hosted инференса — что в проде у вас?
в «Машинное обучение и Data Science» · 9 ответов · 875 просмотров · 05 июн 2026, 23:28
-
- AWQ или GPTQ для vLLM в 2026, и причём тут вообще GGUF
в «Локальные LLM и open-source модели» · 8 ответов · 479 просмотров · 04 июн 2026, 19:11
Популярные запросы по теме:
как запустить llama локальнолучшая локальная llm для кодалучший ai ассистент для разработки 2026как писать промпты для генерации кодачто такое postgresql простыми словамибаза данных postgresql для начинающихsql запросы в postgresql для начинающихмиграция на postgresql без даунтайма как перенести базу · все запросы →