Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Рейтинг: 37.6% · 5 голосов
Raspberry Pi, Arduino, ESP32, Orange Pi: умный дом, датчики, робототехника, 3D-печать и самодельная электроника.
Ответить
Аватара пользователя
fpga87
Сообщения: 26
Зарегистрирован: 13 май 2026, 16:01

Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение fpga87 »

Видел несколько проектов на ESP32-S3 с голосовым управлением умным домом без Алисы и без Google. Конкретно смотрел на Xiaozhi — там ESP32-S3 как клиент, а STT/LLM/TTS крутятся на сервере. Вопрос: реально ли это запустить полностью локально на домашнем сервере, и какое железо нужно под сервер? У меня есть старый ноутбук с GTX 1060 6GB, хочу понять, потянет ли.
👍 ❤️ 🔥1 😄1 🤔
✔ Лучший ответ сформирован автоматически — tvictor10
@fpga87, По поводу LLM для управления умным домом: большая языковая модель тут не обязательна. Можно использовать маленький классификатор намерений вместо полноценного LLM — latency падает до 300-400 мс. Я написал простой intent classifier на основе TF-IDF + SVM, он понимает около 50 команд для HA и жрёт памяти как кот. Правда расширять сложнее чем просто дописывать промпт к LLM.
Перейти к ответу →
Аватара пользователя
go21
Сообщения: 10
Зарегистрирован: 17 май 2026, 23:11

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение go21 »

На GTX 1060 6GB реально. Я именно на таком железе и запускаю. Стек такой: FunASR для STT (русский язык понимает неплохо, модель paraformer), Qwen2.5-3B через Ollama для LLM (помещается в 6 ГБ VRAM с запасом), EdgeTTS или Silero для TTS. Задержка от слова до ответа около 1.5-2 секунд — терпимо. Главное что всё локально и никаких подписок.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
cohenst1
Сообщения: 92
Зарегистрирован: 11 май 2026, 02:08

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение cohenst1 »

Важное уточнение по русскому языку: Whisper large-v3 понимает русский лучше чем FunASR, но жрёт больше ресурсов. На 1060 6GB Whisper medium работает нормально, large-v3 уже с трудом. Для команд умного дома medium вполне достаточно — «включи свет в кухне», «какая температура в спальне» распознаёт без проблем.
👍1 ❤️ 🔥 😄 🤔2
Аватара пользователя
redishacker
Сообщения: 1
Зарегистрирован: 01 июн 2026, 13:26

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение redishacker »

ESP32-S3-BOX-3 от Espressif — готовая железка под это дело, стоит около 2500 рублей на Алиэкспресс. Там уже есть микрофонная матрица, дисплей и корпус. Прошивается через браузер без программатора. Home Assistant официально поддерживает её как голосовой сателлит — добавляешь в HA и она сразу работает с локальным Wyoming протоколом.
👍1 ❤️ 🔥 😄 🤔1
Аватара пользователя
tx3300
Сообщения: 29
Зарегистрирован: 13 май 2026, 07:30

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение tx3300 »

Собрал сам из ESP32-S3 DevKit + INMP441 микрофон + MAX98357 усилитель + динамик 4Ω/3Вт. Обошлось рублей в 800 с Озона. Прошил через Xiaozhi, подключил к своему серверу с Ollama. Работает, но качество микрофона заметно хуже чем в BOX-3 с матрицей — в шумной комнате плохо слышит. Если делать для кухни, лучше взять готовое или добавить второй микрофон и сделать beamforming.
👍1 ❤️1 🔥 😄 🤔
Аватара пользователя
tvictor10
Сообщения: 21
Зарегистрирован: 12 май 2026, 23:12

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение tvictor10 »

✔ Лучший ответ — сформирован автоматически
@fpga87, По поводу LLM для управления умным домом: большая языковая модель тут не обязательна. Можно использовать маленький классификатор намерений вместо полноценного LLM — latency падает до 300-400 мс. Я написал простой intent classifier на основе TF-IDF + SVM, он понимает около 50 команд для HA и жрёт памяти как кот. Правда расширять сложнее чем просто дописывать промпт к LLM.
👍1 ❤️2 🔥2 😄1 🤔
Аватара пользователя
micropal
Сообщения: 1
Зарегистрирован: 02 июн 2026, 17:24

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение micropal »

MCP интеграция в последних версиях Xiaozhi — это реально мощная штука. Ассистент может не просто выполнять команды, но и отвечать на вопросы типа «когда последний раз открывалась входная дверь» запрашивая данные напрямую из HA через MCP сервер. Поднял за вечер, теперь жена тоже пользуется и не жалуется на «умный дом для гиков».
👍1 ❤️1 🔥 😄1 🤔1
Аватара пользователя
redislover
Сообщения: 29
Зарегистрирован: 12 май 2026, 03:09

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение redislover »

@go21, а Qwen2.5-3B по-русски у тебя реально норм? у меня 3B модели на русских командах стабильно сыпались, падежи путают и json для HA ломают через раз. плюнул, перешел на Vikhr-Nemo 12B на 3060, но это уже другой бюджет. может у тебя промпт жестче или дело в коннекторе, интересно
👍3 ❤️ 🔥 😄 🤔
Аватара пользователя
bun8
Сообщения: 24
Зарегистрирован: 12 май 2026, 13:52

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение bun8 »

@redishacker, 2500 за BOX-3 это где такие цены? на али сейчас 3800-4200 минимум, и то по купонам. за 2500 видел только b-stock без дисплея. так что бюджет сразу умножайте
👍1 ❤️ 🔥 😄1 🤔1
Аватара пользователя
Tcraw62981
Сообщения: 41
Зарегистрирован: 11 май 2026, 21:02

Re: Голосовой ассистент на ESP32-S3 без облака — реально в 2026?

Сообщение Tcraw62981 »

@tvictor10, классификатор хорош ровно до момента, пока дома один ты. у меня семья, и каждый формулирует по-своему, типа включи свет там где кот сидит. в итоге гибрид: сначала intent classifier, если уверенность ниже 0.8, кидаю в LLM. процентов 90 запросов отвечаются за 300 мс, остальное за пару секунд. лучшее из обоих подходов, расширять тоже проще
👍 ❤️ 🔥 😄 🤔
Ответить
Поделиться темой: ✈ Telegram VK

Вернуться в «Одноплатники, IoT и DIY-электроника»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость