Локальный ИИ-стек: работа с закрытыми данными без облака
Три программы держат нейросеть на вашем устройстве: модель в телефоне, расшифровка совещаний и сборка презентаций. Ни один файл не уходит на чужой сервер.
Какую задачу решает
Применять ИИ к служебным и персональным данным, не отправляя их в облако и не завися от зарубежных сервисов
Задача
Руководитель работает с тем, что нельзя выкладывать наружу: персональные данные сотрудников и студентов, служебная переписка, черновики решений. Облачный чат-бот для такой работы не подходит — файл уезжает на чужой сервер, и обосновать это перед юристом невозможно.
При этом задачи чаще всего простые: записать совещание, собрать презентацию, разобрать таблицу. Для них не нужна самая большая модель в мире — нужна модель, которая работает на вашем устройстве.
Из чего состоит стек
Три независимые программы. Ставить можно любую отдельно — они не связаны между собой и решают разные задачи.
| Что | Зачем | Платформа |
|---|---|---|
| Google AI Edge Gallery | модель прямо в телефоне, без интернета | Android |
| Meetily | расшифровка и разбор совещаний | Windows, macOS |
| Presenton | сборка презентаций из текста | Windows, Linux, macOS |
Шаг 1. Модель в телефоне: Google AI Edge Gallery
Приложение от Google, которое запускает языковую модель на самом телефоне. Интернет нужен один раз — чтобы скачать модель. Дальше всё работает в самолётном режиме.
- Скачайте APK со страницы релизов проекта:
github.com/google-ai-edge/gallery.
Универсальный файл называется
ai-edge-gallery.apk. Рядом лежат сборки под конкретные процессоры — они больше по размеру, но быстрее на своём чипе. - Разрешите установку из неизвестного источника — Android спросит об этом сам.
- Внутри приложения выберите модель и дождитесь загрузки. Модели тянутся из открытого репозитория Hugging Face прямо из приложения — отдельно ничего искать не надо.
Основные модели из списка версии 1.0.16 и сколько они занимают на диске:
| Модель | Размер | Для чего |
|---|---|---|
| Gemma-4 E2B | 2,6 ГБ | компромисс для среднего телефона |
| Gemma-4 E4B | 3,7 ГБ | лучшее качество из доступного |
| Gemma-3n E2B / E4B | 3,7 / 4,9 ГБ | предыдущее поколение |
| Gemma3-1B | 0,6 ГБ | самая лёгкая, для слабых устройств |
| Qwen2.5-1.5B | 1,6 ГБ | альтернативная линейка |
Важно про название. В нашем посте годичной давности модель была названа «Gemma-4 4B». В самом приложении она называется иначе — Gemma-4 E4B: буква E означает «эффективные параметры», а не миллиарды весов. Ищите в списке именно E2B и E4B.
Телефону нужен свободный объём памяти минимум вдвое больше размера модели и 6 ГБ оперативной памяти для моделей на 3–5 ГБ. На аппарате слабее берите Gemma3-1B.
Шаг 2. Совещания: Meetily
Программа записывает встречу, расшифровывает её и делает краткое изложение. Расшифровка идёт моделями Whisper или Parakeet прямо на компьютере — часть кода проекта взята из whisper.cpp. Аудио никуда не отправляется.
- Скачайте установщик со страницы
github.com/Zackriya-Solutions/meetily.
Под Windows это
meetily_0.4.0_x64-setup.exe(43 МБ) или пакет.msi(70 МБ), под macOS —.dmgдля процессоров Apple. - При первом запуске выберите модель расшифровки. Whisper многоязычный, русский он поддерживает; язык записи указывается явно при импорте.
- Готовый аудиофайл можно не записывать, а импортировать — программа расшифрует его так же.
Про краткое изложение. Meetily умеет делать сводку встречи, но для этого ему нужна языковая модель. Выберите в настройках Ollama — это локальный движок, который держит модель на том же компьютере. В списке провайдеров есть и внешние сервисы: если выбрать их, расшифровка останется локальной, а текст сводки уйдёт наружу. Для служебных записей это не подходит — оставляйте Ollama.
Шаг 3. Презентации: Presenton
Открытый генератор презентаций: на вход текст или тезисы, на выходе — колода слайдов. Может работать с локальной моделью через Ollama, тогда содержание презентации тоже не покидает компьютер.
Скачивание — со страницы presenton.ai/download.
Ограничение, которое надо знать заранее. Свежие версии проекта (0.9.x, лето 2026 года) собираются только под Linux и macOS. Под Windows на сайте отдаётся сборка 0.8.7-beta от июня 2026 года. Она рабочая, но отстаёт от текущей ветки на несколько версий. Если Windows обязателен, а нужна последняя версия — остаётся запуск в Docker; это уже задача для системного администратора, а не для пользователя.
Где стек честно не справится
- Длинные документы. Модель на телефоне держит небольшой объём текста за раз. Договор на сорок страниц целиком в неё не поместится.
- Сложные рассуждения. Локальная модель на 2–4 ГБ уступает большим облачным моделям. Она хорошо переписывает, суммирует и структурирует; спорную аналитику ей поручать не стоит.
- Первая установка. Скачать несколько гигабайт модели по мобильному интернету — плохая идея. Делайте это по Wi-Fi.
Что проверено в июле 2026 года
- Google AI Edge Gallery — релиз 1.0.16 от 23.06.2026, универсальный APK 25,9 МБ.
- Список моделей приложения сверен с реестром проекта: Gemma-4 E2B и E4B в нём есть, модели с названием «Gemma-4 4B» в нём нет.
- Meetily — релиз 0.4.0 от 05.06.2026, установщики под Windows и macOS на месте.
- Presenton — текущая ветка 0.9.3-beta от 27.07.2026, сборка под Windows 0.8.7-beta.
Проверялось наличие и версии программ. Сами файлы мы не устанавливали на чистую машину — если что-то пойдёт не так на вашем оборудовании, напишите нам, поправим карточку.
