К основному содержанию
НейроКонтур
← Все инструменты
бесплатно1–2 часа на установку

Локальный ИИ-стек: работа с закрытыми данными без облака

Три программы держат нейросеть на вашем устройстве: модель в телефоне, расшифровка совещаний и сборка презентаций. Ни один файл не уходит на чужой сервер.

Какую задачу решает

Применять ИИ к служебным и персональным данным, не отправляя их в облако и не завися от зарубежных сервисов

Задача

Руководитель работает с тем, что нельзя выкладывать наружу: персональные данные сотрудников и студентов, служебная переписка, черновики решений. Облачный чат-бот для такой работы не подходит — файл уезжает на чужой сервер, и обосновать это перед юристом невозможно.

При этом задачи чаще всего простые: записать совещание, собрать презентацию, разобрать таблицу. Для них не нужна самая большая модель в мире — нужна модель, которая работает на вашем устройстве.

Из чего состоит стек

Три независимые программы. Ставить можно любую отдельно — они не связаны между собой и решают разные задачи.

ЧтоЗачемПлатформа
Google AI Edge Galleryмодель прямо в телефоне, без интернетаAndroid
Meetilyрасшифровка и разбор совещанийWindows, macOS
Presentonсборка презентаций из текстаWindows, Linux, macOS

Шаг 1. Модель в телефоне: Google AI Edge Gallery

Приложение от Google, которое запускает языковую модель на самом телефоне. Интернет нужен один раз — чтобы скачать модель. Дальше всё работает в самолётном режиме.

  1. Скачайте APK со страницы релизов проекта: github.com/google-ai-edge/gallery. Универсальный файл называется ai-edge-gallery.apk. Рядом лежат сборки под конкретные процессоры — они больше по размеру, но быстрее на своём чипе.
  2. Разрешите установку из неизвестного источника — Android спросит об этом сам.
  3. Внутри приложения выберите модель и дождитесь загрузки. Модели тянутся из открытого репозитория Hugging Face прямо из приложения — отдельно ничего искать не надо.

Основные модели из списка версии 1.0.16 и сколько они занимают на диске:

МодельРазмерДля чего
Gemma-4 E2B2,6 ГБкомпромисс для среднего телефона
Gemma-4 E4B3,7 ГБлучшее качество из доступного
Gemma-3n E2B / E4B3,7 / 4,9 ГБпредыдущее поколение
Gemma3-1B0,6 ГБсамая лёгкая, для слабых устройств
Qwen2.5-1.5B1,6 ГБальтернативная линейка

Важно про название. В нашем посте годичной давности модель была названа «Gemma-4 4B». В самом приложении она называется иначе — Gemma-4 E4B: буква E означает «эффективные параметры», а не миллиарды весов. Ищите в списке именно E2B и E4B.

Телефону нужен свободный объём памяти минимум вдвое больше размера модели и 6 ГБ оперативной памяти для моделей на 3–5 ГБ. На аппарате слабее берите Gemma3-1B.

Шаг 2. Совещания: Meetily

Программа записывает встречу, расшифровывает её и делает краткое изложение. Расшифровка идёт моделями Whisper или Parakeet прямо на компьютере — часть кода проекта взята из whisper.cpp. Аудио никуда не отправляется.

  1. Скачайте установщик со страницы github.com/Zackriya-Solutions/meetily. Под Windows это meetily_0.4.0_x64-setup.exe (43 МБ) или пакет .msi (70 МБ), под macOS — .dmg для процессоров Apple.
  2. При первом запуске выберите модель расшифровки. Whisper многоязычный, русский он поддерживает; язык записи указывается явно при импорте.
  3. Готовый аудиофайл можно не записывать, а импортировать — программа расшифрует его так же.

Про краткое изложение. Meetily умеет делать сводку встречи, но для этого ему нужна языковая модель. Выберите в настройках Ollama — это локальный движок, который держит модель на том же компьютере. В списке провайдеров есть и внешние сервисы: если выбрать их, расшифровка останется локальной, а текст сводки уйдёт наружу. Для служебных записей это не подходит — оставляйте Ollama.

Шаг 3. Презентации: Presenton

Открытый генератор презентаций: на вход текст или тезисы, на выходе — колода слайдов. Может работать с локальной моделью через Ollama, тогда содержание презентации тоже не покидает компьютер.

Скачивание — со страницы presenton.ai/download.

Ограничение, которое надо знать заранее. Свежие версии проекта (0.9.x, лето 2026 года) собираются только под Linux и macOS. Под Windows на сайте отдаётся сборка 0.8.7-beta от июня 2026 года. Она рабочая, но отстаёт от текущей ветки на несколько версий. Если Windows обязателен, а нужна последняя версия — остаётся запуск в Docker; это уже задача для системного администратора, а не для пользователя.

Где стек честно не справится

  • Длинные документы. Модель на телефоне держит небольшой объём текста за раз. Договор на сорок страниц целиком в неё не поместится.
  • Сложные рассуждения. Локальная модель на 2–4 ГБ уступает большим облачным моделям. Она хорошо переписывает, суммирует и структурирует; спорную аналитику ей поручать не стоит.
  • Первая установка. Скачать несколько гигабайт модели по мобильному интернету — плохая идея. Делайте это по Wi-Fi.

Что проверено в июле 2026 года

  • Google AI Edge Gallery — релиз 1.0.16 от 23.06.2026, универсальный APK 25,9 МБ.
  • Список моделей приложения сверен с реестром проекта: Gemma-4 E2B и E4B в нём есть, модели с названием «Gemma-4 4B» в нём нет.
  • Meetily — релиз 0.4.0 от 05.06.2026, установщики под Windows и macOS на месте.
  • Presenton — текущая ветка 0.9.3-beta от 27.07.2026, сборка под Windows 0.8.7-beta.

Проверялось наличие и версии программ. Сами файлы мы не устанавливали на чистую машину — если что-то пойдёт не так на вашем оборудовании, напишите нам, поправим карточку.