
Пост на XDA, который попал на множество главных страниц, обозначил то, что многие пользователи Obsidian тихо тестировали: современный телефон на Android с 8 или 12 ГБ оперативной памяти может запускать трёхмиллиардную модель с читаемой скоростью, полностью офлайн, и в сочетании с Obsidian это превращает хранилище в нечто среднее между дневником и поисковым вторым мозгом. Никаких облачных запросов, никаких счётов за токены, никаких сигналов, необходимых в самолёте или метро.
Мы протестировали 7 приложений для Android, которые делают это сочетание практичным. Каждое из них запускает модель на устройстве, подключается к хранилищу Obsidian на телефоне и остаётся полезным без подключения к сети.
На что обратить внимание
- Вывод на устройстве. Если приложение вызывает API, это не тот инструмент, который мы тестируем.
- Приемлемые модели. Q4-квантизированные 3B или 7B — оптимальный выбор; что-то большее приводит к свопированию.
- Доступ к хранилищу. Прямой доступ к файловой системе хранилища Obsidian лучше, чем копирование-вставка.
- Скорость генерации. Менее 15 токенов в секунду непригодно для чего-либо длиннее предложения.
- Поведение батареи. Генерация за две минуты при 30% нагрузки CPU хороша; за десять минут при 100% — нет.
- Разумные настройки по умолчанию. Шаблоны, поиск с учётом тегов и история чатов, сохраняющаяся после закрытия приложения.
Быстрое сравнение
| Приложение | Для чего лучше | Бесплатный план | Отличительная особенность | Рейтинг |
|---|---|---|---|---|
| Obsidian | Само хранилище на телефоне | Да | То же хранилище на десктопе и мобильном с локальными плагинами | 4,7 звёзд на Aptoide |
| MLC Chat | Самый быстрый вывод на устройстве для чата | Да (с открытым кодом) | Vulkan-ускоренные модели 3B и 7B с разумной скоростью | Только боковая загрузка |
| PocketPal AI | Дружественный запуск LLM для новичков | Да (с открытым кодом) | Загрузка GGUF из Hugging Face прямо в приложении | 4,4 звезды |
| Layla | Чат с локальным RAG над любым файлом | Бесплатный уровень | Запускает маленькую модель над вашими заметками без настроек | 4,3 звезды |
| Ollama in Termux | Полный сервер Ollama на телефоне для опытных пользователей | Да (с открытым кодом) | Тот же API, что на десктопе, поэтому плагины просто работают | Только боковая загрузка |
| Smart Composer (плагин Obsidian) | Доступ к локальной модели из Obsidian на мобильном | Да (с открытым кодом) | Общается с OpenAI-совместимой конечной точкой, включая локальную Ollama | Бесплатный плагин |
| Text Generator (плагин Obsidian) | Шаблонированные подсказки для локальных моделей | Да (с открытым кодом) | Превращает любую заметку в подсказку с переменными | Бесплатный плагин |
7 лучших приложений для Obsidian с локальной LLM на Android
1. Obsidian — лучше всего, потому что всё остальное работает против его хранилища
Obsidian на Android хранит то же хранилище Markdown, что и десктоп, синхронизируется через Obsidian Sync, Syncthing или самостоятельно размещённый Git-удалённый репозиторий, и запускает большинство плагинов, которые не требуют API браузера. Локальные плагины означают, что слой AI остаётся на телефоне даже когда хранилище находится в другом месте.
Где это не срабатывает: Плагины сообщества, которые предполагают окружение рабочего стола, молча не работают. Пользователи iCloud должны полагаться на Obsidian Sync или Working Copy, так как Android не видит iCloud.
Цены:
- Бесплатно: полное приложение с локальными хранилищами
- Платно: Obsidian Sync (опционально) для зашифрованной синхронизации хранилища
Платформы: Android, iOS, Windows, macOS, Linux
Загрузка: obsidian.md — также доступно на Aptoide и Google Play
Итоговый вывод: Выберите Obsidian в первую очередь, потому что каждый AI плагин здесь нацелен на хранилище на телефоне.
2. MLC Chat — лучшая скорость вывода на устройстве
MLC Chat поставляется с моделями, скомпилированными проектом MLC LLM для запуска на GPU телефона через Vulkan. Модель 3B, такая как Phi-3.5-mini, генерирует более 20 токенов в секунду на Snapdragon 8 Gen 3, а 7B Q4 кваантизированная версия полезна на флагманских телефонах. Чаты живут локально, учётная запись не требуется.
Где это не срабатывает: Только боковая загрузка, каталог моделей меньше, чем у PocketPal, и добавление пользовательской модели требует этапа компиляции на десктопе.
Цены:
- Бесплатно: открытый исходный код по Apache 2.0
- Платно: нет
Платформы: Android (боковая загрузка APK)
Загрузка: llm.mlc.ai
Итоговый вывод: Выберите MLC Chat, когда вам нужна самая быстрая локальная генерация на телефоне и вы не возражаете против загруженного APK.
3. PocketPal AI — лучший способ для новичков в локальных LLM
PocketPal AI — это самый дружественный способ начать работу с локальными моделями. Установите приложение, просмотрите проверенный набор GGUF моделей из Hugging Face, коснитесь, чтобы загрузить, и начните чат. Шаблоны охватывают большинство семейств моделей из коробки, поэтому новичок не редактирует chat_template JSON на экране телефона.
Где это не срабатывает: Вывод только CPU через llama.cpp, поэтому скорости ниже, чем у MLC Chat на одном оборудовании. Доступ к хранилищу — копирование-вставка, если вы не объедините это с плагином Obsidian.
Цены:
- Бесплатно: открытый исходный код по MIT
- Платно: нет
Платформы: Android, iOS
Загрузка: Google Play
Итоговый вывод: Выберите PocketPal, если это ваш первый раз запуска модели на телефоне.
4. Layla — лучше всего, когда чат должен видеть ваши заметки
Layla запускает маленькие модели локально и накладывает лёгкий этап поиска с увеличением контекста (RAG) сверху, поэтому подсказка может ссылаться на заметки или PDF, на которые вы указываете. Для пользователя Obsidian это означает, что “суммируй заметки за последнюю неделю” работает без какой-либо работы с плагинами, если хранилище находится в папке, доступной Layla.
Где это не срабатывает: Качество RAG на маленькой модели неровное. Бесплатный уровень ограничивает размер модели; платный уровень его удаляет. Полировка UI отстаёт от PocketPal.
Цены:
- Бесплатный уровень с ограниченными моделями
- Платно: одноразовое обновление открывает большие модели
Платформы: Android, iOS
Загрузка: Google Play
Итоговый вывод: Выберите Layla, если цель — “ответить на вопросы о моих заметках” и вы не хотите строить конвейер самостоятельно.
5. Ollama in Termux — лучшая установка для опытных пользователей, которая отражает десктоп
Установка Ollama внутри Termux дарит телефону тот же HTTP-сервер, который работает на десктопе, на интерфейсе loopback. Любой плагин Obsidian, который говорит с Ollama, затем общается с ним напрямую. Батарея тяжелее, потому что Termux не выходит изящно, но производительность превосходит большинство GUI-запускаторов на том же телефоне.
Где это не срабатывает: Termux из Play Store устарел; загрузите с F-Droid или официального GitHub. Разрешения foreground service требуют внимания, и тепловая дроссель может повредить длительные генерации.
Цены:
- Бесплатно: открытый исходный код
- Платно: нет
Платформы: Android (Termux)
Загрузка: ollama.com с Termux
Итоговый вывод: Выберите это, если вы уже знакомы с Termux и хотите опыт десктопной Ollama на телефоне.
6. Smart Composer — лучший плагин Obsidian для указания на локальную модель
Smart Composer — это плагин сообщества, который превращает чат внутри Obsidian в беседу с любой OpenAI-совместимой конечной точкой, включая локальную Ollama или LM Studio, запущенную на том же телефоне через Termux, или на домашнем сервере через LAN. Подсказки могут ссылаться на заметки, папки и теги с помощью @, поэтому подсказка “переписать этот абзац в тоне заметок за последний месяц” имеет реальный контекст.
Где это не срабатывает: Плагин всё ещё предполагает, что вы можете добраться до сервера, поэтому если телефон автономен и на нём нет работающего локального сервера, он ничего не делает.
Цены:
- Бесплатно: открытый исходный код по MIT
- Платно: нет
Платформы: Android, iOS, Windows, macOS, Linux (внутри Obsidian)
Загрузка: github.com/glowingjade/obsidian-smart-composer
Итоговый вывод: Выберите Smart Composer как мост между Obsidian и моделью, работает ли эта модель на телефоне или на вашем домашнем сервере.
7. Text Generator — лучший плагин для шаблонов подсказок
Text Generator трактует заметки как шаблоны. Оберните переменную, добавьте системное сообщение, и запуск шаблона на любой заметке заполнит заполнители и отправит результат на сконфигурированную модель. Это работает против локальной Ollama, LM Studio или размещённых провайдеров, и библиотека шаблонов на форуме сообщества обширна.
Где это не срабатывает: Синтаксис требует полдня обучения. Отладка неработающего шаблона на мобильном болезненнее, чем на десктопе.
Цены:
- Бесплатно: открытый исходный код по GPLv3
- Платно: нет
Платформы: Android, iOS, Windows, macOS, Linux (внутри Obsidian)
Загрузка: text-gen.com
Итоговый вывод: Выберите Text Generator, если вам нужны переиспользуемые шаблоны подсказок, которые превращают заметку в повторяемое действие AI.
Как выбрать
Если на телефоне ещё нет хранилища, установите Obsidian в первую очередь и синхронизируйте.
Если вам нужна самая быстрая локальная генерация и вы не возражаете против загруженного APK, запустите MLC Chat.
Если это ваш первый раз попытки локальных моделей на телефоне, установите PocketPal AI и выберите модель 3B.
Если чат должен видеть ваши заметки без ручного конвейера, попробуйте Layla с общей папкой хранилища.
Если вы уже живёте в Termux, установите Ollama там и позвольте каждому плагину Obsidian указывать на localhost.
Чтобы внести модель в сам Obsidian, добавьте Smart Composer как поверхность чата.
Для повторяемых шаблонированных подсказок в заметках добавьте Text Generator тоже.
FAQ
Какой самый маленький телефон может запускать полезную модель?
Телефон 8 GB RAM из последних двух поколений флагманов запустит модель 3B с полезной скоростью. Телефон 12 GB RAM открывает 7B Q4 квантизированные версии. Ниже 6 GB ОС постоянно свопирует модель и скорости падают критически.
С какой модели начать?
Phi-3.5-mini и Llama-3.2-3B — хорошие стандартные варианты для телефона. Оба подходят в 3 GB в Q4, генерируют связно и знают достаточно общих знаний, чтобы быть полезными. Переходите на 7B, такой как Qwen2.5-7B или Mistral-7B на флагманском устройстве.
Запуск модели разрушит мою батарею?
Короткие генерации из пары сотен токенов хороши. Длительные запуски агента, RAG конвейеры, которые перекодируют большое хранилище, или непрерывное использование в foreground осушат нормальный телефон за пару часов. Рассматривайте локальную модель как краткосрочного помощника, а не фоновый сервис.
Может ли Obsidian на мобильном вызвать модель, работающую на моём десктопе?
Да. Укажите Smart Composer на локальный IP вашего десктопа и порт Ollama через вашу домашнюю сеть. Добавьте Tailscale или WireGuard, если вы хотите, чтобы то же соединение работало, когда вы находитесь вдали от дома. Телефон остаётся приватным; модель просто где-то в другом месте.