🌐 Самый простой старт
OpenRouter
Один ключ — сотни моделей разных вендоров. Есть модели с пометкой :free,
которыми можно пользоваться вообще без пополнения. Регистрация по почте.
- Заходишь на openrouter.ai и регистрируешься по email.
- Открываешь раздел Keys (профиль → Keys) и жмёшь Create key.
- Копируешь ключ — он начинается с
sk-or-. Показывается один раз, сохрани.
- При желании пополняешь баланс картой — но для free-моделей это не нужно.
В
/settings/llm выбираешь
🌐 OpenRouter, вставляешь ключ, сохраняешь.
Цена: от 0 ₽ на free-моделях; платные — по прайсу конкретной модели, платишь только за использованное.
⚡ Быстро и бесплатно
Groq
Открытые модели (Llama и другие) на собственном железе Groq — отвечают заметно быстрее
обычных облаков. Бесплатный лимит щедрый: для личного ассистента его обычно хватает.
- Регистрируешься на console.groq.com.
- Идёшь в API Keys → Create API Key.
- Копируешь ключ вида
gsk_....
Цена: бесплатный tier с лимитом запросов в минуту/день; платный — за токены.
💸 Очень дёшево
DeepSeek
Сильные модели за копейки: порядок цен — центы за миллион токенов. Если хочешь качество
уровня «взрослой» модели без месячной подписки — это лучший вариант по деньгам.
- Регистрируешься на platform.deepseek.com.
- Раздел API keys → Create new API key.
- Копируешь ключ
sk-....
- Пополняешь баланс — минимальные суммы, хватает надолго.
Цена: единицы долларов за месяц активного личного использования. Бесплатного tier нет — нужен баланс.
🏠 Бесплатно и приватно
Свой Ollama
Модель крутится на твоём ПК. Ни ключей, ни счетов, ни чужих серверов: тексты запросов
не уходят никуда наружу. Самый приватный вариант — и бесплатный навсегда.
- Скачиваешь и ставишь Ollama с ollama.com (Windows / macOS / Linux).
- В терминале тянешь модель:
ollama pull qwen2.5:7b
Слабее ПК — бери qwen2.5:3b.
- Запускаешь Ollama так, чтобы он слушал не только localhost — переменная окружения
OLLAMA_HOST=0.0.0.0, порт 11434.
- Узнаёшь адрес своего ПК и проверяешь, что
http://IP-твоего-ПК:11434 открывается.
В
/settings/llm выбираешь
🏠 Локально через Ollama и в поле адреса пишешь
http://IP-твоего-ПК:11434.
Цена: 0 ₽. Но честно: нужен ПК с 8+ ГБ RAM или VRAM (для 7B-модели), а адрес
должен быть доступен с сервера, где крутится Persona — то есть белый IP,
проброс порта или туннель. Дома за обычным NAT «просто так» это не заработает.
И когда ПК выключен — ассистент не отвечает.
🇷🇺 Оплата картой РФ
ProxyAPI, AITunnel, VseGPT
Агрегаторы-шлюзы: платишь рублями российской картой, а внутри получаешь доступ
к OpenAI / Claude / Gemini и другим моделям. Удобно, если зарубежной карты нет.
- Регистрируешься на proxyapi.ru
или aitunnel.ru
(ещё вариант — vsegpt.ru).
- Пополняешь баланс рублями.
- В личном кабинете создаёшь API-ключ и копируешь его.
В
/settings/llm есть готовые пункты
🇷🇺 ProxyAPI.ru и
🇷🇺 AITunnel.ru — выбирай тот сервис, где завёл ключ.
Отдельного пункта для VseGPT пока нет.
Цена: по прайсу модели плюс комиссия шлюза (обычно небольшая надбавка к оригинальной цене).
🎁 Бесплатно и без карты
Cerebras и GitHub Models
Два сервиса, где бесплатного лимита реально хватает на личного ассистента.
Cerebras — самый быстрый инференс на рынке, отвечает
почти мгновенно. GitHub Models не требует отдельной
регистрации: ключ — это обычный токен GitHub.
- Cerebras: регистрируешься на cloud.cerebras.ai,
в разделе API Keys создаёшь ключ
csk-....
- GitHub Models: на github.com/marketplace/models
принимаешь условия, а ключ берёшь в Settings → Developer settings → Personal access tokens.
В
/settings/llm выбираешь
⚡ Cerebras или
🐙 GitHub Models и вставляешь ключ.
Цена: 0 ₽ в пределах лимита. Честно про лимит: он есть — и по запросам
в минуту, и по токенам в сутки, и провайдер может его менять. Уткнёшься —
сервис начнёт отвечать ошибкой «rate limit», пока лимит не обновится.
Из РФ оба обычно требуют VPN.
🔧 Любой сервис, даже будущий
Свой OpenAI-совместимый сервис
Почти все сервисы говорят одним и тем же протоколом — тем, что придумала OpenAI.
Поэтому в списке есть универсальный пункт: вписываешь адрес, имя модели
и ключ — и работает что угодно, включая сервисы, которых в нашем списке нет
и которых ещё не существует.
- В доках своего сервиса находишь строку вида
base URL —
обычно это https://api.чего-то.com/v1.
- Там же берёшь точное имя модели: сервисы называют их по-своему.
- Создаёшь API-ключ в кабинете сервиса.
В
/settings/llm выбираешь
🔧 Свой OpenAI-совместимый сервис и заполняешь все три поля.
Хвост
/chat/completions дописывать не нужно — добавим сами.
Цена: та, что у выбранного сервиса. Ограничение честное: адрес должен быть
https (по http ключ уехал бы открытым текстом) — исключение сделано
только для адресов в локальной сети вроде 192.168.*, где своего
сертификата обычно нет. Адреса служебных сетей облака закрыты всегда.
🌍 Напрямую
Anthropic, OpenAI, Google Gemini
Если есть зарубежная карта — можно взять ключ прямо у вендора, без посредников.
В /settings/llm для каждого есть свой пункт.
- console.anthropic.com — ключ
sk-ant-... (Claude).
- platform.openai.com — ключ
sk-... (GPT).
- aistudio.google.com — ключ
AIza... (Gemini, есть бесплатный лимит).
Из РФ доступ к этим API обычно требует VPN — в списке провайдеров они так и подписаны.
Цена: по прайсу вендора, оплата зарубежной картой.
Это безопасно?
Ключ хранится на этом сервере (в зашифрованном виде, если доступен vault) и используется
только для твоих запросов — Persona не шлёт его никуда, кроме выбранного тобой провайдера.
Ключ можно в любой момент заменить или удалить в /settings/llm,
а на стороне провайдера — отозвать. Хочешь, чтобы вообще ничего не покидало твою технику, —
бери Ollama: тогда запросы уходят только на твой же ПК.
Сколько это стоит?
Сама Persona — 0 ₽. Модель может стоить тоже ноль: бесплатные модели OpenRouter
(:free), бесплатный tier Groq или свой Ollama — три полностью бесплатных пути.
Если хочешь модель посильнее — DeepSeek обходится в единицы долларов в месяц при
обычном личном использовании. Платишь провайдеру напрямую, никакой подписки нам.
Какую модель выбрать?
Для повседневного чата с памятью хватает модели среднего размера: на OpenRouter —
любая актуальная бесплатная или недорогая; на Groq — модель семейства Llama;
на своём ПК — qwen2.5:7b (если 8+ ГБ памяти) или qwen2.5:3b
на слабом железе. Нужны длинные рассуждения и сложные задачи — бери DeepSeek или
топовую модель через агрегатор. Начни с бесплатной: переключить провайдера
можно в любой момент, ничего не потеряется.
А без своей модели никак?
Своей модели по умолчанию нет альтернативы — и это осознанно. Persona не перепродаёт
чужие токены и не берёт за них подписку: ты платишь провайдеру напрямую (или не платишь
вообще), а мы не встаём между вами со своей наценкой.
Единственное исключение — друг может одолжить свою модель лично тебе
(/settings/llm/sharing) с обязательным дневным
лимитом. Это его ключ и его деньги, поэтому честно: лимит виден вам двоим, отозвать
доступ он может в любой момент и без предупреждения. Как постоянное решение это плохо —
как «дожить до своего ключа» вполне нормально.
Что-то не работает
Сохрани ключ ещё раз и проверь, что выбран правильный провайдер — Persona показывает
статус подключения прямо в /settings/llm. Частые причины:
не пополнен баланс, исчерпан бесплатный лимит на сегодня, из РФ нужен VPN,
либо (для Ollama) выключен ПК или адрес недоступен снаружи.