Тот самый инструмент из ролика. Ставится одной командой, подключает твой Claude Code к сотням других провайдеров (поставщиков нейросетей) и сам переключает модель, когда лимит заканчивается. Проект открытый, лицензия MIT, платить за него не нужно.
OmniRoute — локальный шлюз: он поднимается на твоём компьютере и встаёт между Claude Code и моделями. Ничего никуда не отправляет мимо тебя, облака у него нет. Когда упирается лимит Claude, запрос уходит к следующему доступному провайдеру, и работа не обрывается на середине.
Репозиторий: github.com/diegosouzapw/OmniRoute
Открой Терминал и выполни одну команду:
npm install -g omniroute
Если предпочитаешь Docker — вместо этого:
docker run -d --name omniroute --restart unless-stopped \ -p 127.0.0.1:20128:20128 diegosouzapw/omniroute:latest
omniroute
Панель управления откроется по адресу http://localhost:20128.
В панели зайди в раздел Providers и включи те, что бесплатны навсегда. Часть из них работает вообще без ключа: OpenCode Zen и Pollinations. Ещё бесплатны Kilo Code, Z.AI GLM и Baidu ERNIE.
В настройках Claude Code пропиши адрес шлюза и ключ из панели (раздел Endpoints):
Base URL: http://localhost:20128/v1 API Key: ключ из панели Model: auto
Значение auto означает «выбирай модель сам» — шлюз подберёт
доступную и переключит, когда упрётся в лимит.
curl http://localhost:20128/v1/models \ -H "Authorization: Bearer ТВОЙ_КЛЮЧ"
В ответ придёт список подключённых моделей. Пришёл — значит шлюз работает.
Шлюз не завёлся, лимит кончился или учётку Claude заблокировали — три запасных агента, все ставятся в VS Code. Оплата любого из них — валютная операция (ФЗ-173), решение за тобой.
Отдельно не продаётся: есть подписка ChatGPT (Free $0, Plus $20) — есть и Codex. Из России без VPN не работает: страны нет в списке OpenAI, на входе сайт отвечает «доступ запрещён». Если VPN и зарубежная карта уже есть — вариант рабочий. Как поставить: в VS Code → Extensions → набери «Codex» → Install; при первом запуске откроет браузер и попросит войти в аккаунт ChatGPT. Модель и уровень рассуждения переключаются командой /model в чате агента. Чем хуже: у GPT-5.5 контекст (память агента внутри задачи) был вчетверо меньше, чем у Claude (по открытым разборам, август 2026); с 31.08.2026 Codex перевели на семейство GPT-5.6, для неё размер не проверял; на длинных задачах теряет нить; рассуждение держи на максимуме, ниже заметно глупеет.
Работает без VPN. Платить — подпиской в Alibaba Cloud: карта только Visa/Mastercard с международными платежами, российская отваливается на пробном списании $1, виртуальные и предоплаченные не принимают. Бесплатный вход закрыт с 15 апреля 2026, новому аккаунту дают миллион токенов без карты. Как поставить: в VS Code → Extensions → набери «Qwen Code» → Install расширение Qwen Code Companion; при первом запуске попросит вставить ключ (в меню выбирай Standard API Key, не Coding Plan). Ключ: кабинет Alibaba Cloud Model Studio → страница подписки (Management Platform) → Plan-specific API Key, копировать кнопкой рядом, не выделением — иначе скопируются звёздочки. Чем хуже: на 10 % слабее Opus и медленнее, регистрация и ключ спрятаны за десятком экранов.
Сайт и API открываются из России без VPN. Платить — подпиской Z.ai от $18 в месяц (российская карта не проходит) или через сторонний агрегатор моделей, который принимает оплату криптовалютой, — тогда карта не нужна, но это отдельная история с покупкой и переводом крипты, и правовой статус такой оплаты из РФ спорный. Как поставить: в VS Code → Extensions → набери «Cline» → Install; в панели Cline открой настройки → API Configuration → выбери OpenAI (не пункт Z.ai — он ведёт на другой API) → вставь адрес кодинг-API с сайта Z.ai и ключ. Ключ: кабинет z.ai → Billing (оплатить подписку) → раздел API Keys → Create a new API key. Чем хуже: на длинных задачах уступает Opus в полтора-два раза и может зациклиться; в июне 2026 API лежал пару дней. Контекст по данным на апрель 2026 — 200 тысяч токенов, на июнь (GLM-5.2) — миллион.
Этого шлюза в курсе нет — он из моей рабочей кухни: выручает, когда лимит кончается посреди задачи. А в курсе — то, с чего начинается сам вайбкодинг: за первый вечер собираешь первую работающую вещь.