Заголовок конечно очень похож на классический ИИ SEO слоп, но не спешите закрывать. Анализ вцелом я делал для себя и не претендую на истину в последней инстанции. Просто делюсь вдруг кому окажется полезным.
OpenRouter - самый крупный и известный в мире агрегатор нейросетей. C 26 июля стал пытаться блокировать пользователей из России. Вцелом, с учетом простоты регистрации и возможностью оплаты криптовалютой - это не такая большая проблема. Но только вот пользование сервисом из 3 букв может добавлять определенные задержки к ping-у. А если на агрегатор завязано достаточно много сервисов, то сервис из 3 букв должен работать как часы. Эту проблему можно решить именно так, но откровенно говоря ценность OpenRouter как агрегатора в данном случае сводится практически в нулю, поэтому я решил поискать альтернативу - кто уже озаботился решением этого вопроса, попутно получив и другие полезные плюшки, вроде использования российских моделей если в агентах светит 152 ФЗ (строго для этих запросов) и более простой оплаты без переводов на зарубежную карточку.
Для тех, кому лень читать, краткий итог ниже:

Для баллов использовались следующие критерии с разными скорами в порядке убывания важности:
доступность из рф
возможность оплаты картой рф
работу с юридическими лицами
доступность моделей
embedding модели (включая qwen 3 embedding 8b)
цены
размещение данных в РФ.
доп. фичи вроде guatdrails
отзывы (включая it does matter)
популярность (включая it does matter)
бренд (какая компания делает сервис. Сбербанк, к примеру, заслуживает чуть больше доверия, чем noname)
Наличие OpenAI API
год создания сервиса (чем раньше создан тем лучше - больше доверия)
простота включения (только регистрация на сайте в идеале)
наличие поддержки
присутствие именно последних версий моделей
ping, rps, bandwith если где то заявлено
Сразу оговорюсь, что для моих кейсов использования критично наличие хороших Embedding моделей для русского языка. Мне нужна была замена OpenRouter для MCP серверов в которых используется RAG и соответственно нужны хорошие модели Embedding. Qwen3-Embedding-8b по моим тестам даёт лучший результат. Да и не только по моим. MTEB leaderboard тоже указывает эту модель лидером в своём классе.
Вцелом, по уровню популярности и раскрученности, сейчас пожалуй лидирует router.ai:

Кроме возможностей агрегатора есть так же управление командой позволяет ключи для представителей команды создавать. И контролировать потребление.
С OpenRouter подтянули также возможность выбирать провайдера. Сами провайдеры конечно скрыты, но можно указывать подбирать по скорости, авто или по цене.
Из чего то собственного - доступ к Яндекс моделям, что очень полезно.
Ещё один популярный провайдер - https://polza.ai/

Регистрация уже не такая приятная как у routerai - надо проходить вручную. В агрегаторе есть провайдер, но по факту - только провайдер модели. Фактического провайдера тоже конечно не раскроют. По стоимости +- то же самое что и router.ai.
Из фишек - чуть побольше моделей с Российским инференсом. Есть несколько Qwen-ов и GPT OSS. Ну хоть что то. Предоставляют какую-то "нейростудию" и "хранилище", вряд ли пользующиеся особой популярностью.
Давайте рассмотрим ещё https://caila.io/

Тут у аггрегатора хотя бы не скрыт вендор - небезызвестная Just AI. Возможностей при этом у сервиса вообще не много и каталог моделей скромнее и цена выше. Я бы вряд ли его рекомендовал для использования. Единственное что отличает - есть MLOps платформа - можно развернуть свои модели на хостинге. Но об этом дальше.
https://provod.ai/ - моделей достаточно мало, от перечисленных выше сервисов сильно отстаёт.
Рассмотрим ещё https://aitunnel.ru/

Неплохой провайдер, с хорошей документацией. Единственный из популярных у которого есть хоть какой то Guard для защиты персональных данных. Но стоимость в 5-7 раз выше как минимум. Ещё из уникального - есть отдельное логирование, оплата криптой, собственный кэш. Но стоит ли это x5-x10 от цены выше - есть сомнения.
Вообщем в категории агрегаторов на этом можно пожалуй обзор закончить.
Стоит ещё отдельно рассмотреть три российских AI платформы:
https://aistudio.yandex.ru/ru - Yandex AI Studio. Кроме собсвтенных моделей на инференсе яндекса есть DeepSeek, GPT OSS, Qwen ну и большой каталог открытых моделей можно запустить за большие деньги арендовав инференс.
https://cloud.ru/docs/foundation-models - у СБЕР-а есть как очень дорогой агрегатор, так и часть моделей развернутых у себя. Из приятного можно сказать что заявлено даже GLM 5.1 и Kimi-K2.6. Также есть DeepSeek-V4-Pro. Пожалуй на текущий момент времени это самый полный инференс моделей.
https://mws.ru/services/mws-gpt/ - МТС с VK пока не раскрывают список моделей, в РФ это самый молодой хостинг.
На этом мой краткий обзор закончен. Надеюсь что кому то помог определиться с сервисом.
афывафывафываапривфыавфыа
ToniDoni
Ни у кого кроме yc нет отдельной тарификации кэшированных токенов. Вы серьезно обзор так делаете? Ну камон, пора уже разобраться в матчасти, все-таки уже середина 2026 года на дворе. Без кэшированных токенов вся агентская разработка например мимо.