[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"glossary-model-router::ru":3,"gloss-cluster-model-router::ru":26,"gloss-next-model-router::ru":9},{"slug":4,"category":5,"name":6,"definition":7,"meta_desc":8,"faq":9,"schema_markup":9,"related":10},"model-router","core-ai","Маршрутизатор моделей (Model Router)","Маршрутизатор моделей — слой, который решает, какая модель обработает каждый запрос, вместо того чтобы отправлять всё в одну модель. Маршрутизация может быть основана на правилах (короткая классификация идёт к дешёвой модели, длинная задача с кодом — к рассуждающей), на небольшом классификаторе, предсказывающем сложность, или задаваться самим промптом. Цель — достичь заданного качества при наименьшей стоимости и задержке: большинство запросов просты и идут к быстрой дешёвой модели, а сложное меньшинство эскалируется на мощную и дорогую. Для SaaS-разработчиков маршрутизатор — одна из самых высокорычажных оптимизаций затрат: команды регулярно снижают расходы на LLM вдвое и больше незаметно для пользователей, потому что перестают платить цену флагманской модели за тривиальные вызовы. Практические нюансы: нужны оценки, доказывающие, что дешёвая модель действительно достаточно хороша на маршрутизируемом трафике, запасной путь на случай её сбоя и мониторинг, чтобы дрейф в структуре трафика не ухудшил качество втихую. Сегодня это за вас умеют несколько управляемых сервисов маршрутизации и опенсорсных библиотек.","Маршрутизатор моделей решает, какая модель обработает запрос: простое — дешёвой, сложное рассуждение — флагманской, снижая расходы без потери качества.",null,[11,14,17,20,23],{"slug":12,"name":13},"latency","Задержка (Latency)",{"slug":15,"name":16},"llm","Большая языковая модель (LLM)",{"slug":18,"name":19},"reasoning-model","Рассуждающая модель (Reasoning Model)",{"slug":21,"name":22},"small-language-model","Малая языковая модель (SLM)",{"slug":24,"name":25},"test-time-compute","Вычисления во время инференса (Test-Time Compute)",[27,31,35,39,42,45,48,51,54,57,60,63],{"slug":28,"category":5,"name":29,"updated_at":30},"agentic","Агентный AI (Agentic AI)","2026-08-24T02:46:36+00:00",{"slug":32,"category":5,"name":33,"updated_at":34},"alignment-tax","Налог на выравнивание (Alignment Tax)","2026-08-24T02:46:37+00:00",{"slug":36,"category":5,"name":37,"updated_at":38},"artificial-intelligence","Искусственный интеллект (ИИ)","2026-08-24T02:46:38+00:00",{"slug":40,"category":5,"name":41,"updated_at":30},"attention","Внимание (Attention)",{"slug":43,"category":5,"name":44,"updated_at":38},"beam-search","Лучевой поиск",{"slug":46,"category":5,"name":47,"updated_at":34},"benchmark-contamination","Загрязнение бенчмарка (Benchmark Contamination)",{"slug":49,"category":5,"name":50,"updated_at":34},"catastrophic-forgetting","Катастрофическое забывание (Catastrophic Forgetting)",{"slug":52,"category":5,"name":53,"updated_at":38},"computer-vision","Компьютерное зрение",{"slug":55,"category":5,"name":56,"updated_at":34},"constitutional-ai","Конституционный ИИ (Constitutional AI)",{"slug":58,"category":5,"name":59,"updated_at":30},"context-window","Контекстное окно",{"slug":61,"category":5,"name":62,"updated_at":38},"deep-learning","Глубокое обучение",{"slug":64,"category":5,"name":65,"updated_at":30},"diffusion-model","Диффузионная модель (Diffusion Model)"]