Попередження «switching to fallback» — це не баг, а штатна поведінка Hermes Agent: коли основний провайдер повертає помилку (rate limit, server error, auth failure), агент автоматично перемикається на резервну модель,... Оскільки механізм fallback у Hermes працює за принципом per turn (щотурну), на кожному новому по...

Create a landscape editorial hero image for this Studio Global article: ⚠️ Rate limited — switching to fallback provider... 🔄 Primary model failed — switching to fallback: sg claude opus 4.7 via custom Sao cứ bị. Article summary: Đây không hẳn là “bug fallback”, mà là model chính của Sếp đang bị rate limit nên Hermes tự nhảy sang fallback sg claude opus 4.7 via custom đúng như thiết kế.[8] Vì fallback của Hermes là per turn, nên mỗi tin nhắn mới . Topic tags: general web, openai, llm, ai, workflow. Reference image context from search candidates: Reference image 1: visual subject "# Fallback Providers. ## Primary Model Fallback. When your main LLM provider encounters errors — rate limits, server overload, auth failures, connection drops — Hermes can automat" source context "Fallback Providers | Hermes Agent - nous research" Reference image 2: visual subject "March 18, 2026 - (rate_limit
Бачите це повідомлення вкотре й думаєте, що щось зламалося? Насправді ваш Hermes Agent працює саме так, як задумано. Давайте розберемося, чому попередження повторюється, і що з цим робити.
Коли основний провайдер (primary) стикається з помилкою — перевищення ліміту запитів (rate limit), перевантаження сервера, проблеми автентифікації або обрив з'єднання — Hermes автоматично перемикається на резервну пару «провайдер:модель» без втрати контексту розмови. Це критично важлива функція для безперебійної роботи, а не ознака несправності.
Резервний ланцюжок налаштовується у файлі config.yaml через параметр fallback_providers. Наприклад:
fallback_providers:
- provider: openrouter
model: anthropic/claude-sonnet-4Hermes також підтримує застарілий ключ fallback_model для зворотної сумісності — якщо у вас налаштовано лише одну резервну модель, він все одно її використовуватиме.
Секрет у тому, що механізм fallback у Hermes працює per-turn — тобто окремо для кожного повідомлення в діалозі. Щоразу, коли ви надсилаєте новий запит, агент спочатку намагається звернутися до основної моделі. Якщо вона все ще повертає помилку — спрацьовує fallback, і з'являється те саме попередження.
Іншими словами: якщо ваш основний провайдер протягом тривалого часу лишається недоступним через rate limit, ви бачитимете це повідомлення на кожному кроці діалогу. Це не означає, що fallback не працює — навпаки, він щоразу рятує вашу сесію.
Позначка via customconfig.yaml і налаштовуються інтерактивно через команду hermes model
Тут криється потенційна проблема: якщо ваш основний провайдер і резервний кастомний ендпоінт (sg-*) фактично використовують один і той самий gateway, один і той самий набір API-ключів або один і той самий пул ресурсів із вичерпаною квотою, то обидва будуть недоступні одночасно. Ви побачите перемикання, але якість відповіді не покращиться, бо резервна модель стикається з тими самими обмеженнями.
Наразі недостатньо даних, щоб із певністю стверджувати, що обидва шляхи ділять спільний пул, але це найімовірніший сценарій, який варто перевірити у вашій конфігурації.
Щоб позбутися набридливого попередження, потрібно усунути першопричину — проблему з основним провайдером. Ось що варто зробити:
Перевірте поточну конфігурацію основних і резервних моделей
Зазирніть у ~/.hermes/config.yaml. Знайдіть, який провайдер і модель вказано як primary, та який ланцюжок прописано у fallback_providers. Зверніть увагу, чи не вказують primary і резервний
sg-* на один і той самий gateway або одну групу ключів.
Пробийте стан gateway
Якщо використовуєте OpenClaw gateway, виконайте:
openclaw gateway probeЦя команда покаже, чи доступний gateway (Reachable: yesmissing scope: operator.read
Визначте справжню помилку
Уважно перечитайте текст помилки. Якщо бачите HTTP 429rate_limit_error, згадку Extra usage is required for long context requests Зокрема, для моделей Anthropic помилка 429 може виникати саме через завеликий контекст запиту, що вимагає додаткових ресурсів.
Переконайтеся, що API-ключі коректно зчитані
Якщо gateway працює під systemd/launchd, ключі варто зберігати у ~/.openclaw/.env, після чого перезапустити демон. Переконайтеся, що ключі фізично присутні на хості, де запущено gateway — помилка «ключ не знайдено» може маскуватися під rate limit.
Перевірте, чи немає застарілих клієнтських процесів
Виконайте openclaw gateway status --deep
Зменшіть обсяг контексту
Якщо помилка стабільно виникає на довгих діалогах, спробуйте скоротити розмір контексту — наприклад, розбити задачу на менші частини або очистити історію розмови. Це особливо актуально, якщо у тексті помилки фігурує «Extra usage is required for long context requests».
Варіанти вирішення залежать від того, що саме спричиняє rate limit:
.env. Попередження «Rate limited — switching to fallback» повторюється кожного туру не тому, що fallback не працює, а тому, що основний провайдер досі недоступний, а Hermes щоразу сумлінно пробує до нього звернутися перед перемиканням. Це коректна, передбачувана поведінка системи.
Щоб позбутися попередження остаточно, потрібно вирішити проблему на боці основного провайдера або переконатися, що резервний шлях використовує дійсно незалежний пул ресурсів.
Хочете, щоб я допоміг перевірити ваш конкретний config.yaml прямо зараз? Я можу проаналізувати, який primary використовується, куди веде резервний sg-*, і чому система постійно повертається до основної моделі щотурну.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Попередження «switching to fallback» — це не баг, а штатна поведінка Hermes Agent: коли основний провайдер повертає помилку (rate limit, server error, auth failure), агент автоматично перемикається на резервну модель,...
Попередження «switching to fallback» — це не баг, а штатна поведінка Hermes Agent: коли основний провайдер повертає помилку (rate limit, server error, auth failure), агент автоматично перемикається на резервну модель,... Оскільки механізм fallback у Hermes працює за принципом per turn (щотурну), на кожному новому повідомленні агент спочатку пробує основну модель, а якщо вона досі недоступна — знову перемикається на резервну, через що...
У випадку з «sg claude opus 4.7 via custom» резервна модель йде через кастомний ендпоінт, налаштований у config.yaml; якщо основний і резервний провайдери використовують один і той самий gateway або пул ключів із виче...