OpenAI
Chat Completions, embeddingi, obrazy, audio i pliki, bez zmian.
/v1/chat/completionsOmniRoute / Powierzchnia API
Chat, embeddingi, reranking, obrazy, wideo, muzyka, mowa, OCR, pliki i batche, w formacie żądań, którego twój klient już używa.
Formaty żądań
Jeden proces przyjmuje kilka formatów, więc narzędzie zbudowane na SDK jednego dostawcy potrzebuje tylko zmiany base URL.
Chat Completions, embeddingi, obrazy, audio i pliki, bez zmian.
/v1/chat/completionsFormat Messages, łącznie z liczeniem tokenów.
/v1/messagesKształt Responses API, z kompakcją wyjścia narzędzi.
/v1/responsesgenerateContent i lista modeli Gemini.
/v1beta/modelsZamiennik dla narzędzi używających lokalnego API Ollama.
/v1/api/chatReranking Cohere/Voyage oraz klasyfikacja i segmentacja Jina.
/v1/rerankEndpointy
Pogrupowane według tego, co chcesz zrobić, a nie według dostawcy, który akurat to obsługuje.
Trzy kształty żądań trafiają do tego samego routera, więc klient zachowuje format, którego już używa.
/v1/chat/completionsOpenAI Chat Completions, strumieniowo lub buforowane/v1/messagesAnthropic Messages/v1/responsesOpenAI Responses/v1/messages/count_tokensPolicz tokeny, zanim je wydaszCzęść retrieval stacku RAG za tym samym endpointem i tym samym kluczem.
/v1/embeddingsEmbeddingi tekstowe i multimodalne/v1/rerankReranking zgodny z Cohere i Voyage/v1/searchAbstrakcja wyszukiwania web między dostawcami/v1/classifyKlasyfikacja tekstu Jina/v1/segmentSegmentacja treści Jina/v1/web/fetchEkstrakcja czytelnej treści stronyGenerowanie przechodzi przez ten sam fallback i rozliczanie kosztów co tekst.
/v1/images/generationsSynteza obrazów/v1/images/editsEdycja i inpainting/v1/videos/generationsGenerowanie wideo/v1/music/generationsSynteza muzykiMowa w obu kierunkach oraz OCR dla zeskanowanych materiałów źródłowych.
/v1/audio/transcriptionsMowa na tekst/v1/audio/translationsTranskrypcja z tłumaczeniem/v1/audio/speechTekst na mowę/v1/ocrOCR dokumentówWgraj raz, a potem wykonuj pracę asynchronicznie zamiast trzymać otwarte połączenie.
/v1/filesWgraj plik/v1/files/{id}/contentStrumieniuj zawartość pliku z powrotem/v1/batchesUtwórz zadanie batch/v1/batches/{id}Sprawdź status batcha/v1/batches/{id}/cancelAnuluj działający batchWszystko, czego klient potrzebuje, by wybrać model i zmieścić się w budżecie.
/v1/modelsKatalog modeli pogrupowany po dostawcach/v1/quotas/checkSprawdź pozostały limit z wyprzedzeniem/v1/moderationsModeracja treści/v1/wsUpgrade do WebSocket dla klientów strumieniowychSerwer MCP z 110 narzędziami i karta agenta A2A, serwowane przez ten sam proces.
/api/mcp/streamMCP przez HTTP, 33 zakresów/api/mcp/sseMCP przez Server-Sent Events/a2aJSON-RPC 2.0, 6 umiejętności agenta/.well-known/agent.jsonPubliczna karta agentaNagłówki
Routing nie jest czarną skrzynką: decyzja, koszt i kompresja, które złożyły się na odpowiedź, wracają razem z nią.
X-OmniRoute-DecisionStrategia, alias dostawcy i opóźnienie, które obsłużyły żądanieX-OmniRoute-ProviderAlias dostawcy, do którego faktycznie trafiło żądanieX-OmniRoute-ModelRozwiązany identyfikator modeluX-OmniRoute-Latency-MsOpóźnienie upstreamu w milisekundachX-OmniRoute-Tokens-InLiczba tokenów wejściowychX-OmniRoute-Tokens-OutLiczba tokenów wyjściowychX-OmniRoute-Response-CostKoszt tej odpowiedzi w USDX-OmniRoute-Cost-SavedUSD zaoszczędzone przy trafieniu w cacheX-OmniRoute-CacheHIT lub MISS dla żądań niestrumieniowychX-OmniRoute-CompressionZastosowany tryb kompresji i jego źródłoX-OmniRoute-Fallback-AttemptsWykonane skoki fallbacku, jeśli byłyX-OmniRoute-Request-IdIdentyfikator korelacji dla logu żądańx-omniroute-compressionNadpisz profil kompresji dla jednego żądaniaX-OmniRoute-No-CachePomiń cache semantycznyx-omniroute-no-memoryPomiń wstrzykiwanie pamięci i umiejętnościX-Session-IdKlucz powinowactwa sesji i przypisania kosztówIdempotency-KeyDeduplikuj powtórzone żądanie