OpenAI
Chat Completions, embeddings, รูปภาพ เสียง และไฟล์ โดยไม่ต้องเปลี่ยนอะไร
/v1/chat/completionsOmniRoute / พื้นผิว API
แชท embeddings reranking รูปภาพ วิดีโอ เพลง เสียงพูด OCR ไฟล์ และแบตช์ ในรูปแบบคำขอที่ไคลเอนต์ของคุณใช้อยู่แล้ว
รูปแบบ wire
โปรเซสเดียวรับได้หลายรูปแบบ เครื่องมือที่สร้างบน SDK ของผู้ขายรายหนึ่งจึงต้องเปลี่ยนแค่ base URL เท่านั้น
Chat Completions, embeddings, รูปภาพ เสียง และไฟล์ โดยไม่ต้องเปลี่ยนอะไร
/v1/chat/completionsรูปแบบ Messages รวมถึงการนับโทเค็น
/v1/messagesรูปแบบ Responses API พร้อมการย่อเอาต์พุตเครื่องมือ
/v1/responsesgenerateContent และรายการโมเดลของ Gemini
/v1beta/modelsใช้แทนได้ทันทีสำหรับเครื่องมือที่คุยกับ Ollama API ในเครื่อง
/v1/api/chatreranking แบบ Cohere/Voyage พร้อม classify และ segment ของ Jina
/v1/rerankEndpoints
จัดกลุ่มตามสิ่งที่คุณต้องการทำ ไม่ใช่ตามผู้ให้บริการที่บังเอิญให้บริการ
คำขอสามรูปแบบไปถึง router เดียวกัน ไคลเอนต์จึงใช้ฟอร์แมตเดิมที่คุยอยู่แล้วได้
/v1/chat/completionsOpenAI Chat Completions แบบสตรีมหรือบัฟเฟอร์/v1/messagesAnthropic Messages/v1/responsesOpenAI Responses/v1/messages/count_tokensนับโทเค็นก่อนใช้จ่ายครึ่ง retrieval ของสแต็ก RAG อยู่หลัง endpoint เดียวกันและคีย์เดียวกัน
/v1/embeddingsembeddings แบบข้อความและมัลติโมดัล/v1/rerankreranking ที่เข้ากันได้กับ Cohere และ Voyage/v1/searchการค้นเว็บแบบนามธรรมข้ามผู้ให้บริการ/v1/classifyการจำแนกข้อความของ Jina/v1/segmentการแบ่งส่วนเนื้อหาของ Jina/v1/web/fetchดึงเนื้อหาหน้าเว็บที่อ่านได้การสร้างสื่อผ่าน fallback และการคิดต้นทุนเดียวกับข้อความ
/v1/images/generationsสังเคราะห์รูปภาพ/v1/images/editsแก้ไขและ inpainting/v1/videos/generationsสร้างวิดีโอ/v1/music/generationsสังเคราะห์เพลงแปลงเสียงได้ทั้งสองทาง พร้อม OCR สำหรับต้นฉบับที่สแกนมา
/v1/audio/transcriptionsเสียงเป็นข้อความ/v1/audio/translationsถอดเสียงพร้อมแปล/v1/audio/speechข้อความเป็นเสียง/v1/ocrOCR เอกสารอัปโหลดครั้งเดียว แล้วรันงานแบบอะซิงโครนัสแทนการเปิดการเชื่อมต่อค้างไว้
/v1/filesอัปโหลดไฟล์/v1/files/{id}/contentสตรีมเนื้อหาไฟล์กลับ/v1/batchesสร้างงานแบตช์/v1/batches/{id}ตรวจสถานะแบตช์/v1/batches/{id}/cancelยกเลิกแบตช์ที่กำลังรันทุกสิ่งที่ไคลเอนต์ต้องใช้เพื่อเลือกโมเดลและอยู่ในงบประมาณ
/v1/modelsแคตตาล็อกโมเดลจัดกลุ่มตามผู้ให้บริการ/v1/quotas/checkตรวจโควตาที่เหลือล่วงหน้า/v1/moderationsการกลั่นกรองเนื้อหา/v1/wsอัปเกรด WebSocket สำหรับไคลเอนต์แบบสตรีมเซิร์ฟเวอร์ MCP พร้อมเครื่องมือ 110 รายการ และ agent card ของ A2A ให้บริการจากโปรเซสเดียวกัน
/api/mcp/streamMCP ผ่าน HTTP, 33 ขอบเขต/api/mcp/sseMCP ผ่าน Server-Sent Events/a2aJSON-RPC 2.0, 6 สกิลเอเจนต์/.well-known/agent.jsonagent card สาธารณะHeaders
การกำหนดเส้นทางไม่ใช่กล่องดำ: การตัดสินใจ ต้นทุน และการบีบอัดที่สร้างการตอบกลับนั้นเดินทางกลับมาพร้อมกัน
X-OmniRoute-Decisionกลยุทธ์ นามแฝงผู้ให้บริการ และเวลาแฝงที่ให้บริการคำขอนี้X-OmniRoute-Providerนามแฝงผู้ให้บริการที่กำหนดเส้นทางไปจริงX-OmniRoute-Modelตัวระบุโมเดลที่ถูกเลือกใช้X-OmniRoute-Latency-Msเวลาแฝงต้นทางเป็นมิลลิวินาทีX-OmniRoute-Tokens-Inจำนวนโทเค็นอินพุตX-OmniRoute-Tokens-Outจำนวนโทเค็นเอาต์พุตX-OmniRoute-Response-Costต้นทุนของการตอบกลับนี้เป็น USDX-OmniRoute-Cost-SavedUSD ที่ประหยัดได้เมื่อแคช hitX-OmniRoute-CacheHIT หรือ MISS สำหรับคำขอที่ไม่ใช่สตรีมX-OmniRoute-Compressionโหมดการบีบอัดที่ใช้และที่มาของมันX-OmniRoute-Fallback-Attemptsจำนวน fallback hop ที่เกิดขึ้น หากมีX-OmniRoute-Request-Idรหัสเชื่อมโยงสำหรับบันทึกคำขอx-omniroute-compressionแทนที่โปรไฟล์การบีบอัดสำหรับคำขอเดียวX-OmniRoute-No-Cacheข้ามแคชเชิงความหมายx-omniroute-no-memoryข้ามการแทรกหน่วยความจำและสกิลX-Session-Idคีย์ยึดเซสชันและระบุที่มาของต้นทุนIdempotency-Keyตัดซ้ำคำขอที่ส่งใหม่