請用你的帳號登入
沒有帳號?請聯絡 Krixvon 開通。
| 模型 | 呼叫 | input | output | 字元 |
|---|
對話
圖片(視覺,多模態)
音訊輸入(聽寫/理解)
語音合成(TTS)
OpenAI 相容的對話與語音合成 API。沿用現有的 OpenAI SDK,只要改 base_url 和 api_key。下方範例已帶入你的金鑰。
Base URL:…
認證:每次請求帶 Authorization: Bearer 你的金鑰(OpenAI)或 x-goog-api-key: 你的金鑰(Gemini)。
金鑰見「總覽」分頁;請妥善保管,勿外流。
| model | 類型 | 說明 |
|---|---|---|
gemma-4-12b | 對話 / 多模態 | Gemma 4 12B(圖片 / 音訊 / 影片輸入、工具呼叫、thinking) |
krixvon-tts | 語音合成 | Qwen3-TTS,多語者、多語言 |
對話(Chat)
語音合成(TTS)
本模型為多模態:支援圖片 / 音訊 / 影片輸入、function calling(工具呼叫)、thinking 推理,皆 OpenAI 相容。
圖片輸入(視覺)
⚠️ 圖片建議用 data:image/...;base64, 內嵌(最穩);用網址則需可被伺服器公開抓取,部分網站(如 Wikipedia)會回 403。
音訊輸入(聽寫 / 理解)
支援 wav / flac / mp3,以 base64 放進 input_audio。
工具呼叫 function calling
回應的 choices[0].message.tool_calls 會帶要呼叫的函式與參數;執行後以 role:"tool" 回傳結果繼續對話。
thinking 推理模式
最終答案在 choices[0].message.content;思考過程在 reasoning_content(一般直接讀 content 即可)。
| 端點 | 用途 |
|---|---|
POST /v1/chat/completions | 對話(支援 stream) |
POST /v1/audio/speech | 語音合成(回傳音檔) |
GET /v1/models | 列出可用模型 |
POST /v1beta/models/{model}:generateContent | Gemini 相容(給用 Google GenAI SDK 的人) |