Ollama Gateway

OpenAI 兼容网关 · 由真实文本生成对话测试 (Chat Inference PASS) 验证过滤

💬 真实对话生成验证:通过率 100%
已验证对话存活模型:50 款
测试通过节点:5 台
💬claude-3-opus:latest
245.9 TPS 1 节点通过对话测试 Claude
💬gpt-4:latest
245.9 TPS 1 节点通过对话测试 Claude
💬gpt-4o:latest
245.9 TPS 1 节点通过对话测试 Claude
💬hf.co/INSAIT-Institute/BgGPT-Gemma-3-4B-IT-GGUF:Q4_K_M
245.9 TPS 1 节点通过对话测试 Gemma
💬huihui_ai/gemma-4-abliterated:12b
245.9 TPS 1 节点通过对话测试 Gemma
💬huihui_ai/gpt-oss-abliterated:latest
245.9 TPS 1 节点通过对话测试 Claude
💬ilsp/meltemi-instruct:latest
245.9 TPS 1 节点通过对话测试 模型
💬llama3.2:3b
245.9 TPS 2 节点通过对话测试 Gemma
💬mistral:latest
245.9 TPS 1 节点通过对话测试 Gemma
💬nomic-embed-text-v2-moe:latest
245.9 TPS 1 节点通过对话测试 Embedding
💬nomic-embed-text:latest
245.9 TPS 3 节点通过对话测试 Embedding
💬smollm2:135m
245.9 TPS 1 节点通过对话测试 Gemma
💬tinyllama:latest
245.9 TPS 1 节点通过对话测试 Gemma
💬verif_sys:latest
245.9 TPS 1 节点通过对话测试 模型
💬deepseek-r1:7b
82.0 TPS 1 节点通过对话测试 DeepSeek
💬deepseek-r1:8b
82.0 TPS 1 节点通过对话测试 DeepSeek
💬deepseek-v3.2:cloud
82.0 TPS 1 节点通过对话测试 DeepSeek
💬deepseek-v4-flash:cloud
82.0 TPS 1 节点通过对话测试 DeepSeek
💬deepseek-v4-pro:cloud
82.0 TPS 1 节点通过对话测试 DeepSeek
💬gemini-3-flash-preview:cloud
82.0 TPS 1 节点通过对话测试 Claude
💬gemma3:4b
82.0 TPS 3 节点通过对话测试 Gemma
💬glm-4.6:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬glm-4.7:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬glm-5:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬glm-5.1:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬gpt-oss:20b
82.0 TPS 1 节点通过对话测试 Claude
💬hermes3:8b
82.0 TPS 1 节点通过对话测试 模型
💬hf.co/brunopio/Qwen3.5-14B-A3B-Claude-4.6-Opus-Reasoning-Distilled-reap-Q4_K_M-GGUF:latest
82.0 TPS 1 节点通过对话测试 Qwen
💬hf.co/mradermacher/Hermes-4-14B-BF16-abliterated-GGUF:Q4_K_M
82.0 TPS 1 节点通过对话测试 模型
💬huihui_ai/qwen3-vl-abliterated:4b-instruct
82.0 TPS 1 节点通过对话测试 Qwen
💬huihui_ai/qwen3-vl-abliterated:4b-thinking-q4_K_M
82.0 TPS 1 节点通过对话测试 Qwen
💬kimi-k2-thinking:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬kimi-k2.5:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬kimi-k2.6:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬minimax-m2:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬minimax-m2.1:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬minimax-m2.5:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬minimax-m2.7:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬minimax-m3:cloud
82.0 TPS 1 节点通过对话测试 GLM
💬nemotron-3-super:cloud
82.0 TPS 1 节点通过对话测试 模型
💬phi4-mini:latest
82.0 TPS 1 节点通过对话测试 模型
💬qwen3-coder-next:cloud
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3-next:80b-cloud
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3:14b
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3:4b
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3:8b
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3.5:27b
82.0 TPS 2 节点通过对话测试 Qwen
💬qwen3.5:cloud
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3.5:latest
82.0 TPS 1 节点通过对话测试 Qwen
💬qwen3.6:35b
82.0 TPS 1 节点通过对话测试 Qwen
codellama:7b
0.0 TPS 2 节点通过对话测试 Gemma
deepseek-r1:latest
0.0 TPS 1 节点通过对话测试 DeepSeek
gemma3:latest
0.0 TPS 1 节点通过对话测试 Gemma
glm-4.7-flash:q4_K_M
0.0 TPS 1 节点通过对话测试 GLM
hf.co/reedmayhew/claude-3.7-sonnet-reasoning-gemma3-12B:Q8_0
0.0 TPS 2 节点通过对话测试 Gemma
llama3:8b
0.0 TPS 2 节点通过对话测试 Gemma
llava:latest
0.0 TPS 2 节点通过对话测试 模型
qwen3.6:27b
0.0 TPS 2 节点通过对话测试 Qwen
💡 Cherry Studio / NextChat 配置说明
1. API 接口地址: https://ollama.iiii.us.kg/v1
2. API Key: 填入有效的受信任 API Key (请求头 Authorization: Bearer YOUR_API_KEY)
3. 选择模型: 点击上方模型卡片上的 复制模型名 按钮,贴入客户端即可开始对话!
已复制模型名到剪贴板!