🤖 LLM API 代理服务

检测中... · 请求队列模式 · 轮询间隔 3 秒

📦 可用模型

llama3.2:3b可用
qwen2.5:3b可用

🔌 API 接口

对话补全:POST /v1/chat/completions
模型列表:GET /v1/models
Base URL:http://43.166.240.93:3030/llm-api
⚡ 基于 Ollama 兼容 OpenAI API 格式。
⏱️ 请求-响应队列模式,通常 5-10 秒延迟。
🔒 建议在生产环境添加 API Key 认证。

📖 调用示例

curl -X POST http://43.166.240.93:3030/llm-api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama3.2:3b",
    "messages": [
      {"role": "user", "content": "你好"}
    ],
    "max_tokens": 1024
  }'

🧪 在线测试

📊 服务状态

加载中...