diff --git a/deploy/k8s/docker/serve.py b/deploy/k8s/docker/serve.py index f1a1afe..89afb5e 100644 --- a/deploy/k8s/docker/serve.py +++ b/deploy/k8s/docker/serve.py @@ -120,8 +120,57 @@ class Handler(BaseHTTPRequestHandler): self._json(200, {"models": [BACKEND.model], "backend": BACKEND.backend_name}) return + if self.path in ("/", "/index.html"): + self._send_index() + return self._json(404, {"error": "not found", "path": self.path}) + def _send_index(self) -> None: + """根路径欢迎页:列出可用接口,便于浏览器直接访问。""" + try: + h = BACKEND.health() + health_s = json.dumps(h, ensure_ascii=False) + except Exception as exc: # noqa: BLE001 + health_s = json.dumps({"status": "dry-run", + "reason": str(exc)[:80]}, + ensure_ascii=False) + html = f""" + +
+ +iAOP-Core 推理服务({BACKEND.backend_name} 后端 · {BACKEND.model})。 + 当前为 dry-run 占位模式(未接入真实推理硬件/模型服务)。
+GET /health — 健康巡检GET /v1/models — 模型信息POST /v1/chat/completions — OpenAI 兼容推理
+ {"{model, prompt, max_tokens}"}