技术笔记

一次 AI 对话,经过了哪些地方?

从浏览器到 Nginx、FastAPI,再到百炼模型,用现有项目拆开一次请求的完整路径。

站长约 477 字预计 2 分钟阅读后聊聊 ↗

浏览器发送问题

聊天网页使用原生 HTML、CSS 与 JavaScript。按下发送后,浏览器向 /api/chat 发送消息和最近的历史记录。接口返回以前,页面显示等待提示。

Nginx 把请求交给后端

Nginx 接收公网请求,再转发给只监听服务器本机的 FastAPI 服务。它负责公网入口,模型密钥则留在后端配置中。

浏览器 → Nginx → FastAPI → 百炼 Qwen
浏览器 ← Nginx ← FastAPI ← 模型回复

模型运行在百炼

服务器不需要运行大模型。FastAPI 使用 OpenAI 兼容协议调用百炼,把系统提示词、最近六轮对话和本轮输入组织成请求。

返回的内容目前一次性显示为纯文本。流式输出、停止生成、Markdown 和历史保存属于后续改进方向。

怎样确认服务状态

在服务器上可以查看服务和健康接口:

systemctl status agent-demo --no-pager --lines=0
curl -fsS http://127.0.0.1:8000/health

健康接口报告应用运行情况和是否配置密钥。它不发送模型请求,因此不能单独证明模型额度或生成回答一定正常。

和 AI 一起读这篇

AI 回答可能有误,请结合原文判断。

A CONVERSATION STARTS HERE

留下一点想法

一起聊聊 AI 与科技

评论支持纯文字,按站主审核设置公开显示。仅勾选“让 AI 小助手回应”才会请求一次 AI 回复;AI 回复会单独标记,不代表站长观点。

正在加载评论…