已结束已结束企业AI统一网关与聊天门户,预算15万

用户端:

1、类似界面,对话调用大模型,大模型可以手工选择修改

2、历史记录这些基础功能

管理后端:

1、统一的AI网关,做员工的虚拟key分开

2、组织架构team token的分配

3、统计token使用量、超量警告和禁用

要求:必须要做过这些的才可以,没做过不要报名



企业AI统一网关与聊天门户平台 - RFP需求文档

> 项目名称: 企业AI统一网关与聊天门户平台

> 发布日期: 2026年7月28日

> 预计交付周期: 4-6周

> 目标用户规模: 700-800人

> 部署方式: 私有化部署(云服务器)

---

一、项目背景与目标

1.1 背景

公司目前员工约700-800人,各部门对AI工具的需求快速增长,但存在以下问题:

入口分散:员工自行注册各类AI平台,管理混乱

成本不可控:无法按部门/个人核算AI使用成本

数据安全风险:公司数据可能通过个人账号泄露到外部

模型切换困难:接入新模型需要业务系统逐个修改代码

1.2 目标

建设一套企业级AI统一入口平台,实现:

1.统一入口:员工通过公司自有门户访问AI,支持飞书SSO登录

2.模型即插即用:后台切换模型(DeepSeek/Kimi/通义等),员工无感知

3.成本可视化:按部门/人/模型实时看板展示用量和花费

4.权限管控:不同部门可使用的模型和预算上限不同

5.业务系统统一调用:内部系统代码通过统一网关调用AI API

---

二、技术架构要求

2.1 整体架构

员工(浏览器)



Open WebUI(聊天门户,飞书SSO登录)



LiteLLM Proxy(AI网关:路由/预算/权限/审计)



DeepSeek / Kimi / 通义千问(国内模型供应商)

2.2 必选组件

组件 推荐选型 说明

AI网关 **LiteLLM Proxy** 开源MIT协议,支持虚拟Key/预算/路由/fallback

聊天门户 **Open WebUI** 支持OIDC/飞书SSO,RAG文档问答,多模型切换

数据库 **PostgreSQL** 网关和门户共用,存储配置/用量/用户信息

缓存 **Redis** 会话缓存、请求缓冲

看板监控 **Prometheus + Grafana** 实时展示用量、延迟、错误率、成本

反向代理 **Nginx / Caddy** HTTPS、域名路由、安全头



2.3 模型接入要求

必须接入以下国内模型(可扩展):

模型供应商 接入方式 说明

DeepSeek OpenAI兼容API base_url: https://api.deepseek.com/v1

Kimi(月之暗面) OpenAI兼容API base_url: https://api.moonshot.cn/v1

通义千问 OpenAI兼容API base_url: https://dashscope.aliyuncs.com/compatible-mode/v1



模型别名(model alias)机制:

员工和业务系统调用的永远是网关上的逻辑模型名,如 company-chat、company-code

网关配置里维护"逻辑名 → 供应商模型"的映射

换模型时只改网关一处配置,全员客户端零改动

故障切换(fallback):

主模型不可用时,自动按预设链降级到备用模型

例如:company-chat 默认 DeepSeek → 故障时自动切 Kimi → 再故障切通义

---

三、功能需求

3.1 统一入口与登录

[ ] 员工打开公司AI门户网址,看到公司Logo和登录页

[ ] 支持 飞书SSO(OIDC) 扫码登录

[ ] 首次登录自动创建账号,离职员工在飞书侧禁用后自动失去权限

[ ] 可选:支持本地密码登录作为备用(可关闭)

3.2 聊天功能

[ ] 类ChatGPT的对话界面,支持多轮对话

[ ] 顶部下拉框可选择不同模型(如"通用对话"、"代码辅助")

[ ] 支持上传文档进行RAG问答(PDF、Word、TXT)

[ ] 支持历史会话保存和搜索

[ ] 支持会话分享(可选)

3.3 权限与预算管理

[ ] 按部门建team(如 engineering、marketing、hr)

[ ] 每个team绑定允许的模型列表和月预算上限

[ ] 每个员工分配独立的虚拟Key(virtual key)

[ ] 虚拟Key可随时吊销、重新生成

[ ] 预算快超支时发送告警通知

[ ] 预算超支时可选择:告警但不拒绝 / 直接拒绝请求

3.4 用量与成本看板

[ ] Grafana仪表盘展示以下核心指标:

本月总AI花费(按天趋势)

各部门花费排名TOP10

各模型调用量/花费占比

单用户花费TOP20

预算消耗进度条(按部门)

平均延迟、错误率、QPS

[ ] 看板支持按时间范围筛选(今天/本周/本月/自定义)

[ ] 看板支持飞书机器人推送日报/周报(可选)

3.5 审计与安全

[ ] 记录每次调用的完整元数据:谁、哪个Key、哪个模型、多少token、多少钱、耗时

[ ] 支持按 User-Agent 识别流量来源(Claude Code / 门户 / 业务系统)

[ ] 接入 PII 脱敏(可选,开源版用 Presidio):身份证号、手机号、银行卡号自动打码

[ ] 日志保留策略:至少保留90天

3.6 业务系统API调用

[ ] 网关暴露标准 OpenAI 兼容 API(/v1/chat/completions)

[ ] 内部业务系统只需改 base_url 和 api_key 即可接入

[ ] 支持 Claude Code、Cursor、Cline 等开发工具配置指向公司网关

[ ] 提供 API 调用示例文档(Python/Java/cURL)

---

四、非功能需求

4.1 性能

[ ] 支持 800人日常使用,峰值并发 200人同时在线

[ ] 网关延迟开销 < 100ms(不含模型本身响应时间)

[ ] 压力测试:模拟200并发请求,系统不崩溃、不丢请求

4.2 可用性

[ ] 服务可用性目标:99.5%(允许每周约1小时维护窗口)

[ ] 支持滚动重启(更新配置时不中断服务)

[ ] 数据库定期自动备份(每日一次,保留30天)

4.3 安全

[ ] 所有服务通信使用 HTTPS

[ ] 真实模型API Key只存在于网关侧,员工只接触虚拟Key

[ ] 网关Admin UI需要独立强密码

[ ] 版本锁定:LiteLLM必须pin到指定版本号,禁止自动更新最新版

[ ] 密钥管理:LITELLM_MASTER_KEY 和 LITELLM_SALT_KEY 使用强随机值

4.4 部署

[ ] 使用 Docker Compose 部署,单命令启动/停止

[ ] 所有配置通过环境变量和配置文件管理,不硬编码

[ ] 支持内网域名访问(如 https://ai.公司域名.com)

---

五、飞书SSO对接要求

5.1 飞书侧(由甲方IT配合)

[ ] 在飞书开放平台创建企业自建应用

[ ] 开启"网页应用"和"OAuth2.0登录"

[ ] 配置回调地址:https://ai.公司域名.com/oauth/callback

[ ] 提供 App ID 和 App Secret 给乙方

5.2 平台侧(由乙方实现)

[ ] Open WebUI 配置飞书OIDC参数

[ ] 如果飞书原生OIDC对接失败,需提供备选方案(如 Keycloak/Authentik 桥接)

[ ] 首次飞书登录自动创建平台账号

[ ] 支持按飞书部门自动同步用户组(可选)

---

六、交付物清单

乙方必须在项目结束时交付以下内容:

6.1 代码与配置

[ ] 完整的 docker-compose.yml(含所有服务定义、健康检查、网络隔离)

[ ] LiteLLM 配置文件 config.yaml(model alias、fallback链、虚拟Key策略)

[ ] Open WebUI 环境变量配置 .env

[ ] Nginx/Caddy 配置文件

[ ] Grafana Dashboard JSON 文件(四张核心报表)

[ ] 所有代码和配置提交到 GitHub/GitLab 私有仓库,甲方有完整访问权限

6.2 文档

[ ] 《部署手册》:从零到上线的每一步命令和环境准备

[ ] 《运维手册》:日常操作(加人、加Key、换模型、看预算、重启服务、备份恢复)

[ ] 《故障排查手册》:常见错误及解决(服务起不来、Key失效、429限流、数据库连不上)

[ ] 《业务系统接入指南》:如何修改代码调用公司AI网关

[ ] 《开发工具接入指南》:Claude Code/Cursor配置指向公司网关

[ ] 《安全手册》:密钥管理、版本锁定、备份策略、应急响应

6.3 培训

[ ] 2-3次内部培训(面向运维人员和管理员,每次1-2小时)

[ ] 提供培训录屏或文档供后续新人学习

---

七、验收标准

7.1 功能验收(逐项测试)

验收项 测试方法 通过标准

飞书SSO登录 用飞书账号扫码 成功登录,看到聊天界面

模型对话 输入测试问题 各模型正常返回回答

模型切换 在网关改配置换模型 员工端无感知,对话继续正常

Fallback降级 关闭主模型API 自动切换到备用模型

虚拟Key权限 给测试账号限定只能用company-chat 尝试调用company-code被拒绝

预算告警 设置极低预算后连续调用 超预算时收到告警/被拒绝

看板数据 查看Grafana仪表盘 能看到实时用量和花费数据

业务系统调用 用curl测试API 返回正常,记录在网关日志



7.2 性能验收

[ ] 使用压测工具(如k6/locust)模拟200并发,持续5分钟

[ ] 错误率 < 1%

[ ] 平均响应时间 < 3秒(含模型响应)

[ ] 网关自身延迟 < 100ms

7.3 安全验收

[ ] 所有服务通过HTTPS访问

[ ] 虚拟Key无法反推出真实模型API Key

[ ] 员工虚拟Key吊销后立即失效

[ ] 数据库备份可成功恢复

---

八、项目排期

阶段 时间 交付内容

**第一阶段** 第1-2周 网关部署+模型接入,fallback链测试通过

**第二阶段** 第3周 门户部署+飞书SSO对接,员工可扫码登录

**第三阶段** 第4周 看板+预算告警+虚拟Key体系上线

**第四阶段** 第5-6周 业务系统接入文档+压力测试+安全加固+培训



---

九、甲方配合事项

为确保项目顺利进行,甲方(我方)承诺提供以下配合:

[ ] 提供云服务器资源(2台4C8G或1台8C16G,含公网IP)

[ ] 提供域名及HTTPS证书(或授权乙方申请Let's Encrypt)

[ ] 提供飞书开放平台管理员权限,配合创建OIDC应用

[ ] 提供DeepSeek/Kimi/通义千问的API Key(或由乙方指导申请)

[ ] 指定1名内部对接人,协调业务部门需求

[ ] 按合同约定及时支付各阶段款项

---

十、保密与知识产权

[ ] 乙方对在项目过程中接触到的甲方业务数据、API Key、内部系统信息严格保密

[ ] 项目交付的所有代码、配置、文档的知识产权归甲方所有

[ ] 乙方不得将本项目成果用于其他客户或公开演示(经甲方书面同意除外)

已有21人报名
*************
*************
浏览 2809
点赞
24评论
3收藏
10分享

手机扫一扫分享

分享
举报
评论
图片
表情
全部评论
NX3911666前天
有成熟应用案例,上线运行
点赞回复
做过差不多的,熟悉大概逻辑
点赞回复
熟悉中转站,react+node全栈
点赞回复
前天
已有成品支持多租户,知识库,工作流编排,外链,飞书推送,微信无人值守
点赞回复
感觉很简单,可以做。熟悉全栈开发,任何语言,架构都会
点赞回复
青木前天
可以做,专业团队,有案例
点赞回复
Esanwu前天
做过多个ai agent workbench 项目,有外贸多agent,企业智能体中台,ai seo,geo,建站一体化agent. 数学智能体开发,比如intent 识别,围栏兜底,任务持续对话带记忆等,有较大把握交付本项目需求。
点赞回复
阿柴前天
**********
点赞回复
Limit前天
北京团队,可做,专业靠谱
点赞回复
有类似开发经验,全网智能体ai对接接口熟练。
点赞回复
加载更多
推荐
点赞
24评论
3收藏
10分享

手机扫一扫分享

分享
举报