已结束已结束企业AI统一网关与聊天门户,预算15万
用户端:
1、类似界面,对话调用大模型,大模型可以手工选择修改
2、历史记录这些基础功能
管理后端:
1、统一的AI网关,做员工的虚拟key分开
2、组织架构team token的分配
3、统计token使用量、超量警告和禁用
要求:必须要做过这些的才可以,没做过不要报名
企业AI统一网关与聊天门户平台 - RFP需求文档
> 项目名称: 企业AI统一网关与聊天门户平台
> 发布日期: 2026年7月28日
> 预计交付周期: 4-6周
> 目标用户规模: 700-800人
> 部署方式: 私有化部署(云服务器)
---
一、项目背景与目标
1.1 背景
公司目前员工约700-800人,各部门对AI工具的需求快速增长,但存在以下问题:
入口分散:员工自行注册各类AI平台,管理混乱
成本不可控:无法按部门/个人核算AI使用成本
数据安全风险:公司数据可能通过个人账号泄露到外部
模型切换困难:接入新模型需要业务系统逐个修改代码
1.2 目标
建设一套企业级AI统一入口平台,实现:
1.统一入口:员工通过公司自有门户访问AI,支持飞书SSO登录
2.模型即插即用:后台切换模型(DeepSeek/Kimi/通义等),员工无感知
3.成本可视化:按部门/人/模型实时看板展示用量和花费
4.权限管控:不同部门可使用的模型和预算上限不同
5.业务系统统一调用:内部系统代码通过统一网关调用AI API
---
二、技术架构要求
2.1 整体架构
员工(浏览器)
↓
Open WebUI(聊天门户,飞书SSO登录)
↓
LiteLLM Proxy(AI网关:路由/预算/权限/审计)
↓
DeepSeek / Kimi / 通义千问(国内模型供应商)
2.2 必选组件
组件 推荐选型 说明
AI网关 **LiteLLM Proxy** 开源MIT协议,支持虚拟Key/预算/路由/fallback
聊天门户 **Open WebUI** 支持OIDC/飞书SSO,RAG文档问答,多模型切换
数据库 **PostgreSQL** 网关和门户共用,存储配置/用量/用户信息
缓存 **Redis** 会话缓存、请求缓冲
看板监控 **Prometheus + Grafana** 实时展示用量、延迟、错误率、成本
反向代理 **Nginx / Caddy** HTTPS、域名路由、安全头
2.3 模型接入要求
必须接入以下国内模型(可扩展):
模型供应商 接入方式 说明
DeepSeek OpenAI兼容API base_url: https://api.deepseek.com/v1
Kimi(月之暗面) OpenAI兼容API base_url: https://api.moonshot.cn/v1
通义千问 OpenAI兼容API base_url: https://dashscope.aliyuncs.com/compatible-mode/v1
模型别名(model alias)机制:
员工和业务系统调用的永远是网关上的逻辑模型名,如 company-chat、company-code
网关配置里维护"逻辑名 → 供应商模型"的映射
换模型时只改网关一处配置,全员客户端零改动
故障切换(fallback):
主模型不可用时,自动按预设链降级到备用模型
例如:company-chat 默认 DeepSeek → 故障时自动切 Kimi → 再故障切通义
---
三、功能需求
3.1 统一入口与登录
[ ] 员工打开公司AI门户网址,看到公司Logo和登录页
[ ] 支持 飞书SSO(OIDC) 扫码登录
[ ] 首次登录自动创建账号,离职员工在飞书侧禁用后自动失去权限
[ ] 可选:支持本地密码登录作为备用(可关闭)
3.2 聊天功能
[ ] 类ChatGPT的对话界面,支持多轮对话
[ ] 顶部下拉框可选择不同模型(如"通用对话"、"代码辅助")
[ ] 支持上传文档进行RAG问答(PDF、Word、TXT)
[ ] 支持历史会话保存和搜索
[ ] 支持会话分享(可选)
3.3 权限与预算管理
[ ] 按部门建team(如 engineering、marketing、hr)
[ ] 每个team绑定允许的模型列表和月预算上限
[ ] 每个员工分配独立的虚拟Key(virtual key)
[ ] 虚拟Key可随时吊销、重新生成
[ ] 预算快超支时发送告警通知
[ ] 预算超支时可选择:告警但不拒绝 / 直接拒绝请求
3.4 用量与成本看板
[ ] Grafana仪表盘展示以下核心指标:
本月总AI花费(按天趋势)
各部门花费排名TOP10
各模型调用量/花费占比
单用户花费TOP20
预算消耗进度条(按部门)
平均延迟、错误率、QPS
[ ] 看板支持按时间范围筛选(今天/本周/本月/自定义)
[ ] 看板支持飞书机器人推送日报/周报(可选)
3.5 审计与安全
[ ] 记录每次调用的完整元数据:谁、哪个Key、哪个模型、多少token、多少钱、耗时
[ ] 支持按 User-Agent 识别流量来源(Claude Code / 门户 / 业务系统)
[ ] 接入 PII 脱敏(可选,开源版用 Presidio):身份证号、手机号、银行卡号自动打码
[ ] 日志保留策略:至少保留90天
3.6 业务系统API调用
[ ] 网关暴露标准 OpenAI 兼容 API(/v1/chat/completions)
[ ] 内部业务系统只需改 base_url 和 api_key 即可接入
[ ] 支持 Claude Code、Cursor、Cline 等开发工具配置指向公司网关
[ ] 提供 API 调用示例文档(Python/Java/cURL)
---
四、非功能需求
4.1 性能
[ ] 支持 800人日常使用,峰值并发 200人同时在线
[ ] 网关延迟开销 < 100ms(不含模型本身响应时间)
[ ] 压力测试:模拟200并发请求,系统不崩溃、不丢请求
4.2 可用性
[ ] 服务可用性目标:99.5%(允许每周约1小时维护窗口)
[ ] 支持滚动重启(更新配置时不中断服务)
[ ] 数据库定期自动备份(每日一次,保留30天)
4.3 安全
[ ] 所有服务通信使用 HTTPS
[ ] 真实模型API Key只存在于网关侧,员工只接触虚拟Key
[ ] 网关Admin UI需要独立强密码
[ ] 版本锁定:LiteLLM必须pin到指定版本号,禁止自动更新最新版
[ ] 密钥管理:LITELLM_MASTER_KEY 和 LITELLM_SALT_KEY 使用强随机值
4.4 部署
[ ] 使用 Docker Compose 部署,单命令启动/停止
[ ] 所有配置通过环境变量和配置文件管理,不硬编码
[ ] 支持内网域名访问(如 https://ai.公司域名.com)
---
五、飞书SSO对接要求
5.1 飞书侧(由甲方IT配合)
[ ] 在飞书开放平台创建企业自建应用
[ ] 开启"网页应用"和"OAuth2.0登录"
[ ] 配置回调地址:https://ai.公司域名.com/oauth/callback
[ ] 提供 App ID 和 App Secret 给乙方
5.2 平台侧(由乙方实现)
[ ] Open WebUI 配置飞书OIDC参数
[ ] 如果飞书原生OIDC对接失败,需提供备选方案(如 Keycloak/Authentik 桥接)
[ ] 首次飞书登录自动创建平台账号
[ ] 支持按飞书部门自动同步用户组(可选)
---
六、交付物清单
乙方必须在项目结束时交付以下内容:
6.1 代码与配置
[ ] 完整的 docker-compose.yml(含所有服务定义、健康检查、网络隔离)
[ ] LiteLLM 配置文件 config.yaml(model alias、fallback链、虚拟Key策略)
[ ] Open WebUI 环境变量配置 .env
[ ] Nginx/Caddy 配置文件
[ ] Grafana Dashboard JSON 文件(四张核心报表)
[ ] 所有代码和配置提交到 GitHub/GitLab 私有仓库,甲方有完整访问权限
6.2 文档
[ ] 《部署手册》:从零到上线的每一步命令和环境准备
[ ] 《运维手册》:日常操作(加人、加Key、换模型、看预算、重启服务、备份恢复)
[ ] 《故障排查手册》:常见错误及解决(服务起不来、Key失效、429限流、数据库连不上)
[ ] 《业务系统接入指南》:如何修改代码调用公司AI网关
[ ] 《开发工具接入指南》:Claude Code/Cursor配置指向公司网关
[ ] 《安全手册》:密钥管理、版本锁定、备份策略、应急响应
6.3 培训
[ ] 2-3次内部培训(面向运维人员和管理员,每次1-2小时)
[ ] 提供培训录屏或文档供后续新人学习
---
七、验收标准
7.1 功能验收(逐项测试)
验收项 测试方法 通过标准
飞书SSO登录 用飞书账号扫码 成功登录,看到聊天界面
模型对话 输入测试问题 各模型正常返回回答
模型切换 在网关改配置换模型 员工端无感知,对话继续正常
Fallback降级 关闭主模型API 自动切换到备用模型
虚拟Key权限 给测试账号限定只能用company-chat 尝试调用company-code被拒绝
预算告警 设置极低预算后连续调用 超预算时收到告警/被拒绝
看板数据 查看Grafana仪表盘 能看到实时用量和花费数据
业务系统调用 用curl测试API 返回正常,记录在网关日志
7.2 性能验收
[ ] 使用压测工具(如k6/locust)模拟200并发,持续5分钟
[ ] 错误率 < 1%
[ ] 平均响应时间 < 3秒(含模型响应)
[ ] 网关自身延迟 < 100ms
7.3 安全验收
[ ] 所有服务通过HTTPS访问
[ ] 虚拟Key无法反推出真实模型API Key
[ ] 员工虚拟Key吊销后立即失效
[ ] 数据库备份可成功恢复
---
八、项目排期
阶段 时间 交付内容
**第一阶段** 第1-2周 网关部署+模型接入,fallback链测试通过
**第二阶段** 第3周 门户部署+飞书SSO对接,员工可扫码登录
**第三阶段** 第4周 看板+预算告警+虚拟Key体系上线
**第四阶段** 第5-6周 业务系统接入文档+压力测试+安全加固+培训
---
九、甲方配合事项
为确保项目顺利进行,甲方(我方)承诺提供以下配合:
[ ] 提供云服务器资源(2台4C8G或1台8C16G,含公网IP)
[ ] 提供域名及HTTPS证书(或授权乙方申请Let's Encrypt)
[ ] 提供飞书开放平台管理员权限,配合创建OIDC应用
[ ] 提供DeepSeek/Kimi/通义千问的API Key(或由乙方指导申请)
[ ] 指定1名内部对接人,协调业务部门需求
[ ] 按合同约定及时支付各阶段款项
---
十、保密与知识产权
[ ] 乙方对在项目过程中接触到的甲方业务数据、API Key、内部系统信息严格保密
[ ] 项目交付的所有代码、配置、文档的知识产权归甲方所有
[ ] 乙方不得将本项目成果用于其他客户或公开演示(经甲方书面同意除外)
1、类似界面,对话调用大模型,大模型可以手工选择修改
2、历史记录这些基础功能
管理后端:
1、统一的AI网关,做员工的虚拟key分开
2、组织架构team token的分配
3、统计token使用量、超量警告和禁用
要求:必须要做过这些的才可以,没做过不要报名
企业AI统一网关与聊天门户平台 - RFP需求文档
> 项目名称: 企业AI统一网关与聊天门户平台
> 发布日期: 2026年7月28日
> 预计交付周期: 4-6周
> 目标用户规模: 700-800人
> 部署方式: 私有化部署(云服务器)
---
一、项目背景与目标
1.1 背景
公司目前员工约700-800人,各部门对AI工具的需求快速增长,但存在以下问题:
入口分散:员工自行注册各类AI平台,管理混乱
成本不可控:无法按部门/个人核算AI使用成本
数据安全风险:公司数据可能通过个人账号泄露到外部
模型切换困难:接入新模型需要业务系统逐个修改代码
1.2 目标
建设一套企业级AI统一入口平台,实现:
1.统一入口:员工通过公司自有门户访问AI,支持飞书SSO登录
2.模型即插即用:后台切换模型(DeepSeek/Kimi/通义等),员工无感知
3.成本可视化:按部门/人/模型实时看板展示用量和花费
4.权限管控:不同部门可使用的模型和预算上限不同
5.业务系统统一调用:内部系统代码通过统一网关调用AI API
---
二、技术架构要求
2.1 整体架构
员工(浏览器)
↓
Open WebUI(聊天门户,飞书SSO登录)
↓
LiteLLM Proxy(AI网关:路由/预算/权限/审计)
↓
DeepSeek / Kimi / 通义千问(国内模型供应商)
2.2 必选组件
组件 推荐选型 说明
AI网关 **LiteLLM Proxy** 开源MIT协议,支持虚拟Key/预算/路由/fallback
聊天门户 **Open WebUI** 支持OIDC/飞书SSO,RAG文档问答,多模型切换
数据库 **PostgreSQL** 网关和门户共用,存储配置/用量/用户信息
缓存 **Redis** 会话缓存、请求缓冲
看板监控 **Prometheus + Grafana** 实时展示用量、延迟、错误率、成本
反向代理 **Nginx / Caddy** HTTPS、域名路由、安全头
2.3 模型接入要求
必须接入以下国内模型(可扩展):
模型供应商 接入方式 说明
DeepSeek OpenAI兼容API base_url: https://api.deepseek.com/v1
Kimi(月之暗面) OpenAI兼容API base_url: https://api.moonshot.cn/v1
通义千问 OpenAI兼容API base_url: https://dashscope.aliyuncs.com/compatible-mode/v1
模型别名(model alias)机制:
员工和业务系统调用的永远是网关上的逻辑模型名,如 company-chat、company-code
网关配置里维护"逻辑名 → 供应商模型"的映射
换模型时只改网关一处配置,全员客户端零改动
故障切换(fallback):
主模型不可用时,自动按预设链降级到备用模型
例如:company-chat 默认 DeepSeek → 故障时自动切 Kimi → 再故障切通义
---
三、功能需求
3.1 统一入口与登录
[ ] 员工打开公司AI门户网址,看到公司Logo和登录页
[ ] 支持 飞书SSO(OIDC) 扫码登录
[ ] 首次登录自动创建账号,离职员工在飞书侧禁用后自动失去权限
[ ] 可选:支持本地密码登录作为备用(可关闭)
3.2 聊天功能
[ ] 类ChatGPT的对话界面,支持多轮对话
[ ] 顶部下拉框可选择不同模型(如"通用对话"、"代码辅助")
[ ] 支持上传文档进行RAG问答(PDF、Word、TXT)
[ ] 支持历史会话保存和搜索
[ ] 支持会话分享(可选)
3.3 权限与预算管理
[ ] 按部门建team(如 engineering、marketing、hr)
[ ] 每个team绑定允许的模型列表和月预算上限
[ ] 每个员工分配独立的虚拟Key(virtual key)
[ ] 虚拟Key可随时吊销、重新生成
[ ] 预算快超支时发送告警通知
[ ] 预算超支时可选择:告警但不拒绝 / 直接拒绝请求
3.4 用量与成本看板
[ ] Grafana仪表盘展示以下核心指标:
本月总AI花费(按天趋势)
各部门花费排名TOP10
各模型调用量/花费占比
单用户花费TOP20
预算消耗进度条(按部门)
平均延迟、错误率、QPS
[ ] 看板支持按时间范围筛选(今天/本周/本月/自定义)
[ ] 看板支持飞书机器人推送日报/周报(可选)
3.5 审计与安全
[ ] 记录每次调用的完整元数据:谁、哪个Key、哪个模型、多少token、多少钱、耗时
[ ] 支持按 User-Agent 识别流量来源(Claude Code / 门户 / 业务系统)
[ ] 接入 PII 脱敏(可选,开源版用 Presidio):身份证号、手机号、银行卡号自动打码
[ ] 日志保留策略:至少保留90天
3.6 业务系统API调用
[ ] 网关暴露标准 OpenAI 兼容 API(/v1/chat/completions)
[ ] 内部业务系统只需改 base_url 和 api_key 即可接入
[ ] 支持 Claude Code、Cursor、Cline 等开发工具配置指向公司网关
[ ] 提供 API 调用示例文档(Python/Java/cURL)
---
四、非功能需求
4.1 性能
[ ] 支持 800人日常使用,峰值并发 200人同时在线
[ ] 网关延迟开销 < 100ms(不含模型本身响应时间)
[ ] 压力测试:模拟200并发请求,系统不崩溃、不丢请求
4.2 可用性
[ ] 服务可用性目标:99.5%(允许每周约1小时维护窗口)
[ ] 支持滚动重启(更新配置时不中断服务)
[ ] 数据库定期自动备份(每日一次,保留30天)
4.3 安全
[ ] 所有服务通信使用 HTTPS
[ ] 真实模型API Key只存在于网关侧,员工只接触虚拟Key
[ ] 网关Admin UI需要独立强密码
[ ] 版本锁定:LiteLLM必须pin到指定版本号,禁止自动更新最新版
[ ] 密钥管理:LITELLM_MASTER_KEY 和 LITELLM_SALT_KEY 使用强随机值
4.4 部署
[ ] 使用 Docker Compose 部署,单命令启动/停止
[ ] 所有配置通过环境变量和配置文件管理,不硬编码
[ ] 支持内网域名访问(如 https://ai.公司域名.com)
---
五、飞书SSO对接要求
5.1 飞书侧(由甲方IT配合)
[ ] 在飞书开放平台创建企业自建应用
[ ] 开启"网页应用"和"OAuth2.0登录"
[ ] 配置回调地址:https://ai.公司域名.com/oauth/callback
[ ] 提供 App ID 和 App Secret 给乙方
5.2 平台侧(由乙方实现)
[ ] Open WebUI 配置飞书OIDC参数
[ ] 如果飞书原生OIDC对接失败,需提供备选方案(如 Keycloak/Authentik 桥接)
[ ] 首次飞书登录自动创建平台账号
[ ] 支持按飞书部门自动同步用户组(可选)
---
六、交付物清单
乙方必须在项目结束时交付以下内容:
6.1 代码与配置
[ ] 完整的 docker-compose.yml(含所有服务定义、健康检查、网络隔离)
[ ] LiteLLM 配置文件 config.yaml(model alias、fallback链、虚拟Key策略)
[ ] Open WebUI 环境变量配置 .env
[ ] Nginx/Caddy 配置文件
[ ] Grafana Dashboard JSON 文件(四张核心报表)
[ ] 所有代码和配置提交到 GitHub/GitLab 私有仓库,甲方有完整访问权限
6.2 文档
[ ] 《部署手册》:从零到上线的每一步命令和环境准备
[ ] 《运维手册》:日常操作(加人、加Key、换模型、看预算、重启服务、备份恢复)
[ ] 《故障排查手册》:常见错误及解决(服务起不来、Key失效、429限流、数据库连不上)
[ ] 《业务系统接入指南》:如何修改代码调用公司AI网关
[ ] 《开发工具接入指南》:Claude Code/Cursor配置指向公司网关
[ ] 《安全手册》:密钥管理、版本锁定、备份策略、应急响应
6.3 培训
[ ] 2-3次内部培训(面向运维人员和管理员,每次1-2小时)
[ ] 提供培训录屏或文档供后续新人学习
---
七、验收标准
7.1 功能验收(逐项测试)
验收项 测试方法 通过标准
飞书SSO登录 用飞书账号扫码 成功登录,看到聊天界面
模型对话 输入测试问题 各模型正常返回回答
模型切换 在网关改配置换模型 员工端无感知,对话继续正常
Fallback降级 关闭主模型API 自动切换到备用模型
虚拟Key权限 给测试账号限定只能用company-chat 尝试调用company-code被拒绝
预算告警 设置极低预算后连续调用 超预算时收到告警/被拒绝
看板数据 查看Grafana仪表盘 能看到实时用量和花费数据
业务系统调用 用curl测试API 返回正常,记录在网关日志
7.2 性能验收
[ ] 使用压测工具(如k6/locust)模拟200并发,持续5分钟
[ ] 错误率 < 1%
[ ] 平均响应时间 < 3秒(含模型响应)
[ ] 网关自身延迟 < 100ms
7.3 安全验收
[ ] 所有服务通过HTTPS访问
[ ] 虚拟Key无法反推出真实模型API Key
[ ] 员工虚拟Key吊销后立即失效
[ ] 数据库备份可成功恢复
---
八、项目排期
阶段 时间 交付内容
**第一阶段** 第1-2周 网关部署+模型接入,fallback链测试通过
**第二阶段** 第3周 门户部署+飞书SSO对接,员工可扫码登录
**第三阶段** 第4周 看板+预算告警+虚拟Key体系上线
**第四阶段** 第5-6周 业务系统接入文档+压力测试+安全加固+培训
---
九、甲方配合事项
为确保项目顺利进行,甲方(我方)承诺提供以下配合:
[ ] 提供云服务器资源(2台4C8G或1台8C16G,含公网IP)
[ ] 提供域名及HTTPS证书(或授权乙方申请Let's Encrypt)
[ ] 提供飞书开放平台管理员权限,配合创建OIDC应用
[ ] 提供DeepSeek/Kimi/通义千问的API Key(或由乙方指导申请)
[ ] 指定1名内部对接人,协调业务部门需求
[ ] 按合同约定及时支付各阶段款项
---
十、保密与知识产权
[ ] 乙方对在项目过程中接触到的甲方业务数据、API Key、内部系统信息严格保密
[ ] 项目交付的所有代码、配置、文档的知识产权归甲方所有
[ ] 乙方不得将本项目成果用于其他客户或公开演示(经甲方书面同意除外)
*************
*************
评论
