服务对象 服务范围 项目证据 交付方法 服务规则 常见问题
项目证据

展示结果,也展示口径和边界。

不做虚构客户案例,做真实工程证据。以下记录来自现有实测与已完成的搭建;性能会随硬件、模型、量化方式、上下文长度与并发条件变化,未确认的参数不补写。

实测记录

35B 本地大模型私有化部署实测

在真实桌面级 AI 服务器上完成本地部署与调优,验证单人知识库问答场景的可用性。

76.7 tok/s实测结果 · 单流生成速度
256K配置能力 · 上下文窗口上限
121GB测试环境 · Unified Memory
测试目标
验证 35B 参数级别模型在桌面级 AI 服务器上,能否满足单人知识库问答对响应速度的要求,作为后续私有化方案的性能基线。
测试环境
桌面级 AI 服务器;121GB 统一内存(Unified Memory);35B 参数模型。推理框架与量化方式以测试记录为准,本页不补写未确认信息。
测试条件
单流(单用户串行请求)。未做多人并发压测;输入与输出长度、测试次数等参数未在本页列出。
实测结果
76.7 tok/s 单流生成速度。该数字是上述特定配置下的结果,不是通用承诺。
配置能力
256K 上下文为模型与配置支持的上限,说明可加载的上下文规模;不代表 76.7 tok/s 是在 256K 满上下文条件下的实测速度
使用边界
单流结果不代表多人并发表现;不同模型、量化与推理框架性能不同;长上下文下速度可能明显下降;客户环境需基于真实硬件与场景单独测试。
交付记录

内网知识问答系统搭建与移交

基于开源平台搭建文档问答与运维辅助场景,资料与问答流程均留在内网环境。重点不只是“搭出来”,而是“交出去”。

4业务智能体
5独立知识库
12章操作指南
项目目标
让文档问答与运维辅助两类高频问题能在内网被检索、回答并附带出处,减少对个人经验的依赖。
建设内容
4 个面向不同业务问题的智能体;5 个按资料来源与权限划分的独立知识库;覆盖日常操作与维护的 12 章操作指南。
交付物
配置记录、维护方式、工作流说明、培训、已知限制清单、故障处理方法、正式移交。
项目复盘
把工作流节点中的隐性要求整理成可复用清单,交付时同步培训、维护方法与已知限制,让接手的人能独立运行。
交付证据标准

每个项目留下的,不只是一个能跑的系统。

没有真实数据时不补造案例;用过程、记录与边界建立可信度。以下是每个项目默认会留下的证据。

开始前

  • 项目目标
  • 范围与边界
  • 真实测试问题集

实施中

  • 版本与配置记录
  • 变更记录
  • 测试记录
  • 回滚点

完成后

  • 验收记录
  • 操作与维护文档
  • 培训
  • 已知限制
  • 支持方式与期限
← 上一篇:服务范围下一篇:交付方法 →
从一次判断开始

你的实际环境能否达到类似结果,需要基于真实硬件和场景测试。

先提交需求评估,说明现有设备、资料与目标场景,再讨论是否需要一次针对你环境的验证。

进行需求评估