云砺 · 研发中心 半月工作汇报 | 2026-09-01 ~ 09-15 | 汇报:樊国柱 → 吴总 Bi-weekly(9-15)
统一网关做到内网可演示 + 决策包,AutoDev 跑出 15 PR 全 AI 闭环;四项承诺未按期,原因与补救在第 02 节
数据来源:本机 6 类 Agent 会话记录(9-1 ~ 9-15,约 700 个会话文件)、本机 git、AI 网关用量湖仓只读查询、飞书日程 / 纪要 / 文档(只读);与 9-1 会上口径逐条对照。
一句话:两周的主投入是把"集团统一 AI 框架"从口头做成可验证的东西——选型 32 款、POC 7 场景 49 项检查全过、内网部署可演示、9-14 形成高层决策一页纸(自研约 26 人周、3 人 × 12 周、许可 0 元、5 项待拍板)。没做到的:v0.1 没有按 9-12 上线,运维 benchmark 没有新数字,存量作战图和书面三件套没有出,与谷雪梅的首次对齐没有开。本页不美化,数字全部可回溯。
01半月一览六个可核对的数
统一网关 POC · 7 场景 49 项检查
49/49本机
内网测试机 48/49(9-8)→ 现 44/49 (UI 实验锁死 LLM 路径,未处置);10 容器连续 3 天 0 重启
网关决策包(9-14 One Pager)
26人周 · 许可 0 元
3 人 × 12 周到内部试点;选型 agentgateway 8.76 vs LiteLLM 8.28;5 项待高层决策(第 04 节)
AutoDev 实证(研发本体仓,全 AI 闭环)
15PR 合并 · 16 issue 关闭
主干 +74,867 行;单 PR 最多 87 轮评审;暴露 1 起 47 轮失控案例,已加 20 轮硬闸
OntoOS 全量批(0913 批)
11h16m上批 17h29m
代码通道 810 → 441 分钟(−45.6%);发布区首次更新至 0904 批,112 表 3,350 万行;2 处新回归,黄灯
AI 网关用量 · 8 月全月 / 本半月
622.7亿 token
8 月环比 7 月 +22.5%;9-1~14 共 276.9 亿(+20.6% vs 上半月),日均 19.8 亿,28 人在用
工作面
14/14天
本机约 600 次提交、120 余个主会话、14 份在线材料;会议 28 场 25.5 小时:与陈岳阳同场 13、经营会 3(朱伟);与谷雪梅 0
02对 9-1 要求的兑现承诺 → 实物,不合并口径
| 9-1 要求(期限) | 实物 | 状态 |
| 框架 v0.1 上线(9-12)统一网关 + skill/MCP 市场 + 安全权限审计基线 | 砺石 v0.1 设计定稿(9-1,41 单测 / 12 场景演示);AI Gateway 32 → 17 → 6 款选型;POC 内网部署可演示;Skill 中心(讯飞开源 SkillHub)内网部署 9-11;方案文档 10 份;高层决策一页纸 9-14。差在哪:是 mock ERP / mock LLM 上的 POC,真实流量仍走现网无身份治理的代理;生产化估算从 6–8 人周四次上调到 26 人周,不是两周能上线的量 | POC 完成,未上线 |
| 运维 benchmark(9-8)300 例 / 严格正确率 28% → Q3 50% | 本期无新评测。现有题库三代口径 157 → 85 → 109 题,与"300 例"不同源;评测框架 8-31 自审判 REJECT 未修;运维排障基准包根因维度未上线。请示:先统一题库口径,再谈正确率 | 无进展 |
| AutoDev 一阶段上线(本周)开放内部研发使用 | 在研发本体仓自用跑通:issue → worktree → PR → 多轮 AI 评审 → 合并,15 PR / 16 issue;请求日志平台"对话视图"从方案到发布全链路 12 小时(PR → 云端审查 3 条 → 修复 → 发布)。差在哪:没有发"开放内部"通告;CI 因 GitHub 计费停摆全程不可用,以本地全量替代;评审者是 AI 同账号,不是人 | 自用闭环,未开放 |
| 4.0 封装 skill/MCP(9-15 清单 v1)税件 / 开票 / 合规件优先;新项目基于企享云 | 做了前置盘点:销项条线 57 应用 / 63 仓 / 45 生产工作负载;6 路 AI 独立出重构方案,交叉核验推翻草案 10/12 条断言(开票请求表无幂等唯一索引、DB 账号按库不按服务、核心表写入方 4 个而非 3 个)。差在哪:封装清单 v1 未出;企享云未启动 | 仅前置 |
| 人员分层 v1(9-5)/ v2 数据化(9-15) | v1 于 9-1 当晚完成,早于期限:35 人四档,六个数据源(任务表 4,755 条 / 网关用量 67,520 条 / GitLab 6,510 提交等),看板 + 明细 + 组织树三视图。差在哪:48–72 小时实测包未发出,v2 无实测分,档位仍标"待实测" | v1 完成 · v2 未出 |
| 存量 200 家作战图(9-8)"收益 × 问题"四象限 + 退坡曲线 | 未出。做了数据底座:数仓治理登记 4,139 张物理表 / 21.9 TiB / 1,626 亿行,试算出 241 条"交易沉默"线索——但月度宽表停更于 2024-08,不能当 2026 年经营现状用。 | 未出 |
| 书面三件套(9-15)分配机制 / 标准权 / 专注期移交 | 未成文。本次会上口头对齐后一周内成文。 | 未出 |
| 三方框架对齐(9-3)樊 + 陈岳阳 + 谷雪梅,一页架构共识 | 未开。两周内与谷雪梅无共同日程、纪要或共编文档;与陈岳阳同场 13 次(每周进展会 ×3、9-7 通话等),网关需求与研发内部(顾磊 4 条、翟保延 38 条)完成对齐——6 条改口径、2 处冲突、7 处缺口。补救:9-18 前以决策一页纸为底稿开三方对齐会,并把"与雪梅老师月度交流"从实施计划表的 10% 推到有纪要留痕 | 未开 |
| 熵海协同 / 属地试点周跟进(9-10 / 9-15)老代码库验证反馈回收;刘洪 / 顾磊 试点计划 | 飞书与本机均无记录;属地试点未建立周跟进机制。茶姬智能客服与熵海交接中(支持到 9 月底)。 | 未做 |
03主要工作四块,数字均可回溯到会话与仓库
统一 AI 网关 / Agent 框架9-1 ~ 9-14
- 研判企业 AI 基础设施 12 项投入方向(34 来源、118 票对抗验证):7 项重点、3 项有条件、1 项试点观望;5 项"未取证"如实标注
- 选型 32 候选 → 17 深评 → 6 款对标,四款高星产品出局(合计 70,507 star):归档 / 被收购停更 / 功能锁企业版
- POC:agentgateway + Keycloak + 自建策略处理器,验证"一套标准统一注入、MCP server 零感知":参数覆写、审批、三跳令牌换发、审计链;Claude Code 真实 harness 3 工具面 × 8 任务 24/24
- 现状盘点(湖仓证实):内部 AI 流量已集中到一个统一代理,另有 8 个服务直连厂商;用户中心无 PKCE / 换发,需过渡桥
- 真实流量基线:14 天 27.7 万次调用,峰值 25 QPS、均值 0.21 QPS(峰均比约 120 倍),单次报文 837 KB → 托管 2,474 vs 自建 7,881 元/月
- 反信号:工程量估算 6–8 → 26 人周;两路(Claude / Codex)平行出方案,尚未收敛为一份
AutoDev 实证与治理研发本体仓 + 日志平台
- 两周 15 PR 合并 / 16 issue 关闭 / open 降到 5;主干 +74,867 行;评审最多一单 87 轮 / 414 线程,守卫 122 → 509,变异测试 518 例
- 失控案例:一个 PR 跑到 47 轮 / +18,791 行,用真实数据回放证明只改变 1 条产出且早在第 5 次提交已改对 → 拆成 3 个小 PR 两天合入,提示词加 20 轮硬闸(停 push、人拍板)
- 请求日志平台"对话视图":方案 → 实现(22 新测试)→ PR → 云端审查 3 条发现 → 修复 → 合并 → 发布,全程由 AI 完成、人只审核
- 代表性效果:前端抽取单元 10,591 → 24(4 秒 / 207 MB / 零崩溃);配置真值覆盖 1,084 → 1,597 归档
- 反信号:CI 停摆(GitHub 计费)、测试基线长期红、评审者为 AI 同账号——"N 轮全清"不等于人工质量
OntoOS 底座与对外材料研发本体
- 0913 全量批 11h16m(上批 17h29m),代码通道 −45.6%,worker 利用率 48% → 87%;两批假阳均为 0
- 发布区从落后 5 周的 0730 批切到 0904 批:112 表 3,350 万行、2,190 源指针原子切换、3h24m;ODS 表 110 → 114(新增方法 / 依赖注入 / AOP / 前端 import 图),方法节点 1,419 万行
- 售前材料 v1.3:12 维度调研、解决方案介绍(对外 22 节)、16 张场景卡;核验拦下首稿数字膨胀 2–6 倍(149,073"端点"→ 26,567 条路由)
- 架构图:C4 四图(145 项事实核对)、全局 14 集群 / 5,539 工作负载 / 640 条 Feign 关系;销项核心服务 7 图 709 条关系
- 反信号:0913 批 2 处新回归(前端堆上限、分析器超时丢 11 条),须先修再发布;发布区 1,961 个明文凭据、只读角色零授权 —— 开放访问前的安全 P0
数据治理 · 4.0 重构调研 · 用量成本支撑面
- 销项系统重构:9 路 AI 独立出方案(6 路成稿、5 路上线),核心发现"开票主链路幂等键缺失、DB 账号按库共用、分库前置 3–6 个月"——4.0 封装与新项目边界的决策输入
- 数仓治理:4,139 物理表 / 21.9 TiB,psa 贴源占 71%,可清退候选 842 张 590 GB;三路结论互有矛盾且无业务签署,只到证据级
- 茶姬供应链湖仓盘点:762 表 / 23,906 字段,注释覆盖率 7.8% → 88.9%(客户数据资产盘点方法可复用)
- 用量与成本:8 月 622.7 亿 token / 55.9 万次 / 3.99 万美元;本半月 276.9 亿(+20.6%);上游限频 98.9% 来自智谱 1313,规则热加载缓解;累计成本口径校正 3,919 美元
- 反信号:出口代理流量耗尽整机不可用 2 小时无人发现;日志入湖三次静默停摆;通配符证书 9-22 到期;控制台明文挂公网待 HTTPS
AI 网关月度 token(亿)
6 → 7 → 8 月连续增长,9 月上半月按日均折算与 8 月持平。用量是投入与采用深度指标,不是绩效。
来源:121 用量湖仓 usage_hourly_enriched,2026-09-15 09:50 只读查询
04请吴总拍板网关 5 项 + 口径 2 项
- 网关选型与架构:agentgateway 为 AI 策略执行点,Skill 中心复用讯飞开源 SkillHub(网关侧补签名、MCP 与市场清单),存量南北向网关不动;不引入 Higress、Portkey,不采购 Kong 企业版。
- 投入与团队:平台 3 人 × 12 周,数据平台约 4 人周,用户中心与信息安全各 1 名对接人;未来 30 天完成阶段 0(契约冻结、AI IdP 路线、试点集群到位)。同时把《AI 转型实施计划表》里"网关一期部署 9-30 完成"修订为"阶段 0 收口 9-29、内部试点 11 月",避免口径打架。
- 内部落点:生产主集群独立命名空间;网关自身变更借外部 SIT 验证。
- 客户侧口径:云上单开默认托管模式并用我司账号统一计费;属地化按离线包交付。
- 范围口径:Work 工具的模型调用不经网关;订阅套餐型客户端不纳入;企微 / 钉钉按需。
- 运维 benchmark 口径:以现有 109 题真实工单集为基线(或补齐到 300 例后再定基线),正确率目标随之重定;不用不同源的数字互比。
- 安全 P0 排序:本体发布区 1,961 个明文凭据与只读角色授权、POC 管理界面鉴权、通配符证书 9-22 到期——请认可"先治明文、再开放访问"的顺序。
05下半月(9-16 ~ 9-30)按 9-1 未兑现项倒排,件件有验收物
| 期限 | 动作 | 验收物 |
| 9-18 | 三方框架对齐会(樊 + 陈岳阳 + 谷雪梅):以决策一页纸为底稿,定分工与准入草案 | 1 页架构共识备忘;两路方案收敛为一份 |
| 9-19 | 书面三件套成文;人员分层 48–72h 实测包发出 | 三件套文档;实测任务包 35 份 |
| 9-22 | 通配符证书续期;本体发布区明文凭据治理(掩码 + 加密列)与只读角色授权;POC 管理界面加鉴权 | 证书到期日 > 2027;明文计数 1,961 → 0 |
| 9-25 | 运维 benchmark:题库口径定稿 + 全量复跑 + 判分器人工校准,并与 9-10 经营会口径(Q4 智能体承接 case ≥ 50%、总量压到 9,000 以下)对上;AutoDev 20 轮硬闸提示词入库并开放第 2 个仓自用 | 正确率 v2 数字(带题数与口径);AutoDev 使用记录 |
| 9-26 | 存量作战图 v1:与朱伟侧对齐客户收益与投诉数据,"收益 × 问题"四象限 + 首批自动化改造 3–5 家 | 作战图 + 首批名单 + 退坡曲线 |
| 9-29 | 网关阶段 0 收口:八类契约与三类 IR 冻结、统一代理底稿导出、试点集群与 RDS 到位;4.0 封装清单 v1(税件 / 开票 / 合规件) | 阶段 0 检查单;封装清单 v1 |
| 9-30 | 人员分层 v2(含实测分);0913 批两处回归修复后定向复跑并发布 | 数据化名单 v2;绿灯批发布记录 |
06口径说明不宣称清单
- 不宣称"框架 v0.1 已上线":现阶段是 mock 业务上的内网 POC;POC 通过率有三个口径(本机 49/49、内网 9-8 48/49、内网 9-11 44/49),对外一律并列写。
- 不宣称 AutoDev 的"N 轮评审全清"等于人工质量:评审者为 AI 同账号与机器人,CI 停摆期间以本地全量替代。
- 不宣称运维准确率有变化:本期没有评测;题库三代口径(157 / 85 / 109)与"300 例"不同源,先统一再比。
- 不宣称数仓治理与销项重构结论可直接决策:多路 AI 结论互有矛盾、无业务签署、源码取证完成 1/4。
- token 用量是投入与采用深度指标,不是绩效;"日均 21 亿"(9-1 口径)按实测修正为 19.8–20.1 亿。
- 多路赛马(同题 4–9 路)产出重复、无收敛机制,是本期方法上的最大浪费,下半月改为"多路只用于核验,单路定稿"。
- 9-10 月度经营会对研发的三条要求(产研人效与熵海单独对标、Q4 智能体承接 case ≥ 50% 且总量 < 9,000、"化繁为简拿出可售卖的 AI 产品")已纳入第 05 节;《研发中心 AI 进展跟踪》自 8-18 未更新,本页即 0915 版跟踪。
结论:方向上按 9-1 要求走,实物上"网关与 AutoDev"过线、"benchmark / 作战图 / 三件套"欠账;下半月按第 05 节倒排,9-30 前逐项交付。
樊国柱
2026-09-15