五月中旬的评审会安排在十一楼的大会议室。林晨到的时候,屏幕已经亮了,智研的Demo界面停在首页——一个白色底色的简洁页面,中间是文本输入框,右侧是文件上传区域。
人陆续进来。陈博士坐了主位,面前一杯白水,没碰。孙总在对面落座,他今天穿了件深蓝的polo衫,进来的时候只跟陈博士点了个头,没跟其他人打招呼。刘姐带着产品部的两个人坐在侧边,电脑已经打开,估计在记会议纪要。陈铭靠墙坐,手机扣在桌上。张雨坐在最靠门的位置,手边一台笔记本跑着后台监控——推理日志、GPU占用率、响应延迟,全部实时盯着。
九点整,陈博士看了一眼全场:开始吧。
林晨站起来走到屏幕旁边。他没打开PPT,直接切到了Demo界面。
今天不做录屏演示——直接用智研1.0跑真实案例。在座各位谁有最近的研报,现场丢给模型跑。
会议室安静了两秒。这种演示方式风险很大——提前录好的视频可以剪辑、可以重来,现场跑意味着模型可能输出不准确、甚至出错。林晨扫了一圈在场的人,看到刘姐微微皱了皱眉——产品部的人天然偏好可控的演示流程。
孙总从包里抽出一个平板,翻了几下。国泰证券上周发的《2025年二季度A股策略报告》。四十七页。你确定在这个会上跑这份?
全篇粘贴进去。林晨说。
孙总把平板递给旁边的助理,助理把PDF导出成文本,四十七页的内容全部复制粘贴进了智研的输入框。文字滚了大概十秒钟才停住,密密麻麻挤满了输入区域。
林晨点了提交。
后台的推理日志开始在张雨的屏幕上刷。token消耗数、attention分布、推理层数——一行一行快速滚动。张雨的手放在键盘上,没打字,眼睛跟着日志走。前五秒一切正常,GPU利用率拉到了百分之七十八,推理延迟在预期范围内。
第六秒,延迟突然跳了一下——从正常的0.3秒涨到了1.2秒。
张雨的眉头压下去。他飞快地扫了一眼GPU监控——显存占用率正常,没有OOM。那延迟跳升只有一个可能:模型遇到了一个特别长的注意力跨度计算节点。四十七页的研报里有大量交叉引用——如图3所示详见第38页附表——这些跨页面的引用会让注意力机制在全文范围内做高开销的检索。
他抬头看了一眼大屏幕。界面上显示着正在分析中的等待动画,三个灰色的圆点在缓缓跳动。会议室里没人说话。孙总靠在椅背上,目光从屏幕移到林晨脸上,又移回去。
林晨站在屏幕旁边,手插在裤兜里。他的目光没有看屏幕——在看张雨。张雨的眉头松了一点,对他做了个手势——右手食指画了个小圈,然后竖起来。正在处理,没问题的意思。林晨微微点了一下头,表情没什么变化。
二十八秒后,大屏幕上的等待动画消失了。输出开始逐段渲染。
第一部分——核心结论摘要。七句话。总量观点、配置建议、核心风险提示,一个不缺。林晨快速扫了一眼,内容跟他印象中那份研报的核心结论吻合。
第二部分——关键数据表格。自动提取的结构化表格,GDP预测值、CPI中枢、企业盈利增速预测、主要行业配置建议及权重。每个数字后面跟着原文出处的页码标注。
林晨的目光扫到表格第四行——企业盈利增速预测那一栏。模型输出的数字是8.5%,页码标注p.23。他心里紧了一下。他不记得原文中这个数据是不是8.5%。如果这个数字错了,整个演示的公信力会打折扣。
他没有去看张雨,也没有去看陈博士。他保持姿势不动,等孙总先开口。
孙总盯着表格看了大概二十秒。然后他拿起平板,翻到第二十三页,手指在页面上划了几下。
8.5%,对。孙总把平板放下来,页码也对。
林晨的肩膀松了半寸。他自己都没注意到刚才绷着。
第三部分输出——全文逻辑链条图。一棵树状图从宏观经济判断到行业选择到个股筛选,每个节点标注了支撑该判断的论据和原文数据来源。图形在屏幕上渲染的时候有一瞬间的卡顿——大概一秒半——然后完整展开了。
刘姐把笔记本转过来给旁边的人看了一眼,低声说了句什么,没听清。
孙总没急着说话。他从助理手里拿回平板,自己翻了三分钟,把模型输出的三部分内容跟原文逐项对照。最后他抬头看向林晨。
这个表格里的数字——每一个都能在原文里找到?
每一个都有溯源日志——点任意一个数字会跳转到原文对应段落。
自动提取的准确率呢?
关键数字提取准确率目前是92.1%。林晨停了一下,剩下7.9%的误差集中在嵌套超过三层的层级化表格——研报里那种多层表头加合并单元格的格式,OCR和解析还处理不好。
够用。孙总说了两个字,
>>>点击查看《AI时代:码农的涅盘重生》最新章节