您的位置:首 页 > 言情小说 > AI时代:码农的涅盘重生 > AI时代:码农的涅盘重生目录 > 第239章 突破性进展(第1页/共2页)
返回目录 | 加入书签 | 推荐本书 | 收藏本页

AI时代:码农的涅盘重生 第239章 突破性进展(第1页/共2页)


****3*6*0**小**说**阅**读**网**欢**迎**您****

请用户自行鉴定本站广告的真实性及其合法性,本站对于广告内容不承担任何责任。

    三月中旬的一个周五晚上,林晨正坐在书房里做投资系统的周度复盘。

    双显示器左边是投资面板,右边是这周FinGPT v2的训练日志。他刚把A股子策略的信号看了一半,右下角弹出陈铭的微信消息。

    FinGPT v2评测结果出来了。金融场景超通用模型34%。

    林晨的手停在了键盘上。

    他盯着那行字看了大概五秒钟,然后把投资面板最小化了,点开陈铭发来的评测报告PDF。

    报告第一页就是一张大表格。八个金融子任务,每个任务一个对比分数:

    金融问答:超过通用模型35% 研报摘要:超过通用模型42% 风险提示:超过通用模型28% 市场分析:超过通用模型31% 财报解读:超过通用模型38% 合规检查:超过通用模型26% 投资建议:超过通用模型30% 情感分析:超过通用模型27%

    综合领先:34%。

    他一条一条地往下看,看完最后一行数字之后停住了。34%——超过了30%的目标线四个点。42%的研报摘要单项领先,意味着模型在理解和概括金融文本方面的能力已经远远甩开了通用模型。

    他打开陈铭的微信对话框,打字:数据二次清洗的改进了什么?把优化方案详细写给我。

    陈铭秒回:好!我今晚写。主要是三个方面——删掉了所有没有来源标注的研报摘要数据,统一了风险等级的判定规则,增加了5000条金融问答的难样本。

    林晨放下手机,靠在椅子靠背上。

    他想起两个多月前的那次会议。二十个人坐在会议室里,他在白板上写下30%的目标,台下有人在笔记本上记,有人在心里犯嘀咕。陈铭问他如果达不到怎么办,他说那就继续调。

    现在34%的数字就放在面前——不是运气,是他的团队两个多月的积累。数据组刘明重新设计的标注标准、陈铭反复调整的LoRA参数、张雨构建的专业评测集——三个环节的成果汇在了一起。

    不是兴奋,是一种安静的确认。确认数据质量优先的策略是对的,确认团队执行力是够的,确认自己从投资系统里带过来的方法论的适用性。

    他在心里把34%翻译成了商业语言:这个领先幅度意味着金融客户切换大模型的收益足够明显了。一个客户之前用通用模型做金融问答,正确率一般;切换到FinGPT后正确率直接提升三分之一以上——这种差异不是说服客户换模型,是让客户主动来找你。

    第二天上午十点,他召集了一个紧急会议。

    会议室里的气氛跟两个多月前不一样了。两个多月前第一次开会的时候,有人在椅子上靠着墙站着,气氛里有一种我们要做一件不确定能不能做成的事的紧张感。今天没有人靠着墙——提前五分钟人都到了,椅子够坐,桌上放着打开的笔记本电脑和几张打印好的评测报告。

    林晨站在白板前,把马克笔盖摘下来,写了一个数字:34%。

    这个数字大家都看到了。他转过身,手撑在桌沿上,眼神扫了一圈。FinGPT v2在金融场景下超越通用模型34%,超过目标线30%。这个数字说明三件事。

    他在34%下面写了第一个词:方向。

    第一,方向是对的。用高质量精选数据做微调的效果,远超用大量杂音数据做微调。我们在数据上花的每一分钟都是值得的。

    第二个词:团队。

    第二,团队是能打的。从数据清洗到模型训练到评测构建,每个组的执行力都超过了我最初的要求。评测组的金融评测集被金融部的人拿去当成内部培训素材了——这说明我们的评测标准不仅合理,而且比行业默认的标准更专业。

    第三个词:机会。

    第三,窗口期还在。通用模型在金融场景下的表现仍然不行——通用模型能看懂文字,但看不懂金融。这个认知鸿沟就是我们的机会窗口。

    他停下来,喝了一口水。

    但34%不是终点。我们的下一个目标是40%以上。两个方向——金融问答和风险提示,这两块的提升空间还很大。张雨,你牵头做这两块的专项数据优化。陈铭,你试试把LoRA的rank从32提到64,看效果变化。

    如果rank翻倍但收益递减怎么办?陈铭问。

    那就不加。只做有效的改动,不为了加而加。

    会后,林晨给陈博士发了一条微信:FinGPT v2结果出来了。金融场景超通用模型34%,超过目标。建议尽快启动商业化讨论。

    陈博士回了一个字:

    他走到陈博士的办公室,手里拿着打印好的评测报告。陈博士从头到尾翻了一遍,在研报摘要:42%那行停了一下。

    这个数字是真实的?

    真实的。评测集由张雨独立构建,没有在训练数据中泄露。

    陈博士把报告放在桌上,双手交叉。商业化方案你想好了
>>>点击查看《AI时代:码农的涅盘重生》最新章节