大模型赋能投研系列之三十二:升级后DeepSeek V4.1 Flash投研能力有多强(36页,2026年)
分类:人工智能
标签:大模型评测、多因子回测、智能体工作流、半导体设备产业链、金融工程
摘要:本报告由国金证券金融工程组于2026年9月14日发布,是「大模型赋能投研」系列第三十二篇,全文36页。报告以2026年9月10日正式发布的DeepSeek V4.1 Flash为核心对象,选取DeepSeek V4 Flash、DeepSeek V4 Pro、GPT-6 Astra与Kimi K3四款前沿模型作横向对照,从公开规格、第三方评测与三项真实任务实测三个层面展开,发布时间距模型上线仅四天,属于对新模型结构的首次系统性检验。研究方法上,三类任务均采用统一的结构化提示词,五款模型接收完全相同的指令,在只读宿主环境与最高思考强度下运行,覆盖数据库取数、表格建模、代码执行、图表生成、资料溯源与报告输出等环节,尽量还原真实金融智能体的完整工作流程。 模型层面,DeepSeek V4.1 Flash总参数为552B,采用20层因果编码器衔接20层解码器的新结构,含384个路由专家与1个共享专家,每个token激活其中6个。最关键的改动是输入与输出的非对称激活:处理输入时每token激活约8B参数,生成输出时激活约16B参数,把算力开销较大的读取环节压到最低,恰好对应智能体长任务中「读远大
来源:zuudee | 日期:2026-09-17 | 格式:PDF | 页数:36
加载中...