前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
洞察/09.04 · 00:00/5 MIN/编译自 鹭羽/2 阅读

AFAC金融AI大赛收官,百亿级数据开源

AFAC 2026金融智能创新大赛总决赛落幕,5000多支队伍、近2万人参赛,30多家机构联合发起。四道赛题覆盖资金流向识别、复杂文档还原、Agent决策与记忆压缩,考验AI在真实约束下的落地能力,百亿级金融数据同步开源。

八月末,上海。AFAC 2026金融智能创新大赛总决赛开赛。这场年度“金融AI大考”,以全球5027支队伍、近2万名选手的规模展开,能晋级总决赛路演的只有约1%。

来自清华、北大、复旦、麻省理工等高校的学子,与大厂技术骨干同场竞技。有人从L2行情中识别资金动向,有人拆解复杂金融文档,也有人用Harness、RSI让Agent读懂市场情绪。

比赛现场

赛事同期,主办方首次推出“会、展、赛”三位一体的总决赛路演舞台。主论坛大咖轮番登场,创新展区人气很旺——历届成果亮相、创投一对一对接、HR现场发offer,千问AI眼镜等产品也开放体验。

创新展区

AFAC已办到第四届。今年由上海市科委、中国计算机学会、北京大学、蚂蚁集团、GFTN(全球金融与技术网络)、真格基金、中国银行等30多家机构联合发起;自2023年首届以来,累计吸引全球超2万支队伍、6万名选手,覆盖600余所高校、700余家企业。

大赛现场

AFAC不同于普通算法竞赛的地方,是把金融业正在面对的真问题直接搬进考场。

现场图

普通算法竞赛通常目标清晰,只需在固定数据集上把指标刷高;金融AI却站在一个模糊边界上:市场在变、问题开放、模型每次调用都对应真实成本,答案还必须经得起复核。因此今年四道赛题都刻意模拟真实约束——数据规模更大、反馈更稀疏、环境持续变化,而资源和成本始终有限。

现场图

赛题一“市场参与者交易行为识别与资金流向分析”,要求从L2行情里识别资金动向。评审专家、中科大计算机学院副院长王超把难点概括为三点:数据形态变化大、开放子任务缺少固定评价指标、模型只能以静态历史数据应对动态市场。他的评审标准是复现、解释与泛化——高分可能来自偶然,可落地的系统要在条件变化后依然成立,并且讲得清依据。

现场图

赛题二“复杂金融文档还原挑战”卡在输入端。复旦大学教授张军平说,OCR识别出字符并不等于读懂文件,超长表格往往需要后处理补足,而金融文档模板不固定,对模型鲁棒性要求很高。

现场图

赛题三让Agent像研究员一样,在无法并行、预算有限的前提下,根据每轮实验完成闭环反馈。蚂蚁集团财富保险事业群资深算法专家陈召群认为,流程自动化是技术商业化的典型范式,但技术从概念验证走向大规模应用,成本和ROI总是绕不开的问题。

现场图

赛题四“金融长文本Agent的动态记忆压缩与高效问答”同样直指成本。哈工大计算学部教授张宇的判断是:真正拉开差距的不是提示词写得多漂亮,而是系统有没有上下文控制能力。上下文窗口解决容量问题,有效上下文才解决利用问题;Token消耗直接决定能力能否以合理成本服务海量用户。

蚂蚁集团财富AI Lab研发负责人徐万青进一步对比了成本曲线:互联网时代新增用户边际成本接近零,AI时代每个用户都会带来真实Token消耗,边际成本不会归零。成本不是能力之外的附加题,而是能力本身的一部分。

所以今年赛题看似分散,核心仍是同一个问题:模型能否在真实约束中持续完成任务。把四届赛题串起来看,这条线就是金融AI从“模型可用”走向“系统好用”的浓缩路径。

路线图

2023年首届正值ChatGPT爆发半年后,赛题更多在回答“大模型能不能进金融”;第二年转向业务如何接入,并增设初创组,把考察从算法扩展到商业落地;2025年,因果溯源、逻辑推理和工具调用成为重点,考题开始强调工业级约束;到今年,Agent热度不减,但行业更关心智能体能不能管理上下文、适应动态环境、利用稀疏反馈、控制调用成本。

这条技术路径,也被总决赛现场开源发布的“AFAC百万金融智能数据集”完整保留。

开源发布现场

数据集沉淀自2023至2025年的14道赛题,包含13万条评测样本、2000余份专业金融文档和130多个历届优胜方案,覆盖百亿级金融科技数据条目。开源让赛事多年积累的Know-how成为外部研究者的接口,也为AFAC构建起持续运转的数据飞轮。

AI生成示意图

不过,赛题再接近业务,也不是业务本身。一个想法要变成稳定、高效、成本最优的产业方案,还要在大量细节中打磨。AFAC真正难以复制的,恰恰是赛场之外的生态。

现场图

SGInnovate董事Jae Annie Tay第一次来到AFAC。她注意到,团队越小,越需要一个足够大的外部生态,让创业者能持续连接到人才、资金和产业资源。

现场图

AFAC正试图搭建这样一套转化体系:高校、开发者和初创团队站在一边,蚂蚁长期积累的业务场景站在另一边,中间是围绕赛事生长出的人才、场景、资本和产业连接。

现场图

今年大赛发起方扩至33家,新增新加坡金融科技节发起方GFTN;除百万奖金池外,还有算力支持、大厂直通、6个月加速成长计划,并与WAIC、外滩大会、CNCC等平台联动。

现场图

总决赛现场的“会、展、赛”正是这套生态的缩影:挑战组从真题里识别能力,初创组把能力变成产品,最终都落向真实场景。

现场图

赛制可以模仿,奖金规模可以追赶,难的是让人才、场景、资本和产业持续转动起来的生态。这或许只有长期深耕金融AI的参与者才做得到:从真实业务中抽丝剥茧,再把答案种回真实场景。

轮子能转,舵手也要稳。大浪淘沙之后,金融AI的下一步,锚已起,帆已扬。

标签:蚂蚁集团

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型
置顶

「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型

NeoMME:单塔 Transformer 取代 VLM+投影+解码器,索引缩到 6KB/页
置顶

NeoMME:单塔 Transformer 取代 VLM+投影+解码器,索引缩到 6KB/页

前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
编码 Agent 更靠谱的 5 层护栏:Cole Medin 11 条清单的落地版
置顶

编码 Agent 更靠谱的 5 层护栏:Cole Medin 11 条清单的落地版

//

24小时热榜

乌克兰战场无人机数据流向商业市场:超百家企业获取飞行数据
TOP1

乌克兰战场无人机数据流向商业市场:超百家企业获取飞行数据

GitHub HydraFusion:多模型编排媲美 Opus 5,成本低 67%
TOP2

GitHub HydraFusion:多模型编排媲美 Opus 5,成本低 67%

3

Audacity 4.0 发布:Qt 重构界面,剪辑模型全面重做

刚刚
Audacity 4.0 发布:Qt 重构界面,剪辑模型全面重做
4

微软向纽约时报诉讼提交 820 万条 Copilot 对话日志

刚刚
微软向纽约时报诉讼提交 820 万条 Copilot 对话日志
5

微软 Project Zenith:面向开发者的开箱即用 Win11 配置

刚刚
微软 Project Zenith:面向开发者的开箱即用 Win11 配置
6

HEIR:Google 同态加密编译器让 ML 推理在密文上直接运行

刚刚
HEIR:Google 同态加密编译器让 ML 推理在密文上直接运行
7

「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型

21小时前
「Next-token predictor」是错的心智模型:为什么它决定了你怎么用大模型
8

OpenAI 发布 GPT-6 Astra,网络安全能力首达关键级

1天前
OpenAI 发布 GPT-6 Astra,网络安全能力首达关键级
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断