Samaya 研究:前沿 AI 模型在财报预测上超越人类分析师
先了解这件事
2026 年 10 月 9 日,Samaya 发布研究报告,证实 GPT-6 Astra 等七种前沿 AI 模型在使用专用预测环境时,其财报惊喜(earnings surprises)预测能力超越人类分析师。该研究测试了包括 GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5、GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.8 Flash 和 Kimi K3 在内的模型,基于 456 个样本进行了评估。报告指出,最新一代模型在特定金融场景下展现出优于专业分析师的准确性。
AI 根据报道生成 · 3 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
- Hacker News · AI精选Samaya 研究证实 GPT-6 Astra 等前沿 AI 模型在财报预测中超越人类分析师
Samaya 发布了一项针对前沿 AI 模型在金融领域预测能力的研究,结果显示最新一代模型在使用其专用预测环境时,能够超越人类分析师对财报惊喜(earnings surprises)的预测能力。该研究测试了包括 GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5、GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.8 Flash 和 Kimi K3 在内的七种模型,在 456 家公司的 Q2 财报发布前一周进行预测。研究发现,虽然较旧的模型如 Sonnet 5 和 Kimi K3 能超越原始共识估计,但只有最新的模型(Fable 5.1、Opus 5.5、GPT-6 Astra)能够超越经过偏差修正的更强基线。 实验细节显示,GPT-6 Astra 在多个指标上表现最佳,特别是在收入预测误差和整体预测误差方面。研究还发现,实时数据访问是准确财务预测的最重要因素,给予模型季度初的数据可使性能提升 25 个百分点。专家指导也能显著增强模型的搜索和推理能力,使模型错误率降低。此外,即使在没有访问共识估计的情况下,最强的模型如 GPT-6 Astra 仍能实现几乎相同的性能,可能从公开信息中重建了共识。 事实:Samaya 构建了包含时间门控的预测环境,测试了 7 种模型在 456 家公司上的预测能力。 推断:最新 AI 模型在金融推理任务上已达到超越人类专家的临界点,这得益于实时数据访问和专家指导的结合。 猜测:这种能力可能为强化学习后训练提供高质量信号,未来 AI 可能在更多金融决策场景中替代或辅助人类分析师。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。