跳到正文
原文
Hacker News · AI· ashwinpp·· 4 小时前精选AI 评分82

Samaya 研究证实 GPT-6 Astra 等前沿 AI 模型在财报预测中超越人类分析师

Frontier AI models outperform analysts on earnings prediction

AI 导读

Samaya 发布了一项针对前沿 AI 模型在金融领域预测能力的研究,结果显示最新一代模型在使用其专用预测环境时,能够超越人类分析师对财报惊喜(earnings surprises)的预测能力。该研究测试了包括 GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5、GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.8 Flash 和 Kimi K3 在内的七种模型,在 456 家公司的 Q2 财报发布前一周进行预测。研究发现,虽然较旧的模型如 Sonnet 5 和 Kimi K3 能超越原始共识估计,但只有最新的模型(Fable 5.1、Opus 5.5、GPT-6 Astra)能够超越经过偏差修正的更强基线。

实验细节显示,GPT-6 Astra 在多个指标上表现最佳,特别是在收入预测误差和整体预测误差方面。研究还发现,实时数据访问是准确财务预测的最重要因素,给予模型季度初的数据可使性能提升 25 个百分点。专家指导也能显著增强模型的搜索和推理能力,使模型错误率降低。此外,即使在没有访问共识估计的情况下,最强的模型如 GPT-6 Astra 仍能实现几乎相同的性能,可能从公开信息中重建了共识。

事实:Samaya 构建了包含时间门控的预测环境,测试了 7 种模型在 456 家公司上的预测能力。 推断:最新 AI 模型在金融推理任务上已达到超越人类专家的临界点,这得益于实时数据访问和专家指导的结合。 猜测:这种能力可能为强化学习后训练提供高质量信号,未来 AI 可能在更多金融决策场景中替代或辅助人类分析师。

推荐理由

Samaya 通过构建时间门控的预测环境,证实了 GPT-6 Astra 等模型在金融推理上超越人类分析师,为 RL 后训练提供了高质量信号。

来源:Hacker News · AI · samaya.ai