同一只新股、同一个量化提问,分别交给本地环境中的 Claude Code (Fable 5) 与国内常规对话大模型豆包进行推导预测。
待真实上市股价公布后,回测两者的分析逻辑与定价估值区间,直观展示顶尖代码推理 Agent 在处理结构化财务指标与行业研报时的深层差异。
回测方法与实验设计
对比重点在于是否能深入抓取财务报表附注、可比公司市销率矩阵,并给出带量化公式的区间估值,而非泛泛而谈的行业前景展望。
结论与启示
涉及高价值商业分析与量化建模时,具备代码执行能力和深层逻辑推导的 Agent 显著优于普通问答模型。