8月19日
11:42
11:42官方一手arXiv: DeepSeek@Sahab Zandi, Noah Kostesku, Christophe Mues, María Óskarsdóttir, Cristián Bravo
研究评估了XGBoost和图神经网络(GNN)等信用风险模型,使用Freddie Mac单户贷款数据测试三种LLM配置:Gemma 3 4B、DeepSeek R1 70B和Gemini 2.5。研究发现,证据表示质量比语言模型对解释质量影响更大,解释叙述能准确识别影响因素但影响方向可靠性较低。研究还发现专业人士比非专业人士应用更严格的证据标准,对风险模型治理有重要启示。
推荐理由:这篇论文对比了不同LLM在信用风险解释中的表现,发现证据表示比模型选择更重要,对金融AI应用很有参考价值。