Learning to Replicate Expert Judgment in Financial Tasksa month agohttps://thinkingmachines.ai/news/learning-to-replicate-expert-judgment-in-financ...跑赢市场之所以具有挑战性,是因为它需要基于投资者判断的独特洞察,而这种判断力难以直接阐明或传授。大型语言模型在筛选和处理文档等简单的财务任务上表现不佳,尽管这些任务对投资者来说是常规工作。这篇文章探讨了利用大型语言模型实现信息筛选自动化,并指出通过专家标注,专用模型可以达到专家级别的判断水平。前沿模型(如Gemini、Claude、GPT)在六项筛选任务中表现欠佳,准确率约为50-80%,低于80%的可信度阈值。更多...