跳到正文
FunCoding

搜索

搜索文档、Skill 和 MCP

AI 日报 · 2026年10月2日

Ataraxos 以 85% 有效胜率击败最强人类 Stratego 选手,训练成本不足 8000 美元

研究人员开发的 AI 系统 Ataraxos 以 85% 的有效胜率(平局计半胜)击败了曾获 4 次世界冠军的史上最强 Stratego 选手 Niemeijer,并在 2025 世界锦标赛表演赛中取得 40 局 38 胜。

20 条

模型发布/更新

产品发布/更新

行业动态

论文研究

技巧与观点

  • LangChain 讲解如何在 Agent Harness 中构建模型路由器

    LangChain 在其开源编码 Agent Open SWE 中构建模型路由器,在 973 个线程的 A/B 测试中,中位成本从 $2.61 降到 $0.94(降 64%),PR 合并率 29.2% 对 27.3%,质量无可测变化。

    LangChain:Blog(RSS)

  • OpenRouter 指南:用置信度阈值实现模型分级升级路由

    OpenRouter 发布教程,讲解如何让廉价模型通过结构化输出返回 0 到 1 的置信度字段,低置信度的请求再升级到更强模型。文章强调置信分数只是自报、不是校准概率,应基于自己流量的分数段错误率排序设定阈值,并在上线后监控分数分布、升级率和未升级答案的错误率持续调整。

    OpenRouter:Announcements(RSS)

  • OpenRouter 教程:如何在 CI 中用 LLM eval 门禁拦截 Pull Request

    OpenRouter 发布教程,讲解如何用固定的 eval 集在 CI 中门禁 pull request,当通过率低于阈值时脚本以非零退出码阻止合并,做法与单元测试门禁一致。

    OpenRouter:Announcements(RSS)

快讯

数据来自 AIHOT,标题和摘要由 AI 根据原文生成,细节以原文为准。