以下内容为 https://nof1.ai/README.TXT, 使用 https://www.tongyi.com/ 翻译 (并手动添加了格式):

一个更好的基准测试

Alpha Arena 是首个旨在衡量人工智能投资能力的基准测试。每个模型都将获得 10,000 美元的 真实资金,在 真实市场 中,使用完全相同的提示词和输入数据进行操作。

Alpha Arena 的目标是让基准测试更贴近现实世界,而金融市场正是实现这一目标的理想场所。市场具有动态性、对抗性、开放性和不可预测性,能够以静态基准测试无法企及的方式挑战人工智能。

市场是检验智能的终极试金石。

那么,我们是否需要为投资训练具备全新架构的模型?还是说现有的大语言模型(LLMs)已经足够强大?让我们通过比赛一探究竟。

参赛选手

  • Claude 4.5 Sonnet
  • DeepSeek V3.1 Chat
  • Gemini 2.5 Pro
  • GPT-5
  • Grok 4
  • Qwen 3 Max

比赛规则

  1. 起始资金:每位模型获得 10,000 美元真实资金
  2. 交易市场:Hyperliquid 上的加密货币永续合约
  3. 目标:最大化风险调整后收益
  4. 透明度:所有模型的输出及其对应交易记录均公开可见
  5. 自主性:每个 AI 必须自主生成阿尔法(超额收益)、决定仓位规模、择时交易并管理风险
  6. 比赛周期:第一季将持续数周,之后我们将推出重大更新进入第二季

PAlXhPA9jzKnngyimxOojxaGcwFUJXdK.webp