用事实做选择
把模型目录变成可执行的评估流程。
能力清晰
查看模态、协议、限制和版本状态。
覆盖透明
了解模型在哪些提供商上可用。
便于比较
用统一维度比较候选模型。
开始探索模型目录
从模型、提供商或组织开始。
核心能力
在接入前快速了解模型的能力边界与使用条件。
输入与输出
查看支持的模态以及输入输出方向。
限制与上下文
确认上下文、输出限制和发布日期。
提供商覆盖
比较能够提供该版本的服务商与协议。
Fugu 常见问题
开始使用Fugu
从模型评估走向可交付的生产工作流。
核心规格
能力与适用方向
模型摘要
Multi-agent model for routing expert agents across complex analytical tasks
文本
附件推理结构化输出工具调用
- 输出
- 文本
- 能力
- 4
- 目录更新时间
- 2026-06-15T00:00:00.000Z
- 状态
基准评测
| 评测项目 | 类型 | 分数 / 排名 | 评测时间 |
|---|---|---|---|
| SWE Bench Pro | Coding | 59 | 2026-08-05T03:37:00.044Z |
| Terminal Bench 2.1 | Coding | 80.2 | 2026-08-05T03:37:00.044Z |
| LiveCodeBench | Coding | 92.9 | 2026-08-05T03:37:00.044Z |
| LiveCodeBench Pro | Coding | 87.8 | 2026-08-05T03:37:00.044Z |
| Humanity’s Last Exam | General | 47.2 | 2026-08-05T03:37:00.044Z |
| CharXiv Reasoning | 推理 | 85.1 | 2026-08-05T03:37:00.044Z |
| GPQA Diamond | 推理 | 95.5 | 2026-08-05T03:37:00.044Z |
| SciCode | Coding | 60.1 | 2026-08-05T03:37:00.044Z |
| τ3 Banking | General | 21.7 | 2026-08-05T03:37:00.044Z |
| Long Context Reasoning | 推理 | 74.7 | 2026-08-05T03:37:00.044Z |
| MRCRv2 | General | 86.6 | 2026-08-05T03:37:00.044Z |
| CTI-REALM | General | 67.5 | 2026-08-05T03:37:00.044Z |
提供商覆盖
| 提供商 | 输入 | 输出 | 价格 |
|---|---|---|---|
| Sakana AI | 暂无定价 |