由 提供支持autopilot.law公开、透明、可复现的法律大模型评测

法律大模型 Benchmark 完全公开

CorePact 聚焦法律方向,实时同步通用与法律垂直模型在中英法律评测上的表现。榜单、曲线、训练状态一处直达,让每一分进展都可被看见、被验证。

法律评测维度
9
中英混合基准
上榜模型
16
通用 + 法律垂直
法律垂直模型
9
含自研 Lite/Pro/Max
评测题量
38K+
覆盖合同/司考/推理

法律大模型评测榜单

覆盖中英混合法律评测:LegalBench、CUAD、美国律考、BigLaw Bench,以及 LawBench、LexEval、国家法考。点击表头可按对应维度重新排序,并可按模型类型筛选。

当前排序LegalBench) — 英文法律推理综合基准(162 项任务)

#模型开源
1
CorePact-Legal Max法律垂直
CorePact
86.383.792.679.290.489.188.485.981.7闭源
2
O
GPT-5.6通用
OpenAI
85.778.392.477.591.291.873.170.564.2闭源
3
A
Claude Opus 5通用
Anthropic
83.680.490.178.189.790.570.267.560.8闭源
4
CorePact-Legal Pro法律垂直
CorePact
82.479.188.574.886.985.384.781.376.2闭源
5
G
Gemini 3 Pro通用
Google DeepMind
81.974.288.773.688.489.669.866.159.3闭源
6
Qwen 3 Max通用
阿里巴巴
76.570.179.362.380.582.778.274.668.1开源
7
DeepSeek-V3.2通用
深度求索
75.869.478.161.579.883.477.573.967.2MIT
8
CorePact-Legal Lite法律垂直
CorePact
74.971.278.664.181.280.680.176.470.3Apache-2.0
9
GLM-5通用
智谱AI
74.167.876.559.877.980.276.972.466.5免费商用
10
K
Kimi K3通用
Moonshot AI
73.566.275.158.476.479.175.371.165.0免费商用
11
通义法睿法律垂直
阿里巴巴
72.368.570.460.271.573.883.980.774.8闭源
12
DISC-LawLLM法律垂直
复旦大学
61.258.355.745.756.860.374.171.864.3开源
13
智海-录问法律垂直
浙江大学
58.955.152.443.253.957.672.670.263.1开源
14
ChatLaw法律垂直
北京大学
57.354.851.241.852.455.170.968.561.7开源
15
OS
LawGPT法律垂直
开源社区
52.149.747.836.548.651.266.463.957.2开源
16
Lawyer LLaMA法律垂直
北京大学
50.448.245.134.946.249.764.861.755.4开源
数据来源:CorePact 法律评测团队精选整理(LegalBench / CUAD / LawBench / LexEval 等)已同步至数据库 · 最近同步 2026/08/06 08:52

实时训练状态

训练集群通过接口上报,指标写入数据库并同步至此。数据库实时数据 · 更新于 08/04 11:34

CorePact-Legal Lite · 预训练 · loss

训练步 vs 训练 / 验证 loss

训练验证
412K
总吞吐 tokens/s
192
GPU 在用
3.24M
计算核心
2
活跃任务
CorePact-Legal Lite · 预训练
run-1c05 · 64 GPU · 1.08M 核心 · 运行中
35B A3B
step 192,000 / 240,00080%
x
loss
1.709
吞吐 tok/s
ETA
约 36 小时
CorePact-Legal Pro · SFT
run-4a1d · 128 GPU · 2.16M 核心 · 运行中
238B
step 12,400 / 18,00069%
x
loss
0.913
吞吐 tok/s
412K
ETA
约 14 小时