易语言代码生成 · pass@1
易语言模型基准
每个分数都经过源码回包、工程重开与 AutoLinker 真实编译。编译失败的样本,总分归零。
当前最高分
--
正在载入结果
Published results
编译验证总榜
| # | 模型与思考等级 | 总分 | Raw | Skill | 有效格式 | 编译率 | pass@1 | 详情 |
|---|---|---|---|---|---|---|---|---|
| 正在读取评分数据… | ||||||||
没有匹配的模型
Compile gate impact
结构正确,不等于可以编译
v1.2 compile-gated
评分规则
01严格响应JSON 与授权路径
02工程回包e-packager
03重开比对一致性与 IDE 打开
04真实编译失败则总分归零
05隐藏语义静态断言
预编译结构分 · 100
用于定位格式问题;只有通过真实编译后才成为有效格式分。
每次回包失败扣 15 分
按实际 e-packager 回包失败次数累计,预编译结构分最低为 0。
不能编译,总分为 0
验证、回包、重开、IDE 打开或真实编译失败,均触发编译硬门槛。
API 故障不计模型失败
HTTP、限流与网络重试不参与格式扣分,也不会生成模型成绩。
Category scores