热点事件观察中
Qwen3.8 27B 英文单词加法基准测试
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
2026年10月5日,Simon Willison 发布基准测试,检验本地模型 Qwen3.8-27B-Q4_K_M.gguf 用英文单词表达正整数加法的能力。在 5,070 个禁用推理的用例中,数字准确率为 23.57%;操作数从 1-3 位增至 10-13 位时,准确率由 97.04% 降至 6.44%,格式合规率达 96.17%。启用中等推理后,169 次尝试中答对 167 次。测试显示模型在简单数字上表现良好,但随位数增加准确率急剧下降,推理模式可显著提升表现。
AI 根据报道生成 · 14 小时前更新
最新进展10月5日 07:34
启用中等推理后,169 次尝试中答对 167 次,准确率大幅提升。报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- Simon WillisonQwen3.8 27B 用英文单词做加法:本地模型基准测试
一项基准测试检验本地模型 Qwen3.8-27B-Q4_K_M.gguf 能否仅用英文单词表达正整数加法结果。在 5,070 个禁用推理的用例中,其数字准确率为 23.57%,操作数从 1-3 位增至 10-13 位时准确率由 97.04% 降至 6.44%,格式合规率达 96.17%。启用中等推理后,169 次尝试中答对 167 次。
本事件热度走势
当前热度 4·可比范围峰值 6(10月6日 01:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。