KimiK2在主流基准测试(MMLU、MATH、HumanEval等)上表现出色
2025-08-13 13:46:07
193
相关数据
行业数据1
代表性模型MMLU-Pro得分(%)
2026-06-26 08:15:33
0
原图定位
行业数据1
Attitudes towards human vs AI created fitness content (%)
2026-03-26 08:30:00
89
原图定位
行业数据1
Human Resources (HR)
2026-03-18 08:30:00
53
原图定位
行业数据1
FIGURE 17 ESTIMATED DAILY LOSSES OF ENERGY AND NUTRIENTS AS A SHARE OF HUMAN REQUIREMENTS FOR MEN BY REGION, 1991–2023
2026-03-04 08:30:00
38
原图定位
行业数据1
FIGURE 18 ESTIMATED DAILY LOSSES OF ENERGY AND NUTRIENTS AS A SHARE OF HUMAN REQUIREMENTS FOR WOMEN BY REGION, 1991–2023
2026-03-04 08:30:00
36
原图定位
行业数据1
FIGURE 16 ESTIMATED DAILY LOSSES OF ENERGY AND NUTRIENTS AS A SHARE OF HUMAN REQUIREMENTS, 1991–2023
2026-03-04 08:30:00
37
原图定位
行业数据1
Figure: Human Resources Salary Table 2026
2026-03-03 08:30:00
49
原图定位
行业数据1
2022–2024年在MMLU的评估中得分超过60%
2026-01-14 13:51:52
58
原图定位
市场规模1
图表52022-2024年在MMLU(大规模多任务语言理解)中得分超过60%的最小型人工智能模型参数数量变化
2025-11-20 13:41:56
122
原图定位
行业数据1
KimiK2Thinking与GPT-5(High)、ClaudeSonnet4.5(Thinking)在多项
2025-11-19 13:52:27
155
原图定位
行业数据1
图1.KimiK2在不同基准测试中的表现情况
2025-07-21 14:07:20
219
原图定位
行业数据1
Duolingo2024Duocon更新功能(videocallwithLily,Adventures,Math,Music)
2024-10-17 08:15:31
481
原图定位
行业数据1
o1在广泛的基准测试中优于GPT-4o,包括54/57MMLU子类别
2024-09-19 08:15:58
463
原图定位
其它1
开源和闭源模型在五样本MMLU语言理解基准测试中的得分对比
2024-06-03 08:17:23
415
原图定位
最新数据
行业数据1
全球全年龄段奶粉市场规模(亿美元)
2026-07-30 13:41:18
1
原图定位
行业数据1
全球酸奶及发酵乳制品市场规模(亿美元)
2026-07-30 08:15:57
0
原图定位
行业数据1
全球药用级益生菌市场规模(百万美元)
2026-07-30 08:15:57
0
原图定位
行业数据1
全球益生菌膳食补充剂市场规模及增速
2026-07-30 08:15:57
0
原图定位
行业数据1
全球拥有AKK专利菌株的核心企业
2026-07-30 08:15:57
0
原图定位
综合能力跃升:从“特长生”到“全能型选手”。如果说早期 Kimi 依靠长文本建立护城河,2025 年 7 月发布的 K2 模型则标志着它已从“特长生”进化为“全能型选手”。其在MMLU、MATH、HumanEval 等主流基准测试上的表现,证明了其通用推理和代码生成能力已达到或接近 GPT-4o 和 Claude 3.5 Sonnet 等世界模型的水平。这意味着 Kimi 不仅能“看得全”,更能“想得深”、“做得对”,其编程能力不再是短板,而是与长文本优势相辅相成的强项。
行业数据
原图定位
相关数据
最新数据