Kimi K3在AfterQuery的SpreadsheetBench 2评估中取得了首位。这一结果使其在该特定基准测试中领先于Claude Fable 5。
media
r/LocalLLaMA
·
3 天前
·
open_models
Kimi K3在AfterQuery的SpreadsheetBench 2上排名第一,超越Claude Fable 5
译自 English → 中文
相关文章
media
r/LocalLLaMA
·
12 小时前
Kimi K3在Agent Arena上的推理水平与Opus持平
根据Agent Arena排行榜,Kimi K3在非视觉任务中的表现与Opus相当。虽然一些用户指出Opus在视觉能力方面可能具有优势,但排名表明在其他用例中两者势均力敌。
media
r/LocalLLaMA
·
3 天前
Kimi K3 (max) 在 Simple Bench 上击败 Sonnet 5
文章报道 Kimi K3 (max) 在 Simple Bench 基准测试中优于 Sonnet 5。
media
r/LocalLLaMA
·
6 小时前
Kimi-K3将开源与闭源前沿的差距缩小至1.5个月
根据Artificial Analysis的数据,Kimi-K3的发布将开源和闭源AI前沿之间的时间滞后缩短至仅1.5个月。
media
Don't Worry About the Vase
·
13 小时前
Moonshot AI 在发布 Kimi K3 后计划在香港进行 IPO
Kimi K3 模型发布后,Moonshot AI 已通知投资者,其计划在接下来六个月内于香港进行首次公开募股(IPO)。
media
Interconnects
·
18 小时前
Moonshot AI 发布 Kimi K3,一款拥有 2.8T 参数的 MoE 模型
7月16日,Moonshot AI 发布了其最新旗舰模型 Kimi K3,这是一款拥有 2.8 万亿参数的混合专家(MoE)架构。该公司承诺将于7月27日发布该模型的权重。