Anthropicが公表したベンチマーク比較。Claude Haiku 5.5はTerminal-Bench 4.0で39.2%と、GPT-6 Lunaの16.4%を上回った

Anthropicが公表したベンチマーク比較。Claude Haiku 5.5はTerminal-Bench 4.0で39.2%と、GPT-6 Lunaの16.4%を上回った