Qwen3.6 27B scores 77.2% & the MoE variant, Qwen3.6 35B-A3B, hits 73.4%. These two local models are within spitting distance of Claude Sonnet 4.6 (79.6%).
本地模型在SWE-bench Verified基准测试中表现出色,接近顶级云端模型的性能。这表明本地编码技术已达到实用水平。开发者应关注这些基准数据,但也要注意基准测试可能无法完全反映实际开发场景中的表现。