自我进化编程Agent崛起:Ornith模型的真实能力与局限 围绕Ornith系列模型在代码修复与工具使用中的表现,分析“自我改进型Agent”是否真的带来了能力跃迁。 2026年6月30日 LLM Agent CodeGeneration
开源大模型正在反超闭源?GLM-5.2 与 Claude 的实战对决 围绕 GLM-5.2 在基准测试中表现接近甚至超过 Claude 的争议,探讨开源模型在真实开发场景中的能力与性价比趋势。 2026年6月29日 AI LLM Benchmark