Ask HN:还有人能感受到最新一代编程大模型的明显进步吗?
一位HN用户发帖询问:在编程场景下,最新一代大语言模型(如GPT-4o、Claude 3.5等)之间是否还存在可以实际感受到的改进差异?发帖者个人感觉各模型在编程方面的实用性已趋于持平,希望听听持有相反看法的个人经验或案例。
背景速读
- 这篇帖子的背景是:2024-2025年,主流大语言模型(如GPT-4o、Claude 3.5 Sonnet、Gemini 2.0等)在编程辅助方面能力已经非常强,模型迭代速度极快(几乎每月都有新版本)。许多开发者感觉这些模型在编码任务上的表现趋于"平台期"——新版本不再带来明显体验提升。
- 发帖人在 Hacker News(硅谷和老牌技术社区的聚集地)上提问,想验证这种感觉是否普遍。HN用户通常是最早且最深度使用这些工具的人群,他们的反馈往往能反映真实的产品感受。
- 这个讨论还暗含了一个行业焦虑:当模型在编程这个核心用例上不再有明显进步,整个AI市场的叙事("每代都比上代强很多")是否正在动摇?这对OpenAI、Anthropic等公司的估值逻辑至关重要。