2025 回顧:LLM 開始真的能做事了

2026 到了,回頭看去年 2025 LLM 的發展,很明確的感覺到 AI 終於不只是會說話,而是開始會做事了。

Simon Willison 這篇年終整理寫得很好,他把 2025 年 LLM 的變化濃縮成一句話大概就是: Reasoning + Agents + 長任務,讓 LLM 從工具走向同事

整理幾個我自己也很有感的點:

  • Reasoning 不再只是 benchmark 上的名詞,而是直接影響能不能完成複雜任務
  • Coding agent、CLI agent 真的開始進到工程師日常,不是 demo
  • 從年中 Codex 開始,LLM 可以連續工作幾小時,自己會拆解問題、修錯,然後繼續跑未完成任務
  • $200 美金/月的訂閱開始變合理(代表有人真的用它賺錢或省時間),但我是 20*n 的人

回頭看 2025 模型雖然突飛猛進,但真正值得注意的是 AI 終於開始適配人類的工作流程。

如果你今年也有一種怎麼突然很多事情可以交給 AI 做了的感覺,那你大概已經站在這個轉折點上了,這也意味著,未來競爭力不再只是誰的模型比較強,而是比誰比較能把 LLM 放進正確的工作系統裡,產生長期價值。

原文很長,強烈建議大家看看。