從 Codex 半年 10 倍成長,看 coding agent 的幾個坑
Codex 和 ChatGPT Work 使用者快速衝到 700 萬,這件事比誰超車誰更有意思:coding agent 的競爭正在往 harness、cost per task 和資料邊界移動。
TOPIC
4 篇文章
這裡收集本站中和「LLM」相關的工程判斷筆記,依發布時間排序。
回到主題索引Codex 和 ChatGPT Work 使用者快速衝到 700 萬,這件事比誰超車誰更有意思:coding agent 的競爭正在往 harness、cost per task 和資料邊界移動。
harshaneel/humanize 把 AI 改寫和檢測包成零依賴 LLM 技能,benchmark 支持它壓低表面與 perplexity 訊號,但 learned classifier 仍是明確限制。
Mete Polat 整理二十個與 AI 共事的 mental model,重點落在 upfront alignment、rewind、工具授權、驗證迴圈和安全邊界。
一個 Claude Code 風格 coding agent 的 alpha 版本,重點在檔案工具、命令執行與審批邊界。