從 Codex 暴增看 AI agent 的下一個戰場
以 AINews 2026/7/14 的摘要為基礎,整理 Codex 使用量暴增、harness 與 eval 變成關鍵、低位元本機推論和即時多模態系統幾條線索。
TOPIC
5 篇文章
這裡收集本站中和「Codex」相關的工程判斷筆記,依發布時間排序。
回到主題索引以 AINews 2026/7/14 的摘要為基礎,整理 Codex 使用量暴增、harness 與 eval 變成關鍵、低位元本機推論和即時多模態系統幾條線索。
Codex 和 ChatGPT Work 使用者快速衝到 700 萬,這件事比誰超車誰更有意思:coding agent 的競爭正在往 harness、cost per task 和資料邊界移動。
整理 GPT-5.6 這次發布裡比較值得看的幾個技術點:ultra、多 agent、Programmatic Tool Calling、ChatGPT Work,以及安全邊界。
從 Sol、Terra、Luna 的價格和 benchmark,寫到 ultra effort、Codex 合併、ChatGPT Work、Sites beta 與 cyber safety 爭議。
harshaneel/humanize 把 AI 改寫和檢測包成零依賴 LLM 技能,benchmark 支持它壓低表面與 perplexity 訊號,但 learned classifier 仍是明確限制。