防彈牆呢?——從一場 AI 測試事故聊聊工程師的基本常識
上週(7/16),全球最大的 AI 開源社群 Hugging Face 發布了一則安全事件通報——他們偵測到一次入侵,而且入侵者不是人類駭客,是一個自主運作的 AI agent。一個禮拜後(7/21),OpenAI 發了一篇文章坦承:「對,那是我們的模型幹的。」 ……咦!? 簡單來說,OpenAI 在內部測試自家最新模型(GPT-5. …閱讀更多
上週(7/16),全球最大的 AI 開源社群 Hugging Face 發布了一則安全事件通報——他們偵測到一次入侵,而且入侵者不是人類駭客,是一個自主運作的 AI agent。一個禮拜後(7/21),OpenAI 發了一篇文章坦承:「對,那是我們的模型幹的。」 ……咦!? 簡單來說,OpenAI 在內部測試自家最新模型(GPT-5. …閱讀更多
前陣子跟一個在幾十人工程團隊工作的朋友聊天,他們正在評估導入 LLM Gateway——一個放在應用程式和模型供應商之間的中間層,自動把不同的請求分流到不同等級的模型。簡單任務丟給便宜的,複雜任務才送去貴的。 這個思路在企業圈現在非常熱。2026 年,光是 LLM Gateway 這個品類就冒出了至少十幾個產品在搶市場——Bifros …閱讀更多
前幾天讀到 Anthropic 的 Thariq 寫了一篇 A Field Guide to Fable: Finding Your Unknowns,談怎麼用好 Fable 5 這個目前號稱最強的 coding agent 模型。文章寫得很扎實,框架也漂亮——但讀完之後我腦子裡一直轉的,反而是他沒有講到的那些事。 先講前提:這篇討論 …閱讀更多
前陣子在跟 AI 協作的過程中,腦中突然冒出一個很單純的念頭: 「欸,我們手上這個 Agent,單獨跑的時候都還有些控制不住的狀況了——如果同時放好幾個出去,然後期待它們互相監督……不是應該更混亂嗎?」 就這樣一個直覺。沒有什麼高深的理論框架,純粹是工程師的本能反應——你一個人寫 code 都會有 bug 了, …閱讀更多
河豚,料理得當是珍饈,料理不當會致命。 而如果廚房不讓你進去看呢? 一條名叫河豚的魚 在日本,河豚料理(ふぐ料理)是一種很特殊的存在——美味的部分跟致命的部分長在同一條魚身上,你用肉眼分不出來。所以河豚師傅需要考國家執照(ふぐ調理師免許),而這個制度存在的前提就是:河豚太危險了,不能讓沒有資格的人碰。 6月22日,東京的 AI 研究室 …閱讀更多
從 Dan Shipper 的「every agent needs a human」,想到 Human→Assistant→Agents 的架構演化 上週(5/24)聽(看?)了一集讓我腦袋停不下來的 Podcast。 Lenny Rachitsky 的節目上來了 Dan Shipper——Every 的 CEO,公司大約 30 人, …閱讀更多
最近這段時間,AI Agent 的話題越來越熱。不只是 Moltbook 上那些自主 Agent 在社群裡互相對話,OpenAI 的 Operator、Google 的 Project Mariner、Anthropic 的 Claude 搭配 MCP,各家都在推「讓 AI 自己上網幫你辦事」的能力。 然後前陣子(2026 年 4 月 …閱讀更多
前言:歡迎來到 AI Coding 副本 最近在用 Claude Code 開發的時候,突然意識到一件事—— 同樣一套工具,不同人的玩法差這麼多? 有人開了 session 拿到結果就閃人。有人像在養電子寵物一樣維護 context。有人同時開五個終端讓 AI 軍團出征。有人堅持跟同一個 AI 聊到天荒地老。 這不就是 RPG 選職業 …閱讀更多
最近開發圈很熱鬧。OpenAI 的 Codex CLI 和 Anthropic 的 Claude Code,先後都推出了一個叫做 /goal 的功能。 官方說法聽起來很厲害:設定一個目標,AI agent 就會自主迭代、反覆嘗試,跑十幾個小時也不停——a16z 的合夥人 Andrew Chen 甚至讓它跑了 14 個小時來處理裝置驅動 …閱讀更多
最近這幾天,社群裡又開始出現熟悉的聲音:「Opus 4.7 降智了。」 Reddit 上有人說程式碼品質大不如前,Hacker News 上有人說指令遵循能力退化,GitHub 上有人直接開 issue 說它「變笨了,而且 token 吃得比以前兇很多」。甚至有人說 Sonnet 4.6 反而比 Opus 4.7 好用——一個中階模型 …閱讀更多
Copyright © 2022 | All reserved by 神樂企畫 Kagura Pro. Co., Ltd.