安全測試環境
agent

防彈牆呢?——從一場 AI 測試事故聊聊工程師的基本常識

上週(7/16),全球最大的 AI 開源社群 Hugging Face 發布了一則安全事件通報——他們偵測到一次入侵,而且入侵者不是人類駭客,是一個自主運作的 AI agent。一個禮拜後(7/21),OpenAI 發了一篇文章坦承:「對,那是我們的模型幹的。」 ……咦!? 簡單來說,OpenAI 在內部測試自家最新模型(GPT-5. …閱讀更多

語言與文化差異
Claude

AI 的價值觀,到底是誰的價值觀?—從 Anthropic 的跨語言研究談起

英文說一句「Go!」,短促、有力、像一記鼓點。 翻成中文,「走吧!」——輕輕鬆鬆的,像是拍拍肩膀。 同一個意思,換一種語言說出來,力道、溫度、距離感全都變了。這不是翻譯的問題,這是語言的本質。每一種語言都自帶一套情緒重力場。 我之所以想到這件事,是因為前幾天(7/13)Anthropic 發了一篇研究:Claude’s V …閱讀更多

新手大挑戰
AI

AI 時代初階人才危機的解方,可能和人資長想得不一樣?

最近在 WEF(世界經濟論壇)上,前後出現了兩篇文章在談同一件事:AI 正在改變初階工作的本質,而且速度比大家想的快。 一篇是 Cognizant 的人資長寫的,一篇是 Cornerstone OnDemand 的人資長寫的。兩個不同公司、不同產業,但看到了同一個危機,提出了同一類解法。 當兩篇獨立的文章不約而同指向同一個問題,這件事 …閱讀更多

從創意到實現
AI

AI 大富翁:命運還是機會? (圈外人篇)

你可能聽到了一場跟你無關的恐慌 如果你不是工程師、不是設計師、不在科技公司上班,但最近總覺得隱隱有種壓力——「AI好像很厲害」「是不是該學點什麼」「會不會被淘汰」——我想先告訴你一件事: 那種焦慮,大部分不是你的。 那是科技圈自己的焦慮,溢出來濺到你身上了。 一個馬車夫的故事 一百多年前汽車出現的時候,誰最緊張?馬車夫。 不是麵包師傅 …閱讀更多

從實作到規劃
AI

AI 大富翁:命運還是機會?(圈內人篇)

你確定洪水真的來了? 最近這一年,打開社群媒體,每隔幾天就會看到一篇「AI 即將取代 XX 工作」的文章。標題一個比一個聳動,數字一個比一個嚇人——「9200萬個工作即將消失!」「40%的工作受到衝擊!」「你的工作還能撐幾年?」 身為一個在資訊圈滾了25年的老骨頭,我每次看到這種標題,第一反應不是焦慮,而是一個很基本的問題: 等等,這 …閱讀更多

AI靈魂感
Claude

Anthropic 說他們在 Claude 腦袋裡找到了「意識」?——讓我們換個角度看

前幾天(7/6)Anthropic 丟出了一篇研究報告,標題很學術,但內容炸裂——他們說,在 Claude 的內部找到了一個結構,長得很像神經科學裡一直在討論的「意識的工作空間」。 (等等,意識!?AI 的意識!?這不是科幻電影的台詞嗎……) 消息一出,網路上的反應其實比想像中有層次。X 上大部分人的態度是「impressed cur …閱讀更多

Gateway and routing
agent

省了 41% 的帳單,然後呢?——企業 AI 模型分流的隱性成本

前陣子跟一個在幾十人工程團隊工作的朋友聊天,他們正在評估導入 LLM Gateway——一個放在應用程式和模型供應商之間的中間層,自動把不同的請求分流到不同等級的模型。簡單任務丟給便宜的,複雜任務才送去貴的。 這個思路在企業圈現在非常熱。2026 年,光是 LLM Gateway 這個品類就冒出了至少十幾個產品在搶市場——Bifros …閱讀更多

強模型 vs 弱模型
AI

你無法把判斷力裝進罐頭裡——AI 蒸餾提示詞的認識論困境

Fable 5 重新開放的這幾天,社群裡除了炫耀「我用 Fable 5 做了什麼」之外,冒出了一個我覺得很有意思的思路: 「既然 Fable 5 額度有限、7/7 之後就按量計費,那與其拿它做日常任務,不如用它的判斷力來建立制度——寫好規則、查核清單(checklist)、評量表(rubric),讓之後的便宜模型照著跑。」 然後網路上 …閱讀更多

Thinking Partner
AI

還有人在意AI是不是你的思考夥伴嗎?從ChatGPT放棄4o開始

從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多