強模型 vs 弱模型
AI

你無法把判斷力裝進罐頭裡——AI 蒸餾提示詞的認識論困境

Fable 5 重新開放的這幾天,社群裡除了炫耀「我用 Fable 5 做了什麼」之外,冒出了一個我覺得很有意思的思路: 「既然 Fable 5 額度有限、7/7 之後就按量計費,那與其拿它做日常任務,不如用它的判斷力來建立制度——寫好規則、查核清單(checklist)、評量表(rubric),讓之後的便宜模型照著跑。」 然後網路上 …閱讀更多

Thinking Partner
AI

還有人在意AI是不是你的思考夥伴嗎?從ChatGPT放棄4o開始

從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多

Agentic AI
agent

撿到一塊錢,撐破褲子卻沒發現?—從 Agent 錯誤放大率,看 Loop Engineering 的結構性矛盾

前陣子在跟 AI 協作的過程中,腦中突然冒出一個很單純的念頭: 「欸,我們手上這個 Agent,單獨跑的時候都還有些控制不住的狀況了——如果同時放好幾個出去,然後期待它們互相監督……不是應該更混亂嗎?」 就這樣一個直覺。沒有什麼高深的理論框架,純粹是工程師的本能反應——你一個人寫 code 都會有 bug 了, …閱讀更多

河豚指揮家
agent

當河豚想指揮交響樂團——Sakana Fugu 的協調者悖論

河豚,料理得當是珍饈,料理不當會致命。 而如果廚房不讓你進去看呢? 一條名叫河豚的魚 在日本,河豚料理(ふぐ料理)是一種很特殊的存在——美味的部分跟致命的部分長在同一條魚身上,你用肉眼分不出來。所以河豚師傅需要考國家執照(ふぐ調理師免許),而這個制度存在的前提就是:河豚太危險了,不能讓沒有資格的人碰。 6月22日,東京的 AI 研究室 …閱讀更多

行銷人大談網路底層架構
AI

不只是 AI 的問題——當「專家」跨域時,幽靈也跟著來了

前兩篇聊了什麼 在前兩篇文章裡,我們談了 AI 幻覺的成因(被迫回答 + 選最像而非最正確),也談了比幻覺更隱蔽的「幽靈」——知識錯置——以及它為什麼比幻覺更危險。 寫完之後我一直在想一件事:這真的只是 AI 的問題嗎? 然後我想到了 Vibe Coding。 一場正在進行的戰爭 如果你有在關注 AI 輔助開發的討論,應該知道「Vib …閱讀更多

Car vs F1
AI

12 萬字的 AI 靈魂,打開一看是產品說明書—從 Claude Fable 5 的系統提示詞洩漏,聊聊「角色扮演」和「實際能力」的差距

上週(6/10),知名越獄研究者 Pliny the Liberator 在 X 和 GitHub 上發布了一份文件,號稱是 Anthropic 最新旗艦模型 Claude Fable 5 的完整 系統提示詞(system prompt)。 12 萬字。1,585 行。約 27,000 tokens。 當大家還在細細品味這份文件時,美 …閱讀更多

機器人的未來
AI

“When AI builds its self.” Really? Is it good?

月初(6/4),Anthropic 發布了一篇萬字長文,標題叫《When AI builds itself》(當 AI 打造自己)。 這篇文章一出就爆了。全球科技媒體在轉、AI 圈在討論、各種中文解讀也陸續冒出來。裡面全是 Anthropic 內部第一次公開的數據——Claude 已經寫了他們超過 80% 的程式碼、工程師日均產出是兩 …閱讀更多

學英文
人文

你學英文是為了考試?旅遊?商務?還是溝通?——從突然聽懂黃仁勳,才注意到的初衷問題

先交代一下我的位置。 我不是英文老師。我是一個翻譯了 30 本英文技術書的譯者,在英文書裡浸淫了二十幾年,但我教的是程式設計和系統分析,不是英文。所以這篇文章不會教你怎麼學英文——那不是我的專業。 但正因為我的身份是譯者而不是教師,我看英文的角度可能跟大多數人不太一樣。翻譯 30 本書的過程中,我最深的體會是:真正好翻的英文原文,從來 …閱讀更多