還有人在意AI是不是你的思考夥伴嗎?從ChatGPT放棄4o開始
從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多
從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多
前陣子在跟 AI 協作的過程中,腦中突然冒出一個很單純的念頭: 「欸,我們手上這個 Agent,單獨跑的時候都還有些控制不住的狀況了——如果同時放好幾個出去,然後期待它們互相監督……不是應該更混亂嗎?」 就這樣一個直覺。沒有什麼高深的理論框架,純粹是工程師的本能反應——你一個人寫 code 都會有 bug 了, …閱讀更多
河豚,料理得當是珍饈,料理不當會致命。 而如果廚房不讓你進去看呢? 一條名叫河豚的魚 在日本,河豚料理(ふぐ料理)是一種很特殊的存在——美味的部分跟致命的部分長在同一條魚身上,你用肉眼分不出來。所以河豚師傅需要考國家執照(ふぐ調理師免許),而這個制度存在的前提就是:河豚太危險了,不能讓沒有資格的人碰。 6月22日,東京的 AI 研究室 …閱讀更多
六月初(6/4),我才剛寫完一篇關於 Anthropic《When AI builds itself》的觀察文,質疑那個「AI 打造自己」的遞迴迴圈到底 Is it good。 結果才過幾天,這個迴圈就有了正式名字——Loop Engineering。 而且還爆了。 發生了什麼事? 6 月 7 日,Google Chrome 工程主管 …閱讀更多
前兩篇聊了什麼 在前兩篇文章裡,我們談了 AI 幻覺的成因(被迫回答 + 選最像而非最正確),也談了比幻覺更隱蔽的「幽靈」——知識錯置——以及它為什麼比幻覺更危險。 寫完之後我一直在想一件事:這真的只是 AI 的問題嗎? 然後我想到了 Vibe Coding。 一場正在進行的戰爭 如果你有在關注 AI 輔助開發的討論,應該知道「Vib …閱讀更多
上週(6/10),知名越獄研究者 Pliny the Liberator 在 X 和 GitHub 上發布了一份文件,號稱是 Anthropic 最新旗艦模型 Claude Fable 5 的完整 系統提示詞(system prompt)。 12 萬字。1,585 行。約 27,000 tokens。 當大家還在細細品味這份文件時,美 …閱讀更多
月初(6/4),Anthropic 發布了一篇萬字長文,標題叫《When AI builds itself》(當 AI 打造自己)。 這篇文章一出就爆了。全球科技媒體在轉、AI 圈在討論、各種中文解讀也陸續冒出來。裡面全是 Anthropic 內部第一次公開的數據——Claude 已經寫了他們超過 80% 的程式碼、工程師日均產出是兩 …閱讀更多
先交代一下我的位置。 我不是英文老師。我是一個翻譯了 30 本英文技術書的譯者,在英文書裡浸淫了二十幾年,但我教的是程式設計和系統分析,不是英文。所以這篇文章不會教你怎麼學英文——那不是我的專業。 但正因為我的身份是譯者而不是教師,我看英文的角度可能跟大多數人不太一樣。翻譯 30 本書的過程中,我最深的體會是:真正好翻的英文原文,從來 …閱讀更多
前幾天 Claude 剛釋出最新模型 Fable 5,於是我就拿它來做文章寫作方向的討論。聊著聊著,模型的回應裡突然冒出一個名詞。 那個名詞是我在另一個主題的對話裡討論過好幾次的東西,跟眼前的寫作主題完全沒有關係。 我的第一反應很直覺:「咦?我跟你聊A,你怎麼會提到B呢?這沒有關係呀。」 不是生氣,不是被冒犯,就是純粹的困惑——就好像 …閱讀更多
最近兩週,Anthropic 連續丟了三篇官方文章出來。 老實說,一開始我只是隨手點開看看——結果一篇接一篇看完之後,坐在電腦前愣了一下。 不是因為什麼驚天大消息,而是這三篇湊在一起讀的時候,拼出了一個讓我覺得……嗯,該好好想一想的圖像。 (而且越想越覺得不太妙?) 先來快速看一下這三篇在講什麼 第一篇(5/1 …閱讀更多
Copyright © 2022 | All reserved by 神樂企畫 Kagura Pro. Co., Ltd.