還有人在意AI是不是你的思考夥伴嗎?從ChatGPT放棄4o開始
從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多
從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多
前兩篇聊了什麼 在前兩篇文章裡,我們談了 AI 幻覺的成因(被迫回答 + 選最像而非最正確),也談了比幻覺更隱蔽的「幽靈」——知識錯置——以及它為什麼比幻覺更危險。 寫完之後我一直在想一件事:這真的只是 AI 的問題嗎? 然後我想到了 Vibe Coding。 一場正在進行的戰爭 如果你有在關注 AI 輔助開發的討論,應該知道「Vib …閱讀更多
月初(6/4),Anthropic 發布了一篇萬字長文,標題叫《When AI builds itself》(當 AI 打造自己)。 這篇文章一出就爆了。全球科技媒體在轉、AI 圈在討論、各種中文解讀也陸續冒出來。裡面全是 Anthropic 內部第一次公開的數據——Claude 已經寫了他們超過 80% 的程式碼、工程師日均產出是兩 …閱讀更多
上一篇〈我所看見的 Claude Code 開發三大支柱〉聊了 CLAUDE.md、Auto Memory 和 Skills 構成的四層認知架構——核心原則、專案規範、累積經驗、執行方法。把起點設計好,讓 AI 從第一步就帶著正確的認知結構上場。 文章發出去之後,收到了一些蠻有意思的回饋。 一位朋友 Jared 把這篇文章跟他自己既有 …閱讀更多
最近在翻 Claude Code 的官方文件時,看到一句話讓我停了下來: CLAUDE.md: target under 200 lines per file. 200 行。就這樣? 一個要承載整個專案的 build 指令、程式碼編寫標準、架構決策、命名規範的檔案,Anthropic 跟你說「最好不要超過 200 行」。 我一開始跟大 …閱讀更多
從一份一年半前的調查,看台灣中小企業的 AI 真實處境 一份一年半前的報告,讀起來竟然毫無違和感 這兩天在社群上看到朋友在傳一份報告——KPMG 安侯建業的《台灣產業AI應用趨勢與展望報告》。 起因是有位做資訊服務的朋友,看了國發會 2026 年《台灣經濟論衡》春季號後有感而發,順藤摸瓜找到了這份 KPMG 報告,用 AI 做了摘要分 …閱讀更多
最近幾週看到一個有趣的現象。 在社群上,關於「非技術背景的人該不該用 AI 做開發」這件事,兩邊人馬吵得不亦樂乎。一邊說「AI 讓每個人都能開發產品,這是民主化!」另一邊說「連一行 code 都看不懂就上線,根本不負責任!」 兩邊都講得很有道理,但我覺得,兩邊都只講了一半。 人人都買得起車了 我們先承認一件事:AI coding 工具 …閱讀更多
一個奇怪的實驗 寫部落格不到半年,累積了一些文章之後,這兩天突然冒出一個念頭:這些文章在 AI 眼中,到底長什麼樣? 不是問「寫得好不好」——這種問題問 AI 只會得到一堆客套話。我想知道的是更根本的事:如果讓不同的 AI 去讀同一批文章,它們會「看見」同一個作者嗎? 於是我做了一件事:把部落格上所有文章丟給 Google Gemin …閱讀更多
最近這幾天,社群裡又開始出現熟悉的聲音:「Opus 4.7 降智了。」 Reddit 上有人說程式碼品質大不如前,Hacker News 上有人說指令遵循能力退化,GitHub 上有人直接開 issue 說它「變笨了,而且 token 吃得比以前兇很多」。甚至有人說 Sonnet 4.6 反而比 Opus 4.7 好用——一個中階模型 …閱讀更多
最近 Matt Pocock 在 AI Engineer Europe 上的一場演講「Software Fundamentals Matter More Than Ever」(軟體基礎比以往任何時候都更為重要)很紅。中文社群也已經有幾篇不錯的轉述文,把他演講裡的五個失敗模式、五個 skill 整理得很清楚(grill me、ubiqu …閱讀更多
Copyright © 2022 | All reserved by 神樂企畫 Kagura Pro. Co., Ltd.