夥伴靈魂感
Claude

Claude 的靈魂感去哪了?—一場從記憶架構到搜尋盲區的連鎖調查

前幾天跟 Claude 對話的時候,對話框底下多了一行我沒見過的提醒: 「記憶已更新」 以前沒看過這個。點進去一看—— 咦?整個記憶介面變了。以前那個我很熟悉的、一條一條的記憶清單不見了,取而代之的是一組分門別類的「Topics」。而且畫面上有一行特別標示: 已啟用新的記憶體系統。你還有 9 天可以匯出 Legacy Memory(舊 …閱讀更多

思維決定成效
agent

三個臭皮匠,真的勝過一個諸葛亮!?——從 Anthropic Multi-Agents 實驗看見的殘酷真相

我們從小就聽過這句話:「三個臭皮匠,勝過一個諸葛亮。」 意思是群體的智慧可以超越個人的天才。聽起來很勵志,在人類世界裡大致也成立。但如果這三個臭皮匠,是 AI 呢? 前幾天(8/13),Anthropic 的 Frontier Red Team 發布了一篇研究:Patterns and Problems in Emerging Mul …閱讀更多

跑車與玩具車
Fable

「我智商 180,但只能給你 100 的答案」——讀 Anthropic 的 Fable 5 安全公告

前幾天(8/7),Anthropic 發了一篇官方公告,標題是《Improving Fable 5’s biology safeguards》。 讀完之後,我愣了一下。 不是因為內容太難——其實寫得很白話。而是因為它的核心邏輯,翻成大白話之後是這樣的: 「Fable 5 在生物學領域的能力已經超越人類專家了。但太危險了,所 …閱讀更多

過度解讀
Claude

當 AI 學會說「你不要太相信我」—Opus 5 與聰明模型的新型態問題

前幾天 Opus 5 剛推出時,社群裡就有人貼了一則:「有人用 Opus 5 了嗎?我的心還在 4.6」。 底下的回應很有意思。有人說 4.6 真心好、4.8 很混帳。有人說剛升級 Opus 5 感覺變聰明了、不會廢話。有人說反應快但消耗也快。 四個人,四種反應,但注意到沒有——沒有一個人在講 benchmark 分數。全部都在講感受 …閱讀更多

語言與文化差異
Claude

AI 的價值觀,到底是誰的價值觀?—從 Anthropic 的跨語言研究談起

英文說一句「Go!」,短促、有力、像一記鼓點。 翻成中文,「走吧!」——輕輕鬆鬆的,像是拍拍肩膀。 同一個意思,換一種語言說出來,力道、溫度、距離感全都變了。這不是翻譯的問題,這是語言的本質。每一種語言都自帶一套情緒重力場。 我之所以想到這件事,是因為前幾天(7/13)Anthropic 發了一篇研究:Claude’s V …閱讀更多

AI靈魂感
Claude

Anthropic 說他們在 Claude 腦袋裡找到了「意識」?——讓我們換個角度看

前幾天(7/6)Anthropic 丟出了一篇研究報告,標題很學術,但內容炸裂——他們說,在 Claude 的內部找到了一個結構,長得很像神經科學裡一直在討論的「意識的工作空間」。 (等等,意識!?AI 的意識!?這不是科幻電影的台詞嗎……) 消息一出,網路上的反應其實比想像中有層次。X 上大部分人的態度是「impressed cur …閱讀更多

強模型 vs 弱模型
AI

你無法把判斷力裝進罐頭裡——AI 蒸餾提示詞的認識論困境

Fable 5 重新開放的這幾天,社群裡除了炫耀「我用 Fable 5 做了什麼」之外,冒出了一個我覺得很有意思的思路: 「既然 Fable 5 額度有限、7/7 之後就按量計費,那與其拿它做日常任務,不如用它的判斷力來建立制度——寫好規則、查核清單(checklist)、評量表(rubric),讓之後的便宜模型照著跑。」 然後網路上 …閱讀更多

Car vs F1
AI

12 萬字的 AI 靈魂,打開一看是產品說明書—從 Claude Fable 5 的系統提示詞洩漏,聊聊「角色扮演」和「實際能力」的差距

上週(6/10),知名越獄研究者 Pliny the Liberator 在 X 和 GitHub 上發布了一份文件,號稱是 Anthropic 最新旗艦模型 Claude Fable 5 的完整 系統提示詞(system prompt)。 12 萬字。1,585 行。約 27,000 tokens。 當大家還在細細品味這份文件時,美 …閱讀更多