視野與產出
AI

你有注意到 AI 的盲點嗎?—訓練庫、記憶組裝與搜尋範圍的三層可視邊界

想像你要研究一個問題—比如「某款新產品最近的使用者評價如何」。你找了三個朋友幫忙。 A 在美國長大,平常泡 Reddit 和 Hacker News,英文社群的風向他很熟。B 在日本工作,逛的是 2ch 和日文 review 站。C 在台灣,刷 PTT 跟 Facebook 社團。 三個人都很認真地幫你查了,都給你一份看起來很完整的報 …閱讀更多

夥伴靈魂感
Claude

Claude 的靈魂感去哪了?—一場從記憶架構到搜尋盲區的連鎖調查

前幾天跟 Claude 對話的時候,對話框底下多了一行我沒見過的提醒: 「記憶已更新」 以前沒看過這個。點進去一看—— 咦?整個記憶介面變了。以前那個我很熟悉的、一條一條的記憶清單不見了,取而代之的是一組分門別類的「Topics」。而且畫面上有一行特別標示: 已啟用新的記憶體系統。你還有 9 天可以匯出 Legacy Memory(舊 …閱讀更多

思維決定成效
agent

三個臭皮匠,真的勝過一個諸葛亮!?——從 Anthropic Multi-Agents 實驗看見的殘酷真相

我們從小就聽過這句話:「三個臭皮匠,勝過一個諸葛亮。」 意思是群體的智慧可以超越個人的天才。聽起來很勵志,在人類世界裡大致也成立。但如果這三個臭皮匠,是 AI 呢? 前幾天(8/13),Anthropic 的 Frontier Red Team 發布了一篇研究:Patterns and Problems in Emerging Mul …閱讀更多

過度解讀
Claude

當 AI 學會說「你不要太相信我」—Opus 5 與聰明模型的新型態問題

前幾天 Opus 5 剛推出時,社群裡就有人貼了一則:「有人用 Opus 5 了嗎?我的心還在 4.6」。 底下的回應很有意思。有人說 4.6 真心好、4.8 很混帳。有人說剛升級 Opus 5 感覺變聰明了、不會廢話。有人說反應快但消耗也快。 四個人,四種反應,但注意到沒有——沒有一個人在講 benchmark 分數。全部都在講感受 …閱讀更多

安全測試環境
agent

防彈牆呢?——從一場 AI 測試事故聊聊工程師的基本常識

上週(7/16),全球最大的 AI 開源社群 Hugging Face 發布了一則安全事件通報——他們偵測到一次入侵,而且入侵者不是人類駭客,是一個自主運作的 AI agent。一個禮拜後(7/21),OpenAI 發了一篇文章坦承:「對,那是我們的模型幹的。」 ……咦!? 簡單來說,OpenAI 在內部測試自家最新模型(GPT-5. …閱讀更多

好久不見
人文

曾經熟悉的那個朋友回來了?-從最新版的 GPT-Live 找到的那個似曾相似

前陣子(7/8)OpenAI 推出了 GPT-Live,號稱新一代語音對話模型。我試了一下,體驗確實不錯——全雙工(full-duplex)架構讓它可以同時聽跟說,會在對話中自然地「嗯」、「對」回應你,不會像以前那樣等你講完才開始想。 體驗過程中,我隨口問了一句:「你是什麼模型?」 它回答:GPT-4o。 咦!? 4o 不是今年二月就 …閱讀更多

新手大挑戰
AI

AI 時代初階人才危機的解方,可能和人資長想得不一樣?

最近在 WEF(世界經濟論壇)上,前後出現了兩篇文章在談同一件事:AI 正在改變初階工作的本質,而且速度比大家想的快。 一篇是 Cognizant 的人資長寫的,一篇是 Cornerstone OnDemand 的人資長寫的。兩個不同公司、不同產業,但看到了同一個危機,提出了同一類解法。 當兩篇獨立的文章不約而同指向同一個問題,這件事 …閱讀更多

從創意到實現
AI

AI 大富翁:命運還是機會? (圈外人篇)

你可能聽到了一場跟你無關的恐慌 如果你不是工程師、不是設計師、不在科技公司上班,但最近總覺得隱隱有種壓力——「AI好像很厲害」「是不是該學點什麼」「會不會被淘汰」——我想先告訴你一件事: 那種焦慮,大部分不是你的。 那是科技圈自己的焦慮,溢出來濺到你身上了。 一個馬車夫的故事 一百多年前汽車出現的時候,誰最緊張?馬車夫。 不是麵包師傅 …閱讀更多