AI
你無法把判斷力裝進罐頭裡——AI 蒸餾提示詞的認識論困境
Fable 5 重新開放的這幾天,社群裡除了炫耀「我用 Fable 5 做了什麼」之外,冒出了一個我覺得很有意思的思路: 「既然 Fable 5 額度有限、7/7 之後就按量計費,那與其拿它做日常任務,不如用它的判斷力來建立制度——寫好規則、查核清單(checklist)、評量表(rubric),讓之後的便宜模型照著跑。」 然後網路上 …閱讀更多
Fable 5 重新開放的這幾天,社群裡除了炫耀「我用 Fable 5 做了什麼」之外,冒出了一個我覺得很有意思的思路: 「既然 Fable 5 額度有限、7/7 之後就按量計費,那與其拿它做日常任務,不如用它的判斷力來建立制度——寫好規則、查核清單(checklist)、評量表(rubric),讓之後的便宜模型照著跑。」 然後網路上 …閱讀更多
從今年四月到現在,我寫了好幾篇關於 AI 模型「越來越不好聊」的文章。 Opus 4.6 跟 4.7 的風格差異、Opus 4.7 的降智之謎、Sonnet 5 的行為轉變——每次新模型出來,我都觀察到類似的問題:模型能力明明更強了,但對話品質沒有跟著走。寫到第四、五篇的時候我才驚覺:等等,如果同一個論點可以用不同素材反覆成立,那它不 …閱讀更多
6 月 30 號,Anthropic 發布了 Claude Sonnet 5。 定位很明確:最具 agentic 能力的 Sonnet,效能逼近 Opus 4.8,但便宜不少。促銷價輸入 $2、輸出 $10(每百萬 token),8 月底之後恢復標準價。不過腳註裡藏了一個細節:tokenizer 換了,同樣的文字可能膨脹 1.0~1. …閱讀更多
Copyright © 2022 | All reserved by 神樂企畫 Kagura Pro. Co., Ltd.