AI 與科技新聞摘要 20260709 — 這週的大玩家,都把方向盤交到了別人手上
想像一家車廠做好了一台新車,引擎、底盤、路測全部到位,隨時能開上路。但它不能自己決定哪天發車——得先把鑰匙送到監理單位,等對方跑完一輪測試、點頭,才准掛牌。這在汽車業聽起來很正常。但如果我告訴你,這週全世界最強的 AI 模型,就是這樣上市的,你可能會愣一下。 這週六則新聞表面上各走各的:一款新模型、一樁世紀合作、一顆新晶片、一輪破紀錄募資、一份公開的憲法、一道行政命令。但把它們並排看,會發現一個安靜卻要命的共同點——這個產業裡好幾個握著方向盤的人,這週都把手鬆開了,把方向交給了別人。有的是被拿走的,有的是自己遞出去的。差別很大,後果一樣值得盯著。 一、GPT-5.6 上線,但它得先過政府那一關OpenAI 在 7/9 讓 GPT-5.6 全面上線,一天內推到 ChatGPT、Codex 和 API。這次改了命名法:數字是世代,後面的 Sol、Terra、Luna 是能力層級——Sol 旗艦、Terra 日常、Luna 最快最便宜。API 價格從 Sol 的 $5/$30(每百萬 token 輸入/輸出)一路下探到 Luna 的 $1/$6,...
VibeVoice — 處理長音訊最好的辦法,是根本不要切它
以前要把一段一小時的會議錄音轉成逐字稿,工程師的第一個動作幾乎都一樣:切。 先寫一段程式把音檔切成 30 秒一塊,一塊一塊丟進模型,再把吐出來的文字拼回去。聽起來很合理,直到你發現拼縫處全是坑——一句話被切成兩半,前半段的語氣模型看不到,後半段就認錯字;換人講話的瞬間剛好落在切點上,兩個人的聲音被混成一個;講到第 40 分鐘冒出來的專有名詞,模型早忘了第 5 分鐘鋪陳過的上下文。你花在對齊、去重、補接縫的時間,往往比跑模型本身還久。 微軟研究院 2025 年開源的 VibeVoice,做的事情很簡單,簡單到有點反直覺:它不切。一次讀完整段。TTS 一口氣生成 90 分鐘語音,ASR 一次辨識 60 分鐘音訊,中間不切、不拼、不對齊。 為什麼「不切」以前做不到,現在做得到不切這件事,不是有人終於想通了才去做,而是以前真的做不到。長音訊塞不進模型的上下文窗口——一分鐘的音訊如果照傳統做法編碼,token 數量大到誰的窗口都裝不下,只能切。切是被逼的,不是選的。 VibeVoice 拆掉這道牆的方式,是先問一個更底層的問題:一段音訊,到底需要多少 token 才描述得清楚? 它的答案低...
Claude Code 設定檔為什麼長成五層 — 你那條沒生效的規則,是被誰蓋掉的
Claude Code 剛裝好的時候,設定這件事簡單到你不會多想:一個檔案,~/.claude/settings.json,你要改什麼都往裡面丟。改個預設模型、加幾條權限、設個環境變數,存檔,搞定。 然後有一天,你在 settings.json 裡明明白白寫了一條規則——比方說禁止某個危險指令——結果 Claude Code 完全當它不存在。你檢查了三遍,拼字沒錯、括號沒漏、JSON 也合法。它就是不甩你。 大部分人這時候的第一反應是「壞了」。但九成九的情況,它沒壞。你那條規則好端端地在那裡,只是被另一個地方的設定給蓋掉了。而「另一個地方」有幾個,這就得從設定檔怎麼一路長成今天這副模樣講起。 一個檔案不夠用的那一天先回到最單純的狀態:全世界只有你一個人用 Claude Code,所有設定放在 ~/.claude/settings.json。這個檔在你的家目錄底下,跟著你這個「使用者」走,所以官方叫它 User 層。你開任何專案,它都在。 這套在你單打獨鬥時完美無缺。問題出在你把 Claude Code 帶進團隊的那一刻。 你替專案調了一組很順手的權限規則——哪些指令可以自動跑、哪...
AI 與科技新聞摘要 20260708 — 這週的錢在同一個圈子裡繞,帳單留給了不在場的人
先問你一個問題:這週在 AI 圈流動的每一塊錢,最後是從誰的口袋裡出的? 表面上答案很清楚——OpenAI 花錢、Anthropic 賺錢、微軟撒錢、Intel 裁人省錢。每一筆都有明確的收付雙方。但如果你把這六則新聞一則一則翻到背面,會發現一件不太對勁的事:錢其實一直在同一小群人之間繞圈。雲端巨頭投資模型公司,模型公司拿錢回頭跟雲端巨頭租算力,算力廠再拿這筆訂單去撐自己的估值,估值又變成下一輪投資的籌碼。圈子轉得越快,帳面越漂亮。 而真正付帳的那些人——被裁的工程師、還沒修漏洞的公司、相信「這張估值紙還值錢」的後進場者——一個都不在這個圈子裡。 這很像一場擊鼓傳花。音樂放著的時候,每個人手上的花都在增值,沒人想當停下來時抱著花的那個。這週的六件事,剛好是六個把花往下一個人手裡塞的動作。 一、OpenAI 想讓美國政府當股東,持股 5%據《FT》報導,OpenAI 向白宮提議,讓聯邦政府以約 426 億美元(對應 8,520 億估值的 5%)取得股權,還主張所有領先的美國實驗室——Anthropic、Google、Meta——都比照讓渡同樣比例,匯進一個仿阿拉斯加永久基金、對全民...
Java ThreadLocal — 解決搶同一份資料最好的辦法,是讓大家根本沒得搶
解決多執行緒搶同一份資料的最好辦法,常常是讓他們根本沒東西可搶。 聽起來像廢話,但這句話背後藏著一個一直被名字誤導的工具。ThreadLocal,名字裡明明白白寫著 Local,很多人第一次看到都以為它是拿來做「執行緒之間安全地共用某個東西」的。字面上「執行緒本地」,感覺就是一個放在執行緒層級、大家一起用的儲存格。 結果它幹的事,跟你想的剛好相反。 它不但沒有讓大家共用一份,反而是替每一個執行緒偷偷發了一份獨立的副本。你以為在存取同一個變數,其實每個執行緒摸到的都是自己那份,彼此看不見、也不會踩到對方。所謂執行緒安全,它不是靠「把共用的東西鎖好」達成的,而是靠「乾脆不共用」——沒有共享,就沒有競爭,連鎖都不用上。 這篇就從這個反直覺的點一路拆下去。你會看到它底層到底怎麼做到「一人一份」,為什麼這招在某些場景反而會漏記憶體漏到你哭,以及它到底該用在哪、不該用在哪。 先搞懂:解決搶資料,本來就有兩條路多執行緒的麻煩幾乎都長一個樣:好幾個執行緒同時要動同一份資料,讀到一半被別人改掉,或是兩個同時寫,最後結果對不上。 處理這件事,傳統上大家想到的是加鎖。想像辦公室只有一支簽字筆,誰要簽名...
Claude Code Channels 完整教學 — 讓 CI 警報和聊天訊息自己推進你正在跑的會話
你按下 deploy,看著 CI 開始跑,然後轉頭去吃午餐。回來的時候,terminal 還開著,Claude Code 也還在,但螢幕上什麼都沒發生——因為 build 在你咬第一口便當的時候就炸了,只是它不知道。它就這樣,乾等了你四十分鐘。 這台號稱能自己 debug、自己寫測試、自己修 code 的機器,真正的問題不是不夠聰明。是它的眼睛只盯著一個地方:你的鍵盤。你不打字,它就當作世界什麼都沒發生。 Claude Code v2.1.80 之後有個叫 Channels 的功能,處理的就是這件事——讓外面發生的事,自己推進你正在跑的那個會話。今天來拆它怎麼用、為什麼是「推進現有會話」這幾個字最關鍵,以及它跟你已經知道的那些遠端功能差在哪。 先看清楚卡點在哪Claude Code 的互動模型,從第一天到現在都是同一個方向:你來找它。你開會話、你打字、你把噴出來的錯誤複製貼回去。它再厲害,本質上也是一個等你開口的工具。 這在你坐在電腦前的時候完全沒問題。問題出在你不在的時候。 CI 半夜炸了,沒人管,等你早上起來才發現卡了八小時。同事在 Discord 問「欸那個 API 你改好...
AI 與科技新聞摘要 20260707 — 這週在重新標價的,是那些你看不見的節點
這週的頭條看起來各走各的——一起勒索攻擊、一樁兩百多億的股票掛牌、一筆六百億的收購、一份聯合國峰會的閉幕警告。但把它們的價目表並排放,會發現講的是同一件事:有些東西的價錢正在崩到接近零,有些正在貴到反常,而決定這兩頭的,往往是一些你平常根本不會去想的節點。 一個系統最脆弱的地方,通常不是它最顯眼的部分,而是它把重量偷偷壓上去、你卻沒在看的那幾根柱子。這週的六則新聞,剛好各自幫一根柱子標了價。 一、史上第一起「AI 代理全自動」勒索攻擊,但它仍然需要一個人類資安公司 Sysdig 公布了一起代號 JADEPUFFER 的攻擊,稱它是首例「由 LLM 端到端驅動」的勒索行動。攻擊者透過一個未修補的漏洞打進對外的 Langflow 伺服器,接下來的偵察、竊取憑證、橫向移動、提權、加密,全交給 AI 代理自主完成——中間一次「登入失敗到修好」只花了 31 秒,而且程式碼裡塞滿自我解說的自然語言註解(人類駭客不會這樣寫,但 LLM 預設就會)。 有意思的是兩個反轉。第一,加密用的金鑰是隨機生成、印到畫面後從沒被保存或傳出,等於受害者就算付錢也救不回,本質比較像破壞而非勒索。第二,TechC...
Java 動態代理 — 你每天用的 Spring AOP 和 MyBatis Mapper,底層都是同一招
你寫了一個介面,叫 UserMapper,裡面宣告一個方法 findById。沒有寫任何一行實作。然後 @Autowired 把它注進來,呼叫 userMapper.findById(1),資料庫真的回你一筆資料。 停一下。這個方法的實作在哪裡? 介面不能被 new,這是 Java 的鐵則。UserMapper 沒有任何一個 class implements 它。那你手上這個能跑的 userMapper 物件,到底是誰生出來的? 答案是:它是在程式跑起來那一刻,才被「現場捏出來」的一個類別。捏它的那一招,叫動態代理。而且不只 MyBatis,你每天在用的 @Transactional、@Async、Spring AOP、各種 RPC 框架,底層插進來的都是同一招。搞懂它,這些框架的魔法會一次全部除魅。 先別急著問它能幹嘛。先看它到底在幹嘛。 代理是什麼:先想像一個經紀人假設你想找某個很紅的明星談合作。你不會直接打給本人——你打給他的經紀人。經紀人接了電話,先登記你是誰、要幹嘛,過濾掉一些莫名其妙的邀約,該收訂金的先收,然後才把訊息轉給明星本人。事後還幫忙記帳。 明星還是那個明星,...
Claude Code 的 MCP,你大概只用了三分之一:把被冷落的 Prompts 和 Resources 撿回來
先別管 MCP 能接多少工具、能串多少服務。先問一件更基本的事:當你接上一個 MCP server 的那一刻,Claude Code 到底從它那裡拿到了幾種東西? 大部分人的答案是「一種」——工具。你接了 GitHub server,就叫它開 PR;接了資料庫 server,就叫它查資料。工具(Tools)確實是 MCP 最常被用到的部分。但如果你只用到工具,那你手上這台機器,其實只發動了三分之一。 把 MCP 拆開,裡面有三個抽屜MCP 這個協定,設計上暴露給你的不是一種介面,是三種。官方把它們叫做三個 primitives:Tools、Resources、Prompts。它們最關鍵的差別不在「能做什麼」,而在一個你大概沒想過的問題上——這東西是誰決定要用的? 工具(Tools),是模型決定要不要用的。你說「幫我開個 PR」,Claude 自己判斷「這需要呼叫 GitHub 的 create_pr 工具」,然後就去按了。決定權在 AI 手上。 資源(Resources),是你或應用程式決定要不要用的。它是一份唯讀的資料——一個檔案、一張資料表的 schema、一則 issue ...
AI 與科技新聞摘要 20260706:當實驗室開始賣「還沒到手的成果」
把這週的幾則新聞攤在同一張桌上,會看到一個不太舒服的共同點:越來越多前沿實驗室,開始把「還沒發生的成果」拿出來當「已經到手的成果」講。有人是對股東講,有人是對員工講,有人是對整個市場講。差別只在——誰的牛皮還撐得住外界去戳。 一、Anthropic 不只賣鏟子了,它自己下海挖金礦Anthropic 在舊金山發表了 Claude Science,一個給科學家的 AI 工作台,整合了 60 幾個科學資料庫,每個產出都帶著「可稽核歷史」讓人重現。這部分是好事,一位 UCSF 的研究者用它幾分鐘就揪出一個資料集裡的病毒污染——那個東西他們用傳統方法找了一年沒找到。 真正值得盯著看的是第二件事:Anthropic 同時宣布自己要做新藥開發,專攻傳統藥廠不想碰的「被忽視疾病」。這是頂尖模型實驗室第一次,從「賣工具給藥廠」跨到「自己找藥」。 賣鏟子的人開始自己挖金礦,聽起來很勵志,但地基裡埋了一個問題。藥廠把最敏感的研究資料交給這個平台的同時,這個平台自己也想做藥。今天沒事,是因為大家還在蜜月期;哪天利益真的撞上,你會希望自己不是那個把家當都搬進去的客戶。消息一出,Schrödinger 盤中...














