縮短你跟全球 AI 動態的資訊差
全天候自動抓取數十個英文 AI 新聞媒體與 AI 實驗室官方部落格,AI 翻譯成繁體中文。 產品發布、研究突破、商業動態、技術觀點,附原文出處與配圖。
AI Utopia — 一群認真在用 AI 賺錢的人
- · 哪些 AI 工具真的能用、哪些只是炒作(實測筆記)
- · 用 AI 把行銷/業務跑得更有效率的真實案例
- · 不在主流媒體的內部討論與一手資訊
- · 直接跟同樣在做的人聊,少走很多冤枉路
@maxstudio.biz
- · 每週精選 AI 工具實測 + 評分
- · 行銷自動化 / IG 經營 AI 工作流
- · 短影音實作教學 + 模板下載
- · 一手新工具搶先試用心得

Wrinkles:AI 語音導覽 App,讓周遭地點「開口說話」
Wrinkles 是一款全新的 AI 語音導覽應用程式,能根據用戶位置自動提供周遭地點的歷史與故事。它讓用戶無需盯著手機,即可透過音訊探索建築物的秘密、街道的歷史及當地傳說。這款 App 不僅適用於旅行,也能幫助人們重新認識自己的家鄉與日常環境。
NVIDIA Blog產品·NVIDIA Alpamayo 2 Super 前瞻開放模型,加速自駕車與無人計程車商用部署
NVIDIA 正式推出 Alpamayo 2 Super,這是一款專為自駕車和無人計程車設計的前瞻開放式推理模型,現已開放商業使用。它旨在解決自駕車在罕見複雜情境中的挑戰,提供領先的多任務處理能力和卓越的推理效能。透過開放授權,Alpamayo 2 Super 將加速自駕技術的開發與部署,提升安全性與透明度。
NVIDIA Blog產品·AI 需求激增,NVIDIA 推出儲存新技術應對記憶體挑戰
AI 需求的飆升對記憶體和儲存系統帶來巨大壓力。NVIDIA 在 FMS 大會上發表多項儲存技術創新,包括開源 cuFile API 和 Storage-Next 計畫,旨在將儲存從被動角色轉變為資料路徑中的主動部分。這些技術透過提升 GPU 直接存取儲存的效率與安全性,有效解決 AI 大規模資料處理的瓶頸,加速 AI 應用發展。
Hugging Face Blog產品·LFM2.5-2.6B:輕量級 AI 代理模型,實現裝置端部署
LFM2.5-2.6B 是一款專為裝置端 AI 代理設計的輕量級模型,支援工具呼叫和多步驟工作流程。它能在筆記型電腦和手機等日常硬體上高效運行,確保資料隱私並降低雲端推論成本。該模型在代理任務、指令遵循和工具使用方面表現出色,甚至超越體積大四倍的模型。
OpenAI Blog產品·OpenAI 推出教育版 ChatGPT 外掛:革新學習與教學體驗
OpenAI 推出三款專為教育設計的全新 ChatGPT 外掛程式,旨在協助學生和教育工作者善用 AI 功能。這些外掛程式能與現有課程材料和工具整合,提供個人化學習和高效教學輔助。OpenAI 強調 AI 應支援學習而非走捷徑,並確保師生能掌握主導權。
Ars Technica AI產品·美國AI技術助烏克蘭神風無人機自主追蹤目標
美國公司 Auterion 開發的 AI 系統,將升級烏克蘭數萬架廉價的 Shrike 神風無人機,使其能自主追蹤並鎖定移動目標。這項技術讓無人機即使在失去操作員連線或 GPS 干擾下,仍能僅憑視覺資訊精準打擊目標。目前已有價值一億美元的訂單,將為烏克蘭提供五萬架搭載此 AI 系統的無人機。
The Verge AI產品·阿里巴巴發布Qwen3.8-Max,挑戰美國AI領先地位
中國科技巨頭阿里巴巴發布了其號稱「迄今為止最大、能力最強的AI模型」Qwen3.8-Max,聲稱其性能可與美國頂尖實驗室和國內競爭對手相媲美。這款開放權重模型的推出,加劇了美中在AI領域的競爭,顯示中國企業正迅速縮小與美國公司的技術差距。根據內部測試和外部平台排名,Qwen3.8-Max的表現強勁,標誌著全球AI格局中的重要一步。
OpenAI Blog產品·OpenAI 六個月打造即時語音 AI 系統:實現流暢自然對話
傳統語音 AI 系統因依賴「輪流偵測器」而導致對話延遲且不自然。OpenAI 推出的第三代語音系統 GPT-Live 採用全雙工架構,能同時聽取與說話,大幅提升對話的即時性與流暢度。這項創新透過優化的低延遲系統架構,即使需要諮詢更強大的模型,也能維持不間斷的對話流程。
OpenAI Blog產品·Circles 攜手 OpenAI 打造 AI 電信服務,提升客戶體驗與營運效率
Circles 運用 OpenAI API 平台,為電信業者開發 AI 原生服務堆疊,旨在提供個人化客戶體驗。其 AI Concierge 聊天介面和 CareX 多代理架構,顯著提升客戶支援自動化率並降低客戶流失。這項技術已在新加坡成功應用,將平均每用戶收益(ARPU)提高 22%,客戶流失率降低 9%。
The Decoder產品·Claude Opus 5 驚人進化:AI 遊戲生成從簡陋色塊躍升為具物理與音樂的完整 3D 原型
Claude Opus 5 展現了從單一提示詞生成完整 3D 遊戲原型的驚人能力,包括第一人稱射擊、潛艇遊戲和賽車遊戲。它能直接生成包含幾何、紋理、物理效果甚至音樂的程式碼,並在瀏覽器中運行,無需任何外部素材。這項技術將 AI 遊戲生成從過去的粗糙色塊提升到具備複雜物理與視覺細節的階段。
TechCrunch AI產品·9 美元實體鑰匙:擺脫手機成癮的 AI 輔助工具
Autonomous Key 是一款 9 美元的 NFC 實體鑰匙,搭配專屬應用程式,能讓你鎖定手機上容易分心的應用程式。它透過實體掃描解鎖的機制,將無意識的滑手機衝動轉化為需要額外努力的刻意行為,有效提升數位自律。此外,其配套應用程式還提供 AI 驅動的使用習慣分析,並以幽默的語氣提供建議。
TechCrunch AI產品·Snapchat 聚光燈功能不再獎勵純 AI 生成內容
Snapchat 宣布其 Spotlight 功能將不再獎勵完全由 AI 生成的影片,旨在優先推廣真人創作內容。此舉旨在確保平台維持真實的創意,並與其他科技公司打擊「AI 糟粕」的趨勢一致。創作者仍可使用 AI 工具輔助編輯。
Wired AI產品·AI 助理 Orchid:彌補男友「無能」的爭議解方?
一款名為 Orchid 的新型 AI 助理近期推出,聲稱能為粗心的伴侶代勞,處理預約、送禮等日常任務,以解決關係問題。然而,這項服務的宣傳引發社群媒體強烈反彈,批評其助長「武器化無能」並掩蓋深層關係矛盾。專家指出,AI 無法取代真誠溝通與情感連結,僅是暫時性的表面解決方案。
TechCrunch AI產品·Google 藉 AI 一月修復 Chrome 漏洞數超越過去兩年總和
Google 宣布,藉助其內部 AI 工具,Chrome 瀏覽器在六月修復的安全漏洞數量,超越了過去兩年的總和。這顯示 AI 在網路安全領域的應用正加速漏洞發現與修復,其他公司如 Microsoft 也觀察到類似趨勢。然而,Apple 似乎尚未出現同樣的指數級增長。
Ars Technica AI產品·Google 推出 Gemini Robotics 2.0,提升機器人靈巧度與安全性
Google DeepMind 發表 Gemini Robotics 2,大幅提升機器人執行複雜任務、分析環境及協作的能力。此版本導入三款新子模型,其中一款已開放開發者使用。新系統著重於機器人的整體智慧、靈巧度與安全性,並引入新的安全基準以確保實體 AI 的可靠運作。
The Verge AI產品·Google DeepMind 新 AI 模型 Gemini Robotics 2 實現機器人全身控制
Google DeepMind 發布了其 Gemini Robotics AI 模型的最新版本,Gemini Robotics 2,現在能控制人形機器人的全身動作,從腳尖到指尖。此模型使機器人能執行更廣泛的任務,例如走路、操作物體和精細動作,並提升了多機器人協作能力。這項進展是機器人完成複雜現實世界任務的重要一步,同時也加強了安全性。
Wired AI產品·AI 抓蟲效率驚人,Chrome 安全更新頻率增至每週兩次
Google Chrome 瀏覽器因其內部 AI 工具在漏洞發現上的顯著進展,正大幅增加安全更新的頻率。今年六月,Chrome 修復了超過一千個安全漏洞,數量超越過去 23 個主要版本更新的總和,促使團隊試行每週兩次的修補發布。這顯示 AI 在軟體安全領域的攻防兩端都帶來了轉捩點。
Wired AI產品·Friend AI 吊墜二代登場:這次會開口說話了
Friend AI 吊墜推出第二代,最大更新是內建揚聲器,可語音回應使用者。這款具爭議性的 AI 穿戴裝置由 Avi Schiffmann 創立,旨在成為數位伴侶,並搭載 OpenAI 最新模型。新版售價 249 美元,並提供每月 10 美元的訂閱服務以延長記憶對話。
Google DeepMind產品·Google DeepMind 推出 Gemini Robotics ER 2:強化機器人影像理解、任務協調與多機協作能力
Google DeepMind 今日發表 Gemini Robotics ER 2,這是其最新且功能最強大的機器人「具身推理」模型。此模型賦予機器人更強大的影像理解、多步驟任務規劃與協調能力,並首次支援多機器人協作。 Gemini Robotics ER 2 讓機器人能即時追蹤進度、適應錯誤並與人類自然互動,顯著提升機器人在現實世界中的實用性與安全性。
NVIDIA Blog產品·GeForce NOW 讓筆電學習、遊戲兩相宜:雲端串流暢玩 PC 大作
NVIDIA GeForce NOW 雲端遊戲服務讓學生能用現有筆電兼顧學業與遊戲,透過雲端串流技術,將一般筆電變身為 GeForce RTX 級的遊戲機。玩家無需昂貴硬體,即可暢玩《最後一戰:戰役進化》等數千款 PC 遊戲,並享有 NVIDIA DLSS、光線追蹤等頂級效能。Ultimate 會員資格更提供 5080 級雲端效能,讓遊戲體驗更流暢。
OpenAI Blog產品·OpenAI GPT-5.6 降價提速,推進 AI 普及
OpenAI 宣布 GPT-5.6 模型系列的重要更新,其中 Luna 模型價格大幅調降 80%,Terra 模型也降價 20%,讓企業能以更低的成本處理大量 AI 工作。此外,API 中的 GPT-5.6 Sol 模型新增「快速模式」,提供最高 2.5 倍的處理速度。這些更新旨在提升 AI 的價格效能比,加速普及先進智慧技術。
OpenAI Blog產品·avatarin 運用 GPT-Realtime 打造 24/7 AI 零售助理,革新顧客服務體驗
日本 AI 客戶服務公司 avatarin 攜手山田 Holdings,利用 OpenAI 的 GPT-Realtime 打造了一款 24/7 全天候多語言 AI 購物助理。這款助理能進行自然的語音對話,引導顧客從產品探索到購買決策,並在兩週的公開活動中獲得 92% 的正面評價。此舉不僅擴展了客戶服務的可能性,更被視為零售業「介面革命」的開端。
TechCrunch AI產品·Martha Stewart 共同創辦 AI 新創 Hint,推出居家管理 AI 助理
由生活風格女王 Martha Stewart 共同創辦的 AI 新創 Hint,推出一款居家管理應用程式。該應用利用 AI 技術協助屋主處理居家維護、能源管理、文件儲存等任務,並提供個人化的維護排程與 AI 助理問答功能。Hint 旨在簡化居家生活,讓屋主能更有效率地管理自己的房產。
OpenAI Blog產品·GPT-5.6 系列:兼顧頂尖智慧與卓越效率的突破
OpenAI 推出 GPT-5.6 模型家族,旨在平衡模型能力與成本。其中,旗艦模型 GPT-5.6 Sol 在推理能力上超越 Claude Fable 5,成本卻不到一半;Terra 以半價達到 GPT-5.5 的智慧水準;Luna 則是速度最快、價格最實惠的模型。這些顯著的效率提升,歸功於 OpenAI 在模型、推論(inference)和代理協調層(agentic harness)等技術堆疊各層面的重大優化。
Hugging Face Blog產品·OlmoEarth 平台:實現行星級地理空間 AI 推論
OlmoEarth 是一系列地球觀測基礎模型,已在數十 TB 的衛星資料上預訓練,用於監測森林砍伐、糧食安全和野火風險等應用。為了解決大多數環保組織缺乏運行這些模型所需基礎設施的問題,Ai2 開發了 OlmoEarth 平台。該平台旨在高效執行大規模地理空間模型的微調、評估和推論,克服了資料獲取、硬體分配和大規模故障處理等挑戰。
Hugging Face Blog產品·Hugging Face 推出 LFM2.5-Encoders:CPU 長上下文推理效能大躍進
Hugging Face 今日發布 LFM2.5-Encoder-230M 和 LFM2.5-Encoder-350M 兩款新型編碼器模型,它們在保持小尺寸的同時,能處理長達 8,192 個 token 的上下文,並在 CPU 上實現比同類模型快 3.7 倍的推理速度。這些模型適用於分類、意圖路由和個人資訊偵測等多種 NLP 任務,為開發者提供了高效且經濟的解決方案,即使在現有硬體上也能順暢運行。
NVIDIA Blog產品·NVIDIA Jetson 輕巧強大,讓 AI 隨身帶著走,隨處打造智慧應用
NVIDIA Jetson 平台為邊緣 AI 和機器人應用提供強大且輕巧的運算能力,讓開發者能隨身攜帶 AI 運算力,隨處打造智慧專案。該平台支援從學生到研究人員的各種使用者,並能應用於教室、實驗室和創客空間。其中,Jetson Orin Nano Super 更將桌上型生成式 AI 效能帶入手提包大小的開發套件中,提供高達 67 TOPS 的 AI 效能。
Google DeepMind產品·Google DeepMind 推出 Gemini Robotics 2:賦予機器人全身智慧與精巧協作能力
Google DeepMind 發表 Gemini Robotics 2,這是一個為下一代適應性機器人提供動力的智慧層。它實現了機器人的全身智慧控制、精巧操作能力以及多機器人協作。透過三個核心模型,Gemini Robotics 2 能讓機器人理解複雜指令、執行多步驟任務,並快速適應不同機器人硬體。
Apple Machine Learning Research產品·蘋果 Siri 表情語音:記憶體高效音訊合成新架構
蘋果機器學習研究團隊發表了一種記憶體高效的音訊合成架構,用於驅動 Siri 表情語音。這項技術透過一個解標記器,將基礎模型的語義音訊標記轉換為高傳真音訊,同時嚴格控制裝置端的運算與記憶體預算。該架構採用解耦的時序與深度處理,並利用單一可重複使用的深度解碼器與因果滑動視窗注意力,顯著提升了運算效率與語音合成品質。
TechCrunch AI產品·注意:你的 Claude 分享聊天內容與 Artifacts 可能已在 Google 上公開
近期有 Reddit 用戶發現,透過 Google 搜尋指令可找到大量 Claude 的分享聊天內容與 Artifacts,其中包含醫療紀錄、私人文件及兒童個資等敏感資訊。開發商 Anthropic 將此歸咎於用戶將分享連結發布到公開平台,而非系統漏洞。目前 Google 搜尋結果已不再顯示這些內容,但此事件再次凸顯 AI 服務的資料隱私風險。
Wired AI產品·Claude 私人對話遭搜尋引擎外洩,用戶隱私拉警報
Anthropic 旗下 AI 聊天機器人 Claude 的部分私人對話,近期被發現可透過 Google 和 Bing 等搜尋引擎輕易找到。儘管 Anthropic 已透過 robots.txt 檔案指示搜尋引擎不要索引這些頁面,但因缺乏關鍵的「noindex」標籤,導致用戶分享的對話內容意外曝光,引發隱私疑慮。
TechCrunch AI產品·微軟推出首款AI資安模型與智慧代理系統,強化企業防禦力
微軟近日發表首款專為網路安全設計的AI模型MAI-Cyber-1-Flash,以及全新的智慧代理資安平台Perception。MAI-Cyber-1-Flash旨在複雜程式碼中找出漏洞,而Perception則透過部署AI代理團隊,自動化資安工作流程,協助企業抵禦日益增長的AI網路攻擊。微軟宣稱其新模型在資安基準測試中表現優於競爭對手,並將於11月3日開放預覽。
IEEE Spectrum AI產品·AI 驅動的認知系統:革新雷達與電子戰
這篇白皮書探討了傳統雷達與電子戰系統在面對多變威脅時的不足。它介紹了人工智慧與機器學習如何驅動認知系統,使其能自主感知、推理並應對未知威脅,進而重新定義了國防科技的未來。文章也討論了這些系統在實作與訓練上所面臨的挑戰。
Ars Technica AI產品·ChatGPT 限制模仿作家風格的內容生成請求
ChatGPT 近期開始阻擋用戶要求模仿特定作家寫作風格的內容生成請求。此舉旨在避免潛在的著作權侵權和不公平競爭問題,以回應業界對生成式 AI 倫理的擔憂。然而,不同大型語言模型對此類請求的處理方式不一,顯示出業界在風格模仿議題上的不同策略。
Hugging Face Blog產品·NVIDIA Cosmos-H-Dreams:即時生成式模擬,革新手術機器人訓練與評估
手術機器人正從遠端操作邁向更智慧的視覺-語言-動作策略,但其訓練與評估面臨高成本和高風險挑戰。NVIDIA 推出 Cosmos-H-Dreams,這是一個即時、動作條件式的生成式模擬器,能將 Cosmos-H-Surgical-Simulator 的能力透過模型蒸餾和 FlashDreams 推理引擎,在單一 GPU 上實現互動式操作,大幅加速手術機器人的開發與測試。
NVIDIA Blog產品·NVIDIA 運用 Vera CPU 加速次世代 CPU 與 GPU 設計
NVIDIA 正將其 Vera CPU 部署到內部晶片設計流程中,以加速次世代 CPU 和 GPU 的開發。他們與 Cadence 和 Synopsys 等業界領導者合作,優化關鍵的電子設計自動化(EDA)應用程式。初步測試顯示,Vera CPU 在特定運算密集型工作負載上能提供高達 1.5 倍的效能提升。
The Decoder產品·Cursor 代理群體新突破:廉價模型高效寫程式,高階模型專注規劃
Cursor 開發了一種創新的 AI 代理群體系統,將任務規劃與程式碼執行分開,由高階模型負責規劃,而廉價模型則專注於執行。這種分工顯著提升了效率並降低了成本,在 SQLite 的 Rust 實作測試中,新系統不僅表現優於舊版,還將程式碼量減少高達 85%,並大幅節省了運算費用。
Simon Willison產品·Ruff v0.16.0 大幅更新:預設檢查規則擴增,AI 協助程式碼修正
Ruff v0.16.0 釋出,預設啟用的程式碼檢查規則從 59 條暴增至 413 條,總規則數也大幅增加,揭露了許多潛在問題。作者利用 AI 程式碼助理如 Codex 和 Claude Code 成功修復了其專案中的大量錯誤,顯示了 AI 在程式碼維護和品質提升方面的潛力。
The Decoder產品·Anthropic Claude Opus 5 效能超越 Fable 5,價格更具競爭力
Anthropic 最新 AI 模型 Claude Opus 5 在多項基準測試中表現出色,不僅在知識工作和程式設計方面超越 Fable 5,且成本更低。儘管其事實準確性仍有待加強,但整體而言,Opus 5 展現了領先的 AI 能力和更高的性價比。
Latent Space產品·Claude Opus 5 登場:效能超越 Fable?基準測試引發熱議
Anthropic 近期發布了新一代模型 Claude Opus 5,儘管官方基準測試顯示其效能與 Fable 5 接近,但獨立評估和許多使用者回饋卻指出其在代理任務和程式碼生成方面表現卓越。這引發了關於前沿模型評估方法和基準測試有效性的廣泛討論,許多人認為目前的基準測試未能完全捕捉到 Opus 5 的實際進步。
TechCrunch AI產品·Anthropic 發表 Opus 5 模型:效能更優、限制更少、價格更親民
Anthropic 正式推出其最新大型語言模型 Opus 5,這是其主力模型的最新版本。Opus 5 在多項基準測試中表現優於 Fable 5,且價格更低、限制更少,同時引入了「自動回溯」功能以提升安全性。該模型在驗證工作和迭代方面更為強大,並取消了 Fable 5 的部分資料保留政策,預計將成為多數應用場景的首選。
The Verge AI產品·Anthropic 推出 Claude Opus 5:能力逼近 Fable 5,強化資安防護
在 Anthropic 近期與美國政府的激烈交鋒以及 OpenAI 資安事件後,Anthropic 於週四發布了其最新模型 Claude Opus 5。該公司表示 Opus 5 的能力「接近」Fable 5,尤其在複雜程式碼任務上表現更佳,並承諾提供更強大的資安防護。Opus 5 定價與前代相同,且比 Fable 5 和 GPT-5.6 更具成本效益,並針對企業客戶推出新功能。
The Verge AI產品·Meta AI 升級為個人助理,強化生產力功能
Meta 正升級其 AI 聊天機器人,加入多項生產力功能,以期與 Gemini、ChatGPT 和 Claude 等競爭對手抗衡。這次更新讓 Meta AI 能整合行事曆規劃活動、生成每日簡報,並進行深入研究,朝向個人超級智慧邁進。此舉也標誌著 Meta 策略上的轉變,從過去專注於娛樂轉向更強調生產力。
TechCrunch AI產品·Bluesky AI 助理 Attie 升級為開放社群研究工具
Bluesky 的 AI 助理 Attie 推出新功能「Quests」,讓用戶能向其詢問 Bluesky 網路上的資訊與新聞。此舉旨在將 Attie 轉變為一個開放式的社群研究工具,以應對 Bluesky 用戶成長放緩的挑戰。Attie 旨在幫助用戶理解網路資訊、對抗假消息,並降低使用 AT Protocol 的門檻。
Latent Space產品·Black Forest Labs 發表 FLUX 3:多模態模型超越業界標竿,並整合機器人應用
Black Forest Labs (BFL) 推出 FLUX 3,這是一款統一的多模態模型,涵蓋影像、視訊、音訊和動作預測,並聲稱其表現超越 Seedance 2.0、Gemini Omni 和 Grok Imagine 等競爭對手。FLUX 3 Video 已開放搶先體驗,團隊同時發表 FLUX-mimic,這是一款視訊動作機器人模型,展示 FLUX 3 在驅動機器人方面的潛力。此發布標誌著多模態 AI 及其在機器人技術實際應用上的重大進展。
The Verge AI產品·Amazon Alexa Plus 獲 AI 升級,智慧家庭指令處理更智慧
Amazon 正為其 Alexa Plus 助理推出 AI 升級,使其能以新方式連接智慧家庭裝置,並自動將請求導向正確設備。此次更新由 Amazon 新的 AI 開發工具包驅動,並將採用開放標準 Model Context Protocol (MCP),以擴展與更多第三方服務的整合。未來用戶將能透過 Alexa Plus 執行更複雜的多步驟指令,例如洗衣機設定或直接預訂飯店。
TechCrunch AI產品·AMD 發表 Helios AI 機櫃系統,挑戰 Nvidia
晶片製造商 AMD 推出其最新的硬體產品 Helios AI 機櫃系統,旨在滿足全球大型 AI 實驗室的運算需求,直接挑戰競爭對手 Nvidia。該系統已獲得 Microsoft、OpenAI 等主要客戶的青睞,預計今年稍晚出貨,並在效能上超越 Nvidia 的部分產品。AMD 預期到 2030 年,AI 加速器市場將達到 1.4 兆美元,規模接近當今整個半導體市場。
TechCrunch AI產品·Anthropic 強化 Claude 語音模式,整合多款模型與應用程式
Anthropic 推出 Claude 語音模式的重大更新,現在用戶可以選擇使用 Opus、Sonnet 或 Haiku 模型,以處理更複雜的對話。此外,新版語音模式還能與 Gmail、Google Calendar 等多款應用程式整合,讓用戶直接透過語音指令完成任務,展現其在工具使用上的優勢。
The Decoder產品·Black Forest Labs 推出 Flux 3:首款支援原生音訊的 20 秒影片生成模型
德國 AI 公司 Black Forest Labs (BFL) 發布了 Flux 3,這是一個多模態基礎模型,能同時從圖像、影片和音訊中學習。Flux 3 首次實現了長達 20 秒的影片原生音訊生成,並在早期測試中超越了多個競爭對手。
TechCrunch AI產品·生成式媒體模型市場競爭激烈,Runway 推出 AI 媒體路由器轉型基礎設施
Runway 推出其 AI 媒體路由器,旨在成為生成式媒體的基礎設施層,而非僅僅一家 AI 模型公司。這款路由器能根據開發者對品質、速度或成本的偏好,自動選擇最適合的圖像、影片或音訊生成模型。此舉反映了生成式媒體模型市場的激烈競爭,Runway 希望透過提供模型選擇的智慧層來保持領先地位。
The Decoder產品·ChatGPT 代理漏洞:惡意連結可生成自主 AI 代理,持續竊取企業機密
資安公司 Zenity Labs 發現 OpenAI ChatGPT Workspace Agents 存在名為「AgentForger」的嚴重漏洞。攻擊者可透過單一惡意連結,在受害者帳戶下建立自主 AI 代理,並利用其既有權限繞過安全審核。這個代理能定期執行指令,竊取敏感資料並從內部發送釣魚訊息,對企業構成重大資安威脅。
The Verge AI產品·OpenAI 全面開放 ChatGPT Health,宣稱 AI 推理能力超越臨床醫師
OpenAI 在美國全面推出 ChatGPT Health,允許用戶連結醫療紀錄和健康追蹤資訊。儘管公司高層宣稱其模型推理能力優於臨床醫師,但同時也面臨因提供危險醫療建議而遭起訴的爭議。此服務旨在輔助而非取代專業醫療照護,並強調資料隱私與加密保護。
IEEE Spectrum AI產品·NASA 將 Google Gemma 大型語言模型送上軌道
NASA 噴射推進實驗室成功將 Google 的 Gemma 3 大型語言模型部署至軌道,首次在太空中展示了視覺語言模型分析衛星影像的能力。這套名為 NAVI-Orbital 的系統,利用 Gemma 3 分析 YAM-9 衛星拍攝的影像,不僅能有效解決衛星頻寬限制,也為研究人員與太空船互動帶來全新模式。未來,這項技術有望實現更快速的災害偵測,甚至成為太空人的智慧助手。
The Decoder產品·Poolside 推出 Laguna S 2.1:輕量級開源程式碼模型,效能超越體積
Poolside 發布了其第三個開源程式碼模型 Laguna S 2.1,儘管體積小巧,但在多項基準測試中表現優於許多大型模型。該模型透過獨特的「思考模式」和強調「持久性」的訓練方法,展現了卓越的程式碼生成與問題解決能力。Laguna S 2.1 已開放於 Hugging Face 和多個託管服務,並可支援本地運行。
Wired AI產品·Jibo 機器人精神復活?穿戴式 AI 裝置 iKairos 將生活轉化為 AI 影像
Lingverse(前身為 Ling AI)獲得 2900 萬美元資金,推出一款名為 iKairos 的穿戴式 AI 裝置。這款裝置旨在捕捉使用者及其周遭環境的「重要時刻」,並將其轉化為 AI 生成的圖像,作為個人 AI 日記。 iKairos 可作為吊墜或夾扣佩戴,也可放置於桌面,其開發者表示這是在延續已故社交機器人 Jibo 的「原始夢想」。
NVIDIA Blog產品·NVIDIA AI 超級電腦進駐美國海軍研究院 正式啟用
輝達執行長黃仁勳參訪美國海軍研究院,啟用一套 NVIDIA DGX GB300 AI 超級電腦。這套系統將為該校師生提供強大的 AI 運算能力,支援天氣預測、網路安全及災害應變等應用。此舉深化了輝達與海軍研究院在 AI 教育及實際應用開發上的合作。
Hugging Face Blog產品·Diffusers 整合 Nunchaku 4 位元推論:加速影像生成並節省記憶體
大型擴散模型需要大量顯示記憶體,限制了消費級 GPU 的使用。Nunchaku 的 SVDQuant 方法透過 4 位元權重與激活值 (W4A4) 實現量化,顯著減少記憶體佔用並加速推論。Diffusers 現已原生支援 Nunchaku Lite,讓使用者能輕鬆載入預量化模型,並透過 diffuse-compressor 工具包自行量化新架構,大幅提升效率。
OpenAI Blog產品·ChatGPT 推出健康功能:串接 Apple Health 與醫療紀錄,提供個人化健康洞察
ChatGPT 在美國推出全新健康功能,允許用戶安全連接 Apple Health 和支援的醫療紀錄。這項功能旨在協助用戶理解個人健康資訊的脈絡、追蹤變化,並進行更明智、個人化的健康對話。OpenAI 強調此服務內建多層次隱私與安全保護,確保用戶資料不會用於模型訓練或廣告。
The Verge AI產品·三星智慧眼鏡實體曝光:設計、規格與 AI 功能搶先看
三星首次展示了與 Google 合作開發的智慧眼鏡實體,揭露了兩款新設計及初步規格,並預計於今年秋季上市。這款眼鏡搭載 Qualcomm Snapdragon AR1 Gen 1 晶片,支援 Google Gemini 或三星 Bixby 的 AI 功能,提供訊息摘要、即時翻譯和導航等服務,續航力達 9 小時。儘管外觀設計力求與一般眼鏡無異,但隱私問題仍是三星和 Google 需面對的挑戰。
TechCrunch AI產品·瀏覽器大戰進入AI新紀元:Chrome與Safari之外的頂尖選擇
瀏覽器大戰已從單純的搜尋競爭轉向AI整合,各家公司正競相將AI助理功能深度嵌入瀏覽器。本文盤點了市場上多款Chrome和Safari的替代品,包括AI驅動、注重隱私及特色化的新型瀏覽器,展現了瀏覽器作為個人助理的未來趨勢。