人工智慧新聞 2026年8月25日

人工智慧新聞綜述及測驗:2026年8月25日

Jalapeño 的首批結果顯示,其在人工智慧推理方面擁有業界領先的速度和效率。

OpenAI 公佈了其客製化推理晶片 Jalapeño 的首批效能測試結果。在 GPT-OSS 120B 測試中,該晶片的每千瓦峰值吞吐量比對比系統高出約 1.9 倍,端對端延遲則降低了約1.7 倍。

這些優勢也延續到了 DeepSeek R1 和 Kimi K2.5 上。 OpenAI 計劃將 Jalapeño 部署到其自身的運算基礎設施中,而第二代和第三代的設計也已在進行中……所以,是的,OpenAI 也逐漸成為一家晶片公司,某種程度上來說。 (OpenAI

Claude Cowork 終於想起了你在聊天中告訴應用程式的話

Anthropic 將 Claude 的記憶功能整合到日常聊天和 Cowork 平台中。使用者現在可以將對話中獲得的資訊應用到自主任務中,從而避免反覆解釋同一項目帶來的煩躁。. 

使用者可以查看、編輯和刪除已儲存的話題,對話進行過程中,記憶內容也會隨之更新。此功能在免費版、專業版和高級版套餐中預設為啟用。 (TechCrunch

Google Cloud推出法律產業的Gemini Enterprise。

Google Cloud 為律師推出了一款專門打造的 Gemini Enterprise 套餐,使其代理的功能不再局限於普通聊天,而是擴展到合約審查、法律研究、監管監控、隱私請求和文件起草等領域。.

它包含與 Harvey、iManage、DocuSign、RelativityOne 和 Thomson Reuters 等平台的連接器,同時保留了企業現有的存取控制和倫理障礙。人工智慧代理的「土地爭奪戰」已經波及到法務部門……不出所料,但速度仍然很快。 (Google雲端新聞中心

Google Cloud 為金融服務推出 Gemini Enterprise

谷歌還推出了專門針對金融領域的 Gemini Enterprise 產品,其中包括託管金融研究代理、 50 多項專業技能 以及 13 個 金融和市場數據系統連接器。

該平台的目標工作流程包括信用風險評估、投資組合監控、KYC 研究和市場分析。芝加哥商品交易所集團 (CME Group) 和德意志銀行等機構已率先參與其中——企業代理正變得越來越專業化,幾乎就像穿著西裝的軟體。 (Google雲端新聞中心

NVIDIA 發布 Jetson Orin Nano 2 機器人計算機,重新定義入門級邊緣人工智慧

英偉達推出了 Jetson Orin Nano 2,這是一款面向機器人、無人機和其他實體人工智慧系統的緊湊型電腦。它擁有 每秒 78 兆次運算的速度、8GB 記憶體和八核心 Arm CPU。 

英偉達表示,與上一代 Nano Super 相比,其推理性能翻了一番,而達到相同性能所需的 功耗降低了 40%。更小型的模型能夠在緊湊的硬體上真正發揮作用,這才是關鍵所在——人工智慧不再總是需要連接到龐大的資料中心。 (英偉達新聞中心

Perplexity 與 Nvidia 合作推出 Portable Computer,這是一款完全在地化的 AI 代理,無需代幣成本。

Perplexity 推出了 Portable Computer,將其基於代理的電腦體驗帶到了由 Nvidia 顯示卡驅動的本機硬體上。模型、文件和代理執行過程都可以保留在使用者的電腦上,本地完成的工作不會消耗 任何雲端費用

任務首先在本地執行,系統會在升級到前沿雲端模型之前徵求許可。它基於配備足夠強大的 RTX GPU 的 Nvidia DGX Spark 和 Linux 系統啟動——隱私和成本突然成為本地 AI 的賣點,而不僅僅是速度。 (Venturebeat

根據《華爾街日報》報道,Anthropic公司預計將告訴投資者,其潛在營收超過30兆美元。

據報道,Anthropic公司正準備告知投資者,其潛在市場規模可能超過 30兆美元。需要注意的是,這指的是如果人工智慧能夠完成相關工作,其理論上的年度市場規模,而不是Anthropic公司預測其未來將創造30兆美元的收入。 (路透社

這個龐大的數字有助於理解Anthropic的基礎設施支出、它與OpenAI和Google的競爭,以及更廣泛的投資者故事。即使以人工智慧產業的標準來看,這也是一個驚人的數字。 (路透社

常問問題

OpenAI 的墨西哥辣椒晶片測試結果對人工智慧推理意味著什麼?

OpenAI 表示,在運行 GPT-OSS 120B 時,Jalapeño 的每千瓦峰值吞吐量和端到端延遲均優於其對比系統。 DeepSeek R1 和 Kimi K2.5 也取得了類似的提升。這些結果表明,OpenAI 越來越傾向於圍繞大規模 AI 推理的特定效率和速度需求來設計硬體。.

Claude 的共享記憶如何在聊天和 Cowork 之間運作?

現在,Claude 可以將日常對話中獲得的資訊匯入 Cowork 任務中,從而減少重複解釋相同項目或背景的需要。使用者可以查看、編輯和刪除已記住的主題,這些記憶也會隨著對話的進展而不斷更新。根據文章中提到的公告,該功能在免費版、專業版和高級版套餐中均預設為啟用。.

Gemini Enterprise for Legal and Financial Services 能做什麼?

Google Cloud 的 Gemini Enterprise 專業解決方案是針對特定產業的業務流程,而非通用的 AI 聊天。法律服務版涵蓋合約審查、研究、監管監控、隱私請求和起草等領域,而金融服務版則支援信用風險評估、投資組合監控、KYC 研究和市場分析等業務流程。兩者均可與現有的專業數據和軟體系統對接。.

為什麼本地人工智慧推理變得越來越重要?

本地AI推理可以增強隱私保護,降低對雲端基礎設施的依賴,並有可能降低持續使用成本。英偉達的Jetson Orin Nano 2面向機器人、無人機和其他邊緣系統,而Perplexity的便攜式電腦則將模型、檔案和代理執行保存在相容的本地硬體上。在許多工作流程中,雲端模型可以保留給需要更強大功能的任務使用。.

Perplexity便攜式電腦如何決定何時使用雲端AI?

任務設計為在使用者本地的Nvidia顯示卡硬體上啟動,從而將相容的模型執行和檔案保留在本機。如果某個步驟需要使用前沿的雲端模型,系統會在升級作業前徵求使用者的許可。本地完成的工作不會消耗雲端計費額度,因此這種方法非常適合既關注隱私又關注重複推理成本的使用者。.

Anthropic公司報告的30兆美元人工智慧市場估值意味著什麼?

報告中提到的數字指的是Anthropic公司對人工智慧潛在市場規模的看法,並非預測Anthropic公司本身每年將創造30兆美元的收入。它代表的是人工智慧可能在整個經濟領域解決的工作量的理論價值。這項估算也有助於解釋為什麼領先的人工智慧公司要大力投資基礎設施和企業級能力建設。.

昨日人工智慧新聞:2026年8月24日

在官方人工智慧助理商店尋找最新人工智慧產品

關於我們

人工智慧新聞與產業發展測驗
1. OpenAI 報告稱,其定制的 Jalapeño 推理晶片運行 GPT-OSS 120B 後,性能提升了多少?

2. Anthropic 是如何更新 Claude 在常規聊天和 Cowork 中的記憶體功能的?

3. NVIDIA Jetson Orin Nano 2 的主要規格和性能亮點是什麼?

4. Perplexity 的便攜式電腦如何管理本地和雲端混合執行?

5. Anthropic 報告的 30 兆美元數字究竟意味著什麼?


返回博客