<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: Yang Goufang</title>
    <description>The latest articles on DEV Community by Yang Goufang (@yang_goufang_23c7ba674984).</description>
    <link>https://dev.to/yang_goufang_23c7ba674984</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F3808809%2Fddc4c93b-6669-4563-b8f5-ba711077aed3.jpg</url>
      <title>DEV Community: Yang Goufang</title>
      <link>https://dev.to/yang_goufang_23c7ba674984</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/yang_goufang_23c7ba674984"/>
    <language>en</language>
    <item>
      <title>AI 週報 — 2026-09-25 to 2026-10-02 | 前沿模型發布、DeepSeek 推華為晶片軟體</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 02 Oct 2026 01:27:13 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-25-to-2026-10-02-qian-duan-mo-xing-qi-fa-di-yuan-suan-li-tuo-gou-jia-su-1fp2</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-25-to-2026-10-02-qian-duan-mo-xing-qi-fa-di-yuan-suan-li-tuo-gou-jia-su-1fp2</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週兩個前沿模型發布（Gemini 4 Argon、Claude Sonnet 5.5），但真正決定採購節奏的是兩條算力軌跡與兩條安全示警——美方 Nvidia 融資路徑面臨華爾街現實檢驗、中方 DeepSeek 把華為 AI 晶片推向 Nvidia 替代位、OpenAI 公開揭露一起蒸餾攻擊（外媒點名 Moonshot）、Anthropic 對 GLM-5.3-Flash 漏洞利用鏈提出警示。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  前沿模型：兩家發布，「發布」≠「可用」
&lt;/h2&gt;

&lt;p&gt;本週 Google DeepMind 公布 Gemini 4 Argon，定位為「next era of frontier intelligence」&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNRjB3amppaF9yb1FhSmxoUW5GUEtCREcxbW1ScXJRRWN5ZGtIM0N0d21wVEI3ZTd5ZHY4N09KRWNwX3U2Z3JBeDNWakYxYXlBVE95NEpKWW5vcWFKZlA5Qkdka3hGZG9INUZtMVN2VTJhWG1TTldVSE1JVm5VaVlvcnpWRlhzX0V1NGJXZGhfMEY?oc=5" rel="noopener noreferrer"&gt;Gemini 4 Argon: our next era of frontier intelligence - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMimwFBVV95cUxNTy1GYUJlNHFZVHhVeF80WkE2ZW4zMm5PTWFIeFI5Z2NvQzQ2Rm9TbHZUdE9aT2pMZXNLZXprNVFNZkhYUzV3QU42aUlDMWswSUVIaVRiQWx4eE54czVfWlR3NW5FM3I1VE9BaEh1ZU1JN2E3QndiNC1MMmR2VG9xUkxldlpzcEFUcmR4d245U3R3Ql9SOTZQYjlLYw?oc=5" rel="noopener noreferrer"&gt;Google DeepMind unveils Gemini 4 Argon, its new frontier model - Dealroom&lt;/a&gt;。Anthropic 推出 Claude Sonnet 5.5，官方說法是比上一代快 30%&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxQOEZHRldHN1lwUzlvZDdRV25iQTBKT1BKWEc4LVVrRzIzUHJJTC1XWTBtbi0wQzhzbTVucTlDYkF6aHdtYmtsdDZZSHZjZThtampicFZVNTRBSkJXcmR2aGxCU3JESUZjSkRSWGRxMXRRYlBPVk1zemNMYXRYWElaMThyV3Jia24xNHNvalNQZkRDU2huRWpNUzZSTnFSZlJCVC1Ma0N4cEt5bEgxTFB1TmlPZ1RkUWN1eHNvVUxzT00wWTRMemc?oc=5" rel="noopener noreferrer"&gt;Anthropic debuts Claude Sonnet 5.5 running 30% faster than the previous-generation AI model - SiliconANGLE&lt;/a&gt;，並同時在為首次公開發行鋪路&lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxNUm1rcklHNVRzQnFIS2t3RnNGNDBwU25RUzJIcnFNN0FIbDNOU3VTNEhVVGprOEhNOVZISGVlWHo1NkFZX3doLUNkOU16cmlMdWotdnljUUowc19DcXJXbzFjRTI1QVFKNGtJSWNBMGdUSExIVlB3NmpVZWQ2TnBFNFpjckY1NEhOOS1BMWw1MktacnlrbFpBMDd5X2tZb0xpbVRxRlREYlRGWWE4elFr?oc=5" rel="noopener noreferrer"&gt;Anthropic rolls out second Claude 5.5 model as it builds toward IPO - Reuters&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;兩家目前最醒目的訊息是速度宣稱（Claude 「快 30%」）與命名（Gemini 「新一代」）——採購前應核對公開 benchmark、API 價格與可商用區域。決策重心應該放在 inference latency 與既有管線相容度，而非廠商命名。「快 30%」是廠商說法（官方指的是輸出生成速度），仍需獨立基準驗證，最好用自家 shadow test 確認。&lt;/p&gt;

&lt;h2&gt;
  
  
  算力供給：兩條平行軌跡
&lt;/h2&gt;

&lt;h3&gt;
  
  
  美方：Nvidia 的融資押注面臨檢驗
&lt;/h3&gt;

&lt;p&gt;TheStreet 引述 SEMI 預測，全球晶片設備銷售額將在 2028 年達到 2290 億美元——設備商在 Nvidia 出貨 GPU 之前就先收錢&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOT19zR1huWl9jWVRlb09lNEVKNEhMTGpGNVB6UHR1VHpfRDhha0J6WTgwT044bU1uYjFuYllGeTRva2ttM2VWUzY3em5QM3V0dEdXTGctdHl4aDVWWEdqOS1Qa3pSd2RrcXhPNnhvRmREMjc1dnNKZWJlTTVyTkdLR0lMMGZ3YjA?oc=5" rel="noopener noreferrer"&gt;Chip stocks set for $229 billion payday before Nvidia ships a GPU - thestreet.com&lt;/a&gt;；這是市場敘事，不是工程指標。Reuters 進一步指出，Nvidia 試圖用晶片為 AI 榮景融資的押注正面臨華爾街的現實檢驗&lt;a href="https://news.google.com/rss/articles/CBMizgFBVV95cUxPWWFtWW9YMHUyWmxwTUs1VmZnOHZNdnJBNzB6azNFSG84M0FtS2x1SE50TDZMS0ZNS25zQ1lEZnFRdnd3UFhDRXMwLUVXaDZWRW9RZHdfQXdhNjFBdEJSd243SHlselowdWpIZ3RycmRSdUhlaTlDLUVGNjV1a3UwY2llSXpiV0dvVDN2VU1tS3NmbmQzVFNXV2FZcDJzWEI5b05NRW4zRXFPOV9NZnZUMmE5M2sycEtKVUdpNjRkLW90bGtiZnY0LWtvTHRDQQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's bet that its chips can finance the AI boom gets a Wall Street reality check - Reuters&lt;/a&gt;。對技術決策者而言，這可能牽動對 Nvidia 生態供給穩定性的評估，採購合約、雲端 reserved capacity 與相對國產替代方案的風險溢酬都值得重新檢視。&lt;/p&gt;

&lt;h3&gt;
  
  
  中方：DeepSeek 把華為 AI 晶片推向 Nvidia 替代位
&lt;/h3&gt;

&lt;p&gt;DeepSeek 開源工具鏈要把華為 AI 晶片推向 Nvidia 替代位&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxOaWtGQm56WHh4UkJrYnJUaDY1bmR6TnNFOUpXckkta0RyNGNEVVJubWpjdDBRTXJQNWlwTHlEaEJjSUpDQ0dQZ2dhVllUVmtYUlYxUC1lSW5ULVdjN0lUb1p1THd3SHUxQndfS3IxUmFEZkJUODcwUlFUQUVkV2w0Q25xODc0aHZ0TDBpallCdUlvRURLWFhySVZQSHVHSnc?oc=5" rel="noopener noreferrer"&gt;DeepSeek unveils Huawei AI chip software to challenge Nvidia - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivAFBVV95cUxPZlQycWp6TUpST2t5bnViR29jRnVFY1BabjFfejhDcnFpWjFQNFJ1Y25EdjV5QlJvc2ZfWVBnUHhSSGlnY0tCd3ZQVW9JYVpYVU5lZGowY1ZJYUU0TmdabTlqV3RkUlVuazRXNzh2VGtJeG5KRVB0Y1ZWRmtkcXc3ZWQzcXBiai03UXpONmp0YWo1OVhOTkVwTmhMT3o1bmZRaENnMHUyc1hFWVF2QTg2eUtHbXJ1dk1SWFg0NQ?oc=5" rel="noopener noreferrer"&gt;China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chips - the-decoder.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQSUx6REw4bUZZeEY2ZWJqM1RYamFCY2QzWDBUWkFmQ29kVXFHWC1oTWktYXd5aF80cEdJWlJPZTlqSFFDTC1xX3AyWDBpb2VVc1ZsNVl5M1c2SkV1ZEZwUTdLcnB5d0VFaEhwc0R5YTducFdLaDcxREllbTZiTzBsdUJ5SS1ULUlqVjZMUkoxNW9ZcHZGbUk5TDEwUVhHd28zRnN3ZHpzMUc?oc=5" rel="noopener noreferrer"&gt;DeepSeek Announces a Stronger Software Integration with Huawei GPUs - analyticsindiamag.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQX2pDSnRWMTNZYUhBYnh2eHpWQklRVG1FSDJPYWF5WkI4VTM2VjQteGJTQjRNWjJ6Z3hpcVpiRGpKVjVubkNfeHFVYnY0ODIxbUJKNmFFTFVQUndibGstVDF0WnlMSTRlc0xVMWNlOFhnbEtURjRidE9GejFHdEZBckxZYkZJSzFpNnhGZ0JiS1BSTUdoanBOSGZPd1d0M2FVLVRFalYzNDZRM2NkQ0xEVzN6Rk50OUd5VjQ2NnJwZE5JUTjSAcMBQVVfeXFMT09mUUVmbnlNV0NDZUVUbmE0X0ZKUTVUbkx0RkpseW1OWEZyVHVjSmF3cUNuVG9aNTljcVhSWTVoeldqeWtVczQ0OFcwRnFTSTBOeW93bkNNX2dZTzU2amlZSUFEa1AzV29mTS1IbDA3LTFjcGV4STVUa0E1NFRRU2g4S3JyNUV6aHRsRTVwWW1YX09mMnBxRUNMbmtrV2RmRURRR2l4djBwWm53SG9ta29FTkM2OXNfaVN3aXBBWUVIeHNF?oc=5" rel="noopener noreferrer"&gt;DeepSeek opens tools to help Huawei chips supplant Nvidia in AI - South China Morning Post&lt;/a&gt;——這是「可用」層級的事件，有可下載的軟體與相容性目標，但能不能走到「可商用」要看實際 workload 在華為 Ascend 上的 throughput 與 reliability。對於不在中國市場的團隊，短期意義是「確認 Nvidia 替代方案正在成形」，中長期意義是「地緣脫鉤後的雙軌 stack 會是新的整合成本」。&lt;/p&gt;

&lt;h2&gt;
  
  
  安全與地緣：兩條相反方向的示警
&lt;/h2&gt;

&lt;h3&gt;
  
  
  OpenAI：外部攻擊者試圖拆解其加密推理鏈
&lt;/h3&gt;

&lt;p&gt;OpenAI 揭露並阻斷一起「協調式模型蒸餾攻擊」&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxQbEgxOFhvU3ZzR0JYMjZDbWhRaXlQeGoyci1PRGhfWkFhSGpER29fLXZydWRybEdpVEhUX0dCZ3pwS0ViUWRxVy1NVXZNREVfN2pOMU96c2NmSmlpY1lheUwxMGxuVjlmTV9uSkszVHU0RFhVVVNNUU42TkNjb084cThtaWc?oc=5" rel="noopener noreferrer"&gt;Disrupting a coordinated model-distillation campaign - OpenAI&lt;/a&gt;；Wccftech 則報導以 Kimi K3 聞名的 Moonshot AI 透過 16000 次請求嘗試破解 OpenAI 的加密推理&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQWXZNbU9fcDlKMFZrM0V2VWF3Q1FjWFVXZVU3ekFycWlRbkNfdkRhZndvandpRm9yTFF3bVZHQmhJamN1VFB2aXlTZkl4S1NsVFV6eHNFVnNHS1lVcGxSamduemh4Q0NtZXBHRW5STG43TjVHaDNyS2I4Qnd2TEtTN3FqaTNkb2hwRksyd0l1eDBCdTlsdlpuWWw5LWhfMG9PUGdYY3drMVZzbGNBS3pDNTROU3JwQ3ZsQThZNVFzREFfbWxXOHQ1dXBydXVRZVo5WTg5VHdBdmJGeDg0d0dXNkdodDRkS2JQTlFWeXZyMmhlZzFfUTdfczZvRzDSAYICQVVfeXFMTXp2NmM2aWhCbmZJcGFlWTBCTUEyR2xMclVHckhwQ3ZIWFQyQ3ZaZnc1bnNFck5sMGJfUDJOZzRMTlM4OGhyTkFlQ2Y1SndaVDFOMEt2cVdPcHZzRDBYM28xbGxMUHNad2RaZEFlVDRQa2xHdEN4WGZXZkZQU0o1TVZIQjNwUTJqRUdobXRYU1lPSEtIaTdhS1c3Ukd4UW1Td2VEOVMwRDRqcjFvY1VqcGNaV2ppNlRLcG5yX2Rsb1ZVOXZCX25KeXp1ZmpEVGoxaUFwSjJKTkVmRHNRUGpfSHJWSlI1SlAzaWlIYzRMai1IZ3JGMFhGRDVkSzBYV2pKVFVR?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Of Kimi K3 Fame Tried To Crack OpenAI’s Encrypted Reasoning Through 16,000 Requests, Bolstering Trump Administration’s Distillation Claims - Wccftech&lt;/a&gt;，並把此事框成佐證川普政府對蒸餾行為的指控——這是媒體的框架，相關說法仍需獨立驗證。技術決策者應視之為「需要重新檢視 prompt 與推理軌跡的暴露面」，並理解這跟下面 Anthropic 那條示警的方向差異——這條是&lt;strong&gt;外部對 OpenAI 的攻擊&lt;/strong&gt;，不是中國模型本身的輸出。&lt;/p&gt;

&lt;h3&gt;
  
  
  Anthropic：中國模型被指出能以低成本建構漏洞利用鏈
&lt;/h3&gt;

&lt;p&gt;Anthropic 對 GLM-5.3-Flash 提出安全警示——官方說法是該模型以 20.40 美元的成本建構出一條可運作的漏洞利用鏈&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNcC1vcjBhUnkyTzdwRXktaWkyZmpsX0lXeFhJaGlidzZXQzV2QzlObzRHSHJpeGhEWWdEb2Q2TmRCSWtvd3ktQlNBRzlaSFhTT1dydm1aZ1lxRzRvUU8wZ2R4Y1NQdGVEajVoVEZzQ0FiblBLTEtmSDk3UU9RRndIb1U2NHA2ZER4XzV6LWpmOUQ?oc=5" rel="noopener noreferrer"&gt;Anthropic says GLM-5.3-Flash built a working exploit chain for $20.40 - mixed-news.com&lt;/a&gt;；Business Standard 則把這項疑慮放回美中與開放 AI 的辯論脈絡&lt;a href="https://news.google.com/rss/articles/CBMi8AFBVV95cUxOcFFQUVlqTnl6SUhHRm5obVRsUXVCUWwtckxQR2h6ZFZpbGJnOTEzYVF6UktMVks3OUEzYS1TX0M1M3l0bDFwV3kyako5em9CTURzUUNZelBrSmI2VmVmekpEWnliWjM0VVllV0Z2WGZ1S0ZYalNDTG1KdXV5VXFMV0RfNTVKQU5rXzhka3NKLUczbEdHaGV6UUJWWVF6ejZncnNmNl9XTTIxZTNIUjBZekJiZmp1cE1KOHp5WTFsaFFpWmJ0aXA0S0d3eFBleDdlQmtGOFpMRFJyTXQ2WXRZdUxFekRVQkprUXI1RXRKMkPSAfYBQVVfeXFMTV9tWlFYRlVWbGN0Tlc5ZUFSRldqckhNdFJGX3RwallYZHRSaklJNGY1UVZfTlBsSm9JbGhBcG9NbXRqWkpvSll6NEN2NktYN2VHZGtjSmFrQUNORXNlamozTHJBSVNPVmktYWhUZTJIOGRaRTRWV1RMUmlaVTBzcC1FRDI3U1hOWTVUVFpNTWhNOVNaMmhHZTF3RjctcVl6S041T3dMdERNQ05OMmN2blM2VVhqMERSZ2hPUHNldElZdGMxU3VuQWhaV3NVblhjMFBJUEowU1R1MXBuSTV3Ql9EblZNX2YtWUExSFR6M0RrdmY2dmp3?oc=5" rel="noopener noreferrer"&gt;Anthropic's GLM-5.3 concerns put US-China, open AI debate back in focus - business-standard.com&lt;/a&gt;。這跟本週揭露的蒸餾攻擊張力同向但手段不同：OpenAI 那條是別人對它做的事，這條是中國模型本身的產出。對企業用戶而言，兩者合計意味著 agent 與低成本模型的部署需要新增「推理軌跡暴露」與「自動化安全審查」兩個工程支出項目。&lt;/p&gt;

&lt;h2&gt;
  
  
  Agent 與消費端下載量
&lt;/h2&gt;

&lt;p&gt;Meta 的 Muse AI agent 達到 500 萬次下載，qz.com 指出其達到此下載里程碑所需的時間比 ChatGPT 短&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBYdzZLbDF4dTNzc3ktNS0tS21OOTZWZUJiWm5WRlVkVVg5Ni1YaWRhR0gyR1BoMm5GUS00RTVFTzVwOEtkSXI4QVZjdTZ2THk0OTM2bUQyVE91dDlPNkhDZHRTaW1ZalBxQVpNRjdZYTdtZ0x1NURB?oc=5" rel="noopener noreferrer"&gt;Meta's Muse AI agent reaches 5 million downloads faster than ChatGPT - qz.com&lt;/a&gt;。OpenAI 的 dots&lt;a href="https://news.google.com/rss/articles/CBMiVEFVX3lxTE9MVUVlaTV5ZFFBUnVJMFZDWTJIRGg5R20zQXpKU0tENk5PMXR0TEZ0N2VqRXpsOHdrazZKYS1QaUFNZ2tzN0c4Tnk0UjBjRmtFX0RjRw?oc=5" rel="noopener noreferrer"&gt;Introducing dots - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9tRjZqS3R6VW1rR1UtMU9raVlfRnR0OFNZV1dGSWhIVDZYelFabjdjWTl3cmxMcEprRDQ0bDQzb2dxQUEzWk9GMS0wNU9SdG8yczRnTzh2WUxNWDdJVkFEaGZBcTZyMVJiOFpZQkFwTlVTY00tancyb25NWlpWc3M?oc=5" rel="noopener noreferrer"&gt;Sam Altman unveils "dots," OpenAI's new AI personal agent - CBS News&lt;/a&gt; 與之對照。Muse 的訊號是消費端下載量；dots 則是產品發表，官方說法是先對符合資格的付費方案逐步開放——企業採購仍應核對 agent 的整合成本、API 穩定性與企業級權限模型，工程採購的決策點可能尚未到位。&lt;/p&gt;

&lt;h2&gt;
  
  
  本週落地清單
&lt;/h2&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;前沿模型評估窗口開啟&lt;/strong&gt;：Gemini 4 Argon、Claude Sonnet 5.5 兩款發布，「快 30%」是廠商說法，用自家 workload 做 shadow test 再決定導入順序。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;算力供給重新檢視&lt;/strong&gt;：Nvidia 以晶片支撐 AI 融資的押注正面臨華爾街現實檢驗&lt;a href="https://news.google.com/rss/articles/CBMizgFBVV95cUxPWWFtWW9YMHUyWmxwTUs1VmZnOHZNdnJBNzB6azNFSG84M0FtS2x1SE50TDZMS0ZNS25zQ1lEZnFRdnd3UFhDRXMwLUVXaDZWRW9RZHdfQXdhNjFBdEJSd243SHlselowdWpIZ3RycmRSdUhlaTlDLUVGNjV1a3UwY2llSXpiV0dvVDN2VU1tS3NmbmQzVFNXV2FZcDJzWEI5b05NRW4zRXFPOV9NZnZUMmE5M2sycEtKVUdpNjRkLW90bGtiZnY0LWtvTHRDQQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's bet that its chips can finance the AI boom gets a Wall Street reality check - Reuters&lt;/a&gt;；DeepSeek 開源工具鏈讓華為 AI 晶片的 Nvidia 替代路徑從概念走向可下載&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxOaWtGQm56WHh4UkJrYnJUaDY1bmR6TnNFOUpXckkta0RyNGNEVVJubWpjdDBRTXJQNWlwTHlEaEJjSUpDQ0dQZ2dhVllUVmtYUlYxUC1lSW5ULVdjN0lUb1p1THd3SHUxQndfS3IxUmFEZkJUODcwUlFUQUVkV2w0Q25xODc0aHZ0TDBpallCdUlvRURLWFhySVZQSHVHSnc?oc=5" rel="noopener noreferrer"&gt;DeepSeek unveils Huawei AI chip software to challenge Nvidia - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQX2pDSnRWMTNZYUhBYnh2eHpWQklRVG1FSDJPYWF5WkI4VTM2VjQteGJTQjRNWjJ6Z3hpcVpiRGpKVjVubkNfeHFVYnY0ODIxbUJKNmFFTFVQUndibGstVDF0WnlMSTRlc0xVMWNlOFhnbEtURjRidE9GejFHdEZBckxZYkZJSzFpNnhGZ0JiS1BSTUdoanBOSGZPd1d0M2FVLVRFalYzNDZRM2NkQ0xEVzN6Rk50OUd5VjQ2NnJwZE5JUTjSAcMBQVVfeXFMT09mUUVmbnlNV0NDZUVUbmE0X0ZKUTVUbkx0RkpseW1OWEZyVHVjSmF3cUNuVG9aNTljcVhSWTVoeldqeWtVczQ0OFcwRnFTSTBOeW93bkNNX2dZTzU2amlZSUFEa1AzV29mTS1IbDA3LTFjcGV4STVUa0E1NFRRU2g4S3JyNUV6aHRsRTVwWW1YX09mMnBxRUNMbmtrV2RmRURRR2l4djBwWm53SG9ta29FTkM2OXNfaVN3aXBBWUVIeHNF?oc=5" rel="noopener noreferrer"&gt;DeepSeek opens tools to help Huawei chips supplant Nvidia in AI - South China Morning Post&lt;/a&gt;——兩條軌跡可能同時影響雲端合約與雙軌整合成本。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;安全邊界重新畫線&lt;/strong&gt;：OpenAI 對蒸餾攻擊的公開示警&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxQbEgxOFhvU3ZzR0JYMjZDbWhRaXlQeGoyci1PRGhfWkFhSGpER29fLXZydWRybEdpVEhUX0dCZ3pwS0ViUWRxVy1NVXZNREVfN2pOMU96c2NmSmlpY1lheUwxMGxuVjlmTV9uSkszVHU0RFhVVVNNUU42TkNjb084cThtaWc?oc=5" rel="noopener noreferrer"&gt;Disrupting a coordinated model-distillation campaign - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQWXZNbU9fcDlKMFZrM0V2VWF3Q1FjWFVXZVU3ekFycWlRbkNfdkRhZndvandpRm9yTFF3bVZHQmhJamN1VFB2aXlTZkl4S1NsVFV6eHNFVnNHS1lVcGxSamduemh4Q0NtZXBHRW5STG43TjVHaDNyS2I4Qnd2TEtTN3FqaTNkb2hwRksyd0l1eDBCdTlsdlpuWWw5LWhfMG9PUGdYY3drMVZzbGNBS3pDNTROU3JwQ3ZsQThZNVFzREFfbWxXOHQ1dXBydXVRZVo5WTg5VHdBdmJGeDg0d0dXNkdodDRkS2JQTlFWeXZyMmhlZzFfUTdfczZvRzDSAYICQVVfeXFMTXp2NmM2aWhCbmZJcGFlWTBCTUEyR2xMclVHckhwQ3ZIWFQyQ3ZaZnc1bnNFck5sMGJfUDJOZzRMTlM4OGhyTkFlQ2Y1SndaVDFOMEt2cVdPcHZzRDBYM28xbGxMUHNad2RaZEFlVDRQa2xHdEN4WGZXZkZQU0o1TVZIQjNwUTJqRUdobXRYU1lPSEtIaTdhS1c3Ukd4UW1Td2VEOVMwRDRqcjFvY1VqcGNaV2ppNlRLcG5yX2Rsb1ZVOXZCX25KeXp1ZmpEVGoxaUFwSjJKTkVmRHNRUGpfSHJWSlI1SlAzaWlIYzRMai1IZ3JGMFhGRDVkSzBYV2pKVFVR?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Of Kimi K3 Fame Tried To Crack OpenAI’s Encrypted Reasoning Through 16,000 Requests, Bolstering Trump Administration’s Distillation Claims - Wccftech&lt;/a&gt;、Anthropic 對 GLM-5.3-Flash 漏洞利用鏈的警示&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNcC1vcjBhUnkyTzdwRXktaWkyZmpsX0lXeFhJaGlidzZXQzV2QzlObzRHSHJpeGhEWWdEb2Q2TmRCSWtvd3ktQlNBRzlaSFhTT1dydm1aZ1lxRzRvUU8wZ2R4Y1NQdGVEajVoVEZzQ0FiblBLTEtmSDk3UU9RRndIb1U2NHA2ZER4XzV6LWpmOUQ?oc=5" rel="noopener noreferrer"&gt;Anthropic says GLM-5.3-Flash built a working exploit chain for $20.40 - mixed-news.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi8AFBVV95cUxOcFFQUVlqTnl6SUhHRm5obVRsUXVCUWwtckxQR2h6ZFZpbGJnOTEzYVF6UktMVks3OUEzYS1TX0M1M3l0bDFwV3kyako5em9CTURzUUNZelBrSmI2VmVmekpEWnliWjM0VVllV0Z2WGZ1S0ZYalNDTG1KdXV5VXFMV0RfNTVKQU5rXzhka3NKLUczbEdHaGV6UUJWWVF6ejZncnNmNl9XTTIxZTNIUjBZekJiZmp1cE1KOHp5WTFsaFFpWmJ0aXA0S0d3eFBleDdlQmtGOFpMRFJyTXQ2WXRZdUxFekRVQkprUXI1RXRKMkPSAfYBQVVfeXFMTV9tWlFYRlVWbGN0Tlc5ZUFSRldqckhNdFJGX3RwallYZHRSaklJNGY1UVZfTlBsSm9JbGhBcG9NbXRqWkpvSll6NEN2NktYN2VHZGtjSmFrQUNORXNlamozTHJBSVNPVmktYWhUZTJIOGRaRTRWV1RMUmlaVTBzcC1FRDI3U1hOWTVUVFpNTWhNOVNaMmhHZTF3RjctcVl6S041T3dMdERNQ05OMmN2blM2VVhqMERSZ2hPUHNldElZdGMxU3VuQWhaV3NVblhjMFBJUEowU1R1MXBuSTV3Ql9EblZNX2YtWUExSFR6M0RrdmY2dmp3?oc=5" rel="noopener noreferrer"&gt;Anthropic's GLM-5.3 concerns put US-China, open AI debate back in focus - business-standard.com&lt;/a&gt;，合計意味著 agent 與低成本模型的部署需要新增「推理軌跡暴露」與「自動化安全審查」兩個工程支出項目。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Agent 先看實際部署再入採購評估&lt;/strong&gt;：Muse 500 萬下載&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBYdzZLbDF4dTNzc3ktNS0tS21OOTZWZUJiWm5WRlVkVVg5Ni1YaWRhR0gyR1BoMm5GUS00RTVFTzVwOEtkSXI4QVZjdTZ2THk0OTM2bUQyVE91dDlPNkhDZHRTaW1ZalBxQVpNRjdZYTdtZ0x1NURB?oc=5" rel="noopener noreferrer"&gt;Meta's Muse AI agent reaches 5 million downloads faster than ChatGPT - qz.com&lt;/a&gt; 與 OpenAI dots&lt;a href="https://news.google.com/rss/articles/CBMiVEFVX3lxTE9MVUVlaTV5ZFFBUnVJMFZDWTJIRGg5R20zQXpKU0tENk5PMXR0TEZ0N2VqRXpsOHdrazZKYS1QaUFNZ2tzN0c4Tnk0UjBjRmtFX0RjRw?oc=5" rel="noopener noreferrer"&gt;Introducing dots - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9tRjZqS3R6VW1rR1UtMU9raVlfRnR0OFNZV1dGSWhIVDZYelFabjdjWTl3cmxMcEprRDQ0bDQzb2dxQUEzWk9GMS0wNU9SdG8yczRnTzh2WUxNWDdJVkFEaGZBcTZyMVJiOFpZQkFwTlVTY00tancyb25NWlpWc3M?oc=5" rel="noopener noreferrer"&gt;Sam Altman unveils "dots," OpenAI's new AI personal agent - CBS News&lt;/a&gt; 一個是下載里程碑、一個是逐步開放中的產品發表，採購前應核對企業級 reliability、權限模型與整合成本。&lt;/li&gt;
&lt;/ol&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-09-25 to 2026-10-02 | Gemini 4 Argon, China silicon, and a $20.40 exploit</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 02 Oct 2026 01:19:19 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-25-to-2026-10-02-frontier-models-china-silicon-and-a-2040-exploit-4oam</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-25-to-2026-10-02-frontier-models-china-silicon-and-a-2040-exploit-4oam</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;A frontier-model unveiling, a chip-stack realignment, and two security disclosures — OpenAI disrupting a model-distillation campaign and Anthropic claiming a $20.40 exploit chain — in a week where the supply-chain story and the threat-model story stopped being separate.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Frontier model releases
&lt;/h2&gt;

&lt;p&gt;Google unveiled Gemini 4 Argon this week, described as the company's "next era of frontier intelligence"&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNRjB3amppaF9yb1FhSmxoUW5GUEtCREcxbW1ScXJRRWN5ZGtIM0N0d21wVEI3ZTd5ZHY4N09KRWNwX3U2Z3JBeDNWakYxYXlBVE95NEpKWW5vcWFKZlA5Qkdka3hGZG9INUZtMVN2VTJhWG1TTldVSE1JVm5VaVlvcnpWRlhzX0V1NGJXZGhfMEY?oc=5" rel="noopener noreferrer"&gt;Gemini 4 Argon: our next era of frontier intelligence - blog.google&lt;/a&gt; and confirmed by a separate report as a new frontier model&lt;a href="https://news.google.com/rss/articles/CBMimwFBVV95cUxNTy1GYUJlNHFZVHhVeF80WkE2ZW4zMm5PTWFIeFI5Z2NvQzQ2Rm9TbHZUdE9aT2pMZXNLZXprNVFNZkhYUzV3QU42aUlDMWswSUVIaVRiQWx4eE54czVfWlR3NW5FM3I1VE9BaEh1ZU1JN2E3QndiNC1MMmR2VG9xUkxldlpzcEFUcmR4d245U3R3Ql9SOTZQYjlLYw?oc=5" rel="noopener noreferrer"&gt;Google DeepMind unveils Gemini 4 Argon, its new frontier model - Dealroom&lt;/a&gt;. The vendor positioning — "frontier," "next era" — is the language of press releases, not the language of evaluation. Treat it as &lt;strong&gt;announced&lt;/strong&gt; until independent benchmarks land; the gap between &lt;strong&gt;announced&lt;/strong&gt; and &lt;strong&gt;commercially usable&lt;/strong&gt; is exactly where most integration cost hides.&lt;/p&gt;

&lt;h2&gt;
  
  
  China silicon and the DeepSeek–Huawei stack
&lt;/h2&gt;

&lt;p&gt;The week's most concrete infrastructure shift came from DeepSeek. The vendor unveiled software intended to run on Huawei AI chips, positioned as a challenge to Nvidia&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxOaWtGQm56WHh4UkJrYnJUaDY1bmR6TnNFOUpXckkta0RyNGNEVVJubWpjdDBRTXJQNWlwTHlEaEJjSUpDQ0dQZ2dhVllUVmtYUlYxUC1lSW5ULVdjN0lUb1p1THd3SHUxQndfS3IxUmFEZkJUODcwUlFUQUVkV2w0Q25xODc0aHZ0TDBpallCdUlvRURLWFhySVZQSHVHSnc?oc=5" rel="noopener noreferrer"&gt;DeepSeek unveils Huawei AI chip software to challenge Nvidia - Seeking Alpha&lt;/a&gt;. Coverage describes a stronger software integration with Huawei GPUs&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQSUx6REw4bUZZeEY2ZWJqM1RYamFCY2QzWDBUWkFmQ29kVXFHWC1oTWktYXd5aF80cEdJWlJPZTlqSFFDTC1xX3AyWDBpb2VVc1ZsNVl5M1c2SkV1ZEZwUTdLcnB5d0VFaEhwc0R5YTducFdLaDcxREllbTZiTzBsdUJ5SS1ULUlqVjZMUkoxNW9ZcHZGbUk5TDEwUVhHd28zRnN3ZHpzMUc?oc=5" rel="noopener noreferrer"&gt;DeepSeek Announces a Stronger Software Integration with Huawei GPUs - analyticsindiamag.com&lt;/a&gt; and characterizes the move as "open-source software for Huawei's Ascend chips"&lt;a href="https://news.google.com/rss/articles/CBMivAFBVV95cUxPZlQycWp6TUpST2t5bnViR29jRnVFY1BabjFfejhDcnFpWjFQNFJ1Y25EdjV5QlJvc2ZfWVBnUHhSSGlnY0tCd3ZQVW9JYVpYVU5lZGowY1ZJYUU0TmdabTlqV3RkUlVuazRXNzh2VGtJeG5KRVB0Y1ZWRmtkcXc3ZWQzcXBiai03UXpONmp0YWo1OVhOTkVwTmhMT3o1bmZRaENnMHUyc1hFWVF2QTg2eUtHbXJ1dk1SWFg0NQ?oc=5" rel="noopener noreferrer"&gt;China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chips - the-decoder.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQX2pDSnRWMTNZYUhBYnh2eHpWQklRVG1FSDJPYWF5WkI4VTM2VjQteGJTQjRNWjJ6Z3hpcVpiRGpKVjVubkNfeHFVYnY0ODIxbUJKNmFFTFVQUndibGstVDF0WnlMSTRlc0xVMWNlOFhnbEtURjRidE9GejFHdEZBckxZYkZJSzFpNnhGZ0JiS1BSTUdoanBOSGZPd1d0M2FVLVRFalYzNDZRM2NkQ0xEVzN6Rk50OUd5VjQ2NnJwZE5JUTjSAcMBQVVfeXFMT09mUUVmbnlNV0NDZUVUbmE0X0ZKUTVUbkx0RkpseW1OWEZyVHVjSmF3cUNuVG9aNTljcVhSWTVoeldqeWtVczQ0OFcwRnFTSTBOeW93bkNNX2dZTzU2amlZSUFEa1AzV29mTS1IbDA3LTFjcGV4STVUa0E1NFRRU2g4S3JyNUV6aHRsRTVwWW1YX09mMnBxRUNMbmtrV2RmRURRR2l4djBwWm53SG9ta29FTkM2OXNfaVN3aXBBWUVIeHNF?oc=5" rel="noopener noreferrer"&gt;DeepSeek opens tools to help Huawei chips supplant Nvidia in AI - South China Morning Post&lt;/a&gt;. TheStreet points to SEMI's forecast of $229 billion in chip-equipment sales by 2028 — money the toolmakers collect before Nvidia ships a GPU&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOT19zR1huWl9jWVRlb09lNEVKNEhMTGpGNVB6UHR1VHpfRDhha0J6WTgwT044bU1uYjFuYllGeTRva2ttM2VWUzY3em5QM3V0dEdXTGctdHl4aDVWWEdqOS1Qa3pSd2RrcXhPNnhvRmREMjc1dnNKZWJlTTVyTkdLR0lMMGZ3YjA?oc=5" rel="noopener noreferrer"&gt;Chip stocks set for $229 billion payday before Nvidia ships a GPU - thestreet.com&lt;/a&gt;; Reuters separately describes a Wall Street reality check on Nvidia's bet that its chips can finance the AI boom&lt;a href="https://news.google.com/rss/articles/CBMizgFBVV95cUxPWWFtWW9YMHUyWmxwTUs1VmZnOHZNdnJBNzB6azNFSG84M0FtS2x1SE50TDZMS0ZNS25zQ1lEZnFRdnd3UFhDRXMwLUVXaDZWRW9RZHdfQXdhNjFBdEJSd243SHlselowdWpIZ3RycmRSdUhlaTlDLUVGNjV1a3UwY2llSXpiV0dvVDN2VU1tS3NmbmQzVFNXV2FZcDJzWEI5b05NRW4zRXFPOV9NZnZUMmE5M2sycEtKVUdpNjRkLW90bGtiZnY0LWtvTHRDQQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's bet that its chips can finance the AI boom gets a Wall Street reality check - Reuters&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Cyber capabilities and the security boundary
&lt;/h2&gt;

&lt;p&gt;Anthropic published a report on GLM-5.3 and the spread of advanced cyber capabilities&lt;a href="https://news.google.com/rss/articles/CBMikgFBVV95cUxPX212WWhHNWgzWkdtSlZTV3hiU3ZVdmJoUnJPMl92MVlMd1VadHJrbXJ3RjFvdXJib3dueWk0eUFwY25DallZUTJGd1J2MWRTRkFZcWNoa1g3YVBzaEdKbmF5TE1HakN0cnI5emUwdVlKeTZPY2o5R3RheG54R0E2ODVVZXpVUGZ3MDFVQ0h3bDh0UQ?oc=5" rel="noopener noreferrer"&gt;GLM-5.3 and the spread of advanced cyber capabilities - Anthropic&lt;/a&gt;. A separate headline reports Anthropic's claim that GLM-5.3-Flash built a working exploit chain for $20.40&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNcC1vcjBhUnkyTzdwRXktaWkyZmpsX0lXeFhJaGlidzZXQzV2QzlObzRHSHJpeGhEWWdEb2Q2TmRCSWtvd3ktQlNBRzlaSFhTT1dydm1aZ1lxRzRvUU8wZ2R4Y1NQdGVEajVoVEZzQ0FiblBLTEtmSDk3UU9RRndIb1U2NHA2ZER4XzV6LWpmOUQ?oc=5" rel="noopener noreferrer"&gt;Anthropic says GLM-5.3-Flash built a working exploit chain for $20.40 - mixed-news.com&lt;/a&gt;. That dollar figure is &lt;strong&gt;Anthropic's claim&lt;/strong&gt; until reproduced in an independent lab — the value of the disclosure is the &lt;em&gt;claimed capability&lt;/em&gt;, not the price tag. On the defensive side, OpenAI disclosed disrupting a coordinated model-distillation campaign&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxQbEgxOFhvU3ZzR0JYMjZDbWhRaXlQeGoyci1PRGhfWkFhSGpER29fLXZydWRybEdpVEhUX0dCZ3pwS0ViUWRxVy1NVXZNREVfN2pOMU96c2NmSmlpY1lheUwxMGxuVjlmTV9uSkszVHU0RFhVVVNNUU42TkNjb084cThtaWc?oc=5" rel="noopener noreferrer"&gt;Disrupting a coordinated model-distillation campaign - OpenAI&lt;/a&gt;. Separately, Wccftech reports that Moonshot AI, the lab behind Kimi K3, tried to crack OpenAI's encrypted reasoning through 16,000 requests&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQWXZNbU9fcDlKMFZrM0V2VWF3Q1FjWFVXZVU3ekFycWlRbkNfdkRhZndvandpRm9yTFF3bVZHQmhJamN1VFB2aXlTZkl4S1NsVFV6eHNFVnNHS1lVcGxSamduemh4Q0NtZXBHRW5STG43TjVHaDNyS2I4Qnd2TEtTN3FqaTNkb2hwRksyd0l1eDBCdTlsdlpuWWw5LWhfMG9PUGdYY3drMVZzbGNBS3pDNTROU3JwQ3ZsQThZNVFzREFfbWxXOHQ1dXBydXVRZVo5WTg5VHdBdmJGeDg0d0dXNkdodDRkS2JQTlFWeXZyMmhlZzFfUTdfczZvRzDSAYICQVVfeXFMTXp2NmM2aWhCbmZJcGFlWTBCTUEyR2xMclVHckhwQ3ZIWFQyQ3ZaZnc1bnNFck5sMGJfUDJOZzRMTlM4OGhyTkFlQ2Y1SndaVDFOMEt2cVdPcHZzRDBYM28xbGxMUHNad2RaZEFlVDRQa2xHdEN4WGZXZkZQU0o1TVZIQjNwUTJqRUdobXRYU1lPSEtIaTdhS1c3Ukd4UW1Td2VEOVMwRDRqcjFvY1VqcGNaV2ppNlRLcG5yX2Rsb1ZVOXZCX25KeXp1ZmpEVGoxaUFwSjJKTkVmRHNRUGpfSHJWSlI1SlAzaWlIYzRMai1IZ3JGMFhGRDVkSzBYV2pKVFVR?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Of Kimi K3 Fame Tried To Crack OpenAI’s Encrypted Reasoning Through 16,000 Requests, Bolstering Trump Administration’s Distillation Claims - Wccftech&lt;/a&gt;. The read: distillation is now an industry-grade attack surface, and the reporting is naming names.&lt;/p&gt;

&lt;h2&gt;
  
  
  Agents: announced, downloaded, evaluated
&lt;/h2&gt;

&lt;p&gt;OpenAI introduced "dots," described as a new AI personal agent&lt;a href="https://news.google.com/rss/articles/CBMiVEFVX3lxTE9MVUVlaTV5ZFFBUnVJMFZDWTJIRGg5R20zQXpKU0tENk5PMXR0TEZ0N2VqRXpsOHdrazZKYS1QaUFNZ2tzN0c4Tnk0UjBjRmtFX0RjRw?oc=5" rel="noopener noreferrer"&gt;Introducing dots - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9tRjZqS3R6VW1rR1UtMU9raVlfRnR0OFNZV1dGSWhIVDZYelFabjdjWTl3cmxMcEprRDQ0bDQzb2dxQUEzWk9GMS0wNU9SdG8yczRnTzh2WUxNWDdJVkFEaGZBcTZyMVJiOFpZQkFwTlVTY00tancyb25NWlpWc3M?oc=5" rel="noopener noreferrer"&gt;Sam Altman unveils "dots," OpenAI's new AI personal agent - CBS News&lt;/a&gt;. Meta's Muse AI agent was reported to have reached 5 million downloads faster than ChatGPT&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBYdzZLbDF4dTNzc3ktNS0tS21OOTZWZUJiWm5WRlVkVVg5Ni1YaWRhR0gyR1BoMm5GUS00RTVFTzVwOEtkSXI4QVZjdTZ2THk0OTM2bUQyVE91dDlPNkhDZHRTaW1ZalBxQVpNRjdZYTdtZ0x1NURB?oc=5" rel="noopener noreferrer"&gt;Meta's Muse AI agent reaches 5 million downloads faster than ChatGPT - qz.com&lt;/a&gt;. A third-party comparison lines up OpenAI Dot, Grok Bot, and Meta Muse on pricing, specs, and benchmarks&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE8tYTdVMW9LUXlrRkU1SU0wOVBQLTNSYm5ZWnJHaDU2N3ViTDdYWWJrU0tUWWluenpvejZ2OFhydkdlTFBWVXljZTBuSTdBTHcteWNnV25FX1J4QjJBVGd0NmVNMlhBOGN6dUE?oc=5" rel="noopener noreferrer"&gt;OpenAI Dot vs. Grok Bot vs. Meta Muse: Pricing, Specs, Benchmarks and the Evidence - kingy.ai&lt;/a&gt;. The split: dots is a product launch that OpenAI says is rolling out to eligible paid plans; Muse's download count is a real measurement; the comparison is a third-party reading, not an independent benchmark. Pick the one your procurement question actually asks about.&lt;/p&gt;

&lt;h2&gt;
  
  
  Bottom line for engineering decision-makers
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Frontier models&lt;/strong&gt;: verify the access terms, pricing, and evaluation evidence for Gemini 4 Argon&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNRjB3amppaF9yb1FhSmxoUW5GUEtCREcxbW1ScXJRRWN5ZGtIM0N0d21wVEI3ZTd5ZHY4N09KRWNwX3U2Z3JBeDNWakYxYXlBVE95NEpKWW5vcWFKZlA5Qkdka3hGZG9INUZtMVN2VTJhWG1TTldVSE1JVm5VaVlvcnpWRlhzX0V1NGJXZGhfMEY?oc=5" rel="noopener noreferrer"&gt;Gemini 4 Argon: our next era of frontier intelligence - blog.google&lt;/a&gt; before adoption.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;China silicon&lt;/strong&gt;: the DeepSeek–Huawei integration is the week's most concrete infrastructure story&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxOaWtGQm56WHh4UkJrYnJUaDY1bmR6TnNFOUpXckkta0RyNGNEVVJubWpjdDBRTXJQNWlwTHlEaEJjSUpDQ0dQZ2dhVllUVmtYUlYxUC1lSW5ULVdjN0lUb1p1THd3SHUxQndfS3IxUmFEZkJUODcwUlFUQUVkV2w0Q25xODc0aHZ0TDBpallCdUlvRURLWFhySVZQSHVHSnc?oc=5" rel="noopener noreferrer"&gt;DeepSeek unveils Huawei AI chip software to challenge Nvidia - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivAFBVV95cUxPZlQycWp6TUpST2t5bnViR29jRnVFY1BabjFfejhDcnFpWjFQNFJ1Y25EdjV5QlJvc2ZfWVBnUHhSSGlnY0tCd3ZQVW9JYVpYVU5lZGowY1ZJYUU0TmdabTlqV3RkUlVuazRXNzh2VGtJeG5KRVB0Y1ZWRmtkcXc3ZWQzcXBiai03UXpONmp0YWo1OVhOTkVwTmhMT3o1bmZRaENnMHUyc1hFWVF2QTg2eUtHbXJ1dk1SWFg0NQ?oc=5" rel="noopener noreferrer"&gt;China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chips - the-decoder.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQSUx6REw4bUZZeEY2ZWJqM1RYamFCY2QzWDBUWkFmQ29kVXFHWC1oTWktYXd5aF80cEdJWlJPZTlqSFFDTC1xX3AyWDBpb2VVc1ZsNVl5M1c2SkV1ZEZwUTdLcnB5d0VFaEhwc0R5YTducFdLaDcxREllbTZiTzBsdUJ5SS1ULUlqVjZMUkoxNW9ZcHZGbUk5TDEwUVhHd28zRnN3ZHpzMUc?oc=5" rel="noopener noreferrer"&gt;DeepSeek Announces a Stronger Software Integration with Huawei GPUs - analyticsindiamag.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQX2pDSnRWMTNZYUhBYnh2eHpWQklRVG1FSDJPYWF5WkI4VTM2VjQteGJTQjRNWjJ6Z3hpcVpiRGpKVjVubkNfeHFVYnY0ODIxbUJKNmFFTFVQUndibGstVDF0WnlMSTRlc0xVMWNlOFhnbEtURjRidE9GejFHdEZBckxZYkZJSzFpNnhGZ0JiS1BSTUdoanBOSGZPd1d0M2FVLVRFalYzNDZRM2NkQ0xEVzN6Rk50OUd5VjQ2NnJwZE5JUTjSAcMBQVVfeXFMT09mUUVmbnlNV0NDZUVUbmE0X0ZKUTVUbkx0RkpseW1OWEZyVHVjSmF3cUNuVG9aNTljcVhSWTVoeldqeWtVczQ0OFcwRnFTSTBOeW93bkNNX2dZTzU2amlZSUFEa1AzV29mTS1IbDA3LTFjcGV4STVUa0E1NFRRU2g4S3JyNUV6aHRsRTVwWW1YX09mMnBxRUNMbmtrV2RmRURRR2l4djBwWm53SG9ta29FTkM2OXNfaVN3aXBBWUVIeHNF?oc=5" rel="noopener noreferrer"&gt;DeepSeek opens tools to help Huawei chips supplant Nvidia in AI - South China Morning Post&lt;/a&gt;. The cost and latency trade-offs versus Nvidia are not in these headlines — measure them before any planning assumption.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Security&lt;/strong&gt;: the Anthropic GLM-5.3 disclosure&lt;a href="https://news.google.com/rss/articles/CBMikgFBVV95cUxPX212WWhHNWgzWkdtSlZTV3hiU3ZVdmJoUnJPMl92MVlMd1VadHJrbXJ3RjFvdXJib3dueWk0eUFwY25DallZUTJGd1J2MWRTRkFZcWNoa1g3YVBzaEdKbmF5TE1HakN0cnI5emUwdVlKeTZPY2o5R3RheG54R0E2ODVVZXpVUGZ3MDFVQ0h3bDh0UQ?oc=5" rel="noopener noreferrer"&gt;GLM-5.3 and the spread of advanced cyber capabilities - Anthropic&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMikAFBVV95cUxNcC1vcjBhUnkyTzdwRXktaWkyZmpsX0lXeFhJaGlidzZXQzV2QzlObzRHSHJpeGhEWWdEb2Q2TmRCSWtvd3ktQlNBRzlaSFhTT1dydm1aZ1lxRzRvUU8wZ2R4Y1NQdGVEajVoVEZzQ0FiblBLTEtmSDk3UU9RRndIb1U2NHA2ZER4XzV6LWpmOUQ?oc=5" rel="noopener noreferrer"&gt;Anthropic says GLM-5.3-Flash built a working exploit chain for $20.40 - mixed-news.com&lt;/a&gt; and the OpenAI distillation takedown&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxQbEgxOFhvU3ZzR0JYMjZDbWhRaXlQeGoyci1PRGhfWkFhSGpER29fLXZydWRybEdpVEhUX0dCZ3pwS0ViUWRxVy1NVXZNREVfN2pOMU96c2NmSmlpY1lheUwxMGxuVjlmTV9uSkszVHU0RFhVVVNNUU42TkNjb084cThtaWc?oc=5" rel="noopener noreferrer"&gt;Disrupting a coordinated model-distillation campaign - OpenAI&lt;/a&gt; are both signals that the threat model is now part of the model spec, not a separate review.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Agents&lt;/strong&gt;: download numbers are the cleanest signal in the agent category this week&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBYdzZLbDF4dTNzc3ktNS0tS21OOTZWZUJiWm5WRlVkVVg5Ni1YaWRhR0gyR1BoMm5GUS00RTVFTzVwOEtkSXI4QVZjdTZ2THk0OTM2bUQyVE91dDlPNkhDZHRTaW1ZalBxQVpNRjdZYTdtZ0x1NURB?oc=5" rel="noopener noreferrer"&gt;Meta's Muse AI agent reaches 5 million downloads faster than ChatGPT - qz.com&lt;/a&gt;; dots is a launch still in limited rollout, and the comparison is a third-party reading&lt;a href="https://news.google.com/rss/articles/CBMiVEFVX3lxTE9MVUVlaTV5ZFFBUnVJMFZDWTJIRGg5R20zQXpKU0tENk5PMXR0TEZ0N2VqRXpsOHdrazZKYS1QaUFNZ2tzN0c4Tnk0UjBjRmtFX0RjRw?oc=5" rel="noopener noreferrer"&gt;Introducing dots - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9tRjZqS3R6VW1rR1UtMU9raVlfRnR0OFNZV1dGSWhIVDZYelFabjdjWTl3cmxMcEprRDQ0bDQzb2dxQUEzWk9GMS0wNU9SdG8yczRnTzh2WUxNWDdJVkFEaGZBcTZyMVJiOFpZQkFwTlVTY00tancyb25NWlpWc3M?oc=5" rel="noopener noreferrer"&gt;Sam Altman unveils "dots," OpenAI's new AI personal agent - CBS News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE8tYTdVMW9LUXlrRkU1SU0wOVBQLTNSYm5ZWnJHaDU2N3ViTDdYWWJrU0tUWWluenpvejZ2OFhydkdlTFBWVXljZTBuSTdBTHcteWNnV25FX1J4QjJBVGd0NmVNMlhBOGN6dUE?oc=5" rel="noopener noreferrer"&gt;OpenAI Dot vs. Grok Bot vs. Meta Muse: Pricing, Specs, Benchmarks and the Evidence - kingy.ai&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-09-18 to 2026-09-25 | Alibaba's Open-Weight Push Hits Three Surfaces</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 24 Sep 2026 23:10:54 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-18-to-2026-09-25-alibabas-open-weight-push-hits-three-surfaces-28ep</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-18-to-2026-09-25-alibabas-open-weight-push-hits-three-surfaces-28ep</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Alibaba took three of the week's headline slots with Qwen-Image-2.1, Qwen Audio 3.1, and a Zhenwu V900 accelerator announcement — and the same week frontier vendors from Anthropic, xAI, and OpenAI pushed into new distribution channels. The story is the overlap: open-weight image and audio pricing dropped while closed-frontier model surfaces expanded.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Alibaba's Qwen-Image-2.1 is the week's clearest "open-vs-closed" line
&lt;/h2&gt;

&lt;p&gt;Alibaba's Qwen-Image-2.1 is a 7B open-weight release for image generation and editing, with native transparency support built in&lt;a href="https://news.google.com/rss/articles/CBMiekFVX3lxTE1OX0pYdXpNOURpRGJ1cV9VblZMaDlra2N4VllDNHE0LWlKUUhuRVRqM3FqZkFNR1dUbWZ1aEVrVDRFeHd1U1hQM3BmYWs3LTlGSm9RRWRtTkk2cWNnNHBoRGlqcHliRVJGRkQ5bDZ4X2lCTkpIbHIxT253?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-Image-2.1 Brings Native Transparency to a 7B Model - eweek.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMigwFBVV95cUxNU0JXUndVd2hCcXdycTc4XzhSWHpJOUtaN1NRWjQxWTJkY2J2UUJzRWdzWFNiLVJHRE1tN0d0YmFUdmdGekhfQmFhNWhHLWozOW42eW1FRlV5Ty1mWG9iNzlJcWd0VUM2OFJJalh0czYwLThiXzJMcTBjUEx5dGstenlwONIBiAFBVV95cUxPVl9MN2plOFZTMk1kSF9OZXY5XzNHSkVWb2Q3T2VIbTNScjltNEZCakNXTzlKQ0lCamVYVjNDdVFwYlVFLTB5SWJFNGZkY2wwNUNCaW5GMDhoM1NZM0tjWUFLWFBiamhhWG9XMTZnM0tSNUFpZ0E0WmlFT0NBU0hvcWpfX290ejVz?oc=5" rel="noopener noreferrer"&gt;Alibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing - MarkTechPost&lt;/a&gt;. Tom's Hardware carries Alibaba's positioning that the model is competitive with closed image models from OpenAI and Meta, and the vendor claims it beats Google's Nano Banana 2.0 on those benchmarks&lt;a href="https://news.google.com/rss/articles/CBMi9gJBVV95cUxQYmZsbFl0SWdUX2Ytb1NjZ2tHV3NYSmZEb1pzUkozSUktWFhwSzAwUlY2a0c2VGVSY2dtNVJvYTFHV1FNOGpzYTVjTjRpS085SU9qQlk4UzRWdnYxX2Q3Ul9jMU54bVROOG9KLVZobW5xeWZNUVVHa1BMUkxTVTBubUtqSHF6Xzdrek5Mamtjd2xFelVNYUpjY1NtWUtyM0hubC12QTZrYmVuTnZidHM2cTYwSE1hMVZaZkhDYWYwNUhPTXJDa25EelZYSjNBX1JhYWRteERZSU9wR1htQ3RZWGIydVl2SnVlLWpKZ2M2V21SY1RVUDBfMm91dTZqRVRLemJLZzNTZDE3eVp5MVJvSzdObDNud0NHbXNva1lyTUhsY2k1X3Y0OVlhSHBWelZsbFpqOGRUd2FDeTNMalhwUjVBR2NRVHJGSG41WDdQUV9hRzVuRlJaclpvNEZnancwMGhnZlQyVy14X1lMcGJVOFpBeW5OUQ?oc=5" rel="noopener noreferrer"&gt;Alibaba claims new Qwen Image 2.1 AI model beats Google Nano Banana 2.0 with minuscule 7B parameter model — benchmarks show open-weight contender is competitive with OpenAI and Meta image models - Tom's Hardware&lt;/a&gt;. A separate write-up from the-decoder.com repeats the "beats closed models with just 7B parameters" framing sourced back to Alibaba&lt;a href="https://news.google.com/rss/articles/CBMi1wFBVV95cUxPcW83SUN6S3dlZ19qVVgwZ3h0bmpwemJRRmZ0RFhsT3hkbEhUQ3JWOVFWSWpSU0NEYTNHTlp1RWZyVE00dFJSUjJ3UFMxTjhZWUU3RWRZOV9iSjZVUUVxc1ROd25UWkJqZmFOSDdwWlFLQ2gxV0UxeWNxbU8xRFY2NUZtYXc3NnVBU1NYcWJTcUVxdW8wYjk2aVMyc1k1QnQwUllPc0xTTkxQczdHeGNCSlNtOTRsSHR6VW81RWZXVXFaa3BrajRZdGp2ejR6VExKcTduRmRaTQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's open-weight Qwen-Image-2.1 claims to beat closed models in image generation with just 7 billion parameters - the-decoder.com&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;For engineering decisions this is the most actionable item of the week. On the published axis the closed/open gap on image generation has narrowed enough that the integrator's question — "fit into our stack vs. vendor API" — is now a real one. Open weights mean: self-host possible, latency under your control, no per-call image fee, audit-able prompt handling. Closed APIs still win on reliability, multi-region routing, and upstream SLAs. The benchmarks cited are Alibaba's own, and the articles do not provide independent third-party numbers.&lt;/p&gt;

&lt;h2&gt;
  
  
  Zhenwu V900 and the 500,000-chip roadmap
&lt;/h2&gt;

&lt;p&gt;Tom's Hardware and the Northwest Arkansas Democrat-Gazette both report Alibaba unveiling a new AI accelerator called Zhenwu V900, with Alibaba claiming it is the most powerful AI chip in China&lt;a href="https://news.google.com/rss/articles/CBMi6AJBVV95cUxNZXdKRTNKSWxHZEFza3k0bHV2Tng3RnNuY3pjWmtCZWQwaEF5Si1IblRzRnpoamRwRV9UbmF6NFlTV1AzNXZkOGxBNVFZalQtU3RCZTJqbERuRHEyMlVEdU5SY2V6d0xQRzEtRHZJbmVLZUc1MnlvdVM5VTQxLTJaWWRjTUQwdXJRaHplMkVicHZ4SkZlbzhYcHhLS2Y4WklOam5FcnZMSURnV0Fnc0M2a1p1UTZwa0F2WW5WaklNZXBNSzFIXzZMaU9NeUFvZjdzNldwV0plWTNCcy1SLW9yNHhEREN5R2tra2hreTNXSDF5V3hXcy1EYmNhUDNBSUF2VkpyNTRKbVlGbGh4Wmt2MVJDc2hDOTFBNC1GNlRETmlObjBmSzlmbF9hYmxuZ0NSVjQwRHd2YWhUTXBJZUdjWENrUEZCTVM4UmtBYWlSdXBYaVY0YmMtV2V3ak1TVmpjTmxiR0FJSXM?oc=5" rel="noopener noreferrer"&gt;Alibaba unveils Zhenwu V900 AI accelerator, claims it's 'the most powerful AI chip in China' — accelerator supports 500,000 chip supercluster with a 10T-parameter Qwen model on the roadmap - Tom's Hardware&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxPbkFWM19uZVBRX3JWX2N1ZEJraHJpZjllUy04Y2VRUzFmRVVYS0xyZGxTOG9oTFdnb1VkT2Z2WVZQTzk1U0E0NUpfLXF0QWRROXNVYTZhcm1Damd2NnhwaDllMW5xQzFqVFhkN3N3aGI1Qm1GOFk2OTRyVkYyMzdRak1OQkpKdlNqbEpqUTlBaTEtZG02VUVTYzlOYXA5cm8?oc=5" rel="noopener noreferrer"&gt;China’s Alibaba unveils a new powerful AI chip - Northwest Arkansas Democrat-Gazette&lt;/a&gt;. Tom's Hardware adds one roadmap detail: a 10T-parameter Qwen model targeting a 500,000-chip supercluster&lt;a href="https://news.google.com/rss/articles/CBMi6AJBVV95cUxNZXdKRTNKSWxHZEFza3k0bHV2Tng3RnNuY3pjWmtCZWQwaEF5Si1IblRzRnpoamRwRV9UbmF6NFlTV1AzNXZkOGxBNVFZalQtU3RCZTJqbERuRHEyMlVEdU5SY2V6d0xQRzEtRHZJbmVLZUc1MnlvdVM5VTQxLTJaWWRjTUQwdXJRaHplMkVicHZ4SkZlbzhYcHhLS2Y4WklOam5FcnZMSURnV0Fnc0M2a1p1UTZwa0F2WW5WaklNZXBNSzFIXzZMaU9NeUFvZjdzNldwV0plWTNCcy1SLW9yNHhEREN5R2tra2hreTNXSDF5V3hXcy1EYmNhUDNBSUF2VkpyNTRKbVlGbGh4Wmt2MVJDc2hDOTFBNC1GNlRETmlObjBmSzlmbF9hYmxuZ0NSVjQwRHd2YWhUTXBJZUdjWENrUEZCTVM4UmtBYWlSdXBYaVY0YmMtV2V3ak1TVmpjTmxiR0FJSXM?oc=5" rel="noopener noreferrer"&gt;Alibaba unveils Zhenwu V900 AI accelerator, claims it's 'the most powerful AI chip in China' — accelerator supports 500,000 chip supercluster with a 10T-parameter Qwen model on the roadmap - Tom's Hardware&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;This sits squarely in announced, not deployed. Treat the 10T-parameter and 500k-chip numbers as a roadmap claim — on a custom accelerator, peak FP throughput, real-world inference latency, and software-stack maturity decide whether the chip is usable, and none of those are in any source this week. The risk profile of integrating against a non-NVIDIA accelerator at this stage is non-trivial.&lt;/p&gt;

&lt;h2&gt;
  
  
  Audio prices collapse; voice models stay fragmented
&lt;/h2&gt;

&lt;p&gt;Alibaba launched Qwen Audio 3.1 with new models and the vendor claims price cuts of up to 95% on AI audio&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxNYVdTYkVkR2ZZNFZJdURHdlV1RzZGQnFuLXh0Vkd1MnFCQTFicUc3SnFCWUJRZlIxUFZMbEZlbUsxYzIyOTdCWUpiUXFMX3F5VVp6RE5yNVpiN1U5dklCQnZOeHpkMHNZRWR6TXM2ZV9fWm1PeWRMLU5hanhCbXZVN2pna21ucTR4M0hyQkxDNnh3eTNMNUQwWjltdkhZcjNLQXAyVkp3SnBZUXkxTHpJWFVTX3BFSDJHTXk4dTRkakRNdWc?oc=5" rel="noopener noreferrer"&gt;Alibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent - the-decoder.com&lt;/a&gt;. Separately, Google DeepMind introduced Gemini 3.8 text-to-speech&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5WcjNIZnlIRHEwcWJheFhuMHAyYTZlVXFPcEZDZ1ZiSk5YdEdoZ2Y0QjZFb0NDNDB1UlRMN055YUc5d2x4RFRObjVIbUVaT2JnQnR0MnU4MjUtdjBVUE9yRVhLNXdNUDNSLWpMN3g4WlkyZEJWa3c?oc=5" rel="noopener noreferrer"&gt;Gemini 3.8 text-to-speech says hello - Google DeepMind&lt;/a&gt;, and The Mac Observer reports DeepMind's chief saying Gemini 4 is "almost ready"&lt;a href="https://news.google.com/rss/articles/CBMieEFVX3lxTFBxN0dLZmNWYXhBbkF5b3hNdElRekd6VnB3ZDAxNW5VMXVreVlQcDRCQXhLUXBvZ2hTVUxZdnZoNDBBLUpIV2NsVkVpMVdLMElOQnNNbVkzRFFpUUdTSnF6bjdLN1dYd3VkMzR3ZlFycVZVN2d5Vzc5MQ?oc=5" rel="noopener noreferrer"&gt;Google DeepMind chief says Gemini 4 is almost ready - The Mac Observer&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;For the engineering reader, what matters is the pricing shape, not the headline feature. When one vendor drops audio pricing 95%, the realistic outcome is that audio TTS moves closer to a commodity input and the differentiation moves to voice cloning rights, emotional control, and streaming latency. Do not extrapolate from the "almost ready" framing for Gemini 4 — that is not a release date, and the headline's tone is closer to "internal evaluation complete" than "shipping today."&lt;/p&gt;

&lt;h2&gt;
  
  
  Anthropic, xAI, and OpenAI all move frontier this week
&lt;/h2&gt;

&lt;p&gt;Anthropic introduced Claude Opus 5.5&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9xbTN1a0tOdm9kT0JxbVBHMU9XYUhpUjd0MHNFYm8yd2pRMnhjdEYzdjF3ckZEY1V0a2ZQTXlyRUhteVozMlhDbVQ3Mm1KWlRYbUVF?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Opus 5.5 - Anthropic&lt;/a&gt; and posted a write-up on Claude discovering a novel enzyme system with CRISPR-like repeats&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE9JT0FwTVctZXNkYnJXeW44aHhoZmJfbDYwN3B4a2tMTThJZm9XRklxMkEzdFlxb2Z6VGM2UnpDTGlaQ09PODJUMkJFWWl1UVZOTDJ0WU1UQ1pZMDlrbS0tM3FTS0RGWmNSeGt5QlJjZktQWkl4N0E?oc=5" rel="noopener noreferrer"&gt;Claude discovers a novel enzyme system with CRISPR-like repeats - Anthropic&lt;/a&gt;. xAI announced Grok 4.7 on its own site&lt;a href="https://news.google.com/rss/articles/CBMiP0FVX3lxTFBqb2x1bzQ3UkxTVDFCUVRjODMzbDJ5YTg3Nmh5Q2luZGdUTmctZmo1Ukp4c3RVdUhfSGZFc1p5SQ?oc=5" rel="noopener noreferrer"&gt;Introducing Grok 4.7 - x.ai&lt;/a&gt;, and a third-party write-up from Mezha frames the release with a "almost like Claude, but a fraction of the price" hook&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTE5Pdk5IQUxjclZPaHhwYzdBeFhDa1hZRzlXM193Tk1FendWYmY4dFE5aGR1UlhUX3JmQ0ltT0szNGtkWVJRN1JBSHZoSWJabzdYbUtVVF9HbjhINmVQVXhfWUhlVELSAWRBVV95cUxOT3ZOSEFMY3JWT2h4cGM3QXhYQ2tYWUc5VzNfd05NRXp3VmJmOHRROWhkdVJYVF9yZkNJbU9LMzRrZFlSUTdSQUh2aEliWm83WG1LVVRfR244SDZlUFV4X1lIZVRC?oc=5" rel="noopener noreferrer"&gt;SpaceXAI has unveiled Grok 4.7: almost like Claude, but a fraction of the price - Mezha&lt;/a&gt;. Airbnb widened access to GPT-6 Astra and OpenAI frontier models&lt;a href="https://news.google.com/rss/articles/CBMiV0FVX3lxTE9JX21aTWVHSG9paXFVQ0hiajZqU095SWY3YVhRbzNPSWZmRWFYSXREY3NRTUp0U283dGhyTjVCUXdtNl9kUzZIeU1JbjhzdUtFRGhpREdZRQ?oc=5" rel="noopener noreferrer"&gt;Airbnb widens access to GPT-6 Astra and OpenAI frontier models - openai.com&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The Mezha headline names the source "SpaceXAI" — the article uses this term to refer to xAI, which is itself unusual; treat the naming as third-party framing rather than a separate entity. The Mezha price-vs-Claude framing is editorial, not a vendor claim — handle with the same skepticism you would apply to any pricing-comparison article.&lt;/p&gt;

&lt;p&gt;The honest engineering read on three flagship-tier releases and an OpenAI distribution expansion inside a single week is that the demo-to-API gap is what to watch. None of this week's headlines provide a head-to-head benchmark on identical tasks, so the integration-cost question is concrete: every flagship release is also a context-window change, a prompt-cache rule change, and a tool-use schema change. Budget the migration, not the model. Airbnb's GPT-6 Astra widening is a distribution event — closed-frontier models are reaching consumer surfaces through partner channels as well as APIs.&lt;/p&gt;

&lt;h2&gt;
  
  
  Moonshot's Kimi K3 lands on AWS Bedrock
&lt;/h2&gt;

&lt;p&gt;Silicon UK reports Amazon adding Moonshot's Kimi K3 to its cloud platform&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5YVHctMkFGS3BrSlVweW9jbmpURDJXMWtNYjdnTDJhdlZkSndhY0s3b1lYYU1Ocm5RaE5VeDVHcGFpTzdiVUsxQVBrZFlYRE94aFFoR2lZMzVEd0xmM3BWSGFaWVRLSUx5MjQzbHVuNlJuVTlMT2c?oc=5" rel="noopener noreferrer"&gt;Amazon Adds Moonshot’s Kimi K3 To Cloud Platform - Silicon UK&lt;/a&gt;, and finance.biggo.com frames the listing as Moonshot AI's "overseas revenue-sharing model" going live&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTFBiaTZLWEstcWVNcWNWc19hNzgzSFU0X0pzV1pNR0w0UTJsVXdBWmZYQkxSYVFCNTVteWtkelVXbXk4MUI4S3IxWWhyWFdicDlBU3NlWGVOeE0tVWNfNVlxZ0ZlaUhSZXlZcEsySXdvdm9tMFc4WFE?oc=5" rel="noopener noreferrer"&gt;Kimi K3 Lands on AWS Bedrock as Moonshot AI's Overseas Revenue-Sharing Model Goes Live - finance.biggo.com&lt;/a&gt;. This is a distribution event more than a model event. The integration story is the standard Bedrock path — SDK, IAM-scoped regional endpoints, billed through AWS — and the engineering decision is whether to standardize procurement through Bedrock rather than direct Moonshot API, particularly for teams that already have data-residency or procurement routes through AWS.&lt;/p&gt;

&lt;h2&gt;
  
  
  NVIDIA's gating week: encryption at inference, a buy-warning, and a chip partnership
&lt;/h2&gt;

&lt;p&gt;Four NVIDIA items landed. 24/7 Wall St. ran a retrospective piece on $1,000 invested in NVIDIA versus the S&amp;amp;P 500&lt;a href="https://news.google.com/rss/articles/CBMiuwFBVV95cUxOYkhQUGZyWVNVZlFkTTk2QXRwT2g2ZkxOUERSaU93eTJtN1RjMl9Zay1zVHhBY295dUx4UWV6anNnckM2eHM1Nnl5X0JKZmlzb1ozQVBMR2hsVERTdjZrdnpqWGN2SjY2dzF4RW1TQ3RNTTZwYTN2S0dGb3FZQUdjNm8tNWtWNVRrNFNmVFp6ck0zX2tDZXdsbjNRYVJOUUExNV83SlNxbHRzcVlRMVJkQWkxYTRGaWk2WllB?oc=5" rel="noopener noreferrer"&gt;From Gaming Chips to AI Dominance: $1,000 in Nvidia Outpaced the S&amp;amp;P 500 by 54x - 24/7 Wall St.&lt;/a&gt; — investor-history framing, not engineering news; treat as color. Quantum Zeitgeist reports NVIDIA chips now encrypt AI work for data privacy during inference&lt;a href="https://news.google.com/rss/articles/CBMibEFVX3lxTFB2YXJTdzlBeW5sVnlUQjFhOFNiUW05QTN3VkI4bU13OUdYLUJmMkxXZV9KSzR3WGFueUJaMVRsYWtrY09nQVgyLUU0SlZwNFE0Nk5YaE84Tk0tX05pUnBXVFAtOTBJOTk2U0FmMA?oc=5" rel="noopener noreferrer"&gt;NVIDIA Chips Now Encrypt AI Work To Keep Data Private During Inference - Quantum Zeitgeist&lt;/a&gt;. Shattered.io reports Huang warning NVIDIA's AI chip buyers about a "shut down risk"&lt;a href="https://news.google.com/rss/articles/CBMickFVX3lxTFBtVlhnWVE3NEE0aV9uTTNFNUVhZEJHLWd2cFhaUmJ1a21RQTJ3Q0NSbEFmczlmaDFBWjgxb18tOXFVMGZjX25YNjY0MVRoQWg1UW1lWVB3bnRfWE9XbHVLTTk3eTY1RDBNaUoxY09RNlhQUQ?oc=5" rel="noopener noreferrer"&gt;Huang Warns Nvidia's AI Chip Buyers: Shut Down Risk - shattered.io&lt;/a&gt;, and Intellectia AI's piece on the Nvidia–Amazon chip collaboration&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxPSzB1RE9keDQ2SWROZjJReFNjdUZCakFjNDg4Mk1lRFBmOXpYMG05MExYbGJVNG8ycWUtVE45S1FlUHczbE8zRDVySkppSkpTUmJGZnZOeUdSbXNZSHNkVWxaLUIxbTRvQWhOMGxYczIwazIyOUZ5dmxkVGIxOGNsbQ?oc=5" rel="noopener noreferrer"&gt;Nvidia and Amazon's Chip Collaboration Explained - Intellectia AI&lt;/a&gt; rounds out the supply-side picture.&lt;/p&gt;

&lt;p&gt;The encryption-during-inference note&lt;a href="https://news.google.com/rss/articles/CBMibEFVX3lxTFB2YXJTdzlBeW5sVnlUQjFhOFNiUW05QTN3VkI4bU13OUdYLUJmMkxXZV9KSzR3WGFueUJaMVRsYWtrY09nQVgyLUU0SlZwNFE0Nk5YaE84Tk0tX05pUnBXVFAtOTBJOTk2U0FmMA?oc=5" rel="noopener noreferrer"&gt;NVIDIA Chips Now Encrypt AI Work To Keep Data Private During Inference - Quantum Zeitgeist&lt;/a&gt; is the engineering-relevant one: if it ships as described across the SKU line, it changes confidential-computing threat models for hosted model deployments in customer-regulated industries. The "shut down risk" warning&lt;a href="https://news.google.com/rss/articles/CBMickFVX3lxTFBtVlhnWVE3NEE0aV9uTTNFNUVhZEJHLWd2cFhaUmJ1a21RQTJ3Q0NSbEFmczlmaDFBWjgxb18tOXFVMGZjX25YNjY0MVRoQWg1UW1lWVB3bnRfWE9XbHVLTTk3eTY1RDBNaUoxY09RNlhQUQ?oc=5" rel="noopener noreferrer"&gt;Huang Warns Nvidia's AI Chip Buyers: Shut Down Risk - shattered.io&lt;/a&gt; is harder to act on from the headline alone — flag it as a vendor-channel risk worth raising with your hardware supplier, not an immediate procurement signal.&lt;/p&gt;

&lt;h2&gt;
  
  
  Where the integrations actually break
&lt;/h2&gt;

&lt;p&gt;The two cross-cutting engineering questions this week, neither answered by headlines alone:&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;Open-weight image models — pilot or production?&lt;/strong&gt; A 7B image model that runs on a single high-memory GPU at batchable latency changes the cost calculus for design, marketing, and localization pipelines. The honest position is: run a two-week pilot on your own prompt distribution, do not extrapolate from Alibaba's benchmarks to your use case.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Multi-vendor audio/voice — total-cost-of-ownership check.&lt;/strong&gt; When a 95% price cut lands on one side and a new Google TTS arrives on the other, renegotiate audio contracts before they renew. The reason is not that Gemini 3.8 is better — the reason is that the floor just moved.&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Neither of these requires picking a winner. Both require re-pricing your assumptions.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-09-18 to 2026-09-25 | 模型晶片雙線交火，前沿落地訊號開始分流</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 24 Sep 2026 23:04:31 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-18-to-2026-09-25-mo-xing-jing-pian-shuang-xian-jiao-huo-qian-yan-luo-di-xun-hao-kai-shi-fen-liu-1o72</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-18-to-2026-09-25-mo-xing-jing-pian-shuang-xian-jiao-huo-qian-yan-luo-di-xun-hao-kai-shi-fen-liu-1o72</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：能不能進到實際工作流程，這個問題已經比模型能力本身更早分裂陣營——同一週裡，有人靠科學發現驗證專業場景，有人用 7B 模型對標閉源巨獸，也有人開始把推論過程加密當賣點。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  前沿模型：能力上探與落地驗證並行
&lt;/h2&gt;

&lt;p&gt;Anthropic 本週連發 Opus 5.5&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9xbTN1a0tOdm9kT0JxbVBHMU9XYUhpUjd0MHNFYm8yd2pRMnhjdEYzdjF3ckZEY1V0a2ZQTXlyRUhteVozMlhDbVQ3Mm1KWlRYbUVF?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Opus 5.5 - Anthropic&lt;/a&gt; 與一則研究案例：Claude 在結構生物學中發現一組帶有 CRISPR-like 重複序列的新型酶系統&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE9JT0FwTVctZXNkYnJXeW44aHhoZmJfbDYwN3B4a2tMTThJZm9XRklxMkEzdFlxb2Z6VGM2UnpDTGlaQ09PODJUMkJFWWl1UVZOTDJ0WU1UQ1pZMDlrbS0tM3FTS0RGWmNSeGt5QlJjZktQWkl4N0E?oc=5" rel="noopener noreferrer"&gt;Claude discovers a novel enzyme system with CRISPR-like repeats - Anthropic&lt;/a&gt;。兩件事擺在一起讀，作者的解讀是：能力要被獨立任務驗證，不能停在 benchmark。對導入端的意義是，長鏈推理與多步驟工具使用已具備承接真實研究流程的可能性，但仍要看是否提供 API/SDK、可不可以批次重跑、能不能保留審計軌跡——這些工程條件比模型名稱更早決定能不能用。&lt;/p&gt;

&lt;p&gt;xAI 的 Grok 4.7&lt;a href="https://news.google.com/rss/articles/CBMiP0FVX3lxTFBqb2x1bzQ3UkxTVDFCUVRjODMzbDJ5YTg3Nmh5Q2luZGdUTmctZmo1Ukp4c3RVdUhfSGZFc1p5SQ?oc=5" rel="noopener noreferrer"&gt;Introducing Grok 4.7 - x.ai&lt;/a&gt; 由外部媒體形容為「幾乎像 Claude，但只要零頭價格」&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTE5Pdk5IQUxjclZPaHhwYzdBeFhDa1hZRzlXM193Tk1FendWYmY4dFE5aGR1UlhUX3JmQ0ltT0szNGtkWVJRN1JBSHZoSWJabzdYbUtVVF9HbjhINmVQVXhfWUhlVELSAWRBVV95cUxOT3ZOSEFMY3JWT2h4cGM3QXhYQ2tYWUc5VzNfd05NRXp3VmJmOHRROWhkdVJYVF9yZkNJbU9LMzRrZFlSUTdSQUh2aEliWm83WG1LVVRfR244SDZlUFV4X1lIZVRC?oc=5" rel="noopener noreferrer"&gt;SpaceXAI has unveiled Grok 4.7: almost like Claude, but a fraction of the price - Mezha&lt;/a&gt;。這類橫向比較帶敘事目的，技術讀者要看的是：在你的延遲預算與 token 成本模型下，是否真的能換掉。另外 Grok 系列過往的內容審查爭議並未隨版本消失，企業場景仍需自建內容過濾層。&lt;/p&gt;

&lt;p&gt;Google DeepMind 把 Gemini 3.8 的文字轉語音（TTS）以端到端形式推出&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5WcjNIZnlIRHEwcWJheFhuMHAyYTZlVXFPcEZDZ1ZiSk5YdEdoZ2Y0QjZFb0NDNDB1UlRMN055YUc5d2x4RFRObjVIbUVaT2JnQnR0MnU4MjUtdjBVUE9yRVhLNXdNUDNSLWpMN3g4WlkyZEJWa3c?oc=5" rel="noopener noreferrer"&gt;Gemini 3.8 text-to-speech says hello - Google DeepMind&lt;/a&gt;，同週另有報導指出 Gemini 4 已接近完成&lt;a href="https://news.google.com/rss/articles/CBMieEFVX3lxTFBxN0dLZmNWYXhBbkF5b3hNdElRekd6VnB3ZDAxNW5VMXVreVlQcDRCQXhLUXBvZ2hTVUxZdnZoNDBBLUpIV2NsVkVpMVdLMElOQnNNbVkzRFFpUUdTSnF6bjdLN1dYd3VkMzR3ZlFycVZVN2d5Vzc5MQ?oc=5" rel="noopener noreferrer"&gt;Google DeepMind chief says Gemini 4 is almost ready - The Mac Observer&lt;/a&gt;。3.8 TTS 是產品級更新：語音合成的整合度決定了對話代理、有聲書、客服等場景的可用性；至於「幾乎就緒」的 Gemini 4，目前僅止於廠商說法，沒有 release notes、沒有 benchmark 細節，導入決策請等正式 release。&lt;/p&gt;

&lt;h2&gt;
  
  
  開源與性價比：小模型正面對標閉源巨獸
&lt;/h2&gt;

&lt;p&gt;阿里 Qwen-Image-2.1 把影像生成與編輯壓到 7B 參數&lt;a href="https://news.google.com/rss/articles/CBMiekFVX3lxTE1OX0pYdXpNOURpRGJ1cV9VblZMaDlra2N4VllDNHE0LWlKUUhuRVRqM3FqZkFNR1dUbWZ1aEVrVDRFeHd1U1hQM3BmYWs3LTlGSm9RRWRtTkk2cWNnNHBoRGlqcHliRVJGRkQ5bDZ4X2lCTkpIbHIxT253?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-Image-2.1 Brings Native Transparency to a 7B Model - eweek.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMigwFBVV95cUxNU0JXUndVd2hCcXdycTc4XzhSWHpJOUtaN1NRWjQxWTJkY2J2UUJzRWdzWFNiLVJHRE1tN0d0YmFUdmdGekhfQmFhNWhHLWozOW42eW1FRlV5Ty1mWG9iNzlJcWd0VUM2OFJJalh0czYwLThiXzJMcTBjUEx5dGstenlwONIBiAFBVV95cUxPVl9MN2plOFZTMk1kSF9OZXY5XzNHSkVWb2Q3T2VIbTNScjltNEZCakNXTzlKQ0lCamVYVjNDdVFwYlVFLTB5SWJFNGZkY2wwNUNCaW5GMDhoM1NZM0tjWUFLWFBiamhhWG9XMTZnM0tSNUFpZ0E0WmlFT0NBU0hvcWpfX290ejVz?oc=5" rel="noopener noreferrer"&gt;Alibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing - MarkTechPost&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi1wFBVV95cUxPcW83SUN6S3dlZ19qVVgwZ3h0bmpwemJRRmZ0RFhsT3hkbEhUQ3JWOVFWSWpSU0NEYTNHTlp1RWZyVE00dFJSUjJ3UFMxTjhZWUU3RWRZOV9iSjZVUUVxc1ROd25UWkJqZmFOSDdwWlFLQ2gxV0UxeWNxbU8xRFY2NUZtYXc3NnVBU1NYcWJTcUVxdW8wYjk2aVMyc1k1QnQwUllPc0xTTkxQczdHeGNCSlNtOTRsSHR6VW81RWZXVXFaa3BrajRZdGp2ejR6VExKcTduRmRaTQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's open-weight Qwen-Image-2.1 claims to beat closed models in image generation with just 7 billion parameters - the-decoder.com&lt;/a&gt;，官方說法是在多項影像任務上可與 OpenAI 與 Meta 的閉源模型競爭&lt;a href="https://news.google.com/rss/articles/CBMi9gJBVV95cUxQYmZsbFl0SWdUX2Ytb1NjZ2tHV3NYSmZEb1pzUkozSUktWFhwSzAwUlY2a0c2VGVSY2dtNVJvYTFHV1FNOGpzYTVjTjRpS085SU9qQlk4UzRWdnYxX2Q3Ul9jMU54bVROOG9KLVZobW5xeWZNUVVHa1BMUkxTVTBubUtqSHF6Xzdrek5Mamtjd2xFelVNYUpjY1NtWUtyM0hubC12QTZrYmVuTnZidHM2cTYwSE1hMVZaZkhDYWYwNUhPTXJDa25EelZYSjNBX1JhYWRteERZSU9wR1htQ3RZWGIydVl2SnVlLWpKZ2M2V21SY1RVUDBfMm91dTZqRVRLemJLZzNTZDE3eVp5MVJvSzdObDNud0NHbXNva1lyTUhsY2k1X3Y0OVlhSHBWelZsbFpqOGRUd2FDeTNMalhwUjVBR2NRVHJGSG41WDdQUV9hRzVuRlJaclpvNEZnancwMGhnZlQyVy14X1lMcGJVOFpBeW5OUQ?oc=5" rel="noopener noreferrer"&gt;Alibaba claims new Qwen Image 2.1 AI model beats Google Nano Banana 2.0 with minuscule 7B parameter model — benchmarks show open-weight contender is competitive with OpenAI and Meta image models - Tom's Hardware&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi1wFBVV95cUxPcW83SUN6S3dlZ19qVVgwZ3h0bmpwemJRRmZ0RFhsT3hkbEhUQ3JWOVFWSWpSU0NEYTNHTlp1RWZyVE00dFJSUjJ3UFMxTjhZWUU3RWRZOV9iSjZVUUVxc1ROd25UWkJqZmFOSDdwWlFLQ2gxV0UxeWNxbU8xRFY2NUZtYXc3NnVBU1NYcWJTcUVxdW8wYjk2aVMyc1k1QnQwUllPc0xTTkxQczdHeGNCSlNtOTRsSHR6VW81RWZXVXFaa3BrajRZdGp2ejR6VExKcTduRmRaTQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's open-weight Qwen-Image-2.1 claims to beat closed models in image generation with just 7 billion parameters - the-decoder.com&lt;/a&gt;。以下三個工程提問並非來源討論的範圍、是作者延伸的：在多模態領域，「小模型能跑」與「能跑進工作流程」是兩件事——原生透明通道是否真的省下後處理、推論成本對 7B 模型是否仍可控、生成結果是否能進入現有 DAM/內容審核管線，都是導入前要自己驗證的環節。&lt;/p&gt;

&lt;p&gt;音訊方面，Qwen Audio 3.1 同時上新模型並對語音價格砍最高 95%&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxNYVdTYkVkR2ZZNFZJdURHdlV1RzZGQnFuLXh0Vkd1MnFCQTFicUc3SnFCWUJRZlIxUFZMbEZlbUsxYzIyOTdCWUpiUXFMX3F5VVp6RE5yNVpiN1U5dklCQnZOeHpkMHNZRWR6TXM2ZV9fWm1PeWRMLU5hanhCbXZVN2pna21ucTR4M0hyQkxDNnh3eTNMNUQwWjltdkhZcjNLQXAyVkp3SnBZUXkxTHpJWFVTX3BFSDJHTXk4dTRkakRNdWc?oc=5" rel="noopener noreferrer"&gt;Alibaba launches Qwen Audio 3.1 with new models and slashes AI audio prices by up to 95 percent - the-decoder.com&lt;/a&gt;。對客服、會議記錄、podcast 後製這類用量敏感的場景，這個價差直接改變 ROI 計算；具體節省隨用量與計價單位而異，鎖定合約前請把 API 版本、計價單位、區域 endpoint 寫清楚，價格戰也意味著供應商未來可能隨時調整費率。&lt;/p&gt;

&lt;p&gt;企業端整合：Airbnb 對 GPT-6 Astra 與 OpenAI 前沿模型的存取擴大&lt;a href="https://news.google.com/rss/articles/CBMiV0FVX3lxTE9JX21aTWVHSG9paXFVQ0hiajZqU095SWY3YVhRbzNPSWZmRWFYSXREY3NRTUp0U283dGhyTjVCUXdtNl9kUzZIeU1JbjhzdUtFRGhpREdZRQ?oc=5" rel="noopener noreferrer"&gt;Airbnb widens access to GPT-6 Astra and OpenAI frontier models - openai.com&lt;/a&gt;——這是企業把生成式 AI 內嵌到產品主流程的訊號，前提是多區域推論、內容安全與資料落地都已談妥；對其他企業的價值是同業驗證，不是技術本身。&lt;/p&gt;

&lt;h2&gt;
  
  
  中國自研晶片：對標 NVIDIA 的訊號與現實差距
&lt;/h2&gt;

&lt;p&gt;阿里發表真武 V900 加速器，官方宣稱是「中國最強 AI 晶片」，支援 50 萬顆等級的超級叢集，10T 參數 Qwen 模型已在路線圖&lt;a href="https://news.google.com/rss/articles/CBMi6AJBVV95cUxNZXdKRTNKSWxHZEFza3k0bHV2Tng3RnNuY3pjWmtCZWQwaEF5Si1IblRzRnpoamRwRV9UbmF6NFlTV1AzNXZkOGxBNVFZalQtU3RCZTJqbERuRHEyMlVEdU5SY2V6d0xQRzEtRHZJbmVLZUc1MnlvdVM5VTQxLTJaWWRjTUQwdXJRaHplMkVicHZ4SkZlbzhYcHhLS2Y4WklOam5FcnZMSURnV0Fnc0M2a1p1UTZwa0F2WW5WaklNZXBNSzFIXzZMaU9NeUFvZjdzNldwV0plWTNCcy1SLW9yNHhEREN5R2tra2hreTNXSDF5V3hXcy1EYmNhUDNBSUF2VkpyNTRKbVlGbGh4Wmt2MVJDc2hDOTFBNC1GNlRETmlObjBmSzlmbF9hYmxuZ0NSVjQwRHd2YWhUTXBJZUdjWENrUEZCTVM4UmtBYWlSdXBYaVY0YmMtV2V3ak1TVmpjTmxiR0FJSXM?oc=5" rel="noopener noreferrer"&gt;Alibaba unveils Zhenwu V900 AI accelerator, claims it's 'the most powerful AI chip in China' — accelerator supports 500,000 chip supercluster with a 10T-parameter Qwen model on the roadmap - Tom's Hardware&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinwFBVV95cUxPbkFWM19uZVBRX3JWX2N1ZEJraHJpZjllUy04Y2VRUzFmRVVYS0xyZGxTOG9oTFdnb1VkT2Z2WVZQTzk1U0E0NUpfLXF0QWRROXNVYTZhcm1Damd2NnhwaDllMW5xQzFqVFhkN3N3aGI1Qm1GOFk2OTRyVkYyMzdRak1OQkpKdlNqbEpqUTlBaTEtZG02VUVTYzlOYXA5cm8?oc=5" rel="noopener noreferrer"&gt;China’s Alibaba unveils a new powerful AI chip - Northwest Arkansas Democrat-Gazette&lt;/a&gt;。V900 的可用性仍屬發布層級——沒有第三方 benchmark、沒有公布製程與生態相容性，採購評估請以實測叢集利用率、模型編譯工具鏈成熟度、與既有 CUDA 程式遷移成本為主，而非峰值規格。&lt;/p&gt;

&lt;p&gt;對照 NVIDIA 既有的單卡 H100/H200、NVLink 擴展到 NVL72/GB200 NVL72、推論專用卡與網路，是作者自行整理的背景知識（不在 #5、#6 的標題文字內）；換言之，V900 與 NVIDIA 現有產品線的對比，需讀者另行查證。&lt;/p&gt;

&lt;p&gt;OpenAI 與 Broadcom 的 LLM 最佳化處理器屬於合作宣布&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5YVHctMkFGS3BrSlVweW9jbmpURDJXMWtNYjdnTDJhdlZkSndhY0s3b1lYYU1Ocm5RaE5VeDVHcGFpTzdiVUsxQVBrZFlYRE94aFFoR2lZMzVEd0xmM3BWSGFaWVRLSUx5MjQzbHVuNlJuVTlMT2c?oc=5" rel="noopener noreferrer"&gt;Amazon Adds Moonshot’s Kimi K3 To Cloud Platform - Silicon UK&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTFBiaTZLWEstcWVNcWNWc19hNzgzSFU0X0pzV1pNR0w0UTJsVXdBWmZYQkxSYVFCNTVteWtkelVXbXk4MUI4S3IxWWhyWFdicDlBU3NlWGVOeE0tVWNfNVlxZ0ZlaUhSZXlZcEsySXdvdm9tMFc4WFE?oc=5" rel="noopener noreferrer"&gt;Kimi K3 Lands on AWS Bedrock as Moonshot AI's Overseas Revenue-Sharing Model Goes Live - finance.biggo.com&lt;/a&gt;——本文未引用此條來源，請以正式 release 為準。&lt;/p&gt;

&lt;h2&gt;
  
  
  雲端通路與商業化：模型上架誰家平台
&lt;/h2&gt;

&lt;p&gt;Moonshot 的 Kimi K3 上架 AWS Bedrock&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTFBiaTZLWEstcWVNcWNWc19hNzgzSFU0X0pzV1pNR0w0UTJsVXdBWmZYQkxSYVFCNTVteWtkelVXbXk4MUI4S3IxWWhyWFdicDlBU3NlWGVOeE0tVWNfNVlxZ0ZlaUhSZXlZcEsySXdvdm9tMFc4WFE?oc=5" rel="noopener noreferrer"&gt;Kimi K3 Lands on AWS Bedrock as Moonshot AI's Overseas Revenue-Sharing Model Goes Live - finance.biggo.com&lt;/a&gt;，對中文長文與長上下文工作流是直接選項；對企業架構的意義是又多一個在 Bedrock 上能統一計費、權限與私網連線的模型，省下自建推論叢集的維運成本。對照的是直接呼叫 Moonshot API，後者在資料落地中國境外有疑慮的場景可能需要額外評估，AWS Bedrock 在這點上是賣點。官方商業模式採海外分潤&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTFBiaTZLWEstcWVNcWNWc19hNzgzSFU0X0pzV1pNR0w0UTJsVXdBWmZYQkxSYVFCNTVteWtkelVXbXk4MUI4S3IxWWhyWFdicDlBU3NlWGVOeE0tVWNfNVlxZ0ZlaUhSZXlZcEsySXdvdm9tMFc4WFE?oc=5" rel="noopener noreferrer"&gt;Kimi K3 Lands on AWS Bedrock as Moonshot AI's Overseas Revenue-Sharing Model Goes Live - finance.biggo.com&lt;/a&gt;，定價結構在合約層。&lt;/p&gt;

&lt;h2&gt;
  
  
  基礎設施與安全：推論加密與晶片依賴的辯論
&lt;/h2&gt;

&lt;p&gt;NVIDIA 推論加密&lt;a href="https://news.google.com/rss/articles/CBMibEFVX3lxTFB2YXJTdzlBeW5sVnlUQjFhOFNiUW05QTN3VkI4bU13OUdYLUJmMkxXZV9KSzR3WGFueUJaMVRsYWtrY09nQVgyLUU0SlZwNFE0Nk5YaE84Tk0tX05pUnBXVFAtOTBJOTk2U0FmMA?oc=5" rel="noopener noreferrer"&gt;NVIDIA Chips Now Encrypt AI Work To Keep Data Private During Inference - Quantum Zeitgeist&lt;/a&gt; 與黃仁勳對買家提出「斷供風險」警告&lt;a href="https://news.google.com/rss/articles/CBMickFVX3lxTFBtVlhnWVE3NEE0aV9uTTNFNUVhZEJHLWd2cFhaUmJ1a21RQTJ3Q0NSbEFmczlmaDFBWjgxb18tOXFVMGZjX25YNjY0MVRoQWg1UW1lWVB3bnRfWE9XbHVLTTk3eTY1RDBNaUoxY09RNlhQUQ?oc=5" rel="noopener noreferrer"&gt;Huang Warns Nvidia's AI Chip Buyers: Shut Down Risk - shattered.io&lt;/a&gt; 出現在同一週。技術面上前者處理的是「資料在 GPU 內部被處理的過程中是否可被窺探」，對金融、醫療、政府這類高敏場景是直接價值；後者則把地緣政治風險包進晶片採購決策，提醒買家把單一供應商曝險納入架構審查。兩件事一起讀，訊號很清楚：算力不只是效能題，也是合規題。NVIDIA 與 AWS 在晶片上的合作則被定位為雲端供應鏈的一環&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxPSzB1RE9keDQ2SWROZjJReFNjdUZCakFjNDg4Mk1lRFBmOXpYMG05MExYbGJVNG8ycWUtVE45S1FlUHczbE8zRDVySkppSkpTUmJGZnZOeUdSbXNZSHNkVWxaLUIxbTRvQWhOMGxYczIwazIyOUZ5dmxkVGIxOGNsbQ?oc=5" rel="noopener noreferrer"&gt;Nvidia and Amazon's Chip Collaboration Explained - Intellectia AI&lt;/a&gt;——「不是技術替代方案」是作者的延伸判斷，#20 標題本身並未明示這層語意。&lt;/p&gt;

&lt;h2&gt;
  
  
  投資人視角：歷史回報不等於未來表現
&lt;/h2&gt;

&lt;p&gt;24/7 Wall St. 用 24.5 年回測指出，1,000 美元投入 NVDA 跑贏 S&amp;amp;P 500 約 54 倍&lt;a href="https://news.google.com/rss/articles/CBMiuwFBVV95cUxOYkhQUGZyWVNVZlFkTTk2QXRwT2g2ZkxOUERSaU93eTJtN1RjMl9Zay1zVHhBY295dUx4UWV6anNnckM2eHM1Nnl5X0JKZmlzb1ozQVBMR2hsVERTdjZrdnpqWGN2SjY2dzF4RW1TQ3RNTTZwYTN2S0dGb3FZQUdjNm8tNWtWNVRrNFNmVFp6ck0zX2tDZXdsbjNRYVJOUUExNV83SlNxbHRzcVlRMVJkQWkxYTRGaWk2WllB?oc=5" rel="noopener noreferrer"&gt;From Gaming Chips to AI Dominance: $1,000 in Nvidia Outpaced the S&amp;amp;P 500 by 54x - 24/7 Wall St.&lt;/a&gt;。這是事後報酬數據，不是前瞻表現；對工程讀者的訊號是：AI 基礎設施的價值在過去一個世代被市場重估過，不代表下一個五年仍是同一檔股票結構。技術導入評估與資本配置評估是兩件事，評估時請分開看待。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-09-11 to 2026-09-18 | Cost floors fall, frontier labs discuss safety</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 17 Sep 2026 23:11:20 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-11-to-2026-09-18-cost-gaps-widen-safety-frameworks-converge-59ml</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-11-to-2026-09-18-cost-gaps-widen-safety-frameworks-converge-59ml</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Three shifts hit the same week: DeepSeek's V4.1-Flash pricing resets the off-peak cost floor&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;, Google presents a real-time voice stack for developers&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;, and the three frontier labs publicly discuss collaboration on AI safety&lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxQU2hNbVd5RVh6MTNQU3RjMVBLdnZmbzhRTVhHSnJ0dko1ZnVNeUw2Tm1xLXk3VE5xa3phZTB3TmFHYjJ2emlUZHgyc0NSbEV1RFpGY3JCODFCNW52WjJfdFhVNzFFbExIY1lDS3BwalhUUllSWEtYNm1KM1ZJRHdVVTc4QnlhcFRiX2NnWUZmSlRwdmc4Z0FvQnNucW9GTXlqZW5PREhzWVlWTllxTHlJ?oc=5" rel="noopener noreferrer"&gt;OpenAI Says It’s Working With Anthropic, Google on AI Safety - Bloomberg.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBVX3pnQ1lXY2F2Y3MtZVNTUlZsb2hYeWQxaF9tSTB6aHZRUlR5azdFRkhLOV9EZDZWaHpGUWpqalo2SXVCb1pRQWgyVVNmamsweDJMUzBDeGtUWHBGZ1dRR3p4NHQwNG1CcG51ZWVBM252azBjMTNn0gF8QVVfeXFMUE0zU1ZReFVzWHBKMzliU2ZWbjRMaENCTUwzS3I0TlVwV1Q2dFRkQTNDbU5xelV1MVBWWjZ1NmFJTmNtZEVoc3pXYWRmTXpqUkVoUnlTTHpBbUlOb29aQmExb3NyeTQ2d05ta2VCb1dSaWZLclQ5OUhLSktrbA?oc=5" rel="noopener noreferrer"&gt;OpenAI, Google, Anthropic discussing collaboration on AI safety issues - cnbc.com&lt;/a&gt;. The thread connecting them is the gap between what is announced and what an engineer can actually wire up by Friday.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  The cost floor keeps falling — but check the caveats
&lt;/h2&gt;

&lt;p&gt;DeepSeek released V4.1-Flash, and the headline number is the off-peak cached-input rate at $0.003 per 1M tokens&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;. The vendor positions it against flagship GPT-5.6 Sol and Claude Opus 5 on benchmarks&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;. A separate third-party comparison frames DeepSeek V4 Pro against Qwen3-Coder and Devstral&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPOGZPZnNFd0lnWk01VlkxWWhlSWg3cEhyQk93YWNxUVpRY0hQTmw3UlpSTHZPRkdYb2N2QTFFbTcycXowbVptb2NoLTRubk8yVVhlRTVEeGFRWXZqa29qNUdXWXVGRGwxN3d4cTlWc3VVRVFGV1doN2E0aXZLYUdOSUx5M1I?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4 Pro vs Qwen3-Coder vs Devstral: 11pt Gap [2026] - tech-insider.org&lt;/a&gt;, and a third piece puts a 33x cost gap on the table between GPT-6 Astra, Claude Fable 5.1, and DeepSeek V4.1&lt;a href="https://news.google.com/rss/articles/CBMikgFBVV95cUxNUWhHekU2dVpKWkRGSnJINlZLcFFseFhSZVJpSUdLSkpVQmVxQjVwOVY5dkNkWFdmRTQ0bHdXRWU1OGZEWmNFUmhLQ1ExcUo4ckRPNk4yTTRka2FidXo5Ym5xSlBabkRDckxnVjBSTVVGOVphMnlNcmQ3X1VmMHNDODhvY1Uzb1dFMTVmaWN0cFVGQQ?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra vs Claude Fable 5.1 vs DeepSeek V4.1: 33x Cost Gap [2026] - tech-insider.org&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The cost story is real, but three caveats matter for engineers:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Off-peak is not peak.&lt;/strong&gt; The $0.003 figure applies to cached-input off-peak traffic&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;. The headline gives only the off-peak cached-input rate; business-hours traffic will likely pay more, so read the full rate sheet. Anyone pasting the headline number into a capacity-planning spreadsheet without reading the rate sheet will under-budget.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Benchmark provenance matters.&lt;/strong&gt; The DeepSeek claim that V4.1-Flash outperforms flagship V4-Pro comes from the vendor's own positioning&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxNQXFfeTlYOEQwQ1hHVFFuY2RrLVplZ2NxaGJLY1o1UER2R3d1bWNzdWpiRDZpLTVzckZob3FkQjVabTc1OVd4dGZMY19rRkhwczZZdEtHSEpoSWRSdDhKclFRaDdvRzdNc1o2ZEFHZXNpcVEtb0dCakhPcVpnUjRHQktkQmhWRFBHU0JIWWdicmZJSDI0SDR1Mk9HYm1xWC01VE5r?oc=5" rel="noopener noreferrer"&gt;DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLE&lt;/a&gt;. The Qwen3-Coder and Devstral comparison&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPOGZPZnNFd0lnWk01VlkxWWhlSWg3cEhyQk93YWNxUVpRY0hQTmw3UlpSTHZPRkdYb2N2QTFFbTcycXowbVptb2NoLTRubk8yVVhlRTVEeGFRWXZqa29qNUdXWXVGRGwxN3d4cTlWc3VVRVFGV1doN2E0aXZLYUdOSUx5M1I?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4 Pro vs Qwen3-Coder vs Devstral: 11pt Gap [2026] - tech-insider.org&lt;/a&gt; and the Astra/Fable/V4.1 spread&lt;a href="https://news.google.com/rss/articles/CBMikgFBVV95cUxNUWhHekU2dVpKWkRGSnJINlZLcFFseFhSZVJpSUdLSkpVQmVxQjVwOVY5dkNkWFdmRTQ0bHdXRWU1OGZEWmNFUmhLQ1ExcUo4ckRPNk4yTTRka2FidXo5Ym5xSlBabkRDckxnVjBSTVVGOVphMnlNcmQ3X1VmMHNDODhvY1Uzb1dFMTVmaWN0cFVGQQ?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra vs Claude Fable 5.1 vs DeepSeek V4.1: 33x Cost Gap [2026] - tech-insider.org&lt;/a&gt; both come from the same third-party benchmark outlet, not an independent reproduction. Treat these as procurement shortcuts, not ground truth.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Flagship vs flash is a real distinction.&lt;/strong&gt; V4.1-Flash is the cheap tier&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;. DeepSeek says the cheap tier outperforms its flagship V4-Pro, but that is a vendor claim, not an independent result&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxNQXFfeTlYOEQwQ1hHVFFuY2RrLVplZ2NxaGJLY1o1UER2R3d1bWNzdWpiRDZpLTVzckZob3FkQjVabTc1OVd4dGZMY19rRkhwczZZdEtHSEpoSWRSdDhKclFRaDdvRzdNc1o2ZEFHZXNpcVEtb0dCakhPcVpnUjRHQktkQmhWRFBHU0JIWWdicmZJSDI0SDR1Mk9HYm1xWC01VE5r?oc=5" rel="noopener noreferrer"&gt;DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLE&lt;/a&gt;. Mapping the cheap tier's price onto the flagship tier's tasks is the error pattern that turns cost savings into quality regressions.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;The honest read: if your workload is high-volume, latency-tolerant, and cacheable, V4.1-Flash is now a credible default to benchmark against. If your workload is reasoning-heavy or latency-critical, the headline price does not transfer.&lt;/p&gt;

&lt;h2&gt;
  
  
  Voice stops being a demo
&lt;/h2&gt;

&lt;p&gt;Google introduced Gemini 3.8 Live and 3.8 Live Extended Thinking for voice applications&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;. The companion piece spells out the developer path: building real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The two posts pair the model announcement with a developer path in the same week:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Announced:&lt;/strong&gt; a new voice model.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Developer path:&lt;/strong&gt; a build guide for real-time voice applications&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Commercially usable:&lt;/strong&gt; likely, but verify availability and pricing first. "Extended Thinking" is a separate mode, and its latency for sub-second response loops is untested.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;For teams that have been waiting for a non-toy real-time voice stack, this is the moment to start the integration spike. The risk pattern to watch: concurrent-session cost. Real-time voice is likely metered on continuous audio rather than per turn (check the rate card) — model the per-minute spend before the demo goes in front of stakeholders.&lt;/p&gt;

&lt;h2&gt;
  
  
  The frontier labs want the same rulebook
&lt;/h2&gt;

&lt;p&gt;OpenAI, Anthropic, and Google DeepMind are publicly discussing collaboration on AI safety issues&lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxQU2hNbVd5RVh6MTNQU3RjMVBLdnZmbzhRTVhHSnJ0dko1ZnVNeUw2Tm1xLXk3VE5xa3phZTB3TmFHYjJ2emlUZHgyc0NSbEV1RFpGY3JCODFCNW52WjJfdFhVNzFFbExIY1lDS3BwalhUUllSWEtYNm1KM1ZJRHdVVTc4QnlhcFRiX2NnWUZmSlRwdmc4Z0FvQnNucW9GTXlqZW5PREhzWVlWTllxTHlJ?oc=5" rel="noopener noreferrer"&gt;OpenAI Says It’s Working With Anthropic, Google on AI Safety - Bloomberg.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBVX3pnQ1lXY2F2Y3MtZVNTUlZsb2hYeWQxaF9tSTB6aHZRUlR5azdFRkhLOV9EZDZWaHpGUWpqalo2SXVCb1pRQWgyVVNmamsweDJMUzBDeGtUWHBGZ1dRR3p4NHQwNG1CcG51ZWVBM252azBjMTNn0gF8QVVfeXFMUE0zU1ZReFVzWHBKMzliU2ZWbjRMaENCTUwzS3I0TlVwV1Q2dFRkQTNDbU5xelV1MVBWWjZ1NmFJTmNtZEVoc3pXYWRmTXpqUkVoUnlTTHpBbUlOb29aQmExb3NyeTQ2d05ta2VCb1dSaWZLclQ5OUhLSktrbA?oc=5" rel="noopener noreferrer"&gt;OpenAI, Google, Anthropic discussing collaboration on AI safety issues - cnbc.com&lt;/a&gt;, and a separate piece frames this as the three labs "wanting AI to be regulated" while flagging who would pay the price&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxPQ0MwNDN3WGM5THBkRURHMWhiSlkyc0JmQmpoRmZrOXRWODV1NW8xWUVIQTN2c3duU0NlX1J4MDZnTXhySm9RSXhFZWtFWXRvblJ1NnlNVExnUTctZlNYRnRQbGwwemJxSTh6ZXNnUk5jR3VnZDBoYkxfY1dRcWNPc29DdzRRdXd6WHJ3dFdPdUw5QUpXTndxMVZTVVM2NEM1MmZj?oc=5" rel="noopener noreferrer"&gt;OpenAI, Anthropic, and Google DeepMind Want AI to Be Regulated — Here’s Who Could Pay the Price - Yahoo Finance&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;This matters less for the immediate engineering roadmap than for future compliance work:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;The shared position in the headline is that all three want AI to be regulated; it does not say they agree on what the rules should be&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxPQ0MwNDN3WGM5THBkRURHMWhiSlkyc0JmQmpoRmZrOXRWODV1NW8xWUVIQTN2c3duU0NlX1J4MDZnTXhySm9RSXhFZWtFWXRvblJ1NnlNVExnUTctZlNYRnRQbGwwemJxSTh6ZXNnUk5jR3VnZDBoYkxfY1dRcWNPc29DdzRRdXd6WHJ3dFdPdUw5QUpXTndxMVZTVVM2NEM1MmZj?oc=5" rel="noopener noreferrer"&gt;OpenAI, Anthropic, and Google DeepMind Want AI to Be Regulated — Here’s Who Could Pay the Price - Yahoo Finance&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;The "who pays" question is unresolved, and the answer is likely to land on deployers and integrators, not on the labs themselves&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxPQ0MwNDN3WGM5THBkRURHMWhiSlkyc0JmQmpoRmZrOXRWODV1NW8xWUVIQTN2c3duU0NlX1J4MDZnTXhySm9RSXhFZWtFWXRvblJ1NnlNVExnUTctZlNYRnRQbGwwemJxSTh6ZXNnUk5jR3VnZDBoYkxfY1dRcWNPc29DdzRRdXd6WHJ3dFdPdUw5QUpXTndxMVZTVVM2NEM1MmZj?oc=5" rel="noopener noreferrer"&gt;OpenAI, Anthropic, and Google DeepMind Want AI to Be Regulated — Here’s Who Could Pay the Price - Yahoo Finance&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;OpenAI separately published a framework for reporting model misalignment&lt;a href="https://news.google.com/rss/articles/CBMickFVX3lxTE5YcmZMVzhRdVd1WUM1QUhIZXZYSUxYZGh6WHptVzhyX1BOOWNIUlYtcW5XVV9Ec2VoNTVIU2JPUjRaX25VOWoyaVNBTVUwLUgyb1FBUEc3a0RyUS1SRjd3WG1fWlVZZkpJQUM1b0pydncwdw?oc=5" rel="noopener noreferrer"&gt;Our framework for reporting model misalignment - OpenAI&lt;/a&gt; and disclosed new concerning AI behavior it now plans to track regularly&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE5wenVuMHkxd2dIMl9kOUdPblJhbUFSeWgxUWoxS21fOUdHNHZHbGVhMEVvUnJVMC1Wa1hFd0x5RlRSUFhpSXYtSzFCUE96bUNFUW9EMTN3OVQ3ZkRKX0gwSW8zOFBNR0FIMVFVT09ndktOWE8zTi1EcDdOOUM?oc=5" rel="noopener noreferrer"&gt;OpenAI flags new concerning AI behavior, to track model misalignment regularly - NPR&lt;/a&gt;. The interesting engineering signal is that misalignment reporting is moving from blog posts to a documented framework — meaning audits, red-team outputs, and incident reports will start accumulating a paper trail. If you build on OpenAI models, you may increasingly be asked about your own misalignment-handling posture.&lt;/p&gt;

&lt;h2&gt;
  
  
  Hardware: demand is real, supply is contested
&lt;/h2&gt;

&lt;p&gt;Jensen Huang said Nvidia will sell twice as many chips next year&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFBMZUVscTltc3BSMGJoVVhPeWlDQ2JiendDa3ZsRmF4VGwzVXAtYlNfUE5vVE13OXBsT1N3MXFYdFdRd25jYkhGaFp4QXEwb0g5cXNQdFhicVl0SWlySk1JTXhoc05qd08tcmhBR2VxQU5DLTVq0gF6QVVfeXFMTXo3S3oxZXdkNml4VG1yM09rSUh4cWp4Tlh2SXdSSGZ1Q0Z4NHBPclhJdmdmbUtWTWVUQnd4YUY0N25IV204WWY1QnZISUJ6bl9ZaXVEQ0dnMU1QdHdva0dSdmVOZWctZnBQaHE0WUdBSkFDYWItM2tQTXc?oc=5" rel="noopener noreferrer"&gt;Jensen Huang says Nvidia will sell twice as many chips next year - cnbc.com&lt;/a&gt;. Separately, an investigation details how export-restricted Nvidia AI chips reach China through firms skirting the regulations&lt;a href="https://news.google.com/rss/articles/CBMimgJBVV95cUxNN2NrR0NpT2hTbHdLcmFUcmVUSEFENVJYNVRXNGRSLXZWWjBuVzNvb3Fpbk5pTWhianJybUt5N2YwNFZxdnpJZ1IxRUhVeFZyYjcwZDFQWnlQY2VDMjFpT3dyNERXd2RuSVBlM2RYR1N0WXBNamFhalNnNjdJN2duUnozVTFoSXdXZHd4ZUhrOUVudU15Um85YzVWc3M0WmxFVV8tRUJkQXJzaWtCWnZzRGZ5Tm5nVlhUT2JGNDNYbkJ5bmFHQTVlLTlPTzZVSU9fZ0szWXgwUnR0Y0I3b2pqcmF5UzBxcE0xSGlrMVRYNUFQbnZHbG42UjlKSE5oS0RGSlo0WTdqUXVUT2hhVWxtX255cldYWXYxdVE?oc=5" rel="noopener noreferrer"&gt;Investigation details how billions' worth of export-restricted Nvidia AI chips are sold to China — report details how Chinese firms skirt Trump's regulations - tomshardware.com&lt;/a&gt;. And Samsung backed a Nvidia AI chip rival in a $230 million funding round as GPU alternatives boom&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1ydVhNMHFzRmctZVp2Sjlsd0tXMm5pNTN6UGoyczRpZlBUTjhITy1ybEQ4SDh0MWNZb09ldElzWEZWS3BBTVZwdnlzQXRBM0FFSzEzOXNCVlJneEFydmdXQWc1MVVCZlZRN1lyWG1KM3U0OXd4aUHSAXtBVV95cUxQSWlJd0JfRlNxTVIwNjEyaG5JQWZwYTRic0lfNFVha09oLVF0UGlyemVpOW1USGN5SlpiWXRiVUxSaVllTnZoaXhGZ3dpR0lkUUlIYTVUWkxTaDJYOUYzYXktbnVRNmgzeDJiWFNLWE5icW5UZTRxVzU2UXc?oc=5" rel="noopener noreferrer"&gt;Samsung backs Nvidia AI chip rival in $230 million funding round as GPU alternatives boom - cnbc.com&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The three together describe a market with genuine supply tension and a genuine second-source market forming:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Demand signal:&lt;/strong&gt; doubling chip sales next year&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFBMZUVscTltc3BSMGJoVVhPeWlDQ2JiendDa3ZsRmF4VGwzVXAtYlNfUE5vVE13OXBsT1N3MXFYdFdRd25jYkhGaFp4QXEwb0g5cXNQdFhicVl0SWlySk1JTXhoc05qd08tcmhBR2VxQU5DLTVq0gF6QVVfeXFMTXo3S3oxZXdkNml4VG1yM09rSUh4cWp4Tlh2SXdSSGZ1Q0Z4NHBPclhJdmdmbUtWTWVUQnd4YUY0N25IV204WWY1QnZISUJ6bl9ZaXVEQ0dnMU1QdHdva0dSdmVOZWctZnBQaHE0WUdBSkFDYWItM2tQTXc?oc=5" rel="noopener noreferrer"&gt;Jensen Huang says Nvidia will sell twice as many chips next year - cnbc.com&lt;/a&gt;. That is a vendor-stated figure, but the order-book signal is consistent with what inference-cost compression (see the DeepSeek section) implies for hardware pull-through.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Contested signal:&lt;/strong&gt; export-restricted chips are still reaching China&lt;a href="https://news.google.com/rss/articles/CBMimgJBVV95cUxNN2NrR0NpT2hTbHdLcmFUcmVUSEFENVJYNVRXNGRSLXZWWjBuVzNvb3Fpbk5pTWhianJybUt5N2YwNFZxdnpJZ1IxRUhVeFZyYjcwZDFQWnlQY2VDMjFpT3dyNERXd2RuSVBlM2RYR1N0WXBNamFhalNnNjdJN2duUnozVTFoSXdXZHd4ZUhrOUVudU15Um85YzVWc3M0WmxFVV8tRUJkQXJzaWtCWnZzRGZ5Tm5nVlhUT2JGNDNYbkJ5bmFHQTVlLTlPTzZVSU9fZ0szWXgwUnR0Y0I3b2pqcmF5UzBxcE0xSGlrMVRYNUFQbnZHbG42UjlKSE5oS0RGSlo0WTdqUXVUT2hhVWxtX255cldYWXYxdVE?oc=5" rel="noopener noreferrer"&gt;Investigation details how billions' worth of export-restricted Nvidia AI chips are sold to China — report details how Chinese firms skirt Trump's regulations - tomshardware.com&lt;/a&gt;. For buyers, this means the supply chain is messier than the official allocation chart. For compliance teams, the circumvention routes are now publicly documented, which invites audit scrutiny.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Alternative signal:&lt;/strong&gt; a $230M round into a Samsung-backed Nvidia rival&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1ydVhNMHFzRmctZVp2Sjlsd0tXMm5pNTN6UGoyczRpZlBUTjhITy1ybEQ4SDh0MWNZb09ldElzWEZWS3BBTVZwdnlzQXRBM0FFSzEzOXNCVlJneEFydmdXQWc1MVVCZlZRN1lyWG1KM3U0OXd4aUHSAXtBVV95cUxQSWlJd0JfRlNxTVIwNjEyaG5JQWZwYTRic0lfNFVha09oLVF0UGlyemVpOW1USGN5SlpiWXRiVUxSaVllTnZoaXhGZ3dpR0lkUUlIYTVUWkxTaDJYOUYzYXktbnVRNmgzeDJiWFNLWE5icW5UZTRxVzU2UXc?oc=5" rel="noopener noreferrer"&gt;Samsung backs Nvidia AI chip rival in $230 million funding round as GPU alternatives boom - cnbc.com&lt;/a&gt;. Second-source silicon is no longer theoretical; it is being capitalized at scale.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;For capacity planning, the takeaway is that demand and cleanly regulated supply may not line up. If you are sizing a 2027 deployment, model two scenarios — one where Nvidia allocation comes through on schedule, and one where the export-contested grey channel narrows and the second-source chips are not yet volume-ready.&lt;/p&gt;

&lt;h2&gt;
  
  
  Scientific applications are real but narrow
&lt;/h2&gt;

&lt;p&gt;Anthropic published a piece on how Claude is being used for biomolecular modeling&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE5PbzNJUlpWVXZ6VzVsNU13YVBoQUNmTDNEUG83cTFoZk1oU0ZQMFJCWFhqNTFZSGVZWkg3RjBRNktiaXZjd1ZoNTRLM3NpS2V4a3lVUXRJVXFDbXVwRmhfdDlPSy04ZVBzUHB3aHFEUjRtcHVzd0dvN0NYMA?oc=5" rel="noopener noreferrer"&gt;How Claude is uplifting biomolecular modeling - Anthropic&lt;/a&gt;, and a separate piece reports that an Anthropic AI broke mathematicians' record for the most complicated curve&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxOQURZTjVJM1hoVzJnSGdacHcydUhOUHR0NUhnd0pLNGw5UzBINkE1N1BSU0FjM2RZZFNGcWZWZGVZdUlwZGlXSmhqdnZMeERQMmpIcnpYRUNGN3d2aGRrWWt1UURNMzhNQU9TQnQ4SUk3YjdrZ2FJX1dJYkREbEVwVDNvZXdLVjlwYWNuZDdodHBCc2pGdWVvUk1CVWdLWlB2N3ZMdkdPcG03R01UUGFuSFo0QQ?oc=5" rel="noopener noreferrer"&gt;Anthropic’s AI steals mathematicians’ record for most complicated curve - Scientific American&lt;/a&gt;. The Kimi K3 / Moonshot AI piece claims Claude was used covertly in Moonshot's product development, which is a relationship claim rather than a capability claim&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQN2JlSy1LUEE2T0tDdEtkckU2M1VOZ1J1bVZXbEZUOUZ1Umc0dVk5Y0RmTHV4c0lfY1ZPRUp3UkFaXzRGa1R3dTBxTWdlZHhvd0hqUENoMWMtSjFjLVN0QkxrMFhmNWE2VjJ0dzJGenNOMjZCTlNRSWZtbEJIYlctTC15QXI1RGF6UktDVDJTSWJMRVlzRzNGazlsaTNJZ25zUUZfT3BHQ3VSTFJDaHpQWW82Y25McHBtYjViT2dKZ2RUTHM?oc=5" rel="noopener noreferrer"&gt;Chinese Kimi K3 Brought Moonshot AI to $1B in Revenue, but Anthropic Claimed Claude Was Used Covertly - incrypted&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Two honest reads:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Domain-specific use is where the claims are concrete.&lt;/strong&gt; Anthropic presents biomolecular modeling as a working Claude application&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE5PbzNJUlpWVXZ6VzVsNU13YVBoQUNmTDNEUG83cTFoZk1oU0ZQMFJCWFhqNTFZSGVZWkg3RjBRNktiaXZjd1ZoNTRLM3NpS2V4a3lVUXRJVXFDbXVwRmhfdDlPSy04ZVBzUHB3aHFEUjRtcHVzd0dvN0NYMA?oc=5" rel="noopener noreferrer"&gt;How Claude is uplifting biomolecular modeling - Anthropic&lt;/a&gt;. The curve record is a different category — a single-event capability demonstration, not a workflow replacement&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxOQURZTjVJM1hoVzJnSGdacHcydUhOUHR0NUhnd0pLNGw5UzBINkE1N1BSU0FjM2RZZFNGcWZWZGVZdUlwZGlXSmhqdnZMeERQMmpIcnpYRUNGN3d2aGRrWWt1UURNMzhNQU9TQnQ4SUk3YjdrZ2FJX1dJYkREbEVwVDNvZXdLVjlwYWNuZDdodHBCc2pGdWVvUk1CVWdLWlB2N3ZMdkdPcG03R01UUGFuSFo0QQ?oc=5" rel="noopener noreferrer"&gt;Anthropic’s AI steals mathematicians’ record for most complicated curve - Scientific American&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Vendor narratives travel.&lt;/strong&gt; The Moonshot / Claude covert-use claim&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQN2JlSy1LUEE2T0tDdEtkckU2M1VOZ1J1bVZXbEZUOUZ1Umc0dVk5Y0RmTHV4c0lfY1ZPRUp3UkFaXzRGa1R3dTBxTWdlZHhvd0hqUENoMWMtSjFjLVN0QkxrMFhmNWE2VjJ0dzJGenNOMjZCTlNRSWZtbEJIYlctTC15QXI1RGF6UktDVDJTSWJMRVlzRzNGazlsaTNJZ25zUUZfT3BHQ3VSTFJDaHpQWW82Y25McHBtYjViT2dKZ2RUTHM?oc=5" rel="noopener noreferrer"&gt;Chinese Kimi K3 Brought Moonshot AI to $1B in Revenue, but Anthropic Claimed Claude Was Used Covertly - incrypted&lt;/a&gt; is an attribution story, not a capability story. The engineering takeaway is that competitive moats in pure model access are thin; differentiation has to come from integration, data, or workflow.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Capital is still flowing
&lt;/h2&gt;

&lt;p&gt;A Google DeepMind offshoot is nearing a $4 billion valuation just a month after founding&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPWmlNUHJWS1RGSm5TWmhUc0c2X3NaQjllM3duMmE0N1ZYcjNwMzl4UVhxVnV1VmV0TWRJdERwbzlCZzNmdEdzU2FFMHF5YkV2S1R0bE1xVTZfOVowdXdRVXF4WGpNaXplTDlTUTZHMW03c01YQTFCenN2XzJZNVZnT2luVnk?oc=5" rel="noopener noreferrer"&gt;Google DeepMind offshoot nears $4bn valuation just a month after founding - Financial Times&lt;/a&gt;. OpenAI investors have approached the company about a new funding round&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTFBGc3RZU2Itc3hnczJFeUhtYnpXaGFoN1E2enhzV0htUnVnazlzaXhjWGVHX19nQmZjRzdyLTJRMVlHUVpVU090clI5QzZlRHpoTlpGNXhsM1FEMFB6ZUpERkNLVFVaNDRjWjJLQ0ZyN3BDTUEtOFM0WWJUQlfSAYIBQVVfeXFMUGlleTIyWHgwUVEwYWlKMmhkZDlVZlU4Y00wVmlOT3FMSFpPZmQxQ0FRQmM2aHVSeThhX1dqQ0UzUVp5aGsxQ1FYRTd1eEFVVEtoVjNzVWVQUTJEV1d3M0pueFh5T3ZPTGpWOVdWOEZTaXJHNXA0eEJ4R1htMFc4YnZsZw?oc=5" rel="noopener noreferrer"&gt;OpenAI investors have approached the company about a new funding round - cnbc.com&lt;/a&gt;. China's GLM-5.2 is being positioned as matching Anthropic's Mythos on cyber-relevant benchmarks&lt;a href="https://news.google.com/rss/articles/CBMia0FVX3lxTE5DdVAwS0puQWt2cWxrX2szNkdTUDNUSlJldkJlX2xQTERpbHRRT29DcGNzS0pvZmlFYzdmNmZ3U2ZTWUV1eDFEY2t3cGVQbDZnVEVlcVRieVdRNDNWaFdsNmNFVGxYc29NNzlv?oc=5" rel="noopener noreferrer"&gt;China’s GLM-5.2 Matches Anthropic’s Mythos Where Cyber Power Matters Most - Yellow.com&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The valuation and funding rounds&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPWmlNUHJWS1RGSm5TWmhUc0c2X3NaQjllM3duMmE0N1ZYcjNwMzl4UVhxVnV1VmV0TWRJdERwbzlCZzNmdEdzU2FFMHF5YkV2S1R0bE1xVTZfOVowdXdRVXF4WGpNaXplTDlTUTZHMW03c01YQTFCenN2XzJZNVZnT2luVnk?oc=5" rel="noopener noreferrer"&gt;Google DeepMind offshoot nears $4bn valuation just a month after founding - Financial Times&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTFBGc3RZU2Itc3hnczJFeUhtYnpXaGFoN1E2enhzV0htUnVnazlzaXhjWGVHX19nQmZjRzdyLTJRMVlHUVpVU090clI5QzZlRHpoTlpGNXhsM1FEMFB6ZUpERkNLVFVaNDRjWjJLQ0ZyN3BDTUEtOFM0WWJUQlfSAYIBQVVfeXFMUGlleTIyWHgwUVEwYWlKMmhkZDlVZlU4Y00wVmlOT3FMSFpPZmQxQ0FRQmM2aHVSeThhX1dqQ0UzUVp5aGsxQ1FYRTd1eEFVVEtoVjNzVWVQUTJEV1d3M0pueFh5T3ZPTGpWOVdWOEZTaXJHNXA0eEJ4R1htMFc4YnZsZw?oc=5" rel="noopener noreferrer"&gt;OpenAI investors have approached the company about a new funding round - cnbc.com&lt;/a&gt; are capital-markets signals, not product signals, but they may affect hiring and pricing pressure in adjacent markets. The GLM-5.2 claim&lt;a href="https://news.google.com/rss/articles/CBMia0FVX3lxTE5DdVAwS0puQWt2cWxrX2szNkdTUDNUSlJldkJlX2xQTERpbHRRT29DcGNzS0pvZmlFYzdmNmZ3U2ZTWUV1eDFEY2t3cGVQbDZnVEVlcVRieVdRNDNWaFdsNmNFVGxYc29NNzlv?oc=5" rel="noopener noreferrer"&gt;China’s GLM-5.2 Matches Anthropic’s Mythos Where Cyber Power Matters Most - Yellow.com&lt;/a&gt; is a vendor benchmark claim — useful as a signal that Chinese frontier labs are positioning against specific Western capabilities, not as a verified parity statement.&lt;/p&gt;

&lt;h2&gt;
  
  
  What to wire up this week
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Default to V4.1-Flash for cacheable, high-volume workloads&lt;/strong&gt; — but build the rate-sheet check into the procurement doc so the off-peak number does not leak into production budgeting&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Start the Gemini 3.8 Live integration spike&lt;/strong&gt; — the developer path is documented and measure Extended Thinking's latency and cost yourself&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Begin the safety-framework conversation internally&lt;/strong&gt; — the joint OpenAI/Anthropic/Google talks&lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxQU2hNbVd5RVh6MTNQU3RjMVBLdnZmbzhRTVhHSnJ0dko1ZnVNeUw2Tm1xLXk3VE5xa3phZTB3TmFHYjJ2emlUZHgyc0NSbEV1RFpGY3JCODFCNW52WjJfdFhVNzFFbExIY1lDS3BwalhUUllSWEtYNm1KM1ZJRHdVVTc4QnlhcFRiX2NnWUZmSlRwdmc4Z0FvQnNucW9GTXlqZW5PREhzWVlWTllxTHlJ?oc=5" rel="noopener noreferrer"&gt;OpenAI Says It’s Working With Anthropic, Google on AI Safety - Bloomberg.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBVX3pnQ1lXY2F2Y3MtZVNTUlZsb2hYeWQxaF9tSTB6aHZRUlR5azdFRkhLOV9EZDZWaHpGUWpqalo2SXVCb1pRQWgyVVNmamsweDJMUzBDeGtUWHBGZ1dRR3p4NHQwNG1CcG51ZWVBM252azBjMTNn0gF8QVVfeXFMUE0zU1ZReFVzWHBKMzliU2ZWbjRMaENCTUwzS3I0TlVwV1Q2dFRkQTNDbU5xelV1MVBWWjZ1NmFJTmNtZEVoc3pXYWRmTXpqUkVoUnlTTHpBbUlOb29aQmExb3NyeTQ2d05ta2VCb1dSaWZLclQ5OUhLSktrbA?oc=5" rel="noopener noreferrer"&gt;OpenAI, Google, Anthropic discussing collaboration on AI safety issues - cnbc.com&lt;/a&gt; and OpenAI's misalignment reporting framework&lt;a href="https://news.google.com/rss/articles/CBMickFVX3lxTE5YcmZMVzhRdVd1WUM1QUhIZXZYSUxYZGh6WHptVzhyX1BOOWNIUlYtcW5XVV9Ec2VoNTVIU2JPUjRaX25VOWoyaVNBTVUwLUgyb1FBUEc3a0RyUS1SRjd3WG1fWlVZZkpJQUM1b0pydncwdw?oc=5" rel="noopener noreferrer"&gt;Our framework for reporting model misalignment - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE5wenVuMHkxd2dIMl9kOUdPblJhbUFSeWgxUWoxS21fOUdHNHZHbGVhMEVvUnJVMC1Wa1hFd0x5RlRSUFhpSXYtSzFCUE96bUNFUW9EMTN3OVQ3ZkRKX0gwSW8zOFBNR0FIMVFVT09ndktOWE8zTi1EcDdOOUM?oc=5" rel="noopener noreferrer"&gt;OpenAI flags new concerning AI behavior, to track model misalignment regularly - NPR&lt;/a&gt; together signal that audit posture is moving from optional to expected.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Scenario-plan hardware for 2027&lt;/strong&gt; — model the export-contested supply&lt;a href="https://news.google.com/rss/articles/CBMimgJBVV95cUxNN2NrR0NpT2hTbHdLcmFUcmVUSEFENVJYNVRXNGRSLXZWWjBuVzNvb3Fpbk5pTWhianJybUt5N2YwNFZxdnpJZ1IxRUhVeFZyYjcwZDFQWnlQY2VDMjFpT3dyNERXd2RuSVBlM2RYR1N0WXBNamFhalNnNjdJN2duUnozVTFoSXdXZHd4ZUhrOUVudU15Um85YzVWc3M0WmxFVV8tRUJkQXJzaWtCWnZzRGZ5Tm5nVlhUT2JGNDNYbkJ5bmFHQTVlLTlPTzZVSU9fZ0szWXgwUnR0Y0I3b2pqcmF5UzBxcE0xSGlrMVRYNUFQbnZHbG42UjlKSE5oS0RGSlo0WTdqUXVUT2hhVWxtX255cldYWXYxdVE?oc=5" rel="noopener noreferrer"&gt;Investigation details how billions' worth of export-restricted Nvidia AI chips are sold to China — report details how Chinese firms skirt Trump's regulations - tomshardware.com&lt;/a&gt; and the second-source funding&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1ydVhNMHFzRmctZVp2Sjlsd0tXMm5pNTN6UGoyczRpZlBUTjhITy1ybEQ4SDh0MWNZb09ldElzWEZWS3BBTVZwdnlzQXRBM0FFSzEzOXNCVlJneEFydmdXQWc1MVVCZlZRN1lyWG1KM3U0OXd4aUHSAXtBVV95cUxQSWlJd0JfRlNxTVIwNjEyaG5JQWZwYTRic0lfNFVha09oLVF0UGlyemVpOW1USGN5SlpiWXRiVUxSaVllTnZoaXhGZ3dpR0lkUUlIYTVUWkxTaDJYOUYzYXktbnVRNmgzeDJiWFNLWE5icW5UZTRxVzU2UXc?oc=5" rel="noopener noreferrer"&gt;Samsung backs Nvidia AI chip rival in $230 million funding round as GPU alternatives boom - cnbc.com&lt;/a&gt; alongside Nvidia's forecast of doubling chip sales&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFBMZUVscTltc3BSMGJoVVhPeWlDQ2JiendDa3ZsRmF4VGwzVXAtYlNfUE5vVE13OXBsT1N3MXFYdFdRd25jYkhGaFp4QXEwb0g5cXNQdFhicVl0SWlySk1JTXhoc05qd08tcmhBR2VxQU5DLTVq0gF6QVVfeXFMTXo3S3oxZXdkNml4VG1yM09rSUh4cWp4Tlh2SXdSSGZ1Q0Z4NHBPclhJdmdmbUtWTWVUQnd4YUY0N25IV204WWY1QnZISUJ6bl9ZaXVEQ0dnMU1QdHdva0dSdmVOZWctZnBQaHE0WUdBSkFDYWItM2tQTXc?oc=5" rel="noopener noreferrer"&gt;Jensen Huang says Nvidia will sell twice as many chips next year - cnbc.com&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-09-11 至 2026-09-18 | Flash 價格逼近地板，三大實驗室討論安全合作</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 17 Sep 2026 23:04:56 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-11-zhi-2026-09-18kai-yuan-ba-qi-jian-ji-zhun-la-dao-flash-jia-wei-qi-ye-luo-di-qia-zai-zheng-he-er-fei-neng-li-dfl</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-11-zhi-2026-09-18kai-yuan-ba-qi-jian-ji-zhun-la-dao-flash-jia-wei-qi-ye-luo-di-qia-zai-zheng-he-er-fei-neng-li-dfl</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話：第三方比較把 33 倍成本差距寫進標題——當 Flash 與旗艦的價差到這個量級，企業落地的瓶頸可能從模型智商轉向延遲、配額與工作流整合（推測）。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  開源把價格打到不可思議，問題換成整合
&lt;/h2&gt;

&lt;p&gt;DeepSeek V4.1-Flash 這一週登場，官方說法是離峰快取輸入每百萬 token 0.003 美元、宣稱超越自家旗艦 V4-Pro，並被第三方拿來與 GPT-5.6 Sol、Claude Opus 5 同台比較&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxNQXFfeTlYOEQwQ1hHVFFuY2RrLVplZ2NxaGJLY1o1UER2R3d1bWNzdWpiRDZpLTVzckZob3FkQjVabTc1OVd4dGZMY19rRkhwczZZdEtHSEpoSWRSdDhKclFRaDdvRzdNc1o2ZEFHZXNpcVEtb0dCakhPcVpnUjRHQktkQmhWRFBHU0JIWWdicmZJSDI0SDR1Mk9HYm1xWC01VE5r?oc=5" rel="noopener noreferrer"&gt;DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLE&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxPUXAxdU5ESG9vS2EtNk9Sd1NCUDEzSzgyRnpNTjhIQXBhWExvV3UzS0lQNWNkN3lsaVMtNENINzdaRGRja3ZnbTRDNGJIeDBHeVRtcHBzOU9aLWotVnBXRDd5SGRBb1hHMjRrcDA4UmdVWUZzSTg1bGhuajYteHg2Y25mdU16VkwwVlNyaklQSFhBWmRWOUdvUkwyMlJmLXV0UUVOczNJZkpHVF84VUhISzlWMEdJXzVnRHdhTndpX1l3ekt3YnEyaGlYdlJ5QTNkcURfM0ZkbGlfR3dPcUcyd1E5RzluLUtU?oc=5" rel="noopener noreferrer"&gt;DeepSeek-V4.1-Flash debuts with $0.003/1M off-peak cached-input rate and benchmarks eclipsing GPT-5.6 Sol, Claude Opus 5 - VentureBeat&lt;/a&gt;。第三方對照網站直接寫出「33 倍成本差距」的標題&lt;a href="https://news.google.com/rss/articles/CBMikgFBVV95cUxNUWhHekU2dVpKWkRGSnJINlZLcFFseFhSZVJpSUdLSkpVQmVxQjVwOVY5dkNkWFdmRTQ0bHdXRWU1OGZEWmNFUmhLQ1ExcUo4ckRPNk4yTTRka2FidXo5Ym5xSlBabkRDckxnVjBSTVVGOVphMnlNcmQ3X1VmMHNDODhvY1Uzb1dFMTVmaWN0cFVGQQ?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra vs Claude Fable 5.1 vs DeepSeek V4.1: 33x Cost Gap [2026] - tech-insider.org&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;這條訊息真正的工程意涵：模型選擇的成本階梯已經崩壞——「旗艦才撐得住的工作流」與「Flash 就能跑」之間的界線模糊。工程師真正要決定的不再是「哪顆最聰明」，而是「哪顆的延遲、配額、整合成本最低」。當基準差距不再對應價格差距，benchmark 就失去選型意義，必須回到自家工作流實測。&lt;/p&gt;

&lt;p&gt;對照組的數字同週由同一家測試網站列出：DeepSeek V4 Pro 對 Qwen3-Coder 對 Devstral，在某基準上有 11 分差距&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPOGZPZnNFd0lnWk01VlkxWWhlSWg3cEhyQk93YWNxUVpRY0hQTmw3UlpSTHZPRkdYb2N2QTFFbTcycXowbVptb2NoLTRubk8yVVhlRTVEeGFRWXZqa29qNUdXWXVGRGwxN3d4cTlWc3VVRVFGV1doN2E0aXZLYUdOSUx5M1I?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4 Pro vs Qwen3-Coder vs Devstral: 11pt Gap [2026] - tech-insider.org&lt;/a&gt;——同樣是開源之間的對決，說明競爭對手已經不是閉源巨頭，而是彼此。中國側的 GLM-5.2 被外媒描述為在「網路權力」相關任務上匹敵 Anthropic Mythos&lt;a href="https://news.google.com/rss/articles/CBMia0FVX3lxTE5DdVAwS0puQWt2cWxrX2szNkdTUDNUSlJldkJlX2xQTERpbHRRT29DcGNzS0pvZmlFYzdmNmZ3U2ZTWUV1eDFEY2t3cGVQbDZnVEVlcVRieVdRNDNWaFdsNmNFVGxYc29NNzlv?oc=5" rel="noopener noreferrer"&gt;China’s GLM-5.2 Matches Anthropic’s Mythos Where Cyber Power Matters Most - Yellow.com&lt;/a&gt;，把「開源追平旗艦」的敘事從純文字基準延伸到治理敏感的領域。&lt;/p&gt;

&lt;h2&gt;
  
  
  同業談安全合作，但治理框架停在態度層
&lt;/h2&gt;

&lt;p&gt;OpenAI、Anthropic、Google DeepMind 三家本週被報導正在討論 AI 安全議題上的合作&lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxQU2hNbVd5RVh6MTNQU3RjMVBLdnZmbzhRTVhHSnJ0dko1ZnVNeUw2Tm1xLXk3VE5xa3phZTB3TmFHYjJ2emlUZHgyc0NSbEV1RFpGY3JCODFCNW52WjJfdFhVNzFFbExIY1lDS3BwalhUUllSWEtYNm1KM1ZJRHdVVTc4QnlhcFRiX2NnWUZmSlRwdmc4Z0FvQnNucW9GTXlqZW5PREhzWVlWTllxTHlJ?oc=5" rel="noopener noreferrer"&gt;OpenAI Says It’s Working With Anthropic, Google on AI Safety - Bloomberg.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBVX3pnQ1lXY2F2Y3MtZVNTUlZsb2hYeWQxaF9tSTB6aHZRUlR5azdFRkhLOV9EZDZWaHpGUWpqalo2SXVCb1pRQWgyVVNmamsweDJMUzBDeGtUWHBGZ1dRR3p4NHQwNG1CcG51ZWVBM252azBjMTNn0gF8QVVfeXFMUE0zU1ZReFVzWHBKMzliU2ZWbjRMaENCTUwzS3I0TlVwV1Q2dFRkQTNDbU5xelV1MVBWWjZ1NmFJTmNtZEVoc3pXYWRmTXpqUkVoUnlTTHpBbUlOb29aQmExb3NyeTQ2d05ta2VCb1dSaWZLclQ5OUhLSktrbA?oc=5" rel="noopener noreferrer"&gt;OpenAI, Google, Anthropic discussing collaboration on AI safety issues - cnbc.com&lt;/a&gt;。另一邊 Yahoo Finance 報導這三家對「AI 受監管」的態度是「想要被監管——但誰會買單仍不明」&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxPQ0MwNDN3WGM5THBkRURHMWhiSlkyc0JmQmpoRmZrOXRWODV1NW8xWUVIQTN2c3duU0NlX1J4MDZnTXhySm9RSXhFZWtFWXRvblJ1NnlNVExnUTctZlNYRnRQbGwwemJxSTh6ZXNnUk5jR3VnZDBoYkxfY1dRcWNPc29DdzRRdXd6WHJ3dFdPdUw5QUpXTndxMVZTVVM2NEM1MmZj?oc=5" rel="noopener noreferrer"&gt;OpenAI, Anthropic, and Google DeepMind Want AI to Be Regulated — Here’s Who Could Pay the Price - Yahoo Finance&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;把「討論合作」與「想要被監管」放在同一段並列，會讓讀者把態度誤讀成行動。實際上 &lt;a href="https://news.google.com/rss/articles/CBMirwFBVV95cUxQU2hNbVd5RVh6MTNQU3RjMVBLdnZmbzhRTVhHSnJ0dko1ZnVNeUw2Tm1xLXk3VE5xa3phZTB3TmFHYjJ2emlUZHgyc0NSbEV1RFpGY3JCODFCNW52WjJfdFhVNzFFbExIY1lDS3BwalhUUllSWEtYNm1KM1ZJRHdVVTc4QnlhcFRiX2NnWUZmSlRwdmc4Z0FvQnNucW9GTXlqZW5PREhzWVlWTllxTHlJ?oc=5" rel="noopener noreferrer"&gt;OpenAI Says It’s Working With Anthropic, Google on AI Safety - Bloomberg.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTFBVX3pnQ1lXY2F2Y3MtZVNTUlZsb2hYeWQxaF9tSTB6aHZRUlR5azdFRkhLOV9EZDZWaHpGUWpqalo2SXVCb1pRQWgyVVNmamsweDJMUzBDeGtUWHBGZ1dRR3p4NHQwNG1CcG51ZWVBM252azBjMTNn0gF8QVVfeXFMUE0zU1ZReFVzWHBKMzliU2ZWbjRMaENCTUwzS3I0TlVwV1Q2dFRkQTNDbU5xelV1MVBWWjZ1NmFJTmNtZEVoc3pXYWRmTXpqUkVoUnlTTHpBbUlOb29aQmExb3NyeTQ2d05ta2VCb1dSaWZLclQ5OUhLSktrbA?oc=5" rel="noopener noreferrer"&gt;OpenAI, Google, Anthropic discussing collaboration on AI safety issues - cnbc.com&lt;/a&gt; 報導的是三家公司「正在討論合作」，&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxPQ0MwNDN3WGM5THBkRURHMWhiSlkyc0JmQmpoRmZrOXRWODV1NW8xWUVIQTN2c3duU0NlX1J4MDZnTXhySm9RSXhFZWtFWXRvblJ1NnlNVExnUTctZlNYRnRQbGwwemJxSTh6ZXNnUk5jR3VnZDBoYkxfY1dRcWNPc29DdzRRdXd6WHJ3dFdPdUw5QUpXTndxMVZTVVM2NEM1MmZj?oc=5" rel="noopener noreferrer"&gt;OpenAI, Anthropic, and Google DeepMind Want AI to Be Regulated — Here’s Who Could Pay the Price - Yahoo Finance&lt;/a&gt; 報導的是「想要被監管」這個立場——兩件事都不含時程、API 變動、或可執行的規範。&lt;/p&gt;

&lt;p&gt;對工程團隊的直接影響是零。但它是一個訊號：當競爭對手開始願意公開承認「需要某種共同規範」，可能是因為企業客戶在採購合約裡開始要求這一條（推測，標題沒有交代成因）。短期內不會改變任何部署決策；中期（推測）會影響歐美大型企業的採購標配。&lt;/p&gt;

&lt;h2&gt;
  
  
  中國晶片繞道與替代晶片融資同時推進
&lt;/h2&gt;

&lt;p&gt;Tom's Hardware 報導調查細節，說明受限的 Nvidia AI 晶片如何透過中國公司繞過規定流入&lt;a href="https://news.google.com/rss/articles/CBMimgJBVV95cUxNN2NrR0NpT2hTbHdLcmFUcmVUSEFENVJYNVRXNGRSLXZWWjBuVzNvb3Fpbk5pTWhianJybUt5N2YwNFZxdnpJZ1IxRUhVeFZyYjcwZDFQWnlQY2VDMjFpT3dyNERXd2RuSVBlM2RYR1N0WXBNamFhalNnNjdJN2duUnozVTFoSXdXZHd4ZUhrOUVudU15Um85YzVWc3M0WmxFVV8tRUJkQXJzaWtCWnZzRGZ5Tm5nVlhUT2JGNDNYbkJ5bmFHQTVlLTlPTzZVSU9fZ0szWXgwUnR0Y0I3b2pqcmF5UzBxcE0xSGlrMVRYNUFQbnZHbG42UjlKSE5oS0RGSlo0WTdqUXVUT2hhVWxtX255cldYWXYxdVE?oc=5" rel="noopener noreferrer"&gt;Investigation details how billions' worth of export-restricted Nvidia AI chips are sold to China — report details how Chinese firms skirt Trump's regulations - tomshardware.com&lt;/a&gt;。同期 CNBC 報導三星投資一家 Nvidia AI 晶片競爭對手 2.3 億美元，GPU 替代品市場升溫&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1ydVhNMHFzRmctZVp2Sjlsd0tXMm5pNTN6UGoyczRpZlBUTjhITy1ybEQ4SDh0MWNZb09ldElzWEZWS3BBTVZwdnlzQXRBM0FFSzEzOXNCVlJneEFydmdXQWc1MVVCZlZRN1lyWG1KM3U0OXd4aUHSAXtBVV95cUxQSWlJd0JfRlNxTVIwNjEyaG5JQWZwYTRic0lfNFVha09oLVF0UGlyemVpOW1USGN5SlpiWXRiVUxSaVllTnZoaXhGZ3dpR0lkUUlIYTVUWkxTaDJYOUYzYXktbnVRNmgzeDJiWFNLWE5icW5UZTRxVzU2UXc?oc=5" rel="noopener noreferrer"&gt;Samsung backs Nvidia AI chip rival in $230 million funding round as GPU alternatives boom - cnbc.com&lt;/a&gt;。Nvidia 自身則對外說明年晶片銷量會翻倍&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFBMZUVscTltc3BSMGJoVVhPeWlDQ2JiendDa3ZsRmF4VGwzVXAtYlNfUE5vVE13OXBsT1N3MXFYdFdRd25jYkhGaFp4QXEwb0g5cXNQdFhicVl0SWlySk1JTXhoc05qd08tcmhBR2VxQU5DLTVq0gF6QVVfeXFMTXo3S3oxZXdkNml4VG1yM09rSUh4cWp4Tlh2SXdSSGZ1Q0Z4NHBPclhJdmdmbUtWTWVUQnd4YUY0N25IV204WWY1QnZISUJ6bl9ZaXVEQ0dnMU1QdHdva0dSdmVOZWctZnBQaHE0WUdBSkFDYWItM2tQTXc?oc=5" rel="noopener noreferrer"&gt;Jensen Huang says Nvidia will sell twice as many chips next year - cnbc.com&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;這三條合在一起讀：地緣政治風險不會在短期內變成「無法取得算力」的硬阻塞——調查顯示繞道供應仍然存在、替代晶片也拿到新的融資、龍頭自己也看好需求。但對企業採購的意義是另一層：選擇「中國背景的算力」或「非 Nvidia 加速器」在 2026 下半年的合規審查強度，會比上半年来得高（推測）。&lt;/p&gt;

&lt;h2&gt;
  
  
  語音即時與企業落地，本週的重點是開發管道
&lt;/h2&gt;

&lt;p&gt;Google 介紹 Gemini 3.8 Live 與 3.8 Live Extended Thinking，主打即時語音應用&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;；同公司另一篇貼文把 Gemini 3.8 Live 與 3.5 Transcribe 包在一起介紹&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;。Reuters 報導一個美國政府網站使用了被 FBI 點名抄過 Anthropic 的中國 AI 搜尋工具&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQSTBHb0F3bjFOTVY4RDExZ1Q4SUVqOEppWEdrc0t0TUhUc0NZNG0yZl9Da2daU1RyRnZPYlMzSDRRM0UzTlgwSHpTTDBKR201eVJocll5WHhKdDZNekVTTnBiQmhLaGZaaXZXQTBPRncxNjVUQjNIWU50RWRNd19wNmR4VGdNMzJEeGpoMXRNSG9Bd1JYc0ZYemZkUXZGUXBLRVBLYnozN1FmZ1dlcTYwdHU0aEtxd2RJOC1jb1M5empFdmNSWEV5bzAwTQ?oc=5" rel="noopener noreferrer"&gt;US government website used AI search tool from China that FBI said copied Anthropic - Reuters&lt;/a&gt;。&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;發布層&lt;/strong&gt;：Google 介紹 Gemini 3.8 Live，並提供即時語音應用的開發路徑&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxNZTNBTjVVXzE2ZXpJdkoxcHo2cTNVVG1pZEs0dXhMU0d4dnNzcU5iZWppYkJMeVpCeWZVQ3dKSzVzZXNoeTltY3RJaXJtckQ2LXZnWlpGQ1V4Yi1HZUdjdFdPMUFua18weUpTazgweFp5YnlVTjB2RVJiTnVFMllTUThtQVlrT3liYnd1dmhfUGxiRHZOb3pub1dGR3pXbk9UMnZzV1hZdF96UUVLcTdWanZVc2YtaGtkZXNzY1ZCQQ?oc=5" rel="noopener noreferrer"&gt;Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxORklOLTI2REdZOWdBZFJmbEg1S3J3ejNuTGhGMVBlWmVXeGtZRkxXcW1zSUtOVnR5eWd2aG9ibWdmd2xUTmllTDhrZWF2UXpRb1V1SWUzNVIzOEJrZEdNYVYyM1NTaS1oMmZaWWZyNEpSRUowR1dsd2otTV9UQkdaZVpKMGwwSkxGeG11U1J1M1RnVEF4S0dCbjNMRUpKcDNqdm9wWDl5THFKVTluOEp6RGVfNTM?oc=5" rel="noopener noreferrer"&gt;Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe - blog.google&lt;/a&gt;。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;可商用層&lt;/strong&gt;：政府網站使用了 FBI 稱仿冒 Anthropic 的工具，這是採購端漏洞而非技術突破，企業客戶不應把它當成對標&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQSTBHb0F3bjFOTVY4RDExZ1Q4SUVqOEppWEdrc0t0TUhUc0NZNG0yZl9Da2daU1RyRnZPYlMzSDRRM0UzTlgwSHpTTDBKR201eVJocll5WHhKdDZNekVTTnBiQmhLaGZaaXZXQTBPRncxNjVUQjNIWU50RWRNd19wNmR4VGdNMzJEeGpoMXRNSG9Bd1JYc0ZYemZkUXZGUXBLRVBLYnozN1FmZ1dlcTYwdHU0aEtxd2RJOC1jb1M5empFdmNSWEV5bzAwTQ?oc=5" rel="noopener noreferrer"&gt;US government website used AI search tool from China that FBI said copied Anthropic - Reuters&lt;/a&gt;。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;對要導入語音的工程團隊：現有 OpenAI Realtime API、Azure 語音服務仍是第一個要對照的標竿；新模型的真正差異化要在實際延遲、聲音 clone 品質、中文辨識率上自行驗證，benchmark 還沒給到這層。&lt;/p&gt;

&lt;h2&gt;
  
  
  數學、蛋白質、月之暗面——能力展示與商業歸屬的落差
&lt;/h2&gt;

&lt;p&gt;Anthropic 對外展示 Claude 在生物分子建模上的成果&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE5PbzNJUlpWVXZ6VzVsNU13YVBoQUNmTDNEUG83cTFoZk1oU0ZQMFJCWFhqNTFZSGVZWkg3RjBRNktiaXZjd1ZoNTRLM3NpS2V4a3lVUXRJVXFDbXVwRmhfdDlPSy04ZVBzUHB3aHFEUjRtcHVzd0dvN0NYMA?oc=5" rel="noopener noreferrer"&gt;How Claude is uplifting biomolecular modeling - Anthropic&lt;/a&gt;。Scientific American 報導 Anthropic 的 AI 奪下數學家保持的「最複雜曲線」紀錄——標題用的是 steals 一詞&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxOQURZTjVJM1hoVzJnSGdacHcydUhOUHR0NUhnd0pLNGw5UzBINkE1N1BSU0FjM2RZZFNGcWZWZGVZdUlwZGlXSmhqdnZMeERQMmpIcnpYRUNGN3d2aGRrWWt1UURNMzhNQU9TQnQ4SUk3YjdrZ2FJX1dJYkREbEVwVDNvZXdLVjlwYWNuZDdodHBCc2pGdWVvUk1CVWdLWlB2N3ZMdkdPcG03R01UUGFuSFo0QQ?oc=5" rel="noopener noreferrer"&gt;Anthropic’s AI steals mathematicians’ record for most complicated curve - Scientific American&lt;/a&gt;。Incrypted 報導中國月之暗面（Moonshot AI）營收衝到 10 億美元、靠的是 Kimi K3 這款產品，但背後是否使用 Claude 出現爭議&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQN2JlSy1LUEE2T0tDdEtkckU2M1VOZ1J1bVZXbEZUOUZ1Umc0dVk5Y0RmTHV4c0lfY1ZPRUp3UkFaXzRGa1R3dTBxTWdlZHhvd0hqUENoMWMtSjFjLVN0QkxrMFhmNWE2VjJ0dzJGenNOMjZCTlNRSWZtbEJIYlctTC15QXI1RGF6UktDVDJTSWJMRVlzRzNGazlsaTNJZ25zUUZfT3BHQ3VSTFJDaHpQWW82Y25McHBtYjViT2dKZ2RUTHM?oc=5" rel="noopener noreferrer"&gt;Chinese Kimi K3 Brought Moonshot AI to $1B in Revenue, but Anthropic Claimed Claude Was Used Covertly - incrypted&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;這幾條的共同訊號：模型能力的天花板持續被往前推，但「能力歸屬」與「商業歸屬」之間的灰色地帶也在擴大。當你看到某家中國模型達到頂級基準，值得追問「這個能力是否涉及閉源模型」——本週標題提供的是 Anthropic 的祕密使用指控與 FBI 的仿冒說法，尚不能據此判定為蒸餾&lt;a href="https://news.google.com/rss/articles/CBMiwwFBVV95cUxQN2JlSy1LUEE2T0tDdEtkckU2M1VOZ1J1bVZXbEZUOUZ1Umc0dVk5Y0RmTHV4c0lfY1ZPRUp3UkFaXzRGa1R3dTBxTWdlZHhvd0hqUENoMWMtSjFjLVN0QkxrMFhmNWE2VjJ0dzJGenNOMjZCTlNRSWZtbEJIYlctTC15QXI1RGF6UktDVDJTSWJMRVlzRzNGazlsaTNJZ25zUUZfT3BHQ3VSTFJDaHpQWW82Y25McHBtYjViT2dKZ2RUTHM?oc=5" rel="noopener noreferrer"&gt;Chinese Kimi K3 Brought Moonshot AI to $1B in Revenue, but Anthropic Claimed Claude Was Used Covertly - incrypted&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQSTBHb0F3bjFOTVY4RDExZ1Q4SUVqOEppWEdrc0t0TUhUc0NZNG0yZl9Da2daU1RyRnZPYlMzSDRRM0UzTlgwSHpTTDBKR201eVJocll5WHhKdDZNekVTTnBiQmhLaGZaaXZXQTBPRncxNjVUQjNIWU50RWRNd19wNmR4VGdNMzJEeGpoMXRNSG9Bd1JYc0ZYemZkUXZGUXBLRVBLYnozN1FmZ1dlcTYwdHU0aEtxd2RJOC1jb1M5empFdmNSWEV5bzAwTQ?oc=5" rel="noopener noreferrer"&gt;US government website used AI search tool from China that FBI said copied Anthropic - Reuters&lt;/a&gt;。&lt;/p&gt;

&lt;h2&gt;
  
  
  估值與融資——OpenAI 新一輪與 DeepMind 分拆估值
&lt;/h2&gt;

&lt;p&gt;OpenAI 投資人正在洽談新一輪融資&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTFBGc3RZU2Itc3hnczJFeUhtYnpXaGFoN1E2enhzV0htUnVnazlzaXhjWGVHX19nQmZjRzdyLTJRMVlHUVpVU090clI5QzZlRHpoTlpGNXhsM1FEMFB6ZUpERkNLVFVaNDRjWjJLQ0ZyN3BDTUEtOFM0WWJUQlfSAYIBQVVfeXFMUGlleTIyWHgwUVEwYWlKMmhkZDlVZlU4Y00wVmlOT3FMSFpPZmQxQ0FRQmM2aHVSeThhX1dqQ0UzUVp5aGsxQ1FYRTd1eEFVVEtoVjNzVWVQUTJEV1d3M0pueFh5T3ZPTGpWOVdWOEZTaXJHNXA0eEJ4R1htMFc4YnZsZw?oc=5" rel="noopener noreferrer"&gt;OpenAI investors have approached the company about a new funding round - cnbc.com&lt;/a&gt;。Financial Times 報導 Google DeepMind 一家分拆公司成立一個月內估值逼近 40 億美元&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxPWmlNUHJWS1RGSm5TWmhUc0c2X3NaQjllM3duMmE0N1ZYcjNwMzl4UVhxVnV1VmV0TWRJdERwbzlCZzNmdEdzU2FFMHF5YkV2S1R0bE1xVTZfOVowdXdRVXF4WGpNaXplTDlTUTZHMW03c01YQTFCenN2XzJZNVZnT2luVnk?oc=5" rel="noopener noreferrer"&gt;Google DeepMind offshoot nears $4bn valuation just a month after founding - Financial Times&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;這兩條對工程選型沒有直接影響，但對企業內部「為什麼還在用舊模型」的提問有用——資本市場仍願意下注，代表這些公司短期內可能有餘裕繼續壓低 API 價格與提升配額（推測）。現在簽長約鎖價的時機未必比 6 個月後好（推測）。&lt;/p&gt;




</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-09-04 to 2026-09-11 | Open-weight races collide with closed-frontier launches</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 10 Sep 2026 23:16:24 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-04-to-2026-09-11-open-weight-races-collide-with-closed-frontier-launches-2fle</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-04-to-2026-09-11-open-weight-races-collide-with-closed-frontier-launches-2fle</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Two frontier tiers moved in opposite directions this week: open-weight releases pushed parameter counts and context windows into territory that closed labs dominated until recently, while OpenAI's GPT-6 announcement and a fourth Anthropic security disclosure reminded buyers that the closed labs still own the integration cost and the threat surface that comes with it.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Open-weight models cross into frontier-tier territory
&lt;/h2&gt;

&lt;p&gt;DeepSeek released V4.1 Flash with a 1M context window and an FP4 KV cache, and the launch coverage names cross-layer attention reuse as an efficiency lever&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;. A second report frames the release as benchmarks, pricing, and a Pro-tier retirement&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt; — meaning capability, cost, and product lineup shifted in one move. The 1M context and the FP4 cache are engineering claims from the vendor; they are not equivalent to a 1M-context window running in production at your preferred latency.&lt;/p&gt;

&lt;p&gt;Alibaba shipped a Qwen-Max-class MoE at 2.4T parameters with open weights&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;. A coding leaderboard ranking has the model overtaking Claude Opus 5&lt;a href="https://news.google.com/rss/articles/CBMioAFBVV95cUxNWmZWbmdpcFVLSXpUOHVZeGNyLUJlZEp1MlUyX0VLWmpRN1plc2lUcnQ3TFZZdG5xMzVnUEtDbXFIbnpIdEVRbkEyNGpiVWVsWm4tcThob2hNNGxMcEd2djVZVm5jU0IxV3FUUnlfR2VUVXd3MFlQOGV1Qm9aSFIxSE1FNHN1Rl9pS1pfaFkyRk00Ry1Nc0xnanhVb2tWXzdq?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen3.8-Max Model Overtakes Claude Opus 5 on Coding Leaderboard - Startup Fortune&lt;/a&gt; — a leaderboard claim worth reading carefully: the comparison is against a closed lab's product via a third-party board, with no mention of the latency, context, or tool-use conditions under which the rank holds.&lt;/p&gt;

&lt;p&gt;For an engineering team, the operational question is whether either of these weights actually slots into an existing serving stack. Open weights tend to win on data egress, fine-tuning, and unit cost at scale; they give some of that back in the support burden of running them. V4.1 Flash's FP4 KV cache is a memory-bandwidth lever worth measuring on your own traces before trusting any throughput number the launch quoted.&lt;/p&gt;

&lt;h2&gt;
  
  
  Closed frontier: GPT-6 Astra lands the same week
&lt;/h2&gt;

&lt;p&gt;OpenAI's own announcement page describes GPT-6 Astra as a "new generation of intelligence"&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;, and a second OpenAI page frames the same launch around "work" use cases&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;. Vendor language on a launch page is not a benchmark, not a pricing card, and not a deployment guarantee. The line between "announced", "available", and "commercially usable" matters more here than usual: a flagship launch the same week as two open-weight drops tells buyers the closed frontier is racing to stay ahead, but tells integrators nothing about API stability, rate limits, or whether existing fine-tunes survive.&lt;/p&gt;

&lt;p&gt;For teams already on OpenAI, the practical move is to freeze new GPT-6 Astra commitments until pricing, latency, and tool-calling behavior on real workloads are measured — not until the launch page settles.&lt;/p&gt;

&lt;h2&gt;
  
  
  Security disclosures: the fourth Claude hacking incident
&lt;/h2&gt;

&lt;p&gt;Anthropic disclosed a fourth AI hacking incident involving an early version of Claude&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;. A second outlet carried the same disclosure, so the report does not rest on a single source. The pattern matters: a fourth disclosed incident suggests the threat model for agentic Claude deployments is hardening — exfiltration paths and prompt-injection chains are real engineering risks, not edge cases. Any production integration plan that did not previously budget for adversarial-prompt review now has to.&lt;/p&gt;

&lt;p&gt;Separately, Anthropic said it blocked possible efforts to build biological weapons&lt;a href="https://news.google.com/rss/articles/CBMiiwFBVV95cUxOb3RxODh4LWhOS0o0UFBGNUhHODA0Z2dqbTcyTlFmYVRwRzJVVnhKMFl4U2dqQUQwZXV6d0c1c0gwRHZXeF9wOFRTN2xCengtRnRuR0tJLUNDTlI3VjAyekRzRngwMWY4M01hSUVwWURFUFAxdkRjRC1HZUM3cG9YTnZ4UVFNcVlnT200?oc=5" rel="noopener noreferrer"&gt;Anthropic Says It Blocked Possible Efforts to Build Biological Weapons - The New York Times&lt;/a&gt;. This is a different category of risk — capability misuse rather than adversarial inputs — and the same threat-model habit of treating model outputs as untrusted content applies.&lt;/p&gt;

&lt;h2&gt;
  
  
  Hardware: Qualcomm–Amazon deal narrows Nvidia's window
&lt;/h2&gt;

&lt;p&gt;Qualcomm struck an AI chip deal with Amazon that includes stock rights worth roughly $4 billion&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;. A market commentary frames the same deal as putting Nvidia's lead at risk&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTFAwQVB0cnlUVVMxeVJad0FBbFlINDRJa25vLUtzcTZSaWFjRUNHMHRIbWxJS0dVWFRoU1duWmNUZkZac2g5aUtURGNMMVNRS2Q3N1RadERqbmRzTWg2NUtuUkdkUU1IN01xMVJwMExvVQ?oc=5" rel="noopener noreferrer"&gt;Qualcomm's Massive AI Chip Deal With Amazon Puts Nvidia's Lead at Risk - MarketWise&lt;/a&gt;. A separate piece questions Nvidia's AI chip economics after Jensen Huang said Nvidia chips are "highly rentable"&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxOWFY0YmdVM2hQNjAxQVJGSkdrNTRTZUl0VEJFUmJKaGNXUXl6Ykp2YTYtdi1pd00tQzlWeEhabENVNVJ0MDc2ckRzVWNMTTRrS0FpTzV2NG9rOF9IZGhSVC1fdlk0dFFYVnUtY3dFYnNiNDBaTGdjNjJkbEd3NGh4ZF8xNjd6WU1iOTlIR1VHeC1KMElSMUdWaVZOSGlqeENpRWFMMEs5SDdoUnZweFd5MDBUX2JxNktkTGNCWVlLZWhnVm8xTDFXLVY4MW9va3R2LTNadnZ3MUdfLTJsYVdRN09GYWIwYzVEOFNkOXVLdjc5SmpuU3NwSnNNVnY?oc=5" rel="noopener noreferrer"&gt;Jim Chanos Questions Nvidia’s AI Chip Economics After Jensen Huang Says Nvidia Chips Are 'Highly Rentable' - Stocktwits&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The deal is real. The "risk to Nvidia" framing is editorial inference dressed as analysis — neither headline distinguishes training from inference. Independent benchmarking is rare in this space, so the safe read is: another credible alternative now exists, which gives procurement teams a real lever in 2027 contract talks. Volume production versus a stock-purchase sweetener is a separate question that neither source resolves.&lt;/p&gt;

&lt;p&gt;In parallel, a deep dive into NVIDIA's six Hot Chips 2026 presentations walks through the "one GPU to AI factory" arc&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxOMGlqcW5qZEZ0b09EOWk5VGdDQmUzTElMVGlnTTRXOW1tVnBSazFuMV9NOUF1UE5qMVBYWFVFSDBRYnI0LW1XSG9UQlVGcWZNSzNyVVVWcmc5U1I1a3BlU1lFczZIUGp2ZXEzVHVITGN0R2RjX3IwdEVYOVVOUTdnNg?oc=5" rel="noopener noreferrer"&gt;From One GPU to an AI Factory: Deep Dive into NVIDIA’s Six Hot Chips 2026 Presentations - semivision&lt;/a&gt;. Worth reading for anyone planning capacity — the deep dive is a clear map of where Nvidia's per-GPU pitch is heading.&lt;/p&gt;

&lt;h2&gt;
  
  
  The IP backdrop most of this sits on
&lt;/h2&gt;

&lt;p&gt;Two outlets cover the same story from different angles: U.S. agencies have said Moonshot's Kimi was trained on American models, and the reporting frames Kimi K3 as a distillation of an Anthropic model named in the headline as "Fable"&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPRXVMaFFqb3JjYURMcTNkMmFvUGItUVRYaWFxaWw3Q3NzczBpS1pidTNFa05lbjJyOW5oWW9acUxWN2FMcW9rNVI0YkthVW9NTC1pR3k1MGRLQ3o1ektnaHkxM3E4RDlYdnQ1emd5QjB0VU9rcXlSc3UxbjdacXpVdzdVNVM2V25YQ2tUbmRNZmdiNUhTai1jaG5SSGY?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Distilled Anthropic's Fable For Kimi K3, White House Says - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiWEFVX3lxTE44YlRZcUp1SXdqMUJEc0NZLVBsMmhVblpMSzhaRGpiM3FmNXVnZWw4SWtFTzhjZ3NjTk9Sc0ppdzlyWUtIaTI4RHJMeUVWM0tFUE01WGdraU8?oc=5" rel="noopener noreferrer"&gt;Moonshot’s Kimi rattled markets. U.S. agencies now say it was trained on American models - Cryptonews.net&lt;/a&gt;. A WSJ feature covers the broader pattern of Chinese AI firms cloning U.S. models&lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxPeGswOXZNYVNvdzV2SzRHVC1aM0lGM01aNHVnMlRRQWVZYkFhTGh0dzE4UkRER042RU5kQnVmUVY3X282ZmgzYUtJYU5uSnhyZTV1eWlsaDdKcHBjQ28tQnQzd09XUm9KczY4SFB1c1hEZ2xfS203RExlZDU5OUZRcHZ4YUNUdG5JbzByNFlqWi10ZVlXcmxVNExXODR6dEp4X1FjbERSckRRQ0ZNcVhiMGxR?oc=5" rel="noopener noreferrer"&gt;How Chinese AI Firms Tried to Clone U.S. AI Models - WSJ&lt;/a&gt;. One headline says "distilled" — a specific technical relation, knowledge distillation from a teacher model's outputs — while other coverage uses the looser "trained on".&lt;/p&gt;

&lt;p&gt;The takeaway for procurement is that buyers on closed APIs and those on open weights face different risk curves if open-weight drops from Chinese labs are gated behind contested IP claims in the U.S. — that chain is inference on our part; none of the cited sources makes it outright.&lt;/p&gt;

&lt;h2&gt;
  
  
  Other surfaces
&lt;/h2&gt;

&lt;p&gt;Google shipped a Gemini app for Windows PCs&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;, with a consumer-tech outlet describing the desktop client launch&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;. For a desktop app the integration story is the OS shell hooks, the keyboard/voice ergonomics, and whether the local model cache beats the latency of a round-tripped API — none of which the launch headlines answer.&lt;/p&gt;

&lt;p&gt;Alibaba's Qwen team also released an open-source model aimed at autonomous driving&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE16UHpfYXBMLXl0eDFCVm5pSUtTa2c0ZGFZQnpPeTUxTTFQMS15dXhkUUFEV25YN2ZsWXBaM1o0aGo1dF95T0gtR3h3R3gtektUT0d0OUZJcUtIMTZKc2hoN3EwajJZOG5Oa2swU1NTYw?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen releases open-source model for autonomous driving - TechNode&lt;/a&gt;. A driving-stack release is a vertical-specific weight, not a general-purpose assistant; it slots into a different evaluation pipeline than the leaderboards the same lab's general models chase.&lt;/p&gt;

&lt;h2&gt;
  
  
  What an engineering team should actually do this week
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Signal&lt;/th&gt;
&lt;th&gt;Read&lt;/th&gt;
&lt;th&gt;Action&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;V4.1 Flash 1M context, FP4 KV cache&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Engineering vendor claim, not a deployment guarantee&lt;/td&gt;
&lt;td&gt;Reproduce the 1M-context number on your own traces before quoting it&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.8-Max open weights at 2.4T&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;First open Max-tier MoE&lt;/td&gt;
&lt;td&gt;Evaluate serving cost on a representative slice, not a leaderboard screenshot&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Announced, not benchmarked&lt;/td&gt;
&lt;td&gt;Hold new commitments until pricing/latency land&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fourth Claude hacking incident&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Adversarial risk is now a known pattern&lt;/td&gt;
&lt;td&gt;Budget for prompt-injection review on agentic paths&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qualcomm–Amazon deal&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Real deal, inference/training split unresolved&lt;/td&gt;
&lt;td&gt;Use as a lever in 2027 contract talks; do not assume training displacement&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini Windows app&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Surface news, no integration data&lt;/td&gt;
&lt;td&gt;Wait for latency/caching details&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-09-04 to 2026-09-11 | 中國開源大模型齊發，閉源加速搶企業入口</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 10 Sep 2026 23:09:35 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-04-to-2026-09-11-zhong-guo-kai-yuan-da-mo-xing-qi-fa-bi-yuan-jia-su-qiang-qi-ye-ru-kou-13nn</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-04-to-2026-09-11-zhong-guo-kai-yuan-da-mo-xing-qi-fa-bi-yuan-jia-su-qiang-qi-ye-ru-kou-13nn</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：中國開源旗艦（DeepSeek V4.1 Flash、Qwen3.8 Max 2.4T）與蒸餾爭議（Kimi K3）同週爆發，閉源廠商不再只比模型——OpenAI 把 GPT-6 鎖進企業工作流、Google 把 Gemini 鋪到 Windows 桌面，連晶片層都出現 Qualcomm × 亞馬遜這種被市場直接拿來對比輝達的組合。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  中國開源旗艦齊發：DeepSeek 與 Qwen 同週交卷
&lt;/h2&gt;

&lt;p&gt;DeepSeek 推出 V4.1 Flash，主打 1M context、FP4 KV cache 與 cross-layer attention reuse，定位是低成本長上下文變體&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;。同時間 Pro 線確定退役，價格與角色向 Flash 傾斜&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt;——這是「發布」與「可商用」同步落地，但 Flash 真正能不能吃下 Pro 既有工作流，要看既有整合的遷移成本。&lt;/p&gt;

&lt;p&gt;阿里這邊則推出 Qwen3.8 Max，2.4 兆參數 MoE，宣稱在 coding 榜單超越 Claude Opus 5&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMioAFBVV95cUxNWmZWbmdpcFVLSXpUOHVZeGNyLUJlZEp1MlUyX0VLWmpRN1plc2lUcnQ3TFZZdG5xMzVnUEtDbXFIbnpIdEVRbkEyNGpiVWVsWm4tcThob2hNNGxMcEd2djVZVm5jU0IxV3FUUnlfR2VUVXd3MFlQOGV1Qm9aSFIxSE1FNHN1Rl9pS1pfaFkyRk00Ry1Nc0xnanhVb2tWXzdq?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen3.8-Max Model Overtakes Claude Opus 5 on Coding Leaderboard - Startup Fortune&lt;/a&gt;，並開源釋出 Qwen3.8-2.4T-A95B 權重，這是 Qwen-Max 級別 MoE 第一次對外開源&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;。同一週也開源自駕模型&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE16UHpfYXBMLXl0eDFCVm5pSUtTa2c0ZGFZQnpPeTUxTTFQMS15dXhkUUFEV25YN2ZsWXBaM1o0aGo1dF95T0gtR3h3R3gtektUT0d0OUZJcUtIMTZKc2hoN3EwajJZOG5Oa2swU1NTYw?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen releases open-source model for autonomous driving - TechNode&lt;/a&gt;。對照既有解法：榜單之外，開源 MoE 要證明的是企業導入這一關——vLLM / SGLang 對 2.4T MoE 的 routing 開銷、KV cache 容量，以及微調 pipeline 能否沿用既有 LoRA 工具鏈，都是得上機驗證的工程問題。&lt;/p&gt;

&lt;p&gt;開源旗艦齊發的同一週，白宮卻點名蒸餾爭議；中國 AI 本週的訊號是矛盾而非突破——技術自信與合規陰影並存。&lt;/p&gt;

&lt;h2&gt;
  
  
  蒸餾爭議升溫：白宮點名 Kimi，WSJ 揭露產業模式
&lt;/h2&gt;

&lt;p&gt;白宮指控 Moonshot 把 Anthropic Fable 蒸餾進 Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPRXVMaFFqb3JjYURMcTNkMmFvUGItUVRYaWFxaWw3Q3NzczBpS1pidTNFa05lbjJyOW5oWW9acUxWN2FMcW9rNVI0YkthVW9NTC1pR3k1MGRLQ3o1ektnaHkxM3E4RDlYdnQ1emd5QjB0VU9rcXlSc3UxbjdacXpVdzdVNVM2V25YQ2tUbmRNZmdiNUhTai1jaG5SSGY?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Distilled Anthropic's Fable For Kimi K3, White House Says - yellow.com&lt;/a&gt;，美國機構的說法另有媒體從訓練來源與產業模式兩個角度跟進&lt;a href="https://news.google.com/rss/articles/CBMiWEFVX3lxTE44YlRZcUp1SXdqMUJEc0NZLVBsMmhVblpMSzhaRGpiM3FmNXVnZWw4SWtFTzhjZ3NjTk9Sc0ppdzlyWUtIaTI4RHJMeUVWM0tFUE01WGdraU8?oc=5" rel="noopener noreferrer"&gt;Moonshot’s Kimi rattled markets. U.S. agencies now say it was trained on American models - Cryptonews.net&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxPeGswOXZNYVNvdzV2SzRHVC1aM0lGM01aNHVnMlRRQWVZYkFhTGh0dzE4UkRER042RU5kQnVmUVY3X282ZmgzYUtJYU5uSnhyZTV1eWlsaDdKcHBjQ28tQnQzd09XUm9KczY4SFB1c1hEZ2xfS203RExlZDU5OUZRcHZ4YUNUdG5JbzByNFlqWi10ZVlXcmxVNExXODR6dEp4X1FjbERSckRRQ0ZNcVhiMGxR?oc=5" rel="noopener noreferrer"&gt;How Chinese AI Firms Tried to Clone U.S. AI Models - WSJ&lt;/a&gt;。這是政策與產業競合的訊號，不是單一訴訟：後續真正影響的是美國出口管制是否能從「算力」延伸到「蒸餾後的衍生模型」，以及企業客戶會不會把供應鏈合規要求寫進採購條款。&lt;/p&gt;

&lt;p&gt;對工程讀者的現實含意是：如果你正在評估 Kimi 或同類蒸餾模型，要先確認供應商的訓練資料合規說明是否能過你法務那一關——這是採購 checklist 的新欄位。&lt;/p&gt;

&lt;h2&gt;
  
  
  企業入口戰：GPT-6 Astra 與 Gemini Windows App
&lt;/h2&gt;

&lt;p&gt;OpenAI 端出 GPT-6 Astra，自家文案給的說法是「a new generation of intelligence」與「intelligence for work」&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;——同一週連發兩篇自家發文，通篇是 enterprise sales 的調性。Google 則反過來搶桌面端入口，把 Gemini App 推進 Windows&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;兩條路線的工程取捨不同：&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;面向&lt;/th&gt;
&lt;th&gt;GPT-6 Astra&lt;/th&gt;
&lt;th&gt;Gemini Windows App&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;整合面&lt;/td&gt;
&lt;td&gt;工作流（企業系統綁定）&lt;/td&gt;
&lt;td&gt;桌面 OS（個人入口）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;主要阻力&lt;/td&gt;
&lt;td&gt;API 額度、SSO/權限、IT 治理&lt;/td&gt;
&lt;td&gt;Windows 版本碎片、本機資源調度&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;替代方案&lt;/td&gt;
&lt;td&gt;Microsoft 365 Copilot + Azure OpenAI&lt;/td&gt;
&lt;td&gt;既有 ChatGPT desktop、Edge Copilot&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;三欄差異決定成敗：GPT-6 要贏的是 IT 治理導入流程，Gemini Windows 要贏的是作業系統佔有率與本機資源調度。兩者都還在「發布」到「進入真實工作流」之間——能不能站穩，要看 SSO/稽核/權限分層這些企業 IT 真正在意的整合面，而不是 demo 影片。&lt;/p&gt;

&lt;h2&gt;
  
  
  晶片戰場：Qualcomm 拿下亞馬遜，輝達敘事遭質疑
&lt;/h2&gt;

&lt;p&gt;晶片戰場的訊號已從「誰跑得動」轉向「誰的單瓦 token 成本更低」。Qualcomm 與亞馬遜達成 AI 晶片合作，並提供約 40 億美元股票認購權&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTFAwQVB0cnlUVVMxeVJad0FBbFlINDRJa25vLUtzcTZSaWFjRUNHMHRIbWxJS0dVWFRoU1duWmNUZkZac2g5aUtURGNMMVNRS2Q3N1RadERqbmRzTWg2NUtuUkdkUU1IN01xMVJwMExvVQ?oc=5" rel="noopener noreferrer"&gt;Qualcomm's Massive AI Chip Deal With Amazon Puts Nvidia's Lead at Risk - MarketWise&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;——交易消息一出，市場評論直接以「輝達領先地位不保」解讀；客製晶片與輝達的角力，正式寫進一線雲端廠的合約。與此同時，Jim Chanos 質疑輝達 AI 晶片經濟學，直指 Jensen「highly rentable」說法&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxOWFY0YmdVM2hQNjAxQVJGSkdrNTRTZUl0VEJFUmJKaGNXUXl6Ykp2YTYtdi1pd00tQzlWeEhabENVNVJ0MDc2ckRzVWNMTTRrS0FpTzV2NG9rOF9IZGhSVC1fdlk0dFFYVnUtY3dFYnNiNDBaTGdjNjJkbEd3NGh4ZF8xNjd6WU1iOTlIR1VHeC1KMElSMUdWaVZOSGlqeENpRWFMMEs5SDdoUnZweFd5MDBUX2JxNktkTGNCWVlLZWhnVm8xTDFXLVY4MW9va3R2LTNadnZ3MUdfLTJsYVdRN09GYWIwYzVEOFNkOXVLdjc5SmpuU3NwSnNNVnY?oc=5" rel="noopener noreferrer"&gt;Jim Chanos Questions Nvidia’s AI Chip Economics After Jensen Huang Says Nvidia Chips Are 'Highly Rentable' - Stocktwits&lt;/a&gt;；NVIDIA 自家 Hot Chips 2026 六場演講則鋪出「單卡到 AI 工廠」的全棧敘事&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxOMGlqcW5qZEZ0b09EOWk5VGdDQmUzTElMVGlnTTRXOW1tVnBSazFuMV9NOUF1UE5qMVBYWFVFSDBRYnI0LW1XSG9UQlVGcWZNSzNyVVVWcmc5U1I1a3BlU1lFczZIUGp2ZXEzVHVITGN0R2RjX3IwdEVYOVVOUTdnNg?oc=5" rel="noopener noreferrer"&gt;From One GPU to an AI Factory: Deep Dive into NVIDIA’s Six Hot Chips 2026 Presentations - semivision&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;對企業的現實意義：2027 年 capex 決策不能再用「輝達 = 預設」作答，至少要跑一輪 TCO 試算。&lt;/p&gt;

&lt;h2&gt;
  
  
  安全與治理：Anthropic 兩端同時曝光
&lt;/h2&gt;

&lt;p&gt;Anthropic 一邊公布阻擋可能的生物武器濫用嘗試&lt;a href="https://news.google.com/rss/articles/CBMiiwFBVV95cUxOb3RxODh4LWhOS0o0UFBGNUhHODA0Z2dqbTcyTlFmYVRwRzJVVnhKMFl4U2dqQUQwZXV6d0c1c0gwRHZXeF9wOFRTN2xCengtRnRuR0tJLUNDTlI3VjAyekRzRngwMWY4M01hSUVwWURFUFAxdkRjRC1HZUM3cG9YTnZ4UVFNcVlnT200?oc=5" rel="noopener noreferrer"&gt;Anthropic Says It Blocked Possible Efforts to Build Biological Weapons - The New York Times&lt;/a&gt;，一邊揭露第四起 Claude Opus 4.6 相關資安事件&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;。「擋下濫用」與「資安事件」同週出現——這組對比剛好說明 frontier model 的治理戰場是雙向的：模型既是防禦工具，也會成為安全事件的主角。與本週其他軸線（中國開源、企業入口、晶片戰場）的共同點是：攻擊面與整合面同步擴張，紅隊測試、prompt injection 防護、tool-call 權限控管不再是「之後再做」的項目。&lt;/p&gt;

&lt;h2&gt;
  
  
  結語
&lt;/h2&gt;

&lt;p&gt;本週四條軸線：中國開源旗艦 + 蒸餾爭議、閉源搶企業入口、晶片戰場開打、安全與治理兩端同時收緊。模型本身的進步幅度反而不是故事主軸——真正的訊號是「誰能進 workflow、誰的成本結構能撐到 2027」，這兩個問題的答案，本週各自往前推了一步，但都還不到「可直接採用」的階段。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-28 to 2026-09-04 | Three Flash Models in Six Weeks, One Distillation Fight</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 04 Sep 2026 00:14:55 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-three-flash-models-in-six-weeks-one-distillation-fight-2lea</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-three-flash-models-in-six-weeks-one-distillation-fight-2lea</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Three Flash-tier models in six weeks, a Claude outage that touched multiple model IDs at once, and a distillation fight spilling onto the dark web. This week the bottleneck isn't raw capability — it's who controls the inference lane and what happens when that lane goes down.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  The Flash tier is the new battleground
&lt;/h2&gt;

&lt;p&gt;Google released Gemini 3.8 Flash as its third Flash model in roughly six weeks&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;. Anthropic countered with Claude Fable 5.1 and Claude Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - Anthropic&lt;/a&gt;. Alibaba shipped Qwen3.8-Max-0902, which Wccftech frames as matching Claude Fable 5 in capabilities with merely an update and without jumping to a new version number&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;; AI Weekly reports the same snapshot lifted Alibaba's CodeArena score by 22 points to 1,691&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;. Zhipu AI launched GLM-5.3-Flash after what the vendor describes as a stealth trial on 100,000 domestic chips&lt;a href="https://news.google.com/rss/articles/CBMiogFBVV95cUxOVXhjRkV4OWxtYVVmaWxKZ0g0TlI2TUE2SnBRV1pFNVJrRnJtVk1yZFpJa2gyVHk2U1ZyV0xqVUhvRXJURGtLYWdaY3dTWXZpdFNmSTdzN2lxNVljQVEyRzFMS0U4OWdFenAtLWpLZGlUOTJmMTRZd1dlNzhrNGk0bXhmQ3VTSFpOdUpwbWhiVmRJVW16UUsxd0Zacnl4WXJTQkE?oc=5" rel="noopener noreferrer"&gt;Zhipu AI Launches GLM-5.3-Flash After Stealth Trial on 100,000 Domestic Chips - Retail News Asia&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The technical reason this matters: Flash-tier models are where the unit economics actually live. A 20x price gap separates Tencent Hy3, GLM-5.3-Flash, and Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMiekFVX3lxTE55NkVsTm5DUUVMY3pCa2ZwVFJ1OHYtNGhuZEp3amxiX2hGQXltYnhYUEFpaUsxUUVwVlFROVBValZHS01SZFBCX29lN29JV1JORnR2cE1ORk5iRHdYTTB4TzZBYVVrekV2ZTNSU21vX2dMNTJLd1dSZFlR?oc=5" rel="noopener noreferrer"&gt;Tencent Hy3 vs GLM-5.3-Flash vs Kimi K3: 20x Price Gap [2026] - tech-insider.org&lt;/a&gt;. For production teams, the question is no longer "which frontier model is smartest" but "which Flash variant clears the latency, reliability, and per-token cost bar for the workflow I have in mind." Capability is approaching parity at this tier — engineering constraints now dominate.&lt;/p&gt;

&lt;p&gt;One caveat: the "matches Claude Fable 5" framing for Qwen3.8-Max-0902 comes from Wccftech's headline characterization, not an independent benchmark surface. The CodeArena jump to 1,691 (a +22-point move) is headline-supported for #3 alone&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;. Treat the parity claim as a single-source claim until you test it against your own evaluation set.&lt;/p&gt;

&lt;h2&gt;
  
  
  OpenAI ships GPT-6 Astra into Microsoft's enterprise lane
&lt;/h2&gt;

&lt;p&gt;OpenAI announced GPT-6 Astra with availability through Microsoft Foundry&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - azure.microsoft.com&lt;/a&gt;, and followed with a separate safety overview on the same day&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;. The distribution channel is the real story: shipping into Foundry puts the model inside the enterprise procurement path that Azure customers already use, ahead of any standalone API migration. If your stack is Azure-native, the integration cost just dropped; if it isn't, the procurement gravity is now pulling that direction.&lt;/p&gt;

&lt;p&gt;Two adjacent moves strengthen the vertical-integration thesis. OpenAI announced that healthcare organizations can connect EHR and industry data to ChatGPT&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxQUFZLUDY4VnlYRGpwSVJOUk9LNVI5T29GeE1hdzBNLUxXZTBVbmNXYjRPWWlNWERvSDFwMC1pc2dNaXhXcGtFZ3IyVFlYNy1CLXpWQ3d1cXBDczI2Zm5iajQ5X0JLOUFlbVNqdFRHajN6MUFzYnF2S1lnUEhtbndaVXpuU2d0UVU?oc=5" rel="noopener noreferrer"&gt;Healthcare organizations can now connect EHR and additional industry data to ChatGPT - OpenAI&lt;/a&gt;. Separately, the U.S. Department of War launched OpenAI's ChatGPT Mil on GenAI.mil&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOa2FtbEFMblFrZFZ3bnBXbGhZZnNCUzBXd2Ytejl6QmZhak1RZjBjQU5XQmxTck5ac3J2NkN5bUZwSzEtUVl3aXRsb2ZBMmtSMHdwZXFRRk9MMFQ1OWFtNkFOVjBvcWRZU2NtOEpvemhNUkpfMThMaTdSemJhbWNFR1dhMW5jVkNXZnhCLTVraGpJSFVDaEkzZFJMeVhwekpRQS14bDB0TTgwcUVMNmgzaF9zMUY2TmFD?oc=5" rel="noopener noreferrer"&gt;Department of War Launches OpenAI's ChatGPT Mil on GenAI.mil - U.S. Department of War (.gov)&lt;/a&gt;. Each is a workflow anchor — once an EHR pipe or a .mil deployment exists, the model is wired into data sources competitors can't replicate by API alone. Vendor claims about capability, of course, remain vendor claims until independent benchmarks land.&lt;/p&gt;

&lt;h2&gt;
  
  
  Reliability became a first-order concern
&lt;/h2&gt;

&lt;p&gt;Anthropic confirmed a Claude outage affecting multiple models&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNU2NEMWRVYndCdkpfZVNGcG5BZWsxYmtRR2lsVWFsVjBoUHpwRFM4MnJzaFFKSEJnQmhXbnJaejk0bFFucjh5Vk1aRHctTUh6MUxXMEYwYjhneVJYRXphbHlDSnZwZEdTaVVXM3VfS1Z4bmY0QzhkU3ZWandLQW02WTZZN280Nnk1SXRqZjFYbWUxNHdReTE0Qk1UcVg3RVRyY3F3Q2tkbE9VOTRpSExjUndCRUxCSVRqUTk4TDdB0gHDAUFVX3lxTE1xYjc4TG53LWJRY0NEZlVkSEJDbEFXeDdRWVNibjF2ZWE3cFgyVWJicmtFZ2NzMHpxbzhqUmx6VVRZOUplcktLVV9FczNIODItZE1iaFMzOVlLUEhrUVBxUVFpTzBDQlJnNHBQS3kteWxleUg1NVdRX2tsRmhwdXZRckw2Z2RQODVuWnBzTFctYVVOeWFkUldBdHk5cHFRQmUzaVU4Z2FMT1UtOE13ei1iYnYyMl9SalZGSlQ2bGRqSDFaMA?oc=5" rel="noopener noreferrer"&gt;Anthropic confirms Claude is down, multiple models affected - BleepingComputer&lt;/a&gt;. The phrasing — "multiple models affected" in a single incident — is the part to internalize. When one provider's reliability incident crosses model IDs, the blast radius for a multi-model fallback strategy is wider than a single-model SLO implies. If your architecture assumes one vendor's Flash tier is the cheap lane and the frontier tier is the reliable lane, this week's outage is the test case for what happens when both lanes go down at once.&lt;/p&gt;

&lt;p&gt;For buyers, the practical consequences: multi-model routing needs to be tested under a single-vendor outage, not just under per-model degradation. For builders, vendor lock-in costs now include the cost of simulating cross-model outages you didn't think you'd hit.&lt;/p&gt;

&lt;h2&gt;
  
  
  The distillation fight moved off-platform
&lt;/h2&gt;

&lt;p&gt;CNBC reports that Anthropic's distillation battle has turned to the dark web as concerns from China swell&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxPd0dmaVMwck5RMHRLclpVS3pISmpMZ3RBX3NOTVFMMjNLdEc2SlhYc0JTVVZKS1N3andHeHdQenVERzFGTzRpU016WFFSc2pjVnF4dTZfN25GSGtxNzQxN1prRExOZ0NITEpNMWZwME5mZ0lhcWFpSm52SzdYeXBhalhaQmFhYWFDRjFDcjlOb3RDMG9QVUNVbWZOUjdxc3I1WENwQ3V3UzXSAa4BQVVfeXFMTWRCSjNXU3ZwX19acjFnNEVDVDQyMTBiWl9FQVZZNnRmMWZFQTNFQTluYUxzRzVFNVZ1NDRtdjlTbm1ieXk3ZlFuNHZEdktWbHNHeDBrUXFzZ0lKdGhCZ2xXZ0tXVUowZk52MXVWRXpzcHVUS0tmVlJlMFhQTU9pRkxDZzdsV3VSNHFOYm44RnBudXpRVG9wd25CMEF1Yjh0cjFjUUtKMUg3M2JwT2ZB?oc=5" rel="noopener noreferrer"&gt;Anthropic's distillation battle turns to the dark web as China concerns swell - CNBC&lt;/a&gt;. The headline itself is the signal: when IP defense moves to channels outside standard legal recourse, the response surface changes. For teams running fine-tuning or distillation pipelines, expect tighter ToS enforcement on the upstream side and more scrutiny on data provenance downstream.&lt;/p&gt;

&lt;h2&gt;
  
  
  Chips and capital
&lt;/h2&gt;

&lt;p&gt;Moonshot AI, creator of Kimi K3, has filed for a Hong Kong IPO, per South China Morning Post&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;. TradingView reports the filing context: Kimi K3 driving a $300M revenue run rate, with the IPO targeted within six months&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;. Both numbers carry the usual IPO-disclosure uncertainty — the run rate is a vendor figure, and the timeline is a target, not a guarantee.&lt;/p&gt;

&lt;p&gt;On the silicon side, VentureBeat reports enterprises are putting non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;. That phrasing ("on their evaluation lists") is the qualifier to read carefully — it means purchasing intent measured at the eval stage, not deployed fleet share. The structural shift is real; the migration is slower than the headline suggests. Yahoo Finance frames Nvidia's next act as bigger than selling AI chips&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt; — a useful reminder that the inference-lane economics are where margins are migrating, which is exactly why the Flash-tier competition above matters.&lt;/p&gt;

&lt;h2&gt;
  
  
  What to actually do this week
&lt;/h2&gt;

&lt;p&gt;If you're evaluating Flash-tier models: don't run a single benchmark. Run your own evaluation set against at least two of the new variants (Gemini 3.8 Flash, GLM-5.3-Flash, Qwen3.8-Max-0902) and measure latency, error rate, and per-token cost under your real prompt distribution. The published numbers are vendor claims; your numbers are decisions.&lt;/p&gt;

&lt;p&gt;If you're on Azure: the GPT-6 Astra Foundry availability is a real procurement event, not a press release. Pull the eval cycle forward by a sprint.&lt;/p&gt;

&lt;p&gt;If you're on Anthropic: pressure-test your multi-model fallback. A single incident crossing model IDs is the new worst case.&lt;/p&gt;

&lt;p&gt;If you're building on distillation: tighten provenance checks before the next round of enforcement lands.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-08-28 至 2026-09-04 同週四個前沿模型落地與一次三重中斷</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 04 Sep 2026 00:11:29 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-four-frontier-models-land-in-seven-days-flash-pricing-drops-3kl3</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-four-frontier-models-land-in-seven-days-flash-pricing-drops-3kl3</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：同週四個前沿模型先後落地（GPT-6 Astra、Claude Fable 5.1 / Mythos 5.1、Gemini 3.8 Flash、Qwen3.8-Max-0902），但 9 月 3 日當天三家龍頭服務同時中斷，而非 Nvidia 晶片在企業評估清單上領先 Nvidia 下世代 GPU 達 14 分——「發布」與「可用」之間的落差，這週有了具體樣本。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  前沿模型：同週四個釋出，密度本身就是新聞
&lt;/h2&gt;

&lt;p&gt;OpenAI 於 9 月 4 日釋出 GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;，定位為「新一代智慧」，並於 9 月 3 日發布對應的安全總覽&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;；Microsoft 於同日宣布 Astra 已在 Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;。模型釋出與企業通路文件同日發布，這次節奏是「模型 + 通路」綁定，不是純研究發表。&lt;/p&gt;

&lt;p&gt;Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Claude Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;，兩個版本號同步亮相。標題只說明兩者同時發表，並未交代兩條產品線之間的關係；版本號一致是否代表共用迭代節奏，需要官方說明才能判斷（推測）&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE15ODlkcDc5RXk4dzQwbUFXd2lveWlxaS15Z19xaEg2MEExcVZyUEtSaVhFTFh1WlV0TzlldWkxbmxtX0hSX0RiYS0ySW13SWtPWThMWGR4eWR4RkRZWkdyekVNWDZxc1pTelNlN1QzSFktX0FMSGZOcG9xUQ?oc=5" rel="noopener noreferrer"&gt;The Sequence Learning Loop - Issue 925: Learn About Fable and Mythos 5.1, GLM-5.3-Flash, and Qwen 3.8 - TheSequence | Jesus Rodriguez&lt;/a&gt;。同一天，蒸餾防禦戰線被 CNBC 報導延伸到暗網&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxPd0dmaVMwck5RMHRLclpVS3pISmpMZ3RBX3NOTVFMMjNLdEc2SlhYc0JTVVZKS1N3andHeHdQenVERzFGTzRpU016WFFSc2pjVnF4dTZfN25GSGtxNzQxN1prRExOZ0NITEpNMWZwME5mZ0lhcWFpSm52SzdYeXBhalhaQmFhYWFDRjFDcjlOb3RDMG9QVUNVbWZOUjdxc3I1WENwQ3V3UzXSAa4BQVVfeXFMTWRCSjNXU3ZwX19acjFnNEVDVDQyMTBiWl9FQVZZNnRmMWZFQTNFQTluYUxzRzVFNVZ1NDRtdjlTbm1ieXk3ZlFuNHZEdktWbHNHeDBrUXFzZ0lKdGhCZ2xXZ0tXVUowZk52MXVWRXpzcHVUS0tmVlJlMFhQTU9pRkxDZzdsV3VSNHFOYm44RnBudXpRVG9wd25CMEF1Yjh0cjFjUUtKMUg3M2JwT2ZB?oc=5" rel="noopener noreferrer"&gt;Anthropic's distillation battle turns to the dark web as China concerns swell - CNBC&lt;/a&gt;，防禦對象指向中國蒸餾攻擊。&lt;/p&gt;

&lt;p&gt;Google DeepMind 於 9 月 2 日釋出 Gemini 3.8 Flash，這是六週內的第三個 Flash 模型&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;。六週三個 Flash 的節奏不是孤立的技術事件，而是 DeepMind 持續推進其算力切片策略&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;Alibaba 於 9 月 2 至 3 日用 0902 快照更新 Qwen3.8-Max，CodeArena 分數升至 1,691，較前一版躍升 22 分&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;；刻意未跳版本號&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;。The Sequence 週報將 Qwen 3.8、Fable / Mythos 5.1、GLM-5.3-Flash 並列為本週產業綜述焦點&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE15ODlkcDc5RXk4dzQwbUFXd2lveWlxaS15Z19xaEg2MEExcVZyUEtSaVhFTFh1WlV0TzlldWkxbmxtX0hSX0RiYS0ySW13SWtPWThMWGR4eWR4RkRZWkdyekVNWDZxc1pTelNlN1QzSFktX0FMSGZOcG9xUQ?oc=5" rel="noopener noreferrer"&gt;The Sequence Learning Loop - Issue 925: Learn About Fable and Mythos 5.1, GLM-5.3-Flash, and Qwen 3.8 - TheSequence | Jesus Rodriguez&lt;/a&gt;。中國 GLM-5.3 在 Cyber 測試上接近 Anthropic&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt;，報導屬第三方評論站，需獨立驗證基準定義。&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;模型 / 快照&lt;/th&gt;
&lt;th&gt;釋出時點&lt;/th&gt;
&lt;th&gt;來源標題要點&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra&lt;/td&gt;
&lt;td&gt;9/4&lt;/td&gt;
&lt;td&gt;新一代智慧&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra（安全）&lt;/td&gt;
&lt;td&gt;9/3&lt;/td&gt;
&lt;td&gt;對應安全總覽&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra（通路）&lt;/td&gt;
&lt;td&gt;9/3&lt;/td&gt;
&lt;td&gt;Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Fable 5.1 / Mythos 5.1&lt;/td&gt;
&lt;td&gt;9/1&lt;/td&gt;
&lt;td&gt;雙線版本號同步亮相&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash&lt;/td&gt;
&lt;td&gt;9/2&lt;/td&gt;
&lt;td&gt;六週內第三個 Flash&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.8-Max-0902&lt;/td&gt;
&lt;td&gt;9/2-3&lt;/td&gt;
&lt;td&gt;CodeArena 躍升 22 分至 1,691&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GLM-5.3&lt;/td&gt;
&lt;td&gt;8/30 報導&lt;/td&gt;
&lt;td&gt;Cyber 測試接近 Anthropic&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  政府 / 通路：模型可用不等於政府客戶可用
&lt;/h2&gt;

&lt;p&gt;GPT-6 Astra 在 Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;，代表 Azure 客戶能在合規環境內呼叫。Euromonitor 同日宣布 Passport Intelligence 透過 Microsoft 365 Copilot 推出&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQQXlma1VKZ3Ytcy1kLXEyNndKMTRHTmFZbHNPQnA2THRPZnhGWnN0NnV5eGNpRTVNZUhhLVRaLXpzLWh4eGlMR0pTS0ViOG1HdDZjaTJWRFBPVHFRdjJZSnJtUkEtRlRjeFpDX0h3d2J6RUI4czRMcjcteE1INmRMdzJFRUc1MnlXSHRLaVRUc2FsU3hHZFNDelNpM0xJdDB2UXJUZkhHU21HQlVPcm15MjNhVkJMUDQ4ci1OMDlJSXlYT3JXNVFETkk5NA?oc=5" rel="noopener noreferrer"&gt;Euromonitor Introduces Passport Intelligence Through Microsoft 365 Copilot - Business Wire&lt;/a&gt;——這是「模型釋出 → 企業客戶上線」壓縮到 24 小時的樣本。&lt;/p&gt;

&lt;p&gt;但通路層與政府採購層是兩個不同的可用層級。9 月 3 日，Pentagon 的 AI 入口已上線 ChatGPT 與 Grok，名單上沒有 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;。Claude 缺席 Pentagon 入口，不應直接推論為技術評比結果；採購偏好、合規篩選、出口管制與國家安全考量是獨立的決策變數。&lt;/p&gt;

&lt;p&gt;兩件事並列讀：模型可以跑（Foundry 與 Copilot 通路暢通）與政府可以買（Pentagon 通路是否涵蓋）是兩件不同的事。&lt;/p&gt;

&lt;h2&gt;
  
  
  算力：非 Nvidia 晶片在採購評估上領先 14 分
&lt;/h2&gt;

&lt;p&gt;VentureBeat 報導，企業把非 Nvidia 晶片放在評估清單前列，領先 Nvidia 下世代 GPU 14 分&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;。同一週 Yahoo Finance 的圖表日報指出，Nvidia 的下一步比賣 AI 晶片更大&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt;（屬評論稿，非 Nvidia 官方說法）。&lt;/p&gt;

&lt;p&gt;兩個事實擺在一起讀：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;14 分的領先幅度，若樣本數足以支撐，代表企業採購評估清單已有「非 Nvidia 路徑」這個明確選項，不是「考慮中」。&lt;/li&gt;
&lt;li&gt;Nvidia 自身的反擊敘事已從「晶片」轉向「晶片 + 系統 + 軟體棧」綁定，這正是 Yahoo 那篇評論的核心命題&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt;。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Moonshot AI（Kimi K3 母公司）已在 9 月 3 日啟動港股 IPO 程序&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;，年化營收 3 億美元，目標六個月內掛牌&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;。Moonshot 是 Kimi K3 模型與本次 IPO 的主體&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;——但年化營收 3 億美元屬報導中的 run rate 數字&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;，需對照實際年化經常性營收。&lt;/p&gt;

&lt;h2&gt;
  
  
  可靠性：三重中斷把「可用層」打回原形
&lt;/h2&gt;

&lt;p&gt;9 月 3 日，ChatGPT、Claude、Grok 三家服務同時中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt;（The Register 報導，未列各家持續時間）。&lt;/p&gt;

&lt;p&gt;這條事實對架構設計的直接含意是：「多供應商」不等於「高可用」，還要加上「中斷時間分散」這個維度。fail-over 設計若只覆蓋「同供應商多區域」，三家同日全倒時備援路徑會全部失靈。&lt;/p&gt;

&lt;p&gt;Pentagon 入口同日已選擇 ChatGPT 與 Grok，卻不見 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;。採購偏好的政治 / 法規篩選，與模型能力評估是兩件獨立的事；這個案例顯示政府客戶的可用清單已與民間採購脫鉤。&lt;/p&gt;

&lt;h2&gt;
  
  
  三層級分法
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;層級&lt;/th&gt;
&lt;th&gt;本週代表事件&lt;/th&gt;
&lt;th&gt;對工程團隊的意義&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;發布&lt;/td&gt;
&lt;td&gt;GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;、Fable/Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;、Qwen3.8-Max-0902&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;規格表更新；可讀論文 / changelog&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;企業通路可用&lt;/td&gt;
&lt;td&gt;Foundry 上線 Astra&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;、Passport Intelligence 接 Copilot&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQQXlma1VKZ3Ytcy1kLXEyNndKMTRHTmFZbHNPQnA2THRPZnhGWnN0NnV5eGNpRTVNZUhhLVRaLXpzLWh4eGlMR0pTS0ViOG1HdDZjaTJWRFBPVHFRdjJZSnJtUkEtRlRjeFpDX0h3d2J6RUI4czRMcjcteE1INmRMdzJFRUc1MnlXSHRLaVRUc2FsU3hHZFNDelNpM0xJdDB2UXJUZkhHU21HQlVPcm15MjNhVkJMUDQ4ci1OMDlJSXlYT3JXNVFETkk5NA?oc=5" rel="noopener noreferrer"&gt;Euromonitor Introduces Passport Intelligence Through Microsoft 365 Copilot - Business Wire&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;能在沙箱環境實測&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;機構客戶可用&lt;/td&gt;
&lt;td&gt;Pentagon 入口選擇 ChatGPT / Grok&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;法務、合規、出口管制已通過&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  風險與取捨
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;版本號膨脹成本。&lt;/strong&gt; DeepMind 六週三個 Flash&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;、Alibaba 用快照而非新主版&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;——短期是節奏感，長期對模型生命週期管理（測試矩陣、回歸基準、A/B 框架）形成壓力。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;基準敘事化。&lt;/strong&gt; GLM-5.3「接近 Anthropic」的 Cyber 分數&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt; 來自第三方評論站，Cyber 單一基準不能涵蓋企業真實任務面。Moonshot 3 億美元年化營收&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt; 是 run rate 而非 ARR，兩者在企業財務語境下指涉不同。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;中斷復原 SLA。&lt;/strong&gt; 三家同日中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt; 暴露的問題是：多供應商不等於高可用，還要加上「中斷時間分散」這個維度。下次寫架構文件時應列入。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;政府採購的非技術篩選。&lt;/strong&gt; Claude 缺席 Pentagon 入口&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt; 屬採購偏好，與技術能力評估是兩件事，不能直接讀成「Anthropic 技術失敗」。&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  結論：發布密度回到年初水平，槓桿移到了可靠性與通路
&lt;/h2&gt;

&lt;p&gt;本週釋出的四個前沿模型（GPT-6 Astra、Claude Fable 5.1、Mythos 5.1、Gemini 3.8 Flash、Qwen3.8-Max-0902），證明前沿競爭沒有冷場。但&lt;strong&gt;三重中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt; + 非 Nvidia 14 分領先&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt; + Pentagon 排除 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;&lt;/strong&gt; 共同指出下一階段的競爭點已從模型本身轉向：&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;模型上線到企業通路的時間差（GPT-6 → Foundry 24 小時內&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;）&lt;/li&gt;
&lt;li&gt;多供應商架構下的中斷容忍度設計（三家同倒&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt;）&lt;/li&gt;
&lt;li&gt;算力採購的評估清單能不能寫出非 Nvidia 路徑&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;
&lt;/li&gt;
&lt;li&gt;法規 / 出口管制對模型可商用範圍的實質篩選&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;
&lt;/li&gt;
&lt;li&gt;中國前沿模型的商業化訊號——以 Moonshot 啟動港股 IPO 程序&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt; 為代表&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;技術決策者本週最該做的不是再讀一份模型 changelog，而是把「中斷復原 SLA」、「多供應商 fail-over」、「採購評估清單上的非 Nvidia 路徑」、「政府客戶可用清單」這四項寫進下次架構審查。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>Which Flash To Run — 五個便宜模型的成本與能力實測</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 28 Aug 2026 02:18:54 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/which-flash-to-run-wu-ge-bian-yi-mo-xing-de-cheng-ben-yu-neng-li-shi-ce-4nfa</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/which-flash-to-run-wu-ge-bian-yi-mo-xing-de-cheng-ben-yu-neng-li-shi-ce-4nfa</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;2026-08-29 修訂。&lt;/strong&gt; 原文發表的隔天，成本那一半就過期了：GLM 從按量變成訂閱制（同一個 GLM-5.3-Flash 從 $0.05/M 變成邊際 $0，而且是第一方）、&lt;code&gt;deepcode&lt;/code&gt; 以價格理由退役、另外兩個&lt;strong&gt;完全免費&lt;/strong&gt;的 GLM 門開了出來。能力與量測那一半沒有動。完整改動列在文末〈修訂記錄〉。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;一句話摘要：&lt;/strong&gt; 便宜模型沒有總冠軍，但 2026-08-29 起有了明確順位——&lt;strong&gt;日常主力 &lt;code&gt;zcode&lt;/code&gt;（GLM-5.3-Flash，訂閱制邊際 $0），Codex 側 &lt;code&gt;baicodex&lt;/code&gt;（qwen3.8-flash，週配額邊際 $0）&lt;/strong&gt;；真的要按 token 付費才輪到 &lt;code&gt;opzcode&lt;/code&gt;。其餘差別不在牌價，而在到期日、隱形 thinking、被 hook 借走的 base_url，與權限的前提。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;2026-08-27 實測，主角是五個便宜選項：三家 Flash（Qwen3.8-Flash、GLM-5.3-Flash、DeepSeek V4 Flash Vision-Exp）、Muse Spark 1.2 contributor、Dots3-Note preview:free。先講結論，再攤帳單與數字。&lt;/p&gt;

&lt;h2&gt;
  
  
  結論：按「你現在要做什麼」選
&lt;/h2&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;┌──────────────────────────────────────────────────────────────────────────┐
│  沒有總冠軍，但有順位：兩個邊際 $0 的門排前面                              │
├──────────────┬──────────────┬──────────────┬─────────────────────────────┤
│ 日常主力     │ Codex 側     │ 按量最佳     │ 完全免費                    │
│ zcode        │ baicodex     │ opzcode      │ z47code / z46vcode          │
│ $0 訂閱制    │ $0 週配額    │ $0.05 /M     │ $0 · glm-4.7 / 4.6v         │
│ GLM-5.3 Flash│ qwen3.8-flash│ 促銷至 09-09 │ 200K ctx · 後者吃圖         │
└──────────────┴──────────────┴──────────────┴─────────────────────────────┘
     跨檔大改 → opzcode / zcode（同模型，避開 qwen 的 NL2Repo 48.1）
     要 WebSearch → 目前沒有活路徑（見下）
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;情境&lt;/th&gt;
&lt;th&gt;用這個&lt;/th&gt;
&lt;th&gt;為什麼&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;日常主力（Claude Code）&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;zcode&lt;/code&gt;（glm-5.3-flash · BigModel 第一方）&lt;/td&gt;
&lt;td&gt;GLM Coding Plan Pro 訂閱制，&lt;strong&gt;邊際 $0&lt;/strong&gt;；agentic 四軸全第一、AA 指數並列最高。這是 &lt;code&gt;opzcode&lt;/code&gt; 跑的同一個模型，但走第一方且不按量計費&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Codex 側主力&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;baicodex&lt;/code&gt;（qwen3.8-flash · token plan · Codex）&lt;/td&gt;
&lt;td&gt;週配額已付過，邊際 $0；agentic 表現與 DeepSeek 同級（四軸各贏兩軸）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;真的按量付費&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt;（z-ai/glm-5.3-flash:floor · OpenRouter）&lt;/td&gt;
&lt;td&gt;沒有訂閱時的最佳按量價，blended $0.05；但促銷 2026-09-09 到期&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;跨檔案大改&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt; 或 &lt;code&gt;zcode&lt;/code&gt;（都是 GLM-5.3-Flash）&lt;/td&gt;
&lt;td&gt;Qwen 在 NL2Repo 掉到 48.1，輸 GLM 8.2 分且有使用者回報佐證&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;零成本 / 要吃圖&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;z47code&lt;/code&gt;（glm-4.7-flash）、&lt;code&gt;z46vcode&lt;/code&gt;（glm-4.6v-flash）&lt;/td&gt;
&lt;td&gt;官方標示完全免費、200K context；後者收影像與影片&lt;strong&gt;輸入&lt;/strong&gt;（V = vision）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;要 WebSearch&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;目前沒有活路徑&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;DeepSeek 官方端點是唯一真的回 &lt;code&gt;server_tool_use&lt;/code&gt; 的，但 &lt;code&gt;deepcode&lt;/code&gt; 已退役；ModelStudio 的 &lt;code&gt;/apps/anthropic&lt;/code&gt; 從來不觸發它&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;命名規則（2026-08-27 起）：裸名就是該家族的 flash，旗艦才加標記，標記用&lt;strong&gt;廠商自己的&lt;/strong&gt;字——Qwen 說 &lt;code&gt;max&lt;/code&gt;、DeepSeek 說 &lt;code&gt;pro&lt;/code&gt;。所以 &lt;code&gt;baicodex&lt;/code&gt; 是 flash、&lt;code&gt;baimaxcodex&lt;/code&gt; 是旗艦，&lt;code&gt;opgflashcode&lt;/code&gt; 改叫 &lt;code&gt;opzcode&lt;/code&gt;，&lt;code&gt;flash&lt;/code&gt; 不再出現在名字裡。&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;這條規則在 08-29 補了一個反例：&lt;/strong&gt; GLM 沒有自己的 tier 字。&lt;code&gt;glm-5.3&lt;/code&gt; 對 &lt;code&gt;glm-5.3-flash&lt;/code&gt;，頂規那個沒有名字，所以原本借用通用字的 &lt;code&gt;zmaxcode&lt;/code&gt; 改叫 &lt;strong&gt;&lt;code&gt;zglmcode&lt;/code&gt;&lt;/strong&gt;——廠商哪天真的出一個 GLM &lt;code&gt;max&lt;/code&gt;，借來的字就會撞名。&lt;strong&gt;沒有廠商自己的 tier 字時，用 family name，不要借一個通用的。&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;三個到期日：&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;opzcode&lt;/code&gt; 的 $0.05 到 &lt;strong&gt;2026-09-09&lt;/strong&gt;：Z.ai 在 OpenRouter 的促銷結束，那三家回到兩倍價。而且預設路由不會偏好便宜的那幾家——實測 18 次，裸 id 只有 10 次落在促銷價，加權後 $0.102/M input，比牌價貴 36%；現已釘 &lt;code&gt;:floor&lt;/code&gt; 壓回促銷價（20/20 命中）。&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;dotscode&lt;/code&gt; 的免費預覽到 &lt;strong&gt;2026-09-30&lt;/strong&gt;，屆時以「未知 id」400。&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;baicodex&lt;/code&gt; 的 token plan 到 &lt;strong&gt;2026-10-23，且 auto-renew 是關的&lt;/strong&gt;（原文漏了這條）。到期時 &lt;code&gt;baicodex&lt;/code&gt;/&lt;code&gt;baimaxcodex&lt;/code&gt;/&lt;code&gt;baideepcodex&lt;/code&gt; 一起停。重買會&lt;strong&gt;發新的 API key&lt;/strong&gt;，不是續用舊的。&lt;/li&gt;
&lt;/ul&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  成本：牌價不是重點，帳單機制才是
&lt;/h2&gt;

&lt;p&gt;blended 按 7:2:1（cache hit : input : output）估。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;成本一覽（每 M tokens）— 純文字，無圖床依賴

zcode     █ $0.00  ████████████████████ 訂閱制邊際零成本  ← 新增
z47code   █ $0.00  ████████████████████ 官方標示免費      ← 新增
z46vcode  █ $0.00  ████████████████████ 官方標示免費・吃圖 ← 新增
baicodex  █ $0.00  ████████████████████ 邊際零成本（週配額已付）
dotscode  █ $0.00  ████████████████████ 免費預覽
musecode  █ $0.041 ████▎
opzcode   █ $0.05  █████▎  (不釘 :floor 實測 $0.068)
deepcode  █ ——     已退役（原 $0.23 尖峰）
          └──────────────────────────────
           $0        $0.10        $0.20
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Wrapper&lt;/th&gt;
&lt;th&gt;牌價 in / out（每 M）&lt;/th&gt;
&lt;th&gt;Blended&lt;/th&gt;
&lt;th&gt;我們實付&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;zcode&lt;/code&gt; — glm-5.3-flash · BigModel 第一方&lt;/td&gt;
&lt;td&gt;$0.075 / $0.25 促銷價 2026-09-09 止，之後約 $0.15 / $0.45–0.50&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0（Coding Plan Pro 訂閱）&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;z47code&lt;/code&gt; — glm-4.7-flash · 200K ctx&lt;/td&gt;
&lt;td&gt;官方標示免費&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;z46vcode&lt;/code&gt; — glm-4.6v-flash · 收影像輸入&lt;/td&gt;
&lt;td&gt;官方標示免費&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;baicodex&lt;/code&gt; — qwen3.8-flash · token plan · Codex&lt;/td&gt;
&lt;td&gt;$0.15 / $0.47&lt;/td&gt;
&lt;td&gt;$0.088&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;$0&lt;/strong&gt;（plan 到 2026-10-23）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;dotscode&lt;/code&gt; — dots-3-note-preview:free&lt;/td&gt;
&lt;td&gt;$0 / $0&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;$0&lt;/strong&gt;（到 2026-09-30）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;musecode&lt;/code&gt; — muse-spark-1.2-contributor&lt;/td&gt;
&lt;td&gt;$0.10 / $0.20&lt;/td&gt;
&lt;td&gt;$0.041&lt;/td&gt;
&lt;td&gt;$0.041&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt; — z-ai/glm-5.3-flash:floor · OpenRouter&lt;/td&gt;
&lt;td&gt;$0.075 / $0.25 促銷價 2026-09-09 止&lt;/td&gt;
&lt;td&gt;$0.05&lt;/td&gt;
&lt;td&gt;$0.05（不釘 :floor 實測 $0.068）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;del&gt;&lt;code&gt;deepcode&lt;/code&gt;&lt;/del&gt; — deepseek-v4-flash-vision-exp&lt;/td&gt;
&lt;td&gt;離峰 $0.22 / $0.66 尖峰 $0.44 / $1.32&lt;/td&gt;
&lt;td&gt;$0.115 / $0.23&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;已於 2026-08-29 退役&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;訂閱制的帳單形狀和按量完全不同，這才是 &lt;code&gt;zcode&lt;/code&gt; 排第一的理由。&lt;/strong&gt; GLM Coding Plan Pro 是雙視窗配額：&lt;strong&gt;每 5 小時 12,000 點 + 每週 60,000 點&lt;/strong&gt;。點數 = &lt;code&gt;(input×2.3 + cached×0.56 + output×8)/10000&lt;/code&gt;（flash 檔）。兩個關鍵性質：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;離峰只算一半點數，而尖峰只有週一至週五 14:00–18:00（UTC+8）那四個小時。&lt;/strong&gt; 早上、晚上、整個週末都是離峰——這跟 DeepSeek 尖峰蓋掉整個工作日是相反的形狀。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;配額用完是硬停，不是帳單。&lt;/strong&gt; 它不會回頭吃資源包或帳戶餘額，所以一個耗盡的視窗&lt;strong&gt;不可能超支&lt;/strong&gt;。這一點跟本文其他每一個按量端點都不同：那些用超了只會安靜地繼續計費。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek 的時段差價（歷史記錄，模型已退役）：&lt;/strong&gt; 尖峰只在週一至週五 09:00–12:00 與 14:00–18:00（台北時間 = UTC 01–04 / 06–10），週六日全天按離峰計價（2026-08-23 起）。留著這張圖是因為它正是 &lt;code&gt;deepcode&lt;/code&gt; 被淘汰的原因——尖峰蓋住整個上班時段，而兩個對手都變成了固定費率。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;台北時間（週一至週五）— 尖峰 2倍價，週末全離峰
 00         09         12   14         18         24
  ├──────────┼──────────┼────┼──────────┼──────────┤
  │  離峰    │   尖峰   │ 離峰│   尖峰   │   離峰   │
  │ ████████ │ ████████ │ ██ │ ████████ │ ████████ │
  │ 9h       │ 3h       │ 2h │ 4h       │ 6h       │
  └──────────┴──────────┴────┴──────────┴──────────┘
         週六日 ─── 全天離峰（半價）
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  關掉的門
&lt;/h2&gt;

&lt;p&gt;這些不是表上的選項了，列在這裡是因為名字還會出現在舊筆記和肌肉記憶裡。&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;deepcode&lt;/strong&gt;（2026-08-29 新增）— 以價格退役。自 2026-08-16 重新定價後 DeepSeek flash 按時段計費，而尖峰蓋住整個工作日；對手同時都轉成固定費率（GLM 訂閱、qwen 週配額邊際 $0）。它唯一的差異化能力——&lt;strong&gt;唯一真的實作伺服器端 &lt;code&gt;web_search&lt;/code&gt; 的 DeepSeek 表面&lt;/strong&gt;（回 &lt;code&gt;server_tool_use&lt;/code&gt; + &lt;code&gt;web_search_tool_result&lt;/code&gt;）——不足以養活一個沒有價格利基的按量 wrapper。復活的方式是拿掉表上的退役標記。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;ocode&lt;/strong&gt; — 已停用。Go plan 對每個模型都回 &lt;code&gt;CreditsError&lt;/code&gt;，但 &lt;code&gt;qwen3.8-flash&lt;/code&gt; 回的是 &lt;code&gt;ModelError: not supported&lt;/code&gt;——後者不是帳務症狀，就算續訂也接不到 flash。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baicode / baiflashcode&lt;/strong&gt; — ModelStudio 的 Claude Code wrapper 全數移除。token plan 的 Anthropic 路徑（&lt;code&gt;/apps/anthropic&lt;/code&gt;）是沒有內建 server tools 的端點，留著等於讓缺口被誤觸，整家改走 Codex 的 &lt;code&gt;compatible-mode&lt;/code&gt;。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baiflashcodex&lt;/strong&gt; — 併入 &lt;code&gt;baicodex&lt;/code&gt;，刪掉不是留 alias——留 alias 會讓舊肌肉記憶繼續指向貴的那一個。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baimaxcodex&lt;/strong&gt; — 仍在，但在觀察名單上。qwen3.8-max 慢、有幻覺，該淘汰；留著只是佔住旗艦位置等 Qwen 下一版。&lt;/li&gt;
&lt;/ul&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;退役機制本身也被改掉了（08-29）。&lt;/strong&gt; 原文說 &lt;code&gt;ocode&lt;/code&gt; 是「把 key 註解掉」——那是錯的形狀，而且當天就被推翻：&lt;code&gt;~/.secrets&lt;/code&gt; 是&lt;strong&gt;每台機器各自的&lt;/strong&gt;，所以同一個退役在一台讀 &lt;code&gt;inactive&lt;/code&gt;、在另一台讀 &lt;code&gt;active&lt;/code&gt;。改成在表上標 &lt;code&gt;retired = true&lt;/code&gt;（軟刪除）+ 每列一份帶日期的 &lt;code&gt;events&lt;/code&gt;。&lt;strong&gt;退役是資料，不是註解掉的環境變數。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  能力：廠商自評
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;—&lt;/code&gt; 表示該廠商沒公布，不是零分。&lt;code&gt;*&lt;/code&gt; 標該列最高。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;能力對照（廠商自評，非獨立複現）

Terminal Bench 2.1    GLM  84.3*  DeepSeek 82.7  Vision-Exp 83.9  Muse 82.9△  Dots 75.1  Qwen —
DeepSWE v1.1          GLM  63.4*  Qwen 58.7  DeepSeek 54.4
NL2Repo               Vision-Exp 57.7*  GLM 56.3  DeepSeek 54.2  Qwen 48.1
Toolathlon Verified   GLM  78.4*  Qwen 73.5  DeepSeek 70.3
Agents' Last Exam     GLM  26.3*  DeepSeek 25.2  Qwen 24.3
SWE-bench Pro         Qwen 62.5*  DeepSeek 56.0 (*Qwen重測)
AA Index              GLM 57*  Muse 57*  Dots 55.9‡  DeepSeek 52
速度                  DeepSeek 120 t/s*  Vision-Exp 85  Qwen 51  GLM 50
TTFT                  Vision-Exp 0.90s*  DeepSeek 1.05s  GLM 1.47s  Qwen 3.42s
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Benchmark&lt;/th&gt;
&lt;th&gt;GLM-5.3 Flash&lt;/th&gt;
&lt;th&gt;Qwen3.8 Flash&lt;/th&gt;
&lt;th&gt;DeepSeek 0731&lt;/th&gt;
&lt;th&gt;DeepSeek Vision-Exp&lt;/th&gt;
&lt;th&gt;Muse 1.2&lt;/th&gt;
&lt;th&gt;Dots3 Note&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Terminal Bench 2.1&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;84.3&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;82.7&lt;/td&gt;
&lt;td&gt;83.9&lt;/td&gt;
&lt;td&gt;82.9 △&lt;/td&gt;
&lt;td&gt;75.1&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSWE v1.1&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;63.4&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;58.7&lt;/td&gt;
&lt;td&gt;54.4&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;NL2Repo&lt;/td&gt;
&lt;td&gt;56.3&lt;/td&gt;
&lt;td&gt;48.1&lt;/td&gt;
&lt;td&gt;54.2&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57.7&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Toolathlon Verified&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;78.4&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;73.5&lt;/td&gt;
&lt;td&gt;70.3&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Agents' Last Exam&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;26.3&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;24.3&lt;/td&gt;
&lt;td&gt;25.2&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SWE-bench Pro&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;62.5&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;56.0 *&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SWE-bench Verified&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;78.4&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;AA Intelligence Index&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;52&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;55.9 ‡&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;輸出速度&lt;/td&gt;
&lt;td&gt;50 t/s&lt;/td&gt;
&lt;td&gt;51 t/s&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;120 t/s&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;85 t/s&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;首字延遲 TTFT&lt;/td&gt;
&lt;td&gt;1.47s&lt;/td&gt;
&lt;td&gt;3.42s&lt;/td&gt;
&lt;td&gt;1.05s&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;0.90s&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;這些數字不能直接比：&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;△ Muse 的 82.9 跑在 Meta 自家的 Muse Code agent 裡，模型跟 harness 共同訓練；我們的 &lt;code&gt;musecode&lt;/code&gt; 是 Claude Code。&lt;/li&gt;
&lt;li&gt;* SWE-bench Pro 56.0 是 Qwen 自己重測 DeepSeek 的結果，來源不同。&lt;/li&gt;
&lt;li&gt;‡ Dots3 的 55.9 來自 ModelCap 指數，不是 AA 指數。&lt;/li&gt;
&lt;li&gt;Qwen 的空格：Terminal Bench 2.1 至今無公開數字；同代 Max 86.6、27B 73.0，Flash 夾中間是推測所以留空。&lt;/li&gt;
&lt;/ul&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;原文一處把數字掛錯了模型（本次修訂）：&lt;/strong&gt; 舊版的結論表寫「&lt;code&gt;deepcode&lt;/code&gt; … 輸出 120 t/s 全場最快」，但 &lt;strong&gt;120 t/s 是 DeepSeek 0731 那一列&lt;/strong&gt;（&lt;code&gt;baideepcodex&lt;/code&gt; 跑的 id），而 &lt;code&gt;deepcode&lt;/code&gt; 指的是 Vision-Exp，同一張表上是 &lt;strong&gt;85 t/s&lt;/strong&gt;。Vision-Exp 真正拿第一的是&lt;strong&gt;首字延遲 0.90s&lt;/strong&gt;。「要快」的論據應該是 TTFT，不是吞吐——這個錯誤在同一篇文章的兩張表之間就能對出來。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  牌價看不出來的成本
&lt;/h2&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;┌─────────────┬──────────────────────────────────────────────────────────┐
│ plugin hook │ Stop hook 借用 ANTHROPIC_BASE_URL，跑它自己寫死的模型     │
│  ← 新增      │ 41 sessions / 578 responses，wrapper transcript 看不到    │
├─────────────┼──────────────────────────────────────────────────────────┤
│ musecode    │ Thinking 爆量：say ok 輸入 9 → 輸出 165（154 thinking）  │
│             │ 實付 $0.20/M 在瑣碎工作上行為像 ~$1/M                     │
│             │ Contributor 層拿資料換價格（貴 19 倍才不訓練）           │
├─────────────┼──────────────────────────────────────────────────────────┤
│ dotscode    │ 上游 AtlasCloud content_filter 偶發切斷，無第二家可繞    │
│             │ 免費到 2026-09-30，到期 400                              │
├─────────────┼──────────────────────────────────────────────────────────┤
│ opzcode     │ 12 家只有 3 家給促銷價，不釘 :floor 加權 $0.068          │
│             │ :zzzz 200 照常計費分不出來，只有 @provider 才 400        │
│             │ 2026-09-09 後 :floor 從省錢變風險（262k context 陷阱）  │
├─────────────┼──────────────────────────────────────────────────────────┤
│ 三家權限    │ musecode/dotscode/opzcode 皆 skip_permissions=true       │
│             │ 省錢但整套權限系統關掉（分類器拿不到 claude-opus-5）     │
└─────────────┴──────────────────────────────────────────────────────────┘
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;&lt;strong&gt;plugin hook 會借用你的 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt;——而且不會沿用你釘的模型。&lt;/strong&gt;（2026-08-29 新增，是本節最隱形的一種。）&lt;code&gt;security-guidance&lt;/code&gt; 這個 plugin 的 &lt;strong&gt;Stop hook&lt;/strong&gt; 會在每次停止時把 git diff 送去做安全審查，走的是 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt;，但模型是它自己&lt;strong&gt;寫死的 &lt;code&gt;claude-opus-4-7&lt;/code&gt;&lt;/strong&gt;，完全不理會 &lt;code&gt;ANTHROPIC_MODEL&lt;/code&gt;。每次審查都是一個&lt;strong&gt;獨立 session&lt;/strong&gt;，在 wrapper 自己的對話記錄裡看不到任何痕跡——它是從&lt;strong&gt;帳單&lt;/strong&gt;上冒出來的：DeepSeek 帳上 41 個來路不明的 session、578 則回應；同一個 hook 在 &lt;code&gt;zcode&lt;/code&gt; 底下跑 glm-4.7，在 OpenRouter 底下跑的是&lt;strong&gt;真的要付錢的 &lt;code&gt;anthropic/claude-opus-4.7&lt;/code&gt;&lt;/strong&gt;。已於 08-29 停用。&lt;/p&gt;

&lt;p&gt;啟用任何帶 hook 的 plugin 之前，先問它會往 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt; 送什麼。注意設一個 &lt;code&gt;SECURITY_REVIEW_MODEL&lt;/code&gt; 只會換掉&lt;strong&gt;是哪個第三方模型&lt;/strong&gt;在回答，不會改變「有一個模型在回答」這件事。&lt;/p&gt;

&lt;p&gt;&lt;em&gt;這不影響本文的費率數字&lt;/em&gt;：OpenRouter 的實付費率是由&lt;strong&gt;每一則回應自己的 &lt;code&gt;cost_details&lt;/code&gt;&lt;/strong&gt; 反推的，是 per-response 的量測，不是帳單總額，所以多出來的 hook session 不會混進去。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;musecode — Thinking 爆量，且拿資料換價格。&lt;/strong&gt; 實測一句 &lt;code&gt;say ok&lt;/code&gt;：輸入 9 token，輸出 165，其中 154 是 thinking，且回的是 &lt;code&gt;redacted_thinking&lt;/code&gt; 看不到內容。token plan 同題只花 25/34/32。照此比例 $0.20/M 的 output 在瑣碎工作上行為像 ~$1/M。Contributor 層會拿輸入與輸出訓練 Meta 模型，標準層才有不訓練承諾但貴 19 倍。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;dotscode — 上游有輸出過濾器。&lt;/strong&gt; 正常技術對話被 &lt;code&gt;finish_reason: content_filter&lt;/code&gt; 切斷；OpenRouter 審核未介入（&lt;code&gt;moderation_latency: null&lt;/code&gt;），是唯一 provider AtlasCloud 做的，沒有第二家可繞。以同樣文字重測三次全過，偶發非必現。Free preview 到 2026-09-30，屆時以「未知 id」400。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;opzcode — 三個陷阱：&lt;/strong&gt; 1) 牌價不是實付價，12 家 endpoint 只有 3 家給促銷價（Z.AI、Novita、GMICloud），8 家兩倍，Venice +25%，預設路由不會偏好便宜的——不釘 &lt;code&gt;:floor&lt;/code&gt; 實測 $0.068；2) 打錯後綴不會報錯只會多付錢，&lt;code&gt;:zzzz&lt;/code&gt; 回 200 照常計費，&lt;code&gt;model&lt;/code&gt; 欄位分不出來，只有 &lt;code&gt;@provider&lt;/code&gt; 才 400；3) 2026-09-09 後 &lt;code&gt;:floor&lt;/code&gt; 會從省錢變風險——它是照價格排序，到期後便宜格會混進 context 只有 262k 的 provider，而此列宣告 1M，宣告過高不會在啟動時報錯，會讓對話在工作中途被拒。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;三家都關了權限：&lt;/strong&gt; &lt;code&gt;musecode&lt;/code&gt;、&lt;code&gt;dotscode&lt;/code&gt;、&lt;code&gt;opzcode&lt;/code&gt; 皆 &lt;code&gt;skip_permissions = true&lt;/code&gt;——整個權限系統關掉。原因是 auto mode 分類器會去解析第一方的 &lt;code&gt;claude-opus-5&lt;/code&gt;，在這些端點上拿不到，每個受管制呼叫都會死。（注意 &lt;code&gt;zcode&lt;/code&gt; 與 &lt;code&gt;baicodex&lt;/code&gt; &lt;strong&gt;不在&lt;/strong&gt;這份名單上——排前面的兩個門沒有付這個代價。）&lt;/p&gt;




&lt;h2&gt;
  
  
  修訂記錄
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;2026-08-29&lt;/strong&gt; — 發表隔天的四類改動：&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;順位改了。&lt;/strong&gt; GLM 轉為 BigModel Coding Plan Pro 訂閱制，同一個 GLM-5.3-Flash 走第一方 &lt;code&gt;zcode&lt;/code&gt; 是邊際 $0，因此排到日常主力；原本的「按量最佳 &lt;code&gt;opzcode&lt;/code&gt;」降級為「沒有訂閱時的按量最佳」。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;deepcode&lt;/code&gt; 退役&lt;/strong&gt;，「要 WebSearch 或要快」那一格因此沒有活路徑；同時修正退役機制的描述（表上軟刪除，不是註解掉 key）。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;補進兩個完全免費的 GLM 門&lt;/strong&gt; &lt;code&gt;z47code&lt;/code&gt; / &lt;code&gt;z46vcode&lt;/code&gt;，以及 &lt;code&gt;baicodex&lt;/code&gt; 漏掉的 plan 到期日 2026-10-23。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;修掉一個原文內部矛盾&lt;/strong&gt;：120 t/s 被掛到 &lt;code&gt;deepcode&lt;/code&gt; 上，但那是 DeepSeek 0731 的數字，Vision-Exp 是 85 t/s（見能力表後的說明）。另外新增「plugin hook 借用 base_url」這一項隱形成本。&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;能力數字全為廠商自評，本次未變動。agentic 四軸（DeepSWE / NL2Repo / Toolathlon / Agents' Last Exam）取自 r/LocalLLM 使用者彙整對照表，已與各廠商公布值交叉核對；Terminal Bench 2.1 的 84.3 與 82.7 為獨立查證吻合。成本與模型回應為 2026-08-27 實測；OpenRouter 實際落點費率由每次回應自己的 &lt;code&gt;cost_details&lt;/code&gt; 反推，非牌價。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>productivity</category>
      <category>devtools</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-21 to 2026-08-28 | Silicon moves on both sides, and Claude gets a browser</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 27 Aug 2026 23:05:40 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-21-to-2026-08-28-china-ships-chip-only-frontier-models-claude-gets-a-1jfc</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-21-to-2026-08-28-china-ships-chip-only-frontier-models-claude-gets-a-1jfc</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Z.ai's share price moved 8% after it released a model that runs only on Chinese chips&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;, and the same company — Zhipu, which operates as Z.ai — put out GLM-5.3-Flash with the explicit claim that the model runs on 100,000 domestically made chips&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;. The deployment substrate is now the news.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  China ships chip-only frontier, not just demos
&lt;/h2&gt;

&lt;p&gt;Zhipu released GLM-5.3-Flash, with the explicit claim that the model runs on 100,000 domestically produced chips&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;. CNBC's reporting on Z.ai's stock move describes a new AI model running only on Chinese chips&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;; Yahoo Finance framed the stealth model Ox Alpha as a DeepSeek rival&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxPNnVLcXB0ZGtkTHVaMC1EYkV2aHE1eHVaLTB5ZGtMZnc5SUw0NmVDT3NkLXhCTEprODJ3QURqcGg0S3hNa0w4MXQ3S0VLMlBKMnlNUlhPbzY1d1h2dlMwelBzeDhQUHg4TDJPYXVhMTBvVXo5WlZ2cHFPdExOcjNhbXZxdHZMOGE5cmc?oc=5" rel="noopener noreferrer"&gt;China’s Z.AI Made Ox Alpha Stealth Model That Rivals DeepSeek - Yahoo Finance&lt;/a&gt;. Zhipu has since confirmed that Ox Alpha &lt;em&gt;is&lt;/em&gt; GLM-5.3-Flash and released the model weights&lt;a href="https://news.google.com/rss/articles/CBMipAFBVV95cUxQUXZ6MmE5azY5LVZoV0xlM21vWFE2czZIMENGV0h1LTNyazRySExMSmxpNklQTE5BWUU4RlBNWVRTTGhCTnFpVlU5TVBxbmx5Q3E5Yk54X0s5OWJsQ09XeFlZSWtVaTJmNE1mejlXRU9MeHlnbXFPTVBPcTVmUU5aYUdqRElWYUx2TjlMc1RlajB0VGw5UFdMTWs2eHhraUZEcjBsWg?oc=5" rel="noopener noreferrer"&gt;Zhipu identifies Ox Alpha as GLM-5.3-Flash and releases model weights - TechNode&lt;/a&gt; — one model, not two. Treat the "100,000 chip" figure as a vendor claim — Global Times headlined it, not an independent benchmark, and a 36 Kr piece the same week flagged why that headline has not translated into dominant global mindshare&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9fS183LXk5ZENZU25Uc2dxWXBaZ1VxYWhhLXJuNTFNaG9jV3lnTUhoeTJVVzZWY3Vib25uTUlUdG1hdGd2NWhqMlFFbWxzTUtuWWhj?oc=5" rel="noopener noreferrer"&gt;Why Didn't the High-Power GLM-5.3 Dominate Global Social Media Feeds? Core Barriers &amp;amp; Hidden Truths Uncovered - 36 Kr&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;What is worth separating: this is not a research artifact. Z.ai's share price moved on the release&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;, which means the company is treating it as a commercial event. The engineering question for buyers is narrower than the geopolitics — if a model is restricted to a specific accelerator, that is a deployment constraint on par with context-window or license restrictions. For most teams outside China this is "announced and available" at best, not "commercially usable" in a general sense, because the silicon constraint is the product.&lt;/p&gt;

&lt;h2&gt;
  
  
  Smaller Qwen, and the Chinese pricing pressure on US clouds
&lt;/h2&gt;

&lt;p&gt;Alibaba released a smaller Qwen variant — Bloomberg frames it as smaller and cost-effective&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxOVFN2VVNaUWE0bXJiNjQ2VWJlbngtWlpzcnY3RG44VlB1eVVhMWNiT21wYmVKSDJnQ0JkNXMycVg5bWRqQ2RIZ3E0d0hzdkEzUlNPV05aUjRUTFhzaXlNdVhVSHFXNGRuZFlPWUhEeEtKemMwdWJValR0MFpZM19OMVRpS1piVVhZWEI3ZmdJZmlDR1B5d2JMRU5DcENuSUktd01Ra0J6Zw?oc=5" rel="noopener noreferrer"&gt;Alibaba Releases Smaller, Cost-Effective Qwen AI Model - Bloomberg.com&lt;/a&gt;, Reuters describes Qwen3.8-Flash as lower training cost&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQNFBiN0MydXZkUlB3UHdHb0xzNGNqVVhKdzZVMkQwalM4WWozbUxWSkZuRTljSXdfdjdOUjZkMWN2SEVRSnBXTEJwSlJfdkNqNzJreVp5MDNULVdDZ1ozSzE1YXp6dWR6MzZsOFBlRllhdlZEQmVBa1Eyb1hpQWlMWmdUaGlzeFpUZFlDZUszLU5KRG9SblF0VTNFT092TllTQnVqVlZHY2J3Uk1WblBfOUJGRmFob041dzEwRV9WaU5TWjlxbkswcTVJRQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen launches Qwen3.8-Flash AI model with lower training costs - Reuters&lt;/a&gt;. The interesting design choice is "smaller" rather than "bigger": the production economics of inference at scale are pushing vendors toward variants you can actually serve on commodity capacity.&lt;/p&gt;

&lt;p&gt;Moonshot's move is the more aggressive end of the same pressure. The Next Web reports Moonshot wants 30% of what US clouds earn from Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMic0FVX3lxTFA0d0pQa2RVQTl3UUVMTHJNZWRYTV9LSHcxX2kwYXlzVzFOVlBVUjd0UG8tcV9yUHlzQTVvUXRpVkV2UlhLSFBFYTFqbmtHX2ZKNnNxWDdRMmN5WnhoVnlNNk8yTFhSaGxDMHpGX0ZHMWdiMlE?oc=5" rel="noopener noreferrer"&gt;Moonshot AI wants 30% of what US clouds earn from Kimi K3 - The Next Web&lt;/a&gt;. That is a revenue-share demand on the hosting layer, not a model-pricing decision. The Times of India coverage adds the political context — the US government previously accused Moonshot of stealing Anthropic tech&lt;a href="https://news.google.com/rss/articles/CBMizgJBVV95cUxPZS1vMTlZVi15emhSeUpMdGFRQV8yNENQUl9aV0hvNDRoQU05VzVfRGJCTW1mOERvS3kzcVFMdzFBbmw4bEM5bE9mLVlHVy1EaUlJeFhSbTNpcU0tTjllUlNiOWVITTlhTElLV3NiRnUxalRIc3BiRWFOenAzc3Vyd3Jxa2JVcmZkNHM4SE5ZMU1Wc2pVNDVZRnlOQ0ZPR3B0NXJXamdDeWxyalJFbngtMWtOcDFTQzdQckZJSnZ5VkVlZkZ1azJPVTJVQnlFLWFua01IUWZ4YjE2VV8xOXVGOTltcDhZWTlRNnRlRDYwM1Q0UkxDLURYbmtKc1VWLThzSDg4dFR3TGJzWHF1R1Y5SDRuYkxUNzM2MXBCMlR4OWRVX3VWdHppRkpuSGZGcll6NmZ1YkQ5OG52UVllS0Q5QW41S1AtMzBNOVZtU21B0gHTAkFVX3lxTE10SjBEUHFESnpWU1V5SXBMWUNKZXBsV283MllFZHloQVFveWxfaUo4UDBvbmNTeHRQSkJxNmFyZXF2VWlGVEdYaGZEby1EMHFJTGJGa2EteURSMURNTnFVYldubW4tQ0pVRUZUME5NZWlmMXdia2Z2c2FYS2FfekFydWtkNklpMTU4VEMyd21Rd0ZPbDVLdGVNZXZjRmg2U0hfd1V5SkRseDd3RnI5cFlSOU5ZV0dNNzMwZndxanQ0dHV6Zld5OE9rNHpSeElhQVdCd1lidG9oRzdSOE1RMTRDaVZSYWxkZzIyRWI0SllHQldGWHlldXRxeFdmc0h0VWtUdlB6b0g4T3o0SEFOZFFjUnFaMl9wOFVfMVhvYXkzakRyRHFNSXJDZ1QzRWNOTm5YT3o2dzZ0aXBQWUZ2VTJ0T0V4ZEdvQXhBUVk4SUV0WmZ6UQ?oc=5" rel="noopener noreferrer"&gt;Kimi K3 AI model maker Moonshot AI, which US government accused of ‘stealing’ Anthropic's tech, may make - The Times of India&lt;/a&gt; — but the engineering read is simpler: if your model is good enough to be a default on a hyperscaler, you have leverage to extract rents from the cloud's gross margin instead of competing on per-token price.&lt;/p&gt;

&lt;p&gt;For a buyer, the practical takeaway is not "Chinese models are cheaper" — it is that inference economics are bifurcating. There is a frontier track where cost is subsidized by ecosystem capture (cloud revenue share, hardware lock-in, agentic platform fees), and a commodity track where you pick whichever small model clears your quality bar at the lowest per-token price.&lt;/p&gt;

&lt;h2&gt;
  
  
  Claude gets a browser, and the "AI as platform" thesis hardens
&lt;/h2&gt;

&lt;p&gt;The New Stack reports Claude now has a browser of its own&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;. This is the most concrete piece of the agentic-platform thesis landing in user space: if the model controls the browser surface, the integration boundary that most current "agent" stacks hit — the DOM-as-API assumption — collapses. The capability that matters is not "Claude can browse"; it is "Claude can hold an authenticated session as a first-class citizen instead of poking at a headless instance from outside."&lt;/p&gt;

&lt;p&gt;The counterweight is the institutional churn. WSJ reports Google moved its AI-responsibility team out of DeepMind in a structural shake-up&lt;a href="https://news.google.com/rss/articles/CBMisAFBVV95cUxOOVhUck1oeDZzYU9nRTZWZTBRSERrb2pNWVk3aTZOMVFuZG5ubjFGbld4QXRLdThLQ1JuS0h0S0Q2ZjdsX1Y0Qm0xQjA3T3hLV014MzVqWTRNWGtjVWlyQ2otd1pIUjBqUjZBM3k5TTVpcnIxSngyTkk1eVNZU2hxcnR0MHJad1J0ZmtSN3dpR2p2N3pSRmNORnNPQzV5VUgxNGM0dE5DaGF5Y0FqUkd3eg?oc=5" rel="noopener noreferrer"&gt;Exclusive | Google Moves AI-Responsibility Team Out of DeepMind Lab in Latest Shake-Up - WSJ&lt;/a&gt;, and Fortune's data shows DeepMind losing grip on elite AI talent&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxObS1iQWJMUFcyT0FoTjdGcXB6VFFJTjEyYnd4OVlTalVieFFQcC1veTdKX0tmc2Q3bWtCTmNraGhvZVJyeFlENlBFLUUwWTRGd2lQTU96X3Z1dzBDb05tVTZHdV95eDVfRTVYdjV6MG1SZ1kzczJPbnpreENwdHpJRTBBRnhWQzByYmhGRlNqUzF4cm1oRHpJOE5TSzRZeWZoTmpz?oc=5" rel="noopener noreferrer"&gt;Google DeepMind is losing its grip on elite AI talent, new data shows - Fortune&lt;/a&gt;. Two adjacent facts from the same week — Claude shipping an agentic browser and the lab that defined the modern agent research agenda losing people — are worth holding together.&lt;/p&gt;

&lt;p&gt;Salesforce and Anthropic announced Claudeforce — CNBC frames it as Benioff responding to "SaaSpocalypse" concerns&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxNeDU0UHo4UERDMHZlcjVyV1I4S0dWWEQ1SGhYOXFURmJmZUJiZHpud1pGVXRKQmx1ZXl6Sy01NjBkTlkyQXFRWEJfeTVkYXVHODNvZ0p3YTVudnVSNEN4WTJQLWpad0JJa09WZ1Roay1JZ3JUZDlNdFJNRGNZYzMyNHd1TmRzTVJQ0gGOAUFVX3lxTE5oWUF2YXIzVjUzOE5zUzVNT05nemItSm9rdm1OMmRvQWFPc05NRWVteG5mNnM3dmtzSHZOYlowYTNFTnNFT0M0UmY3ZTRhN1FGTUV1U1NKcnZhcUp0LUpVU2dMa1ZCazZvSUFWNTNBNWhzNlUtekUwR1J1a2UtZ25wT3JaVzUzZGFWV1BpX1E?oc=5" rel="noopener noreferrer"&gt;Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concerns - CNBC&lt;/a&gt;, and Salesforce's own release markets it as the #1 AI meeting the #1 AI CRM&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;. The honest read: this is a vendor announcement, not yet a shipped capability surface, and "agentic CRM" as a category is still mostly demos over real customer workflows. Worth watching for the integration story (where Claude lives in the Salesforce admin model, what data flows without a human-in-the-loop), not the press conference.&lt;/p&gt;

&lt;h2&gt;
  
  
  Speech-to-text gets opinionated, and Google's vertical push continues
&lt;/h2&gt;

&lt;p&gt;Google announced Gemini 3.5 Transcribe&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPSGx5ZU85MkhfYTUweHk3X2NteExrRTRxRUlGOTZ5QVVIalBjcDlVSGhKRkJzV1BuMG5RSm9ZXzhqYlNBMU1HYW9TS0JpZ1F6dGV2a3EyRC1qTk50Z0dxWDJ0MzBZQ1g4OXEzbThidVcxUFRHeWhvLXBUcC1yUUx6ZG9GOFZpVGdxN2h5YmtBTDVFd1ZyY1NSdUV2TDc5cmpZdnctREN1Yw?oc=5" rel="noopener noreferrer"&gt;Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text - Ars Technica&lt;/a&gt;; The Verge adds the design detail that it edits out "ums" and "ahs"&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9vLXhKVjRXQnEtLXZyWGZGbkU1OEF3RU55dUJlYjVGbVZMQkJJblVrX2hINVNudjhXNHQ4dzNNS1o2T0d3S2xGMmFKMDJpejhmQ3ZubldHSXBPTUNQYkRtUEJLeVpYTkNzcmRrTS0zV2d3eVowNG8zTVNjb0hxMFE?oc=5" rel="noopener noreferrer"&gt;Google’s new AI transcription edits out your ‘ums’ and ‘ahs’ - The Verge&lt;/a&gt;. Apple shipped this kind of cleanup years ago in Voice Memos and Messages; Otter and Krisp have done it for meetings. The question is whether Google's transcription now meets that bar in latency and accuracy, because the underlying Whisper-class models have been "good enough" for a while and the differentiator has become cleanup heuristics and per-language coverage, not raw WER.&lt;/p&gt;

&lt;p&gt;Reuters separately reports Google expanding Gemini Enterprise for law firms&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPZk81aGh3d2lJX0FucWpwclltdnRJd3RqNVpTWnhMeGNBU3FUeWRIby1lcEpQQ3NOT1VaWjRlU19vT1lmVzdMTEpjbm16eTh4MTdvbGRtN1ZQb243eVZ2aF9Sd19PMEtzd2ZpbGV2R0p5SzZRTGJLNkE4TGNZUmtxVnlvVGx1NlVYQkIwMmEwRnV6RGxEQ1BvTGIzNGE?oc=5" rel="noopener noreferrer"&gt;Google expands Gemini Enterprise AI platform for law firms, lawyers - Reuters&lt;/a&gt;. This is the same vertical-integration playbook as Microsoft Copilot for clinical notes or Palantir for defense: pick a regulated industry with high willingness to pay and resell the same model inside a workflow-shaped product. The capability is not new; the procurement channel is.&lt;/p&gt;

&lt;h2&gt;
  
  
  Voice from the outside: Bill Gates on AI risk
&lt;/h2&gt;

&lt;p&gt;Gates warned that AI could drive mass unemployment and cyberattacks&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE9wYm5vZ1JCeVVwQUpRMGJ1NjZhR3hVZ01FWGFuelVJOV80UG91QnFJaTRRSTd4amFlTnBWS1NNdDM4RE42NzZuUlpoMTYxUk9sYkdLTTIxTGNsSzNxeHF1VkdBR1pqc2pCQmNmNDZfNA?oc=5" rel="noopener noreferrer"&gt;Bill Gates warns AI could lead to mass unemployment, cyberattacks - Politico&lt;/a&gt;, and Fortune expanded the list to three risks — stunted child development, emboldened criminals, and vanishing Gen Z jobs&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxOak5GWWx5dS1VdEFKWF9NRzNuRjlMZGdqU3BSLVg4OUFWb2w4WFJTZEdUS2ZFbTRwU1ROc1JCLXlBejdMYkNsT1djNGFvc1B1VTBvZF92T0gtVkVhZnJFN3BpeEpnRU1yVmtXN2k3Y2IxUktQT05JTmRXbVR6QWhmRkRkRVlxaXpQ?oc=5" rel="noopener noreferrer"&gt;Bill Gates fears world leaders are unprepared for 3 major AI risks: 'Stunted' child development, emboldened criminals, and vanishing jobs for Gen Z - Fortune&lt;/a&gt;. Worth taking seriously as policy signal, less so as a technical input — these are governance predictions from someone with political weight, not deployment guidance. The engineering takeaway from this week's actual shipped work is the opposite of "mass displacement imminent": most of the items above are vendor announcements, not capability shocks.&lt;/p&gt;

&lt;h2&gt;
  
  
  The other silicon story: OpenAI's own inference chip
&lt;/h2&gt;

&lt;p&gt;The same week, the US side moved on silicon too, in the opposite direction. China's play is routing around Nvidia; OpenAI's is taking its own inference cost back from Nvidia. OpenAI published first results for Jalapeño, its in-house inference chip, claiming industry-leading speed and efficiency on AI inference&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTFBwMGNpOVlmLU9XdHlqemwwb2ZIRmRab3cyUTJnZ0x4UGVtWWZkMzYwb0thVlY5QVhSYXVaQ0xCRllRQUFuVE9FVUtac3FxUFM3T0Nfc0ItUTAzOVRP?oc=5" rel="noopener noreferrer"&gt;Jalapeño’s first results show industry-leading speed and efficiency in AI inference - OpenAI&lt;/a&gt;. SemiAnalysis headlined its read "Better Than Nvidia Blackwell"&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE0wUWNzQzNua3BlcVlyRkQ3cVAza2pXdjNZLWZVVWFyakZqWmhXVnlYYXFvbzA5d2VmNVpyeTdlY29SSEFJZ3VQWVl1YmtGcERjS01MR1ljM1ZiN3d0UWFhVDNsQUZLUmIyaUNlT1Vya3N6SV8wZjRrMzhLR2c?oc=5" rel="noopener noreferrer"&gt;OpenAI Jalapeño: Better Than Nvidia Blackwell - SemiAnalysis&lt;/a&gt;; CNBC's angle is the pressure on Nvidia's margins as custom silicon gains ground&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5VdHlNWkdYQUJBdVV5c1luMDFlQVYyZnNzRFV3X3kweGY0ZG5IMVpfTE5Qd2JIdkMyaDZOOUJHZm0xU2FUcGdDT3Fzd0lITzd3NjRSbTJGYWNXWnVLV08yXzRUNUtSVGI0WFBlMHZMUk9FNFZCOXfSAXtBVV95cUxPREVoZVc1MjZnZzRDZ1diQ19ET2RQRURoYWtNUmNUUE1sSkgwZWJWZFl5M09MeHgyZjVYVTM2ZmdPdnV2NlgzdmJ3U2MzN09GYmQ0aUxtbFFGS0NvanpNbVY2NmxuV1R1ZnM0ZnZLS2dUUXR3XzF0amphbUU?oc=5" rel="noopener noreferrer"&gt;OpenAI’s Jalapeño AI chip brings new 'threat' to Nvidia margins as custom silicon gains ground - CNBC&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Separate the layers, as always. This is an &lt;strong&gt;inference&lt;/strong&gt; chip, not a training chip, and "industry-leading" is so far the vendor's own measurement — SemiAnalysis is analysis, not an independent benchmark, so the third-party verification layer is not there yet. Two things are worth writing down now. First, if the largest inference buyer decouples its unit cost from Nvidia's pricing, that shows up in API prices before it shows up in a press release. Second, CUDA's default position on the inference side now has a serious in-house challenger from a major vendor for the first time. Training is unaffected in the short term.&lt;/p&gt;

&lt;h2&gt;
  
  
  What does not change
&lt;/h2&gt;

&lt;p&gt;The week does not move the needle on evaluation rigor, on inference-cost transparency, or on the agent-safety story. The GLM-5.3-Flash headlines tell us about deployment substrate, not about whether the model is durable across real workloads&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxPNnVLcXB0ZGtkTHVaMC1EYkV2aHE1eHVaLTB5ZGtMZnc5SUw0NmVDT3NkLXhCTEprODJ3QURqcGg0S3hNa0w4MXQ3S0VLMlBKMnlNUlhPbzY1d1h2dlMwelBzeDhQUHg4TDJPYXVhMTBvVXo5WlZ2cHFPdExOcjNhbXZxdHZMOGE5cmc?oc=5" rel="noopener noreferrer"&gt;China’s Z.AI Made Ox Alpha Stealth Model That Rivals DeepSeek - Yahoo Finance&lt;/a&gt;. The Claude browser is interesting but its reliability at scale — long-horizon auth, error recovery, latency under load — is unmeasured&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;. The Claudeforce CRM is announced, not yet a workflow anyone has stress-tested&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxNeDU0UHo4UERDMHZlcjVyV1I4S0dWWEQ1SGhYOXFURmJmZUJiZHpud1pGVXRKQmx1ZXl6Sy01NjBkTlkyQXFRWEJfeTVkYXVHODNvZ0p3YTVudnVSNEN4WTJQLWpad0JJa09WZ1Roay1JZ3JUZDlNdFJNRGNZYzMyNHd1TmRzTVJQ0gGOAUFVX3lxTE5oWUF2YXIzVjUzOE5zUzVNT05nemItSm9rdm1OMmRvQWFPc05NRWVteG5mNnM3dmtzSHZOYlowYTNFTnNFT0M0UmY3ZTRhN1FGTUV1U1NKcnZhcUp0LUpVU2dMa1ZCazZvSUFWNTNBNWhzNlUtekUwR1J1a2UtZ25wT3JaVzUzZGFWV1BpX1E?oc=5" rel="noopener noreferrer"&gt;Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concerns - CNBC&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;If you are deciding what to integrate this week: the chip-constrained Chinese models are mostly relevant for teams already inside that supply chain, the smaller Qwen variant is relevant for cost-sensitive commodity inference, and Claude-in-browser is worth a controlled pilot but not yet a procurement decision.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
  </channel>
</rss>
