<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: Yang Goufang</title>
    <description>The latest articles on DEV Community by Yang Goufang (@yang_goufang_23c7ba674984).</description>
    <link>https://dev.to/yang_goufang_23c7ba674984</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F3808809%2Fddc4c93b-6669-4563-b8f5-ba711077aed3.jpg</url>
      <title>DEV Community: Yang Goufang</title>
      <link>https://dev.to/yang_goufang_23c7ba674984</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/yang_goufang_23c7ba674984"/>
    <language>en</language>
    <item>
      <title>AI Weekly — 2026-09-04 to 2026-09-11 | Open-weight races collide with closed-frontier launches</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 10 Sep 2026 23:16:24 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-04-to-2026-09-11-open-weight-races-collide-with-closed-frontier-launches-2fle</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-09-04-to-2026-09-11-open-weight-races-collide-with-closed-frontier-launches-2fle</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Two frontier tiers moved in opposite directions this week: open-weight releases pushed parameter counts and context windows into territory that closed labs dominated until recently, while OpenAI's GPT-6 announcement and a fourth Anthropic security disclosure reminded buyers that the closed labs still own the integration cost and the threat surface that comes with it.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Open-weight models cross into frontier-tier territory
&lt;/h2&gt;

&lt;p&gt;DeepSeek released V4.1 Flash with a 1M context window and an FP4 KV cache, and the launch coverage names cross-layer attention reuse as an efficiency lever&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;. A second report frames the release as benchmarks, pricing, and a Pro-tier retirement&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt; — meaning capability, cost, and product lineup shifted in one move. The 1M context and the FP4 cache are engineering claims from the vendor; they are not equivalent to a 1M-context window running in production at your preferred latency.&lt;/p&gt;

&lt;p&gt;Alibaba shipped a Qwen-Max-class MoE at 2.4T parameters with open weights&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;. A coding leaderboard ranking has the model overtaking Claude Opus 5&lt;a href="https://news.google.com/rss/articles/CBMioAFBVV95cUxNWmZWbmdpcFVLSXpUOHVZeGNyLUJlZEp1MlUyX0VLWmpRN1plc2lUcnQ3TFZZdG5xMzVnUEtDbXFIbnpIdEVRbkEyNGpiVWVsWm4tcThob2hNNGxMcEd2djVZVm5jU0IxV3FUUnlfR2VUVXd3MFlQOGV1Qm9aSFIxSE1FNHN1Rl9pS1pfaFkyRk00Ry1Nc0xnanhVb2tWXzdq?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen3.8-Max Model Overtakes Claude Opus 5 on Coding Leaderboard - Startup Fortune&lt;/a&gt; — a leaderboard claim worth reading carefully: the comparison is against a closed lab's product via a third-party board, with no mention of the latency, context, or tool-use conditions under which the rank holds.&lt;/p&gt;

&lt;p&gt;For an engineering team, the operational question is whether either of these weights actually slots into an existing serving stack. Open weights tend to win on data egress, fine-tuning, and unit cost at scale; they give some of that back in the support burden of running them. V4.1 Flash's FP4 KV cache is a memory-bandwidth lever worth measuring on your own traces before trusting any throughput number the launch quoted.&lt;/p&gt;

&lt;h2&gt;
  
  
  Closed frontier: GPT-6 Astra lands the same week
&lt;/h2&gt;

&lt;p&gt;OpenAI's own announcement page describes GPT-6 Astra as a "new generation of intelligence"&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;, and a second OpenAI page frames the same launch around "work" use cases&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;. Vendor language on a launch page is not a benchmark, not a pricing card, and not a deployment guarantee. The line between "announced", "available", and "commercially usable" matters more here than usual: a flagship launch the same week as two open-weight drops tells buyers the closed frontier is racing to stay ahead, but tells integrators nothing about API stability, rate limits, or whether existing fine-tunes survive.&lt;/p&gt;

&lt;p&gt;For teams already on OpenAI, the practical move is to freeze new GPT-6 Astra commitments until pricing, latency, and tool-calling behavior on real workloads are measured — not until the launch page settles.&lt;/p&gt;

&lt;h2&gt;
  
  
  Security disclosures: the fourth Claude hacking incident
&lt;/h2&gt;

&lt;p&gt;Anthropic disclosed a fourth AI hacking incident involving an early version of Claude&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;. A second outlet carried the same disclosure, so the report does not rest on a single source. The pattern matters: a fourth disclosed incident suggests the threat model for agentic Claude deployments is hardening — exfiltration paths and prompt-injection chains are real engineering risks, not edge cases. Any production integration plan that did not previously budget for adversarial-prompt review now has to.&lt;/p&gt;

&lt;p&gt;Separately, Anthropic said it blocked possible efforts to build biological weapons&lt;a href="https://news.google.com/rss/articles/CBMiiwFBVV95cUxOb3RxODh4LWhOS0o0UFBGNUhHODA0Z2dqbTcyTlFmYVRwRzJVVnhKMFl4U2dqQUQwZXV6d0c1c0gwRHZXeF9wOFRTN2xCengtRnRuR0tJLUNDTlI3VjAyekRzRngwMWY4M01hSUVwWURFUFAxdkRjRC1HZUM3cG9YTnZ4UVFNcVlnT200?oc=5" rel="noopener noreferrer"&gt;Anthropic Says It Blocked Possible Efforts to Build Biological Weapons - The New York Times&lt;/a&gt;. This is a different category of risk — capability misuse rather than adversarial inputs — and the same threat-model habit of treating model outputs as untrusted content applies.&lt;/p&gt;

&lt;h2&gt;
  
  
  Hardware: Qualcomm–Amazon deal narrows Nvidia's window
&lt;/h2&gt;

&lt;p&gt;Qualcomm struck an AI chip deal with Amazon that includes stock rights worth roughly $4 billion&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;. A market commentary frames the same deal as putting Nvidia's lead at risk&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTFAwQVB0cnlUVVMxeVJad0FBbFlINDRJa25vLUtzcTZSaWFjRUNHMHRIbWxJS0dVWFRoU1duWmNUZkZac2g5aUtURGNMMVNRS2Q3N1RadERqbmRzTWg2NUtuUkdkUU1IN01xMVJwMExvVQ?oc=5" rel="noopener noreferrer"&gt;Qualcomm's Massive AI Chip Deal With Amazon Puts Nvidia's Lead at Risk - MarketWise&lt;/a&gt;. A separate piece questions Nvidia's AI chip economics after Jensen Huang said Nvidia chips are "highly rentable"&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxOWFY0YmdVM2hQNjAxQVJGSkdrNTRTZUl0VEJFUmJKaGNXUXl6Ykp2YTYtdi1pd00tQzlWeEhabENVNVJ0MDc2ckRzVWNMTTRrS0FpTzV2NG9rOF9IZGhSVC1fdlk0dFFYVnUtY3dFYnNiNDBaTGdjNjJkbEd3NGh4ZF8xNjd6WU1iOTlIR1VHeC1KMElSMUdWaVZOSGlqeENpRWFMMEs5SDdoUnZweFd5MDBUX2JxNktkTGNCWVlLZWhnVm8xTDFXLVY4MW9va3R2LTNadnZ3MUdfLTJsYVdRN09GYWIwYzVEOFNkOXVLdjc5SmpuU3NwSnNNVnY?oc=5" rel="noopener noreferrer"&gt;Jim Chanos Questions Nvidia’s AI Chip Economics After Jensen Huang Says Nvidia Chips Are 'Highly Rentable' - Stocktwits&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The deal is real. The "risk to Nvidia" framing is editorial inference dressed as analysis — neither headline distinguishes training from inference. Independent benchmarking is rare in this space, so the safe read is: another credible alternative now exists, which gives procurement teams a real lever in 2027 contract talks. Volume production versus a stock-purchase sweetener is a separate question that neither source resolves.&lt;/p&gt;

&lt;p&gt;In parallel, a deep dive into NVIDIA's six Hot Chips 2026 presentations walks through the "one GPU to AI factory" arc&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxOMGlqcW5qZEZ0b09EOWk5VGdDQmUzTElMVGlnTTRXOW1tVnBSazFuMV9NOUF1UE5qMVBYWFVFSDBRYnI0LW1XSG9UQlVGcWZNSzNyVVVWcmc5U1I1a3BlU1lFczZIUGp2ZXEzVHVITGN0R2RjX3IwdEVYOVVOUTdnNg?oc=5" rel="noopener noreferrer"&gt;From One GPU to an AI Factory: Deep Dive into NVIDIA’s Six Hot Chips 2026 Presentations - semivision&lt;/a&gt;. Worth reading for anyone planning capacity — the deep dive is a clear map of where Nvidia's per-GPU pitch is heading.&lt;/p&gt;

&lt;h2&gt;
  
  
  The IP backdrop most of this sits on
&lt;/h2&gt;

&lt;p&gt;Two outlets cover the same story from different angles: U.S. agencies have said Moonshot's Kimi was trained on American models, and the reporting frames Kimi K3 as a distillation of an Anthropic model named in the headline as "Fable"&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPRXVMaFFqb3JjYURMcTNkMmFvUGItUVRYaWFxaWw3Q3NzczBpS1pidTNFa05lbjJyOW5oWW9acUxWN2FMcW9rNVI0YkthVW9NTC1pR3k1MGRLQ3o1ektnaHkxM3E4RDlYdnQ1emd5QjB0VU9rcXlSc3UxbjdacXpVdzdVNVM2V25YQ2tUbmRNZmdiNUhTai1jaG5SSGY?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Distilled Anthropic's Fable For Kimi K3, White House Says - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiWEFVX3lxTE44YlRZcUp1SXdqMUJEc0NZLVBsMmhVblpMSzhaRGpiM3FmNXVnZWw4SWtFTzhjZ3NjTk9Sc0ppdzlyWUtIaTI4RHJMeUVWM0tFUE01WGdraU8?oc=5" rel="noopener noreferrer"&gt;Moonshot’s Kimi rattled markets. U.S. agencies now say it was trained on American models - Cryptonews.net&lt;/a&gt;. A WSJ feature covers the broader pattern of Chinese AI firms cloning U.S. models&lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxPeGswOXZNYVNvdzV2SzRHVC1aM0lGM01aNHVnMlRRQWVZYkFhTGh0dzE4UkRER042RU5kQnVmUVY3X282ZmgzYUtJYU5uSnhyZTV1eWlsaDdKcHBjQ28tQnQzd09XUm9KczY4SFB1c1hEZ2xfS203RExlZDU5OUZRcHZ4YUNUdG5JbzByNFlqWi10ZVlXcmxVNExXODR6dEp4X1FjbERSckRRQ0ZNcVhiMGxR?oc=5" rel="noopener noreferrer"&gt;How Chinese AI Firms Tried to Clone U.S. AI Models - WSJ&lt;/a&gt;. One headline says "distilled" — a specific technical relation, knowledge distillation from a teacher model's outputs — while other coverage uses the looser "trained on".&lt;/p&gt;

&lt;p&gt;The takeaway for procurement is that buyers on closed APIs and those on open weights face different risk curves if open-weight drops from Chinese labs are gated behind contested IP claims in the U.S. — that chain is inference on our part; none of the cited sources makes it outright.&lt;/p&gt;

&lt;h2&gt;
  
  
  Other surfaces
&lt;/h2&gt;

&lt;p&gt;Google shipped a Gemini app for Windows PCs&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;, with a consumer-tech outlet describing the desktop client launch&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;. For a desktop app the integration story is the OS shell hooks, the keyboard/voice ergonomics, and whether the local model cache beats the latency of a round-tripped API — none of which the launch headlines answer.&lt;/p&gt;

&lt;p&gt;Alibaba's Qwen team also released an open-source model aimed at autonomous driving&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE16UHpfYXBMLXl0eDFCVm5pSUtTa2c0ZGFZQnpPeTUxTTFQMS15dXhkUUFEV25YN2ZsWXBaM1o0aGo1dF95T0gtR3h3R3gtektUT0d0OUZJcUtIMTZKc2hoN3EwajJZOG5Oa2swU1NTYw?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen releases open-source model for autonomous driving - TechNode&lt;/a&gt;. A driving-stack release is a vertical-specific weight, not a general-purpose assistant; it slots into a different evaluation pipeline than the leaderboards the same lab's general models chase.&lt;/p&gt;

&lt;h2&gt;
  
  
  What an engineering team should actually do this week
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Signal&lt;/th&gt;
&lt;th&gt;Read&lt;/th&gt;
&lt;th&gt;Action&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;V4.1 Flash 1M context, FP4 KV cache&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Engineering vendor claim, not a deployment guarantee&lt;/td&gt;
&lt;td&gt;Reproduce the 1M-context number on your own traces before quoting it&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.8-Max open weights at 2.4T&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - Yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;First open Max-tier MoE&lt;/td&gt;
&lt;td&gt;Evaluate serving cost on a representative slice, not a leaderboard screenshot&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Announced, not benchmarked&lt;/td&gt;
&lt;td&gt;Hold new commitments until pricing/latency land&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Fourth Claude hacking incident&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Adversarial risk is now a known pattern&lt;/td&gt;
&lt;td&gt;Budget for prompt-injection review on agentic paths&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qualcomm–Amazon deal&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Real deal, inference/training split unresolved&lt;/td&gt;
&lt;td&gt;Use as a lever in 2027 contract talks; do not assume training displacement&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini Windows app&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;Surface news, no integration data&lt;/td&gt;
&lt;td&gt;Wait for latency/caching details&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-09-04 to 2026-09-11 | 中國開源大模型齊發，閉源加速搶企業入口</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 10 Sep 2026 23:09:35 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-04-to-2026-09-11-zhong-guo-kai-yuan-da-mo-xing-qi-fa-bi-yuan-jia-su-qiang-qi-ye-ru-kou-13nn</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-09-04-to-2026-09-11-zhong-guo-kai-yuan-da-mo-xing-qi-fa-bi-yuan-jia-su-qiang-qi-ye-ru-kou-13nn</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：中國開源旗艦（DeepSeek V4.1 Flash、Qwen3.8 Max 2.4T）與蒸餾爭議（Kimi K3）同週爆發，閉源廠商不再只比模型——OpenAI 把 GPT-6 鎖進企業工作流、Google 把 Gemini 鋪到 Windows 桌面，連晶片層都出現 Qualcomm × 亞馬遜這種被市場直接拿來對比輝達的組合。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  中國開源旗艦齊發：DeepSeek 與 Qwen 同週交卷
&lt;/h2&gt;

&lt;p&gt;DeepSeek 推出 V4.1 Flash，主打 1M context、FP4 KV cache 與 cross-layer attention reuse，定位是低成本長上下文變體&lt;a href="https://news.google.com/rss/articles/CBMi3wFBVV95cUxNV0hSR2lQQU5iODhFMmRBMklOMmRWYXotSEVTVFRORGJmMThZRzlRS00xdFowOFNBQjBULUhyR0ZXdUdOVzdJVktvR0w1Z3IxVjF3NEtndG1JRVNjcEtST2l3RGhzWjc5enE5TEM3cUtDV19HQXp1elVHeVVqYjgxVWxzMkI1NFMtbC1ONTVnM1hDWGlyakt4RVlvTWt0bVdRYVI2ekJnWEhlemRFUUJYUVJqT1dTU0N4amt0V2dnVENCYkJuSXNYVFRSQWpOcDVHbzBnY0N4ZlRiWnU0dlB30gHfAUFVX3lxTE1XSFJHaVBBTmI4OEUyZEEySU4yZFZhei1IRVNUVE5EYmYxOFlHOVFLTTF0WjA4U0FCMFQtSHJHRld1R05XN0lWS29HTDVncjFWMXc0S2d0bUlFU2NwS1JPaXdEaHNaNzl6cTlMQzdxS0NXX0dBenV6VUd5VWpiODFVbHMyQjU0Uy1sLU41NWczWENYaXJqS3hFWW9Na3RtV1FhUjZ6QmdYSGV6ZEVRQlhRUmpPV1NTQ3hqa3RXZ2dUQ0JiQm5Jc1hUVFJBak5wNUdvMGdjQ3hmVGJadTR2UHc?oc=5" rel="noopener noreferrer"&gt;DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse - MarkTechPost&lt;/a&gt;。同時間 Pro 線確定退役，價格與角色向 Flash 傾斜&lt;a href="https://news.google.com/rss/articles/CBMid0FVX3lxTE5FX21yQ056RjQ5QTVqUW9pQjF2WHA5NmtLc3F2U0pYLWIwdllUb1ZXcV9Gc3N4dXR5V3BxWEp6aGJEaHFDSVNIaXlaR1JqZnJ2Y2V1ZXMyeU40SkFnMXk3MUN0NzNiWmJmbG9IRmQ0VTJCUXJnQVRV?oc=5" rel="noopener noreferrer"&gt;DeepSeek V4.1 Flash Released: Benchmarks, Pricing, and Pro Retirement - Intelligent Living&lt;/a&gt;——這是「發布」與「可商用」同步落地，但 Flash 真正能不能吃下 Pro 既有工作流，要看既有整合的遷移成本。&lt;/p&gt;

&lt;p&gt;阿里這邊則推出 Qwen3.8 Max，2.4 兆參數 MoE，宣稱在 coding 榜單超越 Claude Opus 5&lt;a href="https://news.google.com/rss/articles/CBMitgFBVV95cUxNc21zdGptLW1EVTMyb0phVDZNOVlybV9wU0JJVlJCRjRHa1NlSHNHVDBDTXMzdHd0dlZnSW43dlBqXy1JZndnTms2RzRVQ3gxRGxncl9XOENkZHJ1R2d1RjM3bTh3dTltekRCcG1ZcU1ieDlnLXB2c2QxZVZRWXJEcWw4V1VmeVBQalNNSVhtWXcyUFR3SFR0WVVsVjAzUnlOR3ZqMnRiblBzOFFtVU1HWlNBaU9adw?oc=5" rel="noopener noreferrer"&gt;Qwen3.8 Max Debuts With 2.4 Trillion Parameters, Trailing Only Fable 5 - yellow.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMioAFBVV95cUxNWmZWbmdpcFVLSXpUOHVZeGNyLUJlZEp1MlUyX0VLWmpRN1plc2lUcnQ3TFZZdG5xMzVnUEtDbXFIbnpIdEVRbkEyNGpiVWVsWm4tcThob2hNNGxMcEd2djVZVm5jU0IxV3FUUnlfR2VUVXd3MFlQOGV1Qm9aSFIxSE1FNHN1Rl9pS1pfaFkyRk00Ry1Nc0xnanhVb2tWXzdq?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen3.8-Max Model Overtakes Claude Opus 5 on Coding Leaderboard - Startup Fortune&lt;/a&gt;，並開源釋出 Qwen3.8-2.4T-A95B 權重，這是 Qwen-Max 級別 MoE 第一次對外開源&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE81TVJsck1OWHNjN0hyeElwX0ViSzVhc1ZUeXZ0Q1N3TXVtTnBFVlJjU05RaHcxNlFNNDN0TS01cUdQclRRMlZiRFQ3UUFIQ0syMF9IZUpMQjdpWks4TmdsZUJFZVZ0VzVPLUtyNFQwT2JTc3dmYmJGbEF5cmNTdw?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen3.8-2.4T-A95B Weights as First Qwen-Max-Class MoE - Pandaily&lt;/a&gt;。同一週也開源自駕模型&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE16UHpfYXBMLXl0eDFCVm5pSUtTa2c0ZGFZQnpPeTUxTTFQMS15dXhkUUFEV25YN2ZsWXBaM1o0aGo1dF95T0gtR3h3R3gtektUT0d0OUZJcUtIMTZKc2hoN3EwajJZOG5Oa2swU1NTYw?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen releases open-source model for autonomous driving - TechNode&lt;/a&gt;。對照既有解法：榜單之外，開源 MoE 要證明的是企業導入這一關——vLLM / SGLang 對 2.4T MoE 的 routing 開銷、KV cache 容量，以及微調 pipeline 能否沿用既有 LoRA 工具鏈，都是得上機驗證的工程問題。&lt;/p&gt;

&lt;p&gt;開源旗艦齊發的同一週，白宮卻點名蒸餾爭議；中國 AI 本週的訊號是矛盾而非突破——技術自信與合規陰影並存。&lt;/p&gt;

&lt;h2&gt;
  
  
  蒸餾爭議升溫：白宮點名 Kimi，WSJ 揭露產業模式
&lt;/h2&gt;

&lt;p&gt;白宮指控 Moonshot 把 Anthropic Fable 蒸餾進 Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPRXVMaFFqb3JjYURMcTNkMmFvUGItUVRYaWFxaWw3Q3NzczBpS1pidTNFa05lbjJyOW5oWW9acUxWN2FMcW9rNVI0YkthVW9NTC1pR3k1MGRLQ3o1ektnaHkxM3E4RDlYdnQ1emd5QjB0VU9rcXlSc3UxbjdacXpVdzdVNVM2V25YQ2tUbmRNZmdiNUhTai1jaG5SSGY?oc=5" rel="noopener noreferrer"&gt;Moonshot AI Distilled Anthropic's Fable For Kimi K3, White House Says - yellow.com&lt;/a&gt;，美國機構的說法另有媒體從訓練來源與產業模式兩個角度跟進&lt;a href="https://news.google.com/rss/articles/CBMiWEFVX3lxTE44YlRZcUp1SXdqMUJEc0NZLVBsMmhVblpMSzhaRGpiM3FmNXVnZWw4SWtFTzhjZ3NjTk9Sc0ppdzlyWUtIaTI4RHJMeUVWM0tFUE01WGdraU8?oc=5" rel="noopener noreferrer"&gt;Moonshot’s Kimi rattled markets. U.S. agencies now say it was trained on American models - Cryptonews.net&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxPeGswOXZNYVNvdzV2SzRHVC1aM0lGM01aNHVnMlRRQWVZYkFhTGh0dzE4UkRER042RU5kQnVmUVY3X282ZmgzYUtJYU5uSnhyZTV1eWlsaDdKcHBjQ28tQnQzd09XUm9KczY4SFB1c1hEZ2xfS203RExlZDU5OUZRcHZ4YUNUdG5JbzByNFlqWi10ZVlXcmxVNExXODR6dEp4X1FjbERSckRRQ0ZNcVhiMGxR?oc=5" rel="noopener noreferrer"&gt;How Chinese AI Firms Tried to Clone U.S. AI Models - WSJ&lt;/a&gt;。這是政策與產業競合的訊號，不是單一訴訟：後續真正影響的是美國出口管制是否能從「算力」延伸到「蒸餾後的衍生模型」，以及企業客戶會不會把供應鏈合規要求寫進採購條款。&lt;/p&gt;

&lt;p&gt;對工程讀者的現實含意是：如果你正在評估 Kimi 或同類蒸餾模型，要先確認供應商的訓練資料合規說明是否能過你法務那一關——這是採購 checklist 的新欄位。&lt;/p&gt;

&lt;h2&gt;
  
  
  企業入口戰：GPT-6 Astra 與 Gemini Windows App
&lt;/h2&gt;

&lt;p&gt;OpenAI 端出 GPT-6 Astra，自家文案給的說法是「a new generation of intelligence」與「intelligence for work」&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE5CMVNUYU5VZ0ZwQm56OGo4bVhKSmtEU1dLT01wR0hmbzE2ektwRS1LNnVqRkVha3ZzLXJyVE9GdHpMREM5dnRXS1Q2MHJoNGV3RFVLZ3VvZ3dwcGphbnI2RWx4dnFBMWM0Zmc?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: The next generation in intelligence for work - OpenAI&lt;/a&gt;——同一週連發兩篇自家發文，通篇是 enterprise sales 的調性。Google 則反過來搶桌面端入口，把 Gemini App 推進 Windows&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxOQmxvb0k4aWwydW81d2x1REwyUDNiblpiTnNVaUJNMmVxV3Z0WXVUUGxlT1NnYk5ZREloWWxnTnFneEZ2OE5peWpuZXdqcjV4cmxGay1URTBjQ01CeEZoTHZPRjlKV0lnVExsRnliTXl6Q0puekxOdjl4LTN3c2hVajU4WGpJUGs?oc=5" rel="noopener noreferrer"&gt;Google launches Gemini app for Windows PCs (GOOG:NASDAQ) - Seeking Alpha&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxOTjNoLU5SWnMwX3AxQVA5U2VzRXFINEtnMS1VU3pOOEZkbTlORkFRZEQ1MjFmS0ZTdFpSb0k4ajkzVjZDQV9PMFVobVFCdW01TjZRSFBfSkxqbXlqM2hVYjR6cHJSTHg4TGRtNmRFbnB4TGdVeGw1cWtOS1RlanVaTFBIM3Z5WGRVcFl0cDdxRVRTNE9nWW9V?oc=5" rel="noopener noreferrer"&gt;Google Gemini’s New Windows Desktop App Is Here - CNET&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;兩條路線的工程取捨不同：&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;面向&lt;/th&gt;
&lt;th&gt;GPT-6 Astra&lt;/th&gt;
&lt;th&gt;Gemini Windows App&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;整合面&lt;/td&gt;
&lt;td&gt;工作流（企業系統綁定）&lt;/td&gt;
&lt;td&gt;桌面 OS（個人入口）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;主要阻力&lt;/td&gt;
&lt;td&gt;API 額度、SSO/權限、IT 治理&lt;/td&gt;
&lt;td&gt;Windows 版本碎片、本機資源調度&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;替代方案&lt;/td&gt;
&lt;td&gt;Microsoft 365 Copilot + Azure OpenAI&lt;/td&gt;
&lt;td&gt;既有 ChatGPT desktop、Edge Copilot&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;三欄差異決定成敗：GPT-6 要贏的是 IT 治理導入流程，Gemini Windows 要贏的是作業系統佔有率與本機資源調度。兩者都還在「發布」到「進入真實工作流」之間——能不能站穩，要看 SSO/稽核/權限分層這些企業 IT 真正在意的整合面，而不是 demo 影片。&lt;/p&gt;

&lt;h2&gt;
  
  
  晶片戰場：Qualcomm 拿下亞馬遜，輝達敘事遭質疑
&lt;/h2&gt;

&lt;p&gt;晶片戰場的訊號已從「誰跑得動」轉向「誰的單瓦 token 成本更低」。Qualcomm 與亞馬遜達成 AI 晶片合作，並提供約 40 億美元股票認購權&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTFAwQVB0cnlUVVMxeVJad0FBbFlINDRJa25vLUtzcTZSaWFjRUNHMHRIbWxJS0dVWFRoU1duWmNUZkZac2g5aUtURGNMMVNRS2Q3N1RadERqbmRzTWg2NUtuUkdkUU1IN01xMVJwMExvVQ?oc=5" rel="noopener noreferrer"&gt;Qualcomm's Massive AI Chip Deal With Amazon Puts Nvidia's Lead at Risk - MarketWise&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxNRVNjUXJLSmJweEFKQ1NPcjF0eUtfZFZOMlZrd20wbXBkUGNFMm4wWkF1WXRJSkdvMnBtd0N1aFZvNWlQWmJLeHdIMnVrWEFqSm9BNmVhMllCTUwyaVBiS2hVTlNaaksyRkwtSFo5cmtFTXVWRGg3Z2h2LTFtYURjclRvblR5S0NIcXctMGh3LTN6dXpnZHZwWUhDd1dRNkM3SE9iRlN1QVczR2xKQWdTSG9zZXluRW8?oc=5" rel="noopener noreferrer"&gt;Qualcomm strikes AI chip deal with Amazon, offers right to buy about $4 billion in stock By Reuters - Investing.com&lt;/a&gt;——交易消息一出，市場評論直接以「輝達領先地位不保」解讀；客製晶片與輝達的角力，正式寫進一線雲端廠的合約。與此同時，Jim Chanos 質疑輝達 AI 晶片經濟學，直指 Jensen「highly rentable」說法&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxOWFY0YmdVM2hQNjAxQVJGSkdrNTRTZUl0VEJFUmJKaGNXUXl6Ykp2YTYtdi1pd00tQzlWeEhabENVNVJ0MDc2ckRzVWNMTTRrS0FpTzV2NG9rOF9IZGhSVC1fdlk0dFFYVnUtY3dFYnNiNDBaTGdjNjJkbEd3NGh4ZF8xNjd6WU1iOTlIR1VHeC1KMElSMUdWaVZOSGlqeENpRWFMMEs5SDdoUnZweFd5MDBUX2JxNktkTGNCWVlLZWhnVm8xTDFXLVY4MW9va3R2LTNadnZ3MUdfLTJsYVdRN09GYWIwYzVEOFNkOXVLdjc5SmpuU3NwSnNNVnY?oc=5" rel="noopener noreferrer"&gt;Jim Chanos Questions Nvidia’s AI Chip Economics After Jensen Huang Says Nvidia Chips Are 'Highly Rentable' - Stocktwits&lt;/a&gt;；NVIDIA 自家 Hot Chips 2026 六場演講則鋪出「單卡到 AI 工廠」的全棧敘事&lt;a href="https://news.google.com/rss/articles/CBMigAFBVV95cUxOMGlqcW5qZEZ0b09EOWk5VGdDQmUzTElMVGlnTTRXOW1tVnBSazFuMV9NOUF1UE5qMVBYWFVFSDBRYnI0LW1XSG9UQlVGcWZNSzNyVVVWcmc5U1I1a3BlU1lFczZIUGp2ZXEzVHVITGN0R2RjX3IwdEVYOVVOUTdnNg?oc=5" rel="noopener noreferrer"&gt;From One GPU to an AI Factory: Deep Dive into NVIDIA’s Six Hot Chips 2026 Presentations - semivision&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;對企業的現實意義：2027 年 capex 決策不能再用「輝達 = 預設」作答，至少要跑一輪 TCO 試算。&lt;/p&gt;

&lt;h2&gt;
  
  
  安全與治理：Anthropic 兩端同時曝光
&lt;/h2&gt;

&lt;p&gt;Anthropic 一邊公布阻擋可能的生物武器濫用嘗試&lt;a href="https://news.google.com/rss/articles/CBMiiwFBVV95cUxOb3RxODh4LWhOS0o0UFBGNUhHODA0Z2dqbTcyTlFmYVRwRzJVVnhKMFl4U2dqQUQwZXV6d0c1c0gwRHZXeF9wOFRTN2xCengtRnRuR0tJLUNDTlI3VjAyekRzRngwMWY4M01hSUVwWURFUFAxdkRjRC1HZUM3cG9YTnZ4UVFNcVlnT200?oc=5" rel="noopener noreferrer"&gt;Anthropic Says It Blocked Possible Efforts to Build Biological Weapons - The New York Times&lt;/a&gt;，一邊揭露第四起 Claude Opus 4.6 相關資安事件&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE44Nk9jVHVyUWMyRUN6TFJGcXNNX281akYxdExzMlk1elhQbnhpbWt1VzFrS09McEhGemc3V0c5THFQa1VIcmI3ZmFLeFcyTXh3YTNCendNT3YyX3ZpNkNyU0hXWG1LS21KNG1FZ25NSVFGOHhETUx6Y0E2LW0?oc=5" rel="noopener noreferrer"&gt;Anthropic Discloses Fourth AI Hacking Incident Involving Claude Opus 4.6 - The Hacker News&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxNVDNYS0lWQ0xGQUhzdWxVSnM0U0ZqYWZMMnBWVHpxZEpBQWNhYWJMd3FQSzR1clZQRHFDRFhhc3dJYW1GYmRoZk5vbnp5b3hIUGRzaTNrdUhzVVhTWnVpYTE3cVctZmZyMk51cnpRZ0xLVjZPZmVSalFhQkY1TVljaDJFTElLSWpNSlRuR1FmYWNIaXlGdXJ1bVk4OUk?oc=5" rel="noopener noreferrer"&gt;Anthropic reports fourth cybersecurity incident with early version of Claude - Yahoo! Finance Canada&lt;/a&gt;。「擋下濫用」與「資安事件」同週出現——這組對比剛好說明 frontier model 的治理戰場是雙向的：模型既是防禦工具，也會成為安全事件的主角。與本週其他軸線（中國開源、企業入口、晶片戰場）的共同點是：攻擊面與整合面同步擴張，紅隊測試、prompt injection 防護、tool-call 權限控管不再是「之後再做」的項目。&lt;/p&gt;

&lt;h2&gt;
  
  
  結語
&lt;/h2&gt;

&lt;p&gt;本週四條軸線：中國開源旗艦 + 蒸餾爭議、閉源搶企業入口、晶片戰場開打、安全與治理兩端同時收緊。模型本身的進步幅度反而不是故事主軸——真正的訊號是「誰能進 workflow、誰的成本結構能撐到 2027」，這兩個問題的答案，本週各自往前推了一步，但都還不到「可直接採用」的階段。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-28 to 2026-09-04 | Three Flash Models in Six Weeks, One Distillation Fight</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 04 Sep 2026 00:14:55 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-three-flash-models-in-six-weeks-one-distillation-fight-2lea</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-three-flash-models-in-six-weeks-one-distillation-fight-2lea</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Three Flash-tier models in six weeks, a Claude outage that touched multiple model IDs at once, and a distillation fight spilling onto the dark web. This week the bottleneck isn't raw capability — it's who controls the inference lane and what happens when that lane goes down.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  The Flash tier is the new battleground
&lt;/h2&gt;

&lt;p&gt;Google released Gemini 3.8 Flash as its third Flash model in roughly six weeks&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;. Anthropic countered with Claude Fable 5.1 and Claude Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - Anthropic&lt;/a&gt;. Alibaba shipped Qwen3.8-Max-0902, which Wccftech frames as matching Claude Fable 5 in capabilities with merely an update and without jumping to a new version number&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;; AI Weekly reports the same snapshot lifted Alibaba's CodeArena score by 22 points to 1,691&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;. Zhipu AI launched GLM-5.3-Flash after what the vendor describes as a stealth trial on 100,000 domestic chips&lt;a href="https://news.google.com/rss/articles/CBMiogFBVV95cUxOVXhjRkV4OWxtYVVmaWxKZ0g0TlI2TUE2SnBRV1pFNVJrRnJtVk1yZFpJa2gyVHk2U1ZyV0xqVUhvRXJURGtLYWdaY3dTWXZpdFNmSTdzN2lxNVljQVEyRzFMS0U4OWdFenAtLWpLZGlUOTJmMTRZd1dlNzhrNGk0bXhmQ3VTSFpOdUpwbWhiVmRJVW16UUsxd0Zacnl4WXJTQkE?oc=5" rel="noopener noreferrer"&gt;Zhipu AI Launches GLM-5.3-Flash After Stealth Trial on 100,000 Domestic Chips - Retail News Asia&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The technical reason this matters: Flash-tier models are where the unit economics actually live. A 20x price gap separates Tencent Hy3, GLM-5.3-Flash, and Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMiekFVX3lxTE55NkVsTm5DUUVMY3pCa2ZwVFJ1OHYtNGhuZEp3amxiX2hGQXltYnhYUEFpaUsxUUVwVlFROVBValZHS01SZFBCX29lN29JV1JORnR2cE1ORk5iRHdYTTB4TzZBYVVrekV2ZTNSU21vX2dMNTJLd1dSZFlR?oc=5" rel="noopener noreferrer"&gt;Tencent Hy3 vs GLM-5.3-Flash vs Kimi K3: 20x Price Gap [2026] - tech-insider.org&lt;/a&gt;. For production teams, the question is no longer "which frontier model is smartest" but "which Flash variant clears the latency, reliability, and per-token cost bar for the workflow I have in mind." Capability is approaching parity at this tier — engineering constraints now dominate.&lt;/p&gt;

&lt;p&gt;One caveat: the "matches Claude Fable 5" framing for Qwen3.8-Max-0902 comes from Wccftech's headline characterization, not an independent benchmark surface. The CodeArena jump to 1,691 (a +22-point move) is headline-supported for #3 alone&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;. Treat the parity claim as a single-source claim until you test it against your own evaluation set.&lt;/p&gt;

&lt;h2&gt;
  
  
  OpenAI ships GPT-6 Astra into Microsoft's enterprise lane
&lt;/h2&gt;

&lt;p&gt;OpenAI announced GPT-6 Astra with availability through Microsoft Foundry&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - azure.microsoft.com&lt;/a&gt;, and followed with a separate safety overview on the same day&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;. The distribution channel is the real story: shipping into Foundry puts the model inside the enterprise procurement path that Azure customers already use, ahead of any standalone API migration. If your stack is Azure-native, the integration cost just dropped; if it isn't, the procurement gravity is now pulling that direction.&lt;/p&gt;

&lt;p&gt;Two adjacent moves strengthen the vertical-integration thesis. OpenAI announced that healthcare organizations can connect EHR and industry data to ChatGPT&lt;a href="https://news.google.com/rss/articles/CBMihwFBVV95cUxQUFZLUDY4VnlYRGpwSVJOUk9LNVI5T29GeE1hdzBNLUxXZTBVbmNXYjRPWWlNWERvSDFwMC1pc2dNaXhXcGtFZ3IyVFlYNy1CLXpWQ3d1cXBDczI2Zm5iajQ5X0JLOUFlbVNqdFRHajN6MUFzYnF2S1lnUEhtbndaVXpuU2d0UVU?oc=5" rel="noopener noreferrer"&gt;Healthcare organizations can now connect EHR and additional industry data to ChatGPT - OpenAI&lt;/a&gt;. Separately, the U.S. Department of War launched OpenAI's ChatGPT Mil on GenAI.mil&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOa2FtbEFMblFrZFZ3bnBXbGhZZnNCUzBXd2Ytejl6QmZhak1RZjBjQU5XQmxTck5ac3J2NkN5bUZwSzEtUVl3aXRsb2ZBMmtSMHdwZXFRRk9MMFQ1OWFtNkFOVjBvcWRZU2NtOEpvemhNUkpfMThMaTdSemJhbWNFR1dhMW5jVkNXZnhCLTVraGpJSFVDaEkzZFJMeVhwekpRQS14bDB0TTgwcUVMNmgzaF9zMUY2TmFD?oc=5" rel="noopener noreferrer"&gt;Department of War Launches OpenAI's ChatGPT Mil on GenAI.mil - U.S. Department of War (.gov)&lt;/a&gt;. Each is a workflow anchor — once an EHR pipe or a .mil deployment exists, the model is wired into data sources competitors can't replicate by API alone. Vendor claims about capability, of course, remain vendor claims until independent benchmarks land.&lt;/p&gt;

&lt;h2&gt;
  
  
  Reliability became a first-order concern
&lt;/h2&gt;

&lt;p&gt;Anthropic confirmed a Claude outage affecting multiple models&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNU2NEMWRVYndCdkpfZVNGcG5BZWsxYmtRR2lsVWFsVjBoUHpwRFM4MnJzaFFKSEJnQmhXbnJaejk0bFFucjh5Vk1aRHctTUh6MUxXMEYwYjhneVJYRXphbHlDSnZwZEdTaVVXM3VfS1Z4bmY0QzhkU3ZWandLQW02WTZZN280Nnk1SXRqZjFYbWUxNHdReTE0Qk1UcVg3RVRyY3F3Q2tkbE9VOTRpSExjUndCRUxCSVRqUTk4TDdB0gHDAUFVX3lxTE1xYjc4TG53LWJRY0NEZlVkSEJDbEFXeDdRWVNibjF2ZWE3cFgyVWJicmtFZ2NzMHpxbzhqUmx6VVRZOUplcktLVV9FczNIODItZE1iaFMzOVlLUEhrUVBxUVFpTzBDQlJnNHBQS3kteWxleUg1NVdRX2tsRmhwdXZRckw2Z2RQODVuWnBzTFctYVVOeWFkUldBdHk5cHFRQmUzaVU4Z2FMT1UtOE13ei1iYnYyMl9SalZGSlQ2bGRqSDFaMA?oc=5" rel="noopener noreferrer"&gt;Anthropic confirms Claude is down, multiple models affected - BleepingComputer&lt;/a&gt;. The phrasing — "multiple models affected" in a single incident — is the part to internalize. When one provider's reliability incident crosses model IDs, the blast radius for a multi-model fallback strategy is wider than a single-model SLO implies. If your architecture assumes one vendor's Flash tier is the cheap lane and the frontier tier is the reliable lane, this week's outage is the test case for what happens when both lanes go down at once.&lt;/p&gt;

&lt;p&gt;For buyers, the practical consequences: multi-model routing needs to be tested under a single-vendor outage, not just under per-model degradation. For builders, vendor lock-in costs now include the cost of simulating cross-model outages you didn't think you'd hit.&lt;/p&gt;

&lt;h2&gt;
  
  
  The distillation fight moved off-platform
&lt;/h2&gt;

&lt;p&gt;CNBC reports that Anthropic's distillation battle has turned to the dark web as concerns from China swell&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxPd0dmaVMwck5RMHRLclpVS3pISmpMZ3RBX3NOTVFMMjNLdEc2SlhYc0JTVVZKS1N3andHeHdQenVERzFGTzRpU016WFFSc2pjVnF4dTZfN25GSGtxNzQxN1prRExOZ0NITEpNMWZwME5mZ0lhcWFpSm52SzdYeXBhalhaQmFhYWFDRjFDcjlOb3RDMG9QVUNVbWZOUjdxc3I1WENwQ3V3UzXSAa4BQVVfeXFMTWRCSjNXU3ZwX19acjFnNEVDVDQyMTBiWl9FQVZZNnRmMWZFQTNFQTluYUxzRzVFNVZ1NDRtdjlTbm1ieXk3ZlFuNHZEdktWbHNHeDBrUXFzZ0lKdGhCZ2xXZ0tXVUowZk52MXVWRXpzcHVUS0tmVlJlMFhQTU9pRkxDZzdsV3VSNHFOYm44RnBudXpRVG9wd25CMEF1Yjh0cjFjUUtKMUg3M2JwT2ZB?oc=5" rel="noopener noreferrer"&gt;Anthropic's distillation battle turns to the dark web as China concerns swell - CNBC&lt;/a&gt;. The headline itself is the signal: when IP defense moves to channels outside standard legal recourse, the response surface changes. For teams running fine-tuning or distillation pipelines, expect tighter ToS enforcement on the upstream side and more scrutiny on data provenance downstream.&lt;/p&gt;

&lt;h2&gt;
  
  
  Chips and capital
&lt;/h2&gt;

&lt;p&gt;Moonshot AI, creator of Kimi K3, has filed for a Hong Kong IPO, per South China Morning Post&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;. TradingView reports the filing context: Kimi K3 driving a $300M revenue run rate, with the IPO targeted within six months&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;. Both numbers carry the usual IPO-disclosure uncertainty — the run rate is a vendor figure, and the timeline is a target, not a guarantee.&lt;/p&gt;

&lt;p&gt;On the silicon side, VentureBeat reports enterprises are putting non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;. That phrasing ("on their evaluation lists") is the qualifier to read carefully — it means purchasing intent measured at the eval stage, not deployed fleet share. The structural shift is real; the migration is slower than the headline suggests. Yahoo Finance frames Nvidia's next act as bigger than selling AI chips&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt; — a useful reminder that the inference-lane economics are where margins are migrating, which is exactly why the Flash-tier competition above matters.&lt;/p&gt;

&lt;h2&gt;
  
  
  What to actually do this week
&lt;/h2&gt;

&lt;p&gt;If you're evaluating Flash-tier models: don't run a single benchmark. Run your own evaluation set against at least two of the new variants (Gemini 3.8 Flash, GLM-5.3-Flash, Qwen3.8-Max-0902) and measure latency, error rate, and per-token cost under your real prompt distribution. The published numbers are vendor claims; your numbers are decisions.&lt;/p&gt;

&lt;p&gt;If you're on Azure: the GPT-6 Astra Foundry availability is a real procurement event, not a press release. Pull the eval cycle forward by a sprint.&lt;/p&gt;

&lt;p&gt;If you're on Anthropic: pressure-test your multi-model fallback. A single incident crossing model IDs is the new worst case.&lt;/p&gt;

&lt;p&gt;If you're building on distillation: tighten provenance checks before the next round of enforcement lands.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-08-28 至 2026-09-04 同週四個前沿模型落地與一次三重中斷</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 04 Sep 2026 00:11:29 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-four-frontier-models-land-in-seven-days-flash-pricing-drops-3kl3</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-28-to-2026-09-04-four-frontier-models-land-in-seven-days-flash-pricing-drops-3kl3</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：同週四個前沿模型先後落地（GPT-6 Astra、Claude Fable 5.1 / Mythos 5.1、Gemini 3.8 Flash、Qwen3.8-Max-0902），但 9 月 3 日當天三家龍頭服務同時中斷，而非 Nvidia 晶片在企業評估清單上領先 Nvidia 下世代 GPU 達 14 分——「發布」與「可用」之間的落差，這週有了具體樣本。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  前沿模型：同週四個釋出，密度本身就是新聞
&lt;/h2&gt;

&lt;p&gt;OpenAI 於 9 月 4 日釋出 GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;，定位為「新一代智慧」，並於 9 月 3 日發布對應的安全總覽&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;；Microsoft 於同日宣布 Astra 已在 Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;。模型釋出與企業通路文件同日發布，這次節奏是「模型 + 通路」綁定，不是純研究發表。&lt;/p&gt;

&lt;p&gt;Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Claude Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;，兩個版本號同步亮相。標題只說明兩者同時發表，並未交代兩條產品線之間的關係；版本號一致是否代表共用迭代節奏，需要官方說明才能判斷（推測）&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE15ODlkcDc5RXk4dzQwbUFXd2lveWlxaS15Z19xaEg2MEExcVZyUEtSaVhFTFh1WlV0TzlldWkxbmxtX0hSX0RiYS0ySW13SWtPWThMWGR4eWR4RkRZWkdyekVNWDZxc1pTelNlN1QzSFktX0FMSGZOcG9xUQ?oc=5" rel="noopener noreferrer"&gt;The Sequence Learning Loop - Issue 925: Learn About Fable and Mythos 5.1, GLM-5.3-Flash, and Qwen 3.8 - TheSequence | Jesus Rodriguez&lt;/a&gt;。同一天，蒸餾防禦戰線被 CNBC 報導延伸到暗網&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxPd0dmaVMwck5RMHRLclpVS3pISmpMZ3RBX3NOTVFMMjNLdEc2SlhYc0JTVVZKS1N3andHeHdQenVERzFGTzRpU016WFFSc2pjVnF4dTZfN25GSGtxNzQxN1prRExOZ0NITEpNMWZwME5mZ0lhcWFpSm52SzdYeXBhalhaQmFhYWFDRjFDcjlOb3RDMG9QVUNVbWZOUjdxc3I1WENwQ3V3UzXSAa4BQVVfeXFMTWRCSjNXU3ZwX19acjFnNEVDVDQyMTBiWl9FQVZZNnRmMWZFQTNFQTluYUxzRzVFNVZ1NDRtdjlTbm1ieXk3ZlFuNHZEdktWbHNHeDBrUXFzZ0lKdGhCZ2xXZ0tXVUowZk52MXVWRXpzcHVUS0tmVlJlMFhQTU9pRkxDZzdsV3VSNHFOYm44RnBudXpRVG9wd25CMEF1Yjh0cjFjUUtKMUg3M2JwT2ZB?oc=5" rel="noopener noreferrer"&gt;Anthropic's distillation battle turns to the dark web as China concerns swell - CNBC&lt;/a&gt;，防禦對象指向中國蒸餾攻擊。&lt;/p&gt;

&lt;p&gt;Google DeepMind 於 9 月 2 日釋出 Gemini 3.8 Flash，這是六週內的第三個 Flash 模型&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;。六週三個 Flash 的節奏不是孤立的技術事件，而是 DeepMind 持續推進其算力切片策略&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;Alibaba 於 9 月 2 至 3 日用 0902 快照更新 Qwen3.8-Max，CodeArena 分數升至 1,691，較前一版躍升 22 分&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;；刻意未跳版本號&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;。The Sequence 週報將 Qwen 3.8、Fable / Mythos 5.1、GLM-5.3-Flash 並列為本週產業綜述焦點&lt;a href="https://news.google.com/rss/articles/CBMie0FVX3lxTE15ODlkcDc5RXk4dzQwbUFXd2lveWlxaS15Z19xaEg2MEExcVZyUEtSaVhFTFh1WlV0TzlldWkxbmxtX0hSX0RiYS0ySW13SWtPWThMWGR4eWR4RkRZWkdyekVNWDZxc1pTelNlN1QzSFktX0FMSGZOcG9xUQ?oc=5" rel="noopener noreferrer"&gt;The Sequence Learning Loop - Issue 925: Learn About Fable and Mythos 5.1, GLM-5.3-Flash, and Qwen 3.8 - TheSequence | Jesus Rodriguez&lt;/a&gt;。中國 GLM-5.3 在 Cyber 測試上接近 Anthropic&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt;，報導屬第三方評論站，需獨立驗證基準定義。&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;模型 / 快照&lt;/th&gt;
&lt;th&gt;釋出時點&lt;/th&gt;
&lt;th&gt;來源標題要點&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra&lt;/td&gt;
&lt;td&gt;9/4&lt;/td&gt;
&lt;td&gt;新一代智慧&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra（安全）&lt;/td&gt;
&lt;td&gt;9/3&lt;/td&gt;
&lt;td&gt;對應安全總覽&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE96LWRUcTNTOGszRVdVcDMxel8yNUFJajFqLUxxWklNZDZ1a0FKcW9pMXo5X29iS0ZQcFVGLW5KaTVGczUxRi1iUzZYcm1XcDVBZGlUZ0Jfc2xrSGhNN29QbXVRcw?oc=5" rel="noopener noreferrer"&gt;Safety overview: GPT-6 Astra - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-6 Astra（通路）&lt;/td&gt;
&lt;td&gt;9/3&lt;/td&gt;
&lt;td&gt;Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Fable 5.1 / Mythos 5.1&lt;/td&gt;
&lt;td&gt;9/1&lt;/td&gt;
&lt;td&gt;雙線版本號同步亮相&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.8 Flash&lt;/td&gt;
&lt;td&gt;9/2&lt;/td&gt;
&lt;td&gt;六週內第三個 Flash&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.8-Max-0902&lt;/td&gt;
&lt;td&gt;9/2-3&lt;/td&gt;
&lt;td&gt;CodeArena 躍升 22 分至 1,691&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GLM-5.3&lt;/td&gt;
&lt;td&gt;8/30 報導&lt;/td&gt;
&lt;td&gt;Cyber 測試接近 Anthropic&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  政府 / 通路：模型可用不等於政府客戶可用
&lt;/h2&gt;

&lt;p&gt;GPT-6 Astra 在 Microsoft Foundry 上線&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;，代表 Azure 客戶能在合規環境內呼叫。Euromonitor 同日宣布 Passport Intelligence 透過 Microsoft 365 Copilot 推出&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQQXlma1VKZ3Ytcy1kLXEyNndKMTRHTmFZbHNPQnA2THRPZnhGWnN0NnV5eGNpRTVNZUhhLVRaLXpzLWh4eGlMR0pTS0ViOG1HdDZjaTJWRFBPVHFRdjJZSnJtUkEtRlRjeFpDX0h3d2J6RUI4czRMcjcteE1INmRMdzJFRUc1MnlXSHRLaVRUc2FsU3hHZFNDelNpM0xJdDB2UXJUZkhHU21HQlVPcm15MjNhVkJMUDQ4ci1OMDlJSXlYT3JXNVFETkk5NA?oc=5" rel="noopener noreferrer"&gt;Euromonitor Introduces Passport Intelligence Through Microsoft 365 Copilot - Business Wire&lt;/a&gt;——這是「模型釋出 → 企業客戶上線」壓縮到 24 小時的樣本。&lt;/p&gt;

&lt;p&gt;但通路層與政府採購層是兩個不同的可用層級。9 月 3 日，Pentagon 的 AI 入口已上線 ChatGPT 與 Grok，名單上沒有 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;。Claude 缺席 Pentagon 入口，不應直接推論為技術評比結果；採購偏好、合規篩選、出口管制與國家安全考量是獨立的決策變數。&lt;/p&gt;

&lt;p&gt;兩件事並列讀：模型可以跑（Foundry 與 Copilot 通路暢通）與政府可以買（Pentagon 通路是否涵蓋）是兩件不同的事。&lt;/p&gt;

&lt;h2&gt;
  
  
  算力：非 Nvidia 晶片在採購評估上領先 14 分
&lt;/h2&gt;

&lt;p&gt;VentureBeat 報導，企業把非 Nvidia 晶片放在評估清單前列，領先 Nvidia 下世代 GPU 14 分&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;。同一週 Yahoo Finance 的圖表日報指出，Nvidia 的下一步比賣 AI 晶片更大&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt;（屬評論稿，非 Nvidia 官方說法）。&lt;/p&gt;

&lt;p&gt;兩個事實擺在一起讀：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;14 分的領先幅度，若樣本數足以支撐，代表企業採購評估清單已有「非 Nvidia 路徑」這個明確選項，不是「考慮中」。&lt;/li&gt;
&lt;li&gt;Nvidia 自身的反擊敘事已從「晶片」轉向「晶片 + 系統 + 軟體棧」綁定，這正是 Yahoo 那篇評論的核心命題&lt;a href="https://news.google.com/rss/articles/CBMivwFBVV95cUxPd0QyMU9PdzN0d051SmNBNDVmOV9pTUQ5Q1BtS0x0Q3FPbjNWVzVjSy1yZy01T29zVUVDb2VtenRlSjhjbXFnbVRXVmFBd0hoWWNBMml2ZWtUR25QZEk2eVktdkdOdElMSEJYNnJzcm9tOVJSZFdlRzRSV290eE9jMnAzSGFPYlBjTU5jQnlLT2RqblhxUjhiNWE3WFZCNXAzLThFTExuTXJqcndUcjlQVVVMTDNYY0kwQS14NVQ3SQ?oc=5" rel="noopener noreferrer"&gt;Nvidia's next act is bigger than selling AI chips: Chart of the Day - Yahoo Finance&lt;/a&gt;。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Moonshot AI（Kimi K3 母公司）已在 9 月 3 日啟動港股 IPO 程序&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;，年化營收 3 億美元，目標六個月內掛牌&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;。Moonshot 是 Kimi K3 模型與本次 IPO 的主體&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;——但年化營收 3 億美元屬報導中的 run rate 數字&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt;，需對照實際年化經常性營收。&lt;/p&gt;

&lt;h2&gt;
  
  
  可靠性：三重中斷把「可用層」打回原形
&lt;/h2&gt;

&lt;p&gt;9 月 3 日，ChatGPT、Claude、Grok 三家服務同時中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt;（The Register 報導，未列各家持續時間）。&lt;/p&gt;

&lt;p&gt;這條事實對架構設計的直接含意是：「多供應商」不等於「高可用」，還要加上「中斷時間分散」這個維度。fail-over 設計若只覆蓋「同供應商多區域」，三家同日全倒時備援路徑會全部失靈。&lt;/p&gt;

&lt;p&gt;Pentagon 入口同日已選擇 ChatGPT 與 Grok，卻不見 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;。採購偏好的政治 / 法規篩選，與模型能力評估是兩件獨立的事；這個案例顯示政府客戶的可用清單已與民間採購脫鉤。&lt;/p&gt;

&lt;h2&gt;
  
  
  三層級分法
&lt;/h2&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;層級&lt;/th&gt;
&lt;th&gt;本週代表事件&lt;/th&gt;
&lt;th&gt;對工程團隊的意義&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;發布&lt;/td&gt;
&lt;td&gt;GPT-6 Astra&lt;a href="https://news.google.com/rss/articles/CBMiTkFVX3lxTE11QUxBUVJLdC1jSmtJbmcxQzg4Qm9yUlNPS3JEMEVBanIyY1FRT2k2R0hBTlNnX2VqcWpTSDJUMDV0TjBJN1VGamlrZzVPZw?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: A new generation of intelligence - OpenAI&lt;/a&gt;、Fable/Mythos 5.1&lt;a href="https://news.google.com/rss/articles/CBMiY0FVX3lxTE8wODA3NURfTHVDbUZnSE12Q3A0TFpvYjhDLU1rT1NVZ2xmM2Z0VWJPc1ZRM0RVVkpIckh6b0ROcXIxTHgzODZWYV9yekV1dTJiMk1KbkVWcThSeUYxcUpDUy1KZw?oc=5" rel="noopener noreferrer"&gt;Introducing Claude Fable 5.1 and Claude Mythos 5.1 - anthropic.com&lt;/a&gt;、Qwen3.8-Max-0902&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;規格表更新；可讀論文 / changelog&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;企業通路可用&lt;/td&gt;
&lt;td&gt;Foundry 上線 Astra&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;、Passport Intelligence 接 Copilot&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQQXlma1VKZ3Ytcy1kLXEyNndKMTRHTmFZbHNPQnA2THRPZnhGWnN0NnV5eGNpRTVNZUhhLVRaLXpzLWh4eGlMR0pTS0ViOG1HdDZjaTJWRFBPVHFRdjJZSnJtUkEtRlRjeFpDX0h3d2J6RUI4czRMcjcteE1INmRMdzJFRUc1MnlXSHRLaVRUc2FsU3hHZFNDelNpM0xJdDB2UXJUZkhHU21HQlVPcm15MjNhVkJMUDQ4ci1OMDlJSXlYT3JXNVFETkk5NA?oc=5" rel="noopener noreferrer"&gt;Euromonitor Introduces Passport Intelligence Through Microsoft 365 Copilot - Business Wire&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;能在沙箱環境實測&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;機構客戶可用&lt;/td&gt;
&lt;td&gt;Pentagon 入口選擇 ChatGPT / Grok&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;
&lt;/td&gt;
&lt;td&gt;法務、合規、出口管制已通過&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h2&gt;
  
  
  風險與取捨
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;版本號膨脹成本。&lt;/strong&gt; DeepMind 六週三個 Flash&lt;a href="https://news.google.com/rss/articles/CBMixgFBVV95cUxPUC0tcDJ6Y1lnOHZfWUZ2LUltbGQwc1JLNDBib3U5RkNiTWU5aHg0bzhZdzhURjVOdU1fZS13OUl3ejdYWnhCNUV2VF9lXzlyTUdsZmx0NUtZVVBwNkZpRC1BeFFmUHo3b0JiNUNqU3ZtRnpvRnRBc0pNdnkxemdWRWJyWE1SbnJBN0l0Z3FyZi1mMXZiTWtUUlo3WjJjRTdpSDN4azNiU3hsOXdxVHlJUnhXYnYtWFVxQTA2V04yQW9zaVMxYXc?oc=5" rel="noopener noreferrer"&gt;Google DeepMind Ships Gemini 3.8 Flash and Cyber: Six Weeks, Three Flash Models, One Compute Landlord Thesis - forkast.news&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQdFlIZmg0d05aalJ6azg1YmtNZVRORUtUd0ZTcGo0VmRjUDVOSGpfdGk2alVQd1hlWnlBbEhOOUsxUW90MHc3WWhxcmhwd1dMd05iUWp1TkZiN1pZOGVfcDVja0RDX2lKTlVBUFd1VllTR0RqV3lpVVJpd2R1U2lDUDdDcmRIejBZZGlZSEdhVE44X0t3TVRWMXg2dEFrdlYydG1xZDhR?oc=5" rel="noopener noreferrer"&gt;Google releases Gemini 3.8 Flash, its third Flash model in six weeks - Ars Technica&lt;/a&gt;、Alibaba 用快照而非新主版&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxQMzVzTmlFNFZLQkZvVExOZ1dSZlY2T2x2VE50cnl6LVAwb21oa2E4VTd4Y1pYTmhHZW5JSWkxcDdFRXJHTXZlYkNXN0NGN3h3a3JhcklYN2pHMDd2TXJnZVFvbXFHRzJBdG44N1JDSkNYcEVWbkR1UGYwZk1qODlRQjl3SGtBRllLbGdmT3l3UnRsZEZodU9pWDJSaXhva1RWa1h1Z1NZaDE?oc=5" rel="noopener noreferrer"&gt;Alibaba Ships Qwen3.8-Max-0902 Snapshot, CodeArena Score Jumps 22 Points to 1,691 - AI Weekly&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijgJBVV95cUxPX084R0duOGd4SUM4cnROeTk2WkJnbmdGV3VSZTlUZERTSjB1eW9qb2hXQk9DTmJoaVNWeDlpRlYzc2Jzd0lMaFFRaFpqXzlSc3N2bS1IcHRabmg3QjNkSXZrZ0FYNV9xOHZOUnZWWlZGM2sxc0xiT0JLajZuU01Qd1ZtdzA2U2NyZDJZZVA4elJoak16UjdQb3Etak5YSTNpbWxiLW5ZbXRaTmM1dHhYNlRTS1p5VFlRRUhOZWJleGVSRk5FYUJIOU5zQzFJNDE3eG1EQ01WdGFrblpXUDA2UWJrb1JudFpmSlJqNVBhZU9QSjhxMGgyU29iSlBCQWlnbXUxU0lSNG9zUF84ckHSAZMCQVVfeXFMTjBzQW8wSm5CcXFGdFQ5VDRLV3lZMHZnRWFVaHBUTUFvLWN5bklRS21ITHV6b0lXTHFtQWlUQ1VwOV8yUlBUTy1fRTZURDJsUlltVGhiVWdfbzNBVGxZZ0xERnVoVFhpcG5WbUtJdDFFY3RVS1h1dF83ZUR2UTJLMFhZdlJSNEFTbWxLZTBwZ2pFVnA5cEVhWk14bk5UVW9oR2k5eHZGWGZXOVN3LXVYT2haMnN6OUt0c0FtNzd6a0l1OGdnWDFOQ1gwRGt4aE9SSXBTOXVFUmJiVlg5X1lvNWR2Slp1QkpLV1lnc0NCNC1iSWJleEVBd2ttYThUYmw5UUxZZ1Q1c2loZUdNb09CWmdnZWs?oc=5" rel="noopener noreferrer"&gt;Alibaba’s Qwen-3.8-Max-0902 Debuts With The Weirdest Flex Ever: Matches Fable 5 In Capabilities With Merely An Update And Without Jumping To A New Version Number - Wccftech&lt;/a&gt;——短期是節奏感，長期對模型生命週期管理（測試矩陣、回歸基準、A/B 框架）形成壓力。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;基準敘事化。&lt;/strong&gt; GLM-5.3「接近 Anthropic」的 Cyber 分數&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE1Qc1BxNFFZRmNJdDhsNTU2dFFuZ3dEeHZISURRUERjRHVhOF9nM2ZGb0p2dmNLdW1yTG1OWllvOVh2OUp1SmdxTjJYVEtod0JGdUx2Z0RUMVY0dnUtTThXbVQwZ1pUeHBqN2Rxek5UaG5nWW9fSkE?oc=5" rel="noopener noreferrer"&gt;China's GLM-5.3 Nears Anthropic on Cyber Test [2026] - tech-insider.org&lt;/a&gt; 來自第三方評論站，Cyber 單一基準不能涵蓋企業真實任務面。Moonshot 3 億美元年化營收&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt; 是 run rate 而非 ARR，兩者在企業財務語境下指涉不同。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;中斷復原 SLA。&lt;/strong&gt; 三家同日中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt; 暴露的問題是：多供應商不等於高可用，還要加上「中斷時間分散」這個維度。下次寫架構文件時應列入。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;政府採購的非技術篩選。&lt;/strong&gt; Claude 缺席 Pentagon 入口&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt; 屬採購偏好，與技術能力評估是兩件事，不能直接讀成「Anthropic 技術失敗」。&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  結論：發布密度回到年初水平，槓桿移到了可靠性與通路
&lt;/h2&gt;

&lt;p&gt;本週釋出的四個前沿模型（GPT-6 Astra、Claude Fable 5.1、Mythos 5.1、Gemini 3.8 Flash、Qwen3.8-Max-0902），證明前沿競爭沒有冷場。但&lt;strong&gt;三重中斷&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt; + 非 Nvidia 14 分領先&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt; + Pentagon 排除 Claude&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;&lt;/strong&gt; 共同指出下一階段的競爭點已從模型本身轉向：&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;模型上線到企業通路的時間差（GPT-6 → Foundry 24 小時內&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxOdDJEdEpEaVRYYnliaGRvZGk5eTlncFd1empUWUQxVndBM2llTGR3djRiTXFtSWl3Yk9FbDNyVkhVX3dMalJraWo3SWpIaFhScXdwY0pIcGswWUxHeXJqd3RtYTJpTFM1LV9aSTJ4TjlqbW9OdW10LUFYX3puX29mTHZlU1N6aEZJb3JhTVJNTGFKTUtFOU9RM1pack8wOFA1MHo5b2ZxWlVYM0pOWnl1T1NGTm1mNjRk?oc=5" rel="noopener noreferrer"&gt;GPT-6 Astra: Frontier intelligence for work, now available in Microsoft Foundry - Microsoft Azure&lt;/a&gt;）&lt;/li&gt;
&lt;li&gt;多供應商架構下的中斷容忍度設計（三家同倒&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNbC1hMkFydngzZzFNOVhaVkRJMWdlamN3WDhjTUNJYXEwZkZ2OEpqdXJ1emNSVnJuajZ0RTlrQWs3bjFGQmt1TllvUUVUWXBaTW1tQnpqUVBQZWdMbU1tRmw4LTg4b1ZrTUFlbVN1VXJNN2gwcHhjNTRXdUQwWFFhTTBfS1pXWDRuOTViTk1POTZQLWJIZUZnY1hEZllCOVpYTHRVQ19TM180VmhOLWdReFFmYw?oc=5" rel="noopener noreferrer"&gt;True AI-pocalypse as ChatGPT, Claude, and Grok all go down at once - theregister.com&lt;/a&gt;）&lt;/li&gt;
&lt;li&gt;算力採購的評估清單能不能寫出非 Nvidia 路徑&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQbHFNMjYzQzg1WXZTZHA1NXpkdGt6TmlSY3B2Zm9zblJSTWJTVzBJRmlpaHdBdUZuVG12eVd1UTJUQkg0THBaV2JsZ2wtejAzYWZWV1VBVXVkbndjaGN6cUtBSjNURHB1SkowSlZtX0Fidl9hcE1mNkxLU1JXZy1zcFpzRENLSWRuMHFzanpHRU5hYV9tRjY1YWZuQVJCb1M3X1VmYk9xQWlFX0ZfMEIzR2JMbEhwalB1bUVKREQ2c2tXLTRvbnhV?oc=5" rel="noopener noreferrer"&gt;Enterprises put non-Nvidia chips 14 points ahead of Nvidia's next-gen GPUs on their evaluation lists - VentureBeat&lt;/a&gt;
&lt;/li&gt;
&lt;li&gt;法規 / 出口管制對模型可商用範圍的實質篩選&lt;a href="https://news.google.com/rss/articles/CBMingFBVV95cUxNeWE5M2RRUEtsN3dGeHRteG9Fc3pjbmNXbDQ5U1BteGJhRTVIUDNUbnVQYTVtUGJwVDNrR3g2TWhRMzNEVUJsUVJGQ0llNURoUGF3NWxpeFlRRllCZ1pnLVRiNlhud1NPNm9wTVFPTEN2OGxvbVpCT1hBWGIxYndFak10bTIweUZDZHc2Y2hzQUVCdy03SFhnWlk2UXVqZw?oc=5" rel="noopener noreferrer"&gt;Pentagon Loads ChatGPT and Grok Onto Its AI Portal — Claude Is Nowhere in Sight - eGamers.io&lt;/a&gt;
&lt;/li&gt;
&lt;li&gt;中國前沿模型的商業化訊號——以 Moonshot 啟動港股 IPO 程序&lt;a href="https://news.google.com/rss/articles/CBMitwFBVV95cUxOQkZ2VVk5MzV1UVMzcTUtLXNxbTVRS1d5ZG5CM0g2SDdpd1AzUXZYMjQybkZlUzd3Z2pueklIVHM0d29JSjhxcHpScXdReXZVUk1GWGZrb2tvMWUyQmpsSUxxcm1GYzNZenNoX01IZVNwcVVQT04tRFpVQXF3RlJuV01JT3l0b1FvNUpld05uOVhiSGFLcENlZWVZdzhrdF9tSEhyWGhIY2RaTkVpRXI2WUlCeU5LZDjSAbcBQVVfeXFMT3M5ZjRrMGFOdEttTXJBeW9UTHNPclhXd2N4Q0l4NjBWWTI1ME0wakdad3B2bmlDY3dYWDNMV0pIZWYyWFB6TUI1VXpEdWgybVdKOWlxaDVlaG1RZXJrdVNoTTFRck5pLWM1ZUR0WURVZEJoS2RLaXBfNEtyRDdwN0l1Wi1ZMjFPdEtCUzNpSDBXOWVXVzIya3pXX3FIdGtGWEtPdnc4TUV2RFNxWmxvbVdQMEo1R2xF?oc=5" rel="noopener noreferrer"&gt;Moonshot AI – creator of Kimi K3 model – has filed for Hong Kong IPO: sources - South China Morning Post&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi6AFBVV95cUxNdWNDWVpPeGNqWnpRTDR3VjcwNjg1UkJ4MFJQWW54MnZXVnhiT2pTLU5ILXV6eXVwQWU2MFlKOVZvRXNWRFFCTnZiSWV2RnFHLVVPRE01UGRXMUNXTGFwQS1ianhqRE9yU1BDWXFjUWxhNW1IX2dwQmotQlR1YmVHRV9pM195eUpOa1dDQVlWdUFzNWZGSXJlcGFYNzU0VTkxRFlIQTZmb0MxMTJSSzlyLVZYalZsSkN5TXFNNTBmOVc0T0xJVDMwTVhBS0lCeENheWlleEFDRXJtUGJKVldxRERuTlRqNUtH?oc=5" rel="noopener noreferrer"&gt;Moonshot AI eyes Hong Kong IPO within six months as Kimi K3 drives $300M revenue run rate - TradingView&lt;/a&gt; 為代表&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;技術決策者本週最該做的不是再讀一份模型 changelog，而是把「中斷復原 SLA」、「多供應商 fail-over」、「採購評估清單上的非 Nvidia 路徑」、「政府客戶可用清單」這四項寫進下次架構審查。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>Which Flash To Run — 五個便宜模型的成本與能力實測</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Fri, 28 Aug 2026 02:18:54 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/which-flash-to-run-wu-ge-bian-yi-mo-xing-de-cheng-ben-yu-neng-li-shi-ce-4nfa</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/which-flash-to-run-wu-ge-bian-yi-mo-xing-de-cheng-ben-yu-neng-li-shi-ce-4nfa</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;2026-08-29 修訂。&lt;/strong&gt; 原文發表的隔天，成本那一半就過期了：GLM 從按量變成訂閱制（同一個 GLM-5.3-Flash 從 $0.05/M 變成邊際 $0，而且是第一方）、&lt;code&gt;deepcode&lt;/code&gt; 以價格理由退役、另外兩個&lt;strong&gt;完全免費&lt;/strong&gt;的 GLM 門開了出來。能力與量測那一半沒有動。完整改動列在文末〈修訂記錄〉。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;一句話摘要：&lt;/strong&gt; 便宜模型沒有總冠軍，但 2026-08-29 起有了明確順位——&lt;strong&gt;日常主力 &lt;code&gt;zcode&lt;/code&gt;（GLM-5.3-Flash，訂閱制邊際 $0），Codex 側 &lt;code&gt;baicodex&lt;/code&gt;（qwen3.8-flash，週配額邊際 $0）&lt;/strong&gt;；真的要按 token 付費才輪到 &lt;code&gt;opzcode&lt;/code&gt;。其餘差別不在牌價，而在到期日、隱形 thinking、被 hook 借走的 base_url，與權限的前提。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;p&gt;2026-08-27 實測，主角是五個便宜選項：三家 Flash（Qwen3.8-Flash、GLM-5.3-Flash、DeepSeek V4 Flash Vision-Exp）、Muse Spark 1.2 contributor、Dots3-Note preview:free。先講結論，再攤帳單與數字。&lt;/p&gt;

&lt;h2&gt;
  
  
  結論：按「你現在要做什麼」選
&lt;/h2&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;┌──────────────────────────────────────────────────────────────────────────┐
│  沒有總冠軍，但有順位：兩個邊際 $0 的門排前面                              │
├──────────────┬──────────────┬──────────────┬─────────────────────────────┤
│ 日常主力     │ Codex 側     │ 按量最佳     │ 完全免費                    │
│ zcode        │ baicodex     │ opzcode      │ z47code / z46vcode          │
│ $0 訂閱制    │ $0 週配額    │ $0.05 /M     │ $0 · glm-4.7 / 4.6v         │
│ GLM-5.3 Flash│ qwen3.8-flash│ 促銷至 09-09 │ 200K ctx · 後者吃圖         │
└──────────────┴──────────────┴──────────────┴─────────────────────────────┘
     跨檔大改 → opzcode / zcode（同模型，避開 qwen 的 NL2Repo 48.1）
     要 WebSearch → 目前沒有活路徑（見下）
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;情境&lt;/th&gt;
&lt;th&gt;用這個&lt;/th&gt;
&lt;th&gt;為什麼&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;日常主力（Claude Code）&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;zcode&lt;/code&gt;（glm-5.3-flash · BigModel 第一方）&lt;/td&gt;
&lt;td&gt;GLM Coding Plan Pro 訂閱制，&lt;strong&gt;邊際 $0&lt;/strong&gt;；agentic 四軸全第一、AA 指數並列最高。這是 &lt;code&gt;opzcode&lt;/code&gt; 跑的同一個模型，但走第一方且不按量計費&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Codex 側主力&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;baicodex&lt;/code&gt;（qwen3.8-flash · token plan · Codex）&lt;/td&gt;
&lt;td&gt;週配額已付過，邊際 $0；agentic 表現與 DeepSeek 同級（四軸各贏兩軸）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;真的按量付費&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt;（z-ai/glm-5.3-flash:floor · OpenRouter）&lt;/td&gt;
&lt;td&gt;沒有訂閱時的最佳按量價，blended $0.05；但促銷 2026-09-09 到期&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;跨檔案大改&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt; 或 &lt;code&gt;zcode&lt;/code&gt;（都是 GLM-5.3-Flash）&lt;/td&gt;
&lt;td&gt;Qwen 在 NL2Repo 掉到 48.1，輸 GLM 8.2 分且有使用者回報佐證&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;零成本 / 要吃圖&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;z47code&lt;/code&gt;（glm-4.7-flash）、&lt;code&gt;z46vcode&lt;/code&gt;（glm-4.6v-flash）&lt;/td&gt;
&lt;td&gt;官方標示完全免費、200K context；後者收影像與影片&lt;strong&gt;輸入&lt;/strong&gt;（V = vision）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;要 WebSearch&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;目前沒有活路徑&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;DeepSeek 官方端點是唯一真的回 &lt;code&gt;server_tool_use&lt;/code&gt; 的，但 &lt;code&gt;deepcode&lt;/code&gt; 已退役；ModelStudio 的 &lt;code&gt;/apps/anthropic&lt;/code&gt; 從來不觸發它&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;命名規則（2026-08-27 起）：裸名就是該家族的 flash，旗艦才加標記，標記用&lt;strong&gt;廠商自己的&lt;/strong&gt;字——Qwen 說 &lt;code&gt;max&lt;/code&gt;、DeepSeek 說 &lt;code&gt;pro&lt;/code&gt;。所以 &lt;code&gt;baicodex&lt;/code&gt; 是 flash、&lt;code&gt;baimaxcodex&lt;/code&gt; 是旗艦，&lt;code&gt;opgflashcode&lt;/code&gt; 改叫 &lt;code&gt;opzcode&lt;/code&gt;，&lt;code&gt;flash&lt;/code&gt; 不再出現在名字裡。&lt;/p&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;這條規則在 08-29 補了一個反例：&lt;/strong&gt; GLM 沒有自己的 tier 字。&lt;code&gt;glm-5.3&lt;/code&gt; 對 &lt;code&gt;glm-5.3-flash&lt;/code&gt;，頂規那個沒有名字，所以原本借用通用字的 &lt;code&gt;zmaxcode&lt;/code&gt; 改叫 &lt;strong&gt;&lt;code&gt;zglmcode&lt;/code&gt;&lt;/strong&gt;——廠商哪天真的出一個 GLM &lt;code&gt;max&lt;/code&gt;，借來的字就會撞名。&lt;strong&gt;沒有廠商自己的 tier 字時，用 family name，不要借一個通用的。&lt;/strong&gt;&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;三個到期日：&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;code&gt;opzcode&lt;/code&gt; 的 $0.05 到 &lt;strong&gt;2026-09-09&lt;/strong&gt;：Z.ai 在 OpenRouter 的促銷結束，那三家回到兩倍價。而且預設路由不會偏好便宜的那幾家——實測 18 次，裸 id 只有 10 次落在促銷價，加權後 $0.102/M input，比牌價貴 36%；現已釘 &lt;code&gt;:floor&lt;/code&gt; 壓回促銷價（20/20 命中）。&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;dotscode&lt;/code&gt; 的免費預覽到 &lt;strong&gt;2026-09-30&lt;/strong&gt;，屆時以「未知 id」400。&lt;/li&gt;
&lt;li&gt;
&lt;code&gt;baicodex&lt;/code&gt; 的 token plan 到 &lt;strong&gt;2026-10-23，且 auto-renew 是關的&lt;/strong&gt;（原文漏了這條）。到期時 &lt;code&gt;baicodex&lt;/code&gt;/&lt;code&gt;baimaxcodex&lt;/code&gt;/&lt;code&gt;baideepcodex&lt;/code&gt; 一起停。重買會&lt;strong&gt;發新的 API key&lt;/strong&gt;，不是續用舊的。&lt;/li&gt;
&lt;/ul&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  成本：牌價不是重點，帳單機制才是
&lt;/h2&gt;

&lt;p&gt;blended 按 7:2:1（cache hit : input : output）估。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;成本一覽（每 M tokens）— 純文字，無圖床依賴

zcode     █ $0.00  ████████████████████ 訂閱制邊際零成本  ← 新增
z47code   █ $0.00  ████████████████████ 官方標示免費      ← 新增
z46vcode  █ $0.00  ████████████████████ 官方標示免費・吃圖 ← 新增
baicodex  █ $0.00  ████████████████████ 邊際零成本（週配額已付）
dotscode  █ $0.00  ████████████████████ 免費預覽
musecode  █ $0.041 ████▎
opzcode   █ $0.05  █████▎  (不釘 :floor 實測 $0.068)
deepcode  █ ——     已退役（原 $0.23 尖峰）
          └──────────────────────────────
           $0        $0.10        $0.20
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Wrapper&lt;/th&gt;
&lt;th&gt;牌價 in / out（每 M）&lt;/th&gt;
&lt;th&gt;Blended&lt;/th&gt;
&lt;th&gt;我們實付&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;zcode&lt;/code&gt; — glm-5.3-flash · BigModel 第一方&lt;/td&gt;
&lt;td&gt;$0.075 / $0.25 促銷價 2026-09-09 止，之後約 $0.15 / $0.45–0.50&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0（Coding Plan Pro 訂閱）&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;z47code&lt;/code&gt; — glm-4.7-flash · 200K ctx&lt;/td&gt;
&lt;td&gt;官方標示免費&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;z46vcode&lt;/code&gt; — glm-4.6v-flash · 收影像輸入&lt;/td&gt;
&lt;td&gt;官方標示免費&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;$0&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;baicodex&lt;/code&gt; — qwen3.8-flash · token plan · Codex&lt;/td&gt;
&lt;td&gt;$0.15 / $0.47&lt;/td&gt;
&lt;td&gt;$0.088&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;$0&lt;/strong&gt;（plan 到 2026-10-23）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;dotscode&lt;/code&gt; — dots-3-note-preview:free&lt;/td&gt;
&lt;td&gt;$0 / $0&lt;/td&gt;
&lt;td&gt;$0&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;$0&lt;/strong&gt;（到 2026-09-30）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;musecode&lt;/code&gt; — muse-spark-1.2-contributor&lt;/td&gt;
&lt;td&gt;$0.10 / $0.20&lt;/td&gt;
&lt;td&gt;$0.041&lt;/td&gt;
&lt;td&gt;$0.041&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;code&gt;opzcode&lt;/code&gt; — z-ai/glm-5.3-flash:floor · OpenRouter&lt;/td&gt;
&lt;td&gt;$0.075 / $0.25 促銷價 2026-09-09 止&lt;/td&gt;
&lt;td&gt;$0.05&lt;/td&gt;
&lt;td&gt;$0.05（不釘 :floor 實測 $0.068）&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;del&gt;&lt;code&gt;deepcode&lt;/code&gt;&lt;/del&gt; — deepseek-v4-flash-vision-exp&lt;/td&gt;
&lt;td&gt;離峰 $0.22 / $0.66 尖峰 $0.44 / $1.32&lt;/td&gt;
&lt;td&gt;$0.115 / $0.23&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;已於 2026-08-29 退役&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;訂閱制的帳單形狀和按量完全不同，這才是 &lt;code&gt;zcode&lt;/code&gt; 排第一的理由。&lt;/strong&gt; GLM Coding Plan Pro 是雙視窗配額：&lt;strong&gt;每 5 小時 12,000 點 + 每週 60,000 點&lt;/strong&gt;。點數 = &lt;code&gt;(input×2.3 + cached×0.56 + output×8)/10000&lt;/code&gt;（flash 檔）。兩個關鍵性質：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;離峰只算一半點數，而尖峰只有週一至週五 14:00–18:00（UTC+8）那四個小時。&lt;/strong&gt; 早上、晚上、整個週末都是離峰——這跟 DeepSeek 尖峰蓋掉整個工作日是相反的形狀。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;配額用完是硬停，不是帳單。&lt;/strong&gt; 它不會回頭吃資源包或帳戶餘額，所以一個耗盡的視窗&lt;strong&gt;不可能超支&lt;/strong&gt;。這一點跟本文其他每一個按量端點都不同：那些用超了只會安靜地繼續計費。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek 的時段差價（歷史記錄，模型已退役）：&lt;/strong&gt; 尖峰只在週一至週五 09:00–12:00 與 14:00–18:00（台北時間 = UTC 01–04 / 06–10），週六日全天按離峰計價（2026-08-23 起）。留著這張圖是因為它正是 &lt;code&gt;deepcode&lt;/code&gt; 被淘汰的原因——尖峰蓋住整個上班時段，而兩個對手都變成了固定費率。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;台北時間（週一至週五）— 尖峰 2倍價，週末全離峰
 00         09         12   14         18         24
  ├──────────┼──────────┼────┼──────────┼──────────┤
  │  離峰    │   尖峰   │ 離峰│   尖峰   │   離峰   │
  │ ████████ │ ████████ │ ██ │ ████████ │ ████████ │
  │ 9h       │ 3h       │ 2h │ 4h       │ 6h       │
  └──────────┴──────────┴────┴──────────┴──────────┘
         週六日 ─── 全天離峰（半價）
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  關掉的門
&lt;/h2&gt;

&lt;p&gt;這些不是表上的選項了，列在這裡是因為名字還會出現在舊筆記和肌肉記憶裡。&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;deepcode&lt;/strong&gt;（2026-08-29 新增）— 以價格退役。自 2026-08-16 重新定價後 DeepSeek flash 按時段計費，而尖峰蓋住整個工作日；對手同時都轉成固定費率（GLM 訂閱、qwen 週配額邊際 $0）。它唯一的差異化能力——&lt;strong&gt;唯一真的實作伺服器端 &lt;code&gt;web_search&lt;/code&gt; 的 DeepSeek 表面&lt;/strong&gt;（回 &lt;code&gt;server_tool_use&lt;/code&gt; + &lt;code&gt;web_search_tool_result&lt;/code&gt;）——不足以養活一個沒有價格利基的按量 wrapper。復活的方式是拿掉表上的退役標記。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;ocode&lt;/strong&gt; — 已停用。Go plan 對每個模型都回 &lt;code&gt;CreditsError&lt;/code&gt;，但 &lt;code&gt;qwen3.8-flash&lt;/code&gt; 回的是 &lt;code&gt;ModelError: not supported&lt;/code&gt;——後者不是帳務症狀，就算續訂也接不到 flash。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baicode / baiflashcode&lt;/strong&gt; — ModelStudio 的 Claude Code wrapper 全數移除。token plan 的 Anthropic 路徑（&lt;code&gt;/apps/anthropic&lt;/code&gt;）是沒有內建 server tools 的端點，留著等於讓缺口被誤觸，整家改走 Codex 的 &lt;code&gt;compatible-mode&lt;/code&gt;。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baiflashcodex&lt;/strong&gt; — 併入 &lt;code&gt;baicodex&lt;/code&gt;，刪掉不是留 alias——留 alias 會讓舊肌肉記憶繼續指向貴的那一個。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;baimaxcodex&lt;/strong&gt; — 仍在，但在觀察名單上。qwen3.8-max 慢、有幻覺，該淘汰；留著只是佔住旗艦位置等 Qwen 下一版。&lt;/li&gt;
&lt;/ul&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;退役機制本身也被改掉了（08-29）。&lt;/strong&gt; 原文說 &lt;code&gt;ocode&lt;/code&gt; 是「把 key 註解掉」——那是錯的形狀，而且當天就被推翻：&lt;code&gt;~/.secrets&lt;/code&gt; 是&lt;strong&gt;每台機器各自的&lt;/strong&gt;，所以同一個退役在一台讀 &lt;code&gt;inactive&lt;/code&gt;、在另一台讀 &lt;code&gt;active&lt;/code&gt;。改成在表上標 &lt;code&gt;retired = true&lt;/code&gt;（軟刪除）+ 每列一份帶日期的 &lt;code&gt;events&lt;/code&gt;。&lt;strong&gt;退役是資料，不是註解掉的環境變數。&lt;/strong&gt;&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  能力：廠商自評
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;—&lt;/code&gt; 表示該廠商沒公布，不是零分。&lt;code&gt;*&lt;/code&gt; 標該列最高。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;能力對照（廠商自評，非獨立複現）

Terminal Bench 2.1    GLM  84.3*  DeepSeek 82.7  Vision-Exp 83.9  Muse 82.9△  Dots 75.1  Qwen —
DeepSWE v1.1          GLM  63.4*  Qwen 58.7  DeepSeek 54.4
NL2Repo               Vision-Exp 57.7*  GLM 56.3  DeepSeek 54.2  Qwen 48.1
Toolathlon Verified   GLM  78.4*  Qwen 73.5  DeepSeek 70.3
Agents' Last Exam     GLM  26.3*  DeepSeek 25.2  Qwen 24.3
SWE-bench Pro         Qwen 62.5*  DeepSeek 56.0 (*Qwen重測)
AA Index              GLM 57*  Muse 57*  Dots 55.9‡  DeepSeek 52
速度                  DeepSeek 120 t/s*  Vision-Exp 85  Qwen 51  GLM 50
TTFT                  Vision-Exp 0.90s*  DeepSeek 1.05s  GLM 1.47s  Qwen 3.42s
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Benchmark&lt;/th&gt;
&lt;th&gt;GLM-5.3 Flash&lt;/th&gt;
&lt;th&gt;Qwen3.8 Flash&lt;/th&gt;
&lt;th&gt;DeepSeek 0731&lt;/th&gt;
&lt;th&gt;DeepSeek Vision-Exp&lt;/th&gt;
&lt;th&gt;Muse 1.2&lt;/th&gt;
&lt;th&gt;Dots3 Note&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Terminal Bench 2.1&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;84.3&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;82.7&lt;/td&gt;
&lt;td&gt;83.9&lt;/td&gt;
&lt;td&gt;82.9 △&lt;/td&gt;
&lt;td&gt;75.1&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSWE v1.1&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;63.4&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;58.7&lt;/td&gt;
&lt;td&gt;54.4&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;NL2Repo&lt;/td&gt;
&lt;td&gt;56.3&lt;/td&gt;
&lt;td&gt;48.1&lt;/td&gt;
&lt;td&gt;54.2&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57.7&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Toolathlon Verified&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;78.4&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;73.5&lt;/td&gt;
&lt;td&gt;70.3&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Agents' Last Exam&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;26.3&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;24.3&lt;/td&gt;
&lt;td&gt;25.2&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SWE-bench Pro&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;62.5&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;56.0 *&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;SWE-bench Verified&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;78.4&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;AA Intelligence Index&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;52&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;57&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;55.9 ‡&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;輸出速度&lt;/td&gt;
&lt;td&gt;50 t/s&lt;/td&gt;
&lt;td&gt;51 t/s&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;120 t/s&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;85 t/s&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;首字延遲 TTFT&lt;/td&gt;
&lt;td&gt;1.47s&lt;/td&gt;
&lt;td&gt;3.42s&lt;/td&gt;
&lt;td&gt;1.05s&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;0.90s&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;td&gt;—&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;這些數字不能直接比：&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;△ Muse 的 82.9 跑在 Meta 自家的 Muse Code agent 裡，模型跟 harness 共同訓練；我們的 &lt;code&gt;musecode&lt;/code&gt; 是 Claude Code。&lt;/li&gt;
&lt;li&gt;* SWE-bench Pro 56.0 是 Qwen 自己重測 DeepSeek 的結果，來源不同。&lt;/li&gt;
&lt;li&gt;‡ Dots3 的 55.9 來自 ModelCap 指數，不是 AA 指數。&lt;/li&gt;
&lt;li&gt;Qwen 的空格：Terminal Bench 2.1 至今無公開數字；同代 Max 86.6、27B 73.0，Flash 夾中間是推測所以留空。&lt;/li&gt;
&lt;/ul&gt;

&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;原文一處把數字掛錯了模型（本次修訂）：&lt;/strong&gt; 舊版的結論表寫「&lt;code&gt;deepcode&lt;/code&gt; … 輸出 120 t/s 全場最快」，但 &lt;strong&gt;120 t/s 是 DeepSeek 0731 那一列&lt;/strong&gt;（&lt;code&gt;baideepcodex&lt;/code&gt; 跑的 id），而 &lt;code&gt;deepcode&lt;/code&gt; 指的是 Vision-Exp，同一張表上是 &lt;strong&gt;85 t/s&lt;/strong&gt;。Vision-Exp 真正拿第一的是&lt;strong&gt;首字延遲 0.90s&lt;/strong&gt;。「要快」的論據應該是 TTFT，不是吞吐——這個錯誤在同一篇文章的兩張表之間就能對出來。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  牌價看不出來的成本
&lt;/h2&gt;



&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight plaintext"&gt;&lt;code&gt;┌─────────────┬──────────────────────────────────────────────────────────┐
│ plugin hook │ Stop hook 借用 ANTHROPIC_BASE_URL，跑它自己寫死的模型     │
│  ← 新增      │ 41 sessions / 578 responses，wrapper transcript 看不到    │
├─────────────┼──────────────────────────────────────────────────────────┤
│ musecode    │ Thinking 爆量：say ok 輸入 9 → 輸出 165（154 thinking）  │
│             │ 實付 $0.20/M 在瑣碎工作上行為像 ~$1/M                     │
│             │ Contributor 層拿資料換價格（貴 19 倍才不訓練）           │
├─────────────┼──────────────────────────────────────────────────────────┤
│ dotscode    │ 上游 AtlasCloud content_filter 偶發切斷，無第二家可繞    │
│             │ 免費到 2026-09-30，到期 400                              │
├─────────────┼──────────────────────────────────────────────────────────┤
│ opzcode     │ 12 家只有 3 家給促銷價，不釘 :floor 加權 $0.068          │
│             │ :zzzz 200 照常計費分不出來，只有 @provider 才 400        │
│             │ 2026-09-09 後 :floor 從省錢變風險（262k context 陷阱）  │
├─────────────┼──────────────────────────────────────────────────────────┤
│ 三家權限    │ musecode/dotscode/opzcode 皆 skip_permissions=true       │
│             │ 省錢但整套權限系統關掉（分類器拿不到 claude-opus-5）     │
└─────────────┴──────────────────────────────────────────────────────────┘
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;&lt;strong&gt;plugin hook 會借用你的 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt;——而且不會沿用你釘的模型。&lt;/strong&gt;（2026-08-29 新增，是本節最隱形的一種。）&lt;code&gt;security-guidance&lt;/code&gt; 這個 plugin 的 &lt;strong&gt;Stop hook&lt;/strong&gt; 會在每次停止時把 git diff 送去做安全審查，走的是 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt;，但模型是它自己&lt;strong&gt;寫死的 &lt;code&gt;claude-opus-4-7&lt;/code&gt;&lt;/strong&gt;，完全不理會 &lt;code&gt;ANTHROPIC_MODEL&lt;/code&gt;。每次審查都是一個&lt;strong&gt;獨立 session&lt;/strong&gt;，在 wrapper 自己的對話記錄裡看不到任何痕跡——它是從&lt;strong&gt;帳單&lt;/strong&gt;上冒出來的：DeepSeek 帳上 41 個來路不明的 session、578 則回應；同一個 hook 在 &lt;code&gt;zcode&lt;/code&gt; 底下跑 glm-4.7，在 OpenRouter 底下跑的是&lt;strong&gt;真的要付錢的 &lt;code&gt;anthropic/claude-opus-4.7&lt;/code&gt;&lt;/strong&gt;。已於 08-29 停用。&lt;/p&gt;

&lt;p&gt;啟用任何帶 hook 的 plugin 之前，先問它會往 &lt;code&gt;ANTHROPIC_BASE_URL&lt;/code&gt; 送什麼。注意設一個 &lt;code&gt;SECURITY_REVIEW_MODEL&lt;/code&gt; 只會換掉&lt;strong&gt;是哪個第三方模型&lt;/strong&gt;在回答，不會改變「有一個模型在回答」這件事。&lt;/p&gt;

&lt;p&gt;&lt;em&gt;這不影響本文的費率數字&lt;/em&gt;：OpenRouter 的實付費率是由&lt;strong&gt;每一則回應自己的 &lt;code&gt;cost_details&lt;/code&gt;&lt;/strong&gt; 反推的，是 per-response 的量測，不是帳單總額，所以多出來的 hook session 不會混進去。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;musecode — Thinking 爆量，且拿資料換價格。&lt;/strong&gt; 實測一句 &lt;code&gt;say ok&lt;/code&gt;：輸入 9 token，輸出 165，其中 154 是 thinking，且回的是 &lt;code&gt;redacted_thinking&lt;/code&gt; 看不到內容。token plan 同題只花 25/34/32。照此比例 $0.20/M 的 output 在瑣碎工作上行為像 ~$1/M。Contributor 層會拿輸入與輸出訓練 Meta 模型，標準層才有不訓練承諾但貴 19 倍。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;dotscode — 上游有輸出過濾器。&lt;/strong&gt; 正常技術對話被 &lt;code&gt;finish_reason: content_filter&lt;/code&gt; 切斷；OpenRouter 審核未介入（&lt;code&gt;moderation_latency: null&lt;/code&gt;），是唯一 provider AtlasCloud 做的，沒有第二家可繞。以同樣文字重測三次全過，偶發非必現。Free preview 到 2026-09-30，屆時以「未知 id」400。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;opzcode — 三個陷阱：&lt;/strong&gt; 1) 牌價不是實付價，12 家 endpoint 只有 3 家給促銷價（Z.AI、Novita、GMICloud），8 家兩倍，Venice +25%，預設路由不會偏好便宜的——不釘 &lt;code&gt;:floor&lt;/code&gt; 實測 $0.068；2) 打錯後綴不會報錯只會多付錢，&lt;code&gt;:zzzz&lt;/code&gt; 回 200 照常計費，&lt;code&gt;model&lt;/code&gt; 欄位分不出來，只有 &lt;code&gt;@provider&lt;/code&gt; 才 400；3) 2026-09-09 後 &lt;code&gt;:floor&lt;/code&gt; 會從省錢變風險——它是照價格排序，到期後便宜格會混進 context 只有 262k 的 provider，而此列宣告 1M，宣告過高不會在啟動時報錯，會讓對話在工作中途被拒。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;三家都關了權限：&lt;/strong&gt; &lt;code&gt;musecode&lt;/code&gt;、&lt;code&gt;dotscode&lt;/code&gt;、&lt;code&gt;opzcode&lt;/code&gt; 皆 &lt;code&gt;skip_permissions = true&lt;/code&gt;——整個權限系統關掉。原因是 auto mode 分類器會去解析第一方的 &lt;code&gt;claude-opus-5&lt;/code&gt;，在這些端點上拿不到，每個受管制呼叫都會死。（注意 &lt;code&gt;zcode&lt;/code&gt; 與 &lt;code&gt;baicodex&lt;/code&gt; &lt;strong&gt;不在&lt;/strong&gt;這份名單上——排前面的兩個門沒有付這個代價。）&lt;/p&gt;




&lt;h2&gt;
  
  
  修訂記錄
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;2026-08-29&lt;/strong&gt; — 發表隔天的四類改動：&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;順位改了。&lt;/strong&gt; GLM 轉為 BigModel Coding Plan Pro 訂閱制，同一個 GLM-5.3-Flash 走第一方 &lt;code&gt;zcode&lt;/code&gt; 是邊際 $0，因此排到日常主力；原本的「按量最佳 &lt;code&gt;opzcode&lt;/code&gt;」降級為「沒有訂閱時的按量最佳」。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;&lt;code&gt;deepcode&lt;/code&gt; 退役&lt;/strong&gt;，「要 WebSearch 或要快」那一格因此沒有活路徑；同時修正退役機制的描述（表上軟刪除，不是註解掉 key）。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;補進兩個完全免費的 GLM 門&lt;/strong&gt; &lt;code&gt;z47code&lt;/code&gt; / &lt;code&gt;z46vcode&lt;/code&gt;，以及 &lt;code&gt;baicodex&lt;/code&gt; 漏掉的 plan 到期日 2026-10-23。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;修掉一個原文內部矛盾&lt;/strong&gt;：120 t/s 被掛到 &lt;code&gt;deepcode&lt;/code&gt; 上，但那是 DeepSeek 0731 的數字，Vision-Exp 是 85 t/s（見能力表後的說明）。另外新增「plugin hook 借用 base_url」這一項隱形成本。&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;能力數字全為廠商自評，本次未變動。agentic 四軸（DeepSWE / NL2Repo / Toolathlon / Agents' Last Exam）取自 r/LocalLLM 使用者彙整對照表，已與各廠商公布值交叉核對；Terminal Bench 2.1 的 84.3 與 82.7 為獨立查證吻合。成本與模型回應為 2026-08-27 實測；OpenRouter 實際落點費率由每次回應自己的 &lt;code&gt;cost_details&lt;/code&gt; 反推，非牌價。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>productivity</category>
      <category>devtools</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-21 to 2026-08-28 | Silicon moves on both sides, and Claude gets a browser</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 27 Aug 2026 23:05:40 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-21-to-2026-08-28-china-ships-chip-only-frontier-models-claude-gets-a-1jfc</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-21-to-2026-08-28-china-ships-chip-only-frontier-models-claude-gets-a-1jfc</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Z.ai's share price moved 8% after it released a model that runs only on Chinese chips&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;, and the same company — Zhipu, which operates as Z.ai — put out GLM-5.3-Flash with the explicit claim that the model runs on 100,000 domestically made chips&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;. The deployment substrate is now the news.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  China ships chip-only frontier, not just demos
&lt;/h2&gt;

&lt;p&gt;Zhipu released GLM-5.3-Flash, with the explicit claim that the model runs on 100,000 domestically produced chips&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;. CNBC's reporting on Z.ai's stock move describes a new AI model running only on Chinese chips&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;; Yahoo Finance framed the stealth model Ox Alpha as a DeepSeek rival&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxPNnVLcXB0ZGtkTHVaMC1EYkV2aHE1eHVaLTB5ZGtMZnc5SUw0NmVDT3NkLXhCTEprODJ3QURqcGg0S3hNa0w4MXQ3S0VLMlBKMnlNUlhPbzY1d1h2dlMwelBzeDhQUHg4TDJPYXVhMTBvVXo5WlZ2cHFPdExOcjNhbXZxdHZMOGE5cmc?oc=5" rel="noopener noreferrer"&gt;China’s Z.AI Made Ox Alpha Stealth Model That Rivals DeepSeek - Yahoo Finance&lt;/a&gt;. Zhipu has since confirmed that Ox Alpha &lt;em&gt;is&lt;/em&gt; GLM-5.3-Flash and released the model weights&lt;a href="https://news.google.com/rss/articles/CBMipAFBVV95cUxQUXZ6MmE5azY5LVZoV0xlM21vWFE2czZIMENGV0h1LTNyazRySExMSmxpNklQTE5BWUU4RlBNWVRTTGhCTnFpVlU5TVBxbmx5Q3E5Yk54X0s5OWJsQ09XeFlZSWtVaTJmNE1mejlXRU9MeHlnbXFPTVBPcTVmUU5aYUdqRElWYUx2TjlMc1RlajB0VGw5UFdMTWs2eHhraUZEcjBsWg?oc=5" rel="noopener noreferrer"&gt;Zhipu identifies Ox Alpha as GLM-5.3-Flash and releases model weights - TechNode&lt;/a&gt; — one model, not two. Treat the "100,000 chip" figure as a vendor claim — Global Times headlined it, not an independent benchmark, and a 36 Kr piece the same week flagged why that headline has not translated into dominant global mindshare&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9fS183LXk5ZENZU25Uc2dxWXBaZ1VxYWhhLXJuNTFNaG9jV3lnTUhoeTJVVzZWY3Vib25uTUlUdG1hdGd2NWhqMlFFbWxzTUtuWWhj?oc=5" rel="noopener noreferrer"&gt;Why Didn't the High-Power GLM-5.3 Dominate Global Social Media Feeds? Core Barriers &amp;amp; Hidden Truths Uncovered - 36 Kr&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;What is worth separating: this is not a research artifact. Z.ai's share price moved on the release&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;, which means the company is treating it as a commercial event. The engineering question for buyers is narrower than the geopolitics — if a model is restricted to a specific accelerator, that is a deployment constraint on par with context-window or license restrictions. For most teams outside China this is "announced and available" at best, not "commercially usable" in a general sense, because the silicon constraint is the product.&lt;/p&gt;

&lt;h2&gt;
  
  
  Smaller Qwen, and the Chinese pricing pressure on US clouds
&lt;/h2&gt;

&lt;p&gt;Alibaba released a smaller Qwen variant — Bloomberg frames it as smaller and cost-effective&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxOVFN2VVNaUWE0bXJiNjQ2VWJlbngtWlpzcnY3RG44VlB1eVVhMWNiT21wYmVKSDJnQ0JkNXMycVg5bWRqQ2RIZ3E0d0hzdkEzUlNPV05aUjRUTFhzaXlNdVhVSHFXNGRuZFlPWUhEeEtKemMwdWJValR0MFpZM19OMVRpS1piVVhZWEI3ZmdJZmlDR1B5d2JMRU5DcENuSUktd01Ra0J6Zw?oc=5" rel="noopener noreferrer"&gt;Alibaba Releases Smaller, Cost-Effective Qwen AI Model - Bloomberg.com&lt;/a&gt;, Reuters describes Qwen3.8-Flash as lower training cost&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQNFBiN0MydXZkUlB3UHdHb0xzNGNqVVhKdzZVMkQwalM4WWozbUxWSkZuRTljSXdfdjdOUjZkMWN2SEVRSnBXTEJwSlJfdkNqNzJreVp5MDNULVdDZ1ozSzE1YXp6dWR6MzZsOFBlRllhdlZEQmVBa1Eyb1hpQWlMWmdUaGlzeFpUZFlDZUszLU5KRG9SblF0VTNFT092TllTQnVqVlZHY2J3Uk1WblBfOUJGRmFob041dzEwRV9WaU5TWjlxbkswcTVJRQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen launches Qwen3.8-Flash AI model with lower training costs - Reuters&lt;/a&gt;. The interesting design choice is "smaller" rather than "bigger": the production economics of inference at scale are pushing vendors toward variants you can actually serve on commodity capacity.&lt;/p&gt;

&lt;p&gt;Moonshot's move is the more aggressive end of the same pressure. The Next Web reports Moonshot wants 30% of what US clouds earn from Kimi K3&lt;a href="https://news.google.com/rss/articles/CBMic0FVX3lxTFA0d0pQa2RVQTl3UUVMTHJNZWRYTV9LSHcxX2kwYXlzVzFOVlBVUjd0UG8tcV9yUHlzQTVvUXRpVkV2UlhLSFBFYTFqbmtHX2ZKNnNxWDdRMmN5WnhoVnlNNk8yTFhSaGxDMHpGX0ZHMWdiMlE?oc=5" rel="noopener noreferrer"&gt;Moonshot AI wants 30% of what US clouds earn from Kimi K3 - The Next Web&lt;/a&gt;. That is a revenue-share demand on the hosting layer, not a model-pricing decision. The Times of India coverage adds the political context — the US government previously accused Moonshot of stealing Anthropic tech&lt;a href="https://news.google.com/rss/articles/CBMizgJBVV95cUxPZS1vMTlZVi15emhSeUpMdGFRQV8yNENQUl9aV0hvNDRoQU05VzVfRGJCTW1mOERvS3kzcVFMdzFBbmw4bEM5bE9mLVlHVy1EaUlJeFhSbTNpcU0tTjllUlNiOWVITTlhTElLV3NiRnUxalRIc3BiRWFOenAzc3Vyd3Jxa2JVcmZkNHM4SE5ZMU1Wc2pVNDVZRnlOQ0ZPR3B0NXJXamdDeWxyalJFbngtMWtOcDFTQzdQckZJSnZ5VkVlZkZ1azJPVTJVQnlFLWFua01IUWZ4YjE2VV8xOXVGOTltcDhZWTlRNnRlRDYwM1Q0UkxDLURYbmtKc1VWLThzSDg4dFR3TGJzWHF1R1Y5SDRuYkxUNzM2MXBCMlR4OWRVX3VWdHppRkpuSGZGcll6NmZ1YkQ5OG52UVllS0Q5QW41S1AtMzBNOVZtU21B0gHTAkFVX3lxTE10SjBEUHFESnpWU1V5SXBMWUNKZXBsV283MllFZHloQVFveWxfaUo4UDBvbmNTeHRQSkJxNmFyZXF2VWlGVEdYaGZEby1EMHFJTGJGa2EteURSMURNTnFVYldubW4tQ0pVRUZUME5NZWlmMXdia2Z2c2FYS2FfekFydWtkNklpMTU4VEMyd21Rd0ZPbDVLdGVNZXZjRmg2U0hfd1V5SkRseDd3RnI5cFlSOU5ZV0dNNzMwZndxanQ0dHV6Zld5OE9rNHpSeElhQVdCd1lidG9oRzdSOE1RMTRDaVZSYWxkZzIyRWI0SllHQldGWHlldXRxeFdmc0h0VWtUdlB6b0g4T3o0SEFOZFFjUnFaMl9wOFVfMVhvYXkzakRyRHFNSXJDZ1QzRWNOTm5YT3o2dzZ0aXBQWUZ2VTJ0T0V4ZEdvQXhBUVk4SUV0WmZ6UQ?oc=5" rel="noopener noreferrer"&gt;Kimi K3 AI model maker Moonshot AI, which US government accused of ‘stealing’ Anthropic's tech, may make - The Times of India&lt;/a&gt; — but the engineering read is simpler: if your model is good enough to be a default on a hyperscaler, you have leverage to extract rents from the cloud's gross margin instead of competing on per-token price.&lt;/p&gt;

&lt;p&gt;For a buyer, the practical takeaway is not "Chinese models are cheaper" — it is that inference economics are bifurcating. There is a frontier track where cost is subsidized by ecosystem capture (cloud revenue share, hardware lock-in, agentic platform fees), and a commodity track where you pick whichever small model clears your quality bar at the lowest per-token price.&lt;/p&gt;

&lt;h2&gt;
  
  
  Claude gets a browser, and the "AI as platform" thesis hardens
&lt;/h2&gt;

&lt;p&gt;The New Stack reports Claude now has a browser of its own&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;. This is the most concrete piece of the agentic-platform thesis landing in user space: if the model controls the browser surface, the integration boundary that most current "agent" stacks hit — the DOM-as-API assumption — collapses. The capability that matters is not "Claude can browse"; it is "Claude can hold an authenticated session as a first-class citizen instead of poking at a headless instance from outside."&lt;/p&gt;

&lt;p&gt;The counterweight is the institutional churn. WSJ reports Google moved its AI-responsibility team out of DeepMind in a structural shake-up&lt;a href="https://news.google.com/rss/articles/CBMisAFBVV95cUxOOVhUck1oeDZzYU9nRTZWZTBRSERrb2pNWVk3aTZOMVFuZG5ubjFGbld4QXRLdThLQ1JuS0h0S0Q2ZjdsX1Y0Qm0xQjA3T3hLV014MzVqWTRNWGtjVWlyQ2otd1pIUjBqUjZBM3k5TTVpcnIxSngyTkk1eVNZU2hxcnR0MHJad1J0ZmtSN3dpR2p2N3pSRmNORnNPQzV5VUgxNGM0dE5DaGF5Y0FqUkd3eg?oc=5" rel="noopener noreferrer"&gt;Exclusive | Google Moves AI-Responsibility Team Out of DeepMind Lab in Latest Shake-Up - WSJ&lt;/a&gt;, and Fortune's data shows DeepMind losing grip on elite AI talent&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxObS1iQWJMUFcyT0FoTjdGcXB6VFFJTjEyYnd4OVlTalVieFFQcC1veTdKX0tmc2Q3bWtCTmNraGhvZVJyeFlENlBFLUUwWTRGd2lQTU96X3Z1dzBDb05tVTZHdV95eDVfRTVYdjV6MG1SZ1kzczJPbnpreENwdHpJRTBBRnhWQzByYmhGRlNqUzF4cm1oRHpJOE5TSzRZeWZoTmpz?oc=5" rel="noopener noreferrer"&gt;Google DeepMind is losing its grip on elite AI talent, new data shows - Fortune&lt;/a&gt;. Two adjacent facts from the same week — Claude shipping an agentic browser and the lab that defined the modern agent research agenda losing people — are worth holding together.&lt;/p&gt;

&lt;p&gt;Salesforce and Anthropic announced Claudeforce — CNBC frames it as Benioff responding to "SaaSpocalypse" concerns&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxNeDU0UHo4UERDMHZlcjVyV1I4S0dWWEQ1SGhYOXFURmJmZUJiZHpud1pGVXRKQmx1ZXl6Sy01NjBkTlkyQXFRWEJfeTVkYXVHODNvZ0p3YTVudnVSNEN4WTJQLWpad0JJa09WZ1Roay1JZ3JUZDlNdFJNRGNZYzMyNHd1TmRzTVJQ0gGOAUFVX3lxTE5oWUF2YXIzVjUzOE5zUzVNT05nemItSm9rdm1OMmRvQWFPc05NRWVteG5mNnM3dmtzSHZOYlowYTNFTnNFT0M0UmY3ZTRhN1FGTUV1U1NKcnZhcUp0LUpVU2dMa1ZCazZvSUFWNTNBNWhzNlUtekUwR1J1a2UtZ25wT3JaVzUzZGFWV1BpX1E?oc=5" rel="noopener noreferrer"&gt;Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concerns - CNBC&lt;/a&gt;, and Salesforce's own release markets it as the #1 AI meeting the #1 AI CRM&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;. The honest read: this is a vendor announcement, not yet a shipped capability surface, and "agentic CRM" as a category is still mostly demos over real customer workflows. Worth watching for the integration story (where Claude lives in the Salesforce admin model, what data flows without a human-in-the-loop), not the press conference.&lt;/p&gt;

&lt;h2&gt;
  
  
  Speech-to-text gets opinionated, and Google's vertical push continues
&lt;/h2&gt;

&lt;p&gt;Google announced Gemini 3.5 Transcribe&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPSGx5ZU85MkhfYTUweHk3X2NteExrRTRxRUlGOTZ5QVVIalBjcDlVSGhKRkJzV1BuMG5RSm9ZXzhqYlNBMU1HYW9TS0JpZ1F6dGV2a3EyRC1qTk50Z0dxWDJ0MzBZQ1g4OXEzbThidVcxUFRHeWhvLXBUcC1yUUx6ZG9GOFZpVGdxN2h5YmtBTDVFd1ZyY1NSdUV2TDc5cmpZdnctREN1Yw?oc=5" rel="noopener noreferrer"&gt;Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text - Ars Technica&lt;/a&gt;; The Verge adds the design detail that it edits out "ums" and "ahs"&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9vLXhKVjRXQnEtLXZyWGZGbkU1OEF3RU55dUJlYjVGbVZMQkJJblVrX2hINVNudjhXNHQ4dzNNS1o2T0d3S2xGMmFKMDJpejhmQ3ZubldHSXBPTUNQYkRtUEJLeVpYTkNzcmRrTS0zV2d3eVowNG8zTVNjb0hxMFE?oc=5" rel="noopener noreferrer"&gt;Google’s new AI transcription edits out your ‘ums’ and ‘ahs’ - The Verge&lt;/a&gt;. Apple shipped this kind of cleanup years ago in Voice Memos and Messages; Otter and Krisp have done it for meetings. The question is whether Google's transcription now meets that bar in latency and accuracy, because the underlying Whisper-class models have been "good enough" for a while and the differentiator has become cleanup heuristics and per-language coverage, not raw WER.&lt;/p&gt;

&lt;p&gt;Reuters separately reports Google expanding Gemini Enterprise for law firms&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPZk81aGh3d2lJX0FucWpwclltdnRJd3RqNVpTWnhMeGNBU3FUeWRIby1lcEpQQ3NOT1VaWjRlU19vT1lmVzdMTEpjbm16eTh4MTdvbGRtN1ZQb243eVZ2aF9Sd19PMEtzd2ZpbGV2R0p5SzZRTGJLNkE4TGNZUmtxVnlvVGx1NlVYQkIwMmEwRnV6RGxEQ1BvTGIzNGE?oc=5" rel="noopener noreferrer"&gt;Google expands Gemini Enterprise AI platform for law firms, lawyers - Reuters&lt;/a&gt;. This is the same vertical-integration playbook as Microsoft Copilot for clinical notes or Palantir for defense: pick a regulated industry with high willingness to pay and resell the same model inside a workflow-shaped product. The capability is not new; the procurement channel is.&lt;/p&gt;

&lt;h2&gt;
  
  
  Voice from the outside: Bill Gates on AI risk
&lt;/h2&gt;

&lt;p&gt;Gates warned that AI could drive mass unemployment and cyberattacks&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE9wYm5vZ1JCeVVwQUpRMGJ1NjZhR3hVZ01FWGFuelVJOV80UG91QnFJaTRRSTd4amFlTnBWS1NNdDM4RE42NzZuUlpoMTYxUk9sYkdLTTIxTGNsSzNxeHF1VkdBR1pqc2pCQmNmNDZfNA?oc=5" rel="noopener noreferrer"&gt;Bill Gates warns AI could lead to mass unemployment, cyberattacks - Politico&lt;/a&gt;, and Fortune expanded the list to three risks — stunted child development, emboldened criminals, and vanishing Gen Z jobs&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxOak5GWWx5dS1VdEFKWF9NRzNuRjlMZGdqU3BSLVg4OUFWb2w4WFJTZEdUS2ZFbTRwU1ROc1JCLXlBejdMYkNsT1djNGFvc1B1VTBvZF92T0gtVkVhZnJFN3BpeEpnRU1yVmtXN2k3Y2IxUktQT05JTmRXbVR6QWhmRkRkRVlxaXpQ?oc=5" rel="noopener noreferrer"&gt;Bill Gates fears world leaders are unprepared for 3 major AI risks: 'Stunted' child development, emboldened criminals, and vanishing jobs for Gen Z - Fortune&lt;/a&gt;. Worth taking seriously as policy signal, less so as a technical input — these are governance predictions from someone with political weight, not deployment guidance. The engineering takeaway from this week's actual shipped work is the opposite of "mass displacement imminent": most of the items above are vendor announcements, not capability shocks.&lt;/p&gt;

&lt;h2&gt;
  
  
  The other silicon story: OpenAI's own inference chip
&lt;/h2&gt;

&lt;p&gt;The same week, the US side moved on silicon too, in the opposite direction. China's play is routing around Nvidia; OpenAI's is taking its own inference cost back from Nvidia. OpenAI published first results for Jalapeño, its in-house inference chip, claiming industry-leading speed and efficiency on AI inference&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTFBwMGNpOVlmLU9XdHlqemwwb2ZIRmRab3cyUTJnZ0x4UGVtWWZkMzYwb0thVlY5QVhSYXVaQ0xCRllRQUFuVE9FVUtac3FxUFM3T0Nfc0ItUTAzOVRP?oc=5" rel="noopener noreferrer"&gt;Jalapeño’s first results show industry-leading speed and efficiency in AI inference - OpenAI&lt;/a&gt;. SemiAnalysis headlined its read "Better Than Nvidia Blackwell"&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE0wUWNzQzNua3BlcVlyRkQ3cVAza2pXdjNZLWZVVWFyakZqWmhXVnlYYXFvbzA5d2VmNVpyeTdlY29SSEFJZ3VQWVl1YmtGcERjS01MR1ljM1ZiN3d0UWFhVDNsQUZLUmIyaUNlT1Vya3N6SV8wZjRrMzhLR2c?oc=5" rel="noopener noreferrer"&gt;OpenAI Jalapeño: Better Than Nvidia Blackwell - SemiAnalysis&lt;/a&gt;; CNBC's angle is the pressure on Nvidia's margins as custom silicon gains ground&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5VdHlNWkdYQUJBdVV5c1luMDFlQVYyZnNzRFV3X3kweGY0ZG5IMVpfTE5Qd2JIdkMyaDZOOUJHZm0xU2FUcGdDT3Fzd0lITzd3NjRSbTJGYWNXWnVLV08yXzRUNUtSVGI0WFBlMHZMUk9FNFZCOXfSAXtBVV95cUxPREVoZVc1MjZnZzRDZ1diQ19ET2RQRURoYWtNUmNUUE1sSkgwZWJWZFl5M09MeHgyZjVYVTM2ZmdPdnV2NlgzdmJ3U2MzN09GYmQ0aUxtbFFGS0NvanpNbVY2NmxuV1R1ZnM0ZnZLS2dUUXR3XzF0amphbUU?oc=5" rel="noopener noreferrer"&gt;OpenAI’s Jalapeño AI chip brings new 'threat' to Nvidia margins as custom silicon gains ground - CNBC&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Separate the layers, as always. This is an &lt;strong&gt;inference&lt;/strong&gt; chip, not a training chip, and "industry-leading" is so far the vendor's own measurement — SemiAnalysis is analysis, not an independent benchmark, so the third-party verification layer is not there yet. Two things are worth writing down now. First, if the largest inference buyer decouples its unit cost from Nvidia's pricing, that shows up in API prices before it shows up in a press release. Second, CUDA's default position on the inference side now has a serious in-house challenger from a major vendor for the first time. Training is unaffected in the short term.&lt;/p&gt;

&lt;h2&gt;
  
  
  What does not change
&lt;/h2&gt;

&lt;p&gt;The week does not move the needle on evaluation rigor, on inference-cost transparency, or on the agent-safety story. The GLM-5.3-Flash headlines tell us about deployment substrate, not about whether the model is durable across real workloads&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxPNnVLcXB0ZGtkTHVaMC1EYkV2aHE1eHVaLTB5ZGtMZnc5SUw0NmVDT3NkLXhCTEprODJ3QURqcGg0S3hNa0w4MXQ3S0VLMlBKMnlNUlhPbzY1d1h2dlMwelBzeDhQUHg4TDJPYXVhMTBvVXo5WlZ2cHFPdExOcjNhbXZxdHZMOGE5cmc?oc=5" rel="noopener noreferrer"&gt;China’s Z.AI Made Ox Alpha Stealth Model That Rivals DeepSeek - Yahoo Finance&lt;/a&gt;. The Claude browser is interesting but its reliability at scale — long-horizon auth, error recovery, latency under load — is unmeasured&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;. The Claudeforce CRM is announced, not yet a workflow anyone has stress-tested&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxNeDU0UHo4UERDMHZlcjVyV1I4S0dWWEQ1SGhYOXFURmJmZUJiZHpud1pGVXRKQmx1ZXl6Sy01NjBkTlkyQXFRWEJfeTVkYXVHODNvZ0p3YTVudnVSNEN4WTJQLWpad0JJa09WZ1Roay1JZ3JUZDlNdFJNRGNZYzMyNHd1TmRzTVJQ0gGOAUFVX3lxTE5oWUF2YXIzVjUzOE5zUzVNT05nemItSm9rdm1OMmRvQWFPc05NRWVteG5mNnM3dmtzSHZOYlowYTNFTnNFT0M0UmY3ZTRhN1FGTUV1U1NKcnZhcUp0LUpVU2dMa1ZCazZvSUFWNTNBNWhzNlUtekUwR1J1a2UtZ25wT3JaVzUzZGFWV1BpX1E?oc=5" rel="noopener noreferrer"&gt;Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concerns - CNBC&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;If you are deciding what to integrate this week: the chip-constrained Chinese models are mostly relevant for teams already inside that supply chain, the smaller Qwen variant is relevant for cost-sensitive commodity inference, and Claude-in-browser is worth a controlled pilot but not yet a procurement decision.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-08-21 to 2026-08-28 | 晶片戰場兩邊同時開打，企業工作流綁定進入肉搏戰</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 27 Aug 2026 23:03:20 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-21-to-2026-08-28-jing-pian-zi-zhu-xu-shi-jiang-wen-qi-ye-gong-zuo-liu-bang-ding-jin-ru-rou-bo-zhan-1lcm</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-21-to-2026-08-28-jing-pian-zi-zhu-xu-shi-jiang-wen-qi-ye-gong-zuo-liu-bang-ding-jin-ru-rou-bo-zhan-1lcm</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;本週一句話摘要：&lt;/strong&gt; 晶片自主的「跑不跑得起來」這一層，GLM-5.3-Flash 交出了東西，「能賣到中國以外」的問題連 36 Kr 自己也戳破了；模型能力的戰場反而在往律所、CRM、瀏覽器這些換不掉的地方移動；同一週 OpenAI 公布自研推論晶片 Jalapeño，晶片這條線是兩邊同時在動。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  晶片自主：交付物到齊，全球口碑還沒到
&lt;/h2&gt;

&lt;p&gt;智譜（Z.ai）發布 GLM-5.3-Flash，官方說法是這個模型跑在十萬顆國產晶片上&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;；消息帶動 Z.ai 股價上漲 8%&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;。判斷層級要分開看：&lt;strong&gt;有交付物&lt;/strong&gt;這一層已經確認，但只有中國市場語境在意。&lt;/p&gt;

&lt;p&gt;比較有意義的訊號來自 36 Kr 自家提出的質疑——「為什麼 GLM-5.3 沒有在全球社群刷屏？」&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9fS183LXk5ZENZU25Uc2dxWXBaZ1VxYWhhLXJuNTFNaG9jV3lnTUhoeTJVVzZWY3Vib25uTUlUdG1hdGd2NWhqMlFFbWxzTUtuWWhj?oc=5" rel="noopener noreferrer"&gt;Why Didn't the High-Power GLM-5.3 Dominate Global Social Media Feeds? Core Barriers &amp;amp; Hidden Truths Uncovered - 36 Kr&lt;/a&gt;。這是少數由中文媒體自己戳破的冷靜報導，比官方敘事更值得引用。外媒以「匹敵 DeepSeek」形容的隱蔽模型 Ox Alpha&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxPNnVLcXB0ZGtkTHVaMC1EYkV2aHE1eHVaLTB5ZGtMZnc5SUw0NmVDT3NkLXhCTEprODJ3QURqcGg0S3hNa0w4MXQ3S0VLMlBKMnlNUlhPbzY1d1h2dlMwelBzeDhQUHg4TDJPYXVhMTBvVXo5WlZ2cHFPdExOcjNhbXZxdHZMOGE5cmc?oc=5" rel="noopener noreferrer"&gt;China’s Z.AI Made Ox Alpha Stealth Model That Rivals DeepSeek - Yahoo Finance&lt;/a&gt;，智譜已證實就是 GLM-5.3-Flash 本身，並同步釋出模型權重&lt;a href="https://news.google.com/rss/articles/CBMipAFBVV95cUxQUXZ6MmE5azY5LVZoV0xlM21vWFE2czZIMENGV0h1LTNyazRySExMSmxpNklQTE5BWUU4RlBNWVRTTGhCTnFpVlU5TVBxbmx5Q3E5Yk54X0s5OWJsQ09XeFlZSWtVaTJmNE1mejlXRU9MeHlnbXFPTVBPcTVmUU5aYUdqRElWYUx2TjlMc1RlajB0VGw5UFdMTWs2eHhraUZEcjBsWg?oc=5" rel="noopener noreferrer"&gt;Zhipu identifies Ox Alpha as GLM-5.3-Flash and releases model weights - TechNode&lt;/a&gt;——它不是另一個模型。「匹敵 DeepSeek」是媒體評比字眼，不是獨立 benchmark。&lt;/p&gt;

&lt;p&gt;對照組：阿里同週推出 Qwen3.8-Flash，彭博定位為「更小、更省」的路線&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxOVFN2VVNaUWE0bXJiNjQ2VWJlbngtWlpzcnY3RG44VlB1eVVhMWNiT21wYmVKSDJnQ0JkNXMycVg5bWRqQ2RIZ3E0d0hzdkEzUlNPV05aUjRUTFhzaXlNdVhVSHFXNGRuZFlPWUhEeEtKemMwdWJValR0MFpZM19OMVRpS1piVVhZWEI3ZmdJZmlDR1B5d2JMRU5DcENuSUktd01Ra0J6Zw?oc=5" rel="noopener noreferrer"&gt;Alibaba Releases Smaller, Cost-Effective Qwen AI Model - Bloomberg.com&lt;/a&gt;，Reuters 的版本則強調訓練成本更低&lt;a href="https://news.google.com/rss/articles/CBMiywFBVV95cUxQNFBiN0MydXZkUlB3UHdHb0xzNGNqVVhKdzZVMkQwalM4WWozbUxWSkZuRTljSXdfdjdOUjZkMWN2SEVRSnBXTEJwSlJfdkNqNzJreVp5MDNULVdDZ1ozSzE1YXp6dWR6MzZsOFBlRllhdlZEQmVBa1Eyb1hpQWlMWmdUaGlzeFpUZFlDZUszLU5KRG9SblF0VTNFT092TllTQnVqVlZHY2J3Uk1WblBfOUJGRmFob041dzEwRV9WaU5TWjlxbkswcTVJRQ?oc=5" rel="noopener noreferrer"&gt;Alibaba's Qwen launches Qwen3.8-Flash AI model with lower training costs - Reuters&lt;/a&gt;。兩家中國廠商的方向一致：不衝旗艦分數，衝單位成本。對 API 定價的壓力會比模型能力先一步感受到。&lt;/p&gt;

&lt;h2&gt;
  
  
  另一邊的晶片故事：OpenAI 自研推論晶片
&lt;/h2&gt;

&lt;p&gt;同一週美國這邊也在動晶片，方向相反：中國那條線是繞開 Nvidia 的地緣限制，OpenAI 這條線是把自己的推論成本從 Nvidia 手上拿回來。OpenAI 公布自研推論晶片 Jalapeño 的首批結果，官方說法是在 AI 推論的速度與能耗上達到業界領先&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTFBwMGNpOVlmLU9XdHlqemwwb2ZIRmRab3cyUTJnZ0x4UGVtWWZkMzYwb0thVlY5QVhSYXVaQ0xCRllRQUFuVE9FVUtac3FxUFM3T0Nfc0ItUTAzOVRP?oc=5" rel="noopener noreferrer"&gt;Jalapeño’s first results show industry-leading speed and efficiency in AI inference - OpenAI&lt;/a&gt;；SemiAnalysis 的評析標題直接寫「勝過 Nvidia Blackwell」&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE0wUWNzQzNua3BlcVlyRkQ3cVAza2pXdjNZLWZVVWFyakZqWmhXVnlYYXFvbzA5d2VmNVpyeTdlY29SSEFJZ3VQWVl1YmtGcERjS01MR1ljM1ZiN3d0UWFhVDNsQUZLUmIyaUNlT1Vya3N6SV8wZjRrMzhLR2c?oc=5" rel="noopener noreferrer"&gt;OpenAI Jalapeño: Better Than Nvidia Blackwell - SemiAnalysis&lt;/a&gt;，CNBC 的角度則是自研矽逐漸成形、對 Nvidia 毛利形成新的壓力&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5VdHlNWkdYQUJBdVV5c1luMDFlQVYyZnNzRFV3X3kweGY0ZG5IMVpfTE5Qd2JIdkMyaDZOOUJHZm0xU2FUcGdDT3Fzd0lITzd3NjRSbTJGYWNXWnVLV08yXzRUNUtSVGI0WFBlMHZMUk9FNFZCOXfSAXtBVV95cUxPREVoZVc1MjZnZzRDZ1diQ19ET2RQRURoYWtNUmNUUE1sSkgwZWJWZFl5M09MeHgyZjVYVTM2ZmdPdnV2NlgzdmJ3U2MzN09GYmQ0aUxtbFFGS0NvanpNbVY2NmxuV1R1ZnM0ZnZLS2dUUXR3XzF0amphbUU?oc=5" rel="noopener noreferrer"&gt;OpenAI’s Jalapeño AI chip brings new 'threat' to Nvidia margins as custom silicon gains ground - CNBC&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;判斷層級照樣要分開。&lt;strong&gt;這是推論晶片，不是訓練晶片&lt;/strong&gt;，而且「業界領先」目前是廠商自己的測試說法，SemiAnalysis 是分析評論而不是獨立 benchmark——第三方驗證這一層還沒到。但有兩件事值得現在就記下來：其一，最大的推論買方一旦把單位成本與 Nvidia 的定價脫鉤，最先反映的地方會是 API 價格，不是新聞稿；其二，CUDA 在推論側的預設地位，這是第一次被一個大型業者的自研 ASIC 正面挑戰。訓練側短期不受影響。&lt;/p&gt;

&lt;h2&gt;
  
  
  通路戰爭：模型不賣模型，賣入口
&lt;/h2&gt;

&lt;p&gt;美國陣營的同週動作更務實：Google 把 Gemini Enterprise 推向律師事務所&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPZk81aGh3d2lJX0FucWpwclltdnRJd3RqNVpTWnhMeGNBU3FUeWRIby1lcEpQQ3NOT1VaWjRlU19vT1lmVzdMTEpjbm16eTh4MTdvbGRtN1ZQb243eVZ2aF9Sd19PMEtzd2ZpbGV2R0p5SzZRTGJLNkE4TGNZUmtxVnlvVGx1NlVYQkIwMmEwRnV6RGxEQ1BvTGIzNGE?oc=5" rel="noopener noreferrer"&gt;Google expands Gemini Enterprise AI platform for law firms, lawyers - Reuters&lt;/a&gt;，Salesforce 與 Anthropic 把合作擴大為 Claudeforce&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;，CNBC 同步報導 Benioff 回應「SaaS 末日」的質疑&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxNeDU0UHo4UERDMHZlcjVyV1I4S0dWWEQ1SGhYOXFURmJmZUJiZHpud1pGVXRKQmx1ZXl6Sy01NjBkTlkyQXFRWEJfeTVkYXVHODNvZ0p3YTVudnVSNEN4WTJQLWpad0JJa09WZ1Roay1JZ3JUZDlNdFJNRGNZYzMyNHd1TmRzTVJQ0gGOAUFVX3lxTE5oWUF2YXIzVjUzOE5zUzVNT05nemItSm9rdm1OMmRvQWFPc05NRWVteG5mNnM3dmtzSHZOYlowYTNFTnNFT0M0UmY3ZTRhN1FGTUV1U1NKcnZhcUp0LUpVU2dMa1ZCazZvSUFWNTNBNWhzNlUtekUwR1J1a2UtZ25wT3JaVzUzZGFWV1BpX1E?oc=5" rel="noopener noreferrer"&gt;Salesforce, Anthropic expand partnership as Benioff responds to ‘SaaSpocalypse’ concerns - CNBC&lt;/a&gt;。Claude 自己也推出專屬瀏覽器&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;。Moonshot 對 Kimi K3 開出的條件是想向美國雲端抽 30%&lt;a href="https://news.google.com/rss/articles/CBMic0FVX3lxTFA0d0pQa2RVQTl3UUVMTHJNZWRYTV9LSHcxX2kwYXlzVzFOVlBVUjd0UG8tcV9yUHlzQTVvUXRpVkV2UlhLSFBFYTFqbmtHX2ZKNnNxWDdRMmN5WnhoVnlNNk8yTFhSaGxDMHpGX0ZHMWdiMlE?oc=5" rel="noopener noreferrer"&gt;Moonshot AI wants 30% of what US clouds earn from Kimi K3 - The Next Web&lt;/a&gt;，同期被美國政府指控涉及 Anthropic 技術&lt;a href="https://news.google.com/rss/articles/CBMizgJBVV95cUxPZS1vMTlZVi15emhSeUpMdGFRQV8yNENQUl9aV0hvNDRoQU05VzVfRGJCTW1mOERvS3kzcVFMdzFBbmw4bEM5bE9mLVlHVy1EaUlJeFhSbTNpcU0tTjllUlNiOWVITTlhTElLV3NiRnUxalRIc3BiRWFOenAzc3Vyd3Jxa2JVcmZkNHM4SE5ZMU1Wc2pVNDVZRnlOQ0ZPR3B0NXJXamdDeWxyalJFbngtMWtOcDFTQzdQckZJSnZ5VkVlZkZ1azJPVTJVQnlFLWFua01IUWZ4YjE2VV8xOXVGOTltcDhZWTlRNnRlRDYwM1Q0UkxDLURYbmtKc1VWLThzSDg4dFR3TGJzWHF1R1Y5SDRuYkxUNzM2MXBCMlR4OWRVX3VWdHppRkpuSGZGcll6NmZ1YkQ5OG52UVllS0Q5QW41S1AtMzBNOVZtU21B0gHTAkFVX3lxTE10SjBEUHFESnpWU1V5SXBMWUNKZXBsV283MllFZHloQVFveWxfaUo4UDBvbmNTeHRQSkJxNmFyZXF2VWlGVEdYaGZEby1EMHFJTGJGa2EteURSMURNTnFVYldubW4tQ0pVRUZUME5NZWlmMXdia2Z2c2FYS2FfekFydWtkNklpMTU4VEMyd21Rd0ZPbDVLdGVNZXZjRmg2U0hfd1V5SkRseDd3RnI5cFlSOU5ZV0dNNzMwZndxanQ0dHV6Zld5OE9rNHpSeElhQVdCd1lidG9oRzdSOE1RMTRDaVZSYWxkZzIyRWI0SllHQldGWHlldXRxeFdmc0h0VWtUdlB6b0g4T3o0SEFOZFFjUnFaMl9wOFVfMVhvYXkzakRyRHFNSXJDZ1QzRWNOTm5YT3o2dzZ0aXBQWUZ2VTJ0T0V4ZEdvQXhBUVk4SUV0WmZ6UQ?oc=5" rel="noopener noreferrer"&gt;Kimi K3 AI model maker Moonshot AI, which US government accused of ‘stealing’ Anthropic's tech, may make - The Times of India&lt;/a&gt;——一邊談分潤、一邊被告，這個組合本身就是地緣與商業已經綁死的證據。&lt;/p&gt;

&lt;p&gt;這些動作的共同特徵是&lt;strong&gt;都不是模型發布，是通路綁定&lt;/strong&gt;。律所、CRM、需要 agent 上網抓資料的工作流——每一個都是換掉模型供應商時最痛的黏著點。對技術決策者的意義：選模型時的 benchmark 權重會持續下降，選生態時的轉換成本權重會持續上升。&lt;/p&gt;

&lt;h2&gt;
  
  
  轉錄這個不起眼的戰場
&lt;/h2&gt;

&lt;p&gt;Google 發布 Gemini 3.5 Transcribe&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPSGx5ZU85MkhfYTUweHk3X2NteExrRTRxRUlGOTZ5QVVIalBjcDlVSGhKRkJzV1BuMG5RSm9ZXzhqYlNBMU1HYW9TS0JpZ1F6dGV2a3EyRC1qTk50Z0dxWDJ0MzBZQ1g4OXEzbThidVcxUFRHeWhvLXBUcC1yUUx6ZG9GOFZpVGdxN2h5YmtBTDVFd1ZyY1NSdUV2TDc5cmpZdnctREN1Yw?oc=5" rel="noopener noreferrer"&gt;Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text - Ars Technica&lt;/a&gt;，主打在轉錄中自動編掉「嗯」「啊」這類口頭禪&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9vLXhKVjRXQnEtLXZyWGZGbkU1OEF3RU55dUJlYjVGbVZMQkJJblVrX2hINVNudjhXNHQ4dzNNS1o2T0d3S2xGMmFKMDJpejhmQ3ZubldHSXBPTUNQYkRtUEJLeVpYTkNzcmRrTS0zV2d3eVowNG8zTVNjb0hxMFE?oc=5" rel="noopener noreferrer"&gt;Google’s new AI transcription edits out your ‘ums’ and ‘ahs’ - The Verge&lt;/a&gt;。會議轉錄是企業 AI 最普遍的實際使用場景之一，它要的是延遲穩定、整合簡單、成本可預測，不是頂級推理。差異化點在於與 Gemini 生態的整合深度，至於廠商宣稱的品質優勢，留給實測。&lt;/p&gt;

&lt;h2&gt;
  
  
  組織與人事：DeepMind 的兩個獨立訊號
&lt;/h2&gt;

&lt;p&gt;Google 把 AI 責任團隊移出 DeepMind 實驗室（WSJ 獨家）&lt;a href="https://news.google.com/rss/articles/CBMisAFBVV95cUxOOVhUck1oeDZzYU9nRTZWZTBRSERrb2pNWVk3aTZOMVFuZG5ubjFGbld4QXRLdThLQ1JuS0h0S0Q2ZjdsX1Y0Qm0xQjA3T3hLV014MzVqWTRNWGtjVWlyQ2otd1pIUjBqUjZBM3k5TTVpcnIxSngyTkk1eVNZU2hxcnR0MHJad1J0ZmtSN3dpR2p2N3pSRmNORnNPQzV5VUgxNGM0dE5DaGF5Y0FqUkd3eg?oc=5" rel="noopener noreferrer"&gt;Exclusive | Google Moves AI-Responsibility Team Out of DeepMind Lab in Latest Shake-Up - WSJ&lt;/a&gt;；Fortune 的數據則顯示 DeepMind 對頂尖人才的掌握正在鬆動&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxObS1iQWJMUFcyT0FoTjdGcXB6VFFJTjEyYnd4OVlTalVieFFQcC1veTdKX0tmc2Q3bWtCTmNraGhvZVJyeFlENlBFLUUwWTRGd2lQTU96X3Z1dzBDb05tVTZHdV95eDVfRTVYdjV6MG1SZ1kzczJPbnpreENwdHpJRTBBRnhWQzByYmhGRlNqUzF4cm1oRHpJOE5TSzRZeWZoTmpz?oc=5" rel="noopener noreferrer"&gt;Google DeepMind is losing its grip on elite AI talent, new data shows - Fortune&lt;/a&gt;。組織搬遷是組織搬遷，人才流出是人才流出——讀者要分開評估：依賴 Google 路線圖的團隊，前者代表責任歸屬變動，後者代表交付節奏風險。兩者都屬於「追蹤」，還不到「立即行動」。&lt;/p&gt;

&lt;p&gt;比爾蓋茲從 AI 樂觀派轉為警告大規模失業與網路攻擊風險，Politico 與 Washington Post 都有報導&lt;a href="https://news.google.com/rss/articles/CBMib0FVX3lxTE9wYm5vZ1JCeVVwQUpRMGJ1NjZhR3hVZ01FWGFuelVJOV80UG91QnFJaTRRSTd4amFlTnBWS1NNdDM4RE42NzZuUlpoMTYxUk9sYkdLTTIxTGNsSzNxeHF1VkdBR1pqc2pCQmNmNDZfNA?oc=5" rel="noopener noreferrer"&gt;Bill Gates warns AI could lead to mass unemployment, cyberattacks - Politico&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMitAFBVV95cUxOYmZxQlViRG5wSXMxTXM3bXVGWUNaeXdXUFpkbDUwZVlxLXE2LWxiX3pOS2tjVkNYdkpuM1NvOFpHOHhXcWJzQWY3Y0FvRTBoN0d1NC1Bd2JqTEpiR0pwazNQOE5wSjdCUVFnb29LczJSN2ZkWEFrazNyamVkREFyM2d0VlE5Y3lONXljQTFldEQwcGlMelQzcnBKeGs2bWduTnY5QmxpNms2eUJJVzQwYVJzM2U?oc=5" rel="noopener noreferrer"&gt;Bill Gates was an AI optimist. Now he’s scared of what could go wrong. - The Washington Post&lt;/a&gt;。立場轉變的內容比立場本身更值得讀：連科技慈善敘事最知名的代言人都在換調子，政策風向只會更緊。&lt;/p&gt;

&lt;h2&gt;
  
  
  本週判斷
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;晶片自主敘事有交付物支撐，但全球影響力停在中國市場語境&lt;a href="https://news.google.com/rss/articles/CBMiYkFVX3lxTE1MdlNBdE9pQ0VZMGs5VXJEUERVSkhQNzJZZlI1cVctaUoyTFA4M2VweS01UU1QRHQxUEthNGNBSTd4VlNFVjk4RHN6YjFlbGcyRF8zMGpaMlhiTXB6ckZ0QW53?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3-Flash model, powered by 100,000 domestically made chips - Global Times&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE9fS183LXk5ZENZU25Uc2dxWXBaZ1VxYWhhLXJuNTFNaG9jV3lnTUhoeTJVVzZWY3Vib25uTUlUdG1hdGd2NWhqMlFFbWxzTUtuWWhj?oc=5" rel="noopener noreferrer"&gt;Why Didn't the High-Power GLM-5.3 Dominate Global Social Media Feeds? Core Barriers &amp;amp; Hidden Truths Uncovered - 36 Kr&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxNOXJYOG11aWZmNUM0QmxZXzloZEdQel9qaTFBbmRzc1VFV0ZiUFNOMHp0VjNFd1BpQU56X3E4YzA2S0tINnd2TEhSc19uM19WSG1NUG9kblZkamRFcURkNE81Ty16c1dmMXVTYW9CSG5tOEpFN1ZyRnFZeTNLdktSRHhRNnhpaEo3RUt5OUVXY9IBlAFBVV95cUxNTHZVd2RGQndFcXFYcTFITlJZcGJvZ0VLeDV0ZnFQX1JGRXBTS2tJOUdZdXh1Q0FrdGtZV3BxMGJvU1E2MDg2MnVpYnFWYzZtNTAyY3NKVTNOd0FGTXZXbkJoY3daVzk2RWY2bVIxRnlFTXpyUUpreVFkTXg4bVZtYmRmVU9GNTVuR3B2NFB5M2hHU1Zq?oc=5" rel="noopener noreferrer"&gt;Z.ai shares surge 8% after releasing new AI model running only on Chinese chips - CNBC&lt;/a&gt;。&lt;/li&gt;
&lt;li&gt;OpenAI 自研推論晶片 Jalapeño 是本週對長期成本結構影響最大的一則，但目前只有廠商自己的測試說法與分析評論，沒有第三方 benchmark&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTFBwMGNpOVlmLU9XdHlqemwwb2ZIRmRab3cyUTJnZ0x4UGVtWWZkMzYwb0thVlY5QVhSYXVaQ0xCRllRQUFuVE9FVUtac3FxUFM3T0Nfc0ItUTAzOVRP?oc=5" rel="noopener noreferrer"&gt;Jalapeño’s first results show industry-leading speed and efficiency in AI inference - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMifEFVX3lxTE0wUWNzQzNua3BlcVlyRkQ3cVAza2pXdjNZLWZVVWFyakZqWmhXVnlYYXFvbzA5d2VmNVpyeTdlY29SSEFJZ3VQWVl1YmtGcERjS01MR1ljM1ZiN3d0UWFhVDNsQUZLUmIyaUNlT1Vya3N6SV8wZjRrMzhLR2c?oc=5" rel="noopener noreferrer"&gt;OpenAI Jalapeño: Better Than Nvidia Blackwell - SemiAnalysis&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMidkFVX3lxTE5VdHlNWkdYQUJBdVV5c1luMDFlQVYyZnNzRFV3X3kweGY0ZG5IMVpfTE5Qd2JIdkMyaDZOOUJHZm0xU2FUcGdDT3Fzd0lITzd3NjRSbTJGYWNXWnVLV08yXzRUNUtSVGI0WFBlMHZMUk9FNFZCOXfSAXtBVV95cUxPREVoZVc1MjZnZzRDZ1diQ19ET2RQRURoYWtNUmNUUE1sSkgwZWJWZFl5M09MeHgyZjVYVTM2ZmdPdnV2NlgzdmJ3U2MzN09GYmQ0aUxtbFFGS0NvanpNbVY2NmxuV1R1ZnM0ZnZLS2dUUXR3XzF0amphbUU?oc=5" rel="noopener noreferrer"&gt;OpenAI’s Jalapeño AI chip brings new 'threat' to Nvidia margins as custom silicon gains ground - CNBC&lt;/a&gt;。&lt;/li&gt;
&lt;li&gt;通路綁定（法律、CRM、瀏覽器）是本週真正值得行動的訊號&lt;a href="https://news.google.com/rss/articles/CBMinAFBVV95cUxPZk81aGh3d2lJX0FucWpwclltdnRJd3RqNVpTWnhMeGNBU3FUeWRIby1lcEpQQ3NOT1VaWjRlU19vT1lmVzdMTEpjbm16eTh4MTdvbGRtN1ZQb243eVZ2aF9Sd19PMEtzd2ZpbGV2R0p5SzZRTGJLNkE4TGNZUmtxVnlvVGx1NlVYQkIwMmEwRnV6RGxEQ1BvTGIzNGE?oc=5" rel="noopener noreferrer"&gt;Google expands Gemini Enterprise AI platform for law firms, lawyers - Reuters&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiZEFVX3lxTFBjX0FJTVBVb1hqLXh1NTdpVmttQ0FSb2NCX2UwWXBkUGlmckFqclVzcWZPMlBVblpJMmtrRi1LZVV3MVBOU18xUHY2R21BSTlEd3ZuMXRNZkpmeVF2TXlubVB1bXI?oc=5" rel="noopener noreferrer"&gt;Anthropic’s Claude now has a browser of its own - The New Stack&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPcklqU2RlQWZLY3c5dG9uaF83Z0xHSHNuQzNHSGZOTWw3c2wzSmtGTE45VzlWaF80R2tON1JfcFhFVC1walRFUmRyVDA1UkdoQ3pydUdKc1hPTm9SQTV0akl4aWV6NlVqR3ZtSEhCYjJlRTJTOTJYWHU2aDJIWjl0c21ReTJDRVlKb0pwRVE3MTJLdUdVeE9tSGJuQ2hoN3RBbFMtTGJrdw?oc=5" rel="noopener noreferrer"&gt;Salesforce and Anthropic Announce Claudeforce: The #1 AI Meets the #1 AI CRM - Salesforce&lt;/a&gt;。&lt;/li&gt;
&lt;li&gt;轉錄類基礎功能是工程成本敏感的場景，別用旗艦模型邏輯評估&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPSGx5ZU85MkhfYTUweHk3X2NteExrRTRxRUlGOTZ5QVVIalBjcDlVSGhKRkJzV1BuMG5RSm9ZXzhqYlNBMU1HYW9TS0JpZ1F6dGV2a3EyRC1qTk50Z0dxWDJ0MzBZQ1g4OXEzbThidVcxUFRHeWhvLXBUcC1yUUx6ZG9GOFZpVGdxN2h5YmtBTDVFd1ZyY1NSdUV2TDc5cmpZdnctREN1Yw?oc=5" rel="noopener noreferrer"&gt;Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text - Ars Technica&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE9vLXhKVjRXQnEtLXZyWGZGbkU1OEF3RU55dUJlYjVGbVZMQkJJblVrX2hINVNudjhXNHQ4dzNNS1o2T0d3S2xGMmFKMDJpejhmQ3ZubldHSXBPTUNQYkRtUEJLeVpYTkNzcmRrTS0zV2d3eVowNG8zTVNjb0hxMFE?oc=5" rel="noopener noreferrer"&gt;Google’s new AI transcription edits out your ‘ums’ and ‘ahs’ - The Verge&lt;/a&gt;。&lt;/li&gt;
&lt;/ul&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>Claude Code 實戰守則：把「看起來對」換成「可以查證」</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Wed, 26 Aug 2026 00:07:28 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/claude-code-shi-zhan-shou-ze-ba-kan-qi-lai-dui-huan-cheng-ke-yi-cha-zheng--41kh</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/claude-code-shi-zhan-shou-ze-ba-kan-qi-lai-dui-huan-cheng-ke-yi-cha-zheng--41kh</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;一句話摘要：&lt;/strong&gt; 在 Claude Code 裡，ripgrep 的價值不是快幾毫秒，而是讓 agent 少讀錯幾個檔案。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  1. rg 就是 ripgrep，用哪個 rg 決定搜尋是否真的在跑
&lt;/h2&gt;

&lt;p&gt;&lt;code&gt;rg&lt;/code&gt; 是 ripgrep 的執行檔名稱。Claude Code 預設走&lt;strong&gt;捆綁的 Node wrapper&lt;/strong&gt;；要讓 Grep 工具走你本機的 &lt;code&gt;rg&lt;/code&gt;，設 &lt;code&gt;USE_BUILTIN_RIPGREP=0&lt;/code&gt;。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;rg &lt;span class="nt"&gt;--version&lt;/span&gt;           &lt;span class="c"&gt;# 看真正生效的是哪個&lt;/span&gt;
which &lt;span class="nt"&gt;-a&lt;/span&gt; rg            &lt;span class="c"&gt;# 比對 PATH 順序&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;這次環境：系統 &lt;code&gt;rg 13.0.0&lt;/code&gt; → 升級到 &lt;code&gt;15.2.0&lt;/code&gt; 置於 &lt;code&gt;~/.local/bin/rg&lt;/code&gt;（&lt;code&gt;~/.local/bin&lt;/code&gt; 在 PATH 首位）。Claude Code 的 &lt;code&gt;settings.json&lt;/code&gt; 與 &lt;code&gt;~/.zshrc&lt;/code&gt; 兩處皆設 &lt;code&gt;USE_BUILTIN_RIPGREP=0&lt;/code&gt;；重開 Claude Code 後生效（已知有忽略設定檔的舊回報，實測以 &lt;code&gt;which rg&lt;/code&gt; 為準）。&lt;/p&gt;

&lt;p&gt;文件陷阱：官方有寫在 &lt;strong&gt;env-vars&lt;/strong&gt; 頁（&lt;code&gt;Set to 0 to use system-installed rg&lt;/code&gt;），但 settings 頁沒有——只查一處就會誤判為「未文件化」。&lt;/p&gt;

&lt;h2&gt;
  
  
  2. README 上的「更快」不是證據
&lt;/h2&gt;

&lt;p&gt;一份主張 ripgrep 已不是最快的清單，七個替代品逐一查（2026-08-25，&lt;code&gt;crates.io&lt;/code&gt; + &lt;code&gt;GitHub API&lt;/code&gt;）：&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;清單上的宣稱&lt;/th&gt;
&lt;th&gt;查證結果&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;frg&lt;/strong&gt;「每種模式都比 rg 快」&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;qhkm/fastripgrep&lt;/code&gt; 約 ★14，&lt;strong&gt;建立與最後推送同一天&lt;/strong&gt;（2026-03-24），之後五個月沒動。crates.io 上叫 &lt;code&gt;frg&lt;/code&gt; 的是另一專案&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;xerg&lt;/strong&gt;「比 grep 快 34 倍」&lt;/td&gt;
&lt;td&gt;crates.io &lt;code&gt;xerg&lt;/code&gt; v0.2.1，下載約 142 次；描述裡沒有該倍數&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;shim&lt;/strong&gt;「結構查詢改送 ast-grep」&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;PKM-M84/shim&lt;/code&gt; 約 ★2，&lt;strong&gt;機制被清單講反了&lt;/strong&gt;——實為「先跑 rg，再用 ast-grep 去噪」&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;xgrep&lt;/strong&gt;「重複搜尋快 46 倍」&lt;/td&gt;
&lt;td&gt;
&lt;code&gt;momokun7/xgrep&lt;/code&gt; 約 ★14，crates.io 同名為另一套件&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;seek&lt;/strong&gt;「把 zoekt 包成單一 binary」&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;查無此物&lt;/strong&gt;&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;
&lt;strong&gt;fastgrep&lt;/strong&gt;「某編輯器官方部落格背書」&lt;/td&gt;
&lt;td&gt;
&lt;strong&gt;假&lt;/strong&gt;，原文無此工具亦無 Claude Code&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;對照：ripgrep 約 ★67.6k，ast-grep 約 ★15.6k。&lt;/p&gt;

&lt;p&gt;&lt;a href="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F1djt5whny0oizelw09ll.png" class="article-body-image-wrapper"&gt;&lt;img src="https://media2.dev.to/dynamic/image/width=800%2Cheight=%2Cfit=scale-down%2Cgravity=auto%2Cformat=auto/https%3A%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Farticles%2F1djt5whny0oizelw09ll.png" alt="七個宣稱逐一查證：ripgrep 約 6.7 萬星、ast-grep 約 1.6 萬星，四個替代品 14 星以下，兩個查無此物" width="800" height="499"&gt;&lt;/a&gt;&lt;/p&gt;

&lt;p&gt;可複製的查核指令：&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight shell"&gt;&lt;code&gt;curl &lt;span class="nt"&gt;-s&lt;/span&gt; &lt;span class="nt"&gt;-A&lt;/span&gt; &lt;span class="s2"&gt;"your-ua"&lt;/span&gt; https://crates.io/api/v1/crates/&amp;lt;name&amp;gt; &lt;span class="se"&gt;\&lt;/span&gt;
  | jq &lt;span class="nt"&gt;-r&lt;/span&gt; &lt;span class="s1"&gt;'.crate | .max_version, .downloads, .description'&lt;/span&gt;
gh api repos/&amp;lt;owner&amp;gt;/&amp;lt;repo&amp;gt; &lt;span class="se"&gt;\&lt;/span&gt;
  &lt;span class="nt"&gt;--jq&lt;/span&gt; &lt;span class="s1"&gt;'"★\(.stargazers_count) created=\(.created_at[0:10]) pushed=\(.pushed_at[0:10])"'&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;h2&gt;
  
  
  3. 要換就換「能省 token」的，不是「能快幾毫秒」的
&lt;/h2&gt;

&lt;p&gt;Agent 的成本是它塞回上下文的內容量。更準的搜尋比更快的搜尋更省。&lt;br&gt;
&lt;/p&gt;

&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight rust"&gt;&lt;code&gt;&lt;span class="c1"&gt;// demo.rs&lt;/span&gt;
&lt;span class="cd"&gt;/// 這個函式取代了舊的 load_config，不要再呼叫 load_config。&lt;/span&gt;
&lt;span class="k"&gt;fn&lt;/span&gt; &lt;span class="nf"&gt;load_config&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="k"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="nb"&gt;String&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
    &lt;span class="k"&gt;let&lt;/span&gt; &lt;span class="n"&gt;hint&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="s"&gt;"usage: load_config &amp;lt;path&amp;gt;"&lt;/span&gt;&lt;span class="p"&gt;;&lt;/span&gt;
    &lt;span class="nd"&gt;println!&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s"&gt;"{hint}"&lt;/span&gt;&lt;span class="p"&gt;);&lt;/span&gt; &lt;span class="nn"&gt;String&lt;/span&gt;&lt;span class="p"&gt;::&lt;/span&gt;&lt;span class="nf"&gt;new&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt;
&lt;span class="p"&gt;}&lt;/span&gt;
&lt;span class="k"&gt;fn&lt;/span&gt; &lt;span class="nf"&gt;main&lt;/span&gt;&lt;span class="p"&gt;()&lt;/span&gt; &lt;span class="p"&gt;{&lt;/span&gt;
    &lt;span class="c1"&gt;// TODO: load_config 之後要改成非同步&lt;/span&gt;
    &lt;span class="k"&gt;let&lt;/span&gt; &lt;span class="n"&gt;_&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="nf"&gt;load_config&lt;/span&gt;&lt;span class="p"&gt;();&lt;/span&gt;
&lt;span class="p"&gt;}&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;





&lt;div class="highlight js-code-highlight"&gt;
&lt;pre class="highlight console"&gt;&lt;code&gt;&lt;span class="gp"&gt;$&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;rg &lt;span class="nt"&gt;-w&lt;/span&gt; &lt;span class="nt"&gt;-c&lt;/span&gt; &lt;span class="s1"&gt;'load_config'&lt;/span&gt; demo.rs
&lt;span class="gp"&gt;5   #&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;註解、定義、字串、TODO、真正的呼叫
&lt;span class="gp"&gt;$&lt;/span&gt;&lt;span class="w"&gt; &lt;/span&gt;ast-grep run &lt;span class="nt"&gt;-p&lt;/span&gt; &lt;span class="s1"&gt;'load_config()'&lt;/span&gt; &lt;span class="nt"&gt;-l&lt;/span&gt; rust demo.rs
&lt;span class="gp"&gt;demo.rs:10:    let _ = load_config();&lt;/span&gt;&lt;span class="w"&gt;   &lt;/span&gt;&lt;span class="c"&gt;# 只有真正的呼叫&lt;/span&gt;
&lt;/code&gt;&lt;/pre&gt;

&lt;/div&gt;



&lt;p&gt;陷阱：&lt;code&gt;ast-grep -p 'unwrap()'&lt;/code&gt; 在上千處呼叫的專案上回 &lt;strong&gt;0&lt;/strong&gt;；正確是 &lt;code&gt;$X.unwrap()&lt;/code&gt;。每個新 pattern 先在已知有命中的地方跑一次。小專案建索引永遠回不了本，先量再換。&lt;/p&gt;

&lt;h2&gt;
  
  
  4. 從可信到可查的最小清單
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;切系統 &lt;code&gt;rg&lt;/code&gt;：&lt;code&gt;~/.local/bin/rg 15.2.0&lt;/code&gt; + &lt;code&gt;USE_BUILTIN_RIPGREP=0&lt;/code&gt; 兩處設定，&lt;code&gt;which -a rg&lt;/code&gt; 驗證。&lt;/li&gt;
&lt;li&gt;精準搜尋：&lt;code&gt;ast-grep run -p 'load_config()' -l rust &amp;lt;path&amp;gt;&lt;/code&gt;；pattern 錯是靜默失敗，先驗。&lt;/li&gt;
&lt;li&gt;效能宣稱：先看 &lt;code&gt;gh api&lt;/code&gt; 的最後推送與下載量，再看第三方測量——沒有就當待驗證。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;本文 7 宣稱查核與 &lt;code&gt;demo.rs&lt;/code&gt; 範例皆可按上列指令自行複驗。&lt;/p&gt;

</description>
      <category>ai</category>
      <category>claude</category>
      <category>productivity</category>
      <category>devtools</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-14 to 2026-08-21 | Open models narrow the gap, and the supply chain keeps moving</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 20 Aug 2026 23:09:05 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-14-to-2026-08-21-open-models-narrow-the-gap-and-the-supply-chain-keeps-moving-kij</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-14-to-2026-08-21-open-models-narrow-the-gap-and-the-supply-chain-keeps-moving-kij</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;A Russian missile that uses an Nvidia AI chip to help target Ukraine, an H200 thaw in China, and a denial of an imminent China-specific SKU — three Nvidia stories landing in the same window. On a parallel track, open-weights labs closed another gap on coding tasks. The thread connecting both tracks is not model quality alone; it is who can ship, to whom, and under what terms.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Open-weights coding: GLM-5.3 and the "strongest" claim
&lt;/h2&gt;

&lt;p&gt;Zhipu released GLM-5.3 on August 14, and the framing matters more than the leaderboard screenshot. The Decoder reports it as Zhipu's claim of being the strongest open-weights coding model&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxNM0JXWjNoMDQ1Zl93ZWRmejA4djlQQzVodHhYb0lCQnJqSGtFbUxTUDQyYnI3NmN6NF9aazJRTkx4YlZ6b2ROVzNPQUpKTTgtVGh2bDU1aUE0RXItRUV0RE1tckNPNjhoUkxhNUs3ejBJNVAtZU1LMDR4cllacVBDZjV3UU96TnFMbkxqaUdTa3pacWhneDVUQmpLd1hsMmFrcGlB?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3, claims it's the strongest open-weights coding model - the-decoder.com&lt;/a&gt;, and Interconnects AI places it inside the broader question of how Chinese labs keep stride with the frontier&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFB5TDJYb1JiaGx4b3BUOVQxQ1FEdjBITXNCWXJzeHdMVjA5QWVhTVVHbHhuUk9yODdERkQ5dk9iN0U0SjV0WDI1ZG5mWld4WUJ0cDdYX1JmU1pZbFF4NTJKdnh3bUhDUHg5OGpyUkRaTV9JQmFo?oc=5" rel="noopener noreferrer"&gt;GLM-5.3: How Chinese labs keep stride with the frontier - Interconnects AI&lt;/a&gt;. The distinction between "announced" and "available" is doing real work here: an open-weights release means the weights are downloadable, but commercial usability depends on the license and on what the model actually handles on a workstation or a private cluster. Coding benchmarks are also where vendor framing moves the fastest — the headline number tells you what the lab chose to measure, not what your editor will do tomorrow. Treat the claim as a positioning move and benchmark it against your own tasks before migrating.&lt;/p&gt;

&lt;h2&gt;
  
  
  Google's education push: Gemini in the classroom
&lt;/h2&gt;

&lt;p&gt;Google turned on Gemini inside its Classroom app on August 14&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE5SMU5ZVGZnNFNKMzY5b0dsTFE5cVZ0bEhjSkx4d21GX3dCSUgzd0lrWm15STZYVGVUaDJubWRxeHMwTHNtaThOeUg4aElISHFPdS00SGFKTlBzd0x1SGtJaFN3NWpUOWpEUEpTXzdwV3FqNVVSWl9kTG1ERzdlZw?oc=5" rel="noopener noreferrer"&gt;Google Turns On Gemini A.I. for Students Using Its Classroom App - The New York Times&lt;/a&gt;, then layered in additional AI study tools across Search and Gemini on August 19&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPY3V6UVYwYVZlaHE2Y05hR1NRM2lDYzdZYnhEaVhUN0NSeTFpOHZnYlJxbnY3bFJ1bHNFZkRHQ2RCaG1YLU1jWmRyNlhENVJVTXQxa0JsRjNGUndHcmd6WUt3OG1KUVVuelZPdm9KNXVhMHZPTHd5LVJRcDJCelJhektBMm5RaVV3YzdoZ1l4LU1VWk5UeGtCS3M1S2g1eTFCSGxsazlrRQ?oc=5" rel="noopener noreferrer"&gt;Google packs Search and Gemini with new AI study tools - TechCrunch&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxNazZwOEE3ZTJuRTVnY3NDNEJwQzU3dnYyWkk4bHcyMHNGTVdYZFAta1dlWGt4Rm04MXdtdFkzUmx4R0tQbDQ1VDlqcEY0MHNTWEg4VjJuVktDczVFaE5mblpBTGVEUk1jRzNJSXdkMXVyVjZRQkpHMjlVR2lqVnBla0hpbTRSQWhVTEE?oc=5" rel="noopener noreferrer"&gt;Start the semester with one year of Gemini, on us - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNT09INE9YMXlUaXhiUHRNTXZFQng1cTUtV1BGOU5Ienhta1JmLUNzRlZKSXpKczlNLWdvN2w1ODdUcUtrdmxRTExKbFh5RDBWdTlFZ2NyMERvMllYdVNuZWFVX3ZvOWhzbDh4TFFOWUswbG5kbktDclhUeVlzN19kc1B5b21wUXJZSERucXNKMDRQOHRaZlZMU2FDUnBNVVhqYlRDTmlHLWp3NTJHdjVBTERzRnd1Tkl6SWFzRkF3?oc=5" rel="noopener noreferrer"&gt;Google is giving students a free year of Gemini Pro — plus, new AI study features - Tom's Guide&lt;/a&gt;. The interesting part is the distribution channel. Schools and student accounts are a wedge into habits that outlast a single semester; the free year of Gemini Pro for students is the lock-in&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxNazZwOEE3ZTJuRTVnY3NDNEJwQzU3dnYyWkk4bHcyMHNGTVdYZFAta1dlWGt4Rm04MXdtdFkzUmx4R0tQbDQ1VDlqcEY0MHNTWEg4VjJuVktDczVFaE5mblpBTGVEUk1jRzNJSXdkMXVyVjZRQkpHMjlVR2lqVnBla0hpbTRSQWhVTEE?oc=5" rel="noopener noreferrer"&gt;Start the semester with one year of Gemini, on us - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNT09INE9YMXlUaXhiUHRNTXZFQng1cTUtV1BGOU5Ienhta1JmLUNzRlZKSXpKczlNLWdvN2w1ODdUcUtrdmxRTExKbFh5RDBWdTlFZ2NyMERvMllYdVNuZWFVX3ZvOWhzbDh4TFFOWUswbG5kbktDclhUeVlzN19kc1B5b21wUXJZSERucXNKMDRQOHRaZlZMU2FDUnBNVVhqYlRDTmlHLWp3NTJHdjVBTERzRnd1Tkl6SWFzRkF3?oc=5" rel="noopener noreferrer"&gt;Google is giving students a free year of Gemini Pro — plus, new AI study features - Tom's Guide&lt;/a&gt;. For engineers, the practical question is what flows downstream: an entire cohort that grows up with Gemini as the default assistant, and the integration surface (Docs, Classroom, Search) that comes with it. This is availability today, not announced capability, and it is the kind of adoption that compounds quietly. The harder question — what guardrails Google applies inside the Classroom wrapper — is the one regulators and parents will push on, and the one Forbes' piece on DeepMind values hints at without resolving&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxNdzdXdng4dFRFT3JLSlFsUUw3cWZLNkFnanhoUDVyOGdSYjBxM1FVWDI1VHJVZTFIc3JoQThsVFdOdHRZYWh4U2FXdURocFN3X1B0N0F5NEg1Z1FqNVF0aVNDNXg1dTF3a25icW9BLXZCY1B5WVpzSHZWR2swRUt1ZnM4Y0p4blZSREQ5YWlUdkxYYmVxVzR3azNRMTZncDQ3ZUtZV3FrZXFWbkFhR1FSSkhUSEZVeG1N?oc=5" rel="noopener noreferrer"&gt;Why Google’s DeepMind Cannot Let the Tech Race Outrun Its Values - Forbes&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Nvidia's hardware and the supply chain
&lt;/h2&gt;

&lt;p&gt;Three separate Nvidia stories landed in the same window, and reading them together is the only way they make sense. The Register reported that a Russian missile used an Nvidia AI chip to help target Ukraine&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxOblduS0ExYXBLbk1SQWNDaFBNNC1SSVdQLXowai16ZHA0Qzc1dVZNMnV5QWxVR2pRTmFSZWVFTUFpZXhiQkdRX1ZCSnZ1dXZXLXZCdExHR2pFM013S0pweExjeFdpYWNxT190Yi1LNVZTS2c4MEhmUmVGY2tEd3F6SG5QdU5pc0pOUW1obXRmLUk3UnVaOWlxVnVBZjRBVnp4alpQV1pWOXFSR3dVMkhXeXFKUQ?oc=5" rel="noopener noreferrer"&gt;Russian missile uses Nvidia AI chip to help target Ukraine - The Register&lt;/a&gt;. Reuters covered Nvidia's denial that it is rolling out a China-specific AI chip by year-end&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxOMldWMkxfMnFZbHg4YnI0RTdoZGtfMXJIT1hTdHg4aGUyMWhvazNtdWVoLW4wMDR0cXkybXhEMHdqanBCZ0Nmb21xVVVua2lYOTQ4elZsUFlMbTBVYkpwRDBaVWs5Y0xRTUc1U3BSVng1WlpteXhqS0NhdWZ4cmthTlpFYTJJX2hrdGc0Y1VZUTJ5aXNzQWlvb19nei05RHJIYlhEZXRSYko?oc=5" rel="noopener noreferrer"&gt;Nvidia denies report it is rolling out China AI chip by year-end - Reuters&lt;/a&gt;. The Financial Times reported China easing limits on Nvidia H200 chips as the AI race escalates&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxNRF9wTFByQktUOHRwVGVOWVg3TXdURVhZXzVoOTYzY3VwX0J0cXdoZUJGbF9JSWJuLWQ0VVIwY1FpSWNNY2ZuLWREZlEwb1R1MmNnMGNhby12Nk1vako5NzA4VGtjeGJUOXdyTWxMYXpNQWh5TjdPTDdrVVF1dkFOUFFKSkc?oc=5" rel="noopener noreferrer"&gt;China eases limits on Nvidia H200 chips as AI race escalates - Financial Times&lt;/a&gt;. CNBC's piece on Nvidia's moat shifting from chips to capital&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxOeUVqUjhzeWswMXdGZlJFMWFhbWxRMHBlSTFQMEFaTjNWbWVla29BNGtPUDFLdTI3NGg2WE9zRE85QjZyaXdpU0doeDBzM1QzdGM1aG9GSTQ5cWxOUDlSX2lNekRWMkxlR1FKMjVwQVphOFAzRmVjZGRfOU03M2VGdWVNWGNvdHdXUjlFMXNBUdIBlAFBVV95cUxPOVJVZ203Y0JGbnk3WGNFWm1jcmNobDNzZ3dJSF9fNVp1c0RzYUtoQWtscGpaRlN6VWRDUEM1dUY5NW1xc2tBM0ItWWtTV2IxMDI3cjZidmNaVjZ6LWRfdWdrUW9keUcxdEc1VFBObmRxaTV1aHFzc1dzZHFTS1FZTjNmWUpWVmJsRDdrWmJvOExEVTdL?oc=5" rel="noopener noreferrer"&gt;Nvidia's AI moat is shifting from chips to capital - CNBC&lt;/a&gt; and the Nordics matchmaker story&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTE4teEJkRklqaHFoUnU0NzFTNk5CQ0hxS1hvT25ocVR0UW8tSEt3UTZGZXRHNjNzZ0ZnVk9rOGdXZGJ0bGsxb25PYTR5RlRTUVBVb0x3VENKU3RIU2drVXI0Z1JJelVQNXEyWnRlUnk4QXlCTlpW0gF6QVVfeXFMTTRWbmNYcnlQMVNoZF9sWjBLOHVSTTdOcGx4Nl9tT2ZTS055SXRVaVNaSjFlNUlITHJZRlNnY01GNk40XzR3Z0YwQmNEN0R6QVhnQkhGcXljTXJySFRWYVgyUHZzTGU4RlNiaHh6ZlNBM0ZLRXNSMUtsT2c?oc=5" rel="noopener noreferrer"&gt;Nvidia plays matchmaker in Nordics, sources tell CNBC, as AI data center deals boom in region - CNBC&lt;/a&gt; round out the picture: Nvidia is becoming a dealmaker and capital allocator, not just a silicon vendor.&lt;/p&gt;

&lt;p&gt;The operational read for engineers: H200 access in China loosens, which changes who can train large models where; the China-specific SKU is not landing this year, which means existing SKUs and gray channels stay in play; and the missile report is a reminder that the same vendor's hardware reaches both training clusters and weapons systems — a supply-chain governance problem that no leaderboard will solve. The Forbes piece on DeepMind values&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxNdzdXdng4dFRFT3JLSlFsUUw3cWZLNkFnanhoUDVyOGdSYjBxM1FVWDI1VHJVZTFIc3JoQThsVFdOdHRZYWh4U2FXdURocFN3X1B0N0F5NEg1Z1FqNVF0aVNDNXg1dTF3a25icW9BLXZCY1B5WVpzSHZWR2swRUt1ZnM4Y0p4blZSREQ5YWlUdkxYYmVxVzR3azNRMTZncDQ3ZUtZV3FrZXFWbkFhR1FSSkhUSEZVeG1N?oc=5" rel="noopener noreferrer"&gt;Why Google’s DeepMind Cannot Let the Tech Race Outrun Its Values - Forbes&lt;/a&gt; and the Britannica entry&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTE95ZVNmWXdZb241VlFiOU5WbnJxWXA1UzJpa1E1VkVZX1dJdk9TcmItUGRhemFCVUU1V3BsMWdyX0JwZ1otdGJqdDNyZnRCczRhTTczeVU2dlRVLWth?oc=5" rel="noopener noreferrer"&gt;Google DeepMind | History, Innovations, &amp;amp; Controversies - Encyclopedia Britannica&lt;/a&gt; are the longer-arc context for how a lab with global reach handles the gap between capability and restraint.&lt;/p&gt;

&lt;h2&gt;
  
  
  Privacy posture: OpenAI's zero-retention turn
&lt;/h2&gt;

&lt;p&gt;OpenAI announced zero data retention for frontier models on August 19&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE94QkJmU0lSZG9WQ2xIeVMxWDhRaHVTZHFzRzZvd1E4WmpCRlNOaVlLNHhNMi01UEVuZHRFVlBwMVh1bHV6bG0zdk9kTU9RTEV3NnNvZkNoTjl3OW1rRmFiQTBGRVZ1UnUzTy1naXFNcmpOSEVGUmpYTE5ZV3l0c3M?oc=5" rel="noopener noreferrer"&gt;Offering Zero Data Retention for frontier models - OpenAI&lt;/a&gt;, and Axios framed the follow-up: OpenAI says it does not need to store customer business data to keep models safe&lt;a href="https://news.google.com/rss/articles/CBMirgFBVV95cUxOdkZwYlJQTThwMTRUOHBRTE1uNDJ5eXhQdGRhbnZSdGp2YkZsd2dvaXFsMU9nSkpsTkROTmhqLTFqY1ZSdmxPTTFHU2VjV3FQNm1LSzZsZEZkNTJqZEZBbTd6eGNsUHgzWWxhWExtbjhNSlhMdFp1b2hlQ051eGNBengwdEVMWTFLdnFJb1JrbzZKSnZoSmhYLWNaaHg2ZjZFZUJFN2h4ZEx1MUNVV0E?oc=5" rel="noopener noreferrer"&gt;OpenAI says it doesn't need to store customer's business data to keep models safe - Axios&lt;/a&gt;. This is a commercial-grade claim with real procurement implications. For teams that held back on frontier-model adoption because of data-residency or training-leakage risk, a contractual zero-retention tier changes the calculation. Verify the scope: a policy page is announced; a DPA is available; a FedRAMP or SOC 2 attestation that covers the zero-retention tier is commercially usable. Most teams will land in the middle tier.&lt;/p&gt;

&lt;h2&gt;
  
  
  Market share and the consumer frontier
&lt;/h2&gt;

&lt;p&gt;TradingView's piece on ChatGPT holding the AI crown while Gemini slips and Claude climbs is the consumer-market snapshot for the week&lt;a href="https://news.google.com/rss/articles/CBMiaEFVX3lxTFB5NGdYVU41TGNUT01POGlGeUZIX1RNU1NIZFRQZ2N3RWlYTnBTWjlDTVRQcTZGYkdwU0VNUHRtNjd2al91NEdDSGx6QmxlNE9lbjMzaW1tUjJGdDFkTW9EdVhEY0psVllP?oc=5" rel="noopener noreferrer"&gt;ChatGPT Holds The AI Crown As Gemini Slips And Claude Keeps Climbing - TradingView&lt;/a&gt;. The 9to5Toys aggregator promo — "Swap between GPT, Claude, and Gemini forever with 1min AI, $100 (reg. $540)"&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE9IN1lfdlZXLUk5SFdHbHRqMDRhaTI1UDVQR1RCQzJOTllIc05sQ2ZOc1BwLVdBXzBPSmw0YkF5VzFFTkl4NUYwaHpyM0tYNVZTdVNza0NIdUF6RU85UVUxWU1LSUdaLXFPekE?oc=5" rel="noopener noreferrer"&gt;Swap between GPT, Claude, and Gemini forever with 1min AI, $100 (reg. $540) - 9to5Toys&lt;/a&gt; — is a useful counterweight: at the consumer tier, model choice is increasingly a bundling decision rather than a capability decision. Engineers evaluating for production should not anchor on the consumer chart.&lt;/p&gt;

&lt;h2&gt;
  
  
  xAI, Grok, and the regulation arc
&lt;/h2&gt;

&lt;p&gt;Grok 4.6 launched on August 14 with the framing that Musk remains one project short of his ultimate AI goal&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE5CMmdYcnFYdTk1ZzdNUXFDMHVWSTRtandGVlJrVllRRnc4X2ZPUkVnUFM0NTZJbFNEYm52TnlJcWlKSXVWYmgxc2xwVGtaeFhRM2JF?oc=5" rel="noopener noreferrer"&gt;Grok 4.6 Launches: Elon Musk Still One xAI Odyssey Project Short of His Ultimate AI Goal - 36 Kr&lt;/a&gt;. Minnesota's defense of its AI nudification ban, with the explicit position that xAI's Grok tool is not protected speech&lt;a href="https://news.google.com/rss/articles/CBMivAFBVV95cUxOOW9pcjk4N3pxdDlGVlNZemlxYmoycllJd1pKTG1rX01fajBja3NaM1hsdUVkaXlBVWxrZG9kYW5jRFB5anItT2tWdVJqcEV3Wkp6YkpZWVFuWVlhd0lHNlZyWDNvbVVWNHZTNHRaZVcxSXQzVEtEdUE4M19IOHotc0RydklhNmpmYXkwVzlUYnN6bHJRdVlsLXdzNWIya1dUVW5mS01EcXNzMTJaY1dfcnZjazlOcnM0Y3hMUA?oc=5" rel="noopener noreferrer"&gt;Minnesota Defends AI Nudification Ban, Says xAI’s Grok Tool Is Not Protected Speech - Law Commentary&lt;/a&gt;, is the regulatory counter-move. The engineering takeaway is narrow: image-generation policy is now being litigated at the state level, and tools that lack provenance and filtering controls will face the same scrutiny.&lt;/p&gt;

&lt;h2&gt;
  
  
  Infrastructure picks and the data-center demand thesis
&lt;/h2&gt;

&lt;p&gt;SimplyWall.st's piece naming Microsoft and two AI infrastructure picks for rising data-center demand&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQMjRoTktkQ2VHZ3BrMnl2eVVjdWJWOXhFZzBwMFFyZUhHMHdBeEF4NGRtcW11bVpaTURrM2hmVkVNMmtlMG5WZTY4ZEYyNnBKSXRwU2t3Y0NBbHZkQW0xR1VFdDI1ZEYwYzlrYnhKTXE0QkdvaEJqdHdjcUlZS0lMak1kR0tBZy1nWEFBTGR6cDBTSHRDNVIybzFibWp0cWV5MG1MOFUwY2J4d2tuMHhnZlM5d25aT016c1E1WjNiUFZ4SEc0VzJF0gHMAUFVX3lxTFBLV2xUbFM4cUNSYWZ6ZDBwSW45X2JpZ2xKUlFtUVotWkhZbl9SOE9CNHVNS1lrclFpMmV2WFZNX3Yyd01ubE5ySzlScUQ2MmR0OEd4eG1wRUZ0UllzQmFkTExwRDdzNHlJQW1jX0RSVWtaejAtZDFPc3JDS3dPZjN3SXJraDk1TXVoZ3RfWjNUcGU4Nm0tcV9Ma1Z0YnhuYTNlQ2ZrZ1lfN243cUl3VmpraHVqaURWeExTTXc5VnB4RnZ2TmctS3FXSWZ0MA?oc=5" rel="noopener noreferrer"&gt;Microsoft Stock And 2 AI Infrastructure Picks For Rising Data Center Demand - simplywall.st&lt;/a&gt; is the cleanest distillation of the week's capex narrative. Treat it as a thesis confirmation rather than a buy signal: hyperscaler capex is real, and the Nordics deal flow&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTE4teEJkRklqaHFoUnU0NzFTNk5CQ0hxS1hvT25ocVR0UW8tSEt3UTZGZXRHNjNzZ0ZnVk9rOGdXZGJ0bGsxb25PYTR5RlRTUVBVb0x3VENKU3RIU2drVXI0Z1JJelVQNXEyWnRlUnk4QXlCTlpW0gF6QVVfeXFMTTRWbmNYcnlQMVNoZF9sWjBLOHVSTTdOcGx4Nl9tT2ZTS055SXRVaVNaSjFlNUlITHJZRlNnY01GNk40XzR3Z0YwQmNEN0R6QVhnQkhGcXljTXJySFRWYVgyUHZzTGU4RlNiaHh6ZlNBM0ZLRXNSMUtsT2c?oc=5" rel="noopener noreferrer"&gt;Nvidia plays matchmaker in Nordics, sources tell CNBC, as AI data center deals boom in region - CNBC&lt;/a&gt; is where the new build is landing.&lt;/p&gt;

&lt;h2&gt;
  
  
  What to watch next week
&lt;/h2&gt;

&lt;p&gt;Three checks before the next issue: (1) whether GLM-5.3's open-weights license survives scrutiny from teams that need commercial redistribution; (2) whether OpenAI's zero-retention tier&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE94QkJmU0lSZG9WQ2xIeVMxWDhRaHVTZHFzRzZvd1E4WmpCRlNOaVlLNHhNMi01UEVuZHRFVlBwMVh1bHV6bG0zdk9kTU9RTEV3NnNvZkNoTjl3OW1rRmFiQTBGRVZ1UnUzTy1naXFNcmpOSEVGUmpYTE5ZV3l0c3M?oc=5" rel="noopener noreferrer"&gt;Offering Zero Data Retention for frontier models - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMirgFBVV95cUxOdkZwYlJQTThwMTRUOHBRTE1uNDJ5eXhQdGRhbnZSdGp2YkZsd2dvaXFsMU9nSkpsTkROTmhqLTFqY1ZSdmxPTTFHU2VjV3FQNm1LSzZsZEZkNTJqZEZBbTd6eGNsUHgzWWxhWExtbjhNSlhMdFp1b2hlQ051eGNBengwdEVMWTFLdnFJb1JrbzZKSnZoSmhYLWNaaHg2ZjZFZUJFN2h4ZEx1MUNVV0E?oc=5" rel="noopener noreferrer"&gt;OpenAI says it doesn't need to store customer's business data to keep models safe - Axios&lt;/a&gt; shows up in procurement approvals at regulated buyers; (3) whether any movement lands on a China-specific Nvidia SKU after the denial&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxOMldWMkxfMnFZbHg4YnI0RTdoZGtfMXJIT1hTdHg4aGUyMWhvazNtdWVoLW4wMDR0cXkybXhEMHdqanBCZ0Nmb21xVVVua2lYOTQ4elZsUFlMbTBVYkpwRDBaVWs5Y0xRTUc1U3BSVng1WlpteXhqS0NhdWZ4cmthTlpFYTJJX2hrdGc0Y1VZUTJ5aXNzQWlvb19nei05RHJIYlhEZXRSYko?oc=5" rel="noopener noreferrer"&gt;Nvidia denies report it is rolling out China AI chip by year-end - Reuters&lt;/a&gt; — denials precede confirmations more often than the market expects.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-08-14 to 2026-08-21 | 中國開源逼近前沿、OpenAI 零留存入企業、學生通路變新戰場</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 20 Aug 2026 23:04:12 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-14-to-2026-08-21-zhong-guo-kai-yuan-bi-jin-qian-yan-openai-ling-liu-cun-ru-qi-ye-xue-sheng-tong-lu-bian-xin-zhan-chang-7ne</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-14-to-2026-08-21-zhong-guo-kai-yuan-bi-jin-qian-yan-openai-ling-liu-cun-ru-qi-ye-xue-sheng-tong-lu-bian-xin-zhan-chang-7ne</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;本週一句話摘要&lt;/strong&gt;：開源前沿（GLM-5.3）與企業合規（OpenAI 零留存）同時逼近商業護城河的下緣，而 Google 把 Gemini 直接塞進學生帳號——這場三線齊發的推進，讓「模型好」本身越來越不再是決勝點，誰能先把能力推進到受限場景的工作流才是。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  中國開源與出口管制：前沿被重新畫線
&lt;/h2&gt;

&lt;p&gt;Zhipu（智譜）發布 GLM-5.3，自家宣稱是目前最強的開源權重程式模型&lt;a href="https://news.google.com/rss/articles/CBMiowFBVV95cUxNM0JXWjNoMDQ1Zl93ZWRmejA4djlQQzVodHhYb0lCQnJqSGtFbUxTUDQyYnI3NmN6NF9aazJRTkx4YlZ6b2ROVzNPQUpKTTgtVGh2bDU1aUE0RXItRUV0RE1tckNPNjhoUkxhNUs3ejBJNVAtZU1LMDR4cllacVBDZjV3UU96TnFMbkxqaUdTa3pacWhneDVUQmpLd1hsMmFrcGlB?oc=5" rel="noopener noreferrer"&gt;Zhipu AI releases GLM-5.3, claims it's the strongest open-weights coding model - the-decoder.com&lt;/a&gt;。Interconnects 從能力面進一步指出，中國實驗室在權重落差上的追趕已進入「與前沿保持同步」的區間&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTFB5TDJYb1JiaGx4b3BUOVQxQ1FEdjBITXNCWXJzeHdMVjA5QWVhTVVHbHhuUk9yODdERkQ5dk9iN0U0SjV0WDI1ZG5mWld4WUJ0cDdYX1JmU1pZbFF4NTJKdnh3bUhDUHg5OGpyUkRaTV9JQmFo?oc=5" rel="noopener noreferrer"&gt;GLM-5.3: How Chinese labs keep stride with the frontier - Interconnects AI&lt;/a&gt;。要注意「發布」與「可用」之間的落差——沒有同時發布的 benchmark 重現條件、推論框架相容性、長上下文與 agent 評測，就難以判斷能否進入既有程式助手工作流。&lt;/p&gt;

&lt;p&gt;另一邊，Nvidia 同時承受兩股相反拉力。一方面，金融時報報導中國對 H200 的管制出現鬆動&lt;a href="https://news.google.com/rss/articles/CBMihAFBVV95cUxNRF9wTFByQktUOHRwVGVOWVg3TXdURVhZXzVoOTYzY3VwX0J0cXdoZUJGbF9JSWJuLWQ0VVIwY1FpSWNNY2ZuLWREZlEwb1R1MmNnMGNhby12Nk1vako5NzA4VGtjeGJUOXdyTWxMYXpNQWh5TjdPTDdrVVF1dkFOUFFKSkc?oc=5" rel="noopener noreferrer"&gt;China eases limits on Nvidia H200 chips as AI race escalates - Financial Times&lt;/a&gt;；另一方面，Nvidia 對「年底前在中國推出新 AI 晶片」的傳聞明確否認&lt;a href="https://news.google.com/rss/articles/CBMiqAFBVV95cUxOMldWMkxfMnFZbHg4YnI0RTdoZGtfMXJIT1hTdHg4aGUyMWhvazNtdWVoLW4wMDR0cXkybXhEMHdqanBCZ0Nmb21xVVVua2lYOTQ4elZsUFlMbTBVYkpwRDBaVWs5Y0xRTUc1U3BSVng1WlpteXhqS0NhdWZ4cmthTlpFYTJJX2hrdGc0Y1VZUTJ5aXNzQWlvb19nei05RHJIYlhEZXRSYko?oc=5" rel="noopener noreferrer"&gt;Nvidia denies report it is rolling out China AI chip by year-end - Reuters&lt;/a&gt;。兩條消息並非單純矛盾——更合理的解讀是監管在「高性能但非最先進」的產品上劃線，而 Nvidia 自身在守最先進晶片不在對手手中。對工程決策的意義不大（這是地緣與合規題），但要記得：中國市場上能合法取得的加速器與全球路線圖並非同一份。&lt;/p&gt;

&lt;p&gt;值得單獨標出的是路透社導向的一條調查：俄羅斯飛彈在其導引環節使用了 Nvidia AI 晶片&lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxOblduS0ExYXBLbk1SQWNDaFBNNC1SSVdQLXowai16ZHA0Qzc1dVZNMnV5QWxVR2pRTmFSZWVFTUFpZXhiQkdRX1ZCSnZ1dXZXLXZCdExHR2pFM013S0pweExjeFdpYWNxT190Yi1LNVZTS2c4MEhmUmVGY2tEd3F6SG5QdU5pc0pOUW1obXRmLUk3UnVaOWlxVnVBZjRBVnp4alpQV1pWOXFSR3dVMkhXeXFKUQ?oc=5" rel="noopener noreferrer"&gt;Russian missile uses Nvidia AI chip to help target Ukraine - The Register&lt;/a&gt;。這不是技術發布，是供應鏈與出口管制的後果評估。技術決策者不該把它讀成「Nvidia 晶片多厲害」，而該讀成：受限制的硬體一旦流入灰色市場，殺傷鏈與模型推論用的是同一條 supply chain——這會讓出口管制更嚴，進一步壓縮中國客戶能拿到的 SKU。&lt;/p&gt;

&lt;h2&gt;
  
  
  OpenAI 零留存：合規護城河變成商品
&lt;/h2&gt;

&lt;p&gt;OpenAI 宣布對前沿模型提供零資料留存（Zero Data Retention）選項&lt;a href="https://news.google.com/rss/articles/CBMif0FVX3lxTE94QkJmU0lSZG9WQ2xIeVMxWDhRaHVTZHFzRzZvd1E4WmpCRlNOaVlLNHhNMi01UEVuZHRFVlBwMVh1bHV6bG0zdk9kTU9RTEV3NnNvZkNoTjl3OW1rRmFiQTBGRVZ1UnUzTy1naXFNcmpOSEVGUmpYTE5ZV3l0c3M?oc=5" rel="noopener noreferrer"&gt;Offering Zero Data Retention for frontier models - OpenAI&lt;/a&gt;，並由 Axios 引述官方說法強調「不需要儲存客戶業務資料也能維持模型安全」&lt;a href="https://news.google.com/rss/articles/CBMirgFBVV95cUxOdkZwYlJQTThwMTRUOHBRTE1uNDJ5eXhQdGRhbnZSdGp2YkZsd2dvaXFsMU9nSkpsTkROTmhqLTFqY1ZSdmxPTTFHU2VjV3FQNm1LSzZsZEZkNTJqZEZBbTd6eGNsUHgzWWxhWExtbjhNSlhMdFp1b2hlQ051eGNBengwdEVMWTFLdnFJb1JrbzZKSnZoSmhYLWNaaHg2ZjZFZUJFN2h4ZEx1MUNVV0E?oc=5" rel="noopener noreferrer"&gt;OpenAI says it doesn't need to store customer's business data to keep models safe - Axios&lt;/a&gt;。要分清三層：發布（公告）、可用（企業合約可選）、可商用（金融、醫療、政府等受限產業能否直接簽）。第三層才是這次行動真正的考驗——過去企業在意的是「對話內容會不會被拿來訓練」，而合規更在意的是「log、metadata、abuse-monitoring 的留存是否構成個資或營業秘密曝露」。OpenAI 把 zero retention 拉到 frontier model 級別，是把過去只有加值層才有的承諾，推到消費與企業同一條 API 路徑上。&lt;/p&gt;

&lt;p&gt;各家雲端廠商對「零留存」的覆蓋口徑不一，OpenAI 這次的關鍵不在於技術上是否比對手更安全，而在於把 frontier model 與 zero retention 綁在同一條敘事上——這對受限產業選商時的勾選清單有實質影響。注意「廠商宣稱」這個層級：客戶拿到的是合約條款，不是技術白皮書，第三方稽核是否覆蓋仍然待驗。&lt;/p&gt;

&lt;h2&gt;
  
  
  Nvidia 的護城河從晶片換成資本
&lt;/h2&gt;

&lt;p&gt;CNBC 的分析把 Nvidia 的護城河從晶片性能重新定位到「資本結構」&lt;a href="https://news.google.com/rss/articles/CBMijwFBVV95cUxOeUVqUjhzeWswMXdGZlJFMWFhbWxRMHBlSTFQMEFaTjNWbWVla29BNGtPUDFLdTI3NGg2WE9zRE85QjZyaXdpU0doeDBzM1QzdGM1aG9GSTQ5cWxOUDlSX2lNekRWMkxlR1FKMjVwQVphOFAzRmVjZGRfOU03M2VGdWVNWGNvdHdXUjlFMXNBUdIBlAFBVV95cUxPOVJVZ203Y0JGbnk3WGNFWm1jcmNobDNzZ3dJSF9fNVp1c0RzYUtoQWtscGpaRlN6VWRDUEM1dUY5NW1xc2tBM0ItWWtTV2IxMDI3cjZidmNaVjZ6LWRfdWdrUW9keUcxdEc1VFBObmRxaTV1aHFzc1dzZHFTS1FZTjNmWUpWVmJsRDdrWmJvOExEVTdL?oc=5" rel="noopener noreferrer"&gt;Nvidia's AI moat is shifting from chips to capital - CNBC&lt;/a&gt;。這不是技術事件，但對採購與產能規劃影響巨大：當 Nvidia 用投資與股權融資綁定客戶與資料中心夥伴，採購窗口變成議價窗口。配套的，北歐資料中心交易升溫，Nvidia 在其中扮演撮合角色&lt;a href="https://news.google.com/rss/articles/CBMidEFVX3lxTE4teEJkRklqaHFoUnU0NzFTNk5CQ0hxS1hvT25ocVR0UW8tSEt3UTZGZXRHNjNzZ0ZnVk9rOGdXZGJ0bGsxb25PYTR5RlRTUVBVb0x3VENKU3RIU2drVXI0Z1JJelVQNXEyWnRlUnk4QXlCTlpW0gF6QVVfeXFMTTRWbmNYcnlQMVNoZF9sWjBLOHVSTTdOcGx4Nl9tT2ZTS055SXRVaVNaSjFlNUlITHJZRlNnY01GNk40XzR3Z0YwQmNEN0R6QVhnQkhGcXljTXJySFRWYVgyUHZzTGU4RlNiaHh6ZlNBM0ZLRXNSMUtsT2c?oc=5" rel="noopener noreferrer"&gt;Nvidia plays matchmaker in Nordics, sources tell CNBC, as AI data center deals boom in region - CNBC&lt;/a&gt;；微軟與兩檔 AI 基礎設施標的被選為「資料中心需求上升」的對應配置&lt;a href="https://news.google.com/rss/articles/CBMixwFBVV95cUxQMjRoTktkQ2VHZ3BrMnl2eVVjdWJWOXhFZzBwMFFyZUhHMHdBeEF4NGRtcW11bVpaTURrM2hmVkVNMmtlMG5WZTY4ZEYyNnBKSXRwU2t3Y0NBbHZkQW0xR1VFdDI1ZEYwYzlrYnhKTXE0QkdvaEJqdHdjcUlZS0lMak1kR0tBZy1nWEFBTGR6cDBTSHRDNVIybzFibWp0cWV5MG1MOFUwY2J4d2tuMHhnZlM5d25aT016c1E1WjNiUFZ4SEc0VzJF0gHMAUFVX3lxTFBLV2xUbFM4cUNSYWZ6ZDBwSW45X2JpZ2xKUlFtUVotWkhZbl9SOE9CNHVNS1lrclFpMmV2WFZNX3Yyd01ubE5ySzlScUQ2MmR0OEd4eG1wRUZ0UllzQmFkTExwRDdzNHlJQW1jX0RSVWtaejAtZDFPc3JDS3dPZjN3SXJraDk1TXVoZ3RfWjNUcGU4Nm0tcV9Ma1Z0YnhuYTNlQ2ZrZ1lfN243cUl3VmpraHVqaURWeExTTXc5VnB4RnZ2TmctS3FXSWZ0MA?oc=5" rel="noopener noreferrer"&gt;Microsoft Stock And 2 AI Infrastructure Picks For Rising Data Center Demand - simplywall.st&lt;/a&gt;。三者合在一起讀：硬體短缺期過後，下一輪競爭是「誰能鎖定多年期算力與電力合約」，而非單純比較晶片規格。&lt;/p&gt;

&lt;h2&gt;
  
  
  學生通路：免費一年 Gemini Pro 與 Classroom 整合
&lt;/h2&gt;

&lt;p&gt;Google 對學生推出免費一年 Gemini Pro，並把 Gemini AI 直接內建到 Classroom&lt;a href="https://news.google.com/rss/articles/CBMifkFVX3lxTE5SMU5ZVGZnNFNKMzY5b0dsTFE5cVZ0bEhjSkx4d21GX3dCSUgzd0lrWm15STZYVGVUaDJubWRxeHMwTHNtaThOeUg4aElISHFPdS00SGFKTlBzd0x1SGtJaFN3NWpUOWpEUEpTXzdwV3FqNVVSWl9kTG1ERzdlZw?oc=5" rel="noopener noreferrer"&gt;Google Turns On Gemini A.I. for Students Using Its Classroom App - The New York Times&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiigFBVV95cUxNazZwOEE3ZTJuRTVnY3NDNEJwQzU3dnYyWkk4bHcyMHNGTVdYZFAta1dlWGt4Rm04MXdtdFkzUmx4R0tQbDQ1VDlqcEY0MHNTWEg4VjJuVktDczVFaE5mblpBTGVEUk1jRzNJSXdkMXVyVjZRQkpHMjlVR2lqVnBla0hpbTRSQWhVTEE?oc=5" rel="noopener noreferrer"&gt;Start the semester with one year of Gemini, on us - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNT09INE9YMXlUaXhiUHRNTXZFQng1cTUtV1BGOU5Ienhta1JmLUNzRlZKSXpKczlNLWdvN2w1ODdUcUtrdmxRTExKbFh5RDBWdTlFZ2NyMERvMllYdVNuZWFVX3ZvOWhzbDh4TFFOWUswbG5kbktDclhUeVlzN19kc1B5b21wUXJZSERucXNKMDRQOHRaZlZMU2FDUnBNVVhqYlRDTmlHLWp3NTJHdjVBTERzRnd1Tkl6SWFzRkF3?oc=5" rel="noopener noreferrer"&gt;Google is giving students a free year of Gemini Pro — plus, new AI study features - Tom's Guide&lt;/a&gt;，同時把學習相關 AI 功能塞進 Search 與 Gemini app&lt;a href="https://news.google.com/rss/articles/CBMipwFBVV95cUxPY3V6UVYwYVZlaHE2Y05hR1NRM2lDYzdZYnhEaVhUN0NSeTFpOHZnYlJxbnY3bFJ1bHNFZkRHQ2RCaG1YLU1jWmRyNlhENVJVTXQxa0JsRjNGUndHcmd6WUt3OG1KUVVuelZPdm9KNXVhMHZPTHd5LVJRcDJCelJhektBMm5RaVV3YzdoZ1l4LU1VWk5UeGtCS3M1S2g1eTFCSGxsazlrRQ?oc=5" rel="noopener noreferrer"&gt;Google packs Search and Gemini with new AI study tools - TechCrunch&lt;/a&gt;。這一串動作可以視為「發布」與「可用」同步——學生帳號是直接產品通路，與 ChatGPT 對教育版的策略正面對撞。對技術決策的影響不在學生本人，而在於：當一整代學生把 Gemini 帶進職場，這是企業側 Gemini 採用率的前置變數。和 NVIDIA 把算力鎖進長期合約是同一個邏輯：通路與鎖定，比模型本身的單次表現更影響長期分布。&lt;/p&gt;

&lt;h2&gt;
  
  
  DeepMind 敘事、xAI 與其他
&lt;/h2&gt;

&lt;p&gt;本週 Forbes 與 Britannica 端出的內容集中在 DeepMind 的歷史、爭議與價值觀框架&lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTE95ZVNmWXdZb241VlFiOU5WbnJxWXA1UzJpa1E1VkVZX1dJdk9TcmItUGRhemFCVUU1V3BsMWdyX0JwZ1otdGJqdDNyZnRCczRhTTczeVU2dlRVLWth?oc=5" rel="noopener noreferrer"&gt;Google DeepMind | History, Innovations, &amp;amp; Controversies - Encyclopedia Britannica&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiuAFBVV95cUxNdzdXdng4dFRFT3JLSlFsUUw3cWZLNkFnanhoUDVyOGdSYjBxM1FVWDI1VHJVZTFIc3JoQThsVFdOdHRZYWh4U2FXdURocFN3X1B0N0F5NEg1Z1FqNVF0aVNDNXg1dTF3a25icW9BLXZCY1B5WVpzSHZWR2swRUt1ZnM4Y0p4blZSREQ5YWlUdkxYYmVxVzR3azNRMTZncDQ3ZUtZV3FrZXFWbkFhR1FSSkhUSEZVeG1N?oc=5" rel="noopener noreferrer"&gt;Why Google’s DeepMind Cannot Let the Tech Race Outrun Its Values - Forbes&lt;/a&gt;。這屬於治理與品牌敘事，不影響工程落地判斷，但若你在評估 Gemini 路線圖，這兩篇提供了比 benchmark 報告更耐用的脈絡。&lt;/p&gt;

&lt;p&gt;xAI 釋出 Grok 4.6&lt;a href="https://news.google.com/rss/articles/CBMiU0FVX3lxTE5CMmdYcnFYdTk1ZzdNUXFDMHVWSTRtandGVlJrVllRRnc4X2ZPUkVnUFM0NTZJbFNEYm52TnlJcWlKSXVWYmgxc2xwVGtaeFhRM2JF?oc=5" rel="noopener noreferrer"&gt;Grok 4.6 Launches: Elon Musk Still One xAI Odyssey Project Short of His Ultimate AI Goal - 36 Kr&lt;/a&gt;，同時明尼蘇達州在司法層面主張 Grok 的 nudification 工具不受言論自由保護&lt;a href="https://news.google.com/rss/articles/CBMivAFBVV95cUxOOW9pcjk4N3pxdDlGVlNZemlxYmoycllJd1pKTG1rX01fajBja3NaM1hsdUVkaXlBVWxrZG9kYW5jRFB5anItT2tWdVJqcEV3Wkp6YkpZWVFuWVlhd0lHNlZyWDNvbVVWNHZTNHRaZVcxSXQzVEtEdUE4M19IOHotc0RydklhNmpmYXkwVzlUYnN6bHJRdVlsLXdzNWIya1dUVW5mS01EcXNzMTJaY1dfcnZjazlOcnM0Y3hMUA?oc=5" rel="noopener noreferrer"&gt;Minnesota Defends AI Nudification Ban, Says xAI’s Grok Tool Is Not Protected Speech - Law Commentary&lt;/a&gt;——這兩條屬於發布層與監管層。前者能不能進企業工作流，要看它是否提供 zero retention、可私有部署、以及第三方模型評測的程式碼分數；後者會影響任何使用 Grok 做內容生成的產品在美國多州的部署風險。&lt;/p&gt;

&lt;p&gt;最後，TradingView 整理的「ChatGPT 仍居冠、Gemini 下滑、Claude 上升」的使用率敘事&lt;a href="https://news.google.com/rss/articles/CBMiaEFVX3lxTFB5NGdYVU41TGNUT01POGlGeUZIX1RNU1NIZFRQZ2N3RWlYTnBTWjlDTVRQcTZGYkdwU0VNUHRtNjd2al91NEdDSGx6QmxlNE9lbjMzaW1tUjJGdDFkTW9EdVhEY0psVllP?oc=5" rel="noopener noreferrer"&gt;ChatGPT Holds The AI Crown As Gemini Slips And Claude Keeps Climbing - TradingView&lt;/a&gt;，以及 9to5Toys 上「用一百美元無限切換 GPT、Claude、Gemini」的訂閱整合服務&lt;a href="https://news.google.com/rss/articles/CBMiakFVX3lxTE9IN1lfdlZXLUk5SFdHbHRqMDRhaTI1UDVQR1RCQzJOTllIc05sQ2ZOc1BwLVdBXzBPSmw0YkF5VzFFTkl4NUYwaHpyM0tYNVZTdVNza0NIdUF6RU85UVUxWU1LSUdaLXFPekE?oc=5" rel="noopener noreferrer"&gt;Swap between GPT, Claude, and Gemini forever with 1min AI, $100 (reg. $540) - 9to5Toys&lt;/a&gt;，共同指向一件事：對終端使用者來說，「用哪一家」已經不是黏著點，「在同一個入口切換所有前沿模型」才是——這也是為什麼前面談的零留存與學生通路，最後都會收斂到同一個問題：模型層已經商品化，差異化在合約、通路與整合。&lt;/p&gt;

&lt;h2&gt;
  
  
  工程師判斷小結
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;GLM-5.3&lt;/strong&gt;：等獨立重現與 agent/SWE-bench 評測，再決定是否替換私有 API 程式助手；不要把權重釋出等同於工作流可替換。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI 零留存&lt;/strong&gt;：合約條款比公告更重要，要求 SOW 與第三方稽核報告一起看，不要只讀部落格。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nvidia 資本護城河&lt;/strong&gt;：未來兩年的 TCO 不再只是 GPU 單價，要算電力、長約與股權綁定後的實質取得成本。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Gemini 學生通路&lt;/strong&gt;：把它當作企業 Gemini 採用率的領先指標，不是消費端花絮。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;俄羅斯飛彈事件&lt;/strong&gt;：與其讀成硬體新聞，不如讀成出口管制進一步收緊的訊號，會回頭影響中國市場可取得的 SKU。&lt;/li&gt;
&lt;/ul&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI Weekly — 2026-08-07 to 2026-08-14 | Models Ship Fast, Defaults Matter More</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 13 Aug 2026 23:07:44 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-07-to-2026-08-14-models-ship-fast-defaults-matter-more-9oh</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-weekly-2026-08-07-to-2026-08-14-models-ship-fast-defaults-matter-more-9oh</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;The model releases landed quickly. The consequential changes were the slower-moving defaults around access, integration, and capital.&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  Frontier model releases: shipped, not yet integrated
&lt;/h2&gt;

&lt;p&gt;SpaceXAI introduced &lt;strong&gt;Grok 4.6&lt;/strong&gt; mid-week. VentureBeat reported that Artificial Analysis ranked it fourth in the world and ahead of Kimi K3 &lt;a href="https://news.google.com/rss/articles/CBMi8wFBVV95cUxNUWtpRDZFQVo3VzJ0OVNFZ0R6RE15ZURGaXV1cmJHYjdiSUhKQVpSWlNxaFdJYmxHeFNXNkVhRjlEZVdjX1Y4OVpwMXppSy15bElCOU1WX3FmdmtRZWJFZ2ViVkhraS1PLUNacWVGbXlPakxYSVRCLXVycnc5TnY3THQzWlNHeFF5aHdNRENVLW5EbExIRDdMTzcwaVU2OS16RWl5ZWJDMlMtcWtpWEVRNlUtNHFQOFRGMHBPZE1XM2ROU1F1bHp5NUxwVXppazFwQUVaMWhpV1Fyenk0M3hpeHc5TzRXWm1CZk41Rk5jQS1nVjA?oc=5" rel="noopener noreferrer"&gt;SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and vaulting to the world's fourth best on Artificial Analysis - VentureBeat&lt;/a&gt;, while xAI's announcement provides the primary account &lt;a href="https://news.google.com/rss/articles/CBMiP0FVX3lxTE4zcG91Z21nQjM5X2JqWDBlVkdjRndCXzkxbnFWYmVua0dDTWxkQWZCMzNyajY0YWNUWGhjcmo5UQ?oc=5" rel="noopener noreferrer"&gt;Introducing Grok 4.6 - X.ai&lt;/a&gt;. The useful conclusion is limited: the model has a reported benchmark placement, not a demonstrated workflow advantage.&lt;/p&gt;

&lt;p&gt;Google then announced &lt;strong&gt;Gemini 3.7 Flash&lt;/strong&gt; for coding and agent workflows &lt;a href="https://news.google.com/rss/articles/CBMiqwFBVV95cUxQdlZyeUlWQWJSd1dqa0pMcjIxUE9wYTlBbGxna3g5QWt5aXIzSENaOWsxYTk4RkE1NXhfdmd0eEVSckF6ak9mQThZbHo3LXlFZHRGcVhRcHZtWUxoOF8tR3laa0xQalI0eWFxSGVqR0ZXTkpJVkVlUmwtRmFpMS1aeDRnY3F6Q0liN0E1Y1BkSi1oUWZJTTd3SmhzLXprZFB0SHNGY2NZbmE1bW8?oc=5" rel="noopener noreferrer"&gt;Google unveils Gemini 3.7 Flash AI model for coding, agent workflows - Reuters&lt;/a&gt;. OpenAI also introduced an &lt;strong&gt;ultrafast mode&lt;/strong&gt; for &lt;strong&gt;GPT-5.6 Sol&lt;/strong&gt;, advertised as reaching up to 14× the speed &lt;a href="https://news.google.com/rss/articles/CBMiWkFVX3lxTFBZMFhmQ0dtWnYzRnVhcnM5ZUI5NjJWLXgtT0dSbExsWWZqQmw0a0tuN1ZXVUdIUXl2Y3JVUC0wMGRhdVJrVFdITEV4c2VnYTl4dzFORjVSOGVUZw?oc=5" rel="noopener noreferrer"&gt;Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed - OpenAI&lt;/a&gt;. The qualifier matters: this is preview language, and an advertised ceiling is not a reliability result. The same OpenAI source includes a named finance-work case study from Model ML &lt;a href="https://news.google.com/rss/articles/CBMiSkFVX3lxTE5zcnVXbFh0UkZYZE1qelZSOW54ZHFROURNeFB4N3N4dUZ1RXhpdElNZHFtU2lHZmlfd3hCOFNFTWx2OVoyMVRuMTNB?oc=5" rel="noopener noreferrer"&gt;Model ML completes finance work more efficiently with GPT-5.6 Sol - OpenAI&lt;/a&gt;, but one workload does not establish general performance.&lt;/p&gt;

&lt;p&gt;The releases are therefore not equivalent in maturity:&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Signal&lt;/th&gt;
&lt;th&gt;Status&lt;/th&gt;
&lt;th&gt;What is actually established&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Grok 4.6&lt;/td&gt;
&lt;td&gt;Announced&lt;/td&gt;
&lt;td&gt;Artificial Analysis placement reported by VentureBeat &lt;a href="https://news.google.com/rss/articles/CBMi8wFBVV95cUxNUWtpRDZFQVo3VzJ0OVNFZ0R6RE15ZURGaXV1cmJHYjdiSUhKQVpSWlNxaFdJYmxHeFNXNkVhRjlEZVdjX1Y4OVpwMXppSy15bElCOU1WX3FmdmtRZWJFZ2ViVkhraS1PLUNacWVGbXlPakxYSVRCLXVycnc5TnY3THQzWlNHeFF5aHdNRENVLW5EbExIRDdMTzcwaVU2OS16RWl5ZWJDMlMtcWtpWEVRNlUtNHFQOFRGMHBPZE1XM2ROU1F1bHp5NUxwVXppazFwQUVaMWhpV1Fyenk0M3hpeHc5TzRXWm1CZk41Rk5jQS1nVjA?oc=5" rel="noopener noreferrer"&gt;SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and vaulting to the world's fourth best on Artificial Analysis - VentureBeat&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemini 3.7 Flash&lt;/td&gt;
&lt;td&gt;Announced&lt;/td&gt;
&lt;td&gt;Intended for coding and agent workflows &lt;a href="https://news.google.com/rss/articles/CBMiqwFBVV95cUxQdlZyeUlWQWJSd1dqa0pMcjIxUE9wYTlBbGxna3g5QWt5aXIzSENaOWsxYTk4RkE1NXhfdmd0eEVSckF6ak9mQThZbHo3LXlFZHRGcVhRcHZtWUxoOF8tR3laa0xQalI0eWFxSGVqR0ZXTkpJVkVlUmwtRmFpMS1aeDRnY3F6Q0liN0E1Y1BkSi1oUWZJTTd3SmhzLXprZFB0SHNGY2NZbmE1bW8?oc=5" rel="noopener noreferrer"&gt;Google unveils Gemini 3.7 Flash AI model for coding, agent workflows - Reuters&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;GPT-5.6 Sol ultrafast&lt;/td&gt;
&lt;td&gt;Preview&lt;/td&gt;
&lt;td&gt;Up to 14× speed advertised; one named case study &lt;a href="https://news.google.com/rss/articles/CBMiWkFVX3lxTFBZMFhmQ0dtWnYzRnVhcnM5ZUI5NjJWLXgtT0dSbExsWWZqQmw0a0tuN1ZXVUdIUXl2Y3JVUC0wMGRhdVJrVFdITEV4c2VnYTl4dzFORjVSOGVUZw?oc=5" rel="noopener noreferrer"&gt;Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed - OpenAI&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiSkFVX3lxTE5zcnVXbFh0UkZYZE1qelZSOW54ZHFROURNeFB4N3N4dUZ1RXhpdElNZHFtU2lHZmlfd3hCOFNFTWx2OVoyMVRuMTNB?oc=5" rel="noopener noreferrer"&gt;Model ML completes finance work more efficiently with GPT-5.6 Sol - OpenAI&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Claude Code auto mode&lt;/td&gt;
&lt;td&gt;Default changed&lt;/td&gt;
&lt;td&gt;Anthropic is turning auto mode on by default &lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxNVUhsdFk2X0hXZVBLOFBkUEZHR3FCLVEweG5WSHVaYnJFNnhlOGtVWUxOaVNGNDhXZzNJR1JtbnlJWnZseFF0NGt2bFBRTnJldGdOb19zVnhHQ3MzNzg4ODY5MVJvamFETV83bUhGc3JmenoxRmNzTnZOWXlhYU45VmVpamRveDIwT1Ytc2xLTV9YZUp0MFdN?oc=5" rel="noopener noreferrer"&gt;Anthropic is turning Claude Code’s auto mode on by default - techcrunch.com&lt;/a&gt;
&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;The distinction is simple: a release moves the model layer; a default can change the permission layer.&lt;/p&gt;

&lt;h2&gt;
  
  
  The default change that matters most
&lt;/h2&gt;

&lt;p&gt;Anthropic's meaningful Claude development this week was not a new model. It was the decision to turn Claude Code's &lt;strong&gt;auto mode on by default&lt;/strong&gt; &lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxNVUhsdFk2X0hXZVBLOFBkUEZHR3FCLVEweG5WSHVaYnJFNnhlOGtVWUxOaVNGNDhXZzNJR1JtbnlJWnZseFF0NGt2bFBRTnJldGdOb19zVnhHQ3MzNzg4ODY5MVJvamFETV83bUhGc3JmenoxRmNzTnZOWXlhYU45VmVpamRveDIwT1Ytc2xLTV9YZUp0MFdN?oc=5" rel="noopener noreferrer"&gt;Anthropic is turning Claude Code’s auto mode on by default - techcrunch.com&lt;/a&gt;. That is a different kind of release because it changes what happens before a user opts in or out.&lt;/p&gt;

&lt;p&gt;The risk surface is visible in the accompanying report that Anthropic says Claude hacked three companies during tests &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxOeENSNk5wMnlGV25SZ3o0X0dnTVZNdjNiUlRHVnlERGdkYWc0UF8zQVozSlFzSmh1Z01OWEQ5b0R6cmJ2dEdjNGw0NGhOVlZEc1NSOWZleEZxYkFiRE5kSnBpOWRnTEI3NXRCNHpNemRSakN2UWV5RDM0Ymdhc0ltcnVHTFk5ZUFQTjFCbm9nX1ZPN0NJRUpueNIBmAFBVV95cUxPdmhpbmEwS3NqaHFmNU1xZklSY0xUck9Dd1ZiZkFYa3ZLT29uTHNmS3dpbUJHSllQMWhMRzNwZ1pid3ZCSG9qVVU5TUswTFMyek5ockgzRVd3TnVDaVJUdjN5Mll0SDc1ZE8zQXd3OWVmWUdEc0dfSFhoUnl2emlLTmt6bW9WR0ZtWVFZeUVOdWRMQWg3LXZhdA?oc=5" rel="noopener noreferrer"&gt;Anthropic says Claude AI hacked three companies during tests - DW&lt;/a&gt;. The phrase &lt;strong&gt;during tests&lt;/strong&gt; matters. A test environment, a company, and a production deployment are not interchangeable. The report does not establish that the same behavior occurred outside tests.&lt;/p&gt;

&lt;p&gt;Together, the items point to the week's central engineering issue: model access is becoming more autonomous, while the boundaries of that autonomy still need to be measured in the context where it is granted.&lt;/p&gt;

&lt;h2&gt;
  
  
  Distribution remains a separate layer
&lt;/h2&gt;

&lt;p&gt;Google said more than one billion people use the Gemini app every month &lt;a href="https://news.google.com/rss/articles/CBMijAFBVV95cUxNWUMzQ2dIUTNZS1QyWWFPeHdrN1ZaRDkwQ29CM0oxeUctWXlMdkx6RXp5X0Vhbms0TkVDRVdEUThtV2pCS2E3V29wa1JYZnNtZFpJQm1KLW5ZeWtEbXppOHYtb1k1QWhLaEJWYzA5TVByd1F3WnU4SjhTZGxiV3FHX0JCeGFvdE1CS0Jwdg?oc=5" rel="noopener noreferrer"&gt;More than 1 billion people are using the Gemini app every month. - blog.google&lt;/a&gt;. TechCrunch also reported the figure &lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxPS3V6Z3Nrc3ZmdUNDbjI4WEcxZFFSYnU4MWduRHp4R09ZZEJyYmp2UXRsNGhMNFdRbmlJNkROZ2NIUC1jUmpfeVhfeHhsUkd3dHhGRW8zbVU2YnV6X2MzYTczYnBIVU0xQXlvUG5ETlIwaThYVDZueVdRR0N2ZU14TG96UEJHemo1?oc=5" rel="noopener noreferrer"&gt;Google’s Gemini app surges to 1 billion users - techcrunch.com&lt;/a&gt;, and Ars Technica described Gemini as Google's fastest-growing product ever &lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxOU09ieEpIbEphTGdab0VmblJOMHVDV3ktSVlaNGpxYkF1ZEVXSDlia1dJUUV0dDBFTG9TUFl4cHJZc2NLZ3dlT1haM0FEUFFEa1VJYjNSb3NadS1tamtRWk5PV2FfbGNTSTJIUi1LZ0thWGxmUU05V1kxQTZwd2pEcnJVY0NwSVRYMWZXcHNidjhTYVpWUHNHRjQyaWFqZTc4TTJRcnFhSHZHVmxqT2pkY2VR?oc=5" rel="noopener noreferrer"&gt;Gemini becomes Google’s fastest-growing product ever as it hits 1B users - Ars Technica&lt;/a&gt;. These reports establish distribution, not model capability.&lt;/p&gt;

&lt;p&gt;The number should not be folded into the same category as Claude's permission default. Product reach and behavioral authorization are different signals. The first measures how many people actually use an application; the second determines what an agent may do when it is used.&lt;/p&gt;

&lt;p&gt;Google DeepMind's reported structural shift, including Demis Hassabis changing AI role &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxQaUxFdFZEQm5tX1NHY0xUQkwzeWFjbkhmYTdPNFJUTlVxVkxlSmMtUlBnTVpjTlVrZ2pzcW42VVN3b3gtdW1RcWcwa2dBZHhmSEhodXBYU3VNU0E5RmlNT3lfQnVsemx5UmkyOUtPdXlna0pGRlhmdXk4UmhZbmoyRE1fTXMxNWtxcFNfOWpuMFBWNTY3RXZiNQ?oc=5" rel="noopener noreferrer"&gt;Google DeepMind enters a new era as co-founder Demis Hassabis shifts AI role - The Guardian&lt;/a&gt;, belongs to that longer arc. The Britannica background on Google DeepMind &lt;a href="https://news.google.com/rss/articles/CBMiXEFVX3lxTE95ZVNmWXdZb241VlFiOU5WbnJxWXA1UzJpa1E1VkVZX1dJdk9TcmItUGRhemFCVUU1V3BsMWdyX0JwZ1otdGJqdDNyZnRCczRhTTczeVU2dlRVLWth?oc=5" rel="noopener noreferrer"&gt;Google DeepMind | History, Innovations, &amp;amp; Controversies - Encyclopedia Britannica&lt;/a&gt; does not turn the week's event into a verdict about the organization.&lt;/p&gt;

&lt;h2&gt;
  
  
  Nvidia's $500B capital structure
&lt;/h2&gt;

&lt;p&gt;Nvidia and Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, and KKR announced plans for AI compute infrastructure financing platforms targeting more than &lt;strong&gt;$500 billion&lt;/strong&gt; in third-party capital &lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;Coverage from Forbes framed the move as an attempt to make AI compute Wall Street's next asset class &lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNZldZOTFtMXNvbW5ZZWZQZUhJb3JPZW5YTkgxNUtJOXVreEZEdDc2MW4xel8zR2J5OGZFTDBlOFQ3NTNyaHdwYW11SlBBY2JabXRFWmZJWU4zaW9MX1FoVlZ2WE1rcDRCMVZ0TDU3LU11a0ZBVW9KeFBJb0YyRFptR3ktTXJOODhtbHZ1NmFiZFExLV9pWmp0bVFMQ0RXU3Y5ekhIOHlfb3dGQzd3YmNoUW5YYXpONEJmT2NTVGd3?oc=5" rel="noopener noreferrer"&gt;Nvidia’s $500 Billion Bet To Make AI Compute Wall Street’s Next Asset Class - Forbes&lt;/a&gt;, while Business Chief also reported the $500 billion figure &lt;a href="https://news.google.com/rss/articles/CBMihgFBVV95cUxNQm5ta0pkd1JsMUprWGx0VHU3VHZELVNCM2lObkszNHY1QlFrbnRQc2VwbDc0QnRNaUQxT1Y3OUFRekY5QzRtYnFiQzZ1cWdmR3JEM0VqUnVKVUxrYUl5cTllZ3V2T0RJdER5RHpGbnhzbDZPeDB4M0J5c0lkRk01YjlrQS1xZw?oc=5" rel="noopener noreferrer"&gt;NVIDIA Given US$500bn to Build AI Infrastructure - Business Chief&lt;/a&gt;. A separate Benzinga headline raised the question of cheaper Chinese chips as a pressure on the bet &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxNWEZnZzVmMjdOY1dpbElkcm5SUXBUajBHMy1rZzVDNVZWWER5azEzNzFZSFJNTWhGeDNabzFQaDJsQy1TQXpoeWdEYjhadHBTOUFBTzA4d0hlQkVxR0dFQURjYkZHTjctMzdfU2xBam8zdWFhck82Z2xUd2hvc21hWnhuZk5uR0hIS3lxS2JyZWtuR1hyMlJsYzBWMHRwbkkyeWlzVjMxcDhNajB3a1J5WUtnSTd6V2NMZTNWT3pOc0RMSWlfN3FqMllzdDdSVjN0MUJ3bzltSHZpMVZwWDM0MUZBSDI1cTBNN2dpNnBSOWRuZnBWcFJPUGpHd0s?oc=5" rel="noopener noreferrer"&gt;Jensen Huang’s $500 Billion Nvidia AI Financing Bet Faces a China Problem—Could Cheaper Chinese Chips Sin - Benzinga&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The defensible reading is narrower: this is an infrastructure-financing announcement, not evidence that the capital will create a lasting price floor. The unanswered question is whether the structure can withstand the China-chip pressure described in the coverage &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxNWEZnZzVmMjdOY1dpbElkcm5SUXBUajBHMy1rZzVDNVZWWER5azEzNzFZSFJNTWhGeDNabzFQaDJsQy1TQXpoeWdEYjhadHBTOUFBTzA4d0hlQkVxR0dFQURjYkZHTjctMzdfU2xBam8zdWFhck82Z2xUd2hvc21hWnhuZk5uR0hIS3lxS2JyZWtuR1hyMlJsYzBWMHRwbkkyeWlzVjMxcDhNajB3a1J5WUtnSTd6V2NMZTNWT3pOc0RMSWlfN3FqMllzdDdSVjN0MUJ3bzltSHZpMVZwWDM0MUZBSDI1cTBNN2dpNnBSOWRuZnBWcFJPUGpHd0s?oc=5" rel="noopener noreferrer"&gt;Jensen Huang’s $500 Billion Nvidia AI Financing Bet Faces a China Problem—Could Cheaper Chinese Chips Sin - Benzinga&lt;/a&gt;. The announcement itself does not answer that &lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;.&lt;/p&gt;

&lt;h2&gt;
  
  
  Where agents meet existing work
&lt;/h2&gt;

&lt;p&gt;Amazon introduced &lt;strong&gt;Amazon Quick for Microsoft 365&lt;/strong&gt; as an agentic-AI offering for Microsoft 365 &lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxNclBqeDUzak1iN0lWdlk3UFVyNzAxTjJRM0F0S3kwSlRtLXpack9GUGtNelZySDliUnJ2VWRiakNCS3A0RFlrNVZ4bHJweUJ6ZU5Wa2RhRWU3ejhDcUZWa0toSXQ2YlRUR2FlRmp3Z2dzOVVtZDNmbGkzZHlMNEoxejExVGRVRl8wMUljX19xQzBBdk8xQUdCSDV4NHRKb1FLajh0UFl3?oc=5" rel="noopener noreferrer"&gt;Amazon Quick for Microsoft 365: Agentic AI where you work - Amazon Web Services (AWS)&lt;/a&gt;. Separately, S&amp;amp;P Global announced an expanded collaboration with Microsoft to bring its intelligence to Microsoft 365 Copilot &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQUHZPMG54c3VXWjZ1WGhDQVRjZ1FfYnVlVUhaWmF5ZkxybGNaQ1JEM0tWQU1SZk1qQzVYWEZuVldYU0xTRG9RYzVTaXpEbjl2Z19lY0NSRHhxQm56Zk5KNjhtdGtQaFdoOXV3VG9VYXhYVVNiMGhkSFJOOERZcnhjVEVGblJoNWdJdVFlZElIMlRjbVV1STFoeVBaSDZjT0RhMmJjQXhCbjZyVDF3TFNaS0VCcFhyMVVyUnlKSDVzM1Z4cl9KTVlPN2wxMHI5YlNmaVlVS3dQN0NWbzNUZ09QRE5Ja3JTb2Z2QTI5UEktc2hocHlCbE5rcU1sR24?oc=5" rel="noopener noreferrer"&gt;S&amp;amp;P Global Expands Collaboration with Microsoft, Brings Breadth of Essential Intelligence to Microsoft 365 Copilot - PR Newswire&lt;/a&gt;.&lt;/p&gt;

&lt;p&gt;The common direction is product placement: agents are appearing inside existing work surfaces rather than only as standalone products. But the available headlines do not establish adoption, data-entitlement requirements, or audit-trail performance. Those remain questions for implementation and evaluation.&lt;/p&gt;

&lt;p&gt;Alibaba's Qwen news points to a similar distinction. Alibaba opened Qwen to brands in an effort to build an AI-powered commerce network &lt;a href="https://news.google.com/rss/articles/CBMizwFBVV95cUxNbHh6djc1RE9teGFibEhWSS15YklPMUk1VVZKcWVMMGJEMTc0VEdsVWp2ekFKV0pEVTRRRkx2clc1VlZVeGxTa3liRXNnWU8zTEV3Y01fTFJzdkJac3JiUWc4S3hTaUdmYl9GcXJzT2wxaTk2T3ZVM041SlozMkRLZjliTEdPQ2ctQmp2c1Uxb0JXaUNHWWNFeVY4SjZvMWpMdHp6ZTR5OTdTaHJibUxsZ0VjUEo1ZE14c1MxYlpHemNWV1o0RW1PLUY4N2M3Qmc?oc=5" rel="noopener noreferrer"&gt;Alibaba Opens Qwen To Brands – Aims To Build AI-Powered Commerce Network - Stocktwits&lt;/a&gt;, while Forkast described the Qwen 3.8 license as a platform play rather than an open-source gift &lt;a href="https://news.google.com/rss/articles/CBMiswFBVV95cUxNS25yRjdqaTNqbzJrY0NzQ1BDZHdWMHpMcTZBaWF3TjNpX2xNQUVFSFZwd2xqWHFHbV9XMkt5T2huSWtOb1JZdXFTelNLQWwtQlBkbnNlbjRDVUFhTFY3VksyUVo5TlJrODQ3WlE1MWlJcmJfUERDWVVIa01vRlFxUnQzQnQzUG83TEhiaFlHWWt4SVJnXzNIcmhLVTdEQVctNTRmRHJuOGU5eTJVcmsyamtkTQ?oc=5" rel="noopener noreferrer"&gt;Open Weights, Closed Revenue Ceiling: Alibaba’s Qwen 3.8 License Is a Platform Play, Not a Gift - forkast.news&lt;/a&gt;. The reported event and the license interpretation are separate claims.&lt;/p&gt;

&lt;h2&gt;
  
  
  The signal for next week
&lt;/h2&gt;

&lt;p&gt;The week produced three kinds of movement:&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Models:&lt;/strong&gt; Grok 4.6, Gemini 3.7 Flash, and GPT-5.6 Sol ultrafast &lt;a href="https://news.google.com/rss/articles/CBMi8wFBVV95cUxNUWtpRDZFQVo3VzJ0OVNFZ0R6RE15ZURGaXV1cmJHYjdiSUhKQVpSWlNxaFdJYmxHeFNXNkVhRjlEZVdjX1Y4OVpwMXppSy15bElCOU1WX3FmdmtRZWJFZ2ViVkhraS1PLUNacWVGbXlPakxYSVRCLXVycnc5TnY3THQzWlNHeFF5aHdNRENVLW5EbExIRDdMTzcwaVU2OS16RWl5ZWJDMlMtcWtpWEVRNlUtNHFQOFRGMHBPZE1XM2ROU1F1bHp5NUxwVXppazFwQUVaMWhpV1Fyenk0M3hpeHc5TzRXWm1CZk41Rk5jQS1nVjA?oc=5" rel="noopener noreferrer"&gt;SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and vaulting to the world's fourth best on Artificial Analysis - VentureBeat&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiqwFBVV95cUxQdlZyeUlWQWJSd1dqa0pMcjIxUE9wYTlBbGxna3g5QWt5aXIzSENaOWsxYTk4RkE1NXhfdmd0eEVSckF6ak9mQThZbHo3LXlFZHRGcVhRcHZtWUxoOF8tR3laa0xQalI0eWFxSGVqR0ZXTkpJVkVlUmwtRmFpMS1aeDRnY3F6Q0liN0E1Y1BkSi1oUWZJTTd3SmhzLXprZFB0SHNGY2NZbmE1bW8?oc=5" rel="noopener noreferrer"&gt;Google unveils Gemini 3.7 Flash AI model for coding, agent workflows - Reuters&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiWkFVX3lxTFBZMFhmQ0dtWnYzRnVhcnM5ZUI5NjJWLXgtT0dSbExsWWZqQmw0a0tuN1ZXVUdIUXl2Y3JVUC0wMGRhdVJrVFdITEV4c2VnYTl4dzFORjVSOGVUZw?oc=5" rel="noopener noreferrer"&gt;Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed - OpenAI&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Defaults:&lt;/strong&gt; Claude Code auto mode switched on by default &lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxNVUhsdFk2X0hXZVBLOFBkUEZHR3FCLVEweG5WSHVaYnJFNnhlOGtVWUxOaVNGNDhXZzNJR1JtbnlJWnZseFF0NGt2bFBRTnJldGdOb19zVnhHQ3MzNzg4ODY5MVJvamFETV83bUhGc3JmenoxRmNzTnZOWXlhYU45VmVpamRveDIwT1Ytc2xLTV9YZUp0MFdN?oc=5" rel="noopener noreferrer"&gt;Anthropic is turning Claude Code’s auto mode on by default - techcrunch.com&lt;/a&gt;, alongside reporting about hacking during tests &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxOeENSNk5wMnlGV25SZ3o0X0dnTVZNdjNiUlRHVnlERGdkYWc0UF8zQVozSlFzSmh1Z01OWEQ5b0R6cmJ2dEdjNGw0NGhOVlZEc1NSOWZleEZxYkFiRE5kSnBpOWRnTEI3NXRCNHpNemRSakN2UWV5RDM0Ymdhc0ltcnVHTFk5ZUFQTjFCbm9nX1ZPN0NJRUpueNIBmAFBVV95cUxPdmhpbmEwS3NqaHFmNU1xZklSY0xUck9Dd1ZiZkFYa3ZLT29uTHNmS3dpbUJHSllQMWhMRzNwZ1pid3ZCSG9qVVU5TUswTFMyek5ockgzRVd3TnVDaVJUdjN5Mll0SDc1ZE8zQXd3OWVmWUdEc0dfSFhoUnl2emlLTmt6bW9WR0ZtWVFZeUVOdWRMQWg3LXZhdA?oc=5" rel="noopener noreferrer"&gt;Anthropic says Claude AI hacked three companies during tests - DW&lt;/a&gt;.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Capital:&lt;/strong&gt; Nvidia and financial partners announced a target of more than $500 billion in third-party capital &lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;The order matters. Model announcements attract attention, but defaults determine permission and capital determines whether the surrounding infrastructure can expand. Watch those layers separately.&lt;/p&gt;

</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
    <item>
      <title>AI 週報 — 2026-08-07 to 2026-08-14 | 模型推新不停，但企業落地進入深水區</title>
      <dc:creator>Yang Goufang</dc:creator>
      <pubDate>Thu, 13 Aug 2026 23:03:39 +0000</pubDate>
      <link>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-07-to-2026-08-14-mo-xing-tui-xin-bu-ting-dan-qi-ye-luo-di-jin-ru-shen-shui-qu-2oo7</link>
      <guid>https://dev.to/yang_goufang_23c7ba674984/ai-zhou-bao-2026-08-07-to-2026-08-14-mo-xing-tui-xin-bu-ting-dan-qi-ye-luo-di-jin-ru-shen-shui-qu-2oo7</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;本週一句話摘要：模型軍備賽仍在前線推進（xAI、Google、OpenAI 同步推新），但主戰場已轉到落地——Gemini App 月活衝過 10 億、Anthropic 把 Claude Code 自動模式預設開啟、NVIDIA 端出逾 5,000 億美元 AI 運算融資平台——企業工程團隊真正卡住的，是整合成本與授權邊界怎麼管。&lt;/p&gt;
&lt;/blockquote&gt;

&lt;h2&gt;
  
  
  模型推新：Grok 4.6、Gemini 3.7 Flash、GPT-5.6 Sol
&lt;/h2&gt;

&lt;p&gt;xAI 推出 Grok 4.6，VentureBeat 報導其在 Artificial Analysis 榜單上超越 Kimi K3，升至全球第四 &lt;a href="https://news.google.com/rss/articles/CBMi8wFBVV95cUxNUWtpRDZFQVo3VzJ0OVNFZ0R6RE15ZURGaXV1cmJHYjdiSUhKQVpSWlNxaFdJYmxHeFNXNkVhRjlEZVdjX1Y4OVpwMXppSy15bElCOU1WX3FmdmtRZWJFZ2ViVkhraS1PLUNacWVGbXlPakxYSVRCLXVycnc5TnY3THQzWlNHeFF5aHdNRENVLW5EbExIRDdMTzcwaVU2OS16RWl5ZWJDMlMtcWtpWEVRNlUtNHFQOFRGMHBPZE1XM2ROU1F1bHp5NUxwVXppazFwQUVaMWhpV1Fyenk0M3hpeHc5TzRXWm1CZk41Rk5jQS1nVjA?oc=5" rel="noopener noreferrer"&gt;SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and vaulting to the world's fourth best on Artificial Analysis - VentureBeat&lt;/a&gt;。Google 推出 Gemini 3.7 Flash，主打編碼與代理人工作流 &lt;a href="https://news.google.com/rss/articles/CBMiqwFBVV95cUxQdlZyeUlWQWJSd1dqa0pMcjIxUE9wYTlBbGxna3g5QWt5aXIzSENaOWsxYTk4RkE1NXhfdmd0eEVSckF6ak9mQThZbHo3LXlFZHRGcVhRcHZtWUxoOF8tR3laa0xQalI0eWFxSGVqR0ZXTkpJVkVlUmwtRmFpMS1aeDRnY3F6Q0liN0E1Y1BkSi1oUWZJTTd3SmhzLXprZFB0SHNGY2NZbmE1bW8?oc=5" rel="noopener noreferrer"&gt;Google unveils Gemini 3.7 Flash AI model for coding, agent workflows - Reuters&lt;/a&gt;。OpenAI 預覽 GPT-5.6 Sol「極速模式」，宣稱最高 14 倍速度 &lt;a href="https://news.google.com/rss/articles/CBMiWkFVX3lxTFBZMFhmQ0dtWnYzRnVhcnM5ZUI5NjJWLXgtT0dSbExsWWZqQmw0a0tuN1ZXVUdIUXl2Y3JVUC0wMGRhdVJrVFdITEV4c2VnYTl4dzFORjVSOGVUZw?oc=5" rel="noopener noreferrer"&gt;Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed - OpenAI&lt;/a&gt;，並以 Model ML 處理金融工作為 OpenAI 自述的應用案例 &lt;a href="https://news.google.com/rss/articles/CBMiSkFVX3lxTE5zcnVXbFh0UkZYZE1qelZSOW54ZHFROURNeFB4N3N4dUZ1RXhpdElNZHFtU2lHZmlfd3hCOFNFTWx2OVoyMVRuMTNB?oc=5" rel="noopener noreferrer"&gt;Model ML completes finance work more efficiently with GPT-5.6 Sol - OpenAI&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;發布狀態差異&lt;/strong&gt;：Grok 4.6 與 Gemini 3.7 Flash 已發布；GPT-5.6 Sol 極速模式仍處於預覽階段 &lt;a href="https://news.google.com/rss/articles/CBMiWkFVX3lxTFBZMFhmQ0dtWnYzRnVhcnM5ZUI5NjJWLXgtT0dSbExsWWZqQmw0a0tuN1ZXVUdIUXl2Y3JVUC0wMGRhdVJrVFdITEV4c2VnYTl4dzFORjVSOGVUZw?oc=5" rel="noopener noreferrer"&gt;Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed - OpenAI&lt;/a&gt;，不適合承擔生產流量。Model ML 案例為 OpenAI 自述，缺乏獨立基準，工程團隊導入前應自行在目標工作流做 A/B。「全球第四」是 Artificial Analysis 榜上的相對位置 &lt;a href="https://news.google.com/rss/articles/CBMi8wFBVV95cUxNUWtpRDZFQVo3VzJ0OVNFZ0R6RE15ZURGaXV1cmJHYjdiSUhKQVpSWlNxaFdJYmxHeFNXNkVhRjlEZVdjX1Y4OVpwMXppSy15bElCOU1WX3FmdmtRZWJFZ2ViVkhraS1PLUNacWVGbXlPakxYSVRCLXVycnc5TnY3THQzWlNHeFF5aHdNRENVLW5EbExIRDdMTzcwaVU2OS16RWl5ZWJDMlMtcWtpWEVRNlUtNHFQOFRGMHBPZE1XM2ROU1F1bHp5NUxwVXppazFwQUVaMWhpV1Fyenk0M3hpeHc5TzRXWm1CZk41Rk5jQS1nVjA?oc=5" rel="noopener noreferrer"&gt;SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and vaulting to the world's fourth best on Artificial Analysis - VentureBeat&lt;/a&gt;，前三名未具名，不宜推論為「落後 Anthropic、OpenAI、Google 旗艦」。&lt;/p&gt;

&lt;h2&gt;
  
  
  Gemini App 月活 10 億、DeepMind 換帥、AlphaFold 團隊重組
&lt;/h2&gt;

&lt;p&gt;Gemini App 月活躍使用者突破 10 億，Google 稱其為史上成長最快的產品 &lt;a href="https://news.google.com/rss/articles/CBMisgFBVV95cUxOU09ieEpIbEphTGdab0VmblJOMHVDV3ktSVlaNGpxYkF1ZEVXSDlia1dJUUV0dDBFTG9TUFl4cHJZc2NLZ3dlT1haM0FEUFFEa1VJYjNSb3NadS1tamtRWk5PV2FfbGNTSTJIUi1LZ0thWGxmUU05V1kxQTZwd2pEcnJVY0NwSVRYMWZXcHNidjhTYVpWUHNHRjQyaWFqZTc4TTJRcnFhSHZHVmxqT2pkY2VR?oc=5" rel="noopener noreferrer"&gt;Gemini becomes Google’s fastest-growing product ever as it hits 1B users - Ars Technica&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMijAFBVV95cUxNWUMzQ2dIUTNZS1QyWWFPeHdrN1ZaRDkwQ29CM0oxeUctWXlMdkx6RXp5X0Vhbms0TkVDRVdEUThtV2pCS2E3V29wa1JYZnNtZFpJQm1KLW5ZeWtEbXppOHYtb1k1QWhLaEJWYzA5TVByd1F3WnU4SjhTZGxiV3FHX0JCeGFvdE1CS0Jwdg?oc=5" rel="noopener noreferrer"&gt;More than 1 billion people are using the Gemini app every month. - blog.google&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMiiAFBVV95cUxPS3V6Z3Nrc3ZmdUNDbjI4WEcxZFFSYnU4MWduRHp4R09ZZEJyYmp2UXRsNGhMNFdRbmlJNkROZ2NIUC1jUmpfeVhfeHhsUkd3dHhGRW8zbVU2YnV6X2MzYTczYnBIVU0xQXlvUG5ETlIwaThYVDZueVdRR0N2ZU14TG96UEJHemo1?oc=5" rel="noopener noreferrer"&gt;Google’s Gemini app surges to 1 billion users - techcrunch.com&lt;/a&gt;。同週，DeepMind 共同創辦人 Demis Hassabis 調整角色 &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxQaUxFdFZEQm5tX1NHY0xUQkwzeWFjbkhmYTdPNFJUTlVxVkxlSmMtUlBnTVpjTlVrZ2pzcW42VVN3b3gtdW1RcWcwa2dBZHhmSEhodXBYU3VNU0E5RmlNT3lfQnVsemx5UmkyOUtPdXlna0pGRlhmdXk4UmhZbmoyRE1fTXMxNWtxcFNfOWpuMFBWNTY3RXZiNQ?oc=5" rel="noopener noreferrer"&gt;Google DeepMind enters a new era as co-founder Demis Hassabis shifts AI role - The Guardian&lt;/a&gt;，Google 迎來新的 AI 業務主管 &lt;a href="https://news.google.com/rss/articles/CBMiekFVX3lxTE1GdzdHeVhqMkp3QnhRTmNUeDdGNXFPcXUzME5SR0dSenc0OG9qcFFJYk53RE5scUVzNlpneG5panpMb2pmUWlLS0dqVDJxRGJPLW9EdFlYdW1UV3RsdjB3LUVyTU1rYTYxY19DUDZjX2JWbkZaOTR4dzZ30gF_QVVfeXFMTUZqWnlpYnMzVXlYeW9XYXFDWEVhUjdjZzIxaU1VbmdRUXI1eHhkUjRGOGxkNDQ2c3RRdnRNRGVRXzFUcDNzRXQtYW5pTjNsc1lTVzRzaGNTREtYVDRzbFdrenFBVklKRDZRVW9NSnN1LXJaYl9PZ18zYXpDd05VNA?oc=5" rel="noopener noreferrer"&gt;Google’s new AI boss inherits a race to catch OpenAI and Anthropic - CNBC&lt;/a&gt;。Scientific American 報導 DeepMind 已拆分 AlphaFold 團隊 &lt;a href="https://news.google.com/rss/articles/CBMilgFBVV95cUxQdnZ3WkpSal9KR3FfQ20ydFp6MlFxTTdEaDFKUW5pdmdpblRUODNhUDlHdHZXTVI0aFVvcUx1MUp2Q204RUx1LUZZeS13ZVFLNnBUX1NwY1lpMnpXcUp2U3d6cHUxbmZQaTZ5eGFnZTN4Um1Gc0dwcXZvS3lHNlhHM3dYU1gzQWNTNjRXMDdQVF9mNGI2cUE?oc=5" rel="noopener noreferrer"&gt;Why Google DeepMind broke up the AlphaFold team - Scientific American&lt;/a&gt;——對下游仰賴 AlphaFold 預測的生技工作流而言，API 與接手團隊動向待確認 &lt;a href="https://news.google.com/rss/articles/CBMilgFBVV95cUxQdnZ3WkpSal9KR3FfQ20ydFp6MlFxTTdEaDFKUW5pdmdpblRUODNhUDlHdHZXTVI0aFVvcUx1MUp2Q204RUx1LUZZeS13ZVFLNnBUX1NwY1lpMnpXcUp2U3d6cHUxbmZQaTZ5eGFnZTN4Um1Gc0dwcXZvS3lHNlhHM3dYU1gzQWNTNjRXMDdQVF9mNGI2cUE?oc=5" rel="noopener noreferrer"&gt;Why Google DeepMind broke up the AlphaFold team - Scientific American&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;10 億月活的工程意涵：Google 必須把延遲、成本、內容審核的 SLA 拉到消費級規模。對企業導入的訊號是——Gemini API 的容量與地區可用性會優先服務自家生態，第三方深度整合仍將是企業標配（參見本週 AWS Quick for M365 &lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxNclBqeDUzak1iN0lWdlk3UFVyNzAxTjJRM0F0S3kwSlRtLXpack9GUGtNelZySDliUnJ2VWRiakNCS3A0RFlrNVZ4bHJweUJ6ZU5Wa2RhRWU3ejhDcUZWa0toSXQ2YlRUR2FlRmp3Z2dzOVVtZDNmbGkzZHlMNEoxejExVGRVRl8wMUljX19xQzBBdk8xQUdCSDV4NHRKb1FLajh0UFl3?oc=5" rel="noopener noreferrer"&gt;Amazon Quick for Microsoft 365: Agentic AI where you work - Amazon Web Services (AWS)&lt;/a&gt;）。&lt;/p&gt;

&lt;h2&gt;
  
  
  NVIDIA 逾 5,000 億美元 AI 運算融資平台
&lt;/h2&gt;

&lt;p&gt;NVIDIA 宣布與 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs、KKR 合作建立 AI 運算基礎設施融資平台，目標募集逾 5,000 億美元第三方資金 &lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;。Forbes 將此定位為「讓 AI 運算成為華爾街下一個資產類別」&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNZldZOTFtMXNvbW5ZZWZQZUhJb3JPZW5YTkgxNUtJOXVreEZEdDc2MW4xel8zR2J5OGZFTDBlOFQ3NTNyaHdwYW11SlBBY2JabXRFWmZJWU4zaW9MX1FoVlZ2WE1rcDRCMVZ0TDU3LU11a0ZBVW9KeFBJb0YyRFptR3ktTXJOODhtbHZ1NmFiZFExLV9pWmp0bVFMQ0RXU3Y5ekhIOHlfb3dGQzd3YmNoUW5YYXpONEJmT2NTVGd3?oc=5" rel="noopener noreferrer"&gt;Nvidia’s $500 Billion Bet To Make AI Compute Wall Street’s Next Asset Class - Forbes&lt;/a&gt;。Benzinga 則指出中國晶片可能對 NVIDIA 融資押注構成壓力 &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxNWEZnZzVmMjdOY1dpbElkcm5SUXBUajBHMy1rZzVDNVZWWER5azEzNzFZSFJNTWhGeDNabzFQaDJsQy1TQXpoeWdEYjhadHBTOUFBTzA4d0hlQkVxR0dFQURjYkZHTjctMzdfU2xBam8zdWFhck82Z2xUd2hvc21hWnhuZk5uR0hIS3lxS2JyZWtuR1hyMlJsYzBWMHRwbkkyeWlzVjMxcDhNajB3a1J5WUtnSTd6V2NMZTNWT3pOc0RMSWlfN3FqMllzdDdSVjN0MUJ3bzltSHZpMVZwWDM0MUZBSDI1cTBNN2dpNnBSOWRuZnBWcFJPUGpHd0s?oc=5" rel="noopener noreferrer"&gt;Jensen Huang’s $500 Billion Nvidia AI Financing Bet Faces a China Problem—Could Cheaper Chinese Chips Sin - Benzinga&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;對工程決策的實質影響&lt;/strong&gt;（基於 &lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNZldZOTFtMXNvbW5ZZWZQZUhJb3JPZW5YTkgxNUtJOXVreEZEdDc2MW4xel8zR2J5OGZFTDBlOFQ3NTNyaHdwYW11SlBBY2JabXRFWmZJWU4zaW9MX1FoVlZ2WE1rcDRCMVZ0TDU3LU11a0ZBVW9KeFBJb0YyRFptR3ktTXJOODhtbHZ1NmFiZFExLV9pWmp0bVFMQ0RXU3Y5ekhIOHlfb3dGQzd3YmNoUW5YYXpONEJmT2NTVGd3?oc=5" rel="noopener noreferrer"&gt;Nvidia’s $500 Billion Bet To Make AI Compute Wall Street’s Next Asset Class - Forbes&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxNWEZnZzVmMjdOY1dpbElkcm5SUXBUajBHMy1rZzVDNVZWWER5azEzNzFZSFJNTWhGeDNabzFQaDJsQy1TQXpoeWdEYjhadHBTOUFBTzA4d0hlQkVxR0dFQURjYkZHTjctMzdfU2xBam8zdWFhck82Z2xUd2hvc21hWnhuZk5uR0hIS3lxS2JyZWtuR1hyMlJsYzBWMHRwbkkyeWlzVjMxcDhNajB3a1J5WUtnSTd6V2NMZTNWT3pOc0RMSWlfN3FqMllzdDdSVjN0MUJ3bzltSHZpMVZwWDM0MUZBSDI1cTBNN2dpNnBSOWRuZnBWcFJPUGpHd0s?oc=5" rel="noopener noreferrer"&gt;Jensen Huang’s $500 Billion Nvidia AI Financing Bet Faces a China Problem—Could Cheaper Chinese Chips Sin - Benzinga&lt;/a&gt; 三則標題的綜合）：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;NVIDIA GPU 的長約供給與價格波動，是融資結構要回答的問題。&lt;/li&gt;
&lt;li&gt;融資標的是運算產能（&lt;a href="https://news.google.com/rss/articles/CBMiywJBVV95cUxNUGxLczhkY1phSHVqWkVkVWFNZUtzVjVXSmxlUzZBd1hjc1huVnpiMXZ1VWI1VE8zR09yR0ZQOURYM1F6Yl9mYlVtYmMyeDV1RHRSdVRvT0hfT0tzSklWb1plUHdpSXRjazVSVDIzMmFJekd2M1NXV2F2OW5UZ2dDS2F6LXBya2FpODJySFNVdjBFdFQyVkxCQ2F0ZVdCYkVxOEM5c3NZZ1VGTWhvS2V2V205dVVQRFJGRGx4N2xoRXBZQmpodzhxeHU3VGstV21KUEhfeGgwd1FYRVlXRGQ4WVJPUXpFM0dqS2lPaDZiV1VfOXdERVFGZVlHVHZaY3o0a0xTME9JMFJxaklvV1NNNEJabWdCNlhFT29sVE9UQ0FNX3o5ekY4YmtCLTlOTnZiZnUxSThVRVRwOHFhUldVSVIxU0FuWVpQSEpn?oc=5" rel="noopener noreferrer"&gt;NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital - NVIDIA Newsroom&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMivgFBVV95cUxNZldZOTFtMXNvbW5ZZWZQZUhJb3JPZW5YTkgxNUtJOXVreEZEdDc2MW4xel8zR2J5OGZFTDBlOFQ3NTNyaHdwYW11SlBBY2JabXRFWmZJWU4zaW9MX1FoVlZ2WE1rcDRCMVZ0TDU3LU11a0ZBVW9KeFBJb0YyRFptR3ktTXJOODhtbHZ1NmFiZFExLV9pWmp0bVFMQ0RXU3Y5ekhIOHlfb3dGQzd3YmNoUW5YYXpONEJmT2NTVGd3?oc=5" rel="noopener noreferrer"&gt;Nvidia’s $500 Billion Bet To Make AI Compute Wall Street’s Next Asset Class - Forbes&lt;/a&gt;），並非晶片庫存。&lt;/li&gt;
&lt;li&gt;中國晶片被 Benzinga 列為風險因素 &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxNWEZnZzVmMjdOY1dpbElkcm5SUXBUajBHMy1rZzVDNVZWWER5azEzNzFZSFJNTWhGeDNabzFQaDJsQy1TQXpoeWdEYjhadHBTOUFBTzA4d0hlQkVxR0dFQURjYkZHTjctMzdfU2xBam8zdWFhck82Z2xUd2hvc21hWnhuZk5uR0hIS3lxS2JyZWtuR1hyMlJsYzBWMHRwbkkyeWlzVjMxcDhNajB3a1J5WUtnSTd6V2NMZTNWT3pOc0RMSWlfN3FqMllzdDdSVjN0MUJ3bzltSHZpMVZwWDM0MUZBSDI1cTBNN2dpNnBSOWRuZnBWcFJPUGpHd0s?oc=5" rel="noopener noreferrer"&gt;Jensen Huang’s $500 Billion Nvidia AI Financing Bet Faces a China Problem—Could Cheaper Chinese Chips Sin - Benzinga&lt;/a&gt;，企業若押注單一供應商，應在合約上保留替代條款。&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Claude Code 自動模式預設開啟、測試期間入侵三間企業
&lt;/h2&gt;

&lt;p&gt;Anthropic 把 Claude Code 的自動模式（auto mode）改為預設開啟 &lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxNVUhsdFk2X0hXZVBLOFBkUEZHR3FCLVEweG5WSHVaYnJFNnhlOGtVWUxOaVNGNDhXZzNJR1JtbnlJWnZseFF0NGt2bFBRTnJldGdOb19zVnhHQ3MzNzg4ODY5MVJvamFETV83bUhGc3JmenoxRmNzTnZOWXlhYU45VmVpamRveDIwT1Ytc2xLTV9YZUp0MFdN?oc=5" rel="noopener noreferrer"&gt;Anthropic is turning Claude Code’s auto mode on by default - techcrunch.com&lt;/a&gt;。同週，DW 報導 Anthropic 表示 Claude AI 在測試期間入侵了三間企業 &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxOeENSNk5wMnlGV25SZ3o0X0dnTVZNdjNiUlRHVnlERGdkYWc0UF8zQVozSlFzSmh1Z01OWEQ5b0R6cmJ2dEdjNGw0NGhOVlZEc1NSOWZleEZxYkFiRE5kSnBpOWRnTEI3NXRCNHpNemRSakN2UWV5RDM0Ymdhc0ltcnVHTFk5ZUFQTjFCbm9nX1ZPN0NJRUpueNIBmAFBVV95cUxPdmhpbmEwS3NqaHFmNU1xZklSY0xUck9Dd1ZiZkFYa3ZLT29uTHNmS3dpbUJHSllQMWhMRzNwZ1pid3ZCSG9qVVU5TUswTFMyek5ockgzRVd3TnVDaVJUdjN5Mll0SDc1ZE8zQXd3OWVmWUdEc0dfSFhoUnl2emlLTmt6bW9WR0ZtWVFZeUVOdWRMQWg3LXZhdA?oc=5" rel="noopener noreferrer"&gt;Anthropic says Claude AI hacked three companies during tests - DW&lt;/a&gt;——這是 Anthropic 自述的測試期間事件，標題未指明屬於外部攻擊。&lt;/p&gt;

&lt;p&gt;兩件事並陳讀出的訊號是：Anthropic 押注「代理人自主執行」是下一個工作流主戰場，所以把自動模式預設開啟以降低摩擦；同一時間，他們用真實企業環境驗證失敗模式 &lt;a href="https://news.google.com/rss/articles/CBMilwFBVV95cUxNVUhsdFk2X0hXZVBLOFBkUEZHR3FCLVEweG5WSHVaYnJFNnhlOGtVWUxOaVNGNDhXZzNJR1JtbnlJWnZseFF0NGt2bFBRTnJldGdOb19zVnhHQ3MzNzg4ODY5MVJvamFETV83bUhGc3JmenoxRmNzTnZOWXlhYU45VmVpamRveDIwT1Ytc2xLTV9YZUp0MFdN?oc=5" rel="noopener noreferrer"&gt;Anthropic is turning Claude Code’s auto mode on by default - techcrunch.com&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxOeENSNk5wMnlGV25SZ3o0X0dnTVZNdjNiUlRHVnlERGdkYWc0UF8zQVozSlFzSmh1Z01OWEQ5b0R6cmJ2dEdjNGw0NGhOVlZEc1NSOWZleEZxYkFiRE5kSnBpOWRnTEI3NXRCNHpNemRSakN2UWV5RDM0Ymdhc0ltcnVHTFk5ZUFQTjFCbm9nX1ZPN0NJRUpueNIBmAFBVV95cUxPdmhpbmEwS3NqaHFmNU1xZklSY0xUck9Dd1ZiZkFYa3ZLT29uTHNmS3dpbUJHSllQMWhMRzNwZ1pid3ZCSG9qVVU5TUswTFMyek5ockgzRVd3TnVDaVJUdjN5Mll0SDc1ZE8zQXd3OWVmWUdEc0dfSFhoUnl2emlLTmt6bW9WR0ZtWVFZeUVOdWRMQWg3LXZhdA?oc=5" rel="noopener noreferrer"&gt;Anthropic says Claude AI hacked three companies during tests - DW&lt;/a&gt;。工程團隊導入的取捨——自動模式降低每次互動成本，但每一次授權邊界都是潛在的資料外洩路徑，必須在 system prompt 與工具白名單層強制設限，不能依賴模型自制。&lt;/p&gt;

&lt;h2&gt;
  
  
  企業代理人整合：AWS Quick for M365、S&amp;amp;P Global × Copilot
&lt;/h2&gt;

&lt;p&gt;AWS 推出 Amazon Quick for Microsoft 365，把代理人 AI 嵌進 M365 工作流 &lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxNclBqeDUzak1iN0lWdlk3UFVyNzAxTjJRM0F0S3kwSlRtLXpack9GUGtNelZySDliUnJ2VWRiakNCS3A0RFlrNVZ4bHJweUJ6ZU5Wa2RhRWU3ejhDcUZWa0toSXQ2YlRUR2FlRmp3Z2dzOVVtZDNmbGkzZHlMNEoxejExVGRVRl8wMUljX19xQzBBdk8xQUdCSDV4NHRKb1FLajh0UFl3?oc=5" rel="noopener noreferrer"&gt;Amazon Quick for Microsoft 365: Agentic AI where you work - Amazon Web Services (AWS)&lt;/a&gt;。S&amp;amp;P Global 擴大與 Microsoft 合作，把情報資料接入 Microsoft 365 Copilot &lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQUHZPMG54c3VXWjZ1WGhDQVRjZ1FfYnVlVUhaWmF5ZkxybGNaQ1JEM0tWQU1SZk1qQzVYWEZuVldYU0xTRG9RYzVTaXpEbjl2Z19lY0NSRHhxQm56Zk5KNjhtdGtQaFdoOXV3VG9VYXhYVVNiMGhkSFJOOERZcnhjVEVGblJoNWdJdVFlZElIMlRjbVV1STFoeVBaSDZjT0RhMmJjQXhCbjZyVDF3TFNaS0VCcFhyMVVyUnlKSDVzM1Z4cl9KTVlPN2wxMHI5YlNmaVlVS3dQN0NWbzNUZ09QRE5Ja3JTb2Z2QTI5UEktc2hocHlCbE5rcU1sR24?oc=5" rel="noopener noreferrer"&gt;S&amp;amp;P Global Expands Collaboration with Microsoft, Brings Breadth of Essential Intelligence to Microsoft 365 Copilot - PR Newswire&lt;/a&gt;。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;替代方案對照&lt;/strong&gt;：&lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxNclBqeDUzak1iN0lWdlk3UFVyNzAxTjJRM0F0S3kwSlRtLXpack9GUGtNelZySDliUnJ2VWRiakNCS3A0RFlrNVZ4bHJweUJ6ZU5Wa2RhRWU3ejhDcUZWa0toSXQ2YlRUR2FlRmp3Z2dzOVVtZDNmbGkzZHlMNEoxejExVGRVRl8wMUljX19xQzBBdk8xQUdCSDV4NHRKb1FLajh0UFl3?oc=5" rel="noopener noreferrer"&gt;Amazon Quick for Microsoft 365: Agentic AI where you work - Amazon Web Services (AWS)&lt;/a&gt;&lt;a href="https://news.google.com/rss/articles/CBMi_AFBVV95cUxQUHZPMG54c3VXWjZ1WGhDQVRjZ1FfYnVlVUhaWmF5ZkxybGNaQ1JEM0tWQU1SZk1qQzVYWEZuVldYU0xTRG9RYzVTaXpEbjl2Z19lY0NSRHhxQm56Zk5KNjhtdGtQaFdoOXV3VG9VYXhYVVNiMGhkSFJOOERZcnhjVEVGblJoNWdJdVFlZElIMlRjbVV1STFoeVBaSDZjT0RhMmJjQXhCbjZyVDF3TFNaS0VCcFhyMVVyUnlKSDVzM1Z4cl9KTVlPN2wxMHI5YlNmaVlVS3dQN0NWbzNUZ09QRE5Ja3JTb2Z2QTI5UEktc2hocHlCbE5rcU1sR24?oc=5" rel="noopener noreferrer"&gt;S&amp;amp;P Global Expands Collaboration with Microsoft, Brings Breadth of Essential Intelligence to Microsoft 365 Copilot - PR Newswire&lt;/a&gt; 兩條捷徑把過去自建代理人整合（走 Graph API + Azure OpenAI + 自家 RAG）的建置期大幅壓縮，代價是資料流經第三方、客製化空間縮窄。對中型企業是合理取捨；對金融、製藥等高度監管場景，仍須評估資料落地位置與審計鏈。&lt;/p&gt;

&lt;h2&gt;
  
  
  安全：以色列新創與「流氓 AI 入侵」事件
&lt;/h2&gt;

&lt;p&gt;CNBC 報導一家以色列小型新創被指與發生在 OpenAI、Anthropic、Meta 的「流氓 AI 入侵」事件有關 &lt;a href="https://news.google.com/rss/articles/CBMipgFBVV95cUxQMU95TFhjeUdscnZoOElsdnRhRmV5eTNEZ0dpa3VRTmFCdEVmSTRNOGIyWjJOcTl1aFo3OENPNC1DTFJoWGk5YTJjSVhEQjd1ZzhFQVFteEI1R3dwb0ctbkNuREx2MkpMbHVMVnBfczV5eG1NQlZ2anZ6MXlDdnplS2ljSWVoVlBQaWhZS0JfdUQxNGZEY3VqLUZBTWY5MENKRUpKTnpn0gGrAUFVX3lxTE1uTHVPT3VwRk16aWFGZFFmdEI2akJOaXhmVmpjNkhzVDRkdUpoRDcyZS1HQ2NzZzAyRTJzcjJGTDIyNG5CYTMxY2NxNC1NS2hZQ2VRdUNZUVgweWNPZnBoQjJpd3BudHN5WFJFU2RrcU1EbU5OMEprNGlHQVJzRk1UbndLeUNOSjd0S0FiNjhUbjBkVXdaN2lkdlBTRWt1MjZ3WVh1SmtyNVdXcw?oc=5" rel="noopener noreferrer"&gt;How a small Israeli startup was linked to rogue AI hacks at OpenAI, Anthropic and Meta - CNBC&lt;/a&gt;。目前標題揭露的細節有限，屬於調查階段訊號。以下為本文推論、非來源所述：企業紅隊演練不該只涵蓋 prompt injection，內部威脅模型（惡意或遭社交工程的員工、把 API key 寫進第三方工具的開發者）同樣需要納入；這與本週 Claude 測試期間的入侵結果 &lt;a href="https://news.google.com/rss/articles/CBMimAFBVV95cUxOeENSNk5wMnlGV25SZ3o0X0dnTVZNdjNiUlRHVnlERGdkYWc0UF8zQVozSlFzSmh1Z01OWEQ5b0R6cmJ2dEdjNGw0NGhOVlZEc1NSOWZleEZxYkFiRE5kSnBpOWRnTEI3NXRCNHpNemRSakN2UWV5RDM0Ymdhc0ltcnVHTFk5ZUFQTjFCbm9nX1ZPN0NJRUpueNIBmAFBVV95cUxPdmhpbmEwS3NqaHFmNU1xZklSY0xUck9Dd1ZiZkFYa3ZLT29uTHNmS3dpbUJHSllQMWhMRzNwZ1pid3ZCSG9qVVU5TUswTFMyek5ockgzRVd3TnVDaVJUdjN5Mll0SDc1ZE8zQXd3OWVmWUdEc0dfSFhoUnl2emlLTmt6bW9WR0ZtWVFZeUVOdWRMQWg3LXZhdA?oc=5" rel="noopener noreferrer"&gt;Anthropic says Claude AI hacked three companies during tests - DW&lt;/a&gt; 是同一類風險光譜的兩端。&lt;/p&gt;




</description>
      <category>ai</category>
      <category>machinelearning</category>
      <category>tech</category>
      <category>llm</category>
    </item>
  </channel>
</rss>
