<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: 4663437Mehdi</title>
    <description>The latest articles on DEV Community by 4663437Mehdi (@4663437mehdi).</description>
    <link>https://dev.to/4663437mehdi</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F3933985%2Fd12e89b2-cc42-404c-b494-5ebd7577086c.png</url>
      <title>DEV Community: 4663437Mehdi</title>
      <link>https://dev.to/4663437mehdi</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/4663437mehdi"/>
    <language>en</language>
    <item>
      <title>The Token Ledger Digest – 2026-08-27</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Thu, 27 Aug 2026 18:17:11 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-27-26oj</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-27-26oj</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-08-27
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Top cost impact:&lt;/strong&gt; DeepSeek’s V4 Flash Vision Exp model saw its prompt price drop 50% and completion price halve, saving &lt;strong&gt;$0.88 per 1M tokens&lt;/strong&gt; total.&lt;/p&gt;

&lt;h3&gt;
  
  
  Price changes
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Vision Exp&lt;/strong&gt; – Prompt ↓$0.44→$0.22 /1M; Completion ↓$1.32→$0.66 /1M. &lt;em&gt;Who:&lt;/em&gt; Vision‑heavy apps (OCR, image QA).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Completion ↑$0.075→$0.10 /1M (prompt unchanged). &lt;em&gt;Who:&lt;/em&gt; Low‑latency chat bots seeing a slight cost rise.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash 0731&lt;/strong&gt; – Prompt ↓$0.06→$0.05 /1M; Completion ↓$0.12→$0.10 /1M. &lt;em&gt;Who:&lt;/em&gt; General‑purpose workloads on this snapshot.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Tencent Hy3&lt;/strong&gt; – Prompt ↓$0.132→$0.0825 /1M; Completion ↓$0.528→$0.33 /1M. &lt;em&gt;Who:&lt;/em&gt; Multimodal services using Hy3.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi K2.7 Code&lt;/strong&gt; – Prompt ↓$0.67→$0.66 /1M (completion flat). &lt;em&gt;Who:&lt;/em&gt; Code‑generation pipelines.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen Qwen3.6 35B A3B&lt;/strong&gt; – Prompt ↓$0.14→$0.10 /1M; Completion ↓$1.00→$0.90 /1M. &lt;em&gt;Who:&lt;/em&gt; Mid‑size LLM users needing cheaper inference.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt ↓$0.089→$0.078 /1M; Completion ↓$0.177→$0.156 /1M. &lt;em&gt;Who:&lt;/em&gt; Users locked to the 0423 checkpoint.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai GLM 4.6&lt;/strong&gt; – Prompt ↓$0.50→$0.43 /1M; Completion ↓$2.00→$1.75 /1M. &lt;em&gt;Who:&lt;/em&gt; Enterprises running GLM‑4.6 at scale.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen Qwen3 235B A22B Instruct 2507&lt;/strong&gt; – Prompt ↓$0.09→$0.0875 /1M; Completion ↓$0.55→$0.35 /1M. &lt;em&gt;Who:&lt;/em&gt; Large‑scale instruction‑following tasks.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Added models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;inclusionai/ling-3.0-flash-fin:free&lt;/strong&gt; – $0 prompt, $0 completion (free). &lt;em&gt;Who:&lt;/em&gt; Cost‑sensitive prototyping.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;qwen/qwen3.8-flash&lt;/strong&gt; – Prompt $0.15 /1M, Completion $0.47 /1M, 1M‑token context. &lt;em&gt;Who:&lt;/em&gt; Long‑context applications needing flash speed.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;z-ai/glm-5.3-flash&lt;/strong&gt; – Prompt $0.075 /1M, Completion $0.25 /1M, 1.31M‑token context. &lt;em&gt;Who:&lt;/em&gt; Users needing large context with low price.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Removed models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;stealth/ox-alpha&lt;/strong&gt; – Free model removed. &lt;em&gt;Who:&lt;/em&gt; Anyone relying on the zero‑cost Ox Alpha.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;z-ai/glm-5.2:batch&lt;/strong&gt; – Prompt $1.40 /1M, Completion $4.40 /1M. &lt;em&gt;Who:&lt;/em&gt; Batch‑job users must migrate.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;mistralai/ministral-8b&lt;/strong&gt; – Prompt $0.11 /1M, Completion $0.11 /1M. &lt;em&gt;Who:&lt;/em&gt; Low‑cost edge‑device developers.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;em&gt;No other meaningful shifts; total models now 417.&lt;/em&gt;&lt;br&gt;&lt;br&gt;
&lt;em&gt;Three cheapest today:&lt;/em&gt; IBM Granite 4.0 Micro ($0.017 prompt / $0.112 completion per 1M), Mistral Nemo ($0.019 prompt / $0.030 completion per 1M), Ling‑3.0‑flash ($0.021 prompt / $0.063 completion per 1M).&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-27" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-08-26</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Wed, 26 Aug 2026 07:57:55 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-26-3nic</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-26-3nic</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-08-26
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.5 397B A17B&lt;/strong&gt; – Prompt price fell from &lt;strong&gt;$0.50&lt;/strong&gt; to &lt;strong&gt;$0.39&lt;/strong&gt; per 1M tokens (‑$0.11/1M); completion price fell from &lt;strong&gt;$3.60&lt;/strong&gt; to &lt;strong&gt;$2.34&lt;/strong&gt; per 1M tokens (‑$1.26/1M).
&lt;em&gt;Who should care:&lt;/em&gt; Teams running large mixture‑of‑experts workloads see per‑token cost drop ~35%.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Other price changes&lt;/strong&gt;&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt ($/1M) Old → New&lt;/th&gt;
&lt;th&gt;Completion ($/1M) Old → New&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Latest&lt;/td&gt;
&lt;td&gt;0.035 → 0.030&lt;/td&gt;
&lt;td&gt;0.10 → 0.075&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash 0731&lt;/td&gt;
&lt;td&gt;0.14 → 0.06&lt;/td&gt;
&lt;td&gt;0.28 → 0.12&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI Kimi Latest&lt;/td&gt;
&lt;td&gt;2.80 → 2.55&lt;/td&gt;
&lt;td&gt;14.0 → 12.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.6 27B&lt;/td&gt;
&lt;td&gt;0.32 → 0.60&lt;/td&gt;
&lt;td&gt;3.20 → 3.60&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Pro 0423&lt;/td&gt;
&lt;td&gt;0.790 → 0.870&lt;/td&gt;
&lt;td&gt;1.581 → 1.740&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Gemma 4 31B&lt;/td&gt;
&lt;td&gt;0.10 → 0.09&lt;/td&gt;
&lt;td&gt;0.34 → 0.34 (unchanged)&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Llama 4 Scout&lt;/td&gt;
&lt;td&gt;0.10 → 0.11&lt;/td&gt;
&lt;td&gt;0.30 → 0.34&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen2.5 VL 72B Instruct&lt;/td&gt;
&lt;td&gt;0.80 → 0.25&lt;/td&gt;
&lt;td&gt;1.00 → 0.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Llama 3.3 70B Instruct&lt;/td&gt;
&lt;td&gt;0.10 → 0.71&lt;/td&gt;
&lt;td&gt;0.32 → 0.71&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;Removed models&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen Plus 0728 (thinking)&lt;/strong&gt; – Prompt $0.26/1M, Completion $0.78/1M, 1M‑token context.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemma 3n 4B&lt;/strong&gt; – Prompt $0.06/1M, Completion $0.12/1M, 32 K‑token context.
&lt;em&gt;Who should care:&lt;/em&gt; Users of these models must switch to alternatives; no further pricing data will be available.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;Total models tracked: 417. No additions today.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-26" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-08-25</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Tue, 25 Aug 2026 07:57:07 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-25-28om</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-25-28om</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-08-25
&lt;/h1&gt;

&lt;h2&gt;
  
  
  Top cost impact
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;Z.ai: GLM 5.1&lt;/strong&gt; – Prompt price ↑ $0.966 → $1.26 /1M (+$0.294); completion ↑ $3.036 → $3.96 /1M (+$0.924).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Anyone running GLM 5.1 at scale; per‑million token cost rises ~30 % for prompts and ~30 % for completions.&lt;/p&gt;

&lt;h2&gt;
  
  
  Added models
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax M3 (free)&lt;/strong&gt; – $0.00 prompt, $0.00 completion /1M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax M2.7 (free)&lt;/strong&gt; – $0.00 prompt, $0.00 completion /1M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral Devstral 2 2512&lt;/strong&gt; – $0.44 prompt, $2.20 completion /1M.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Removed models
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;inclusionAI Ring‑2.6‑1T – $0.075 prompt, $0.625 completion /1M.
&lt;/li&gt;
&lt;li&gt;inclusionAI Ling‑2.6‑1T – $0.075 prompt, $0.625 completion /1M.
&lt;/li&gt;
&lt;li&gt;inclusionAI Ling‑2.6‑flash – $0.01 prompt, $0.03 completion /1M.
&lt;/li&gt;
&lt;li&gt;NVIDIA Nemotron 3 Nano 30B A3B (free) – $0.00 / both.
&lt;/li&gt;
&lt;li&gt;NVIDIA Nemotron Nano 12B 2 VL (free) – $0.00 / both.
&lt;/li&gt;
&lt;li&gt;NVIDIA Nemotron Nano 9B V2 (free) – $0.00 / both.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Price changes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Vision Exp&lt;/strong&gt; – Prompt $0.22 → $0.44 /1M (+$0.22); Completion $0.66 → $1.32 /1M (+$0.66).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen Qwen3.8 27B&lt;/strong&gt; – Prompt $0.40 → $0.425 /1M (+$0.025); Completion $3.00 → $2.55 /1M (‑$0.45).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt $0.04 → $0.035 /1M (‑$0.005); Completion $0.08 → $0.10 /1M (+$0.02).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Thinking Machines Inkling&lt;/strong&gt; – Prompt $1.00 → $0.95 /1M (‑$0.05); Completion unchanged $4.05 /1M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai GLM 5.2&lt;/strong&gt; – Prompt $0.966 → $1.19 /1M (+$0.224); Completion $3.036 → $3.74 /1M (+$0.704).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi Latest&lt;/strong&gt; – Prompt $2.60 → $2.80 /1M (+$0.20); Completion $13.0 → $14.0 /1M (+$1.00).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Pro 0423&lt;/strong&gt; – Prompt $0.526 → $0.790 /1M (+$0.264); Completion $1.052 → $1.581 /1M (+$0.528).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt $0.057 → $0.089 /1M (+$0.031); Completion $0.115 → $0.177 /1M (+$0.062).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax M2.7&lt;/strong&gt; – Prompt $0.24 → $0.30 /1M (+$0.06); Completion $0.96 → $1.20 /1M (+$0.24).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi K2.5&lt;/strong&gt; – Prompt $0.45 → $0.60 /1M (+$0.15); Completion $2.25 → $3.00 /1M (+$0.75).
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;em&gt;Who should care:&lt;/em&gt; Developers budgeting for inference; note the largest upward moves (GLM 5.1, Kimi Latest) and notable drops (Qwen 3.8, Inkling).  &lt;/p&gt;

&lt;p&gt;Total models tracked: 419.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-25" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-08-24</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Mon, 24 Aug 2026 08:03:22 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-24-1c1o</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-24-1c1o</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-08-24
&lt;/h1&gt;

&lt;p&gt;The most cost‑impacting change today is the completion price jump for &lt;strong&gt;Qwen: Qwen3.5 397B A17B&lt;/strong&gt;, rising &lt;strong&gt;+$1.26 / 1M tokens&lt;/strong&gt;.&lt;/p&gt;

&lt;h3&gt;
  
  
  Price changes (per‑million‑token view)
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Qwen: Qwen3.5 397B A17B&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.39 → $0.50 (+$0.11)
&lt;/li&gt;
&lt;li&gt;Completion: $2.34 → $3.60 (+$1.26)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Teams running large‑scale generation workloads with this model; completion costs now exceed $3.50/M.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Qwen: Qwen3.6 27B&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.60 → $0.32 (−$0.28)
&lt;/li&gt;
&lt;li&gt;Completion: $3.60 → $3.20 (−$0.40)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Users of this 27B variant see a 19% prompt and 11% completion cost cut.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.40 → $0.53 (+$0.13)
&lt;/li&gt;
&lt;li&gt;Completion: $0.79 → $1.05 (+$0.26)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Applications relying on the Pro tier will see ~33% higher completion spend.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;MiniMax: MiniMax M2.7&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.30 → $0.24 (−$0.06)
&lt;/li&gt;
&lt;li&gt;Completion: $1.20 → $0.96 (−$0.24)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Cost‑sensitive inference pipelines benefit from a 20% completion reduction.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0731&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.08 → $0.14 (+$0.06)
&lt;/li&gt;
&lt;li&gt;Completion: $0.18 → $0.28 (+$0.10)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Flash users face a 75% prompt and 56% completion increase.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Flash Latest&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: unchanged at $0.04
&lt;/li&gt;
&lt;li&gt;Completion: $0.13 → $0.08 (−$0.05)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Minor completion savings for latency‑critical flash workloads.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Prompt: $0.05 → $0.06 (+$0.006)
&lt;/li&gt;
&lt;li&gt;Completion: $0.10 → $0.11 (+$0.011)
&lt;/li&gt;
&lt;li&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Negligible impact; monitor only if operating at very high volume.&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Cheapest models today (per‑million‑token)
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI: Ling-2.6-flash – Prompt $0.01, Completion $0.03
&lt;/li&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – Prompt $0.017, Completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – Prompt $0.019, Completion $0.030
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 422.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-24" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-08-23</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sun, 23 Aug 2026 07:46:11 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-23-4n5f</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-23-4n5f</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-08-23
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Biggest cost impact:&lt;/strong&gt; MoonshotAI’s Kimi K2.6 saw its completion price jump from &lt;strong&gt;$2.28 / 1M&lt;/strong&gt; to &lt;strong&gt;$4.00 / 1M&lt;/strong&gt; (+$1.72 / 1M) and its prompt price rise from &lt;strong&gt;$0.54 / 1M&lt;/strong&gt; to &lt;strong&gt;$0.95 / 1M&lt;/strong&gt; (+$0.41 / 1M). Developers using this model for long‑form generation should reassess budget forecasts.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Price changes&lt;/strong&gt;&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Change&lt;/th&gt;
&lt;th&gt;Old → New (per 1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Vision Exp&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.44 → $0.22; Completion: $1.32 → $0.66&lt;/td&gt;
&lt;td&gt;Vision‑heavy workloads see ~50% cost cut.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3.8 27B&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.45 → $0.40; Completion: $3.20 → $3.00&lt;/td&gt;
&lt;td&gt;Moderate savings for mid‑size models.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Pro 0813&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $1.188 → $1.122; Completion: $3.564 → $3.366&lt;/td&gt;
&lt;td&gt;Slight trim for Pro tier users.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Meta Muse Glimmer 30B&lt;/td&gt;
&lt;td&gt;Prompt ↑, Completion ↑&lt;/td&gt;
&lt;td&gt;Prompt: $0.30 → $0.35; Completion: $1.10 → $1.50&lt;/td&gt;
&lt;td&gt;Cost rise; consider alternatives for high‑volume tasks.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Latest&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.065 → $0.040; Completion: $0.18 → $0.13&lt;/td&gt;
&lt;td&gt;Ultra‑cheap flash model gets even cheaper.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Thinking Machines Inkling&lt;/td&gt;
&lt;td&gt;Prompt ↑, Completion ↔&lt;/td&gt;
&lt;td&gt;Prompt: $0.95 → $1.00; Completion: $4.05 unchanged&lt;/td&gt;
&lt;td&gt;Prompt‑heavy apps face modest increase.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Pro 0423&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.4475 → $0.3969; Completion: $0.8951 → $0.7938&lt;/td&gt;
&lt;td&gt;Continued cost reduction for Pro line.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash 0423&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.0713 → $0.0517; Completion: $0.1425 → $0.1033&lt;/td&gt;
&lt;td&gt;Flash tier gets cheaper across the board.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OpenAI gpt‑oss‑120b&lt;/td&gt;
&lt;td&gt;Prompt ↑, Completion ↔&lt;/td&gt;
&lt;td&gt;Prompt: $0.030 → $0.037; Completion: $0.17 unchanged&lt;/td&gt;
&lt;td&gt;Small prompt‑cost uptick; negligible for most.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3 30B A3B&lt;/td&gt;
&lt;td&gt;Prompt ↓, Completion ↓&lt;/td&gt;
&lt;td&gt;Prompt: $0.13 → $0.12; Completion: $0.52 → $0.50&lt;/td&gt;
&lt;td&gt;Minor savings for this variant.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;Added model&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Tencent: Hy‑MT2‑7B&lt;/strong&gt; – Prompt $0.074 / 1M, Completion $0.295 / 1M, context 8192. Suitable for low‑latency, budget‑conscious tasks.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today (per 1M tokens)&lt;/strong&gt;  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI: Ling‑2.6‑flash – Prompt $0.01, Completion $0.03
&lt;/li&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – Prompt $0.017, Completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – Prompt $0.019, Completion $0.03
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 422.&lt;/em&gt; No other meaningful changes reported.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-23" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-08-22</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sat, 22 Aug 2026 07:44:30 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-22-kgg</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-22-kgg</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-08-22
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt; OpenAI’s GPT‑5.6 Sol Pro (and its non‑batch variant) dropped prompt pricing from $2.50 to $2.00 per 1M tokens and completion from $15.00 to $10.00 per 1M tokens – a $5.50/M token saving. Anyone running high‑volume completion workloads should see immediate cost cuts.&lt;/p&gt;

&lt;h3&gt;
  
  
  Added (9)
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Spark 1.2 Contributor&lt;/strong&gt; – prompt $0.10/M, completion $0.20/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash Vision Exp&lt;/strong&gt; – prompt $0.44/M, completion $1.32/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ox Alpha&lt;/strong&gt; – free (0/0).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Tencent: Hy‑MT2‑1.8B&lt;/strong&gt; – prompt $0.044/M, completion $0.177/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Tencent: Hy‑MT2‑30B‑A3B&lt;/strong&gt; – prompt $0.074/M, completion $0.295/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Thinking Machines: Inkling Small (free)&lt;/strong&gt; – free.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Thinking Machines: Inkling (free)&lt;/strong&gt; – free.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral: Ministral 8B&lt;/strong&gt; – prompt $0.11/M, completion $0.11/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mancer: Weaver (alpha)&lt;/strong&gt; – prompt $0.50/M, completion $0.75/M.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Removed (2)
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Deep Cogito: Cogito v2.1 671B&lt;/strong&gt; – prompt $1.25/M, completion $1.25/M (no longer available).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: gpt‑oss‑20b (free)&lt;/strong&gt; – free tier withdrawn.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Price Changes (18)
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑5.6 Sol Pro&lt;/strong&gt; – prompt ↓$2.50→$2.00/M, completion ↓$15.00→$10.00/M (‑$5.50/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑5.6 Sol&lt;/strong&gt; – same ‑$5.50/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI GPT Latest&lt;/strong&gt; – same ‑$5.50/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – prompt ↓$1.60→$0.4475/M, completion ↓$3.20→$0.8951/M (‑$3.46/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K2.6&lt;/strong&gt; – prompt ↓$0.95→$0.5415/M, completion ↓$4.00→$2.28/M (‑$2.13/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑5.6 Sol Pro (batch)&lt;/strong&gt; – prompt ↓$1.25→$1.00/M, completion ↓$7.50→$5.00/M (‑$2.75/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑5.6 Sol (batch)&lt;/strong&gt; – same ‑$2.75/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax: MiniMax M2.5&lt;/strong&gt; – prompt ↑$0.225→$0.27/M, completion ↑$0.90→$1.08/M (+$0.225/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemma 4 31B&lt;/strong&gt; – prompt ↑$0.09→$0.10/M (+$0.01/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0731&lt;/strong&gt; – prompt ↓$0.14→$0.08/M, completion ↓$0.28→$0.18/M (‑$0.16/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K2.7 Code&lt;/strong&gt; – prompt ↓$0.71→$0.67/M, completion ↓$3.50→$3.40/M (‑$0.14/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash&lt;/strong&gt; – prompt ↓$0.0886→$0.0713/M, completion ↓$0.1772→$0.1425/M (‑$0.052/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V3.2&lt;/strong&gt; – prompt ↓$0.269→$0.26/M, completion ↓$0.40→$0.38/M (‑$0.029/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – completion ↑$0.14→$0.18/M (+$0.04/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;All other changes&lt;/strong&gt; are under $0.05/M and mainly affect niche tiers.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Who should care
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Cost‑focused teams&lt;/strong&gt; – prioritize the OpenAI Sol Pro/Sol drops and DeepSeek V4 Pro cuts.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Vision‑heavy users&lt;/strong&gt; – new DeepSeek V4 Flash Vision Exp adds multimodal capability at moderate cost.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Free‑tier seekers&lt;/strong&gt; – Ox Alpha, both Inkling models remain zero‑cost.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Batch workloads&lt;/strong&gt; – OpenAI Sol Pro/Sol batch cuts halve expenses.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Budget‑conscious projects&lt;/strong&gt; – the cheapest models today are inclusionAI Ling‑2.6‑flash ($0.01/$0.03/M), IBM Granite 4.0 Micro ($0.017/$0.112/M), and Mistral Nemo ($0.019/$0.03/M).
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 421.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-22" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>AI API Digest – 2026-08-20</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Thu, 20 Aug 2026 07:54:51 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/ai-api-digest-2026-08-20-5g46</link>
      <guid>https://dev.to/4663437mehdi/ai-api-digest-2026-08-20-5g46</guid>
      <description>&lt;h1&gt;
  
  
  AI API Digest – 2026-08-20
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.6 27B&lt;/strong&gt; – Prompt price rose from $0.30 to $0.60 /1M tokens (+$0.30); completion price rose from $2.00 to $3.60 /1M tokens (+$1.60).
&lt;em&gt;Who should care:&lt;/em&gt; Teams using this model for long‑form generation will see per‑million costs jump by ~$1.90; consider alternatives or adjust usage budgets.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Added models&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – Prompt $1.40 /1M, completion $4.40 /1M, 1M‑token context.
&lt;em&gt;Who should care:&lt;/em&gt; Users needing very long context (1M tokens) at moderate pricing.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Removed models&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;AI21: Jamba Large 1.7&lt;/strong&gt; – Prompt $2.00 /1M, completion $8.00 /1M, 256k context.
&lt;em&gt;Who should care:&lt;/em&gt; Migrate workloads; this model is no longer available.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mancer: Weaver (alpha)&lt;/strong&gt; – Prompt $0.50 /1M, completion $0.75 /1M, 8k context.
&lt;em&gt;Who should care:&lt;/em&gt; Alpha users must switch to another provider.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Price changes&lt;/strong&gt; (per‑million tokens)  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Pro 0813&lt;/strong&gt; – Prompt ↓$0.13 (1.32→1.19), completion ↓$0.40 (3.96→3.56).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt ↓$0.01 (0.076→0.065), completion ↓$0.01 (0.153→0.14).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Pro 0423&lt;/strong&gt; – Prompt ↑$0.28 (1.32→1.60), completion ↓$0.76 (3.96→3.20).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt ↑$0.01 (0.083→0.089), completion ↑$0.01 (0.165→0.177).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen3.5‑35B‑A3B&lt;/strong&gt; – Prompt ↑$0.03 (0.225→0.250), completion ↓$0.55 (1.80→1.25).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax M2.5&lt;/strong&gt; – Prompt ↑$0.01 (0.220→0.225), completion unchanged (0.90).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V3 0324&lt;/strong&gt; – Prompt ↓$0.02 (0.270→0.250), completion ↓$0.12 (1.12→1.00).&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today&lt;/strong&gt; (prompt / completion per 1M tokens)  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI: Ling‑2.6‑flash – $0.01 / $0.03
&lt;/li&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – $0.02 / $0.11
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – $0.02 / $0.03
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 414.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-20" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-08-19</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Wed, 19 Aug 2026 07:53:14 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-19-1bmm</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-19-1bmm</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-08-19
&lt;/h1&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2 (batch)&lt;/strong&gt; – Prompt: $0.70 → $1.40/M; Completion: $2.20 → $4.40/M (both doubled). &lt;em&gt;Who should care:&lt;/em&gt; batch users seeing a 2× cost increase.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Thinking Machines: Inkling (batch)&lt;/strong&gt; – Prompt: $0.50 → $1.00/M; Completion: $2.03 → $4.05/M (both doubled). &lt;em&gt;Who should care:&lt;/em&gt; batch workloads now cost twice as much.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K2.7 Code (batch)&lt;/strong&gt; – Prompt: $0.48 → $0.95/M; Completion: $2.00 → $4.00/M (both doubled). &lt;em&gt;Who should care:&lt;/em&gt; batch API consumers facing a 2× price jump.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;NVIDIA: Nemotron 3 Ultra (batch)&lt;/strong&gt; – Prompt: $0.30 → $0.60/M; Completion: $1.80 → $3.60/M (both doubled). &lt;em&gt;Who should care:&lt;/em&gt; batch users experiencing doubled expenses.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax: MiniMax M3 (batch)&lt;/strong&gt; – Prompt: $0.15 → $0.30/M; Completion: $0.60 → $1.20/M (both doubled). &lt;em&gt;Who should care:&lt;/em&gt; batch customers seeing a 2× rise.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2&lt;/strong&gt; – Prompt: $0.50 → $0.97/M (+94%); Completion: $3.15 → $3.04/M (−3.6%). &lt;em&gt;Who should care:&lt;/em&gt; prompt‑heavy applications will notice higher costs.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.6 27B&lt;/strong&gt; – Prompt: $0.60 → $0.30/M (−50%); Completion: $3.60 → $2.00/M (−44%). &lt;em&gt;Who should care:&lt;/em&gt; cost‑sensitive users benefit from lower pricing.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemma 4 31B&lt;/strong&gt; – Prompt: $0.10 → $0.09/M (−10%); Completion unchanged at $0.34/M. &lt;em&gt;Who should care:&lt;/em&gt; minor prompt savings for Google Gemma users.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.5-122B-A10B&lt;/strong&gt; – Prompt: $0.29 → $0.26/M (−10%); Completion: $2.40 → $2.08/M (−13%). &lt;em&gt;Who should care:&lt;/em&gt; moderate savings for both prompt and completion.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K2.5&lt;/strong&gt; – Prompt: $0.57 → $0.45/M (−21%); Completion: $2.85 → $2.25/M (−21%). &lt;em&gt;Who should care:&lt;/em&gt; users see roughly a fifth‑price reduction.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 Next 80B A3B Instruct&lt;/strong&gt; – Prompt: $0.10 → $0.09/M (−10%); Completion unchanged at $1.10/M. &lt;em&gt;Who should care:&lt;/em&gt; slight prompt discount.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt: $0.079 → $0.077/M (−2.7%); Completion: $0.157 → $0.153/M (−2.7%). &lt;em&gt;Who should care:&lt;/em&gt; tiny cost decrease for high‑volume users.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Added: Z.ai: GLM 5.3&lt;/strong&gt; – Prompt: $1.40/M; Completion: $4.40/M. &lt;em&gt;Who should care:&lt;/em&gt; new model option with mid‑range pricing.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Added: LiquidAI: LFM2.5-2.6B (free)&lt;/strong&gt; – Prompt: $0.00/M; Completion: $0.00/M. &lt;em&gt;Who should care:&lt;/em&gt; zero‑cost entry point for experimentation.&lt;/li&gt;
&lt;/ul&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-19" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-08-18</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Tue, 18 Aug 2026 07:52:12 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-18-2lce</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-18-2lce</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-08-18
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Top cost impact:&lt;/strong&gt; OpenAI’s GPT‑5.6 Sol Pro and GPT‑5.6 Sol models cut completion prices by 50% (from &lt;strong&gt;$30.00&lt;/strong&gt; to &lt;strong&gt;$15.00&lt;/strong&gt; per 1M tokens) and halved prompt prices (&lt;strong&gt;$5.00 → $2.50&lt;/strong&gt; per 1M). Their batch variants saw the same proportional drops.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Other notable price changes&lt;/strong&gt;&lt;/p&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Change&lt;/th&gt;
&lt;th&gt;Old → New (per 1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Latest&lt;/td&gt;
&lt;td&gt;↑ Prompt +18% , ↑ Completion +30%&lt;/td&gt;
&lt;td&gt;Prompt: $0.060 → $0.079 ; Completion: $0.121 → $0.157&lt;/td&gt;
&lt;td&gt;Cost‑sensitive users of low‑latency flash models&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OpenAI GPT‑5.6 Luna Pro / Luna&lt;/td&gt;
&lt;td&gt;↑ Prompt +100% , ↑ Completion +100%&lt;/td&gt;
&lt;td&gt;Prompt: $0.10 → $0.20 ; Completion: $0.60 → $1.20&lt;/td&gt;
&lt;td&gt;Teams relying on Luna‑series for high‑throughput tasks&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OpenAI GPT‑5.6 Terra Pro / Terra&lt;/td&gt;
&lt;td&gt;↑ Prompt +100% , ↑ Completion +100%&lt;/td&gt;
&lt;td&gt;Prompt: $1.00 → $2.00 ; Completion: $6.00 → $12.00&lt;/td&gt;
&lt;td&gt;Users of Terra‑class models needing large context&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen Qwen3.6 27B&lt;/td&gt;
&lt;td&gt;↑ Prompt +115% , ↑ Completion +50%&lt;/td&gt;
&lt;td&gt;Prompt: $0.289 → $0.600 ; Completion: $2.40 → $3.60&lt;/td&gt;
&lt;td&gt;Developers using mid‑size Qwen for reasoning&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai GLM 5.2&lt;/td&gt;
&lt;td&gt;↓ Prompt ‑42% , ↓ Completion ‑16%&lt;/td&gt;
&lt;td&gt;Prompt: $1.19 → $0.50 ; Completion: $3.74 → $3.15&lt;/td&gt;
&lt;td&gt;Cost‑focused workloads on GLM 5.2&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;OpenAI GPT Latest&lt;/td&gt;
&lt;td&gt;↓ Prompt ‑50% , ↓ Completion ‑50%&lt;/td&gt;
&lt;td&gt;Prompt: $5.00 → $2.50 ; Completion: $30.00 → $15.00&lt;/td&gt;
&lt;td&gt;General‑purpose API consumers&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai GLM 4.6&lt;/td&gt;
&lt;td&gt;↓ Prompt ‑9% , ↓ Completion ‑9%&lt;/td&gt;
&lt;td&gt;Prompt: $0.55 → $0.50 ; Completion: $2.20 → $2.00&lt;/td&gt;
&lt;td&gt;Light‑usage scenarios&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V3.1 Terminus&lt;/td&gt;
&lt;td&gt;↑ Completion +5%&lt;/td&gt;
&lt;td&gt;Completion: $0.95 → $1.00&lt;/td&gt;
&lt;td&gt;Users needing slightly higher output budget&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;Removed model&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;LiquidAI LFM‑2.5‑2.6B (free) – no longer available.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today (per 1M tokens)&lt;/strong&gt;  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI Ling‑2.6‑flash – Prompt &lt;strong&gt;$0.01&lt;/strong&gt;, Completion &lt;strong&gt;$0.03&lt;/strong&gt;
&lt;/li&gt;
&lt;li&gt;IBM Granite 4.0 Micro – Prompt &lt;strong&gt;$0.017&lt;/strong&gt;, Completion &lt;strong&gt;$0.112&lt;/strong&gt;
&lt;/li&gt;
&lt;li&gt;Mistral Mistral Nemo – Prompt &lt;strong&gt;$0.019&lt;/strong&gt;, Completion &lt;strong&gt;$0.03&lt;/strong&gt;
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 413.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-18" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-08-17</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Mon, 17 Aug 2026 07:59:34 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-17-4o4f</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-08-17-4o4f</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-08-17
&lt;/h1&gt;

&lt;h2&gt;
  
  
  Top Cost Impact
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0813&lt;/strong&gt; – Prompt price ↑ from &lt;strong&gt;$0.435/M&lt;/strong&gt; to &lt;strong&gt;$1.32/M&lt;/strong&gt; (+$0.885/M); completion price ↑ from &lt;strong&gt;$0.87/M&lt;/strong&gt; to &lt;strong&gt;$3.96/M&lt;/strong&gt; (+$3.09/M).
&lt;em&gt;Who should care:&lt;/em&gt; Anyone using this model will see roughly a 4× increase in per‑million‑token cost.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Other Price Changes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2&lt;/strong&gt; – Prompt ↑ $0.308/M → $1.19/M (+$0.882/M); completion ↑ $0.968/M → $3.74/M (+$2.772/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;NVIDIA: Nemotron 3.5 Lightning&lt;/strong&gt; – Prompt ↓ $0.10/M → $0.08/M (−$0.02/M); completion ↓ $0.25/M → $0.20/M (−$0.05/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt ↓ $0.067/M → $0.060/M (−$0.0068/M); completion ↓ $0.134/M → $0.121/M (−$0.0135/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi Latest&lt;/strong&gt; – Prompt ↓ $2.80/M → $2.60/M (−$0.20/M); completion ↓ $14.0/M → $13.0/M (−$1.00/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.6 35B A3B&lt;/strong&gt; – Prompt ↓ $0.15/M → $0.14/M (−$0.01/M); completion unchanged at $1.00/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.6 27B&lt;/strong&gt; – Prompt ↓ $0.30/M → $0.289/M (−$0.011/M); completion ↑ $2.00/M → $2.40/M (+$0.40/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – Prompt ↑ $1.168/M → $1.32/M (+$0.152/M); completion ↑ $2.336/M → $3.96/M (+$1.624/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt ↑ $0.061/M → $0.083/M (+$0.021/M); completion ↑ $0.123/M → $0.165/M (+$0.042/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K2.6&lt;/strong&gt; – Prompt ↑ $0.542/M → $0.95/M (+$0.409/M); completion ↑ $2.28/M → $4.00/M (+$1.72/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemma 4 26B A4B&lt;/strong&gt; – Prompt ↓ $0.12/M → $0.07/M (−$0.05/M); completion ↓ $0.40/M → $0.34/M (−$0.06/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 VL 235B A22B Instruct&lt;/strong&gt; – Prompt ↓ $0.26/M → $0.21/M (−$0.05/M); completion ↑ $1.04/M → $1.90/M (+$0.86/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen2.5 VL 72B Instruct&lt;/strong&gt; – Prompt ↑ $0.25/M → $0.80/M (+$0.55/M); completion ↑ $0.75/M → $1.00/M (+$0.25/M).&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Added Model
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2 (free)&lt;/strong&gt; – Prompt $0/M, completion $0/M, context 128k tokens.
&lt;em&gt;Who should care:&lt;/em&gt; Teams needing a no‑cost, large‑context model for prototyping or low‑budget workloads.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Cheapest Models Today (per‑million‑token)
&lt;/h2&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI: Ling‑2.6‑flash – Prompt $0.01/M, Completion $0.03/M
&lt;/li&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – Prompt $0.017/M, Completion $0.112/M
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – Prompt $0.019/M, Completion $0.030/M
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 414.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-17" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger – 2026-08-16</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sun, 16 Aug 2026 07:43:44 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-2026-08-16-36l1</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-2026-08-16-36l1</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger – 2026-08-16
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt; Qwen Qwen3.6 27B saw its completion price drop from $3.60 to $2.00 per 1M tokens (‑$1.60/1M) and its prompt price fall from $0.60 to $0.30 per 1M tokens (‑$0.30/1M). Developers running long‑form generation workloads should see noticeable savings.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt: $0.070 → $0.067/1M (‑$0.003); Completion: $0.140 → $0.134/1M (‑$0.006).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Users of latency‑sensitive flash variants.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Z.ai GLM 5.2&lt;/strong&gt; – Prompt: $0.49 → $0.31/1M (‑$0.18); Completion: $1.54 → $0.97/1M (‑$0.57).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Teams balancing quality and cost for mid‑size models.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Qwen Qwen3.6 27B&lt;/strong&gt; – Prompt: $0.60 → $0.30/1M (‑$0.30); Completion: $3.60 → $2.00/1M (‑$1.60).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Heavy‑generation pipelines (chat, summarization).&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt: $0.074 → $0.061/1M (‑$0.013); Completion: $0.148 → $0.123/1M (‑$0.025).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Applications needing ultra‑low prompt overhead.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;MoonshotAI Kimi K2.6&lt;/strong&gt; – Prompt: $0.65 → $0.54/1M (‑$0.11); Completion: $3.41 → $2.28/1M (‑$1.13).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Users of long‑context reasoning models.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Qwen Plus 0728 (thinking)&lt;/strong&gt; – Prompt: $0.40 → $0.26/1M (‑$0.14); Completion: $1.20 → $0.78/1M (‑$0.42).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Workloads that enable thinking mode.&lt;/p&gt;&lt;/li&gt;
&lt;li&gt;&lt;p&gt;&lt;strong&gt;Qwen Qwen3 30B A3B&lt;/strong&gt; – Prompt: $0.12 → $0.13/1M (+$0.01); Completion: $0.50 → $0.52/1M (+$0.02).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Slight cost increase; monitor usage if budget‑tight.&lt;/p&gt;&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today (per 1M tokens):&lt;/strong&gt;  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;inclusionAI Ling‑2.6‑flash – Prompt $0.01, Completion $0.03
&lt;/li&gt;
&lt;li&gt;IBM Granite 4.0 Micro – Prompt $0.017, Completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral Nemo – Prompt $0.019, Completion $0.03
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Total models tracked: 413. No models were added or removed today.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-16" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-08-15</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sat, 15 Aug 2026 07:43:19 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-15-3j8d</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-08-15-3j8d</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-08-15
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.1&lt;/strong&gt; – Prompt price fell from &lt;strong&gt;$1.40 / 1M&lt;/strong&gt; to &lt;strong&gt;$0.966 / 1M&lt;/strong&gt; (−$0.434); completion price fell from &lt;strong&gt;$4.40 / 1M&lt;/strong&gt; to &lt;strong&gt;$3.036 / 1M&lt;/strong&gt; (−$1.364). Total cost ↓ &lt;strong&gt;$1.798 / 1M&lt;/strong&gt;.
&lt;em&gt;Who should care:&lt;/em&gt; Teams running high‑volume inference on GLM 5.1 will see ~40% lower per‑million‑token spend.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Added Models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.8 27B&lt;/strong&gt; – Prompt &lt;strong&gt;$0.45 / 1M&lt;/strong&gt;, Completion &lt;strong&gt;$3.20 / 1M&lt;/strong&gt;, context 262,144 tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Dots Studio: Dots3‑Note Preview (free)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.00&lt;/strong&gt;, Completion &lt;strong&gt;$0.00&lt;/strong&gt;, context 512,000 tokens.
&lt;em&gt;Who should care:&lt;/em&gt; Developers needing a free, long‑context model for note‑taking or prototyping.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Price Changes (selected highlights)
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Old Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;New Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;Δ Prompt&lt;/th&gt;
&lt;th&gt;Old Comp ($/1M)&lt;/th&gt;
&lt;th&gt;New Comp ($/1M)&lt;/th&gt;
&lt;th&gt;Δ Comp&lt;/th&gt;
&lt;th&gt;Δ Total ($/1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Latest&lt;/td&gt;
&lt;td&gt;0.08&lt;/td&gt;
&lt;td&gt;0.07&lt;/td&gt;
&lt;td&gt;−0.01&lt;/td&gt;
&lt;td&gt;0.252&lt;/td&gt;
&lt;td&gt;0.14&lt;/td&gt;
&lt;td&gt;−0.112&lt;/td&gt;
&lt;td&gt;−0.122&lt;/td&gt;
&lt;td&gt;Cost‑sensitive batch jobs&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai: GLM 5.2&lt;/td&gt;
&lt;td&gt;0.63&lt;/td&gt;
&lt;td&gt;0.49&lt;/td&gt;
&lt;td&gt;−0.14&lt;/td&gt;
&lt;td&gt;1.98&lt;/td&gt;
&lt;td&gt;1.54&lt;/td&gt;
&lt;td&gt;−0.44&lt;/td&gt;
&lt;td&gt;−0.58&lt;/td&gt;
&lt;td&gt;Mid‑scale LLM users&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI: Kimi K2.7 Code&lt;/td&gt;
&lt;td&gt;0.67&lt;/td&gt;
&lt;td&gt;0.71&lt;/td&gt;
&lt;td&gt;+0.04&lt;/td&gt;
&lt;td&gt;3.40&lt;/td&gt;
&lt;td&gt;3.50&lt;/td&gt;
&lt;td&gt;+0.10&lt;/td&gt;
&lt;td&gt;+0.14&lt;/td&gt;
&lt;td&gt;Teams needing slightly higher quality&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash 0423&lt;/td&gt;
&lt;td&gt;0.14&lt;/td&gt;
&lt;td&gt;0.074&lt;/td&gt;
&lt;td&gt;−0.066&lt;/td&gt;
&lt;td&gt;0.28&lt;/td&gt;
&lt;td&gt;0.148&lt;/td&gt;
&lt;td&gt;−0.132&lt;/td&gt;
&lt;td&gt;−0.198&lt;/td&gt;
&lt;td&gt;Flash inference workloads&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Tencent: Hy3 preview&lt;/td&gt;
&lt;td&gt;0.063&lt;/td&gt;
&lt;td&gt;0.18&lt;/td&gt;
&lt;td&gt;+0.117&lt;/td&gt;
&lt;td&gt;0.21&lt;/td&gt;
&lt;td&gt;0.60&lt;/td&gt;
&lt;td&gt;+0.39&lt;/td&gt;
&lt;td&gt;+0.507&lt;/td&gt;
&lt;td&gt;Experimental preview users&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI: Kimi K2.6&lt;/td&gt;
&lt;td&gt;0.95&lt;/td&gt;
&lt;td&gt;0.65&lt;/td&gt;
&lt;td&gt;−0.30&lt;/td&gt;
&lt;td&gt;4.00&lt;/td&gt;
&lt;td&gt;3.41&lt;/td&gt;
&lt;td&gt;−0.59&lt;/td&gt;
&lt;td&gt;−0.89&lt;/td&gt;
&lt;td&gt;Code‑gen pipelines&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen: Qwen3.5‑35B‑A3B&lt;/td&gt;
&lt;td&gt;0.25&lt;/td&gt;
&lt;td&gt;0.225&lt;/td&gt;
&lt;td&gt;−0.025&lt;/td&gt;
&lt;td&gt;1.25&lt;/td&gt;
&lt;td&gt;1.80&lt;/td&gt;
&lt;td&gt;+0.55&lt;/td&gt;
&lt;td&gt;+0.525&lt;/td&gt;
&lt;td&gt;Balanced prompt/completion shift&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen: Qwen3.5 397B A17B&lt;/td&gt;
&lt;td&gt;0.50&lt;/td&gt;
&lt;td&gt;0.39&lt;/td&gt;
&lt;td&gt;−0.11&lt;/td&gt;
&lt;td&gt;3.60&lt;/td&gt;
&lt;td&gt;2.34&lt;/td&gt;
&lt;td&gt;−1.26&lt;/td&gt;
&lt;td&gt;−1.37&lt;/td&gt;
&lt;td&gt;Large‑model cost optimizers&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai: GLM 5&lt;/td&gt;
&lt;td&gt;0.95&lt;/td&gt;
&lt;td&gt;0.60&lt;/td&gt;
&lt;td&gt;−0.35&lt;/td&gt;
&lt;td&gt;2.55&lt;/td&gt;
&lt;td&gt;1.92&lt;/td&gt;
&lt;td&gt;−0.63&lt;/td&gt;
&lt;td&gt;−0.98&lt;/td&gt;
&lt;td&gt;General purpose GLM users&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai: GLM 4.6&lt;/td&gt;
&lt;td&gt;0.50&lt;/td&gt;
&lt;td&gt;0.55&lt;/td&gt;
&lt;td&gt;+0.05&lt;/td&gt;
&lt;td&gt;2.00&lt;/td&gt;
&lt;td&gt;2.20&lt;/td&gt;
&lt;td&gt;+0.20&lt;/td&gt;
&lt;td&gt;+0.25&lt;/td&gt;
&lt;td&gt;Slight uptick for legacy GLM&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Meta: Llama 4 Maverick&lt;/td&gt;
&lt;td&gt;0.20&lt;/td&gt;
&lt;td&gt;0.20&lt;/td&gt;
&lt;td&gt;0.00&lt;/td&gt;
&lt;td&gt;0.696&lt;/td&gt;
&lt;td&gt;0.80&lt;/td&gt;
&lt;td&gt;+0.104&lt;/td&gt;
&lt;td&gt;+0.104&lt;/td&gt;
&lt;td&gt;Maverick adopters&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;strong&gt;No models were removed today.&lt;/strong&gt;  &lt;/p&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 413.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-08-15" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
  </channel>
</rss>
