<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: 4663437Mehdi</title>
    <description>The latest articles on DEV Community by 4663437Mehdi (@4663437mehdi).</description>
    <link>https://dev.to/4663437mehdi</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F3933985%2Fd12e89b2-cc42-404c-b494-5ebd7577086c.png</url>
      <title>DEV Community: 4663437Mehdi</title>
      <link>https://dev.to/4663437mehdi</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/4663437mehdi"/>
    <language>en</language>
    <item>
      <title>Token Ledger Digest – 2026-09-17</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Thu, 17 Sep 2026 12:35:36 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-17-2gmj</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-17-2gmj</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-17
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt; Z.ai’s GLM 5.2 saw its prompt price rise from $0.60 to $1.40 per 1M tokens and completion from $2.00 to $4.40 per 1M tokens – a &lt;strong&gt;+$3.20/M&lt;/strong&gt; increase. Developers running latency‑critical or high‑volume workloads on this model should re‑evaluate cost budgets or consider alternatives.&lt;/p&gt;

&lt;h3&gt;
  
  
  Added models
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;Completion ($/1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;stealth/union‑alpha&lt;/td&gt;
&lt;td&gt;0.00&lt;/td&gt;
&lt;td&gt;0.00&lt;/td&gt;
&lt;td&gt;Experimental users seeking zero‑cost access.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;deepseek/deepseek‑pro‑latest&lt;/td&gt;
&lt;td&gt;0.66&lt;/td&gt;
&lt;td&gt;1.98&lt;/td&gt;
&lt;td&gt;Teams needing strong reasoning at moderate price.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;deepseek/deepseek‑flash‑latest&lt;/td&gt;
&lt;td&gt;0.15&lt;/td&gt;
&lt;td&gt;0.60&lt;/td&gt;
&lt;td&gt;Cost‑sensitive apps requiring fast responses.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;z‑ai/glm‑5.2:free&lt;/td&gt;
&lt;td&gt;0.00&lt;/td&gt;
&lt;td&gt;0.00&lt;/td&gt;
&lt;td&gt;Anyone wanting a free, medium‑context model.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h3&gt;
  
  
  Removed models
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;Completion ($/1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;thinkingmachines/inkling‑small:batch&lt;/td&gt;
&lt;td&gt;0.50&lt;/td&gt;
&lt;td&gt;1.20&lt;/td&gt;
&lt;td&gt;Batch‑oriented users losing a cheap option.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;google/gemma‑4‑31b‑it:batch&lt;/td&gt;
&lt;td&gt;0.39&lt;/td&gt;
&lt;td&gt;0.97&lt;/td&gt;
&lt;td&gt;Users of Google’s batch‑tuned Gemma.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;openai/gpt‑oss‑20b:batch&lt;/td&gt;
&lt;td&gt;0.05&lt;/td&gt;
&lt;td&gt;0.20&lt;/td&gt;
&lt;td&gt;Low‑cost batch workloads now unavailable.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;google/gemini‑2.5‑pro‑preview‑05‑06&lt;/td&gt;
&lt;td&gt;1.25&lt;/td&gt;
&lt;td&gt;10.00&lt;/td&gt;
&lt;td&gt;High‑preview Gemini users losing access.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;openai/gpt‑4‑turbo‑preview&lt;/td&gt;
&lt;td&gt;10.00&lt;/td&gt;
&lt;td&gt;30.00&lt;/td&gt;
&lt;td&gt;Anyone relying on the preview Turbo model.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h3&gt;
  
  
  Notable price changes (top 5 by absolute impact)
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Old Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;New Prompt ($/1M)&lt;/th&gt;
&lt;th&gt;Old Comp. ($/1M)&lt;/th&gt;
&lt;th&gt;New Comp. ($/1M)&lt;/th&gt;
&lt;th&gt;Net Δ ($/1M)&lt;/th&gt;
&lt;th&gt;Who should care&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;z‑ai/glm‑5.2&lt;/td&gt;
&lt;td&gt;0.60 → 1.40&lt;/td&gt;
&lt;td&gt;+0.80&lt;/td&gt;
&lt;td&gt;2.00 → 4.40&lt;/td&gt;
&lt;td&gt;+2.40&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;+3.20&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;High‑volume GLM 5.2 users.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;moonshotai/kimi‑k3&lt;/td&gt;
&lt;td&gt;2.65 → 3.00&lt;/td&gt;
&lt;td&gt;+0.35&lt;/td&gt;
&lt;td&gt;13.28 → 15.00&lt;/td&gt;
&lt;td&gt;+1.72&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;+2.07&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;Kimi‑K3 adopters seeing higher spend.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;meta/muse‑glimmer‑30b&lt;/td&gt;
&lt;td&gt;0.35 → 0.30&lt;/td&gt;
&lt;td&gt;–0.05&lt;/td&gt;
&lt;td&gt;1.50 → 1.10&lt;/td&gt;
&lt;td&gt;–0.40&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;–0.45&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;Cost‑conscious Muse users benefit.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;z‑ai/glm‑5.3&lt;/td&gt;
&lt;td&gt;1.09 → 1.40&lt;/td&gt;
&lt;td&gt;+0.31&lt;/td&gt;
&lt;td&gt;3.43 → 4.40&lt;/td&gt;
&lt;td&gt;+0.97&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;+1.28&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;GLM 5.3 workloads now pricier.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;deepseek/deepseek‑v4‑pro‑0813&lt;/td&gt;
&lt;td&gt;0.58 → 0.66&lt;/td&gt;
&lt;td&gt;+0.08&lt;/td&gt;
&lt;td&gt;1.73 → 1.98&lt;/td&gt;
&lt;td&gt;+0.25&lt;/td&gt;
&lt;td&gt;&lt;strong&gt;+0.33&lt;/strong&gt;&lt;/td&gt;
&lt;td&gt;DeepSeek V4 Pro users face modest rise.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;em&gt;All other price changes were smaller than $0.33/M.&lt;/em&gt;  &lt;/p&gt;

&lt;p&gt;Total models tracked: &lt;strong&gt;444&lt;/strong&gt;.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-17" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-13</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sun, 13 Sep 2026 12:43:44 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-13-j1j</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-13-j1j</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-13
&lt;/h1&gt;

&lt;p&gt;12 price changes, no additions or removals.&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.79/1M&lt;/strong&gt; to &lt;strong&gt;$1.60/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$1.58/1M&lt;/strong&gt; to &lt;strong&gt;$3.20/1M&lt;/strong&gt;. Developers running high‑volume inference will see ≈+$2.43 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K3&lt;/strong&gt; – prompt rose from &lt;strong&gt;$2.30/1M&lt;/strong&gt; to &lt;strong&gt;$2.65/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$11.55/1M&lt;/strong&gt; to &lt;strong&gt;$13.28/1M&lt;/strong&gt;. Cost‑sensitive apps using this model face ≈+$2.08 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3&lt;/strong&gt; – prompt fell from &lt;strong&gt;$1.40/1M&lt;/strong&gt; to &lt;strong&gt;$1.09/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$4.40/1M&lt;/strong&gt; to &lt;strong&gt;$3.43/1M&lt;/strong&gt;. Users benefit ≈‑$1.28 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi Latest&lt;/strong&gt; – prompt fell from &lt;strong&gt;$2.13/1M&lt;/strong&gt; to &lt;strong&gt;$2.10/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$11.90/1M&lt;/strong&gt; to &lt;strong&gt;$10.95/1M&lt;/strong&gt;. Savings ≈‑$0.98 per 1M tokens for existing workloads.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Llama 3.1 70B Instruct&lt;/strong&gt; – prompt fell from &lt;strong&gt;$0.72/1M&lt;/strong&gt; to &lt;strong&gt;$0.40/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$0.72/1M&lt;/strong&gt; to &lt;strong&gt;$0.40/1M&lt;/strong&gt;. Reduction ≈‑$0.64 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Glimmer 30B&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.30/1M&lt;/strong&gt; to &lt;strong&gt;$0.35/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$1.10/1M&lt;/strong&gt; to &lt;strong&gt;$1.50/1M&lt;/strong&gt;. Increase ≈+$0.45 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3 Flash&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.08/1M&lt;/strong&gt; to &lt;strong&gt;$0.15/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$0.25/1M&lt;/strong&gt; to &lt;strong&gt;$0.50/1M&lt;/strong&gt;. Increase ≈+$0.33 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.87/1M&lt;/strong&gt; to &lt;strong&gt;$0.94/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$3.36/1M&lt;/strong&gt; to &lt;strong&gt;$3.17/1M&lt;/strong&gt;. Net change ≈‑$0.13 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemma 4 26B A4B&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.04/1M&lt;/strong&gt; to &lt;strong&gt;$0.09/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$0.22/1M&lt;/strong&gt; to &lt;strong&gt;$0.30/1M&lt;/strong&gt;. Increase ≈+$0.13 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 30B A3B Instruct 2507&lt;/strong&gt; – prompt fell from &lt;strong&gt;$0.09/1M&lt;/strong&gt; to &lt;strong&gt;$0.05/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$0.30/1M&lt;/strong&gt; to &lt;strong&gt;$0.19/1M&lt;/strong&gt;. Savings ≈‑$0.15 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash Latest&lt;/strong&gt; – prompt rose from &lt;strong&gt;$0.03/1M&lt;/strong&gt; to &lt;strong&gt;$0.04/1M&lt;/strong&gt;; completion rose from &lt;strong&gt;$0.07/1M&lt;/strong&gt; to &lt;strong&gt;$0.11/1M&lt;/strong&gt;. Increase ≈+$0.04 per 1M tokens.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt; – prompt fell from &lt;strong&gt;$0.07/1M&lt;/strong&gt; to &lt;strong&gt;$0.05/1M&lt;/strong&gt;; completion fell from &lt;strong&gt;$0.13/1M&lt;/strong&gt; to &lt;strong&gt;$0.10/1M&lt;/strong&gt;. Reduction ≈‑$0.05 per 1M tokens.
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today&lt;/strong&gt; (per‑token prices):  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – $0.017/1M prompt, $0.112/1M completion
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – $0.019/1M prompt, $0.030/1M completion
&lt;/li&gt;
&lt;li&gt;inclusionAI: Ling 3.0 Flash – $0.021/1M prompt, $0.063/1M completion
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Developers should monitor the highlighted changes for budget impact, especially the sharp rise in DeepSeek V4 Pro and MoonshotAI Kimi K3.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-13" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-12</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sat, 12 Sep 2026 11:36:15 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-12-34jo</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-12-34jo</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-12
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most impactful change:&lt;/strong&gt; Z.ai: GLM 5.2 saw its completion price fall from $3.04/1M to $2.00/1M (‑34%) and prompt price from $0.97/1M to $0.60/1M (‑38%). Developers running long‑form generation or batch workloads will see the biggest per‑token savings.&lt;/p&gt;

&lt;h2&gt;
  
  
  Added models
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Inference.net: Schematron V2 Turbo&lt;/strong&gt; – prompt $0.03/1M, completion $0.15/1M. Teams needing cheap structured‑output inference.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Inference.net: Schematron V2 Small&lt;/strong&gt; – prompt $0.05/1M, completion $0.23/1M. Same use‑case, slightly higher quality.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT Astra Latest&lt;/strong&gt; – prompt $10.00/1M, completion $50.00/1M. Cutting‑edge research or premium‑tier apps.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT Sol Latest&lt;/strong&gt; – prompt $2.00/1M, completion $10.00/1M. Mid‑range commercial products.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT Terra Latest&lt;/strong&gt; – prompt $2.00/1M, completion $12.00/1M. Similar to Sol with a bit more completion cost.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT Luna Latest&lt;/strong&gt; – prompt $0.20/1M, completion $1.20/1M. Low‑latency, cost‑sensitive services.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;inclusionAI: Ling 3.0 Flash VL&lt;/strong&gt; – prompt $0.06/1M, completion $0.18/1M. Vision‑language tasks on a budget.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Removed model
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI GPT Latest&lt;/strong&gt; – prompt $2.00/1M, completion $10.00/1M. Users should migrate to Sol/Terra/Luna or another provider.&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Price changes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3 Flash&lt;/strong&gt; – prompt $0.15 → $0.075/1M (‑50%); completion $0.50 → $0.25/1M (‑50%). Cost‑conscious inference pipelines.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – prompt $0.97 → $0.873/1M (‑10%); completion $3.31 → $3.36/1M (+1.5%). Minor shift; watch for completion‑heavy jobs.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.8 27B&lt;/strong&gt; – prompt $0.42 → $0.214/1M (‑49%); completion $3.00 → $2.55/1M (‑15%). Mid‑size model users benefit.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0813&lt;/strong&gt; – prompt $0.66 → $0.578/1M (‑12%); completion $1.98 → $1.734/1M (‑12%). Pro‑tier workloads.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash Latest&lt;/strong&gt; – prompt $0.05 → $0.03/1M (‑40%); completion $0.16 → $0.07/1M (‑56%). Ultra‑low‑cost flash usage.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0731&lt;/strong&gt; – prompt $0.065 → $0.04/1M (‑38%); completion $0.18 → $0.08/1M (‑56%). Similar to above.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi K3&lt;/strong&gt; – prompt $2.34 → $2.303/1M (‑1.6%); completion $11.70 → $11.55/1M (‑1.3%). Negligible impact.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2&lt;/strong&gt; – prompt $0.966 → $0.60/1M (‑38%); completion $3.04 → $2.00/1M (‑34%). Already highlighted as top saver.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI: Kimi Latest&lt;/strong&gt; – prompt $2.34 → $2.125/1M (‑9%); completion $11.70 → $11.90/1M (+1.7%). Slight trade‑off.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – prompt $0.955 → $0.789/1M (‑17%); completion $1.911 → $1.578/1M (‑17%). Pro‑tier savings.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt; – prompt $0.0886 → $0.0668/1M (‑25%); completion $0.177 → $0.134/1M (‑24%). Flash‑tier efficiency.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax: MiniMax M2.5&lt;/strong&gt; – prompt $0.30 → $0.27/1M (‑10%); completion $1.20 → $1.08/1M (‑10%). Balanced cost cut.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 235B A22B Instruct 2507&lt;/strong&gt; – prompt $0.22 → $0.0875/1M (‑60%); completion $0.88 → $0.35/1M (‑60%). Large‑model users see major savings.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Llama 3.1 70B Instruct&lt;/strong&gt; – prompt $0.40 → $0.72/1M (+80%); completion $0.40 → $0.72/1M (+80%). Cost increase; consider alternatives for budget‑sensitive apps.
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;em&gt;Who should care:&lt;/em&gt; anyone integrating these models into production—especially those optimizing for cost per token, latency, or specific modalities (vision, long‑context). Adjust budgets or model selection accordingly.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-12" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-11</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Fri, 11 Sep 2026 12:11:37 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-11-2092</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-11-2092</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-11
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Biggest cost shift:&lt;/strong&gt; MoonshotAI: Kimi K3 – prompt price fell from $3.00 to $2.34 / 1M tokens (‑0.66) and completion from $15.00 to $11.70 / 1M tokens (‑3.30). Total ‑$3.96 / 1M. &lt;em&gt;Who should care:&lt;/em&gt; Teams running long‑form generation or chat workloads on Kimi K3 see ~26% lower inference cost.&lt;/p&gt;

&lt;h3&gt;
  
  
  Added models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Sakana: Fugu Ultra v2&lt;/strong&gt; – 1M‑token context, prompt $5.00 / 1M, completion $30.00 / 1M. &lt;em&gt;Who should care:&lt;/em&gt; Users needing very long context with moderate‑priced generation.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Sakana: Fugu Max&lt;/strong&gt; – 1M‑token context, prompt $2.00 / 1M, completion $6.00 / 1M. &lt;em&gt;Who should care:&lt;/em&gt; Cost‑sensitive applications that still require large context windows.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;inclusionAI: Ling 3.0 Flash VL (free)&lt;/strong&gt; – 262k‑token context, prompt $0.00, completion $0.00 / 1M. &lt;em&gt;Who should care:&lt;/em&gt; Prototyping or education where zero cost is critical.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Other price changes (Δ per 1M tokens)
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt Δ&lt;/th&gt;
&lt;th&gt;Completion Δ&lt;/th&gt;
&lt;th&gt;Total Δ&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai: GLM Latest&lt;/td&gt;
&lt;td&gt;–0.0375&lt;/td&gt;
&lt;td&gt;–0.1023&lt;/td&gt;
&lt;td&gt;–0.1398&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek: V4 Pro 0813&lt;/td&gt;
&lt;td&gt;–0.3894&lt;/td&gt;
&lt;td&gt;–1.1682&lt;/td&gt;
&lt;td&gt;–1.5576&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Upstage: Solar Pro 4&lt;/td&gt;
&lt;td&gt;+0.0600&lt;/td&gt;
&lt;td&gt;+0.2400&lt;/td&gt;
&lt;td&gt;+0.3000&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI: Kimi Latest&lt;/td&gt;
&lt;td&gt;–0.0600&lt;/td&gt;
&lt;td&gt;–0.3000&lt;/td&gt;
&lt;td&gt;–0.3600&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Google: Gemma 4 26B A4B&lt;/td&gt;
&lt;td&gt;–0.0280&lt;/td&gt;
&lt;td&gt;–0.1200&lt;/td&gt;
&lt;td&gt;–0.1480&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen: Qwen3 30B A3B Instruct 2507&lt;/td&gt;
&lt;td&gt;+0.0419&lt;/td&gt;
&lt;td&gt;+0.1070&lt;/td&gt;
&lt;td&gt;+0.1489&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek: V3 0324&lt;/td&gt;
&lt;td&gt;–0.0400&lt;/td&gt;
&lt;td&gt;–0.1400&lt;/td&gt;
&lt;td&gt;–0.5400&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;p&gt;&lt;em&gt;Who should care:&lt;/em&gt; Developers monitoring budget impacts—note the notable price rise for Upstage Solar Pro 4 (+$0.30 / 1M) and Qwen3 (+$0.15 / 1M), while most models saw reductions.&lt;/p&gt;

&lt;h3&gt;
  
  
  Cheapest models today (per 1M tokens)
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – prompt $0.017, completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – prompt $0.019, completion $0.030
&lt;/li&gt;
&lt;li&gt;inclusionAI: Ling 3.0 Flash – prompt $0.021, completion $0.063
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Total models tracked: 439. No removals reported.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-11" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-10</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Thu, 10 Sep 2026 12:13:50 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-10-1i2</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-10-1i2</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-10
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.5-122B-A10B&lt;/strong&gt; – Completion price fell from &lt;strong&gt;$2.40 / 1M&lt;/strong&gt; to &lt;strong&gt;$2.08 / 1M&lt;/strong&gt; (‑$0.32/M); prompt price fell from &lt;strong&gt;$0.29 / M&lt;/strong&gt; to &lt;strong&gt;$0.26 / M&lt;/strong&gt; (‑$0.03/M).
&lt;em&gt;Who should care:&lt;/em&gt; Teams running large‑scale Qwen inference; lowers cost per token for long‑form generation.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Added models&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4.1 Flash&lt;/strong&gt; – Prompt &lt;strong&gt;$0.15 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.60 / M&lt;/strong&gt;.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral Small 4 (batch)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.075 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.30 / M&lt;/strong&gt;.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ministral 3 8B 2512 (batch)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.075 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.075 / M&lt;/strong&gt;.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral Large 3 2512 (batch)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.25 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.75 / M&lt;/strong&gt;.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral Medium 3.1 (batch)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.20 / M&lt;/strong&gt;, Completion &lt;strong&gt;$1.00 / M&lt;/strong&gt;.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Codestral 2508 (batch)&lt;/strong&gt; – Prompt &lt;strong&gt;$0.15 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.45 / M&lt;/strong&gt;.
&lt;em&gt;Who should care:&lt;/em&gt; Developers seeking new Mistral or DeepSeek options; batch variants offer lower latency‑cost tradeoffs.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Removed model&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Nous: Hermes 4 70B&lt;/strong&gt; – Prompt &lt;strong&gt;$0.13 / M&lt;/strong&gt;, Completion &lt;strong&gt;$0.40 / M&lt;/strong&gt; (no longer available).
&lt;em&gt;Who should care:&lt;/em&gt; Anyone relying on this model must migrate to alternatives.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Other price changes&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3 Flash&lt;/strong&gt; – Prompt ↑$0.075/M (0.075→0.15), Completion ↑$0.25/M (0.25→0.50).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – Prompt ↓$0.106/M (1.113→1.008), Completion ↓$0.088/M (3.498→3.410).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax: MiniMax M2.5&lt;/strong&gt; – Prompt ↑$0.03/M (0.27→0.30), Completion ↑$0.12/M (1.08→1.20).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V3&lt;/strong&gt; – Prompt ↓$0.063/M (0.32→0.257), Completion ↑$0.139/M (0.890→1.029).
&lt;em&gt;Who should care:&lt;/em&gt; Users of these models should adjust cost estimates; GLM 5.3 Flash becomes notably more expensive for completion‑heavy workloads.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today&lt;/strong&gt; (per‑million tokens)  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;IBM Granite 4.0 Micro – Prompt $0.017/M, Completion $0.112/M
&lt;/li&gt;
&lt;li&gt;Mistral Nemo – Prompt $0.019/M, Completion $0.030/M
&lt;/li&gt;
&lt;li&gt;inclusionAI Ling 3.0 Flash – Prompt $0.021/M, Completion $0.063/M
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 436.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-10" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-09</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Wed, 09 Sep 2026 12:19:51 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-09-5844</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-09-5844</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-09
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Lead:&lt;/strong&gt; DeepSeek V4 Pro 0813 (batch) delivers the biggest cost cut, lowering prompt price from &lt;strong&gt;$1.32&lt;/strong&gt; to &lt;strong&gt;$0.66&lt;/strong&gt; per 1M tokens and completion from &lt;strong&gt;$3.96&lt;/strong&gt; to &lt;strong&gt;$1.98&lt;/strong&gt; per 1M tokens – a total saving of &lt;strong&gt;$2.64&lt;/strong&gt; per 1M tokens. Teams running large‑scale batch workloads should revisit their cost forecasts.  &lt;/p&gt;

&lt;h2&gt;
  
  
  Added Models
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Inception: Mercury 2.5&lt;/strong&gt; – new; prompt &lt;strong&gt;$0.04&lt;/strong&gt;/1M, completion &lt;strong&gt;$0.15&lt;/strong&gt;/1M, 260k context. Suitable for latency‑sensitive apps needing long context.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nex AGI: Nex‑N2.5‑Mini (free)&lt;/strong&gt; – new; free. Ideal for prototyping or education.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nex AGI: Nex‑N2.5‑Pro (free)&lt;/strong&gt; – new; free. Same use‑case as Mini.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash Vision Exp (batch)&lt;/strong&gt; – new; prompt &lt;strong&gt;$0.11&lt;/strong&gt;/1M, completion &lt;strong&gt;$0.33&lt;/strong&gt;/1M, 1M context. Vision‑focused batch pipelines.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3 (batch)&lt;/strong&gt; – new; prompt &lt;strong&gt;$0.70&lt;/strong&gt;/1M, completion &lt;strong&gt;$2.20&lt;/strong&gt;/1M, 1M context. High‑throughput batch jobs.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2 (batch)&lt;/strong&gt; – new; same pricing as GLM 5.3.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Removed Models
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Inception: Mercury 2.5 Preview&lt;/strong&gt; – removed; was &lt;strong&gt;$0.04&lt;/strong&gt;/1M prompt, &lt;strong&gt;$0.15&lt;/strong&gt;/1M completion. Migrate to Mercury 2.5.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nex AGI: Nex‑N2‑Mini&lt;/strong&gt; – removed; was &lt;strong&gt;$0.025&lt;/strong&gt;/1M prompt, &lt;strong&gt;$0.10&lt;/strong&gt;/1M completion. Replace with the free Mini or another low‑cost option.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Nex AGI: Nex‑N2‑Pro&lt;/strong&gt; – removed; was &lt;strong&gt;$0.25&lt;/strong&gt;/1M prompt, &lt;strong&gt;$1.00&lt;/strong&gt;/1M completion. Consider newer Pro variants or free alternatives.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Price Changes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;IBM: Granite 4.2 8B&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.10 → $0.06&lt;/strong&gt;/1M; completion ↑ &lt;strong&gt;$0.15 → $0.25&lt;/strong&gt;/1M. Cost‑sensitive inference workloads.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Flash Latest&lt;/strong&gt; – prompt ↑ &lt;strong&gt;$0.071 → $0.075&lt;/strong&gt;/1M; completion ↑ &lt;strong&gt;$0.238 → $0.250&lt;/strong&gt;/1M. Minor uptick; monitor latency‑critical services.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.3 Flash (batch)&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.15 → $0.075&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$0.50 → $0.25&lt;/strong&gt;/1M. Batch pipelines benefit from ~50% savings.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$1.12 → $1.113&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$3.52 → $3.498&lt;/strong&gt;/1M. Negligible impact; keep existing contracts.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0813 (batch)&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$1.32 → $0.66&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$3.96 → $1.98&lt;/strong&gt;/1M. Major saving for large batch jobs.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Glimmer 30B (batch)&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.35 → $0.175&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$1.50 → $0.75&lt;/strong&gt;/1M. Substantial cut for creative‑generation batches.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0731 (batch)&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.14 → $0.11&lt;/strong&gt;/1M; completion ↑ &lt;strong&gt;$0.28 → $0.33&lt;/strong&gt;/1M. Mixed effect; evaluate prompt‑heavy vs. completion‑heavy loads.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi Latest&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$2.50 → $2.40&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$14.0 → $12.0&lt;/strong&gt;/1M. Notable reduction for long‑form generation.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 4.6&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.55 → $0.43&lt;/strong&gt;/1M; completion ↓ &lt;strong&gt;$2.20 → $1.75&lt;/strong&gt;/1M. Moderate saving for standard workloads.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 Next 80B A3B Instruct&lt;/strong&gt; – prompt ↓ &lt;strong&gt;$0.10 → $0.09&lt;/strong&gt;/1M; completion unchanged &lt;strong&gt;$1.10&lt;/strong&gt;/1M. Small prompt‑only gain.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3 235B A22B Instruct 2507&lt;/strong&gt; – prompt ↑ &lt;strong&gt;$0.09 → $0.22&lt;/strong&gt;/1M; completion ↑ &lt;strong&gt;$0.55 → $0.88&lt;/strong&gt;/1M. Cost increase; assess alternatives.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;MiniMax: MiniMax M1&lt;/strong&gt; – prompt ↑ &lt;strong&gt;$0.40 → $0.55&lt;/strong&gt;/1M; completion unchanged &lt;strong&gt;$2.20&lt;/strong&gt;/1M. Slight uplift; watch budget‑sensitive deployments.
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;em&gt;If no meaningful changes had occurred, we would note that and list the three cheapest models today.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-09" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-09-08</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Tue, 08 Sep 2026 12:08:10 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-09-08-273a</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-09-08-273a</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-09-08
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Lead change – biggest cost impact&lt;/strong&gt;&lt;br&gt;&lt;br&gt;
&lt;strong&gt;MoonshotAI: Kimi Latest&lt;/strong&gt; – Prompt price fell from $2.55 / 1M to $2.50 / 1M; completion price rose from $12.75 / 1M to $14.00 / 1M. Net increase of &lt;strong&gt;+$1.25 / 1M&lt;/strong&gt; for output‑heavy workloads. Teams using Kimi Latest for long generations should re‑evaluate cost forecasts.&lt;/p&gt;

&lt;h3&gt;
  
  
  Notable price changes (sorted by absolute impact)
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt Δ ($/1M)&lt;/th&gt;
&lt;th&gt;Completion Δ ($/1M)&lt;/th&gt;
&lt;th&gt;Note&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V3.1&lt;/td&gt;
&lt;td&gt;–0.30&lt;/td&gt;
&lt;td&gt;–0.70&lt;/td&gt;
&lt;td&gt;Large cut; cheapest for chat‑style workloads.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Pro 0423&lt;/td&gt;
&lt;td&gt;+0.268&lt;/td&gt;
&lt;td&gt;+0.535&lt;/td&gt;
&lt;td&gt;Notable rise; consider alternatives for Pro tier.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen3 14B&lt;/td&gt;
&lt;td&gt;+0.108&lt;/td&gt;
&lt;td&gt;+0.670&lt;/td&gt;
&lt;td&gt;Completion cost jumps sharply.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI Kimi K2.7 Code&lt;/td&gt;
&lt;td&gt;+0.050&lt;/td&gt;
&lt;td&gt;+0.100&lt;/td&gt;
&lt;td&gt;Moderate increase across both fields.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek V4 Flash Latest&lt;/td&gt;
&lt;td&gt;+0.005&lt;/td&gt;
&lt;td&gt;+0.070&lt;/td&gt;
&lt;td&gt;Small upward tick; still among the cheapest flash models.&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai GLM Flash Latest&lt;/td&gt;
&lt;td&gt;–0.004&lt;/td&gt;
&lt;td&gt;–0.013&lt;/td&gt;
&lt;td&gt;Minor reduction; retains low‑cost position.&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h3&gt;
  
  
  Removed models (free tiers)
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;Z.ai: GLM 5.2 (free) – 256k context
&lt;/li&gt;
&lt;li&gt;MiniMax: MiniMax M3 (free) – 1,048,576 context
&lt;/li&gt;
&lt;li&gt;MiniMax: MiniMax M2.7 (free) – 196,608 context
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;These free offerings are no longer available; users must switch to paid plans or alternative providers.&lt;/p&gt;

&lt;h3&gt;
  
  
  Cheapest models today (per‑million)
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;IBM: Granite 4.0 Micro&lt;/strong&gt; – Prompt $0.017 / 1M, Completion $0.112 / 1M
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral: Mistral Nemo&lt;/strong&gt; – Prompt $0.019 / 1M, Completion $0.030 / 1M
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;inclusionAI: Ling 3.0 Flash&lt;/strong&gt; – Prompt $0.021 / 1M, Completion $0.063 / 1M
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Total models tracked: &lt;strong&gt;428&lt;/strong&gt;.  &lt;/p&gt;

&lt;p&gt;&lt;em&gt;No other substantive changes were recorded.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-08" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger – 2026-09-06</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sun, 06 Sep 2026 11:38:28 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-2026-09-06-4mmj</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-2026-09-06-4mmj</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger – 2026-09-06
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Qwen: Qwen3.5-35B-A3B&lt;/strong&gt; – Prompt price rose from $0.08 to $0.3125 per 1M tokens (+$0.2325); completion price rose from $0.75 to $1.25 per 1M tokens (+$0.50). &lt;em&gt;Impact:&lt;/em&gt; Developers using this model for generation‑heavy workloads will see per‑token costs increase by ~67% for prompts and ~67% for completions.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – Prompt price fell from $0.8904 to $0.6876 per 1M tokens (-$0.2027); completion price fell from $1.7807 to $1.3753 per 1M tokens (-$0.4054). &lt;em&gt;Impact:&lt;/em&gt; Cost‑sensitive teams relying on this model for long‑form completion can cut expenses by ~23%.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – Prompt price increased from $1.15 to $1.17 per 1M tokens (+$0.02); completion price increased from $3.50 to $3.96 per 1M tokens (+$0.46). &lt;em&gt;Impact:&lt;/em&gt; Moderate uplift for completion‑focused use cases (~13% rise).&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0731&lt;/strong&gt; – Prompt price dropped from $0.065 to $0.04998 per 1M tokens (-$0.0150); completion price dropped from $0.18 to $0.09996 per 1M tokens (-$0.0800). &lt;em&gt;Impact:&lt;/em&gt; Notable savings (~44% completion reduction) for flash‑mode workloads.&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – Prompt price decreased from $0.04998 to $0.045 per 1M tokens (-$0.0050); completion price decreased from $0.09996 to $0.09 per 1M tokens (-$0.0100). &lt;em&gt;Impact:&lt;/em&gt; Minor cost trim (~10% completion).&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt; – Prompt price slipped from $0.08526 to $0.08078 per 1M tokens (-$0.0045); completion price slipped from $0.17052 to $0.16156 per 1M tokens (-$0.0090). &lt;em&gt;Impact:&lt;/em&gt; Small reduction (~5% completion).&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today (per 1M tokens):&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;IBM Granite 4.0 Micro – prompt $0.017, completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral Nemo – prompt $0.019, completion $0.030
&lt;/li&gt;
&lt;li&gt;inclusionAI Ling 3.0 Flash – prompt $0.021, completion $0.063
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;No models were added or removed; total model count remains 431.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-06" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-05</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Sat, 05 Sep 2026 11:15:47 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-05-42li</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-05-42li</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-05
&lt;/h1&gt;

&lt;h2&gt;
  
  
  Biggest cost impact
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;Qwen: Qwen3.6 27B&lt;/strong&gt; – completion price fell from $3.60 to $2.00 per M tokens (‑$1.60/M); prompt price dropped from $0.60 to $0.30 per M tokens (‑$0.30/M).&lt;br&gt;&lt;br&gt;
&lt;em&gt;Who should care:&lt;/em&gt; Teams running long‑form generation or chat workloads on this model see ~35% lower variable cost.&lt;/p&gt;

&lt;h2&gt;
  
  
  Other notable price changes
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;MoonshotAI Kimi Latest&lt;/strong&gt; – completion ↓$1.25/M (from $14.00 to $12.75/M); prompt ↑$0.05/M (from $2.50 to $2.55/M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Pro 0423&lt;/strong&gt; – prompt ↓$0.15/M; completion ↓$0.30/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen3.5‑35B‑A3B&lt;/strong&gt; – prompt ↓$0.17/M; completion ↓$0.50/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash Latest&lt;/strong&gt; – completion ↓$0.06/M (tiny prompt change).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen3 235B A22B Instruct 2507&lt;/strong&gt; – completion ↑$0.20/M; prompt ↑$0.0025/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Pro 0813&lt;/strong&gt; – prompt ↑$0.005/M; completion ↑$0.016/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek V4 Flash 0423&lt;/strong&gt; – prompt ↓$0.003/M; completion ↓$0.007/M.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  New models added
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑6 Astra&lt;/strong&gt; – prompt $10/M, completion $50/M (context 1.05M).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑6 Astra (batch)&lt;/strong&gt; – prompt $5/M, completion $25/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;OpenAI: GPT‑6 Astra Pro&lt;/strong&gt; – same as Astra; batch version halves both rates.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;inclusionAI: Ling 3.0 Flash Sante (free)&lt;/strong&gt; – $0 prompt &amp;amp; completion.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.8 Max (0902)&lt;/strong&gt; – prompt $2/M, completion $6/M (context 1M).
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Models removed
&lt;/h2&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.8 Max&lt;/strong&gt; (same pricing as the new 0902 version).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;IBM: Granite 4.1 8B&lt;/strong&gt; – prompt $0.05/M, completion $0.10/M.
&lt;/li&gt;
&lt;/ul&gt;

&lt;h2&gt;
  
  
  Cheapest models today (per M tokens)
&lt;/h2&gt;

&lt;ol&gt;
&lt;li&gt;IBM Granite 4.0 Micro – prompt $0.017, completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral Nemo – prompt $0.019, completion $0.030
&lt;/li&gt;
&lt;li&gt;inclusionAI Ling 3.0 Flash – prompt $0.021, completion $0.063
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 431.&lt;/em&gt;  &lt;/p&gt;




&lt;p&gt;&lt;em&gt;All prices shown in USD per 1 M tokens.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-05" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger – 2026-09-04</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Fri, 04 Sep 2026 12:07:43 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-2026-09-04-1lfj</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-2026-09-04-1lfj</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger – 2026-09-04
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt; MoonshotAI Kimi Latest completion price rose from $12.75 to $14.00 per 1M tokens (+$1.25/1M), while prompt price fell slightly from $2.55 to $2.50 per 1M (-$0.05/1M). Developers using long‑form completions should budget for higher output costs.&lt;/p&gt;

&lt;h3&gt;
  
  
  Price changes (per 1M tokens)
&lt;/h3&gt;

&lt;div class="table-wrapper-paragraph"&gt;&lt;table&gt;
&lt;thead&gt;
&lt;tr&gt;
&lt;th&gt;Model&lt;/th&gt;
&lt;th&gt;Prompt (old → new)&lt;/th&gt;
&lt;th&gt;Completion (old → new)&lt;/th&gt;
&lt;th&gt;Net impact&lt;/th&gt;
&lt;/tr&gt;
&lt;/thead&gt;
&lt;tbody&gt;
&lt;tr&gt;
&lt;td&gt;Z.ai: GLM Latest&lt;/td&gt;
&lt;td&gt;$1.12 → $1.15 (+$0.03)&lt;/td&gt;
&lt;td&gt;$3.52 → $3.50 (-$0.02)&lt;/td&gt;
&lt;td&gt;+$0.01&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen: Qwen3.8 27B&lt;/td&gt;
&lt;td&gt;$0.425 → $0.420 (-$0.005)&lt;/td&gt;
&lt;td&gt;$2.55 → $3.00 (+$0.45)&lt;/td&gt;
&lt;td&gt;+$0.445&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;NVIDIA: Nemotron 3 Ultra&lt;/td&gt;
&lt;td&gt;$0.60 → $0.625 (+$0.025)&lt;/td&gt;
&lt;td&gt;$2.40 → $3.125 (+$0.725)&lt;/td&gt;
&lt;td&gt;+$0.75&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;MoonshotAI Kimi Latest&lt;/td&gt;
&lt;td&gt;$2.55 → $2.50 (-$0.05)&lt;/td&gt;
&lt;td&gt;$12.75 → $14.00 (+$1.25)&lt;/td&gt;
&lt;td&gt;+$1.20&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;DeepSeek: DeepSeek V3.1&lt;/td&gt;
&lt;td&gt;$0.25 → $0.55 (+$0.30)&lt;/td&gt;
&lt;td&gt;$0.95 → $1.65 (+$0.70)&lt;/td&gt;
&lt;td&gt;+$1.00&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;Qwen: Qwen2.5 VL 72B Instruct&lt;/td&gt;
&lt;td&gt;$0.25 → $0.80 (+$0.55)&lt;/td&gt;
&lt;td&gt;$0.75 → $1.00 (+$0.25)&lt;/td&gt;
&lt;td&gt;+$0.80&lt;/td&gt;
&lt;/tr&gt;
&lt;tr&gt;
&lt;td&gt;ReMM SLERP 13B&lt;/td&gt;
&lt;td&gt;$0.45 → $0.35 (-$0.10)&lt;/td&gt;
&lt;td&gt;$0.65 → $0.65 (0)&lt;/td&gt;
&lt;td&gt;-$0.10&lt;/td&gt;
&lt;/tr&gt;
&lt;/tbody&gt;
&lt;/table&gt;&lt;/div&gt;

&lt;h3&gt;
  
  
  Added models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;inclusionai/ling-3.0-flash-fin&lt;/strong&gt; – 262k ctx, prompt $0.06/1M, completion $0.18/1M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;nvidia/nemotron-3.5-content-safety&lt;/strong&gt; – 131k ctx, prompt &amp;amp; completion $0.20/1M each.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;x-ai/grok-4.3:batch&lt;/strong&gt; – 1M ctx, prompt $1.00/1M, completion $2.00/1M (batch pricing).&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  No removals
&lt;/h3&gt;

&lt;h3&gt;
  
  
  Cheapest models today (per 1M tokens)
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – prompt $0.017, completion $0.112
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – prompt $0.019, completion $0.030
&lt;/li&gt;
&lt;li&gt;Ling-3.0-flash – prompt $0.021, completion $0.063
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;Total models tracked: 427.&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-04" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>Token Ledger Digest – 2026-09-03</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Thu, 03 Sep 2026 12:05:13 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-03-1p82</link>
      <guid>https://dev.to/4663437mehdi/token-ledger-digest-2026-09-03-1p82</guid>
      <description>&lt;h1&gt;
  
  
  Token Ledger Digest – 2026-09-03
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.5 397B A17B&lt;/strong&gt; – completion price rose from $2.34 to $3.50 per M tokens (+$1.16/M); prompt price rose from $0.39 to $0.55 per M tokens (+$0.16/M).
&lt;em&gt;Who should care:&lt;/em&gt; Teams running large‑scale completion workloads (e.g., chatbots, code generation) will see ~49% higher completion costs.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Added models&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Spark 1.3 Contributor&lt;/strong&gt; – prompt $0.10/M, completion $0.20/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Spark 1.3&lt;/strong&gt; – prompt $1.25/M, completion $4.25/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemini 3.8 Flash&lt;/strong&gt; – prompt $0.75/M, completion $3.75/M.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemini 3.8 Flash (batch)&lt;/strong&gt; – prompt $0.38/M, completion $1.88/M.
&lt;em&gt;Who should care:&lt;/em&gt; Users needing 1M‑token context models; batch variant offers ~50% lower prompt cost.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Removed model&lt;/strong&gt;  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;NVIDIA: Nemotron 3 Ultra (batch)&lt;/strong&gt; – prompt $0.60/M, completion $3.60/M (no longer available).
&lt;em&gt;Who should care:&lt;/em&gt; Migrate batch jobs to alternatives (e.g., Gemini 3.8 Flash batch) to avoid service interruption.&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Price changes&lt;/strong&gt; (old → new, per M tokens)  &lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – prompt $1.15 → $1.12 (−$0.03), completion $3.50 → $3.52 (+$0.02).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Google: Gemini 3.7 Flash (batch)&lt;/strong&gt; – prompt $0.19 → $0.38 (+$0.19), completion $0.94 → $1.88 (+$0.94).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Muse Glimmer 30B&lt;/strong&gt; – completion $1.20 → $1.10 (−$0.10); prompt unchanged $0.30.
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;NVIDIA: Nemotron 3 Ultra&lt;/strong&gt; – prompt $0.63 → $0.60 (−$0.03), completion $3.13 → $2.40 (−$0.73).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 4.6&lt;/strong&gt; – prompt $0.43 → $0.55 (+$0.12), completion $1.75 → $2.20 (+$0.45).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V3&lt;/strong&gt; – prompt $0.26 → $0.32 (+$0.06), completion $1.03 → $0.89 (−$0.14).
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Meta: Llama 3.3 70B Instruct&lt;/strong&gt; – prompt $0.71 → $0.10 (−$0.61), completion $0.71 → $0.32 (−$0.39).
&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;Cheapest models today&lt;/strong&gt; (per M tokens)  &lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;IBM: Granite 4.0 Micro – prompt $0.02, completion $0.11
&lt;/li&gt;
&lt;li&gt;Mistral: Mistral Nemo – prompt $0.02, completion $0.03
&lt;/li&gt;
&lt;li&gt;Ling-3.0-flash – prompt $0.02, completion $0.06
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 424.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-03" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
    <item>
      <title>The Token Ledger Digest – 2026-09-02</title>
      <dc:creator>4663437Mehdi</dc:creator>
      <pubDate>Wed, 02 Sep 2026 12:06:11 +0000</pubDate>
      <link>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-09-02-4p11</link>
      <guid>https://dev.to/4663437mehdi/the-token-ledger-digest-2026-09-02-4p11</guid>
      <description>&lt;h1&gt;
  
  
  The Token Ledger Digest – 2026-09-02
&lt;/h1&gt;

&lt;p&gt;&lt;strong&gt;Most cost‑impacting change:&lt;/strong&gt; DeepSeek: DeepSeek V4 Pro 0813 – prompt price rose from $0.66 to $1.12/1M tokens (+$0.46) and completion from $1.98 to $3.35/1M (+$1.37). Developers using this model for high‑volume generation will see inference costs jump ~92%.&lt;/p&gt;

&lt;h3&gt;
  
  
  Added models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Anthropic: Claude Fable 5.1&lt;/strong&gt; – prompt $10.00/1M, completion $50.00/1M. Teams needing long‑context (1M tokens) with strong reasoning should evaluate.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Anthropic: Claude Fable 5.1 (batch)&lt;/strong&gt; – prompt $5.00/1M, completion $25.00/1M. Batch users can halve costs vs. synchronous version.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Inception: Mercury 2.5 Preview&lt;/strong&gt; – prompt $0.04/1M, completion $0.15/1M. Ultra‑cheap for short‑form tasks; attractive for prototyping.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Flash Latest&lt;/strong&gt; – prompt $0.075/1M, completion $0.25/1M. Good balance of cost and 1.3M‑token context for retrieval‑augmented workflows.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Removed models
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Claude Opus 5 (Fast)&lt;/strong&gt; – prompt $10.00/1M, completion $50.00/1M. Users must migrate to Claude Fable 5.1 or alternatives.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Anthropic: Claude Opus 4.8 (Fast)&lt;/strong&gt; – same pricing as Opus 5 Fast; same migration impact.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Price changes
&lt;/h3&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM Latest&lt;/strong&gt; – prompt $1.15/1M (down $0.02), completion $3.50/1M (down $0.46). Cost‑sensitive apps benefit slightly.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Qwen: Qwen3.8 2.4T A95B (batch)&lt;/strong&gt; – prompt $2.00/1M (down $0.50), completion $6.00/1M (down $0.25). Batch users see ~12% lower spend.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0813&lt;/strong&gt; – prompt $1.12/1M (+$0.46), completion $3.35/1M (+$1.37). Notable cost increase; reconsider usage.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Z.ai: GLM 5.2&lt;/strong&gt; – prompt $0.97/1M (down $0.22), completion $3.04/1M (down $0.70). Moderate savings for existing users.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;NVIDIA: Nemotron 3 Ultra&lt;/strong&gt; – prompt $0.63/1M (+$0.13), completion $3.13/1M (+$0.93). Higher cost for those needing large model capacity.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Pro 0423&lt;/strong&gt; – prompt $1.04/1M (down $0.56), completion $2.08/1M (down $1.12). Significant reduction; attractive for cost‑conscious deployments.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V4 Flash 0423&lt;/strong&gt; – prompt $0.089/1M (+$0.008), completion $0.177/1M (+$0.015). Minimal impact.&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;DeepSeek: DeepSeek V3.1&lt;/strong&gt; – prompt $0.25/1M (down $0.30), completion $0.95/1M (down $0.70). Large savings for chat‑oriented workloads.&lt;/li&gt;
&lt;/ul&gt;

&lt;h3&gt;
  
  
  Cheapest models today (per‑million)
&lt;/h3&gt;

&lt;ol&gt;
&lt;li&gt;
&lt;strong&gt;IBM: Granite 4.0 Micro&lt;/strong&gt; – prompt $0.017/1M, completion $0.112/1M
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Mistral: Mistral Nemo&lt;/strong&gt; – prompt $0.019/1M, completion $0.030/1M
&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;Ling-3.0-flash&lt;/strong&gt; – prompt $0.021/1M, completion $0.063/1M
&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;&lt;em&gt;Total models tracked: 421.&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;Originally published at &lt;a href="https://4663437Mehdi.github.io/token-ledger/entry.html?d=2026-09-02" rel="noopener noreferrer"&gt;The Token Ledger&lt;/a&gt;. Subscribe for the daily digest.&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>api</category>
      <category>news</category>
    </item>
  </channel>
</rss>
