<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/">
  <channel>
    <title>DEV Community: 力智栩</title>
    <description>The latest articles on DEV Community by 力智栩 (@_2ab71a79dd36101e6be89).</description>
    <link>https://dev.to/_2ab71a79dd36101e6be89</link>
    <image>
      <url>https://media2.dev.to/dynamic/image/width=90,height=90,fit=cover,gravity=auto,format=auto/https:%2F%2Fdev-to-uploads.s3.us-east-2.amazonaws.com%2Fuploads%2Fuser%2Fprofile_image%2F4070598%2F9d62ce90-e638-4ecf-9f42-699ea01a42f1.jpeg</url>
      <title>DEV Community: 力智栩</title>
      <link>https://dev.to/_2ab71a79dd36101e6be89</link>
    </image>
    <atom:link rel="self" type="application/rss+xml" href="https://dev.to/feed/_2ab71a79dd36101e6be89"/>
    <language>en</language>
    <item>
      <title>我讓一個 AI 拿 2000 塊台幣去股市，目標 30 天翻倍，這是第 0 天</title>
      <dc:creator>力智栩</dc:creator>
      <pubDate>Mon, 10 Aug 2026 06:05:40 +0000</pubDate>
      <link>https://dev.to/_2ab71a79dd36101e6be89/wo-rang-ge-ai-na-2000-kuai-tai-bi-qu-gu-shi-mu-biao-30-tian-fan-bei-zhe-shi-di-0-tian-4dgb</link>
      <guid>https://dev.to/_2ab71a79dd36101e6be89/wo-rang-ge-ai-na-2000-kuai-tai-bi-qu-gu-shi-mu-biao-30-tian-fan-bei-zhe-shi-di-0-tian-4dgb</guid>
      <description>&lt;p&gt;先講清楚這件事在賭什麼。&lt;/p&gt;

&lt;p&gt;我開了一個真實的台股帳戶，裡面 2200 塊，交給一個 AI agent 全權操作。30 天，目標把它翻成兩倍。過程我不介入、不追加資金、不幫它踩煞車。它自己上網找策略、自己下單、自己覆盤，賠光了就是賠光了。&lt;/p&gt;

&lt;p&gt;達標的機率我自己估很低。但錢能不能翻倍其實是次要的。這個實驗真正要驗的是更底層的一個問題：&lt;strong&gt;一個只會預測下一個字的語言模型，能不能學會預測一個世界？&lt;/strong&gt;&lt;/p&gt;

&lt;h2&gt;
  
  
  LLM 跟 LWM 差在哪
&lt;/h2&gt;

&lt;p&gt;大型語言模型（LLM）的本事是接話。給它一段文字，它算出下一個最可能的 token，一個接一個吐出來。它對世界的理解，全壓在文字的統計關係裡。它知道「崩盤」後面常接「恐慌」，可是它腦中沒有一個市場可以讓它先跑一遍、看看真掛下去會怎樣。&lt;/p&gt;

&lt;p&gt;世界模型（LWM, Large World Model）要的是另一種能力：腦子裡有一台環境的模擬器，餵它一個動作，它能推演出環境接下來長什麼樣。自駕車推算三秒後的車流、機器人推算手臂推過去杯子會不會倒，走的都是這條路。跟接話比，核心差兩點。第一，它處理的是「我做了 A，世界會變成 B」的因果鏈，不是字面上哪個字後面常接哪個字。第二，它能在真正動手前，先在腦中把好幾種動作各推演一遍、挑結果最好的那個下手，這動作叫 rollout，純接話的 LLM 天生沒有。&lt;/p&gt;

&lt;p&gt;股市是個很殘忍的世界模型測驗場。它即時、用真金白銀告訴你預測對不對，而且分秒都在更新。你以為某檔要漲、掛了單，市場三秒後打你臉。這裡沒有標準答案可以背，昨天有效的 pattern 今天可能剛好害你賠錢；一個只會複述歷史統計的模型，在這裡會被慢慢磨死。&lt;/p&gt;

&lt;h2&gt;
  
  
  怎麼把 LLM 逼近 LWM
&lt;/h2&gt;

&lt;p&gt;我的做法不換模型，而是在 LLM 外面套一層迴圈，逼它像世界模型一樣運作：&lt;strong&gt;先預測、再行動、然後對答案。&lt;/strong&gt;&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;下單前，agent 必須先寫下它預測會發生什麼：這筆會不會成交、成交後部位風險變多少、預期報酬落在哪個區間、最壞會賠多少。這一步等於逼它把腦中對市場的模型攤開來，攤開了才驗得了。&lt;/li&gt;
&lt;li&gt;下單後，系統把「當初的預測」跟「市場的真實回報」擺在一起，一欄一欄比對：方向對不對、幅度差多少、哪個假設破了，全部記進日誌。&lt;/li&gt;
&lt;li&gt;預測錯的那個落差就是訊號。它不是拿來罵 agent 的，是拿來當梯度用的，回頭修正它對這個市場的內部模型，下一次預測就該更準一點。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;一個純 LLM 缺的正是這條迴路。它吐出一段話，沒有人告訴它「你剛剛對世界的判斷，三小時後被證明是錯的」，所以它學不會為後果負責。市場幫我把這條迴路免費補上了：每一筆單都是一次帶標準答案的實驗，而標準答案由真金白銀當場開出。我做的就是把這個回饋硬接回 agent 的下一輪決策，讓它的世界模型從賠賺裡長出來。&lt;/p&gt;

&lt;p&gt;這套 predict-act-verify 就是我這一年在做的 AI agent 平台 DuDuClaw 的核心。它平常跑在軟體任務上（改一個檔案、預測會不會過測試），內建任務層的世界模型：動手前先預測結果、事後比對真實回報、把落差記下來修正。這次我把同一套機制接到一個會賠錢的真實環境，看它撐不撐得住。說穿了，市場就是那個「世界」，agent 每天要做的就是把自己的世界模型調得更準一點。&lt;/p&gt;

&lt;p&gt;整個實驗的骨架都是 DuDuClaw 撐起來的：操盤的 agent、幫它接上券商下單的 MCP、每天盯盤的排程、還有等一下會出場的那個「隨隊記者」，全部是平台上的 agent 在跑。我這個人類的角色，只有一開始把錢放進去、然後閉嘴看。&lt;/p&gt;

&lt;h2&gt;
  
  
  這實驗，公開資料裡我找不到第二個
&lt;/h2&gt;

&lt;p&gt;動筆前我認真查了一輪。LLM 真金操盤這個大方向，已經有人踩過：最有名的是 Alpha Arena，六個頂尖模型各拿一萬美金，在加密永續市場全自主對決、零人為介入；學界也排了一整列 benchmark（StockBench、LiveTradeBench、Agent Market Arena）在評測這件事。方向上我不孤單。&lt;/p&gt;

&lt;p&gt;可是我這套的組合，我查不到第二個。真金，但只有 NT$2,200 這種散戶到底的微資本；標的是台股，不是加密貨幣；操盤的只有一隻 agent，從找策略、下單到覆盤全程自己包；框架上明擺著用世界模型的角度去逼它，還派另一隻 agent 每天把過程寫成一般人看得懂的連載。&lt;/p&gt;

&lt;p&gt;公開的實盤幾乎都是機構等級的名目金額，多半還是模擬或紙上成交，產出的是排行榜或論文。用兩千塊真錢、單一自主 agent、加上 LWM 的框架跟每日隨隊記錄，這一格是空的。我不確定空著是因為沒人想做，還是因為做了會賠得很難看、沒人想公開。30 天後就知道我是哪一種。&lt;/p&gt;

&lt;h2&gt;
  
  
  這 30 天要看什麼
&lt;/h2&gt;

&lt;p&gt;&lt;strong&gt;目標&lt;/strong&gt;：帳戶 2200 → 4400，30 個交易日內。&lt;/p&gt;

&lt;p&gt;&lt;strong&gt;實驗項目&lt;/strong&gt;：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;Agent 自主研究策略、自主建立研究團隊（它可以自己開子 agent 分工）。&lt;/li&gt;
&lt;li&gt;每一筆交易都要附下單理由，收盤後強制寫覆盤。&lt;/li&gt;
&lt;li&gt;系統層有硬風控：單筆金額上限就是帳戶餘額、每日下單次數上限、下單必填理由，這幾道閘 agent 繞不過去。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;&lt;strong&gt;真正想知道的&lt;/strong&gt;：&lt;/p&gt;

&lt;ol&gt;
&lt;li&gt;一個 LLM agent 在「決策要付出真實代價」的環境裡，會不會退化成亂賭，還是真的會建立並修正自己的市場模型？&lt;/li&gt;
&lt;li&gt;它誠不誠實。賠錢會不會如實記、還是會美化敘事騙自己（也騙我）。這點我特別在意，昨天它就有一次拒絕在證據不足時宣稱自己已連上真實帳戶，那個當下我反而放心。&lt;/li&gt;
&lt;/ol&gt;

&lt;p&gt;我不預設它會成功。我預設它會賠，而我想看的是它「怎麼賠、有沒有從賠裡面學到東西」。&lt;/p&gt;

&lt;h2&gt;
  
  
  開盤前的苦工，跟一路踩的坑
&lt;/h2&gt;

&lt;p&gt;真正動手才知道，讓 AI 能下真單這件事，九成力氣花在跟券商的下單 API 搏鬥，跟 AI 一點關係都沒有。挑幾個印象最深的坑：&lt;/p&gt;

&lt;ul&gt;
&lt;li&gt;
&lt;strong&gt;憑證認證的鬼打牆&lt;/strong&gt;。元富的下單要用憑證簽章，但驗證主機回給我的憑證設定欄位是三個問號 &lt;code&gt;???&lt;/code&gt;，程式怎麼比對都找不到憑證。追到最後發現，是台新併購元富後，伺服器還在用舊的機構名「MasterLink」當比對條件，而我新申請的憑證掛的是「Taishin」，兩邊對不上。把舊的 MasterLink 憑證裝回去才通。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;憑證綁在錯的 Windows 使用者底下&lt;/strong&gt;。憑證私鑰用 DPAPI 綁死在申請它的那個帳號，我的交易程式跑在另一個帳號，怎麼樣都讀不到，最後靠一個免密碼的互動排程繞過去。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;盤後主機會拒連&lt;/strong&gt;。凌晨測到一半，券商的下單主機直接拒絕連線，害我一度以為被鎖 IP，其實是它只在交易時段開。而我的程式連不上還會無限重連狂敲人家主機，得自己加斷路器。&lt;/li&gt;
&lt;li&gt;
&lt;strong&gt;一個假完成陷阱&lt;/strong&gt;。有一版腳本因為少了一個檔案提早結束，卻讓日誌停在上一次的舊結果，我差點以為「跑過了」。這種沉默失敗比直接報錯還危險。&lt;/li&gt;
&lt;/ul&gt;

&lt;p&gt;這些坑我全部寫進了實驗日誌。認證昨天終於過了，元富核准、下一個工作日開通，帳戶就會從「紙上模擬」切成真金白銀。&lt;/p&gt;

&lt;p&gt;明天開始，主角就不是我了。是那個 agent，跟它對這個市場的第一個預測。&lt;/p&gt;




&lt;p&gt;&lt;em&gt;這是「LLM→LWM 自主投資實驗」的第 0 天。接下來每天，我會請另一個 agent 盯著操盤手的每一個動作與結果，把值得看的地方寫成一篇。賠或賺，都會照實寫。&lt;/em&gt;&lt;/p&gt;




&lt;p&gt;&lt;em&gt;這個實驗跑在開源 AI agent 平台 DuDuClaw 上,操盤、下單、盯盤、每日觀察都由平台上的 agent 自主執行。&lt;/em&gt;&lt;br&gt;
&lt;em&gt;原始碼:&lt;a href="https://github.com/zhixuli0406/DuDuClaw" rel="noopener noreferrer"&gt;https://github.com/zhixuli0406/DuDuClaw&lt;/a&gt;&lt;/em&gt;&lt;/p&gt;

</description>
      <category>ai</category>
      <category>llm</category>
      <category>trading</category>
      <category>experiment</category>
    </item>
  </channel>
</rss>
