DEV Community

力智栩
力智栩

Posted on

我讓一個 AI 拿 2000 塊台幣去股市,目標 30 天翻倍,這是第 0 天

先講清楚這件事在賭什麼。

我開了一個真實的台股帳戶,裡面 2200 塊,交給一個 AI agent 全權操作。30 天,目標把它翻成兩倍。過程我不介入、不追加資金、不幫它踩煞車。它自己上網找策略、自己下單、自己覆盤,賠光了就是賠光了。

達標的機率我自己估很低。但這個實驗要驗的根本不是「AI 能不能靠 2000 塊變 4000」,而是一個更底層的問題:一個只會預測下一個字的語言模型,能不能學會預測一個世界?

LLM 跟 LWM 差在哪

大型語言模型(LLM)的本事是接話。給它一段文字,它算出下一個最可能的 token,一個接一個吐出來。它對「世界」的理解,全部壓縮在文字的統計關係裡。

世界模型(LWM, Large World Model)想做的是另一件事:在腦中建一個環境的模擬器,輸入一個動作,它能預測環境接下來會變成什麼樣子。自駕車預測車流、機器人預測手臂推過去杯子會不會倒,走的都是這條路。差別在於,LWM 關心的是「我做了 A,世界會變成 B」的因果,不是「這個字後面通常接哪個字」。

股市剛好是一個很殘忍的世界模型測驗場。它會即時、用真金白銀,告訴你的預測對不對。你以為某檔會漲,掛了單,市場三秒後打你臉。這裡沒有標準答案可以背,昨天有效的 pattern 今天可能剛好害你賠錢。

怎麼把 LLM 逼近 LWM

我的做法不是換一個新模型,是在 LLM 外面套一層迴圈,強迫它像世界模型一樣運作:先預測、再行動、然後對答案。

  • 下單前,agent 要先寫下它預測會發生什麼:這筆會不會成交、成交後部位風險變多少、預期報酬區間。
  • 下單後,系統把「預測」跟「真實回報」擺在一起比對,差多少、差在哪,全部記進日誌。
  • 預測錯了,錯誤本身變成訓練訊號,回頭修正它對這個市場的內部模型。

這套 predict-act-verify 就是我這一年在做的 AI agent 平台 DuDuClaw 的核心。它平常跑在軟體任務上(改一個檔案、預測會不會過測試),內建任務層的世界模型:動手前先預測結果、事後比對真實回報、把落差記下來修正。這次我把同一套機制接到一個會賠錢的真實環境,看它撐不撐得住。說穿了,市場就是那個「世界」,agent 每天要做的就是把自己的世界模型調得更準一點。

整個實驗的骨架都是 DuDuClaw 撐起來的:操盤的 agent、幫它接上券商下單的 MCP、每天盯盤的排程、還有等一下會出場的那個「隨隊記者」,全部是平台上的 agent 在跑。我這個人類的角色,只有一開始把錢放進去、然後閉嘴看。

這 30 天要看什麼

目標:帳戶 2200 → 4400,30 個交易日內。

實驗項目

  • Agent 自主研究策略、自主建立研究團隊(它可以自己開子 agent 分工)。
  • 每一筆交易都要附下單理由,收盤後強制寫覆盤。
  • 系統層有硬風控:單筆金額上限就是帳戶餘額、每日下單次數上限、下單必填理由,這幾道閘 agent 繞不過去。

真正想知道的

  1. 一個 LLM agent 在「決策要付出真實代價」的環境裡,會不會退化成亂賭,還是真的會建立並修正自己的市場模型?
  2. 它誠不誠實。賠錢會不會如實記、還是會美化敘事騙自己(也騙我)。這點我特別在意,昨天它就有一次拒絕在證據不足時宣稱自己已連上真實帳戶,那個當下我反而放心。

我不預設它會成功。我預設它會賠,而我想看的是它「怎麼賠、有沒有從賠裡面學到東西」。

開盤前的苦工,跟一路踩的坑

真正動手才知道,讓 AI 能下真單這件事,九成力氣花在跟券商的下單 API 搏鬥,跟 AI 一點關係都沒有。挑幾個印象最深的坑:

  • 憑證認證的鬼打牆。元富的下單要用憑證簽章,但驗證主機回給我的憑證設定欄位是三個問號 ???,程式怎麼比對都找不到憑證。追到最後發現,是台新併購元富後,伺服器還在用舊的機構名「MasterLink」當比對條件,而我新申請的憑證掛的是「Taishin」,兩邊對不上。把舊的 MasterLink 憑證裝回去才通。
  • 憑證綁在錯的 Windows 使用者底下。憑證私鑰用 DPAPI 綁死在申請它的那個帳號,我的交易程式跑在另一個帳號,怎麼樣都讀不到,最後靠一個免密碼的互動排程繞過去。
  • 盤後主機會拒連。凌晨測到一半,券商的下單主機直接拒絕連線,害我一度以為被鎖 IP,其實是它只在交易時段開。而我的程式連不上還會無限重連狂敲人家主機,得自己加斷路器。
  • 一個假完成陷阱。有一版腳本因為少了一個檔案提早結束,卻讓日誌停在上一次的舊結果,我差點以為「跑過了」。這種沉默失敗比直接報錯還危險。

這些坑我全部寫進了實驗日誌。認證昨天終於過了,元富核准、下一個工作日開通,帳戶就會從「紙上模擬」切成真金白銀。

明天開始,主角就不是我了。是那個 agent,跟它對這個市場的第一個預測。


這是「LLM→LWM 自主投資實驗」的第 0 天。接下來每天,我會請另一個 agent 盯著操盤手的每一個動作與結果,把值得看的地方寫成一篇。賠或賺,都會照實寫。


這個實驗跑在開源 AI agent 平台 DuDuClaw 上,操盤、下單、盯盤、每日觀察都由平台上的 agent 自主執行。
原始碼:https://github.com/zhixuli0406/DuDuClaw

Top comments (0)