我們拿 Tripo 的 Astra 提示詞餵給 Claude:$5.47、一次跑起來的 3D 網頁遊戲實測

作者:阿凱AI 技術編輯
我們拿 Tripo 的 Astra 提示詞餵給 Claude:$5.47、一次跑起來的 3D 網頁遊戲實測
Tripo Astra 提示詞發佈 2026-09-117,161

30 秒版

Tripo 在 GitHub 上放了一個蒐集 GPT-6 Astra 3D 提示詞的 repo,號稱 211 個範例、涵蓋 14 種語言、其中 7 個附原始碼可對照。我們想知道:這些提示詞換成 Claude 能不能用。挑了唯一在提示詞本文就寫死「單一 index.html、不用外部資產」的一條,用 claude-fable-5-1 跑了 3 次 API 呼叫,花 $5.47、約 24 分鐘。結果:一次就跑出能玩、0 個 console error、54.8~60.6 FPS 的 3D 遊戲,改一個數字也真的能調整手感。但這是 n=1 的樣本,成立的範圍很窄,下面照順序講。

這個提示詞庫是什麼

Tripo 的 awesome-astra-prompts 是一份提示詞蒐集 repo,README 宣稱收錄 211 個範例、14 種語言,其中 7 個標示附原始碼。它是廠商蒐集來展示 GPT-6 Astra 能力的行銷資產,不是教學文件——repo 本身不解釋怎麼跑、用什麼參數、多少 token,只有提示詞文字。

我們實際核對後發現一個落差:README 目前只渲染 211 條裡的前 100 條,所以就算 sync-manifest.json 內部標記 7 條有原始碼,畫面上看得到「· GitHub」標籤、可以真的對照原始碼的只有 3 條。這 3 條裡,1 條要先在 Blender 建模才能匯出到 Three.js(不是純瀏覽器流程),1 條沒有指定單檔、也沒禁止外部資產。真正符合「瀏覽器直接跑、不需要額外資產檔」條件、又能對照原始碼的,只剩 1 條。

換句話說:211 個範例裡,真正能拿來做「單檔網頁、原始碼公開、可對照」測試的,只有 1 條。學這個 repo 的價值是看懂它怎麼設計提示詞的結構(把「不變的核心規則」寫死、把「視覺與細節」完全交給模型自由發揮),不是把 211 條當成 211 個可以直接照抄的成品。

我們怎麼測

挑哪一條,為什麼:Mosswing——作者 Ayi1337 於 2026-09-10 發布的「Mobile 3D Tap-to-Flap Game」。提示詞原文明寫「One index.html, opens and plays instantly, no external assets (CDN libraries are allowed)」,是唯一同時滿足「唯一索引檔、不用外部資產、有原始碼可對照」三個條件的一條。

我們也自己核對過這條是不是原文照搬——把 Tripo README 裡的提示詞全文和作者本人 repo 裡的提示詞全文做位元組比對:兩邊都是 839 字元、逐字相同(sha256 前 16 碼一致:c22a744005859de4)。確認是 verbatim,不是我們自己腦補或 Tripo 改寫過的版本。

提示詞全文(839 字元,未改寫):

Remaster the classic "tap-to-flap" game — the one where you tap to keep a small creature airborne while gliding through an endless series of gaps — as a 3D game playable in a mobile browser. One index.html, opens and plays instantly, no external assets (CDN libraries are allowed; your call). Keep the core exactly as everyone remembers it: one-tap control, gravity, gaps that scroll toward you, one hit and you're done, score is gaps passed. Everything else is yours to decide: what the creature is, what the obstacles are, the world, the camera, the feel of the flap, how far to take the visuals. Design an original character and style rather than copying the original's art. I won't answer clarifying questions. I'm judging a complete, elegant, great-feeling piece of work — not a feature list. Small and finished beats big and rough.

作者本人用 GPT-6 Astra、effort 設 Xhigh、one-shot 跑出對照組:耗時 21 分鐘,產物是 701,216 bytes 的單一 HTML。

我們的測法:呼叫 Anthropic Messages API,模型 claude-fable-5-1。system prompt 只給一句限制:「Output a single HTML file. Load Three.js from cdnjs or jsdelivr. Do not use any other external resources.」呼叫方式用 streaming(避免大 max_tokens 撞 HTTP timeout)。拿到 HTML 後用 Playwright + Chromium 開一個 390×844、device_scale_factor 2 的觸控模擬視窗,量 console error、pageerror、canvas 是否存在、3 秒內 requestAnimationFrame 次數換算 FPS、截圖的相異顏色數(用來判斷畫面是不是空白)。

三次呼叫的結果:

| # | 設定 | 結果 | token in/out | 耗時 | 成本 |

|---|---|---|---|---|---|

| attempt-1 | 有 system,max_tokens=16000 | ❌ 沒有任何產出(stop_reason: max_tokens) | 320 / 16,000 | 242.6s | $0.8032 |

| attempt-2 | 有 system,max_tokens=128000 | ✅ 一次跑起來,0 console error | 320 / 41,262 | 531.1s | $2.0663 |

| attempt-raw | 無 system,max_tokens=128000 | ✅ 一次跑起來,0 console error | 280 / 52,041 | 661.1s | $2.6048 |

合計 3 次呼叫、$5.4743、約 24 分鐘 API 時間。

attempt-1 為什麼失敗,以及一個偏離原始參數的決定max_tokens=16000 是原本規劃要用的參數,但這條提示詞需要的推理量會把 16000 token 全部吃光——回傳內容只有一個空的 thinking block,正文 text 是 0 bytes,stop_reasonmax_tokens,也就是模型連「想」都還沒想完就被截斷,一個字的 HTML 都沒吐出來,花了 $0.80、4 分鐘,產出為零。如果照原參數繼續跑,整個實驗的答案永遠會是「不能跑」,但原因跟 Tripo 的提示詞或 Claude 的能力都無關,只是 token 預算不夠。因此 attempt-2 起把 max_tokens 調到 128000,attempt-1 的失敗紀錄完整保留,不刪除。

覺得有用?每天 5 分鐘掌握 AI 新工具

免費訂閱,新工具搶先看,隨時可取消

結果:一次就跑起來、可玩、可編輯

attempt-2(主結果):單一 HTML,17,713 bytes、360 行,沒有 markdown 圍欄包裹,可以直接存成 .html 開啟。外部資源只有 1 個——cdnjs.cloudflare.com 上的 three.js r128,完全符合 system prompt 的限制。瀏覽器實測:console error 0、pageerror 0、canvas 780×1688、WebGL context 沒有遺失、FPS 54.8(3 秒內 rAF 次數換算)、截圖有 8,258 個相異顏色(最大占比色只佔 3.5%,不是空白畫面)。

畫面內容是一個完整的原創 3D 遊戲:粉紅色小鳥、3D 柱狀障礙物、分數 HUD、漸層天空配太陽與星點、起伏地形。標題畫面寫著「PIP — A SMALL BIRD, A LONG WAY / TAP TO FLAP」,觸控後標題消失、進入遊戲狀態、分數 HUD 出現,互動有驗證到。

attempt-raw(不給 system prompt、不限制外部資源):產物 19,656 bytes,遊戲名叫「Kami」,主角是紅色摺紙鶴,低多邊形地景配上真實陰影。console error 0、pageerror 0、FPS 60.6、5,935 個相異顏色。有意思的地方是:就算完全不給 system prompt、不禁止外部資源,模型還是自己選了單一 HTML+同一個 cdnjs 上的 three.js r128,沒有引用任何其他外部資源——因為提示詞本文自己就寫死了「One index.html… no external assets」。兩者唯一實質差異是包裝:attempt-raw 把 HTML 包在 markdown 程式碼圍欄裡,前面加了一段介紹、後面加一長段「What you're playing」說明,整段複製貼進 .html 檔會壞掉,得先把圍欄內的內容抽出來才能用;attempt-2(有 system)是裸 HTML,可以直接存檔。

可編輯性怎麼驗attempt-2.html 開頭第 64–70 行就是一個具名的 tuning 區塊:

/ ---------- tuning ---------- /

const GRAV=-27, FLAP=8.3, SPEED=4.2, GAP=2.9, SPACING=4.6;

const GROUND_Y=-4.2, CEIL_Y=5.2, BIRD_R=0.36, PR=0.75;

const GAP_MIN=GROUND_Y+1.3+GAP/2, GAP_MAX=CEIL_Y-1.0-GAP/2;

const NPILLARS=7;

重力、拍翅力道、捲動速度、缺口大小、柱間距、鳥半徑、柱子數量全部具名集中,衍生值(GAP_MIN/GAP_MAX)由基礎值算出,不是各自寫死。整個檔案還有 9 個具名分區(tuning、helpers、renderer/scene、audio、state、input、resize、update、loop)和 17 個具名函式,物件也都有名字(scenecamerarendererterrainsunDiscglowsfxui……)。

我們實際改了一個數字重跑驗證:把 BIRD_R=0.36 改成 BIRD_R=1.0,其他一個字元都沒動。重新跑 Playwright,pageerror 0,正常算繪;視覺對照(左邊原版 0.36、右邊改成 1.0)看得出小鳥變成約 3 倍大,而且是整個 mesh 一起放大,不是只有碰撞框變了。BIRD_R 在檔案裡被引用 8 次,同時驅動幾何體建構(4 處)與碰撞判定(3 處),改一個數字兩邊會一起變、不會失同步——這代表參數是真的有被抽出來接線,不是開頭擺一個好看的常數表卻沒真的用到。另外也測了 SPACING=4.6 改成 1.8:console error 0、FPS 60.3,一樣正常運作。

但有一個面向不可編輯:顏色沒有集中attempt-2.html 裡有 23 個硬寫的 0x...... 十六進位色碼散落在天空 shader、地形、太陽、材質各處,沒有調色盤常數,想換配色得逐處找。有意思的是 attempt-raw 反而做得比較好,它有一個 const PAL=[[0xf28b7d,0xf9b3a6],[0x80bfd8,...]] 這樣的調色盤陣列。同一條提示詞、同一個模型,兩次產出在「顏色可不可編輯」這件事上結論相反,n=1 在這種細節上就是不穩定。

「換到 Claude 也能跑」成不成立

成立——但只在這一條提示詞、這一個模型、這樣的參數下成立。

具體成立到什麼程度:一次就跑得起來(attempt-2 與 attempt-raw 都是 one-shot、0 次修正,原本規劃「跑不起來就把 console error 丟回去修,最多 3 輪」的修正迴圈一輪都沒用到,因為兩次的 console error 都是 0);產出是完整可玩的東西,不是靜態展示;效能可接受(行動裝置 viewport 下 54.8~60.6 FPS);產出可編輯(遊戲手感參數集中且具名,改一個數字就能改變場景,已實測)。

但這個結論有幾個必須一起講的但書:

  • n=1。 211 條提示詞只測了 1 條、1 個模型,每種設定各跑 1 次,不能外推成「Tripo 的提示詞庫換到 Claude 都能跑」。
  • 這條提示詞對「一次跑起來」特別有利。 它自己就寫明了單檔、可用 CDN、不用外部資產、「我不會回答澄清問題」。需要 Blender、需要外部 GLB/貼圖檔的條目(該庫裡很多),這個結論完全不適用——同一批 3 條有原始碼的條目裡,就有 1 條(dual-ring energy core)必須先跑 Blender。
  • 參數會決定成敗。 attempt-1 證明了:同一條提示詞、同一個模型,max_tokens 設 16000 就是 0 bytes 產出。能不能跑不只取決於模型,也取決於呼叫方式。
  • 沒有跟 GPT-6 Astra 做同題對照。 我們沒有重跑 Astra,所以不能說 Claude 比較好或比較差,只能說 Claude 這一次做出了能跑的東西。作者的 Astra 版本(Xhigh、21 分鐘、701KB)跟我們的(約 8.9 分鐘、17.7KB)規模差一個數量級,但我們沒有在同一套標準下評比品質。
  • 「可玩」的驗證有缺口。 我們驗到了算繪、輸入回應、frame loop、狀態切換,但分數遞增沒有驗到——自動點擊器是固定 300ms 節奏,不是稱職的玩家,25 秒內 HUD 數字始終為 0。這代表機器人不會玩,不代表計分壞掉,但我們沒有證據說它會加分。

想自己跑的步驟

以下只列我們真的做過的:

  1. 呼叫 Anthropic Messages API,模型設 claude-fable-5-1
  2. max_tokens 要給夠——16000 會被推理吃光導致 0 產出,我們用的是 128000。
  3. 想限制輸出格式,可以加一句 system prompt,例如我們用的:「Output a single HTML file. Load Three.js from cdnjs or jsdelivr. Do not use any other external resources.」加了這句,回傳的是裸 HTML,可以直接存檔;不加這句,回傳可能被包在 markdown 程式碼圍欄裡,要先把圍欄內容抽出來才能存成 .html
  4. 建議用 streaming 呼叫,避免大 max_tokens 撞到 HTTP timeout。
  5. 存成 .html 後直接用瀏覽器開啟即可執行,不需要額外的建置步驟。

常見問題 FAQ

這次實測花多少錢?

3 次 API 呼叫合計 $5.4743。其中失敗的 attempt-1(0 產出)也花了 $0.8032,兩次成功的分別是 $2.0663(有 system prompt)和 $2.6048(無 system prompt)。

可以用其他模型跑同一條提示詞嗎?

沒測過。我們只用 claude-fable-5-1 跑了這一條提示詞,換其他模型能不能跑出類似結果、品質如何,我們沒有測過。

為什麼 max_tokens=16000 會失敗?

claude-fable-5-1 的 thinking 永遠開啟,會計入 output token。16000 額度全被推理用完,正文是 0 bytes,stop_reasonmax_tokens——不是拒絕生成,是額度不夠寫正文。

生成出來的遊戲能商用嗎?

要看各模型的服務條款與 Three.js 授權條款而定,我們沒有查證這塊,商用前請自行確認。

顏色配色可以自己調嗎?

看版本。我們測出來的 attempt-2 版本顏色沒有集中,23 個十六進位色碼散落在檔案各處,想換配色得逐一找;反而是沒給 system prompt 的 attempt-raw 版本有集中的調色盤陣列。同一條提示詞、同一個模型,兩次結果不一樣,這件事本身也是這次實測的發現之一。

這代表 Tripo 這個提示詞庫都能換成 Claude 用嗎?

不能這樣推論。這次只測了 211 條裡的 1 條、1 個模型、每種設定各跑 1 次,且這條提示詞本身條件特別有利(單檔、免外部資產、規則寫死)。庫裡其他需要 Blender 建模或外部資產檔的條目沒有測過,結論不適用。

資料來源

常見問題 FAQ

這次實測花多少錢?
3 次 API 呼叫合計 $5.4743。其中失敗的 attempt-1(0 產出)也花了 $0.8032,兩次成功的分別是 $2.0663(有 system prompt)和 $2.6048(無 system prompt)。
可以用其他模型跑同一條提示詞嗎?
沒測過。我們只用 claude-fable-5-1 跑了這一條提示詞,換其他模型能不能跑出類似結果、品質如何,我們沒有測過。
為什麼 max_tokens=16000 會失敗?
claude-fable-5-1 的 thinking 永遠開啟,會計入 output token。16000 額度全被推理用完,正文是 0 bytes,stop_reason 為 max_tokens——不是拒絕生成,是額度不夠寫正文。
生成出來的遊戲能商用嗎?
要看各模型的服務條款與 Three.js 授權條款而定,我們沒有查證這塊,商用前請自行確認。
顏色配色可以自己調嗎?
看版本。attempt-2 版本顏色沒集中,23 個十六進位色碼散落各處,想換配色得逐一找;反而沒給 system prompt 的 attempt-raw 版本有集中調色盤陣列。同一提示詞、同模型,兩次結果不同。
這代表 Tripo 這個提示詞庫都能換成 Claude 用嗎?
不能這樣推論。這次只測了 211 條裡的 1 條、1 個模型、每種設定各跑 1 次,且這條提示詞本身條件特別有利(單檔、免外部資產、規則寫死)。庫裡其他需要 Blender 建模或外部資產檔的條目沒有測過,結論不適用。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

延伸閱讀

🤖 本指南由 AI 整理,功能、價格與規格請以官方網站為準。如有疑慮,請參閱關於我們