原文(2026-08-03 版)からの翻訳

From Pelicans to Ephemeral Worlds
ペリカンテストからオンデマンドの世界生成へ · 英日対訳 + 共読ノート

著者:Andrej Karpathy|公開日 2026-08-02|出典:Post by @karpathy on X
左欄は原文と一文ずつの訳。右欄の共読ノートは、原文をめぐる今回の精読対話から
右欄 = 共読ノート|要点:用語解説、重要な理解、能力の限界

Reading Overview(共読総覧:このタスクは何を試したのか)

タスクの入力:『指輪物語』の第一段落、Opus 5、100 万トークンの予算、そして Three.js でレンダリングするという目標

モデルの成果:約二時間の自律的な作業で、約 5,500 行のコードにより動作する三次元アニメーション世界を構築

本当に試されているもの:コードの行数でも、Three.js のプログラミング技術だけでもなく、曖昧な目標を完全なプロジェクトへ押し進め続けられるかどうか

同時に露わになった限界:モデルは世界を生成できるが、人間のように自分の作品を自然に見て試遊することはまだできず、そのため視覚的な検収と自己修正は依然として遅い

タスクの連鎖:文学テキストの理解 → 世界モデルの構築 → エンジニアリングタスクの分解 → 三次元アセットの配置 → アニメーションの編成 → 実行と確認 → 問題の修正

Leaving the Pelican Test(ペリカンテストを離れる)

We're starting to leave the territory where you'd test an LLM by e.g. “create an svg of pelican on a bicycle”.

私たちは、「自転車に乗るペリカンの SVG を作って」のような課題で LLM をテストする段階を離れ始めています

Experiment Setup(実験の設定)

As one idea to generalize it, I was interested what Opus 5 would do if I gave it the first paragraph of the Lord of the Rings, a 1M token budget (~$10) and asked for three js render of it.

テストをより複雑な課題へ一般化するアイデアとして、私は興味がありました。『指輪物語』の第一段落を Opus 5 に渡し、100 万トークン、およそ 10 ドルの予算を与え、その文章を Three.js でレンダリングするよう求めたら、何を作るだろうか、と

A Working Result(本当に動く結果)

Opus went off for ~2 hours and wrote 5500 lines of code that (procedurally) rendered the story.

Opus は約二時間、自律的に作業し、5,500 行のコードを書いて、この物語をプロシージャルにレンダリングしました

It's kind of janky but fun.

やや粗削りですが、面白いものです

Orchestrating a 3D World(三次元世界を編成する)

But it's a bit mindboggling that the LLM has to place and orchestrate various polygon assets in (x,y,z) coordinates and write code that animates it all, and that it even does anything at all.

しかし少し信じがたいのは、LLM がさまざまなポリゴンのアセットを三次元空間の (x, y, z) 座標に配置・編成し、それらすべてを動かすコードまで書かなければならず、しかも最終的に本当に動くものを作ってしまったことです

From “No One Would” to “Why Not?”(誰もやらないから、やらない手はないへ)

I also like this kind of examples because no one in their right mind would ever spend the time to write something this custom but LLMs have all the stamina and patience in the world, so it's an example where we go from “no one would ever do this” to “sure, why not, it's ~free”.

私はこの種の例も好きです。まともな人なら誰も、これほどカスタム性の高いものを書くのに時間を費やしたりしませんが、LLM には無尽蔵の持久力と忍耐があります。だからこれは、「誰もこんなことはしない」から「もちろん、やらない手はない、ほぼ無料なのだから」へ移る例なのです

Hyper-Custom Worlds on Demand(高度にカスタムされた世界をオンデマンドで)

There might be a lot more.

こうした可能性はまだたくさんあるかもしれません

But I'm excited about creating hyper custom worlds that you can imagine dropping players into, e.g. here to participate in the LoTR story as a spectator NPC, or one of the characters, or etc.

しかし本当に私が興奮しているのは、高度にカスタムされた世界を作ることです。プレイヤーをそこへ直接放り込むことを想像できます。たとえばここでは『指輪物語』の物語に入り、筋書きを傍観する NPC として、あるいは登場人物の一人として、などです

Something like an ephemeral GTA of X on demand.

任意のテーマ X について、一時的に存在する GTA 風のオープンワールドをオンデマンドで生成するようなものです

The Missing Audit Loop(欠けている自己検証のループ)

Last thought is that the domain of worlds/games exposes a weakness in LLMs: they can't easily audit their work because they aren't able to efficiently and natively perceive videos or play games within them.

最後の考えとして、世界とゲームという領域は LLM の弱点を露わにします。LLM は自分の仕事を簡単には検証できません。動画を効率的かつネイティブに知覚することも、そのゲームの中で自ら遊ぶこともまだできないからです

Here, Opus 5 had to very slowly and painstakingly take screenshots at different points, and it messed up a few times and created a bunch of jank.

この例では、Opus 5 は非常にゆっくり、骨を折ってさまざまな時点でスクリーンショットを撮らざるを得ず、何度か失敗して、粗くちぐはぐな結果をかなり生み出しました

An example of raw capability (multimodal, gameplay) that I think is still quite lacking.

これは、モデルにまだかなり欠けている基礎能力、たとえばマルチモーダルな知覚や実際のゲーム操作の能力の一例です

Playable Source(動かせるソース)

I uploaded the source here so it's playable in the browser, forkable etc.

ソースをここにアップロードしたので、ブラウザでそのまま動かせますし、フォークして改変を続けることもできます

https://karpathy.ai/lotr-movie/

原文:Andrej Karpathy、Post by @karpathy on X
日本語の逐文訳。右欄の共読ノートは、原文をめぐる今回の精読対話から整理