CASE 01評価同じプロンプトでSolとLunaのLPを比較
両モデルを同一プロンプトのLP比較サイトに追加した事例。公開結果はあるが、当サイトでは再現していません。
最近の更新 / (上海時間)
林悦己 / アーカイブ
GPT-6 SolとLunaのWeb制作、ゲーム、エージェント、動画ワークフロー、評価の公開事例を、モデルの役割と報告された制約とともに紹介します。
USE CASE MAP / 01
GPT-6 SolまたはLunaと明確に特定できる公開タスク、評価、失敗例のみ収録。各事例に作者と原文を示します。多くは投稿者や事業者の報告で、当サイトで再現していません。
HOW TO USE / 02
カードでモデルと課題を確認し、元投稿で実装、外部ツールへの依存、証拠の限界を調べてください。
コーディング、エージェント、制作、評価などから範囲を絞ります。
タイトル、方法、作者から現在の課題に近い事例を探します。
作者名からデモ、制約、文脈、完全な説明を確認します。
検証したい方法を選び、モデルに接続して自分のフローにします。
REAL CREATOR CASES / 03
1行最大4件。作者名を選ぶと元の事例を開けます。画像と動画は必要なときだけ読み込みます。
58 件
CASE 01評価両モデルを同一プロンプトのLP比較サイトに追加した事例。公開結果はあるが、当サイトでは再現していません。
同じプロンプトとmax設定でSolと旧Opus 5を比較。Opus 5.5との比較ではありません。
API事業者による品質と費用の比較。事業者の自己評価で、当サイトでは再現していません。
CASE 04評価同じ指示でSolとOpus 5.5を比較。見た目の評価は投稿者によるもので、当サイトでは再現していません。
CASE 05評価GPT-6 Luna MaxとGPT-5.6 Luna Maxの同一課題比較。映像はあるがコードは未確認です。
Sol xHighとAstra Highの具体的なSVG課題比較。結果画像はあるが、コードは未確認です。
CASE 07制限投稿者によるとSolは指定された描画ループとカメラ移動を実装できず、未完成でした。
CASE 08評価HiggsfieldがSolとOpus 5.5を比較。プロジェクトと操作性は独立検証していません。
投稿者による短いゲーム実演。当サイトでは実行していません。
Solによる制作例として公開。ソースコードとプレイ可能性は未確認です。
JetBrainsが社員によるSol活用ゲームを紹介した、プラットフォーム発の実演です。
CASE 12デモ投稿者はLunaで制作したと説明。制作工程は非公開で、動画の直接生成能力は示されていません。
CASE 13評価Mirageによる比較。描画は動画ツールに依存し、当サイトでは再現していません。
数回の指示による制作例。外部ツールによる生成をSol固有の動画生成能力とはみなしません。
CASE 15デモ共同創業者がSolを用いた編集を紹介。製品デモであり、独立検証ではありません。
CASE 16ベンチマークBrowser Useによる難しい長時間課題の評価。費用と性能は事業者報告です。
既存タスクの切替は投稿者の報告。Lunaによる別APIの置換は今後の計画です。
CASE 18評価研究者はSolの改善とLunaの後退を報告。当サイトでは再現していません。
CASE 19ベンチマークNext.jsチームはSolの成功率97%を報告。あくまで特定評価で、開発全般の結果ではありません。
CASE 20評価投稿者は2組のテスト通過と0.03ドル対0.15ドルの費用を報告。費用は独立検証していません。
CASE 21デモ指示と結果のメディアを公開。当サイトではブラウザー操作を再現していません。
10ジャンルで50本を生成し3つのAIで評価。実際の視聴者反応は示していません。
CASE 23評価PerplexityによるWANDR評価。Light向けの採用予定と測定済みの結果は区別します。
コンロを開いてモカポットを置く課題で失敗した報告。課題名は引用されたAstra実験に由来します。
CASE 25評価BridgeBenchが同じ指示で4モデルを比較。所要時間と費用はこの試験に限られます。
CASE 26ベンチマーク発表者は105件中29.3件を発見したと報告。推定費用は低い一方、この試験の品質は低下しました。
投稿者は4つのハーネスでGitHub連携を使わずブラウザーを開いたと報告しています。
CASE 28デモHiggsfieldがOpus 5.5との比較を公開。制作環境は同サービスで、操作性は未検証です。
CASE 29評価BridgeBenchは44秒、0.07ドルで完成したと報告。単一の視覚比較です。
CASE 30デモHiggsfieldが戦場規模の試作を比較。サービス側のデモです。
CASE 31デモSolとCombos CLIを併用。素材、通信、公開は外部ツールが担ったと説明しています。
CASE 32ベンチマークRoboflowの自己評価では抽出、計数、推論が旧版より低く、検出はわずかに改善しました。
CASE 33制限投稿者によると画像と回転する円で代用し、期待したアニメになりませんでした。
CASE 34評価カーソル追従と餌への反応を比較。投稿者はLunaが最速だが表情に難があると報告しました。
CASE 35評価同一課題でLunaは6分22秒、Solは17分26秒だったと投稿者は報告しました。
CASE 36デモ単一HTMLでブラウザー描画した例。Solの役割はコード生成で、動画の直接生成ではありません。
CASE 37評価投稿者は10分で3つの惑星を制作したと報告。Opusとの使用量は契約条件が異なります。
CASE 38評価Hermes Agent向けの同一指示を4モデルで比較し、投稿者はSolを最下位と評価しました。
CASE 39評価OpenDesignが同じ課題で比較。スタイル差を報告し、完全な評価は未公開です。
CASE 40ベンチマーク32件のCVE評価でSol 68.8%、Luna 53.1%と報告。再現率は旧版を下回りました。
CASE 41制限同一課題で速く安い一方、形状とリグに欠陥があったと投稿者は報告しました。
CASE 42ベンチマークGertLabsの独自評価ではSolはOpus 5.5と誤差内、Lunaは旧版をわずかに上回りました。
CASE 43デモAstraが計画、Solが実装を担当。3D素材、音、通信、公開には別ツールを使用しました。
CASE 44デモChatGPT VoiceとWebMCPを使った同期視聴サイトで、Solが再生中にコメントする実演です。
CASE 45評価同じ指示で告知文とUI画像を作成。Solの費用は推定3.10ドルで、作者は別の結果を好みました。
CASE 46ベンチマークMazeBenchは難しい空間課題で1%と報告。推論能力全般を示す値ではありません。
CASE 47ベンチマークArenaはSol MaxをWebDev部門4位と報告。順位は同評価の課題と投票に依存します。
CASE 48ベンチマークRailsの評価ではLuna Maxの完了率18%、費用11ドルと報告し、Solと同じ図で比較しています。
表示中 48 / 58
BUILD WITH EVOLINK / 04
EvoLinkのモデル一覧で現在の提供状況と接続方法を確認し、自分の課題で検証してください。