内容最近更新 / (上海时间)

林悦己 / ARCHIVE

GPT-6 Sol & Luna 使用案例

查看 GPT-6 Sol 与 Luna 在网页、游戏、Agent、视频工作流和评测中的公开案例,区分模型贡献、失败记录与作者自述。

58 个真实案例6 类任务三语内容

USE CASE MAP / 01

GPT-6 Sol & Luna 的真实用法,不只是一张能力表

只收录能明确归属 GPT-6 Sol 或 Luna 的公开任务、评测与失败记录。每条保留作者和原帖;结果多为作者或平台自述,本站未独立复现。

58经整理的真实案例
6任务类别
3英语、中文与日语

HOW TO USE / 02

从案例发现到工作流验证

先核对卡片中的子型号和任务,再回到原帖查看实现方式、工具依赖与证据边界。

  1. 01

    按任务类别浏览

    从编码、Agent、创意或评测等任务入口缩小范围。

  2. 02

    搜索具体目标

    按标题、方法或作者找到与你当前问题最接近的案例。

  3. 03

    回到原始出处

    点击作者核对演示、限制、上下文和创作者的完整说明。

  4. 04

    在 EvoLink 复现

    选择值得验证的方法,通过 EvoLink 接入模型并形成自己的流程。

REAL CREATOR CASES / 03

58 个 GPT-6 Sol & Luna Use Case

每行最多四个案例;点击作者可打开该案例的原始出处。图片与视频按需加载。

按类别筛选

58 个案例

案例 01评测
网页、3D 与 SVG

同一提示词比较 Sol 与 Luna 的落地页

作者将两款 GPT-6 模型加入同提示词落地页对比站;结果已展示,但本站未独立复现。

案例 02评测
网页、3D 与 SVG

Sol:用 Three.js 制作机械蜂鸟

作者以相同提示词和 max 档比较 Sol 与旧版 Opus 5;对手不是 Opus 5.5。

案例 03评测
网页、3D 与 SVG

比较 Sol 与 Opus 的 3D 制作

API 平台展示质量与成本对比;结果来自平台自测,本站未复现。

案例 04评测
网页、3D 与 SVG

Sol:在 Blender 中制作骑车鹈鹕循环动画

平台以相同 brief 比较 Sol 与 Opus 5.5;画面优劣是发布者评价,本站未复现。

案例 05评测
网页、3D 与 SVG

Luna Max 生成体素宝塔

同任务对比 GPT-6 Luna Max 与 GPT-5.6 Luna Max;有视觉输出,未核验源码。

案例 06评测
网页、3D 与 SVG

用 Sol xHigh 绘制指尖陀螺 SVG

具体 SVG 任务对比 Sol xHigh 与 Astra High;有画面,未核验源代码。

案例 07限制
网页、3D 与 SVG

Sol:纽约 Three.js 场景只交付静态帧

作者称 Sol 未实现要求的 render loop 和镜头移动;记录为未完成结果。

案例 08评测
游戏与交互原型

Sol:在 Unreal Engine 中制作 3D 游戏

Higgsfield 比较 Sol 与 Opus 5.5 的游戏制作;工程与可玩性未独立测试。

案例 09演示
游戏与交互原型

用 Luna Max 制作马里奥风格游戏

作者发布简短游戏演示;本站未独立运行。

案例 10演示
游戏与交互原型

用 Sol 制作 Minecraft 风格游戏

作者展示 Sol 产物;源码与可玩性未核验。

案例 11演示
游戏与交互原型

Sol:制作 Neon Exit 逃脱游戏

JetBrains 展示员工用 Sol 制作的游戏;证据来自平台官方演示。

案例 12演示
视频工具工作流

用 Luna 制作模型介绍视频

作者展示视频,但未披露制作链路,不能据此认定 Luna 原生生成视频。

案例 13评测
视频工具工作流

比较 Sol 与 Astra 的 Tesseract 视频流程

Mirage 展示两款模型配合 Tesseract 的结果;渲染依赖视频工具,本站未复现。

案例 14演示
视频工具工作流

Sol 配合 HyperFrames 制作视频

作者演示几轮提示词的视频工作流;不将外部工具的生成归为 Sol 原生能力。

案例 15演示
视频工具工作流

Sol:用 Tesseract 改品牌元素与画幅

联合创始人展示 Sol 辅助的视频修改;属于产品演示,未独立复现。

案例 16基准测试
Agent、编程与浏览器任务

Sol 与 Luna 的长流程浏览器任务评测

Browser Use 发布长难度任务与成本对比;数字为平台自测,不能泛化到所有浏览器任务。

案例 17集成
Agent、编程与浏览器任务

把定时任务从 Astra 迁移到 Sol

作者自述已切换既有任务;Luna 替换其他 API 仍是计划。

案例 18评测
Agent、编程与浏览器任务

Sol + Luna:用 ts-bench 测试工具调用

研究者自测 Sol 改善、Luna 退步;本站未复现,保留正反结果。

@gosrum
案例 19基准测试
Agent、编程与浏览器任务

Sol 参与 Next.js 框架任务评测

Next.js 团队公布特定评测中 Sol 成功率 97%;不能外推到所有软件开发任务。

@nextjs
案例 20评测
Agent、编程与浏览器任务

Luna 跑完整 Agent 端到端测试

作者自述两套测试全过,费用分别为 0.03 与 0.15 美元;成本未独立核验。

案例 21演示
Agent、编程与浏览器任务

让 Sol 在浏览器 Paint 画肖像

作者给出操作指令与结果媒体;本站未复现浏览器操作。

@The_Alex
案例 22评测
研究与写作

Sol:编写并盲评 YouTube 脚本

发布者按十类题材生成 50 稿并用三个 AI 评审;结果不能代表真实观众反馈。

案例 23评测
研究与写作

Sol 用于深度研究评测与轻量编排

Perplexity 自述 WANDR 评测,计划把 Sol 用于 Light 编排;计划与已测结果分开。

案例 24限制
机器人与能力边界

Luna 未完成 LIBERO 机器人操作

研究者记录打开炉灶并放置摩卡壶的失败;任务名称来自所引 Astra 实验。

案例 25评测
网页、3D 与 SVG

Sol + Luna:制作熔岩灯

BridgeBench 用同一提示词比较四款模型;Sol/Luna 的耗时与费用仅对应这次测试。

案例 26基准测试
Agent、编程与浏览器任务

Sol:查找两个仓库的预埋 Bug

发布者报告 Sol Max 在 105 个预埋缺陷中找到 29.3 个,估算成本较低,但该次质量下降。

案例 27限制
Agent、编程与浏览器任务

Luna:仓库审查走错工具路径

作者称 Luna 在四种 harness 中都忽略 GitHub 集成,改用浏览器执行仓库审查。

案例 28演示
游戏与交互原型

Sol:制作狗拉雪橇竞速游戏原型

Higgsfield 展示 Sol 与 Opus 5.5 的游戏对比;制作环境由平台提供,未独立试玩。

案例 29评测
网页、3D 与 SVG

Sol:制作日落海面场景

BridgeBench 报告 Sol 用 44 秒、0.07 美元完成同题场景;只是一次视觉对比。

案例 30演示
游戏与交互原型

Sol:制作 3D 策略游戏原型

Higgsfield 比较 Sol 与 Opus 5.5 的战场规模原型;属于平台演示。

案例 31演示
游戏与交互原型

Sol:制作多人森林大富翁

作者用 Sol 与 Combos CLI 制作 2–4 人棋盘游戏;素材、联机和发布由外部工具完成。

@cnyzgkc
案例 32基准测试
研究与写作

Luna:视觉抽取与计数评测

Roboflow 自测称抽取、计数、推理低于 5.6 Luna,目标检测略有提高。

案例 33限制
网页、3D 与 SVG

Luna:孔雀动画出现取巧画法

作者称 Luna 用图片和旋转圆圈代替完整动画;属于具体失败反馈。

案例 34评测
游戏与交互原型

Sol + Luna:制作跟随光标的互动宠物

同题任务要求怪物跟随光标并对喂食作反应;发布者称 Luna 最快,但表情效果有限。

案例 35评测
游戏与交互原型

Sol + Luna:制作霓虹弹球游戏

同题可玩弹球任务中,发布者报告 Luna 耗时 6 分 22 秒、Sol 耗时 17 分 26 秒。

案例 36演示
视频工具工作流

Sol:编写循环水循环动画

Higgsfield 展示单文件 HTML 和浏览器实时渲染;Sol 负责代码,不是原生视频生成。

案例 37评测
网页、3D 与 SVG

Sol:制作可交互的行星网站

作者称 Sol 用十分钟完成三颗行星;与 Opus 的订阅额度来自不同套餐,不能直接等价。

案例 38评测
网页、3D 与 SVG

Sol:设计看板 Web 应用

作者以同一提示词比较四款模型的 Hermes Agent 看板界面,并将 Sol 排在最后。

案例 39评测
网页、3D 与 SVG

Sol:渲染中国古城 3D 场景

OpenDesign 以同题比较 Sol 与 Opus 5.5,称两者风格不同;完整评测尚未发布。

案例 40基准测试
Agent、编程与浏览器任务

Sol + Luna:复现已知漏洞发现

发布者的 32-CVE 评测报告 Sol 召回率 68.8%、Luna 53.1%;两者低于各自 5.6 版本。

案例 41限制
网页、3D 与 SVG

Sol:Blender 场景出现绑定与几何缺陷

同题测试中,作者称 Sol 更快且较便宜,但绑定和几何质量存在明显问题。

案例 42基准测试
Agent、编程与浏览器任务

Sol + Luna:测试百个编码环境

GertLabs 自测称 Sol 与 Opus 5.5 差距在误差内、Luna 略好于 5.6 Luna;结果依赖其 harness。

案例 43演示
游戏与交互原型

Sol:搭建多人 3D 竞技游戏

作者用 Astra 规划、Sol 编码;3D 素材、音效、联机和发布由 Combos CLI 及其他模型协作。

@Saccc_c
案例 44演示
Agent、编程与浏览器任务

Sol:边看 YouTube 边讨论

作者用 ChatGPT Voice 与 WebMCP 做同步观看站点,演示 Sol 随视频播放给出评论。

@miu21590
案例 45评测
研究与写作

Sol:撰写 shared-runners 产品公告

同题要求写产品更新并配界面截图;作者估算 Sol 成本 3.10 美元,主观更偏好其他结果。

案例 46基准测试
研究与写作

Sol:挑战 3D 空间迷宫评测

MazeBench 报告 Sol 在其高难空间任务中得分 1%;不代表全部推理任务。

案例 47基准测试
网页、3D 与 SVG

Sol:参与 Code Arena 网页开发评测

Arena 报告 Sol Max 在 WebDev 排名第四;分数由该平台任务和投票决定。

@arena
案例 48基准测试
Agent、编程与浏览器任务

Sol + Luna:运行 Rails Agent 任务

Rails Agent 评测报告 Luna Max 完成率 18%、花费 11 美元,并与 Sol 同图比较。

@dhh

当前显示 48 / 58

BUILD WITH EVOLINK / 04

查看可用于下一步验证的模型

在 EvoLink 模型目录确认当前可用型号与接入方式,再用自己的任务验证案例。