升级意图·在切换前重放生产任务

Claude Opus 5 与 Opus 4.8 针对虚幻引擎——全球首个在线原生虚幻工作流

对比 Claude Opus 5 与 Opus 4.8 在 Unreal 编码、调试、长周期代理、价格、迁移、安全回退、本地校验和回滚方面的表现。

直接回答

Opus 5是更新模型,Anthropic称其在同等5/25美元基准代币定价下相较Opus 4.8有显著提升,尤其在编码、验证和长时任务中更强。不要只依据厂商基准就迁移Unreal工作流。应重放已保存任务,对比被采纳编辑、根因准确性、工具使用、总成本、延迟、安全行为、恢复能力及本地构建证据。

同一Unreal测试门禁下输入两套中性模型评估基准的Seedream概念图
此概念图由 SEELE 编辑团队使用 Seedream 5.0 创建。它既非 Anthropic 资产,也非 Epic 资产,不是 Unreal Editor 的真实截图,不是游戏内容,也不能证明有官方集成。

在 SEELE 中开始构建一个 Unreal 5 游戏

选择一个具体提示词,打开 SEELE Unreal creator,查看预填充简报并生成本机项目。第一条提示词为本页定制,其余提示词可作为可复用的起始模板。

使用本页的范围化简报

创建一个可复用的原生Unreal 5废墟导航基准切片用于重复评估。玩家打开一扇门、躲避一个移动陷阱、取回文物并返回入口。包含确定性的目标状态、失败与重启、清晰的检测点,以及简短的浏览器预览路径,以便两种流程在同一可见结果上进行对比。

创建一款 Unreal 5 游戏

生成一款山地探险游戏

使用 Unreal Engine 生成一个简单的第三人称游览游戏,包含山脉和水体。应包括响应式移动、清晰路线、一个完成状态、失败恢复、立即重启、浏览器预览,以及可本地下载的 Unreal 5 原生项目。

创建一款 Unreal 5 游戏

生成一个可玩的地牢爬行游戏

使用 Unreal Engine 构建一个紧凑的地牢爬行游戏。包含第三人称移动、一个战斗循环、两个相连房间、一个钥匙与门目标、可见生命值与反馈、死亡、完成、立即重启、浏览器预览,以及可本地下载的 Unreal 5 原生项目。测试并回归验证结果。

创建一款 Unreal 5 游戏

生成一段带天气效果的城市巡游

创建一个本机 Unreal 5 第三人称城市漫游,包含紧凑可行走区域、植被、地标照明,以及晴、阴、雨三种天气状态。包含清晰的操作控件、浏览器预览、稳定的重启行为、打包检查和本地项目下载。

创建一款 Unreal 5 游戏

生成完成后 SEELE 为您提供了什么?

原生Unreal 5项目

应为可检查的 Unreal 项目,而非模型回答或非官方集成声明。

浏览器预览

在继续本地化之前,快速检查相机、控制、目标清晰度、反馈、完成、失败和重启。

优化与打包路径

面向外部发布前用于性能评估与打包准备的工作流。

可下载项目

进行源码、Blueprint、资产、插件、权利、构建、目标设备和发布审核的本地项目交接。

已核实内容及其对 Unreal 的意义

已发布改进

Anthropic表示Opus 5在与Opus 4.8相同成本下显著提升性能,并在其所称的Frontier-Bench设置上相比4.8性能提升超过两倍。

价格连续性

这两个模型在发布时均定价为每百万输入代币5美元、每百万输出代币25美元。

回退相关性

Anthropic描述了Opus 4.8在某些安全分类器场景下的回退行为,因此迁移计划应记录是否启用了自动回退。

Unreal证据缺口

既往基准结果和相同定价均不能证明具体项目中C++、Blueprint、插件、Cook、Package或目标设备输出更好。

五阶段Opus 4.8迁移与升级流程

导出真实回归集

从现有Opus 4.8流程中收集有代表性的提示词、已批准上下文、预期输出、通过和拒绝的差异、工具追踪、构建日志、失败记录以及审核决策。脱敏敏感内容。

同时运行两个模型ID

使用相同的仓库版本、工具、权限、努力策略、时间与成本上限、引擎版本、目标平台和验收检查。标记任何自动回退,以免计入Opus 5评分。

对比已完成的工作

衡量正确根因、可采纳变更率、不支持的假设、非必要变更、工具调用、总代币数、延迟、构建通过率、中断后的恢复能力以及审核者时间。

先做升级金丝雀验证

将一个小且可回滚的任务类别路由到Opus 5,监控质量与成本,在允许条件下保留4.8作为明确回退路线,并在金丝雀样本达到预设阈值后再扩大范围。

重新校验游戏路径

在创作目标上,应将模型对比与SEELE的原生Unreal生成分开。模型可能影响brief生成,而SEELE项目产出必须单独进行预览、下载、构建和测试以形成独立证据。

采用前需阻断的失败模式

风险 1

即使代币价格不变,提示词和工具行为也可能发生变化。

风险 2

如果未记录最终模型身份,自动安全回退可能污染结果。

风险 3

一个更擅长复杂任务的模型,仍可能在日常工作上形成更高成本循环。

风险 4

没有保存回归集的迁移会使质量退化难以检测或回滚。

决策评分卡

Dimension什么才算正确需保留的证据
Quality正确归属、根因、采纳编辑且无新增缺陷盲审评审与原生测试结果
Efficiency每个通过任务的Token、工具、耗时、重试次数和人工复核时间供应商与工作流遥测
Reliability方差、中断、拒绝、回退与回滚重复的匹配试验与强制恢复
迁移适配性提示词、架构、工具、策略与运行兼容性金丝雀+即时回退测试

该决策的 Unreal 实施说明

保持迁移范围不变

比较相同的 API 或客户端路径、提示词、上下文检索、工具、权限、工作量、超时、重试策略和回退机制。否则实验同时测量了平台迁移和模型变化。

包含回归任务

新模型评估需要已知的“已解决难题”和已知历史失误:虚构API、错误的子系统归属、过度变更、被中断后的丢失、违反安全边界、只编译成功以及打包构建回归。性能提升应减少特定故障类别,而不是引入新的故障。

使用金丝雀与回退路线

先在小规模任务池中采用该方法,记录实际模型身份和是否通过,设置花费上限,保留旧路线,并定义自动回滚阈值。可回滚的运营迁移比一日基准胜负更可信。

从已评估的创意到 SEELE 原生 Unreal 项目

使用模型研究来细化需求说明,而不是替代项目证据。直接的创建路径有意保持简短且可观察:

1. 约束玩家循环

保持单一摄像机、单一主动词、单一目标链路、明确的失败与完成、重启行为、视觉引导、控制方式、目标时长和清晰的完成清单。

2. 在 SEELE 中生成

打开标准化 Unreal creator,选择最接近的已验证起始世界,提交简报并生成一个本机 Unreal 5 项目,而不是把文本回答当作交付成果。

3. 检查浏览器预览

从开始到成功、失败与重启全过程进行体验。检查相机、输入、目标清晰度、反馈、交互状态、视觉层次,以及明显的性能或稳定性问题。

4. 下载或继续制作

在本地继续或外部发布之前,先审查项目、源代码、Blueprint、资源、插件、版权、配置、性能、存档、网络、烹饪、打包和目标要求。

起步方案说明

创建一个可复用的原生Unreal 5废墟导航基准切片用于重复评估。玩家打开一扇门、躲避一个移动陷阱、取回文物并返回入口。包含确定性的目标状态、失败与重启、清晰的检测点,以及简短的浏览器预览路径,以便两种流程在同一可见结果上进行对比。

官方证据与能力边界

快照日期:2026年7月25日。Anthropic 于 2026年7月24日发布的公告是发布状态、定价、定位和上线可用性的第一方来源,但其并未声称获得 Epic 官方支持的 Unreal 集成。Epic 文档和具体项目仍是引擎行为、编译、资源、测试、烹饪、打包和目标平台结果的权威依据。

Anthropic 发布

发布日期、claude-opus-5 模型 ID、编码与代理定位、定价、Fast 模式、对齐、安全性与可用性。

打开官方公告

开发者指南

在生产环境中采用前,请重新检查当前模型行为、API 范围、提示词指导、限制、努力设置与迁移说明。

Opus 5 的新增内容 · 提示词指南

继续执行 Claude Opus 5 × Unreal 集群

Claude Opus 5 与 Sonnet 5 在 Unreal 中的比较

为 Unreal 编码和代理任务选择 Claude Opus 5 或 Sonnet 5,依据任务路由、匹配测试、成本、延迟、审查、原生构建证据和 SEELE 交接。

阅读本指南

Claude Opus 5 在 Unreal Editor 中的 Computer Use

围绕 Unreal Editor 评估 Claude Opus 5 计算机使用,应采用权限边界、视觉状态校验、保存与打包门禁、审计追踪、恢复机制和 SEELE 交付交接。

阅读本指南

使用Claude Opus 5构思以构建Unreal游戏

将 Claude Opus 5 的游戏点子与规格转换为 SEELE AI 中的原生 Unreal 5 项目,包含浏览器预览、验证、打包和下载检查点。

阅读本指南

常见问题

Opus 5优于Opus 4.8吗?

Anthropic报告了显著的总体提升,但Unreal团队应基于匹配的项目任务和本地证据做出决策。

它们的API定价相同吗?

发布时是:每百万输入代币5美元,每百万输出代币25美元。

我应该立即替换4.8吗?

不。重放已保存任务,对小范围任务做金丝雀验证,记录回退情况,并保留可回退的经过验证路线,直到质量和成本稳定。

为什么要记录实际响应模型?

安全或服务端回退可能将请求路由到其他模型,从而改变证据与调试过程。

升级会改变SEELE输出吗?

未作任何关系声明。SEELE原生Unreal生成是独立工作流,需基于其实际项目与预览输出进行评估。

我应该一次性将所有Unreal任务都迁移到新模型吗?

不是。先测试任务类型,先对小范围路径做金丝雀验证,保留旧模型,监控通过率与失败类型,只有在本地证据支持时再扩展。

将研究成果转化为原生 Unreal 5 游戏

打开官方 SEELE Unreal 创作器,选择已验证的起始世界,生成原生项目,检查浏览器预览,再下载或继续进行优化和打包。将第三方模型评估与项目证据分开保存。