使用本页的范围化简报
创建一个可复用的原生Unreal 5废墟导航基准切片用于重复评估。玩家打开一扇门、躲避一个移动陷阱、取回文物并返回入口。包含确定性的目标状态、失败与重启、清晰的检测点,以及简短的浏览器预览路径,以便两种流程在同一可见结果上进行对比。
创建一款 Unreal 5 游戏升级意图·在切换前重放生产任务
对比 Claude Opus 5 与 Opus 4.8 在 Unreal 编码、调试、长周期代理、价格、迁移、安全回退、本地校验和回滚方面的表现。
Opus 5是更新模型,Anthropic称其在同等5/25美元基准代币定价下相较Opus 4.8有显著提升,尤其在编码、验证和长时任务中更强。不要只依据厂商基准就迁移Unreal工作流。应重放已保存任务,对比被采纳编辑、根因准确性、工具使用、总成本、延迟、安全行为、恢复能力及本地构建证据。
选择一个具体提示词,打开 SEELE Unreal creator,查看预填充简报并生成本机项目。第一条提示词为本页定制,其余提示词可作为可复用的起始模板。
创建一个可复用的原生Unreal 5废墟导航基准切片用于重复评估。玩家打开一扇门、躲避一个移动陷阱、取回文物并返回入口。包含确定性的目标状态、失败与重启、清晰的检测点,以及简短的浏览器预览路径,以便两种流程在同一可见结果上进行对比。
创建一款 Unreal 5 游戏使用 Unreal Engine 生成一个简单的第三人称游览游戏,包含山脉和水体。应包括响应式移动、清晰路线、一个完成状态、失败恢复、立即重启、浏览器预览,以及可本地下载的 Unreal 5 原生项目。
创建一款 Unreal 5 游戏使用 Unreal Engine 构建一个紧凑的地牢爬行游戏。包含第三人称移动、一个战斗循环、两个相连房间、一个钥匙与门目标、可见生命值与反馈、死亡、完成、立即重启、浏览器预览,以及可本地下载的 Unreal 5 原生项目。测试并回归验证结果。
创建一款 Unreal 5 游戏创建一个本机 Unreal 5 第三人称城市漫游,包含紧凑可行走区域、植被、地标照明,以及晴、阴、雨三种天气状态。包含清晰的操作控件、浏览器预览、稳定的重启行为、打包检查和本地项目下载。
创建一款 Unreal 5 游戏应为可检查的 Unreal 项目,而非模型回答或非官方集成声明。
在继续本地化之前,快速检查相机、控制、目标清晰度、反馈、完成、失败和重启。
面向外部发布前用于性能评估与打包准备的工作流。
进行源码、Blueprint、资产、插件、权利、构建、目标设备和发布审核的本地项目交接。
Anthropic表示Opus 5在与Opus 4.8相同成本下显著提升性能,并在其所称的Frontier-Bench设置上相比4.8性能提升超过两倍。
这两个模型在发布时均定价为每百万输入代币5美元、每百万输出代币25美元。
Anthropic描述了Opus 4.8在某些安全分类器场景下的回退行为,因此迁移计划应记录是否启用了自动回退。
既往基准结果和相同定价均不能证明具体项目中C++、Blueprint、插件、Cook、Package或目标设备输出更好。
从现有Opus 4.8流程中收集有代表性的提示词、已批准上下文、预期输出、通过和拒绝的差异、工具追踪、构建日志、失败记录以及审核决策。脱敏敏感内容。
使用相同的仓库版本、工具、权限、努力策略、时间与成本上限、引擎版本、目标平台和验收检查。标记任何自动回退,以免计入Opus 5评分。
衡量正确根因、可采纳变更率、不支持的假设、非必要变更、工具调用、总代币数、延迟、构建通过率、中断后的恢复能力以及审核者时间。
将一个小且可回滚的任务类别路由到Opus 5,监控质量与成本,在允许条件下保留4.8作为明确回退路线,并在金丝雀样本达到预设阈值后再扩大范围。
在创作目标上,应将模型对比与SEELE的原生Unreal生成分开。模型可能影响brief生成,而SEELE项目产出必须单独进行预览、下载、构建和测试以形成独立证据。
即使代币价格不变,提示词和工具行为也可能发生变化。
如果未记录最终模型身份,自动安全回退可能污染结果。
一个更擅长复杂任务的模型,仍可能在日常工作上形成更高成本循环。
没有保存回归集的迁移会使质量退化难以检测或回滚。
| Dimension | 什么才算正确 | 需保留的证据 |
|---|---|---|
| Quality | 正确归属、根因、采纳编辑且无新增缺陷 | 盲审评审与原生测试结果 |
| Efficiency | 每个通过任务的Token、工具、耗时、重试次数和人工复核时间 | 供应商与工作流遥测 |
| Reliability | 方差、中断、拒绝、回退与回滚 | 重复的匹配试验与强制恢复 |
| 迁移适配性 | 提示词、架构、工具、策略与运行兼容性 | 金丝雀+即时回退测试 |
比较相同的 API 或客户端路径、提示词、上下文检索、工具、权限、工作量、超时、重试策略和回退机制。否则实验同时测量了平台迁移和模型变化。
新模型评估需要已知的“已解决难题”和已知历史失误:虚构API、错误的子系统归属、过度变更、被中断后的丢失、违反安全边界、只编译成功以及打包构建回归。性能提升应减少特定故障类别,而不是引入新的故障。
先在小规模任务池中采用该方法,记录实际模型身份和是否通过,设置花费上限,保留旧路线,并定义自动回滚阈值。可回滚的运营迁移比一日基准胜负更可信。
使用模型研究来细化需求说明,而不是替代项目证据。直接的创建路径有意保持简短且可观察:
保持单一摄像机、单一主动词、单一目标链路、明确的失败与完成、重启行为、视觉引导、控制方式、目标时长和清晰的完成清单。
打开标准化 Unreal creator,选择最接近的已验证起始世界,提交简报并生成一个本机 Unreal 5 项目,而不是把文本回答当作交付成果。
从开始到成功、失败与重启全过程进行体验。检查相机、输入、目标清晰度、反馈、交互状态、视觉层次,以及明显的性能或稳定性问题。
在本地继续或外部发布之前,先审查项目、源代码、Blueprint、资源、插件、版权、配置、性能、存档、网络、烹饪、打包和目标要求。
创建一个可复用的原生Unreal 5废墟导航基准切片用于重复评估。玩家打开一扇门、躲避一个移动陷阱、取回文物并返回入口。包含确定性的目标状态、失败与重启、清晰的检测点,以及简短的浏览器预览路径,以便两种流程在同一可见结果上进行对比。
快照日期:2026年7月25日。Anthropic 于 2026年7月24日发布的公告是发布状态、定价、定位和上线可用性的第一方来源,但其并未声称获得 Epic 官方支持的 Unreal 集成。Epic 文档和具体项目仍是引擎行为、编译、资源、测试、烹饪、打包和目标平台结果的权威依据。
发布日期、claude-opus-5 模型 ID、编码与代理定位、定价、Fast 模式、对齐、安全性与可用性。
打开官方公告在生产环境中采用前,请重新检查当前模型行为、API 范围、提示词指导、限制、努力设置与迁移说明。
使用版本特定的 Epic 文档和实际项目来进行 C++、Blueprint、构建、测试、Cook 和打包决策。
C++ · Blueprints · Automation · 构建并打包
为 Unreal 编码和代理任务选择 Claude Opus 5 或 Sonnet 5,依据任务路由、匹配测试、成本、延迟、审查、原生构建证据和 SEELE 交接。
阅读本指南围绕 Unreal Editor 评估 Claude Opus 5 计算机使用,应采用权限边界、视觉状态校验、保存与打包门禁、审计追踪、恢复机制和 SEELE 交付交接。
阅读本指南将 Claude Opus 5 的游戏点子与规格转换为 SEELE AI 中的原生 Unreal 5 项目,包含浏览器预览、验证、打包和下载检查点。
阅读本指南Anthropic报告了显著的总体提升,但Unreal团队应基于匹配的项目任务和本地证据做出决策。
发布时是:每百万输入代币5美元,每百万输出代币25美元。
不。重放已保存任务,对小范围任务做金丝雀验证,记录回退情况,并保留可回退的经过验证路线,直到质量和成本稳定。
安全或服务端回退可能将请求路由到其他模型,从而改变证据与调试过程。
未作任何关系声明。SEELE原生Unreal生成是独立工作流,需基于其实际项目与预览输出进行评估。
不是。先测试任务类型,先对小范围路径做金丝雀验证,保留旧模型,监控通过率与失败类型,只有在本地证据支持时再扩展。
打开官方 SEELE Unreal 创作器,选择已验证的起始世界,生成原生项目,检查浏览器预览,再下载或继续进行优化和打包。将第三方模型评估与项目证据分开保存。