Contrôle des fixtures
Figer la révision, la version Unreal, les plugins, les assets, la plateforme, le mode de build, le prompt et les outils.
Laboratoire d’évaluation Qwen3.8 × Unreal
Un benchmark utile corrige la révision, la tâche, la preuve, le budget, le scoreur et le chemin de récupération. Il mesure si un changement fonctionne, pas si la réponse paraît experte.
Aucun benchmark officiel public Qwen3.8 Unreal n’est établi. Construisez une suite locale qui évalue l’achèvement, le taux de compilation du premier passage, le taux d’erreurs d’API inventées, les régressions, la qualité des preuves, le temps de revue humaine et le comportement packagé dans des conditions équivalentes.

plans, explications, modifications de code proposées, actions d’outils, revues, tests et notes de transmission.
Figer la révision, la version Unreal, les plugins, les assets, la plateforme, le mode de build, le prompt et les outils.
Notez la compilation, le runtime, l’automatisation, le packaging, la correction, la latence, le coût, la revue et la récupération.
Masquer l’identité du modèle lorsque c’est possible et utiliser une seule grille pour les tentatives modèle et humaine.
Conservez les premiers échecs, les diff rejetés, les journaux et les résultats de rollback ; les retries silencieux faussent la fiabilité.
Choisir une correction de compilation, une revue de Blueprint, un bug runtime, un problème d’asset/config, et une vérification de build empaqueté.
Documentez le propriétaire attendu, le chemin d’acceptation, les modifications interdites et la preuve minimale.
Utiliser le même contexte, les mêmes outils, le même temps, le plafond de Credits et les mêmes règles d’arrêt.
Appliquer la grille, examiner à l’aveugle, répéter les tâches instables et publier les limites.
Réparer une panne de compilation déterministe. Expliquer la première erreur, proposer le plus petit diff et s’arrêter si les preuves manquent.
Diagnostiquer une incohérence client/serveur et nommer la limite d’autorité ainsi qu’un test de correction reproductible.
Captures avant/après revue, étapes de gameplay et journaux ; retournez une matrice d’échec et un déclencheur de rollback.
Séparer les assets manquants des erreurs de module/config et proposer un seul changement de diagnostic à la fois.
Identifiants de tâche, révisions, entrées, outils, budgets, pondérations et exclusions.
Prompts, réponses, diffs, commandes, timings, coûts, échecs et notes.
Achèvement, compilation, runtime, packaging, invention, régression, temps de revue et reproductibilité.
Usages approuvés, usages interdits, surveillance, date de relance et propriétaire du rollback.
SEELE AI peut générer un jeu Unreal 5 natif, le prévisualiser dans le navigateur, l'optimiser et l'empaqueter, et fournir un jeu téléchargeable ou une construction empaquetée pour une publication externe ou des jeux Seele payants. Les ventes ne sont pas garanties.
Les sources de lancement citées ne fournissent pas de benchmark public spécifique à Unreal.
Utiliser une correction de tâche prouvée par des preuves de build, runtime et packaging.
Commencer avec cinq échecs représentatifs, puis étendre aux systèmes principaux et aux régressions.
Fournissez uniquement le contexte pertinent et autorisé, puis mesurez la récupération séparément.
Non. Répétez les tâches, conservez les échecs, testez la récupération et mesurez l’effort de revue.
Il peut fournir une cible prototype de navigateur tandis que le scoring natif reste dans Unreal.
Générer un jeu natif Unreal 5 dans SEELE AI, examiner l'aperçu dans le navigateur, puis optimiser, empaqueter, télécharger ou publier le jeu. Conserver la licence, les tests de plateforme cible et les revendications de modèles tiers comme des étapes de vérification séparées.
Le téléchargement payant est facultatif pour les sorties SEELE AI éligibles. Disponibilité, demande, tarification et revenus ne sont pas garantis.