Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.097 — 2026-10-09
PAPER HF 15 约 1 分钟

世界模型第一次学会被深度编辑

AI开始从换贴图走向改机制,并要保证游戏世界其余部分照常运行。

给游戏里的剑加伤害不难;难的是加一套技能树后,战斗、成长和界面还能彼此配合,没被要求修改的部分也照常运行。World Editing把这种能力叫作“世界编辑”:不是凭空生成场景,而是让编码智能体修改《Minecraft》和《Terraria》的游戏模组,再实际编译、启动和检验这个可执行世界。

作者构建的IGMBench——一套统一任务和评分办法——包含110项任务、1161条可执行检查,并按“干预深度”分为四级:从改属性、添实体,到重写行为规则和多个系统。最强配置严格完成了78.2%的整项任务,但越深的修改越不可靠;即使控制任务的检查条目数量,这一趋势仍然存在。更值得注意的是,多数失败版本仍能编译和载入,真正卡住的是世界没有按要求运转。所有配置的联合视觉通过率还不到50%。换句话说,AI已经会动手改世界,但要同时管住机制、外观和未改部分,仍有明显距离。以上效果均为论文作者报告。


供稿材料 SOURCES — 1

← 返回 2026-10-09 · 学术板块