跳到正文
原文
The Decoder· Jonathan Kemper·· 2 小时前AI 评分59

AI 智能体通过编写代码构建3D场景,但缺乏自我判断能力

AI agents build 3D scenes from photos but have no idea if they got it right

AI 导读

研究者提出的LEGO-Anything方法让编码智能体通过编写Blender代码从单张照片重建3D场景。团队使用包含208张图像的LEGO-Bench评测发现,各模型在几何准确性上表现不一且自我评估极不可靠。为此,研究者开发了无需训练的LEGO-Plugin,通过引入具体测量指标替代智能体自身判断来防止退化编辑,从而显著提升了所有模型的场景重建效果。

来源:The Decoder · the-decoder.com