跳到正文
原文
The Decoder· Jonathan Kemper·· 5 小时前AI 评分63

LEGO-Anything:AI智能体从照片生成3D场景,但难以判断重建是否正确

AI agents build 3D scenes from photos but have no idea if they got it right

AI 导读

LEGO-Anything采用“Image-to-Code”,让编码智能体根据单张照片迭代编写Blender程序,以明确表示对象、几何结构、布局和相机位置。LEGO-Bench包含104个室内外场景的208张图片,并从有效性、几何精度和视觉相似度评估六种GPT配置,结果显示场景越复杂,准确度越低,智能体对几何结果的自评接近或低于随机水平。

来源:The Decoder · the-decoder.com