The Decoder· Jonathan Kemper·· 5 小时前AI 评分63
LEGO-Anything:AI智能体从照片生成3D场景,但难以判断重建是否正确
AI agents build 3D scenes from photos but have no idea if they got it right
AI 导读
LEGO-Anything采用“Image-to-Code”,让编码智能体根据单张照片迭代编写Blender程序,以明确表示对象、几何结构、布局和相机位置。LEGO-Bench包含104个室内外场景的208张图片,并从有效性、几何精度和视觉相似度评估六种GPT配置,结果显示场景越复杂,准确度越低,智能体对几何结果的自评接近或低于随机水平。
来源:The Decoder · the-decoder.com