返回列表
📄论文

AUV-Bench:用户界面审美理解与生成评测

Deng Z. et al.
2026-09

简介

2026 年 9 月提出的 UI 评测基准,在 1,395 个可执行 Web 界面上统一测试审美评分、问题诊断、界面修复与文本生成 UI,并用 660 个受控退化案例配对诊断和修复,检验模型能否把设计判断转化为有效的界面修改。

内容总结

AUV-Bench 的新增价值:

1. 统一评测基础:四类能力共享界面样本与专业设计师制定的审美原则
2. 连接判断与行动:在同一个退化页面上对齐缺陷诊断和源码修复
3. 具体能力缺口:12 个模型中,完整诊断链成功率最高仅为 24.7%,正确判断也不总能带来成功修复
4. 复现边界明确:数据集已公开,但论文链接的仓库仍注明评测代码尚待发布

标签

ui-generationaesthetic-evaluationdiagnosis-and-repairhuman-evaluationbenchmark

相关文章

生成式 UI 精选资源合集。

用 ❤️ 由社区制作