Kembali ke Daftar
📄Paper

MV-Bench: Benchmarking MLLMs for Coordinated Multi-View Interface Construction

Zhao Y. et al.
2026-07

Tentang

Benchmark Juli 2026 untuk menguji apakah multimodal language model dapat membuat interface visualisasi multi-view yang dapat dieksekusi dari desain visual. MV-Bench memakai workbook Tableau sebagai structured ground truth dan mengevaluasi fidelity visual, data binding, interaksi terkoordinasi, serta kemampuan kode untuk dieksekusi.

Ringkasan

Mengapa MV-Bench Memberi Perspektif Baru:

1. Melampaui tampilan satu layar: Menguji dashboard terkoordinasi dengan beberapa view yang saling terhubung
2. Benchmark yang dapat dieksekusi: Menyediakan 1.048 instance terverifikasi beserta kode, interface hasil rendering, dataset, dan anotasi interaksi
3. Structured ground truth: Mengambil binding dan interaksi dari 92 workbook Tableau
4. Evaluasi semantik: Mengukur kebenaran data dan kelengkapan interaksi bersama fidelity visual
5. Kesenjangan kemampuan penting: Model terkuat yang diuji mencapai akurasi layout 75,45%, tetapi hanya 21,71% untuk data binding dan 11,68% untuk interaksi

Tag

ui-generationmultimodal-modelsdata-visualizationinteractionbenchmark

Artikel Terkait

📄Paper

Toward Frontier-Quality Declarative UI Generation at Small-Model Cost

September 2026 Harness4GenUI paper studying whether small language models can generate production-oriented A2UI from approved component catalogs. Across task-management and cloud-console domains, the authors compare training-data strategies, model sizes, catalog sizes, cost, latency, binding correctness, and rendered quality.

a2uismall-language-modelssupervised-fine-tuning
oleh Yang Y. et al. · 2026-09
Baca Selengkapnya
📄Paper

EvoGenUI-Bench: Evaluating Multi-Turn Generative UI Assistants

August 2026 benchmark testing whether LLM assistants can maintain one executable web interface as user requirements evolve. EvoGenUI-Bench contains 150 five-turn tasks across information presentation, stateful interaction, and tool-grounded external state, with browser-based evaluation over screenshots, DOM and source evidence, actor traces, and runtime logs.

generative-uimulti-turnbenchmark
oleh Peng Y. et al. · 2026-08
Baca Selengkapnya
📄Paper

Maru: Information Architecture for Aligned, Persistent Generative UI

August 2026 HCI paper introducing information architecture as shared state for Generative UI. Maru captures how users partition, order, name, and prioritize information, turns those choices into persistent rules, and applies them across successive interface generations instead of rebuilding structure from each prompt.

generative-uiinformation-architecturepersonalization
oleh Kim E. et al. · 2026-08
Baca Selengkapnya

Kumpulan terkurasi berisi resource Generative UI untuk designer dan developer.

Dibuat dengan ❤️ oleh komunitas