Kembali ke Daftar
📄Paper

Learning to Detect UI Principle Violations via Reinforcement Learning

Mehta N. et al.
2026-07

Tentang

Paper Juli 2026 tentang vision-language critic ringan untuk interface web yang dihasilkan. Para penulis menyatukan 19 prinsip yang mencakup accessibility WCAG 2.2, deceptive design, dan cognitive usability, lalu melatih model pada sekitar 10.000 halaman hasil generasi dengan pelanggaran sintetis yang telah diverifikasi.

Ringkasan

Mengapa Paper Ini Memberi Perspektif Baru:

1. Kualitas melampaui correctness: Mengevaluasi apakah interface yang dihasilkan mudah digunakan dan bertanggung jawab, bukan sekadar apakah kodenya berjalan
2. Cakupan desain yang luas: Menggabungkan prinsip accessibility, deceptive pattern, persepsi, kognisi, dan interaksi
3. Pipeline data yang dapat direproduksi: Menyisipkan dan memverifikasi pelanggaran yang diketahui pada beragam halaman Tailwind buatan LLM
4. Critic yang efisien: Meningkatkan vision-language model 4B dari micro-F1 36% menjadi 84% pada benchmark 19 prinsip
5. Kegunaan dalam generation loop: Menempatkan critic sebagai audit gate, filter data training, dan reward signal untuk generator UI yang lebih baik

Tag

ui-evaluationaccessibilitydesign-qualityvision-language-modelreinforcement-learning

Artikel Terkait

📄Paper

LEGOUI: Designing with UI-DSL Bricks for Transparent, Controllable Generation

Paper HCI Agustus 2026 yang memperkenalkan framework Generative UI bertahap untuk ideasi desain awal. LEGOUI mencatat keputusan dari prompt dan inferensi model dalam UI DSL yang melacak asal keputusan, memungkinkan pengguna menerima, menolak, atau menambahkan keputusan pada tahap layout, interaksi, relasi, dan style, lalu melakukan rendering dari spesifikasi yang terus berkembang.

genuiui-dsldesign-time
oleh Zhou Y. et al. · 2026-08
Baca Selengkapnya
📄Paper

Beyond a Single Judge: Simulating Social Persona Panels for Generative UI Evaluation

Paper Juli 2026 yang memperkenalkan ESPP, metode evaluasi yang mengganti satu LLM judge dengan panel persona yang beragam secara psikologis dan berpijak pada bukti. Setiap panelis menilai screenshot interface yang dihasilkan secara independen, bertukar pendapat melalui mekanisme bounded-confidence, lalu hasilnya digabungkan menggunakan pembobotan sosial.

genuiui-evaluationhuman-preferences
oleh Wu Z. et al. · 2026-07
Baca Selengkapnya
📄Paper

Design Theater: A Benchmark for Generative UI

Paper Juli 2026 yang memperkenalkan benchmark untuk memeriksa apakah tool Generative UI benar-benar menerapkan alasan desain yang disampaikan kepada pengguna. Melalui 120 interface dari lima tool dan 24 tugas struktural, styling, serta fungsional, studi ini mengukur kesenjangan antara keputusan desain yang diklaim dan hasil yang dibuat.

genuiui-evaluationdesign-rationale
oleh Imteyaz K. et al. · 2026-07
Baca Selengkapnya

Kumpulan terkurasi berisi resource Generative UI untuk designer dan developer.

Dibuat dengan ❤️ oleh komunitas