Meet DigiData: Smarter Training and Testing for Phone‑Control AIs

Meet DigiData: Smarter Training and Testing for Phone‑Control AIs

Imagine telling your phone what you want—and an AI taps, types, and swipes to get it done. This paper introduces DigiData, a large, diverse, multi‑modal dataset designed to train general‑purpose mobile control agents. Instead of relying on unstructured user logs, the team systematically explores app features to craft goals, leading to richer tasks and longer, more realistic action sequences.

To track real progress, they also present DigiData‑Bench, a benchmark of complex, real‑world mobile tasks. The authors show that the popular “step accuracy” metric can be misleading for UI agents, and they propose dynamic evaluation protocols plus AI‑assisted scoring that judge whether the task was actually completed.

Why it matters: Better training data + better tests = faster, more reliable assistants that can navigate apps like we do—making everyday digital tasks smoother and more intuitive.

Paper: http://arxiv.org/abs/2511.07413v1

Paper: http://arxiv.org/abs/2511.07413v1

Register: https://www.AiFeta.com

AI MobileAgents Dataset Benchmark HCI UX MachineLearning Automation Smartphones

Read more

Pieni kielimalli oppi kysymään taulukoilta ihmisen puolesta

Pieni kielimalli oppi kysymään taulukoilta ihmisen puolesta

Moni on tuijottanut Exceliä ja toivonut voivansa vain kysyä: missä kaupunginosissa koti on kävelymatkan päässä terveysasemasta ja ruokakaupasta? Ihmismielelle yksinkertainen pyyntö muuttuu helposti tuntien suodatukseksi ja kaavanviilaukseksi. Tietokone kyllä tietää vastauksen – jos vain osaisimme puhua sen kieltä. Viime vuosina apua on pyydetty juttelevalta tekoälyltä. Se osaa etsiä ja tiivistää tekstejä,

By Kari Jaaskelainen
Tekoäly vastaa fiksummin, kun sille annetaan oikea tieto oikealla tavalla

Tekoäly vastaa fiksummin, kun sille annetaan oikea tieto oikealla tavalla

Katsaus kokoaa, miten kielimalleja voi vahvistaa antamalla niille jäsenneltyä lisätietoa vastaushetkellä – yksinkertaisista vihjeistä aina syy–seurausketjuiksi järjestettyyn taustaan. Kuvittele, että pyydät tekoälyä selittämään, mitä uusi lakimuutos tarkoittaa pienyrittäjälle. Yleismallinen kielimalli osaa puhua aiheesta sujuvasti, mutta jos laki on muuttunut äskettäin, vastauksessa voi olla vanhaa tietoa tai epävarmoja arvailuja. Sama kokemus

By Kari Jaaskelainen
Tekoäly voi olla sekä nopea että säästeliäs – jos se oppii milloin ajatella ääneen

Tekoäly voi olla sekä nopea että säästeliäs – jos se oppii milloin ajatella ääneen

Kuvittele chat-ikkuna, jossa vastaus alkaa rönsyillä: ensin pari perustelua, sitten varmistus, lopulta vielä varmistuksen varmistus. Käyttäjä odottaa, laskutus juoksee. Tekoälymallit hinnoitellaan usein “tokeneina” – sananpaloina – joten jokainen turha kiemura maksaa sekä aikaa että rahaa. Vuosia alalla vallitsi hiljainen oletus: mitä enemmän mallilla on laskentatehoa ja mitä pidemmin se ”miettii”, sitä parempaa

By Kari Jaaskelainen