Meet Mon3tr: Lifelike 3D Telepresence from One Camera

Meet Mon3tr: Lifelike 3D Telepresence from One Camera

Imagine joining a meeting as a lifelike 3D hologram—no studio rig, just your phone or laptop camera. Mon3tr makes this possible.

How it works: Mon3tr builds your personal 3D avatar once (offline) from multi-view photos. During calls, a single RGB camera tracks your body and face to drive that avatar in real time. Only compact motion-and-appearance features are sent—under 0.2 Mbps over WebRTC—so it stays smooth even on spotty networks.

On the receiver (e.g., Meta Quest 3), a lightweight “Gaussian” renderer—think a cloud of tiny 3D dots—fine-tunes the pre-built avatar on the fly, delivering photorealistic motion and expressions at about 60 FPS.

Results: over 1000× less bandwidth than point-cloud streaming, about 80 ms end-to-end latency, and high visual quality (>28 dB PSNR) across diverse scenes—while running from a single camera.

Demos: https://mon3tr3d.github.io

Paper: https://arxiv.org/abs/2601.07518v1

Register: https://www.AiFeta.com

#AR #VR #Telepresence #3D #AI #ComputerVision #XR #WebRTC #MetaQuest #GaussianSplatting #Monocular #Holograms

Read more

Pieni kielimalli oppi kysymään taulukoilta ihmisen puolesta

Pieni kielimalli oppi kysymään taulukoilta ihmisen puolesta

Moni on tuijottanut Exceliä ja toivonut voivansa vain kysyä: missä kaupunginosissa koti on kävelymatkan päässä terveysasemasta ja ruokakaupasta? Ihmismielelle yksinkertainen pyyntö muuttuu helposti tuntien suodatukseksi ja kaavanviilaukseksi. Tietokone kyllä tietää vastauksen – jos vain osaisimme puhua sen kieltä. Viime vuosina apua on pyydetty juttelevalta tekoälyltä. Se osaa etsiä ja tiivistää tekstejä,

By Kari Jaaskelainen
Tekoäly vastaa fiksummin, kun sille annetaan oikea tieto oikealla tavalla

Tekoäly vastaa fiksummin, kun sille annetaan oikea tieto oikealla tavalla

Katsaus kokoaa, miten kielimalleja voi vahvistaa antamalla niille jäsenneltyä lisätietoa vastaushetkellä – yksinkertaisista vihjeistä aina syy–seurausketjuiksi järjestettyyn taustaan. Kuvittele, että pyydät tekoälyä selittämään, mitä uusi lakimuutos tarkoittaa pienyrittäjälle. Yleismallinen kielimalli osaa puhua aiheesta sujuvasti, mutta jos laki on muuttunut äskettäin, vastauksessa voi olla vanhaa tietoa tai epävarmoja arvailuja. Sama kokemus

By Kari Jaaskelainen
Tekoäly voi olla sekä nopea että säästeliäs – jos se oppii milloin ajatella ääneen

Tekoäly voi olla sekä nopea että säästeliäs – jos se oppii milloin ajatella ääneen

Kuvittele chat-ikkuna, jossa vastaus alkaa rönsyillä: ensin pari perustelua, sitten varmistus, lopulta vielä varmistuksen varmistus. Käyttäjä odottaa, laskutus juoksee. Tekoälymallit hinnoitellaan usein “tokeneina” – sananpaloina – joten jokainen turha kiemura maksaa sekä aikaa että rahaa. Vuosia alalla vallitsi hiljainen oletus: mitä enemmän mallilla on laskentatehoa ja mitä pidemmin se ”miettii”, sitä parempaa

By Kari Jaaskelainen