Tavlo AI Lab / der erzähler
Der Erzähler
Eine Kamera, die spricht: Ein Vision-Sprachmodell mit 256 Millionen Parametern beobachtet Ihre Webcam und erzählt, was es sieht.
live · auf dem Gerät · kein Upload
WebGPU erforderlich. Diese Demo führt ein Vision-Sprachmodell auf Ihrer GPU aus und braucht einen WebGPU-Browser wie Chrome oder Edge.
das modell sieht
Fragen zur Szene
Von Grund auf privat. Der Erzähler ist das Open-Source-Vision-Sprachmodell SmolVLM-256M, das über Transformers.js und WebGPU auf Ihrer GPU läuft (einmaliger Download von ca. 1 GB, danach im Browser gecacht). Bilder werden im Speicher Ihres Geräts analysiert und niemals hochgeladen, aufgezeichnet oder gespeichert; der Kamerazugriff wird erst angefragt, wenn Sie auf „Kamera aktivieren“ klicken. Details in unserer Datenschutzerklärung.