Microsoft Research veröffentlichte Lens, ein Text-zu-Bild-Modell mit 3,8 Milliarden Parametern, das bei Benchmarks mit deutlich größeren Konkurrenten mithalten konnte und dabei zu einem Bruchteil der Kosten trainiert werden konnte. Es nutzte 800 Millionen detaillierte Bildunterschriften, die von GPT-4.1 generiert wurden, und veröffentlichte Code und Gewichte unter einer Open-Source-Lizenz.