2 artykuły z tym tagiem
GenCeption wykorzystuje generator wideo do zadań wizji komputerowej, dorównując wyspecjalizowanym modelom przy użyciu 500 razy mniej danych treningowych.
Model „Count Anything” z Uniwersytetu Tsinghua potrafi liczyć obiekty od zdjęć satelitarnych po skany medyczne, używając tylko tekstowych poleceń.