Generator nie losuje bezmyślnie. Ocenia zestawy według kompatybilności kolorów, kategorii, warstwowania i obecności obuwia.
Klasyfikacja kategorii korzysta z modelu CLIP uruchamianego przez Transformers.js. Pozostała logika aplikacji działa lokalnie.
Model: Xenova/clip-vit-base-patch32
Zdjęcia nie są wysyłane do mojego serwera. Model jest ładowany do przeglądarki z CDN/model repository, a inferencja obrazu odbywa się po stronie klienta.
Pierwsze uruchomienie może być długie, ponieważ model Vision musi zostać pobrany i przygotowany w przeglądarce.