Od obrazów, przez czaty, animacje, transkrypcje, muzykę, filmy… tak, sztuczna inteligencja dotarła już do wszystkich tych dziedzin, ale wciąż pozostaje jedno pole do zaznaczenia: generowanie obiektów 3D. We wrześniu ubiegłego roku Nvidia mówiła nam o swoim systemie GET3D. Teraz przyszła kolej na OpenAI, które po prezentacji Point-E zdecydowało się opublikować na GitHubie kod swojego modelu Shap-E, obiecując tworzenie modeli 3D przy użyciu zaledwie opisu.
Hype związany ze sztuczną inteligencją nie stracił na intensywności. Wręcz przeciwnie, liczba usług online wciąż rośnie i widzieliśmy już prawie wszystko, od stacji radiowych po wirtualnych asystentów na WhatsApp. Konflikty etyczne i prawne wciąż są dalekie od rozwiązania, ale jeśli jest coś, co może uciec od tego szumu, to jest to generowanie obiektów 3D.
Ludzie z OpenAI starają się zmierzać w tym kierunku dzięki nowemu projektowi o nazwie Shap-E. W istocie OpenAI opublikowało kod, ale wciąż brakuje wielu informacji. Profil Shap-E na GitHubie nie zawiera zaawansowanych instrukcji, a nawet nie opisuje wymaganych zależności, ale ci, którzy zdołają go zainstalować, zyskają dwie przewagi: działa offline i nie wymaga API OpenAI.
Shap-E: Pierwsze kroki od tekstu do 3D
Tryby działania są trzy: tekst na 3D, obraz na 3D (czyli konwersja 2D -> 3D) oraz Encode, który wykorzystuje Blendera do przekształcania obiektu 3D w coś innego. Logicznie rzecz biorąc, Shap-E potrzebuje dużo mocy obliczeniowej, a pierwsi odkrywcy zalecają rozpoczęcie od sprzętu Nvidia. Nawet przy GeForce RTX 3080 renderowanie modelu może zająć od czterech do pięciu minut.
Jego wyniki są zdecydowanie podstawowe, a błędy pojawiają się wszędzie… ale to niczego sobie jak na wersję początkową. Od znacznie prostszej instalacji po ulepszenia wydajności, mamy nadzieję, że Shap-E zyska popularność. Potencjał tekstu na 3D jest ogromny, a jeśli jego modele osiągną jakość odpowiednią do druku… niebo jest granicą.
Oficjalna strona: Kliknij tutaj
Źródło: Tom's Hardware