OpenAI zaprezentowało najnowszą wersję swojego chatbota, który łączy w sobie analizę tekstu i obrazów. Dzięki zastosowaniu technologii multimodalnej, użytkownicy mogą teraz przesyłać zdjęcia, grafiki lub dokumenty, a chatbot jest w stanie odpowiedzieć na pytania dotyczące ich treści. Nowy model nie tylko rozpoznaje obiekty na zdjęciach, ale także potrafi generować opisy i wyjaśniać złożone konteksty. W…
OpenAI ogłosiło wprowadzenie ChatGPT Pro z natywnym wsparciem dla wtyczek, co otwiera zupełnie nowe możliwości dla użytkowników i firm. Wtyczki pozwalają na integrację modelu z zewnętrznymi źródłami danych, aplikacjami biznesowymi oraz usługami online. Dzięki temu ChatGPT może teraz wykonywać złożone operacje, takie jak rezerwacje, zakupy czy analiza danych w czasie rzeczywistym. Co nowego w ChatGPT…
Meta zaprezentowała najnowszą wersję swojego modelu generatywnego do tworzenia dźwięku — AudioCraft Ultra. To rozwinięcie wcześniejszych modeli MusicGen i AudioGen, jednak różnica jakościowa jest na tyle duża, że może realnie wpłynąć na branżę muzyczną, produkcję filmową, reklamę i projektowanie gier. AudioCraft Ultra potrafi generować pełne kompozycje muzyczne, realistyczne instrumenty, ludzkie chórki, a także efekty dźwiękowe…
Perplexity zaprezentowało nowy model sztucznej inteligencji o nazwie Comet, który został opracowany z myślą o dostarczaniu bezpośrednich, wiarygodnych i zweryfikowanych odpowiedzi na pytania użytkowników. W przeciwieństwie do typowych chatbotów generatywnych, Comet nie stara się „zgadywać” informacji. Jego zadaniem jest precyzyjne szukanie źródeł, analizowanie ich treści oraz przygotowywanie podsumowań pozbawionych domysłów. To istotna zmiana w podejściu…
Tesla zaprezentowała najnowszą wersję swojego robota humanoidalnego Optimus Gen 3. To kolejny krok Elona Muska w kierunku wykorzystania robotów w codziennych zadaniach — zarówno w fabrykach, jak i w przestrzeniach domowych. Najnowsza generacja charakteryzuje się płynniejszymi ruchami, lepszym wyczuciem balansu oraz funkcją autonomicznego uczenia się poprzez obserwację. Optimus Gen 3 — co nowego? Robot został…
Google ogłosiło uruchomienie funkcji Gemini Live, która pozwala użytkownikom prowadzić rozmowy głosowe z modelem sztucznej inteligencji w czasie rzeczywistym. To krok, który ma zrewolucjonizować sposób, w jaki korzystamy z asystentów AI — od codziennych zadań po naukę, pracę oraz kreatywne wsparcie. Gemini Live — AI, które rozmawia jak człowiek W przeciwieństwie do dotychczasowych asystentów głosowych,…
Google DeepMind zaprezentowało dziś nową wersję swojego zaawansowanego modelu sztucznej inteligencji — Gemini 2.0. To następca znanego Gemini 1.5, który już w momencie premiery wprowadził nowy standard w rozumieniu kontekstu i przetwarzaniu informacji multimodalnych. Jednak wersja 2.0 to coś znacznie więcej — system, który zaczyna naprawdę „rozumieć” świat tak, jak człowiek. Gemini 2.0 – nowy…