Czy wam też się wydaje, że artyści zaczęli korzystać z AI, żeby tworzyć nowe utwory? Tak sobie przeglądam youtube i kiedyś premiery były rzadko, a teraz nagle mam wysyp premier jakichś losowych ludzi typu Cara Delevinge (modelka de facto, coś tam próbowała aktorsko, ale jej nie idzie). O co kaman?
Wyszkoczył mi teraz jakiś Zenek z Martyniukiem, to ma nie cały miesiąc i już ma 25 milionów wyświetleń, ale najśmieszniejszy jest tekst tego,
  • 1
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

@Arivederczi: to raczej zwykli ludzie tak robią, wrzucają prompty które mają brzmieć podobnie do głównych hitów bo wiadomo że chwyci, do tego generator im pisze tekst z paru słów, vocal jest dostrajany i generowany i parę minut masz legalną kopię każdego hitu a że dzieciaki lubią słychać takich pierdół to nabijają wyświetlenia albo wogole na początku są one wykupowane żeby się pojawiały na listach, a jak inni to widzą to
  • Odpowiedz
Elon Musk ostrzega, że czas się kończy:

„Maksymalnie pozostały 3 lata, w których jeszcze będziesz mógł zarabiać pieniądze, sprzedając swoją pracę”

Potem IA wykonuje większość zadań i płacenie komuś za jego czas przestaje mieć sens

Umowa
  • 38
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

@beata_ty_cyka: ktoś tu kiedyś mówił i nawet prognoze wstawiał z kąś że poprzedni piątek będzie ostatni z upałami, zapominając o tym że co parę dni pogodynki mówią co innego i znowu na koniec tygodnia dowali prawie 30... O ile coś się nie zmidni i będzie więcej, a za tydzień pewnie powtórka że niby koniec ale jednak nie
  • Odpowiedz
Ma ktoś pomysł jakim ai jest generowany ten lektor? Gubi się przy czytaniu dat, co widać to już na samym początku i potem w okolicach 2:25, ale poza tym to brzmi bardzo naturalnie. Szukam czegoś czym mógłbym sobie pogenerować dłuższe audiobooki ze starych książek.
#ai #sztucznainteligencja
bgb1 - Ma ktoś pomysł jakim ai jest generowany ten lektor? Gubi się przy czytaniu dat...
  • 5
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Nie ma nic lepszego niż płatny https://elevenlabs.io/ (za free jest limit)

Modele:
Eleven v3 – najlepszy do audiobooków, narracji, podcastów (pełna kontrola emocji tagami).
Multilingual v2 – najbardziej naturalna intonacja (YouTube, voiceover).
Flash v2.5 / Turbo v2.5 – bardzo niska latencja (~75 ms), idealne do voicebotów i real-time.
  • Odpowiedz
@bgb1: Poczekaj jeszcze chwilę, będą doskonałe modele z diaryzacją (podziałem na role - inne głosy), z emocjami... za darmo. O dziwo, modele generujące audio nie są jakieś bardzo złożone, nie są duże - zmieszczą się na gamingowej karcie graficznej :-)

@makrofag74 zrobił fajne zestawienie :-) Jakieś pół roku temu testowałem Gemini Flash Preview - najpierw zrobiłem diaryzację dialogu na role, potem skonfigurowałem dwie osoby do różnych ról i wygenerowałem
  • Odpowiedz