Pobrałem sobie #llama2 i zadałem mu pytanie o kod do szukania liczb pierwszych. 13b sobie średnio poradził, a z 70b dpuściłem, tak mi kompa zwiesił. #chatgpt gpt w sekundę zwraca kod. Albo to jest tak zasobożerne, albo coś źle robię. #programowanie
@kutafonixor: mam 3090. W LM Studio 70b puszczam na CPU+GPU+RAM z integry i idzie. Powoli, ale idzie. A mam też WEBUI do lokalnego pythona, gdzie puszczam 13b na samym GPU+zintegrowanym GPU i tam fajnie śmiga. Jakbym miał pewność, że w SLI mi odpali 70B na dwóch 3090, to bym jedną dokupił, ale sam model waży 160 GB, więc słabo to widzę.
Na wydajniejsze modele przyjdzie jeszcze poczekać. Możesz sobie sprawdzić Vicuna, ten model 13b działa jak Chatgpt i jeszcze kilka miechów temu był najwydajniejszym modelem open source. Teraz pewnie są lepsze
Jest to 1-godzinne ogólne wprowadzenie do dużych modeli językowych: podstawowego komponentu technicznego stojącego za systemami takimi jak ChatGPT, Claude i Bard. Czym są, dokąd zmierzają, porównania i analogie do współczesnych systemów operacyjnych oraz niektóre wyzwania związane z bezpieczeństwem
@midalohn: W sumie masz kilka modeli jak coś, jak chcesz tylo do chatu, masz llama-chat, a jak chcesz do pomocy w pisaniu kodu to masz llama-code: https://ollama.ai/library
@aptitude: o fajnie, też protestuje. Narazie pobrałem ten pierwszy domyślny i na pytanie o dzisiejszą datę po polsku odpowiada że "dnia dwudziestego drugiego lutego", dobrze to nie wróży ???? Zobaczymy jak będzie generować kod jak się tylko skończy pobierać model.