#ai #sztucznainteligencja #llm

Chyba przestane patrzec na te wszystkie benchmarki.
Bo niby GLM5.3 jest dobry. A według mnie pierniczy jak pokręcony....
Deepseek v4 pro też według mnie dużo gorszy do RP niż sie mogłoby wydawać.
  • 3
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

  • 2
Chyba przestane patrzec na te wszystkie benchmarki.

Bo niby GLM5.3 jest dobry. A według mnie pierniczy jak pokręcony....

Deepseek v4 pro też według mnie dużo gorszy do RP niż sie mogłoby wydawać.


@LadySandra: W szczególności chińskie modele są tuningowane pod benchmarki i trzeba patrzeć na to przez palce... Najlepszym benchmarkiem są Twoje zadania/zapytania.

Zrób sobie swój benchmark - to czego potrzebujesz do pracy/zabawy i na tych pytaniach testuj modele :-)
  • Odpowiedz
@LadySandra: ClaudeCode i opus5 bezkonkurencyjny jeżeli chodzi o przydatność, pluje sobie w brodę że kupiłem
GPT plus, Astra 6 to zwykły marketing. Wróciłem do clauda ponownie po dwóch dniac. W codex nie da się nic zrobić, tokeny przepalają się na prostych rzeczach w 20 minut
  • Odpowiedz
Grok stale coraz głupszy:
https://grok.com/share/bGVnYWN5LWNvcHk_ec22c61c-1229-40a6-b50c-3bde6b7502f5
Od początku założył, że mam złe intencje, i przez to kompletnie spieprzył analizę mojego pytania: zamiast rozważyć, czy detektor może zostać wykorzystany jako element procesu uczenia generatora, zaczął odpowiadać na znacznie węższe pytanie, którego w ogóle nie zadałem. Kiedy wyjaśniłem mu konkretny mechanizm iteracyjnego wykorzystania wyników detektora jako informacji zwrotnej, nadal nie potrafił odnieść się do tego argumentu i w kółko wracał do odmowy dotyczącej DDoS. Nawet
look997 - Grok stale coraz głupszy:
https://grok.com/share/bGVnYWN5LWNvcHk_ec22c61c-1...

źródło: Gemini_Generated_Image_8qnw4j8qnw4j8qnw

Pobierz
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

  • Doceń
#gamedev #programowanie #vibecoding #ai #sztucznainteligencja #llm

Robię sobie obecnie gierkę, którą łączę z LLM-em - NPC gadają to, co model wypluje.
I jest przy tym masa problemów, żeby to stabilnie spiąć.

OpenAI API ma niby coś takiego jak response-format (można ustawić json-schema i skonfigurować strukturę JSON-a), ale w praktyce różnie z tym bywa. Nie u każdego providera to dobrze działa - niektórzy w
  • 4
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

  • 1
@Sinti:
Model ma mi po prostu zwrócić dane w formacie (JSON), który zrozumie silnik gry (Godot).

Robię visual novel, w której gracz wpisuje w pole tekstowe własne akcje, a LLM ciągnie fabułę dalej. Żeby gra wiedziała, co z tym zrobić, muszę dostać odpowiedni sformatowany tekst zeby silnik gry zrozumiał o co chodzi:
- Jaki prompt wysłać do generatora AI obrazów (do tła sceny)
- Kto w danym
  • Odpowiedz
@LadySandra: a, tera czaję

już gdzieś to pisałem, myślę że AI sprawi że visual novelki przeżyją nową młodość, już pomijając oczywiście interakcje z AI, ale jak ktoś zrobi jakiś silnik dla VN działający na podobnej zasadzie jak Genie 3 (czy tam inne tego typu) - no to kosmos będzie
Sinti - @LadySandra: a, tera czaję

już gdzieś to pisałem, myślę że AI sprawi że visu...
  • Odpowiedz
A no i w koncu spożytkowałem tego 5090 prawilnie i postawiłem NInfer z Qwen 3.8 27B. Jako harness wybrałem DSH. (DeepSeek Harness) Myślę sobie, sprawdzę te lokalne LLMy i jaki jest postęp i jak wypadają w porównaniu do modeli Anthropic/OpenAI.

No i kurde, jest nieźle. Powiedziałbym że czulem sie jakbym uzywal GPT czy Claude z około 12 miesięcy temu. Jest nieco wolniej, ale można normalnie robić ciekawe rzeczy, kod, zapytania, research. No
  • 1
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Jestem w wielkim szoku, jak dobrze rozwiązuje zadania ten nowy model od Alibaba: Qwen 3.8

To jest dosłownie przepaść wobec tego co było wcześniej, może i długo myśli i długo planuje na ustawieniu xhigh ale efekt jest doskonały jak na lokalne LLM z ograniczonymi zasobami.

Jak ktoś chce potestować, to niestety dużo pamięci na kontekst trzeba przeznaczyć ale warto. Wrócił sens lokalnego hostowania LLMów

#sztucznainteligencja #ai #llm
  • 2
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Jak ktoś chce potestować, to niestety dużo pamięci na kontekst trzeba przeznaczyć ale warto. Wrócił sens lokalnego hostowania LLMów


@kot_w_krawacie: IMO:
Za chwilę mają opublikować wagi GLM-5,3, a ma 3x mniej parametrów od Quen, przy porównywalnej jakości, to pewnie ten model stanie się królem lokalnego wykorzystania.
Arkass - >Jak ktoś chce potestować, to niestety dużo pamięci na kontekst trzeba przez...

źródło: image

Pobierz
  • Odpowiedz
#ai #llm #sztucznainteligencja #claude #anthropic
11 sierpnia 2026 roku firma Anthropic ogłosiła, że ​​zacznie oznaczać wszystko, co wyprodukuje Claude. Do obrazów i innych plików dołącza podpisane metadane pochodzenia, korzystając ze standardu c2pa . Do zwykłego tekstu dodaje to, co firma nazywa niezauważalnym znakiem wodnym, który pozostaje w tekście nawet po skopiowaniu i wklejeniu w inne miejsce.

"Warstwa, która pasuje do opisu Anthropica,
  • 2
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Hej,

Szukam najbardziej opłacalnego modelu LLM do tworzenia aplikacji.

Po zmianach w czerwcu w GitHub Copilot próbuję ogarnąć, który plan oferuje najlepszy stosunek jakości do ceny.

Sprawdziłem
  • 7
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Ze wszystkich AI projektów nie rozumiem czemu ludzie najbardziej jarają się przepisaniem jakiegoś projektu na inny język. Nie ma nic mniej wnoszącego w rozwój oprogramowania niż rewrite na inny język. Jaracie się rewritem buna który zjadł już 800k$ i wciąż wymaga mocnego nadzoru ze strony programistów. Widziałem gdzieś post z rewritem Sqllite który kosztował "tylko" 1k$. Tymczasem jest to najprostsza rzecz do przepisania dla LLMa, ma w swoich danych treningowych cały kod
  • 7
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

@OlekAleksander: z licencji MIT ( ͡° ͜ʖ ͡°) Faktycznie warto. Myślisz, że jakbyś 1:1 przepisał Windowsa w rust i nazwał go Oknos 12 i sprzedawał za 50 PLN to Microsoft by powiedział "w sumie to ok, bo my pisaliśmy w C"?
  • Odpowiedz