Wpis z mikrobloga

@ethize: i wszystko to bez znaczenia, w faktycznych zastosowaniach jest gorszy niż Codex czy Opus, słabiej rozumuje. Google pewnie końcowo i tak wyścig AI wygra, ale to jeszcze nie to
  • Odpowiedz
i wszystko to bez znaczenia, w faktycznych zastosowaniach jest gorszy niż Codex czy Opus, słabiej rozumuje. Google pewnie końcowo i tak wyścig AI wygra, ale to jeszcze nie to


@DiaVoll: To jest "Flash" czyli mały/szybki model, który krótko myśli albo wcale a jest porównywalny z dużymi modelami SOTA. No to ciekawe jakie wyniki będzie mieć 3.5 Pro.

Gemini to jeden z tych 3 brzegowych obecnie modeli (Gemini, GPT, Cloude). Reszta
  • Odpowiedz
chińskie małe modele open source też są porównywalne w tych benchmarkach, a w praktyce każdy wie jak jest


@perfumowyswir: Chińczycy jak to Chińczycy oszukują jak się tylko da... więc trenują modele na benchmarkach więc doskonale sobie w nich radzą a potem rzeczywistość skrzeczy.

Oczywiście nie umniejszając chińskim darmowym modelom, są ok i trudno znaleźć zachodni odpowiednik bo te 3 firmy które robią brzegowe modele nie mają ochoty wydawać otwartych modeli...
  • Odpowiedz
Google też oszukuje, Gemini jest słabe do kodzenia, a w benchmarkach daje radę


@perfumowyswir: W tym co teraz wałkuję (konfiguracja takiego śmiesznego clustra: ansible, zdalny dostęp, instalowanie aplikacji, python, docker, kupę zarządzania - linux, sieciówka, etc...) nie widzę jakiejś dużej różnicy pomiędzy Gemini i Claude.

Może w inny sposób komunikują pracę ale ona idzie do przodu. Rozwiązuja problemy, dodają nowe funkcjonalności. Często przełączam się pomiędzy nimi - jak mi limity
  • Odpowiedz