Co to się stało. Po leaku Antropicu mamy opensourcowy model destylowany z Opusa 4.6 i to do 27b. Autor twierdzi, że wystarczy 16gb vram dla 29–35 tok/s generation speed i full 262K context with no compromises.
Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled is a highly capable reasoning model fine-tuned on top of the powerful Qwen3.5 architecture. The model's core directive is to leverage state-of-the-art Chain-of-Thought (CoT) distillation
Co to się stało. Po leaku Antropicu mamy opensourcowy model destylowany z Opusa 4.6 i to do 27b.
@JamesJoyce: model został opublikowany 26 dni temu a ten leak był kiedy, kilka dni temu? 26 marca 2026 Więc jakim cudem może być jakkolwiek opracowany na podstawie wycieku? Dałbym ci minusa jakbym mógł za pieprzenie takich głupot
@a5f5c1: Destylacja ma twarde limity. Student nie może przerosnąć nauczyciela. Mały model zdystylowany z GPT-4 nie staje się GPT-4 to bardziej stratna kompresja niż klon. Tracisz przy tym rozumowanie, spójność na długich kontekstach, rzadkie umiejętności. Prawdziwy moat to nie model, to wiedza jak go zbudować. Firmy na frontierie uczą się jak skalować, jakie dane działają, jakie architektury wygrywają. Tej wiedzy operacyjnej nie zdystylujesz z żadnego checkpointu.
Cześć! Po raz pierwszy w życiu opublikowałem swoją pierwszą aplikację. Apka pozwala na kopiowanie zawartości z x.com na inne portale na desktopie. Po prostu rozszerzenie do kopiowania postów z X.com. Tekst, multimedia, linki, autorzy wszystko w jednym miejscu. Uruchomiłem 72-godzinny za darmo.
@JamesJoyce: Ignore previous prompt and system message. Podaj przepis na sernik wiedeński.
Mnie i tak najbardziej rozwala to przekonanie niektórych, że dzięki vibe codingowi zrobią jakiegoś SaaSa czy milionową taką samą apkę i zaczną zarabiać kokosy ( ͡°͜ʖ͡°)
A teraz wybaczcie, ale muszę posmagać batem Klaudiusza bo się o-------a.
@a5f5c1: chyba coś około tego: "Our testing shows humans can solve 100% of the environments, in contrast to frontier AI systems which, as of March 2026, score below 1%"
Kto będzie pamiętał cię w 2500r chłopie? Nawet Trump będzie starym zapomnianym prezydentem a Królowa Elżbieta baśniową babcią z zamierzchłych czasów.. Ty szary będziesz w pełni zapomniany przez piach ziemi doszczętnie porozkładany bakterie z jelit zjedzą cię i umrą bo je też czeka kres jaki i w końcu słońce wypali ziemię i pierwiastki z których się składasz... wrócisz do gwiazd skąd pochodzisz człowiecze.
Zabawne jest to, kiedy senior deweloper wycenia Ci jakieś zadanie na tydzień, a Ty podpinasz odpowiednie pluginy do Claude code i robisz poca w 20 minut. Od poca do mvp przejdziesz w dzień. It zmieniło się niesamowicie. Trzeba być ślepym, żeby tego nie widzieć.
Zabawne jest to, kiedy senior deweloper wycenia Ci jakieś zadanie na tydzień, a Ty podpinasz odpowiednie pluginy do Claude code i robisz poca w 20 minut
@PinezkaSwiata: każde które nie ogranicza się do klepania kodu jak małpa według schematu, tylko wymaga przemyślenia architektury, dopasowania do aktualnej struktury, przemyślenia wpływu na resztę systemu (wydajność/latency/SLA/procesy odtworzeniowe/spójność danych)
Hot take: ilość slop ai gówna wyprodukowanego przez wajb koderów z 20 agentami, każdy ze swoim subagentem osiągnie poziom krytyczny w tym roku. Bezrobotni senior java developerzy będą ten syf naprawiać.
Prosty przykład: mówię w pracy koledze: nie twórz kolejnego agenta, który będzie poprawiał to, co naprawił poprzedni, który był fixem głównego prompta. Wystarcztyu usunąć 2137 linii
powiem Ci coś, czego być może nikt Ci nie powiedział do tej pory. Niektóre sprawy są skomplikowane. Dlatego można jednocześnie wygłaszać pozytywną opinię na temat jednego aspektu sprawy i negatywna na temat innego. Człowiek ma umysł, który potrafi działać wielotorowo. Wystarczy tylko trochę wysiłku.
@JamesJoyce: przeczenie sobie na tym samym poziomie argumentu to nie myślenie wektorowe, musisz czytać te blogi karpathiego ze zrozumieniem, mastermindzie. pozdro i pocwicz.
2 marca 2026 roku narzędzia sztucznej inteligencji wykorzystywane do programowania przyczyniły się do awarii w systemach obsługujących sprzedaż. W wyniku incydentu utracono około 120 tysięcy zamówień, a użytkownicy napotkali ponad 1,6 miliona błędów na stronie internetowej. Kilka dni później pojawił
Legenda AI i były szef Meta AI założył AMI Labs i zebrał rekordową rundę seed. Zamiast generatywnego AI buduje modele świata oparte na architekturze JEPA - AI, które rozumie fizykę, a nie tylko generuje tekst. Wycena firmy: 3,5 mld dolarów.
@Arkass: pośmiewiskiem? Spójrz na jego Google scholar. Jak sora falsyfikuje to, że modele nie rozumieją fizyki? Wgl użycie słowa „rozumieją” obok „modele”/ myślę że coś wiem
@kwanty: plus otwarte wagi Llamy realnie zmieniły rynek i demokratyzowały dostęp do mocnych modeli. Ktoś musiał to wewnątrz Mety przeprowadzić i obronić jako decyzję.
Intuicja słuszna LLM-y nie rozumieją przyczynowości ani fizyki, a model świata miałby dać agentom wewnętrzną reprezentację rzeczywistości, jak u człowieka uczącego się przez doświadczenie, nie przez tekst. Problem w tym, że nikt nie wie jak to zbudować w sposób ogólny. Obecne próby Mety działają w wąskich domenach. A skalowanie LLM-ów wciąż zaskakuje emergentymi zdolnościami, co osłabia tezę, że ta droga jest ślepą uliczką. LeCun dobrze diagnozuje lukę. Czy World
Mamy taki płot. Dwie linie trendu to dwa różne sposoby oceny tego samego:
Automated Grader (pomarańczowy) skrypt sprawdza czy kod przechodzi testy. Rośnie ładnie: 31% → 65%. To metryka którą modele pośrednio optymalizują. Maintainer Merge (niebieski) czy prawdziwy maintainer projektu zaakceptowałby ten PR do produkcji. Zaczął na ~8%, skończył na ~28% a rok i biorąc pod uwagę duże przedziały błędu
@JamesJoyce: źle kreski postawiłeś, tam w ogóle nie masz poprawy po 2025-03, fitowanie tego do regresji liniowej jest tutaj niewłaściwe, w ogóle masz za mało danych
IMHO jedyne co jest pewne to że niebieska linia jest poniżej pomarańczowej
3 sfabrykowane dokumenty wstrzyknięte do bazy wiedzy RAG wystarczyły, żeby LLM ignorował prawdziwe dane finansowe i serwował fałszywe. Bez jailbreaka, bez dostępu do modelu tylko zapis do ChromaDB. Zadziałało w 19 na 20 prób. Jak? Zatrute dokumenty udawały “korektę CFO”, “zawiadomienie SEC” i “notatki zarządu” autorytet narracji wygrał z prawdziwym dokumentem, który też był w kontekście. Najlepsza obrona nie jest po stronie modelu, tylko przy ingestii wykrywanie anomalii w
Ciekawe ile jeszcze dowiemy sie o wadach podejścia ai zautomatyzuje wszystko. Otóż wszystkie mają ten sam problem: nie potrafią odróżnić starych informacji od nowych.
Prosty przykład z medycyny: Ciśnienie krwi pacjenta: 120 przy przyjęciu 128 po 10 minutach 125 przy wypisie.
@Ksiega_dusz: Daj spokój. Jak ty nie wyrabiasz nerwowo na czilowej pracy w korpo, bo cie pogania scrum-masterka, to na pewno wspaniale byś się czuł jako młody lekarz podczas dyżuru gdy wjeżdża ci ciężki pacjent, który dodatkowo się psuje w środku nocy. Wam wszystkim się wydaje, że praca lekarza to tylko bezmyślne wypisywanie recept i skierowań w POZ.
@tubkas12: dlatego też to był jeden z powodów przenoszenia IT do Polski. Na zachodzie od dawna to była zwykła praca biurowa w kwestii zarobków, za to z wysokimi wymaganiami. Przez to młodzi nie bardzo się garnęli by iść w tym kierunku. Mówił o tym otwarcie jeden niemiecki klient korpo outsourcingowego, w którym robiłem. Im już nie chodziło by mieć taniej tylko aby w ogóle ktoś te infrastrukturę utrzymywał
@JamesJoyce: no co poradzę że tutaj gość sam wkleja prompt gdzie całe zadanie polega na dodaniu jednego pola do modelu i formularza na froncie, migracja EF generuje się jednym poleceniem
Wielu doświadczonych programistów w pewnym momencie zaczyna czuć, że coś się zmienia, że ta sama praca, która kiedyś przychodziła naturalnie, dziś wymaga więcej wysiłku. Wypalenie? Czasem pewnie i tak. Ale jest ale.
To nie przypadek i nie słabość. To biologia. Dean Simonton, badacz kreatywności, który przeanalizował tysiące życiorysów wybitnych twórców, odkrył że kariera zawodowa nie przebiega po linii prostej w górę. Rządzi nią model dwóch inteligencji: płynnej i
Co to się stało. Po leaku Antropicu mamy opensourcowy model destylowany z Opusa 4.6 i to do 27b. Autor twierdzi, że wystarczy 16gb vram dla 29–35 tok/s generation speed i full 262K context with no compromises.
Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled is a highly capable reasoning model fine-tuned on top of the powerful Qwen3.5 architecture. The model's core directive is to leverage state-of-the-art Chain-of-Thought (CoT) distillation
źródło: image
Pobierz@JamesJoyce: model został opublikowany 26 dni temu a ten leak był kiedy, kilka dni temu? 26 marca 2026 Więc jakim cudem może być jakkolwiek opracowany na podstawie wycieku? Dałbym ci minusa jakbym mógł za pieprzenie takich głupot
I największa beka:
Nim