Wykop.pl Wykop.pl
  • Główna
  • Wykopalisko266
  • Hity
  • Mikroblog
  • Zaloguj się
  • Zarejestruj się
Zaloguj się

Popularne tagi

  • #ciekawostki
  • #informacje
  • #technologia
  • #polska
  • #swiat
  • #motoryzacja
  • #podroze
  • #heheszki
  • #sport

Wykop

  • Ranking
  • Osiągnięcia
  • FAQ
  • O nas
  • Kontakt
  • Reklama
  • Regulamin

483

Inżynier Netflixa otworzył za darmo narzędzie do cięcia kosztów AI o 90%

Inżynier Netflixa otworzył za darmo narzędzie do cięcia kosztów AI o 90%

Project Headroom kompresuje tokeny przed wysłaniem do modelu językowego, eliminując powtarzające się dane. Logi serwera odchudza o 90%, JSON o 70%. Łącznie zaoszczędzono grupie użytkowników ponad 700 tys. dol. przy 200 mld tokenów. Kod dostępny na GitHubie.

real_scoria
real_scoria
z
theregister.com
dodany: 31.05.2026, 10:35:13
  • #
    programowanie
  • #
    opensource
  • #
    ai
  • #
    narzedzia
  • #
    technologia
  • 58
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych komentarzach

Treści powiązane (2)

Bez zbędnego gadania i czarowania - link do repo
hocuspocus
z github.com
  • 25
Caveman - Podobne tylko na output
nastarkill
z github.com
  • 5

Komentarze (58)

najlepsze

LudzieToDebile
LudzieToDebile
LudzieToDebile
31.05.2026, 10:38:08 via Wykop
  • 123
Kompresuje to złe słowo. On je przycinał usuwając dane nadmiarowe. Czyli zostawiał same konkrety.
  • 7
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

kotbehemoth
kotbehemoth
31.05.2026, 12:54:30 via Android
  • 48
@LudzieToDebile:

przycinał usuwając dane nadmiarowe


To właśnie kompresja. Chociaż bardzo prosta.
  • Odpowiedz
Niech_moc_bedzie_z_toba
Niech_moc_bedzie_z_toba
31.05.2026, 18:03:20 via Wykop
  • 14
@2152: „nie wysyłasz 2 raz tego co już ostało wysłane” czyli usuwasz to co zbędne i wysyłasz to co niezbędne do odczytu polecenia. To jest właśnie kompresja. Tak samo jak mój cytat twojej wypowiedzi.
  • Odpowiedz
kill15you
kill15you
kill15you
31.05.2026, 11:15:26 via Wykop
  • 96
Czyli co koszty spadną więc będzie taniej? Czy może ceny trzeba będzie podnieść? XD
  • 23
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

KochanekAdmina
KochanekAdmina
31.05.2026, 12:28:10 via Wykop
  • 54
Czy może ceny trzeba będzie podnieść? XD


@kill15you: Nie da się podnosić ceny tokenów w sytuacji kiedy Chińczycy za punkt honoru wzieli sobie r--------e Amerykanów na rynku AI za sankcje xD DeepSeek jest 95% tańszy od Amerykańskiej konkurencji (i tylko trochę gorszy), a poza tym lokalne AI są coraz lepiej optymalizowane i Qwen wychodzi na model który w przeciągu kilku lat może być TYM DOMYŚLNYM MODELEM W KAŻDEJ FIRMIE, poza
  • Odpowiedz
kill15you
kill15you
kill15you
31.05.2026, 12:45:39 via Wykop
  • 37
@KochanekAdmina: tez nie mam pojęcia. jeśli jeszcze do tego dojdą modele odpalane lokanie. oni budują te centra, teraz wszyscy na raz jednocześnie windując ceny wszystkiego, np. ram, dysków nie mówiąć już o GPU xD
Jednocześnie windując ceny kart graficznych zostawili ten rynek dla konkurencji, dla konkurencji z chin która ma w miare dogodne warunki na tworzenie własnych GPU i tym sposobem stworzyli: LX 7G100.
I teraz ta karta jest w tyle jeszcze,
  • Odpowiedz
model_trzy_zmianowy
model_trzy_zmianowy
31.05.2026, 20:09:17 via Wykop
  • 36
Zrobiłby jakaś apke do liczenia kalorii, a nie się pierdołami zajmuje
  • 3
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

SpecX
SpecX
31.05.2026, 21:10:33 via Wykop
  • 15
@model_trzy_zmianowy: albo nowy kalkulator BMI, to by się nam przydało.
  • Odpowiedz
Pro-Xts
Pro-Xts
01.06.2026, 16:07:36 via Wykop
  • 2
@model_trzy_zmianowy: @SpecX albo kalkulator wagi, wzrostu i numeru buta na podstawie kalorii i BMI. Co teras?
  • Odpowiedz
ubijakitopiel
ubijakitopiel
31.05.2026, 18:10:48 via Wykop
  • 11
Czyli coś jak caveman?
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

Bejro
Bejro
31.05.2026, 18:29:43 via Wykop
  • 6
Ogólnie to korporacje jak na razie nie przejmują się tymi kosztami ale miejsca do poprawek jest mnóstwo. Chyba nikt nie korzysta z cachowania i customowe claude cody na wejściu przepalają mnóstwo tokenów albo ładują sobie do pamięci tysiące tokenów ale nie z jakiegoś prekompilowanego readme a iterując sobie dokumentację przy pomocy narzędzi. Już nie mówiąc, że LLMy są powoli na wyjściu i zaraz będzie nowa generacja AI która jest 100 razy mniejsza
  • 6
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

Bejro
Bejro
31.05.2026, 22:25:29 via Wykop
  • 3
@glass3: A wiesz chociaż jak te modele działają i jak bardzo są przeparametryzowane? Nie musisz znać wszystkich książek Harrego Pottera na pamięć aby odpowiadać na logiczne pytania - a na tym opiera się uczenie LLMów - wrzuć całą wiedzę świata w nadziei, że model nauczy się myśleć - niby to działa ale większość wag modelu to martwa masa i w sumie wystarczy mały model który sobie poszuka informacji (już dawno
  • Odpowiedz
mrreow
mrreow
01.06.2026, 11:35:43 via Wykop
  • 2
@Bejro: Przede wszystkim na razie AI operuje na wielozadaniowych kartach graficznych zdolnych do badania i trenowania nowego AI ale okropnie wolnych.

Jeśli dojdziemy do momentu krystalizacji to przejdziemy bardzo szybko na wyspecjalizowany krzem tylko do jednego modelu który będzie mieć wypalone weights i będzie ultra szybki, tysiące razy szybszy.

Na razie jest to ogromnie powolne bo trzeba miec tę uniwersalność sprzętową do badań.

Testowali już taki wyspecjalizowany układ z małym
  • Odpowiedz
konsument
konsument
31.05.2026, 18:24:29 via Wykop
  • 4
Ale to zmienia samo działanie algorytmu (LLM to dalej algorytm). Zobaczcie co się dzieje z TF-IDF przy takim trimmingu / "deduplikacji".
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

JozinZBazin5002
JozinZBazin5002
JozinZBazin5002
31.05.2026, 18:45:59 via Wykop
  • 3
o̶t̶w̶o̶r̶z̶y̶ł̶ , udostępnił
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

osadzeszklanki
osadzeszklanki
osadzeszklanki
01.06.2026, 13:11:13 via Wykop
  • 2
ja prdl - nie rozumiem nic, idę poszukać jakiejś fajnej urny ....
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

Dzikiczan
Dzikiczan
02.06.2026, 19:55:01 via Wykop
  • 1
Pomysł fajny, ale nie bardzo to działa w zastosowaniach z agentami. O ile kompresja w zwykłym czacie daje radę i pozwala oszczędzić nieco na czasie, tak bywa uciążliwa w innych zastosowaniach. Sam pomysł i fakt, że idziemy w kierunku "kombinowania" a nie tylko czystej wydajności generowania tokenów bardzo mnie jednak cieszy. Od dawna obserwuję rozwój i różnice między głównymi konkurentami. Testuję i weryfikuje ich rozwiązania i narzędzia które pomagają wycisnąć jak najwięcej
  • 1
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

dreadingit
dreadingit
dreadingit
11.06.2026, 12:58:43 via Android
  • 0
@Dzikiczan

Czy coś więcej o tych potencjalnych domowych i mniej kosztownych rozwiązaniach możesz napisać?
  • Odpowiedz
eturbo
eturbo
31.05.2026, 17:43:51 via Wykop
  • 1
No i niby co my zwykli konsumenci Copilot CLI mamy z tym zrobić? ( ͡º ͜ʖ͡º) Jak rozumiem w prompcie wjeżdża: "Hey copilot, powiedz mi jak mogę to zastosować w moim projekcie ##Link##' ( ͡°( ͡° ͜ʖ( ͡° ͜ʖ ͡°)ʖ ͡°) ͡°)
  • Odpowiedz
  • Otrzymuj powiadomienia
    o nowych odpowiedziach

  • <
  • 1
  • 2
  • Strona 1 z 2
  • >

Hity

tygodnia

Córka wpływowych lekarzy zabiła na drodze 3 osoby, ale nie siedzi w więzieniu.
Córka wpływowych lekarzy zabiła na drodze 3 osoby, ale nie siedzi w więzieniu.
4164
Minister zdrowia apeluje żeby przystopować z wykrywaniem afer lekarzy
Minister zdrowia apeluje żeby przystopować z wykrywaniem afer lekarzy
3649
Kontrole B2B przez PIP mają omijać szpitale
Kontrole B2B przez PIP mają omijać szpitale
3194
Z każdej 100 zł zapłaconej składki tylko 17 zł idzie na leczenie
Z każdej 100 zł zapłaconej składki tylko 17 zł idzie na leczenie
3106
Szpital w Pszczynie: uznajemy zarobki lekarzy za poufne i odmawiamy ujawnienia
Szpital w Pszczynie: uznajemy zarobki lekarzy za poufne i odmawiamy ujawnienia
2959
Pokaż więcej

Powiązane tagi

  • #programista15k
  • #pracait
  • #it
  • #pracbaza
  • #naukaprogramowania
  • #java
  • #informatyka
  • #webdev
  • #gruparatowaniapoziomu
  • #korposwiat
  • #praca
  • #sztucznainteligencja
  • #heheszki
  • #pytanie
  • #ai

Wykop © 2005-2026

  • O nas
  • Reklama
  • FAQ
  • Kontakt
  • Regulamin
  • Polityka prywatności i cookies
  • Hity
  • Ranking
  • Osiągnięcia
  • Changelog
  • więcej

RSS

  • Wykopane
  • Wykopalisko
  • Komentowane
  • Ustawienia prywatności

Regulamin

Reklama

Kontakt

O nas

FAQ

Osiągnięcia

Ranking