mccloud
mccloud
Jest tu jakiś spec od #awsglue #glue #spark ?
Po odpaleniu joba, po jakims czasie dostaje bład jak niżej...

I nie wyglada to na coś złego, normalnie wszystko się przetwarza (screen)
jakieś pomysły co zrobiłem nie tak?

An error occurred while calling o5466.resolveChoice. Job aborted due to stage failure: Task 6 in stage 53.0 failed 4 times, most recent failure: Lost task 6.3 in stage 53.0
0
mccloud
mccloud
Czy #spark sam z siebie wywala kolumny które mają tylko nulla?

Co prawda mam #awsglue i #spark pod spodem, ale jak na wejsciu dałem 200 kolumn to polowa mi zniknęła - sprawdziłem dane i są te które zniknęły mają same nulle.
0
KORraN
KORraN
#dji #spark #drony Wygrzebałem swojego Sparka po prawie dwóch latach i niestety jedna bateria już się nie ładuje. Gdzie najlepiej kupić nową? Widzę, że kiepsko z dostępnością ( ͡° ʖ̯ ͡°)
0
  • Najlepsze
  • Wszystkie komentarze
Laszl0
@KORraN: Ja yebie, jeszcze 3 lata temu był to nowoczesny dron a teraz nawet akumulatorów do nich nie robią.
1
jurii
@KORraN nie ma nowych, musisz szukać tam, gdzie komuś zostały na stocku lub naprawić starą. Ebay, amazon- tam jeszcze trafisz, ale często w chorych cenach.
0
Hektorrr
Humble Bundle z książkami wydawnictwa Apress. Głównie o technologiach związanych z .NET, ML.NET, Cpłotek, TypeScript, Azure, Github.

26 książek za £14!

Pełna lista:

Practical
3
  • Najlepsze
  • Wszystkie komentarze
Hektorrr
@Hektorrr: Dodam, że zestaw tych wszystkich książek normalnie wyceniony jest na £1,119.85.
Tak więc £14 funtów to prawie jak za darmo a jak wiadomo za darmo to uczciwa cena.
3
chaddeveloper
@Hektorrr: szkoda, że nie fizyczne wydanie ( ͡° ʖ̯ ͡°)
1
mccloud
mccloud
#pyspark #awsglue #spark

Mam sobie kolumne z danymi:

60
null
0
  • Najlepsze
  • Wszystkie komentarze
Bulldogjob
1
  • Najlepsze
  • Wszystkie komentarze
inny_89
@Bulldogjob: ehhh, dałem się złapać na clickbajtowy tytuł. Argumenty przeciw sparkowi są prawdziwe ale w praktyce należy je pominąć z rozważań. Zwłaszcza argument o syntax pysparka vs pandasa
1
Hadzik
@Bulldogjob:

z mojego doświadczenia wynika, że osoby zajmujące się data science, nie są tak dobrze zaznajomione z (Py)Spark, jak z Pandas. W obu przypadkach wykorzystywana jest koncepcja ramek danych, ale API do manipulowania danymi w ramce jest zupełnie inny.


Był Koalas, a teraz już nawet nie trzeba:
https://databricks.com/blog/2021/10/04/pandas-api-on-upcoming-apache-spark-3-2.html#:~:text=We're%20thrilled%20to%20announce,on%20their%20existing%20Spark%20clusters.
0
mlodymedyk
Szukam prezentu dla fana #f1 i pomyślałem o modelu bolidu Maxa Verstappena. Czy znacie może producenta modeli #spark ? A może jakaś inna firma lepsza? #modelarstwo

#f1
1
  • Najlepsze
  • Wszystkie komentarze
xaro
używał ktoś aplikacji #spark do kupowania biletów na a4?
wszystko działa nie ma przypału? bo tam w porównaniu do etolla po prostu kupuje się bilet bramka A -> bramka B i tyle?

#polskiedrogi #a4 #etoll
1
  • Najlepsze
  • Wszystkie komentarze
PiotrokeJ
Cześć, dostałem mały projekt w pracy w pysparku. Mała transformacja danych i wrzucenie wyników do nowej tabeli. W punktach opiszę co trzeba zrobić:
1. 4 uniony
2. Pobrać tabelę z mappingiem
3. Zrobić joina (te 4 uniony i mapping)
5. Przerobić 2 kolumny na podstawie wartości, i dodać dwie puste kolumny
4. Wykonać prostą agregacje danych -> groupby po 5 kolumnach.
0
  • Najlepsze
  • Wszystkie komentarze
inny_89
Hey #scala
Macie może jakieś dobre tutoriale, dokumentację odnośnie implementacji ZIO ze #spark ?

Na głównym repo ziverge od zio-spark nie mogę dużo znaleźć, a znowu film Pana Leo Benkela bardzo mnie zaciekawił i chciałbym trochę bardziej zgłębić temat:

#apachespark #databricks
1
  • Najlepsze
  • Wszystkie komentarze
inny_89
Słuchajcie mam zagadkę. Z zakresu troche fanaberii i sci-fi.

Raczej mniej istotne tło problemu:

Tworzę sobie Wheela w #pythonie i do pełnego wykorzystania tej libki, którą zbuduje jest potrzebna inna libka udostępniana jako plik .JAR.
Lokalnie jak sobie z tym pracuje i odpalam kod w ramach mojego develpmentu na sparku to mam zwyczajnie załączony ten JAR w odpowiedniej lokalizacji i wskazuje go podczas budowania SparkSession. Tak jak na uproszczonym przykłądzie poniżej:
0
  • Najlepsze
  • Wszystkie komentarze
mccloud
mccloud
Kurcze mam dane 145 kolumn, 100k wierszy. Wrzucam do glue/sparka i mam kilkadziesiat krokow. W wiekszosci cos w stylu a*b itd (testuje sobie).
Większość kodu to funkcje np jak poniższa:

def handle(gc: GlueContext, df: DynamicFrame) -> DynamicFrame:
return ApplyMapping.apply(frame=df, mappings=t)

def t(rec: DynamicRecord) -> DynamicRecord:
0
  • Najlepsze
  • Wszystkie komentarze
kamarosz
kamarosz
Siema, poszukuje apki DJI 4 mod 2.0, skąd mogę pobrać? Miałem na starym telefonie ale nie pamiętam skąd pobrałem. Apka dla Sparka by latać na fcc.
#dji #spark #drony
1
  • Najlepsze
  • Wszystkie komentarze
kulpa007
Ja się pytam gdzie jest cały #spark od Rippla?
#xrp #kryptowaluty
3
  • Najlepsze
  • Wszystkie komentarze
inny_89
Potrzebuję zrobić #hurtowniedanych w #sqlserver ale jako narzędzie do #etl służy mi #spark, a konkretnie #pyspark

Macie może jakieś dobre materiały albo przykładowe kody, żeby podejrzeć jakieś dobre praktyki?

Jak ogarnąć slow changing dimension? Metadane itp.?
1
  • Najlepsze
  • Wszystkie komentarze
onionhero
Czy da się jakoś w #spark dodać stopkę w HTML z odnośnikami do lokalizacji miniaturki i innych grafik?
Jeśli tak, to jak?

#osx #ios
0
p.....k
p.....k
#spark #scala #programowanie

Nie działa mi 1 przykład z dokumentacji sparka: https://spark.apache.org/docs/latest/structured-streaming-kafka-integration.html

val df = spark
.readStream
1
  • Najlepsze
  • Wszystkie komentarze
p.....k
p.....k
Tak to jest się uczyć z książki w której przykłady nie działają, bo są bez konfiguracji.
Próbuję zapodać przykładowy structured streaming sparkiem do kafki i same problemy. Większość już rozwiązałem, teraz mam na drodze ten:

org.apache.spark.AnalysisException: value attribute unsupported type bigint. value must be a(n) string or binary;
at org.apche.spark.sql.kafka010.KafkaWriter ...

kod:
1