Katanya mau jadi Data Scientist, tapi masih takut statisik? 🤨😱
Kenalan sama basicnya dulu yuk!
.
.
.
A thread
Hayoo siapa yang disini lagi mau banting setir buat ngerambah dunia perdataan dan jadi Data Scientist?
Kalau kamu udah mau menyelami profesi ini, ada baiknya nih tau dulu kira kira kamu bakal berurusan sama apa sih ketika jadi DS nanti? Biar kebayang, kamu bisa liat diagram venn dibawah ini nih:
Bila diperhatikan, data science ini ada di perpotongan math & statistics, computer science, dan domain expertise. Maksudnya adalah, untuk menjadi seorang DS yang handal, kamu harus menguasai ketiga bidang tadi.
Kalau menguasai computer science sama domain expertise doang berarti menjadi software developer. Kalau math & stat sama domain expertise berarti jadi data analyst. Dan terakhir, kalau menguasai computer science dan math & stat berarti jadi computer scientist.
Sekarang kamu jadi lebih tau kan bedanya pekerjaan-pekerjaan yang udah mimin sebutin tadi.
Nah, dari nama profesinya aja ‘Data Scientist’, udah pasti nih sehari-harinya kita ketemu dengan data. Ketika bermain dengan data yang jumlahnya banyaaakkk banget, Data Scientist gabisa nih mengabaikan pemahaman statistik.
Eits, jangan takut duluan baca ‘harus paham statistik’. Tenang, kalian ga bakal ngitung data-data yang banyak banget jumlahnya secara manual. Seperti yang dijelasin di awal, kalian kan pasti menggunakan tools untuk mengolah data yg udah ga bisa dihitung pakai jari lagi banyaknya

• • •

Missing some Tweet in this thread? You can try to force a refresh
 

Keep Current with Follow us on instagram: @pacmannai

Follow us on instagram: @pacmannai Profile picture

Stay in touch and get notified when new unrolls are available from this author!

Read all threads

This Thread may be Removed Anytime!

PDF

Twitter may remove this content at anytime! Save it as PDF for later use!

Try unrolling a thread yourself!

how to unroll video
  1. Follow @ThreadReaderApp to mention us!

  2. From a Twitter thread mention us with a keyword "unroll"
@threadreaderapp unroll

Practice here first or read more on our help page!

More from @pacmannai

30 Apr
Mau punya model bagus tapi datanya imbalanced? 😢🤷‍♂️
Catat 3 solusinya!
.
.
.
A thread
Suatu hari, kita diminta klien membangun model machine learning yang bisa mendeteksi tumor ganas pada lambung pasien. Kemudian, dengan memakai dataset berisi kumpulan CT-Scan perut, kita buat model yang memprediksi apakah seorang pasien menderita kanker lambung atau tidak.
Tapi masalahnya, ‘Gastric cancer’ atau kanker lambung ini tergolong sangat jarang temen-temen. Bahkan di Indonesia, resikonya itu cuma sekitar 0.0028%. Itu artinya, kalau kita sampling 100.000 orang, kemungkinannya kita cuma akan peroleh 3 sampel data penderita kanker lambung!
Read 34 tweets
30 Apr
Enam alasan kenapa project DS sering gagal. 🥲🤦
Jangan sampai terjerumus ke 6 penyebab ini!
.
.
.
A thread
Pernah gak sih udah cape-cape begadang berminggu-minggu bikin model tapi kok ga selesai-selesai? Atau mungkin modelnya udah jadi tapi ternyata ga memberikan insight sesuai yang diminta atasan? 🥲🥲🥲
Yaa, kita semua setuju lah ya hal-hal di atas jadi nightmare banget, dan sebisa mungkin kita mau menghindari project menjadi gagal. Nah, makanya di thread kali ini, mimin mau bahas beberapa alasan yang bisa menyebabkan project kita fail. Langsung aja ke alasan yang pertama
Read 31 tweets
30 Apr
Butuh kedewasaan untuk mengakui pekerjaan kita gak perlu pakai model/tool yang paling canggih.

Butuh kedewasaan untuk mengakui model yang dibutuhkan gak njlimet pakai Deep Learning Transformers, tapi pakai Logistic Regression aja bisa.
Menurut gue ini penyakit semua orang yang baru masuk ke industry ya, terlepas industry nya apa aja.

Gue juga dulu pas kerja pertama jadi DS di 2015, semua model mau gue deeplearning-kan-saja-semua.
Namun ya gue ke sini mikirnya adalah bikin model yang:

1. Mudah
2. Sederhana
3. Cepat
4. Gampang lo debug
5. Gampang di-tuning, yang ini adalah hasil diskusi dengan teman kemarin di suatu kantor berita.
Read 8 tweets
29 Apr
Udah buat program tapi bingung evaluasinya gimana?🧐🤔
Pakai Difference in Difference aja!
.
.
.
A thread
Mimin yakin tempat kerja kalian pasti pernah membuat program baru / keputusan krusial. Setelah membuat program baru ini, tentunya ada outcome yang diharapkan dong, kalau ga ya ngapain repot-repot bikin program?
Yang menjadi pertanyaan adalah, gimana caranya kita tau kalau program ini memiliki dampak yang signifikan?
Read 32 tweets
28 Apr
Central Limit Theorem: kenyataan pahit yang ga semua orang tahu📊
Introduction to Cauchy Distribution
.
.
.
A thread
Central limit theorem? Hmm.. udah sering banget ga sih denger teorema ini? Tapi kalo Cauchy Distribution, udah pada tau belum, nih?
Central Limit Theorem itu kan bunyinya gini: distribusi dari rata-rata sampel variabel acak yang gak di-generate dari dist Gaussian biasanya akan jadi Gaussian kalo misalnya ukuran sampelnya cukup besar. Image
Read 29 tweets
28 Apr
Mau jadi Data Scientist dengan gaji diatas 2 digit?🤑📈
Nih, ikutin tips nya!
.

.

A Thread
(image credit: unsplash.com/@jpvalery) Image
Coba tebak-tebakan dulu: Berapa sih gaji Data Scientist di Indonesia?
Sebenernya, ketiga opsi itu nggak ada yang salah guys HEHE. Soalnya, penentuan gaji seseorang bakal dipengaruhi oleh banyak hal, meski punya titel sama sebagai ‘Data Scientist’.
Read 34 tweets

Did Thread Reader help you today?

Support us! We are indie developers!


This site is made by just two indie developers on a laptop doing marketing, support and development! Read more about the story.

Become a Premium Member ($3/month or $30/year) and get exclusive features!

Become Premium

Too expensive? Make a small donation by buying us coffee ($5) or help with server cost ($10)

Donate via Paypal Become our Patreon

Thank you for your support!

Follow Us on Twitter!