:::: MENU ::::

Seputar Big Data Edisi #50

Kumpulan berita, artikel, tutorial dan blog mengenai Big Data yang dikutip dari berbagai site. Berikut ini beberapa hal menarik yang layak untuk dibaca kembali selama minggu pertama bulan maret 2018

Artikel dan Berita

  1. Korea to adopt AI, big data, blockchain for customs service
    Bea Cukai Korea Selatan akan mengadopsi beberapa teknologi terkini, seperti kecerdasan buatan (AI), big data dan blockchain, untuk meningkatkan kualitas pelayanan kepabeanan sebagai bentuk antisipasi atas pertumbuhan volume perdagangan dan ecommerce
  2. Cargill Offers Big Data, Digital Tools to Help Shrimp Farmers
    Cargill Inc. akan menawarkan solusi big data untuk meningkatkan produksi udang. Dengan memanfaatkan machine learning dan sensor diharapkan dapat membantu petani untuk memperoleh analisa berbagai hal mulai dari hubungan antar ukuran udang dan pola pemberian pakan hingga kualitas air dan cuaca yang dapat diakses melalui telepon genggam atau tablet.
  3. Why Is Health Care Cybersecurity So Bad? Blame the Insiders, New Verizon Report Says
    Bukan rahasia lagi bahwa bidang kesehatan sangat rentan terhadap serangan cyber bila dibandingkan dengan industri lainnya. Industri kesehatan adalah satu-satunya industri di mana aktor internal merupakan ancaman terbesar bagi sebuah organisasi.
  4. Alibaba is to Launch New A.I. and Big Data Cloud Products in Europe
    Pada MCW Barcelona 2018, Alibaba Cloud meluncurkan tiga produk utama – solusi pencarian berbasis gambar, Intelligent Services Robot dan Dataphin. Walaupun Alibaba Cloud telah memasuki pasar Eropa sejak 2016, dan telah meluncurkan produk AI, tapi hanya memfokuskan untuk melayani pelanggan China yang berbisnis di Eropa.
  5. Weighing Open Source’s Worth for the Future of Big Data
    Tidak diragukan lagi bahwa software open source menjadi motor penggerak kemajuan big data, bahkan vendor-vendor raksasa pun tidak ketinggalan menjadi penggiat dan pengguna open source. Namun bagaimana posisi software open source saat ini, termasuk dari sisi bisnis, dan bagaimana prospeknya di masa depan?
  6. Blockchains and APIs
    Kemajuan teknologi terutama yang berbasisan blockchain, memberi peluang bagi model bisnis baru, dikarenakan akan terjadi peningkatan jumlah perangkat yang terhubung dalam kehidupan kita sehari-hari. Artikel ini menjelaskan lengkap dengan contoh penerapan, bagaimana blockchain dan API membuka berbagai peluang untuk model-model bisnis baru.

Tutorial dan Pengetahuan Teknis

  1. Hortonworks DataFlow (HDF) 3.1 blog series part 5: Introducing Apache NiFi-Atlas integration
    Artikel ini menjelaskan mengenai bagaimana Hortonwork DataFlow mengintegrasikan Apache NiFi dengan Apache Atlas untuk mencatat data lineage pada Kafka, Hive, dan lain-lain.
  2. Spark Streaming Checkpointing on Kubernetes
    Sebuah job streaming Spark yang berlangsung dalam waktu lama memerlukan checkpoint, baik untuk data maupun metadata, agar dapat dilakukan recovery jika terjadi kegagalan. Artikel ini membahas mengenai konfigurasi metadata checkpoint serta beberapa setting tambahan yang diperlukan untuk menjalankan Spark di atas Kubernetes.
  3. Twitter sentiment analysis with Machine Learning in R using doc2vec approach (part 1)
    Word2vec adalah sebuah jaringan syaraf tiruan dengan 2 layer yang memproses teks. Inputnya berupa korpus teks, dan outputnya berupa sekumpulan vektor. Metode ini saat ini termasuk yang paling banyak dignakan dalam analisis sentimen. Artikel ini menguraikan dengan jelas implementasi word2vec untuk sentimen analisis Twitter menggunakan R.
  4. Understanding LSTM and its quick implementation in keras for sentiment analysis
    LSTM saat ini telah banyak digunakan untuk pengenalan suara, pemodelan bahasa, analisis sentimen dan prediksi teks. Artikel ini menjelaskan mengenai LSTM, apa kelebihannya dibanding RNN, dan bagaimana penerapannya untuk analisis sentimen dengan Keras.
  5. [DATASET] Labeled Faces in the Wild
    13.000 gambar wajah manusia yang disusun dan dilabeli, untuk digunakan dalam mengembangkan aplikasi yang melibatkan pengenalan wajah.

Rilis Produk

  1. Apache Storm 1.2.0
    Rilis 1.2.0 ini mencakup banyak perbaikan terhadap integrasi Kafka yang meningkatkan stabilitas, kemudahan konfigurasi, dan fitur-fitur baru. Dalam rilis ini juga mencakup sistem metriks yang baru untuk statistik internal dan API baru untuk user defined metrics, serta beberapa fitur lainnya yang terkait HBase, Flux maupun Kafka.
  2. Apache Flink 1.4.1
    Rilis ini merupakan bugfix pertama untuk Apache Flink seri 1.4. Mencakup lebih dari 60 perbaikan dan peningkatan minor terhadap Flink 1.4.0. Pengguna Flink 1.4.0 sangat disarankan untuk melakukan update ke versi ini.
  3. JupyterLab: Ready for Users
    JupyterLab, sebuah antarmuka berbasis web untuk Project Jupyter baru-baru ini diluncurkan versi Beta-nya. JupyterLab adalah lingkungan pengembangan interaktif untuk notebooks, code dan data. Dalam JupyterLab anda dapat menggunakan editor teks, terminal, data file viewers dan berbagai komponen custom lainnya, berdampingan dengan notebook di dalam sebuah work area.

 

Contributor :


Tim idbigdata
always connect to collaborate every innovation 🙂
Tertarik dengan Big Data beserta ekosistemnya? Gabung