
Data adalah minyak kotoran baru 💩
Saya menemukan utas Reddit yang luar biasa. Seorang pengembang merilis aplikasi di toko dalam kategori pelacakan tubuh (mirip dengan layanan Tuute, yang dengan serius melacak kentut — ya, itu juga ada). Pengguna harus memotret, ehm, feses mereka. Aplikasi memberi mereka analitik dasar, sementara di bawah kapal semuanya disimpan ke database.
Hasilnya: pria itu memiliki dataset 150.000 foto kotoran yang diberi label dan diklasifikasikan (!) dari 25.000 pengguna unik.
Dan sekarang dia duduk di atas tumpukan ini (dalam segala arti) dan mengeluh bahwa dia tidak dapat menemukan pembeli untuk datasetnya.
Di sini perlu dipahami bahwa seluruh Reddit, Github, dan Wikipedia sudah disedot oleh raksasa. Anda tidak akan memenangkan persaingan dalam teks, kucing, atau open source. Nilai tambah nyata terletak pada ceruk yang sulit dijangkau, kotor, dan spesifik.
Dataset medis berlabel 150k gambar di bidang seperti itu adalah tambang emas. Produsen toilet pintar (yang sudah membuat kamera untuk menganalisis tinja Anda dengan cepat) atau perusahaan farmasi yang meneliti penyakit usus menghabiskan waktu bertahun-tahun dan jutaan dolar untuk pengumpulan klinis sebanyak itu.
Tapi pria itu mengumpulkan emas, tetapi tidak memikirkan cara memonetisasinya.
Bisnis besar tidak akan pernah membeli dataset dari orang tak dikenal, mereka membutuhkan kebersihan hukum. Dan menjual data biometrik/medis (bahkan yang diduga dianonimkan) yang dikumpulkan melalui perjanjian pengguna aplikasi seluler adalah tiket langsung ke pengadilan.
Satu-satunya jalan keluar yang layak baginya sekarang adalah menjual bukan datasetnya, tetapi seluruh perusahaan. Atau melatih model CV-nya sendiri dan menjual akses API ke klien B2B.
Moral: jika Anda membuat sesuatu yang kotor, pertama-tama pikirkan bagaimana Anda akan menjual kotoran itu. ☝️
Komentar
0Belum ada komentar.
Masuk untuk ikut berdiskusi.