HN user

datascientist

839 karma
Posts129
Comments15
View on HN
radar.oreilly.com 10y ago

Kudu, distributed systems, and more: a conversation with Todd Lipcon

datascientist
3pts0
www.oreilly.com 10y ago

Specialized and hybrid data management and processing engines

datascientist
1pts0
www.oreilly.com 10y ago

Todd Lipcon's Strata-NYC-2015 Talk on Kudu

datascientist
1pts0
radar.oreilly.com 10y ago

Bounded and unbounded data processing and analytics

datascientist
3pts0
radar.oreilly.com 10y ago

Hadoop co-founder Mike Cafarella: “the Pete Best of big data”

datascientist
4pts0
radar.oreilly.com 10y ago

Celebrating the real-time processing and analytics revival

datascientist
2pts0
radar.oreilly.com 10y ago

Bridging the divide: Business users and machine learning experts

datascientist
1pts0
radar.oreilly.com 10y ago

The (data) science of sports – a conversation with David Epstein

datascientist
2pts0
radar.oreilly.com 10y ago

The world beyond batch: Streaming 101

datascientist
3pts0
radar.oreilly.com 10y ago

Understanding neural function and virtual reality

datascientist
1pts0
radar.oreilly.com 11y ago

6 reasons why I like KeystoneML

datascientist
1pts0
radar.oreilly.com 11y ago

Why data preparation frameworks rely on human-in-the-loop systems

datascientist
11pts1
radar.oreilly.com 11y ago

Building self-service tools to monitor high-volume time-series data

datascientist
2pts0
radar.oreilly.com 11y ago

NBA (basketball) and spatio-temporal pattern recognition

datascientist
1pts0
radar.oreilly.com 11y ago

Patrick Wendell on the state of the Spark ecosystem

datascientist
8pts0
databricks.com 11y ago

Statistical and Mathematical Functions with DataFrames in Spark

datascientist
7pts0
databricks.com 11y ago

Tuning Java Garbage Collection for Spark Applications

datascientist
43pts3
radar.oreilly.com 11y ago

Data science makes an impact on Wall Street

datascientist
1pts0
radar.oreilly.com 11y ago

The tensor renaissance in data science

datascientist
85pts46
radar.oreilly.com 11y ago

More tools for managing and reproducing complex data projects

datascientist
1pts0
radar.oreilly.com 11y ago

Michael Stack on HBase past, present, and future

datascientist
1pts0
databricks.com 11y ago

Deep Dive into Apache Spark SQL’s Catalyst Optimizer

datascientist
21pts0
radar.oreilly.com 11y ago

Building big data systems in academia and industry

datascientist
3pts0
radar.oreilly.com 11y ago

A real-time processing and analytics revival

datascientist
9pts0
radar.oreilly.com 11y ago

Let’s build open source tensor libraries for data science

datascientist
2pts0
radar.oreilly.com 11y ago

Turning Ph.D.s into industrial data scientists and data engineers

datascientist
2pts0
radar.oreilly.com 11y ago

David Blei on Topic Models (past, present, future)

datascientist
4pts1
radar.oreilly.com 11y ago

Recent performance improvements in Apache Spark

datascientist
2pts0
radar.oreilly.com 11y ago

Forecasting events, from disease outbreaks to sales to cancer research

datascientist
1pts0
radar.oreilly.com 11y ago

A tale of two clusters: Mesos and YARN

datascientist
15pts2