all problems

Skip rate per user PRO

pandashardtransformgroupby

The full problem statement is available to Pro members.

preloaded fixtures

import pandas as pd
import numpy as np

plays = pd.DataFrame({
    "play_id": range(1, 13),
    "user": ["u1", "u1", "u2", "u2", "u3", "u1", "u4", "u2", "u3", "u1", "u2", "u4"],
    "artist": ["Nova Wave", "Nova Wave", "Nova Wave", "Maren Cruz", "The Quiet Hours", "Nova Wave",
               "Maren Cruz", "Basement Theory", "The Quiet Hours", "Maren Cruz", "Nova Wave", "Nova Wave"],
    "played_on": pd.to_datetime(["2024-01-05", "2024-01-05", "2024-01-06", "2024-01-06", "2024-01-07",
                                  "2024-01-08", "2024-01-09", "2024-01-10", "2024-01-11", "2024-02-01",
                                  "2024-02-02", "2024-02-03"]),
    "ms_played": [215000, 50000, 200000, 196000, 240000, 215000, 100000, 178000, 300000, 196000, 215000, 215000],
})

This is a Pro problem

“Skip rate per user” is part of the Pro problem set. Upgrade to unlock the harder half of every track — SQL, Python and pandas.

Upgrade to Pro

The first problems in each track stay free.