{"slug":"rampstackco-experimentation-analytics","source_name":"rampstackco/experimentation-analytics","name":"Rampstackco/Experimentation Analytics","description":"How to read experiment results without fooling yourself. Confidence intervals, p-values, multiple testing, sequential testing, CUPED, heterogeneous treatment effects, ratio metrics, network effects, dashboard reconciliation, and the interpretation failures that produce confidently wrong shipping decisions.","version":1,"lift":{"pass_rate_delta_pts":13.04,"pass_rate_pct":87,"total_cases":23,"passed_cases":20,"tokens_delta_pct":314.6,"turns_delta_pct":0,"verdict":"mixed","benchmark_model":"gemini-3.6-flash","grading_method":"judged","completed_at":"2026-08-20T00:21:41.406785+00:00"},"skill_score":null,"benchmark_models":[{"model":"gemini-3.6-flash","headline":true,"delta_pts":13.04,"with_pass_pct":87,"without_pass_pct":73.9,"tokens_delta_pct":314.6,"turns_delta_pct":0,"total_cases":23,"cases_aggregated":23,"verdict":"mixed","never_hurt":true,"completed_at":"2026-08-20T00:21:41.406785+00:00","run_id":"7bcb0adf-3e20-4ba7-b8c4-f7e603575bc7","version_number":1,"is_latest_version":true,"gate":null}],"trust":{"skill_safety":"passed","safety_status":"clean","intent_verdict":"safe","content_status":"clean","indexable":true},"license":"MIT","install_count":0,"manifest_hash":"73b4218c4dda7d69325c8871ae9036efd9fed317664bb8b2c9e7516f33dbb902","raw_url":"https://app.decimal.ai/s/rampstackco-experimentation-analytics/SKILL.md","scorecard_url":"https://app.decimal.ai/skills/rampstackco-experimentation-analytics"}