{"abstract":"Each term is scaled by 1/beta_B instead of 1/(beta_B + i).","category":"Experiment statistics","checks":8,"contract":"With an integer Beta(prior_a, prior_b) prior, arm posteriors are Beta(prior_a + s, prior_b + n - s). P(B > A) uses the exact integer-parameter sum over i < alpha_B of exp(lnB(alpha_A + i, beta_A + beta_B) - ln(beta_B + i) - lnB(1 + i, beta_B) - lnB(alpha_A, beta_A)). Return [posterior mean A, posterior mean B, P(B > A)] rounded to 6.","evaluation_group":"w2-experiment-statistics-beta-binomial","failed_approach":"Using the control beta in the denominator mixes arms.","family":"w2-experiment-statistics-beta-binomial-log-denominator","id":"FA-74601","implementations":{"attempt":{"sha256":"547bff14615454e4f4f629707a63ba0266b2daab41de74a5c86e97c265906b3c","source":"\"\"\"Failure Map reference implementation. Python standard library only.\"\"\"\nimport json\nimport math\nN = 1\nobservations = []\ndef solve(a_succ, a_n, b_succ, b_n, prior_a, prior_b):\n    aa, ba = prior_a + a_succ, prior_b + a_n - a_succ\n    ab, bb = prior_a + b_succ, prior_b + b_n - b_succ\n    def lbeta(x, y):\n        return math.lgamma(x) + math.lgamma(y) - math.lgamma(x + y)\n    total = 0.0\n    for i in range(ab):\n        total += math.exp(lbeta(aa + i, ba + bb) - math.log(ba + i) - lbeta(1 + i, bb) - lbeta(aa, ba))\n    return [round(aa / (aa + ba), 6), round(ab / (ab + bb), 6), round(total, 6)]\ndef check(label, actual, expected):\n    observations.append({\"check\": label, \"actual\": actual, \"expected\": expected, \"passed\": actual == expected})\nfixtures = [[('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 1', [7, 20, 5, 10, 3, 5], [0.357143, 0.444444, 0.724072]),\n  ('posterior sample 2', [4, 40, 10, 10, 1, 1], [0.119048, 0.916667, 1.0])],\n [('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 3', [8, 10, 23, 40, 1, 5], [0.5625, 0.521739, 0.384139]),\n  ('posterior sample 6', [13, 20, 0, 10, 2, 2], [0.625, 0.142857, 0.000906]),\n  ('posterior sample 7', [2, 5, 2, 5, 2, 1], [0.5, 0.5, 0.5])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 10', [4, 5, 2, 10, 1, 1], [0.714286, 0.25, 0.017534]),\n  ('posterior sample 11', [5, 5, 30, 40, 1, 1], [0.857143, 0.738095, 0.1814]),\n  ('posterior sample 12', [16, 20, 9, 20, 2, 1], [0.782609, 0.478261, 0.013376])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 16', [7, 10, 1, 20, 1, 2], [0.615385, 0.086957, 0.000212]),\n  ('posterior sample 17', [9, 10, 8, 10, 1, 2], [0.769231, 0.692308, 0.320203]),\n  ('posterior sample 19', [12, 40, 7, 40, 1, 1], [0.309524, 0.190476, 0.098949])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 21', [6, 10, 16, 40, 1, 1], [0.583333, 0.404762, 0.132122]),\n  ('posterior sample 26', [4, 5, 16, 40, 1, 1], [0.714286, 0.404762, 0.054327]),\n  ('posterior sample 28', [0, 5, 4, 5, 3, 1], [0.333333, 0.777778, 0.97972])]]\nfor label, args, expected in fixtures[N - 1]:\n    check(label, solve(*args), expected)\nprint(json.dumps({\"observations\": observations, \"passed\": all(x[\"passed\"] for x in observations)}, ensure_ascii=False))\nraise SystemExit(0 if all(x[\"passed\"] for x in observations) else 1)\n"},"broken":{"sha256":"047346671d8ab38a663499d3461cfbb9fc37448062361da747dec4793146a3f5","source":"\"\"\"Failure Map reference implementation. Python standard library only.\"\"\"\nimport json\nimport math\nN = 1\nobservations = []\ndef solve(a_succ, a_n, b_succ, b_n, prior_a, prior_b):\n    aa, ba = prior_a + a_succ, prior_b + a_n - a_succ\n    ab, bb = prior_a + b_succ, prior_b + b_n - b_succ\n    def lbeta(x, y):\n        return math.lgamma(x) + math.lgamma(y) - math.lgamma(x + y)\n    total = 0.0\n    for i in range(ab):\n        total += math.exp(lbeta(aa + i, ba + bb) - math.log(bb) - lbeta(1 + i, bb) - lbeta(aa, ba))\n    return [round(aa / (aa + ba), 6), round(ab / (ab + bb), 6), round(total, 6)]\ndef check(label, actual, expected):\n    observations.append({\"check\": label, \"actual\": actual, \"expected\": expected, \"passed\": actual == expected})\nfixtures = [[('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 1', [7, 20, 5, 10, 3, 5], [0.357143, 0.444444, 0.724072]),\n  ('posterior sample 2', [4, 40, 10, 10, 1, 1], [0.119048, 0.916667, 1.0])],\n [('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 3', [8, 10, 23, 40, 1, 5], [0.5625, 0.521739, 0.384139]),\n  ('posterior sample 6', [13, 20, 0, 10, 2, 2], [0.625, 0.142857, 0.000906]),\n  ('posterior sample 7', [2, 5, 2, 5, 2, 1], [0.5, 0.5, 0.5])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 10', [4, 5, 2, 10, 1, 1], [0.714286, 0.25, 0.017534]),\n  ('posterior sample 11', [5, 5, 30, 40, 1, 1], [0.857143, 0.738095, 0.1814]),\n  ('posterior sample 12', [16, 20, 9, 20, 2, 1], [0.782609, 0.478261, 0.013376])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 16', [7, 10, 1, 20, 1, 2], [0.615385, 0.086957, 0.000212]),\n  ('posterior sample 17', [9, 10, 8, 10, 1, 2], [0.769231, 0.692308, 0.320203]),\n  ('posterior sample 19', [12, 40, 7, 40, 1, 1], [0.309524, 0.190476, 0.098949])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 21', [6, 10, 16, 40, 1, 1], [0.583333, 0.404762, 0.132122]),\n  ('posterior sample 26', [4, 5, 16, 40, 1, 1], [0.714286, 0.404762, 0.054327]),\n  ('posterior sample 28', [0, 5, 4, 5, 3, 1], [0.333333, 0.777778, 0.97972])]]\nfor label, args, expected in fixtures[N - 1]:\n    check(label, solve(*args), expected)\nprint(json.dumps({\"observations\": observations, \"passed\": all(x[\"passed\"] for x in observations)}, ensure_ascii=False))\nraise SystemExit(0 if all(x[\"passed\"] for x in observations) else 1)\n"},"fixed":{"sha256":"0f839c4ba0e6aeaafe3803437d4b1a0969d8745db69ac0fac33b398d9efe1eb1","source":"\"\"\"Failure Map reference implementation. Python standard library only.\"\"\"\nimport json\nimport math\nN = 1\nobservations = []\ndef solve(a_succ, a_n, b_succ, b_n, prior_a, prior_b):\n    aa, ba = prior_a + a_succ, prior_b + a_n - a_succ\n    ab, bb = prior_a + b_succ, prior_b + b_n - b_succ\n    def lbeta(x, y):\n        return math.lgamma(x) + math.lgamma(y) - math.lgamma(x + y)\n    total = 0.0\n    for i in range(ab):\n        total += math.exp(lbeta(aa + i, ba + bb) - math.log(bb + i) - lbeta(1 + i, bb) - lbeta(aa, ba))\n    return [round(aa / (aa + ba), 6), round(ab / (ab + bb), 6), round(total, 6)]\ndef check(label, actual, expected):\n    observations.append({\"check\": label, \"actual\": actual, \"expected\": expected, \"passed\": actual == expected})\nfixtures = [[('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 1', [7, 20, 5, 10, 3, 5], [0.357143, 0.444444, 0.724072]),\n  ('posterior sample 2', [4, 40, 10, 10, 1, 1], [0.119048, 0.916667, 1.0])],\n [('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 3', [8, 10, 23, 40, 1, 5], [0.5625, 0.521739, 0.384139]),\n  ('posterior sample 6', [13, 20, 0, 10, 2, 2], [0.625, 0.142857, 0.000906]),\n  ('posterior sample 7', [2, 5, 2, 5, 2, 1], [0.5, 0.5, 0.5])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 10', [4, 5, 2, 10, 1, 1], [0.714286, 0.25, 0.017534]),\n  ('posterior sample 11', [5, 5, 30, 40, 1, 1], [0.857143, 0.738095, 0.1814]),\n  ('posterior sample 12', [16, 20, 9, 20, 2, 1], [0.782609, 0.478261, 0.013376])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('treatment clearly worse', [15, 20, 3, 20, 1, 1], [0.727273, 0.181818, 6.3e-05]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 16', [7, 10, 1, 20, 1, 2], [0.615385, 0.086957, 0.000212]),\n  ('posterior sample 17', [9, 10, 8, 10, 1, 2], [0.769231, 0.692308, 0.320203]),\n  ('posterior sample 19', [12, 40, 7, 40, 1, 1], [0.309524, 0.190476, 0.098949])],\n [('uniform prior small counts', [3, 10, 6, 10, 1, 1], [0.333333, 0.583333, 0.90081]),\n  ('informative prior shifts means', [0, 5, 1, 5, 2, 5], [0.166667, 0.25, 0.706767]),\n  ('equal data gives one half', [4, 10, 4, 10, 1, 1], [0.416667, 0.416667, 0.5]),\n  ('zero successes in treatment', [2, 10, 0, 10, 1, 1], [0.25, 0.083333, 0.107143]),\n  ('unequal sample sizes', [5, 40, 3, 10, 1, 2], [0.139535, 0.307692, 0.902022]),\n  ('posterior sample 21', [6, 10, 16, 40, 1, 1], [0.583333, 0.404762, 0.132122]),\n  ('posterior sample 26', [4, 5, 16, 40, 1, 1], [0.714286, 0.404762, 0.054327]),\n  ('posterior sample 28', [0, 5, 4, 5, 3, 1], [0.333333, 0.777778, 0.97972])]]\nfor label, args, expected in fixtures[N - 1]:\n    check(label, solve(*args), expected)\nprint(json.dumps({\"observations\": observations, \"passed\": all(x[\"passed\"] for x in observations)}, ensure_ascii=False))\nraise SystemExit(0 if all(x[\"passed\"] for x in observations) else 1)\n"}},"limitations":"A deterministic toy experiment-analysis model with a stipulated contract; results are rounded and are not a substitute for a validated statistics package. This reproducer isolates one failure mechanism. Results cover the supplied fixtures. Variants within a family share a test contract and should remain grouped when constructing evaluation splits. Related mechanisms with a shared evaluation_group must also remain together; these controlled models are not independent production incidents.","method":"Deterministic executable model with adversarial boundary fixtures.","provenance":{"created_by":"Failure Map","dependencies":"Python standard library","family":"w2-experiment-statistics-beta-binomial-log-denominator","generated_at":"2026-09-29T14:48:58.352682+00:00","license":"CC0-1.0","python":"3.12.14","seed":1,"split":"open-access"},"relevance":"Bayesian dashboards report a \"chance to beat control\" that product teams act on directly.","repair":"Use ln(beta_B + i) in every term.","root_cause":"The log term is ln(beta_B) rather than ln(beta_B + i).","sha256":"24fed451ac50e67643e24c0bddd7bb2e3f718ba63833ad554bd9233aed713f65","title":"Bayesian conversion comparison: The per-term denominator drops the index · case 01","variant":1,"variant_policy":"Five numbered records share a model and may reuse boundary fixtures.","verification":{"attempt":{"elapsed_ms":42.543,"exit_code":1,"observations":[{"actual":[0.333333,0.583333,0.626041],"check":"uniform prior small counts","expected":[0.333333,0.583333,0.90081],"passed":false},{"actual":[0.166667,0.25,0.641165],"check":"informative prior shifts means","expected":[0.166667,0.25,0.706767],"passed":false},{"actual":[0.416667,0.416667,0.5],"check":"equal data gives one half","expected":[0.416667,0.416667,0.5],"passed":true},{"actual":[0.727273,0.181818,0.000152],"check":"treatment clearly worse","expected":[0.727273,0.181818,6.3e-05],"passed":false},{"actual":[0.25,0.083333,0.130952],"check":"zero successes in treatment","expected":[0.25,0.083333,0.107143],"passed":false},{"actual":[0.139535,0.307692,0.239345],"check":"unequal sample sizes","expected":[0.139535,0.307692,0.902022],"passed":false},{"actual":[0.357143,0.444444,0.457936],"check":"posterior sample 1","expected":[0.357143,0.444444,0.724072],"passed":false},{"actual":[0.119048,0.916667,0.030552],"check":"posterior sample 2","expected":[0.119048,0.916667,1.0],"passed":false}],"passed":false,"stderr":"","stdout":"{\"observations\": [{\"check\": \"uniform prior small counts\", \"actual\": [0.333333, 0.583333, 0.626041], \"expected\": [0.333333, 0.583333, 0.90081], \"passed\": false}, {\"check\": \"informative prior shifts means\", \"actual\": [0.166667, 0.25, 0.641165], \"expected\": [0.166667, 0.25, 0.706767], \"passed\": false}, {\"check\": \"equal data gives one half\", \"actual\": [0.416667, 0.416667, 0.5], \"expected\": [0.416667, 0.416667, 0.5], \"passed\": true}, {\"check\": \"treatment clearly worse\", \"actual\": [0.727273, 0.181818, 0.000152], \"expected\": [0.727273, 0.181818, 6.3e-05], \"passed\": false}, {\"check\": \"zero successes in treatment\", \"actual\": [0.25, 0.083333, 0.130952], \"expected\": [0.25, 0.083333, 0.107143], \"passed\": false}, {\"check\": \"unequal sample sizes\", \"actual\": [0.139535, 0.307692, 0.239345], \"expected\": [0.139535, 0.307692, 0.902022], \"passed\": false}, {\"check\": \"posterior sample 1\", \"actual\": [0.357143, 0.444444, 0.457936], \"expected\": [0.357143, 0.444444, 0.724072], \"passed\": false}, {\"check\": \"posterior sample 2\", \"actual\": [0.119048, 0.916667, 0.030552], \"expected\": [0.119048, 0.916667, 1.0], \"passed\": false}], \"passed\": false}\n"},"broken":{"elapsed_ms":40.845,"exit_code":1,"observations":[{"actual":[0.333333,0.583333,1.280832],"check":"uniform prior small counts","expected":[0.333333,0.583333,0.90081],"passed":false},{"actual":[0.166667,0.25,0.77193],"check":"informative prior shifts means","expected":[0.166667,0.25,0.706767],"passed":false},{"actual":[0.416667,0.416667,0.661249],"check":"equal data gives one half","expected":[0.416667,0.416667,0.5],"passed":false},{"actual":[0.727273,0.181818,7.3e-05],"check":"treatment clearly worse","expected":[0.727273,0.181818,6.3e-05],"passed":false},{"actual":[0.25,0.083333,0.107143],"check":"zero successes in treatment","expected":[0.25,0.083333,0.107143],"passed":true},{"actual":[0.139535,0.307692,1.01619],"check":"unequal sample sizes","expected":[0.139535,0.307692,0.902022],"passed":false},{"actual":[0.357143,0.444444,1.009383],"check":"posterior sample 1","expected":[0.357143,0.444444,0.724072],"passed":false},{"actual":[0.119048,0.916667,1.138889],"check":"posterior sample 2","expected":[0.119048,0.916667,1.0],"passed":false}],"passed":false,"stderr":"","stdout":"{\"observations\": [{\"check\": \"uniform prior small counts\", \"actual\": [0.333333, 0.583333, 1.280832], \"expected\": [0.333333, 0.583333, 0.90081], \"passed\": false}, {\"check\": \"informative prior shifts means\", \"actual\": [0.166667, 0.25, 0.77193], \"expected\": [0.166667, 0.25, 0.706767], \"passed\": false}, {\"check\": \"equal data gives one half\", \"actual\": [0.416667, 0.416667, 0.661249], \"expected\": [0.416667, 0.416667, 0.5], \"passed\": false}, {\"check\": \"treatment clearly worse\", \"actual\": [0.727273, 0.181818, 7.3e-05], \"expected\": [0.727273, 0.181818, 6.3e-05], \"passed\": false}, {\"check\": \"zero successes in treatment\", \"actual\": [0.25, 0.083333, 0.107143], \"expected\": [0.25, 0.083333, 0.107143], \"passed\": true}, {\"check\": \"unequal sample sizes\", \"actual\": [0.139535, 0.307692, 1.01619], \"expected\": [0.139535, 0.307692, 0.902022], \"passed\": false}, {\"check\": \"posterior sample 1\", \"actual\": [0.357143, 0.444444, 1.009383], \"expected\": [0.357143, 0.444444, 0.724072], \"passed\": false}, {\"check\": \"posterior sample 2\", \"actual\": [0.119048, 0.916667, 1.138889], \"expected\": [0.119048, 0.916667, 1.0], \"passed\": false}], \"passed\": false}\n"},"fixed":{"elapsed_ms":37.895,"exit_code":0,"observations":[{"actual":[0.333333,0.583333,0.90081],"check":"uniform prior small counts","expected":[0.333333,0.583333,0.90081],"passed":true},{"actual":[0.166667,0.25,0.706767],"check":"informative prior shifts means","expected":[0.166667,0.25,0.706767],"passed":true},{"actual":[0.416667,0.416667,0.5],"check":"equal data gives one half","expected":[0.416667,0.416667,0.5],"passed":true},{"actual":[0.727273,0.181818,6.3e-05],"check":"treatment clearly worse","expected":[0.727273,0.181818,6.3e-05],"passed":true},{"actual":[0.25,0.083333,0.107143],"check":"zero successes in treatment","expected":[0.25,0.083333,0.107143],"passed":true},{"actual":[0.139535,0.307692,0.902022],"check":"unequal sample sizes","expected":[0.139535,0.307692,0.902022],"passed":true},{"actual":[0.357143,0.444444,0.724072],"check":"posterior sample 1","expected":[0.357143,0.444444,0.724072],"passed":true},{"actual":[0.119048,0.916667,1.0],"check":"posterior sample 2","expected":[0.119048,0.916667,1.0],"passed":true}],"passed":true,"stderr":"","stdout":"{\"observations\": [{\"check\": \"uniform prior small counts\", \"actual\": [0.333333, 0.583333, 0.90081], \"expected\": [0.333333, 0.583333, 0.90081], \"passed\": true}, {\"check\": \"informative prior shifts means\", \"actual\": [0.166667, 0.25, 0.706767], \"expected\": [0.166667, 0.25, 0.706767], \"passed\": true}, {\"check\": \"equal data gives one half\", \"actual\": [0.416667, 0.416667, 0.5], \"expected\": [0.416667, 0.416667, 0.5], \"passed\": true}, {\"check\": \"treatment clearly worse\", \"actual\": [0.727273, 0.181818, 6.3e-05], \"expected\": [0.727273, 0.181818, 6.3e-05], \"passed\": true}, {\"check\": \"zero successes in treatment\", \"actual\": [0.25, 0.083333, 0.107143], \"expected\": [0.25, 0.083333, 0.107143], \"passed\": true}, {\"check\": \"unequal sample sizes\", \"actual\": [0.139535, 0.307692, 0.902022], \"expected\": [0.139535, 0.307692, 0.902022], \"passed\": true}, {\"check\": \"posterior sample 1\", \"actual\": [0.357143, 0.444444, 0.724072], \"expected\": [0.357143, 0.444444, 0.724072], \"passed\": true}, {\"check\": \"posterior sample 2\", \"actual\": [0.119048, 0.916667, 1.0], \"expected\": [0.119048, 0.916667, 1.0], \"passed\": true}], \"passed\": true}\n"}},"verified":true,"visibility":"public"}