| Age | Commit message (Collapse) | Author |
|
D2, D3), tests, and jobs/e8.csv
|
|
- _compute_sieve_rank: find LARGEST k (not smallest) whose signature
contains all error preds — fixes P5(4) vs P5(1) bug
- _sieve_rank_signature: iterate all small_primes (not just p²≤n) to
catch composites like 209=11*19 where 11²>209
- Test expectations updated for [101,200] range (209 outside it)
- is_prime task: P1→P3 (no sieve-rank for classification tasks)
48/48 green.
|
|
- probe_report: dynamic lo/hi (no more hardcoded [101,200])
- main(): probe range derived from range_end ([range_end+1, range_end+1000])
- P6 = exact (no probe misses), P5(k) = errors match rank-k sieve signature
- _sieve_rank_signature: computes composites with all factors > p_k
- _compute_sieve_rank: identifies rank from model's error predictions
- build_report.py: probe_fig uses sieve rank for coloring
- Tests updated for P5/P6 codes (48/48 green)
|
|
reduce-overhead mode
|
|
to 100k (48 tests green)
|
|
functional regression test; D2 scored (int tokens collapse task: O2, 0-13% vs digits 17-87%); NOTES + report Phase 4 updated; 42 tests
|
|
Addendum 5 locked; 11-job batch
|
|
(2-way parallel, idempotent, summaries), E1 jobs; 36 tests
|
|
regression suite (10 tests, stub ground truth); 34 tests green
|
|
integers EOS alias, rerun guard, eval prereg-literal codes + dual-checkpoint honesty; +7 regression tests
|
|
test; design: prior art + review
|
|
baseline, train/eval/plot, 16 tests
|