2jw5U060C4 / poster_embed.html
DineshAI's picture
Add executed training and generalization evidence
6538a84 verified
Raw
History Blame Contribute Delete
2.77 kB
<!doctype html>
<html lang="en">
<head>
<meta charset="utf-8">
<meta name="viewport" content="width=device-width, initial-scale=1">
<title>K-means transformer training audit</title>
<style>
:root{--ink:#17232b;--muted:#52616b;--paper:#f4f0e7;--card:#fff;--blue:#18517c;--green:#18714c;--red:#a43d32}
*{box-sizing:border-box}body{margin:0;color:var(--ink);background:var(--paper);font-family:ui-sans-serif,system-ui,sans-serif}
main{max-width:1180px;margin:auto;padding:42px}header{border-left:8px solid var(--blue);padding-left:22px}
h1{margin:0 0 8px;font-size:clamp(2rem,5vw,4rem);line-height:1.03}h2{color:var(--blue);margin-top:0}p{line-height:1.48}.sub{color:var(--muted);font-size:1.1rem}
.grid{display:grid;grid-template-columns:1fr 1fr;gap:20px;margin:30px 0}.card{background:var(--card);border:1px solid #d7d0c4;border-radius:14px;padding:24px;box-shadow:0 8px 22px #17232b10}
.metric{font-size:2.2rem;font-weight:850;color:var(--green)}.negative{color:var(--red)}.wide{grid-column:1/-1}code{background:#edf1f3;padding:2px 5px;border-radius:4px}footer{border-top:1px solid #cbc4b7;padding-top:16px;color:var(--muted)}
@media(max-width:760px){main{padding:24px}.grid{grid-template-columns:1fr}.wide{grid-column:auto}}
</style>
</head>
<body><main>
<header><h1>Can training beat Lloyd?</h1><p class="sub">2jw5U060C4 路 three trained seeds 路 paired held-out and OOD controls</p></header>
<section class="grid">
<article class="card"><h2>Training worked</h2><div class="metric">3 / 3 seeds</div><p>Validation improved, parameters moved, and every checkpoint stayed within 2.6% of Lloyd-10.</p></article>
<article class="card"><h2>Held-out superiority</h2><div class="metric negative">Not detected</div><p>Normalized costs: trained <code>0.64676</code>, Lloyd-10 <code>0.64306</code>; paired CI crosses zero.</p></article>
<article class="card"><h2>OOD generalization</h2><div class="metric negative">Significantly worse</div><p>Trained <code>1.03585</code> vs Lloyd-10 <code>1.01574</code>; 95% CI <code>[0.01119, 0.03040]</code>.</p></article>
<article class="card"><h2>Paper source</h2><div class="metric">Question left open</div><p>The paper uses chosen parameters without training and expressly leaves learnability to future work.</p></article>
<article class="card wide"><h2>Bounded conclusion</h2><p>The challenge claim is falsified in this executed protocol: successful optimization does not produce superior clustering or OOD generalization. This does not prove impossibility for every conceivable learning environment.</p></article>
</section><footer>C1 preserved at 10,000-point paper scale 路 C2: 200 ID + 100 OOD tasks 路 14/14 tests pass 路 no paid compute</footer>
</main></body></html>