Edukaizen

Menu
  • Home
  • Hubbard 1D
    • Part 1: 1D Hubbard model
    • Part 2: Snake layout and fSWAP
    • Part 3: Qiskit and Fire Opal
    • Part 4: 120-qubit run
    • Part 5: Time-to-answer
    • Part 6: Tensor networks
    • Part 7: Majorana propagation
    • Part 8: Heatmaps
    • Part 9: 2D Hubbard outlook
  • Hubbard 2D
    • Part 1: 1D to 2D
    • Part 2: Cuprates
    • Part 3: 3×3
    • Part 4: Time
    • Part 5: 4×4
    • Part 6: 6×6 Fez
  • Hadron
    • Deel 1: Hadron op quantumprocessor
    • Deel 2: Quarks en confinement
    • Deel 3: SU(2) en LSH
    • Deel 4: Hamiltoniaan en circuit
    • Deel 5: Fire Opal
    • Deel 6: Klassieke simulaties
    • Deel 7: Quantumvoordeel
  • Black Hole OLE
    • Part 1: What we ran
    • Part 2: How OLE works
    • Part 3: Fire Opal and Kingston
    • Part 4: The tensor-network challenge
    • Part 5: Hawking and scrambling
    • Part 6: What the result proves
  • Random Graph
    • Part 1: Theory
    • Part 2: Circuit
    • Part 3: Qiskit
    • Part 4: Complexity
    • Part 5: Verification
    • Part 6: Workflow
    • Part 7: Conclusion
  • QOS QML
    • Nederlands
    • English
  • Advantage List
Menu

405 observabelen en een lekvrije classifier

Nederlands | English | Projectpagina | Vorig deel | Volgend deel | QOS paper | Officiële code | Hardwarecode

Een hardware-experiment wordt pas een machine-learningexperiment wanneer vooraf duidelijk is welke data voor training, modelkeuze en toetsing worden gebruikt. Met slechts 32 trainings- en 32 testcellen kan één onzorgvuldige keuze de score sterk vertekenen.

De quantumprocessor levert features, geen eindlabel

Voor iedere cel berekenen we uit de X-, Y- en Z-metingen 405 verwachtingswaarden. Een enkele feature heeft de vorm:

\[
\langle P_i \rangle \quad\text{of}\quad \langle P_iP_j \rangle,
\]

waar \(P\) een X-, Y- of Z-Paulioperator is. De verzameling beschrijft lokale qubittoestanden en geselecteerde correlaties. Het hardwaredeel eindigt bij deze featurevector.

Daarna start een gewone supervised classifier. Dat is belangrijk voor de interpretatie: de voorspelling komt uit de combinatie van quantumfeaturemap en klassiek beslismodel. Een verschil met een klassieke baseline kan aan beide onderdelen liggen.

Het vooraf vastgelegde protocol

Voor de hardware-uitkomst werd de analyse als volgt vastgelegd:

  • primaire maat: balanced accuracy op de vaste testset;
  • modelkeuze: vier-fold gestratificeerde cross-validatie;
  • CV-seed: 6011;
  • modelkeuze uitsluitend op 32 trainingsrijen;
  • testset één keer gebruiken nadat de winnaar vaststaat;
  • klassieke frontier opnieuw berekenen op exact dezelfde 32/32-split.

De selectorfunctie in de code heeft opzettelijk geen testargument. Daardoor kan zij technisch geen testfeatures of testlabels gebruiken. Een unit test controleert die grens.

Welke modellen zijn geprobeerd?

Op de 405 hardwarefeatures vergeleken we binnen de training:

  • ridge-classificatie;
  • logistische regressie met L2-regularisatie;
  • lineaire support-vectorclassificatie;
  • RBF-support-vectorclassificatie.

Regelsterktes en enkele RBF-gammawaarden vormden een bescheiden grid. Iedere standaardisatie werd opnieuw binnen de betreffende CV-fold geleerd. De selectie rangschikte eerst de gemiddelde balanced accuracy, daarna de slechtste fold, de spreiding en ten slotte eenvoud.

De winnaar was een RBF-SVC met C=1 en gamma=0.01. De fold-scores waren 0,625; 0,375; 0,750 en 0,625. Het gemiddelde was 0,59375, maar de standaardafwijking 0,136 en de slechtste fold 0,375 laten zien dat het signaal instabiel was.

Waarom balanced accuracy?

De volledige kandidaatpopulatie bevat meer regulatoire dan geheugencellen. De pilot-split is wel exact gebalanceerd. Balanced accuracy berekent eerst de gevoeligheid per klasse en neemt daarna het gemiddelde:

\[
\operatorname{BA}=\frac{1}{2}(\operatorname{TPR}+\operatorname{TNR}).
\]

Op onze gebalanceerde testset is dat numeriek gelijk aan gewone accuracy, maar de definitie blijft bruikbaar wanneer toekomstige splits niet perfect gelijk zijn.

De klassieke frontier

Een quantumroute mag niet alleen tegen een zwak model op dezelfde gecomprimeerde input worden vergeleken. Daarom gebruikten we twee klassieke representaties:

  1. alle 32.738 ruwe genen, per cel genormaliseerd naar een library size van 10.000 en daarna log1p;
  2. exact dezelfde vier gehashte B=4-blokken, platgemaakt tot 160 klassieke features.

Ook hier gebeurde modelkeuze uitsluitend via training-CV. De klassieke winnaar werd logistische regressie op de raw-gene log1p-matrix met C=0.01. Daarmee krijgt klassiek toegang tot informatie die door de top-48- en hashstappen aan de quantumkant kan zijn verwijderd. Dat is streng, maar relevant: een praktische voordeelclaim moet concurreren met de beste redelijke klassieke route naar dezelfde biologische voorspelling.

Overfitting zichtbaar maken

Na fitten op alle 32 trainingscellen haalden zowel de gekozen hardwareclassifier als het klassieke model een trainingsscore van 1,0. Beide konden de kleine training dus volledig scheiden. Hun CV-scores waren veel lager, en de vaste test nog lager.

Dat verschil is geen detail maar de hoofdles. Een model kan een indrukwekkende geometrie in zijn trainingsfeatures vinden en toch geen stabiele regel voor nieuwe cellen hebben. Dit sluit aan bij bredere QML-literatuur: expressiviteit en trainbaarheid garanderen geen generalisatie.

Wat de onzekerheidsanalyse wel meet

We vergelijken de twee voorspellers paarsgewijs op dezelfde 32 testcellen. Een exacte McNemar-test kijkt naar cellen waarop slechts één van beide modellen correct is. Daarnaast resamplen we binnen iedere klasse 10.000 keer de testcellen om een interval voor het accuracyverschil te krijgen.

Die bootstrap meet onzekerheid door de kleine teststeekproef. Zij omvat niet:

  • een nieuwe hardwaremeting met onafhankelijke shots;
  • calibratiedrift op een andere dag;
  • een nieuwe train/testsplit;
  • onzekerheid door het kiezen van de modelgrid;
  • biologische variatie tussen donoren.

In deel 6 openen we de vaste testscore en bespreken we wat 16 tegen 17 werkelijk betekent.

Bronnen

  • Lokale hardwareanalyse met training-only selectie
  • QOS-paper: LS-SVM-classificatietaak
Nederlands | English | Projectpagina | Vorig deel | Volgend deel | QOS paper | Officiële code | Hardwarecode

Recent Posts

  • Black Hole OLE, part 6: what the result proves and what comes next
  • Black Hole OLE, part 5: Hawking, black holes, and scrambling
  • Black Hole OLE, part 4: the tensor-network challenge
  • Black Hole OLE, part 3: Fire Opal on IBM Kingston
  • Black Hole OLE, part 2: how an Operator Loschmidt Echo works

Recent Comments

No comments to show.

Archives

  • July 2026
  • May 2026
  • March 2026
  • February 2026
  • September 2024

Categories

  • 10
  • Quantum Computing
  • Uncategorized
©2026 Edukaizen | Theme by SuperbThemes