Hylaean

Standortanalyse

Wo Hylaean heute steht

Eine kurze Bestandsaufnahme in einfacher Sprache: was hier gebaut wird, woran Fortschritt gemessen wird, was heute wirklich steht und woran gerade gearbeitet wird. Jede Zahl auf dieser Seite stammt aus einem versiegelten Messlauf oder aus der Verifikationsregistry des Projekts.

Stand: Montag, 17. August 2026 Form: redaktionelle Momentaufnahme Für: Leserinnen und Leser ohne Fachhintergrund

Diese Seite ist von Hand geschrieben und friert einen Tag ein. Gelesen wurde der Stand des Progress Bündels vom 17. August 2026 um 11:32 Uhr (MESZ). Die maschinell gepflegte Quelle der Wahrheit ist die Progress Ansicht auf der Statusseite. Dort wird jeder Wert beim Bauen der Seite aus einem eingecheckten Laufartefakt aufgelöst und bewegt sich mit jeder Landung. Wenn beide Seiten auseinandergehen, gilt die Statusseite.

Dieselbe Standortanalyse gibt es fortlaufend aktualisiert und auf Englisch als Big Picture Reiter der Statusseite. Dort werden alle Zahlen und datierten Aussagen beim Bauen aus den generierten Bündeln aufgelöst; nur die erklärenden Absätze stehen fest. Wer den heutigen Stand lesen will, ist hier richtig; wer den aktuellen Stand braucht, folgt dem Reiter.

01 · Der Gegenstand

Was Hylaean ist

Drei Absätze, bevor die erste Zahl fällt.

Hylaean ist ein Forschungsprojekt für eine Intelligenz, die wie ein physikalisches Material funktioniert und nicht wie ein Sprachmodell. Wissen ist Form, eine Frage ist eine Störung, und eine Antwort entsteht erst, wenn sich das Feld auf einen stabilen Zustand beruhigt hat.

Es gibt genau ein lebendes Denksubstrat, den Feldzustand state.S. Alles, was das System denkt, muss durch dieses Feld hindurch. Ein zweites Gehirn in Python, ein cleverer Dekodierer oder eine Notfallantwort sind ausdrücklich verboten. Der Prüfsatz dazu ist hart: wenn der Dekodierer die Antwort auch ohne das Feld kennt, gilt der Bau als gescheitert.

Deshalb ist Schweigen hier eine Funktion und kein Makel. Findet das Feld keinen stabilen Zustand, verweigert das System die Antwort, statt zu raten. Diese Disziplin ist der Grund, warum viele Zahlen weiter unten niedrig aussehen und trotzdem belastbar sind.

02 · Der Maßstab

Die ehrliche Messlatte

Fünf Reifegrade. Nur die obersten beiden zählen als Fortschritt.

Die größte Fehlerquelle in diesem Projekt war nie, dass nichts funktioniert. Sehr viel funktioniert. Der Fehler war, wann etwas als Fortschritt verbucht wurde. Seit dem 8. August gilt deshalb für jeden Arbeitsgegenstand eine feste Stufenleiter.

  • E0 Evidenz. Etwas wurde sauber gemessen, gezählt oder diagnostiziert.
  • E1 Mechanismus. Ein Mechanismus läuft im Labor durch, mit kausaler Gegenprobe: nimmt man das Teil heraus, verschwindet der Effekt.
  • E2 Produktionskette. Derselbe Mechanismus läuft auf der regulären, ausgelieferten Fläche und wird dort tatsächlich aufgerufen.
  • E3 Externes Ergebnis. Eine Größe außerhalb des Systems verbessert sich, im direkten Vergleich gemessen. Das ist Fortschritt.
  • E4 Transfer. Derselbe Mechanismus bewegt eine zweite, deutlich getrennte Fläche. Das ist allgemeiner Fortschritt.

Der ehrliche Stand heute: weiterhin sehr viel E0 bis E2, und die ersten E3- und E4-Nachweise stehen. Die schwere Weltzelle hat sich als externes Ergebnis von 15 über 16 auf 21 von 24 gewertete Episoden bewegt und wurde am 17. August zweifach unabhängig repliziert, jeweils exakt 21 von 24 bei null falschen Abschlüssen. Derselbe Programmmechanismus trägt mit identischem Programm-Hash in eine zweite Welt, der E4-Transfernachweis ist seit dem 14. August geschlossen. Der externe Benchmark-Anker D2 bleibt dagegen leer, und das bleibt die entscheidende offene Sprosse.

Die Verifikationsregistry führt zum Zeitpunkt dieser Momentaufnahme 3.137 aktive Einträge: 2.489 bestätigte Messungen, 641 ehrliche Negativergebnisse und 7 geplante. Der Zähler bewegt sich täglich weiter. Diese Zahl ist bewusst kein Fortschrittsmaß. Bestätigt heißt: die Messung war sauber und hat ihre eigenen Kontrollen überlebt. Es heißt nicht, dass sich außerhalb des Systems etwas verbessert hat. Ein Negativergebnis ist dabei genauso wertvoll, weil es eine Sackgasse benennt, die niemand ein zweites Mal ablaufen muss.

03 · Der Ausgangspunkt

Wo wir heute stehen

Stand 17. August 2026. Wenige Zahlen, jede mit Quelle.

Die öffentliche Beweisleiter: drei von vier

Vier Beweise tragen die öffentliche Aussage des Projekts. Drei stehen, der externe steht nicht.

D1 geschlossen

Selbst gebildete Gesetze überleben einen echten Neustart und tragen danach auf einer anderen Oberfläche weiter.

D2 offen

Der externe Benchmark. Der öffentliche Anker ist versiegelt und ehrlich gemessen, und die Spalte, die zählt, ist leer. Das ist die entscheidende offene Sprosse.

D3 im Labor

Erfahrung, Gesetz, spätere Handlung, Ergebnis und Lernen schließen sich zu einem Kreis, und derselbe Ablauf trägt in einer zweiten Welt. Auf der Produktionsfläche noch nicht.

D4 geschlossen

Eine versiegelte Kapsel reproduziert die veröffentlichten Zahlen auf einer unabhängigen Maschine, damit Außenstehende nachrechnen können.

Die erste kalte Gesamtaufnahme, am 8. August versiegelt

An diesem Tag wurde erstmals ein vollständiges Fähigkeitsprofil kalt gemessen und versiegelt: 84 Zeilen, jede einzeln berichtet, ohne Vorlernen und ohne Aufwärmen. Kalt heißt: dem System wurde die Antwort nicht kurz vorher gezeigt. Das ist der ehrliche Ausgangspunkt, gegen den alles Weitere gemessen wird.

10 von 84 Zeilen haben ihre eigene Schwelle bestanden, und keine einzige ist gerissen
74 von 84 Zeilen stehen ehrlich auf „nicht gemessen“ statt auf einer geschönten Null
0 falsche Antworten auf allen neun geprüften Achsen, und null unerlaubte Schreibzugriffe
8 von 8 Negativkontrollen bestanden, darunter die Falle, in der ein cleverer Dekodierer gewinnen würde

Die Freigabe des Profils bleibt trotzdem blockiert, und das ist Absicht: das Gesamturteil verlangt jede geforderte Zeile, und mehrere fehlen noch. Hinter diesem Gate stehen die Rohbeobachtungen des Laufs.

  • Rechnende Organe: 12 von 18 richtig, 0 falsch. Das ist die stabilste Fläche im Profil.
  • Selbstbestimmung an neuen Fällen: 0 von 24. Hier fällt das System korrekt auf Schweigen zurück.
  • Nonverbale Aufgaben: 0 von 32, ebenfalls ohne eine einzige falsche Antwort.
  • Abstinenz an unmöglichen Aufgaben: 10 von 10. Wo es nichts zu antworten gibt, schweigt das System zuverlässig.
  • Hygiene des Antwortpfads: 0,363, kalt und ohne Vorlernen gemessen, über dem Boden von 0,35. Dieser Wert ist ein Gesundheitscheck der Leitung, ausdrücklich kein Intelligenzmaß.
  • Sudoku als getrennte Regressionszeile: 75 von 104 gelöst, davon 21 von 29 in der schweren Klasse, 0 falsch. Diese Zeile misst geordnetes Kollabieren, nicht Modellbildung, und zählt bewusst nicht in den Gesamtnenner.

Die eine Zahl, an der alles hängt

Der externe Anker ist das öffentliche Evaluationsset für abstraktes Schließen. Gezählt wird nur, was das Feld selbst erzeugt hat. Aufgaben, die ein mitgelieferter Lehrerkorpus löst, zählen ausdrücklich nicht.

0 / 120 ARC-AGI-2 Evaluationsset, nur vom Feld selbst erzeugte Lösungen. Alle 120 Aufgaben enden in einer Enthaltung, was die korrekte Ausgabe ist, solange sich kein stabiler Zustand bildet. Der erste Treffer wäre der Beginn von E3.

Das Ergebnisboard: sieben Zellen

Dies ist die einzige öffentliche Fortschrittssicht. Jeder Wert wird aus einem eingecheckten Laufartefakt aufgelöst, keiner wird von Hand getippt.

ErgebniszelleBelastbarer StandNächster Meilenstein
Externes Evaluationsset, nur vom Feld erzeugte Lösungen 0 von 120 1, dann 3, dann 6, dann 12
Standardfragen, tatsächlich abgegebene richtige Antworten 26 von 220 27 bei null falschen
Nonverbale Fragen, tatsächlich abgegebene richtige Antworten 0 von 60 3 von 60
Welt leicht, gewertete Episoden 11 von 24 14 oder besser
Welt schwer, gewertete Episoden 21 von 24 24 von 24 oder besser
Vollständige eigene Kreise auf der Produktionsfläche 10 dauerhafte Einschaltung, noch offene Blocker
Breite Selbstbestimmung, bisher nur im Messstand armiert 0,0527 0,10 und eine zweite Fläche

Zwei Lesehilfen, ohne die diese Tabelle falsch verstanden wird. Bei den Standardfragen sind inzwischen 26 tatsächlich abgegebene richtige Antworten bei null falschen notariell belegt, gemessen auf der unveränderten Produktionskonfiguration. Früher als richtig etikettierte Zeilen, die in Wahrheit korrekte Enthaltungen waren, zählen weiterhin nicht als Antworten. Bei den nonverbalen Fragen ist die Zahl tatsächlich abgegebener richtiger Antworten weiterhin null.

Und eine gewertete Episode in der Weltbatterie heißt nur, dass der Durchlauf zu einem Urteil kam. Sie heißt nicht, dass die Aufgabe gewonnen wurde.

04 · Der Befund

Was klar geworden ist

Ein einziger Satz erklärt fast alle offenen Zellen von oben.

Der Befund vom 17. August zuerst. Was schon funktioniert, repliziert exakt: zwei unabhängige versiegelte Wiederholungen der schweren Weltzelle lieferten beide genau 21 von 24 bei null falschen Abschlüssen, und jeder verbliebene Fehlversuch trägt jetzt genau eine benannte Ursachenklasse. Was neu vorgeschlagen wurde, hat sich ehrlich verweigert: eine konstruktive Morphismus-Grammatik für den externen Anker ist zwar auf allen 15 Verantwortungsklassen ausdrückbar, aber das Evaluationstor bleibt mit 11 von 15 gegen die geforderten 12 geschlossen, und die Nachrüstung löst 0 von 74 plus 0 von 39 zugeordneten Fehlschlägen. Auch der neu geöffnete Sehweg über eine kovariante Inhalts- und Lagedarstellung wurde in zwei Entwurfszensen auf allen vier Formachsen negativ gemessen und ist mit benannten Ursachen geschlossen. Eine neue, strukturierte Zusatzpopulation für Frage und Antwort wurde gemessen; ob sie öffentlich als Ergebniszelle gebunden wird, ist eine noch offene Entscheidung, deshalb steht sie nicht in der Tabelle oben.

Der stehende Befund vom 8. August gilt unverändert. Legt man die Ergebnisse jenes Tages nebeneinander, zeigen sie alle in dieselbe Richtung. Das System hat Verbraucher, die Material lesen können. Es hat Träger, die Struktur durch die Physik transportieren. Es hat einen Ausführer, der ein fertiges Gesetz zuverlässig abarbeitet. Was fehlt, sind die Erzeuger: das Feld bildet von sich aus keine eigenen Hypothesen, keine eigenen Handlungsvorschläge und keine eigenen Anfragen.

Als Bild: das Feld kann prüfen, verrechnen und ausführen. Es kann noch keine eigenen Einfälle erzeugen. Vier geordnete Bauprüfungen sind an genau dieser Stelle ehrlich stehen geblieben, statt einen positiven Effekt zu behaupten.

Zum ersten Mal ist das eine Zahl und keine Vermutung

Ein Zensus hat gemessen, wie stark verschiedene Materialquellen die Feldbewegung an den möglichen Geburtspunkten einer neuen Struktur überhaupt antreiben. Das Maß dafür ist die Kopplung: null bedeutet, die Kraft zeigt in keine Richtung, in der sich das Feld bewegt.

0,0 in 20 von 20 Kopplung ohne Aufnahmeorgan, in jeder einzelnen gemessenen Zelle. Von allein, aus dem symmetrischen Nichts heraus, entsteht nichts.
1,0 in 6 von 6 Dieselbe Kopplung, wenn ein Aufnahmeorgan davorsteht, in allen sechs Startzuständen und mit einer Mindestkraft von 0,707.

Das ist kein Rückschlag, sondern eine saubere Weggabelung. Alles, wo im System heute tatsächlich Neues entsteht, läuft über einen ausdrücklichen Aufnahmeschritt: das Organ, das Beziehungsklassen bildet, die Familienfindung beim Hochfahren, die Regionenbildung. Keiner dieser Fälle beruht auf spontaner Entstehung im Feld. Die Messung bestätigt damit genau das Muster, das ohnehin funktioniert, und ein solches Aufnahmeorgan darf jetzt gebaut werden.

Die physikalische Gegenfrage wurde am selben Tag beantwortet, und zwar negativ: fünf konkrete Kandidatenklassen für eine spontane Verzweigung wurden rein lesend geprüft. Vier sind widerlegt, eine ist mit dem vorhandenen Material nicht entscheidbar, keine hat überlebt. Der Weg über ein Aufnahmeorgan bleibt damit die einzige belegte Form.

Eine Ehrlichkeitsnotiz, die zum Bild gehört. Eine grüne Vorabprüfung ist keine Wirkungszusage, sondern nur die Erlaubnis, einen Bau zu versuchen. Von drei zuvor grün gescreenten Bauvorhaben hat später keines einen messbaren Effekt auf der regulären Fläche gezeigt. Diese Bilanz wird bewusst mitgeführt, damit ein grünes Signal nicht als Ergebnis gelesen wird.

05 · Aktive Arbeit

Was gerade läuft

Vier Forschungsbahnen, jede mit eigener schriftlicher Freigabe des Eigentümers.

  • Gedächtnis: ein freigegebener Messzensus. Eine eigene Bahn misst rein lesend und ohne Bau eine benannte Störgröße im Ablagepfad; die Freigabe des Eigentümers vom 16. August liegt schriftlich vor, das Ergebnis steht noch aus und wird hier erst nach der Landung berichtet.
  • Externer Anker: die Ausdrucksgrenze wird weiter kartiert. Zwei Entwurfszensen haben die vorgeschlagene konstruktive Grammatik ehrlich verworfen; die Bahn arbeitet an der nächsten Grammatikfrage, ohne Bau und ohne Evaluation.
  • Frage und Antwort: die strukturierte Zusatzpopulation. Die Messung steht, die öffentliche Bindung als Ergebniszelle ist eine offene Entscheidung des Eigentümers und wird hier erst nach dieser Entscheidung berichtet.
  • Sehen: nach dem doppelten Nein die nächste Formfrage. Der kovariante Darstellungsweg ist mit benannten Ursachen geschlossen; die Bahn prüft die daraus abgeleitete nächste Kanalform, wieder rein lesend und mit erlaubtem ehrlichem Abbruch.

06 · Die Richtung

Wie es weitergeht

Eine senkrechte Kette statt einer Liste von Bausteinen. Eine Sprosse zählt erst, wenn die darunter trägt.

  1. 1AufgabenweltEine gemeinsame Aufgabenfläche für alle Domänen. Kein Benchmark lebt im Kern, alles tritt durch denselben Eingang ein.
  2. 2Mehrere eigene ModelleVier Kandidatenmodelle bestehen gleichzeitig als vorübergehende Feldstruktur, vor dem Ausführer und ohne Aufzählung in Python.
  3. 3Vorhersage und AnfrageDie Kandidaten müssen sich in etwas Beobachtbarem widersprechen. Der Widerspruch ist das Experiment.
  4. 4Gesetz mit BelegWas die Gegenbeispiele überlebt, wird zu einem abgeschlossenen Gesetz. Vorher wird nichts dauerhaft gespeichert.
  5. 5Ein durchgehender LaufDie ganze Kette läuft in einem regulären Produktionslauf, nicht als Folge einzelner Messstände.
  6. 6Externes Ergebnis, dann TransferErst eine gepaart verbesserte Größe außerhalb des Systems ist Fortschritt. Erst eine zweite Domäne ist allgemeiner Fortschritt.

Der Nordstern in einem Satz: Hylaean bekommt eine unbekannte Situation, bildet mehrere eigene Modelle, macht unterscheidbare Vorhersagen, widerlegt die falschen, schließt ein Gesetz, handelt oder antwortet damit, verbessert ein Ergebnis außerhalb seiner selbst, behält nur den bewiesenen Nutzen und trägt denselben Mechanismus in eine zweite Domäne.

07 · Herkunft

Woher diese Zahlen kommen

Keine Zahl auf dieser Seite ist geschätzt. Jede hat einen Lauf hinter sich.

  • Kalte Gesamtaufnahme, Kontrollen, Abstinenz, Sudoku und Hygiene des Antwortpfads: VERIFY.IQ.FIELD_CAPABILITY_PROFILE_V2.01, versiegelt am 8. August 2026.
  • Externes Evaluationsset: VERIFY.ARC.ARC8_PUBLIC_ANCHOR_SEALED_REMEASURE.01.
  • Abgegebene Antworten gegenüber Enthaltungen: VERIFY.IQ.COMMIT_TRACE_FIELD_POPULATION_CENSUS.01.
  • Gewertete Weltepisoden, leicht: VERIFY.IQ.BATTERY_WORLD_TAIL_OUTER_DRAIN_BUDGET_COMPLETE_MEASUREMENT.01; schwer: VERIFY.WORLD.DISCIPLINED_NINE_KEY_HARD_CELL_CONTINUATION.01, zweifach repliziert durch VERIFY.WORLD.HARD_CELL_REPLICATION_AND_EASY_ANATOMY.01.
  • Tatsächlich abgegebene Standardantworten: VERIFY.QA.POST_FLIP_COLD_220_EXTERNAL_CELL_REMEASUREMENT.02; nonverbale Antworten und Enthaltungen: VERIFY.IQ.COMMIT_TRACE_FIELD_POPULATION_CENSUS.01.
  • Kreise auf der Produktionsfläche: VERIFY.WORLD.D3_TEN_DISTINCT_FULL_CIRCLES_BUILD.05; E4-Transfer mit identischem Programm-Hash: VERIFY.WORLD.D3_ROLE_QUOTIENT_SECOND_DOMAIN_TRANSFER.02.
  • Die beiden Grammatik-Entwurfszensen: VERIFY.ARC.CONSTRUCTIVE_MORPHISM_GRAMMAR_DESIGN_CENSUS.01 und VERIFY.ARC.CANVAS_INNER_VALUE_GRAMMAR_EXTENSION_DESIGN_CENSUS.01.
  • Die beiden Seh-Entwurfszensen: VERIFY.VISION.COVARIANT_CONTENT_POSE_FIBER_DESIGN_CENSUS.01 und VERIFY.VISION.APERTURE_STABLE_COVARIANT_CONTENT_CHANNEL_DESIGN_CENSUS.01.
  • Breite Selbstbestimmung: VERIFY.R3.DETERMINATION_TRACK_REPORTABLE.05.
  • Kopplung ohne und mit Aufnahmeorgan: VERIFY.PHYS.ENDOGENOUS_GENESIS_CLASS_DRIVE_CENSUS.01 und VERIFY.PHYS.ANONYMOUS_MATERIAL_RESIDUAL_NUCLEATION_ORGAN_DESIGN_CENSUS.01.
  • Die fünf geprüften Kandidatenklassen: VERIFY.PHYS.BOUNDED_BIFURCATION_CANDIDATE_CLASS_FALSIFICATION_MEASUREMENT.01.
  • Der ehrlich gestoppte Funktionsbeweis: VERIFY.ARCH.MODEL_DISCOVERY_MANIFOLD_K4_FUNCTIONAL_PROOF.01.
  • Zählung der Einträge: verification/registry.csv im gelandeten Hauptstand vom 17. August 2026.

Die laufend aktualisierte Fassung all dieser Zellen, jeweils mit Verweis auf das zugehörige Laufartefakt, steht in der Progress Ansicht. Die einzelnen Urteile pro Messung stehen im Statusprotokoll, und wie die Schichten zusammenarbeiten sollen, erklärt die Architekturseite.