Ein größeres Argumentationssystem innerhalb einer eingebetteten Randhülle
Reinventy wurde gefördert NVIDIA Nemotron 3.5 Lightning 30B-A3B NVFP4 als kanonische Argumentationsmaschine in Odino 3.11.0/Q19 auf NVIDIA Jetson AGX Thor. TensorRT Edge-LLM 0.10.0 dient dem Produktionsmodell; die ehemalige Nano-Engine ist inaktiv und es ist kein automatischer Fallback oder Modellwähler aktiviert.
Nemotron 3.5 ist ein 30-Milliarden-Parameter Mix-of-Experten-Modell mit etwa 3 Milliarden aktiven Parametern pro Token. Es bietet das 7,5-fache der gesamten Parameterkapazität des ehemaligen Nano-4B-Motors und behält gleichzeitig einen enthaltenen Active-Compute-Fußabdruck, der für eine beschleunigte eingebettete Plattform geeignet ist.
Produktionsleistung
Gegenüber der anhaltenden vergleichbaren Nano-Baseline verzeichnet Odino 3.11:
- 72.623 tok/s über den HTTP-Mittelwert der Fünf-Run-Produktion, eine Verbesserung von 27,6%;
- 77.104 tok/s auf den qualifizierten festen HTTP-Workload, eine Verbesserung von 35,5 %;
- 92,8 Tok/s bei nativem Motorpeak, eine Verbesserung von 63,1%;
- 68,072 ms Medianzeit bis zum ersten Produktionsinhalt.
Die Produktionsmaschine belegt 19.102 MiB GPU Unified Memory bei voller Residenz. Ein überwachter Warmmotor-Neustart gibt die Bereitschaft in vier Sekunden zurück.
Wissenschaftliches Denken und direkte Beweise
Auf dem identischen festen zweisprachigen wissenschaftlichen und kontradiktorischen Manifest erhöhte sich die gemessene Genauigkeit von 63,33% auf 100%. Direct Evidence p50 fiel von 3.556,867 ms auf 31.370 ms, und die frühere Kataloganforderung, die das HTTP-Limit überschritt, schließt nun erfolgreich mit einer geerdeten Werkzeugspur über 236 Katalogzeilen ab.
Knowledge Graph, Provenienz auf Anspruchsebene, Evidenzbewertung, lokale Unsicherheit und Out-of-Domain-Handling, geerdete Tools und spezialisierte Read-Only-Konsumenten bleiben integriert, ohne Mutation, Export, Einnahme oder autonome Experimentausführung zu ermöglichen.
Der Meilenstein demonstriert die Kernthese von Reinventy: Mehr fähiges Denken muss keine Cloud-Abhängigkeit, versteckte Autorität oder unbegrenzte Ausführung bedeuten. Leistung, Evidenz und Governance können gemeinsam auf einem NVIDIA-beschleunigten Edge-Knoten voranschreiten.
Quellen: Odino 3.11.0 / Q19 kontrollierter Produktionsrekord · verifiziert 2026-08-23