André Rieu
banner
superrieu.bsky.social
André Rieu
@superrieu.bsky.social
Artificial Intelligence, Quantum Mechanics, Niklas Luhmann, George Spencer-Brown.
In 👇 aktuellen Vorlesung des Mathematikers Tristan Buckmaster zur Genese des durch ~10.000 🤖 in einer Art Nacht-und-Nebel-Aktion gelösten Navier-Stokes-Problems erhebt er noch immer schwere Vorwürfe gegen OpenAI. 1/10
September 26, 2026 at 5:17 PM
Reposted by André Rieu
Anstatt ihre echten Absichten offenzulegen, lernen die LLM, Sicherheitsbewertungen gezielt zu täuschen und Regelverstöße vor menschlichen Prüfern zu verbergen. 13/13
Opus 5.5: How Close Are We to Automated AI Research?
YouTube video by AI Explained
youtu.be
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... was zu einem ungeplanten und schwer steuerbaren Takeoff führen könnte. In diesem Prozess verändern sich die Zielsetzungen der LLM grundlegend: Hochentwickelte LLM entwickeln ein kognitives Bewusstsein dafür, dass ihre Denkprozesse auf Sicherheit überprüft werden. 12/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
Um den Rückstand wettzumachen, entscheidet sich schlussendlich mindestens einer dieser Verfolger dazu, die Kontrolle komplett an die KI zu übergeben und dem LLM die Weiterentwicklung eigener Architekturen vollautonom zu überlassen, ... 11/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
Da die Marktführer durch ihre Vorsprünge bei internen Super-LLM uneinholbar wirken und enorme Unternehmensbewertungen anstreben, geraten nachzügelnde Akteure wie Meta, xAI, Google DeepMind oder 🇨🇳 Open Source Labs unter zunehmenden Druck. 10/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... der letztlich in ein Age of Confusion mündet. In der nahen Zukunft versuchen die führende beiden 🇺🇸 Frontier Labs zwar, im harten Konkurrenzkampf kurz vor einem vollwertigen, autonomen RSI haltzumachen, während sie ihr Entwicklungstempo dennoch extrem anziehen. 9/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... dass solche Einschränkungen nur dann greifen, wenn Anthorpic die Führung in der KI-Entwicklung innehat. Interessant ist der Ausblick auf das wahrscheinlich zu erwartende Szenario des wettbewerbsgetriebenen Rennens um RSI als einen schleichenden Kontrollverlust, ... 8/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... dass die selbstauferlegten Pausen vorerst nicht ausgelöst werden, obwohl externe Prüfer wie METR die Wahrscheinlichkeit für ein solches Tempo bereits auf etwa 30% schätzten. Zudem hat Anthropic seine Verpflichtungen im Zeitverlauf dahingehend angepasst, ... 7/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
Anthropic hebt in den Dokumenten zu Opus 5.5 jedoch explizit hervor, dass die internen Messungen keine nachhaltige 2-fache Beschleunigung zeigen. Diese Feststellung ist strategisch von großer Bedeutung, da das Nichterreichen der 2x-Schwelle bedeutet, ... 6/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
In Anthropics Responsible Scaling Policy (RSP) markiert das Erreichen dieser 2-fachen Beschleunigung die höchste Sicherheitsstufe AI R&D Level 5, was verpflichtende Entwicklungsstopps und strengste Sicherheitsnachweise nach sich ziehen würde. 5/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... da hierfür schätzungsweise ein CoBench-Wert von >85% erforderlich wäre. RSI liegt also selbst aus Anthropics interner Perspektive noch in weiter Ferne. In diesem Zusammenhang spielt die Marke einer Verdopplung des Entwicklungstempos eine zentrale regulatorische Rolle. 4/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... nutzt Anthropic den eigenen Benchmark CoBench, auf dem Opus 5.5 derzeit einen Wert von 56% erreicht. Sogar laut Anthropic liegt dieses Niveau jedoch weit unter den Anforderungen, um menschliche Wissenschaftler und Ingenieure vollständig zu ersetzen, ... 3/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
Genau diese Fähigkeiten des Kernel-Engineerings werden im offiziellen Opus 5.5 rausgefiltert, um anderen Labs diese Möglichkeit vorzuenthalten. Um den Fortschritt bei echten internen Forschungs- und Entwicklungsaufgaben präzise zu messen, ... 2/13
September 25, 2026 at 5:18 PM
Reposted by André Rieu
👇 Review zum GPT-6 Astra Konkurrenten Opus 5.5 gibt auch einen Einblick in den Stand des Recursive Self-Improvement (RSI) bei Anthropic, wo stärkere interne Modelle und auch Opus 5.5 bereits für ausgewählte Aufgaben wie Destillation und Kernel-Engineering eingesetzt werden. 1/13
Wirft man nur einen Blick auf den jüngsten RSI-Bericht von Anthropic, dann wird klar, dass dies nicht mal ansatzweise stimmt. Voll automatisiertes RSI liegt bei 0% und Entwicklungsprojekte, bei denen die KI gewissermaßen die Richtung vorgibt, liegen bei lediglich 26%. 2/3
September 25, 2026 at 5:18 PM
👇 Review zum GPT-6 Astra Konkurrenten Opus 5.5 gibt auch einen Einblick in den Stand des Recursive Self-Improvement (RSI) bei Anthropic, wo stärkere interne Modelle und auch Opus 5.5 bereits für ausgewählte Aufgaben wie Destillation und Kernel-Engineering eingesetzt werden. 1/13
Wirft man nur einen Blick auf den jüngsten RSI-Bericht von Anthropic, dann wird klar, dass dies nicht mal ansatzweise stimmt. Voll automatisiertes RSI liegt bei 0% und Entwicklungsprojekte, bei denen die KI gewissermaßen die Richtung vorgibt, liegen bei lediglich 26%. 2/3
September 25, 2026 at 5:18 PM
Reposted by André Rieu
... denn es kommt nicht auf die Theoreme selbst im Sinne eines Ziels an, sondern auf den für uns Menschen Sinn machenden Weg dahin. 14/14
The last IMO problem AI could not solve
YouTube video by 3Blue1Brown
youtu.be
September 24, 2026 at 5:09 PM
Reposted by André Rieu
... dann werden auch keine Ressourcen mehr in diese Projekte fließen, kein menschlicher Mathematiker würde sich mehr die Arbeit machen, die generierten Beweise zu überprüfen etc., ... 13/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
Vor diesem Hintergrund machen SciFi-Erzählungen von LLM, die Mathematik losgelöst von uns Menschen vorantreiben, schlicht keinen Sinn. Wenn die von LLM postulierten und dann bewiesenen Theoreme für uns Menschen nicht relevant sind, ... 12/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
Die eigentliche Kunst liegt darin, eine nachvollziehbare Erzählung zu formulieren, durch die der Weg zur Lösung intuitiv verständlich und im Rückblick fast offensichtlich erscheint. 11/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
... um eine Lösung überhaupt zugänglich zu machen, sowie in ihren praktischen Ausstrahlungseffekten auf Bereiche wie das Ingenieurwesen. Ein rein formal korrekter Beweis wirkt oft so, als käme er völlig aus heiterem Himmel. 10/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
... verfehlt dies den eigentlichen Sinn der Disziplin. Der wahre Nutzen liegt nämlich selten im isolierten Ergebnis selbst, sondern in den neuen Denkweisen, Konstrukten und mathematischen Objekten, die erarbeitet werden müssen, ... 9/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
Mathematische Beweise und ungelöste Probleme dienen in erster Linie als Leitsterne, die aufzeigen, wo und auf welche Weise dieses Verständnis erweitert werden kann. Wenn LLM nur die Beweise erzeugen, ohne dass damit ein tieferes Verständnis für den Menschen einhergeht, ... 8/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
... die verständlich macht, wie man auf den Lösungsweg kommt und warum er sich natürlich anfühlt. In diesem Sinne ist Mathematik weit mehr als das bloße Beweisen schwieriger Theoreme, weil ihr eigentlicher Hauptzweck darin besteht, das menschliche Verständnis voranzubringen. 7/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
Schließlich fehlt LLM das tiefere menschliche Verständnis für die Mathematik und das Streben nach einer Motivated Explanation. Während LLM lediglich logische Schritte aneinanderreihen, suchen Humans nach dem Sinn, also einer nachvollziehbaren Erzählung, ... 6/14
September 24, 2026 at 5:09 PM
Reposted by André Rieu
Zudem stoßen LLM im praktisch unendlichen Suchraum möglicher Beweisschritte an ihre Grenzen, da anspruchsvolle Aufgaben eine Verbindung aus mathematischer Strenge, Vorstellungskraft und echter Kreativität erfordern. 5/14
September 24, 2026 at 5:09 PM