Wissensstufe: Fortgeschritten

  • Verbotene KI-Praktiken in der EU

    Der AI Act verbietet mehrere Praktiken, die Menschen manipulieren, Schwächen ausnutzen oder Grundrechte besonders stark beeinträchtigen. Seit Februar 2025 gelten die ersten acht Verbote. Ein zusätzliches Verbot für Systeme zur Erzeugung nicht einvernehmlicher intimer Inhalte tritt nach dem AI Omnibus im Dezember 2026 in Kraft.

    Beispiele

    • Schädliche Manipulation oder Täuschung
    • Schädliche Ausnutzung besonderer Verletzlichkeit
    • Social Scoring
    • Ungezieltes Sammeln von Gesichtern zum Aufbau von Erkennungsdatenbanken
    • Emotionserkennung am Arbeitsplatz und in Bildungseinrichtungen in den erfassten Fällen
    • Bestimmte biometrische Kategorisierung und Echtzeit-Fernidentifizierung
    • KI-Systeme für nicht einvernehmliche intime Darstellungen und Missbrauchsmaterial

    Nicht jede ähnliche Funktion ist automatisch verboten

    Die genaue Einordnung hängt von Zweck, Kontext, Ausnahmen und rechtlicher Definition ab. Eine technische Funktion darf nicht ohne Prüfung mit einer verbotenen Praxis gleichgesetzt werden.

    Für Betreiber

    Organisationen sollten bereits vor Beschaffung oder Entwicklung prüfen, ob der geplante Anwendungsfall in einen verbotenen Bereich fällt. Ein späteres Abschalten ist kein Ersatz für diese Vorprüfung.

    Quellen und Rechtsstand

    Prüfstand: 28.07.2026. Rechtliche Beiträge dienen der allgemeinen Information und ersetzen keine Rechtsberatung.

  • Menschliche Kontrolle: Mehr als ein Bestätigungsbutton

    Ein Mensch in der Schleife verhindert Fehler nicht automatisch. Zeitdruck, Automatisierungsvertrauen, unklare Zuständigkeit oder fehlende Alternativen können die Kontrolle wirkungslos machen. Gute Aufsicht ist organisatorisch und technisch vorbereitet.

    Wirksame Aufsicht braucht

    • Verständliche Informationen über Zweck, Grenzen und Unsicherheit
    • Ausreichend Zeit und Fachkenntnis für eine Prüfung
    • Zugriff auf zugrunde liegende Daten und Begründungen soweit möglich
    • Befugnis, das Ergebnis zu ändern oder das System abzuschalten
    • Einen funktionierenden manuellen Ersatzprozess

    Warnzeichen

    • Menschen bestätigen fast alle Vorschläge ungeprüft
    • Abweichungen müssen aufwendig begründet werden
    • Leistungsziele lassen keine reale Prüfzeit
    • Es gibt keine Aufzeichnung, wer entschieden hat
    • Betroffene können eine Entscheidung nicht anfechten

    Besonders wichtig

    Bei Entscheidungen über Gesundheit, Beschäftigung, Bildung, Kredit, Versicherung, Recht oder staatliche Leistungen darf KI nicht als unfehlbare Autorität behandelt werden.

    Quellen und Rechtsstand

    Prüfstand: 28.07.2026. Rechtliche Beiträge dienen der allgemeinen Information und ersetzen keine Rechtsberatung.

  • EU AI Act: Was gilt wann?

    Der EU AI Act gilt stufenweise. Bereits anwendbar sind unter anderem Verbote bestimmter KI-Praktiken und Regeln für General-Purpose-AI-Modelle. Transparenzpflichten gelten ab 2. August 2026; zentrale Pflichten für Hochrisiko-Systeme wurden 2026 zeitlich verlängert. Stand dieses Artikels: 28. Juli 2026.

    Die wichtigsten Termine

    • 1. August 2024: Inkrafttreten des AI Act
    • 2. Februar 2025: erste Verbote und ursprüngliche Regeln zur KI-Kompetenz werden anwendbar
    • 2. August 2025: Regeln für General-Purpose-AI-Modelle und Governance werden anwendbar
    • 2. August 2026: Transparenzpflichten für bestimmte KI-Systeme und synthetische Inhalte werden anwendbar
    • 2. Dezember 2027: Hochrisiko-Systeme aus den in Anhang III genannten sensiblen Bereichen
    • 2. August 2028: Hochrisiko-KI als Bestandteil regulierter Produkte nach Anhang I

    Warum sich Termine geändert haben

    Der am 27. Juli 2026 in Kraft getretene AI Omnibus verlängerte insbesondere die Übergangsfristen für Hochrisiko-Systeme. Rechtliche Zeitpläne sollten deshalb immer mit der aktuellen EU-Übersicht geprüft werden.

    Für wen ist das relevant?

    • Anbieter von KI-Systemen und Modellen
    • Unternehmen und Behörden, die KI einsetzen
    • Organisationen mit KI in Personal, Bildung, Kredit, Gesundheit oder kritischer Infrastruktur
    • Betreiber von Diensten mit Chatbots, Deepfakes oder anderen generativen Inhalten

    Wichtiger Hinweis

    Dieser Überblick ist eine Orientierung und keine Rechtsberatung. Maßgeblich sind der geltende Gesetzestext, einschlägige Leitlinien und die konkrete Rolle im Einzelfall.

    Quellen und Rechtsstand

    Prüfstand: 28.07.2026. Rechtliche Beiträge dienen der allgemeinen Information und ersetzen keine Rechtsberatung.

  • KI-Benchmarks und Evaluationen

    Benchmarks vergleichen Modelle unter festgelegten Bedingungen. Praktische Evaluationen müssen zusätzlich reale Aufgaben, Daten, Fehlerfolgen, Kosten und menschliche Kontrolle abbilden. Besonders agentische Systeme benötigen mehrstufige Tests in einer realistischen Umgebung.

    Einfach erklärt

    Ein Benchmark ist eine standardisierte Prüfung. Ein gutes Ergebnis dort bedeutet nicht automatisch, dass das Modell in deinem Arbeitsablauf ebenso gut funktioniert.

    Arten von Evaluationen

    • Wissens- und Verständnisfragen
    • Code- und Mathematikaufgaben
    • Faktentreue und Quellenbindung
    • Bild-, Audio- oder Videoverständnis
    • Sicherheitstests und Red Teaming
    • End-to-End-Aufgaben mit Werkzeugen

    Warum Ergebnisse schwanken

    • Prompt und Systemanweisung beeinflussen das Ergebnis
    • Modelle und Dienste werden laufend aktualisiert
    • Bewertungsmodelle können eigene Verzerrungen besitzen
    • Trainingsdaten können Testaufgaben enthalten
    • Zufälligkeit und Werkzeugfehler verändern einzelne Läufe

    Praxisnahe Evaluation

    1. Repräsentative Aufgaben aus dem eigenen Betrieb sammeln
    2. Erwartete Ausgabe und Fehlerklassen definieren
    3. Mehrere Durchläufe und schwierige Randfälle testen
    4. Qualität, Zeit, Kosten und Sicherheitsvorfälle messen
    5. Ergebnisse regelmäßig nach Modellupdates wiederholen

    Agenten testen

    Bei Agenten zählt nicht nur die Endantwort. Auch Werkzeugwahl, Zwischenzustände, Berechtigungen, Abbruchverhalten und die Fähigkeit zur Übergabe an Menschen müssen geprüft werden.

    Primärquellen

  • Lokale KI und Quantisierung

    Bei lokaler KI laufen Modell und Daten auf dem eigenen Gerät oder einer selbst kontrollierten Infrastruktur. Quantisierung reduziert Speicherbedarf und Rechenaufwand, kann aber Qualität oder Geschwindigkeit je nach Modell, Hardware und Verfahren unterschiedlich beeinflussen.

    Einfach erklärt

    Ein großes Modell speichert sehr viele Zahlen. Werden diese Zahlen mit weniger Stellen gespeichert, benötigt das Modell weniger Speicher. Das ähnelt einer komprimierten Darstellung, bei der möglichst wenig nutzbare Genauigkeit verloren gehen soll.

    Vorteile lokaler Ausführung

    • Daten müssen nicht zwangsläufig an einen externen Dienst übertragen werden
    • Feste Kosten statt nutzungsabhängiger API-Gebühren können möglich sein
    • Offline-Betrieb und geringe Netzwerklatenz
    • Eigene Kontrolle über Version und Konfiguration

    Typische Präzisionen

    • FP32: hohe Genauigkeit, hoher Speicherbedarf
    • FP16 oder BF16: verbreitet für moderne Beschleuniger
    • INT8: deutlich kleiner, häufig mit geringer Qualitätseinbuße
    • INT4 und darunter: starke Kompression mit höherem Abstimmungsbedarf

    Grenzen

    • Lokale Verarbeitung ist nicht automatisch datenschutzkonform
    • Hardware, Stromverbrauch und Wartung bleiben erforderlich
    • Sehr große Modelle passen auch quantisiert nicht auf jedes Gerät
    • Manche Aufgaben verlieren durch starke Quantisierung messbar an Qualität

    Auswahlkriterien

    • Aufgabe und benötigte Modellqualität
    • Verfügbarer RAM oder Grafikspeicher
    • Unterstützung der konkreten CPU, GPU oder NPU
    • Lizenz und erlaubte Nutzung
    • Update- und Sicherheitskonzept

    Primärquellen

  • Mixture-of-Experts-Modelle (MoE)

    Ein Mixture-of-Experts-Modell enthält mehrere sogenannte Experten. Ein Router entscheidet für jedes Token, welche Experten berechnet werden. Dadurch kann ein Modell sehr viele Parameter besitzen, ohne bei jeder Eingabe alle Parameter zu verwenden.

    Einfach erklärt

    Statt jede Frage an die gesamte Mannschaft zu geben, verteilt ein Router einzelne Aufgaben an wenige passende Spezialisten.

    Technische Grundidee

    • Mehrere Feed-Forward-Netze dienen als Experten
    • Ein Routing-Netz berechnet Auswahlgewichte
    • Nur die ausgewählten Experten verarbeiten das jeweilige Token
    • Die Ergebnisse werden gewichtet zusammengeführt

    Vorteile

    • Hohe Modellkapazität bei begrenztem Rechenaufwand pro Token
    • Spezialisierung verschiedener Experten kann entstehen
    • Skalierung auf sehr große Parameterzahlen

    Herausforderungen

    • Ungleichmäßige Auslastung einzelner Experten
    • Hoher Kommunikationsaufwand über mehrere Beschleuniger
    • Komplexere Bereitstellung und Optimierung
    • Gesamtparameterzahl ist nicht direkt mit aktiv genutzten Parametern vergleichbar

    Einordnung

    MoE ist eine Architekturentscheidung und kein Beleg für bessere Qualität. Vergleichbar sind Modelle nur über konkrete Aufgaben, aktive Rechenkosten, Speicherbedarf und unabhängige Evaluationen.

    Primärquellen

  • AlphaFold 3: Strukturen biomolekularer Wechselwirkungen

    AlphaFold 3 nutzt eine deutlich veränderte, diffusionsbasierte Architektur zur gemeinsamen Strukturvorhersage biomolekularer Komplexe. Es ist ein Forschungswerkzeug für Hypothesen und Strukturmodelle, kein Ersatz für experimentelle Validierung oder klinische Entscheidungen.

    Forschungsfrage

    Wie lassen sich nicht nur einzelne Proteine, sondern die räumlichen Strukturen und Wechselwirkungen verschiedener Biomoleküle vorhersagen?

    Ansatz

    Das Modell verarbeitet Sequenzen und chemische Komponenten gemeinsam und erzeugt atomare 3D-Strukturen mit einem Diffusionsmodul. Konfidenzwerte helfen dabei, Vorhersagen einzuordnen.

    Validierte Ergebnisse

    • Die Nature-Arbeit berichtet verbesserte Genauigkeit für mehrere Klassen biomolekularer Interaktionen
    • Unterstützt werden unter anderem Proteine, Nukleinsäuren, kleine Moleküle, Ionen und modifizierte Reste
    • Der AlphaFold Server ermöglicht ausgewählten Forschungsnutzungen ohne eigene Hochleistungsinfrastruktur

    Bedeutung

    • Hypothesen über Protein-Ligand- und Protein-Nukleinsäure-Interaktionen
    • Unterstützung früher Phasen biologischer und pharmazeutischer Forschung
    • Gemeinsame Betrachtung verschiedener Molekülklassen in einem Modell

    Grenzen

    • Vorhersagen ersetzen keine Labor- oder klinischen Daten
    • Beweglichkeit, Reaktionsabläufe und zelluläre Bedingungen werden nur begrenzt abgebildet
    • Konfidenzwerte müssen für jede Komponente und Interaktion geprüft werden

    Status

    Veröffentlichtes Forschungssystem; Nutzung und Lizenzbedingungen unterscheiden sich zwischen Server, Code und Gewichten.

    Primärquellen

  • AlphaGenome: Auswirkungen genetischer Varianten vorhersagen

    AlphaGenome ist ein Forschungsmodell für regulatorische Genomik. Es verarbeitet lange DNA-Sequenzen und liefert hochauflösende Vorhersagen zu verschiedenen molekularen Eigenschaften. Die Ergebnisse sind Hypothesen für Forschung und keine medizinische Diagnose.

    Forschungsfrage

    Viele krankheitsrelevante Varianten liegen außerhalb protein-codierender Bereiche. Wie beeinflussen sie Genregulation, Spleißen und andere molekulare Prozesse?

    Ansatz

    Das Modell kombiniert lange Eingabesequenzen mit feiner räumlicher Auflösung und sagt mehrere genomische Signale sowie Varianteneffekte voraus.

    Mögliche Anwendungen

    • Priorisierung regulatorischer Varianten für Experimente
    • Untersuchung möglicher Mechanismen hinter Erkrankungen
    • Analyse von Effekten auf Genexpression und RNA-Verarbeitung
    • Planung gezielter Laborstudien

    Grenzen

    • Das Modell wurde als Forschungsvorschau vorgestellt
    • Vorhersagen können populations- und zelltypspezifische Zusammenhänge übersehen
    • Kausalität und klinische Bedeutung müssen experimentell und medizinisch bestätigt werden
    • Die API ist nicht für diagnostische Entscheidungen bestimmt

    Status

    Forschungsvorschau mit API-Zugang für nichtkommerzielle Forschung; weitere Validierung und Veröffentlichung des Modells wurden angekündigt.

    Primärquellen

  • AlphaEvolve: Algorithmen durch evolutionäre Codesuche

    AlphaEvolve sucht nach Programmen, die ein klar messbares Ziel verbessern. Kandidaten werden automatisch ausgeführt und bewertet; erfolgreiche Varianten dienen als Ausgangspunkt für weitere Vorschläge. Ergebnisse sind besonders belastbar, wenn die Bewertungsfunktion die Aufgabe vollständig abbildet.

    Forschungsfrage

    Können Sprachmodelle nicht nur Code schreiben, sondern durch wiederholte, automatisch bewertete Variation neue und effizientere Algorithmen entdecken?

    Ansatz

    • Mehrere Sprachmodelle schlagen Programmvarianten vor
    • Automatische Evaluatoren messen Korrektheit oder Leistung
    • Eine evolutionäre Datenbank wählt vielversprechende Kandidaten
    • Neue Generationen verändern und kombinieren erfolgreiche Programme

    Berichtete Anwendungen

    • Optimierung von Rechenzentrums- und Planungsalgorithmen
    • Beiträge zu Chipdesign und KI-Training
    • Neue Varianten für Matrixmultiplikation
    • Suche nach Lösungen mathematischer Probleme

    Warum das überprüfbarer ist

    Die Ausgabe besteht aus ausführbarem Code. Dieser kann mit Tests, Benchmarks oder mathematischen Prüfungen bewertet werden. Das reduziert, aber beseitigt nicht die Gefahr einer unvollständigen Bewertungsfunktion.

    Grenzen

    • Die Aufgabe benötigt eine verlässliche maschinelle Bewertungsfunktion
    • Optimierung kann unbeabsichtigte Lücken im Messverfahren ausnutzen
    • Entdeckter Code muss von Fachleuten verstanden, getestet und abgesichert werden

    Status

    Aktives Forschungssystem; konkrete Zugänglichkeit und Einsatzbereiche sind begrenzt und können sich ändern.

    Primärquellen

  • GNoME: neue stabile Kristallstrukturen vorhersagen

    Das Projekt vergrößerte den rechnerisch vorhergesagten Raum stabiler Materialien erheblich. Eine vorhergesagte Stabilität bedeutet jedoch nicht, dass ein Material praktisch synthetisierbar, dauerhaft oder für eine konkrete Anwendung geeignet ist.

    Forschungsfrage

    Wie kann die Suche im enormen Raum möglicher anorganischer Kristallstrukturen beschleunigt werden?

    Ansatz

    Graphenmodelle sagen Energie und Stabilität von Kandidaten voraus. Neue Kandidaten werden iterativ erzeugt, berechnet und zum weiteren Training verwendet.

    Veröffentlichte Ergebnisse

    • Die Nature-Arbeit beschreibt 2,2 Millionen vorhergesagte Kristallstrukturen
    • Rund 381.000 Kandidaten wurden in den Berechnungen als stabil eingeordnet
    • Daten wurden für weitere Forschung bereitgestellt

    Bedeutung

    • Erweiterte Ausgangsbasis für Batterien, Halbleiter und andere Materialklassen
    • Priorisierung von Kandidaten vor teuren Laborversuchen
    • Verknüpfung von KI-Vorhersage und automatisierter Synthese

    Grenzen

    • Thermodynamische Stabilität ist nur ein Auswahlkriterium
    • Synthesewege, Defekte, Kosten und Umweltwirkung müssen separat untersucht werden
    • Experimentelle Bestätigung bleibt notwendig

    Primärquellen