Wissensstufe: Einfach

  • Mit KI recherchieren und Quellen prüfen

    Nutze KI als Rechercheassistenten, nicht als Quelle. Entscheidend ist, ob jede wichtige Aussage auf eine tatsächlich vorhandene, passende und aktuelle Originalquelle zurückgeführt werden kann.

    Geeignet für

    • Fragestellung präzisieren
    • Synonyme und Suchbegriffe finden
    • Quellen nach Themen ordnen
    • Widersprüche zwischen Quellen sichtbar machen
    • Forschungslücken und offene Fragen sammeln

    Voraussetzungen

    Internet- oder Datenbankzugriff, klare Qualitätskriterien und ausreichend Zeit zur Prüfung der Originalquellen.

    Vorgehensweise

    1. Recherchefrage und Zeitraum festlegen.
    2. Geeignete Primärquellen und Fachdatenbanken bestimmen.
    3. Suchbegriffe und alternative Formulierungen erzeugen.
    4. Jede vorgeschlagene Quelle öffnen und Identität prüfen.
    5. Aussagen nur mit tatsächlich passenden Fundstellen übernehmen.
    6. Standdatum, Unsicherheit und widersprechende Ergebnisse dokumentieren.

    Beispiel

    „Erstelle Suchbegriffe für die Frage, wie KI in der Proteinstrukturvorhersage eingesetzt wird. Bevorzuge Originalpublikationen und offizielle Forschungsseiten. Erfinde keine Literaturangaben.“

    Qualitätskontrolle

    • Existiert die Quelle wirklich?
    • Ist sie primär, aktuell und fachlich passend?
    • Unterstützt sie genau die zitierte Aussage?
    • Wurden Gegenpositionen oder Einschränkungen berücksichtigt?

    Grenzen und Risiken

    • Modelle können Literaturangaben oder Zitate erfinden.
    • Suchrankings und Zusammenfassungen können verzerrt sein.
    • Paywalls oder fehlender Volltext erschweren die Prüfung.
    • Aktualität muss bei schnell wechselnden Themen ausdrücklich kontrolliert werden.

    Passende Tools und Modelle

    Geeignet sind Systeme mit nachvollziehbarer Websuche, Zitatverweisen und Zugriff auf wissenschaftliche Datenbanken. Für fachliche Arbeiten bleiben die Originalpublikationen maßgeblich.

    Quellen

  • Token

    Eine Verarbeitungseinheit, in die Text für ein Sprachmodell zerlegt wird. Ein Token kann ein Wort, Wortteil oder Satzzeichen sein.

    Einfach erklärt

    Eine Verarbeitungseinheit, in die Text für ein Sprachmodell zerlegt wird. Ein Token kann ein Wort, Wortteil oder Satzzeichen sein.

    Beispiel

    Ein langes zusammengesetztes deutsches Wort kann aus mehreren Token bestehen.

    Technische Bedeutung

    Tokenizer ordnen Textstücken numerische IDs zu. Tokenzahl beeinflusst Kontextlänge, Rechenaufwand und Kosten.

    Verwandte Begriffe

    Kontextfenster, LLM, Tokenizer

    Quellen

  • Was ist künstliche Intelligenz?

    Künstliche Intelligenz ist kein einzelnes Programm und keine denkende Maschine. Der Begriff umfasst Systeme, die aus Daten und Eingaben Muster ableiten und daraus Vorhersagen, Inhalte, Empfehlungen oder Entscheidungen erzeugen.

    Einfach erklärt

    Ein KI-System erhält Eingaben – zum Beispiel Text, Bilder, Messwerte oder Sprache – und berechnet daraus eine passende Ausgabe. Ein Spamfilter entscheidet, ob eine E-Mail verdächtig ist. Eine Bilderkennung ordnet einem Foto Begriffe zu. Ein Sprachmodell erzeugt Text.

    Das Wort „Intelligenz“ bedeutet dabei nicht automatisch, dass ein System Bewusstsein, Gefühle oder ein menschliches Verständnis besitzt. Viele KI-Systeme lösen eng begrenzte Aufgaben sehr gut, können ihre Ergebnisse aber außerhalb des gelernten Bereichs nicht zuverlässig beurteilen.

    Anschauliches Beispiel

    Ein klassisches Navigationssystem bewertet viele mögliche Routen. Ein KI-gestütztes System kann zusätzlich aus historischen Verkehrsdaten lernen, zu welchen Zeiten bestimmte Straßen häufig überlastet sind. Es erkennt statistische Zusammenhänge und nutzt sie für eine Prognose.

    Fortgeschrittene Erklärung

    Die OECD beschreibt ein KI-System als maschinenbasiertes System, das für explizite oder implizite Ziele aus Eingaben ableitet, wie es Ausgaben erzeugt. Dazu gehören Vorhersagen, Inhalte, Empfehlungen und Entscheidungen, die virtuelle oder physische Umgebungen beeinflussen können.

    KI umfasst unterschiedliche Ansätze: regelbasierte Systeme, Such- und Optimierungsverfahren, maschinelles Lernen, neuronale Netze und hybride Kombinationen. Moderne generative Systeme beruhen meist auf großen neuronalen Netzen, die aus sehr umfangreichen Datensätzen statistische Repräsentationen lernen.

    Expertenwissen

    Formal lässt sich ein KI-System als Abbildung von Eingaben auf Ausgaben betrachten. Beim maschinellen Lernen wird diese Abbildung nicht vollständig von Hand programmiert, sondern durch Optimierung von Modellparametern anhand einer Zielfunktion gelernt. Je nach System kommen Wahrscheinlichkeitsmodelle, Entscheidungsbäume, Kernelverfahren, neuronale Netze, Suchalgorithmen oder symbolische Regeln zum Einsatz.

    Autonomie und Anpassungsfähigkeit sind keine binären Eigenschaften. Ein System kann lediglich Vorschläge liefern, einzelne Entscheidungen automatisieren oder über längere Abläufe selbstständig Werkzeuge einsetzen. Die technische Leistungsfähigkeit sagt noch nichts darüber aus, ob der Einsatz rechtlich, sicher oder gesellschaftlich sinnvoll ist.

    Möglichkeiten und Grenzen

    • KI kann Muster in großen Datenmengen erkennen, Inhalte erzeugen, Prozesse unterstützen und komplexe Suchräume bearbeiten.
    • Die Qualität hängt von Daten, Zielsetzung, Modell, Einsatzumgebung und Kontrolle ab.
    • Ein plausibles Ergebnis ist nicht automatisch richtig.
    • Systeme können Verzerrungen übernehmen, vertrauliche Daten gefährden oder außerhalb ihres geprüften Bereichs versagen.
    • Bei folgenreichen Entscheidungen bleibt eine fachliche und menschliche Kontrolle erforderlich.

    Quellen

  • AlphaFold: Proteinstrukturen mit KI vorhersagen

    AlphaFold ist ein KI-System von Google DeepMind zur Vorhersage dreidimensionaler Proteinstrukturen. Die Vorhersagen ersetzen Experimente nicht, machen aber für sehr viele Proteine schnell nutzbare Strukturmodelle verfügbar.

    Einfach erklärt

    Proteine bestehen aus Ketten von Aminosäuren, die sich zu komplexen dreidimensionalen Formen falten. Diese Form beeinflusst, wie ein Protein funktioniert.

    AlphaFold berechnet aus der Aminosäuresequenz eine wahrscheinliche räumliche Struktur und gibt zusätzlich Vertrauenswerte aus. Forschende können damit Hypothesen schneller bilden und Experimente gezielter planen.

    Wissenschaftlicher Hintergrund

    AlphaFold 2 kombiniert Informationen aus multiplen Sequenzalignments mit einer speziell entwickelten neuronalen Architektur. Das System verarbeitet evolutionäre Beziehungen und geometrische Constraints und erzeugt atomare Strukturvorhersagen.

    Die Nature-Publikation von 2021 beschreibt eine stark verbesserte Genauigkeit und Ergebnisse im CASP14-Wettbewerb. Über die AlphaFold Protein Structure Database wurden Vorhersagen für sehr große Teile der bekannten Proteinwelt öffentlich zugänglich gemacht.

    Ergebnisse

    • Regelmäßig hohe Genauigkeit für viele einzelne Proteindomänen.
    • Öffentlich zugängliche Strukturvorhersagen für mehr als 200 Millionen Proteine.
    • Breite Nutzung in Biologie, Medizin, Enzymforschung und Wirkstoffentwicklung.
    • Vertrauensmaße helfen dabei, zuverlässige und unsichere Bereiche zu unterscheiden.

    Bedeutung und mögliche Anwendungen

    Strukturvorhersagen können die Planung von Experimenten, die Interpretation genetischer Varianten, die Untersuchung von Krankheitserregern und die Suche nach Wirkstoffzielen unterstützen. Sie beschleunigen Forschung, liefern aber keine vollständige Beschreibung der Dynamik und Funktion eines Proteins.

    Grenzen und offene Fragen

    • Eine Vorhersage ist kein experimenteller Nachweis.
    • Flexible, ungeordnete oder kontextabhängige Regionen bleiben schwierig.
    • Proteinbewegungen, zelluläre Umgebung und viele Wechselwirkungen werden nicht vollständig durch eine einzelne statische Struktur erfasst.
    • Für medizinische Anwendungen sind zusätzliche experimentelle und klinische Prüfungen erforderlich.

    Publikationen und Originalquellen

    Die zentrale technische Veröffentlichung erschien 2021 in Nature. Die offizielle DeepMind-Seite und die AlphaFold-Datenbank dokumentieren Zugang, Weiterentwicklungen und Anwendungsfälle.

    Quellen

  • Training

    Der Prozess, in dem ein Modell seine Parameter anhand von Daten und einer Zielfunktion anpasst.

    Einfach erklärt

    Der Prozess, in dem ein Modell seine Parameter anhand von Daten und einer Zielfunktion anpasst.

    Beispiel

    Ein Bilderkennungsmodell sieht viele beschriftete Beispiele und verringert schrittweise seine Fehler.

    Technische Bedeutung

    Training nutzt Optimierungsverfahren, Validierung und Testdaten. Gute Trainingsleistung allein beweist keine Generalisierung.

    Verwandte Begriffe

    Inferenz, Parameter, Verlustfunktion

    Quellen

  • Maschinelles Lernen

    Maschinelles Lernen ist ein Teilgebiet der KI. Ein Modell lernt aus Daten, welche Eingaben typischerweise zu welchen Ausgaben gehören, anstatt jede Regel einzeln programmiert zu bekommen.

    Einfach erklärt

    Statt einem Computer jede mögliche Regel aufzuschreiben, zeigt man ihm viele Beispiele. Aus diesen Beispielen lernt ein Modell wiederkehrende Muster. Danach kann es neue, bisher nicht gesehene Fälle einschätzen.

    Ein Lernverfahren „versteht“ die Beispiele nicht automatisch wie ein Mensch. Es verändert Zahlenwerte im Modell so, dass die berechneten Ausgaben bei den Trainingsbeispielen möglichst gut zu den gewünschten Ergebnissen passen.

    Anschauliches Beispiel

    Für eine Bilderkennung werden viele Bilder mit den Bezeichnungen „Katze“ und „Hund“ verwendet. Während des Trainings passt das Modell seine Parameter an. Bei einem neuen Bild berechnet es anschließend Wahrscheinlichkeiten für die gelernten Kategorien.

    Fortgeschrittene Erklärung

    Beim überwachten Lernen liegen Eingaben und gewünschte Zielwerte vor. Beim unüberwachten Lernen sucht ein Verfahren Strukturen in nicht beschrifteten Daten, etwa Gruppen ähnlicher Datensätze. Beim Reinforcement Learning erhält ein System Rückmeldungen in Form von Belohnungen und lernt eine Strategie für aufeinanderfolgende Entscheidungen.

    Training, Validierung und Test müssen getrennt betrachtet werden. Gute Ergebnisse auf Trainingsdaten beweisen nicht, dass ein Modell auf neue Daten verallgemeinert. Überanpassung entsteht, wenn ein Modell Besonderheiten der Trainingsdaten lernt, die außerhalb dieses Datensatzes nicht gelten.

    Expertenwissen

    Ein Modell mit Parametern θ wird häufig durch Minimierung einer Verlustfunktion L(θ) trainiert. Gradientenbasierte Optimierer verändern θ schrittweise in eine Richtung, die den Fehler auf den Trainingsdaten verringert. Generalisierung, Regularisierung, Datenverteilung und die Wahl geeigneter Bewertungsmetriken sind zentrale Bestandteile der Modellierung.

    Maschinelles Lernen ist nicht auf neuronale Netze beschränkt. Lineare Modelle, Entscheidungsbäume, Support-Vector-Machines, probabilistische Modelle und Clustering-Verfahren bleiben für viele Aufgaben sinnvoll und oft besser erklärbar.

    Möglichkeiten und Grenzen

    • Geeignet für Aufgaben, bei denen genügend repräsentative Daten und messbare Zielgrößen vorhanden sind.
    • Schlechte oder einseitige Daten führen zu entsprechend problematischen Ergebnissen.
    • Veränderte Umweltbedingungen können die Leistung nach der Einführung verschlechtern.
    • Eine hohe Durchschnittsgenauigkeit kann seltene, aber wichtige Fehler verdecken.

    Quellen

  • GraphCast: Wettervorhersage mit Graph Neural Networks

    GraphCast war ein wichtiger Forschungsmeilenstein für KI-gestützte Wettermodelle. Das System lernte aus Reanalyse-Daten und erzeugte globale Vorhersagen für zahlreiche Wettervariablen.

    Einfach erklärt

    Klassische Wettermodelle berechnen physikalische Gleichungen auf Supercomputern. GraphCast lernte aus historischen, physikalisch aufbereiteten Wetterdaten, wie sich globale Zustände typischerweise weiterentwickeln.

    Das System konnte eine Zehn-Tage-Prognose in sehr kurzer Rechenzeit erzeugen. Es ist kein gewöhnlicher Wetterdienst für Endnutzer, sondern ein Forschungsmodell und Baustein einer schnell fortschreitenden Modellfamilie.

    Wissenschaftlicher Hintergrund

    GraphCast nutzt ein Graph Neural Network, das Wetterzustände auf einem globalen Gitter und einem mehrskaligen Graphen verarbeitet. Trainiert wurde es mit ERA5-Reanalysedaten.

    Die 2023 in Science veröffentlichte Arbeit verglich GraphCast mit dem damaligen operationellen deterministischen HRES-System des ECMWF. Neuere KI-Wettermodelle wurden seitdem weiterentwickelt; GraphCast ist daher als dokumentierter Forschungsstand von 2023 einzuordnen, nicht als Aussage über das heute beste Modell.

    Ergebnisse

    • Vorhersage zahlreicher globaler Wettervariablen bis zu zehn Tage.
    • Im veröffentlichten Vergleich bessere Ergebnisse auf einem großen Anteil der geprüften Zielgrößen.
    • Sehr kurze Inferenzzeit im Vergleich zu aufwendigen numerischen Simulationen.
    • Bereitgestellter Forschungscode und Modellressourcen.

    Bedeutung und mögliche Anwendungen

    Schnelle KI-Modelle können Ensembles, Frühwarnung, Forschung und die Ergänzung numerischer Wettermodelle unterstützen. Besonders wichtig ist die Kombination mit meteorologischer Expertise, Unsicherheitsabschätzung und kontinuierlicher Validierung.

    Grenzen und offene Fragen

    • Wettervorhersagen bleiben grundsätzlich unsicher und müssen probabilistisch bewertet werden.
    • Leistung bei Extremereignissen, veränderten Klimabedingungen und seltenen Situationen muss fortlaufend geprüft werden.
    • Training beruht auf Reanalysedaten, die selbst Modelle und Messungen kombinieren.
    • Operationeller Einsatz erfordert robuste Datenpipelines, Überwachung und institutionelle Verantwortung.

    Publikationen und Originalquellen

    Die GraphCast-Arbeit erschien 2023 in Science. Google DeepMind stellt außerdem Projektinformationen und Code bereit. Die aktuelle DeepMind-Wetterforschung wird unter WeatherNext weitergeführt.

    Quellen

  • Transformer

    Eine neuronale Netzwerkarchitektur, die Sequenzen hauptsächlich mit Attention-Mechanismen verarbeitet.

    Einfach erklärt

    Eine neuronale Netzwerkarchitektur, die Sequenzen hauptsächlich mit Attention-Mechanismen verarbeitet.

    Beispiel

    Das Modell kann Beziehungen zwischen weit auseinanderliegenden Wörtern eines Satzes berücksichtigen.

    Technische Bedeutung

    Transformer kombinieren Multi-Head Attention, Feedforward-Netze, Residualverbindungen, Normalisierung und Positionsinformation.

    Verwandte Begriffe

    Attention, LLM, Token

    Quellen

  • Neuronale Netze und Deep Learning

    Ein künstliches neuronales Netz verarbeitet Zahlen durch mehrere miteinander verbundene Schichten. Beim Training werden die Verbindungsgewichte so angepasst, dass das Netz eine Aufgabe zunehmend besser löst.

    Einfach erklärt

    Ein neuronales Netz besteht aus vielen kleinen Rechenschritten. Jede Schicht nimmt Zahlen entgegen, gewichtet sie, wendet eine nichtlineare Funktion an und gibt neue Zahlen an die nächste Schicht weiter.

    „Deep Learning“ bedeutet, dass ein Netz viele Verarbeitungsschichten besitzt. Dadurch kann es aus Rohdaten schrittweise komplexere Merkmale bilden – bei Bildern zum Beispiel von Kanten über Formen bis zu ganzen Objekten.

    Anschauliches Beispiel

    Eine Bilderkennung erhält Pixelwerte. Frühe Schichten reagieren auf einfache Kontraste und Kanten. Spätere Schichten kombinieren diese Signale zu Texturen, Formen und schließlich zu Merkmalen, die für die gesuchte Kategorie relevant sind.

    Fortgeschrittene Erklärung

    Die Recheneinheiten werden üblicherweise als lineare Transformationen mit anschließender Aktivierungsfunktion umgesetzt. Beim Vorwärtslauf entsteht eine Ausgabe. Eine Verlustfunktion misst die Abweichung vom Ziel. Durch Backpropagation werden Gradienten für die Parameter berechnet und von einem Optimierer aktualisiert.

    Unterschiedliche Architekturen sind auf unterschiedliche Datenstrukturen zugeschnitten. Faltungsnetze wurden für räumliche Daten populär, rekurrente Netze für Sequenzen und Transformer für lange Abhängigkeiten sowie stark parallelisierbare Verarbeitung.

    Expertenwissen

    Tiefe Netze lernen hierarchische Repräsentationen. Ihre Ausdrucksstärke entsteht aus der Verkettung vieler affiner Transformationen und Nichtlinearitäten. Entscheidend sind nicht nur Tiefe und Parameterzahl, sondern auch Daten, Optimierungsverfahren, Regularisierung, Normierung, Architektur und Rechenbudget.

    Die internen Repräsentationen sind verteilt: Ein einzelner Parameter entspricht meist keinem klar benennbaren Wissensteil. Interpretierbarkeit und robuste Kausalität bleiben deshalb anspruchsvoll.

    Möglichkeiten und Grenzen

    • Neuronale Netze sind besonders leistungsfähig bei Bildern, Sprache, Text, Audio und komplexen Sensordaten.
    • Sie benötigen häufig große Datenmengen und erhebliche Rechenleistung.
    • Sie können empfindlich auf Datenverschiebungen und manipulierte Eingaben reagieren.
    • Ihre Entscheidungen sind oft schwer vollständig nachzuvollziehen.

    Quellen

  • Algorithmus

    Eine endliche, eindeutig beschriebene Folge von Verarbeitungsschritten zur Lösung einer Aufgabe.

    Einfach erklärt

    Eine endliche, eindeutig beschriebene Folge von Verarbeitungsschritten zur Lösung einer Aufgabe.

    Beispiel

    Ein Kochrezept ist eine anschauliche Analogie: Aus Zutaten und klaren Schritten entsteht ein Ergebnis.

    Technische Bedeutung

    In KI-Systemen können Algorithmen Daten aufbereiten, Modelle trainieren, Suchräume durchsuchen oder Ausgaben erzeugen.

    Verwandte Begriffe

    Maschinelles Lernen, Training, Modell

    Quellen