Medium oder Format: Text

  • Gemini

    Gemini ist Googles dialogbasierter KI-Dienst. Er unterstützt Schreiben, Planung, Ideensuche, Recherche und multimodale Aufgaben; einzelne Funktionen sind mit Google-Diensten und spezialisierten Kreativ- oder Forschungswerkzeugen verbunden.

    Funktionen

    • Texte erstellen, erklären, zusammenfassen und planen.
    • Bilder und andere Medien als Eingabe verstehen.
    • Je nach Tarif Deep Research, umfangreiche Kontexte und kreative Medienfunktionen nutzen.
    • Mit ausgewählten Google-Diensten und Arbeitsabläufen zusammenarbeiten.

    Stärken

    • Enge Einbindung in das Google-Ökosystem.
    • Multimodale Modellfamilie und mehrere Leistungs- und Kostenklassen.
    • Zugang über App, Web und Entwickler-API.

    Grenzen

    • Funktionen und Modelle unterscheiden sich nach Region, Tarif und Konto.
    • Rechercheausgaben müssen anhand der Originalquellen geprüft werden.
    • Integrationen können zusätzliche Zugriffsrechte auf persönliche oder geschäftliche Daten benötigen.

    Datenschutz und Nutzung

    Bei der Verbindung mit Google-Diensten ist genau zu prüfen, welche Datenquellen freigegeben werden und welche Kontoeinstellungen gelten.

    Preismodell und Verfügbarkeit

    Gemini ist in kostenlosen und kostenpflichtigen Angeboten verfügbar. Modellzugang, Limits und Zusatzfunktionen werden laufend angepasst.

    Offizielle Quellen

  • GitHub Copilot

    GitHub Copilot ist ein KI-gestützter Entwicklungsdienst. Er unterstützt beim Verstehen, Schreiben, Ändern und Prüfen von Code und kann je nach Produktstufe Aufgaben agentisch in Entwicklungsumgebungen oder auf GitHub bearbeiten.

    Funktionen

    • Codevervollständigung und Vorschläge für nächste Änderungen.
    • Chat und Erklärungen im Kontext eines Projekts.
    • Agentenmodus für Änderungen über mehrere Dateien, Tests und Validierung.
    • Code-Review, CLI-Unterstützung und asynchrone Aufgaben auf GitHub – abhängig vom Tarif.

    Stärken

    • Direkte Einbindung in verbreitete Entwicklungswerkzeuge.
    • Nutzung des vorhandenen Projektkontexts.
    • Unterstützung vom Entwurf bis zu Tests und Review.

    Grenzen

    • Generierter Code kann Fehler, Sicherheitsprobleme oder ungeeignete Abhängigkeiten enthalten.
    • Ergebnisse müssen getestet und von Entwicklern geprüft werden.
    • Funktionen, Modellwahl und Kontingente hängen vom Tarif ab.

    Datenschutz und Nutzung

    Organisationen sollten Ausschlussregeln, Richtlinien, Datenkontrollen und Rechte für Repository-Zugriffe festlegen.

    Preismodell und Verfügbarkeit

    GitHub Copilot wird in mehreren Tarifen für Einzelpersonen und Organisationen angeboten. Der genaue Funktionsumfang ist der aktuellen Tarifübersicht zu entnehmen.

    Offizielle Quellen

  • GPT-Modellfamilie

    Die GPT-Modellfamilie umfasst generative Modelle von OpenAI für Text, visuelle Eingaben, Programmierung, Reasoning und Werkzeugnutzung. Der konkrete Modellkatalog wird laufend aktualisiert; für technische Entscheidungen ist deshalb die offizielle Modellübersicht maßgeblich.

    Modelltyp und Fähigkeiten

    • Transformer-basierte generative Modelle für Text und weitere Modalitäten.
    • Unterstützung für mehrsprachige Aufgaben, visuelle Eingaben, Code und strukturierte Ausgaben – modellabhängig.
    • Werkzeugaufrufe, agentische Abläufe und unterschiedliche Reasoning-Stufen in aktuellen Modelllinien.

    Technische Einordnung

    GPT-Modelle erzeugen Ausgaben tokenweise auf Grundlage gelernter Wahrscheinlichkeitsverteilungen. Moderne Varianten kombinieren Vortraining, Nachtraining, Sicherheitsverfahren, Werkzeugnutzung und zusätzliche Laufzeitberechnung für komplexe Aufgaben.

    Verfügbarkeit und Zugang

    Der Zugang erfolgt über ChatGPT sowie über OpenAIs API. Modellnamen, Kontextgrößen, Preise und Endpunkte verändern sich; produktive Systeme sollten auf die offizielle Modellliste und Migrationshinweise abgestimmt werden.

    Benchmarks und Grenzen

    Benchmarks zeigen nur Ausschnitte der Leistung. Modelle können halluzinieren, bei ungewöhnlichen Verteilungen versagen und in agentischen Abläufen falsche Aktionen planen. Evaluationen müssen den realen Einsatzzweck, Kosten, Latenz und Sicherheitsanforderungen abbilden.

    Offizielle Quellen

  • Claude-Modellfamilie

    Die Claude-Modellfamilie von Anthropic umfasst Modelle mit unterschiedlichen Profilen für komplexes Reasoning, schnelle Aufgaben, Programmierung und agentische Abläufe. Konkrete Modellvarianten und Grenzwerte werden in der offiziellen Dokumentation gepflegt.

    Modelltyp und Fähigkeiten

    • Große Sprachmodelle für Text, Bilder, Code und Dokumentanalyse.
    • Unterschiedliche Modellklassen für maximale Leistungsfähigkeit, ausgewogene Nutzung und schnelle kosteneffiziente Aufgaben.
    • Werkzeugnutzung, strukturierte Ausgaben und agentische Arbeitsabläufe.

    Technische Einordnung

    Claude-Modelle sind generative Transformer-Systeme. Anthropic kombiniert Vortraining und Nachtraining mit Verfahren zur Steuerbarkeit und Sicherheit. Die Produktfamilie wird regelmäßig durch neue Modellgenerationen ersetzt oder ergänzt.

    Verfügbarkeit und Zugang

    Claude ist über Anthrophics API, die Claude-Anwendungen und ausgewählte Cloud-Plattformen verfügbar. Für stabile Integrationen sind konkrete Modell-IDs und Abschaltfristen zu beachten.

    Benchmarks und Grenzen

    Leistungsangaben sind abhängig von Aufgaben, Prompt, Werkzeugen und Evaluationsmethode. Auch leistungsfähige Varianten können Quellen erfinden, fehlerhafte Schlüsse ziehen oder Werkzeugaktionen falsch ausführen.

    Offizielle Quellen

  • Gemini-Modellfamilie

    Gemini bezeichnet Googles Familie multimodaler Modelle. Verschiedene Varianten sind auf hohe Leistungsfähigkeit, Geschwindigkeit, geringe Kosten, Echtzeit-Audio oder spezielle Aufgaben ausgerichtet.

    Modelltyp und Fähigkeiten

    • Multimodale Verarbeitung von Text, Bildern, Audio, Video und Code – abhängig vom Modell.
    • Unterschiedliche Pro-, Flash- und spezialisierte Varianten.
    • Werkzeugnutzung, lange Kontexte und Echtzeitanwendungen in ausgewählten Modellen.

    Technische Einordnung

    Gemini-Modelle werden als multimodale Foundation Models entwickelt. Die Modellfamilie umfasst verschiedene Größen und Laufzeitprofile; experimentelle Endpunkte können sich schneller ändern als stabile Varianten.

    Verfügbarkeit und Zugang

    Zugang besteht über die Gemini-Anwendungen, Google AI Studio, die Gemini API und Google-Cloud-Angebote. Für produktive Systeme sollten stabile Modellkennungen und offizielle Lebenszyklusangaben verwendet werden.

    Benchmarks und Grenzen

    Vergleiche zwischen Modellvarianten sind nur bei identischen Aufgaben und Einstellungen aussagekräftig. Multimodalität beseitigt weder Halluzinationen noch Fehler bei Bildern, langen Kontexten oder Werkzeugaktionen.

    Offizielle Quellen

  • Llama-Modellfamilie

    Llama ist eine von Meta entwickelte Modellfamilie mit veröffentlichten Gewichten. Sie wird für lokale, cloudbasierte und angepasste Anwendungen eingesetzt und umfasst Sprach- sowie multimodale Varianten.

    Modelltyp und Fähigkeiten

    • Generative Sprachmodelle für Text, Code, Reasoning und Werkzeugnutzung.
    • Multimodale Varianten für Text- und Bildverarbeitung.
    • Unterschiedliche Größen für Server, einzelne Beschleuniger und ressourcenärmere Umgebungen.

    Technische Einordnung

    Llama-Modelle sind Transformer-basierte Foundation Models. Open Weight bedeutet, dass Modellgewichte unter den jeweiligen Lizenzbedingungen heruntergeladen werden können; es bedeutet nicht automatisch uneingeschränktes Open Source.

    Verfügbarkeit und Zugang

    Modelle werden über Meta, Partnerplattformen und Modell-Repositories bereitgestellt. Lizenz, Hardwarebedarf, Quantisierung und Sicherheitskonfiguration müssen für den jeweiligen Einsatz geprüft werden.

    Benchmarks und Grenzen

    Lokale Kontrolle ist ein Vorteil, verlagert aber Verantwortung für Betrieb, Schutzmaßnahmen und Updates auf den Betreiber. Kleinere oder stark quantisierte Varianten können deutlich an Genauigkeit verlieren.

    Offizielle Quellen

  • Mistral-Modellfamilie

    Die Mistral-Modellfamilie umfasst Open-Weight- und kommerzielle Modelle mit unterschiedlichen Größen und Spezialisierungen. Sie kann über APIs, Cloud-Dienste oder teilweise selbst betrieben werden.

    Modelltyp und Fähigkeiten

    • Sprachmodelle für Text, Reasoning, Code und Werkzeugnutzung.
    • Spezialisierte Modelle und Dienste für Dokumentverarbeitung, OCR und Embeddings.
    • Unterschiedliche offene und kommerzielle Bereitstellungsformen.

    Technische Einordnung

    Mistral entwickelt Transformer-basierte Modelle mit verschiedenen Leistungs-, Größen- und Lizenzprofilen. Der Modellkatalog wird fortlaufend aktualisiert und enthält allgemeine sowie spezialisierte Endpunkte.

    Verfügbarkeit und Zugang

    Zugang erfolgt über Mistrals API und Plattform, Cloud-Partner oder bei ausgewählten Open-Weight-Modellen durch eigenen Betrieb. Lizenz und Modellkarte sind pro Variante zu prüfen.

    Benchmarks und Grenzen

    Modellgröße allein bestimmt nicht die Eignung. Sprachabdeckung, Kontext, Werkzeugunterstützung, Hardwarebedarf und reale Evaluationen sind entscheidend. Auch selbst betriebene Modelle benötigen Schutzmaßnahmen gegen Datenabfluss und missbräuchliche Eingaben.

    Offizielle Quellen

  • Whisper

    Whisper ist ein von OpenAI veröffentlichtes Modell für automatische Spracherkennung. Es kann Sprache transkribieren, Sprachen erkennen und gesprochene Inhalte aus mehreren Sprachen ins Englische übersetzen.

    Modelltyp und Fähigkeiten

    • Mehrsprachige automatische Spracherkennung.
    • Transkription von Audio in Text.
    • Spracherkennung und Übersetzung gesprochener Inhalte ins Englische.
    • Robustheit gegenüber unterschiedlichen Sprechern, Akzenten und Hintergrundgeräuschen – ohne Fehlerfreiheit.

    Technische Einordnung

    Whisper wurde auf einem großen, vielfältigen Datensatz mit mehrsprachigen und multitaskbezogenen Audiodaten trainiert. Es ist ein Encoder-Decoder-Transformer für Sequenz-zu-Sequenz-Aufgaben.

    Verfügbarkeit und Zugang

    OpenAI veröffentlichte Modellcode und Gewichte; zusätzlich ist whisper-1 über die Audio API verfügbar. Neuere Transkriptionsmodelle können bei einzelnen Aufgaben bessere Qualität oder Zusatzfunktionen bieten.

    Benchmarks und Grenzen

    Genauigkeit hängt von Sprache, Aufnahmequalität, Fachbegriffen, Sprecherwechseln und Geräuschen ab. Stille oder schwer verständliche Passagen können falsche Wörter erzeugen. Für rechtlich oder medizinisch relevante Transkripte ist eine Kontrolle erforderlich.

    Offizielle Quellen

  • Mit KI recherchieren und Quellen prüfen

    Nutze KI als Rechercheassistenten, nicht als Quelle. Entscheidend ist, ob jede wichtige Aussage auf eine tatsächlich vorhandene, passende und aktuelle Originalquelle zurückgeführt werden kann.

    Geeignet für

    • Fragestellung präzisieren
    • Synonyme und Suchbegriffe finden
    • Quellen nach Themen ordnen
    • Widersprüche zwischen Quellen sichtbar machen
    • Forschungslücken und offene Fragen sammeln

    Voraussetzungen

    Internet- oder Datenbankzugriff, klare Qualitätskriterien und ausreichend Zeit zur Prüfung der Originalquellen.

    Vorgehensweise

    1. Recherchefrage und Zeitraum festlegen.
    2. Geeignete Primärquellen und Fachdatenbanken bestimmen.
    3. Suchbegriffe und alternative Formulierungen erzeugen.
    4. Jede vorgeschlagene Quelle öffnen und Identität prüfen.
    5. Aussagen nur mit tatsächlich passenden Fundstellen übernehmen.
    6. Standdatum, Unsicherheit und widersprechende Ergebnisse dokumentieren.

    Beispiel

    „Erstelle Suchbegriffe für die Frage, wie KI in der Proteinstrukturvorhersage eingesetzt wird. Bevorzuge Originalpublikationen und offizielle Forschungsseiten. Erfinde keine Literaturangaben.“

    Qualitätskontrolle

    • Existiert die Quelle wirklich?
    • Ist sie primär, aktuell und fachlich passend?
    • Unterstützt sie genau die zitierte Aussage?
    • Wurden Gegenpositionen oder Einschränkungen berücksichtigt?

    Grenzen und Risiken

    • Modelle können Literaturangaben oder Zitate erfinden.
    • Suchrankings und Zusammenfassungen können verzerrt sein.
    • Paywalls oder fehlender Volltext erschweren die Prüfung.
    • Aktualität muss bei schnell wechselnden Themen ausdrücklich kontrolliert werden.

    Passende Tools und Modelle

    Geeignet sind Systeme mit nachvollziehbarer Websuche, Zitatverweisen und Zugriff auf wissenschaftliche Datenbanken. Für fachliche Arbeiten bleiben die Originalpublikationen maßgeblich.

    Quellen

  • Programmcode verstehen und prüfen

    Ein Sprachmodell kann Quellcode in natürlicher Sprache erklären und Änderungsvorschläge machen. Verlässlich ist das Ergebnis erst nach Ausführung, Tests, Versionsprüfung und fachlichem Review.

    Geeignet für

    • unbekannten Code erklären
    • Fehlerstellen eingrenzen
    • Tests und Dokumentation entwerfen
    • API-Nutzung anhand offizieller Dokumentation prüfen
    • kleine Prototypen vorbereiten

    Voraussetzungen

    Programmiersprache, Laufzeitversion, Bibliotheksversionen, erwartetes Verhalten und Fehlermeldung müssen genannt werden. Geheimnisse, Zugangsdaten und proprietärer Code gehören nur in freigegebene Systeme.

    Vorgehensweise

    1. Umgebung und exakte Versionen angeben.
    2. Erwartetes und tatsächliches Verhalten beschreiben.
    3. Zuerst Erklärung und Fehlerhypothesen anfordern.
    4. Nur eine Änderung nach der anderen durchführen.
    5. Tests vor und nach der Änderung ausführen.
    6. Sicherheits- und Lizenzfragen getrennt prüfen.

    Beispiel

    „Erkläre diesen Python-3.13-Code Zeile für Zeile. Ändere noch nichts. Nenne anschließend drei überprüfbare Ursachen für die Fehlermeldung und jeweils einen Test.“

    Qualitätskontrolle

    • Passt der Vorschlag zur genannten Version?
    • Laufen vorhandene und neue Tests?
    • Wurden Seiteneffekte und Fehlerbehandlung berücksichtigt?
    • Entstehen neue Sicherheitslücken oder Abhängigkeiten?

    Grenzen und Risiken

    • Modelle können nicht existierende APIs oder veraltete Parameter vorschlagen.
    • Funktionierender Code kann unsicher oder ineffizient sein.
    • Große Projekte benötigen Architekturverständnis, Tests und Code-Review.

    Passende Tools und Modelle

    Geeignet sind codefähige Sprachmodelle mit Zugriff auf das Repository, eine isolierte Ausführungsumgebung und aktuelle offizielle Dokumentation.

    Quellen