Produkte & Anwendungen
Werkzeuge, Apps und Dienste, mit denen KI in den Alltag kommt. 21 Beiträge, jeder mit seiner Quellenlage.
Hugging Face stellt mit funes eine lokale Erinnerungsschicht für Coding-Agenten vor
Das Open-Source-Werkzeug indexiert lokale Sitzungsprotokolle, kann sie optional in private Hugging-Face-Datensätze synchronisieren und soll den Abruf früherer Agentenarbeit mit Quellenangaben ermöglichen.
Google berichtet über AMIE-Studie zu klinischen Video-Sprechstunden – ausschließlich in Simulationen
In 300 standardisierten Konsultationen mit geschulten Patientendarstellern bewerteten Prüfärzte Googles medizinisches KI-System AMIE (Video) bei mehreren Kompetenzen ähnlich wie Hausärzte. Aussagen über einen Nutzen mit realen Patienten sind daraus jedoch noch nicht möglich.
ALTK-Evolve berichtet modellabhängige Vorteile von Agenten-Gedächtnis im AppWorld-Test
Ein Beitrag im Hugging-Face-Blog beschreibt eine Methode, die Verhaltensleitlinien aus früheren Agenten-Trajektorien gewinnt und zur Laufzeit einspielt. Die berichteten Resultate auf AppWorld variieren deutlich je nach Modell; unabhängige Bestätigung liegt nicht vor.
Hugging Face beschreibt hybride Sucharchitektur für Papers with Code
Die Plattform kombiniert PostgreSQL-Volltextsuche, pgvector-basierte semantische Suche und eine Fallback-Logik. Dokument-Einbettungen werden überwiegend außerhalb des Anfragepfads erzeugt.
Google startet agentisches Videoverständnis für Gemini-Flash-Modelle
Die Funktion ist über die Gemini API, Google AI Studio und die Gemini Enterprise Agent Platform verfügbar. Google verspricht weniger Tokenverbrauch und niedrigere Analyseausgaben; unabhängige Bestätigungen der Leistungswerte liegen im vorliegenden Material nicht vor.
Google beschreibt AI Mode als Hilfe für Planung, Einkäufe und verbundene Apps
In einem Blogbeitrag nennt Google neue Anwendungsbeispiele für den AI Mode in der Suche – von Kursvorschlägen auf Basis des Kalenders bis zu Produktverfügbarkeit, Tickets und Canva-Entwürfen. Unabhängige Tests liegen im Dossier nicht vor.
Google und Kaggle melden mehr als 353.000 Anmeldungen für KI-Agenten-Kurs
Laut einem Google-AI-Blogpost reichten Teilnehmende des fünftägigen Kurses „AI Agents: Intensive Vibe Coding“ mehr als 6.000 Abschlussprojekte ein. Die Materialien sind weiterhin im Selbststudium über Kaggle Learn verfügbar.
Google führt Sheets canvas für interaktive Ansichten aus Tabellen ein
Die neue Gemini-Funktion soll Daten aus Google Sheets per Texteingabe in bearbeitbare, interaktive Layouts umwandeln. Verfügbar ist sie zunächst auf Englisch für bestimmte Abonnements und Workspace-Tarife.
loveholidays meldet deutlich mehr KI-gestützte Codeänderungen mit OpenAIs Codex
In einer von OpenAI veröffentlichten Kundenfallstudie berichtet der Online-Reiseanbieter, dass der Anteil KI-unterstützter Codeänderungen binnen eines Jahres von rund 7 auf 79 Prozent gestiegen sei. Die Angaben stammen allein von den beteiligten Unternehmen und wurden nicht unabhängig geprüft.
Studie mit Bocconi-Studierenden berichtet bessere Bewertungen mit ChatGPT-Zugang
In einem randomisierten Versuch mit mehr als 1.000 Erstsemester-Studierenden an der Bocconi University wurden ChatGPT-Zugang und ein Training zu kausalem Denken getrennt und kombiniert untersucht. Die Ergebnisse stammen aus einem Beitrag von OpenAI und beruhen bislang auf einer einzelnen primären Quelle.
Google setzt Gemini 3.6 Flash als Standard für Managed Agents in der Gemini API
Neue Hooks, Zeitpläne, Token-Limits und Sandbox-Verwaltung sollen Entwicklern mehr Kontrolle über agentische Abläufe geben. Managed Agents sind laut Google nun auch im kostenlosen Tarif verfügbar.
Qwen stellt Qwen3-Coder vor und veröffentlicht Qwen Code als Open Source
Das Qwen-Team kündigt ein Mixture-of-Experts-Modell für agentisches Programmieren mit 480 Milliarden Parametern sowie ein Kommandozeilenwerkzeug für Forschungszwecke an.
OpenAI zeigt Beispiele für agentische Arbeitsabläufe bei Basis, Clay und Exa Labs
In einem Beitrag zur KI-Einführung beschreibt OpenAI Onboarding-, Account-Management- und Integrationsprozesse mit Agents und Codex. Die genannten Ergebnisse stammen aus einer Unternehmensveröffentlichung und sind nicht unabhängig überprüft.
Google rollt Musikmodell Lyria 3.5 in Flow Music aus
Google zufolge soll Lyria 3.5 in Flow Music bessere musikalische Strukturen, Liedtexte und Gesang liefern sowie mehr Kontrolle über Tempo und Dauer bieten. Unabhängige Bewertungen der Angaben liegen im vorliegenden Material nicht vor.
Google führt KI-Lernwerkzeuge in der Suche ein – Verfügbarkeit variiert je nach Funktion
Übungsquizze, generative Visualisierungen und Dateierstellung sind laut Google bereits auf Englisch verfügbar; eine interaktive Lens-Lernfunktion soll in den kommenden Wochen folgen.
Google stellt Gemini Omni 1.1 Flash für generative Video-Workflows vor
Laut Google bringt das produktionsreife Entwickler-Update Szenenverlängerung, Interpolation zwischen zwei Schlüsselbildern, Videoreferenzen sowie Vorschauen in 360p und Ausgaben bis 4K.
Google stellt Gemini 3.5 Transcribe für Echtzeit-Transkription vor
Das neue Speech-to-Text-Modell ist laut Google als öffentliche Vorschau über Gemini-APIs und die Gemini Enterprise Agent Platform verfügbar. Der Konzern meldet niedrigere Fehlerraten und geringere Latenz gegenüber Chirp 3; unabhängige Bestätigungen liegen im Dossier nicht vor.
Google DeepMind skizziert gestuften KI-Forschungsplan für das EVE-Universum
Die Partnerschaft mit Fenris Creations soll zunächst in einer vom Live-Spiel getrennten EVE-Online-Instanz starten, über EVE Frontier führen und erst bei ausgereiften Fähigkeiten mögliche Einsätze in EVE Online und EVE Vanguard prüfen.
OpenAI kündigt Epic-Anbindung und öffentliche Gesundheitsdatenquellen für ChatGPT an
Gesundheitsorganisationen können laut OpenAI autorisierten Patientenkontext aus Epic in ChatGPT for Healthcare einbinden. Ein neues Plugin soll zudem neun offizielle öffentliche Gesundheitsquellen strukturiert verfügbar machen.
Meta stellt Muse Spark 1.3 für agentische Workflows und Programmierung vor
Auf einer Entwicklerseite beschreibt Meta Muse Spark 1.3 als Modell für lang laufende agentische Aufgaben und Competitive Coding. Genannt werden multimodale Verarbeitung, ein Kontextfenster von einer Million Token sowie mehrere Zugangswege.
Google startet KI-Bildtool Google Pics für Workspace
Google zufolge wird das auf dem Modell Nano Banana basierende Tool in den kommenden Wochen für Google-AI-Pro- und -Ultra-Abonnenten sowie die meisten Workspace-Geschäftskunden freigeschaltet. Die Einbindung in Docs und Slides beginnt sofort, Drive soll folgen.