1. KI-Update kompakt: Gemini Omni Flash, WikiSkill, Apple-Support, DLSS-5

Google erweitert Video-KI Gemini Omni Flash

Weiterlesen nach der Anzeige

Google hat sein Video-Modell Gemini Omni Flash auf Version 1.1 aktualisiert. Anders als klassische Videomodelle erzeugt Omni Flash keine Clips aus einem einzigen Prompt, sondern fungiert als Steuerungsebene. Die neue Version nutzt bei der Verlängerung bestehender Szenen jetzt zehn Sekunden Vorlauf als Kontext, statt bisher einer. Farben, Bewegungen und Stil bleiben dadurch stabiler. Clips lassen sich in Zehn-Sekunden-Schritten auf bis zu 40 Sekunden strecken.

Neu ist auch, dass Nutzer Start- und Endbild vorgeben können und die KI den Übergang erzeugt, etwa für Kameraschwenks oder nahtlose Loops. Vorschauen in 360p laufen 60 Prozent schneller und kosten nur ein Drittel der bisherigen 720p-Variante. Wer zufrieden ist, kann anschließend auf 1080p oder 4K hochskalieren. Verfügbar ist Omni Flash 1.1 über die Gemini-API, Google AI Studio und die Gemini Enterprise Agent Platform. Ob das reicht, um an Konkurrenten wie Seedance 2.0 oder Kling 3.0 vorbeizuziehen, bleibt offen.

Sony Music und Warner verklagen Anthropic

Sony Music und Warner Music haben gemeinsam Klage gegen Anthropic eingereicht. Im Zentrum stehen Songtexte, die der KI-Assistent Claude auf Anfrage wiedergibt. Die Labels werfen Anthropic vor, geschütztes Material ohne Erlaubnis für das Training verwendet, Copyright-Hinweise ignoriert und Daten über Tauschbörsen beschafft zu haben.

Die Kläger fordern die Entfernung ihres Materials aus den Trainingsdaten und Schadensersatz in Milliardenhöhe. Als Maßstab dient ein früherer Vergleich mit Buchautoren und Verlagen über 1,5 Milliarden Dollar. Damit stehen nun alle drei großen Musiklabels gegen Anthropic.

KI-Videos ersetzen in China Schauspieler und Influencer

Weiterlesen nach der Anzeige

In China treten in immer mehr Produktionen KI-generierte Figuren an die Stelle echter Darsteller. Möglich machen das Videomodelle wie Seedance von ByteDance, dem Betreiber von TikTok. Im ersten Quartal 2026 erschienen dort dreimal so viele Kurzdramen wie im gesamten Vorjahr. Ein Branchenverband beziffert den KI-Anteil auf 95 Prozent. Eine Minute Video kostet inzwischen nur noch etwa ein Zehntel der früheren Produktionskosten.

Für die Beschäftigten hat das Folgen. Hunderttausende arbeiten in der Branche, Millionen bestreiten ihren Lebensunterhalt mit Livestreaming. Laut Financial Times müssen manche Darsteller Stimme und Aussehen an KI-Werkzeuge übertragen, bevor ihnen gekündigt wird. Anwälte melden für die vergangenen zwei bis drei Jahre deutlich mehr Arbeitsstreitigkeiten rund um KI.

KI-Agenten sollen mit eigenem Wiki aus Fehlern lernen

Ein KI-Agent, der eine Aufgabe verpatzt, beginnt beim nächsten Versuch meist bei null. Google Research hat dafür ein System namens WikiSkill entwickelt. Es legt eine dauerhafte Wissensbasis aus wiederverwendbaren Modulen an, den sogenannten Agent Skills. An den Modellparametern ändert sich nichts. Der Agent lernt also nicht wirklich dazu, sondern schreibt sich für jeden nächsten Versuch bessere Anleitungen. Das System geht auf einen Vorschlag von KI-Forscher Andrej Karpathy zurück.

Der Arbeitsbereich hat drei Ebenen: Rohprotokolle unten, das wachsende Wiki in der Mitte, aktive Anweisungen obenauf. Ein Kontrollmechanismus prüft auf Testdaten, ob Änderungen etwas bringen, und verwirft sie sonst. In Tests mit Modellen aus den Reihen Qwen, Gemma und Gemini stiegen die Trefferquoten bei mathematischem Schlussfolgern, Websuche und Tabellenbearbeitung um 15 bis 25 Prozentpunkte. Kleinere Modelle rücken damit an größere heran. Bei Aufgaben mit langen Dokumenten fällt der Zuwachs allerdings deutlich kleiner aus.

Interaktive Karte zeigt geplante Rechenzentren in Deutschland

Das Aktionsbündnis „Heiße Luft“ dokumentiert in einer interaktiven Karte, wo in Deutschland neue Rechenzentren geplant oder bereits im Bau sind. Die Bundesregierung will die Kapazität bis 2030 vervierfachen. Kritiker bemängeln fehlende Steuerung: Viele Projekte seien spekulativ und würden womöglich nie fertig.

Engpässe beim Netzanschluss bremsen den Ausbau. Kleinere Gemeinden, in denen viele Rechenzentren entstehen sollen, sind mit den Anforderungen oft überfordert. Fragen zum Wasser- und Energieverbrauch bleiben weitgehend offen.

KI-Update KI-Update

Wie intelligent ist Künstliche Intelligenz eigentlich? Welche Folgen hat generative KI für unsere Arbeit, unsere Freizeit und die Gesellschaft? Im "KI-Update" von Heise bringen wir Euch gemeinsam mit The Decoder dreimal die Woche Updates zu den wichtigsten KI-Entwicklungen. Freitags beleuchten wir mit Experten die unterschiedlichen Aspekte der KI-Revolution.

Nvidia legt Deals mit Rechenzentrumsbetreibern auf Eis

Nvidia stoppt vorerst ein neues Geschäftsmodell. Der Chiphersteller wollte kleineren KI-Infrastrukturbetreibern mehrjährige Partnerschaften anbieten: Kunden sollten Nvidia-GPUs kaufen, finanziert über einen Kredit von Nvidia, und im Gegenzug einen Teil ihres Umsatzes abgeben.

Intern gab es Bedenken. Mitarbeitende sahen darin eine zu starke Einmischung in Kundengeschäfte und einen problematischen Einsatz von Marktmacht. Das Programm ruht daher zunächst. Nvidia kann weiter auf anderen Wegen wachsen, etwa durch die Übernahme der KI-Plattform Hugging Face oder Beteiligungen an SpaceX und Intel.

Apple setzt in Shopping-App und Hotline verstärkt auf KI

Apple stellt seinen Kundensupport in den USA teilweise auf KI um. Die offizielle Support-Hotline ist laut Medienberichten beim ersten Kontakt mit einer generativen KI besetzt, die möglichst viele Fragen direkt beantworten soll. Wer einen Menschen sprechen möchte, muss explizit danach fragen und potenziell warten. Ziel ist offenbar, das Anrufvolumen in den Call-Centern zu senken. In Europa hat Apple die Telefon-KI bislang nicht ausgerollt.

Auch die Apple-Store-App auf dem iPhone bekommt einen KI-gestützten Einkaufsratgeber auf Basis eines Chatbots, zunächst als Vorschau-Version.

Empfohlener redaktioneller Inhalt

Mit Ihrer Zustimmung wird hier ein externer Podcast (Podigee GmbH) geladen.

Podcast jetzt laden

Siemens-Chef warnt vor zu viel KI-Regulierung

Siemens-Chef Roland Busch kritisiert, dass Regelwerke wie der EU AI Act zu langsam entstehen. In derselben Zeit entwickelten sich KI-Modelle mehrfach weiter. Regulierung hinke der Technologie stets hinterher.

Auch vor pauschalen Zöllen gegen China warnt Busch. Chinesische Unternehmen seien echte Wettbewerber mit starker Innovationskraft. Die Sorge vor einer KI-Spekulationsblase teilt er nicht: Die Investitionen stammten überwiegend aus dem Cashflow profitabler Unternehmen. Siemens selbst profitiert stark von der Nachfrage nach KI-Rechenzentren.

Meta wollte sich laut Reuters von Grund auf umbauen. Unter dem Namen „Project OT“ sollten tausende Stellen wegfallen und KI-Systeme einen Großteil der täglichen Arbeit übernehmen. Manche Abteilungen wären um bis zu 60 Prozent geschrumpft. Vorbild waren KI-Start-ups mit KI-zentrierter Betriebsstruktur. Wenige Stunden vor der geplanten Ankündigung am 20. Mai stoppte Konzernchef Mark Zuckerberg den Plan. Stattdessen gab Meta eine kleinere Entlassungswelle bekannt.

Für den Kurswechsel scheint es zwei Gründe zu geben. In der Belegschaft hatte sich Unmut aufgebaut, auch wegen einer Tracking-Software, die Mausbewegungen und Tastenanschläge aufzeichnete. Die Mitarbeiterzufriedenheit brach ein, Gewerkschaftsbestrebungen wuchsen. Zudem lieferte die KI nicht wie erhofft. Die Menge automatisch erzeugten Codes stieg zwar stark, die Produktivität kaum. Infrastrukturteams warnten vor unzuverlässiger Programmierung, unkontrollierte Agenten führten laut internen Berichten „großangelegte, störende Aktionen“ aus. Zuckerberg räumte im Juli Fehleinschätzungen ein. Die zweite geplante Umstrukturierungswelle im November wurde gestrichen.

OpenAI sperrt Coding-Tool Cursor nach Musk-Übernahme aus

OpenAI beendet den Vertrag mit dem KI-Coding-Tool Cursor, nachdem SpaceX das Unternehmen übernommen hat. Zur Begründung nennt OpenAI fehlendes Vertrauen, dass Elon Musks Firmen die Nutzungsbedingungen einhalten. Der Vertrag läuft im November aus. Hintergrund ist ein langer Konflikt: Musk soll nach der Twitter-Übernahme einen Lizenzvertrag gebrochen und Daten fremder KI-Modelle für eigene Trainings genutzt haben.

OpenAI betont, die Maßnahme richte sich gezielt gegen Musk, nicht gegen KI-Coding-Tools allgemein. Anthropic nutzte die Lage, um sich als verlässlicher Partner zu positionieren, und will die Kapazitäten für Claude in Cursor ausbauen. Zuvor hatte allerdings auch Anthropic der Konkurrenz den API-Zugang entzogen.

OpenAI regelt Werbung in ChatGPT

OpenAI verankert Werbung offiziell in seinen Datenschutzbestimmungen. Anzeigen erscheinen künftig in der kostenlosen und der Einsteiger-Variante von ChatGPT, kostenpflichtige Abonnements bleiben werbefrei. Zum Start setzt OpenAI auf kontextbasiertes Targeting: Anzeigen richten sich nach dem Inhalt des aktuellen Gesprächs, nicht nach gespeicherten Profilen oder früheren Chats.

Personalisierte Werbung soll nur mit ausdrücklicher Einwilligung möglich sein. Werbetreibende erhalten ausschließlich anonymisierte Auswertungen. OpenAI stützt sich auf das Instrument des berechtigten Interesses und versucht so den Spagat zwischen lukrativen Einnahmen und den Vorgaben der Datenschutz-Grundverordnung.

DLSS 5 als Mod ausprobiert

Nvidias KI-Technik DLSS soll Spiele mit einem generativen Modell aufhübschen. Nach den ersten, fotorealistisch verfremdeten Gesichtern folgte Kritik. Als Mod in „Kingdom Come Deliverance 2“ zeigt die Vorabversion aber auch das Potenzial. Besonders das Shading gewinnt: Töpfe und Kohlköpfe werfen Schatten auf einem Marktstand, Pastinaken feine Kontaktschatten, Ketten Schatten auf Oberkörper. Das Gemüse wirkt nicht mehr, als schwebe es in der Luft. Drei Presets, offenbar von Nvidia selbst, lassen sich per Regler feinjustieren, Gesichter kann man ausnehmen.

Die Rechenkosten sind allerdings hoch. Die Bildrate halbiert sich in etwa, selbst mit einer 2000 Euro teuren High-End-Grafikkarte wird es in hohen Auflösungen knapp. Die Effektstärke zu senken hilft nicht, die Kosten bleiben. Auch die Bildstabilität hakt noch. Vieles, was gerade in sozialen Medien kursiert, ist der Worst Case: die Mod wirft den Algorithmus unreflektiert über das gesamte Bild. Bauen Entwickler die Technik selbst gezielt ein, dürfte sich die Debatte um die künstlerische Vision entspannen.

Pollen Robotics bringt Roboter-Ente auf den Markt

Pollen Robotics, ein französisches Robotikunternehmen, verkauft mit Microduck einen gehfähigen Roboter in Entenform für rund 440 Euro. Das Gerät richtet sich an KI-Enthusiasten, Forschende und Bildungseinrichtungen und soll die Brücke zwischen KI-Entwicklung und physischer Robotik schlagen.

Ausgestattet ist Microduck mit Kamera, Abstandssensor, Mikrofon und Bewegungsaktoren, mit dem Schnabel kann er sogar greifen. KI-Werkzeuge lassen sich nutzen, sind aber nicht Pflicht: Auch ein handgeschriebenes Python-Skript steuert die Ente. Die gesamte Software ist quelloffen.

KI rekonstruiert erstes Bundesliga-Tor von 1963

Borussia Dortmund und Vodafone haben das erste Tor der Bundesligageschichte, erzielt von Dortmunds Timo Konietzka 1963, per KI rekonstruiert. Von dem Treffer existieren weder Foto- noch Filmaufnahmen.

Grundlage waren Zeitzeugenberichte, Archivmaterial und Medienberichte aus der Zeit. Daraus erstellten die Beteiligten Bewegungsmodelle, leiteten das wahrscheinliche Wetter ab und erzeugten die Stadionatmosphäre per KI. Die U19-Mannschaft des Vereins stellte die Spielsituation nach. Das Ergebnis läuft als Dokumentation auf YouTube.

(igr)

Dieser Link ist leider nicht mehr gültig.

Links zu verschenkten Artikeln werden ungültig, wenn diese älter als 7 Tage sind oder zu oft aufgerufen wurden.


Sie benötigen ein heise+ Paket, um diesen Artikel zu lesen. Jetzt eine Woche unverbindlich testen – ohne Verpflichtung!