- IKT
Vizekanzlerin der Universität von Ghana fordert Integration afrikanischer Sprachen und indigenen Wissens in die KI-Entwicklung
Die Vizekanzlerin der Universität von Ghana, Prof. Nana Aba Appiah Amfo, forderte in einer Rede, das...
InnAIO bringt in Frankreich KI-Diktiergerät auf den Markt
InnAIO bringt zwei Produkte auf den Markt: das TransNote AI-Diktiergerät und den intelligenten Bilde...
Französische OVH-Gruppe plant Übernahme des KI-Sprachunternehmens Gladia
Die OVH-Gruppe (OVH Groupe) hat den Eintritt in exklusive Verhandlungen zur Übernahme des auf Sprach...
Google bringt Echtzeit-Sprachübersetzungsmodell Gemini 3.5 Live Translate auf den Markt
Am 9. Juni kündigte Google die Einführung des Echtzeit-Sprachübersetzungsmodells Gemini 3.5 Live Tra...
Microsoft bringt Windows-seitige Spracherkennungs-API und Aion-Kleinsprachmodelle auf den Markt
Vom 2. bis 3. Juni veröffentlichte Microsoft auf der Build 2026 ein Update für die Windows AI APIs, ...
Google führt für Android eine Funktion zur Erkennung falscher Anrufe ein – kann KI-Stimmklon-Betrug identifizieren
Google hat für Android eine Funktion zur Erkennung falscher Anrufe eingeführt, um sich gegen Identit...
US-Startup AethexAI sammelt 3 Millionen US-Dollar ein und zielt auf Sprach-KI in Afrika und dem Nahen Osten ab
AethexAI, ein Startup, das sich auf die Entwicklung von Sprach-KI-Produkten für die Märkte in Afrika...
Chinas JD.com veröffentlicht Open-Source-Framework JoyAI-Echo für lange Audio-Video-Generierung
Am 3. Juni hat JD.com das Framework JoyAI-Echo für die Generierung langer Audio-Video-Inhalte vorges...
Deepgram aus den USA arbeitet mit Fortanix und NVIDIA zusammen, um lokale Sprach-KI auf vertrauliches Computing umzustellen
Das US-amerikanische Unternehmen Deepgram, ein Anbieter von Echtzeit-Sprach-KI-Infrastruktur, hat kü...
MAI-Transcribe-1.5 von Microsoft in die Foundry integriert: 43-Sprachen-Transkriptionsmodell vervollständigt den Sprach-KI-Workflow
Am 2. Juni stellte Microsoft im Rahmen der Build 2026 ein neues Mitglied der MAI-Modellfamilie vor. ...
Chinas Soul App macht SoulX-Transcriber Open Source: Mehrpersonen-Dialog-Transkriptionsmodell vereint Sprecher-, Zeitstempel- und Texterkennung
Am 3. Juni haben das KI-Team von Soul App (Soul AI Lab) gemeinsam mit der Forschungsgruppe für Audio...
Tencent Cloud aus China und Soniox aus den USA fördern gemeinsam mehrsprachige Sprach-KI
Tencent Cloud hat eine strategische Partnerschaft mit dem in San Francisco ansässigen Sprach-KI-Unte...
NTT stellt multimodales erklärbares KI-Rahmenwerk für Reasoning vor – visuelle Sprachmodelle erreichen Phase der vertrauenswürdigen Ausgabekalibrierung
Die japanische NTT hat kürzlich die Einführung des multimodalen erklärbaren KI-Rahmenwerks „Rational...
Tencent Cloud aus China und Soniox aus den USA verbinden Echtzeit-Sprachtranskription mit globaler Kommunikationsinfrastruktur
Tencent Cloud aus China hat kürzlich eine strategische Partnerschaft mit dem in San Francisco ansäss...
Chinesisches Unternehmen MiniMax stellt M3-Modell vor: Millionen-Kontext treibt KI-Wettbewerb in Richtung langlaufender Agenten
Am 1. Juni brachte das chinesische KI-Unternehmen MiniMax das neue Universalmodell MiniMax M3 auf de...
Das US-Unternehmen OpenAI bringt drei Audiomodelle der GPT-Realtime-Serie auf den Markt und integriert erstmals die GPT-5-Inferenzfähigkeit in die Sprachinteraktion
Das US-Unternehmen OpenAI hat offiziell drei Echtzeit-Audiomodelle der GPT-Realtime-Serie vorgestell...