Kategorie: Technik für Sprachverarbeitung

Vizekanzlerin der Universität von Ghana fordert Integration afrikanischer Sprachen und indigenen Wissens in die KI-Entwicklung

Die Vizekanzlerin der Universität von Ghana, Prof. Nana Aba Appiah Amfo, forderte in einer Rede, das...

2026-06-15

InnAIO bringt in Frankreich KI-Diktiergerät auf den Markt

InnAIO bringt zwei Produkte auf den Markt: das TransNote AI-Diktiergerät und den intelligenten Bilde...

2026-06-12

Französische OVH-Gruppe plant Übernahme des KI-Sprachunternehmens Gladia

Die OVH-Gruppe (OVH Groupe) hat den Eintritt in exklusive Verhandlungen zur Übernahme des auf Sprach...

2026-06-12

Google bringt Echtzeit-Sprachübersetzungsmodell Gemini 3.5 Live Translate auf den Markt

Am 9. Juni kündigte Google die Einführung des Echtzeit-Sprachübersetzungsmodells Gemini 3.5 Live Tra...

2026-06-10

Microsoft bringt Windows-seitige Spracherkennungs-API und Aion-Kleinsprachmodelle auf den Markt

Vom 2. bis 3. Juni veröffentlichte Microsoft auf der Build 2026 ein Update für die Windows AI APIs, ...

2026-06-04

Google führt für Android eine Funktion zur Erkennung falscher Anrufe ein – kann KI-Stimmklon-Betrug identifizieren

Google hat für Android eine Funktion zur Erkennung falscher Anrufe eingeführt, um sich gegen Identit...

2026-06-04

US-Startup AethexAI sammelt 3 Millionen US-Dollar ein und zielt auf Sprach-KI in Afrika und dem Nahen Osten ab

AethexAI, ein Startup, das sich auf die Entwicklung von Sprach-KI-Produkten für die Märkte in Afrika...

2026-06-04

Chinas JD.com veröffentlicht Open-Source-Framework JoyAI-Echo für lange Audio-Video-Generierung

Am 3. Juni hat JD.com das Framework JoyAI-Echo für die Generierung langer Audio-Video-Inhalte vorges...

2026-06-04

Deepgram aus den USA arbeitet mit Fortanix und NVIDIA zusammen, um lokale Sprach-KI auf vertrauliches Computing umzustellen

Das US-amerikanische Unternehmen Deepgram, ein Anbieter von Echtzeit-Sprach-KI-Infrastruktur, hat kü...

2026-06-03

MAI-Transcribe-1.5 von Microsoft in die Foundry integriert: 43-Sprachen-Transkriptionsmodell vervollständigt den Sprach-KI-Workflow

Am 2. Juni stellte Microsoft im Rahmen der Build 2026 ein neues Mitglied der MAI-Modellfamilie vor. ...

2026-06-03

Chinas Soul App macht SoulX-Transcriber Open Source: Mehrpersonen-Dialog-Transkriptionsmodell vereint Sprecher-, Zeitstempel- und Texterkennung

Am 3. Juni haben das KI-Team von Soul App (Soul AI Lab) gemeinsam mit der Forschungsgruppe für Audio...

2026-06-03

Tencent Cloud aus China und Soniox aus den USA fördern gemeinsam mehrsprachige Sprach-KI

Tencent Cloud hat eine strategische Partnerschaft mit dem in San Francisco ansässigen Sprach-KI-Unte...

2026-06-03

NTT stellt multimodales erklärbares KI-Rahmenwerk für Reasoning vor – visuelle Sprachmodelle erreichen Phase der vertrauenswürdigen Ausgabekalibrierung

Die japanische NTT hat kürzlich die Einführung des multimodalen erklärbaren KI-Rahmenwerks „Rational...

2026-06-02

Tencent Cloud aus China und Soniox aus den USA verbinden Echtzeit-Sprachtranskription mit globaler Kommunikationsinfrastruktur

Tencent Cloud aus China hat kürzlich eine strategische Partnerschaft mit dem in San Francisco ansäss...

2026-06-02

Chinesisches Unternehmen MiniMax stellt M3-Modell vor: Millionen-Kontext treibt KI-Wettbewerb in Richtung langlaufender Agenten

Am 1. Juni brachte das chinesische KI-Unternehmen MiniMax das neue Universalmodell MiniMax M3 auf de...

2026-06-02

Das US-Unternehmen OpenAI bringt drei Audiomodelle der GPT-Realtime-Serie auf den Markt und integriert erstmals die GPT-5-Inferenzfähigkeit in die Sprachinteraktion

Das US-Unternehmen OpenAI hat offiziell drei Echtzeit-Audiomodelle der GPT-Realtime-Serie vorgestell...

2026-05-13