companyTRANSCRIBE
BetacompanyTRANSCRIBE ist eine Transkriptionsanwendung, die wie der CompanyGPT vollständig im Microsoft-Tenant des Unternehmens betrieben wird. Sie transkribiert Audio- und Videodateien sowie Aufnahmen direkt aus dem Browser und trennt dabei automatisch die einzelnen Sprecher. Umgekehrt lässt sich mit ihr aus Text auch wieder Audio erzeugen. Die Verarbeitung erfolgt über den Azure Speech-Dienst im eigenen Tenant — es werden keine Daten an Drittanbieter außerhalb der Microsoft-Cloud übermittelt, sodass die Anforderungen der DSGVO erfüllt werden.
Sie finden die Anwendung in der Seitenleiste des CompanyGPT unter Transkribieren. Der Bereich ist für alle Benutzer mit den entsprechenden Berechtigungen sichtbar, sofern er im Tenant ausgerollt ist.
Zugang und Authentifizierung
Abschnitt mit dem Titel „Zugang und Authentifizierung“Der Zugang erfolgt ausschließlich über Microsoft Single Sign-On (SSO) mit dem bestehenden Firmenkonto. Es werden keine separaten Zugangsdaten benötigt.
Aufbau der Anwendung
Abschnitt mit dem Titel „Aufbau der Anwendung“Die Startseite Transkripte listet alle Aufnahmen auf, die Sie selbst aufgenommen oder hochgeladen haben. Über die beiden Schaltflächen oben rechts erreichen Sie die zwei Wege, auf denen ein Transkript entsteht: Hochladen für vorhandene Dateien und Aufnehmen für eine Aufnahme direkt im Browser.

Jeder Eintrag zeigt Titel, Erstellungszeitpunkt, Audiolänge und den Ersteller. Über die Symbole am rechten Rand öffnen Sie das Transkript oder löschen den Eintrag. Die Seitenleiste der Anwendung führt daneben zu den Sprachausgaben, in denen die aus Text erzeugten Audiodateien verwaltet werden.
Die Bereiche im Überblick
Abschnitt mit dem Titel „Die Bereiche im Überblick“- Aufnehmen und transkribieren — Audioquelle und Sprechererkennung wählen, im Browser aufnehmen oder eine Datei hochladen.
- Transkripte bearbeiten — Metadaten, Textkorrektur, Sprecherzuweisung und Export als Markdown.
- Sprachausgaben — Text mit einer KI-Stimme in Audio umwandeln.
- Zugriff über den CompanyGPT — Transkripte und Sprachausgaben per MCP-Server im Chat nutzen.
Unterstützte Formate und Grenzen
Abschnitt mit dem Titel „Unterstützte Formate und Grenzen“| Aspekt | Wert |
|---|---|
| Audio- und Videoformate beim Upload | z. B. .mp3, .wav, .m4a, .mp4, .webm |
| Maximale Dateigröße beim Upload | 75 MB |
| Sprechererkennung | bis zu 35 Stimmen je Aufnahme |
| Export | sprecherbeschriftete Markdown-Datei (.md) |
Bei Videodateien wird die Tonspur automatisch extrahiert. Die Transkription läuft als Auftrag im Hintergrund; der Fortschritt ist in der Anwendung sichtbar.
Datenhaltung
Abschnitt mit dem Titel „Datenhaltung“Alle Transkriptionen werden in einer benutzerbezogenen Historie gespeichert und können dort eingesehen, bearbeitet oder gelöscht werden. Sämtliche Daten verbleiben in der Microsoft-Cloud des Unternehmens.