Zum Inhalt
Alle Plattform-Editionen

Plattform-Edition

Microsoft AI

Microsoft AI für macOS

Mitgeliefert

Microsoft MAI Transcribe über Azure Speech, mit Spracherkennung, Wörterbuch-Biasing, Transkriptionsstilen, Segment-Zeitstempeln und optionaler Sprechererkennung.

Version
1.0.0
Plugin-ID
com.typewhisper.microsoft-ai
Anforderungen
TypeWhisper 1.7.0 oder neuer · macOS 14.0 oder neuer · Eine Azure-Speech-Ressource in einer unterstützten MAI-Region und ihr API-Key

Einblick in diese Edition

Microsoft-AI-Einstellungen in TypeWhisper für macOS
Azure-Speech-Endpunkt und API-Key im Schlüsselbund, MAI-Transcribe-Modell, Transkriptionsstil und Sprechererkennung.

Funktionen dieser Edition

  • Cloud-Transkription mit MAI Transcribe 2 und MAI Transcribe 1.5
  • Automatische Spracherkennung oder ein eindeutiger Sprachhinweis
  • Fachbegriffs-Biasing mit bis zu 500 Wörterbucheinträgen
  • Bereinigter und wörtlicher Transkriptionsstil
  • Segment-Zeitstempel und optionale Sprecherlabels mit MAI Transcribe 2
  • Foundry-Modellsuche mit lokal zwischengespeichertem Fallback-Katalog

Einstellungen dieser Edition

  • Azure-Speech-Endpunkt oder Ressourcenname und API-Key im macOS-Schlüsselbund speichern
  • MAI Transcribe 2 oder ein kompatibles gefundenes Modell auswählen
  • Microsoft-Foundry-Modellkatalog bei Bedarf aktualisieren
  • Bereinigten oder wörtlichen Transkriptionsstil auswählen
  • Sprechererkennung aktivieren, wenn MAI Transcribe 2 Sprecher kennzeichnen soll

Verfügbarkeit

Microsoft AI 1.0.0 ist als Plugin-Release für TypeWhisper unter macOS verfügbar. Es benötigt TypeWhisper 1.7.0 und macOS 14 oder neuer. Microsoft kennzeichnet MAI Transcribe in Azure Speech derzeit als Vorschau.

Was das macOS-Add-on macht

Das Add-on stellt eine Cloud-Transkriptions-Engine bereit: Microsoft AI (MAI Transcribe). Wenn eine Mikrofonaufnahme endet oder eine Audiodatei übergeben wird, normalisiert TypeWhisper sie als WAV und sendet sie an die verbundene Azure-Speech-Ressource. Die Antwort kann erkannte Sprache, Textsegmente, Zeitangaben und Sprecherinformationen enthalten.

Diese Edition streamt keinen Teiltext und unterstützt weder Übersetzungen noch LLM-Workflows oder Text-to-Speech. Der integrierte Katalog enthält MAI Transcribe 2 und MAI Transcribe 1.5. Eine erfolgreiche Aktualisierung ergänzt kompatible MAI-Modelle aus Microsoft Foundry und speichert sie lokal zwischen.

Einstellungen

EinstellungFunktion
Endpunkt oder RessourcennameAkzeptiert den Azure-Speech-HTTPS-Endpunkt ohne Pfad oder nur den Ressourcennamen. Aus einem reinen Namen wird https://<name>.cognitiveservices.azure.com.
API-KeySpeichert den Speech-Ressourcen-Key im macOS-Schlüsselbund. Der Augen-Button blendet den Wert während der Bearbeitung ein oder aus.
Verbindung speichern/aktualisierenNormalisiert und speichert Endpunkt und Key. Beim Speichern einer vollständigen Verbindung versucht das Add-on auch, den Modellkatalog zu aktualisieren.
EntfernenLöscht den gespeicherten API-Key. Die Transkriptions-Engine bleibt danach bis zum Speichern eines neuen Keys nicht verfügbar.
ModellWählt standardmäßig MAI Transcribe 2, MAI Transcribe 1.5 als Fallback oder ein anderes kompatibles gefundenes Modell.
Aktualisieren-SymbolRuft über den gespeicherten Azure-Endpunkt den Foundry-Modellkatalog ab. Integrierte und zwischengespeicherte Modelle bleiben bei einem Fehler verfügbar.
TranskriptionsstilBereinigt entfernt Füllwörter für bessere Lesbarkeit. Wörtlich erhält Füllwörter, Fehlstarts und Selbstkorrekturen.
SprechererkennungFordert mit MAI Transcribe 2 Sprecherlabels an. Für MAI Transcribe 1.5 ist der Schalter deaktiviert.

Die Einstellungen warnen, wenn ein erkennbarer regionaler Endpunkt außerhalb von East US, North Europe, Southeast Asia oder West US liegt.

Einrichtungs-Tutorial

  1. Aktualisiere TypeWhisper auf Version 1.7.0 oder neuer.
  2. Erstelle im Azure-Portal eine Microsoft-Foundry-Ressource für Speech in eastus, northeurope, southeastasia oder westus.
  3. Kopiere aus der Ressource den Speech-Endpunkt oder Ressourcennamen und einen API-Key.
  4. Öffne TypeWhisper > Einstellungen > Integrationen.
  5. Suche Microsoft AI unter Entdecken, installiere das Add-on und stelle sicher, dass es aktiviert ist.
  6. Öffne die Einstellungen, gib Endpunkt und API-Key ein und wähle Verbindung speichern.
  7. Lass MAI Transcribe 2 ausgewählt, lege den Transkriptionsstil fest und aktiviere die Sprechererkennung nur bei Bedarf.
  8. Wähle Microsoft AI als Transkriptions-Engine eines Profils und teste eine kurze Aufnahme.

MAI Transcribe verwenden

  1. Wähle Microsoft AI als Transkriptions-Engine in dem TypeWhisper-Profil, das Azure verwenden soll.
  2. Lege eine Eingabesprache fest, wenn du sie sicher kennst. Lass die Auswahl für automatische Erkennung oder gemischtsprachiges Audio offen.
  3. Ergänze Produktnamen, Personen, Abkürzungen und Fachvokabular im TypeWhisper-Wörterbuch. Das Plugin sendet höchstens 500 Begriffe mit insgesamt 20.000 Zeichen als Phrasenhinweise.
  4. Nutze Bereinigt für lesbare Notizen oder Untertitel und Wörtlich, wenn die genaue gesprochene Form wichtig ist.
  5. Aktiviere die Sprechererkennung vor der Aufnahme oder dem Import von Audio mit mehreren Personen. Die Funktion benötigt MAI Transcribe 2.
  6. Prüfe das fertige Ergebnis, nachdem Azure geantwortet hat; während der laufenden Aufnahme erscheint kein Teiltranskript.

Mit MAI Transcribe 2 fordert TypeWhisper Segment-Zeitstempel an. Gibt Azure Sprecherinformationen zurück, behält das strukturierte Ergebnis das Label pro Segment und der sichtbare Text nutzt Zeilen wie Speaker 1: ....

Audiogrenzen

Das macOS-Plugin akzeptiert normalisiertes WAV-Audio bis zu zwei Stunden und bis zu 300 MB. Größere Eingaben werden vor dem Upload abgelehnt. Jede Azure-Anfrage hat ein Netzwerk-Timeout von drei Minuten; das verändert die maximale Aufnahmelänge nicht.

Fehlerbehebung

  • Die Verbindung lässt sich nicht speichern: Nutze einen Azure-Speech-HTTPS-Endpunkt ohne zusätzlichen Pfad, Query-Parameter, Benutzerinformationen oder Fragment. Alternativ kannst du nur den Ressourcennamen eingeben.
  • MAI Transcribe ist in dieser Region nicht verfügbar: Erstelle oder nutze eine Speech-Ressource in East US, North Europe, Southeast Asia oder West US.
  • Foundry-Katalog nicht verfügbar: Die verbundene Speech-Ressource stellt möglicherweise keinen Modellkatalog-Endpunkt bereit. MAI Transcribe 2 und 1.5 bleiben lokal verfügbar.
  • Es erscheinen keine Sprecherlabels: Wähle MAI Transcribe 2, aktiviere die Sprechererkennung vor der Transkription und prüfe, ob Azure Sprecherinformationen geliefert hat.
  • Die Übersetzung schlägt fehl: Das Plugin lehnt Übersetzungsanfragen bewusst ab, weil MAI Transcribe sie über diese Integration nicht unterstützt.
  • Die Authentifizierung schlägt fehl: Kopiere erneut den Key, der zu derselben Azure-Speech-Ressource wie der Endpunkt gehört, und aktualisiere die Verbindung.

Cloud-Verarbeitung und Datenschutz

Audio wird zur Transkription an Microsoft Azure gesendet. Der API-Key liegt im macOS-Schlüsselbund. Endpunkt, gewähltes Modell, zwischengespeicherte Modell-IDs, Stil und Einstellung zur Sprechererkennung bleiben lokale Plugin-Einstellungen. Prüfe Microsofts aktuelle Azure-Bedingungen zu Datenschutz, Vorschau, regionaler Verfügbarkeit und Preisen, bevor du sensible Audiodaten überträgst.

Quellen: Microsoft-Dokumentation zu MAI Transcribe, Microsoft-AI-Plugin-Quellcode