Technische Fähigkeit

On-Device
Machine Learning

Sprach-Anti-Spoofing-Modelle, trainiert, auf INT8 quantisiert und auf extrem stromsparende neuronale Prozessoren bereitgestellt. Audio-Inferenz am Mikrofon, niemals in der Cloud.

LCNNINT8 QuantisierungONNX → TFLite → NPUASVspoof 2019

Trainingspipeline

PyTorch-basierte Trainingspipeline auf ASVspoof 2019 Logical Access. Reproduzierbare Läufe mit fixierten Hyperparametern, Dataset-Versionierung und Seed-Kontrolle.

  • PyTorch + ASVspoof 2019 LA
  • Reproduzierbares Training unter Seed-Kontrolle
  • EER-Metrik über Epochen verfolgt

Quantisierung für extrem niedrigen Stromverbrauch

Post-Training-Quantisierung auf INT8 mit repräsentativem Kalibrierungssatz. Modellgröße und Inferenzlatenz werden beide deutlich reduziert; der durch die Quantisierung bedingte Genauigkeitsverlust wird durch Kalibrierung minimal gehalten.

  • PTQ mit repräsentativem Kalibrierungssatz
  • Durch Quantisierung bedingter Genauigkeitsverlust minimal gehalten
  • Speicherbedarf geeignet für eingebettete NPU

NPU-Bereitstellung

ONNX-Export → TFLite-Zwischenformat → NPU-Herstellerformatkonvertierung. Validiert auf EU-Silizium-Anbieter Embedded NPU und anderen stromsparenden Beschleunigern. Inferenzlatenz <30 ms pro Audio-Frame.

  • ONNX als Austauschformat
  • TFLite als Zwischenformat
  • Herstellerspezifische NPU-Laufzeitintegration