Tech & Ökosystem
Vier Hardwarelinien · ein Motor · volle Abdeckung
KI-Sprach-Engine
Aufbauend auf der internen Forschung des NEU NLP Lab haben wir die ASR-Pipeline von der traditionellen AM + LM + Decoder-Kaskade in ein End-to - End (E2E) neuronales Modell neu gestaltet. Mit der Hybridmodellierung von Conformer + CTC / Attention, kombiniert mit INT8 / INT4-Quantifizierung, Trimming, Wissensdestillation, struktureller Neuparameterierung und Operator-Fusion, erreicht der Motor Echtzeit-ASR auf CPU allein - kein GPU erforderlich. Leichtgewichtige Sprachmodellierung mit adaptive Kontextkompression reduziert die LM-Berechnung um über 70%, während die Erkennungsgenauigkeit gegenüber herkömmlichen Ansätzen um 10 - 20% verbessert wird.
- ▸E2E-Modell: Conformer + CTC / Attention-Hybrid, wodurch die Akustik - / Sprachmodellierungsfehler nicht mehr anhäuft werden
- ▸INT8 / INT4-Quantifizierung und - Beschneiden: drastisch reduzierte Parameter für Echtzeit-CPU - Inferenz
- ▸Wissensdestillation & strukturelle Re-Parameterisierung: Kompaktmodell mit hoher Verallgemeinerung
- ▸Operator Fusion & Cache-Optimierung: Verbesserte Effizienz der CPU-Matrix
- ▸Leichtgewichtige LM: interne LM + adaptive Kontextkompression, 70% Reduzierung der Rechenleistung
- ▸Context-enhanced training & restrained self-attention: hohe Genauigkeit in resource-armen Bedingungen
Accelerator-Unterstützung
- •NVIDIA: T4 / L4 / A10 / A100
- •Ascend: 310P / 910B
- •Cambricon: MLU370 / MLU590
- •Hygon DCU (nur CPU funktioniert auch)
Vollständige OA-Integration
- •WeCom
- •DingTalk
- •Feishu
- •Landray
- •Seeyon
Deployment
- •Docker / K8s One-Click
- •Bare-Metall
- •Gov Cloud / Private Cloud / SIEM
- •RESTful API / WebSocket
ASR × OCR Multimodelle Fusion
Bildschirm-Inhalt - Bewusstsein × dynamische ASR-Verstärkung
VoiVision verknüpft ASR mit auf dem Gerät OCR und nutzt den visuellen Inhalt des Bildschirms (PPT / docs / Whiteboard), um Spracherkennung zu verbessern. Der BJ66+ WCB06 erfasst den Bildschirm über drahtgebundene + drahtlose Kanäle; ein auf dem Gerät-Großmodell OCR liest den Text Frame für Frame; die Domänenwissenbasis stimmt automatisch ab und injiziert Domänenbegriffe in den ASR-Decoder - was die Genauigkeit in terminologisch dichten Szenen wie Vorträgen, Beratungen und Roadshows erhöht.
Vier-Schritte geschlossene Schleife
- ▸1 Aufnahme: BJ66+ WCB06 erfasst den Bildschirm-Byte - Stream (HDMI-in + wireless)
- ▸2 auf dem Gerät OCR: Frame-by - frame-Parsing von PPT / docs / Whiteboard-Text
- ▸3 KB-Match: 200+ Disziplin Hotword Wörterbücher Auto-Ausrichten
- ▸4 Hotword-Injektion: Domänenbegriffe werden dynamisch in den ASR-Decoder injiziert
Key Vorteile
- ✓Vollständig lokal On-Premise-Bereitstellung - Daten lassen nie Platz
- ✓Hot-swappable Domain KBs (Bildung / Gesundheitswesen / Finanzen / Recht)
- ✓Neue Domains brauchen kein ASR-Umschulung - Hotword wirkt sofort
- ✓Hotword-Injektion < 500ms, OCR auf Frame-Ebene < 500ms
OA Integration
Nahtlos mit Mainstream-Büroplattformen · Besprechungsprotokoll in Ihren Workflow
VoiVision ist tief in führende Office- und Collaboration-Plattformen integriert - automatische Besprechungsprotokoll-Synchronisierung, intelligente Todo-Extraktion, ein-Terminal - Multi-Plattform - Management- und integriert Meeting-Intelligence direkt in bestehende Workflows des Unternehmens.
WeCom
- •Kalender Synchronisierung · Kontakte
- •Approval-Flow - App-Push
- •Auto Besprechungsprotokoll synchronisieren · todo
DingTalk
- •Kalender synchronisieren · Meeting mgmt
- •DING Notify · Genehmigung
- •Alles · mehrdimensionale Blätter
Feishu
- •Kalender sync · docs
- •Msg Benachrichtigung · Meeting
- •Genehmigung · Enterprise Wiki
Landray / Seeyon
- •Ökointegration · SSO
- •Workflow Engine Link
- •Custom self-built OA
Buchen Sie eine personalisierte Demo
Erzählen Sie uns von Ihrem Meeting-Szenario und Ihren Compliance-Anforderungen - erhalten Sie einen maßgeschneiderten Plan.
