Core Technology

Proprietary
Speech & Voice AI Stack

오울소프트는 ASR·TTS·AI Data·Edge AI 핵심 엔진을 외부 의존 없이 자체 보유합니다. End-to-End Streaming Transformer 기반의 원천기술로 서버부터 온디바이스까지 실시간 음성지능을 제공합니다.

ASR

음성인식

Automatic Speech Recognition

스트리밍 트랜스포머 기반 End-to-End 음성인식 엔진을 자체 보유합니다. CTC 기반 경계검출과 blockwise beam search로 서버부터 엣지 단말까지 실시간 인식을 제공합니다.

  • Streaming Transformer · CTC · Beam Search
  • On-Device / Server-Client / On-Premise
  • WER 3.76–9.25% · RTF 0.84 · Raspberry Pi 4B
E2E ASRStreaming TransformerCTCBeam SearchRTF
TTS

음성합성

Neural Text-to-Speech

고품질 음성 데이터 기반의 Neural TTS. 소용량·고품질(compact & high-fidelity) 합성으로 자연스러운 프로소디(prosody)를 구현합니다.

  • Neural Vocoder · Prosody Modeling
  • Compact & High-Fidelity Synthesis
  • 안내·응대·콘텐츠 내레이션
Neural TTSVocoderProsodyVoice Cloning
DATA

AI 데이터 구축

AI Training Data Pipeline

자체 authoring tool 기반의 데이터 파이프라인. Speech corpus 설계부터 annotation·diarization·QA까지 고품질 학습데이터를 구축합니다.

  • Speech Corpus Design · Annotation · Diarization
  • 저작도구(Authoring Tool) 자체 개발
  • 데이터사업자 신고 · 데이터바우처 공급기업
Speech CorpusAnnotationDiarizationData Voucher
SOLUTION

접근성 · 온디바이스 AI

Accessibility & Edge AI

청각장애인·고령자를 위한 STT/TTS와 Edge-AI 배리어프리 솔루션, 클라우드 기반 AI 서비스를 제공합니다.

  • Barrier-free Kiosk · Vision-AI
  • Edge Inference · On-device Deployment
  • Cloud AI · Healthcare Voice
Edge AIBarrier-freeVision-AICloud Inference
Technology Stack

보유 기술 스택

오울소프트와 오유리 대표의 주요 연구·보유 기술입니다. 다이어그램 표시가 있는 기술은 마우스를 올리면 미리보기, 클릭하면 크게 볼 수 있습니다.

Benchmark · INTERSPEECH 2021

On-Device Streaming Transformer
End-to-End ASR

임베디드 IoT 기기에서 스트리밍 트랜스포머 음성인식을 실행한 세계 최초 실증. Context block encoder + blockwise-synchronous beam search + CTC boundary detection.

0
Word Error Rate
Librispeech, best
0
Real-Time Factor
RTF, faster than real-time
0
Avg. Latency
0.75 ± 0.62 s
0
Raspberry Pi
Edge deployment
Data Pipeline

AI 학습데이터 End-to-End Pipeline

01
수집
Collection
다중 화자·환경 음성 수집, 크라우드소싱
02
전사·라벨링
Annotation
전사(transcription)·타임스탬프·화자분리
03
화자분리
Diarization
Speaker Diarization · Segmentation
04
정제·검수
Validation
QA·consistency check·inter-annotator
05
코퍼스화
Corpus
Balanced Speech Corpus 설계
06
납품·활용
Delivery
AI-Hub·학습셋 포맷 변환·검증
Technology Keywords

Speech & Language AI Expertise

Automatic Speech RecognitionNeural Text-to-SpeechEnd-to-EndStreaming TransformerCTC · Beam SearchOn-Device InferenceEdge AIReal-Time FactorSpeech CorpusSpeaker DiarizationProsody ModelingMLLR / MAP AdaptationPronunciation ModelingWord Error RateMultimodal AILLM Fine-tuningVoice CloningBarrier-free AI

기술 도입을 검토 중이신가요?

기술 문의하기