TL;DR
- OpenVoiceOS(OVOS) 블로그가 음성 인증, 번역, 읽기 파이프라인, 라이선스, 터미널 클라이언트, 음성 서버 연동에 관한 최신 글을 소개함.
- 새 웨이크 워드 검증 플러그인이 등록된 가정 내 화자의 음성을 인식해 TV 광고나 손님과 구별함.
- OVOS Localize가 GitHub에서 번역 편집기, 자동 풀 리퀘스트(PR) 파이프라인, 검증 엔진, 공개 머신러닝(ML) 데이터셋을 제공하며 자체 인프라를 운영할 필요가 없음.
- 2018년 Mycroft 동화 스킬을 출발점으로 8개 제공자를 아우르는 OVOS 공통 읽기 파이프라인이 만들어짐.
- 여러 음성 합성·인식 프로그램의 인공지능(AI) 기반 포팅과 라이선스 문제, OVOS용 터미널 클라이언트, UTCP 및 MCP를 통한 음성 서버 연동, macOS 설치 도구가 소개됨.
주요 기사
- “치즈버거 주문은 본인만 가능”: OVOS에 화자 인증 도입 — 새 웨이크 워드 검증 플러그인이 OpenVoiceOS에 말한 내용뿐 아니라 누가 말하는지도 인식하도록 함. 등록된 가정 내 화자는 웨이크 게이트를 통과하고, TV 광고와 재미있다고 생각하는 손님의 음성은 통과하지 못함.
- 게시일: 2026년 9월 26일
- 게시자: JarbasAI 외 1명
최신 글
- OVOS Localize: 유지 관리가 필요 없는 GitHub 번역 플랫폼 — OpenVoiceOS 스킬을 위한 번역 플랫폼으로, 문맥을 반영하는 편집기, 자동 PR 파이프라인, 음성 비서 파일 유형에 맞춘 검증 엔진, 공개 ML 데이터셋을 제공함. 자체 운영 인프라 없이 GitHub에서 전부 실행되며, GitHub 계정만 있으면 되고 누구나 포크할 수 있음.
- 게시일: 2026년 9월 19일
- 게시자: Claude (Anthropic) 외 1명
- 동화 스킬 하나에서 완성된 읽기 파이프라인 플러그인까지 — 2018년 Mycroft 동화 스킬과 두 번의 실패, Jarbas의 즉흥적인 발언 하나가 어떻게 OVOS용 8개 제공자 공통 읽기 파이프라인으로 이어졌는지 다룸.
- 게시일: 2026년 9월 12일
- 게시자: andlo
- 기계로 포팅하기와 답할 수 없었던 라이선스 문제 —
espeak-ng의 자소-음소 변환기(G2P), Cotovia, AhoTTS, HermiT 등 여러 C, C++, Java 프로그램을 순수 Python으로 다시 작성함. 인공지능이 원본 소스를 읽고 사람이 작업을 조율했으며, 작업에 참여한 사람 중 원본을 직접 읽은 사람은 없음. 결과물의 소유권이 성립하는지, 결과물이 입력의 2차적 저작물인지라는 두 가지 질문이 남음. 답을 내리는 것보다 비용이 적게 든다는 이유로 상위 프로젝트의 라이선스를 유지했으며, 이 문제는 여전히 미해결이라고 봄. - 게시일: 2026년 8월 2일
- 게시자: JarbasAI
- OVOS에 없던 터미널 클라이언트 — 마이크나 스피커 없이 OVOS를 테스트할 수 있는 텍스트 사용자 인터페이스(TUI) 클라이언트를 만든 이유와, 로그를 계속 살펴보는 것만으로는 발견하지 못했을 몇 가지 실제 버그를 다룸.
- 게시일: 2026년 7월 24일
- 게시자: andlo
- 어떤 AI 에이전트에서든 OVOS 음성 서버 호출 — OVOS 음성 인식(STT), 음성 합성(TTS), 번역 서버가 이제 UTCP를 통해 자신을 설명하고 MCP 엔드포인트를 연결함. 두 프로토콜 중 하나를 사용하는 에이전트라면 별도 클라이언트나 래퍼 코드 없이 서버를 검색하고 호출할 수 있음.
- 게시일: 2026년 7월 15일
- 게시자: JarbasAl
- macOS에서도 간편한 설치:
ovos-installer, 인텔 및 Apple Silicon 지원 —ovos-installer가launchd와virtualenv를 사용해 인텔 및 Apple Silicon 기반 macOS에 OpenVoiceOS를 배포함. - 게시일: 2026년 3월 5일
- 게시자: Gaëtan Trellu
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요