태그: #MiniCPM-o
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 1 편
전이중 음성 통화를 웹소켓으로 중계하기: 브라우저 마이크에서 GPU 모델까지
듣는 중에도 말하는 전이중 음성 모델을 브라우저에 붙이면서 웹소켓으로 무엇을 어떻게 주고받았는지 정리합니다. 왜 브라우저를 모델 서버에 바로 붙이지 않고 백엔드가 중계하는지, 소리를 몇 Hz·몇 비트·몇 초 묶음으로 보내는지, 텍스트 프레임과 이진 프레임을 어떻게 나눴는지, 몰아 보내는 클라이언트를 어떻게 막는지, 서버가 한 통화만 받을 때 웹 파드 둘에서 자리를 어떻게 지키는지를 직접 잰
2026-10-07 · 17 분 읽기 #웹소켓#전이중#음성 에이전트#MiniCPM-o#llama.cpp