<rss xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title>LiveKit - 标签 - 研发日志 · R&amp;D Log</title><link>https://rd163.visword.com/tags/livekit/</link><description>LiveKit - 标签 - 研发日志 · R&amp;D Log</description><generator>Hugo -- gohugo.io</generator><language>zh-CN</language><managingEditor>whutluohui@gmail.com (小智晖)</managingEditor><webMaster>whutluohui@gmail.com (小智晖)</webMaster><copyright>本作品采用知识共享署名-非商业性使用 4.0 国际许可协议进行许可。</copyright><lastBuildDate>Sat, 23 Aug 2025 00:00:00 +0800</lastBuildDate><atom:link href="https://rd163.visword.com/tags/livekit/" rel="self" type="application/rss+xml"/><item><title>实时语音转文字</title><link>https://rd163.visword.com/posts/realtime_audio_to_text/</link><pubDate>Sat, 23 Aug 2025 00:00:00 +0800</pubDate><author><name>小智晖</name></author><guid>https://rd163.visword.com/posts/realtime_audio_to_text/</guid><description>&lt;p>实时语音转文字（Real-time Automatic Speech Recognition，简称实时 ASR）是会议纪要、字幕生成、语音助手等场景的基础能力。与「先录音再转写」的离线模式不同，实时方案需要在用户说话的同时，把浏览器或终端采集到的音频流低延迟地送到识别引擎，并把识别结果以流式方式回传给前端。本文先梳理一条端到端链路涉及的核心组件，再介绍开源项目 IntraScribe 的实现思路，以及 fastrtc、FunASR 等关键框架的定位与用法。&lt;/p></description></item></channel></rss>