原文语言: 中文
FunASR 性能实践:从 Queue 到 SharedMemory 与全链路并发控制
记录从单卡单实例到双卡双实例与软件优化的系统对比:50 路并发下 RTF 从 0.61 降至 0.23。结果包含硬件扩容与软件调整的共同影响,不能归因于 SharedMemory 单项优化。
已归档系统工程
研究归档
记录从单卡单实例到双卡双实例与软件优化的系统对比:50 路并发下 RTF 从 0.61 降至 0.23。结果包含硬件扩容与软件调整的共同影响,不能归因于 SharedMemory 单项优化。
在一个 Python 文件中,通过 multiprocessing 同时跑多个模型实例,实现多 GPU 绑定与并发任务调度的完整实战记录。