网易有道近日开源了其子曰 Live 系列的两款实时模型——Confucius4-R2T2 流式语音识别模型与 Confucius4-T3PO 流式翻译模型,这两款模型在 Hugging Face 的 ASR 和 Translation Trending 榜单上均荣登榜首。它们能够实现稳定的边说边识别、边翻译功能,其中,R2T2 模型的平均延迟控制在200至600毫秒之间,而 T3PO 模型则在保证低延迟的同时,也确保了翻译质量。自开源以来,这两款模型已获得 ZeroGPU Demo、audio.cpp、GGUF 量化和 llama.cpp/Ollama 等适配支持。
功能建议、内容纠错或使用问题,请留下联系方式,我们会尽快处理。
品牌合作、商务对接、内容共建等,请留下联系方式,我们会尽快与您沟通。
欢迎投递行业稿件。请填写联系方式并上传 Word 文档(.doc / .docx),我们会尽快审阅回复。
仅支持 .doc / .docx,建议不超过 2MB(受服务器上传限制)
如果您希望与光互连开展更多商务合作,请发邮件至:
如果您对本网站有任何建议和反馈请联系
简体中文 English