Techub News 消息,SpaceXAI 发布了其最新的语音转文本模型 Grok Voice Transcribe 2.0。该模型基于 Grok Voice 的音频基础模型构建,开发团队声称其在相同价格下,准确率是 1.0 版本的两倍,尤其擅长处理嘈杂电话线、多人对话、地方口音等复杂音频。 模型支持批处理和实时流式转录,通过 API 提供服务,定价与 1.0 版本相同,为每音频小时 0.10 美元(批处理)。SpaceXAI 报告称,该模型在公开的 Artificial Analysis 流式模型排行榜上位列第一,并在内部测试的多个数据集上均优于 1.0 版本。 该模型支持数十种语言的转录和自动语言检测,并能在单次处理中跟随录音中途的语言切换。开发者功能包括词级时间戳、说话人分离、多通道转录、关键词偏向和填充词移除等。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,SpaceXAI 发布了其最新的语音转文本模型 Grok Voice Transcribe 2.0。该模型基于 Grok Voice 的音频基础模型构建,开发团队声称其在相同价格下,准确率是 1.0 版本的两倍,尤其擅长处理嘈杂电话线、多人对话、地方口音等复杂音频。 模型支持批处理和实时流式转录,通过 API 提供服务,定价与 1.0 版本相同,为每音频小时 0.10 美元(批处理)。SpaceXAI 报告称,该模型在公开的 Artificial Analysis 流式模型排行榜上位列第一,并在内部测试的多个数据集上均优于 1.0 版本。 该模型支持数十种语言的转录和自动语言检测,并能在单次处理中跟随录音中途的语言切换。开发者功能包括词级时间戳、说话人分离、多通道转录、关键词偏向和填充词移除等。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。