Google 发布 Gemini 3.5 Transcribe 该模型可学习自定义词汇,识别订单号等字母数字串,还能为预录音频中的最多 3 名说话者标注词级时间戳。可将无结构语音整理为格式化文本,自动识别超过 85 种语言、删除语气词“嗯”“呃”等,并支持用语音指令编辑内容。 上一篇:苹果发布 M6 与 M5 Ultra 芯片 下一篇:Apple Event 将于 9 月 9 日举行 发表回复 请登录后评论...登录后才能评论 提交