Gemini 3.5 Transcribe 支持多少种语言?
支持85种以上语言和地区变体,并能自动判断当前使用的语言。

谷歌落伍了?
谷歌发布Gemini 3.5 Transcribe语音转文本模型,号称迄今最强,可自动清理语气词、处理自我修正,支持85种以上语言和实时切换。据称实时流式词错误率4.0%,非流式2.6%,延迟较前代降低70%。网友评论认为谷歌在AI竞赛中落后,但文章认为该模型可能是语音Agent的关键基础层。
支持85种以上语言和地区变体,并能自动判断当前使用的语言。
根据谷歌引用的Artificial Analysis测评,实时流式场景平均词错误率为4.0%。
从 270 分钟到 18 分钟:B 端产品经理如何主导一个 AI 达人撮合系统
英伟达开始限制Claude使用了
HIP-3:昂贵的入场券 买不来的护城河
HTTP 新增 QUERY 方法:有人叫好,也有人质疑“这不就是 GET?”
豆包 2.1 Pro模型更新,已接入豆包工作Build an AI-powered product tagging system with Amazon SageMaker serverless model customizationSDL3 移植到 HarmonyOS / OpenHarmony
CLARITY法案投票失败 加密监管立法再度搁浅
现在参与以太坊原生质押为什么要先排队一个月?基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用
特朗普“一再让步”:美国加密法案仍未过关
豆包工作打出“团队Agent”牌,Workbuddy、千问会跟吗?
差 11 票:币圈和华盛顿的蜜月期结束了
Dense vs. MoE Models: Active Parameters, Throughput, and When to Choose Each
从担心AI失控 到AI造福人类:比尔盖茨怎么想
百度做了一堆AI产品,却没有一个能代表百度?
AI 写了几十页 PPT,“经营分析”报告仍被批不够深入?
工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!
比 MEGA Home 便宜 14 万!理想 i9 Home 上市定价 36.98 万元,六座旗舰变天了实时互动、实时改视频、探索空间视频,Vidu S2一次放了三个大招
今晚「鸽派加息」?
New insights from Google’s AI & Economy ATLAS产品已批量进入全球头部Tier 1产线,「知来具身」要为工业场景打造“开箱即用”的泛化机器人
华为坤灵升级“4+10+N”场景化方案,发布“经纬计划”和50个样板点
穿透查询怎样升级为穿透管控?
CoinShares Q2 挖矿季报:矿企倒贴钱退出
被用了几千年的铜,怎么突然成了AI时代的新宠?F-Droid 上的应用有多少是在 AI 帮助下编写的?
做了两年AI落地,我总结了这7点思考
飞书与豆包工作合体后首亮相:Agent 能进群,还能帮你写周报、做PPT