跳转到主内容

新模型:说话人识别与速度

· 2 分钟阅读时间

新模型:说话人识别与速度

转录中的说话人识别以及 Gemini 3.5 Flash 的到来

日期: 2026-06-09

类别: 更新

AI-School 现已提供新模型,帮助你更高效地工作。最重要的新增功能是转录模块的新模型:gpt-4o-transcribe-diarize。借助该模型,系统可以自动识别何时轮到另一位说话人发言。这使得整理学生访谈、与同事的会议或课堂录音变得更加清晰,因为文本会直接按不同人员进行分段。

此外,我们还在语言模型阵容中加入了 Gemini 3.5 Flash。该模型专为速度和效率而设计,非常适合需要立即得到答案的任务,例如生成简短的文本建议、翻译作业,或在备课过程中快速回答问题。

你可以通过聊天中的模型选择器轻松选择新的 Gemini 模型。当你为音频录音启动转录模块时,带有说话人识别的增强转录会自动启用。

通过这些更新,我们为你的文档整理带来更多清晰度,也为你的日常工作带来更高速度。祝你使用新模型愉快!

WhatsApp