NoteGenNOTEGEN.

录音与语音转文字

配置录音记录使用的 STT 模型和识别偏好。

桌面端语音设置,包含朗读和录音识别

本页用于将实时录音或导入的音频转换为文字。文本朗读请前往朗读设置

STT 模型

在模型配置中添加 stt 类型模型,再在音频设置中选择。内置免费模型可用于基础转写;也可以使用兼容 OpenAI 音频接口的自定义服务。

使用方式

  • 在记录工具栏单击麦克风开始或停止实时录音。
  • 桌面端可通过对应操作选择已有音频文件并转写。
  • 转写完成后会创建录音记录,保留音频引用和识别文本。

识别建议

  • 授予 NoteGen 麦克风权限,并尽量在安静环境录制。
  • 长录音上传和识别时间更长,网络中断可能导致失败。
  • 模型支持的语言由服务商决定;混合语言和专业术语可能需要手动校对。
  • 使用在线 STT 时,音频会发送给模型服务商处理。