Hasty Briefsbeta

双语

Model 4: Our best model yet for local dictation and cleanup on Mac

16 hours ago
  • Epilude Model 4是本地模式的第四代设备端模型,自推出以来实现了最大的质量跃升,同时保持了1.5 GB的下载体积与速度,且所有数据均不会离开用户的Mac设备。
  • 本地模式采用双模型结构:语音模型负责将语音转为文本,清理模型则优化转录内容——包括删除填充词、修正标点、处理自我修正及匹配语调;Model 4是基于Qwen家族新微调的清理模型,专注于听写优化,未更改语音模型。
  • 评估采用零容忍标准:对改变语义或泄露指令的关键错误进行严格检测,基于90个听写场景的内部基准测试;Model 4比Model 3多通过9个场景,关键语义错误减少56%,在中途自我修正、日期、混合语言对话及随意语气处理方面表现突出。
  • 构建Model 4的核心经验表明:标注质量比数据量更重要——修正错误标注的训练样本显著提升了自我修正能力,且多轮模型权重平均方案通过消除罕见故障模式,效果优于单一模型。
  • Model 4存在局限:对冗长散漫的段落及口语化提问处理仍有困难,云端模式在整体性能上保持领先;需Apple Silicon芯片与16 GB内存以实现完整AI清理功能,但在配置较低的设备上可离线运行基础格式化,所有数据本地处理的设计保障了隐私安全且无需额外成本。