Whisper
Whisper 适合需要成熟参数控制、VAD 静音检测以及 CPU、NVIDIA 或 AMD 后端选择的工作流。可根据设备性能选择模型,并使用提示词、分段长度和过滤策略控制结果。
产品能力
从识别引擎到项目交付,功能按实际工作顺序组织。你可以只使用本地能力,也可以按需接入自己的 AI 服务。
Transcription
两套本地引擎覆盖不同硬件与工作方式。Voxly 负责媒体预处理、依赖检测、任务记录和字幕段生成,避免把运行环境交给用户手动拼装。
Whisper 适合需要成熟参数控制、VAD 静音检测以及 CPU、NVIDIA 或 AMD 后端选择的工作流。可根据设备性能选择模型,并使用提示词、分段长度和过滤策略控制结果。
Qwen3-ASR 0.6B 使用 Qwen3-ForcedAligner 0.6B 生成词级时间戳。便携运行时支持 NVIDIA CUDA 与 CPU;显存不足时会明确提示回退策略,不会静默改变执行方式。
Editing
转录结果直接进入可操作的字幕列表。所有修改围绕时间轴和可恢复性展开,适合访谈、课程、播客、影视对白与长视频整理。
Knowledge Base
知识库把一次性的人工修正变成可复用资产。它不会代替最终审核,但能显著减少相同术语在多个项目中反复出错。
管理人名、地名、品牌名和行业术语。转录时可将相关词条注入提示词,AI 校对时也可作为约束上下文。
保存常见的错误词与正确写法。手动修正或 AI 校对产生的词对可用于后续任务,逐步形成自己的质量基线。
导入原始剧本后,对齐功能可比较转录字幕与剧本内容,标记误读、漏读和多字片段,并在确认后应用修改。
AI Assistant
在线 AI 功能使用你配置的 DeepSeek、OpenRouter 或自定义 OpenAI 兼容接口。处理范围、提示词和结果应用都需要用户显式确认。
Projects & Delivery
任务数据采用独立 .voxly 工程文件。项目可以搜索、重命名、切换、自动保存和手动备份,不依赖一个集中数据库承载全部工作。
.voxlypkg 项目包可同时包含任务数据、关联媒体和字幕文件。导入后自动恢复关联,适合跨设备迁移、交接和长期归档。
对白类任务可在 AI 预校验后整理并导出为 DOCX 剧本文档,自动区分说话人并使用颜色帮助阅读和审校。
完成字幕后可以继续进入专业后期,不需要重新手工搭建时间线或复制大量中间文件。
将字幕与关联媒体发送到 REAPER,以时间线条目继续调整。脚本支持安装路径检测,也保留手动导入的退路。
独立合成器支持音视频、字幕和图片素材,提供预览、字幕样式、封面、转场、马赛克与 MP4 导出;视频编辑器提供多轨、剪切、混音、变速和导出流程。
Accessibility
界面操作不依赖鼠标悬停或视觉定位。重要操作需要明确触发,后台处理会播报状态,焦点不会因为列表刷新而无故跳走。
15 天试用