产品能力

一套完整的字幕生产工作流

从识别引擎到项目交付,功能按实际工作顺序组织。你可以只使用本地能力,也可以按需接入自己的 AI 服务。

01

Transcription

本地转录引擎

两套本地引擎覆盖不同硬件与工作方式。Voxly 负责媒体预处理、依赖检测、任务记录和字幕段生成,避免把运行环境交给用户手动拼装。

Engine A可调参数

Whisper

Whisper 适合需要成熟参数控制、VAD 静音检测以及 CPU、NVIDIA 或 AMD 后端选择的工作流。可根据设备性能选择模型,并使用提示词、分段长度和过滤策略控制结果。

  • CPU / NVIDIA / AMD
  • VAD
  • 多模型
Engine B词级对齐

Qwen3-ASR

Qwen3-ASR 0.6B 使用 Qwen3-ForcedAligner 0.6B 生成词级时间戳。便携运行时支持 NVIDIA CUDA 与 CPU;显存不足时会明确提示回退策略,不会静默改变执行方式。

  • NVIDIA CUDA / CPU
  • ForcedAligner
  • 分段输出
02

Editing

字幕与时间轴编辑

转录结果直接进入可操作的字幕列表。所有修改围绕时间轴和可恢复性展开,适合访谈、课程、播客、影视对白与长视频整理。

  • 逐条播放、连续播放、暂停与精确跳转
  • 增加、删除、拆分、合并和恢复原始字幕
  • 查找替换、批量时间偏移与手动时间轴输入
  • 单条颜色、说话人标记和双语字幕输出
  • 全局快捷键自定义与任务切换状态播报
03

Knowledge Base

可复用的质量资产

知识库把一次性的人工修正变成可复用资产。它不会代替最终审核,但能显著减少相同术语在多个项目中反复出错。

01Glossary

专名词表

管理人名、地名、品牌名和行业术语。转录时可将相关词条注入提示词,AI 校对时也可作为约束上下文。

02Memory

纠错记忆

保存常见的错误词与正确写法。手动修正或 AI 校对产生的词对可用于后续任务,逐步形成自己的质量基线。

03Alignment

剧本参照

导入原始剧本后,对齐功能可比较转录字幕与剧本内容,标记误读、漏读和多字片段,并在确认后应用修改。

04

AI Assistant

结果先预览,再决定是否应用

在线 AI 功能使用你配置的 DeepSeek、OpenRouter 或自定义 OpenAI 兼容接口。处理范围、提示词和结果应用都需要用户显式确认。

  • 仅纠错、简繁转换、标点补全与填充词清理
  • 双语字幕、全文翻译和字幕风格调整
  • 说话人分析、情感语气标注与摘要关键词提取
  • 自定义提示词与选中范围处理
  • 结果预览后再写回当前任务
05

Projects & Delivery

项目可迁移,交付可继续

任务数据采用独立 .voxly 工程文件。项目可以搜索、重命名、切换、自动保存和手动备份,不依赖一个集中数据库承载全部工作。

.voxlypkg

完整项目包

.voxlypkg 项目包可同时包含任务数据、关联媒体和字幕文件。导入后自动恢复关联,适合跨设备迁移、交接和长期归档。

.docx

剧本文档

对白类任务可在 AI 预校验后整理并导出为 DOCX 剧本文档,自动区分说话人并使用颜色帮助阅读和审校。

继续进入专业后期

完成字幕后可以继续进入专业后期,不需要重新手工搭建时间线或复制大量中间文件。

REAPER

将字幕与关联媒体发送到 REAPER,以时间线条目继续调整。脚本支持安装路径检测,也保留手动导入的退路。

视频输出

独立合成器支持音视频、字幕和图片素材,提供预览、字幕样式、封面、转场、马赛克与 MP4 导出;视频编辑器提供多轨、剪切、混音、变速和导出流程。

06

Accessibility

纯键盘与屏幕阅读器优先

界面操作不依赖鼠标悬停或视觉定位。重要操作需要明确触发,后台处理会播报状态,焦点不会因为列表刷新而无故跳走。

  • JAWS 与 NVDA 场景持续验证
  • 菜单、对话框、列表与状态区域提供可读名称
  • 快捷键可查询并按个人习惯修改
  • 破坏性操作使用确认或可恢复流程
  • 任务切换、导出完成和错误状态可被感知

15 天试用

用一段真实素材完成验证

下载 Voxly