隐私优先的 Windows 听写
PrimeDictate logo

Maximus Prime Software

PrimeDictate

自然说话,随处输入。

系统级语音工作区,借助经过验证的本地 GPU 加速将语音转换为精炼文本,并可选用独立配置的 AI 润色阶段。

PrimeDictate premium dashboard

默认模式

本地优先

本地引擎

CPU · CUDA · Vulkan

云端 STT

3 个服务商

访问方式

全局快捷键

为日常工作而设计

快速听写,不打断当前工作

可选择切换模式或按住说话,通过简洁的浮动控件掌握状态,并在转录安全地于后台完成时继续工作。

实时快捷键验证与状态感知托盘控制
适合轻声和短语音的自适应语音检测
带时间轴的 TXT、SRT、VTT 与 JSON 导出
可搜索本地历史与隐私安全诊断
PrimeDictate 浮动听写控件

两阶段架构

转录与润色彼此独立

PrimeDictate 不会将语音识别和文本处理锁定到同一家服务商。可为每个阶段选择最佳引擎,也可将整个流程保留在设备本地。

01

采集

使用可配置的切换或按住说话快捷键,从任何 Windows 应用开始。

02

转录

使用经过验证的 Vulkan、NVIDIA CUDA、本地 CPU 或明确选择的云端 STT 模型。

03

润色并送达

应用本地规则或独立 AI 模型,再将文本安全送回原窗口。

灵活推理

根据场景选择合适的硬件和服务

本地引擎优先保护隐私并控制成本;需要便携性或更强模型能力时,可明确选择云端引擎。

01
已验证

AMD / Vulkan

内置 whisper.cpp v1.9.2,提供 SHA-256 完整性校验与运行时 GPU 检测。

02
本地 GPU

NVIDIA CUDA

在支持的 NVIDIA 硬件上通过 CUDA 和 cuDNN 加速 faster-whisper。

03
私密

多核 CPU

适用于无兼容独立 GPU 的 Windows 设备的本地 int8 推理。

04
可选

云端 STT

明确选择 Groq、OpenAI Transcribe 或 Gemini Audio,不存在静默上传路径。

核心能力

完整的听写工作区

01

全局快捷键:在任意 Windows 应用中使用可配置的切换式或按住说话式听写

02

本地加速:适用于兼容 AMD、Intel 和 NVIDIA GPU 的 SHA-256 验证 whisper.cpp Vulkan 运行时

03

灵活引擎:NVIDIA CUDA、本地多核 CPU,或可选的 Groq、OpenAI 与 Gemini 转录

04

转录与转录后润色的服务商和模型完全独立

05

本地规则润色,以及可选 Ollama、LM Studio、Gemini、Groq、OpenAI 与 Grok

06

安全恢复目标窗口,并可在粘贴后恢复原剪贴板

07

媒体工作流:支持分块、取消以及 TXT、SRT、VTT 和 JSON 导出的音视频转录

08

默认本地处理,云端回退必须获得明确许可

09

API 密钥由 Windows 凭据管理器保护

10

可关闭的本地可搜索转录历史

11

桌面控制:浮动录音控件、状态感知系统托盘菜单与开机启动集成

12

质量与诊断:自适应语音检测、脱敏轮转日志和隐私安全诊断包

隐私边界

除非您主动选择,否则麦克风数据始终留在本地

默认使用本地处理。云服务是可见选项,凭据由 Windows 保护,云端回退上传需要明确授权。

  • API 密钥存储于 Windows 凭据管理器,而不是明文 JSON。
  • 在用户明确启用前,云端回退始终关闭。
  • 历史记录可关闭,并保留在当前 Windows 用户配置中。
  • 无法恢复原目标窗口时,安全粘贴会自动取消。

技术与架构

桌面界面
Python 3.12 与 PySide6
AMD / 跨厂商 GPU
whisper.cpp v1.9.2 + GGML Vulkan
NVIDIA GPU
faster-whisper + CUDA / cuDNN
本地 CPU
多核 int8 faster-whisper
云端 STT
Groq、OpenAI Transcribe 与 Google Gemini Audio
凭据存储
Windows 凭据管理器

系统要求

  • Windows 10 或 Windows 11(64 位)
  • 实时听写所需麦克风
  • 使用 CUDA 或 Vulkan 加速时需要最新兼容显卡驱动
  • 仅模型下载或可选云服务需要网络连接