好友
阅读权限 20
听众
最后登录 1970-1-1
hukuu
发表于 2026-7-27 13:27
AI 语音识别助手 (VoiceAssistant) 软件简介 本软件是一款基于本地化 AI 模型(ONNX Runtime)构建的桌面级高性能语音识别与处理工具,纯CPU运行。它集成了先进的语音活动检测(VAD)、自动语音识别(ASR)以及智能标点预测(PUNC)三大核心模型,致力于为用户提供极低延迟的实时语音输入、沉浸式的会议记录以及高效的音视频批量转写体验。 🚀 主要功能 (Core Features) ⚡ 极速实时语音输入 (全局快捷键) 用户只需按住 F2 键即可随时随地进行录音,松开即刻完成极速识别。 识别结果将通过“闪现注入”技术(模拟 Ctrl+V)自动且无痕地输入到当前激活的软件窗口中,同时完美保护并复原用户的历史剪贴板内容。
🤝 沉浸式会议记录模式 开启后,软件将在后台持续拾音,托盘图标会开启红色“呼吸灯”效果提示运行状态。 会议结束后,系统会在桌面自动生成一份带有精准时间戳的会议纪要(TXT格式)以及一份完整的高保真会议原声录音文件(WAV格式),确保信息一字不漏。
📁 音视频批量转写与字幕生成 支持选择单个文件或整个文件夹进行批量离线转写,兼容 mp4、wav、mp3、mkv 等十余种主流音视频格式。 处理完成后,将在原文件同目录下自动生成纯文本(TXT)和带时间轴的标准字幕文件(SRT)。
📦 自动下载模型
内置模型检查下载机制。当首次运行或发现核心文件缺失时,软件会自动通过 ModelScope 拉取所需的 Int8 量化模型(如 Paraformer 和 FSMN),默认下载到model文件夹。
纯本地化与隐私安全
所有核心 AI 算力(ASR、VAD、标点恢复)均依赖本地 ONNX Runtime 引擎独立完成,无需将音频数据上传云端,充分保障用户的隐私数据与会议机密安全。
下载地址:https://wwbwm.lanzouq.com/b0188fp39g 密码:a7zh
源代码:
源代码下载地址.txt
(49 Bytes, 下载次数: 26)
注: 这款软件纯 CPU 运行 、右侧托盘常驻 以及无 GUI(无图形界面),功能比较粗糙,已上传源代码,有时间的道友可以继续开发,做出功能更好的产品。
免费评分
查看全部评分
发帖前要善用【论坛搜索 】 功能,那里可能会有你要找的答案或者已经有人发布过相同内容了,请勿重复发帖。