AutoArk

Audio8-ASR-0.1B:把语音识别装进口袋

Audio8-ASR 家族 · 0.1B 端侧模型

2026 年 09 月 10 日

即刻接入API
从声音到文字Audio8-ASR / Audio8-ASR-0.1B
audio inputacoustic contexttranscript

有些语音识别必须发生在设备上:飞机、地铁、弱网环境,或者用户根本不想把录音传到云端的地方。Audio8-ASR-0.1B 将语音识别放进手机、耳机、录音笔和各类边缘设备。

小模型的价值不是“缩水”,而是不依赖网络、不消耗流量、不把敏感声音传出设备,同时交付值得使用的本地识别体验。

项目信息
模型名称Audio8-ASR-0.1B
参数量级0.1B 参数
定位端侧轻量,本地低功耗识别
主要运行环境CPU、边缘设备与手机(含 Apple ANE)
语言支持7 种语言
适合的任务语音输入、现场记录、离线字幕与隐私敏感应用

核心能力:在设备上,稳定地听懂

当模型常驻设备,参数量、内存峰值和功耗直接决定产品能否成立。Audio8-ASR-0.1B 围绕本地实时转写、稳定响应和长时间低功耗运行设计。

特点带来的好处
ONNX Runtime 通用形态无 CUDA、PyTorch 依赖,设备部署简单直接
INT8 / INT4 量化压缩存储与内存占用,低配设备也能运行
Apple ANE 路径识别计算交给专用低功耗单元,续航更安心
完全本地处理声音不出设备,隐私天然友好

适用场景与快速上手

适合手机语音输入、采访会议现场记录、离线字幕和隐私敏感应用。选择通用 ONNX Runtime 或 Apple ANE 版本,接入 Swift / C 接口,即可在本地完成录音转写。

家族一览

需要复杂场景的最高质量时选择 3B;需要 GPU 与成本平衡时选择 0.6B。

边界与负责任使用

自动转写可能受噪声、口音、重叠语音、专有名词和音频质量影响,不应作为未经复核的事实记录。医疗、法律、金融等高风险场景必须经人工审核,部署方应对最终输出负责。

处理个人声音、谈话内容或敏感信息时应依法取得授权并遵守《个人信息保护法》、GDPR 等法规,音频与文本需妥善加密、限权与限期存储。

Audio8-ASR-0.1B / Audio8-ASR

把“听懂声音”落实到目标设备,让识别质量与部署成本同时成立。