智能硬件︱199 元的开源 AI 录音卡,凭什么"平替"智能录音笔?
首次会自动下载 FunASRSenseVoiceSmall(约 900MB)并缓存本地,之后完全离线运行。该模型是阿里达摩院开源的多语言识别模型,离线、CPU 可跑,一小时录音转写不到 10 分钟,质量接近商用 API。
云端翻译(可选):APP 支持中、英、日、韩、俄、中文繁体等数十种语言转写与翻译;云端只是"增强",录音原文与本地转写始终留在你手里。
仓库的 40 项单元测试已覆盖协议、设备、ASR 三层——不是演示级 demo,而是真机验证过的工具。
核心价值:把数据主权交还用户。
02 开放开发协议,可二次开发
很多 AI 录音卡支持蓝牙、支持 APP,但那是"封闭生态里的封闭硬件"。NextProto 从第一天就把"被开发"当成核心卖点:蓝牙 + USB 双传输 + 开放 API。
硬件侧做了四件事:
开放 RESTful 上传接口(POST /api/v1/record/upload)、公开帧格式协议文档、提供多平台 SDK、蓝牙与 USB 双传输——任何人拿到设备当天就能写第三方工具,不必等厂商适配。
仓库已把"骨架"做完,你只需在外层套上 AI Agent:命令行 REPL 一条命令搞定全部操作,或 python main.py --web 启动 FastAPI + WebSocket 控制台,录音同时把 OPUS 码流落盘喂给下游。
