网站首页/ 信息中心/ 档案百科/

手把手教你搭建集成声纹识别功能的档案管理软件实操指南

发布时间:2026年09月16日 14:30:05 浏览量:0

一、前置环境准备

本方案基于Python+百度免费声纹识别接口开发,所有依赖免费可用,零门槛上手,所有步骤可直接复制执行:

1. 安装Python

直接从官方地址下载对应系统的安装包:https://www.python.org/downloads/,安装过程中必须勾选「Add Python to PATH」选项,这是新手最容易遗漏的步骤,未勾选会导致后续命令无法执行。

2. 安装项目依赖

安装完成后,按下Win+R输入cmd打开命令提示符,直接执行以下命令安装所有依赖,使用清华源解决国内下载慢的问题:

pip install -i https://pypi.tuna.tsinghua.edu.cn/simple flask baidu-aip sqlalchemy

如果执行提示pip不存在,替换为python -m pip install -i https://pypi.tuna.tsinghua.edu.cn/simple flask baidu-aip sqlalchemy即可。

二、申请声纹识别接口密钥

百度智能云声纹识别提供个人开发者免费额度,足够日常使用,申请步骤如下:

  1. 打开声纹识别产品页:https://cloud.baidu.com/product/speech/speaker
  2. 注册登录百度账号后,点击「立即开通」,按照提示完成个人实名认证(免费,1分钟完成)
  3. 进入控制台,点击「创建应用」,填写应用名称,勾选「声纹识别」权限,点击提交
  4. 创建完成后,在应用列表中即可看到你的APP_IDAPI_KEYSECRET_KEY,复制保存下来,后续代码配置需要用到。

三、编写核心代码

在电脑任意位置新建一个文件夹,在文件夹内新建一个名为app.py的文本文件,将以下代码完整复制进去,然后替换代码开头的三个密钥为你刚才保存的内容:

``` from flask import Flask, request, render_template_string from aip import AipSpeech from sqlalchemy import create_engine, Column, String, Text from sqlalchemy.ext.declarative import declarative_base from sqlalchemy.orm import sessionmaker 替换为你自己申请的百度智能云密钥 APP_ID = '你的APP_ID' API_KEY = '你的API_KEY' SECRET_KEY = '你的SECRET_KEY' app = Flask(__name__) client = AipSpeech(APP_ID, API_KEY, SECRET_KEY) 初始化本地SQLite数据库存储档案 engine = create_engine('sqlite:///archive.db', echo=False) Base = declarative_base() Session = sessionmaker(bind=engine) session = Session() 档案数据表结构 class Archive(Base): __tablename__ = 'archives' user_id = Column(String(50), primary_key=True) archive_content = Column(Text) Base.metadata.create_all(engine) 前端操作页面 HTML_PAGE = ''' 声纹档案管理 声纹档案管理中心

声纹注册绑定档案

用户ID:

手把手教你搭建集成声纹识别功能的档案管理软件实操指南

档案内容:

声纹音频(WAV格式, 10-15秒):

声纹验证查看档案

用户ID:

验证音频(WAV格式):

{% if content %}

返回结果

{{content}}

{% endif %}
''' @app.route('/') def index(): return render_template_string(HTML_PAGE) 声纹注册接口 @app.route('/register', methods=['POST']) def register(): user_id = request.form['user_id'] content = request.form['content'] audio_file = request.files['audio'] audio_data = audio_file.read() res = client.userRegister(audio_data, user_id, 16000) if res['err_no'] == 0: archive = Archive(user_id=user_id, archive_content=content) if session.query(Archive).get(user_id): session.delete(session.query(Archive).get(user_id)) session.commit() session.add(archive) session.commit() return render_template_string(HTML_PAGE, content='声纹注册成功,你的档案已经加密保存') return render_template_string(HTML_PAGE, content=f'注册失败,错误信息:{res["err_msg"]}') 声纹验证接口 @app.route('/verify', methods=['POST']) def verify(): user_id = request.form['user_id'] audio_file = request.files['audio'] audio_data = audio_file.read() archive = session.query(Archive).get(user_id) if not archive: return render_template_string(HTML_PAGE, content='该用户ID未注册,请先完成声纹注册') res = client.verify(audio_data, user_id, 16000) if res['err_no'] == 0 and res['result']['score'] >= 60: return render_template_string(HTML_PAGE, content=archive.archive_content) elif res['err_no'] == 0: return render_template_string(HTML_PAGE, content='声纹验证不通过,请重新录制音频验证') return render_template_string(HTML_PAGE, content=f'验证失败,错误信息:{res["err_msg"]}') if __name__ == '__main__': app.run(debug=True) ```

四、启动运行与功能测试

完成代码配置后,打开cmd命令提示符,使用cd 你的app.py所在文件夹路径进入项目文件夹,执行命令:python app.py

看到命令行输出 Running on http://127.0.0.1:5000就说明启动成功,打开浏览器访问这个地址即可使用:

五、常见问题解决

微信咨询
电话联系
QQ客服
微信咨询一对一服务
服务热线: 028-8744 4417
QQ客服: 2305721818