标签: OpenAI

  • 在 Fedora 44 上部署 OpenAI Whisper

    OpenAI Whisper 是一个由 OpenAI 开源的、极其强大的语音识别(ASR)大模型,其核心功能是将人类的语音高效、精准地转化为文字。由于其完全开源,你可以将其轻松部署在本地,享受 100% 的隐私安全与零成本的转写体验。

    在 Fedora 44 系统中,配合目前业界最快的 Python 包管理工具 uv,我们可以用极短的时间、极干净的代码链,快速搭建起一套现代化的 OpenAI Whisper 语音识别环境。

    1. 安装 uv

    uv 是目前最快的 Python 包管理工具,我们可以直接通过 dnf 进行全局安装:

    sudo dnf install uv

    安装完成后验证:

    uv --version

    2. 创建并进入项目目录

    打开终端(Terminal),创建一个独立的文件夹用于存放 Whisper 项目

    mkdir openai-whisper
    cd openai-whisper

    3. 创建并激活虚拟环境

    为了保证 Python 环境的隔离与干净,我们使用 uv 来创建并激活虚拟环境

    # 使用 uv 创建虚拟环境(默认目录为 .venv)
    uv venv
    
    # 激活虚拟环境
    source .venv/bin/activate

    4. 安装openai-whisper

    GPU 显卡加速版

    如果你的机器安装了 NVIDIA 显卡与 CUDA,可安装 GPU 版本:

    # 安装 PyTorch CUDA 版本
    pip install torch torchvision --index-url https://download.pytorch.org/whl/cu132
    
    # 安装 OpenAI Whisper
    pip install -U openai-whisper

    CPU 版

    CPU 版本(无独立显卡)

    # 安装 OpenAI Whisper
    pip install -U openai-whisper

    运行

    whisper --help
    
    whisper audio.flac audio.mp3 audio.wav --model turbo