C#將科大訊飛語音合成文件轉換為MULAW音頻格式

来源:http://www.cnblogs.com/HZM/archive/2016/04/28/5443903.html
-Advertisement-
Play Games

任務描述:通過科大訊飛語音合成組件線上完成文本轉語音的合成,然後再轉換為電話系統IVR要求的音頻格式: wave mu-law 16位 8kHZ 64kbps。 完成步驟: 首先,我們要先通過科大訊飛語音合成組件實現文本合成,由於科大訊飛提供的介面都是C語言的,如果用C#調用需要做二次封裝,為了快速 ...


任務描述:通過科大訊飛語音合成組件線上完成文本轉語音的合成,然後再轉換為電話系統IVR要求的音頻格式: wave mu-law 16位 8kHZ 64kbps。

完成步驟:

首先,我們要先通過科大訊飛語音合成組件實現文本合成,由於科大訊飛提供的介面都是C語言的,如果用C#調用需要做二次封裝,為了快速完成任務,我們直接在科大訊飛論壇中找到一個現成組件進行修改,感謝wangkang提供的分享。

1、下載C#代碼:http://bbs.xfyun.cn/forum.php?mod=viewthread&tid=10182&highlight=c%23

2、修改iFlyDotNet的界面(根據自己的業務要求修改界面輸入方式);

3、修改iFlydll工程中的iFlyTTS.cs文件

找到iFlyMSC.QTTSSessionBegin(str, ref errorCode )方法,修改轉換參數str如下:

 string str = "ssm=1," + this._speeker + ",spd=" + this._speed + ",aue=speex-wb;7,vol=" + this._vol + ",auf=audio/L16;rate=8000,ent=sms8k,rdn=3,rcn=0";

通過以上調用介面將輸出採樣速率8000,量化比特16位,8kHZ的PCM格式音頻。

註,音頻頭部格式設置如下:

                            RIFF_ID = 0x46464952, 
                            File_Size = data_len -8, 
                            RIFF_Type = 0x45564157, 
                            FMT_ID = 0x20746d66, 
                            FMT_Size = 0x10, 
                            FMT_Tag = 1, 
                            FMT_Channel = 1,
                            FMT_SamplesPerSec = 8000, 
                            AvgBytesPerSec = 16000, 
                            BlockAlign = 2, 
                            BitsPerSample = 16, 
                            DATA_ID = 0x61746164, 
                            DATA_Size = data_len- 44

 

接著我們要轉換為wave mu-law 16位 8kHZ 64kbps的音頻格式,這裡藉助了NAudio.dll的開源組件。

1)增加一個新類:

public class RawSourceWaveStream : WaveStream
    {
        private Stream sourceStream;
        private WaveFormat waveFormat;
 
        public RawSourceWaveStream(Stream sourceStream, WaveFormat waveFormat)
        {
            this.sourceStream = sourceStream;
            this.waveFormat = waveFormat;
        }
 
        public override WaveFormat WaveFormat
        {
            get { return this.waveFormat; }
        }
 
        public override long Length
        {
            get { return this.sourceStream.Length; }
        }
 
        public override long Position
        {
            get
            {
                return this.sourceStream.Position;
            }
            set
            {
                this.sourceStream.Position = value;
            }
        }
 
        public override int Read(byte[] buffer, int offset, int count)
        {
            return sourceStream.Read(buffer, offset, count);
        }
        public override void Write(byte[] buffer, int offset, int count)
        {
            sourceStream.Write(buffer, offset, count);
        }
    }
2)將PCM音頻轉換為u-law格式
WaveFormat waveFormat = WaveFormat.CreateMuLawFormat(8000, 1);
RawSourceWaveStream rawStream = new RawSourceWaveStream(stream, new WaveFormat(8000, 16, 1));
WaveStream muStream = new WaveFormatConversionStream(WaveFormat.CreateMuLawFormat(8000, 1), rawStream); WaveFileWriter.CreateWaveFile(outWaveFlie, muStream);
3)轉換完成後輸出的文件已經是u-law格式的電話音頻格式了,我們用goldwave播放器進行播放,結果發現所有轉換的結果開始部分會出現短暫的噪音。
用UltraEdit工具分析音頻文件的頭部發現格式後面會出現一些其他數據造成噪音(註:u-law格式頭部為58個位元組)
對輸出的文件進一步處理後噪音問題解決:
using (FileStream stream2 = new FileStream(outWaveFlie, FileMode.Open))                         {                             byte[] blank = new byte[22];                             for (int i = 0; i < 22; i++)                             {                                 blank[i] = 0xFF;                             }                             stream2.Position = 58;                             stream2.Write(blank, 0, blank.Length);                         }

以下是正常u-law格式的電話音頻:

您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • u8 是 unsigned char u16 是 unsigned short u32 是 unsigned int ...
  • IronMan之裝飾者 前言 上一篇的文章我們講到要給"IronMan"配備"武器",並且還使用了"武器",效果還是不錯的,對於多種環境、多種攻擊方式的"武器"使用,我們已經掌握了。 有的朋友沒有看過上一篇文章,那也沒關係,此篇的重點不會涉及到上一篇的內容。 好吧,廢話不多說,直接進入正題, 這裡簡 ...
  • ...
  • 【問】xml的標準形式是: <Root> <Name>John</Name> <Age>16</Age> </Root> 現在假如是一個字元串的形式—— <Root><Name>John</Name><Age>16</Age></Root> 請教如何對該字元串格式化,以便成為標準的xml文件格式? ...
  • Quartz:首先我貼出來了兩段代碼(下方),可以看出,首先根據配置文件(quartz.config),包裝出一個Quartz.Core.QuartzScheduler instance,這是一個調度器,調度各個任務項(Jobs)的執行。這個調度器可以被Start、被Shutdown、被PauseA ...
  • 無聊練習一下WinForm,輸入網址,點擊按鈕就在瀏覽器打開網址。 源代碼下載: http://hovertree.com/h/bjaf/cao15h74.htm ...
  • 平臺之大勢何人能擋? 帶著你的Net飛奔吧!:http://www.cnblogs.com/dunitian/p/4822808.html#iis 原文:http://dnt.dkill.net/Article/Detail/330 先建一個用戶 FTp角色添加一下 打開IIS,添加FTP站(如果發 ...
  • 第一次自己寫博客文章,大家多多指教。寫博客主要記錄一下學習的過程,給初學者提供下參考,也留給自己做備忘。 Slickflow .NET開源工作流-環境搭建 在VS2010中使用附加進程的方式調試IIS中的頁面,請參考如下頁面: http://www.cnblogs.com/minesky/p/338 ...
一周排行
    -Advertisement-
    Play Games
  • 移動開發(一):使用.NET MAUI開發第一個安卓APP 對於工作多年的C#程式員來說,近來想嘗試開發一款安卓APP,考慮了很久最終選擇使用.NET MAUI這個微軟官方的框架來嘗試體驗開發安卓APP,畢竟是使用Visual Studio開發工具,使用起來也比較的順手,結合微軟官方的教程進行了安卓 ...
  • 前言 QuestPDF 是一個開源 .NET 庫,用於生成 PDF 文檔。使用了C# Fluent API方式可簡化開發、減少錯誤並提高工作效率。利用它可以輕鬆生成 PDF 報告、發票、導出文件等。 項目介紹 QuestPDF 是一個革命性的開源 .NET 庫,它徹底改變了我們生成 PDF 文檔的方 ...
  • 項目地址 項目後端地址: https://github.com/ZyPLJ/ZYTteeHole 項目前端頁面地址: ZyPLJ/TreeHoleVue (github.com) https://github.com/ZyPLJ/TreeHoleVue 目前項目測試訪問地址: http://tree ...
  • 話不多說,直接開乾 一.下載 1.官方鏈接下載: https://www.microsoft.com/zh-cn/sql-server/sql-server-downloads 2.在下載目錄中找到下麵這個小的安裝包 SQL2022-SSEI-Dev.exe,運行開始下載SQL server; 二. ...
  • 前言 隨著物聯網(IoT)技術的迅猛發展,MQTT(消息隊列遙測傳輸)協議憑藉其輕量級和高效性,已成為眾多物聯網應用的首選通信標準。 MQTTnet 作為一個高性能的 .NET 開源庫,為 .NET 平臺上的 MQTT 客戶端與伺服器開發提供了強大的支持。 本文將全面介紹 MQTTnet 的核心功能 ...
  • Serilog支持多種接收器用於日誌存儲,增強器用於添加屬性,LogContext管理動態屬性,支持多種輸出格式包括純文本、JSON及ExpressionTemplate。還提供了自定義格式化選項,適用於不同需求。 ...
  • 目錄簡介獲取 HTML 文檔解析 HTML 文檔測試參考文章 簡介 動態內容網站使用 JavaScript 腳本動態檢索和渲染數據,爬取信息時需要模擬瀏覽器行為,否則獲取到的源碼基本是空的。 本文使用的爬取步驟如下: 使用 Selenium 獲取渲染後的 HTML 文檔 使用 HtmlAgility ...
  • 1.前言 什麼是熱更新 游戲或者軟體更新時,無需重新下載客戶端進行安裝,而是在應用程式啟動的情況下,在內部進行資源或者代碼更新 Unity目前常用熱更新解決方案 HybridCLR,Xlua,ILRuntime等 Unity目前常用資源管理解決方案 AssetBundles,Addressable, ...
  • 本文章主要是在C# ASP.NET Core Web API框架實現向手機發送驗證碼簡訊功能。這裡我選擇是一個互億無線簡訊驗證碼平臺,其實像阿裡雲,騰訊雲上面也可以。 首先我們先去 互億無線 https://www.ihuyi.com/api/sms.html 去註冊一個賬號 註冊完成賬號後,它會送 ...
  • 通過以下方式可以高效,並保證數據同步的可靠性 1.API設計 使用RESTful設計,確保API端點明確,並使用適當的HTTP方法(如POST用於創建,PUT用於更新)。 設計清晰的請求和響應模型,以確保客戶端能夠理解預期格式。 2.數據驗證 在伺服器端進行嚴格的數據驗證,確保接收到的數據符合預期格 ...