<listing id="vjp15"></listing><menuitem id="vjp15"></menuitem><var id="vjp15"></var><cite id="vjp15"></cite>
<var id="vjp15"></var><cite id="vjp15"><video id="vjp15"><menuitem id="vjp15"></menuitem></video></cite>
<cite id="vjp15"></cite>
<var id="vjp15"><strike id="vjp15"><listing id="vjp15"></listing></strike></var>
<var id="vjp15"><strike id="vjp15"><listing id="vjp15"></listing></strike></var>
<menuitem id="vjp15"><strike id="vjp15"></strike></menuitem>
<cite id="vjp15"></cite>
<var id="vjp15"><strike id="vjp15"></strike></var>
<var id="vjp15"></var>
<var id="vjp15"></var>
<var id="vjp15"><video id="vjp15"><thead id="vjp15"></thead></video></var>
<menuitem id="vjp15"></menuitem><cite id="vjp15"><video id="vjp15"></video></cite>
<var id="vjp15"></var><cite id="vjp15"><video id="vjp15"><thead id="vjp15"></thead></video></cite>
<var id="vjp15"></var>
<var id="vjp15"></var>
<menuitem id="vjp15"><span id="vjp15"><thead id="vjp15"></thead></span></menuitem>
<cite id="vjp15"><video id="vjp15"></video></cite>
<menuitem id="vjp15"></menuitem>

用于控制終端的信息處理方法及其系統與流程

文檔序號:11776306閱讀:312來源:國知局
用于控制終端的信息處理方法及其系統與流程

本公開涉及人工智能領域,更具體地,涉及一種用于控制終端的信息處理方法及其系統、以及一種非易失性存儲介質和一種計算機系統。



背景技術:

人工智能時代的來臨,使得業界產生了一系列的智能家居設備。而支持遠程喚醒的語音智能音箱作為一系列智能家居設備的入口(如echo,googlehome,叮咚音箱等),成為了一種最自然且實用的智能設備。

一般家庭即可通過智能音箱等控制終端作為控制中樞,來串起所有的智能家居設備,使得原先較為分散的智能設備變成了一個統一的可操控的智能生態體系以提供各種的智能服務(如外賣、家政、購物等)。

在實現本公開實施例的過程中,發明人發現相關技術中至少存在如下問題:控制終端(如智能音箱)的語音應答模式不靈活,導致用戶體驗不佳。

針對相關技術中的上述問題,目前還未提出有效的解決方案。



技術實現要素:

有鑒于此,本公開提供了一種用于控制終端的信息處理方法及用于控制終端的信息處理系統。

本公開的一方面提供了一種用于控制終端的信息處理方法,包括:獲取用戶輸入的語音信號;獲取調整信息,其中,上述調整信息包括根據上述語音信號確定的用于描述上述用戶的特征屬性的特征信息和/或上述被控制終端根據上述語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息;根據上述調整信息對上述語音信號所對應的控制信號進行調整;以及向上述被控制終端輸出調整后的控制信號。

根據本公開的實施例,獲取調整信息包括根據上述語音信號確定用于描述上述用戶的特征屬性的特征信息,該操作包括:從上述語音信號中提取對應的語音特征參數;將上述語音特征參數輸入預設分類器以對上述用戶的特征屬性進行分類;以及根據上述用戶的特征屬性的分類結果確定用于描述上述用戶的特征屬性的特征信息。

根據本公開的實施例,將上述語音特征參數輸入預設分類器以對上述用戶的特征屬性進行分類包括:在上述用戶的特征屬性包括上述用戶的年齡信息和/或性別信息的情況下,對輸入上述預設分類器中的上述語音特征參數進行后驗概率統計;根據后驗概率統計結果確定上述語音特征參數對應的上述年齡信息和/或上述性別信息;以及基于確定出的上述年齡信息和/或上述性別信息對上述用戶的特征屬性進行分類。

根據本公開的實施例,將上述語音特征參數輸入預設分類器以對上述用戶的特征屬性進行分類包括:在上述用戶的特征屬性至少包括用于描述上述用戶與上述控制終端的所屬關系的身份信息的情況下,計算輸入上述預設分類器中的上述語音特征參數與預先存儲在上述預設分類器中的語音特征參數的相似度;根據上述相似度計算結果,確定上述用戶的身份信息;以及基于上述用戶的身份信息對上述用戶的特征屬性進行分類。

根據本公開的實施例,在獲取用戶輸入的語音信號之后,上述方法還包括:對上述用戶輸入上述控制終端的上述語音信號進行自然語言處理,以得到對應的語義信息,其中,上述語義信息用于確定上述被控制終端根據上述語音信號所對應的控制信號需要執行的操作。

根據本公開的實施例,獲取調整信息包括:獲取被控制終端根據上述語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

本公開的另一方面還提供了一種用于控制終端的信息處理系統,包括:第一獲取模塊,用于獲取用戶輸入的語音信號;第二獲取模塊,用于獲取調整信息,其中,上述調整信息包括根據上述語音信號確定的用于描述上述用戶的特征屬性的特征信息和/或上述被控制終端根據上述語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息;以及調整模塊,根據上述調整信息對上述語音信號所對應的控制信號進行調整;輸出模塊,用于向上述被控制終端輸出調整后的控制信號。

根據本公開的實施例,上述第二獲取模塊包括:提取單元,用于從上述語音信號中提取對應的語音特征參數;分類單元,用于將上述語音特征參數輸入預設分類器以對上述用戶的特征屬性進行分類;以及確定單元,用于根據上述用戶的特征屬性的分類結果確定用于描述上述用戶的特征屬性的特征信息。

根據本公開的實施例,上述分類單元包括:第一處理子單元,用于在上述用戶的特征屬性包括上述用戶的年齡信息和/或性別信息的情況下,對輸入上述預設分類器中的上述語音特征參數進行后驗概率統計;第一確定子單元,用于根據后驗概率統計結果確定上述語音特征參數對應的上述年齡信息和/或上述性別信息;以及第一分類子單元,用于基于確定出的上述年齡信息和/或上述性別信息對上述用戶的特征屬性進行分類。

根據本公開的實施例,上述分類單元包括:第二處理子單元,用于在上述用戶的特征屬性至少包括用于描述上述用戶與上述控制終端的所屬關系的身份信息的情況下,計算輸入上述預設分類器中的上述語音特征參數與預先存儲在上述預設分類器中的語音特征參數的相似度;第二確定子單元,用于根據上述相似度計算結果,確定上述用戶的身份信息;以及第二分類子單元,用于基于上述用戶的身份信息對上述用戶的特征屬性進行分類。

根據本公開的實施例,上述系統還包括:處理模塊,用于對上述用戶輸入上述控制終端的上述語音信號進行自然語言處理,以得到對應的語義信息,其中,上述語義信息用于確定上述被控制終端根據上述語音信號所對應的控制信號需要執行的操作。

根據本公開的實施例,第二獲取模塊還用于獲取被控制終端根據上述語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

本公開的另一方面還提供了一種非易失性存儲介質,存儲有計算機可執行指令,上述指令在被處理器執行時用于實現上述任一項所述的用于控制終端的信息處理方法。

本公開的另一方面還提供了一種用于控制終端的信息處理系統,包括:存儲器,用于存儲計算機可執行指令;以及處理器,用于執行上述指令以實現上述任一項所述的用于控制終端的信息處理方法。

根據本公開的實施例,由于提供一種用于控制終端的信息處理方法,使得控制終端可以依據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息進行應答模式的調整,而不再是固定的應答模式,可以至少部分地克服相關技術提供的方案中由于控制終端語音應答模式不靈活而導致的用戶體驗不佳的技術問題,并因此可以實現提高控制終端語音應答模式靈活性,提升用戶體驗的技術效果。

附圖說明

通過以下參照附圖對本公開實施例的描述,本公開的上述以及其他目的、特征和優點將更為清楚,在附圖中:

圖1示意性示出了根據本公開實施例的可應用于控制終端的信息處理方法及其系統的應用場景;

圖2示意性示出了根據本公開實施例的用于控制終端的信息處理方法的流程圖;

圖3a示意性示出了根據本公開實施例的根據語音信號確定用于描述用戶的特征屬性的特征信息的流程圖;

圖3b示意性示出了根據本公開實施例的將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類的流程圖;

圖3c示意性示出了根據本公開另一實施例的將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類的流程圖;

圖3d示意性示出了根據本公開另一實施例的用于控制終端的信息處理方法的流程圖;

圖4示意性示出了根據本公開實施例的用于控制終端的信息處理系統的框圖;

圖5a示意性示出了根據本公開實施例的第二獲取模塊的框圖;

圖5b示意性示出了根據本公開實施例的分類單元的框圖;

圖5c示意性示出了根據本公開另一實施例的分類單元的框圖;

圖5d示意性示出了根據本公開另一實施例的用于控制終端的信息處理系統的框圖;以及

圖6示意性示出了根據本公開實施例的適用于控制終端的信息處理方法的計算機系統的框圖。

具體實施方式

以下,將參照附圖來描述本公開的實施例。但是應該理解,這些描述只是示例性的,而并非要限制本公開的范圍。此外,在以下說明中,省略了對公知結構和技術的描述,以避免不必要地混淆本公開的概念。

在此使用的術語僅僅是為了描述具體實施例,而并非意在限制本公開。這里使用的詞語“一”、“一個(種)”和“該”等也應包括“多個”、“多種”的意思,除非上下文另外明確指出。此外,在此使用的術語“包括”、“包含”等表明了特征、步驟、操作和/或部件的存在,但是并不排除存在或添加一個或多個其他特征、步驟、操作或部件。

在此使用的所有術語(包括技術和科學術語)具有本領域技術人員通常所理解的含義,除非另外定義。應注意,這里使用的術語應解釋為具有與本說明書的上下文相一致的含義,而不應以理想化或過于刻板的方式來解釋。

附圖中示出了一些方框圖和/或流程圖。應理解,方框圖和/或流程圖中的一些方框或其組合可以由計算機程序指令來實現。這些計算機程序指令可以提供給通用計算機、專用計算機或其他可編程數據處理裝置的處理器,從而這些指令在由該處理器執行時可以創建用于實現這些方框圖和/或流程圖中所說明的功能/操作的裝置。

因此,本公開的技術可以硬件和/或軟件(包括固件、微代碼等)的形式來實現。另外,本公開的技術可以采取存儲有指令的計算機可讀介質上的計算機程序產品的形式,該計算機程序產品可供指令執行系統使用或者結合指令執行系統使用。在本公開的上下文中,計算機可讀介質可以是能夠包含、存儲、傳送、傳播或傳輸指令的任意介質。例如,計算機可讀介質可以包括但不限于電、磁、光、電磁、紅外或半導體系統、裝置、器件或傳播介質。計算機可讀介質的具體示例包括:磁存儲裝置,如磁帶或硬盤(hdd);光存儲裝置,如光盤(cd-rom);存儲器,如隨機存取存儲器(ram)或閃存;和/或有線/無線通信鏈路。

在使用類似于“a、b和c等中至少一個”這樣的表述的情況下,一般來說應該按照本領域技術人員通常理解該表述的含義來予以解釋(例如,“具有a、b和c中至少一個的系統”應包括但不限于單獨具有a、單獨具有b、單獨具有c、具有a和b、具有a和c、具有b和c、和/或具有a、b、c的系統等)。在使用類似于“a、b或c等中至少一個”這樣的表述的情況下,一般來說應該按照本領域技術人員通常理解該表述的含義來予以解釋(例如,“具有a、b或c中至少一個的系統”應包括但不限于單獨具有a、單獨具有b、單獨具有c、具有a和b、具有a和c、具有b和c、和/或具有a、b、c的系統等)。本領域技術人員還應理解,實質上任意表示兩個或更多可選項目的轉折連詞和/或短語,無論是在說明書、權利要求書還是附圖中,都應被理解為給出了包括這些項目之一、這些項目任一方、或兩個項目的可能性。例如,短語“a或b”應當被理解為包括“a”或“b”、或“a和b”的可能性。

本公開的實施例提供了一種用于控制終端的信息處理方法及系統。該方法包括獲取用戶輸入的語音信號,獲取調整信息,其中,調整信息包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息,根據調整信息對語音信號所對應的控制信號進行調整;以及向被控制終端輸出調整后的控制信號。

圖1示意性示出了根據本公開實施例的可應用于控制終端的信息處理方法及其系統的應用場景。

如圖1所示,在該應用場景中,不同用戶對控制終端輸入語音信號,控制終端對接收到的語音信號進行處理和分析,根據不同的語音信號獲得對應的描述用戶特征屬性的特征信息,如用戶是家人、還是陌生人、進一步判斷出家人的年齡信息和/或性別信息等,進一步控制終端會根據語音信號控制被控制終端響應對應的控制信號而執行對應的操作,例如,當用戶輸入“打開冰箱”的語音信號時,控制終端根據該控制信號控制冰箱這個被控制終端執行打開操作,使得冰箱門打開,當用戶向輸入“天氣預報”的語音信號時,控制終端根據該控制信號控制終端設備如網絡電臺播報天氣預報。

本公開的實施例提供了一種用于控制終端的信息處理方法。

圖2示意性示出了根據本公開實施例的用于控制終端的信息處理方法的流程圖。

如圖2所示,該用于控制終端的信息處理的方法可以包括操作s210~s240,其中:

在操作s210,獲取用戶輸入的語音信號。

需要說明的是,對一個家庭來說,控制終端可以包括但不限于智能音箱,控制終端作為控制中樞可以控制智能家居設備(空調、電視、電冰箱等)、信源(歌曲、網絡電臺等)以及智能服務(提供第三方服務的外賣、家政、購物等),使得智能家居設備、信源以及智能服務變成一個統一的可以操控的智能生態系統。

用戶通過語音向控制終端輸入語音信號,使得被控制終端根據語音信號所對應的控制信號而執行的對應操作,例如,用戶可以向智能音箱輸入“打開空調”的語音信號,控制終端(智能音箱)控制被控制終端(空調),使得空調執行開機操作。

用戶可以是對控制終端執行語音輸入行為的用戶,可以是家庭內部成員,也可以是家庭成員之外的陌生人。通常家庭內部成員按年齡劃分的話包括大人、小孩和老人。出于安全性的考慮,不同的用戶可以設置不同的操作權限,例如,可對小孩或陌生人進行部分或全部權限的禁止。

語音信號是用戶輸入至控制終端以控制被控制終端執行相應操作的信號,不同的語音信號具有不同的語音特征參數即聲紋特征不同。所謂聲紋(voiceprint),是用電聲學儀器顯示的攜帶言語信息的聲波頻譜,由于聲紋不僅具有特定性,而且有相對穩定性的特點,所以通常利用聲紋檢測技術來識別用戶的身份信息。通過對聲紋信息進行分析,可以得到用于描述用戶的特征屬性的特征信息。

在操作s220,獲取調整信息,其中,調整信息包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

需要說明的是,調整信息可以包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

用于描述用戶的特征屬性的特征信息可以包括用戶的年齡信息和/或性別信息,例如可以是老人,小孩,大人等,還可以包括用于描述用戶與控制終端的所屬關系的身份信息,如陌生人、家人等。可以通過聲紋識別技術來識別用戶的特征屬性。

被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息可以包括對被控制終端響應于對應的控制信號輸出的內容,通過對被控制終端的輸出內容進行自然語音分析,可以得到相應的場景歸類,如天氣預報場景、歌曲播放場景等。

在操作s230,根據調整信息對語音信號所對應的控制信號進行調整。

需要說明的是,可以根據語音信號確定的用于描述用戶的特征屬性的特征信息對語音信號所對應的控制信號進行調整,也可以根據被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息對語音信號所對應的控制信號進行調整,還可以根據語音信號確定的用于描述用戶的特征屬性的特征信息和被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息共同對語音信號所對應的控制信號進行調整。

在操作s240,向被控制終端輸出調整后的控制信號。

需要說明的是,在對語音信號所對應的控制信號進行調整之后,向被控制終端輸出調整后的控制信號,使得被控制終端能夠根據用戶輸入的語音信號和被控制終端的反饋信息對音箱的反饋效果進行干預。

通過本公開的實施例,由于提供一種用于控制終端的信息處理方法,使得控制終端可以依據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息進行應答模式的調整,而不再是固定的應答模式,可以至少部分地克服相關技術提供的方案中由于控制終端語音應答模式不靈活而導致的用戶體驗不佳的技術問題,并因此可以實現提高控制終端語音應答模式靈活性,提升用戶體驗的技術效果。

下面參考圖3a~圖3d,結合具體實施例對圖2所示的用于控制終端的信息處理的方法做進一步說明。

圖3a示意性示出了根據本公開實施例的根據語音信號確定用于描述用戶的特征屬性的特征信息的流程圖。

在該實施例中,該用于控制終端的信息處理的方法除了可以包括上文參考圖2所對應的實施例中描述的操作s210~s240之外,還可以包括操作s310~s330,具體地,圖2中的操作s220還可以包括操作s310~s330。為了描述的簡潔起見,這里省略對圖2描述的操作s210~s240的描述。如圖3a所示,其中:

在操作s310,從語音信號中提取對應的語音特征參數。

在操作s320,將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類。

在操作s330,根據用戶的特征屬性的分類結果確定用于描述用戶的特征屬性的特征信息。

需要說明的是,在接收到用戶輸入的語音信號之后,可以提取語音信號對應的語音特征參數,將提取的語音特征參數輸入預設分類器中,以使預設分類器基于用戶的語音特征參數識別用戶的屬性,根據用戶的特征屬性的分類結果可以確定出用于描述用戶的特征屬性的特征信息,如可以識別出用戶的年齡、性別和用戶與控制終端的所屬關系等特征信息。

預設分類器是使用專門的用戶訓練樣本預先訓練得到并存儲在本地或者云端的,使用時直接加載即可。在本公開的實施例中,預設分類器的識別依據可以包括但不限于:從語音信號中提取對應的語音特征參數。

通過本公開的實施例,因為采用了基于分類器模型對用戶的語音特征參數進行分類的技術手段,進而根據用戶的語音中的特征參數得到用戶的特征參數的特征信息,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖3b示意性示出了根據本公開實施例的將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類的流程圖。

在該實施例中,該用于控制終端的信息處理的方法除了可以包括上文參考圖3a所對應的實施例中描述的相應操作之外,還可以包括操作s321~s323,具體地,圖3a中的操作s320可以包括操作s321~s323。為了描述的簡潔起見,這里省略對圖3a描述的其他相應操作的描述。如圖3b所示,其中:

在操作s321,在用戶的特征屬性包括用戶的年齡信息和/或性別信息的情況下,對輸入預設分類器中的語音特征參數進行后驗概率統計。

在操作s322,根據后驗概率統計結果確定語音特征參數對應的年齡信息和/或性別信息。

在操作s323,基于確定出的年齡信息和/或性別信息對用戶的特征屬性進行分類。

需要說明的是,在用戶的特征屬性包括用戶的年齡信息和/或性別信息的情況下,接收到用戶輸入的語音信號之后,可以提取語音信號對應的語音特征參數,例如,可以提取mel頻譜倒譜系數(melfrequencycepstrumcoefficient,簡稱為mfcc),將語音特征參數輸入預先訓練好的預設分類器中,確定用戶的屬性,將用戶在性別、年齡等維度上進行劃分,具體地,可以依據精度需求和設備的運算能力選擇不同的預設分類器模型,只要能達到根據語音特征參數對用戶進行識別的目的即可,在此不做限定,例如可以選擇全背景-高斯混合模型(gaussianmixturemodel-universalbackgroundmodel,簡稱為gmm-ubm)或深度神經網絡模型(deepneuralnetwork,簡稱為dnn)的技術方案,在此不再贅述。

通過本公開的實施例,因為采用了基于分類器模型對用戶的語音特征參數進行分類的技術手段,進而根據用戶的語音中的特征參數得到用戶的特征參數的特征信息,例如用戶的年齡信息和/或性別信息,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖3c示意性示出了根據本公開另一實施例的將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類的流程圖。

在該實施例中,該用于控制終端的信息處理的方法除了可以包括上文參考圖3a所對應的實施例中描述的相應操作之外,還可以包括操作s324~s326,具體地,圖3a中的操作s320可以包括操作s324~s326。為了描述的簡潔起見,這里省略對圖3a描述的其他相應操作的描述。如圖3c所示,其中:

在操作s324,在用戶的特征屬性至少包括用于描述用戶與控制終端的所屬關系的身份信息的情況下,計算輸入預設分類器中的語音特征參數與預先存儲在預設分類器中的語音特征參數的相似度。

在操作s325,根據相似度計算結果,確定用戶的身份信息。

在操作s326,基于用戶的身份信息對用戶的特征屬性進行分類。

需要說明的是,在用戶的特征屬性至少包括用于描述用戶與控制終端的所屬關系的身份信息的情況下,將輸入預設分類器中的語音特征參數與預先存儲在預設分類器中的語音特征參數進行比對,采用對數似然比得分取代似然比得分的算法,獲得用戶語音特征參數的相似度,結合預設閾值進行判斷,識別出用戶對控制終端的所屬關系,進一步,根據不同用戶對控制終端的所屬關系,可以設定對控制終端的不同權限。例如當識別出用戶的身份信息為陌生人時,可將該用戶的操作權限設定為全部禁止。

在基于預設分類器對用戶的特征屬性進行分類之后,隨著用戶特征數據的不斷積累,可以利用用戶特征數據去迭代預設分類器模型,使得分類器的檢測效果越來越好。

通過本公開的實施例,因為采用了計算輸入預設分類器中的語音特征參數與預先存儲在預設分類器中的語音特征參數的相似度的技術手段,可以得出用戶與控制終端的所屬關系的身份信息,例如用戶是否是陌生用戶等,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖3d示意性示出了根據本公開另一實施例的用于控制終端的信息處理方法的流程圖。

在該實施例中,該用于控制終端的信息處理的方法除了可以包括上文參考圖2所對應的實施例中描述的相應操作之外,在操作s210之后該方法還可以包括操作s250。為了描述的簡潔起見,這里省略對圖2描述的其他相應操作的描述。如圖3d所示,其中:

在操作s250,對用戶輸入控制終端的語音信號進行自然語言處理,以得到對應的語義信息,其中,語義信息用于確定被控制終端根據語音信號所對應的控制信號需要執行的操作。

需要說明的是,為了更好的實現對控制終端的輸出信息的調整,本公開的實施例對用戶輸入控制終端的語音信號進行自然語言處理,以得到對應的語義信息,根據不同的語義信息,將用戶對控制終端的指令進行場景歸類,例如,控制終端可以依據用戶的語義分類,例如新聞、歌曲播放等指令進行語速語調的自動調節,如新聞類的語速可以提升,提高信息的獲取效率。

通過本公開的實施例,由于采用了對語音信號進行自然語言處理以得到語義信息的技術方案,使得控制終端可以依據得到的語義信息,劃分語音信號的種類,得到相應的場景,從而達到控制終端根據語音信號所對應的控制信號做應答模式的調整,克服了現有技術提供的技術方案由于應答模式固定導致的用戶體驗不好的技術問題,實現提升用戶體驗的技術效果。

根據本公開的實施例,獲取調整信息包括獲取被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

需要說明的是,調整信息可以包括被控制終端的反饋信息,該反饋信息在被控制終端根據用戶輸入的語音信號所對應的控制信號而執行對應操作的過程中產生,例如被控制終端是網絡電視的情況下,當用戶輸入語音信號為“天氣預報”的時候,在冬天的時候遇到陽光明媚即可自動調節語調為歡樂模式,而在夏天遇到陽光燦爛,則可自動調節成抱怨模式,同時還可以根據天氣情況進行燈光的顯示色彩的設定,即被控制終端根據不同的反饋信息,可以賦予控制終端不同的語音應答模式以不同的情感或應答形式。

通過本公開的實施例,由于采用獲取被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息作為調整信息的技術方案,使得控制終端可以依據被控制終端的反饋信息而對語音信號所對應的控制信號進行調整,克服了現有技術中控制終端對語音信號的應答模式固導致的用戶體驗不佳的技術問題,進而實現提高用戶體驗的技術效果。

本公開的實施例另一方面提供了一種能夠用于控制終端的信息處理系統。

圖4示意性示出了根據本公開實施例的用于控制終端的信息處理系統的框圖。

在該實施例中,該用于控制終端的信息處理系統400可以包括第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440。該系統可以執行上面參考圖2~圖3d描述的方法,以實現對控制終端的信息進行處理的目的。如圖4所示,其中:

第一獲取模塊410用于獲取用戶輸入的語音信號。

第二獲取模塊420用于獲取調整信息,其中,調整信息包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

調整模塊430根據調整信息對語音信號所對應的控制信號進行調整。

輸出模塊440用于向被控制終端輸出調整后的控制信號。

需要說明的是,對一個家庭來說,控制終端可以包括但不限于智能音箱,控制終端作為控制中樞可以控制智能家居設備(空調、電視、電冰箱等)、信源(歌曲、網絡電臺等)以及智能服務(提供第三方服務的外賣、家政、購物等),使得智能家居設備、信源以及智能服務變成一個統一的可以操控的智能生態系統。

用戶通過語音向控制終端輸入語音信號,使得被控制終端根據語音信號所對應的控制信號而執行的對應操作,例如,用戶可以向智能音箱輸入“打開空調”的語音信號,控制終端(智能音箱)控制被控制終端(空調),使得空調執行開機操作。

用戶可以是對控制終端執行語音輸入行為的用戶,可以是家庭內部成員,也可以是家庭成員之外的陌生人。通常家庭內部成員按年齡劃分的話包括大人、小孩和老人。出于安全性的考慮,不同的用戶可以設置不同的操作權限,例如,可對小孩或陌生人進行部分或全部權限的禁止。

語音信號是用戶輸入至控制終端以控制被控制終端執行相應操作的信號,不同的語音信號具有不同的語音特征參數即聲紋特征不同。所謂聲紋(voiceprint),是用電聲學儀器顯示的攜帶言語信息的聲波頻譜,由于聲紋不僅具有特定性,而且有相對穩定性的特點,所以通常利用聲紋檢測技術來識別用戶的身份信息。通過對聲紋信息進行分析,可以得到用于描述用戶的特征屬性的特征信息。

需要說明的是,調整信息可以包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

用于描述用戶的特征屬性的特征信息可以包括用戶的年齡信息和/或性別信息,例如可以是老人,小孩,大人等,還可以包括用于描述用戶與控制終端的所屬關系的身份信息,如陌生人、家人等。可以通過聲紋識別技術來識別用戶的特征屬性。

被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息可以包括對被控制終端響應于對應的控制信號輸出的內容,通過對被控制終端的輸出內容進行自然語音分析,可以得到相應的場景歸類,如天氣預報場景、歌曲播放場景等。

需要說明的是,可以根據語音信號確定的用于描述用戶的特征屬性的特征信息對語音信號所對應的控制信號進行調整,也可以根據被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息對語音信號所對應的控制信號進行調整,還可以根據語音信號確定的用于描述用戶的特征屬性的特征信息和被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息共同對語音信號所對應的控制信號進行調整。

需要說明的是,在對語音信號所對應的控制信號進行調整之后,向被控制終端輸出調整后的控制信號,使得被控制終端能夠根據用戶輸入的語音信號和被控制終端的反饋信息對音箱的反饋效果進行干預。

通過本公開的實施例,由于提供一種用于控制終端的信息處理方法,使得控制終端可以依據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息進行應答模式的調整,而不再是固定的應答模式,可以至少部分地克服相關技術提供的方案中由于控制終端語音應答模式不靈活而導致的用戶體驗不佳的技術問題,并因此可以實現提高控制終端語音應答模式靈活性,提升用戶體驗的技術效果。

圖5a示意性示出了根據本公開實施例的第二獲取模塊的框圖。

在該實施例中,該數據處理系統400除了可以包括上文參考圖4所對應實施例中描述的第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440之外,第二獲取模塊420還可以包括提取單元421、分類單元422、確定單元423。為了描述的簡潔起見,這里省略對第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440的描述。如圖5a所示,其中:

提取單元421用于從語音信號中提取對應的語音特征參數。

分類單元422用于將語音特征參數輸入預設分類器以對用戶的特征屬性進行分類。

確定單元423用于根據用戶的特征屬性的分類結果確定用于描述用戶的特征屬性的特征信息。

通過本公開的實施例,因為采用了基于分類器模型對用戶的語音特征參數進行分類的技術手段,進而根據用戶的語音中的特征參數得到用戶的特征參數的特征信息,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖5b示意性示出了根據本公開實施例的分類單元的框圖。

在該實施例中,該數據處理系統400除了可以包括上文參考圖5a所對應實施例中描述的相應單元之外,該數據處理系統的分類單元420可以包括第一處理子單元424、第一確定子單元425、第一分類子單元426。為了描述的簡潔起見,這里省略對圖5a中描述的相應單元的描述。如圖5b所示,其中:

第一處理子單元424用于在用戶的特征屬性包括用戶的年齡信息和/或性別信息的情況下,對輸入預設分類器中的語音特征參數進行后驗概率統計。

第一確定子單元425用于根據后驗概率統計結果確定語音特征參數對應的年齡信息和/或性別信息。

第一分類子單元426用于基于確定出的年齡信息和/或性別信息對用戶的特征屬性進行分類。

通過本公開的實施例,因為采用了基于分類器模型對用戶的語音特征參數進行分類的技術手段,進而根據用戶的語音中的特征參數得到用戶的特征參數的特征信息,例如用戶的年齡信息和/或性別信息,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖5c示意性示出了根據本公開另一實施例的分類單元的框圖。

在該實施例中,該數據處理系統400除了可以包括上文參考圖5a所對應實施例中描述的相應單元之外,分類單元420可以包括第二處理子單元427、第二確定子單元428、第二分類子單元429。為了描述的簡潔起見,這里省略對圖5a中描述的相應單元的描述。如圖5c所示,其中:

第二處理子單元427用于在用戶的特征屬性至少包括用于描述用戶與控制終端的所屬關系的身份信息的情況下,計算輸入預設分類器中的語音特征參數與預先存儲在預設分類器中的語音特征參數的相似度。

第二確定子單元428用于根據相似度計算結果,確定用戶的身份信息。

第二分類子單元429用于基于用戶的身份信息對用戶的特征屬性進行分類。

通過本公開的實施例,因為采用了計算輸入預設分類器中的語音特征參數與預先存儲在預設分類器中的語音特征參數的相似度的技術手段,可以得出用戶與控制終端的所屬關系的身份信息,例如用戶是否是陌生用戶等,可以實現快速準確的確定用戶的特征信息,達到簡化識別流程、提高識別效率的技術效果。

圖5d示意性示出了根據本公開另一實施例的用于控制終端的信息處理系統的框圖。

在該實施例中,該數據處理系統400除了可以包括上文參考圖4所對應實施例中描述的相應模塊之外,該用于控制終端的信息處理系統400還可以包括處理模塊450。為了描述的簡潔起見,這里省略對圖4中描述的相應模塊的描述。如圖5d所示,其中:

處理模塊450用于對用戶輸入控制終端的語音信號進行自然語言處理,以得到對應的語義信息,其中,語義信息用于確定被控制終端根據語音信號所對應的控制信號需要執行的操作。

通過本公開的實施例,由于采用了對語音信號進行自然語言處理以得到語義信息的技術方案,使得控制終端可以依據得到的語義信息,劃分語音信號的種類,得到相應的場景,從而達到控制終端根據語音信號所對應的控制信號做應答模式的調整,克服了現有技術提供的技術方案由于應答模式固定導致的用戶體驗不好的技術問題,實現提升用戶體驗的技術效果。

根據本公開的實施例,第二獲取模塊還用于獲取被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息。

通過本公開的實施例,由于采用獲取被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息作為調整信息的技術方案,使得控制終端可以依據被控制終端的反饋信息而對語音信號所對應的控制信號進行調整,克服了現有技術中控制終端對語音信號的應答模式固導致的用戶體驗不佳的技術問題,進而實現提高用戶體驗的技術效果。

可以理解的是,第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440等模塊可以合并在一個模塊中實現,或者其中的任意一個模塊可以被拆分成多個模塊。或者,這些模塊中的一個或多個模塊的至少部分功能可以與其他模塊的至少部分功能相結合,并在一個模塊中實現。根據本發明的實施例,第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440等模塊中的至少一個可以至少被部分地實現為硬件電路,例如現場可編程門陣列(fpga)、可編程邏輯陣列(pla)、片上系統、基板上的系統、封裝上的系統、專用集成電路(asic),或可以以對電路進行集成或封裝的任何其他的合理方式等硬件或固件來實現,或以軟件、硬件以及固件三種實現方式的適當組合來實現。或者,第一獲取模塊410、第二獲取模塊420、調整模塊430和輸出模塊440等模塊中的至少一個可以至少被部分地實現為計算機程序模塊,當該程序被計算機運行時,可以執行相應模塊的功能。

需要說明的是,本公開實施例的用于控制終端的信息處理方法與用于控制終端的信息處理系統是相對應的,對于該用于控制終端的信息處理系統的描述可以參考根據本公開實施例的用于控制終端的信息處理方法的描述,在此不再贅述。

本公開的另一方面還提供了一種非易失性存儲介質,存儲有計算機可執行指令,指令在被處理器執行時用于實現上述方法實施例中任一項用于控制終端的信息處理方法。

本公開的另一方面提供了一種信息處理系統,包括:存儲器,用于存儲計算機可執行指令;以及處理器,用于執行指令以實現上述方法實施例中任一項用于控制終端的信息處理方法。

圖6示意性示出了根據本公開另一實施例的用于控制終端的信息處理方法的計算機系統的方框圖。圖6示出的計算機系統僅僅是一個示例,不應對本公開實施例的功能和使用范圍帶來任何限制。

如圖6所示,根據本公開實施例的計算機系統600包括處理器601,其可以根據存儲在只讀存儲器(rom)602中的程序或者從存儲部分608加載到隨機訪問存儲器(ram)603中的程序而執行各種適當的動作和處理。處理器601例如可以包括通用微處理器(例如cpu)、指令集處理器和/或相關芯片組和/或專用微處理器(例如,專用集成電路(asic)),等等。處理器610還可以包括用于緩存用途的板載存儲器。處理器610可以包括用于執行參考圖2~圖3d描述的根據本公開實施例的用于控制終端的信息處理方法流程的不同動作的單一處理單元或者是多個處理單元。

在ram603中,存儲有系統600操作所需的各種程序和數據。處理器601、rom602以及ram603通過總線604彼此相連。處理器601通過執行rom602和/或ram603中的程序來執行以上參考圖2~圖3d描述的用于控制終端的信息處理方法的各種操作。需要注意,所述程序也可以存儲在除rom602和ram603以外的一個或多個存儲器中。處理器601也可以通過執行存儲在所述一個或多個存儲器中的程序來執行以上參考圖2~圖3d描述的用于控制終端的信息處理方法的各種操作。

根據本公開的實施例,系統600還可以包括輸入/輸出(i/o)接口605,輸入/輸出(i/o)接口605也連接至總線604。系統600還可以包括連接至i/o接口605的以下部件中的一項或多項:包括鍵盤、鼠標等的輸入部分606;包括諸如陰極射線管(crt)、液晶顯示器(lcd)等以及揚聲器等的輸出部分607;包括硬盤等的存儲部分608;以及包括諸如lan卡、調制解調器等的網絡接口卡的通信部分609。通信部分609經由諸如因特網的網絡執行通信處理。驅動器610也根據需要連接至i/o接口605。可拆卸介質611,諸如磁盤、光盤、磁光盤、半導體存儲器等等,根據需要安裝在驅動器610上,以便于從其上讀出的計算機程序根據需要被安裝入存儲部分608。

根據本公開的實施例,上文參考流程圖描述的方法可以被實現為計算機軟件程序。例如,本公開的實施例包括一種計算機程序產品,其包括承載在計算機可讀介質上的計算機程序,該計算機程序包含用于執行流程圖所示的方法的程序代碼。在這樣的實施例中,該計算機程序可以通過通信部分609從網絡上被下載和安裝,和/或從可拆卸介質611被安裝。在該計算機程序被處理器601執行時,執行本公開實施例的系統中限定的上述功能。根據本公開的實施例,上文描述的系統、設備、裝置、模塊、單元等可以通過計算機程序模塊來實現。

需要說明的是,本公開所示的計算機可讀介質可以是計算機可讀信號介質或者計算機可讀存儲介質或者是上述兩者的任意組合。計算機可讀存儲介質例如可以是——但不限于——電、磁、光、電磁、紅外線、或半導體的系統、裝置或器件,或者任意以上的組合。計算機可讀存儲介質的更具體的例子可以包括但不限于:具有一個或多個導線的電連接、便攜式計算機磁盤、硬盤、隨機訪問存儲器(ram)、只讀存儲器(rom)、可擦式可編程只讀存儲器(eprom或閃存)、光纖、便攜式緊湊磁盤只讀存儲器(cd-rom)、光存儲器件、磁存儲器件、或者上述的任意合適的組合。在本公開中,計算機可讀存儲介質可以是任何包含或存儲程序的有形介質,該程序可以被指令執行系統、裝置或者器件使用或者與其結合使用。而在本公開中,計算機可讀的信號介質可以包括在基帶中或者作為載波一部分傳播的數據信號,其中承載了計算機可讀的程序代碼。這種傳播的數據信號可以采用多種形式,包括但不限于電磁信號、光信號或上述的任意合適的組合。計算機可讀的信號介質還可以是計算機可讀存儲介質以外的任何計算機可讀介質,該計算機可讀介質可以發送、傳播或者傳輸用于由指令執行系統、裝置或者器件使用或者與其結合使用的程序。計算機可讀介質上包含的程序代碼可以用任何適當的介質傳輸,包括但不限于:無線、電線、光纜、rf等等,或者上述的任意合適的組合。根據本公開的實施例,計算機可讀介質可以包括上文描述的rom602和/或ram603和/或rom602和ram603以外的一個或多個存儲器。

附圖中的流程圖和框圖,圖示了按照本公開各種實施例的系統、方法和計算機程序產品的可能實現的體系架構、功能和操作。在這點上,流程圖或框圖中的每個方框可以代表一個模塊、程序段、或代碼的一部分,上述模塊、程序段、或代碼的一部分包含一個或多個用于實現規定的邏輯功能的可執行指令。也應當注意,在有些作為替換的實現中,方框中所標注的功能也可以以不同于附圖中所標注的順序發生。例如,兩個接連地表示的方框實際上可以基本并行地執行,它們有時也可以按相反的順序執行,這依所涉及的功能而定。也要注意的是,框圖或流程圖中的每個方框、以及框圖或流程圖中的方框的組合,可以用執行規定的功能或操作的專用的基于硬件的系統來實現,或者可以用專用硬件與計算機指令的組合來實現。

作為另一方面,本公開還提供了一種計算機可讀介質,該計算機可讀介質可以是上述實施例中描述的設備中所包含的;也可以是單獨存在,而未裝配入該設備中。上述計算機可讀介質承載有一個或者多個程序,當上述一個或者多個程序被一個該設備執行時,使得該設備執行用于控制終端的信息處理方法:該方法包括:獲取用戶輸入的語音信號;獲取調整信息,其中,調整信息包括根據語音信號確定的用于描述用戶的特征屬性的特征信息和/或被控制終端根據語音信號所對應的控制信號而執行的對應操作的過程中反饋的反饋信息;根據調整信息對語音信號所對應的控制信號進行調整;以及向被控制終端輸出調整后的控制信號。

以上對本公開的實施例進行了描述。但是,這些實施例僅僅是為了說明的目的,而并非為了限制本公開的范圍。盡管在以上分別描述了各實施例,但是這并不意味著各個實施例中的措施不能有利地結合使用。本公開的范圍由所附權利要求及其等同物限定。不脫離本公開的范圍,本領域技術人員可以做出多種替代和修改,這些替代和修改都應落在本公開的范圍之內。

當前第1頁1 2 
網友詢問留言 已有0條留言
  • 還沒有人留言評論。精彩留言會獲得點贊!
1
韩国伦理电影