近日,小米推出了全面支持情感化語音交互的小米小愛音箱Art,小米也成為業(yè)內(nèi)首家情感化TTS大規(guī)模落地的企業(yè)。
基于開心、關心、害羞等有限但類型不同的情感音頻數(shù)據(jù),通過不同技術訓練并迭代聲學模型,這款音箱支持情感TTS合成,并實現(xiàn)了“小愛同學”的音感化、擬人化。
隨著人工智能技術的發(fā)展,在實現(xiàn)人機對話的基礎上,各大AI企業(yè)都在情感化語音交互的領域積極展開探索。
例如在智能客服領域,當用戶的問題無法解決或者問題表述不清時,智能客服很有可能無法識別用戶的情緒、進行進一步操作,從而引發(fā)用戶的不滿和投訴。
針對這一情況,日本NTT研究所研發(fā)出一款客服電話情感識別系統(tǒng),對用戶的電話語音進行收集處理,如果未檢測到用戶憤怒的情感,則繼續(xù)當前的語音服務;如果檢測到憤怒的情感,則轉為人工服務進行業(yè)務處理。
語音情感識別通常指機器從語音中自動識別人類情感和情感相關狀態(tài)的過程。通過分析說話人情緒使機器進行擬人化的互動,識別說話人的情感成為語音技術發(fā)力的一個新熱點。
語音情感識別包括兩種,NTT推出的客服電話情感識別系統(tǒng)屬于只通過聲音來分析情感。這一情感語音識別模型的落地應用離不開訓練數(shù)據(jù)的支撐。
數(shù)據(jù)堂深耕于AI數(shù)據(jù)領域近十年,一直致力于為全球人工智能企業(yè)提供專業(yè)的數(shù)據(jù)服務,行業(yè)內(nèi)高標準的語音情感識別訓練數(shù)據(jù)《20人英文情感語音麥克風采集數(shù)據(jù)》和《30部電影語音視頻標注數(shù)據(jù)》廣受重視和好評。
語音情感識別的另外一種模型就是結合聲音和圖像的多模態(tài)情感分析。
機器人Pepper就是應用多模態(tài)情感分析的典型案例。
Pepper是由日本軟銀集團和法國Aldebaran Robotics研發(fā)的一款人形機器人,可綜合考慮周圍環(huán)境,積極主動地作出反應。
Pepper配備了語音識別技術以及分析表情和聲調(diào)的情緒識別技術,經(jīng)過定制化開發(fā),可通過表情、動作、語音與人類交流、反饋,甚至能夠跳舞、開玩笑。
如今在商業(yè)領域,全球超過2000家企業(yè)應用了Pepper,服務于零售、金融、健康護理等眾多行業(yè)。
麻省理工學院媒體實驗室分拆公司Affectiva通過語音和面部數(shù)據(jù)打造了情感檔案,其神經(jīng)網(wǎng)絡SoundNet可以在短短1.2秒內(nèi)識別出音頻數(shù)據(jù)中的憤怒情緒。
除了憤怒,人的情感從大類上可分為高興、悲傷、失望、驚訝等面部情感,從內(nèi)心情感上還可細分為:尷尬、猶豫、贊同、羨慕等。這些情感可以用VAD方法進行量化打分。
所謂VAD,是指Valence、Arousal、Dominance三個衡量維度。
· Valence(效價),指達到目標對于滿足個人需要的價值,同一個目標對每一個人可能有三種效價:正、零、負。
· Arousal(積極程度),即精神+身體共同體現(xiàn)出的積極程度,如充滿活力或死氣沉沉。
· Dominance(優(yōu)勢度),表示個體對情景和他人的控制狀態(tài),如憤怒就屬于優(yōu)勢度高的情感,而恐懼屬于優(yōu)勢度低的情感。
數(shù)據(jù)堂一直致力于開發(fā)個性化的機器訓練數(shù)據(jù),并將數(shù)據(jù)和服務落地到AI產(chǎn)品和業(yè)務,為人們帶去更好的產(chǎn)品體驗,讓每個人都能享受人工智能帶來的美好生活。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!
2023年7月6日,第六屆世界人工智能大會(WAIC2023)在上海開幕,“人工智能大模型”是本屆大會的備受矚目的話題,據(jù)悉,在昇騰AI大模型的創(chuàng)新研發(fā)中,華為聯(lián)手26家行業(yè)領軍企業(yè),組建了一支協(xié)同創(chuàng)新的“AI明星隊”,云天勵飛作為中國人工智能企業(yè)的杰出代表,和互聯(lián)網(wǎng)大廠、運營商、科研院所等優(yōu)秀團隊
這幾個月來,以ChatGPT為代表的生成式AI展現(xiàn)出的能力令世界驚嘆。自從2016年AlphaGo戰(zhàn)勝李世石掀起了一波AI浪潮后,AI仿佛已經(jīng)沉寂了很久,ChatGPT的橫空出世就如同一束耀眼的光芒,讓AI這個名詞重回C位。過去在AI1.0時代,主要通過訓練模型來實現(xiàn)圖像識別、聲音識別、語言處理等特
文:互聯(lián)網(wǎng)江湖作者:志剛2023年的IoT需要一個新故事。6月29日,涂鴉智能在開發(fā)者大會上,發(fā)布了企業(yè)級戰(zhàn)略PaaS2.0,希望通過一個平臺+四大開發(fā)服務,建立起IoT生態(tài)。對于這場發(fā)布會,市場的態(tài)度是積極的。美東時間6月29日收盤,涂鴉智能美股股價上漲5.6%,來到1.87美元/股。近日股價穩(wěn)定
美團曾經(jīng)的二號人物王慧文對標OpenAI的創(chuàng)業(yè)項目光年之外,以20億賣給美團,再度引發(fā)市場對大模型的熱議。
2020年底,王慧文在朋友圈寫下這句話時,外界本以為這位伴隨中國互聯(lián)網(wǎng)發(fā)展而持續(xù)創(chuàng)業(yè)20年的人物即將告別創(chuàng)業(yè)舞臺。但是,一個曾經(jīng)多次創(chuàng)業(yè),正值壯年的互聯(lián)網(wǎng)老將心中的創(chuàng)業(yè)熱情是難以熄滅的。
2025國際人工智能程序設計精英挑戰(zhàn)賽(IAEPC)在香港中文大學成功舉辦。來自深圳的學生吳林林作為主辦方記者團成員,采訪了大會嘉賓:全國政協(xié)委員、香港特別行政區(qū)立法會議員、香港中文大學工程學院副院長、IAEPC聯(lián)合發(fā)起人黃錦輝先生。在吳林林的采訪中,黃錦輝教授勉勵年輕人要像懂中文和英語一樣懂AI,
昨天新出了一個AI,據(jù)說比DeepSeek還牛,而截止到今早,已經(jīng)有10萬人在排隊申請Manus邀請碼了,而且它邀請碼已經(jīng)炒到10萬了。這是北京的一家人工智能公司蝴蝶科技,創(chuàng)始人是一名來自華中科技大學的90后畢業(yè)生肖弘,突然向全球宣布:世界上第一款真正的人工智能、通用智能體產(chǎn)品出現(xiàn)了,名叫Manus
謠言肆虐,擦亮眼睛
蘋果16弄了兩個版本,一個是專門給中國人用的,準備用百度的AI,還要交錢。第二個是全世界都可以用的,用了ChatGPT,包括臺灣、香港、澳門都可以用。以后都這樣了。好,問題就出在這,蘋果和百度的合作出現(xiàn)問題了,新聞連起來看,才能明白其中含義。新聞一:蘋果正在和騰訊、字節(jié)初步接洽,考慮將二者的AI模型
“技術日新月異,人類生活方式正在快速轉變,這一切給人類歷史帶來了一系列不可思議的奇點。我們曾經(jīng)熟悉的一切,都開始變得陌生?!庇嬎銠C之父約翰·馮·諾依曼曾這樣說到。
“人工智能的商業(yè)模式,是要創(chuàng)造一個市場,而非一個算法”。這是世界AI泰斗MichaelI.Jordan的觀點。而當前的全球AI市場,占據(jù)主導地位的中美雙方,卻也走出了兩條截然不同的技術路徑,前者執(zhí)著于前沿技術的探索,后者則發(fā)力應用優(yōu)化和商業(yè)化落地。南轅北轍的兩個方向,或許已經(jīng)無法直接進行排位先后、優(yōu)
智能體進化發(fā)展了一年,現(xiàn)在的RPAAgent迭代到什么程度了?從實在智能最新發(fā)布的實在Agent7.0,看RPAAgent的迭代升級抓取豆瓣信息、自己制作PPT,這款AIAgent真的實現(xiàn)了流程全自動化AIAgent構建到執(zhí)行全自動化,持續(xù)進化RPAAgent再次降低智能體應用門檻實在智能重磅發(fā)布實
崔大寶|節(jié)點財經(jīng)創(chuàng)始人進入2024年,大模型似乎有熄火之勢:資本市場,與之關聯(lián)的概念炒不動了,英偉達股價動輒暴跌重挫,引發(fā)“泡沫戳破”的擔憂;消費市場,BATH們的推新活動少了,產(chǎn)品更新迭代的速度慢了,民眾的關注度降了……熱鬧的大概只剩下兩場酣仗:自5月15日字節(jié)跳動宣布“以厘計費”,打響國內(nèi)大模型
文|智能相對論作者|陳泊丞好消息!你心心念念的事業(yè)單位發(fā)錄取公告了!壞消息!他們沒錄你,錄了個數(shù)字人。圖片來源網(wǎng)絡隨著數(shù)字人技術的突破,越來越多的傳統(tǒng)企業(yè)和機構開始用上了“數(shù)字員工”。甚至很多中國人心心念念的“鐵飯碗”,也被這些數(shù)字人給捧上了。數(shù)字人捧上了“鐵飯碗”簡單翻看一下全國各地事業(yè)單位的“錄