
8月12日晚間消息,在2025金融AI推理應(yīng)用落地與發(fā)展論壇上,中國(guó)銀聯(lián)執(zhí)行副總裁涂曉軍、華為數(shù)字金融軍團(tuán)CEO曹沖出席并發(fā)表致辭。論壇上,華為公司副總裁、數(shù)據(jù)存儲(chǔ)產(chǎn)品線總裁周躍峰發(fā)布AI推理創(chuàng)新技術(shù)——UCM推理記憶數(shù)據(jù)管理器,旨在推動(dòng)AI推理體驗(yàn)升級(jí),提升推理性價(jià)比,加速AI商業(yè)正循環(huán)。同時(shí),華為攜手中國(guó)銀聯(lián)率先在金融典型場(chǎng)景開(kāi)展UCM技術(shù)試點(diǎn)應(yīng)用,并聯(lián)合發(fā)布智慧金融AI推理加速方案應(yīng)用成果。
周躍峰在論壇上強(qiáng)調(diào):“AI時(shí)代,模型訓(xùn)練、推理效率與體驗(yàn)的量綱都以Token數(shù)為表征,Token經(jīng)濟(jì)已經(jīng)到來(lái)”。為保障流暢的推理體驗(yàn),企業(yè)需持續(xù)加大算力投入,但如何在推理效率與成本之間找到最佳平衡點(diǎn),成為了全行業(yè)亟待解決的重要課題。
為此,華為推出UCM推理記憶數(shù)據(jù)管理器,包括對(duì)接不同引擎與算力的推理引擎插件(Connector)、支持多級(jí)KV Cache管理及加速算法的功能庫(kù)(Accelerator)、高性能KV Cache存取適配器(Adapter)三大組件,通過(guò)推理框架、算力、存儲(chǔ)三層協(xié)同,實(shí)現(xiàn)AI推理“更優(yōu)體驗(yàn)、更低成本”。
在與中國(guó)銀聯(lián)的聯(lián)合創(chuàng)新技術(shù)試點(diǎn)中,UCM的技術(shù)價(jià)值得到驗(yàn)證。在中國(guó)銀聯(lián)“客戶之聲”業(yè)務(wù)場(chǎng)景下,借助UCM技術(shù)及工程化手段,大模型推理速度提升125倍,僅需10秒即可精準(zhǔn)識(shí)別客戶高頻問(wèn)題,促進(jìn)服務(wù)質(zhì)量提升。未來(lái),中國(guó)銀聯(lián)將依托國(guó)家人工智能應(yīng)用中試基地,聯(lián)合華為等生態(tài)伙伴共建“AI+金融”示范應(yīng)用,推動(dòng)技術(shù)成果從“實(shí)驗(yàn)室驗(yàn)證”走向“規(guī)模化應(yīng)用”。
論壇現(xiàn)場(chǎng),華為正式公布了UCM開(kāi)源計(jì)劃。UCM通過(guò)開(kāi)放統(tǒng)一的南北向接口,可適配多類型推理引擎框架、算力及存儲(chǔ)系統(tǒng)。今年9月,UCM將正式開(kāi)源,后續(xù)逐步貢獻(xiàn)給業(yè)界主流推理引擎社區(qū),攜手全產(chǎn)業(yè)共同推動(dòng)AI推理生態(tài)的繁榮發(fā)展。