編輯|Panda、張倩
通勤路上,你擠在地鐵車廂里,手機(jī)舉到耳邊,微信語音那頭是同事在交代今天要交的方案細(xì)節(jié)。「關(guān)于那個(gè)…… 預(yù)算…… 三點(diǎn)之前……」聲音斷斷續(xù)續(xù)地,關(guān)鍵信息大半都遺漏了。
![]()
在地鐵、地下車庫或者大會(huì)、演唱會(huì)現(xiàn)場,你是不是經(jīng)常遇到這種情況?只要網(wǎng)絡(luò)變差,微信通話就變成了一件折磨人的事情,卡頓、吞字、電流聲讓人莫名煩躁…… 怎么都 2026 年了,想打個(gè)微信電話把事情說清楚還那么難?網(wǎng)絡(luò)差就聽不清,這真的是鐵律嗎?
在今年 WAIC 中國電信的展臺(tái)上,我們看到了反常識(shí)的一幕。展臺(tái)上擺著兩部正在通話中的手機(jī),上面各自顯示著一個(gè)局域網(wǎng) IP 地址,音質(zhì)聽起來很清晰。然而,其背后的幾個(gè)字「極窄帶寬語音通話」卻吸引了我們的注意。
![]()
「極窄」到底是有多窄?我們?cè)诂F(xiàn)場聽到了一個(gè)超乎想象的數(shù)字:0.266kbps
沒錯(cuò),超夸張。你可以查看你電腦上任意一個(gè)音頻文件的碼率,你幾乎不可能找到如此低碼率的文件。0.266kbps 確實(shí)是一項(xiàng)新的世界記錄。
![]()
目前主流的音樂文件的碼率通常為 320kbps,某些甚至可達(dá)到數(shù)千 kbps
那么,碼率究竟是什么?其實(shí)從其單位也能看出來,kbps = kilo-bits per second,也即每秒多少千比特;也就是說,碼率決定了一秒鐘的語音里能裝下多少信息。碼率越高,聲音細(xì)節(jié)越完整;碼率越低,數(shù)據(jù)要擠過狹窄的通道,就得舍棄細(xì)節(jié) —— 聲音發(fā)悶、發(fā)飄、斷斷續(xù)續(xù),都是這么來的。
在實(shí)際語音通話中,服務(wù)商通常會(huì)使用動(dòng)態(tài)碼率:網(wǎng)絡(luò)好時(shí)用高碼率,清晰流暢;一旦網(wǎng)絡(luò)波動(dòng)(比如地鐵鉆進(jìn)隧道),就自動(dòng)降到低碼率,以保住通話不斷。
那 0.266kbps 到底有多低?做個(gè)對(duì)照更能體會(huì):移動(dòng)通信的語音編碼走過了 2G 的 AMR-NB、4G 的 AMR-WB,到今天 VoLTE 高清通話普遍采用的 EVS 編解碼(這已是 3GPP 迄今性能最好的語音編碼),但也需要在 5.9 到 128 kbps 區(qū)間工作,日常一通 VoLTE 高清通話大約需 15 kbps。而智傳網(wǎng)(AI Flow)把這個(gè)數(shù)字壓到了 0.266 kbps!
按過去的經(jīng)驗(yàn),這種碼率頂多傳輸一些簡單的文字指令,打電話是想都不敢想的事,極端情況下,對(duì)方說「飛流直下三千尺,疑是銀河落九天」,你聽得到的卻是「飛…… 天」。但在中國電信這里,它不僅能清晰通話,甚至連音樂都能傳 —— 僅相當(dāng)于傳統(tǒng)編解碼技術(shù) 128 kbps 的 1/500;如果只傳語音,碼率還能更低。這也刷新了已知語音通信的最低碼率紀(jì)錄
可以說,中國電信的這項(xiàng)技術(shù)挑戰(zhàn)了「網(wǎng)絡(luò)差就聽不清」的鐵律。而這項(xiàng)技術(shù)也有個(gè)名字:智傳網(wǎng)(AI Flow),由中國電信人工智能研究院(TeleAI)全自研原創(chuàng)打造。就在大會(huì)開幕當(dāng)天,它從 230 多個(gè)項(xiàng)目中脫穎而出,拿下了今年 WAIC 的最高獎(jiǎng):卓越人工智能引領(lǐng)者獎(jiǎng)(SAIL 獎(jiǎng)),這個(gè)獎(jiǎng)也被稱為「AI 界的奧斯卡」。
![]()
此外,智傳網(wǎng)(AI Flow)的核心技術(shù)生成式智能傳輸(Generative Transmission)還獲得了首屆 WAIC-Academic 最佳論文獎(jiǎng)
![]()
那么,智傳網(wǎng)(AI Flow)到底是什么?為什么能做到傳統(tǒng)通信做不到的事?會(huì)對(duì)哪些領(lǐng)域帶來深遠(yuǎn)影響?中國電信集團(tuán)CTO、首席科學(xué)家、中國電信人工智能研究院(TeleAI)院長李學(xué)龍?jiān)?WAIC 中國電信人工智能生態(tài)論壇上進(jìn)行了深度解析。
生成式智能傳輸:
把傳「比特流」變成傳「詞元流」
智傳網(wǎng)(AI Flow)是什么?其名字本身就已暗示:智代表人工智能,傳是指通信傳輸,而網(wǎng)指網(wǎng)絡(luò)技術(shù)。
表面看是一項(xiàng)技術(shù),但背后融合了三大學(xué)科,這就不難理解為什么智傳網(wǎng)(AI Flow)會(huì)誕生在 TeleAI。
TeleAI 是央企里第一家人工智能研究院。而中國電信這家公司本身就是通信起家的。也正因如此,通信的天花板在哪里、瓶頸卡在哪里,沒有人比他們更清楚。智傳網(wǎng)(AI Flow)就是他們把 AI 這套新工具,接進(jìn)通信這門老手藝后長出來的東西。
它到底新在哪兒?關(guān)鍵在于換掉了傳輸?shù)摹肛浳铩埂?/p>
最傳統(tǒng)的通信本質(zhì)上做的是符號(hào)搬運(yùn)。你的聲音被麥克風(fēng)收進(jìn)來,收到多少信息,就原原本本傳多少比特;視頻則拆成一個(gè)個(gè)像素點(diǎn)往外發(fā)。信息越清晰,數(shù)據(jù)量越大,占的帶寬也越多。這是一筆省不掉的剛性開銷。
帶寬不夠怎么辦?只能壓縮,而壓縮又分為無損壓縮和有損壓縮。為了盡可能降低帶寬,只能選擇有損壓縮,即丟棄部分細(xì)節(jié)。可壓縮有極限,壓到最后,就是我們熟悉的那種糊成一團(tuán)、斷斷續(xù)續(xù)的體驗(yàn)。所以在舊框架里,這幾乎是個(gè)死結(jié):要清晰就得要帶寬,沒帶寬就別想清晰。
![]()
不同程度的圖像有損壓縮示意,音頻也是類似
智傳網(wǎng)(AI Flow)的不同之處在于,它是一種借助智能完成的壓縮。其核心技術(shù)叫生成式智能傳輸,思路可以概括成六個(gè)字:用計(jì)算換帶寬
具體來說,發(fā)送端不再直接搬運(yùn)聲音本身,而是先用多模態(tài)大模型把這段語音「讀懂」,把其中最核心的語義、聲紋、特征等信息,凝練成一小串詞元(Token)發(fā)出去;接收端收到這串詞元后,再用生成式大模型把聲音重新「生成」還原出來。傳輸?shù)膶?duì)象,就此從「比特流」變成了「詞元流」。詞元的體量遠(yuǎn)小于原始比特,帶寬占用自然斷崖式下降。
這套打法背后是 TeleAI 早就鋪下來的理論地基。早在 2002 年,李學(xué)龍團(tuán)隊(duì)就提出了信容理論,揭示了計(jì)算、通信與存儲(chǔ)之間可以相互折疊、彼此換算的關(guān)系。除此之外,團(tuán)隊(duì)對(duì)「噪聲」的重新定義也為這套架構(gòu)掃清了認(rèn)知障礙——傳統(tǒng)通信視噪聲為洪水猛獸,而「正激勵(lì)噪聲」理論指出,當(dāng)噪聲與任務(wù)目標(biāo)相關(guān)時(shí),它反而能降低任務(wù)復(fù)雜度、起到正向驅(qū)動(dòng)作用。這一認(rèn)知讓AI不再盲目地「丟棄」低碼率下的細(xì)節(jié),而是學(xué)會(huì)區(qū)分哪些是干擾、哪些是可用的線索。后來,多模態(tài)大模型成熟,「用計(jì)算換帶寬」終于得以從紙面走進(jìn)現(xiàn)實(shí) —— 通信研究盯了幾十年的編碼和信道,天花板被 AI 捅破。
對(duì)智傳網(wǎng)(AI Flow)來說,傳語音其實(shí)只是一道「簡單題」,畢竟語音的碼率本來就不大。真正的考驗(yàn)是視頻。
傳統(tǒng)視頻編碼(從 H.264 到 H.265、H.266)本質(zhì)上是在「找冗余」,即靠幀間預(yù)測和運(yùn)動(dòng)補(bǔ)償,只記錄前后畫面里變化的部分。這套思路已經(jīng)打磨到極致,H.266 在理想情況下甚至能把碼率壓到 H.264 的四分之一。但它再聰明,傳的仍然是像素的差值,一旦帶寬被壓到臨界點(diǎn),殘差信息不夠了,畫面就開始糊、開始丟幀。這是「搬運(yùn)像素」這條路線繞不開的物理下限。
同樣地,智傳網(wǎng)(AI Flow)更換了這條路線:不再搬運(yùn)像素差值,而是傳詞元。
發(fā)送端從視頻流中抽出畫面語義、動(dòng)態(tài)特征,凝成輕量的詞元流發(fā)出;接收端再把畫面重新「生成」出來。結(jié)果相當(dāng)夸張:一段 1080P、24FPS 的高清視頻,不到 100kbps 就能穩(wěn)定傳輸,而傳統(tǒng)方式需要約 3.6Mbps—— 前者只有后者的 3%。如果說語音方向,智傳網(wǎng)實(shí)現(xiàn)的是「用發(fā)信息的帶寬打電話」,那在視頻方向它就實(shí)現(xiàn)了「用打電話的帶寬傳高清視頻」。
![]()
極致的壓縮效率讓「傳詞元」這件事的想象力沒有止步于傳畫面。和世界模型聯(lián)手之后,它甚至能傳一個(gè)「世界」。
最近有多少人熬夜看世界杯?但無論你買的電視多大,你能看到的畫面始終是導(dǎo)播給你切的那個(gè)角度,說白了就是一個(gè)三維世界的投影。
智傳網(wǎng)(AI Flow)就不一樣了,借助詞元流,它能裝下一場球賽的球員、足球、球場和動(dòng)作軌跡之間的時(shí)空關(guān)系。當(dāng)然,要把這樣的詞元流還原成畫面,靠傳統(tǒng)解碼已經(jīng)不夠了,TeleAI 在接收端引入的,正是當(dāng)下 AI 領(lǐng)域最熱的技術(shù)之一:世界模型。
接收端也不再只是逐幀重建像素,而是根據(jù)詞元流還原出一個(gè)可進(jìn)入、可觀察的三維世界 —— 同一次射門,你可以從全景俯瞰,可以貼身跟拍,甚至可以切換到門將的第一人稱視角,重新看一遍。
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
李學(xué)龍?jiān)谘葜v中用了柏拉圖的比喻:傳統(tǒng)視頻里,觀眾是洞穴中看影子的囚徒;而智傳網(wǎng)(AI Flow)讓你走出洞穴,自由翱翔。對(duì)賽事直播來說,這也許意味著一件不小的事:「導(dǎo)播決定你看什么」的時(shí)代,正在出現(xiàn)裂縫。
![]()
這就是「傳比特」和「傳詞元」的本質(zhì)區(qū)別,前者很快觸及天花板,而后者的應(yīng)用邊界才剛剛開始探索。
當(dāng)然,畫面是 AI「生成」出來的,一個(gè)自然的疑問是:它能信嗎?畢竟,一個(gè)不可信的東西,你傳得再快、再清晰有什么用?
這方面,TeleAI 給出的回答是雙重保障。一方面,團(tuán)隊(duì)對(duì)重建的通信速率與理解性能做了系統(tǒng)評(píng)估,無論是下游任務(wù)的理解能力,還是原始音視頻的重建質(zhì)量,都達(dá)到國際領(lǐng)先水平;另一方面,可信溯源技術(shù)會(huì)給每一段重建視頻打上「不可磨滅的數(shù)字烙印」,確保無論從哪個(gè)視角觀察,事件的真實(shí)性都不會(huì)被篡改。
這其中,藏著一次遲到七十多年的突破。早在信息論奠基之初,香農(nóng)和韋弗就把通信分成了三層:符號(hào)層,關(guān)心一串比特能否準(zhǔn)確送達(dá);語義層,關(guān)心意思有沒有傳對(duì);效用層,關(guān)心接收方拿到信息后能不能真正把事情辦成。傳統(tǒng)通信八十年來主要在啃第一層。
而智傳網(wǎng)(AI Flow)想做的是讓同一串詞元貫通三層:它既是精準(zhǔn)重建畫面的特征數(shù)據(jù)(符號(hào)層),又是可被理解、推理的語義向量(語義層),還能直接驅(qū)動(dòng)一次救援決策或一個(gè)機(jī)器人動(dòng)作(效用層)。
以災(zāi)區(qū)救援為例,一棵樹的紋理還原得準(zhǔn)不準(zhǔn),優(yōu)先級(jí)其實(shí)很低;「哪里有人、道路斷沒斷、房子會(huì)不會(huì)塌」,才是效用層真正在乎的東西。
所以,智傳網(wǎng)(AI Flow)真正的意義,不只是把聲音、畫面壓縮得更小,而是讓信息以「可信可用」的形態(tài)抵達(dá)原本到不了的地方,去發(fā)揮它應(yīng)有的效用 —— 這對(duì) AI 來說,正是當(dāng)下最緊迫的一道關(guān)卡。
天空地海:低帶寬鏈路下實(shí)時(shí)傳輸音視頻
這幾年 AI 的演進(jìn)有一條清晰的主線:從大模型,到智能體,再到具身智能,能力越來越強(qiáng),也越來越需要突破物理邊界「走出去」,走進(jìn)天空、荒野、深海這些人和網(wǎng)絡(luò)都難以抵達(dá)的地方。可傳統(tǒng)通信的覆蓋,高度依賴基站、光纖和穩(wěn)定電力,一旦離開這些基礎(chǔ)設(shè)施,連接就會(huì)迅速崩塌。
智傳網(wǎng)(AI Flow)要做的,是讓一批硬件終端擺脫這種束縛,把智能送到更遠(yuǎn)的地方。TeleAI 把這件事拆成了天、空、地、海四個(gè)方向。
先看「天」和「空」。當(dāng)下業(yè)界都在喊「算力上天」,但算力上天的意義究竟在哪?過去,衛(wèi)星在通信網(wǎng)絡(luò)里扮演的角色幾乎沒變過,它就像一面掛在天上的鏡子,只負(fù)責(zé)把信號(hào)反射回去,大部分的「思考」都發(fā)生在地面。算力上天真正的價(jià)值,就是讓衛(wèi)星從「管道」變成「節(jié)點(diǎn)」:信息還在軌道上,就被讀懂了。
道理成立,但怎么落地?智傳網(wǎng)(AI Flow)提供了實(shí)現(xiàn)的可能。星地鏈路的特點(diǎn)是地面終端功率小、天線小,往衛(wèi)星發(fā)信號(hào)(上行)的帶寬很緊張;而衛(wèi)星往地面廣播(下行)的帶寬相對(duì)寬裕。順著這個(gè)天然的不對(duì)稱,智傳網(wǎng)(AI Flow)把最吃算力的解碼模型部署到在軌衛(wèi)星上 —— 終端只管把輕量詞元發(fā)上去,重活留給天上。目前,這一應(yīng)用方向還在推進(jìn)過程中。
而順著這張網(wǎng)往下,就到了「空」這一層 ——輕小型無人機(jī)直連衛(wèi)星,傳輸高清視頻,這是國內(nèi)首次
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
輕小型無人機(jī)是低空勘察的核心裝備,卻長期被物理瓶頸死死卡住:想傳得快、傳得清,就得背更重、更耗電的通信設(shè)備,可設(shè)備一重,續(xù)航和機(jī)動(dòng)性就得打折。過去它還必須先把畫面?zhèn)鹘o地面的臨時(shí)接收站,再由地面轉(zhuǎn)發(fā)上星,而這意味著無人機(jī)不能飛得太遠(yuǎn),只能圍著地面設(shè)備打轉(zhuǎn)。
而 TeleAI 在國內(nèi)首次做到:給無人機(jī)裝上一個(gè)生成式智能傳輸?shù)摹负凶印购鸵惶仔⌒托l(wèi)星通信設(shè)備,讓它直接連上衛(wèi)星。
在這套方案下,無人機(jī)以平均約 60 kbps 的帶寬就能實(shí)時(shí)回傳 720P 視頻,而同樣的畫面用傳統(tǒng) H.264 編碼大約需要 2 Mbps。掙脫了基站和光纖的羈絆,無人機(jī)實(shí)時(shí)回傳的范圍一下子變大了。從此,斷網(wǎng)不再意味著失聯(lián),生命線被重新搭起,「信息孤島」這個(gè)詞,第一次在物理意義上被拆掉了。
再看「地」,也就是機(jī)器人。人類把機(jī)器人造出來,目的之一就是讓它們?nèi)ノ覀內(nèi)ゲ涣说牡胤剑瓿蓪?duì)我們有危險(xiǎn)或我們不愿意做的任務(wù)。但由于機(jī)器人的自主性依然有限,人去搖操機(jī)器人是當(dāng)下最好的選擇。但這一搖操半徑,經(jīng)常因無法忍受的網(wǎng)絡(luò)延遲被鎖死在一個(gè)小小的范圍內(nèi)。智傳網(wǎng)(AI Flow)實(shí)現(xiàn)的突破在于:通過傳詞元這種高效的傳輸方式,它把端到端時(shí)延壓縮到 20—50 毫秒(最新已降到 20 毫秒),首次讓機(jī)器人的遠(yuǎn)程遙操作半徑覆蓋到全國范圍;即便在沒有基站的荒野,也能靠衛(wèi)星鏈路實(shí)現(xiàn)千里之外的畫面實(shí)時(shí)回傳和精準(zhǔn)操控。
此外,機(jī)器人要走進(jìn)復(fù)雜環(huán)境干活,光靠單打獨(dú)斗還不夠,關(guān)鍵在于機(jī)器與機(jī)器之間能不能高效協(xié)同。智傳網(wǎng)(AI Flow)的不同之處在于:它依托統(tǒng)一編碼的詞元流,可以讓不同型號(hào)、不同廠商的機(jī)器人共享同一套環(huán)境感知。
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
TeleAI 自研的人形機(jī)器人,以及像宇樹這樣的合作伙伴的機(jī)器人,都能接入這張網(wǎng):一臺(tái)機(jī)器人發(fā)現(xiàn)的路況,可以同步給另一臺(tái);一臺(tái)學(xué)到的經(jīng)驗(yàn),可以變成整個(gè)機(jī)器人網(wǎng)絡(luò)的共識(shí)。多臺(tái)設(shè)備由此減少重復(fù)感知與重復(fù)計(jì)算,逐步走向分布式群體智能
最后是「海」或者說「水」。我們生活在一個(gè)被水包圍的世界,很多活動(dòng)都在水里展開。可在無線通信意義上,任何一片水域都是一塊「信號(hào)黑洞」,因?yàn)殡姶挪ㄔ谒锼p極快,幾乎傳不了幾米;換光通信,清水里能傳得遠(yuǎn),可水一渾濁就瞬間失效。于是只能退回到聲波,因?yàn)槁晫W(xué)鏈路是渾濁水體里唯一還能遠(yuǎn)距離傳輸?shù)妮d體,但它本身帶寬極窄。智傳網(wǎng)(AI Flow)做的,是在這條狹窄的聲學(xué)鏈路上,硬生生跑通了實(shí)時(shí)高清視頻。
依托智傳網(wǎng)(AI Flow)與自研的高速聲通信模組,TeleAI 首次實(shí)現(xiàn)了在任意水體中的遠(yuǎn)程無線實(shí)時(shí)視頻傳輸,可在超過 10 米的距離上穩(wěn)定回傳 720P 高清畫面,應(yīng)用于水下巡檢、生態(tài)監(jiān)測、應(yīng)急搜救等場景,為這些極端環(huán)境提供了穩(wěn)定、實(shí)時(shí)的無線視覺通信能力。
這套核心載荷,目前已經(jīng)搭載在 TeleAI 自研的「空海跨域潛航器」上。我們可以把它理解成一臺(tái)能從空中扎進(jìn)水里的無人機(jī),未來還將隨著與中國船舶集團(tuán)的合作,出現(xiàn)在更多平臺(tái)上。
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
衛(wèi)星、無人機(jī)、機(jī)器人、潛航器,形態(tài)各異,但智傳網(wǎng)(AI Flow)讓它們說上了同一種語言 —— 詞元。過去,每往一個(gè)新空間拓展,通信方案就得重新造一套;而現(xiàn)在,同一套詞元流從天到地、海一路通用。這意味著一件事:機(jī)器能抵達(dá)的地方,智能就能抵達(dá);過去網(wǎng)絡(luò)到不了的地方,從此不再是智能的禁區(qū)
當(dāng)然,讓終端走得遠(yuǎn)只是上半場。這些被送出去的能力,最終要在一個(gè)個(gè)真實(shí)的場景里兌現(xiàn)價(jià)值 —— 這是智傳網(wǎng)(AI Flow)要回答的下一個(gè)問題。
三個(gè)規(guī)模化落地場景
TeleAI 目前跑得最實(shí)的,是應(yīng)急、存儲(chǔ)和隱私三塊。
第一塊是應(yīng)急救援。今年全球極端天氣頻發(fā),洪澇災(zāi)害往往帶來「斷路、斷電、斷網(wǎng)」的三斷困境,災(zāi)區(qū)瞬間被切割成一座座信息孤島,而救援最大的難處,常常不是沒有力量,而是不知道現(xiàn)場究竟發(fā)生了什么。
智傳網(wǎng)(AI Flow)在這里派上了大用場。中國電信打造的「翼鋒·智傳網(wǎng)(AI Flow)應(yīng)急系統(tǒng)」,只需在手機(jī)上裝一個(gè) App,一線人員就能在極窄的衛(wèi)星鏈路下把現(xiàn)場畫面?zhèn)骰睾蠓?—— 傳一張圖只要約 9.6 kbps,配合應(yīng)急救援車提供的約 110 kbps 帶寬,就能實(shí)時(shí)回傳 720P 高清視頻。
要知道,過去在三斷場景下,傳一張高清照片都要幾分鐘,現(xiàn)場態(tài)勢根本來不及送達(dá)指揮部。今年,這套設(shè)備已經(jīng)投入到全國 31 個(gè)省份的一線防汛抗洪中,累計(jì)超過千余套。它讓遠(yuǎn)方的指揮中心,第一次擁有了一雙能抵達(dá)現(xiàn)場的「眼睛」。
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
第二塊是海量視頻的存儲(chǔ)。城市里的攝像頭越來越多,4K、8K 設(shè)備不斷普及,視頻數(shù)據(jù)正在爆炸式增長。傳統(tǒng)做法要完整保存每一幀畫面,可大量監(jiān)控畫面長期「存而不用」,既吃存儲(chǔ)空間,又難以按需調(diào)取。很多監(jiān)控往往只能留存一周左右就得清空騰地方。
智傳網(wǎng)(AI Flow)換了個(gè)思路:不再逐像素保存,而是把視頻編碼成精簡的詞元存下來,需要時(shí)再用生成式模型按需還原。
需要說明的是,傳統(tǒng)視頻壓縮同樣會(huì)利用前后幀的冗余,這不新鮮。智傳網(wǎng)(AI Flow)的不同在于它進(jìn)一步借助模型能力,把背景、人物、車輛、事件統(tǒng)一編碼,因?yàn)楣潭C(jī)位的監(jiān)控畫面里,背景常年不變,系統(tǒng)就只留人和車這些真正動(dòng)態(tài)的語義,而不是一幀幀去記錄幾乎沒變的畫面。
中國電信擁有全球最大的視聯(lián)網(wǎng),覆蓋超過 1 億路攝像頭,正在規(guī)模化推廣這項(xiàng)壓縮存儲(chǔ)技術(shù)。
效果是:在同等硬件條件下,存儲(chǔ)空間可降低為傳統(tǒng)方案的約 1/40,原本只能存一周的影像,如今能存下接近一整年。這項(xiàng)技術(shù)已在天翼視聯(lián)的視聯(lián)網(wǎng)上規(guī)模化落地,首批已有上千路攝像頭接入。
第三塊是隱私保護(hù)。在養(yǎng)老看護(hù)、校園防霸凌這類敏感場景里,人們既希望攝像頭能及時(shí)發(fā)現(xiàn)危險(xiǎn),又不愿意自己的生活被赤裸裸地錄下來、傳上去。這是一對(duì)天然的矛盾。
![]()
視頻鏈接:https://mp.weixin.qq.com/s/jBVInHGPdfZtFc79I6NBAQ
智傳網(wǎng)(AI Flow)靠分層的語義詞元流化解了它:在傳輸階段就把敏感詞元篩掉,讓接收端能讀懂「發(fā)生了什么」,卻無法還原「看到了什么」。比如在養(yǎng)老場景中,系統(tǒng)能識(shí)別老人跌倒、揮手求助等異常行為并及時(shí)向后臺(tái)報(bào)警,但原始影像無從恢復(fù)。用一句現(xiàn)場文案來說 ——「傳的是詞元,不是畫面;認(rèn)的是行為,不是人臉」。這套方案將在智云上海等平臺(tái)上線,觸達(dá)約 400 萬終端用戶。
從災(zāi)區(qū)到城市,從搶險(xiǎn)到看護(hù),這三塊場景的共同點(diǎn)在于:智傳網(wǎng)(AI Flow)關(guān)心的,已經(jīng)不只是「傳了多少數(shù)據(jù)」,而是「這些信息能不能幫人和機(jī)器把事情辦成」。
通信,正在成為智能涌現(xiàn)的條件
從地鐵里那通斷斷續(xù)續(xù)的電話,到災(zāi)區(qū)、深海和衛(wèi)星軌道,智傳網(wǎng)(AI Flow)在 WAIC 上講的其實(shí)是一個(gè)關(guān)于「連接」的故事:那些因?yàn)閹挕⒕嚯x和環(huán)境而被切斷的連接,正在一條一條被接回來。
李學(xué)龍?jiān)谘葜v里說過一句讓人印象很深的話:「智能的涌現(xiàn),源于連接和交互。」他說,智人之所以繁衍壯大,靠的不是比尼安德特人更強(qiáng)壯的體格,而是語言和信息的交流互動(dòng),即連接讓個(gè)體的聰明變成了集體的智慧。
AI 時(shí)代同樣如此。大模型、智能體和機(jī)器人都不會(huì)孤立成長,只有當(dāng)一個(gè)機(jī)器看到的世界能成為另一個(gè)機(jī)器的經(jīng)驗(yàn),當(dāng)分散的感知與能力能夠持續(xù)流動(dòng)、融合,智能才可能真正涌現(xiàn)
七十多年前,香農(nóng)用信息論教會(huì)人類如何把比特送得更遠(yuǎn);今天,智傳網(wǎng)(AI Flow)想回答的是另一個(gè)問題:當(dāng)比特變成了詞元,當(dāng)連接無處不在,智能可以生長到多遠(yuǎn)?
值得玩味的是,AI 圈這些年一直在講「壓縮即智能」,即一個(gè)模型能把世界壓縮得多好,某種程度上就代表它對(duì)世界理解得多深。智傳網(wǎng)(AI Flow)把這句話反了過來:用智能去做壓縮。它靠對(duì)世界的理解,把該傳的意思拎出來、把冗余的比特扔掉,還在其分層網(wǎng)絡(luò)架構(gòu)中部署了一系列大小不同的家族式同源模型,希望實(shí)現(xiàn)基于連接與交互的智能涌現(xiàn)。壓縮與智能,就此變成了一條真實(shí)跑在網(wǎng)絡(luò)里的技術(shù)路徑。
從這個(gè)意義上說,通信正在卸下「傳輸工具」的舊身份,成為智能得以涌現(xiàn)的條件本身。而智傳網(wǎng)(AI Flow)所拓展的也不只是帶寬的邊界,更是智能能夠抵達(dá)、連接與生長的邊界。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.