![]()
作者|洋紫
編輯|李小天
霞光社獲悉,Visual Agent 創(chuàng)業(yè)公司 Chance AI 宣布完成數(shù)百萬美元融資。本輪由美圖領(lǐng)投,NYX Ventures、阿里系投資機(jī)構(gòu)等跟投。融資將用于模型能力迭代、北美學(xué)生群體增長、以及社區(qū)與商業(yè)化探索。
Chance AI 成立于2025年,核心產(chǎn)品是世界第一款以攝像頭為主要入口的AI產(chǎn)品Visual Agent(視覺智能體)。與傳統(tǒng)AI產(chǎn)品依賴輸入框不同,用戶打開Chance AI后直接拍攝眼前內(nèi)容,系統(tǒng)即可理解視覺意圖并提供判斷、建議和行動(dòng)方案。
在Chance AI看來,視覺不是輸入方式,而是人類的認(rèn)知系統(tǒng)。“對(duì)人類來說,視覺才是最直覺的操作系統(tǒng),而不是輸入框。”Chance AI創(chuàng)始人兼CEO曾熙告訴霞光社,“從第一天開始做產(chǎn)品,我們的首頁就是沒有任何輸入框的。在我們的產(chǎn)品里面唯一的輸入框就是出現(xiàn)在評(píng)論區(qū),但是現(xiàn)在更多人是用語音,點(diǎn)開只有一個(gè)拍照按鍵,進(jìn)來以后用戶不用輸入prompt,one tap,因?yàn)檫@才是人類最直覺的方式。”
使用方式也很簡單,只需要通過Chance AI拍攝任何圖片,Chance AI就會(huì)快速將圖片內(nèi)容轉(zhuǎn)為對(duì)于圖片深層次含義的解讀。每一個(gè)圖片都不只限于“閱讀”,更多在于“理解”,即在認(rèn)識(shí)的基礎(chǔ)上解釋看見事物的意義;此外,Chance AI也有Live模式,即實(shí)時(shí)視覺交互系統(tǒng)(Real-time Visual Intelligence System),在Live模式中,用戶可以一邊看,一邊與Chance AI交流,它還會(huì)做出對(duì)于畫面的實(shí)時(shí)視覺理解(Real-time perception)以及連續(xù)推理(Continuous reasoning,而非單次響應(yīng))。
![]()
![]()
巴塞爾藝術(shù)周現(xiàn)場,觀眾使用Chance AI「Visual Agent – Live」,在觀看作品的過程中與AI實(shí)時(shí)交流與理解
Chance AI的交互方式,打破了過去兩年間,AI通過輸入框提問、隨后獲得答案的主流形態(tài)。曾熙向霞光社表示,產(chǎn)品設(shè)計(jì)的差異源自年輕人認(rèn)識(shí)世界的底層邏輯不同,對(duì)從小使用emoji、meme和縮寫溝通的Gen Z來說,他們本身就是visual native:更習(xí)慣通過圖像和直覺理解世界,而不是先組織語言再提問。也就是說,越來越多的年輕人對(duì)于現(xiàn)實(shí)世界的認(rèn)知方式是從“先提問再理解” 轉(zhuǎn)變?yōu)椤跋瓤匆娫倮斫狻薄?/p>
對(duì)圖像的精準(zhǔn)理解離不開Chance AI的技術(shù)突破。MMMMU-Pro 是目前最嚴(yán)苛的多模態(tài)基準(zhǔn)測(cè)試之一,它通過過濾純文本可解題、增加選項(xiàng)干擾,并將問題嵌入圖像中,真正考察 AI 是否具備人類級(jí)別的視覺理解與跨學(xué)科推理能力,而非依賴模式匹配或文字捷徑。Chance AI Visual Agent 在 MMMU 相關(guān)評(píng)測(cè)中以 86.07% 的準(zhǔn)確率位列世界第一,在藝術(shù)理解、結(jié)構(gòu)分析與跨語境解釋等任務(wù)上表現(xiàn)優(yōu)秀,甚至超越了人類在2024年的成績。
![]()
實(shí)際操作上也可見Chance AI的出色表現(xiàn),如下圖所示,為一塊坐標(biāo)于洛杉磯的市中心的石頭,在Chance AI的“看見”里,不只有關(guān)于石頭的來歷故事——即一位藝術(shù)家把這個(gè)石頭從內(nèi)華達(dá)州搬過來花了1300萬美金,還有這一故事背后的意義:這場搬運(yùn)是為了體現(xiàn)美國的種族和階級(jí)對(duì)立的問題。
![]()
截至目前,Chance AI的全球年輕用戶已突破20萬,在iOS歐美多個(gè)國家進(jìn)入下載榜Top 3,并在Product Hunt上兩次獲得當(dāng)日最佳產(chǎn)品(Product of the Day)。在剛剛過去的香港Art Central藝術(shù)展上,Chance AI也作為官方創(chuàng)新合作伙伴,深度融入觀眾的觀展體驗(yàn),這一能力也首次得到了真實(shí)場景的驗(yàn)證。
面向未來的可能性,曾熙表示,手機(jī)拍照分享目前是圖片數(shù)據(jù)來源最直接、量最大的場景。“現(xiàn)在我們的數(shù)據(jù)是,每個(gè)北美的女生每天會(huì)拍2.8次的穿搭,這是非常海量的數(shù)據(jù)。”而視覺數(shù)據(jù)本身就創(chuàng)造了價(jià)值,“我們想把Visual Agent engine這‘發(fā)動(dòng)機(jī)’給搭好,以后我們會(huì)有更豐富的數(shù)據(jù),會(huì)形成視覺的社區(qū),這就是最大的價(jià)值。”
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.