摘要:WAIC 2026現(xiàn)場亮點 | 海康威視重磅發(fā)布多模態(tài)智能攝像機(jī)
WAIC 2026現(xiàn)場亮點 | 海康威視重磅發(fā)布多模態(tài)智能攝像機(jī)
“如果水庫里有人游泳,請及時告警。”在過去,這是一句交給安全管理員的指令,而在2026世界人工智能大會(WAIC 2026)上,海康威視展示了一種全新的可能——將這個任務(wù)直接下達(dá)給一臺攝像機(jī)。
7月17日,WAIC 2026開幕首日,海康威視重磅發(fā)布多模態(tài)智能攝像機(jī),實現(xiàn)了“一句話就能讓攝像機(jī)干活”。例如,在水庫安全管理場景中,傳統(tǒng)相機(jī)看到的是有“人”和“水域”,而設(shè)定好任務(wù)的多模態(tài)智能攝像機(jī)不僅能夠?qū)崟r監(jiān)測風(fēng)險區(qū)域,精準(zhǔn)描述場景中的人物、狀態(tài)與環(huán)境,更能理解場景,判斷“人員游泳存在溺水風(fēng)險”,主動聯(lián)動喇叭發(fā)出警示。這種“能聽懂、能理解、能執(zhí)行”的能力,標(biāo)志著攝像機(jī)正在進(jìn)化為主動服務(wù)的“智能助手”。
這份突破得益于多模態(tài)大模型與邊緣計算架構(gòu)的深度融合。海康威視相關(guān)負(fù)責(zé)人介紹:“我們把多模態(tài)大模型裝進(jìn)了這個小巧的機(jī)身里,讓它不僅能精準(zhǔn)感知,還能快速認(rèn)知、判斷、響應(yīng),適配類似近水提醒這種事關(guān)安全,對實時性要求較高的場景。”相比于傳統(tǒng)攝像機(jī),多模態(tài)智能攝像機(jī)具備更強(qiáng)的場景理解能力、更靈活的任務(wù)配置方式以及更實時的邊緣處理能力。
具體來說,傳統(tǒng)攝像機(jī)僅能看見畫面中有什么、加持了單一視覺大模型的攝像機(jī)能看懂畫面中有什么,但無法響應(yīng)人類的語言指令。而多模態(tài)智能攝像機(jī)通過多模態(tài)能力,實現(xiàn)了三重躍升:一是交互升級,從編寫復(fù)雜規(guī)則到直接說出需求;二是理解升級,從識別“有一群人”到理解“他們在游泳,存在風(fēng)險”;三是決策升級,從被動報警到主動聯(lián)動聲光、通知管控。
在算力和參數(shù)上,多模態(tài)智能攝像機(jī)集成26T算力、內(nèi)置2B參數(shù)量多模態(tài)大模型、支持圖文深度理解與語義解析,在端側(cè)就能實現(xiàn)多模態(tài)交互閉環(huán),可廣泛應(yīng)用于公共安全、城市治理、工業(yè)制造、安全生產(chǎn)等領(lǐng)域。
值得一提的是,多模態(tài)智能攝像機(jī)支持自然語言布控,可以有效提升業(yè)務(wù)效率。以應(yīng)用在安全生產(chǎn)場景為例,用戶只需輸入一段自然語言,如“未穿反光衣進(jìn)入施工區(qū)人員請報警”,系統(tǒng)即刻將其轉(zhuǎn)化為動態(tài)布控規(guī)則,端側(cè)實時視頻流一旦匹配目標(biāo),立即觸發(fā)報警并支持聯(lián)動聲光、門禁等周邊設(shè)備。從被動檢索到主動防御,從事后查證到事中干預(yù),實現(xiàn)閉環(huán)管理。
在WAIC 2026海康威視展區(qū),觀眾還可親自體驗這種“觸手可及”的智能。通過點擊屏幕上的詞條,如“這是什么場景,分析場景中的風(fēng)險行為”或“檢測畫面中是否有人游泳,如有,告警”,多模態(tài)智能攝像機(jī)便能自動分析視頻內(nèi)容,并在屏幕上實時生成圖文問答結(jié)果、預(yù)警信息,并聯(lián)動發(fā)出語音報警提示“此處禁止游泳,請盡快離開”。
這一演示不僅直觀展現(xiàn)了海康威視在圖文理解與自然語言交互上的實力,也讓現(xiàn)場觀眾切身感受到,大模型不只是“能看懂”,更“能對話”“能干活”,是真正可以扎根進(jìn)一線場景的智慧助手。
從水庫近水提醒到工廠安全生產(chǎn),從城市治理到智慧零售……過去許多智能分析場景受限于網(wǎng)絡(luò)帶寬或云端算力成本,難以實現(xiàn)實時響應(yīng)。海康威視憑借在智能物聯(lián)領(lǐng)域的深厚積累,持續(xù)推動AI技術(shù)在邊緣端的落地,如今多模態(tài)智能攝像機(jī)的發(fā)布,更是標(biāo)志著AI能力真正能夠下沉至行業(yè)應(yīng)用的最后一公里,這將為千行百業(yè)的數(shù)字化轉(zhuǎn)型,注入澎湃的新動能。
推薦閱讀
最新資訊
微視角