国产九九视频一区二区三区_亚洲欧美资源在线_精品国产自在久精品国产_成人午夜黄色影院

京東MALL現場直擊多款多噴頭3D打印機實操評測 消費級3D打印機迎來新突破里程碑時刻!縱橫第100家體驗中心榮耀啟幕,筑牢中國豪華越野品類生態根基惡意利用“七無天無理由退貨”政策法律不予支持!央視曝光“摸摸黨”拼多多聯席董事長趙佳臻:Temu將All In中國供應鏈以科技守味非遺!卡薩帝冰箱冬至將全國啟幕「好好吃」餃子館字節TRAE,正悄悄“解放”600萬工程師酷開再獲國家級“信任牌照”:數據安全彰顯戰略定力ThinkPad 2025黑FUN禮——了不起的offer,企業采購專享狂歡來襲!拼多多宣布實行聯席董事長制度 下一個三年爭取再造一個拼多多菜鳥將入股九識智能 無人車業務有望大整合抖音上線“長輩防走失模式”同程旅行發布2025年度旅行榜:長線出行北上廣至川藏航線熱度居首XR專利首案在歐洲落地,中國智造出海風險與機遇并行超能小度,賦能生長,小度全屋智能舉辦年終核心服務商成長特訓營破“內卷”、立標準、向未來 光伏行業領袖共話行業生態重塑之道AI重構2026年線上帶貨新生態:零庫存爆單、小紅書月銷百萬,開啟AI小店副業新時代人形機器人租賃市場大幅降溫 行業商業化路徑仍待探索阿里云AI Landing Zone正式發布,助力企業從“上好云”到“用好AI”的戰略升級118家標桿企業脫穎而出,定義AI時代的雇主標桿!2025NFuture最佳雇主AI榜單重磅發布昇思人工智能框架峰會 | MindSpore Lite混合精度推理,實現內存節省30%,助力鴻蒙翻譯模型輕量化部署
  • 首頁 > 云計算頻道 > 大模型

    清華、浙大推GPT-4V開源平替!LLaVA、CogAgent等開源視覺模型大爆發

    2024年01月04日 11:43:44 來源:站長之家

      近期,GPT-4V的開源替代方案在中國的頂尖學府清華、浙大等的推動下,出現了一系列性能優異的開源視覺模型。其中,LLaVA、CogAgent和BakLLaVA是三種備受關注的開源視覺語言模型。

      LLaVA是一個端到端訓練的多模態大模型,它將視覺編碼器和用于通用視覺和語言理解的Vicuna相結合,具備令人印象深刻的聊天能力。而CogAgent是在CogVLM基礎上改進的開源視覺語言模型,擁有110億個視覺參數和70億個語言參數。

      另外,BakLLaVA是使用LLaVA1.5架構增強的Mistral7B基礎模型,已經在多個基準測試中優于LLaVA213B。這三種開源視覺模型在視覺處理領域具有極大的潛力。

      LLaVA在視覺聊天和推理問答方面表現出接近GPT-4水平的能力。在視覺聊天方面,LLaVA的表現相對于GPT-4的評分達到了85%,在推理問答方面更是達到了92.53%的超過GPT-4的新SoTA。LLaVA在回答問題時,能夠全面而有邏輯地生成回答,并且可以以JSON格式輸出。

      它不僅可以從圖片中提取信息并回答問題,還可以將圖片轉化為JSON格式。LLaVA還可以識別驗證碼、識別圖中的物體品種等,展現出了強大的多模態能力。在性能上接近GPT-4的情況下,LLaVA具有更高的成本效益,訓練只需要8個A100即可在1天內完成。

      CogAgent作為在CogVLM基礎上改進的開源視覺語言模型,擁有更多的功能和性能優勢。它支持更高分辨率的視覺輸入和對話答題,能夠處理超高分辨率圖像輸入。

    image.png

      CogAgent還提供了可視化代理的能力,能夠返回任何給定任務的計劃、下一步行動和帶有坐標的具體操作。它還增強了與圖形用戶界面相關的問題解答功能,可以處理與網頁、PC應用程序、移動應用程序等任何圖形用戶界面截圖相關的問題。另外,通過改進預培訓和微調,CogAgent還增強了OCR相關任務的能力。這些功能的提升使得CogAgent在多個基準測試上實現了最先進的通用性能。

      BakLLaVA是使用LLaVA1.5架構增強的Mistral7B基礎模型,具備更好的性能和商用能力。BakLLaVA在多個基準測試中優于LLaVA213B,并且可以在某些數據上進行微調和推理。雖然BakLLaVA在訓練過程中使用了LLaVA的語料庫,不允許商用,但BakLLaVA2則采用了更大的數據集和更新的架構,超越了當前的LLaVA方法,具備商用能力。

      文章內容僅供閱讀,不構成投資建議,請謹慎對待。投資者據此操作,風險自擔。

    海報生成中...

    最新新聞

    熱門新聞

    即時

    全球頂級AI創作社區回歸!海藝AI國內首發“全民娛樂化創作

    海藝AI的模型系統在國際市場上廣受好評,目前站內累計模型數超過80萬個,涵蓋寫實、二次元、插畫、設計、攝影、風格化圖像等多類型應用場景,基本覆蓋所有主流創作風格。

    新聞

    市場占比高達35.8%,阿里云引領中國AI云增長

    9月9日,國際權威市場調研機構英富曼(Omdia)發布了《中國AI云市場,1H25》報告。中國AI云市場阿里云占比8%位列第一。

    3C消費

    雅馬哈推出兩款高端頭戴耳機YH-4000與YH-C3000

    雅馬哈昨日宣布推出兩款頭戴式耳機,分別是平板振膜的YH-4000和動圈原理的YH-C3000。

    研究

    IDC:2025上半年全球智能家居清潔機器人出貨量同比暴

    IDC今日發布的《全球智能家居清潔機器人設備市場季度跟蹤報告,2025年第二季度》顯示,上半年全球智能家居清潔機器人市場出貨1,2萬臺,同比增長33%,顯示出品類強勁的市場需求。

    国产九九视频一区二区三区_亚洲欧美资源在线_精品国产自在久精品国产_成人午夜黄色影院
    | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | | |