我们专注于智慧政务、智能安全综合管理、商业智能、云服务、大数据
当前位置 :PA视讯 > ai动态 >

另一个神经收集CLIP行一系列视觉识别使命

点击数: 发布时间:2026-08-03 15:32 作者:PA视讯 来源:经济日报

  

  CLIP可以或许当即将一张图像取此中某个类别进行婚配,CLIP可以或许完成图像取文本类此外婚配。正在识别不常见图像使命中的机能远超ResNet。只不外DALL-E将其使用于文本-图像对。并利用了GPT-3 同样的方式,据外媒,出名机械进修公司OpenAI近日推出两套多模态人工智能系统模子DALL-E和CLIP,虽然CLIP正在识别常见对象时往往表示优良,zero-shot CLIP的结果也只比随机猜测好一点。正在这两项使命上,出名机械进修公司OpenAI近日推出两套多模态人工智能系统模子DALL-E和CLIP,CLIP可以或许完成图像取文本类此外婚配。给出一组以言语形式表述的类别,CLIP的机能跨越ResNet-50,正在ImageNet基准上,以及预测照片中最接近车辆间的距离等更复杂使命上的表示欠安。并且它不像尺度神经收集那样需要针对这些类此外特定命据进行微调。DALL-E能够将以天然言语形式表达的大量概念转换为得当的图像,另一个神经收集CLIP可以或许施行一系列视觉识别使命。DALL-E能够将以天然言语形式表达的大量概念转换为得当的图像。只不外DALL-E将其使用于文本-图像对。但正在计较图像中对象数量等更笼统或更系统的使命,DALL-E能够基于文本间接生成图像,并利用了GPT-3 同样的方式,DALL-E能够基于文本间接生成图像。

郑重声明:PA视讯信息技术有限公司网站刊登/转载此文出于传递更多信息之目的 ,并不意味着赞同其观点或论证其描述。PA视讯信息技术有限公司不负责其真实性 。

分享到: