资讯
展览资讯 大型展会 灯光节 大型盛典 赛事 中标捷报 产品快讯 热门话题 艺术节 活动 演出 新闻 数艺报道 俱乐部签约
观点
大咖专访 观点洞察 书籍推荐 吐槽 设计观点 企业访谈 问答 趋势创新 论文 职场方法 薪资报价 数艺专访
幕后
幕后故事 团队访谈 经验分享 解密 评测 数艺访谈
干货
设计方案 策划方案 素材资源 教程 文案资源 PPT下载 入门宝典 作品合集 产品手册 电子书 项目对接
  • 0
  • 0
  • 0

分享

ChatGPT图像识别能力解锁和深度分析

2023-02-13



  新智元报道  

来源:老罗不说
作者:罗予晨
编辑:好困
【新智元导读】其实,ChatGPT是可以识别图片的!你只需要输入图片网址,并确保图片能不受限制地被OpenAI的服务器读取到。

因为ChatGPT网页上没有上传图片按钮,所以一般人都不知道它能识别图片。但是其实它是可以识别图片的,你需要输入图片网址,确保图片不需要登录或者其他限制条件就能被美国服务器读取到。

目前看它读取Wiki、CNN图片都没有问题。

那么它能识别出什么内容?

普通新闻图片


ChatGPT没有识别出具体的装备型号,但是描述了一个非常贴近的场景氛围。对构图的视角有较强的理解力。

人物图片


马克龙这张,没有识别出人脸,也没有识别出画面的文字。但是可以基本描述出画面内容,虽然有一些错误。重点是它对场景的猜测,和接近人的感觉,比如它说马克龙像是很有礼貌的人。

上面两张是识别精度一般的,这里还有画面特征比较强,识别精度较高的。

特定历史图片


这幅越战美军搜查敌人的照片。被ChatGPT详细的描述了细节,这幅图的场景,人物和细节的信息量,会比上面的两张更大(ChatGPT看起来没有对特定的物体和人脸做针对性的优化),所以描述非常生动,虽然有少许错误。而且对人的工作态度这样抽象的信息也有理解。

值得注意的是这里提到警察。这图片来自Wiki越战词条。如果ChatGPT是通过读取连接的文字信息来获取图片信息的,那么就不会认为那些执行任务的人是警察。因此可以认为它的结论完全来自于图片信息。

全球著名图片


这是一幅名画,这个时候ChatGPT是能完整的识别人物和事件的。同时仍然有很多抽象的描述,比如动感等。

针对图片的人机互动


这幅画,一开始ChatGPT没有看懂。给它输入更多信息之后,它能理解这幅画,且描述了画面的感情。所以ChatGPT对图片的理解是能够交互的,而不是一次性的输出。

地标图片


伦敦地标识别成功。

红场识别准确

捏造了一个所谓地标,查了没有这样的地标。

视频内容识别


ChatGPT是承认自己可以识别视频的,但是在油管、CNN等网站的内容识别中,输出有错误。这是业务没有开放造成的,它甚至知道我的问题是看快进的进度。

如果不多问一句,都不知道它是不是真的看了视频。

继续保持对ChatCPT的关注。


阅读原文

* 文章为作者独立观点,不代表数艺网立场转载须知

本文内容由数艺网收录采集自微信公众号新智元 ,并经数艺网进行了排版优化。转载此文章请在文章开头和结尾标注“作者”、“来源:数艺网” 并附上本页链接: 如您不希望被数艺网所收录,感觉到侵犯到了您的权益,请及时告知数艺网,我们表示诚挚的歉意,并及时处理或删除。

数字媒体艺术 新媒体艺术 科技艺术

21261 举报
  0
登录| 注册 后参与评论