参考https://zhuanlan.zhihu.com/p/664192860
模型对图片进行caption操作时,输出的标题一般描述图片中的主体,而忽视了背景、常识关系等更为细节的描述。
图片比较重要的细节的描述应当包括:
- 物体存在的场景。如:在厨房的水槽(场景为厨房)、人行道上的标志
- 物体在场景的位置、物体的数量
- 物体的颜色,大小
- 图片中的文本
参考https://zhuanlan.zhihu.com/p/664192860
模型对图片进行caption操作时,输出的标题一般描述图片中的主体,而忽视了背景、常识关系等更为细节的描述。
图片比较重要的细节的描述应当包括:
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/391390.html
如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!