Skip to content

dddv587

CogFlorence-2.2-Large

dddv587/CogFlorence-2.2-Large

CogFlorence-2.2-Large is a image-to-text model from dddv587. Use it when you need a caption or text from an image. It is set up for transformers. The card lists the license as mit.

This repository contains a fine-tuned version of the microsoft/Florence-2-large model. The model has been tuned on a 40,000 image subset of the Ejafa/ye-pop dataset, with captions generated using THUDM/cogvlm2-llama3-…

Downloads · 30 days

11

46% of all-time downloads

All-time downloads

24

Public

Parameters

823M

1.6 GB on disk

Likes

0

Public

Hugging Face

Repo makeup

Click a slice to open those files.

.safetensors1.6 GB · 100%

At a glance

Task
Image-to-Text
Library
transformers
License
mit
Model type
florence2
Access
Public
Created
Aug 12, 2026
Updated
Aug 12, 2026
SHA
61ade294

Base models

Datasets

Task
Image-to-Text
Library
transformers
Type
florence2
License
mit
Languages
en
Created
Aug 12, 2026
Updated
Aug 12, 2026
CogFlorence-2.2-Large — AI Model — AIMarketly