← Back to all generators
lucataco/florence-2-base
OfficialView on Replicate →
Florence-2: Advancing a Unified Representation for a Variety of Vision Tasks
Capabilities
Reference Images
Cost
Community model (estimated from hardware time)
Input Parameters
| Name | Type | Description | Default | Constraints |
|---|---|---|---|---|
image* | string(uri) | Grayscale input image | — | — |
task_input | string | Input task | "Caption" | CaptionDetailed CaptionMore Detailed CaptionCaption to Phrase GroundingObject DetectionDense Region CaptionRegion ProposalOCROCR with Region |
text_input | string | Text Input(Optional) | — | — |
imagerequiredstringGrayscale input image
task_inputstringInput task
Default:
"Caption"CaptionDetailed CaptionMore Detailed CaptionCaption to Phrase GroundingObject DetectionDense Region CaptionRegion ProposalOCROCR with Region
text_inputstringText Input(Optional)
Version:
c81609117f66Updated: 7/25/2026132.3K runs
cinemasetfree.com