Moondream2¶
Class: Moondream2BlockV1
Source: inference.core.workflows.core_steps.models.foundation.moondream2.v1.Moondream2BlockV1
This workflow block runs Moondream2, a multimodal vision-language model. You can use this block to run zero-shot object detection.
Type identifier¶
Use the following identifier in step "type" field: roboflow_core/moondream2@v1to add the block as
as step in your workflow.
Properties¶
| Name | Type | Description | Refs |
|---|---|---|---|
name |
str |
Enter a unique identifier for this step.. | ❌ |
prompt |
str |
Optional text prompt to provide additional context to Moondream2.. | ✅ |
model_version |
str |
The Moondream2 model to be used for inference.. | ✅ |
The Refs column marks possibility to parametrise the property with dynamic values available
in workflow runtime. See Bindings for more info.
Runtime compatibility¶
-
hard— runtimeself_hosted_cpu; executionlocal - Requires a GPU; run_locally() loads a model that needs CUDA.
Available Connections¶
Compatible Blocks
Check what blocks you can connect to Moondream2 in version v1.
- inputs:
Local File Sink,Text Display,Roboflow Asset Library Attributes,Crop Visualization,Image Slicer,Roboflow Dataset Upload,Instance Segmentation Model,Image Threshold,Image Blur,LMM,Color Visualization,Google Gemini,Classification Label Visualization,Corner Visualization,Dynamic Crop,S3 Sink,MQTT Writer,Image Slicer,Absolute Static Crop,Qwen-VL,Instance Segmentation Model,Google Gemini,Current Time,Roboflow Custom Metadata,Stitch OCR Detections,Slack Notification,Event Writer,Multi-Label Classification Model,SIFT Comparison,SIFT,Morphological Transformation,Background Subtraction,Line Counter Visualization,Auto Rotate on Edges,Stitch OCR Detections,Google Gemini,Ellipse Visualization,OpenAI,MoonshotAI Kimi,Instance Segmentation Model,Multi-Label Classification Model,Twilio SMS Notification,Trace Visualization,Single-Label Classification Model,Grid Visualization,Bounding Box Visualization,Perspective Correction,Morphological Transformation,Camera Focus,Google Gemma,EasyOCR,Google Gemma API,Semantic Segmentation Model,Semantic Segmentation Model,Object Detection Model,Cosmos 3,Object Detection Model,OpenAI,Instance Segmentation Model,Multi-Label Classification Model,MoonshotAI Kimi,Webhook Sink,VLM As Detector,Depth Estimation,Twilio SMS/MMS Notification,Blur Visualization,Image Preprocessing,OPC UA Writer Sink,LMM For Classification,Polygon Visualization,Model Monitoring Inference Aggregator,Stability AI Inpainting,Image Convert Grayscale,Microsoft SQL Server Sink,Florence-2 Model,Qwen3.5-VL,Single-Label Classification Model,Stitch Images,Roboflow Dataset Upload,OpenAI,Clip Comparison,Camera Calibration,Google Vision OCR,OpenAI,Mask Visualization,QR Code Generator,Florence-2 Model,Reference Path Visualization,Email Notification,Polygon Zone Visualization,Polygon Visualization,Contrast Equalization,Roboflow Visual Search,VLM As Classifier,Halo Visualization,Pixelate Visualization,Contrast Enhancement,Keypoint Detection Model,Llama 3.2 Vision,Qwen 3.6 API,GLM-OCR,CogVLM,PLC Writer,CSV Formatter,Circle Visualization,Image Contours,Camera Focus,Heatmap Visualization,Triangle Visualization,Stability AI Image Generation,Roboflow Vision Events,Llama 3.2 Vision,Icon Visualization,Dot Visualization,Stability AI Outpainting,OpenAI-Compatible LLM,Keypoint Visualization,Relative Static Crop,Anthropic Claude,PP-OCR,Label Visualization,Background Color Visualization,Anthropic Claude,Keypoint Detection Model,Roboflow Visual Search Classifier,OCR Model,Single-Label Classification Model,Model Comparison Visualization,Keypoint Detection Model,Qwen 3.5 API,Halo Visualization,OpenRouter,Object Detection Model,Email Notification,Anthropic Claude - outputs:
Crop Visualization,Detection Event Log,Roboflow Dataset Upload,ByteTrack Tracker,Color Visualization,Corner Visualization,Dynamic Crop,SAM 3 Interactive,Detections Transformation,Time in Zone,Per-Class Confidence Filter,Velocity,Detections Classes Replacement,Overlap Analysis,Stitch OCR Detections,Roboflow Custom Metadata,Event Writer,Detections Consensus,Mask Area Measurement,Nearest Neighbor Detection Match,Stitch OCR Detections,BoT-SORT Tracker,Time in Zone,Ellipse Visualization,Trace Visualization,Segment Anything 2 Model,Perspective Correction,Bounding Box Visualization,Camera Focus,Byte Tracker,Overlap Filter,OC-SORT Tracker,Distance Measurement,Path Deviation,Size Measurement,Path Deviation,Blur Visualization,Detections Stabilizer,Model Monitoring Inference Aggregator,Florence-2 Model,Line Counter,Roboflow Dataset Upload,SAM2 Video Tracker,Florence-2 Model,Detection Offset,Detections List Roll-Up,Pixelate Visualization,SORT Tracker,Detections Combine,Byte Tracker,Circle Visualization,Detections Stitch,Track Class Lock,Heatmap Visualization,Triangle Visualization,Roboflow Vision Events,Line Counter,Icon Visualization,Dot Visualization,Byte Tracker,Label Visualization,Time in Zone,Background Color Visualization,Model Comparison Visualization,PTZ Tracking (ONVIF),Detections Merge,GeoTag Detection,Detections Filter,Frame Delay
Input and Output Bindings¶
The available connections depend on its binding kinds. Check what binding kinds
Moondream2 in version v1 has.
Bindings
-
input
images(image): The image to infer on..prompt(string): Optional text prompt to provide additional context to Moondream2..model_version(roboflow_model_id): The Moondream2 model to be used for inference..
-
output
predictions(object_detection_prediction): Prediction with detected bounding boxes in form of sv.Detections(...) object.
Example JSON definition of step Moondream2 in version v1
{
"name": "<your_step_name_here>",
"type": "roboflow_core/moondream2@v1",
"images": "$inputs.image",
"prompt": "my prompt",
"model_version": "moondream2/moondream2_2b_jul24"
}