SAM 3 Interactive¶
Class: SegmentAnything3InteractiveBlockV1
Run the interactive (promptable visual segmentation) head of Segment Anything 3 (SAM3) on an image.
Unlike the SAM 3 concept segmentation block (which takes text or exemplar prompts and returns ALL instances of a concept), this block performs SAM2-style interactive segmentation: each prompt targets ONE object and the model returns a single mask for it.
Two prompt inputs are supported (at least one must be provided): - points: a list of labeled 2D points defining a single object. Positive points mark the object to segment, negative points mark regions to exclude (useful to refine the mask). - boxes: detections from another model. Each bounding box becomes a separate prompt and the model segments the object inside it. Class names of the boxes are forwarded to the predicted masks.
Type identifier¶
Use the following identifier in step "type" field: roboflow_core/sam3_interactive@v1to add the block as
as step in your workflow.
Properties¶
| Name | Type | Description | Refs |
|---|---|---|---|
name |
str |
Enter a unique identifier for this step.. | ❌ |
points |
List[Any] |
Labeled points defining a single object to segment. Each point is {'x': ..., 'y': ..., 'positive': ...} in absolute pixel coordinates - positive points mark the object, negative points mark regions to exclude. Plain (x, y) or (x, y, positive) sequences are also accepted.. | ✅ |
threshold |
float |
Minimum confidence threshold for predicted masks. | ✅ |
multimask_output |
bool |
Flag to determine whether to use SAM3 internal multimask or single mask mode. For ambiguous prompts (like a single point) setting to True is recommended.. | ✅ |
The Refs column marks possibility to parametrise the property with dynamic values available
in workflow runtime. See Bindings for more info.
Runtime compatibility¶
-
hard— runtimeself_hosted_cpu; executionlocal - Requires a GPU; run_locally() loads a model that needs CUDA.
Available Connections¶
Compatible Blocks
Check what blocks you can connect to SAM 3 Interactive in version v1.
- inputs:
Keypoint Visualization,Keypoint Detection Model,Twilio SMS/MMS Notification,OPC UA Writer Sink,SIFT Comparison,Grid Visualization,SAM 3,Object Detection Model,PLC Writer,JSON Parser,Absolute Static Crop,Roboflow Visual Search Classifier,Velocity,Image Threshold,Polygon Zone Visualization,BoT-SORT Tracker,MQTT Writer,Contrast Equalization,Detections List Roll-Up,OCR Model,Background Subtraction,Contrast Enhancement,Reference Path Visualization,Mask Edge Snap,Instance Segmentation Model,Twilio SMS Notification,Detections Filter,Detections Classes Replacement,Detections Merge,PTZ Tracking (ONVIF),VLM As Detector,Dynamic Crop,Halo Visualization,Image Blur,SAM 3 Interactive,Seg Preview,SAM 3,Ellipse Visualization,Byte Tracker,Line Counter,Time in Zone,Path Deviation,Instance Segmentation Model,Event Writer,Time in Zone,Keypoint Detection Model,Byte Tracker,Slack Notification,Heatmap Visualization,SORT Tracker,Email Notification,Circle Visualization,Perspective Correction,Camera Focus,Byte Tracker,Crop Visualization,Polygon Visualization,Detections Consensus,Keypoint Detection Model,ByteTrack Tracker,Detections Combine,Stability AI Inpainting,SAM 3,Object Detection Model,VLM As Classifier,Image Slicer,Roboflow Vision Events,Detections Transformation,Local File Sink,Object Detection Model,SAM3 Video Tracker,Dot Visualization,Line Counter Visualization,Time in Zone,Instance Segmentation Model,Depth Estimation,PP-OCR,Blur Visualization,EasyOCR,Segment Anything 2 Model,Color Visualization,Per-Class Confidence Filter,Dynamic Zone,Image Convert Grayscale,Motion Detection,Trace Visualization,Icon Visualization,PLC Reader,Model Comparison Visualization,Camera Focus,QR Code Generator,Detections Stitch,Instance Segmentation Model,Mask Visualization,Microsoft SQL Server Sink,Text Display,Gaze Detection,Stability AI Image Generation,Google Vision OCR,Webhook Sink,VLM As Detector,Identify Outliers,Cosine Similarity,Pixelate Visualization,Stitch Images,Detection Offset,S3 Sink,Classification Label Visualization,Overlap Filter,Polygon Visualization,Roboflow Dataset Upload,Morphological Transformation,Detection Event Log,Bounding Box Visualization,Template Matching,VLM As Classifier,Image Contours,Image Slicer,Stability AI Outpainting,Roboflow Custom Metadata,SAM2 Video Tracker,Camera Calibration,Roboflow Asset Library Attributes,Morphological Transformation,Detections Stabilizer,Path Deviation,Relative Static Crop,Mask Area Measurement,Background Color Visualization,Model Monitoring Inference Aggregator,Corner Visualization,SIFT,Track Class Lock,Moondream2,Roboflow Visual Search,Identify Changes,Bounding Rectangle,Email Notification,Triangle Visualization,Roboflow Dataset Upload,OC-SORT Tracker,Image Preprocessing,SIFT Comparison,YOLO-World Model,Halo Visualization,Label Visualization - outputs:
Blur Visualization,Segment Anything 2 Model,Color Visualization,Per-Class Confidence Filter,Dynamic Zone,Distance Measurement,Velocity,Trace Visualization,Icon Visualization,Time in Zone,Model Comparison Visualization,BoT-SORT Tracker,Detections Stitch,Detections List Roll-Up,Mask Visualization,Mask Edge Snap,Detections Filter,Detections Merge,Detections Classes Replacement,PTZ Tracking (ONVIF),Florence-2 Model,Dynamic Crop,SAM 3 Interactive,Halo Visualization,Ellipse Visualization,Pixelate Visualization,Byte Tracker,Florence-2 Model,Detection Offset,Line Counter,Time in Zone,Overlap Filter,Polygon Visualization,Path Deviation,Roboflow Dataset Upload,Event Writer,Time in Zone,Byte Tracker,Detection Event Log,Bounding Box Visualization,Heatmap Visualization,SORT Tracker,Circle Visualization,Roboflow Custom Metadata,SAM2 Video Tracker,Perspective Correction,Camera Focus,Byte Tracker,Crop Visualization,Polygon Visualization,Detections Consensus,Detections Stabilizer,Line Counter,ByteTrack Tracker,Path Deviation,Detections Combine,Mask Area Measurement,Background Color Visualization,Model Monitoring Inference Aggregator,Stability AI Inpainting,GeoTag Detection,Corner Visualization,Track Class Lock,Roboflow Vision Events,Detections Transformation,Bounding Rectangle,Size Measurement,Overlap Analysis,Triangle Visualization,Roboflow Dataset Upload,OC-SORT Tracker,Dot Visualization,Halo Visualization,Label Visualization
Input and Output Bindings¶
The available connections depend on its binding kinds. Check what binding kinds
SAM 3 Interactive in version v1 has.
Bindings
-
input
images(image): The image to infer on..points(labeled_points): Labeled points defining a single object to segment. Each point is {'x': ..., 'y': ..., 'positive': ...} in absolute pixel coordinates - positive points mark the object, negative points mark regions to exclude. Plain (x, y) or (x, y, positive) sequences are also accepted..boxes(Union[object_detection_prediction,keypoint_detection_prediction,instance_segmentation_prediction]): Bounding boxes (from another model) to use as prompts - the model segments the object inside each box.threshold(float): Minimum confidence threshold for predicted masks.multimask_output(boolean): Flag to determine whether to use SAM3 internal multimask or single mask mode. For ambiguous prompts (like a single point) setting to True is recommended..
-
output
predictions(instance_segmentation_prediction): Prediction with detected bounding boxes and segmentation masks in form of sv.Detections(...) object.
Example JSON definition of step SAM 3 Interactive in version v1
{
"name": "<your_step_name_here>",
"type": "roboflow_core/sam3_interactive@v1",
"images": "$inputs.image",
"points": [
{
"positive": true,
"x": 320,
"y": 240
}
],
"boxes": "$steps.object_detection_model.predictions",
"threshold": 0.3,
"multimask_output": true
}