Skip to main content
MindStudio
Pricing
BlogAbout
My Workspace
Vision ModelDeprecated

Gemini 1.5 Pro Vision

Adept at processing visual and text inputs for multimodal tasks and content creation.

PublisherGoogle
TypeVision
Context Window1,000,000 tokens
Training DataNovember 2023

Gemini 1.5 Pro Vision

Gemini 1.5 Pro is a foundation model that performs well at a variety of multimodal tasks such as visual understanding, classification, summarization, and creating content from image, audio and video. It's adept at processing visual and text inputs such as photographs, documents, infographics, and screenshots

Ready to build with Gemini 1.5 Pro Vision?

Get Started Free

Documentation & links

Parameters & options

Max Temperature1
Max Response Size8,192 tokens
TemperatureNumber
Default: 1Range: 0–1 (step 0.1)
Max Response TokensNumber
Default: 4096Range: 1–8192 (step 1)

Start building with Gemini 1.5 Pro Vision

No API keys required. Create AI-powered workflows with Gemini 1.5 Pro Vision in minutes — free.