Question 1

What is the gemini-3-multimodal skill?

Accepted Answer

Process multimodal inputs (images, video, audio, PDFs) with Gemini 3 Pro. Covers image understanding, video analysis, audio processing, document extraction, media resolution control, OCR, and token optimization. Use when analyzing images, processing video, transcribing audio, extracting PDF content, or working with multimodal data.

Question 2

What tools does gemini-3-multimodal use?

Accepted Answer

gemini-3-multimodal does not declare a restricted tool list.

gemini-3-multimodal

Details

FAQ