要让gemini 3 pro准确识别图片中小字、图表细节或密集表格,必须将media resolution设为high:网页版在上传后点击输入框下方选项条选择high;ai studio在设置中拖动滑块或下拉选high;api调用时在request body中严格传"media_resolution": "high"(小写无空格)。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要让Gemini 3 Pro准确识别图片里的小字、图表细节或密集表格,但默认上传后AI只返回模糊描述或漏掉关键数据——这是因为Media Resolution参数没调对。
网页版中设置Media Resolution
打开 https://gemini.google.com → 登录Google账号 → 在右上角点击“Model”下拉菜单 → 确认已选中 【Gemini 3 Pro】 → 点击输入框左侧的“+”号上传图片。
上传成功后,输入框下方会立即出现“Media Resolution”选项条,点击它 → 从弹出菜单中选择 【High】(不是Default,也不是Raw)→ 输入你的具体指令,例如:“请提取图中表格所有单元格内容,保留原始格式” → 按回车发送。
这一步不能跳过:如果上传前没点开Media Resolution菜单并手动选High,系统会沿用上次设置或默认Default,而Default在处理发票、电路图、论文插图时大概率丢失坐标轴标签或公式下标。
AI Studio中调整媒体分辨率
访问 aistudio.google.com → 登录 → 点击左上角“New Chat” → 在对话界面右上角找到齿轮图标 ⚙️ → 点击进入“Settings” → 向下滚动到“Media Resolution”区域。
方法一:直接拖动滑块至最右侧“High”位置
方法二:点击下拉箭头 → 选择“High” → 关闭设置面板 → 再上传图片 → 输入问题。
【注意:AI Studio中该设置是全局生效的,一旦设为High,后续所有新对话都会沿用,除非你手动改回】
上传图片后,若发现响应速度明显变慢(首token延迟超8秒),说明High模式已启用——这是正常现象,高分辨率解析需要额外计算资源。
通过API调用时指定media_resolution
在请求体(request body)中添加 media_resolution 字段,值必须为字符串 "high":
Python示例:
```python
response = client.models.generate_content(
model="gemini-3-pro-preview",
contents=[
{"text": "分析这张芯片引脚图的信号流向"},
{"inline_data": {"mime_type": "image/png", "data": image_bytes}}
],
generation_config={"media_resolution": "high"}
)
```
这个字段不支持缩写或大小写混写,填 "HIGH" 或 "high "(末尾空格)都会触发400错误;必须严格使用小写"high"且无空格。
如果你同时传了PDF和图片,media_resolution仅作用于图像部分,PDF仍按默认策略解析——如需提升PDF内嵌图质量,需先单独导出为PNG再上传。











