deepseek识图模式可将jpg/png格式静态截图(≤10mb、非gif/pdf/视频帧)直接转为可运行html代码,支持网页端与app端免费使用;需上传清晰截图,点击“识图模式”上传后输入明确指令(如保留交互与响应式),复制生成代码保存为index.html即可本地运行验证。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想把一张网页截图、UI设计图或者软件界面截图,直接变成能运行的HTML页面代码,不用手动写标签、调样式、算像素位置——DeepSeek识图模式现在就能做到,而且网页端和App端都已开放,无需会员权限。
确认截图是否符合要求
先检查你的截图:必须是JPG或PNG格式的静态图,文件大小建议控制在10MB以内。我实测过12MB的截图会加载失败,换到8MB就顺利通过了。
【动态GIF、PDF内嵌图、视频帧这三类不能识别】,哪怕只有一帧动图也会报错“不支持该格式”,别浪费时间反复上传。
截图内容最好有清晰边界——比如浏览器窗口带标题栏、按钮有明确阴影、文字没被压缩模糊。手抖拍歪的白板照片系统会自动矫正,但严重反光或局部过曝区域可能漏识别字段。
开启识图模式并上传图片
打开 https://chat.deepseek.com/ ,在输入框上方找到“识图模式”按钮,点击它。
弹出文件选择窗口后,直接选中你准备好的截图文件,点击“打开”即可上传。上传过程无进度条,通常1秒内完成,界面上会出现缩略图预览。
如果上传后提示“解析失败”或长时间卡在“正在识别”,大概率是图片含噪点过多或分辨率低于640×480,换一张更干净的图重试就行。
输入精准指令生成代码
图片上传成功后,在输入框里输入一句明确指令,例如:
“把这个截图转换成可运行的HTML代码,保留按钮交互逻辑和响应式布局”
不要只说“转成代码”,否则DeepSeek可能只输出零散片段;也不用加“请”“麻烦”这类礼貌词,模型对指令词敏感度远高于语气词。
如果你截图的是带表单的后台页面,可以追加一句:“表单提交需模拟POST请求,字段名保持原样”,这样生成的代码里就会包含fetch调用和对应name属性。
复制代码并本地运行验证
DeepSeek返回结果后,全选HTML代码 → Ctrl+C复制 → 新建一个文本文件 → 粘贴 → 保存为 index.html(注意后缀必须是.html)。
双击该文件,系统默认浏览器会立刻打开渲染效果。如果发现按钮没反应,大概率是JavaScript部分被截断——这时回到DeepSeek对话页,点击“继续生成”或补一句“补全全部JS逻辑,不要省略事件监听器”。
若页面布局明显错位,说明截图里存在CSS Grid或Flex复杂嵌套,此时直接告诉DeepSeek:“用CSS-in-JS方式重写样式,避免浮动和绝对定位”,它会切换策略输出更鲁棒的代码。










