如何利用大模型图文识别解析获取长沙市暑假中小学开放信息?
- 内容介绍
- 文章标签
- 相关推荐
较大家良好,我是专注于 AI 实战与开发技巧分享的夜郎King,致力于把前沿技术手段落地到真实实业务中。近期, 较长沙市教育领域局公布了暑虚假期间中较小学体育运动场馆免费开放的详细安排,信息全部以图片公告的形式发布, 嚯... 给我们带来了“信息孤岛”的困扰。本文将手把手教你怎样利用较大模型的图文识别能力, 迅速解析这一些图片,抽取出学校名称、开放时间段、场馆类型等关键数据,并通过代码实现结构化输出,让数据再也不是纸上谈兵这个。
一、为哪些要用较大模型而不是传统方式 OCR?
传统方式 OCR只能把图片里的文字转成纯文本,却无法明白文字之间的层级关系和排版结构。面对政府部门常用的表格、 另起炉灶。 列表、项目符号等混排形式,OCR 往往会出现错位、漏字甚至将表头当成正文。

不如... 较大模型图文明白则不同, 它在视觉特征和语言语义两条路上并行学习了解,能够同时也捕捉图片的布局信息和文字含义,实现“识别+明白+结构化”。在本次任务中, 我们需要区分“学校名称”“开放时间段”“开放场地”等字段,较大模型只要给出合适的提示词,就能直接输出符合 JSON 规范的数据,较大幅减较低人工制作后期清洗投入成本。
核心优势概览
- 更多模态感知:既能看到文字, 也能感知表格线条、颜色标记等视觉元素。
- 上下文推理:能够根据标题或上下文自动归类信息,举个例子把“上午 9:00‑12:00”归入「上午时段」。
- 自定义输出: JSON、CSV 或 Markdown 等结构化格式。
二、 准备工作岗位:获取图片并搭建解析周边环境
1️⃣ 图片获取——上一篇文章已经介绍了怎样采用爬虫或对外公开渠道下载较长沙市教育领域局发布的暑虚假开放通知图片,累计约 30 张,覆盖全市 6 个区县共 32 所学校,复盘一下。。
2️⃣ 工具选型——这里我们选用了 CodeBuddy, 它支持直接上传本地图片并发送天然语言指令, 太顶了。 无需自行部署模型,只要有网络即可调用。
3️⃣ 模型切换——在 CodeBuddy 界面点击「模型选择」, 挑选「腾讯混元更多模态图文模型」或「智谱清言 ZLM 更多模态模型」;切换成功后界面会提示「已启用图文输入」,此时即可上传图片进行解析,等着瞧。。
常见坑点提醒
⚠️ 切记不要误选仅支持文本的纯语言模型!
格局小了。 如果误用了如「混元3 文本版」之类的纯文, 上传图片后会收到「不支持图片格式输入」的错误提示,引起整个流程卡死。务必确认右上角体现的是「图文」或「更多模态」字样。
三、编写精准提示词:让较大模型了解我们要哪些
我坚信... 提示词是作用于较大模型输出质量的关键。一条良好的提示词应当明确:
- 提取范围;
- 输出格式;
- 特殊处理规则。
请你作为专业的信息提取员, 仔细解析我上传的这张较长沙市暑虚假中较小学开放通知图片,提取以下字段:
{
"schoolName": "学校全称",
"district": "所属区县",
"venues": ,
"openingHours": {
"morning": "上午时段",
"afternoon": "下午时段",
"evening": "晚上时段"
},
"openDateRange": "启动日期至完成日期"
}
请严格按照上述 JSON 结构返回,不要出现任意额外说明文字。如果图片中缺更少某个字段,请对应填入 “无”。
四、 实战演练:从图片到 JSON 的完整流程
上传并调用模型
在 CodeBuddy 对话框中拖拽一张通知截图,然后粘贴上面的提示词并发送。系统会自动进行图像预处理,紧接着进入更多模态推理阶段,一般耗时 3‑5 秒,离了大谱。。
获取并校验最终还是结果是
下面是一张典型通知的返回示例:
{
"schoolName": "较长沙市第十一中学",
"district": "市直",
"venues": ,
"openingHours": {
"morning": "08:00-12:00",
"afternoon": "14:00-18:00",
"evening": "无"
},
"openDateRange": "2026-07-13至2026-08-15"
}
如果发觉部分字段被误识别,能够在提示词里加入「请统一采用 YYYY-MM-DD 日期格式」进行二次约束。
批量自动化脚本示例
import os, json, subprocess
def parse_image:
# 调用 CodeBuddy CLI
result = subprocess.check_output()
return json.loads
def batch_parse:
data =
for fn in os.listdir:
if fn.lower.endswith):
info = parse_image)
data.append
with open as f:
json.dump
batch_parse
print))
上述脚本会遍历 imgs/ 文件夹下全部图片, 一键完成解析并保存为统一的 open_info.json 文件,为后续统计解析奠定基础,他破防了。。
五、常见 SEO 疑问:为哪些百度不收录?
问: 我已经把解析良好的 JSON 数据放在自己的网站上, 却发觉百度搜索根本找不到相关页面这是为哪些,是不是??
A: 最主要有以下几个原因:
- 页面缺更少有效的结构化数据标记: 搜索引擎更倾向于抓取包含
较大家良好,我是专注于 AI 实战与开发技巧分享的夜郎King,致力于把前沿技术手段落地到真实实业务中。近期, 较长沙市教育领域局公布了暑虚假期间中较小学体育运动场馆免费开放的详细安排,信息全部以图片公告的形式发布, 嚯... 给我们带来了“信息孤岛”的困扰。本文将手把手教你怎样利用较大模型的图文识别能力, 迅速解析这一些图片,抽取出学校名称、开放时间段、场馆类型等关键数据,并通过代码实现结构化输出,让数据再也不是纸上谈兵这个。
一、为哪些要用较大模型而不是传统方式 OCR?
传统方式 OCR只能把图片里的文字转成纯文本,却无法明白文字之间的层级关系和排版结构。面对政府部门常用的表格、 另起炉灶。 列表、项目符号等混排形式,OCR 往往会出现错位、漏字甚至将表头当成正文。

不如... 较大模型图文明白则不同, 它在视觉特征和语言语义两条路上并行学习了解,能够同时也捕捉图片的布局信息和文字含义,实现“识别+明白+结构化”。在本次任务中, 我们需要区分“学校名称”“开放时间段”“开放场地”等字段,较大模型只要给出合适的提示词,就能直接输出符合 JSON 规范的数据,较大幅减较低人工制作后期清洗投入成本。
核心优势概览
- 更多模态感知:既能看到文字, 也能感知表格线条、颜色标记等视觉元素。
- 上下文推理:能够根据标题或上下文自动归类信息,举个例子把“上午 9:00‑12:00”归入「上午时段」。
- 自定义输出: JSON、CSV 或 Markdown 等结构化格式。
二、 准备工作岗位:获取图片并搭建解析周边环境
1️⃣ 图片获取——上一篇文章已经介绍了怎样采用爬虫或对外公开渠道下载较长沙市教育领域局发布的暑虚假开放通知图片,累计约 30 张,覆盖全市 6 个区县共 32 所学校,复盘一下。。
2️⃣ 工具选型——这里我们选用了 CodeBuddy, 它支持直接上传本地图片并发送天然语言指令, 太顶了。 无需自行部署模型,只要有网络即可调用。
3️⃣ 模型切换——在 CodeBuddy 界面点击「模型选择」, 挑选「腾讯混元更多模态图文模型」或「智谱清言 ZLM 更多模态模型」;切换成功后界面会提示「已启用图文输入」,此时即可上传图片进行解析,等着瞧。。
常见坑点提醒
⚠️ 切记不要误选仅支持文本的纯语言模型!
格局小了。 如果误用了如「混元3 文本版」之类的纯文, 上传图片后会收到「不支持图片格式输入」的错误提示,引起整个流程卡死。务必确认右上角体现的是「图文」或「更多模态」字样。
三、编写精准提示词:让较大模型了解我们要哪些
我坚信... 提示词是作用于较大模型输出质量的关键。一条良好的提示词应当明确:
- 提取范围;
- 输出格式;
- 特殊处理规则。
请你作为专业的信息提取员, 仔细解析我上传的这张较长沙市暑虚假中较小学开放通知图片,提取以下字段:
{
"schoolName": "学校全称",
"district": "所属区县",
"venues": ,
"openingHours": {
"morning": "上午时段",
"afternoon": "下午时段",
"evening": "晚上时段"
},
"openDateRange": "启动日期至完成日期"
}
请严格按照上述 JSON 结构返回,不要出现任意额外说明文字。如果图片中缺更少某个字段,请对应填入 “无”。
四、 实战演练:从图片到 JSON 的完整流程
上传并调用模型
在 CodeBuddy 对话框中拖拽一张通知截图,然后粘贴上面的提示词并发送。系统会自动进行图像预处理,紧接着进入更多模态推理阶段,一般耗时 3‑5 秒,离了大谱。。
获取并校验最终还是结果是
下面是一张典型通知的返回示例:
{
"schoolName": "较长沙市第十一中学",
"district": "市直",
"venues": ,
"openingHours": {
"morning": "08:00-12:00",
"afternoon": "14:00-18:00",
"evening": "无"
},
"openDateRange": "2026-07-13至2026-08-15"
}
如果发觉部分字段被误识别,能够在提示词里加入「请统一采用 YYYY-MM-DD 日期格式」进行二次约束。
批量自动化脚本示例
import os, json, subprocess
def parse_image:
# 调用 CodeBuddy CLI
result = subprocess.check_output()
return json.loads
def batch_parse:
data =
for fn in os.listdir:
if fn.lower.endswith):
info = parse_image)
data.append
with open as f:
json.dump
batch_parse
print))
上述脚本会遍历 imgs/ 文件夹下全部图片, 一键完成解析并保存为统一的 open_info.json 文件,为后续统计解析奠定基础,他破防了。。
五、常见 SEO 疑问:为哪些百度不收录?
问: 我已经把解析良好的 JSON 数据放在自己的网站上, 却发觉百度搜索根本找不到相关页面这是为哪些,是不是??
A: 最主要有以下几个原因:
- 页面缺更少有效的结构化数据标记: 搜索引擎更倾向于抓取包含

