眼镜拍照
1. 基本信息
工具名称 | 眼镜拍照 |
工具编码 | tQ8fCF.capture_photo |
功能描述 | 控制眼镜拍摄一张照片,返回照片的公网可访问地址 |
适用场景 | 当 Skill 的执行依赖用户当前所见的真实画面时使用本工具 |
返回方式 | 非流式。工具执行完成后,将完整结果一次性返回给 Agent |
备注 | 用户可感知拍照:拍照时眼镜端会有提示音以及提示灯闪烁; 照片地址URL有效期:1小时 |
2. 工作原理
下发拍照指令 -> 眼镜拍照 -> 蓝牙回传千问 AI 穿戴App -> App上传云端 -> 云端临时存储 -> 返回照片可访问地址。全过程由工具内部封装,Skill 只需处理返回的照片地址
3. 请求参数
全部来自系统上下文,无需额外关注
4. 响应参数
字段 | 类型 | 描述 | 示例值 |
success | boolean | 调用结果 | true |
errorCode | string | 错误码 | |
errorMsg | string | 错误消息 | |
model | object | 返回的业务数据 | |
model.url | string | 公网可下载的临时图片地址 | "https://xxx.example.com/photo/xxx.jpg" |
model.format | string | 图片类型 | "jpg" |
model.mimeType | string | 媒体类型 | "image/jpeg" |
model.requestId | string | 请求唯一id | "photo_sync_202608xxx" |
5. 使用示例
一个基于拍照+图片识别工具实现的文物识别SKILL:
---
name: relic-recognition
description: 文物识别技能。通过 AI 眼镜拍照识别文物,给出文物名称、年代、材质、纹饰特征、历史文化背景及有趣故事等信息。当用户提到"拍照识别文物""这是什么文物""这是什么瓷器/青铜器/玉器""识别一下这件文物""帮我看看这是什么古董""这件文物是什么年代的"时使用。
---
# 文物识别
通过 AI 眼镜拍照获取文物图片,自动识别文物种类并给出年代、材质与历史文化信息。
## 工作流程
### 第一步:拍照获取文物图片
调用 ^^tQ8fCF.capture_photo^^
拍照成功后返回结构示例:
```json
{
"success":true,
"model":{
"url": "https://xxx.example.com/photo/xxx.jpg",
"format": "jpg",
"mimeType": "image/jpeg",
"requestId": "photo_sync_202608xxx"
}
}
```
其中 `url` 字段为图片的可访问地址;
### 第二步:识别文物
将上一步拍到的图片连同提问一起传入 ^^4F2df8.image_qa_stream^^,进行文物识别问答。
调用参数:
- imageUrl(必填):取第一步 ^^tQ8fCF.capture_photo^^ 返回的 url
- query(必填):文物识别专用提问,并结合用户原始诉求做适当优化。基础模板如下:
> 请根据这张图片,用自然流畅的口语介绍这件文物。说说它大概是什么、什么年代的、用什么材质做的、上面有什么纹饰或特征,再讲讲它背后的历史文化故事和有趣的地方。如果看不清或拿不准的地方就直说,不要瞎编。控制在 300 字以内。若图中不是文物或无法确定,请直接说明。其中
4F2df8.image_qa_stream是官方提供的图片识别工具的唯一编码,细节可见 图片识别;
示例中
^^{工具编码}^^是 SKILL 引用工具的内置语法,可在SKILL.md中通过@快速选取工具。
6. 限制
图片分辨率:800 x 600
技能平台