眼镜拍照

眼镜拍照

1. 基本信息

工具名称

眼镜拍照

工具编码

tQ8fCF.capture_photo

功能描述

控制眼镜拍摄一张照片,返回照片的公网可访问地址

适用场景

当 Skill 的执行依赖用户当前所见的真实画面时使用本工具

返回方式

非流式。工具执行完成后,将完整结果一次性返回给 Agent

备注

用户可感知拍照:拍照时眼镜端会有提示音以及提示灯闪烁;

照片地址URL有效期:1小时

2. 工作原理

下发拍照指令 -> 眼镜拍照 -> 蓝牙回传千问 AI 穿戴App -> App上传云端 -> 云端临时存储 -> 返回照片可访问地址。全过程由工具内部封装,Skill 只需处理返回的照片地址

3. 请求参数

全部来自系统上下文,无需额外关注

4. 响应参数

字段

类型

描述

示例值

success

boolean

调用结果

true

errorCode

string

错误码

errorMsg

string

错误消息

model

object

返回的业务数据

model.url

string

公网可下载的临时图片地址

"https://xxx.example.com/photo/xxx.jpg"

model.format

string

图片类型

"jpg"

model.mimeType

string

媒体类型

"image/jpeg"

model.requestId

string

请求唯一id

"photo_sync_202608xxx"

5. 使用示例

一个基于拍照+图片识别工具实现的文物识别SKILL:

---
name: relic-recognition
description: 文物识别技能。通过 AI 眼镜拍照识别文物,给出文物名称、年代、材质、纹饰特征、历史文化背景及有趣故事等信息。当用户提到"拍照识别文物""这是什么文物""这是什么瓷器/青铜器/玉器""识别一下这件文物""帮我看看这是什么古董""这件文物是什么年代的"时使用。
---

# 文物识别

通过 AI 眼镜拍照获取文物图片,自动识别文物种类并给出年代、材质与历史文化信息。

## 工作流程

### 第一步:拍照获取文物图片

调用 ^^tQ8fCF.capture_photo^^

拍照成功后返回结构示例:

```json
{
  "success":true,
  "model":{
    "url": "https://xxx.example.com/photo/xxx.jpg",
    "format": "jpg",
    "mimeType": "image/jpeg",
    "requestId": "photo_sync_202608xxx"
  }
}
```

其中 `url` 字段为图片的可访问地址;

### 第二步:识别文物

将上一步拍到的图片连同提问一起传入 ^^4F2df8.image_qa_stream^^,进行文物识别问答。

调用参数:

- imageUrl(必填):取第一步 ^^tQ8fCF.capture_photo^^ 返回的 url
- query(必填):文物识别专用提问,并结合用户原始诉求做适当优化。基础模板如下:

> 请根据这张图片,用自然流畅的口语介绍这件文物。说说它大概是什么、什么年代的、用什么材质做的、上面有什么纹饰或特征,再讲讲它背后的历史文化故事和有趣的地方。如果看不清或拿不准的地方就直说,不要瞎编。控制在 300 字以内。若图中不是文物或无法确定,请直接说明。
  • 其中4F2df8.image_qa_stream是官方提供的图片识别工具的唯一编码,细节可见 图片识别

  • 示例中 ^^{工具编码}^^ 是 SKILL 引用工具的内置语法,可在SKILL.md中通过@快速选取工具。

6. 限制

  1. 图片分辨率:800 x 600