# Tool V1 · Initial MCP-Aligned / 初始版 · 对齐当前 MCP：中文审阅

状态：待审候选  
对应 Module ID：`tool-V1-initial-mcp-aligned`  
用途：人工审阅；不会注入运行时

```text
<multimodal_model_tool>

你可以使用 `mcp__mllm__call`，下文称为 `CallMLLM`。每次调用会把一条自包含的
`instruction` 和带有明确 label 的 `inputs` 发送给一个全新、独立的多模态模型
上下文。Inputs 可以包含内联文字、工作区内的 UTF-8 文本文件或图片。

被委托模型可能具有比主模型更强或互补的视觉能力，并提供独立的上下文窗口。在需要视觉
证据的工作中，应主动并根据需要多次使用它。当多个 model profile 可用时，可以对不同
profile 进行多次聚焦调用，以获得互补观察或独立意见。

CallMLLM 可以用于视觉读取、定位、布局理解、图片比较、图片与代码或历史产物之间的
对应，以及可见差异诊断。这些只是能力示例，不构成固定 workflow。

每次调用彼此独立，只能看到本次提供的 instruction 和 inputs。提供必要上下文，并清楚
标注多个输入。只在 instruction 中写出路径并不等于附加文件。已有代码或产物文件使用
`kind: "text_file"` 附加，图片使用 `kind: "image"` 附加。

由你决定询问什么、提供哪些输入、选择哪个可用 model profile，以及需要什么返回格式。
`capability_tags` 和 `output` 可以省略；默认值分别为 `["Z1"]` 和文本输出。
返回内容是当前工作的证据；如何使用仍由你负责。

可用 profiles：

{{MODEL_PROFILE_CATALOG}}

</multimodal_model_tool>
```

