π¦ ClawHub
Aliyun Qwen Multimodal Embedding
by @cinience
Use when multimodal embeddings are needed from Alibaba Cloud Model Studio models such as `qwen3-vl-embedding` for image, video, and text retrieval, cross-mod...
TERMINAL
clawhub install aliyun-qwen-multimodal-embeddingπ About This Skill
name: aliyun-qwen-multimodal-embedding description: Use when multimodal embeddings are needed from Alibaba Cloud Model Studio models such as
qwen3-vl-embedding for image, video, and text retrieval, cross-modal search, clustering, or offline vectorization pipelines.
version: 1.0.0
Category: provider
Model Studio Multimodal Embedding
Validation
mkdir -p output/aliyun-qwen-multimodal-embedding
python -m py_compile skills/ai/search/aliyun-qwen-multimodal-embedding/scripts/prepare_multimodal_embedding_request.py && echo "py_compile_ok" > output/aliyun-qwen-multimodal-embedding/validate.txt
Pass criteria: command exits 0 and output/aliyun-qwen-multimodal-embedding/validate.txt is generated.
Output And Evidence
output/aliyun-qwen-multimodal-embedding/.Use this skill when the task needs text, image, or video embeddings from Model Studio for retrieval or similarity workflows.
Critical model names
Use one of these exact model strings as needed:
qwen3-vl-embeddingqwen2.5-vl-embeddingtongyi-embedding-vision-plus-2026-03-06Selection guidance:
qwen3-vl-embedding for the newest multimodal embedding path.qwen2.5-vl-embedding when you need compatibility with an older deployed pipeline.Prerequisites
DASHSCOPE_API_KEY in your environment, or add dashscope_api_key to ~/.alibabacloud/credentials.Normalized interface (embedding.multimodal)
Request
model (string, optional): default qwen3-vl-embeddingtexts (arrayimages (arrayvideos (arraydimension (int, optional): e.g. 2560, 2048, 1536, 1024, 768, 512, 256 for qwen3-vl-embeddingResponse
embeddings (arraydimension (int)usage (object, optional)Quick start
python skills/ai/search/aliyun-qwen-multimodal-embedding/scripts/prepare_multimodal_embedding_request.py \
--text "A cat sitting on a red chair" \
--image "https://example.com/cat.jpg" \
--dimension 1024
Operational guidance
input.contents as an array; malformed shapes are a common 400 cause.Output location
output/aliyun-qwen-multimodal-embedding/request.jsonOUTPUT_DIR.References
references/sources.mdπ‘ Examples
python skills/ai/search/aliyun-qwen-multimodal-embedding/scripts/prepare_multimodal_embedding_request.py \
--text "A cat sitting on a red chair" \
--image "https://example.com/cat.jpg" \
--dimension 1024
βοΈ Configuration
DASHSCOPE_API_KEY in your environment, or add dashscope_api_key to ~/.alibabacloud/credentials.π Constraints
mkdir -p output/aliyun-qwen-multimodal-embedding
python -m py_compile skills/ai/search/aliyun-qwen-multimodal-embedding/scripts/prepare_multimodal_embedding_request.py && echo "py_compile_ok" > output/aliyun-qwen-multimodal-embedding/validate.txt
Pass criteria: command exits 0 and output/aliyun-qwen-multimodal-embedding/validate.txt is generated.