圖片上傳
使用方式
點擊 🖼️ 按鈕上傳,或使用 Cmd+V/Ctrl+V 貼上剪貼簿中的圖片。
支援格式
JPEG、PNG、GIF、WebP。
圖片預覽
上傳後會顯示縮圖預覽;可單張移除,亦支援同時附加多張圖片。
支援的模型
| 供應商/類型 | 說明 |
|---|---|
| OpenAI | GPT-5.4 系列等具視覺能力的模型 |
| Gemini 2.5、Gemini 1.5 系列 | |
| Anthropic | Claude 3 系列(claude-3-opus、claude-3-sonnet 等) |
| Alibaba | Qwen VL |
| OpenRouter | 依所選模型是否支援視覺而定 |
| Ollama | LLaVA 等支援多模態的本機模型 |
⚠️ 檔案大小限制單張圖片最大 5MB。超過限制的圖片會被自動跳過。
⚠️ 模型能力不支援視覺的模型可能無法正確處理圖片內容。
AI 回覆中的圖片
除了你上傳圖片給 AI,Momo 也會自動處理 AI 回覆裡帶出的圖片(常見於 Hermes、OpenClaw 等 Agent 生成圖片的場景)。
當回覆文字包含下列任一形式時,Momo 會嘗試下載並在對話泡泡內直接顯示:
MEDIA:<https-url>標記- Markdown 圖片語法
 - 以
.png、.jpg、.jpeg、.webp、.gif結尾的 HTTP/HTTPS 圖片 URL
下載成功的圖片會存入本機 IndexedDB(AttachmentStore),之後在同一對話中直接渲染,不只保留外部連結。OpenClaw 若以 image / image_url content part 回傳 HTTP 圖片,也會走同一流程。
⚠️ 下載限制若圖片 URL 已過期、需要登入、或無法以 HTTP/HTTPS 存取,Momo 可能無法下載,此時仍可能只看到連結或空白。此為暫行方案,日後若 Agent 提供正式 media endpoint,行為可能調整。
技術細節(上傳)
圖片以 Base64 編碼傳送;請求格式採用 OpenAI Vision API 慣例之 image_url 內容區塊。