圖片上傳

使用方式

點擊 🖼️ 按鈕上傳,或使用 Cmd+V/Ctrl+V 貼上剪貼簿中的圖片。

支援格式

JPEG、PNG、GIF、WebP。

圖片預覽

上傳後會顯示縮圖預覽;可單張移除,亦支援同時附加多張圖片。

支援的模型

供應商/類型 說明
OpenAI GPT-5.4 系列等具視覺能力的模型
Google Gemini 2.5、Gemini 1.5 系列
Anthropic Claude 3 系列(claude-3-opus、claude-3-sonnet 等)
Alibaba Qwen VL
OpenRouter 依所選模型是否支援視覺而定
Ollama LLaVA 等支援多模態的本機模型
⚠️ 檔案大小限制單張圖片最大 5MB。超過限制的圖片會被自動跳過。
⚠️ 模型能力不支援視覺的模型可能無法正確處理圖片內容。

AI 回覆中的圖片

除了你上傳圖片給 AI,Momo 也會自動處理 AI 回覆裡帶出的圖片(常見於 Hermes、OpenClaw 等 Agent 生成圖片的場景)。

當回覆文字包含下列任一形式時,Momo 會嘗試下載並在對話泡泡內直接顯示:

下載成功的圖片會存入本機 IndexedDB(AttachmentStore),之後在同一對話中直接渲染,不只保留外部連結。OpenClaw 若以 image / image_url content part 回傳 HTTP 圖片,也會走同一流程。

⚠️ 下載限制若圖片 URL 已過期、需要登入、或無法以 HTTP/HTTPS 存取,Momo 可能無法下載,此時仍可能只看到連結或空白。此為暫行方案,日後若 Agent 提供正式 media endpoint,行為可能調整。

技術細節(上傳)

圖片以 Base64 編碼傳送;請求格式採用 OpenAI Vision API 慣例之 image_url 內容區塊。