dsh-image-gen
DeepSeek Harness 的 AI 影像工作室 — 在聊天中生成、編輯與比較圖片,擁有 500+ 提示詞、圖庫、多模型工作流程及 ComfyUI。
比較 198 款經過品質篩選的 圖片工具,參考公開熱門度、活躍度、授權與資料來源。
瀏覽經品質篩選的 圖片工具,可依資料來源、收費方式或新舊程度縮小範圍,更快找到合適選項。
DeepSeek Harness 的 AI 影像工作室 — 在聊天中生成、編輯與比較圖片,擁有 500+ 提示詞、圖庫、多模型工作流程及 ComfyUI。
彙整光學字元辨識 (OCR) 相關資源(包括論文與資料集)
只需輸入提示即可從圖像中擦除任何物件
DreamLayer Eval:開源基準測試,用於影像與影片擴散模型。自動化提示詞、種子與指標,實現可重現的結果。
一個可搜尋的圖庫,收錄 2,730 張來自 ICLR、ICML、NeurIPS、CVPR、ACL、AAAI(2023-2025)的精心設計 Figure 1 / teaser 圖,並標註 Oral / Spotlight / Best 論文等級。
破限本地AI女友後宮,Agent+繪圖語音向量資料庫+live2D+桌寵+酒館角色卡匯入+webchat,QQ+Telegram雙通道,8G顯存可跑 uncensored 完全離線 AI 女友後宮 Openclaw/Claude code+本地LLM+GPT-SoVITS+ComfyUI 圖片+Live2D+桌面寵物+
MegaDetector 是一個 AI 模型,協助保育人員減少在相機陷阱影像上耗費的無趣時間。
掌握AI推理、AI代理系統與硬體工程,最終設計出實體AI晶片 — 這就是目標。
`xxg-portrait-rebuild-light` 是一個針對現有人像照片的影像編輯工具,透過導演級的打光流程重建主光、補光、陰影與背景氛圍。
適用於 1,400 多個 fal.ai 模型的生產級 ComfyUI 自訂節點,自動更新的影像、影片、音訊、LLM 與 VLM API,具備原生媒體、快取與成本控制功能。
AMD MIVisionX 是一套電腦視覺工具包,以高度最佳化且符合規範的 Khronos OpenVX™ 1.3.2 規格開源實作為核心。
開源 Python 函式庫,用於建立生物影像分析管線
自動車牌辨識管線 - fast-alpr + fast-plate-ocr + FastAPI。隱私保護(HMAC + KVKK + GDPR)。pip install anpr-pipeline
專為初學者設計的 ComfyUI 前端介面。
用於 MiniMax H3 靜態影像生成、參考編輯及 Qwen 細節優化的 ComfyUI 節點與測試工作流程。
[IEEE TCSVT'26] 🂡 AceVFI:視訊影格插值進展之綜合調查
用於 AI 圖片生成與編輯的 MCP 伺服器,具備自動提示詞優化與品質預設。支援 Nano Banana (Gemini)、OpenAI GPT Image 與 Byte
[ICLR 2026] 官方實作「Patch-as-Decodable-Token: Towards Unified Multi-Modal Vision Tasks in MLLMs」
DarkGPT Chat Explorer 是一個互動式網頁應用程式,讓使用者能即時與各種 GPT(生成式預訓練轉換器)模型進行對話。
歡迎使用 **LiveRecall**,這是一款 Microsoft Recall 的開源替代方案。LiveRecall 能捕捉螢幕畫面,並讓您利用自然語言查詢來回憶這些畫面。
基於語義匹配的 Danbooru 標籤搜尋引擎,支援多維匹配、智慧分詞與共現關聯推薦。
隱私優先、僅限本機的條碼掃描SDK,支援Web、Node.js、React、iOS與Android,具備多格式解碼、即時追蹤、批次掃描及原生/WASM引擎。
30 多種可安裝的 Codex 視覺設計技能,搭配可重複使用的 Python 工具、版本化套件與自動化測試。將照片轉化為藝術作品。
AI 影像生成工作台、影片工作台。支援 Agent 與工作台模式、無限畫布、素材管理、提示詞反推/廣場及 PWA,支援外鏈式配置;可接入 Grok、GPT Image 2 等自訂模型生成影像。