焚.com

图像与视觉

按「解决什么问题」分类:图像与视觉方向的高分开源项目,共 16 个,按焚评六维公式排序。

编程开发智能体框架数据与金融安全与扫描图像与视觉音视频处理写作与文档搜索与采集系统与运维桌面效率
Deep-Live-Cam 是 Python 实时换脸与一键视频 deepfake 工具,仅凭一张图片即可换脸,支持实时视频、摄像头场景。适合想体验 AI 换脸、实时 deepfake 的开发者与爱好者。
Python · ★ 96.8k · 1 天前有推送
图像与视觉aiai-deep-fakeai-faceai-webcam
9.8
🖼️ Image Toolbox is a powerful app for advanced image manipulation. It offers dozens of features, from basic tools like crop and draw to filters, OCR, and a wide range of image processing options
Kotlin · ★ 14.8k · 1 天前有推送
图像与视觉aiandroidbackground-removalcrop
9.8
ComfyUI 是面向扩散模型的模块化 GUI、API 和后端,带图/节点界面,可用于本地推理。它适合希望通过节点界面操作扩散模型的开发者与用户,主要用 Python 编写,并自称最快的本地推理引擎。
Python · ★ 135.2k · 8 小时前有推送
图像与视觉aicomfycomfyuipython
9.4
Learn OpenCV : C++ and Python Examples
Jupyter Notebook · ★ 23.2k · 7 天前有推送
图像与视觉aicomputer-visioncomputervisiondeep-learning
9.1
NVR with realtime local object detection for IP cameras
Python · ★ 36.1k · 19 小时前有推送
图像与视觉aicameragoogle-coralhome-assistant
9.0
用 Go 编写的 AI 驱动照片应用,支持自托管与私有云部署,借助机器学习和 TensorFlow 管理照片,可作为 Google Photos 的替代方案。适合注重隐私、希望自主托管照片库的用户。
Go · ★ 40.2k · 4 小时前有推送
8.7
SVG Optimizer for Node.js and CLI. ⚙️
JavaScript · ★ 22.7k · 1 个月前有推送
图像与视觉clihacktoberfestjavascriptminification
8.4
Upscayl 是一款免费开源的 AI 图像放大工具,支持 Linux、macOS 与 Windows。它基于 AI 模型处理低分辨率图片,帮助用户在不损失细节的前提下放大图像,适合需要修复或增强老照片、素材清晰度的普通用户与设计人员。
TypeScript · ★ 49.9k · 12 天前有推送
图像与视觉aielectronesrgangigapixel
7.6
Industry leading face manipulation platform
Python · ★ 30k · 1 天前有推送
图像与视觉aideep-fakedeepfakeface-swap
7.5
three.js 是一个用 JavaScript 编写的 3D 库,主要服务于网页上的三维图形开发,也关联 AR、VR、Canvas、SVG、WebGL、WebGL2、WebGPU、WebXR、WebAudio 等方向。它适合 JavaScript 开发者、前端开发者以及需要制作网页三维内容的人使用,在 GitHub 上获得 115953 个星标。
JavaScript · ★ 116k · 1 天前有推送
图像与视觉3daugmented-realitycanvashtml5
7.1
A privacy-first app that strips AI watermarks from content you own.
Python · ★ 22.9k · 1 天前有推送
图像与视觉agent-skillaianthropicc2pa
7.1
Rebuild the object in a reference image as a code-only, procedural, quality-gated, animation-ready Three.js model. Token-efficient image-to-3D.
Python · ★ 17k · 4 天前有推送
图像与视觉3dai-agentsclaude-codecomputer-graphics
7.1
PaddleOCR 是轻量级 OCR 工具包,能把 PDF 和图片文档转为结构化数据,衔接图像/PDF 与 LLM。支持 100 多种语言,覆盖中文 OCR、文档解析、PDF 转 Markdown、关键信息抽取和 RAG 等方向,适合需要文档处理的开发者。
Python · ★ 90.3k · 11 天前有推送
图像与视觉ai4sciencechineseocrdocument-parsingdocument-translation
7.0
Invoke is a leading creative engine for Stable Diffusion models, empowering professionals, artists, and enthusiasts to generate and create visual media using the latest AI-driven technologies. The sol
Python · ★ 28.3k · 17 小时前有推送
图像与视觉ai-artartificial-intelligencegenerative-artimage-generation
7.0
基于 PyTorch 的扩散模型库,面向图像、视频与音频生成,涵盖文生图、图生图、文生视频等任务,收录大量先进扩散模型与预训练权重。适合深度学习研究者、模型微调人员及生成式应用开发者使用,主要语言为 Python。
Python · ★ 34.6k · 1 天前有推送
图像与视觉deep-learningdiffusionfluximage-generation
6.4
✅(已完结)超级全面的 深度学习 笔记【土堆 Pytorch】【李沐 动手学深度学习】【吴恩达 深度学习】【大飞 大模型Agent】
Jupyter Notebook · ★ 23.8k · 7 天前有推送
图像与视觉agentagentsbookchinese
6.1