#DragGAN
InternGPT - 基于非语言指令的视觉互动系统
Github开源项目DragGANInternGPTiGPTHuskyImageBind
InternGPT允许用户通过点击、拖拽和绘图与ChatGPT进行视觉交互,优化了视觉任务处理的效率和准确性。该系统集成了辅助控制机制和高质量的视觉语言模型Husky,支持多模态对话、图像生成和编辑等功能,适用于复杂的视觉场景。
DragGAN - 基于交互点的生成图像操作
Github开源项目PyTorchDragGANGANStyleGAN3SIGGRAPH 2023
DragGAN项目介绍了一种基于交互点操作的生成图像技术,可以在生成图像流形上进行精确调整。内容包括技术实现步骤如安装依赖、运行Docker、下载预训练权重和使用GUI进行图像编辑。该项目关键是集成了StyleGAN3和部分StyleGAN-Human代码,提供一个在Linux和Windows系统上高效运行的图像编辑工具。代码遵循CC-BY-NC许可,部分源代码基于Nvidia Source Code License。
相关文章