共 154 条结果
V
用户529332587
· 更新于2026-04-13
google-research/vision_transformer
图像与视觉
运行时长0hGitHub Star12.5k
vision transformer
☆ 0↓ 0▣ 0
K
用户580667318
· 更新于2026-03-02
ru1ven/KeypointFusion
图像与视觉
运行时长1546hGitHub Star27
KeypointFusion_Py39_Torch1.10_CUDA11.3
☆ 1↓ 0▣ 0
A
用户772625847
· 更新于2026-02-04
a545030159/a123a123
图像与视觉
运行时长0hGitHub Star0
a123
☆ 0↓ 0▣ 0
L
akibanzu
· 更新于2026-05-26
Akegarasu/lora-scripts/lora-train
图像与视觉
运行时长0hGitHub Star6.0k
Stable Diffusion LoRA 训练
☆ 0↓ 0▣ 0
D
用户318744975
· 更新于2026-01-28
OnoRyuuji/test
图像与视觉
运行时长1301hGitHub Star0
none
☆ 0↓ 0▣ 0
H
用户791698901
· 更新于2025-12-23
Tencent-Hunyuan/HunyuanImage-3.0
图像与视觉
运行时长0hGitHub Star3.1k
强大的原生多模态图像生成模型
☆ 1↓ 0▣ 1
G
用户310785488
· 更新于2025-12-18
dongconse/facenet
图像与视觉
运行时长0hGitHub Star0
GLIDER
☆ 0↓ 0▣ 0
G
RVC-Boss
· 更新于2026-05-26
RVC-Boss/GPT-SoVITS/GPT-SoVITS-Official
语音与听觉
运行时长0hGitHub Star57.8k
GPT-SoVITS语音合成官方镜像
☆ 0↓ 0▣ 0
Q
用户791698901
· 更新于2025-12-16
QwenLM/Qwen-Image
图像与视觉
运行时长0hGitHub Star7.9k
具有精准的图像编辑功能的模型
☆ 0↓ 0▣ 0
Q
用户791698901
· 更新于2025-12-12
QwenLM/Qwen3-VL
图像与视觉
运行时长0hGitHub Star19.2k
迄今为止 Qwen 系列中最强大的视觉-语言模型
☆ 0↓ 0▣ 0
Q
用户791698901
· 更新于2025-12-11
QwenLM/Qwen3-VL
图像与视觉
运行时长3106hGitHub Star19.2k
迄今为止 Qwen 系列中最强大的视觉-语言模型
☆ 0↓ 0▣ 0
M
O_O
· 更新于2026-05-26
TMElyralab/MuseTalk/MuseTalk
语音与听觉
运行时长0hGitHub Star5.8k
数字人制作,根据声音修改视频人物的唇形
☆ 0↓ 0▣ 0