My work focuses on DiT-based video generation, digital humans, face AI, multimodal systems, and production-oriented AI infrastructure.
- 🗣️ Jogg-Avatar — 720p DiT 数字人生成模型,支持音频注入与音画同步。
- 🧑🎨 ltx23-headswap-toolkit — 基于 LTX 2.3 的视频换头方案,包含 ComfyUI 工作流、WanAnimate 数据生成与 LoRA 训练。
- 🚀 Self-Forcing-Plus — 面向 DiT 视频生成的 Self-Forcing 蒸馏工程,支持 1.3B 模型训练。
- 🎥 VideoX-Fun — DiT 视频生成训练与推理实验,用于 FlashHead 官模 V2V 改造探索。
- 🎞️ AnimateDiff-I2V — AnimateDiff 图生视频改造版,支持 IP-Adapter 与多 ControlNet。
- 🤖 Duix-Mobile — 端侧实时交互数字人 SDK。
- 🧑🎤 Duix-Avatar — 开源 AI 数字人工具,支持离线视频生成与形象、声音克隆。
- 🔍 Duix-Mobile-reverse — Duix 移动端应用的逆向分析与接口研究。
- 🎭 ReHiFace-S — 实时高保真换脸算法,支持零样本推理与 ONNX 部署。
- 🎯 XSegNet2onnx — DeepFaceLab XSegNet 权重转 ONNX 工具,推理提速至 90ms。
- 📷 face_power — 人脸算法工具库,从 AI_Power 独立出的人脸专用模块。
- 🛡️ Silent-Face-Anti-Spoofing — 小视科技静默活体检测项目,包含训练、测试与移动端部署资源。
- 🎨 photo2cartoon-paddle — PaddlePaddle 版人像卡通化项目,支持照片到卡通风格转换实验。
- 🧠 AI_power — AI 工具箱与预训练模型集合,覆盖 CV、音频、视频生成等多领域。
- 🔊 audio_power — 音频处理工具库,封装 TTS、ASR、音频特征提取等常用接口。
- 🧩 cv2box — 工作中高频使用的 CV 工具函数集合。
- ⏱️ apstone — ONNX 模型推理高级封装,用于下游项目。
- 🧠 llm_power — LLM API 调用与视频生成实验工具集,集成豆包、通义千问等多平台接口。
- 🎬 Subtitle Remover — 自动化的视频字幕提取与移除工具。
- 🌐 VideoTrans — 视频翻译流程实验项目,整合 ASR、机器翻译与 TTS。
- 📹 pyvirtualcam — 全网首发,支持 macOS 的虚拟摄像头工具。
- 🍏 Torch2CoreML — PyTorch 模型转 CoreML 的转换工具。
- 🛰️ TopFreeProxies — 多源免费代理聚合工具,自动测速生成 Clash 配置。




