主页

关于我 / About me


Hi there! I'm 𝙃𝙪𝙘𝙚𝙜𝙤𝙣 (胡成功) 👋,很高兴你能访问我的主页!

胡成功 个人简介

🎓 基本信息

个人主页: www.hucegon.cloud

师承背景: VIPA实验室 - 宋明黎

政治面貌: 中共党员

微信号: 18650100989

研究方向: 扩散模型,长视频实时流式交互生成,数字人,视频智能剪辑模型,视频编辑

联系方式: 19558231506

电子邮箱: huchenggong@zju.edu.cn

🏫 教育背景

浙江大学 (工学硕士,保研)

2024.09 - 2027.06

软件工程

  • 研究方向:扩散模型,长视频实时流式交互生成,数字人,视频智能剪辑模型,视频编辑
  • 奖项荣誉:校区优秀实践奖学金(全院仅10人),院优秀研究生、五好研究生

华侨大学 (工学学士)

2020.09 - 2024.06

计算机科学与技术

  • 专业排名:1 / 106
  • 实践活动:院学生会学术部部长
  • 奖项荣誉:国家奖学金×3 (人名日报报道获奖100人候选人),综测优秀奖学金×2,校优秀学生、优秀毕业生

🔬 科研成果

第一作者 Accepted by AAAI 2026 [CCF-A]
扩散模型 图生图
第一作者 Accepted by ACMMM 2026 [CCF-A]
扩散模型 多模态 数字人
共同一作 Accepted by EMNLP 2026 [NLP 顶会]
LLM Agent Prompt Engineering
共同一作 Under Review by IJCV2025 [CCF-A类期刊,CV领域顶刊]
扩散模型 量化加速
Under Review by AAAI 2027 [CCF-A]
视觉自回归 图像编辑
Under Review by AAAI 2027 [CCF-A]
强化学习 智能体 模型选择

💻 实习经历

流式实时长视频生成算法实习生 2026.06 — 至今
  • 负责脑洞秀流式实时长视频生成:完成 LTX2.3 教师适配、Omni-Forcing 因果化、长视频稳定性与分布式推理加速,并构建实时 prompt 交互 demo。
  • 研究方向:因果流式长视频生成、Diffusion-Forcing 式推理并行、身份感知 KV-Cache、场景切换(recache + R2AV/T2AV)。
电商带货挂店短视频智能剪辑与生成算法实习生 2026.05 — 2026.06
  • 负责挂店短视频智能剪辑 pipeline 搭建与上线:基于 VACE-14B 实现字幕擦除与毛玻璃去除,通过 Omni-vLLM 加速与素材库扩充提升成片质量。
  • 研究方向:短视频智能剪辑、视频字幕擦除、文生视频素材扩充。

南方电网-数字变电事业部(广州、海南)

电网作业安全智能识别与检测算法实习生 2025.09 — 2025.11
  • 负责电网作业人员人身安全防控项目及变电站内 17 种带电部件的精确识别。
  • 研究方向:目标检测,电力作业安全防控,带电部件精确识别。

🏆 竞赛荣誉

🥇 2023.11:中国大学生工程实践与创新能力大赛虚拟仿真赛道工程场景数字化赛项 | 金奖

🥈 2023.08:睿抗机器人开发者大赛CAIP编程设计赛道 | 国家二等奖

🥈 2023.05:中国高校计算机大赛-团体程序设计天梯赛 | 国家二等奖

🏅 2023.05:美国大学生数学建模比赛 | Honorable Mention 奖

🥇 2022.11:全国大学生数学建模大赛高教社杯 | 福建省一等奖

🥈 2022.11:全国大学生数字媒体科技作品及创意竞赛 | 国家二等奖

🥈 2022.10:全国大学生算法设计与编程挑战赛 | 铜奖

🛠️ 个人知识库

音视频生成架构: 熟悉 LTX, MOVA, Bernini, MiniMax-H3 等主流音视频生成架构,并拥有丰富的训练、推理和落地经验。

生成式框架: 熟悉 MMDiT / UNet (Wan, SD, Flux), VAE, Transformer 等架构和基本 DDPM / CFG / FM / LCM 等技术。

流式长视频生成: 熟悉 Self / Omni / Resampling / Teacher-Forcing, Longlive, StreamDiT, Causal-Forcing 等视频因果化技术。

MLLM & RLHF: 掌握多种多模态大模型的架构 (Qwen 系列),理解多种强化学习算法原理 (DPO, GRPO 等)。

Python Git Linux VS Code

感谢您的来访 !/ THANKS FOR VISITING !