HunyuanCustom HunyuanCustom是腾讯混元团队开发的多模态视频生成框架,支持图像、音频、视频和文本等多种输入条件,生成高质量定制化视频。采用文本-图像融合与图像ID增强技术,提升身份一致性和视频真实性。适用于虚拟人广告、虚拟试穿、视频编辑等场景,具备音频驱动和视频驱动两种生成方式,展现强大可控性与灵活性。 AI项目与工具 2025年06月11日 73 点赞 0 评论 613 浏览
FlowGPT FlowGPT是一个针对ChatGPT的高质量问题模板大全,专门为小白用户汇集了ChatGPT的各种Prompt清单,可以认为是向ChatGPT提问的模板,小白用户可以直接抄作业。它旨在通过提供各种模... AI写作对话 1970年01月01日 0 点赞 0 评论 613 浏览
Airpost Airpost是一款基于AI的视频广告生成工具,专为电商营销设计。用户只需提供产品链接和素材,即可在短时间内生成多个高质量的UGC风格广告视频。平台内置大量真实用户生成内容,确保广告自然且具吸引力。支持脚本编写、镜头选择、音乐匹配等功能,同时允许品牌自定义。适用于新品推广、广告优化及中小团队低成本制作视频广告。 AI项目与工具 2025年06月11日 48 点赞 0 评论 612 浏览
Agent Q Agent Q是一种自监督代理推理和搜索框架,结合了引导式蒙特卡洛树搜索(MCTS)、AI自我批评及直接偏好优化(DPO)等技术。该框架通过迭代微调和基于人类反馈的强化学习进行自我改进,在网页导航和多步任务执行中表现优异。Agent Q的主要功能包括引导式搜索、自我批评、迭代微调、多步推理任务和零样本学习。它在电子商务、在线预订服务、软件开发、客户服务、数据分析和个性化推荐等领域具有广泛应用前景。 AI项目与工具 2025年06月12日 77 点赞 0 评论 612 浏览
Beepbooply Beepbooply是一款人工智能驱动的文本转语音工具,允许用户快速轻松地生成具有逼真声音的音频内容。超过80种语言、120种口音和900种声音,用户可以自定义他们的音频,并生成几个小... Ai语音工具 1970年01月01日 0 点赞 0 评论 612 浏览
IDM IDM-VTON是一种基于改进扩散模型的先进AI虚拟试穿技术,由韩国科学技术院和OMNIOUS.AI的研究人员共同开发。该技术利用视觉编码器提取服装的高级语义信息,并通过GarmentNet捕捉服装的低级细节特征,从而生成逼真的人物穿戴图像。IDM-VTON支持文本提示理解,实现了个性化定制和逼真的试穿效果,广泛应用于电子商务、时尚零售、个性化推荐、社交媒体以及时尚设计等领域。 AI项目与工具 2024年01月01日 49 点赞 0 评论 612 浏览
Azure AI Azure AI 语音服务为用户提供了一套全面的语音处理解决方案,支持多种语言,具备高度的自定义能力,适用于各种规模的公司和多样化的应用场景。 创作工具 1970年01月01日 0 点赞 0 评论 612 浏览