PhotoMaker PhotoMaker V2是腾讯推出的一款AI图像生成框架,能够快速生成逼真的人物照片。它在角色的一致性和可控性上取得了显著进步,用户可以通过文本指令进行精准控制。该工具利用深度学习技术和生成对抗网络(GANs),能够将文本描述转化为图像,并通过集成脚本增强生成过程的个性化和可控性。PhotoMaker V2广泛应用于游戏开发、电影制作、广告、社交媒体、艺术创作和教育等领域。 AI项目与工具 2025年06月12日 34 点赞 0 评论 1005 浏览
TemPolor 一款人工智能音乐生成器,TemPolor可以将您的文本转化为个性化音乐,创造属于您自己的音乐交响曲。用户使用文字、敲击或哼唱来提供旋律灵感,然后帮助将其生成一首歌。 Ai语音工具 2025年06月05日 12 点赞 0 评论 1006 浏览
Stable Video 通过简化视频制作过程,即使是没有专业视频编辑技能的用户也能快速创建吸引人的视频。Stable Video目前处于公测阶段,每个人都可以免费使用。 Ai视频生成 2026年09月24日 0 点赞 0 评论 1006 浏览
Logome Logome是一款基于AI技术的在线标志设计工具,能够根据用户输入的品牌信息快速生成多种标志方案,并支持风格、颜色和字体的自定义调整。同时提供品牌套件生成、智能设计建议以及高分辨率文件导出等功能,适用于初创企业、自由职业者和个人品牌建设,帮助用户高效打造专业且一致的品牌形象。 AI项目与工具 2025年06月12日 63 点赞 0 评论 1006 浏览
Spikes Studio Spikes Studio是一个将长视频转化为YouTube、TikTok和Reels病毒视频的工具。它具有强大的AI编辑器,自动添加字幕等功能。 视频剪辑 2025年06月05日 51 点赞 0 评论 1006 浏览
PixArt PixArt-Σ是一款基于扩散Transformer架构(DiT)的文本生成图像模型,专为生成高达4K分辨率的高质量图像而设计。该模型通过整合高级元素并采用从弱到强的训练方法,不仅提升了生成图像的保真度,还增强了图像与文本提示之间的对齐效果。PixArt-Σ的生成图像在美学质量上可媲美当前顶级的文本到图像产品,并且在遵循文本提示方面表现出色。主要功能包括4K分辨率图像生成、高保真转换、高效率训练和 AI项目与工具 2024年01月01日 82 点赞 0 评论 1006 浏览
TITAN TITAN是一款由哈佛医学院研究团队开发的多模态全切片病理基础模型,通过视觉自监督学习和视觉-语言对齐预训练,能够在无需微调或临床标签的情况下提取通用切片表示并生成病理报告。它在多种临床任务中表现出色,包括线性探测、少样本和零样本分类、罕见癌症检索、跨模态检索和病理报告生成,尤其适用于资源有限的临床场景。 AI项目与工具 2025年06月12日 93 点赞 0 评论 1006 浏览
Gemini 2.5 Flash Gemini 2.5 Flash 是 Google 推出的高性能 AI 模型,具备低延迟、高效率及推理能力,适用于代码生成、智能代理和复杂任务处理。其优化设计降低了计算成本,适合大规模部署。该模型基于 Transformer 架构,结合推理机制和模型压缩技术,提升了响应速度与准确性,广泛应用于智能开发、内容生成和实时交互等领域。 AI项目与工具 2025年06月12日 33 点赞 0 评论 1007 浏览
alethea.ai Alethea.ai是一家专注于生成式人工智能与区块链技术融合的创新机构,其核心产品CharacterGPT能够基于文本描述生成具有独特个性和外观的AI角色。这些角色可以通过区块链技术实现代币化,支持用户在去中心化环境中拥有、交易和互动。此外,Alethea.ai推出的AI Protocol提供了去中心化的智能合约,确保AI角色及其相关资产的所有权、互操作性和治理机制。平台目标在于推动AI的普及化 AI项目与工具 2025年06月12日 56 点赞 0 评论 1007 浏览
Seedance 1.0 lite Seedance 1.0 lite 是火山引擎推出的轻量级AI视频生成工具,支持文生视频和图生视频,可生成5秒或10秒、480p/720p分辨率的视频。具备精细的人物控制和丰富的运镜方式,画质清晰、风格多样,广泛应用于电商、影视、娱乐等领域,有效提升制作效率并降低成本。 AI项目与工具 2025年06月11日 66 点赞 0 评论 1007 浏览