工具

Gemini Diffusion

Gemini Diffusion是谷歌推出的实验性文本扩散模型,通过逐步细化噪声生成文本,具备快速响应、生成更连贯文本和迭代细化等能力。与传统自回归模型不同,它能并行生成文本,提高效率。在外部基准测试中表现优异,速度更快,适用于内容创作、代码生成、数学问题解答和文本编辑等场景。用户需加入等待名单获取访问权限。

Xiaomi MiMo

Xiaomi MiMo 是小米推出的推理型大模型,具备强大的数学推理与代码生成能力。通过预训练与后训练相结合,利用大量高价值语料及强化学习算法,在 7B 参数规模下实现超越更大模型的表现。支持多场景应用,包括教育、科研、软件开发等,已开源至 HuggingFace,便于开发者使用与研究。

TokenVerse

TokenVerse 是一种基于扩散模型的多概念图像生成工具,支持从单图或多图中解耦并组合视觉元素,如物体、材质、姿势等。通过优化调制空间,实现对复杂概念的局部控制,无需微调模型即可生成个性化图像,适用于创意设计、艺术创作和内容生成等多种场景。

创脑

创脑是一款面向公众的AI机器人社区平台,提供从创建、配置到发布AI助手的一站式服务。其核心功能包括创建个性化AI机器人、浏览现有机器人、进行AI对话与创作、复刻AI分身等,广泛应用于办公自动化、客户服务、教育、医疗和金融等领域,助力用户提高效率并实现智能化解决方案。

YouCam AI Pro

一款多功能人工智能艺术生成器,允许用户从文本和图像创建高质量的数字艺术和头像。 YouCam AI Pro 专注于创造力和易用性,适合艺术家、设计师和任何有兴趣探索人工智能生成视觉效果潜力的人。

Pollinations.AI

Pollinations.AI是一个开源AI内容生成平台,提供图像生成、文本生成、音频转换及视觉分析等功能。用户无需注册即可使用,支持多种模型和参数配置,适合开发者和创作者快速集成与应用。平台还提供浏览器开发环境,简化了使用流程,提升了效率。

BlueWillow

BlueWillow 是一种基于 Web并使用人工智能根据您的文本输入生成逼真而美丽的图像。

CineMaster

CineMaster是快手推出的3D感知视频生成框架,支持通过文本提示及深度图、相机轨迹等控制信号生成高质量视频内容。其核心功能包括3D物体与摄像机控制、交互式设计、自动化数据标注和高质量视频输出。采用两阶段工作流程与扩散模型技术,结合语义布局控制网络与摄像机适配器,提升视频生成的精确度与灵活性。适用于影视制作、广告营销、游戏开发等多个领域。

新言意码

新言意码是一家专注于AI编程应用开发的科技公司,提供代码生成、补全、审查、优化、测试及智能搜索等功能,支持多语言开发。其产品适用于软件开发、教育学习、代码维护、团队协作及快速原型构建等多种场景,旨在提升开发效率和代码质量。公司成立于2024年,已获得多轮投资,估值达8000万美元。

FlexiAct

FlexiAct是由清华大学与腾讯ARC实验室联合研发的动作迁移模型,可在空间结构差异较大的场景下实现精准动作迁移,并保持目标主体的外观一致性。其核心模块包括轻量级RefAdapter和频率感知动作提取(FAE),有效提升跨主体动作迁移的灵活性与准确性。该模型适用于影视、游戏、广告等多个领域,具有良好的应用前景。