AI

Unmute

Unmute 是 Kyutai 推出的低延迟语音交互系统,专注于语音转文字和文字转语音功能。基于先进 AI 模型,提供实时、高效的语音交互体验,支持用户与 AI 进行语音交流,并能将文字内容快速转换为自然流畅的语音输出。其低延迟处理能力实现无缝交互,具备快速集成、随时打断、10秒生成声音、多样化调整等功能,适用于在线教育、智能客服、语音助手、游戏娱乐和企业会议等场景。

洞图

洞图是一款集多功能于一体的AI图片处理工具,主要功能包括制作隐藏文字的幻觉图片、生成逼真的AI写真、智能擦除路人、照片动态化、AI换脸、美肤优化、风格滤镜应用以及照片清晰度提升等。其简洁的操作界面和强大处理能力,使用户能快速生成个性化图文素材,适用于多种应用场景,如社交媒体分享、隐私保护、形象照制作及照片修复等。

Diffutoon

Diffutoon是一款基于扩散模型的AI框架,旨在将现实风格的视频转换为动漫风格。该框架支持高分辨率视频处理,能够实现风格化、一致性增强、结构引导和自动着色等功能。此外,Diffutoon具备内容编辑功能,用户可通过文本提示调整视频细节,确保视觉效果和内容的一致性。

字幕酱

字幕酱是一个在线字幕生成工具,利用 AI 深度学习技术,提供自动字幕生成、字幕翻译、字幕格式转换等功能。

Project Blink

Adobe Labs一款实验性的人工智能视频编辑工具项目,可以搜索视频的特定部分、编辑视频脚本并概述关键时刻。它利用机器学习和人工智能自动修剪剪辑并消除干扰。

MiniMind

MiniMind 是一款轻量级开源语言模型项目,具备极低的训练成本和高效的训练流程。其最小模型仅需 25.8M 参数,可在普通 GPU 上运行,支持多模态能力,如视觉语言模型 MiniMind-V。项目提供完整的训练代码,涵盖预训练、微调、LoRA、DPO 和模型蒸馏,兼容主流框架,适合初学者和开发者快速上手并应用于多个领域。

XiHATEK-AI

通过3D数字人技术,用户可以跨越现实与虚拟的界限,享受每一次互动带来的视觉盛宴。

轻竹办公PPT

款国内精选的简约AIPPT制作工具,通过AI技术实现一键生成内容的功能。轻竹办公提供了丰富多彩的PPT模板,让用户能够轻松制作出完美设计的PPT。

BasedLabs.ai

BasedLabs AI是一个高级的人工智能换脸平台,它利用先进的AI技术为用户提供异常真实的换脸效果。该平台不仅注重自然的外观和无缝的编辑,还特别强调用户隐私和数据安全。