工具

ProfilePicture.AI

Postcraft的免费PFP Maker是一个在线工具,允许用户为他们的社交媒体账户创建自定义头像。它允许用户上传照片,然后该工具将自动删除背景,并生成数百张独特的头像照片。

Alpha Engine

Alpha Engine 是一款面向资本市场的 AI 投研工具,提供全面的数据库、智能搜索、会议记录、文件转录、摘要提取及翻译等功能。通过 AI 技术提升投研效率,支持实时数据更新与个性化知识管理,适用于分析师、投资者及研究人员,助力精准决策与信息获取。

Replay

Replay是一款基于AI技术的音频处理工具,可精准分离音乐中的主唱、人声和伴奏等音轨。支持多种音频格式,具备高质量输出、实时预览、参数调整和自动化处理等功能,适用于音乐制作、KTV伴奏、教学及内容创作等领域。操作简便,兼容多平台,为音乐创作和分析提供高效解决方案。

豆包1.5·UI

豆包1.5·UI-TARS是字节跳动推出的一款面向图形用户界面(GUI)的智能代理模型,具备视觉理解、逻辑推理和操作执行能力。它无需预定义规则,即可实现端到端的GUI任务自动化,适用于办公、测试、客服及机器人交互等多个场景。模型基于多模态融合与端到端学习技术,支持高效的界面交互与精准的视觉定位。

HunyuanCustom

HunyuanCustom是腾讯混元团队开发的多模态视频生成框架,支持图像、音频、视频和文本等多种输入条件,生成高质量定制化视频。采用文本-图像融合与图像ID增强技术,提升身份一致性和视频真实性。适用于虚拟人广告、虚拟试穿、视频编辑等场景,具备音频驱动和视频驱动两种生成方式,展现强大可控性与灵活性。

World Labs 空间智能模型

World Labs 空间智能模型是一款基于人工智能技术的工具,能够通过单张图片生成逼真的3D世界,并支持实时渲染与交互操作。其核心功能包括3D几何估算、场景补全、内容生成及相机效果模拟,广泛应用于电影、游戏、虚拟现实、教育以及建筑设计等多个领域,大幅提升了创作效率与视觉表现力。

Hibiki

Hibiki是一款由Kyutai Labs开发的开源语音翻译解码器,支持实时语音到语音(S2ST)和语音到文本(S2TT)的翻译。其基于多流语言模型架构,结合弱监督学习和上下文对齐技术,实现低延迟、高保真度的翻译效果。适用于国际会议、在线教育、旅游、新闻采访及客户服务等场景,具备良好的实用性和可扩展性。

VXlive

VXlive是一款以语音社交为核心的多功能应用,支持语音聊天、直播、1对1视频通话及AI互动功能。内置AI语音识别与语音日记,提供个性化互动体验,增强用户情感陪伴。语音挑战活动提升社交趣味性,适合各类用户拓展社交圈,尤其适合社交焦虑人群。应用注重互动性和社区氛围,打造轻松友好的社交环境。

扣子空间

扣子空间是由字节跳动推出的AI Agent平台,支持用户通过可视化界面快速构建和管理AI应用,无需编程基础。平台集成60余款MCP插件,涵盖资讯、出行、办公等功能,提供探索与规划两种协作模式,适应不同任务需求。用户可将开发的Bot发布至微信、飞书等平台,也可自定义插件扩展功能。适用于商品推荐、播客制作、智能协作等多种场景,具备良好的扩展性与实用性。

赞多多

赞多多是一款基于AI技术的小程序,旨在帮助用户轻松创作个性化的朋友圈文案。它支持多种场景(如生活分享、工作宣传、营销推广)的文案生成,并提供多样化的风格选择,如“儒雅真挚”、“口语化”等。用户可上传图片并自动匹配文案,或对已有的文案进行润色优化。此外,赞多多还提供了免费试用期和灵活的订阅方案,适用于个人用户及商业用途。