工具

speakSync

AI语音翻译器,无缝语音和文本转换,一款基于ChatGPT的AI语音翻译应用,支持70多种语言。它可以实现面对面语音通话。

SnapGen

SnapGen是一款由Snap Inc、香港科技大学和墨尔本大学联合开发的文本到图像扩散模型,专为移动设备设计,支持在1.4秒内生成1024×1024像素的高分辨率图像。它通过优化网络架构、跨架构知识蒸馏和对抗性训练等技术,在保持小模型规模的同时,提供了高质量的图像生成能力,适用于社交媒体、移动应用、教育、新闻等多个领域。

豆包1.5·UI

豆包1.5·UI-TARS是字节跳动推出的一款面向图形用户界面(GUI)的智能代理模型,具备视觉理解、逻辑推理和操作执行能力。它无需预定义规则,即可实现端到端的GUI任务自动化,适用于办公、测试、客服及机器人交互等多个场景。模型基于多模态融合与端到端学习技术,支持高效的界面交互与精准的视觉定位。

灵感岛

灵感岛是一款结合AI技术的内容创作与智能营销平台,专注于为自媒体创作者及品牌营销团队提供全方位的支持。它具备智能文案生成、视频脚本创作、智能混剪、数字人直播等多项核心功能,覆盖内容生产的全流程,并支持多平台分发与效果追踪,帮助企业实现内容营销的降本增效。

飞书智能伙伴

飞书智能伙伴是字节跳动旗下企业办公和协作平台飞书最新推出的AI办公助手,能在多种工作场景中发挥作用,例如帮助用户提炼会议要点、总结未读消息、分析PDF与音视频、自动续写或生...

小白AI

全球AI集合站,集合了包含GPT,midjourney等全球优秀AI优秀工具。

PydanticAI

一个Pydantic 团队开发的Python代理框架,可以通过生成式AI轻松构建生产级应用程序。

AI Draw

AI Draw 是一个基于AI的头像生成素描风格的神器,通过智能 AI 技术,能在短短的几秒钟内就可以快速将照片变成有意思的素描画。

Gemma 3n

Gemma 3n 是谷歌 I/O 开发者大会推出的端侧多模态 AI 模型,基于 Gemini Nano 架构,采用逐层嵌入技术,将内存占用压缩至 2-4B 参数模型水平。支持文本、图像、短视频和音频输入,可生成结构化文本输出,并具备音频转录、情感分析等功能。可在本地设备运行,响应时间低至 50 毫秒,适用于语音助手、内容生成和学术任务定制。

Coral AI

Coral AI 是一款基于 AI 的文档分析平台,专注于智能搜索、摘要生成、翻译及问答功能。它支持超过 90 种语言,适用于学术研究、法律分析和商业报告等场景,特别适合处理大量文档。主要功能包括智能搜索、自动摘要生成、实时翻译、引用生成、跨文档搜索、文档标记与管理等,并支持多种文件类型和图像分析。