工具

FunASR

FunASR是一个由阿里巴巴达摩院开源的多功能语音识别工具包,涵盖语音识别(ASR)、语音活动检测(VAD)、标点恢复、说话人验证及分离等功能。它支持工业级模型的训练与微调,并提供预训练模型和易用接口,便于快速部署。新增的Whisper-large-v3-turbo模型进一步提升了其性能,广泛应用于智能助手、会议记录、客服系统和语音搜索等领域。

MyMap AI

MyMap AI,一个基于 AI 的视觉思维助手。

Photor

一款简单易用且功能强大的在线截图美化工具,Photor提供了可以为截图添加背景颜色、阴影、圆角等元素,并支持多种标注方式。

Gemini 2.0 Flash

Gemini 2.0 Flash是Google推出的多模态AI模型,支持文本与图像生成及对话式编辑,能根据自然语言生成连贯图像,并保持上下文一致性。其在长文本渲染方面表现优异,适用于广告、社交媒体、教育等领域。开发者可通过Google AI Studio或Gemini API进行测试和集成,广泛应用于创意插图、互动故事、设计辅助等场景。

绘创Al

绘创AI图片修改配图能力,基于AI人工智能图片处理技术,支持多种格式图片,一键在线修改调整,修改图片,编辑图片,AI绘图可调整风格、画质、清晰度等,秒级场景AI智能合成。

Veo 3

Veo 3是谷歌推出的新一代视频生成模型,在I/O开发者大会上发布。它是首个能生成视频背景音效的模型,可合成画面并匹配人物对话和口型,支持1080P高质量视频生成,具备物理模拟与口型同步能力,可生成超过60秒的视频片段,并支持多种视觉风格。Veo 3整合了多项先进技术,适用于影视制作、广告营销及教育领域。

知意AI

知意AI是一款利用自然语言处理技术的人工智能内容创作工具,专注于提升创作效率与质量。它可生成社交媒体文案、电商营销内容、视频脚本,并提供文本润色和文章总结服务,还支持AI绘图与智能对话功能,适用于教育、职场、生活等多个领域,满足多样化创作需求。

Zazzani AI

一个提供由人工智能驱动的各种工具和服务的网站。Zazzani AI 可以帮助您完成诸如撰写文章、创建照片、调试代码、产生想法和获得问题答案等任务。

Whisk

Whisk是一款基于AI的图像生成工具,由谷歌推出,支持用户通过上传图像并指定主题、场景和风格生成新图像。它具备多图像输入、自动图像提示及额外文字细节添加等功能,基于谷歌最新的Imagen 3模型,适用于艺术创作、广告营销、社交媒体内容生产等多个领域,助力用户高效完成创意设计。