多语言

Pangea

Pangea是一款由卡内基梅隆大学团队开发的多语言多模态大型语言模型,支持39种语言,具备多模态理解和跨文化覆盖能力。其主要功能包括多语言文本生成与理解、图像描述、视觉问答等,同时通过高质量指令和文化相关任务优化性能。Pangea基于丰富的数据集和先进的模型架构,适用于多语言客户服务、教育、跨文化交流等多个领域。

VideoTrans

一个开源的视频翻译和配音工具,VideoTrans能够一键识别视频字幕、翻译成其他语言以及进行多种语音合成,最终输出带字幕和配音的目标语言的视频。

EasySub

一个在线字幕生成器,专注于长视频文本和字幕生成,自动获取最准确的转录字幕,支持150多种免费语言翻译,提供免费试用选项,但并非完全免费。

Aoyo.ai

一个AI搜索工具网站,专门设计用于满足在互联网上搜索信息时遇到语言障碍的用户,有效地消除了语言差异带来的障碍。

Talk AI练口语

Talk AI是一款基于AI技术的语言学习应用,支持超过60种语言,提供实时语法纠错、智能生词本、视频通话等功能。它通过模拟真实对话场景,帮助用户提升口语能力,同时提供语言考试模拟练习。无论是在日常交流、商务场景还是旅行准备中,Talk AI都能满足不同用户的需求。

麦耳会记

麦耳会记是思必驰科技股份有限公司旗下产品,依托思必驰深耕多年的全链路智能语音语言技术,形成了以语音文字、字幕同传、智能硬件等为核心的智慧办公系列产品和服务平台,可满足...

BizGen

BizGen是由清华大学与微软研究院联合开发的AI信息图生成工具,能将长篇文章自动转化为专业级的信息图和幻灯片。其核心技术包括高质量数据集Infographics-650K和“布局引导的交叉注意力机制”,可精准控制图像中各区域的文本与视觉元素。支持多语言和多种风格,适用于商业汇报、产品展示、学术研究等多个场景,具备高准确性与排版质量。

Mistral Saba

Mistral Saba 是一款面向中东和南亚地区的定制化 AI 模型,具备 240 亿参数,专注于阿拉伯语及南亚语言(如泰米尔语、马拉雅拉姆语)的处理。其优势在于高效部署、低资源占用和高准确性,适合需要文化背景理解的场景。可通过微调应用于多个行业,并支持 API 和本地部署,适用于对话支持、专业领域知识生成及文化内容创作。

Mistral Small 3.1

Mistral Small 3.1 是一款由 Mistral AI 开发的开源多模态 AI 模型,拥有 240 亿参数,支持文本与图像处理,具备长达 128k tokens 的上下文窗口和每秒 150 token 的推理速度。采用 Transformer 架构与 MoE 技术,提升计算效率,支持多语言和本地部署。适用于文档处理、图像分析、质量检测、虚拟助手等多种场景。

novelistAI

NovelistAI是一款基于AI技术的小说创作平台,支持多种文学体裁和语言的创作,提供封面设计、插图生成和有声书制作等功能,旨在提升创作体验并扩大全球影响力。用户可以通过个性化图书馆功能管理自己的创作成果,适用于个人、教育、语言学习和专业写作等多个场景。