多语言

MonkeyOCR

MonkeyOCR是由华中科技大学与金山办公联合开发的文档解析模型,能够高效地将非结构化文档内容转换为结构化信息。其支持多种文档类型和语言,处理复杂文档(如公式、表格)效果显著,处理速度达每秒0.84页。基于SRR三元组范式和MonkeyDoc数据集,模型在准确性和效率上表现优异,适用于自动化业务流程、数字存档、智能教育、医疗记录管理及学术研究等场景。

Cursor AI

一个利用AI提升编程效率的代码生成工具,帮助开发者编写、编辑和理解代码。Cursor AI提供智能配对编程、上下文理解和强大的自动补全功能,极大地提高了编程效率。

Auphonic

Auphonic是一款利用人工智能技术的在线音频后期处理工具,提供自动音量平衡、降噪、混响减少、滤波、静音剪切等功能,适用于播客制作、广播电台、电影视频制作等多个场景,支持多语言语音转文字及视频章节生成,提供免费和多种付费订阅方案。

Lingvotube

一个可以将视频及其隐藏式字幕(CC)翻译成多种语言,并自动生成真实的画外音的视频翻译工具。

智面星

智面星是一款以AI为核心技术的面试辅助平台,集成了AI选岗、AI模拟面试、面试精灵、深度复盘及实时反馈等功能模块,通过个性化指导和全面分析助力求职者提升面试表现,同时支持企业和教育机构用于招聘筛选、教学培训及职业咨询服务。

VDSpeak

一个专注于为YouTube视频提供多语言翻译和配音服务的在线工具,只需输入视频链接,就能快速生成翻译字幕或配音音频。

驯鹿AI

专注于跨境电商市场的智能客服工具,驯鹿AI依托通用大语言模型技术,提供智能客服和销售机器人服务,支持多语言实时翻译和全球客户管理。

Qwen3

Qwen3 是阿里巴巴推出的下一代大型语言模型,支持“思考模式”和“非思考模式”,适用于复杂与简单任务。具备 119 种语言支持,优化了编码与 Agent 能力,数据量达 36 万亿 token,采用四阶段训练流程。提供多种模型配置,涵盖从轻量级到企业级应用。在多项基准测试中表现优异,广泛应用于文本生成、机器翻译、法律文书、技术文档、医疗辅助等领域。

Qwen2

Qwen2是由阿里云通义千问团队开发的大型语言模型系列,涵盖从0.5B到72B的不同规模版本。该系列模型在自然语言理解、代码编写、数学解题及多语言处理方面表现出色,尤其在Qwen2-72B模型上,其性能已超过Meta的Llama-3-70B。Qwen2支持最长128K tokens的上下文长度,并已在Hugging Face和ModelScope平台上开源。 ---

TurboTTS

TurboTTS是一款支持多语言的在线文本转语音工具,提供300多种真实语音选择,生成自然流畅的语音效果。适用于短视频、教育、广告及播客等多种场景,操作简单,支持多种音频格式下载,并可合法用于商业用途。凭借AI技术,用户能高效完成语音内容制作,满足多样化需求。