VoxInstruct VoxInstruct是清华大学开源的语音合成技术,能够根据人类语言指令生成高质量的语音。该系统采用统一的多语言编解码器语言建模框架,将传统的文本到语音任务扩展到了更广泛的人类指令到语音任务。VoxInstruct通过引入语音语义标记和多种无分类器指导策略,提升了语音合成的自然度和表现力。它支持多语言和跨语言合成,适用于智能语音助手、有声读物、教育培训等多个领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 576 浏览
PDF2Audio PDF2Audio 是一款开源工具,支持将 PDF 文档转换为音频内容,适用于播客制作、教育、业务演示等多个场景。其核心功能包括 PDF 转文本、生成播客脚本、文本转语音转换、多语言支持及高级编辑功能。用户可通过自定义选项调整文本生成模型、语音风格等,支持批量处理和多种模板适配,方便用户根据需求生成高质量音频。 AI项目与工具 2025年06月12日 35 点赞 0 评论 576 浏览
同花顺·问财 同花顺·问财大模型是一款集合了实时数据获取、深度语义理解、专业投资建议、数据可视化和内容安全控制等多功能的智能投顾工具。 创作工具 1970年01月01日 0 点赞 0 评论 575 浏览
讯飞智文 讯飞智文是科大讯基于讯飞星火认知大模型,一款极具创新性的智能文档创作平台,不仅提供高效便捷的文案改写服务,还能自动生成令人印象深刻的PPT文档。 PPT资源 2025年06月05日 77 点赞 0 评论 575 浏览
RTranslator RTranslator是一款基于AI技术的开源、免费离线翻译应用,专为Android设备设计。它支持对话模式、对讲机模式及文本翻译功能,能够实现高质量的多语言实时翻译。RTranslator采用Meta的NLLB翻译模型和OpenAI的Whisper语音识别技术,支持多种语言,完全离线运行,保障用户隐私安全。 AI项目与工具 2025年06月12日 44 点赞 0 评论 575 浏览
Chromox Chromox是一款基于AI技术的视频生成工具,可将文本和图像快速转化为高质量的视频内容。支持文本到视频、图像到视频的转换,并提供多样化的风格选项,适用于广告、教育、社交媒体等多种场景。其用户友好型界面和高清晰度输出使其成为创意表达的理想选择。 AI项目与工具 2025年06月12日 26 点赞 0 评论 575 浏览
奇布塔 奇布塔是一个依托AI技术的有声绘本创作平台,提供文字、图片、声音和视频一体化编辑工具,集成丰富的资源库,支持用户创作高质量有声作品。平台特色包括图片转绘、角色画面分离及社区互动功能,广泛适用于儿童教育、语言学习、早期教育及家庭娱乐等领域。 AI项目与工具 2025年06月12日 20 点赞 0 评论 574 浏览
浦语灵笔 浦语灵笔IXC-2.5是一款由上海人工智能实验室开发的多模态大模型,具备7B规模的大型语言模型后端,能够处理长上下文、超高分辨率图像和细粒度视频理解,支持多轮多图像对话。该模型可以自动生成网页代码和高质量图文内容,在多模态基准测试中表现出色,性能可与OpenAI的GPT-4V相媲美。 AI项目与工具 2025年06月12日 62 点赞 0 评论 574 浏览
抖音搜索 抖音搜索是一款集短视频与图文内容于一体的搜索引擎,融合了AI技术,支持关键词、语音等多种搜索方式。它提供视频、图文、商品等多频道内容,具备精准推荐和个性化展示功能,旨在为用户提供流畅的观看体验和便捷的社交互动。 AI项目与工具 2025年06月12日 35 点赞 0 评论 574 浏览
Napkins.dev Napkins.dev 是一款基于 AI 技术的开源工具,能够将用户上传的截图或线框图快速转化为可运行的网页应用程序。它利用 Meta 的 Llama 系列模型和 Together.ai 的推理服务,支持代码生成、编辑和定制,并具备多主题选择及版本管理功能,适用于快速原型开发、教育学习、初创公司以及 UI/UX 设计验证等场景。 AI项目与工具 2025年06月12日 51 点赞 0 评论 574 浏览