R

RAGEN

RAGEN是一款开源的强化学习框架,专为在交互式和随机环境中训练大型语言模型(LLM)推理代理而设计。它基于StarPO架构,支持多轮轨迹优化和多种强化学习算法,如PPO和GRPO。通过MDP形式化和渐进式奖励归一化策略,RAGEN提高了训练的稳定性和效率。其模块化设计支持多种环境,适用于智能对话、游戏AI、自动化推理等多个领域。

Effie

Effie是一款集写作、笔记与思维导图于一体的综合性软件,提供沉浸式界面与强大功能,支持多平台操作和云端同步。内置AI功能优化写作流程,包括润色、提要生成及创意激发,适用于个人写作、学术研究、商业写作及教育等多个场景。

Drawio

现更名为Diagram,一款免费开源的思维导图流程图表制作软件,Drawio允许用户创建和分享各种图表,包括流程图、组织结构图、UML图、网络图等。

TextHarmony

TextHarmony是一款由华东师范大学与字节跳动联合开发的多模态生成模型,擅长视觉与文本信息的生成与理解。该模型基于Slide-LoRA技术,支持视觉文本生成、编辑、理解及感知等功能,广泛应用于文档分析、场景文本识别、视觉问题回答、图像编辑与增强以及信息检索等领域。通过高质量数据集的构建与多模态预训练,TextHarmony在视觉与语言生成任务中表现出色。

Cobra

Cobra是由清华大学、香港中文大学和腾讯ARC实验室联合开发的漫画线稿上色框架,采用因果稀疏注意力机制和局部可复用位置编码技术,实现高精度、高效率的自动上色。支持颜色提示调整,提升灵活性与个性化。适用于漫画、动画、插画等多种场景,具有高效的推理能力和良好的扩展性。项目已开源,包含技术论文与模型资源。

VirtuLook

wondershare VirtuLook,AI电商图片生成神器。

PaliGemma 2

PaliGemma 2是一款由Google DeepMind研发的视觉语言模型(VLM),结合了SigLIP-So400m视觉编码器与Gemma 2语言模型,支持多种分辨率的图像处理。该模型具备强大的知识迁移能力和出色的学术任务表现,在OCR、音乐乐谱识别以及医学图像报告生成等方面实现了技术突破。它能够处理多模态任务,包括图像字幕生成、视觉推理等,并支持量化和CPU推理以提高计算效率。

Suno AI

Suno AI 是由 Anthropic 公司开发的一款 AI 音乐和语音生成工具。 仅使用文本提示即可生成高质量的歌声、乐器和完整的音乐作品。

Creasquare

Creasquare 是一款可使用人工智能 (AI) 为您的帖子生成标题、主题标签和产品描述,帮助您轻松创建和安排社交媒体内容的网站,

Genspark AI幻灯片

一款能够快速将如PDF、Excel、Word等数据格式转化为专业PPT幻灯片的工具,支持一句话交互修改、艺术风格化设计,并可导出为PPTX、PDF等格式