AI模型

汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。

Qwen-UI-Agent – 阿里通义推出的GUI智能体基座模型

Qwen-UI-Agent是一款由阿里通义推出的GUI智能体基座模型,主要用于在手机、电脑和网页端像真人一样操作界面并完成跨应用长程任务,支持GUI与命令行混合执行及...

Mureka V9.5 – 昆仑万维推出的新一代AI音乐生成模型

Mureka V9.5是一款由昆仑万维推出的AI音乐生成模型,主要用于通过文本描述一键生成包含旋律、人声、和声与编曲的完整歌曲,基于MusiCoT音乐思维链框架并主打...

Happy Shrimp – 阿里巴巴推出的AI音乐整曲生成模型

Happy Shrimp是一款由阿里巴巴推出的AI音乐整曲生成模型(中文名'快乐虾米'),主要用于从一段情绪、故事或记忆的描述直接生成完整歌曲,支持作词、作曲、编...

Mage – 微软开源的4B参数全模态模型家族

Mage是一款由微软开源的4B参数多模态模型家族,主要用于图像生成编辑与流式视频理解,支持原生分辨率文生图、指令式图像编辑与实时视频分析,适用于边缘设备...

dots3-note preview – 小红书开源的280B MoE全模态大模型

dots3-note preview是一款由小红书dots.studio于2026年8月14日开源的280B MoE全模态大模型(预览版),激活参数16B,主要用于Agent任务执行、长上下文处理与...

IndexTTS-2.5 – B站开源的零样本多语种语音克隆TTS

IndexTTS-2.5是一款由B站IndexSpeech团队于2026年8月开源的零样本语音克隆TTS模型,参数量8亿,主要用于3秒参考音频克隆音色并生成多语种语音,支持中英日西...

dots.tts – 小红书开源的全连续自回归语音合成模型

dots.tts是一款由小红书dots团队联合上海交大X-LANCE实验室开源的全连续自回归TTS模型,参数量20亿,主要用于零样本语音克隆与高自然度语音合成,支持48kHz高...

LTX-2.5 – Lightricks开源的4K同步音画视频模型

LTX-2.5是一款由Lightricks于2026年8月开源的AI视频生成模型,总参数220亿,主要用于从文本、图片和视频输入生成带同步音频的4K HDR视频,支持原生多镜头叙事...

Muse Glimmer – Meta开源的本地运行智能体模型

Muse Glimmer是一款由Meta Superintelligence Labs于2026年8月开源的30B参数本地智能体模型,采用Apache 2.0许可证,主要用于断网环境下的AI工具调用、代码生...

Gemini 3.7 Flash – 谷歌推出的编程与智能体低成本主力模型

Gemini 3.7 Flash是一款由Google于2026年8月13日推出的编程与智能体特化大模型,上下文窗口100万token,主要用于代码生成、软件工程与多步自动化任务,支持三...
1 3 4 5 6 7 32