AI模型

汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。

ABot-Earth 0.5 – 高德推出的3D原生城市世界模型与数字地球生成平台

ABot-Earth 0.5是高德地图AMAP CV Lab推出的3D原生城市世界模型,支持单张卫星图像或文本生成公里级三维城市场景,输出可编辑3DGS资产,适用于数字孪生、具身...

Kairos-HomeWorld – 大晓机器人推出的全屋三维可交互世界模型

Kairos-HomeWorld是大晓机器人联合香港中文大学MMLab与深圳河套学院推出的全屋三维可交互世界模型,支持户型生成、家具布局、交互物体生成与机器人仿真训练,...

PawBench – 阿里通义实验室推出的模型与Harness联合评测基准

PawBench是通义实验室推出的通用智能体评测基准,用于评估模型与Harness在真实Agent任务中的联合表现,覆盖150个任务与4050个测试单元,支持多模型与多运行框...

Magenta RealTime 2 – 谷歌 Magenta推出的实时音乐生成与AI乐器模型

Magenta RealTime 2是Google Magenta推出的开源实时音乐生成模型,支持文本、音频和MIDI控制,可在Apple Silicon设备本地运行。适用于AI音乐创作、实时编曲、...

JoyAI-Echo – 京东推出的长音视频生成与多镜头故事创作框架

JoyAI-Echo是京东Joy Future Academy开源的长音视频生成框架,支持5分钟多镜头故事生成、音视频联合生成、跨模态记忆一致性和Director Agent对话式编辑。适用...

MAI-Code-1-Flash – 微软推出的代码生成与Agent开发模型

MAI-Code-1-Flash 是 Microsoft AI 发布的代码大语言模型,支持代码生成、代码补全、Bug修复、Agent开发和软件工程任务处理。适用于GitHub Copilot、开发辅助...

MAI-Transcribe-1.5 – 微软推出的多语言语音转写与企业级ASR模型

MAI-Transcribe-1.5是Microsoft AI发布的企业级语音转文字模型,支持43种语言识别、自动语言检测、关键词增强和语音转文字API服务,适用于会议记录AI工具、视...

MAI-Voice-2 – Microsoft AI推出的多语言文本转语音与语音克隆模型

MAI-Voice-2是Microsoft AI于2026年发布的多语言文本转语音模型,支持AI语音生成、零样本语音克隆、情感控制、代码混说和长文本语音合成。适用于智能助手、有...

MAI-Thinking-1 – 微软推出的高级推理与代码生成模型

MAI-Thinking-1是微软推出的高级推理大语言模型,支持数学推理、软件工程代码生成、长上下文分析与Agent任务执行。模型采用MoE架构并支持256K上下文,在AIME...

Bernini – 字节跳动开源视频生成与语义规划统一框架

Bernini是字节跳动开源的视频生成与编辑统一框架,基于MLLM语义规划与DiT扩散渲染架构,支持文本生成视频、图像生成视频、多参考视频编辑与风格迁移等能力,...
1 13 14 15 16 17 32