AI模型
汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。
PhoneBuddy – 腾讯混元推出的开源手机智能体训练框架
PhoneBuddy是腾讯混元发布的开源手机智能体训练框架,支持真实应用强化学习、PhoneWorld模拟环境训练、GUI界面理解和任务规划执行,适用于移动Agent开发、手...
Mistral OCR 4 – Mistral AI推出的文档理解与OCR解析模型
Mistral OCR 4是Mistral AI推出的文档理解与OCR解析模型,支持多语言文本识别、表格提取、结构化数据输出、Bounding Box定位和知识库构建,适用于合同审核、...
openPangu 2.0 – 华为开源超长上下文大语言模型与智能体平台
openPangu 2.0是华为推出的开源大语言模型,支持512K超长上下文、MoE稀疏架构与智能体任务执行能力,提供Pro与Flash版本,适用于企业知识库、长文档分析与国...
Confucius4-TTS – 网易有道推出的多语言语音克隆与语音合成模型
Confucius4-TTS是网易有道开源的语音合成模型,支持文本转语音、零样本语音克隆、跨语言语音生成和情感韵律迁移。模型支持14种语言,可用于数字人配音、有声...
豆包音频生成模型1.0 – 火山引擎推出的端到端音频创作模型
豆包音频生成模型1.0是火山引擎Seed团队推出的音频创作模型,支持文本和参考音频输入,可生成对白、音效和环境声等完整音频内容,具备长时音色一致性、零样本...
Qwen-AgentWorld – 阿里巴巴千问团队推出的智能体世界模型
Qwen-AgentWorld是阿里巴巴千问团队发布的智能体世界模型,面向AI Agent训练、环境模拟、强化学习和智能体评测场景。支持256K上下文、多环境交互、MCP工具调...
Baichuan-M4 – 百川智能推出的临床级医疗大模型
Baichuan-M4是百川智能联合清华大学THUBPM团队研发的临床级医疗大模型,支持医疗推理、循证医学检索、长期患者管理、多模态医疗理解和智能问诊。模型面向辅助...
Rodin Gen-2.5 – 影眸科技推出的AI 3D模型
Rodin Gen-2.5是一款由影眸科技推出的AI 3D模型,支持文本生成3D模型与图片生成3D模型,自动完成Mesh构建、纹理生成与拓扑优化,适用于游戏资产制作、数字人...
豆包2.1 – 字节跳动推出的智能体与代码工程大模型
豆包2.1是字节跳动Seed团队推出的新一代智能体大模型,支持代码工程、多模态理解、长上下文推理与智能体任务执行。模型提供Pro和Turbo版本,适用于软件开发、...
Seedance 2.5 – 字节跳动推出的长视频生成与多模态视频创作模型
Seedance 2.5 是字节跳动推出的新一代AI视频生成模型,支持最长30秒原生视频生成、50个全模态参考素材输入和局部视频编辑能力,适用于广告制作、影视预演、工...

浙公网安备33010202004812号