AI模型

汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。

Unlimited-OCR – 百度开源的端到端长文档OCR模型

Unlimited-OCR是百度开源的端到端长文档OCR模型,采用R-SWA注意力机制和3B参数MoE架构,支持40页以上PDF单次解析、表格识别、公式提取和复杂版面理解,在Omni...

HappyHorse 1.1 – 阿里推出的AI视频生成与多模态创作模型

HappyHorse 1.1是阿里推出的新一代AI视频生成模型,支持文生视频、图生视频、多图参考生成、音画同步及API调用。适用于短剧制作、电商广告、品牌营销、游戏CG...

Seedance 2.0 Mini – 字节跳动推出的高性价比视频生成模型

Seedance 2.0 Mini是字节跳动推出的高性价比视频生成模型,支持文生视频、图生视频和视频生视频创作,具备多模态参考生成能力。模型面向短视频制作、电商营销...

GLM-5.2 – 智谱AI推出的开源AI编程与智能体开发大模型

GLM-5.2是智谱AI发布的开源AI编程模型,支持100万Token上下文、智能体编程、代码生成、多文件代码分析及私有化部署。模型采用MIT协议开源,适用于软件工程、...

PP-OCRv6 – 百度飞桨推出的多语言OCR识别与文档数字化模型

PP-OCRv6是百度飞桨PaddleOCR团队发布的新一代OCR模型,支持50种语言文本识别、文档解析、PDF转文本、工业字符检测和知识库数据处理。文章全面解析PP-OCRv6的...

Kimi K2.7 Code – 月之暗面推出的长上下文编程与智能体开发模型

Kimi K2.7 Code是月之暗面推出的AI编程模型,支持256K超长上下文、代码生成、代码补全、代码审查、智能体开发和API调用。适用于软件开发、大型代码库分析、自...

HiDream-O1-Image-1.5 – 智象未来推出的商用图像生成与视觉创作模型

HiDream-O1-Image-1.5是智象未来推出的商用图像生成模型,基于原生全模态UiT架构,支持文生图、图像编辑、多主体一致性、复杂文字渲染与分镜生成。在Artifici...

SpaceMind – 科大讯飞推出的智能空间Agent与场景自动化平台

SpaceMind是科大讯飞发布的智能空间Agent平台,支持空间感知、多Agent协作、长期记忆与设备联动控制,适用于智慧家庭、智慧酒店、智慧办公和智慧建筑场景。平...

Gemini 3.5 Live Translate – 谷歌推出的实时语音翻译与跨语言沟通模型

Gemini 3.5 Live Translate 是 Google 发布的实时语音翻译模型,支持70多种语言自动识别与近实时语音互译,可保留说话者语调和语音特征。适用于跨国会议、多...

Claude Fable 5 – Anthropic推出的超长任务推理与科研开发大语言模型

Claude Fable 5 是 Anthropic 于2026年发布的大语言模型,支持超长上下文、多模态理解、复杂推理、代码生成和科研分析。适用于软件工程、企业知识库、科学研...
1 12 13 14 15 16 32