AI模型

汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。

Gemini Omni Flash – Google推出的多模态AI视频生成与连续编辑模型

Gemini Omni Flash 是 Google DeepMind 推出的多模态AI视频生成模型,支持文本生成视频、图片转视频、连续视频编辑与音频同步生成,适用于AI短视频创作、广告...

Gemini 3.5 Flash – Google DeepMind推出的Agent执行与多模态推理模型

Gemini 3.5 Flash是Google DeepMind推出的多模态大模型,基于Gemini 3 Flash架构,支持agent执行、代码生成与100万token上下文窗口,并通过thinking_level控...

Qwen3.7-Max – 阿里通义推出的智能体旗舰大模型

Qwen3.7-Max是阿里通义千问团队发布的新一代智能体大模型,支持长周期自主执行、AI编程、工具调用与企业工作流自动化。模型具备1M上下文、多智能体协作与跨框...

Qwen3.5-LiveTranslate – 阿里推出的实时多语言语音翻译模型

Qwen3.5-LiveTranslate是阿里巴巴Qwen团队推出的实时多语言语音翻译模型,支持AI语音识别、视频字幕自动生成、多语言语音转写与实时同传。模型具备多模态理解...

HiDream-O1-Image-Pro – 智象未来推出基于UiT的原生全模态图像生成模型

HiDream-O1-Image-Pro是智象未来推出的基于UiT架构的原生全模态图像生成模型,支持文生图、高保真文字渲染与图像编辑等能力,具备超200B参数规模与多模态统一...

Composer 2.5 – Cursor推出的AI Agent编程与代码重构模型

Composer 2.5是Cursor推出的AI Agent编程模型,支持长上下文代码生成、多文件重构、终端命令执行与自动化测试,适用于AI辅助开发、代码审查、DevOps部署与大...

Xiaomi OneVL – 小米推出的自动驾驶潜空间推理多模态模型

Xiaomi OneVL是小米推出的自动驾驶多模态推理模型,支持视觉语言动作协同、潜空间推理、世界模型预测与车端实时规划,适用于辅助驾驶、机器人控制、轨迹预测...

MiniCPM-V 4.6 – OpenBMB推出的端侧多模态视觉理解模型

MiniCPM-V 4.6是OpenBMB推出的端侧多模态模型,支持图像理解、视频分析与移动端本地部署,兼容iOS、Android和HarmonyOS。模型支持GGUF量化与llama.cpp部署,...

StepAudio 2.5 Realtime – 阶跃星辰推出的实时语音交互与AI语音模型

StepAudio 2.5 Realtime 是阶跃星辰推出的实时语音AI模型,支持实时语音对话、语音转文字、AI语音识别、副语言理解与多角色语音生成,适用于AI语音助手、会议...

文心 5.1 – 百度推出的多模态大语言模型与智能体平台

文心 5.1是百度发布的新一代多模态大语言模型,支持AI搜索、智能体任务执行、长文本理解、代码生成与API调用,适用于企业知识库、AI办公、内容创作与自动化场...
1 16 17 18 19 20 32