AI模型

汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。

Gemini 3.8 – 谷歌推出的旗舰推理与编码模型

Gemini 3.8是一款由谷歌于2026年9月推出的旗舰推理与编码模型系列,主要用于长程软件工程自动化与多步推理任务,支持仓库级代码改写与漏洞自动修复,适用于开...

Claude Mythos 5.1 – Anthropic推出的网络安全与生命科学特化大模型

Claude Mythos 5.1是一款由 Anthropic 于 2026 年 9 月推出的面向网络安全与生命科学的可信访问特化大模型,与 Claude Fable 5.1 基于同一底层模型,差异在安...

Claude Fable 5.1 – Anthropic推出的智能体编程与科研推理大语言模型

Claude Fable 5.1是一款由 Anthropic 于 2026 年 9 月推出的通用旗舰大语言模型,与同日发布的 Claude Mythos 5.1 基于同一底层模型,差异仅在安全防护等级:...

Muse Voice Transcribe – Meta推出的实时音频感知与流式语音转写模型

Muse Voice Transcribe是一款由 Meta 超级智能实验室于 2026 年 9 月推出的实时音频感知模型,在同一流程中整合流式语音识别、说话人分离与端点检测,可在 20...

Atlas – World Labs推出的空间智能多模态世界模型

Atlas是一款由李飞飞创立的 World Labs 于 2026 年 9 月推出的面向空间智能的多模态世界模型,采用多模态自回归扩散 Transformer 架构,把文本、图像、相机位...

FireRedAudio – 小红书FireRed团队推出的通用音频语言模型

FireRedAudio是一款由小红书 FireRed 团队于 2026 年 8 月推出的通用音频语言模型,基于 Qwen3.5 架构、参数量 9B,用解耦连续表征把音频理解与生成统一进同...

WeMM-Embedding – 腾讯开源的通用多模态Embedding模型

WeMM-Embedding是一款由腾讯微信视觉团队于 2026 年 8 月推出的通用多模态 Embedding 检索与表示模型,基于 Qwen3.5 训练,把文本、图像、视频与视觉文档统一...

Zing-0.5 – Loopit推出的实时交互视频世界模型

Zing-0.5是一款由 Loopit(涌跃智能)于 2026 年 8 月推出的实时交互视频世界模型。它基于 Wan2.2-TI2V-5B 训练,参数规模 5B,以 Apache 2.0 协议开放代码与...

Ling-3.0-flash-Fin – 蚂蚁百灵推出的金融增强模型

Ling-3.0-flash-Fin是一款由蚂蚁百灵于 2026 年 8 月推出的金融增强大模型。它延续 Ling-3.0-flash 的 124B 总参数 / 5.1B 激活参数 MoE 架构,在通用底座上...

Gemini Omni 1.1 Flash – 谷歌推出的4K AI视频生成模型

Gemini Omni 1.1 Flash是一款由谷歌于2026年8月推出的AI 视频生成模型,主要用于从文本、图像或已有视频生成与连续编辑高分辨率视频,支持场景扩展、首尾帧指...
1 2 3 4 5 32