AI模型
汇集最全的AI模型资源,包括通用大模型、垂直领域模型及实用工具,提供使用教程、测评与更新动态,让你快速掌握AI模型应用。
Gemini 3.8 – 谷歌推出的旗舰推理与编码模型
Gemini 3.8是一款由谷歌于2026年9月推出的旗舰推理与编码模型系列,主要用于长程软件工程自动化与多步推理任务,支持仓库级代码改写与漏洞自动修复,适用于开...
Claude Mythos 5.1 – Anthropic推出的网络安全与生命科学特化大模型
Claude Mythos 5.1是一款由 Anthropic 于 2026 年 9 月推出的面向网络安全与生命科学的可信访问特化大模型,与 Claude Fable 5.1 基于同一底层模型,差异在安...
Claude Fable 5.1 – Anthropic推出的智能体编程与科研推理大语言模型
Claude Fable 5.1是一款由 Anthropic 于 2026 年 9 月推出的通用旗舰大语言模型,与同日发布的 Claude Mythos 5.1 基于同一底层模型,差异仅在安全防护等级:...
Muse Voice Transcribe – Meta推出的实时音频感知与流式语音转写模型
Muse Voice Transcribe是一款由 Meta 超级智能实验室于 2026 年 9 月推出的实时音频感知模型,在同一流程中整合流式语音识别、说话人分离与端点检测,可在 20...
Atlas – World Labs推出的空间智能多模态世界模型
Atlas是一款由李飞飞创立的 World Labs 于 2026 年 9 月推出的面向空间智能的多模态世界模型,采用多模态自回归扩散 Transformer 架构,把文本、图像、相机位...
FireRedAudio – 小红书FireRed团队推出的通用音频语言模型
FireRedAudio是一款由小红书 FireRed 团队于 2026 年 8 月推出的通用音频语言模型,基于 Qwen3.5 架构、参数量 9B,用解耦连续表征把音频理解与生成统一进同...
WeMM-Embedding – 腾讯开源的通用多模态Embedding模型
WeMM-Embedding是一款由腾讯微信视觉团队于 2026 年 8 月推出的通用多模态 Embedding 检索与表示模型,基于 Qwen3.5 训练,把文本、图像、视频与视觉文档统一...
Zing-0.5 – Loopit推出的实时交互视频世界模型
Zing-0.5是一款由 Loopit(涌跃智能)于 2026 年 8 月推出的实时交互视频世界模型。它基于 Wan2.2-TI2V-5B 训练,参数规模 5B,以 Apache 2.0 协议开放代码与...
Ling-3.0-flash-Fin – 蚂蚁百灵推出的金融增强模型
Ling-3.0-flash-Fin是一款由蚂蚁百灵于 2026 年 8 月推出的金融增强大模型。它延续 Ling-3.0-flash 的 124B 总参数 / 5.1B 激活参数 MoE 架构,在通用底座上...
Gemini Omni 1.1 Flash – 谷歌推出的4K AI视频生成模型
Gemini Omni 1.1 Flash是一款由谷歌于2026年8月推出的AI 视频生成模型,主要用于从文本、图像或已有视频生成与连续编辑高分辨率视频,支持场景扩展、首尾帧指...

浙公网安备33010202004812号