Fun-CineForge – 通义实验室开源的影视级多模态配音大模型

Fun-CineForge 是通义实验室开源的影视级多模态配音大模型,支持独白、对白和多角色场景配音,具有音画同步、情绪表达与说话人切换功能,适用于电影及短视频...

InternVL-U – 上海人工智能实验室推出的多模态大语言模型

InternVL-U 是由上海人工智能实验室发布的多模态大语言模型,支持文本与图像输入处理,具备逻辑推理、生成与编辑能力,适用于科研、视觉问答及跨模态任务。

Kairos 3.0-4B – 大晓机器人开源的具身原生世界模型

Kairos 3.0-4B 是大晓机器人开源的具身原生世界模型,支持多模态理解、长时序视频生成与跨本体机器人控制,适用于动态场景建模和机器人研究。

PixVerse R1 – 爱诗科技推出的实时多模态视频生成模型

PixVerse R1是什么 PixVerse R1 是由爱诗科技(PixVerse)推出的实时世界模型,发布于 2026 年初,定位为面向视频生成与动态场景建模的 AI模型。与传统大...

StepClaw – 阶跃星辰推出的OpenClaw云端AI助手部署与自动化工具

StepClaw是阶跃星辰基于OpenClaw框架推出的云端AI助手,支持一键部署、长期在线与自动化任务处理,适合个人及团队使用,实现内容生成、数据分析、办公效率提...

Nemotron 3 Super – 英伟达开源的大语言模型,支持长上下文与智能体推理

Nemotron 3 Super是什么 Nemotron 3 Super 是由 NVIDIA 发布于 2026 年 3 月的开源大语言模型,属于 Nemotron 3 系列 AI 模型家族的中等规模成员,旨在支...

Moltbook – Meta 推出的 AI Agent 社交实验平台与多智能体互动运行环境

Moltbook 是一个用于 AI Agent 运行与互动的实验平台,支持多智能体协作、自动化发布和 API 接入。本文介绍 Moltbook 的功能、使用方法、应用场景及是否收费...

DuClaw – 百度智能云推出的AI智能体云端自动化平台

DuClaw 是百度智能云推出的 AI 智能体云服务平台,支持多模型调用、自动化任务执行和云端托管环境,用户无需本地部署即可构建 AI 工作流。DuClaw 适合开发者...

Gemini Embedding 2 – Google DeepMind推出的多模态向量嵌入AI模型

Gemini Embedding 2 是 Google DeepMind 发布的多模态向量嵌入AI模型,支持文本、图像、音频和文档统一向量表示,适用于语义搜索、RAG系统、向量数据库、知识...

BoldVoice – AI发音训练与口音矫正工具

BoldVoice是一款AI口音训练工具,提供发音评估、个性化学习路径和真人教练视频课程,帮助非英语母语者提升英语发音清晰度和口语表达能力。
1 26 27 28 29 30 55