最新AI
向尾 – 阿里云推出的AI互动故事创作与阅读平台
向尾是阿里云推出的AI互动故事创作与阅读平台,支持AI小说生成、剧情续写、多结局互动阅读和故事分支设计。本文详细介绍向尾功能、向尾怎么用、向尾适合人群...
Confucius4-TTS – 网易有道推出的多语言语音克隆与语音合成模型
Confucius4-TTS是网易有道开源的语音合成模型,支持文本转语音、零样本语音克隆、跨语言语音生成和情感韵律迁移。模型支持14种语言,可用于数字人配音、有声...
豆包音频生成模型1.0 – 火山引擎推出的端到端音频创作模型
豆包音频生成模型1.0是火山引擎Seed团队推出的音频创作模型,支持文本和参考音频输入,可生成对白、音效和环境声等完整音频内容,具备长时音色一致性、零样本...
Claude Tag – Anthropic推出的Slack团队协作与企业AI Agent
Claude Tag 是 Anthropic 推出的企业级 AI Agent,深度集成 Slack 工作区,支持团队共享记忆、任务执行、知识检索和工作流自动化。适用于企业协作、项目管理...
Qwen-AgentWorld – 阿里巴巴千问团队推出的智能体世界模型
Qwen-AgentWorld是阿里巴巴千问团队发布的智能体世界模型,面向AI Agent训练、环境模拟、强化学习和智能体评测场景。支持256K上下文、多环境交互、MCP工具调...
Baichuan-M4 – 百川智能推出的临床级医疗大模型
Baichuan-M4是百川智能联合清华大学THUBPM团队研发的临床级医疗大模型,支持医疗推理、循证医学检索、长期患者管理、多模态医疗理解和智能问诊。模型面向辅助...
Rodin Gen-2.5 – 影眸科技推出的AI 3D模型
Rodin Gen-2.5是一款由影眸科技推出的AI 3D模型,支持文本生成3D模型与图片生成3D模型,自动完成Mesh构建、纹理生成与拓扑优化,适用于游戏资产制作、数字人...
豆包2.1 – 字节跳动推出的智能体与代码工程大模型
豆包2.1是字节跳动Seed团队推出的新一代智能体大模型,支持代码工程、多模态理解、长上下文推理与智能体任务执行。模型提供Pro和Turbo版本,适用于软件开发、...
Seedance 2.5 – 字节跳动推出的长视频生成与多模态视频创作模型
Seedance 2.5 是字节跳动推出的新一代AI视频生成模型,支持最长30秒原生视频生成、50个全模态参考素材输入和局部视频编辑能力,适用于广告制作、影视预演、工...
Unlimited-OCR – 百度开源的端到端长文档OCR模型
Unlimited-OCR是百度开源的端到端长文档OCR模型,采用R-SWA注意力机制和3B参数MoE架构,支持40页以上PDF单次解析、表格识别、公式提取和复杂版面理解,在Omni...
浙公网安备33010202004812号