Gemini Embedding 2 – Google DeepMind推出的多模态向量嵌入AI模型

Gemini Embedding 2 是 Google DeepMind 发布的多模态向量嵌入AI模型,支持文本、图像、音频和文档统一向量表示,适用于语义搜索、RAG系统、向量数据库、知识...

BoldVoice – AI发音训练与口音矫正工具

BoldVoice是一款AI口音训练工具,提供发音评估、个性化学习路径和真人教练视频课程,帮助非英语母语者提升英语发音清晰度和口语表达能力。

ArkClaw – 火山引擎推出的云端AI智能助手服务

ArkClaw是火山引擎推出的云端AI智能助手平台,支持多模型切换、办公集成、文档处理及自动化任务,适合企业和个人用户实现高效在线AI Agent服务。

JVS Claw – 阿里云推出的云端多智能体任务执行平台

JVS Claw是什么 JVS Claw是由中国阿里巴巴集团旗下云计算团队推出的一款云原生AI智能体平台,旨在将AI从单纯的对话助手升级为能够执行复杂任务的云端智能“...

FireRed-Image-Edit – 小红书推出的开源AI图像编辑模型,支持高精度编辑与多模态处理

FireRed-Image-Edit 是小红书推出的开源AI图像编辑模型,基于扩散Transformer架构,支持多模态输入、高精度图像编辑、人物一致性保持和文本修改能力,适用于...

GPT-5.4 – OpenAI推出的专业级AI模型,支持百万上下文与任务自动化能力

GPT-5.4是OpenAI发布的专业级大语言模型,支持约100万Token上下文、多模态输入及API调用,在推理能力、编程能力与自动化任务执行方面表现稳定,适用于内容生...

HiClaw – Higress推出的开源多Agent团队协作系统

HiClaw 是由 Higress 社区推出的开源 AI 多 Agent 协作系统,具备自然语言驱动的任务拆解、Manager‑Worker 协同、安全凭证隔离和可视化交互等核心能力,适合...

Phi-4-reasoning-vision-15B – 微软推出的多模态推理视觉模型,支持GUI理解与数学推理

Phi-4-reasoning-vision-15B 是微软发布的150亿参数多模态推理模型,支持视觉理解、数学推理、GUI界面识别和文档解析,适合本地部署与自动化代理开发,属于Ph...

Kimi总结100页PDF教程:快速提取论文和报告重点 (附提示词模板)

本文深度教你如何利用Kimi总结100页PDF文档。涵盖AI阅读论文、提取行业报告数据及跨境电商越南市场周报实操。包含3个高阶提示词模板,助你高效完成AI总结研究...

MiniMax Music 2.5+ – MiniMax推出的多风格AI音乐生成模型,支持纯音乐创作与跨风格融合

MiniMax Music 2.5+是一款由MiniMax推出的AI音乐生成模型,支持古典管弦、电子、氛围音等多风格创作,可应用于游戏、影视、广告、冥想等场景,提供高保真纯音...
1 27 28 29 30 31 56