Gemini Embedding 2 – Google DeepMind推出的多模态向量嵌入AI模型
Gemini Embedding 2 是 Google DeepMind 发布的多模态向量嵌入AI模型,支持文本、图像、音频和文档统一向量表示,适用于语义搜索、RAG系统、向量数据库、知识...
BoldVoice – AI发音训练与口音矫正工具
BoldVoice是一款AI口音训练工具,提供发音评估、个性化学习路径和真人教练视频课程,帮助非英语母语者提升英语发音清晰度和口语表达能力。
ArkClaw – 火山引擎推出的云端AI智能助手服务
ArkClaw是火山引擎推出的云端AI智能助手平台,支持多模型切换、办公集成、文档处理及自动化任务,适合企业和个人用户实现高效在线AI Agent服务。
JVS Claw – 阿里云推出的云端多智能体任务执行平台
JVS Claw是什么 JVS Claw是由中国阿里巴巴集团旗下云计算团队推出的一款云原生AI智能体平台,旨在将AI从单纯的对话助手升级为能够执行复杂任务的云端智能“...
FireRed-Image-Edit – 小红书推出的开源AI图像编辑模型,支持高精度编辑与多模态处理
FireRed-Image-Edit 是小红书推出的开源AI图像编辑模型,基于扩散Transformer架构,支持多模态输入、高精度图像编辑、人物一致性保持和文本修改能力,适用于...
GPT-5.4 – OpenAI推出的专业级AI模型,支持百万上下文与任务自动化能力
GPT-5.4是OpenAI发布的专业级大语言模型,支持约100万Token上下文、多模态输入及API调用,在推理能力、编程能力与自动化任务执行方面表现稳定,适用于内容生...
HiClaw – Higress推出的开源多Agent团队协作系统
HiClaw 是由 Higress 社区推出的开源 AI 多 Agent 协作系统,具备自然语言驱动的任务拆解、Manager‑Worker 协同、安全凭证隔离和可视化交互等核心能力,适合...
Phi-4-reasoning-vision-15B – 微软推出的多模态推理视觉模型,支持GUI理解与数学推理
Phi-4-reasoning-vision-15B 是微软发布的150亿参数多模态推理模型,支持视觉理解、数学推理、GUI界面识别和文档解析,适合本地部署与自动化代理开发,属于Ph...
Kimi总结100页PDF教程:快速提取论文和报告重点 (附提示词模板)
本文深度教你如何利用Kimi总结100页PDF文档。涵盖AI阅读论文、提取行业报告数据及跨境电商越南市场周报实操。包含3个高阶提示词模板,助你高效完成AI总结研究...
MiniMax Music 2.5+ – MiniMax推出的多风格AI音乐生成模型,支持纯音乐创作与跨风格融合
MiniMax Music 2.5+是一款由MiniMax推出的AI音乐生成模型,支持古典管弦、电子、氛围音等多风格创作,可应用于游戏、影视、广告、冥想等场景,提供高保真纯音...

浙公网安备33010202004812号