ASAM

ASAM(Adversarial Adjustment of Segment Anything Model)是vivo公司推出的AI图像分割模型,通过对抗性调整来增强原有SAM模型的性能。ASAM用自然对抗性示例...
阅读原文

Falcon Mamba 7B

Falcon Mamba 7B是阿联酋技术创新研究所(TII)推出的开源AI大模型,性能超越了Meta的Llama 3.1-8B等模型。Falcon Mamba 7B采用编码器-解码器结构和多头注意...
阅读原文

醒蓝AI

醒蓝AI是一款AI照片生成工具,支持一键生成AI形象照,用户能够轻松制作工作形象照、写真照、证件照和AI换脸照片。醒蓝AI还提供API接口和定制化解决方案,满足...
阅读原文

Clapper

Clapper 是一款免费开源的可视化AI视频编辑工具,由 HuggingFace 的AI前端工程师 Julian Bilcke 开发。集成多种生成式 AI 技术,用户通过交互式、迭代和直观...
阅读原文

Gemini Live

Gemini Live是谷歌推出的智能语音助手,具有自然语言理解和多模态识别能力,支持图像、视频和语音交互。用户可通过语音指令控制,实现日常任务自动化。Gemini...
阅读原文

UniTalker

UniTalker是推出的音频驱动3D面部动画生成模型,能根据输入的音频生成逼真的面部动作。采用统一的多头架构模型,用带有不同标注的数据集,支持多语言和多种音...
阅读原文

Pixel Studio

Pixel Studio是谷歌推出的一款AI图像生成应用,专为Pixel 9系列手机预装设计。Pixel Studio基于Imagen 3模型,擅长快速生成艺术风格图片,仅需2秒即可创作出...
阅读原文

Mureka

Mureka是昆仑万维推出的 AI 音乐商用创作平台,让专业艺术家和音乐爱好者能在平台上创作个性化音乐。用户在Mureka页面输入歌词,添加参考音乐,用Style功能控...
阅读原文

Grok-2

Grok-2是xAI公司推出的新一代AI模型,提供卓越的聊天、编程和推理能力。在学术基准测试中,Grok-2在GPQA、MMLU、MMLU-Pro和MATH等领域的表现超越了前代Grok-1...
阅读原文

Melodio

Melodio是昆仑万维推出的全球首款AI流媒体音乐APP,根据用户输入的提示实时生成个性化音乐。支持中文等多种语言,提供无限流式播放,用户可以随时修改提示,...
阅读原文

MagicPose

MagicPose是南加州大学和字节跳动联合研发的AI视频生成模型,无需任何微调,直接生成逼真的人类动作和面部表情视频。MagicPose通过一个新颖的两阶段训练策略...
阅读原文

Agent Q

Agent Q是MultiOn公司联合斯坦福大学推出的自监督代理推理和搜索框架。Agent Q融合了引导式蒙特卡洛树搜索(MCTS)、AI自我批评和直接偏好优化(DPO)等技术...
阅读原文

有道小P

有道小P是网易有道推出的AI全科学习助手,专为K12阶段的学生设计。有道小P搭载了有道子曰教育大模型,能覆盖全学段和全学科的答疑需求,提供个性化的学习辅导...
阅读原文

晓象

晓象是光启慧语推出的AI克隆产品,基于自研可信大模型,创建各领域知识博主的AI分身。模拟知识博主的声音、风格和表达方式,生成个性化的内容。
阅读原文

Mo卡片

Mo卡片是一站式AI知识库卡片式学习工具。Mo卡片以卡片形式提供1500+张专业AI知识卡片,涵盖理论、实操、特别篇等主题。用户通过图文、动画、视频、语音等互动...
阅读原文