AI工具

FramePackLoop

FramePackLoop 是基于 FramePack 推出的无限循环视频生成工具。工具通过创建主视频和连接视频,将视频组合成循环视频,适用视频背景、图标等场景。
阅读原文

MiniCPM-V 4.5

MiniCPM-V 4.5是面壁智能推出的端侧多模态模型,拥有8B参数。模型在图片、视频、OCR等多个领域表现卓越,尤其在高刷视频理解方面取得突破,能处理高刷新率视...
阅读原文

Waver 1.0

Waver 1.0 是字节跳动推出的新一代视频生成模型,基于修正流 Transformer 架构,支持文本到视频(T2V)、图像到视频(I2V)和文本到图像(T2I)生成,可在单...
阅读原文

Claude for Chrome

Claude for Chrome是Anthropic推出的浏览器智能体扩展程序,目前处于研究预览阶段。支持用户在Chrome浏览器中与Claude进行交互,通过侧边栏窗口与用户聊天,...
阅读原文

Youtu-agent

Youtu-agent 是腾讯优图实验室推出的开源智能体框架,用在构建、运行和评估自主智能体。框架基于开源模型DeepSeek-V3实现领先性能,支持多种模型 API 和工具...
阅读原文

Tunee

Tunee是新一代AI音乐智能体,能帮助用户轻松创作音乐,通过文字、图片、音频等方式与Tunee交流创作想法,Tunee像专业音乐制作人一样理解并提供帮助,包括作曲...
阅读原文

Wan2.2-S2V

Wan2.2-S2V 是开源的多模态视频生成模型,仅需一张静态图片和一段音频,能生成电影级数字人视频,视频时长可达分钟级,且支持多种图片类型和画幅。
阅读原文

Colorify AI

Colorify AI 是基于人工智能的图像上色工具,能将黑白照片转换为彩色照片,也可以将文本或照片快速转换为高质量的涂色页。用户只需上传黑白照片或输入简单的...
阅读原文

Gemini 2.5 Flash Image

Gemini 2.5 Flash Image(代号nano banana)是谷歌 AI Studio推出的先进图像生成与编辑模型。模型能保持角色在不同场景中的一致性,支持通过自然语言进行精准...
阅读原文

Emergent

Emergent 是强大的 AI 编程工具,能通过一句话生成全栈生产级应用,涵盖前端、后端、数据库、认证、支付集成等,并直接输出 iOS 和 Android 应用包。
阅读原文

SpatialLM 1.5

SpatialLM 1.5 是群核科技推出的强大的空间语言模型。模型基于大语言模型训练,能理解自然语言指令,输出包含空间结构、物体关系和物理参数的空间语言。用户...
阅读原文

WhisperLiveKit

WhisperLiveKit 是开源的实时语音识别工具,能将语音实时转录为文字,支持说话人识别。工具基于先进的技术如 SimulStreaming 和 WhisperStreaming,提供超低...
阅读原文

VibePPT

VibePPT 是 AI 演示文稿制作工具,通过对话式交互,让用户能快速生成具有专业设计感的演示文稿。用户只需输入主题或内容,VibePPT能智能生成幻灯片,提供多种...
阅读原文

XBai o4

XBai o4是开源的大语言模型,基于“反射生成形式”训练,结合长CoT强化学习和过程奖励学习,在复杂推理能力上表现出色,中等模式下已超越OpenAI-o3-mini。

VibeVoice

VibeVoice 是微软推出的新型文本到语音(TTS)模型,能生成富有表现力、长篇幅、多说话者的对话式音频,如播客。
阅读原文
11415161718273