Nano Bananary
Nano Bananary(香蕉超市) 是开源的图像编辑工具,基于 Google Gemini 图像模型开发,支持中文界面和明暗主题切换,提供 50 多种图像转换效果,无需复杂提示...
数说Social Research
数说Social Research 是数说故事旗下的全能营销 Agent 工具,依托领先大模型技术,接入海量社交媒体数据,能快速解答营销、市场、消费者口碑等专业问题并生成...
Bilibili发布IndexTTS2语音模型:情感与时长可控的语音合成技术突破!
今天要聊的主角是——Bilibili的IndexTTS2语音模型。作为一款专为语音合成设计的AI工具,IndexTTS2自2025年发布以来,已经迅速吸引了大量关注,特别是在情感控...
蚂蚁集团在2025Inclusion·外滩大会上正式发布全球首个智能眼镜可信连接技术框架— gPass
如今,AI眼镜被不少人看作是下一代智能终端的潜力股,市场潜力肉眼可见。但仔细观察就会发现,这个行业还处在起步阶段,面临着不少让人头疼的问题。清华大学...
跨境支付难题:塔塔支付科技如何赋能亚洲数字商务新生态
引言:亚洲支付市场的黄金时代 2025年,亚洲数字支付市场正经历着前所未有的变革浪潮。印度数字支付市场预计到2030年将达到9580亿美元,年复合增长率高达18.5...
豆包4.0美化精修实测:6 大日常玩法,新手也能轻松出质感图
我是小陶。一个专注AI学习成长、致力于用AI工具提升效率的自媒体人。最近,豆包推出了新一代的图像创作模型【Seedream 4.0】。小陶也分享豆包4.0在“单图图生...
真卷啊!据传Claude 4.5和Gemini 3.0即将发布
小红书发布FireRedTTS-2,助力AI播客制作简介:小红书智创音频团队推出FireRedTTS-2,一款先进的对话合成模型,显著提升语音合成的自然度和真实感。它支持音...
开源进阶版Nano Banana UI,支持局部涂选、连续编辑,比官方更好用。
Nano Banana最近大家应该都玩的很溜了,搞来搞去就那些玩法,可能新鲜感也弱了些。AI大部分的新东西都有这个特点,刚出来的时候大家都感觉很有趣,跟风去玩,...
InfiniteTalk
InfiniteTalk是美团视觉智能部推出的新型数字人驱动技术,通过稀疏帧video dubbing范式,仅需少量关键帧能驱动数字人人生成自然流畅的视频,解决传统技术中口...
清华炸场!AI 大模型天梯榜来了,选模型不再头秃。
周六在杭州有一个 GOSIM 大会。这个大会上,清华大学联合中软评测中心发布了《2025 大模型服务性能排行榜》。这个排行榜挺有意思的,它不是对比各个 AI 大模...
GPT-5-Codex 发布,可以7小时连续编程,但OpenAI 封杀了API。。
凌晨一点,OpenAI 发布了 GPT-5-Codex,但这次,所有想调用 API 的开发者可能要失望了。OpenAI 做了一个决定:Codex 并不通过 API 开放。你不能靠 key 来偷偷...
Lumina-DiMOO
Lumina-DiMOO是上海人工智能实验室等机构开源的新一代多模态生成与理解模型。模型采用全离散扩散架构,统一处理文本、图像等多模态数据,支持文本到图像生成...