分类目录介绍:
精选最新、最前沿的行业视频,深入探索AI技术在各领域的最新应用与未来发展趋势。内容涵盖核心技术、市场机遇,为行业决策者、研究人员和技术爱好者提供一手研究资料与行业洞察。
内容持续更新中
Adobe Research与西北大学联合开发出一项突破性的AI系统Sketch2Sound,该技术能将简单的人声模仿和文字描述转化为专业级音效,有望彻底改变声音设计行业的工作方式。 该系统会分析语音…
在最近的更新中,AI创意工具 Krea AI 宣布在Krea Editor推出了令人兴奋的新功能 —— 自定义训练。 据官方介绍,该功能可以在在几秒钟内将真实产品添加到任何图像中,就像变魔术…
Krea AI宣布在其编辑器平台Krea Editor推出自定义培训功能,让用户能够在几秒钟内将真实产品无缝添加到任何图像中。这一新功能的发布,将为电商商家、营销人员和内容创作者带来更高效的视觉内容制…
近日,备受瞩目的Genesis Project正式发布,这款全新的生成式物理引擎旨在以最高的真实感模拟整个物理世界,为虚拟领域带来前所未有的沉浸式体验。 核心亮点:速度惊人,效率卓越 Genesis …
Domo AI近日发布了v2v 5. 0 测试版,其中最引人注目的新功能是推出了一个v2v真实模型。该模型可以实现视频的反向操作,即可以将动漫类型的视频转换为真人视频,给用户带来了前所未有的视觉体验。…
OpenAI 近日推出了其 API 的全新版本 o1模型,命名为 “o1-2024-12-17”,此版本带来了多个激动人心的新功能,包括智能函数调用、支持 JSON 格式的结构化输出以及图像分析能力。…
机器人公司宇树科技(Unitree)近日宣布,将全面开源其机器人训练的源代码,这一举措在业界引发广泛关注。此次开源内容包括强化学习(RL)训练代码,以及从模拟到模拟(Sim-to-Sim)和从模拟到现…
谷歌发布了一款名为Whisk的新AI工具,它颠覆了传统的图像生成模式,允许用户使用图片作为提示词,而非冗长的文字描述。 通过Whisk,你可以上传图片来指定AI生成图像的主题、场景和风格,并且可以为这…
Pika近日推出了其最新的AI视频生成工具——Pika2.0,宣称这是一次重大更新,承诺为用户提供更多的控制权和可定制性。作为AI视频生成领域的早期领导者之一,Pika自推出Pika1.5后,已获得了…
各位“冲浪达人”们,还记得那些年我们追过的表情包吗?从“地铁老人看手机”到“金馆长熊猫头”,它们不仅承包了我们的笑点,也成为了一种独特的网络文化符号。如今,短视频风靡全球,表情包也“与时俱进”,从静态…
OpenAI 在本周四宣布,其为 ChatGPT 开发的类人对话功能"高级语音模式"已实现视觉化。订阅 ChatGPT Plus、Team 或 Pro 的用户现在可以通过手机摄像头…
在为期12天的"ship-mas"产品发布系列中,OpenAI正式推出了备受期待的Sora视频生成AI模型。这款创新技术现已在Sora.com上线,面向美国及大多数国家的ChatG…
Runway Act One的最新更新为视频制作带来了革命性的变化。现在,你可以将自己的表演和声音直接“套用”到其他视频中的角色身上,实现动作和声音的完美同步。 想象一下,你在手机上随意拍摄的表演,可…
随着科技的不断进步,视频修复和增强技术正变得越来越先进。最近,一款名为VISION XL的视频修复和超分辨率工具以其卓越的性能和易用性脱颖而出。这款工具不仅能够修复视频中的缺失部分,去除因拍摄不稳定导…
Fish Audio最近丢出了一枚重磅炸弹——Fish Speech1.5,这款全新的语音合成模型简直是“声”临其境,不仅在准确性、稳定性和跨语言能力上狂甩前辈几条街,还一口气新增了五种语言支持!此外…
Google DeepMind近期发布的Genie2,正以其惊人的世界生成能力,重新定义了AI训练和交互的可能性。 Genie2是一个革命性的基础世界模型,能够通过自然语言指令,实时生成高度多样化且逻…
近日,人工智能领域的领先公司ElevenLabs宣布推出其全新对话式AI平台,使开发者能够在几分钟内构建高效、流畅的智能语音代理。该平台不仅具备低延迟、高可配置性和强大的可扩展性,还为用户提供了极大的…
Hailuo AI近日推出的I2V-01-Live功能,正在重新定义数字艺术的可能性。这项突破性技术能够将静态二维插画瞬间转变为栩栩如生的动态影像。 传统的插画一直被局限在静态展示,而现在,这些原本静…
腾讯正式推出其最新视频生成大模型——混元视频生成模型,并全面开源,为人工智能视频创作领域带来重大突破。这款模型拥有130亿参数,目前被誉为最大的开源视频生成模型。 腾讯混元视频生成模型展现出四大核心优…
Luma Labs 推出两款全新图像生成模型:Luma Photon 和 Photon Flash,为用户带来前所未有的视觉生成体验。这两款模型基于全新架构,生成高质量图像的速度比市场上其他模型快10…
还记得掀起人工智能热潮的“AI女神”李飞飞吗?她带着她的第一个创业项目强势回归了!这一次,她要颠覆的是3D 世界。你只需要提供一张图片,甚至一句话,就能创造出一个栩栩如生的3D 场景,而且你还能实时与…
网购时,你是不是也被买家秀和卖家秀的巨大差异伤到过?明明是同一件衣服,穿在模特身上时尚感爆棚,怎么到自己身上就变得“惨不忍睹”?别担心!德国比勒费尔德大学的机器学习团队开发了一项名为 TryOffDi…
还记得我们被虚拟主播支配的恐惧吗?之前市面上的虚拟主播不是动作僵硬就是表情呆滞,仿佛一个只会念稿的机器人,让人忍不住想问:这年头,连虚拟人都不能有点“人味儿”吗? 现在,这个问题解决了!中国科学院和腾…
Rhymes AI近日发布了其革命性文本-图像到视频生成模型Allegro-TI2V,这一突破性技术为数字内容创作开辟了全新的疆界。作为生成式AI的最新进展,Allegro-TI2V为创意工作者提供了…
就在刚刚,智谱AI再次上演了一出大戏!短短一个月内,他们不仅升级了AutoGLM,还一口气推出了浏览器版AutoGLM-Web和电脑版GLM-PC,简直是要颠覆我们对AI的想象。 这次的升级最大亮点就…
还记得电影里那些酷炫的特效吗?物体凭空消失、场景瞬间变换,是不是让你大呼过瘾? 现在,谷歌DeepMind团队研发出了一款名为“Generative Omnimatte”的AI模型,让这些特效不再是电…
最近,360AI搜索神器"纳米搜索"悄悄登陆App Store和应用宝,直接向百度、阿里夸克等老牌搜索巨头发起正面挑战。 为什么叫纳米搜索呢?据周鸿祎的说法,是希望做AI 搜索能够…
世界,正在被重新想象! Runway的最新图像生成模型Frames,正以前所未有的方式颠覆着视觉创作的边界。这不仅仅是一个AI工具,更是一个能够帮助用户构建完整视觉世界的创意引擎。 与传统的通用图像生…