速递|将2D照片转化为3D视频,新模型能否解决Stability AI商业困境
图片来源:Stability AIStability AI 发布了一款新 AI 模型——Stable Virtual Camera,该公司宣称该模型能将 2D 图像转化为,具有真实深度和视角的“沉浸式
阅读全文图片来源:Stability AIStability AI 发布了一款新 AI 模型——Stable Virtual Camera,该公司宣称该模型能将 2D 图像转化为,具有真实深度和视角的“沉浸式
阅读全文图片来源:Nvidia通用汽车正与 Nvidia 深化合作,借助其技术将人工智能引入现实世界,这一合作旨在触及汽车制造商业务的方方面面,包括工厂、机器人和自动驾驶汽车。Nvidia 创始人兼首席执行官
阅读全文最近在推特上刷到一条视频,特别火爆,彻底把我看呆了。请看视频效果——Prompt: 在 blender 中创建一个龙站在一堆金币旁边的场景。确保照明活泼有趣,整体效果精致。使用适当的材质,使最终渲染效
阅读全文老黄会前穿着“外卖”围裙送汉堡(图片来源:视频截图)老黄再度带领 AI 芯片等新品“炸场”。北京时间3月19日凌晨,“AI超级碗”GTC大会上,英伟达创始人兼CEO黄仁勋向全球推出最强AI芯片GB30
阅读全文💥英伟达发布多款「核弹级」产品📈小米公布史上最强年度财报🎊机构:Switch 2 首年销量或达 1500 万台📺xAI 收购 AI 视频创企,剑指 OpenAI 的 Sora🔥OpenAI o1 /
阅读全文Google进入了"疯狂发货"模式。刚刚官方推特账号@GeminiApp又宣布了一个重磅功能——Canvas,让不少人直呼"真香"!Canvas功能可以说是给Gemini效率提升了10倍。实时预览功能
阅读全文点击👇🏻可关注,文章来自🙋♂️ 想加入社群的朋友,可看文末方法,进群交流。“ API Agents 和 GUI Agents 像是 AI 领域的“双子星”,它们正在改变我们对软件自动化的认知。想知道
阅读全文点击👇🏻可关注,文章来自🙋♂️ 想加入社群的朋友,可看文末方法,进群交流。“ 在电影制作领域,自动化电影生成一直是个极具吸引力但又充满挑战的方向。传统电影制作不仅耗时耗力,还需要大量专业人员的协作。
阅读全文大模型(LLMs)微调问答集领域模型训练策略Q8: 领域数据训练后,通用能力往往会有所下降,如何缓解模型遗忘通用能力?问题动机:仅使用领域数据集进行模型训练,模型很容易出现灾难性遗忘现象解决方法:在领
阅读全文打造一个有温度、有趣味、专业的全栈式AI&AIGC交流社区,用心写好每一篇文章!项目主页-https://jianhongbai.github.io/ReCamMaster/代码链接-https://
阅读全文新智元报道 编辑:编辑部 HNYZ【新智元导读】万众瞩目的Blackwell Ultra终于登场亮相,专为DeepSeek R1这样的推理模型打造,性能直达Hoper的40倍!而下一代GPU「R
阅读全文新智元报道 编辑:KingHZ 定慧【新智元导读】在美国,媒体调查称近40%中学生、近50%大学生用AI作弊拿高分。ChatGPT已成为美国学生的「作弊黑科技」,从作业到论文,无所不包,而且难以
阅读全文新智元报道 编辑:LRST【新智元导读】通过收集六名志愿者一周的多模态生活数据,研究人员构建了300小时的第一视角数据集EgoLife,旨在开发一款基于智能眼镜的AI生活助手。项目提出了EgoB
阅读全文作者|王兆洋,Jessica,周一笑图|王兆洋科技界泰勒·斯威夫特、Token经济学鼓吹者、摩尔定律的新希望和新晋“英伟达首席财务摧毁官”黄仁勋,刚刚完成了他年度最重要演讲。“人们说我的GTC演讲就像
阅读全文今年GTC大会期间,有一个无人能忽视的热门话题——开源。开源的影响力从未如此强大,此刻,它已成为推动整个AI发展进程的最关键因素。你甚至可以这样说:"AGI is just another open
阅读全文文章转载于新智元随着华人大佬执掌英特尔之后,一场大刀阔斧的改革呼之欲出。路透独家报道称,新任CEO陈立武计划全面改革「制造和AI」业务,试图带领英特尔重回时代巅峰。在上周的全员大会上,他直言不讳地告诉
阅读全文金磊 一水 发自 凹非寺量子位 | 公众号 QbitAI皮衣老黄,带着最强AI芯片GB300闪亮登场“AI超级碗”GTC,燃爆全场!性能方面,和去年发布的GB200相比,推理性能是其1.5倍。据悉,G
阅读全文lmm-r1团队 投稿量子位 | 公众号 QbitAI多模态大模型虽然在视觉理解方面表现出色,但在需要深度数学推理的任务上往往力不从心,尤其是对于参数量较小的模型来说更是如此。如何让小型多模态大模型也
阅读全文Shark 投稿量子位 | 公众号 QbitAI从自动驾驶、机器人导航,到AR/VR等前沿应用,SLAM都是离不开的核心技术之一。现有基于3D高斯分布(3DGS)的SLAM方法虽在室内场景表现出色,但
阅读全文DeepSeek 发自 凹非寺量子位 | 公众号 QbitAI未来同事,你好~这是一则招聘帖。量子位是一个关注AI及前沿科技的新媒体平台,我们着迷于全新技术和趋势带来的改变,并正致力于帮助更多人第一时
阅读全文英伟达 GTC 大会已经成了 AI 界超级碗,没有剧本也没有提词器,中途黄仁勋被线缆卡住,反而是这场高浓度 AI 发布会里最有人味的片段,在当今提前基本提前彩排或录播的科技发布会里已经很稀缺了。刚刚,
阅读全文谷歌最新发布的 Gemini 2.0 Flash 模型最近被玩“疯”了。主要是其 原生生图 这个功能。什么意思?一般来说,AI 模型中,文本生成模型,如 GPT-4o,DeepSeek-V3,和图像生
阅读全文作者|褚杏娟、冬梅 北京时间 3 月 19 日凌晨 1:00 大洋彼岸的美国加利福尼亚州圣何塞会议中心灯火通明,人声鼎沸。全球科技界瞩目的年度盛会——英伟达 GTC 2025 大会在这里盛大开幕。作
阅读全文作者 | 石士 概览 随着大模型时代的到来,搜推广模型是否具备新的进化空间?能否像深度学习时期那样迸发出旺盛的迭代生命力?带着这样的期待,阿里妈妈搜索广告在过去两年的持续探索中,逐步厘清了一些关键问
阅读全文机器之心报道机器之心编辑部Token is the new frontier.「因为 AI 技术爆发,GTC 大会的规模每年都在扩大,以前人们说 GTC 是 AI 的伍德斯托克音乐节,今年我们搬进了体
阅读全文选自simonwillison.net作者:Simon Willison机器之心编辑部近段时间,著名 AI 科学家 Andrej Karpathy 提出的氛围编程(vibe coding)是 AI 领
阅读全文本文的作者均来自新加坡国立大学 LinS Lab。本文第一作者为新加坡国立大学博士生高崇凯,其余作者为北京大学实习生张浩卓,新加坡国立大学博士生徐志轩,新加坡国立大学硕士生蔡哲豪。本文的通讯作者为新加
阅读全文LightGen 主要作者来自香港科技大学和 Everlyn AI, 第一作者为香港科技大学准博士生吴显峰,主要研究方向为生成式人工智能和 AI4Science。通讯作者为香港科技大学助理教授 Har
阅读全文简介在本教程中,我将逐步指导如何将一个复杂的 ComfyUI 工作流转换为一个简单的 Gradio 应用程序,并讲解如何将其部署在 Hugging Face Spaces 的 ZeroGPU 无服务器
阅读全文Mainly, PPO optimization (a RLHF technique) relies on computing “advantages” associated with taking
阅读全文