全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

    作者:机器之心发布日期:2025-05-27 12:11:06

    机器之心报道编辑:Panda大模型越来越聪明,企业却似乎越来越焦虑了。模型性能突飞猛进,从写文案到搭智能体(Agent),AI 掌握的技能也越来越多。但一到真正上线部署,问题就来了:为什么推理成本越来

    阅读全文
  • 文章封面

    One RL to See Them All?一个强化学习统一视觉-语言任务!

    作者:机器之心发布日期:2025-05-27 12:11:06

    机器之心报道编辑:+0、Panda强化学习 (RL) 显著提升了视觉-语言模型 (VLM) 的推理能力。然而,RL 在推理任务之外的应用,尤其是在目标检测 和目标定位等感知密集型任务中的应用,仍有待深

    阅读全文
  • 文章封面

    让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力

    作者:机器之心发布日期:2025-05-27 12:11:06

    在大型推理模型(例如 OpenAI-o3)中,一个关键的发展趋势是让模型具备原生的智能体能力。具体来说,就是让模型能够调用外部工具(如网页浏览器)进行搜索,或编写/执行代码以操控图像,从而实现「图像中

    阅读全文
  • 文章封面

    北大团队发布首篇大语言模型心理测量学系统综述:评估、验证、增强

    作者:机器之心发布日期:2025-05-27 12:11:06

    随着大语言模型(LLM)能力的快速迭代,传统评估方法已难以满足需求。如何科学评估 LLM 的「心智」特征,例如价值观、性格和社交智能?如何建立更全面、更可靠的 AI 评估体系?北京大学宋国杰教授团队最

    阅读全文
  • 文章封面

    百度心响上线iOS版,多智能体协作应用终于卷对地方了

    作者:量子位发布日期:2025-05-27 11:53:05

    小明 发自 凹非寺量子位 | 公众号 QbitAI今年的4月26日,我们测评了百度新发布的多智能体协作应用心响APP。当时只上线了安卓版,很多网友在线求苹果版链接。就在这几天,iOS版也终于上线了,只

    阅读全文
  • 文章封面

    Claude 4被诱导窃取个人隐私!GitHub官方MCP服务器安全漏洞曝光

    作者:量子位发布日期:2025-05-27 11:53:05

    一水 发自 凹非寺量子位 | 公众号 QbitAI被选为GitHub Copilot官方模型后,Claude 4直接被诱导出bug了!一家瑞士网络安全公司发现,GitHub官方MCP服务器正在面临新型

    阅读全文
  • 文章封面

    形式化证明与大模型:共创可验证的AI数学未来|量子位直播

    作者:量子位发布日期:2025-05-27 11:53:05

    林樾 发自 凹非寺量子位|公众号 QbitAI就在5月,前有DeepSeek Prover V2发布,后有陶哲轩的AI数学直播,还有谷歌最新发布的AlphaEvolve。大模型“解数学题”的能力已经是

    阅读全文
  • 文章封面

    低Token高精度!字节复旦推出自适应推理框架CAR

    作者:量子位发布日期:2025-05-27 11:53:05

    复旦大学余海洋 投稿量子位 | 公众号 QbitAI过度依赖CoT思维链推理会降低模型性能,有新解了!来自字节、复旦大学的研究人员提出自适应推理框架CAR,能根据模型困惑度动态选择短回答或详细的长文本

    阅读全文
  • 文章封面

    扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

    作者:量子位发布日期:2025-05-27 11:53:05

    EPIC Lab团队 投稿量子位 | 公众号 QbitAI首个用于加速扩散式大语言模型(diffusion-based Large Language Models, 简称 dLLMs)推理过程的免训练

    阅读全文
  • 文章封面

    OpenAI 大量内幕曝光!7 年「潜伏」调查扒出 AI 帝国真面目,奥特曼坐立难安公开阴阳

    作者:APPSO发布日期:2025-05-27 11:34:17

    回到 2019 年,OpenAI 还只是一个实验室、一个小作坊,Sam Altman 也 Y Combinator 里的一员,甚至还有一次创业失败的经历。那时的 OpenAI 是什么样子?前《华尔街日

    阅读全文
  • 文章封面

    速递|红杉中国进军AI测评赛道:xbench为何要“摆脱智力题”考察AI的真实效用?

    作者:Z Potentials发布日期:2025-05-27 10:37:44

    在基础模型疯狂“刷榜”的时代,传统的AI基准测试正迅速失效——各大模型纷纷取得满分,评测榜单失去了区分度与指导意义。当“考卷”不再能反映真实能力,测评本身就成了问题。因此,构建一个更加科学、长效和反映

    阅读全文
  • 文章封面

    深度|ARK Invest 木头姐:医疗领域是AI最被低估的受益者,推出新药所需的时间将从13年缩短到8年

    作者:Z Potentials发布日期:2025-05-27 10:37:44

    图片来源:Bloomberg TelevisionZ Highlights如果税率更高,人们就会选择停止工作或寻找避税的方法。创新的成本正在急剧下降。世界正在向无人机的商品化发展。医疗领域是AI最被低

    阅读全文
  • 文章封面

    速递|Meta AI人才流失危机:Llama原始论文14位作者中11人已离职,或动摇开源根基?

    作者:Z Potentials发布日期:2025-05-27 10:37:44

    图片来源:UnsplashMeta 的 AI 团队面临人才流失,多位 Llama 模型核心创作者已离职。这些离职事件引发了人们对Meta 能否留住顶尖 AI 人才的担忧。Meta 的 AI 战略正面临

    阅读全文
  • 文章封面

    速递|OpenAI亚洲布局第三站:韩国ChatGPT付费第二,继日本、新加坡后设立办事处

    作者:Z Potentials发布日期:2025-05-27 10:37:44

    图片来源:UnsplashOpenAI 已在韩国成立法律实体,旨在推动其人工智能技术的进一步普及。其在 5 月 26 日发布的声明中表示,计划未来几个月内在首尔设立办公室,并正在招聘员工以支持与企业和

    阅读全文
  • 文章封面

    对话CMU李磊:好的AI学者绝不只搞“纯学术”,大厂AI Lab请集中资源干大事

    作者:硅星人Pro发布日期:2025-05-27 10:07:33

    作者|王兆洋邮箱|wangzhaoyang@pingwest.com李磊总是出现在某股浪潮的开端。2002年,在拿下中国高校第一个ACM(计算机领域最顶尖的程序设计大赛)金牌后,上海交大设立了“ACM

    阅读全文
  • 文章封面

    AI战场,腾讯向左,阿里向右

    作者:硅星人Pro发布日期:2025-05-27 10:07:33

    文章转载于硅基研究室作者:kiki作为中国两家公开表示「追求AGI」的科技大厂,腾讯和阿里成为了「互联网大厂派」中对AI投入最激进的两个典型案例。这几天,腾讯前脚在北京开了今年的AI产业应用峰会,把主

    阅读全文
  • 文章封面

    刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿

    作者:硅星人Pro发布日期:2025-05-27 10:07:33

    文章转载于新智元OpenAI前研究员大佬、如今的Thinking Machines Lab联创Lilian Weng,刚刚转发了一个神秘产品——一个看似仪表盘的东西。或许,这就将是公司即将打造的第一个

    阅读全文
  • 文章封面

    小米辟谣玄戒 O1 为 Arm 定制芯片,雷军发声/微信语音新界面曝光/马斯克:AI 将替代传统搜索

    作者:APPSO发布日期:2025-05-27 08:44:10

    🤖小米回应玄戒芯片「自研风波」🔍马斯克:AI 将替代传统搜索🔒哪吒汽车原 CEO 被冻结 4050 万股权📲红杉中国推出智能体 基准测试「xbench」💰15 亿美元 AI 独角兽崩塌,被曝用程序员冒

    阅读全文
  • 文章封面

    MMaDA:多模态大型扩散语言模型的创新突破(万字)

    作者:觉察流发布日期:2025-05-27 08:15:00

    点击👇🏻可关注,文章来自🙋‍♂️ 想加入社群的朋友,可看文末方法,进群交流。“ MMaDA(Multimodal Large Diffusion Language Models)正以其创新的统一扩散架

    阅读全文
  • 文章封面

    DeepSeek-V3:硬件与模型的完美统协,奏响 AI 高效新乐章(万字)

    作者:觉察流发布日期:2025-05-27 08:15:00

    点击👇🏻可关注,文章来自🙋‍♂️ 想加入社群的朋友,可看文末方法,进群交流。“ DeepSeek-V3 通过硬件感知的模型协同设计,在 2048 个 NVIDIA H800 GPU 上实现了成本高效的

    阅读全文
  • 文章封面

    使用agno实现AI代理设计的五个层级,由易到难

    作者:PyTorch研习社发布日期:2025-05-27 08:00:00

    AI代理设计指南本指南将代理设计分解为五个实际难度级别,每个级别均提供可运行的代码示例。无论开发者是初学者还是处理现实世界的复杂任务,本指南都能帮助避免常见陷阱,构建真正有效的代理。这些级别包括:•级

    阅读全文
  • 文章封面

    3D生成算力暴降93% | 8卡训练1024³模型,反向求导加速9.6倍,“毛孔级精度”碾压SOTA!

    作者:AI产品汇发布日期:2025-05-27 07:45:00

    打造一个有温度、有趣味、专业的全栈式AI&AIGC交流社区,用心写好每一篇文章!项目主页-https://nju-3dv.github.io/projects/Direct3D-S2/代码链接-htt

    阅读全文
  • 文章封面

    太好用了!Roo终于出了一个我迫切想要的功能:Codebase Indexing

    作者:字节笔记本发布日期:2025-05-27 06:50:08

    大型项目搜索代码终于有救了!Roo Code新推出的 Codebase Indexing 功能,通过 AI 语义理解技术,用自然语言搜索代码,彻底解决大型项目中"找代码"的痛点。在大型项目中,很难记住

    阅读全文
  • 文章封面

    微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星

    作者:AIGC开放社区发布日期:2025-05-27 06:19:34

    微软在官网开源了一个专用于浏览器网络任务的Agent——Magentic-UI。Magentic-UI是基于微软曾经开源的 Magentic-One基础之上开发而成,并支持人机协同的控制方法来提升智能

    阅读全文
  • 文章封面

    AI 写作大乱斗!GPT-4.5、o3、Claude 4、Gemini 2.5,我替你测出了谁最强!

    作者:AI信息Gap发布日期:2025-05-27 06:00:00

    现在不是 AI 能不能写的问题,而是 —— 你选谁来写?01|开篇:AI 都能写,那我该用谁写?2025年,AI 写作不再是“能不能写”的问题,而是“哪个写得像人、像我、像爆款”。OpenAI 有最牛

    阅读全文
  • 文章封面

    99%的人都理解错了,AI Agent ≠ Agentic AI,康奈尔大学发33页论文澄清关键区别。

    作者:AI修猫Prompt发布日期:2025-05-27 02:04:59

    TL;DR:如果您有一个AI产品,用户问您这是AI Agent还是Agentic AI?如果您回答不出来,或者认为这两个概念是一回事,那您可能需要重新审视自己的技术认知了。不过没关系,因为99%的人

    阅读全文
  • 文章封面

    一键部署 MCP 到阿里百炼

    作者:二师兄说AI发布日期:2025-05-27 00:19:37

    阅读全文
  • 文章封面

    智能体与智能合约构建的Web3理想国

    作者:九歌AI大模型发布日期:2025-05-27 00:12:26

    大家好,我是九歌。周末的时候,刷短视频看晓辉博士聊参加新加坡的一个AI国际会议的收获,同时提到了Agent和Web3,顿时让我来了兴趣和灵感。晓辉博士的原话是:未来的世界,Agent变成了劳动力大军,

    阅读全文
  • 文章封面

    豆包AI离线运行,本地文件检索和问答!

    作者:托尼不是塔克发布日期:2025-05-26 23:58:00

    豆包还能把模型下载到本地? 今天在某台电脑升级豆包的时候突然跳出一个提示,说是可以下载模型到本地,然后离线加载自己的知识库,进行检索和问答。这个页面又有一种非常熟悉的感觉!这不就是当年英伟达本地检索D

    阅读全文
  • 文章封面

    宇树机器人格斗打嗨了,然后呢?

    作者:智能Pro发布日期:2025-05-26 22:24:15

    👆👆👆重要提醒!微信推荐机制大幅调整,大家务必将我们公众号设为★星标,否则很可能看不到推送了......别看博茨大战了,CMG才是真男人该看的比赛。作为目前全球热度最高的机器人格斗比赛,连续举办了20

    阅读全文
上一页下一页