全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    人形机器人不再「走走停停」:Current Robotics发布全身灵巧操作模型Curr-0

    作者:机器之心发布日期:2026-06-18 17:10:00

    机器之心发布让人形机器人在移动中完成精细操作,一直是具身智能领域没有被很好解决的问题。过去的主流方案是把移动和操作拆成两个独立模块:机器人先走到目标位置,停下来,再执行手部操作。这套逻辑在工厂流水线上

    阅读全文
  • 文章封面

    PPT之外,AI之内|2026WAIC机器之心特别企划栏目

    作者:机器之心发布日期:2026-06-18 17:10:00

    在智能浪潮席卷全球之际,2026世界人工智能大会暨人工智能全球治理高级别会议将于 7 月 17 日至 20 日在上海举行,分设世博(世博中心、世博展览馆)、张江(张江科学会堂)、西岸(西岸国际会展中心

    阅读全文
  • 文章封面

    ICML 2026 Oral | 为3D空间智能数据构建全自动数据飞轮,Holi-Spatial打造400万级空间多模态数据集

    作者:机器之心发布日期:2026-06-18 17:10:00

    从原始视频出发,无需人工介入,自动生成 3D 重建、深度、2D mask、3D 框、实例描述、3D grounding 和空间问答。Holi-Spatial 试图把「空间智能」的数据生产,推进到自动化

    阅读全文
  • 文章封面

    堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答

    作者:机器之心发布日期:2026-06-17 18:00:26

    编辑|Panda截至今年 3 月,中国日均 Token 调用量已突破 140 万亿,两年间增长超过千倍。这个数字比任何分析报告都更直白地说明了一件事:AI 已经从实验室走进了生产线。然而,数字背后藏着

    阅读全文
  • 文章封面

    DeepMind:Transformer存在拓扑缺陷,思维链治标不治本

    作者:机器之心发布日期:2026-06-17 18:00:26

    编辑|Panda如今,思维链(CoT)已然成为前沿模型的标配。其机制并不复杂:用户提一个问题,模型会先输出一大段内部推导过程(有时候长达几千个词),然后才给出正式答案。然而,随着模型能力的提升,思维链

    阅读全文
  • 文章封面

    ACL 2026 Main|混合推理模型也会「钻空子」:南大移动团队提出TNT,破解「假装不思考」骗奖励

    作者:机器之心发布日期:2026-06-17 18:00:26

    作者介绍: 南京大学智能科学与技术学院博士生甘思远为本文第一作者;南京大学高阳教授为本文合作者;上海人工智能实验室孟林建青年研究员和南京大学霍静副教授为本文通讯作者。以 DeepSeek-R1、Ope

    阅读全文
  • 文章封面

    年薪300万的前沿部署工程师,要被「录屏教学」替代了

    作者:机器之心发布日期:2026-06-16 11:33:02

    机器之心发布AI 正在学着操作电脑。过去 AI 回答问题,现在它直接开始帮你干活。填表格、录系统、整理文件,Anthropic 的 Claude Cowork、OpenAI 的 Codex 桌面版 —

    阅读全文
  • 文章封面

    Anthropic又摊上事了,夸大使用额度,被用户起诉

    作者:机器之心发布日期:2026-06-16 11:33:02

    机器之心编辑部最近的 Anthropic 真是风波不断。前脚刚因最强模型的访问权限问题,卷入美国政府出口管制风波;后脚又因 Claude 高价订阅计划,被用户告上法庭。据《华尔街日报》报道,居住在华盛

    阅读全文
  • 文章封面

    视觉latent reasoning为什么不稳?这篇论文从特征空间找到了关键缺口

    作者:机器之心发布日期:2026-06-16 11:33:02

    导读:视觉 latent reasoning 希望让多模态模型在内部生成连续 latent token,用这些中间表示补充多模态理解和推理任务中缺失的视觉证据。但问题在于,模型生成出来的 latent

    阅读全文
  • 文章封面

    腾讯Robotics X开源HyVLA-0.5:基于亚毫米级指套UMI与真机强化,摆脱繁重遥操

    作者:机器之心发布日期:2026-06-15 17:55:04

    机器之心编辑部6 月 15 日,腾讯 Robotics X、福田实验室与混元团队联合发布面向真实世界机器人操作任务的端到端具身智能模型 Hy-Embodied-0.5-VLA(简称 HyVLA-0.5

    阅读全文
  • 文章封面

    用国产GPU训练AI给自己写内核,摩尔线程刷榜硬核基准

    作者:机器之心发布日期:2026-06-15 17:55:04

    编辑|泽南国产算力生态的难题,从此有了 AI 解。最近,在比「AI 生成 GPU 内核」的硬核基准 KernelBench 上,摩尔线程的模型拿下了第一。在 MooreEval 执行式验证协议的加持下

    阅读全文
  • 文章封面

    1080条提示词、7款模型大比拼:视频生成离「好看、好用又准确」还差多少?

    作者:机器之心发布日期:2026-06-15 17:55:04

    当视频生成模型走出娱乐创作的舒适区,进入科学、医疗、教育等知识密集场景,它们是否还能生成事实准确、清晰可用的视频?任务对比 —— 传统视觉质量导向 vs KIVI 知识密集型导向针对这一挑战,研究者首

    阅读全文
  • 文章封面

    Fable 5被特朗普禁止幕后黑手曝光?Karpathy可能也用不了了

    作者:机器之心发布日期:2026-06-14 10:50:15

    机器之心编辑部昨天,美国特朗普政府对 Anthropic 的 Fable 5 和 Mythos 5 模型开启禁令,全面禁止外国政府、企业和个人的访问权限。在发布仅仅 4 天后,Fable 5 就已经结

    阅读全文
  • 文章封面

    CVPR 2026 | GaussianDWM:用3D高斯表示统一自动驾驶场景理解与多模态生成

    作者:机器之心发布日期:2026-06-14 10:50:15

    自动驾驶世界模型的研究目标已经从单纯预测未来视觉帧,扩展到构建可用于场景理解、空间定位和后续决策的世界表示。如果模型只能生成外观上合理的未来图像,却无法回答场景中有哪些目标、目标位于何处,以及不同视角

    阅读全文
  • 文章封面

    突发!美国政府禁止外国人使用Claude Fable 5

    作者:机器之心发布日期:2026-06-13 10:10:10

    机器之心编辑部Anthropic 最新模型 Fable 5 和 Mythos 5 再起风波。据媒体 Axios 爆料,美国特朗普(Trump)政府正式援引国家安全权力,对 AI 独角兽企业 Anthr

    阅读全文
  • 文章封面

    交白卷也排第一?Fable 5二百题全部拒答,却登顶最严AI编程基准

    作者:机器之心发布日期:2026-06-13 10:10:10

    编辑|Panda太离谱了!是的,本文的主角还是前些天刚发布了 Claude Fable 5 的 Anthropic。Fable 5 发布时的排面是真的足。SWE-Bench Pro 得分 80.3%,

    阅读全文
  • 文章封面

    ICML 2026|一句无关问题也能劫持Agent,港科大&复旦提出首个语义缓存键碰撞攻击

    作者:机器之心发布日期:2026-06-13 10:10:10

    本文第一作者张芝翔为复旦大学本科四年级学生,即将前往香港科技大学CSE系攻读博士,研究方向为AI Security&Trustworthy AI。通讯作者是香港科技大学佘东冬教授。在当前大语言模型(L

    阅读全文
  • 文章封面

    入围CVPR 2026最佳论文决选,ViT³用「测试时训练」突破Transformer复杂度瓶颈

    作者:机器之心发布日期:2026-06-12 16:51:00

    编辑|+0CVPR 2026 刚在美国丹佛落下帷幕。16092 篇投稿中,15 篇杀入最佳论文决选(Best Paper Finalists),入围率不足千分之一。其中一篇来自阿里巴巴与清华大学的合作

    阅读全文
  • 文章封面

    5秒攻破,仅需1次对话:Fable 5最强安全机制被华人团队破解

    作者:机器之心发布日期:2026-06-12 16:51:00

    不是提示注入,不是角色扮演,也不是把恶意请求伪装成正常问题。这一次,风险出现在智能体自主完成任务的过程中。Fable 5 是 Anthropic 面向公众开放的 Mythos 级模型,不仅具备极强的综

    阅读全文
  • 文章封面

    RSS 2026 | 别再让机器人看错重点,GuidedVLA给动作解码器装上可控可解释的注意力专家

    作者:机器之心发布日期:2026-06-12 16:51:00

    具身智能要想真正走进复杂真实场景,VLA(Vision-Language-Action,视觉 - 语言 - 动作)模型只会「看图听话再出动作」还不够。更关键的问题是:当机器人伸手之前,它到底看向了哪里

    阅读全文
  • 文章封面

    斩获15个顶级零日漏洞:0G Lab联合新国立,北大和北邮团队构建的共识协议debug智能体框架

    作者:机器之心发布日期:2026-06-11 12:30:00

    机器之心发布分布式系统的 “圣杯”—— 共识协议(Consensus Protocols),长久以来都是顶级基础设施工程师的 “Bug 地狱”。由于其状态极其复杂、多节点交织,传统测试和单体 LLM

    阅读全文
  • 文章封面

    谷歌开源26B文本扩散MoE,劈柴:生成速度像赛马一样快

    作者:机器之心发布日期:2026-06-11 12:30:00

    机器之心编辑部今天一早,谷歌又发新模型了!Gemmna 家族有了新成员 ——DiffusionGemma,一个探索文本扩散的实验性开源模型,在文本生成任务上速度极快。根据官方介绍,DiffusionG

    阅读全文
  • 文章封面

    ACL 2026 Oral|语义推理如鲠在喉:大模型被「短语」难住了

    作者:机器之心发布日期:2026-06-11 12:30:00

    研究发表于 ACL 2026 主会,并获选为 Oral 论文,核心作者为北京通用人工智能研究院的研究者刘洋和北京科技大学的本科生李鸿铭,指导老师为北京科技大学外国语学院教授秦晓惠以及计算机与通信工程学

    阅读全文
  • 文章封面

    能自动干活的AI浏览器,永久免费,来自美团

    作者:机器之心发布日期:2026-06-10 11:49:05

    编辑|杜伟公测 100 天、更新十多个版本之后,国内 AI 浏览器赛道的代表玩家「美团 GN06」,亮出了 Tabbit 1.0 正式版。三月初,美团旗下 GN06 团队宣布,其主打 AI 原生的 T

    阅读全文
  • 文章封面

    SwarmFlow来了!openJiuwen开创蜂群可控协同新范式

    作者:机器之心发布日期:2026-06-10 11:49:05

    机器之心发布AI Agent 正在从 "单兵作战" 走向 "团队协作"—— 让多个 Agent 分工配合,去完成单个 Agent 难以独立扛下来的复杂任务,也是近期最受关注的方向之一。沿着这条路,华为

    阅读全文
  • 文章封面

    RSS2026 | 强泛化强迁移VLA,上海创智学院×上海交大提出MINT:让VLA从模仿轨迹走向理解意图

    作者:机器之心发布日期:2026-06-10 11:49:05

    机器人视觉语言动作(Vision-Language-Action, VLA)模型越来越多地开始展示叠衣服、倒茶、做咖啡等复杂操作。但是,今天的大多数 VLA 更像 “展台机器人”。它们在固定场景、固定

    阅读全文
  • 文章封面

    新架构模型HRM-Text创新纪录!1B参数、1000美元,图灵奖得主都亲自下场了

    作者:机器之心发布日期:2026-06-09 12:06:07

    编辑|+0一个约 1B 参数的模型,在 MATH 上拿到 56.2,在 GSM8K 上拿到 84.5,在 ARC-Challenge 上拿到 81.9。训练成本约 1500 美元,16 块 H100

    阅读全文
  • 文章封面

    Anthropic最新博客:生物学Agent的瓶颈不在模型,而在数据基础设施

    作者:机器之心发布日期:2026-06-09 12:06:07

    机器之心编辑部当前,Coding Agents 在软件工程领域一路高歌猛进,科学家们看到此场景,也不禁寄予厚望:AI 智能体何时能以同样的速度,帮人类攻克药物设计、病毒监控与生物学建模的重重难关?然而

    阅读全文
  • 文章封面

    ICML 2026 | PhysForge框架来了,让3D资产从静态模型变成可交互对象

    作者:机器之心发布日期:2026-06-09 12:06:07

    在交互式虚拟世界和具身智能快速发展的今天,高质量 3D 资产已经不再只是 “看起来像” 就足够。一个柜门不仅要有柜门的外观,还需要知道绕哪条轴旋转;一个按钮不仅要有按钮的形状,还需要具备 “按下 /

    阅读全文
  • 文章封面

    阿里RTPurboV2:原生Transformer再次崛起,百步训练实现10倍稀疏注意

    作者:机器之心发布日期:2026-06-08 10:06:03

    机器之心发布“Full Attention 正在被遗忘”随着 Agent 的广泛应用带来的长序列需求,传统 GPT 架构的 Attention 部分,由于其 O (N^2) 的计算复杂度,正逐渐被视为

    阅读全文
上一页下一页