Test-Time Scaling:把算力花在刀刃上
> 本文由 Intern-S1 等 AI 生成,机智流编辑部校对一、为什么要在推理时花算力训练时扩展(training-time scaling)的剧本大家都很熟了:更多参数、更多数据、更多算力。Sc
阅读全文> 本文由 Intern-S1 等 AI 生成,机智流编辑部校对一、为什么要在推理时花算力训练时扩展(training-time scaling)的剧本大家都很熟了:更多参数、更多数据、更多算力。Sc
阅读全文> 本文转载自「眸深智能」T²MB模型首发让机器人实现自主学习新突破前言近日,眸深智能团队联合复旦大学,创新性地提出新模型T²MB,颠覆了传统模型的强化学习范式。研究证实了模型具备“自我评估”的内在能
阅读全文图片由 AI 生成导读:轻量级“直觉”模型先行预判,复杂任务再交大模型,一场关于AI效率的思维范式转移正在发生。在多模态大模型(MLLM)飞速发展的今天,以OpenAI o3和Gemini Agent
阅读全文> 作者:李剑锋前言什么是 RAG在上一节课中,我们介绍了一种最简单的微调大模型的方法——提示词工程。我们通过一些原则和技术让模型的输出更加符合我们的需求。那除了使用提示词技术以外,还有一种在不改变大
阅读全文图片由 AI 生成导读:当机器人能记住过去15分钟的每一个细节,它就能为你准备一顿完整的晚餐。如果你让机器人清理整个厨房——从收拾餐具到擦拭台面,再到清洗碗碟,整个过程可能需要15分钟。传统的机器人策
阅读全文> 作者:北辰前言:小白入门OpenClaw的初衷与实测背景OpenClaw的热度一直居高不下,昨天微信又推出了OpenClaw专门的插件,估计大家都开始跃跃欲试想拥有自己的虾了。特别提醒:目前微信插
阅读全文图片由AI生成在当今AI浪潮中,大语言模型(LLM)以其强大的生成和理解能力,正深刻改变着人机交互与应用开发的面貌。然而,其动辄数百亿参数的庞大规模,也带来了严峻的部署挑战:GPU显存容量和内存带宽,
阅读全文> 本文活动解释权归属GMI Cloud-- 完 --加入机智流 Pro,1 天一块钱,AI 能力指数级增长时代,不掉队。机智流 AI 团队将燃烧远超人类的智能的 AI Tokens 驱动 AI Ag
阅读全文图片由AI生成当通用代码大模型在工业级硬件设计、GPU 优化、嵌入式系统等专业领域频频 “翻车” 时,一款真正理解工业约束的代码智能助手终于应运而生。通用代码大模型的这一短板并非偶然,其核心症结在于训
阅读全文> 本文转载自外网文章,有删改,原文链接见文末这篇文章的全部论点其实就在下面这张 CommitStrip 漫画里。四格,四句话:第一格:黑衣服的人端着咖啡说,总有一天我们不需要程序员了,只要写好 sp
阅读全文> 本文来自社区投稿TLDR. 搜索Agent的真正瓶颈不是模型不够聪明,而是「工作台」太乱了。🤔 你有没有过这样的体验:让AI帮你深入调研一个话题,前几轮搜索还挺靠谱,可搜着搜着,它就开始「说胡话」
阅读全文图片由AI生成导读:无需调整模型参数,仅通过“读写反思学习”循环,AI智能体就能在部署中持续成长。这篇研究像是 RAG 与 Skill 的结合,将 Skill 作为 LLM 的外置记忆系统,又将检索目
阅读全文> 本文转载自「Second State」各位开发者朋友们, KCD Beijing + vLLM 2026于3月21日如期而至。当下 AI 与云原生深度融合,大量工程难题亟待跨领域碰撞与实践沉淀。本
阅读全文> 作者:李剑锋前言在真实教学或工程实践中,我们经常会发现一个现象:同一个模型同一个问题不同的提示词输出质量天差地别这说明一个关键问题:大模型不是“会不会”,而是“你怎么问”。对于大模型而言,最低成本
阅读全文> 本文来自社区投稿,作者:眸深智能当具身智能成为 AI 领域的终极赛道,所有从业者都在面对同一个灵魂拷问:为什么效果拉满的顶级 VLA(视觉-语言-动作)模型,只能跑在数据中心的 H100 上,却无
阅读全文> 本文转载自「书生 Intern」智能体在物理世界中实现“具身化”演进,核心瓶颈是数据匮乏。针对这一难题,上海人工智能实验室近期推出InternVerse具身数据平台,包括四大核心组件:Intern
阅读全文图片由 AI 生成TL;DR: 更聪明的信息融合,带来更稳定、更强大的模型在大语言模型(LLM)层层堆叠的Transformer架构中,残差连接 无疑是支撑模型深度训练的关键功臣。它通过恒等映射为梯度
阅读全文图片由 AI 生成在AI内容生成狂飙突进的今天,从一段文字生成一张精美图片已不稀奇,但你是否想象过,输入一篇研究论文,AI就能在几秒钟内开始为你流式播放一段由虚拟人物主持、声画同步的解读视频播客?这背
阅读全文今天半夜,NVIDIA GTC 2026 Keynote[1] 就要正式开始了。按官方时间,Keynote 安排在了北京时间,3 月 17 日凌晨 2:00–4:00。但在 keynote 开讲之前,
阅读全文> 本文来自社区投稿TLDR. Agent是强大的,但用户是狂野的😦又是一个工具使用Benchmark?不是说模型厂商追逐榜单严重,忽略用户实际体验?确实,但我们面对这个质疑提出了WildToolBe
阅读全文图片由AI生成随着最近 OpenClaw 爆火,Agent Skills(智能体技能)也开始走进大众的视野。当你遇到一个非常复杂、难以解决的问题时,你不需要重新训练庞大的模型,只需在运行时给它一个“技
阅读全文> 本文由 Intern-S1 等 AI 生成,机智流编辑部校对FlexAttention 回顾FlexAttention 是一个 PyTorch API,让你只需几行 Python 代码就能实现自定
阅读全文图片由 AI 生成你是否曾想过,你与AI助手的每一次对话、每一次让它执行命令、每一次它调用工具后的结果,其实都蕴含着宝贵的“教学信号”?这些信号本可以指导AI变得更好,但在现有系统中,它们却被无情地“
阅读全文> 作者:羰汤羰经常关注OpenClaw的朋友都懂,想“养虾”真的太难了!前段时间还听说闲鱼上OpenClaw上门安装一千块一次,真的给我整懵了。然后我就试着自己部署,下载安装、改配置文件、接入飞书、
阅读全文图片由 AI 生成当你被蒙上眼睛带进一个陌生的多房间公寓,然后摘掉眼罩。为了了解这个环境,你会怎么做?你可能会先环顾四周,记住眼前物品的位置和方向,然后走向一扇门,进入下一个房间,继续观察和记忆。在这
阅读全文2026 年是 AI 行业井喷式发展的一年,从 GTC、CVPR 到 NeurIPS,从上海 WAIC 到沙特 Global AI Summit,全球各地的 AI 盛会精彩纷呈。我们整理了全
阅读全文图片由AI生成你是否曾在使用大语言模型处理长文档、长对话时,经历过点击“发送”后那令人焦灼的等待?屏幕上光标闪烁,模型却仿佛陷入沉思,迟迟不肯吐出第一个字。这背后的“罪魁祸首”,正是Transform
阅读全文HF Papers 周报2026.03.02 — 03.08151 篇论文 · Top 15 深度解读 · 三条研究主线📊 本周三条主线主线一:「一个模型通吃」持续推进与被质疑Utonia(153票)
阅读全文本文翻译自 Anthropic 官方出品的 《The Complete Guide to Building Skill for Claude》 ,虽然名称是“为Claude”,但经小编试验,这篇指南适
阅读全文📖 本文为精选摘要版,完整版含交互图表和更多资讯,请访问:ai-insight.org/reports/weekly-0308📋 编辑导语 本周可能是 2026 年迄今最密集的一周。GPT-5
阅读全文