CVPR Oral | 南京大学李武军教授课题组推出分布式训练算法UniAP,大模型训练最高加速3.8倍
李武军教授为通讯作者,硕士生林昊(已毕业,现工作于阿里巴巴)、吴轲、李杰为共同第一作者,博士生李俊为参与作者。训练成本高昂已经成为大模型和人工智能可持续发展的主要障碍之一。大模型的训练往往采用多机多卡
阅读全文李武军教授为通讯作者,硕士生林昊(已毕业,现工作于阿里巴巴)、吴轲、李杰为共同第一作者,博士生李俊为参与作者。训练成本高昂已经成为大模型和人工智能可持续发展的主要障碍之一。大模型的训练往往采用多机多卡
阅读全文鱼羊 一水 发自 凹非寺量子位 | 公众号 QbitAI开源大模型新王者,正在受到空前关注。Qwen3预告一出,直接开启不眠夜模式。△来自编辑部本部等到深夜正式上线并宣布登顶全球最强开源模型,更是瞬间
阅读全文明敏 发自 凹非寺量子位 | 公众号 QbitAI被AI带飞的小绿鸟,现在要彻底AI-first了。多邻国CEO最新全员信宣布:拥抱AI已经到了相当紧迫的时刻,哪怕技术没有100%成熟,也不能再等了,
阅读全文允中 发自 凹非寺量子位 | 公众号 QbitAI在推荐、广告场景,如何利用好大模型的能力?这是个很有挑战的命题。背后主要有两个核心难点:1)LLM虽然具备丰富的世界知识和推理能力,但缺乏电商领域的专
阅读全文MedKGEval团队 投稿量子位 | 公众号 QbitAI医疗大模型知识覆盖度首次被精准量化!在医疗领域,大语言模型(LLM)的潜力令人振奋,但其知识储备是否足够可靠?腾讯优图实验室天衍研究中心的最
阅读全文DeepSeek 发自 凹非寺量子位 | 公众号 QbitAI未来同事,你好~这是一则招聘帖。量子位是一个关注AI及前沿科技的新媒体平台,我们着迷于全新技术和趋势带来的改变,并正致力于帮助更多人第一时
阅读全文嘿,大家好!这里是一个专注于前沿AI和智能体的频道~“拍照搜图”这事儿吧,不新鲜, Google Lens 都快盘出包浆了。但是,最近夸克那个“拍照问”功能,没怎么大的宣传,居然还悄悄火了?(很多博主
阅读全文当前,大语言模型(LLMs)已在数学推理、代码等任务中展现出强大的能力。然而,现有提升推理性能的主流范式,往往依赖监督微调(SFT)与强化学习(RL)的结合,依赖于人工标注的推理路径、标准答案或额外的
阅读全文近年来,Transformer 架构在自然语言处理领域取得了巨大成功,从机器翻译到文本生成,其强大的建模能力为语言理解与生成带来了前所未有的突破。然而,随着模型规模的不断扩大和应用场景的日益复杂,传统
阅读全文在复杂推荐场景中,多任务联合优化面临 “联合训练耗时冗长、新任务泛化能力差” 的低效困境,行业亟待突破性解决方案。北京邮电大学-腾讯联合提出两阶段多任务提示调优框架 MPT-Rec,精准攻克知识迁移中
阅读全文合适的工作难找?最新的招聘信息也不知道?AI 求职为大家精选人工智能领域最新鲜的招聘信息,助你先人一步投递,快人一步入职!中电信AI中电信人工智能科技有限公司是中国电信开展人工智能业务的科技型、能力型
阅读全文OpenAI 刚把上周的 GPT-4o 更新给撤了,原因居然是:太讨好了!ChatGPT 用户们发现,上周的 GPT-4o 升级后,AI 助手变得太过热情友好,简直像个见人就夸的讨好型人格,有大量用户
阅读全文作者|蒸蒸邮箱|zz@pingwest.com在2025上海车展上,奔驰全球首发的纯电长轴距CLA车型成为焦点,这款专为中国市场打造的"史上最智能奔驰",标志着德系豪华品牌智能化转型进入新阶段。宝马、
阅读全文硅星人正在寻找最有潜力的作者、编辑、社区建设者加入。硅正在成为创造未来的基础,而我们每个人都是硅星人。作为“硅星人”的我们,相信今天这个世界并没有那么无聊。有趣的事情总在发生,令人兴奋的科技进步甚至在
阅读全文文章转载于新智元一项惊人的实验揭秘:AI超强说服力,已达人类的6倍!当你在论坛上激烈争辩,对方逻辑缜密、情感真挚,句句击中内心——但你不知道的是,这根本不是人类,而是一个AI机器人。最近,苏黎世大学在
阅读全文🔥微软与 OpenAI「相爱相杀」细节曝光🌩️我国首部《人工智能气象应用服务办法》发布🤖英伟达辟谣「拆分中国业务」📅马斯克预告 Grok 3.5 下周发布😠OpenAI 承认「向未成年生成色情内容」:
阅读全文xAI宣布下周向SuperGrok订阅用户开放Grok 3.5早期测试版。这款模型的最大突破,在于其具有第一性原理的推理能力。不同于传统AI依赖互联网数据拼接答案,Grok 3.5能像科学家般从物理定
阅读全文点击👇🏻可关注,文章来自🙋♂️ 想加入社群的朋友,可看文末方法,进群交流。“ Computer Use 智能体在 AI 落地的产品中不算少见。然而,传统智能体技术却因 GUI 元素定位不精准、长时序
阅读全文Crawl4AI 是一个专为大模型(LLM)设计的开源网页爬虫和数据提取工具。它支持异步架构,能够高效地从多个网站中提取结构化数据,输出格式包括 JSON、清理过的 HTML 和 Markdown,方
阅读全文笔者开始写公账号大概一个月时间了,期间收到很多同学的私信,发现大家对LLM基础技术还是比较感兴趣,故根据我现在已有的知识,给大家整理一个脑图;主要梳理了基础技术篇的脑图,后续文章会继续给出开发、应用偏
阅读全文让RAG更聪明:构建带相关性判断与问题重写的智能问答系统引言RAG(Retrieval-Augmented Generation,检索增强生成)已成为智能问答、企业知识库、智能助手等场景的主流方案。但
阅读全文打造一个有温度、有趣味、专业的全栈式AI&AIGC交流社区,用心写好每一篇文章!项目主页-https://techcrunch.com/2025/04/28/hugging-face-releases
阅读全文今天凌晨3点,OpenAI首席执行官兼联合创始人SamAltman表示,针对近期GPT-4o阿谀奉承献媚的问题,已经进行了修复。目前,免费用户已完成更新,100%回滚到老版本。对于付费用户,会在完成回
阅读全文宇宙的尽头是直播带货,AI 自然也不例外。ChatGPT 开始带货了。是的,你没有看错。昨天,OpenAI 官宣为 ChatGPT 推出了好物推荐功能:当你搜索商品时,ChatGPT 会自动输出产品效
阅读全文千问在放假前扔出了一个重磅炸弹💣--Qwen3 ! Qwen3 在编码、数学、通用能力等能力上可以直接和 Gemini,chatgpt,Grok 最强模型掰手腕。模型支持开关深度思考能力,提供多种尺寸
阅读全文凌晨 5:05 分,Qwen 发推宣布,Qwen3 来了!推文非常长,亮点也很多。推文包含的核心内容如下:Qwen3包括 2 个混合专家(MoE)模型和 6 个密集模型,参数规模从 6 亿到 2350
阅读全文阶跃星辰正式发布并开源图像编辑大模型 Step1X-Edit,性能达到开源 SOTA。该模型总参数量为 19B (7B MLLM + 12B DiT),具备语义精准解析、身份一致性保持、高精度区域级控
阅读全文👆👆👆重要提醒!微信推荐机制大幅调整,大家务必将我们公众号设为★星标,否则很可能看不到推送了......今天(4 月 29 日)凌晨,阿里巴巴推出了 4 月压轴的一款大语言模型——Qwen3 系列。而
阅读全文(点击上方图片进入商城)干净整洁的家就像一个温暖的怀抱,尤其是所有衣物、物品摆放得井井有条,让人一踏入就感受到无比的舒适和放松。但是很多朋友都搞不定衣物被子收纳的问题,每次一到换季,都很发愁。尤其是租
阅读全文👆👆👆重要提醒!微信推荐机制大幅调整,大家务必将我们公众号设为★星标,否则很可能看不到推送了......早上出门戴上耳机,点开熟悉的歌单,结果发现某首歌「变灰」了;喜欢的歌手推出了新专辑,但只上架了特
阅读全文