ACL2025 | 从漏洞到修复:北大CoV-Eval重新定义大模型代码安全评估
全文约 2800 字,预计阅读时间 8 分钟在人工智能飞速发展的今天,大型语言模型(LLMs)如GitHub Copilot、ChatGPT等已成为开发者手中的“得力助手”,极大地提升了代码编写效率。
阅读全文全文约 2800 字,预计阅读时间 8 分钟在人工智能飞速发展的今天,大型语言模型(LLMs)如GitHub Copilot、ChatGPT等已成为开发者手中的“得力助手”,极大地提升了代码编写效率。
阅读全文由中国电子商会归口管理,汇集众多企业、大模型专家提供支持,智合标准中心(北京之合网络科技有限公司)组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准(以下简称《标准》)现已正式立项。这是
阅读全文全文约 1000 字,预计阅读时间 3 分钟新闻资讯1. MiniMax发布通用 AI 智能体平台 MiniMax Agent,实现多领域任务自动化新锐 AI 公司 MiniMax 悄然推出全新的通用
阅读全文导读:这是一篇写得比较全面的基准数据集构建论文,论文附录还开源了人工标注说明、模型评测实验软硬件环境、详细的系统和用户提示词等,希望对大家有帮助。论文和数据集链接见文末全文约 3000 字,预计阅读时
阅读全文司南评测集社区 CompassHub 作为司南评测体系的重要组成部分,旨在打造创新性的基准测试资源导航社区,提供丰富、及时、专业的评测集信息,帮助研究人员和行业人士快速搜索和使用评测集。评测集社区 C
阅读全文全文约 3500 字,预计阅读时间约 9 分钟近年来,大型语言模型(LLMs)在自然语言处理领域掀起了一场风暴,从对话生成到复杂任务推理,它们的表现令人惊叹。然而,单个模型的性能总有瓶颈,训练成本高
阅读全文作者:企鹅火烈鸟原文链接:https://research.colfax-intl.com/cutlass-tutorial-writing-gemm-kernels-using-tensor-mem
阅读全文作者:李剑锋前言继上节课我们学习了如何利用 Function Calling 完成文本标注和信息抽取任务后,本节课将围绕“从真实网页中提取结构化信息”的主题展开一次完整实战。课程分为以下三个模块:模块
阅读全文全文约 2100 字,预计阅读时间 6 分钟在大语言模型(LLM)推理服务需求激增的背景下,如何高效处理海量请求、保障服务质量成为行业焦点。就在上个月,来自港科大与上海交大的研究团队提出了全新框架——
阅读全文作者:yanbo新闻资讯1. 扣子空间开放测试,无需邀请码即可体验专家 Agent 服务近日,扣子空间正式宣布开放测试,无需邀请码即可登录官网体验产品。此次测试开放了三大专家 Agent,包括:用户研
阅读全文全文约 2000 字,预计阅读时间 6 分钟在大语言模型(LLM)席卷AI行业的今天,如何高效地为多个LLM提供服务成为了一个亟待解决的问题。一篇题为《MuxServe: Flexible Spati
阅读全文本文转载自量子位,作者:量子位梦晨 鹭羽最新开源模型LTXV-13B,免费可商用、推理速度快、游戏显卡就能跑,视觉效果也不错。要素都齐了,想不火都难。从官方透露的信息看,新模型在速度、质量和控制三个方
阅读全文