全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    实锤了, deepseek做出了自己的claude code

    作者:探索AGI发布日期:2026-07-20 11:50:00

    朋友们好呀,这里是「探索AGI」。说好7月中旬发的deepseek v4,今天都20号了,正式版还是没影。从上周五的评论区来看,很多朋友还是想念,一个智力巅峰的小鲸鱼。昨天有网友晒出了和deepsee

    阅读全文
  • 文章封面

    kimi k3刚发布,就把自己人都吓跑了。

    作者:探索AGI发布日期:2026-07-17 11:59:02

    朋友们好呀,这里是「探索AGI」。今天一早,Kimi发布了K3。 2.8T参数,原生1M上下文,原生多模态。又是铺天盖地的评测文,很多朋友估计直接被价格劝退了。输入21元百万token,输出100元百

    阅读全文
  • 文章封面

    一觉醒来,claude也可以白嫖了!

    作者:探索AGI发布日期:2026-07-15 11:53:30

    今天很好玩。 前脚anthropic官宣claude for teacher,美国k12教师免费送claude pro一整年。 后脚,openai把k12白嫖号第二轮清洗到几乎全军覆没。早上刷帖子,老

    阅读全文
  • 文章封面

    奥特曼白送你一周额度,又偷偷把5.6降智了

    作者:探索AGI发布日期:2026-07-13 11:50:00

    周末,openai杀红眼了,疯狂重置。 今天,codex负责人tibo再次发推,官宣三件事: codex的5小时限制,取消,Plus、Business、Pro全生效; 5.6再优化一轮,同样的活耗更

    阅读全文
  • 文章封面

    花sonnet的钱,干fable的活,A社官方省钱教程

    作者:探索AGI发布日期:2026-07-10 11:56:12

    昨天A社发来一个devblog,已经几百万阅读了,手把手教你怎么省钱用fable。 其实,就是额度烧的太快了,而且最新版还有个bug,你的额度有1/3可能是浪费的。。。。注意: 教的是2个套路,理论可

    阅读全文
  • 文章封面

    Claude/Codex又爆猛烧钱bug,随时准备烧空你的额度,官方躺平不修复。

    作者:探索AGI发布日期:2026-07-08 11:58:30

    哭了,昨天群友又分享一个离谱的事情。 这次codex、claude code都中招。 这2个用户量最大的agent产品都隐藏了一个官方不修复的烧钱坑。真是崩不住了。简单来说,往会话里边,cmd+v贴的

    阅读全文
  • 文章封面

    大神周末开源省token野路子,claude fable5账单砍掉6成

    作者:探索AGI发布日期:2026-07-06 11:50:53

    上周肥波5解禁,可以说是全球程序员平均水平最强的几天。这几天有很多关于fable5的技巧发布,开源框架也在猛薅,superpowers让fable5优化了一版6.0出来,token比之前版本省了一大半

    阅读全文
  • 文章封面

    DeepSeek高薪Agent岗面经流出:三轮面下来,一道算法题都没考

    作者:探索AGI发布日期:2026-07-03 11:52:37

    deepseek最近融资500亿,大规模扩张,负责人天天在线招聘,终于有面经流出了。。。。抛开他们应该对学历这些硬性要求巨高(基本是top几学校的,不然也不会每天收上万份简历,还是找不满了),从他们j

    阅读全文
  • 文章封面

    codex降智大bug找到了,一句话让它把智商找回来!

    作者:探索AGI发布日期:2026-07-01 14:20:08

    这两天codex虽然疯狂额度重置,但几乎可以确定它被降智了。 平时十几分钟能搞定的活,来来回回折腾。网友们整的一个专门监测codex智商的雷达站,曲线也明显往下掉。虽然部分xhigh被偷摸灰度到了5.

    阅读全文
  • 文章封面

    大多数人还不知道,你的codex已经被偷偷换成了阉割版GPT-5.6

    作者:探索AGI发布日期:2026-06-29 11:50:00

    笑死。 因为A➗ 肥波5的骚操作,openai新模型gpt5.6也不敢直接对公众开放了。但是不敢直接开放,openai玩上悄摸灰度的骚操作了。 可能很多朋友还不知道自己的号有没有灰度到。测试方法很简单

    阅读全文
  • 文章封面

    刚刚,中午的时候,DS在hugging face上开源了2个新模型,外加一个github上的训练框架DeepSpec

    作者:探索AGI发布日期:2026-06-27 15:55:00

    阅读全文
  • 文章封面

    Claude还是最强,但Anthropic这周好像疯了

    作者:探索AGI发布日期:2026-06-26 11:50:00

    Anthropic这周是真有点癫。昨天写信告阿里搞蒸馏,用近25000个号、44天蒸了它2880万次,然后阿里股价也不出意外刷新了16个月最低。肥波5谈判失利,达里奥被特朗普嫌弃,根本没法沟通,踢出了

    阅读全文
  • 文章封面

    Anthropic总想摔碎程序员饭碗,甩出了“以后只招两种人”名单。

    作者:探索AGI发布日期:2026-06-24 11:57:22

    昨天anthropic发布了新产品claude tag。 karpathy大神狂吹,这是llm交互的第三范式,第一代ai是你去访问网站,第二代是你下载的app,第三代它成了常驻组织、自己带着工具和记忆

    阅读全文
  • 文章封面

    Codex史诗级大bug,随时准备烧穿你的硬盘

    作者:探索AGI发布日期:2026-06-22 14:00:00

    周末,codex一个大bug爆了。在流式传输和自动化任务的时候,以5M/s的速度,持续往磁盘写日志。 每年大概要写640TB。要不了一年,就可以耗尽部分消费级SSD标的写入寿命。Github 上已经有

    阅读全文
  • 文章封面

    deepseek v4.1? 梁圣的端午礼物突袭。

    作者:探索AGI发布日期:2026-06-17 08:00:00

    昨天,群里有小伙伴说deepseek官方灰度新模型了!梁圣又打算端午节前搞偷袭??? 那真的疯狂星期四了~手机端和web端的Flash模型思考模式风格大变。变成了,1、2、3、4、5 罗列的模式...

    阅读全文
  • 文章封面

    一小时烧掉1400刀,Loop Engineering是真烧钱

    作者:探索AGI发布日期:2026-06-15 17:05:00

    最近有个人用Cursor,一小时烧了1400美元。一个循环逻辑出了岔,陷进死循环,他一觉醒来收到天价账单。CEO直接在评论区全额退款,还连夜去给产品加单任务的消费上限。而搞出这个东西的玩法,就是这两天

    阅读全文
  • 文章封面

    Claude Code之父复盘一周年,最先慌的竟然是中间层工程师

    作者:探索AGI发布日期:2026-06-11 17:14:58

    前几天,Claude Code之父复盘了Claude Code发布一周年。畅谈了Agent架构、验证的变化。工作流、角色的变化。看微信指数,Claude Code差不多从去年底开始爆发,打开公众号,还

    阅读全文
  • 文章封面

    Agent Skill越进化越蠢?我啃完3篇核心论文,把玄学自进化变成了科学调优

    作者:探索AGI发布日期:2026-06-10 18:08:17

    现在各种自动进化Agent都在说,只要你打开自动沉淀经验/进化的开关,它跑完一个任务,自己就总结一条写成Skill。 可能开始几次真的很惊艳,越跑越顺,逢人就吹这功能碉堡了。但是一个月后,打开ski

    阅读全文
  • 文章封面

    Claude Code之父和龙虾之父,刚刚同时宣判:手动调Agent的时代结束了(附5个技巧)!

    作者:探索AGI发布日期:2026-06-08 17:17:51

    今天OpenClaw之父 Peter Steinberger 和 Claude Code 之父 Boris,同一天甩出同一句话:Agent 自主跑几天的时代,写prompt正在变成一种落后的状态。Bo

    阅读全文
  • 文章封面

    我用Karpathy的Autoresearch跑通Agent harness调优,任务通过率从60%飙到80%。

    作者:探索AGI发布日期:2026-06-04 17:09:11

    我做了一个很好玩的事情,让模型给自己迭代一个上下文管理的plugin插件,看能给swe-bench刷成什么样子?结果还挺意外的:任务通过率从60%飙到80%。 最后最佳的方案,仅仅是一行不到50个字符

    阅读全文
  • 文章封面

    用了1个月的Flash级模型,我发现效率才是Agent的真理。

    作者:探索AGI发布日期:2026-06-02 11:50:00

    IBM和Artificial Analysis上周发了一个新基准测试叫ITBench-AA。跟以前的coding benchmark不一样,这个测的是真实企业场景,59个Kubernetes故障诊断任

    阅读全文
  • 文章封面

    删掉95%的Agent Skills,成功率反而从77% 飙到97%

    作者:探索AGI发布日期:2026-06-01 15:30:00

    我前两天看了一眼我的Cursor,装了500多个Skills。一启动,上下文窗口直接被吃掉50%,Opus的200k context,还没开始干活就只剩一半了。然后我看到了WorkOS在AI Engi

    阅读全文
  • 文章封面

    你配了一堆的MCP、Skills,Agent可能根本不会选。。。

    作者:探索AGI发布日期:2026-05-29 11:50:00

    微软昨天发了一篇博客,还有点意思,拆解了AI Coding Agent从“用户敲prompt”到“生成代码”之间到底发生了什么。里边揭漏了很多非常容易踩的坑。核心结论:你给模型配置了一堆MCP,各种S

    阅读全文
  • 文章封面

    所有人在让Agent更强,YC却投了一家靠Agent翻车赚钱的公司。

    作者:探索AGI发布日期:2026-05-27 10:03:00

    笑死,上周,YC孵化的新一批公司里,有一家叫Mount。 给AI Agent卖保险。我看到这条帖子第一反应是:有人觉得Agent出事的频率高到,可以靠收保费赚钱了。第二反应:YC投了。YC觉得这是一门

    阅读全文
  • 文章封面

    Anthropic智能体大会:Agent也会精神分裂,我们发现了多Agent协作的本质解法。

    作者:探索AGI发布日期:2026-05-25 11:30:05

    上个周A➗的开发者大会,视频陆陆续续出炉了。 这一次可以说是一场Agent大会,基本都在围绕,如何做好Agent,如何发挥模型极限价值。Anthropic虽然现在搞得自己名声不咋地,但是分享的实战经

    阅读全文
  • 文章封面

    对比龙虾、爱马仕、CC账单、架构后,我发现Agent 90%的token都是浪费的!

    作者:探索AGI发布日期:2026-05-21 11:50:00

    这周我深度研究了一个宝藏开源项目OpenClacky,让我发现一个很荒诞的事实。现在这么多知名的开源Agent框架: OpenClaw、Hermes Agent、Claude Code...如果实际用

    阅读全文
  • 文章封面

    说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!

    作者:探索AGI发布日期:2026-05-20 14:56:22

    很开心,提前2天拿到了Qwen3.7-Max的内测。因为我们项目一直在用Qwen,所以我特别关注,每个版本的Qwen,跟上一个版本差异在哪里?能不能替换掉我们之前的API服务。经过几天的测试,我觉得3

    阅读全文
  • 文章封面

    模型都一样了,AI Agent 真正的差距在 Harness 层!

    作者:探索AGI发布日期:2026-05-18 12:03:02

    天工超级智能体更新了!现在几乎所有所有平台接入的模型都一样,DeepSeek V4、GLM 5.1、Kimi K2.6.... 你有我也有,模型层的差异化基本消失了。所以,现在各种Agent系统或者

    阅读全文
  • 文章封面

    我发现,装了一周AI浏览器,上班摸鱼都变高级了。回不去了!

    作者:探索AGI发布日期:2026-05-14 11:50:00

    现在每天打开电脑, 除了IDE就是浏览器。Coding agent 越来越聪明了,写代码、写文档基本都全权交给它们了。 腾出来更多的时间,摸鱼,刷博客,玩新产品,全都在浏览器里边,浏览器时间应该已

    阅读全文
  • 文章封面

    模型的自我进化,可能真的开始了。

    作者:探索AGI发布日期:2026-05-13 21:35:39

    昨天Hermes Agent更新了0.13.0。终于支持原生Windows了。 之前电脑的wsl坏了,一直懒得折腾,终于可以体验一下了。安装具简单,管理员启动PowerSheell 一行命令搞定:ir

    阅读全文
下一页