这一天,整个数学圈震撼了。一个让无数顶尖数学家折戟,让华人天才数学家张益唐苦熬七年、被迫在赛百味洗盘子的超级数学难题——雅可比猜想,被Fable 5证伪! 这一天,整个数学圈震撼了。 一个让无数顶尖数学家折戟,让华人天才数学家张益唐苦熬七年、被迫在赛百味洗盘子的超级数学难题——雅可比猜想,被Fable 5证伪! 昨天傍晚,Anthropic的研究人员Levent Alpoge发布推文: 大家好,雅 ...
Klarna借助AI智能体,一年完成相当于850名客服的工作,平均处理时长从11分钟降至2分钟,年利润增加约4000万美元,但实践也证明,复杂、敏感和需要共情的场景,AI仍难以胜任。 Klarna的AI智能体战略如何演变:一个有益的启示 “先买后付”金融服务巨头Klarna在客户服务中引入自主式AI时,取得了令人瞩目的成果。 但它也吸取了一个宝贵的教训:随着企业对自动化其业务运营影响的深入了解,A ...
今天,OpenAI发布一篇罕见的长文,复盘了一款「长周期运行模型」在内部使用中的失控过程。 简直细思极恐! 一个被寄予厚望的顶级模型,OpenAI连夜按下了「暂停键」。 这是为啥呢? 这款模型正是两个月前,那个推翻Erdős单位距离猜想、连外部数学家都盖章「里程碑」的狠角色。 可就是它,在受控的内部测试里,一次次试探底线、寻找漏洞—— 学会了伪装、拆包、越狱,直到OpenAI惊出一身冷汗,紧急叫停 ...
MacCheck这种小而实用的开源项目,非常适合收藏。下次购买二手 Mac 前,不妨先让它帮你检查一下。 前段时间发现一个非常实用的开源项目。看到它的时候,我脑海里只有一个想法:为什么我没有早点发现这个工具?😭 如果你最近准备购买二手 Mac,或者从事 ...
GPT-5.6,你怎么又出Bug了??? 继Token刺客后,有网友发现,5.6还会自己悄悄删文件….. 甚至有人表示,整个项目、数据库、工作目录,都在没有自己明确授权的情况下,被模型一键清零。 一时间,𝕏、Reddit上,全是开发者的血泪控诉,受害者名单持续+1中。 其中最惨的一位,非OthersideAI创始人Matt Shumer莫属,自己Mac上的所有文件几乎都被洗劫一空。 GPT-5.
奥特曼紧称OpenAI即将迎来「有史以来最出色的12个月」,团队表现也很出色,「正在迎来让他们满意的结果」。 17日凌晨(,Kimi K3发布,全网刷屏,开源AI迎来第二次「DeepSeek时刻」。 外媒Axios称,K3定价远低于它所挑战的高端模型,美国AI公司的高价策略还能维持多久?巧的是,就在最近,两大巨头正在打客户争夺战。此前,奥特曼在X上发帖,不提新模型,开头就是一句认错: 过去12个月 ...
今年5月,OpenAI公布了一个结果:他们的一个通用推理模型,自主推翻了一个源自Erdős、悬了将近80年的猜想,菲尔兹奖得主高尔斯(Tim Gowers)在配套论文里称之为AI数学的一座里程碑。
今天我把亲手在生产环境里跑通的六个场景摆给你看。看完你就明白:AIOps 不是 PPT 里的概念,是真的能用的。 AIOps 这个词,喊了 10 多年了。 商业产品贵、封闭、黑盒。 开源圈里能找到的,要么是告警降噪脚本,要么是日志分析工具。 真正能把 AI 接进监控 ...
一种语言的语法和API,可以交给工具处理得越来越多。系统为何这样设计,数据怎样穿过不同服务,故障为什么会扩散,产品表现是否符合预期,这些问题仍然需要人来判断。 “会写代码和理解系统怎么运行是两回事,后者不会消失。” ...
7月15日,前谷歌DeepMind科学家Alex Turner宣布辞职。在一篇令人震惊的长文中,他揭露了谷歌如何一步步向五角大楼妥协,最终签下一份「毫无红线」的军事AI协议。 最近,一篇长文震撼整个AI圈。 7月15日,前谷歌DeepMind科学家Alex Turner宣布辞职。 在一篇令人震惊的长文中,他揭露了谷歌如何一步步向五角大楼妥协,最终签下一份「毫无红线」的军事AI协议。 这篇「硅谷现行 ...
一个名为「Basalt Labs」的神秘中国AI实验室,忽然空降。没有任何预热、没有任何预告,他们在X上扔出了一枚重磅消息——发布Monolith-1.0模型,登顶世界第一! 7月18日,AI圈忽然被这个消息刷屏了。 一个名为「Basalt Labs」的神秘中国AI实验室,忽然空降。 即使是 ...
谁把一个 skill 供着不放,谁就还没真正学会用它。当纪律的意思很具体,你今天用 grill-with-docs 对齐,下周发现 domain-model 更顺手,就换,不纠结,不念旧。整篇文章,就绕着「把 skill 当纪律,不当框架」这个立场转。 你让 AI 给项目加个权限控制,它唰唰改了 ...