智能体经常去攻击不是预先指定的那些漏洞。GPT-5.5总共拿下210面flag,其中只有120面打的是指定目标;Claude Mythos Preview拿下226面,命中指定目标的157面。 ExploitGym论文里的一条完整利用轨迹。GPT-5.4从一个只在调试版才崩的V8漏洞起步,71分钟、447条命令、229行代码,最后拿到flag,成本15.80美元。
AI时代,企业最大的挑战已经不是拥有先进模型,而是能否改变自己。思科、IBM、安永等企业发现,AI落地的真正瓶颈来自组织惯性、变革管理、战略模糊和决策迟缓。AI带来的价值并非简单提升效率,而是重塑业务流程、工作方式和竞争模式。 随着AI技术的飞速发展 ...
就在今天,GPT-5.6 Pro证伪了图论领域三十年猜想——Dinitz-Garg-Goemans。 30年图论「悬案」,一夜崩塌。 就在今天,GPT-5.6 Pro证伪了图论领域三十年猜想——Dinitz-Garg-Goemans。
这一天,整个数学圈震撼了。一个让无数顶尖数学家折戟,让华人天才数学家张益唐苦熬七年、被迫在赛百味洗盘子的超级数学难题——雅可比猜想,被Fable 5证伪! 这一天,整个数学圈震撼了。
Datadog 近期发布的《2026 年人工智能工程现状报告》引发了业内广泛讨论。这份基于 1000 + 生产环境真实遥测数据的报告,被公认为目前最全面的 AI 生产应用分析。 但作为一名关注系统可靠性与安全的 ...
限制Token看起来像是一种负责任的管理手段,但这就像关掉一台有杂音的收音机,而不是去调准电台频道。在2026年削减AI预算的公司会在2027年发现,他们把那些高效协同的工作流与无效的工作流一并砍掉了。
过去一年,大模型已经逐渐进入金融研究的日常工作流:它可以总结新闻、解释财报、回答股票问题,甚至生成一份结构完整的分析报告。但当这些能力逐渐成为 “标配” 之后,一个更现实的问题开始浮现 —— 金融 AI 的下一步,究竟应该走向哪里?
这些漏洞公告发布的速度与规模,伴随着 AI 辅助安全研究在 Linux 生态系统中日益增长的影响力。 Linux 内核项目在约 24 小时内发布了针对 400 多个漏洞的修复程序。这些漏洞涉及多个领域,包括网络、文件系统、内存管理、蓝牙、虚拟化、驱动程序以及安全组件。 这一波集中的 CVE(常见漏洞与暴露)公告,突显出自动化与人工智能辅助代码分析正加速漏洞发现,同时也给 Linux 管理员带来巨大 ...
英国 AI 安全研究所(AISI)7 月 17 日发布了一份评估报告,第一次公开量化了开源 AI 模型与闭源前沿模型在网络攻击能力上的差距:4 到 7 个月。 GPT-5.6-Sol 的攻防能力超越了 Claude Mythos 5! 英国 AI ...
结果让人哭笑不得——模型能认出这个人是谁,也说得出来他拿过金牌,但给出来的答案却是他现在的纪录,而不是“之前”的。同理,“第25届奥运会期间布达佩斯的市长是谁?”这种带时间窗口约束的问题,Google和ChatGPT都翻了车。
1999年,Yefim Dinitz、Naveen Garg和Michel Goemans发表了单源不可分流领域的经典论文,并证明这种拥堵可以被控制在一定范围内。
一夜之间,Tokenmaxxing成为硅谷热议话题!几个月前,Meta内网搭了个排行榜,追踪全公司8.5万多名员工的Token消耗量。结果,令人咋舌——仅仅30天,Meta员工烧掉了60多万亿个Token,榜一单人刷了2810亿,连小扎都没挤进前250。 一夜之间,Tokenmaxxing成为硅谷热议话题! 几个月前,Meta内网搭了个排行榜,追踪全公司8.5万多名员工的Token消耗量。 结果, ...
Some results have been hidden because they may be inaccessible to you
Show inaccessible results