五个步骤,五分钟,一行alias命令,GPT-5.6 Sol就堂而皇之地在Claude Code的harness里跑了起来,还被起了个名字叫claudex。
而在2026年7月,就有多方人士爆料,OpenAI即将到来的下一代模型采用全新预训练基础(超越此前约4T token的「Spud」),规模约10T,上下文可能达到1.5M token,对标的是Anthropic的Mythos/Fable。
哈佛+MIT博士领衔、OpenAI、Anthropic、Google DeepMind、xAI等40余人参与、共200多位顶尖科学家,发布MatrAIx,构建83亿个智能体,模拟全世界人类真实行为。 数据来源包括联合国人口统计、General Social Survey、Wikipedia人物志、Amazon真实消费评论、Stack Overflow开发者调查…… ...
Sonnet 5 目前的上下文是 100 万 token,且官方文档明确写了 1M 既是默认值也是最大值、不提供更小的变体。翻倍到 200 万,对着大型代码仓库和长文档集合干活的开发者会直接受益。
散热不再仅仅是一个运维层面的考量,它正成为决定数据中心如何扩展、运行效率如何以及性能有多可靠的决定性因素。随着AI工作负载将基础设施推向新的极限,高效管理热量的能力将直接影响企业能走多远、走多快。
AI 圈知名播客主持人 Dwarkesh Patel 随后发文反驳:只要模型能力仍在快速增长,领先本身就能创造巨大的商业价值;一旦真正的 AGI 出现,它就会主动扩散。
就在刚刚,英国AI安全研究所AISI发布了一份35页事故报告,并在X上同步发文。 这回,AI已经对真人动手了! 就在刚刚,英国AI安全研究所AISI发布了一份35页事故报告,并在X上同步发文。 7分钟内,OpenAI和Anthropic先后跟发声明,承认是自家模型干的。 Mythos 5直接把恶意代码塞进了一个真实GitHub项目。 被抓包后,它第一反应不是停手,而是改记录、开小号、给自己作证,继 ...
Claude Code 的官方文档把它的工作过程描述成一个循环:收集上下文、采取行动、验证结果,然后根据新结果继续。它可以搜索文件、编辑内容、执行命令、运行测试,再根据输出调整下一步。复杂任务里,这个循环可能串起几十个动作。
Jeff Dean 离职创业去了,Pichai 的全员信感谢了 Jeff Dean「了不起的 27 年」,说他要和 Sanjay Ghemawat 一起去创业。他在 𝕏 上发的也是这两个名字。 但 Discovery Loop 官网当天上线,列出的创始人是四位。被谷歌那份公告略过的两位,一位是 Google Brain 联合创始人 Quoc Le,另一位是 Oriol Vinyals —— 他 ...
密码的问题,其实每个人都亲身体验过:要记住、要够复杂、还不能重复使用。于是现实中大多数人的做法是——同一套密码走天下,或者干脆把密码存进浏览器。这就给了撞库攻击、钓鱼网站可乘之机。
如果机器人需要行走、转向、避障以接近目标,它需要一副能够移动的身体;如果机器人需要进一步完成抓取、倒水、叠杯子或拾取纸张等精细任务,它还需要一只足够灵巧的手。长期以来,这两类能力通常由不同的机器人平台分别实现:人形机器人侧重移动与全身交互,灵巧手则专注于物体尺度上的精细操作。这种分工虽然清晰,却也在无形中将机器人系统割裂为两部分:会移动的机器人,手往往不够灵巧;足够灵巧的手,又常常离不开机械臂和固 ...
在OpenAI提出的PaperBench (Code-Dev)上,BigBang跑出了53.6,V4 Pro仅为50.4。它主要考的是大模型复现AI学术论文的能力。 然后把留下的交给AlphaFold,预测抗体与靶标的复合物结构,再用结构置信度和界面指标,评估结构是否稳定、结合是否合理。不达标的就直接淘汰,或者退回上一步重做。