就在刚刚,Anthropic 发布了 Claude Haiku 5.5,单价只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一个价。 官方跑分表里 Luna 交了成绩的六项全输给了它,好几项还咬住了 Sonnet。 操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11 ...
2026年10月10日,全球科技圈突然抖了三抖——不是因为某款新机发布,也不是某家巨头裁员,而是谷歌悄悄点亮了一颗新星:代号‘Carbon’的Gemini 4正式进入内部灰度测试阶段。没错,你没看错,这不是预告片,是正在发生的现实。就在ChatGPT-5还在PPT里加班、Meta的Llama 4尚在调参实验室打哈欠的当口,谷歌已把Gemini 4的‘Carbon’版本塞进工程师的IDE里,让代码自 ...
今天,外网被这个视频刷屏了。 有人用Fable 5.5一键生成了一部「人类数万年进化史」,把整个人类历史压缩进了3分钟。 整个过程,都是用纯代码写出,零视频素材,零版权音乐,没有使用任何视频生成模型。 这部震撼短片,在X和Reddit上传疯了。
Anthropic 最新官宣了一个叫 Anthropic Cyber Mission 的长期计划,要拿自家的模型、工程师和钱,去帮防守方把大家都在依赖的系统们做好防守。 Cyber Mission 官宣 第一批落地的有两件事。
Anthropic 于 2026 年 10 月 8 日宣布了 Anthropic 网络任务,并将其描述为一项帮助保护公众依赖系统的长期努力。该计划由两个项目启动:由 11 家创始合作伙伴支持的关键基础设施防御计划,以及 OSS Scanner——一项免费自愿加入的服务,利用公司最强大的模型对开源软件进行定期安全扫描。 Anthropic 表示,前沿模型可能被滥用于利用漏洞和进行网络行动,且国家支持 ...
给定一个基座模型、一个目标能力和算力预算,RSI Agent 自己设计后训练算法、收集和整理数据、写代码、跑实验、迭代改进,最终交出一个训练好的模型,全程无人介入。在自主后训练基准 PostTrainBench 上,它以 46.6 分排名第一,超过所有前沿模型与 Agent 系统,接近人类专家表现(51.1)。近日,AIBuildAI 团队发布了 PostTrain Agent,一个用于自主后训练 ...
文章浏览阅读28次。更准确的理解是,头部公司把"能自己定的部分"自己定掉,把"必须外购的部分"继续外购——不是替代,是分工再切一刀。对做 AI ...
covering all the hot paths through the loop. the VM would start tracing there. When the inner loop exits, the VM would detect that a different branch was taken. The VM would try to record a branch ...
过去十年间,机器学习在医学领域扮演着日益重要的角色。然而,许多正在开发和部署的最先进模型缺乏透明度,限制了其融入临床决策过程,并引发了对患者安全的担忧。在此,研究人员呼吁关注符号回归(symbolic regression, SR)——一种在很大程度上被忽视的 ...
Python 3.15 is out today as the newest annual feature release for the Python programming language. Python's JIT compiler is ...
Python 3.15 introduces lazy imports, UTF-8 as the default encoding, faster experimental JIT performance, and new profiling ...
Hello. Today, I am sharing this in the hope that it might be helpful to someone who has encountered their first error while ...