林晓今天想和大家聊一个“小个子”模型。美国时间10月7日,Anthropic在官网发布了新模型Claude Haiku 5.5,文章英文标题是《Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we’ve ever released》,按字面意思译成中文,就是“推出Claude Hai ...
2026年9月27日,科技圈突然刮起一阵‘超音速’风——不是SpaceX的火箭点火,也不是英伟达新卡发布,而是一则来自OpenAI内部文档的蛛丝马迹:Ultrafast API,这个曾被少数头部企业攥在手心、连开发者社区都只能隔着玻璃窗偷瞄的‘AI超跑模式’,正悄悄松动闸门,准备驶向更广阔的应用平原。 没错,你没听错——Ultrafast API,这个让GPT-5.6Sol模型峰值输出飙到每秒75 ...
2025年,有一件事让做GPU编程的人挺不是滋味的:一个叫cudaLLM的模型,砸了128块H100显卡去训练,结果在KernelBench Level 1这个基础测试集上,十次尝试里也就八成能对。 这是什么概念? 你花了相当于几十万美元的算力,训出来的模型,写十个GPU程序,还有两个是错的。而这些还只是最简单的单算子任务,比如卷积、矩阵乘法这类基础操作。 问题出在哪?不是模型不够聪明,是喂给它的 ...
Opus 5.5 并非一次常规的半代升级。官方称,它在多数任务上的表现已经达到 Claude Fable 5.1 水平,相比 Opus 5 的典型任务成本降低 40%,输出速度提高超过 30%。 Anthropic 将 Opus 5.5 定位为面向长时间编程 Agent 和知识工作的主力模型。从官方公布的成绩看,它在 Agent 编程、电脑操作和专业工作上都取得了明显提升。
最近 Jev 模型被搬进了各种 Agent。 Browser-Use 开源了 jev-ultrafast,把 Jev API 接进浏览器操作流程《基于Jev的浏览器Agent插件开源,狂揽12.1k star!》。APUS 开源了纯本地的 ...
文章浏览阅读140次。2026年9月1日到11日,海内外7家头部模型厂商迭代了新模型。过去大模型的升级周期以年计算,后来缩短到几个月,如今已经开始以周为单位。据OpenRouter平台数据,DeepSeek V4.1 Flash在发布24小时内被处理了约1万亿Token。当模型迭代进入“周更时代”,一个越来越尖锐的工程问题浮出水面:你的应用架构,跟得上这个节奏吗?
ENVIRONMENT: A cutting-edge global FinTech company seeks the coding talents of a Full Stack Developer who is passionate about building scalable systems, joining its team on a mission to provide ...
OpenAI’s Decisions API enters public beta, returning typed answers about 10x faster at $0.10 per 1M input tokens.
Anthropic calls Haiku its fastest model at standard speeds, while acknowledging that Opus in Fast Mode runs faster. It does ...
Generate text and code, create images and video, build voice agents, and search the web in real time, all through one API.
"I was running AI agents autonomously, and my API bill reached tens of thousands of yen in no time..." "I just want to ...