2026年9月4日凌晨,OpenAI正式发布GPT-6 Astra,官方称其为「迄今为止最强的软件工程模型」。ARC-AGI-3得分99.9%,ExploitBench网络安全测试100%,Coding Agent Index 67与Claude Opus 5持平。同一天前后,OpenAI Agents API进入公测,四层模型矩阵Astra/Sol/Terra/Luna曝光。通用编程智能体平台的 ...
TaoToken 只做统一接入这一层,不替 skill-creator 写技能。它给一把 YOUR_API_KEY 和一个兼容 Base URL,Claude Code 继续用原生 /plugin 、 /skill 工作流。下面按原文节奏,从插件市场安装走到技能创建、评估、验证。
Google 官方宣布,自 2026 年 10 月起,个人账号访问 Gemini 应用的模型可用性将发生重大变更。对于未订阅任何 AI 方案的用户,新政策将于 10 月 9 日生效;订阅 AI Plus 的用户则会收到电子邮件,获知变更的具体生效时间 ...
近日,Anthropic发布了Claude Code的最新版本v2.1.287,其中新增了引人注目的功能——ClaudeMods。这一功能让开发者能够通过编写简单的Type或Java函数,直接参与到事件流中,观察、改写或接管工具调用。这不仅为开发者提供了更大的灵活性,也引发了人们对类似DeepSeek Harness的关注,后者采用服务接口拼装的方式进行功能扩展。 ClaudeMods功能解析 C ...
文章浏览阅读89次。2026年诺贝尔生理学或医学奖授予戴塞罗思、黑格曼与内格尔,表彰他们发现并应用光遗传学技术,利用绿藻感光蛋白实现对神经元的精准光控。这一突破使科学家能以毫秒级精度激活或抑制特定神经元,首次建立大脑活动与行为间的因果关系,推动神经科 ...
21世纪经济报道记者 岑栩2026年9月16日,火山引擎方面宣布,Doubao-Seed-2.1-Pro(0915新版)完成小版本更新,模型API已在火山方舟全量上线。本次豆包App也同步升级,用户下载或升级至最新版,在应用内选取“豆包2.1 Pro ...
Anthropic联创兼CEO达里奥·阿莫迪。图片经由AI处理文丨晓静编辑丨徐青阳9月22日,Anthropic发布Claude 5.5系列的首个模型Opus 5.5。三周前,它刚推出旗舰模型Fable 5.1;如今,Anthropic称,Opus 5.5在大多数工作任务中已达到Fable 5.1的水平。与上一代Opus ...
BT财经 on MSN
成本骤降40%! Claude Opus 5.5打破AI高价定律
2026年9月22日,Anthropic正式推出Claude Opus 5.5——这款产品在AI行业引发了一个反直觉的商业事件。 通常情况下,AI模型性能越强,调用成本越高。但Opus 5.5打破了这一逻辑:它在Terminal-Bench 4.0基准测试中以66.4%的正确率超过前代Opus ...
红板报 on MSNOpinion
Agent 测试分数很漂亮,上线就翻车? Anthropic 给出自动化评估与调优方案
测试满分≠线上能用!Anthropic 这套工具解决 Agent 调优的自欺欺人 拆解 Claude 全新 skill:一键构建评估集 + 自动爬山调优,规避 Agent 过拟合 2026年,AI ...
9月22日,Anthropic发布Claude 5.5系列的首个模型Opus 5.5。 三周前,它刚推出旗舰模型Fable 5.1;如今,Anthropic称,Opus 5.5在大多数工作任务中已达到Fable 5.1的水平。与上一代Opus 5相比,新模型输出速度提高超过30%,输入、输出Token单价下降20%;在默认设置的典型任务中,完成工作的成本降低约40%。性能比较的对象是Fable 5 ...
最抓眼的是 TypeSafe 公布的四个 Workflow 测试:Jev 和 Claude Sonnet 5 的平均准确度同为 67.8%,但单次成本只有后者的 1/293,平均耗时则是 0.4 秒对 78.1 秒。
9月16日,字节跳动(以下简称“字节”)旗下火山引擎宣布豆包大模型Doubao-Seed-2.1-pro更新至0915版本,API全量上线火山方舟,豆包工作同步完成升级,TRAE亦已接入。 新版豆包2.1 Pro模型围绕企业生产级需求,把多模态编程(Multimodal Coding)能力推到国内领先水平 ...
一些您可能无法访问的结果已被隐去。
显示无法访问的结果