AIが「難しいバグ」は全問正解し「簡単なバグ」で全滅した理由 — 28回の実験が示す「情報の欠如」という盲点
DRANK

8月23日、Towards Data Scienceが「Bug Detection Blind Spots in AI Coding Harnesses (GStack and Beyond)」と題した記事を公開した。この記事では、AIコーディングエージェントが「難しいバグ」より「情報が欠如した簡単なバグ」で失敗するという、28回の実験から得られた知見について詳しく紹介されている。

by @tf_official
Related Topics: AI AI Code Generator Software testing