OpenAI 6. září zveřejnilo interní měření využívání agentů ve výzkumu. Uvádí 3,1 osmihodinového agentního pracovního dne na jeden den lidské práce.

Tento poměr měří běh nástrojů, nikoli násobek vědecké produktivity. Firma zaznamenala více experimentů, současně však rostly její výpočetní kapacity.

Doprovodný esej Jakuba Pachockého zdůrazňuje nevyřešenou otázku kontroly stále schopnějších systémů. Jde o stanovisko vedoucího výzkumu, nikoli nezávislou předpověď.

Možné využití podobného měření vidíme v odhalování úzkých míst laboratoře: kde agent šetří čas a kde přidává kontrolní práci. Smysluplné srovnání musí zahrnout kvalitu výsledků, náklady i opravy chyb.

Redakční odhad: vlastní měřené piloty mohou týmy zavést během 1–6 měsíců. Termín spolehlivého autonomního vědce z těchto dat odvodit nelze.