# Что в этих данных / What is in this data

## RU

**Файл:** `agentivity_pilot_2026-07-08.csv` — 1012 заголовков Google News за 8 июля 2026, 11 стран (симметричная выборка).

**Что измерялось.** Для каждого заголовка определялось, КТО в нём действует, когда речь идёт о действии страны:

| final_class | Значение |
|---|---|
| 0 | страна в заголовке не является действующим лицом (спорт, упоминание, контекст) |
| 1 | действует **названный человек** («Trump says…») |
| 2 | действует **названный институт** («Kremlin says…», «U.S. Navy…») |
| 3 | **столица-метонимия** («Beijing is looking at…») |
| 4 | **страна-монолит** («Russia strikes…», «US hits…») |

`stage` — как получена метка: `rules` (автоправило), `llm:claude` (разбор LLM), `auto:sport`/`auto:prep` (автофильтры нерелевантного).

**Индекс агентности** = доля (1+2) среди субъектных заголовков (1–4). За 8 июля: 55/236 = **23%**.

**Что эти данные НЕ измеряют.** Они ничего не говорят о поведении, характере или «прозрачности» государств. Низкий процент у страны — упрёк **заголовкам** (редакции реже называют автора действий), а не стране и не её людям. Рейтинг меряет точность, не лояльность.

**Статус надёжности.** Разметка выполнена правилами + LLM и **пока не прошла независимую валидацию** — это первая задача соратников проекта. Цифры одного дня — направление, не закон.

## EN

**File:** `agentivity_pilot_2026-07-08.csv` — 1,012 Google News headlines from July 8, 2026, 11 countries (symmetric sample).

**What was measured.** For each headline: WHO acts in it when a country's action is reported. `final_class`: 0 = the country is not the actor (sport/mention/context); 1 = a **named person** acts; 2 = a **named institution**; 3 = **capital-as-metonymy** ("Beijing is looking at…"); 4 = **country-as-monolith** ("Russia strikes…"). `stage` = how the label was produced: `rules`, `llm:claude`, `auto:sport`/`auto:prep`.

**Agentivity Index** = share of (1+2) among subject headlines (1–4). For July 8: 55/236 = **23%**.

**What this data does NOT measure.** Nothing about the behavior, character or "transparency" of states. A low score faults the **headlines** (editors name the author of this country's actions less often) — not the country, not its people. The rating measures precision, not loyalty.

**Reliability status.** Labels are rules + LLM and **have not yet passed independent validation** — that is the first task for the project's collaborators. One day's numbers are a direction, not a law.
