

# Memulai
<a name="datasets-getting-started"></a>

Topik ini menyediakan alur kerja ujung ke ujung untuk membuat, mengisi, dan menerbitkan kumpulan data.

## Skema dataset
<a name="datasets-gs-schema-overview"></a>

Setiap dataset mendeklarasikan a `schemaType` pada waktu pembuatan. AgentCore memvalidasi setiap contoh terhadap skema yang dideklarasikan sebelum menerimanya. Dua jenis skema didukung:
+  **AGENTCORE\_EVALUATION\_PREDEFINED\_V1 — Untuk agen pengujian terhadap giliran percakapan yang telah ditulis sebelumnya**. Bidang wajib:`scenario_id`, `turns` (daftar tidak kosong; setiap giliran harus berisi`input`).
+  **AGENTCORE\_EVALUATION\_SIMULATED\_V1** — Untuk pembuatan percakapan sintetis. Bidang wajib:`scenario_id`, `actor_profile` (objek dengan wajib `context` dan`goal`),`input`.

Untuk definisi bidang skema lengkap, contoh, dan pemetaan kebenaran dasar, lihat Skema [kumpulan data](dataset-evaluations-schema.md).

## End-to-end alur kerja
<a name="datasets-gs-workflow"></a>

Contoh berikut menunjukkan siklus hidup set data lengkap: membuat, menambahkan contoh, daftar contoh, menerbitkan versi, dan membersihkan.

**Example**  

1. 

   ```
   # 1. Create dataset
   agentcore add dataset --name my_eval_dataset \
       --schema-type AGENTCORE_EVALUATION_PREDEFINED_V1
   
   # 2. Add your scenarios to the JSONL file
   #    File: agentcore/datasets/my_eval_dataset.jsonl
   
   # 3. Deploy to create the dataset and sync examples
   agentcore deploy
   
   # 4. Publish version 1
   agentcore dataset publish-version --name my_eval_dataset
   
   # 5. Check status (shows versions and example count)
   agentcore status --type dataset
   
   # 6. Download a published version to local file
   agentcore dataset download --name my_eval_dataset --version 1
   
   # 7. Cleanup
   agentcore remove dataset --name my_eval_dataset
   agentcore deploy
   ```

1. 

   ```
   from bedrock_agentcore.evaluation import DatasetClient
   
   client = DatasetClient(region_name="us-west-2")
   
   # 1. Create dataset (polls until ACTIVE)
   ds = client.create_dataset_and_wait(
       datasetName="my_eval_dataset",
       schemaType="AGENTCORE_EVALUATION_PREDEFINED_V1",
       source={
           "inlineExamples": {
               "examples": [
                   {
                       "scenario_id": "TC-01",
                       "turns": [{"input": "What is my balance?", "expected_response": "Your balance is $50."}],
                       "assertions": ["Response includes a dollar amount"],
                   }
               ]
           }
       },
   )
   dataset_id = ds["datasetId"]
   print(f"Created: {dataset_id}, status={ds['status']}")
   
   # 2. Add more examples
   ds = client.add_examples_and_wait(
       datasetId=dataset_id,
       source={
           "inlineExamples": {
               "examples": [
                   {"scenario_id": "TC-02", "turns": [{"input": "Transfer $100", "expected_response": "Transfer complete."}]}
               ]
           }
       },
   )
   print(f"Example count: {ds['exampleCount']}")
   
   # 3. List examples
   resp = client.list_dataset_examples(datasetId=dataset_id)
   for example in resp["examples"]:
       print(f"  {example['exampleId']}: {example['scenario_id']}")
   
   # 4. Publish version 1
   ds = client.create_dataset_version_and_wait(datasetId=dataset_id)
   print(f"Published, draftStatus: {ds.get('draftStatus')}")
   
   # 5. List versions
   resp = client.list_dataset_versions(datasetId=dataset_id)
   for v in resp["versions"]:
       print(f"  Version {v['datasetVersion']}: {v['exampleCount']} examples")
   
   # 6. Cleanup
   client.delete_dataset_and_wait(datasetId=dataset_id)
   ```