> ## Documentation Index
> Fetch the complete documentation index at: https://docs.pinkfish.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# kaggle-datasets

> Kaggle Datasets - search, create, and manage datasets

**Server path:** `/kaggle-datasets` | **Type:** Application | **PCID required:** Yes

## Tools

| Tool                                                                                  | Description                   |
| ------------------------------------------------------------------------------------- | ----------------------------- |
| [`kaggle_datasets_create_dataset`](#kaggle_datasets_create_dataset)                   | Create a new dataset          |
| [`kaggle_datasets_create_dataset_version`](#kaggle_datasets_create_dataset_version)   | Create a new dataset version  |
| [`kaggle_datasets_delete_dataset`](#kaggle_datasets_delete_dataset)                   | Delete a dataset              |
| [`kaggle_datasets_get_dataset`](#kaggle_datasets_get_dataset)                         | Get dataset details           |
| [`kaggle_datasets_get_dataset_metadata`](#kaggle_datasets_get_dataset_metadata)       | Get dataset metadata          |
| [`kaggle_datasets_get_dataset_status`](#kaggle_datasets_get_dataset_status)           | Get dataset processing status |
| [`kaggle_datasets_list_dataset_files`](#kaggle_datasets_list_dataset_files)           | List files in a dataset       |
| [`kaggle_datasets_list_datasets`](#kaggle_datasets_list_datasets)                     | List datasets                 |
| [`kaggle_datasets_update_dataset_metadata`](#kaggle_datasets_update_dataset_metadata) | Update dataset metadata       |

***

## kaggle\_datasets\_create\_dataset

Create a new dataset

**Parameters:**

| Parameter      | Type    | Required | Default | Description                                           |
| -------------- | ------- | -------- | ------- | ----------------------------------------------------- |
| `description`  | string  | No       | —       | Full description in markdown                          |
| `is_private`   | boolean | No       | —       | Whether the dataset is private                        |
| `license_name` | string  | Yes      | —       | License type (e.g. CC0-1.0, CC-BY-4.0, GPL-2.0, etc.) |
| `owner_slug`   | string  | Yes      | —       | Owner username for the dataset                        |
| `slug`         | string  | Yes      | —       | URL-friendly identifier for the dataset               |
| `subtitle`     | string  | No       | —       | Short subtitle for the dataset                        |
| `title`        | string  | Yes      | —       | Display title for the dataset                         |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "description": {
        "type": "string",
        "description": "Full description in markdown"
      },
      "is_private": {
        "type": "boolean",
        "description": "Whether the dataset is private"
      },
      "license_name": {
        "type": "string",
        "description": "License type (e.g. CC0-1.0, CC-BY-4.0, GPL-2.0, etc.)"
      },
      "owner_slug": {
        "type": "string",
        "description": "Owner username for the dataset"
      },
      "slug": {
        "type": "string",
        "description": "URL-friendly identifier for the dataset"
      },
      "subtitle": {
        "type": "string",
        "description": "Short subtitle for the dataset"
      },
      "title": {
        "type": "string",
        "description": "Display title for the dataset"
      }
    },
    "required": [
      "PCID",
      "license_name",
      "owner_slug",
      "slug",
      "title"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_create\_dataset\_version

Create a new dataset version

**Parameters:**

| Parameter      | Type   | Required | Default | Description              |
| -------------- | ------ | -------- | ------- | ------------------------ |
| `body`         | object | Yes      | —       | Version creation body    |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier  |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "body": {
        "type": "object",
        "description": "Version creation body",
        "properties": {
          "version_notes": {
            "type": "string",
            "description": "Notes describing this version"
          },
          "subtitle": {
            "type": "string",
            "description": "Updated subtitle"
          },
          "description": {
            "type": "string",
            "description": "Updated description"
          },
          "delete_old_versions": {
            "type": "boolean",
            "description": "Whether to delete old versions"
          }
        }
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      }
    },
    "required": [
      "PCID",
      "body",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_delete\_dataset

Delete a dataset

**Parameters:**

| Parameter      | Type   | Required | Default | Description              |
| -------------- | ------ | -------- | ------- | ------------------------ |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier  |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_get\_dataset

Get dataset details

**Parameters:**

| Parameter      | Type   | Required | Default | Description              |
| -------------- | ------ | -------- | ------- | ------------------------ |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier  |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_get\_dataset\_metadata

Get dataset metadata

**Parameters:**

| Parameter      | Type   | Required | Default | Description              |
| -------------- | ------ | -------- | ------- | ------------------------ |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier  |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_get\_dataset\_status

Get dataset processing status

**Parameters:**

| Parameter      | Type   | Required | Default | Description              |
| -------------- | ------ | -------- | ------- | ------------------------ |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier  |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_list\_dataset\_files

List files in a dataset

**Parameters:**

| Parameter                | Type    | Required | Default | Description                               |
| ------------------------ | ------- | -------- | ------- | ----------------------------------------- |
| `dataset_slug`           | string  | Yes      | —       | Dataset slug/identifier                   |
| `dataset_version_number` | string  | No       | —       | Specific version number (omit for latest) |
| `owner_slug`             | string  | Yes      | —       | Dataset owner's username                  |
| `page_size`              | integer | No       | —       | Results per page                          |
| `page_token`             | string  | No       | —       | Pagination token                          |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "dataset_version_number": {
        "type": "string",
        "description": "Specific version number (omit for latest)"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      },
      "page_size": {
        "type": "integer",
        "description": "Results per page"
      },
      "page_token": {
        "type": "string",
        "description": "Pagination token"
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_list\_datasets

List datasets

**Parameters:**

| Parameter    | Type    | Required | Default | Description                                            |
| ------------ | ------- | -------- | ------- | ------------------------------------------------------ |
| `file_type`  | string  | No       | —       | Filter by file type: csv, sqlite, json, bigQuery       |
| `group`      | string  | No       | —       | Filter group                                           |
| `license`    | string  | No       | —       | Filter by license type                                 |
| `max_size`   | integer | No       | —       | Maximum dataset size in bytes                          |
| `min_size`   | integer | No       | —       | Minimum dataset size in bytes                          |
| `page`       | integer | No       | —       | Page number                                            |
| `page_size`  | integer | No       | —       | Results per page                                       |
| `page_token` | string  | No       | —       | Pagination token                                       |
| `search`     | string  | No       | —       | Search terms to filter datasets                        |
| `sort_by`    | string  | No       | —       | Sort order: hottest, votes, updated, active, published |
| `tag_ids`    | string  | No       | —       | Comma-separated tag IDs to filter by                   |
| `user`       | string  | No       | —       | Filter by dataset owner username                       |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "file_type": {
        "type": "string",
        "description": "Filter by file type: csv, sqlite, json, bigQuery",
        "enum": [
          "csv",
          "sqlite",
          "json",
          "bigQuery"
        ]
      },
      "group": {
        "type": "string",
        "description": "Filter group"
      },
      "license": {
        "type": "string",
        "description": "Filter by license type"
      },
      "max_size": {
        "type": "integer",
        "description": "Maximum dataset size in bytes"
      },
      "min_size": {
        "type": "integer",
        "description": "Minimum dataset size in bytes"
      },
      "page": {
        "type": "integer",
        "description": "Page number"
      },
      "page_size": {
        "type": "integer",
        "description": "Results per page"
      },
      "page_token": {
        "type": "string",
        "description": "Pagination token"
      },
      "search": {
        "type": "string",
        "description": "Search terms to filter datasets"
      },
      "sort_by": {
        "type": "string",
        "description": "Sort order: hottest, votes, updated, active, published",
        "enum": [
          "hottest",
          "votes",
          "updated",
          "active",
          "published"
        ]
      },
      "tag_ids": {
        "type": "string",
        "description": "Comma-separated tag IDs to filter by"
      },
      "user": {
        "type": "string",
        "description": "Filter by dataset owner username"
      }
    },
    "required": [
      "PCID"
    ]
  }
  ```
</Expandable>

***

## kaggle\_datasets\_update\_dataset\_metadata

Update dataset metadata

**Parameters:**

| Parameter      | Type   | Required | Default | Description                |
| -------------- | ------ | -------- | ------- | -------------------------- |
| `dataset_slug` | string | Yes      | —       | Dataset slug/identifier    |
| `owner_slug`   | string | Yes      | —       | Dataset owner's username   |
| `settings`     | object | No       | —       | Dataset settings to update |

<Expandable title="inputSchema">
  ```json theme={null}
  {
    "type": "object",
    "properties": {
      "PCID": {
        "type": "string",
        "description": "Pink Connect ID for the authenticated connection"
      },
      "dataset_slug": {
        "type": "string",
        "description": "Dataset slug/identifier"
      },
      "owner_slug": {
        "type": "string",
        "description": "Dataset owner's username"
      },
      "settings": {
        "type": "object",
        "description": "Dataset settings to update",
        "properties": {
          "title": {
            "type": "string",
            "description": "Dataset title"
          },
          "subtitle": {
            "type": "string",
            "description": "Dataset subtitle"
          },
          "description": {
            "type": "string",
            "description": "Dataset description"
          },
          "is_private": {
            "type": "boolean",
            "description": "Whether the dataset is private"
          },
          "keywords": {
            "type": "array",
            "items": {
              "type": "string"
            },
            "description": "Keywords/tags for the dataset"
          }
        }
      }
    },
    "required": [
      "PCID",
      "dataset_slug",
      "owner_slug"
    ]
  }
  ```
</Expandable>
