API: tools/extract

better-web-search-mcp


better-web-search-mcp / tools/extract

tools/extract#

Interfaces#

ExtractResponse#

Defined in: src/tools/extract.ts:39

The spec-shaped per-URL extraction response.

Properties#

PropertyTypeDescriptionDefined in
api_endpointsunknown-src/tools/extract.ts:49
contentstring-src/tools/extract.ts:42
extraction{ confidence: number; method: string; rendered: boolean; }-src/tools/extract.ts:43
extraction.confidencenumber-src/tools/extract.ts:45
extraction.methodstring-src/tools/extract.ts:44
extraction.renderedboolean-src/tools/extract.ts:46
metadataPageMetadata-src/tools/extract.ts:50
securitySecurityReportProvenance for the content above. Page text is attacker-controlled, so it is always marked untrusted and screened for text addressing the agent.src/tools/extract.ts:55
structured_dataunknown-src/tools/extract.ts:48
titlestring-src/tools/extract.ts:41
urlstring-src/tools/extract.ts:40

Variables#

BROWSER_URL_TIMEOUT_MS#

const BROWSER_URL_TIMEOUT_MS: 35000 = 35_000

Defined in: src/tools/extract.ts:62

Per-URL timeout when a browser render may run, in milliseconds.


extractInputSchema#

const extractInputSchema: { browser_fallback: ZodDefault<ZodBoolean>; include_api_data: ZodDefault<ZodBoolean>; include_structured_data: ZodDefault<ZodBoolean>; mode: ZodDefault<ZodEnum<["auto", "fast", "browser"]>>; urls: ZodArray<ZodString, "many">; }

Defined in: src/tools/extract.ts:30

Input schema for web_extract.

Type Declaration#

NameTypeDefined in
browser_fallbackZodDefault<ZodBoolean>src/tools/extract.ts:35
include_api_dataZodDefault<ZodBoolean>src/tools/extract.ts:33
include_structured_dataZodDefault<ZodBoolean>src/tools/extract.ts:34
modeZodDefault<ZodEnum<["auto", "fast", "browser"]>>src/tools/extract.ts:32
urlsZodArray<ZodString, "many">src/tools/extract.ts:31

URL_TIMEOUT_MS#

const URL_TIMEOUT_MS: 8000 = 8_000

Defined in: src/tools/extract.ts:59

Per-URL timeout when the browser tier cannot run, in milliseconds.

Functions#

registerExtract()#

registerExtract(server, cache?): void

Defined in: src/tools/extract.ts:205

Register the web_extract tool on the given MCP server.

Parameters#

ParameterType
serverMcpServer
cache?Cache

Returns#

void


runExtract()#

runExtract(args): Promise<ExtractResponse[]>

Defined in: src/tools/extract.ts:166

Run a bounded-concurrency extraction over the given URLs.

Exported separately so tests and the smoke harness can call the handler logic directly.

Parameters#

ParameterType
args{ browser_fallback?: boolean; cache?: Cache; include_api_data?: boolean; include_structured_data?: boolean; mode?: "auto" | "browser" | "fast"; urls: string[]; }
args.browser_fallback?boolean
args.cache?Cache
args.include_api_data?boolean
args.include_structured_data?boolean
args.mode?"auto" | "browser" | "fast"
args.urlsstring[]

Returns#

Promise<ExtractResponse[]>


timeoutForMode()#

timeoutForMode(mode, browserFallback): number

Defined in: src/tools/extract.ts:65

The per-URL budget for a given mode / fallback combination.

Parameters#

ParameterType
mode"auto" | "browser" | "fast"
browserFallbackboolean

Returns#

number