Enable Local Models (WebGPU) in Settings
Run downloaded Transformers.js models locally in your browser with WebGPU acceleration. Models are cached for offline use and all inference happens on your device.
| Field | Type | Required | Description |
|---|---|---|---|
| modelId | text | Optional | Model from your downloaded collection |
Add provider:
npx webinfer provider add localTest connection:
npx webinfer provider test localBasic usage:
import { generateText } from "webinfer"
// WebInfer automatically routes to the best available provider
const result = await generateText({
prompt: "Write a haiku about programming"
})
console.log(result.text)Specify Local Models (WebGPU) explicitly:
import { generateText } from "webinfer"
const result = await generateText({
prompt: "Write a haiku about programming",
provider: "local"
})
console.log(result.text)
console.log("Provider:", result.provider)
console.log("Model:", result.model)Streaming:
import { streamText } from "webinfer"
const { textStream } = await streamText({
prompt: "Write a story about AI",
provider: "local"
})
for await (const chunk of textStream) {
process.stdout.write(chunk)
}