Enable Transformers.js in Settings
Run Hugging Face Transformers models directly in the browser or server-side using WebGPU/WebAssembly. No API keys required, fully local inference with support for chat, vision, embeddings, and transcription.
| Field | Type | Required | Description |
|---|---|---|---|
| modelId | text | Required | Hugging Face model ID (e.g., HuggingFaceTB/SmolLM2-360M-Instruct, Xenova/whisper-base) |
| device | text | Optional | Inference device: auto, cpu, webgpu, or gpu |
| dtype | text | Optional | Model precision: auto, fp32, fp16, q8, q4, or q4f16 |
Add provider:
npx webinfer provider add transformersjsTest connection:
npx webinfer provider test transformersjsBasic usage:
import { generateText } from "webinfer"
// WebInfer automatically routes to the best available provider
const result = await generateText({
prompt: "Write a haiku about programming"
})
console.log(result.text)Specify Transformers.js explicitly:
import { generateText } from "webinfer"
const result = await generateText({
prompt: "Write a haiku about programming",
provider: "transformersjs",
model: "HuggingFaceTB/SmolLM2-360M-Instruct"
})
console.log(result.text)
console.log("Provider:", result.provider)
console.log("Model:", result.model)Streaming:
import { streamText } from "webinfer"
const { textStream } = await streamText({
prompt: "Write a story about AI",
provider: "transformersjs"
})
for await (const chunk of textStream) {
process.stdout.write(chunk)
}