Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Este guia mostra como executar a inferência de modelos ONNX no Electron usando bindings JS para as APIs de ML do SDK do Aplicativo Windows (detecção do provedor de execução via ExecutionProviderCatalog e download do modelo via ModelCatalog), combinadas com onnxruntime-node para inferência — sem exigir um complemento em C#. A inferência é executada em um processo do utilitário Electron para que ele não bloqueie o processo principal.
Pré-requisitos
Antes de iniciar este guia, verifique se você:
- Concluiu a configuração do ambiente de desenvolvimento.
Instalar o ONNX Runtime para Node:
npm install onnxruntime-node@1.24.3
Important
O aplicativo do Windows Runtime carrega previamente seu próprio onnxruntime.dll nos processos filho. A versão onnxruntime-node deve corresponder à ABI ORT incluída na sua versão do SDK do Aplicativo Windows. Para SDK do Aplicativo Windows 2.x, use onnxruntime-node@1.24.x.
Etapa 1: Confirmar associações WinML
O SDK do Aplicativo Windows depende transitivamente de Microsoft.WindowsAppSDK.ML, portanto as APIs WinML já estão nos seus bindings gerados. Verificar:
Requer
@microsoft/dynwinrt-codegen≥0.1.0-preview.8— consulte Primeiros passos com o Electron para alternativas para projetos antigos.
node -e "console.log(Object.keys(require('#winapp/bindings')).filter(k => k.startsWith('ExecutionProvider')))"
Você deve ver [ 'ExecutionProvider', 'ExecutionProviderCatalog', 'ExecutionProviderReadyState' ].
Etapa 2: Baixar o modelo por meio do Catálogo de Modelos (processo principal)
Use ModelCatalog dos bindings JS para baixar e armazenar o modelo localmente em cache. O catálogo lê um manifesto JSON (hospedado remotamente ou localmente) que descreve os modelos disponíveis e suas URLs de download. Após o primeiro download, as execuções subsequentes usam a cópia armazenada em cache:
Criar src/winml-model.js:
const { ModelCatalog, ModelCatalogSource, Uri } = require('#winapp/bindings');
const fs = require('node:fs');
const path = require('node:path');
// Remote catalog JSON hosted in the WindowsAppSDK-Samples repo
const MODEL_CATALOG_URL =
'https://raw.githubusercontent.com/microsoft/WindowsAppSDK-Samples/main/Samples/WindowsML/Resources/SqueezeNetModelCatalog.json';
async function downloadModel(modelId, onProgress) {
const uri = Uri.createUri(MODEL_CATALOG_URL);
const source = await ModelCatalogSource.createFromUriAsync(uri);
const catalog = ModelCatalog.createInstance([source]);
const model = await catalog.findModelAsync(modelId);
const op = model.getInstanceAsync();
if (onProgress) {
op.progress((value) => {
try { onProgress(value); } catch {}
});
}
const result = await op;
const instance = result.getInstance();
if (!instance) return undefined;
const paths = instance.modelPaths;
// modelPaths returns directories containing model files
for (let i = 0; i < paths.size; i++) {
const dir = paths.getAt(i);
if (fs.existsSync(dir) && fs.statSync(dir).isDirectory()) {
const onnx = fs.readdirSync(dir).find((f) => f.endsWith('.onnx'));
if (onnx) {
instance.close();
return path.join(dir, onnx);
}
} else if (dir.endsWith('.onnx')) {
instance.close();
return dir;
}
}
instance.close();
return undefined;
}
module.exports = { downloadModel };
Etapa 3: Descobrir e garantir provedores de execução (processo principal)
Use ExecutionProviderCatalog para listar provedores disponíveis (CPU, DirectML, QNN/NPU) e ensureReadyAsync para baixar o runtime, se necessário:
Criar src/winml-ep.js:
const { ExecutionProviderCatalog, ExecutionProviderReadyState, ExecutionProviderReadyResultState } = require('#winapp/bindings');
function listProviders() {
const catalog = ExecutionProviderCatalog.getDefault();
return catalog.findAllProviders().map((p) => ({
name: p.name,
readyState: p.readyState,
libraryPath: p.libraryPath,
}));
}
async function ensureProviderReady(providerName, onProgress) {
const catalog = ExecutionProviderCatalog.getDefault();
const providers = catalog.findAllProviders();
const provider = providers.find((p) => p.name === providerName);
if (!provider) {
throw new Error(`Execution provider not found: ${providerName}`);
}
if (provider.readyState === ExecutionProviderReadyState.Ready) {
return { name: provider.name, readyState: 'Ready', libraryPath: provider.libraryPath };
}
const op = provider.ensureReadyAsync();
if (onProgress) {
op.progress((value) => {
try { onProgress(value); } catch {}
});
}
const result = await op;
let readyState;
if (result.status === ExecutionProviderReadyResultState.Success) readyState = 'Ready';
else if (result.status === ExecutionProviderReadyResultState.Failure) readyState = 'Failed';
else readyState = 'InProgress';
return {
name: provider.name,
readyState,
diagnosticText: result.diagnosticText,
libraryPath: provider.libraryPath,
};
}
module.exports = { listProviders, ensureProviderReady };
Etapa 4: Executar inferência em um processo de utilitário
A criação de sessão e a inferência no ONNX Runtime são operações bloqueantes — execute essas tarefas em um processo utilitário do Electron para manter o processo principal responsivo.
4.1. Criar o trabalho
Criar src/winml-worker.js (este arquivo é executado em um processo de utilitário):
const { roInitialize } = require('@microsoft/dynwinrt');
// When dynwinrt and onnxruntime-node share the same process, ORT's native
// init can leave the COM apartment uninitialized. Explicitly init MTA first.
roInitialize(1);
const ort = require('onnxruntime-node');
async function runModel(modelPath, inputData, inputShape, ep) {
const providers = ep === 'dml'
? [{ name: 'dml', deviceId: 0 }, 'cpu']
: ['cpu'];
const session = await ort.InferenceSession.create(modelPath, {
executionProviders: providers,
graphOptimizationLevel: 'all',
});
const inputName = session.inputNames[0];
const input = new ort.Tensor('float32', inputData, inputShape);
const outputs = await session.run({ [inputName]: input });
return Array.from(outputs[session.outputNames[0]].data);
}
process.parentPort.on('message', async (e) => {
const { id, method, args } = e.data;
try {
if (method === 'classify') {
const [modelPath, inputData, inputShape, ep] = args;
const result = await runModel(modelPath, new Float32Array(inputData), inputShape, ep);
process.parentPort.postMessage({ id, ok: true, result });
}
} catch (err) {
process.parentPort.postMessage({ id, ok: false, error: err.message });
}
});
4.2. Iniciar e chamar o worker da thread principal
Adicione o seguinte ao seu src/index.js:
const { utilityProcess } = require('electron');
const path = require('node:path');
const { listProviders, ensureProviderReady } = require('./winml-ep.js');
const { downloadModel } = require('./winml-model.js');
let worker = null;
let workerReady = null;
const pending = new Map();
let nextId = 1;
function startWinmlWorker() {
worker = utilityProcess.fork(path.join(__dirname, 'winml-worker.js'), [], {
stdio: 'pipe',
serviceName: 'winml-worker',
});
worker.on('message', (msg) => {
const entry = pending.get(msg.id);
if (!entry) return;
pending.delete(msg.id);
if (msg.ok) entry.resolve(msg.result);
else entry.reject(new Error(msg.error));
});
workerReady = new Promise((resolve) => worker.once('spawn', resolve));
}
async function classify(modelPath, inputData, inputShape, ep) {
if (!worker) startWinmlWorker();
await workerReady;
return new Promise((resolve, reject) => {
const id = nextId++;
pending.set(id, { resolve, reject });
worker.postMessage({ id, method: 'classify', args: [modelPath, Array.from(inputData), inputShape, ep] });
});
}
4.3. Utilizar
Verifique se sua createWindow função está async, em seguida, adicione:
const createWindow = async () => {
// ... existing window creation code ...
// List and ensure all execution providers are ready
const providers = listProviders();
console.log('Available providers:', providers);
for (const ep of providers) {
console.log(`Ensuring ${ep.name} is ready...`);
const result = await ensureProviderReady(ep.name, (progress) => {
const pct = progress <= 1 ? Math.round(progress * 100) : Math.round(progress);
process.stdout.write(`\r ${ep.name}: ${pct}%`);
});
process.stdout.write('\n');
console.log(` ${ep.name}: ${result.readyState}`);
}
// Download model via Model Catalog (cached after first run)
console.log('Downloading model...');
const modelPath = await downloadModel('squeezenet', (progress) => {
if (progress >= 0 && progress <= 100) {
process.stdout.write(`\rDownloading model: ${Math.round(progress)}%`);
}
});
process.stdout.write('\n');
console.log('Model path:', modelPath);
// Run inference in utility process (replace with real preprocessed data)
const inputData = new Float32Array(1 * 3 * 224 * 224);
const output = await classify(modelPath, inputData, [1, 3, 224, 224], 'dml');
console.log('Model output (top 5 values):', output.slice(0, 5));
};
Etapa 5: Execute-o
npx winapp node add-electron-debug-identity
npm start
Você deve ver os provedores de execução disponíveis e a saída do modelo no console.
Tip
Para obter um pipeline completo de classificação de imagem com decodificação de imagem por meio de associações JS (StorageFile, BitmapDecoder, BitmapTransform), consulte o exemplo WinML da Galeria de Elétrons.
Próximas etapas
Parabéns! Você está executando os provedores de execução do WinML e o ONNX Runtime a partir do JavaScript — sem necessidade de uma extensão em C#. 🎉
Agora você está pronto para:
- Empacotar seu aplicativo para distribuição – produzir um MSIX que você pode enviar.
Ou explore outros guias:
- Exibir uma notificação com JavaScript — notificações do SDK do Aplicativo Windows por meio de bindings de JS.
- Chame APIs do Windows a partir do JavaScript — selecione um arquivo usando bindings de JS.
- Use o Phi Silica no JavaScript — resuma texto com a IA do SDK do Aplicativo Windows.
- Criando um complemento WinML — equivalente de complemento C# nativo.
- Visão geral de introdução – retorne ao guia principal.
Windows developer