Performance Guidance
Prefer Native-First
Use native BatchEncoding as long as possible:
encode/encode_batch/flushfor native flowas_pyg(...)only when needed by model training/inference code
Tune Metadata Export
export_node_names=Falsecan reduce metadata overhead.include_metadata=Falsefor conversion paths can reduce payload size in PyG objects.
Stream for Incremental Workloads
- Use append-only streams for pure append pipelines.
- Use mutable streams only when update/remove semantics are required.
Profile and Benchmark
Use:
scripts/profile_encoding.pyfor profiling pathsscripts/benchmark_encoder_suite.pyfor comparative encoder and batch-size benchmarks