Skip to content
Closed
Show file tree
Hide file tree
Changes from all commits
Commits
Show all changes
27 commits
Select commit Hold shift + click to select a range
d63b8e4
Added all the changes of logger
abhishek-singh591 Jan 2, 2026
fbf3dbb
Minor fixes
abhishek-singh591 Jan 2, 2026
0ae9204
Fixed finetunning logger
abhishek-singh591 Jan 5, 2026
192ae46
Merge branch 'main' into logger_support
abhishek-singh591 Feb 9, 2026
f0fb8a7
Made Minnor fix
abhishek-singh591 Feb 10, 2026
f48d76a
Merge branch 'main' into logger_support
abhishek-singh591 Feb 25, 2026
276c850
Made minor fix
abhishek-singh591 Feb 26, 2026
63d7528
Merge branch 'quic:main' into logger_support
abhishek-singh591 Feb 26, 2026
9a5bde4
fixed lint error
abhishek-singh591 Feb 26, 2026
9c01ff7
Addressed few of the comments
abhishek-singh591 Mar 16, 2026
2493821
Merge branch 'quic:main' into logger_support
abhishek-singh591 Mar 16, 2026
eb442f8
Addressed a few more comments
abhishek-singh591 Mar 16, 2026
5de01b4
Made minnor fix
abhishek-singh591 Mar 17, 2026
cc1c5a0
Merge branch 'quic:main' into logger_support
abhishek-singh591 Mar 17, 2026
e28f066
Rebased from main
abhishek-singh591 Apr 19, 2026
8dc7a10
rebased
abhishek-singh591 Apr 19, 2026
9214991
pushed lint fix
abhishek-singh591 Apr 19, 2026
db84bd2
Made minnor fix
abhishek-singh591 Apr 19, 2026
55eceb0
Added logger support to new models
abhishek-singh591 Apr 19, 2026
519f2af
Update logging_utils.py
abhishek-singh591 Apr 19, 2026
9cec675
Merge branch 'main' into logger_support
abhishek-singh591 Apr 29, 2026
9b67118
Removed qeff logger from fine tuning
abhishek-singh591 Apr 29, 2026
7d2e402
Removed qeff logger from fine tuning
abhishek-singh591 Apr 29, 2026
6e79a46
Added few changes
abhishek-singh591 May 4, 2026
6e5c843
Lint fix
abhishek-singh591 May 4, 2026
85a021e
Merge branch 'main' into logger_support
abhishek-singh591 May 4, 2026
6361028
Made minor fixes
abhishek-singh591 May 4, 2026
File filter

Filter by extension

Filter by extension


Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
4 changes: 3 additions & 1 deletion QEfficient/__init__.py
Original file line number Diff line number Diff line change
Expand Up @@ -37,7 +37,9 @@
from QEfficient.peft import QEffAutoPeftModelForCausalLM
from QEfficient.transformers.transform import transform
from QEfficient.utils import custom_format_warning
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")

# custom warning for the better logging experience
warnings.formatwarning = custom_format_warning
Expand Down
6 changes: 4 additions & 2 deletions QEfficient/base/modeling_qeff.py
Original file line number Diff line number Diff line change
Expand Up @@ -7,7 +7,6 @@

import gc
import inspect
import logging
import shutil
import subprocess
import warnings
Expand Down Expand Up @@ -45,8 +44,9 @@
to_named_specializations,
)
from QEfficient.utils.export_utils import export_wrapper
from QEfficient.utils.logging_utils import QEFFLogger

logger = logging.getLogger(__name__)
logger = QEFFLogger.get_logger("INFRA")


class QEFFBaseModel(ABC):
Expand Down Expand Up @@ -382,6 +382,7 @@ def _export(
raise e

self.onnx_path = onnx_path
logger.info("Model export is finished and saved at: %s", onnx_path)
return onnx_path

def get_onnx_path(
Expand Down Expand Up @@ -686,4 +687,5 @@ def _compile(
logger.info("Hashed parameters exported successfully.")

self.qpc_path = qpc_path
logger.info("Model compilation is finished and saved at: %s", qpc_path)
return qpc_path
4 changes: 3 additions & 1 deletion QEfficient/base/pytorch_transforms.py
Original file line number Diff line number Diff line change
Expand Up @@ -9,7 +9,9 @@

from torch import nn

from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


class PytorchTransform:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/cloud/export.py
Original file line number Diff line number Diff line change
Expand Up @@ -12,7 +12,9 @@
from QEfficient.base.common import QEFFCommonLoader
from QEfficient.utils import check_and_assign_cache_dir
from QEfficient.utils.custom_yaml import generate_custom_io
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")

# Specifically for Docker images.
ROOT_DIR = os.path.dirname(os.path.abspath(""))
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/cloud/infer.py
Original file line number Diff line number Diff line change
Expand Up @@ -17,7 +17,9 @@

from QEfficient.base.common import QEFFCommonLoader
from QEfficient.utils import check_and_assign_cache_dir, load_hf_processor, load_hf_tokenizer
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


# TODO: Remove after adding support for VLM's compile and execute
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/compile/compile_helper.py
Original file line number Diff line number Diff line change
Expand Up @@ -15,7 +15,9 @@
from QEfficient.compile.qnn_compiler import compile as qnn_compile
from QEfficient.utils import constants
from QEfficient.utils._utils import load_json, load_yaml, to_named_specializations
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


def create_and_dump_specializations(
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/compile/qnn_compiler.py
Original file line number Diff line number Diff line change
Expand Up @@ -18,7 +18,9 @@
generate_qnn_specialization,
)
from QEfficient.utils.hash_utils import to_hashable
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


class QNN:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/diffusers/models/transformers/transformer_flux.py
Original file line number Diff line number Diff line change
Expand Up @@ -20,7 +20,9 @@
)

from QEfficient.diffusers.models.modeling_utils import compute_blocked_attention, get_attention_blocking_config
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


def qeff_apply_rotary_emb(
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/diffusers/pipelines/flux/pipeline_flux.py
Original file line number Diff line number Diff line change
Expand Up @@ -38,7 +38,9 @@
set_execute_params,
)
from QEfficient.generation.cloud_infer import QAICInferenceSession
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


class QEffFluxPipeline:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/diffusers/pipelines/pipeline_utils.py
Original file line number Diff line number Diff line change
Expand Up @@ -16,7 +16,9 @@
from tqdm import tqdm

from QEfficient.utils._utils import load_json
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


def calculate_compressed_latent_dimension(height: int, width: int, vae_scale_factor: int) -> int:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/diffusers/pipelines/wan/pipeline_wan.py
Original file line number Diff line number Diff line change
Expand Up @@ -37,7 +37,9 @@
)
from QEfficient.generation.cloud_infer import QAICInferenceSession
from QEfficient.utils import constants
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


class QEffWanPipeline:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/diffusers/pipelines/wan/pipeline_wan_i2v.py
Original file line number Diff line number Diff line change
Expand Up @@ -41,7 +41,9 @@
)
from QEfficient.generation.cloud_infer import QAICInferenceSession
from QEfficient.utils import constants
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


class QEffWanImageToVideoPipeline:
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/exporter/export_hf_to_cloud_ai_100.py
Original file line number Diff line number Diff line change
Expand Up @@ -20,7 +20,9 @@
from QEfficient.utils import load_hf_tokenizer
from QEfficient.utils.constants import QEFF_MODELS_DIR, Constants
from QEfficient.utils.generate_inputs import InputHandler
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


def convert_to_cloud_bertstyle(
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/generation/embedding_handler.py
Original file line number Diff line number Diff line change
Expand Up @@ -23,7 +23,9 @@

from QEfficient.generation.cloud_infer import QAICInferenceSession
from QEfficient.utils import constants
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


class VisionHandler:
Expand Down
6 changes: 5 additions & 1 deletion QEfficient/generation/text_generation_inference.py
Original file line number Diff line number Diff line change
Expand Up @@ -19,9 +19,11 @@
from QEfficient.generation.cloud_infer import QAICInferenceSession
from QEfficient.utils import padding_check_and_fix
from QEfficient.utils.constants import Constants
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger
from QEfficient.utils.sampler_utils import validate_sampler_inputs

logger = QEFFLogger.get_logger("INFRA")


@dataclass
class PerfMetrics:
Expand Down Expand Up @@ -1326,4 +1328,6 @@ def generate(
generated_ids=self._qaic_model.generated_ids,
perf_metrics=perf_metrics,
)
logger.info("Text generation finished")
QEFFLogger.print_table()
return latency_stats
4 changes: 3 additions & 1 deletion QEfficient/generation/vlm_generation.py
Original file line number Diff line number Diff line change
Expand Up @@ -37,7 +37,9 @@
)
from QEfficient.utils import LRUCache
from QEfficient.utils.constants import Constants
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("INFRA")


class VisionLanguageGeneration(QEffTextGenerationBase):
Expand Down
4 changes: 2 additions & 2 deletions QEfficient/peft/auto.py
Original file line number Diff line number Diff line change
Expand Up @@ -6,7 +6,6 @@
# ----------------------------------------------------------------------------

import hashlib
import logging
import warnings
from typing import List, Optional, Union

Expand All @@ -32,8 +31,9 @@
from QEfficient.utils import constants
from QEfficient.utils._utils import get_padding_shape_from_config
from QEfficient.utils.hash_utils import to_hashable
from QEfficient.utils.logging_utils import QEFFLogger

logger = logging.getLogger(__name__)
logger = QEFFLogger.get_logger("FT")


class QEffAutoPeftModelForCausalLM(QEFFBaseModel):
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/peft/lora/auto.py
Original file line number Diff line number Diff line change
Expand Up @@ -19,7 +19,9 @@
from QEfficient.peft.lora.pytorch_transforms import LoraModelInputsTransform, TargetModulesTransform
from QEfficient.utils import constants, get_padding_shape_from_config
from QEfficient.utils.hash_utils import to_hashable
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("FT")


class QEffAutoLoraModelForCausalLM(QEFFAutoModelForCausalLM):
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/transformers/modeling_utils.py
Original file line number Diff line number Diff line change
Expand Up @@ -92,7 +92,7 @@
from QEfficient.customop import CustomRMSNormAIC
from QEfficient.proxy.pytorch_transform import QeffProxyModuleTransform
from QEfficient.utils.constants import MIN_MASKED_ATTENTION_VALUE
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

if TYPE_CHECKING:
from QEfficient.base.modeling_qeff import QEFFBaseModel
Expand Down Expand Up @@ -164,6 +164,8 @@
QEffWhisperPositionalEmbedding,
)

logger = QEFFLogger.get_logger("MODEL")

# Define a named tuple for ModelArchitectures
# Required for the Automation tool
ModelArchitectures = namedtuple("ModelArchitectures", ["architectures"])
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/transformers/models/gpt_oss/modeling_gpt_oss.py
Original file line number Diff line number Diff line change
Expand Up @@ -39,7 +39,9 @@
from QEfficient.transformers.cache_utils import QEffHybridCacheForGPTOSS
from QEfficient.transformers.modeling_attn_mask_utils import _create_causal_mask
from QEfficient.utils.constants import MIN_MASKED_ATTENTION_VALUE
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


class QEffGptOssExperts(GptOssExperts):
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/transformers/models/internvl/modeling_internvl.py
Original file line number Diff line number Diff line change
Expand Up @@ -13,7 +13,9 @@

from QEfficient.utils import constants
from QEfficient.utils._utils import IOInfo, get_padding_shape_from_config
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


class QEffInternEncoderWrapper(nn.Module):
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/transformers/models/llava/modeling_llava.py
Original file line number Diff line number Diff line change
Expand Up @@ -15,7 +15,9 @@
)

from QEfficient.utils._utils import IOInfo
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")

BS = 1
FBS = 4
Expand Down
Original file line number Diff line number Diff line change
Expand Up @@ -18,7 +18,9 @@

from QEfficient.utils import constants
from QEfficient.utils._utils import IOInfo
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")

BS = constants.ONNX_EXPORT_EXAMPLE_BATCH_SIZE
FBS = constants.ONNX_EXPORT_EXAMPLE_FBS
Expand Down
4 changes: 3 additions & 1 deletion QEfficient/transformers/models/mistral3/modeling_mistral3.py
Original file line number Diff line number Diff line change
Expand Up @@ -21,7 +21,9 @@

from QEfficient.utils import constants
from QEfficient.utils._utils import IOInfo, get_padding_shape_from_config
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger

logger = QEFFLogger.get_logger("MODEL")


def custom_cumsum(tensor):
Expand Down
16 changes: 10 additions & 6 deletions QEfficient/transformers/models/modeling_auto.py
Original file line number Diff line number Diff line change
Expand Up @@ -76,9 +76,10 @@
get_padding_shape_from_config,
)
from QEfficient.utils.check_ccl_specializations import process_ccl_specializations
from QEfficient.utils.logging_utils import logger
from QEfficient.utils.logging_utils import QEFFLogger
from QEfficient.utils.sampler_utils import get_sampling_inputs_and_outputs

logger = QEFFLogger.get_logger("MODEL")
CUSTOM_IO_DTYPE_MAP = {
torch.float16: "float16",
torch.bfloat16: "bfloat16",
Expand Down Expand Up @@ -153,7 +154,7 @@ def from_pretrained(cls, pretrained_model_name_or_path: str, *args, **kwargs):
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})

logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, *args, **kwargs)

kwargs.update({"enable_proxy": enable_proxy} if enable_proxy else {})
Expand Down Expand Up @@ -315,7 +316,7 @@ def from_pretrained(cls, pretrained_model_name_or_path, pooling=None, *args, **k
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})

logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, *args, **kwargs)

# This is support models that should be classified to in a different auto class but transformers load them via this class
Expand Down Expand Up @@ -695,7 +696,7 @@ def from_pretrained(cls, pretrained_model_name_or_path, *args, **kwargs):
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})

logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, *args, **kwargs)
kwargs.update({"enable_proxy": enable_proxy} if enable_proxy else {})
return cls(model, pretrained_model_name_or_path=pretrained_model_name_or_path, **kwargs)
Expand Down Expand Up @@ -1271,7 +1272,7 @@ def from_pretrained(cls, pretrained_model_name_or_path: str, qaic_config: Option
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})

logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, **kwargs)

kwargs.update({"enable_proxy": enable_proxy} if enable_proxy else {})
Expand Down Expand Up @@ -2085,6 +2086,7 @@ def from_pretrained(
config = AutoConfig.from_pretrained(pretrained_model_name_or_path, trust_remote_code=True)
config._attn_implementation = "eager"
config.vision_config.use_flash_attn = "false"
logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, config, *args, **kwargs)

kwargs.update({"enable_proxy": enable_proxy} if enable_proxy else {})
Expand Down Expand Up @@ -2697,6 +2699,7 @@ def from_pretrained(
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})
logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, **kwargs)

kwargs.update({"enable_proxy": enable_proxy} if enable_proxy else {})
Expand Down Expand Up @@ -2949,6 +2952,7 @@ def from_pretrained(
kv_offload = kwargs.pop("kv_offload", None)

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})
logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, *args, **kwargs)
if qaic_config is not None:
qaic_config["pretrained_model_name_or_path"] = pretrained_model_name_or_path
Expand Down Expand Up @@ -4209,7 +4213,7 @@ def from_pretrained(cls, pretrained_model_name_or_path, pooling=None, *args, **k
logger.warning("Updating low_cpu_mem_usage=False")

kwargs.update({"attn_implementation": "eager", "low_cpu_mem_usage": False})

logger.info("Initiating the model weight loading.")
model = cls._hf_auto_class.from_pretrained(pretrained_model_name_or_path, *args, **kwargs)

# This is support models that should be classified to in a different auto class but transformers load them via this class
Expand Down
Loading
Loading