Skip to content

Commit e7c44f7

Browse files
authored
[bugfix] fix get_logger (#131)
1 parent a4ed54f commit e7c44f7

3 files changed

Lines changed: 5 additions & 3 deletions

File tree

‎src/mcore_bridge/model/gpts/deepseek_v4.py‎

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -503,7 +503,7 @@ def _set_param(self, param, tensor, scale_inv):
503503
tensor = fp4_to_fp8(tensor)
504504
tensor = tensor.reshape(*param.shape)
505505
scale_inv = scale_inv.reshape(-1, scale_inv.shape[-1])
506-
tensor = Fp8Dequantizer().convert(tensor, scale_inv)
506+
tensor = Fp8Dequantizer(block_size='auto').convert(tensor, scale_inv)
507507
if self._is_fp8_param(param):
508508
param._high_precision_init_val.copy_(tensor)
509509
param.data.copy_(tensor)

‎src/mcore_bridge/model/mm_gpts/gemma4.py‎

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -21,14 +21,14 @@
2121
from megatron.core.transformer.moe.moe_layer import MoELayer
2222
from megatron.core.transformer.spec_utils import build_module
2323
from megatron.core.utils import make_viewless_tensor, nvtx_range_pop, nvtx_range_push
24-
from swift.utils import get_logger
2524
from torch import Tensor, nn
2625
from transformers import AutoModel, PretrainedConfig
2726
from transformers.utils.versions import require_version
2827
from typing import Optional, Tuple
2928

3029
from mcore_bridge.bridge import MultimodalGPTBridge
3130
from mcore_bridge.config import ModelConfig
31+
from mcore_bridge.utils import get_logger
3232

3333
from ..constant import ModelType
3434
from ..gpt_model import GPTModel

‎src/mcore_bridge/utils/dequantizer.py‎

Lines changed: 3 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -5,8 +5,10 @@
55

66
class Fp8Dequantizer:
77

8-
def __init__(self, block_size: Tuple[int, int] = (None, None)):
8+
def __init__(self, block_size: Tuple[int, int] = (128, 128)):
99
# Set to None to enable automatic selection.
10+
if block_size in {None, 'auto'}:
11+
block_size = (None, None)
1012
self.block_size = block_size
1113

1214
def convert(

0 commit comments

Comments
 (0)