Skip to content

[webgpu] [ FAILED ] MatMulNBits.Float32_8b_AccuracyLevel4 #25231

Description

@daijh

Describe the issue

MatMulNBits.Float32_8b_AccuracyLevel4 fails on native webgpu-ep.

To reproduce

Build native webgpu-ep: commit 8aad8f9

Run:

onnxruntime_test_all.exe --gtest_filter=MatMulNBits.Float32_8b_AccuracyLevel4

Log:

Note: Google Test filter = MatMulNBits.Float32_8b_AccuracyLevel4
[==========] Running 1 test from 1 test suite.
[----------] Global test environment set-up.
[----------] 1 test from MatMulNBits
[ RUN      ] MatMulNBits.Float32_8b_AccuracyLevel4
onnxruntime\onnxruntime\test\providers\checkers.cc(392): error: The difference between cur_expected[i] and cur_actual[i] is 0.10537012666463852, which exceeds tolerance, where
cur_expected[i] evaluates to -0.22783160209655762,
cur_actual[i] evaluates to -0.1224614754319191, and
tolerance evaluates to 0.10455663502216339.
i:4662
Google Test trace:
onnxruntime\onnxruntime\test\providers\checkers.cc(568): provider type: WebGpuExecutionProvider
onnxruntime\onnxruntime\test\providers\base_tester.cc(846): registered execution providers: WebGpuExecutionProvider
onnxruntime\onnxruntime\test/common/random_generator.h(50): ORT test random seed: 1234
onnxruntime\onnxruntime\test\contrib_ops\matmul_8bits_test.cc(66): M:2, N:5120, K:3072, block_size:32, accuracy_level:4, has_zero_point:0, has_g_idx:0, has_bias:0
Stack trace:
  00007FF625A7DB08: onnxruntime::utils::MLTypeCallDispatcher<bool,float,double,unsigned char,unsigned short,unsigned int,unsigned __int64,signed char,short,int,__int64,std::basic_string<char,std::char_traits<char>,std::allocator<char> >,onnxruntime::Int4x2Base<1>,onnxruntime::Int4x2Base<0>,onnxruntime::Float8E4M3FN,onnxruntime::Float8E4M3FNUZ,onnxruntime::Float8E5M2,onnxruntime::Float8E5M2FNUZ,onnxruntime::MLFloat16,onnxruntime::BFloat16>::InvokeWithLeadingTemplateArgs<onnxruntime::test::`anonymous namespace'::TensorCheck,onnxruntime::TypeList<>,onnxruntime::Tensor const &,onnxruntime::Tensor const &,onnxruntime::test::ValidateOutputParams const &,std::basic_string<char,std::char_traits<char>,std::allocator<char> > const &>
  00007FF625A7B565: onnxruntime::test::Check<onnxruntime::Tensor>
  00007FF625A7BD5A: onnxruntime::test::CheckDispatch<onnxruntime::Tensor,std::vector<std::map<std::basic_string<char,std::char_traits<char>,std::allocator<char> >,float,std::less<std::basic_string<char,std::char_traits<char>,std::allocator<char> > >,std::allocator<std::pair<std::basic_string<char,std::char_traits<char>,std::allocator<char> > const ,float> > >,std::allocator<std::map<std::basic_string<char,std::char_traits<char>,std::allocator<char> >,float,std::less<std::basic_string<char,std::char_traits<char>,std::allocator<char> > >,std::allocator<std::pair<std::basic_string<char,std::char_traits<char>,std::allocator<char> > const ,float> > > > >,std::vector<std::map<__int64,float,std::less<__int64>,std::allocator<std::pair<__int64 const ,float> > >,std::allocator<std::map<__int64,float,std::less<__int64>,std::allocator<std::pair<__int64 const ,float> > > > >,onnxruntime::TensorSeq>
  00007FF625A89901: onnxruntime::test::CheckOrtValuesAreEqual
  00007FF625A714F2: onnxruntime::test::BaseTester::ExecuteModel<onnxruntime::InferenceSession>
  00007FF625A76EFC: onnxruntime::test::BaseTester::ExecuteModelForEps
  00007FF625A787F5: onnxruntime::test::BaseTester::RunWithConfig
  00007FF6259B1085: onnxruntime::test::`anonymous namespace'::RunTest8Bits<float>
  00007FF6259B4F20: onnxruntime::test::`anonymous namespace'::TestMatMul8BitsTyped<float,2,5120,3072,32,4>
  00007FF626B9E2AB: testing::internal::HandleSehExceptionsInMethodIfSupported<testing::Test,void>
  00007FF626B9E196: testing::internal::HandleExceptionsInMethodIfSupported<testing::Test,void>
  00007FF626BC4254: testing::Test::Run
  00007FF626BC436D: testing::TestInfo::Run
  00007FF626BC450E: testing::TestSuite::Run
... Google Test internal frames ...

[  FAILED  ] MatMulNBits.Float32_8b_AccuracyLevel4 (39200 ms)
[----------] 1 test from MatMulNBits (39200 ms total)

[----------] Global test environment tear-down
[==========] 1 test from 1 test suite ran. (39200 ms total)
[  PASSED  ] 0 tests.
[  FAILED  ] 1 test, listed below:
[  FAILED  ] MatMulNBits.Float32_8b_AccuracyLevel4

 1 FAILED TEST

Urgency

No response

Platform

Windows

OS Version

11

ONNX Runtime Installation

Built from Source

ONNX Runtime Version or Commit ID

8aad8f9

ONNX Runtime API

C++

Architecture

X64

Execution Provider

Default CPU

Execution Provider Library Version

native webgpu

Activity

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Metadata

Metadata

Assignees

No one assigned

    Labels

    ep:WebGPUort-web webgpu providerplatform:webissues related to ONNX Runtime web; typically submitted using template

    Type

    No type

    Projects

    No projects

      Milestone

      No milestone

      Relationships

      None yet

      Development

      No branches or pull requests

      Issue actions