marginal significancep = 0.10
Statistical analysis confirmed a significant preference for LA over HA in Korean, with marginal significance in GPT-3.5-turbo (z = −1.63, p = 0.10).
Statistical analysis confirmed a significant preference for LA over HA in Korean, with marginal significance in GPT-3.5-turbo (z = −1.63, p = 0.10).
Question type B in GPT −4-turbo exhibited the same trend, favoring LA interpretations, but did not reach statistical significance (z = −0.83, p = 0.40).
Although the overall LA interpretation rate of o1-mini did not reach 60%, it was close—reaching 58.49%—and still showed a numerical trend toward LA preference.