highly significantP < 0.001
A highly significant difference was observed between ChatGPT-4.0 and Claude-3-Opus ( P < 0.001), and a significant difference was also observed between Gemini-1.5-Pro and Claude-3-Opus ( P < 0.01).
A highly significant difference was observed between ChatGPT-4.0 and Claude-3-Opus ( P < 0.001), and a significant difference was also observed between Gemini-1.5-Pro and Claude-3-Opus ( P < 0.01).