Large language model accuracy for radiology board–style questions was reduced by prompts that mimicked cognitive biases, especially on image-based tasks, and prompt-level mitigations, although effective, only partially restored accuracy.
📖 افتح في inklap 🔗 DOI 📮 اطلب بحثاً