Tag
A developer tested six AI interview assistant products, found all failed several behavior checks, and published a public dataset with 66 assessments across 6 products and 11 criteria, available on GitHub and Zenodo.