Interpreting psychiatric digital phenotyping data with large language models: a preliminary analysis
GPT-3.5-turbodepressiondigital phenotyping
…terns based on standard test cases, significantly outperforming GPT-3.5-turbo (12%, 95% CI 8.4% to 15.6%). When analysing GPT-4o’s performanc…