{"version":"configuration-source-5","evidencePolicy":"documented","snapshotId":"sha256-df858793dcb753b0f77beb223fce04e1de99a2c08f2c7b5f14534efcafa8c7c5","effortDatasetId":"sha256-1f186994047883a45f76e96fbce2f07320baf4f104506414be2bba69a334a02f+sha256-2bc644d4e2fb34bd4fecd1ef0a2a50302a9d18f3b8cd3aa0e6dfc487669f5146+sha256-b6d2e58f71798704ee9f3e6b341e3627e6b0dc1caef890fc1e08b62a226e3f36+sha256-7a7d95c40c608cc28483fb5cef9007da8c102f1e7278882ccbcc02a16078607d+sha256-99e5ccb2eac4abb63cc6d9823b591f2ffac992cdee03ac725f66bd8a5ec086a3+sha256-9fbe9729fecc9cf9232f3292684307ba1a85d69beff3920a2a7ed9e2c77bf7ef+sha256-7e00d90a437b5a33e79607a04b57b10dc14322bbaa63ce8bbe9ce1338eaf26f5","scope":"All collected observations, not a claim that every public result has been collected. Contributing means positive graph weight, not sufficient evidence for a rank.","models":[{"id":"qwen3.5-4b","collected":26,"contributing":23,"admittedWithoutWeight":0,"excluded":3}],"observations":[{"id":"0ea8b264473dc425326ac154","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/artificial-analysis-long-context-reasoning","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"897ab118ac1342a924d6112e","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/artificial-analysis-long-context-reasoning","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"053597e91079b350b9341d09","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/critpt","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"92b1bbe4bab1236ee4b0635f","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/critpt","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"e91f85c76ca2395e8d16bcd7","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/gpqa-diamond","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"af08f36e4be4659803ff0480","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/gpqa-diamond","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"47153236c0ed4b07d1500751","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/humanitys-last-exam","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"642772c958d7cd65f97835cb","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/humanitys-last-exam","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"dce15135abcbf97e2e75e164","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/ifbench","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"9f54a0ec86853c159d448797","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/ifbench","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"a9e1f9b1809bcd29819a8408","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/mmmu-pro","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"a1af20461c5aa98121c402cd","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/mmmu-pro","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"e7f8e4594adf9ffcf3ed6e8a","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/omniscience","status":"excluded","reason":"Benchmark family or source protocol has not been reviewed"},{"id":"ebe98a5e899b1dcb02f76998","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/omniscience","status":"excluded","reason":"Benchmark family or source protocol has not been reviewed"},{"id":"ed5f4a1b29b3009ad0ceeed1","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/omniscience","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"247c36abe2eb6e790cc417b2","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/omniscience","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"d28e385d70e803a765f7fc5c","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/tau2-bench","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"50e3c30102eb314283834c71","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/tau2-bench","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"f08a6b8acbba22210e4198c1","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/tau3-banking","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"b2ed8afbd8136fb37d1c54bd","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/tau3-banking","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"d6fe8b1efef057e8b67e8412","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/terminalbench-hard","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"3f84ada02ed713f5b4df5e8b","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/terminalbench-hard","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"5776b4e242b36d7888d749b7","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/terminalbench-v2-1","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"6b92b80ee9f40384f85cdd13","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-reasoning","sourceUrl":"https://artificialanalysis.ai/evaluations/terminalbench-v2-1","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"epoch-run-SAZy8rk2HgyPjA8XZJFUmR","modelId":"qwen3.5-4b","configurationId":"qwen3.5-4b--effort-non-reasoning","sourceUrl":"https://epoch.ai/benchmarks/otis-mock-aime-2024-2025","status":"contributing","reason":"Positive comparison weight in the overall connected graph"},{"id":"s-mmlu-pro-qwen3.5-4b-df03094a9acf","modelId":"qwen3.5-4b","configurationId":null,"sourceUrl":"https://huggingface.co/spaces/TIGER-Lab/MMLU-Pro","status":"excluded","reason":"No reviewed effort for this catalog observation; any separately collected effort measurement is counted separately"}]}