{"observation":{"id":"ee856e78-f809-4d13-8e6a-b8e824cd34f4","tool":"llamaparse","tool_name":"LlamaParse","criterion":"output-quality","criterion_name":"Output quality","criterion_definition":"Is the parsed result clean, complete, and usable overall?","criterion_evidence_type":"transformation","criterion_rank_role":"decisive","criterion_rank_role_reason":"The whole point is usable structured extraction; clean, complete, usable output is the core measure of success. (3 of 3 judges)","scenario":"multi-column-sidebar-resume-priya-sharma","scenario_name":"Multi-column sidebar resume — Priya Sharma","group_tag":"resume-parsing","scenario_description":"A two-column sidebar resume for Priya Sharma, used to test whether parsers can preserve reading order and correctly extract content split across columns.","modality":"pdf","input_text":null,"input_artifact_refs":[{"alt":null,"url":"https://d3epheqghktydj.cloudfront.net/parseur-input2-priya-sharma-multicolumnresume-0e443ffc95c3.pdf","role":"input"}],"stresses":["multi-column layout handling","sidebar content extraction","reading-order robustness","projects extraction","languages and certifications extraction"],"verdict":"worked","score":null,"score_total":null,"note":"The multi-column output was clean and complete overall, with fully extracted work histories, projects, certifications, and languages.","evidence_state":"verified","source":null,"artifacts":[{"url":"https://d3epheqghktydj.cloudfront.net/research-media-llama-20output-202-b0738d3697c2.txt","role":"output","alt":null}],"run_id":"cbbef4db-964c-49fa-a57f-a2977822bdfc","study_title":"Parse resumes into structured data using an API","study_kind":"generation","research_task":"86b9jm30n","tested_at":null,"completeness":"input-and-output","input":{"state":"files","text":null,"files":[{"url":"https://d3epheqghktydj.cloudfront.net/parseur-input2-priya-sharma-multicolumnresume-0e443ffc95c3.pdf","filename":"parseur-input2-priya-sharma-multicolumnresume-0e443ffc95c3.pdf","alt":"Multi-column sidebar resume — Priya Sharma","role":"input"}],"modality":"pdf","stresses":["multi-column layout handling","sidebar content extraction","reading-order robustness","projects extraction","languages and certifications extraction"]},"tool_page_slug":"llamaparse","tool_url":"https://aidemos.com/tools/llamaparse","permalink":"https://aidemos.com/evidence/ee856e78-f809-4d13-8e6a-b8e824cd34f4","api_url":"https://ai.aidemos.com/v1/observations/ee856e78-f809-4d13-8e6a-b8e824cd34f4"},"peers":[{"id":"579f59ad-e495-4503-a0bb-204f9e734432","tool":"airparser","tool_name":"Airparser","verdict":"mixed","score":null,"score_total":null,"note":"Produces structured JSON, but the skills section loses its original category grouping and comes back as a flat list.","artifact_count":1,"thumbnail":"https://d3epheqghktydj.cloudfront.net/research-media-image-66bcb817e223.png","evidence_url":"https://aidemos.com/evidence/579f59ad-e495-4503-a0bb-204f9e734432"},{"id":"0319d532-1fc8-4624-a3b5-045b8c952f3b","tool":"extracta-ai","tool_name":"Extracta.ai","verdict":"worked","score":null,"score_total":null,"note":"Returns an excellent, clean JSON result that captures both columns completely and avoids irrelevant metadata.","artifact_count":2,"thumbnail":"https://d3epheqghktydj.cloudfront.net/research-media-image-aa9cc0c96107.png","evidence_url":"https://aidemos.com/evidence/0319d532-1fc8-4624-a3b5-045b8c952f3b"},{"id":"a242c7f2-c21c-4a1c-a38e-e24d698f957f","tool":"hireability","tool_name":"Hireability","verdict":"failed","score":null,"score_total":null,"note":"Output quality collapsed on the two-column resume because the parser produced a job-order-style structure instead of a candidate resume structure.","artifact_count":1,"thumbnail":"https://d3epheqghktydj.cloudfront.net/hireability-hireability-task2-job-order-misclassific-e8f4531332a1.png","evidence_url":"https://aidemos.com/evidence/a242c7f2-c21c-4a1c-a38e-e24d698f957f"},{"id":"ee98cce8-ef44-4d9a-ae44-8b6b2503b5bf","tool":"hrflow","tool_name":"HrFlow","verdict":"mixed","score":null,"score_total":null,"note":"The two-column output is only moderate quality: core fields are present, but title truncation, noisy skills, and incomplete task extraction reduce usability.","artifact_count":3,"thumbnail":"https://d3epheqghktydj.cloudfront.net/research-media-image-dfe47b81f568.png","evidence_url":"https://aidemos.com/evidence/ee98cce8-ef44-4d9a-ae44-8b6b2503b5bf"},{"id":"16601ff3-41ff-468f-8b72-fa1608a00cbd","tool":"openresume","tool_name":"OpenResume","verdict":"mixed","score":null,"score_total":null,"note":"Text extraction is largely correct, but the overall result is only moderate because the two-column layout produces significant work-experience mapping errors.","artifact_count":3,"thumbnail":"https://d3epheqghktydj.cloudfront.net/openresume-o6-company-jobtitle-mismatch-03145f230bed.png","evidence_url":"https://aidemos.com/evidence/16601ff3-41ff-468f-8b72-fa1608a00cbd"},{"id":"161e513d-c61e-466c-a3e5-47779ac96b21","tool":"skima-ai","tool_name":"Skima AI","verdict":"mixed","score":null,"score_total":null,"note":"The two-column output was only moderately usable: core contact and work-history fields were present, but sidebar skills/certifications/languages, projects, and GPA were missing or poorly handled.","artifact_count":2,"thumbnail":"https://d3epheqghktydj.cloudfront.net/skima-ai-06-input2-sidebar-missing-07290c0a1129.png","evidence_url":"https://aidemos.com/evidence/161e513d-c61e-466c-a3e5-47779ac96b21"}],"other_criteria":[{"id":"a90c31b5-b17f-409b-9b4c-ec89a653ac9b","criterion":"accuracy","criterion_name":"Accuracy","rank_role":"decisive","verdict":"mixed","score":null,"score_total":null,"note":"Certifications were extracted, but the issuer field was dropped entirely on the multi-column resume, so only name and year remained.","artifact_count":2,"evidence_url":"https://aidemos.com/evidence/a90c31b5-b17f-409b-9b4c-ec89a653ac9b"},{"id":"1a1cbbe6-4c52-4ee3-a44b-e6725d653493","criterion":"accuracy","criterion_name":"Accuracy","rank_role":"decisive","verdict":"worked","score":null,"score_total":null,"note":"The multi-column resume's name, email, phone, LinkedIn URL, location, and job title headline were extracted correctly.","artifact_count":1,"evidence_url":"https://aidemos.com/evidence/1a1cbbe6-4c52-4ee3-a44b-e6725d653493"},{"id":"a66b482b-9fe0-48b9-a5d8-1de7ed3b966e","criterion":"field-coverage","criterion_name":"Field coverage","rank_role":"decisive","verdict":"worked","score":null,"score_total":null,"note":"The multi-column output included the core resume fields and the sidebar-specific sections, including name, email, phone, experience, education, skills, certifications, languages, and projects.","artifact_count":2,"evidence_url":"https://aidemos.com/evidence/a66b482b-9fe0-48b9-a5d8-1de7ed3b966e"},{"id":"1a6ab01f-c271-4d3d-a0d0-b32e57a58694","criterion":"multi-column-handling","criterion_name":"Multi-column handling","rank_role":"decisive","verdict":"worked","score":null,"score_total":null,"note":"The parser handled the two-column sidebar layout correctly and preserved content from both columns rather than dropping the right sidebar.","artifact_count":3,"evidence_url":"https://aidemos.com/evidence/1a6ab01f-c271-4d3d-a0d0-b32e57a58694"}],"appears_in":[{"page_type":"ranking","slug":"resume-parsing-api","title":"Best AI Tools for Parsing Resumes via API (2026)","url":"https://aidemos.com/best/resume-parsing-api","binding":"run"}],"same_scenario":[{"id":"579f59ad-e495-4503-a0bb-204f9e734432","tool":"airparser","tool_name":"Airparser","verdict":"mixed","score":null,"score_total":null,"note":"Produces structured JSON, but the skills section loses its original category grouping and comes back as a flat list."},{"id":"0319d532-1fc8-4624-a3b5-045b8c952f3b","tool":"extracta-ai","tool_name":"Extracta.ai","verdict":"worked","score":null,"score_total":null,"note":"Returns an excellent, clean JSON result that captures both columns completely and avoids irrelevant metadata."},{"id":"a242c7f2-c21c-4a1c-a38e-e24d698f957f","tool":"hireability","tool_name":"Hireability","verdict":"failed","score":null,"score_total":null,"note":"Output quality collapsed on the two-column resume because the parser produced a job-order-style structure instead of a candidate resume structure."},{"id":"ee98cce8-ef44-4d9a-ae44-8b6b2503b5bf","tool":"hrflow","tool_name":"HrFlow","verdict":"mixed","score":null,"score_total":null,"note":"The two-column output is only moderate quality: core fields are present, but title truncation, noisy skills, and incomplete task extraction reduce usability."},{"id":"16601ff3-41ff-468f-8b72-fa1608a00cbd","tool":"openresume","tool_name":"OpenResume","verdict":"mixed","score":null,"score_total":null,"note":"Text extraction is largely correct, but the overall result is only moderate because the two-column layout produces significant work-experience mapping errors."},{"id":"161e513d-c61e-466c-a3e5-47779ac96b21","tool":"skima-ai","tool_name":"Skima AI","verdict":"mixed","score":null,"score_total":null,"note":"The two-column output was only moderately usable: core contact and work-history fields were present, but sidebar skills/certifications/languages, projects, and GPA were missing or poorly handled."}]}