{"as_of":"2026-08-05T13:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b24ea9d3141f3a95f66c8cb7e5f5efcb52b1ec761bc79c5f74a7227a98ebbb17","coverage":[{"denominator":96,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T21:14:13.351140Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:42:38.419346Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13898","snapshot_observed_at":"2026-07-14T04:42:38.419346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11570","last_updated":"2026-07-13T13:50:43Z","snapshot_observed_at":"2026-07-16T23:19:54.159757Z","submitted_at":"2026-07-13T13:50:43Z","title":"ERR@HRI 3.0 Challenge: Multimodal Detection of Errors and Anticipation in Human-Robot Interactions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T04:42:38.419346Z"},"links":{"cited_paper":"/paper/2504.13898","citing_paper":"/paper/2607.11570"},"observation_digest":"sha256:5024c03ca317a379c62c361896fe1827e3418c9660862a39dc077f934f1ebefe","observation_id":"3817769c-5cb8-4ff4-83e7-447242ee67db","resolution":{"observed_at":"2026-07-14T04:42:38.419346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.13898/citation-record","integrity":"/paper/2504.13898/integrity","json":"/paper/2504.13898/citation-record.json","paper":"/paper/2504.13898"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-07-06T20:45:27.814045Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:1ab38e95610a52faf97d28e38ac4895d8892af3180cff531ab5171bf3bca052c","observation_id":"2a68bdae-f164-4ca5-9802-5acdc0db4668","resolution":{"observed_at":"2026-05-22T21:15:09.419799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inter-coder agreement for computational linguistics.Computational linguistics, 34(4):555–596","venue":null,"work_id":"713ffe57-a0c0-4571-8238-f0bafb6002c7","year":2008},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:bd94c9655affb4a009134bfa7df68b1fb93c6491929e8fe7e377c03b9177edf7","observation_id":"dac5ec38-fa8a-4316-9202-7cab6c7b1c3d","resolution":{"observed_at":"2026-05-22T21:15:09.854405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A new test of social sensitivity: Detection of faux pas in normal children and children with asperger syndrome.Journal of Autism and Developmental Disorders, 29(5):407–418","venue":null,"work_id":"3a660f75-96d2-4732-9f12-5d409be2914c","year":1999},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:de1962b2aacdc5372a79d023f4305527e46f67e1da6d0cf9782a6ce18e9f4825","observation_id":"dfbc25cc-41be-4bcb-8887-14a0c5e41f5c","resolution":{"observed_at":"2026-05-22T21:15:09.917982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-05T10:06:10.880743Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":"2407.07726","doi":"10.48550/arxiv.2407.07726","metadata_source":"pith","pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":"cs.CV","work_id":"df6f48b3-5792-47c7-9614-cb856ea31ad9","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:fbfb20d9468203a61098c80827382cf81672578215df18304c5958abdb16d97e","observation_id":"98c23f88-ceef-4d25-9e6e-490c15bfc1e9","resolution":{"observed_at":"2026-05-22T21:15:09.432909Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24e2bcd1-2f21-4c59-9596-34a297bc4193","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c152b3c23dc5dedf9a2a2a15ef438a2e984aaeb006babe7a3780f256f2b9f800","observation_id":"0380d1c8-11f7-447d-a6e9-0c96a065ce3f","resolution":{"observed_at":"2026-05-22T21:15:09.888579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ISBN 979-8-89176-195-7","venue":null,"work_id":"224f486a-a085-4d80-9fdb-60feae6bdf69","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:8a849503b16526f8cba8b70606ca5b3e07b3b7a3e540a3461c0ccee074299e64","observation_id":"f0613d2b-535a-4c5a-99e6-2d0ad285236f","resolution":{"observed_at":"2026-05-22T21:15:09.848139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Internvl: Scaling up vision foun- dation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":"7d9d444d-b6e2-45b2-aef3-6448b99c03ee","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:fc86de88c127337e4fd63d0451aa77c300bb5fa6abef8c7de50a4201c9fc1622","observation_id":"a14c1aff-363a-40b8-bf62-6aedf44b0658","resolution":{"observed_at":"2026-05-22T21:15:09.855761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":"2401.01335","doi":"10.48550/arxiv.2401.01335","metadata_source":"pith","pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","venue":"cs.LG","work_id":"6b7f0773-4e99-4274-9d8e-279a1f25c5e1","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:9cb22be7e56377b5d2b2dd0e721a98181f38d79fa289fa6bcadf21149304f0bc","observation_id":"213b4573-da5f-41dc-aea5-b96741bff7f2","resolution":{"observed_at":"2026-05-22T21:15:09.385559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pydantic, 1","venue":null,"work_id":"3b5c485d-8487-458c-ad33-6acbaf3448e3","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:555b6a6c72922ac3bdca4c1618d42b290d728273d236966b05c8fb03a7420f07","observation_id":"0e52a2be-4db5-40a6-ad6b-62bb98c87a33","resolution":{"observed_at":"2026-05-22T21:15:09.839298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eee4dffb-5346-48eb-aca7-eb40efd13f73","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:4748bc7bd0873015e45fc34fa69dc87cdf363d57a7a9427e683283f6ebb5b92d","observation_id":"d2728ca3-1e49-4fa0-aff2-69026ab1ce40","resolution":{"observed_at":"2026-05-22T21:15:09.894890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08751","last_updated":"2025-05-13T17:03:48Z","snapshot_observed_at":"2026-07-06T21:23:23.760393Z","submitted_at":"2025-05-13T17:03:48Z","title":"Aya Vision: Advancing the Frontier of Multilingual Multimodality","version":1},"cited_work":{"arxiv_id":"2505.08751","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08751","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aya vision: Advancing the frontier of multilingual multimodality","venue":null,"work_id":"e8d61cae-b44e-43b8-8595-9e7320cd601a","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2505.08751","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:f9c91f767311f4c967ebc879c178bb7f10d8c5b0fd4fbd0712c91be7068c19e1","observation_id":"fa0c292a-97d8-4025-a39c-48662fcce578","resolution":{"observed_at":"2026-05-22T21:15:09.414591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Commonsense reasoning and commonsense knowledge in artificial intelligence","venue":null,"work_id":"2e71d384-6e89-43ee-ad86-b3020d01c7bc","year":2015},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:fc4b84ea2c7995738820a0b7f15233ec3531e57d4ea703af7a290381c9544e2f","observation_id":"52e8c147-89d1-4aad-a421-eb30b8c00699","resolution":{"observed_at":"2026-05-22T21:15:09.877924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpersonal reactivity index.Journal of Personality and Social Psychology","venue":null,"work_id":"f6a0efa3-930e-42c4-8c69-7f2485f52d17","year":1980},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:1f01e9ba064fbfc6403f2792c5c13b716b143f9b0ed3d83cf5b859e6fca8d5ad","observation_id":"70e885e5-bd9a-4842-b391-d4db7f307ebc","resolution":{"observed_at":"2026-05-22T21:15:09.930595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16741","last_updated":"2023-11-02T17:37:53Z","snapshot_observed_at":"2026-07-06T16:12:46.676413Z","submitted_at":"2023-08-31T13:59:35Z","title":"Socratis: Are large multimodal models emotionally aware?","version":3},"cited_work":{"arxiv_id":"2308.16741","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16741","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Socratis: Are large multimodal models emotionally aware?","venue":null,"work_id":"b61ae96e-87b7-46e3-9357-6dfa1f46ee03","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2308.16741","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:a8957270dd9fcc01ea82d5fcf961778b696469aa51041fed7ac34a485dfc733f","observation_id":"bb84be84-3064-49a1-ad75-9a58b74e12d2","resolution":{"observed_at":"2026-05-22T21:15:09.331617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:36:10.633869Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"1bdc18bb-17d9-44c5-8f2b-ca096572a66b","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:83c513c57d788a5efea9b8239843435e633e8aa670f7451a4645fdc6534a5b5a","observation_id":"d872e910-24ae-4f3c-b775-732a68fbd605","resolution":{"observed_at":"2026-05-22T21:15:09.933999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing masc: a movie for the assessment of social cognition.Journal of autism and developmental disorders, 36:623–636","venue":null,"work_id":"d28ee744-67ec-4687-92ed-63fc18294558","year":2006},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:e91ce32c52ba49d047245153d9f1b6af9dfd6a08a4440a7423ff5f65725a5688","observation_id":"3ca10361-16b7-48b5-b904-efbc3a5f2f25","resolution":{"observed_at":"2026-05-22T21:15:09.882554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repairing trust in robots?: A meta-analysis of hri trust repair studies with a no-repair condition","venue":null,"work_id":"70d6779a-61d5-43e4-9616-f1baf690074d","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ab0f0d989ff36b427cd65215ddfd4e23ccbdc932ad94724d6074f7191f532664","observation_id":"0c9f6697-c211-439f-abba-b86b27bace1a","resolution":{"observed_at":"2026-05-22T21:15:09.945043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The artificial- social-agent questionnaire: establishing the long and short questionnaire versions","venue":null,"work_id":"91ace549-5bbc-4e31-b333-77eefd46c271","year":2022},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:96c3a30d5dbf7c280bd8b9c5281553b67b793cd5256f8ab4f049e3774c9ec6b8","observation_id":"52d5f79c-ccaf-4de1-b3c3-72897b6db690","resolution":{"observed_at":"2026-05-22T21:15:09.871869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Investigating con- versational dynamics: Interactive alignment, interpersonal synergy, and collective task performance.Cognitive science, 40(1):145–171","venue":null,"work_id":"2799f00c-8d92-4f09-aca9-d8b7efb1d0ae","year":2016},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ad7161bf6b0a42a8aa868bb795007794ad718b6f2cc9381a28928279b0175533","observation_id":"64723b5a-f67b-4fd7-bea0-112c63aebf4c","resolution":{"observed_at":"2026-05-22T21:15:09.921295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Systematic analysis of video data from different human– robot interaction studies: a categorization of social signals during error situations.Frontiers in psychology, 6:931","venue":null,"work_id":"5d4871a0-5750-467a-8b6b-c30988b3d528","year":2015},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:37c3def0df0673f6d9b59f1ee8bc5d455d30626f1fadb447a899bce2b34ee51d","observation_id":"f832df7a-1902-4235-9a03-9e6baa10748c","resolution":{"observed_at":"2026-05-22T21:15:09.810415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"reading the mind in films","venue":null,"work_id":"6ad51d6b-9f3f-42f8-b6b1-a91c563a48a2","year":2006},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:f2629bb7731fb39ab5c61688c38bf868517550e3c8f520485f4b10e945b35848","observation_id":"cbe98189-e6fa-44f8-8ef5-8e55b3a4bb5e","resolution":{"observed_at":"2026-05-22T21:15:09.804614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ff6ec7d200d3515604a325054dedf815de558087e93ad479266df5f43eb25ba7","observation_id":"62e18565-f566-4daf-af52-b1af65d82457","resolution":{"observed_at":"2026-05-22T21:15:09.420902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:0dfab64a213fc598a98a03d00b83deba362453ef7fbd4e59f85a6cec7926132d","observation_id":"0c311622-675b-42de-9781-55f79ba65698","resolution":{"observed_at":"2026-05-22T21:15:09.400280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affective social competence.Social development, 10(1):79–119","venue":null,"work_id":"4e87a4d2-be02-4e06-9d40-80e842cc2ded","year":2001},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:76f9e512ecd29cb8170a89eb7fc0f1c9cd0601926fe6f70d436a3c04698d713a","observation_id":"913c6ea4-6ddc-401c-a0b1-5c36b447f627","resolution":{"observed_at":"2026-05-22T21:15:09.942186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:d9379a7a4e29ddd98010108c18a788b92af2e0009029fdf31296b8c8a31ed8b6","observation_id":"dcea0e49-58b2-4cea-a4c6-ce158539046c","resolution":{"observed_at":"2026-05-22T21:15:09.318462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c722f5e66a5e4126757d883f0ae9b0537e8d713dd64a285f0d7f62a81241a4e8","observation_id":"5ca418fd-412b-48a8-a360-de6e2d5c0104","resolution":{"observed_at":"2026-05-22T21:15:09.416470Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Explanations from a robotic partner build trust on the robot’s decisions for collaborative human-humanoid interaction.Robotics, 10(1):51","venue":null,"work_id":"19275fa4-a07c-4861-8a07-0625a7c0bada","year":2021},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:fc8f63f0b52156e630a0862552f55b1963a2c13c431727358095466f52e3a2b3","observation_id":"38a47847-b352-4c3a-9854-0b5d543b5c30","resolution":{"observed_at":"2026-05-22T21:15:09.801953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A robotic positive psychology coach to improve college students’ wellbeing","venue":null,"work_id":"fc3ebab2-bbce-4261-a1e3-3178b61fe0bf","year":2020},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:15e3b8165d051ae819139fb30e15e36e3a2ac1bd9305536fd758a866bcab7b3a","observation_id":"8cd1c55a-24f1-4beb-a2e0-cc28bd80a2cc","resolution":{"observed_at":"2026-05-22T21:15:09.885495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A robotic companion for psychological well-being: A long-term investigation of companionship and therapeutic alliance","venue":null,"work_id":"80300e87-67f0-494c-9961-1b6550b90785","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:940c9c818e58de4b322da76b42620d3efd9088e60550137671ba4a34d3690f73","observation_id":"a90c9d3d-7ce8-4c8f-8bff-2ca54df39fb8","resolution":{"observed_at":"2026-05-22T21:15:09.879276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deploying a robotic positive psychology coach to improve college students’ psychological well-being.User Modeling and User-Adapted Interaction, 33(2):571–615","venue":null,"work_id":"51f26111-4d9b-4119-8249-b58750fe899f","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:3ab493c8c44acf161ee109f8f7c6fe38293031c50dccdd04d64835e81139c707","observation_id":"7c8db6b7-1e96-4068-803d-9afd45d57b47","resolution":{"observed_at":"2026-05-22T21:15:09.862497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trust repair in human-agent teams: the effectiveness of explanations and expressing regret","venue":null,"work_id":"305c59de-0cd6-430e-8cb0-ad0f054d8c8f","year":2021},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:d3b85f0660d8f116e24d29e4685ec0d5745a1c49a54fb2780c244013965e1899","observation_id":"a3142e34-042e-4e60-a1cb-3dee891ceb4f","resolution":{"observed_at":"2026-05-22T21:15:09.853262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building machines that learn and think like people.Behavioral and brain sciences, 40: e253","venue":null,"work_id":"0186bb45-1725-406a-a3ab-57b09d808d8c","year":2017},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:4a3616befbfdfadab530b5cb9f7e600ab0849bcaccb496095177013a74f26716","observation_id":"17a8c2a3-dec6-4977-a594-8a01393524c9","resolution":{"observed_at":"2026-05-22T21:15:09.724524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":"1909.11942","doi":"10.48550/arxiv.1909.11942","metadata_source":"pith","pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","venue":"cs.CL","work_id":"aedf7950-7c35-4e28-a32d-bec290f51669","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:cfaa8aa699ca2e4f3a541d83dbb494e364cd38b2cec7ed7ffd52b8b83ad34b00","observation_id":"a07483af-13f6-4cab-bc01-0e33da3959e1","resolution":{"observed_at":"2026-05-22T21:15:09.437230Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":"2309.00267","doi":"10.48550/arxiv.2309.00267","metadata_source":"pith","pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","venue":"cs.CL","work_id":"81d8781d-2933-4e89-97ee-9bbfc6d4ca0c","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:cc31e3afd57f7a125aa38ca2cf4a7312e37b46aa1e99c0d51de1d06a9ac3621d","observation_id":"812a3722-82d2-4f38-97ed-335e899b38f4","resolution":{"observed_at":"2026-05-22T21:15:09.374973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:05.545533+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:05.545533+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04990","last_updated":"2023-06-06T15:31:33Z","snapshot_observed_at":"2026-07-06T15:24:45.921232Z","submitted_at":"2023-05-08T18:53:45Z","title":"Explanation-based Finetuning Makes Models More Robust to Spurious Cues","version":3},"cited_work":{"arxiv_id":"2305.04990","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.04990","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Explanation-based finetuning makes models more robust to spurious cues","venue":null,"work_id":"c85d3283-4536-4a65-aad1-7a875b2dc02d","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2305.04990","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:8752a28184f64579f758857966ec7e85d1a37c401af00e883d60450a174ed008","observation_id":"943eace6-8c60-469d-91cb-5b35a1a78195","resolution":{"observed_at":"2026-05-22T21:15:09.424091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11023","last_updated":"2024-10-08T11:27:04Z","snapshot_observed_at":"2026-07-30T16:21:12.981855Z","submitted_at":"2024-04-17T02:57:42Z","title":"Advancing Social Intelligence in AI Agents: Technical Challenges and Open Questions","version":2},"cited_work":{"arxiv_id":"2404.11023","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.11023","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advancing social intelligence in ai agents: Technical challenges and open questions","venue":null,"work_id":"49300cfd-c99d-4df1-9fa1-85426cb5c705","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2404.11023","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:5e34a6fb43e15974a2282cafe5f3f68da9850e614e9e65b2c134a6415ff44063","observation_id":"83f35cf8-1766-41a3-bb81-2c19db876007","resolution":{"observed_at":"2026-05-22T21:15:09.404589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15109","last_updated":"2025-06-04T02:43:41Z","snapshot_observed_at":"2026-07-06T20:40:10.731339Z","submitted_at":"2025-02-21T00:05:40Z","title":"Social Genome: Grounded Social Reasoning Abilities of Multimodal Models","version":4},"cited_work":{"arxiv_id":"2502.15109","doi":"10.48550/arxiv.2502.15109","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.15109","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Social genome: Grounded social reasoning abilities of multimodal models","venue":"arXiv (Cornell University)","work_id":"b217ccc8-0c9a-4ad7-a074-2d14797faddb","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2502.15109","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:7b507ce7b48778dd3ef190832fb286d9c95d86cee0618b76707ba44ae672c6b6","observation_id":"9c677a54-efbb-4703-bbe2-df7eeff15c9a","resolution":{"observed_at":"2026-05-22T21:15:09.388080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mixed-method long-term robot usage: Older adults’ lived experience of social robots","venue":null,"work_id":"a99c5b96-2bbe-458f-9185-2c77d1e6aa67","year":2022},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ac4076947eedbd39dcd9401af176ef16d19cbf06512ba398efcae23787266aeb","observation_id":"498c2035-2951-4744-bad3-863041237e95","resolution":{"observed_at":"2026-05-22T21:15:09.845328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Train- ing language models to follow instructions with human feedback.Advances in Neural Information Processing Systems, 35:27730–27744","venue":null,"work_id":"a54ab118-87f0-45e9-a8b5-6a568d4cce74","year":2022},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:31a99bddb487f2b89b6041cc0492b27971906f43258497446e09e016ddb821aa","observation_id":"74137294-3566-4ff5-9158-aeeea57ddf39","resolution":{"observed_at":"2026-05-22T21:15:09.774132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Growing growth mindset with a social robot peer","venue":null,"work_id":"c4fdd3a4-25b3-4c8e-90f2-be54fa674557","year":2017},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:698305ab5574105b2463e1c411e9ad8c9dae6a1f9e3e2615b07cb474b694bdb6","observation_id":"29944520-55dc-46db-8328-a664710c0c54","resolution":{"observed_at":"2026-05-22T21:15:09.869419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jibo community social robot research platform@ scale","venue":null,"work_id":"8779530a-f22a-4a6b-a042-30b3ab5580bc","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:155a2808bf44c609d61c16d259885f5ccb3c27ab6d1b83e4e44a0f09fb6c0eca","observation_id":"fb5b6788-cf4a-41b9-9127-6da68b671a02","resolution":{"observed_at":"2026-05-22T21:15:09.833418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intro- ducing gemini 2.0: our new ai model for the agentic era","venue":null,"work_id":"518d8c55-0748-4525-a46c-0ec2a7dc47dd","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c6bd943c9184ac0ee50ca553d567e2b4d9739ca799956f895b9927f26d3ffe79","observation_id":"0e313f03-8214-4482-8eaf-335448a66c5c","resolution":{"observed_at":"2026-05-22T21:15:09.767090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1050","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":"5a68f22c-1600-4a82-b4d9-b033ee0feb08","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ad3d4be5e2a3cb875b3c8723831f20fb8e983f51d58b7bba31e387483be2fda0","observation_id":"4b5a577e-1c61-477e-a203-24f79dfdb9c8","resolution":{"observed_at":"2026-05-22T21:15:09.262709Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T18:54:22.27037+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T18:54:22.27037+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13575","last_updated":"2022-10-24T19:54:57Z","snapshot_observed_at":"2026-07-06T14:09:52.729001Z","submitted_at":"2022-10-24T19:54:57Z","title":"Does Self-Rationalization Improve Robustness to Spurious Correlations?","version":1},"cited_work":{"arxiv_id":"2210.13575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.13575","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does self-rationalization improve robustness to spurious correlations?","venue":null,"work_id":"007ccd2d-863b-4e2a-99ee-c3eb34978b33","year":2022},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2210.13575","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ed3d369af8a548f310868a8f5bf2e6f00f9861c21c665fe8fd34f3eb6fcb02c7","observation_id":"ca2babe9-3e3d-4502-b71e-65801bc17cdb","resolution":{"observed_at":"2026-05-22T21:15:09.314864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Atomic: An atlas of machine commonsense for if-then reasoning","venue":null,"work_id":"65ddbf10-07c9-44fa-b483-af0767aa91fe","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:41a20c129b7d4de654aa6c916b49f50b116ff3b652866fa9a6afbf0598fbd8a0","observation_id":"3502b6a2-0bce-430b-a067-7e777e7b6517","resolution":{"observed_at":"2026-05-22T21:15:09.873873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":"1904.09728","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-07-08T01:44:26.198243Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","venue":"cs.CL","work_id":"3f93670e-0ae7-40e5-bed5-74c216638dd1","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:6be55d94e2506f915aaf6a19a66c9696aa4088e303492cbc652637c79e2d3a2d","observation_id":"96a4b1fa-dd28-44bf-8f76-f712a57b9859","resolution":{"observed_at":"2026-05-22T21:15:09.369079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social ontology and the philosophy of society.Analyse & Kritik, 20(2):143–158","venue":null,"work_id":"64f64ddc-c247-42d7-8062-8a9c5e75b165","year":1998},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:5fb0cbd9d481debf71ffd015f49c43f96055d05766a913afbdd22443d21b9b7e","observation_id":"315e1312-273c-4b55-bd90-34dcdd2ebe99","resolution":{"observed_at":"2026-05-22T21:15:09.842347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How well do large language models perform on faux pas tests? InFindings of the Association for Computational Linguistics: ACL 2023, pages 10438–10451","venue":null,"work_id":"9a077822-0353-47c4-9eff-e8167d86c667","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:dd0f7b79eb23622fa1e9ed59e2d7b8f00153c444c9235f7015d75df93bea754a","observation_id":"15dc6d36-6891-4c22-a120-87041b9e6d54","resolution":{"observed_at":"2026-05-22T21:15:09.914593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memor: A dataset for multimodal emotion reasoning in videos","venue":null,"work_id":"070111af-f047-4b98-bd5a-029fcc818c9b","year":2020},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:804ead0e187c7b697a263a7e576644192f5810f875789c862e9c14a016e5cc36","observation_id":"531f6347-6374-43bb-9674-130da2003723","resolution":{"observed_at":"2026-05-22T21:15:09.798239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15708","last_updated":"2024-05-24T16:57:18Z","snapshot_observed_at":"2026-08-04T09:21:49.376771Z","submitted_at":"2024-05-24T16:57:18Z","title":"EmpathicStories++: A Multimodal Dataset for Empathy towards Personal Experiences","version":1},"cited_work":{"arxiv_id":"2405.15708","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.15708","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Empathicstories++: A multimodal dataset for empathy towards personal experiences","venue":null,"work_id":"05c7e695-39af-40a5-9c60-d78fb9b3e8d0","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2405.15708","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:14fe5280f601fa4651222f84ee999e6acd6f3fd9c64b98cc3eb5c204ae63d258","observation_id":"e728afe9-4458-4efb-b8f5-3ab5c12dd887","resolution":{"observed_at":"2026-05-22T21:15:09.428920Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":"2403.05530","doi":"10.48550/arxiv.2403.05530","metadata_source":"pith","pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":"cs.CL","work_id":"80e3e977-f1bb-4c83-8d0c-1ab0a0c5c3f1","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:69436e14044cef7d796adaec5df9b2144bd8c556c6eb85562b98890e045cb37a","observation_id":"0f0a1d5a-1978-4685-b5a8-599725f51cc7","resolution":{"observed_at":"2026-05-22T21:15:09.402439Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotion norms, emotion work, and social order","venue":null,"work_id":"b69df060-7996-4a1c-b925-1a260dd79817","year":2004},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:88fa530b4b722fed80363fde4b760ef4cef5f9a13aa7e24d91cea898a18e61f3","observation_id":"a0f21668-ebe1-4755-beba-266985828f78","resolution":{"observed_at":"2026-05-22T21:15:09.820874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A taxonomy of social errors in human-robot interaction.ACM Transactions on Human-Robot Interaction (THRI), 10(2):1–32","venue":null,"work_id":"dbf84204-1edc-4343-a2a8-af1c24a65dd0","year":2021},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:87125ea0e7c5c70d6054e9fcd3dd45c22e251bb368df8f88c561cb7abb6bc7bd","observation_id":"1135c861-0fa4-4494-aba6-5526afffc8a7","resolution":{"observed_at":"2026-05-22T21:15:09.804185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08399","last_updated":"2023-03-14T13:47:26Z","snapshot_observed_at":"2026-07-06T14:52:34.482294Z","submitted_at":"2023-02-16T16:18:03Z","title":"Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks","version":5},"cited_work":{"arxiv_id":"2302.08399","doi":"10.48550/arxiv.2302.08399","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.08399","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks","venue":"arXiv (Cornell University)","work_id":"1bc47679-bdf4-4416-89dc-897e02469d50","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2302.08399","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:56970dea40dfb14ed9d0c3bb4daf341f685a80f01b3a57f5ab2f9d8830f95e70","observation_id":"2338b580-a693-4d3d-a534-5ebe96e9046b","resolution":{"observed_at":"2026-05-22T21:15:09.382305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.216017+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.216017+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotional intelligence of large language models.Journal of Pacific Rim Psychology, 17:18344909231213958","venue":null,"work_id":"518877f4-7eda-4f1e-b851-4e3829879ca6","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:79980277395e0055609658b94b4b9aa4b9fbb6c65b34b73f8d6a307f3ffb2553","observation_id":"590f3b06-6512-44b5-96e1-706ffb8cbcc6","resolution":{"observed_at":"2026-05-22T21:15:09.844874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social-iq 2.0 challenge: Benchmarking mul- timodal social understanding.Social-iq 2.0 challenge: Benchmarking multimodal social understanding","venue":null,"work_id":"bf3102a5-7d24-4ab8-928b-98cf2dc3e6fb","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:9dd0d6f8e3a4595c9e18ed4182cced3f6b4a20524e34646771d90ccc52ea4e67","observation_id":"2370cc50-fcf2-476b-974f-9d2ced2b7e3e","resolution":{"observed_at":"2026-05-22T21:15:09.897561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05390","last_updated":"2024-05-18T10:25:41Z","snapshot_observed_at":"2026-07-06T15:25:01.109419Z","submitted_at":"2023-05-09T12:36:58Z","title":"COKE: A Cognitive Knowledge Graph for Machine Theory of Mind","version":2},"cited_work":{"arxiv_id":"2305.05390","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.05390","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coke: A cognitive knowledge graph for machine theory of mind","venue":null,"work_id":"45e60fc8-a111-40e3-ab08-5b88067d71c7","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2305.05390","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:9d69b6172d8ea63879a220623d868e58cd7c912544e8c4ae1406d710f0468dc6","observation_id":"2d005ab1-9b3f-4ec0-b1f8-984dc199d592","resolution":{"observed_at":"2026-05-22T21:15:09.409771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-grained human feedback gives better rewards for language model training","venue":null,"work_id":"0a48d164-7942-49fd-9742-5d3cd6264e45","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:31c91ef187547f10481faa4dea385ba7bbc73dcf5a3a180ea560e140ec4f7ee4","observation_id":"c0c43ec4-6bef-4b68-9267-d22fba369505","resolution":{"observed_at":"2026-05-22T21:15:09.807933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fresco: Spatial-temporal correspondence for zero- shot video translation","venue":null,"work_id":"f0cef4fd-2edd-4385-b74e-ebd5b5d7a3ac","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:5b14e478414ee1180706033f55e30c134d7b80ac31393b99860c502a65059912","observation_id":"3522db23-85ac-4993-b3ef-b83afcf4796e","resolution":{"observed_at":"2026-05-22T21:15:09.897860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":"2408.01800","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-07-10T11:37:03.161139Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","venue":"cs.CV","work_id":"0f06e436-0c76-4e3c-be5e-6168f6bc4336","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:60abd0517a3f6f06dbf57989af6131c33ccdbf51ef03547caf081be9a3b3501e","observation_id":"7318a428-6471-4495-abf4-707192b9afda","resolution":{"observed_at":"2026-05-22T21:15:09.349994Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social-iq: A question answering benchmark for artificial social intelligence","venue":null,"work_id":"fca6d108-115b-4721-bc45-a225f3c7f48e","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:ac74458ad22ea53bc12e7ac4603344bd85a8665f0d8eef2fe2484d7eacc69002","observation_id":"663bb478-39c6-4bed-a31e-75985f6cc8d8","resolution":{"observed_at":"2026-05-22T21:15:09.851515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Social-iq: A question answering benchmark for artificial social intelligence","venue":null,"work_id":"19479ed3-a92a-45cd-95dc-d533a4d49b00","year":2019},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:8870093b5a1f12943f108c06187396f14fb37a98f56c069197d54754e05b0244","observation_id":"deeda1b2-ed1b-4949-beee-48f26814acab","resolution":{"observed_at":"2026-05-22T21:15:09.931422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal language analysis in the wild: Cmu-mosei dataset and interpretable dynamic fusion graph","venue":null,"work_id":"ba5ae800-5644-469e-a756-f5507dd9a21c","year":2018},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:d371e9924c17820d554ea724814a9410173da32e864573ddd3717c4fc4059837","observation_id":"a37ea3e4-1c2f-4ef5-b284-596ceaa81179","resolution":{"observed_at":"2026-05-22T21:15:09.923723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T11:03:40.467184Z","title":"Multimodal language analysis in the wild: Cmu-mosei dataset and interpretable dynamic fusion graph","venue":null,"work_id":"9ac9f0ae-f958-44e9-aa53-be7469f0dfa0","year":2018},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:bcd6a841fe02ed77db8fe74ab4e0617f07c9bad552c389a24e2fca73d69dca5a","observation_id":"d2492c97-e274-46c1-a106-929a831bde9a","resolution":{"observed_at":"2026-05-22T21:15:09.928864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10313","last_updated":"2023-12-05T08:59:33Z","snapshot_observed_at":"2026-07-06T16:20:21.258653Z","submitted_at":"2023-09-19T04:51:13Z","title":"Investigating the Catastrophic Forgetting in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.10313","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10313","snapshot_observed_at":"2026-07-04T15:59:57.238238Z","title":"Investigating the catastrophic forgetting in multimodal large language models","venue":null,"work_id":"95c78634-877a-4197-b810-4112c73bd205","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2309.10313","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:5005345e899779405553195b1608f56d79a70d3da45fdcff115848b69485b9f3","observation_id":"e7f946cf-355a-4be4-86f5-0d4fbde378bc","resolution":{"observed_at":"2026-05-22T21:15:09.360489Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llava-next: A strong zero-shot video understanding model, April 2024","venue":null,"work_id":"b64e3354-108b-4df8-9dfa-7c9e3913a287","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:eb9b04e2ced62ccc83f92b191614ab2317b73a85e9de1ec116531c78959c93a1","observation_id":"c88d6e9c-b8e1-40b2-a0c3-79a770f74a78","resolution":{"observed_at":"2026-05-22T21:15:09.917577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Judging llm-as- a-judge with mt-bench and chatbot arena.Advances in Neural Information Processing Systems, 36:46595–46623","venue":null,"work_id":"ed7f3173-cb4a-49dc-aa5e-b39f3ca68c67","year":2023},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:a4c3a2f7ebe4f5272b91e555a9516a17395120f48ed68c5c9a45600b5804c2d4","observation_id":"de2b9e6e-a2b2-42eb-9370-d7ef88925667","resolution":{"observed_at":"2026-05-22T21:15:09.921028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sotopia: Interactive evaluation for social intelligence in language agents","venue":null,"work_id":"ad5e6104-5a54-41c7-896b-c7b0444b3243","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c157d0dcfca6a8efccdeb7c38239fbd442378c58b2bdf3e6cb879e2d2fc6ea89","observation_id":"9a6e78be-c7b8-4e53-9d3e-f766d2417686","resolution":{"observed_at":"2026-05-22T21:15:09.868985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• Social Error:Behaviors that violate social norms and degrade a user’s perception of the robot’s socio-affective competence, such as interrupting at inappropriate times","venue":null,"work_id":"258097a8-f0fa-40a5-b3b2-472eef647072","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:d32fe54a3a12c400ad6251b4fa6212055187769d56cc9ae9b16a6cb05b0a5ae5","observation_id":"601adab4-b5a3-40ee-98ff-34b5c5a80f1f","resolution":{"observed_at":"2026-05-22T21:15:09.858517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• None:Neither a social error nor competence is observed","venue":null,"work_id":"e6a7ccc2-bc95-40f0-b136-d984f7a5fcfd","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:2537132ceb47b0d6c30b7fd089583a2bcd57913765b1d16bee48933ac7f24bf6","observation_id":"7b6704f8-4b08-4655-acc5-20155a31eaa5","resolution":{"observed_at":"2026-05-22T21:15:09.893957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"You are given theImages and Conversation History between a social robotic agent (Jibo) and a participant","venue":null,"work_id":"6f7bf1b1-16d4-4e0c-8267-7df9d17f593e","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:f8beb4f3b07a9d22ca35a1ebbec174033e54de084c855f03a649634091f70b77","observation_id":"f001d6e7-4ff3-41da-9953-8a586228883e","resolution":{"observed_at":"2026-05-22T21:15:09.857046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"01a99e7a-2232-4b64-be39-ab8c87ee1337","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:6aba16271b23656d89033aeab4b66d469eea937e7d69586fba8c50430232ef62","observation_id":"900a2e27-6932-46d8-a099-439bd12f49a8","resolution":{"observed_at":"2026-05-22T21:15:09.905134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a4a2f9ea-5e3c-444e-96d0-438f289b8f87","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:4721c72e63ccfeb1ce6d81117b50662ee7ef348dc6fcc06f78b68cbef888941b","observation_id":"0a21ed2b-d771-4dc0-a77c-5a16f0cfe771","resolution":{"observed_at":"2026-05-22T21:15:09.908327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"10aedd87-4a57-469a-a37a-c0974ccaffa8","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:eecbb9eb4bbf970fccc840adbcef985e895c39143675fd934c63a36d099dfb06","observation_id":"15fe6099-3bc7-45d8-8f43-73191b927cb4","resolution":{"observed_at":"2026-05-22T21:15:09.885028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83000fde-10a2-4718-9f74-d40d86f7285d","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:f47ddaf934aacbc0c8bb1b349f625449924bcf5dcf2f10bcdcc47b193ed8583d","observation_id":"9cfc20a4-3015-4a10-9d28-6526533a985a","resolution":{"observed_at":"2026-05-22T21:15:09.825180Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bd521334-275d-45a9-9494-083749e50499","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:6c484cb7182b94567957c0c7a5c06db2a03747ba0fc26e5ce472c8db0ef354cf","observation_id":"fd18e065-4127-473e-9991-6540468b2228","resolution":{"observed_at":"2026-05-22T21:15:09.933729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"475196f5-a033-4e9e-8cf4-873c0b7b975d","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:6e6583f3e560aaa31813f66b525482f61f0bc2d2fe5ba363eddd035314b3f4a2","observation_id":"c86f18b7-0987-4475-b5c1-413f7c914387","resolution":{"observed_at":"2026-05-22T21:15:09.914324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Respond with True if the behavior demonstrates more than one social attribute","venue":null,"work_id":"63174294-e8a0-436b-853a-bc2f02b4f22b","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:bef3292685abc6a9d40c55e2ffd13f1cc177fe0b6d87bccaf80dc210f7732f74","observation_id":"4aafd43b-9b3c-4547-8845-e6f93ff2e3f0","resolution":{"observed_at":"2026-05-22T21:15:09.927548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I’ll tell you about that next week","venue":null,"work_id":"765dde2f-329a-47d6-bf8d-a166478a817e","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:b7f22561a6f235f530e8dabdcd0f58a297b72caf9a0fcad15023a26b310ac791","observation_id":"cfc1ab52-0109-4c98-86ab-4e965f6d1ab4","resolution":{"observed_at":"2026-05-22T21:15:09.740769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Today I took a walk around the building that I work in","venue":null,"work_id":"e88b745f-2b90-4343-be22-e7c714fdde28","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:03daa9b57ae4924fa5b3eb214638c0803f8280a62e3faf0831e9d6ddc4376e4a","observation_id":"b8cde8d5-676c-4b99-870b-76b92cf20116","resolution":{"observed_at":"2026-05-22T21:15:09.730877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Well, yeah, I did, but I’ve just been staying up late because I get home late and, you know, I go to work late and so it’s kind of just a little bit of a cycle","venue":null,"work_id":"5ab0707e-37ac-477e-8403-a08a9b52f3ba","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:b7506d99d1c5df1bccc7f0e6ce37f9eb27a1df173602a7ecdf027661a4260da2","observation_id":"4a52c350-2e97-4bf2-b8e2-433fee4f8118","resolution":{"observed_at":"2026-05-22T21:15:09.814197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba275e4d-50b1-4b54-8de7-47b379c7140d","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:58882dfada2683d78e4a5da0c06e679b72dce181b445db2941a91878141075eb","observation_id":"9e3bcc59-0fa0-4814-b9e9-e3465a5ef6b1","resolution":{"observed_at":"2026-05-22T21:15:09.850460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Looking forward to hearing about it next week","venue":null,"work_id":"4449d713-6f52-4b3f-a2c2-b4ea69b366b7","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:65f8cab312eced9fe3a81c6d37a68543bebd7dffb366c946154bb2f850347bf4","observation_id":"cc0ed818-ab82-4687-8787-3a1583107ae7","resolution":{"observed_at":"2026-05-22T21:15:09.785139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"It’s great to hear that you took a moment for yourself","venue":null,"work_id":"1609bf76-2510-49e4-b50d-af0fc20cc728","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:591a844e1d19ac14fa83bc0100972b19b8bb69829387cccf38cc9c2bb4608098","observation_id":"44b8a6fc-d46a-4a7a-b710-c063d70c4592","resolution":{"observed_at":"2026-05-22T21:15:09.859866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"But congratulations on finishing a book","venue":null,"work_id":"6cfb9e53-8b55-4091-be52-b4320679acd4","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:44b1331dd70b094a906167d501b428fac70491c397ad33144a680032bc4ffa0f","observation_id":"815b41d0-e97d-46b7-9dac-6721d311ec82","resolution":{"observed_at":"2026-05-22T21:15:09.937621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spending time with friends and trying new activities can be really refreshing","venue":null,"work_id":"4a0494b2-f087-44f0-9970-fe4a2ed4b198","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:a71c2a5d869f97001300df79598b500f655486ce7a0a4bf2e503bbb87a72d9b2","observation_id":"32aadb27-e1d5-469f-a8ae-ffc7dd10d757","resolution":{"observed_at":"2026-05-22T21:15:09.940880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b6ebcf4-dad7-4719-bf03-f217df56aae5","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:3b240d72c7206d29e3abc0d3fd9d89ea62e0964997c884f61ac7d2e60134ef53","observation_id":"9af30814-d136-4b7e-bda1-09034e0370a4","resolution":{"observed_at":"2026-05-22T21:15:09.947152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a30cc551-4f5a-4a00-b9de-491b2a054803","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:901ceea975645beba3676a2aebfa429871dee79150a9a2730b25a2e1df395e71","observation_id":"055c5a8b-8e7a-4d39-be94-e485743404ec","resolution":{"observed_at":"2026-05-22T21:15:09.936804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"87dbb39f-d295-43d9-b285-03b6db9f83e9","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:9f811cbc2ef4d1ef8eec105dbc358f4df483c2e3489493d325184d997829e6b6","observation_id":"a84be610-db7c-4fad-9d56-ae31768e4552","resolution":{"observed_at":"2026-05-22T21:15:09.911740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"06b06d3c-b764-4ee7-88ab-0aa3d986ae32","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:9f5bd71e0ec1dada8051bb828be0b7847b9629d3cbeeaaf289662e95e0a0d0f0","observation_id":"6443deb0-46f5-4331-b405-4e821df8b8e6","resolution":{"observed_at":"2026-05-22T21:15:09.900812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f958b3ab-75a2-4b1e-a8a0-c9067d927cff","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:3406cd075025a6036b49409e00637daec1e96928564e990c232c1be1790c33dd","observation_id":"1ad52494-1993-4202-8ce9-203f243d6725","resolution":{"observed_at":"2026-05-22T21:15:09.911401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b2d4ac88-4a51-4586-a612-4ee4191f69a3","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:fa4e485c54d5f776c0f1706da06dd74b9317e108ea49911582e6fc0c6d1c7aca","observation_id":"d2cb3e6e-e3ba-49c0-b7a1-ad31811cb7b5","resolution":{"observed_at":"2026-05-22T21:15:09.926013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5b1d148c-3e55-4d0c-940f-edcd8c3e100d","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c609ad251eb00f6c1903b7105ca7d24ce8a54a58b62430bfa4e720f33677cb18","observation_id":"7c678bde-2960-4596-9905-cd0892ac176c","resolution":{"observed_at":"2026-05-22T21:15:09.939732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I’m fin- ished","venue":null,"work_id":"33e222dd-d632-4075-a8bd-19348ab7a018","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:c7cd3b34f12fb489af67235ed290928e55d82eb6a433c4581815a62c8fe361fe","observation_id":"85500e76-2153-4927-b1d5-db7be023b80b","resolution":{"observed_at":"2026-05-22T21:15:09.836415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"03da201a-b866-4721-a016-e467813625e7","year":null},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:304bbc5a5a7efbf35e9afd48fe4cde93adebcdc11555e5dcebec720aa5524394","observation_id":"69dcfa45-46c8-45e3-9524-8fac19a9bab8","resolution":{"observed_at":"2026-05-22T21:15:09.943935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I’m ready","venue":null,"work_id":"4c6219c4-3086-4f47-aaa6-48df3ff75bc5","year":2024},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:d6f7c443bf79ace22e288a8116143130f2aca25372c65fb1864adb87cbb76a4f","observation_id":"c2ccd029-1b8c-448e-af8f-5db752474b01","resolution":{"observed_at":"2026-05-22T21:15:09.909134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","latest_version":3,"primary_category":"cs.HC","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning"},"reference_resolution":{"displayed":96,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":23,"verified_fuzzy":56},"total_outbound_references":96},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 96 of 96 outbound references and 1 inbound Pith citation observation for arXiv:2504.13898."}