{"as_of":"2026-08-12T16:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2973a435908d5852774ed4a1e0a4da5ea43c35fd44496555bb6fa71b4d7b6f1e","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:09:24.593662Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.05936/citation-record","integrity":"/paper/2501.05936/integrity","json":"/paper/2501.05936/citation-record.json","paper":"/paper/2501.05936"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:25.107245Z","title":"A 3d-cnns approach to classify users’ emotion through eeg-based topographical maps in hri,","venue":null,"work_id":"7aa5bfc2-bdba-4bba-899e-32e730c520e9","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.445634Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:adef6924ffa3a50548bb98379e7e197e4c5d32f763a5eeebaf8db20c559882d1","observation_id":"5d075735-ab8a-4065-9305-034111c61106","resolution":{"observed_at":"2026-08-10T21:09:25.114072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:25.082020Z","title":"What we learn on the streets: Situated human-robot interactions from an industry perspective,","venue":null,"work_id":"b4984588-4656-4b28-a42d-aac3d3e888c0","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.453078Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:74c13a4fc370d9d2b2a4cc31599d39bf778a23705bd4343f062c20f75d59ef35","observation_id":"525fcbd2-368b-49b1-a9f3-30fd15feb1ac","resolution":{"observed_at":"2026-08-10T21:09:25.093084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:25.057313Z","title":"Getting closer to real-world: Monitoring humans working with collaborative industrial robots,","venue":null,"work_id":"15a913f7-f33d-4ad9-8636-8961cf4f3582","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.458709Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:888b4392a4557143e50c6840ce11ed894f727a5bced5dc32925c734cd0a619b0","observation_id":"e3dad706-b49c-4544-89ed-297dfa38400b","resolution":{"observed_at":"2026-08-10T21:09:25.065745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:25.029684Z","title":"Iar-net: A human-object context guided action recognition network for industrial environment monitoring,","venue":null,"work_id":"f7a731a3-8f48-4a4f-b008-c59b88d018d5","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.464739Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:59f1c3654975a54b0dfa5a705fcc0a11fbb8487cfeb4bcf5e0590990384b3a28","observation_id":"a9e75a96-59bc-483c-9a66-6b7f30442a0f","resolution":{"observed_at":"2026-08-10T21:09:25.037182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:25.006421Z","title":"Df sampler: A self-supervised method for adaptive keyframe sampling,","venue":null,"work_id":"0d600a86-0e9f-4f8c-9adc-4e7a4d00fbd6","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.471439Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:6f6817842b92d982ae9333ada80067171dc8304c831a8e90a3762d2ea48e2e99","observation_id":"b6f0b9d3-ebc6-42cb-987d-e173320bbd28","resolution":{"observed_at":"2026-08-10T21:09:25.013769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.978902Z","title":"Meccano: A multimodal egocentric dataset for humans behavior understanding in the industrial- like domain,","venue":null,"work_id":"9463af81-c61b-4523-ac55-d3435e80d5c7","year":2023},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.478333Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:15b267e11f27b72427387647bb39379692a3b58b1fa6efbc7529d17fd7a1015d","observation_id":"904f2ea0-7722-4700-8197-3a114979a462","resolution":{"observed_at":"2026-08-10T21:09:24.985778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.949194Z","title":"Hri30: An action recognition dataset for industrial human-robot interaction,","venue":null,"work_id":"dcc03545-fbe9-41c5-a72f-ee6cd6d6884e","year":2022},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.486342Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:259c5a04c9aeea94ec27e00cef7139b1d69a03ac6408c27f064839a34e1c2826","observation_id":"43c4bf17-5040-4962-bb5c-a6177ed2fb28","resolution":{"observed_at":"2026-08-10T21:09:24.955731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.923656Z","title":"The ha4m dataset: Multi-modal monitoring of an assembly task for human action recognition in manufacturing,","venue":null,"work_id":"ba6f1543-fd9f-4f95-8f6d-c761da2a66c3","year":2022},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.494075Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:3f66300a2e620f239d3b8ab714734575bbf28547aca8755b5a975aadaf878749","observation_id":"6a58ebd2-ce81-4740-9169-4aae5fee85cd","resolution":{"observed_at":"2026-08-10T21:09:24.930842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.898982Z","title":"Enigma-51: Towards a fine-grained understanding of human behavior in industrial scenarios,","venue":null,"work_id":"ce76059a-0963-4874-9b24-506732510f3e","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.501879Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:e3a2cb5c90cb0ed7e115440762472ba65240e1f13ee01a930b818cbad9f385e5","observation_id":"d3bf1691-fbe2-4167-b409-0068d60277cb","resolution":{"observed_at":"2026-08-10T21:09:24.906288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.878715Z","title":"Multimodal engagement prediction in multiperson human–robot interaction,","venue":null,"work_id":"0522d80d-67b6-43af-a24d-ec8270aa70bd","year":2022},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.509908Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:5f3e96445048601eee8b4eeb1712defbca3a69f612c41837a3e0adfc891f722a","observation_id":"91410af7-7c9a-4e75-a914-517bd6c62757","resolution":{"observed_at":"2026-08-10T21:09:24.884698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.516281Z","title":"A survey on dialogue management in human-robot interaction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.516281Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:1521f14a8907d924ef99f7322bca9615154ae995190a30bd29748b770f983d1e","observation_id":"2a0c7d5b-9444-4dd4-ada1-d51aae434160","resolution":{"observed_at":"2026-08-10T21:09:24.516281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.525169Z","title":"Engagement in human-agent interaction: An overview,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.525169Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:8f4b4799e8d8076d997207d32bb3bfe5506bd081fdc5e01b07de05a9854caef2","observation_id":"397d6a18-3c0c-4d83-ac71-cb5a3fcdcf53","resolution":{"observed_at":"2026-08-10T21:09:24.525169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.818173Z","title":"From the definition to the automatic assessment of engagement in human–robot interaction: A systematic review,","venue":null,"work_id":"d70b9317-0435-4091-a600-2ad7f64d0266","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.532761Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:f2b4a55b0b602a47d3fb800b7257dcb2440e27919d5aae76080a7744c5a6aa06","observation_id":"b568e2e8-b074-406e-a146-a9fba4e59b04","resolution":{"observed_at":"2026-08-10T21:09:24.825065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.797934Z","title":"Enhancing human-machine interactions: a novel framework for ar-based digital twin systems in industrial environments,","venue":null,"work_id":"bb9b72ec-d59d-40b7-bc25-a24d864ee981","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.544096Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:849e762f767f52f02fb054f3131c9f5242b289a510baebfdb1700ee6d7ce7142","observation_id":"3e139c15-63cb-4bfa-adc0-0e659e95ce75","resolution":{"observed_at":"2026-08-10T21:09:24.804771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.776107Z","title":"Unlocking human-robot dynamics: Introducing sensec- obot, a novel multimodal dataset on industry 4.0,","venue":null,"work_id":"6c8bbd83-0340-4524-9597-65cf89ed9d2a","year":2024},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.550964Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:dcbec5ee751f2c0665e4277264e2a81c6e6f6f8c8a3eb3759b166da0b6241c22","observation_id":"55a153dd-359c-45b6-8f12-0e5fbe358fe0","resolution":{"observed_at":"2026-08-10T21:09:24.782224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.745414Z","title":"The via annotation software for images, audio and video,","venue":null,"work_id":"53a007dc-7020-4a6b-86ca-f2a159ea4bc7","year":2019},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.558657Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:6b30dd2eabb09a88db36ca19cca0b44957c451f7dc7f3ce9ef268b5beff79220","observation_id":"9b066c98-61e4-485f-9848-dc8dc12f4196","resolution":{"observed_at":"2026-08-10T21:09:24.757149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.565202Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.565202Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:8c175f3b92d5812e3c76716cbf8d23c161bd6223a2b3dc00cee37bd04b7dc5bd","observation_id":"407f0a51-e324-422c-87f0-fc60bfd256f8","resolution":{"observed_at":"2026-08-10T21:09:24.565202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T21:09:24.570842Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.570842Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:9c4f12ea4a35c2590e66dfc8a4478548a9849beb758b14c93fbd9c4ead61db8a","observation_id":"52026dd1-d33e-497e-bf8e-46f3fb44f197","resolution":{"observed_at":"2026-08-10T21:09:24.570842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.576923Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.576923Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:d5bb4a65957adc033f1ae4b0f4004000476b23cd3adec66fa9f6e904bc8c2bc3","observation_id":"bf2bd7a0-a6c2-488d-aac2-bc1610d260df","resolution":{"observed_at":"2026-08-10T21:09:24.576923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:24.582952Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.582952Z"},"links":{"citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:822ece226d63b5100c66aaa954e522dbf2a9b36e881b8c86fc19164f2b48f80d","observation_id":"88092a0a-c2e4-4902-a45b-27a3052e59ad","resolution":{"observed_at":"2026-08-10T21:09:24.582952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-05T19:15:35.517082Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-10T21:09:24.593662Z","title":"Mediapipe: A framework for building perception pipelines,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.593662Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:3f5afb54af8f8015d69d5b7e6e9bd25590f3ef8924fbd11f1443780f276cf1a0","observation_id":"a7b82c53-e14c-4b42-9b38-8449d89ffa85","resolution":{"observed_at":"2026-08-10T21:09:24.593662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T16:22:29.968672Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2501.05936."}