{"as_of":"2026-08-08T06:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12a587e4393971a6ba1c302e7fbfd975636e256b6f0f646f0e38a9694edc77c1","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:52:40.806226Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.01673/citation-record","integrity":"/paper/2507.01673/integrity","json":"/paper/2507.01673/citation-record.json","paper":"/paper/2507.01673"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.760134Z","title":"An introduction to vision-language mod- eling,","venue":null,"work_id":"a06c0c86-9430-437f-b479-549506af76fa","year":2024},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.573642Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:bcdc37766140adba0cb13af541d9522cbadfc5e810866a83c4fa9da17f72240d","observation_id":"31357355-75cf-4959-bd17-48bfc776012b","resolution":{"observed_at":"2026-08-06T20:52:41.765027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.744045Z","title":"Large language models: A survey,","venue":null,"work_id":"23669c7d-7bb1-4803-a093-1e2a9df70bb7","year":2024},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.578560Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:fc4cb57ce1cea04e83326cecfb689cbf26ce2d374d817d99e2b88ebcf62268ff","observation_id":"e93fd182-7993-4aef-ae89-0da411ee3fbc","resolution":{"observed_at":"2026-08-06T20:52:41.748738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.583109Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.583109Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:62ae3617ab48ad3a656ef02281209ed7cf4c6936d1d8745fa24d4dbf233831f1","observation_id":"0f500986-8d3b-41a1-8e31-17f7a5e9e0c8","resolution":{"observed_at":"2026-08-06T20:52:40.583109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.717644Z","title":"Fine-tuning large vision-language models as decision- making agents via reinforcement learning,","venue":null,"work_id":"de55ea97-69d5-4206-8ce6-eecab2e52bd1","year":2024},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.588072Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:5d3b662ef07c5fe10302bb554e4fd94bdd3bf16d2aafaeea389c8c3ea344fa1f","observation_id":"41012dbe-e383-480a-aad6-f4e39f0a9e8e","resolution":{"observed_at":"2026-08-06T20:52:41.722066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.703498Z","title":"Affective computing in education: A systematic review and future research,","venue":null,"work_id":"a25e6341-e498-48e0-aa4f-5f523cda86b2","year":2019},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.592857Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:03f74cffc002ab8052bf33c81a2b33e8d419bfbfbc23a9aa5e53ada5fe24d583","observation_id":"005c1c03-6d16-4f54-b57d-f27965ee5d3b","resolution":{"observed_at":"2026-08-06T20:52:41.707901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.688016Z","title":"Learning from label relationships in human affect,","venue":null,"work_id":"65b9d011-26f0-4674-bbf0-7b8f6fafc648","year":2022},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.597306Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:4a5fe0f9989184e3b867a0fecf51c9ab4dcbe9bf2abe0b3962e16031d813d33c","observation_id":"6d7c80ba-dd34-4d0c-8b3c-c124fbbbfbf5","resolution":{"observed_at":"2026-08-06T20:52:41.692862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.674240Z","title":"Survey on rgb, 3d, thermal, and multimodal approaches for facial expression recognition: History, trends, and affect-related applications,","venue":null,"work_id":"ac373e06-f082-44e7-9022-6acf70448e56","year":2016},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.602224Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:c91b40f3b6d9c584e8fb37f5a6704b49d9996f7cd3287073ca69a98e59733cc4","observation_id":"f888bdd9-89b6-4bb8-80c2-3f18343e62ce","resolution":{"observed_at":"2026-08-06T20:52:41.678659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.659092Z","title":"4d facial analysis: A survey of datasets, algorithms and applications,","venue":null,"work_id":"d466ebd9-8735-4c18-a6ea-7cfddc6dc35d","year":2023},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.606501Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:18d542854a6ec615854d3b41cdd04c9a08ea98d2f61851a712501bb1bed2c0b5","observation_id":"f1206aa0-3d42-4c07-b0e2-ab4c27f778f0","resolution":{"observed_at":"2026-08-06T20:52:41.663783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.643104Z","title":"Constants across cultures in the face and emotion.,","venue":null,"work_id":"e22a3a85-4593-4761-a90a-18cfae634b7a","year":1971},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.610753Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:2ca022bac341fac9da4168f0d58c742e558814e691d03505567436525bd8fcfd","observation_id":"ad8c868d-7a53-4619-af27-fe83171c03f6","resolution":{"observed_at":"2026-08-06T20:52:41.647633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.628117Z","title":"3d facial expression recognition via multiple kernel learning of multi-scale local normal patterns,","venue":null,"work_id":"8cdb186b-f410-4a30-a93e-5d1e560b91d2","year":2012},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.615012Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:5ea7ff8661ccd899fdcd49c8e226f5512260e019bbe7aeec34344273849e5745","observation_id":"9a12f4e3-cc13-43ec-8a9a-a383d78fc887","resolution":{"observed_at":"2026-08-06T20:52:41.632653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.613334Z","title":"Expression-insensitive 3d face recognition using sparse representation,","venue":null,"work_id":"bf3280cf-caab-47f7-873c-ebe6e56dbc0e","year":2009},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.619305Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:1dd4a66e5cc3ce9e7051622d0bcc2c7b7b1fc58a7d3d0b2bc1ce1efd1d62eda9","observation_id":"a0fed24d-b882-4089-9a8a-b4a471e818f8","resolution":{"observed_at":"2026-08-06T20:52:41.618034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.597490Z","title":"An efficient multimodal 2d+ 3d feature-based approach to automatic facial expression recognition,","venue":null,"work_id":"e117cc92-6381-459d-9c04-e5f2eec2772b","year":2015},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.623937Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:8717e33484e31d50ac9a068d8eadac9d09df317f022b74ff3a492d63f0d857ce","observation_id":"12d850ac-a75b-4be9-9e24-b6e4c5f6b12c","resolution":{"observed_at":"2026-08-06T20:52:41.602565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.565725Z","title":"Bilinear models for 3-d face and facial expression recognition,","venue":null,"work_id":"093fcdb9-9ba5-4079-bce8-6d548175dd9e","year":2008},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.628283Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:e17f30217dfd05c9726d4a3c76469b1eb31871bd625bb3d95e61c3f0458bb37a","observation_id":"4fb04a88-cb74-4ab8-8efb-1f6be4c54ad1","resolution":{"observed_at":"2026-08-06T20:52:41.578498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.521271Z","title":"Automatic 3d facial expres- sion recognition based on a bayesian belief net and a statistical facial feature model,","venue":null,"work_id":"f7bdc589-d049-4ba6-859c-9b932a655323","year":2010},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.632621Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:6fe066a792383fc24849e343c59b01f552c0511bbc6b5bcf8b4b42baaf4e42a6","observation_id":"ef7616e6-4238-48e3-b59a-fae33f85eeda","resolution":{"observed_at":"2026-08-06T20:52:41.541842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.486065Z","title":"An intrinsic framework for analysis of facial surfaces,","venue":null,"work_id":"3be623d0-d6db-4291-8b6c-299f4f7a164d","year":2009},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.636802Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:0caf078c82a92fd642176bf095e4ce1db8e6c3292b2e15c45cd3a1dc3bc32123","observation_id":"f0f0e481-4128-46e0-81cf-2280dd0d3a18","resolution":{"observed_at":"2026-08-06T20:52:41.501482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.436734Z","title":"Shape analysis of local facial patches for 3d facial expression recognition,","venue":null,"work_id":"d41027e2-7739-4b06-b059-107cdd71684f","year":2011},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.640831Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ca6b645f629a92217c972ce07c96d679e31ef619154611d2650940cc3ddc374b","observation_id":"ddb676f9-5f24-48ac-9276-8bb7f0c9f541","resolution":{"observed_at":"2026-08-06T20:52:41.454304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.406140Z","title":"Multimodal 2d+3d facial expression recog- nition with deep fusion convolutional neural network,","venue":null,"work_id":"828ad67d-d665-435f-82fe-9f45f8b115b1","year":2017},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.645346Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:17b0dc00e00745b7ba97ecfa98a124882fe6ea7c42c3c74455535e91494ea90b","observation_id":"9455b85b-170f-4dda-a138-81f91c5ca377","resolution":{"observed_at":"2026-08-06T20:52:41.415472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.383600Z","title":"Facial expression recognition via joint deep learning of rgb-depth map latent representations,","venue":null,"work_id":"fe30d82e-abe1-431e-aa4f-a21c4f4d60db","year":2017},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.649579Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:7083ba1925c6b16b7cd3dfc370550169e41c6aa99c9496ebf50b3fc20c86d18e","observation_id":"de5520cb-b1f6-48bd-b21c-5ee574309594","resolution":{"observed_at":"2026-08-06T20:52:41.392384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.368143Z","title":"A high-resolution spontaneous 3d dynamic facial expression database,","venue":null,"work_id":"c07faabd-6c27-49ff-ad76-ceb742def03c","year":2013},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.653632Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:10bad6e2be64868530782e19c90ebc2fe37b497969fa8bf789955f5a9af2561f","observation_id":"7e522cdf-c59f-413a-ae52-326ec58cfd1f","resolution":{"observed_at":"2026-08-06T20:52:41.373278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.353474Z","title":"Tracking vertex flow and model adaptation for three-dimensional spatiotemporal face analysis,","venue":null,"work_id":"09064203-e0e2-44a4-bad5-97b298c4496f","year":2010},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.658347Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:b5316d698d4893647418b8eb1ef19630cf85a9fe74ac532087c6184033288c21","observation_id":"8e93f52d-622d-4091-9bd2-a9b754c65e32","resolution":{"observed_at":"2026-08-06T20:52:41.357989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.338404Z","title":"Recognition of 3d facial expression dynamics,","venue":null,"work_id":"f311767c-e673-4256-8e1e-dc15210b09f0","year":2012},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.662431Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:fee1560bbffe0baafa03888b9c7f55e0eafad9798ab74487bf520e36d0de679f","observation_id":"55425718-8679-47cf-a3f9-ad76bb7c4e44","resolution":{"observed_at":"2026-08-06T20:52:41.342798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.322908Z","title":"4-d facial expression recognition by learning geometric deformations,","venue":null,"work_id":"634b93bc-b1d5-4ef1-85ea-fcaf9a7f2ea6","year":2014},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.666973Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ad01a3f40c5acef78c2c4cfa62f5a56378ead5b0d6821569fc9968289b3f8ded","observation_id":"5a90fac8-2f71-4ec3-866f-e58a3cf86dde","resolution":{"observed_at":"2026-08-06T20:52:41.328037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.308411Z","title":"3d/4d facial expression analysis: An advanced annotated face model approach,","venue":null,"work_id":"3aa409ff-c2e7-480d-8ad6-5bee2afd90cb","year":2012},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.671247Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:0cb32758c32393ac9328bf460a1fdd032ab880688ca836ddf1adf7158a49080b","observation_id":"685c816c-96d0-4855-ae9d-b82dce96226f","resolution":{"observed_at":"2026-08-06T20:52:41.312956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.293669Z","title":"4d facial expression recognition,","venue":null,"work_id":"af175f89-419a-45a0-af8f-bbc73f25b738","year":2011},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.675791Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ca976eea0476da7d6dc48a1429bb74bd4a0707c1e0af14459394e8b92076aa9e","observation_id":"d69e3dc3-e442-4dc6-a050-167844711986","resolution":{"observed_at":"2026-08-06T20:52:41.298055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.278300Z","title":"Nebula feature: A space-time feature for posed and spontaneous 4d facial behavior analysis,","venue":null,"work_id":"000a89a5-72fe-4410-b3fc-83b17eabcabb","year":2013},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.679841Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:47c6e23543ead4ffc24fa035f747cad57b79f3ceba67b6fdf797e61b3580143c","observation_id":"d714e1b3-bb28-4f5d-83bd-33d27b94fec5","resolution":{"observed_at":"2026-08-06T20:52:41.283252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.264172Z","title":"Automatic 4d facial expression recog- nition using dynamic geometrical image network,","venue":null,"work_id":"2d44cc67-c8af-4b5a-94e3-bba65026e2ee","year":2018},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.684474Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:43567cfad1faf0a4609ad62d413e51fbd693cfc0acafebdae55173042a5d9c71","observation_id":"f4afa926-76e5-402e-bb0d-8bbf67bd1562","resolution":{"observed_at":"2026-08-06T20:52:41.268490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.250202Z","title":"Margin loss: Making faces more separable,","venue":null,"work_id":"d1f19aba-e2cf-45f1-a819-7084fb507bb7","year":2018},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.688570Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:3f266823a6a96e5791bba54fed7eb006fb48e78ec932ffff707a15671bb2a5f1","observation_id":"df51fbb4-ae9e-4fde-9407-125554856f4b","resolution":{"observed_at":"2026-08-06T20:52:41.254805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.235733Z","title":"Secondary information aware fa- cial expression recognition,","venue":null,"work_id":"72b1a3dd-13cf-4df0-930d-c4a7f6bc666a","year":2019},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.692995Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:2bf333c4ad3a02eb4bb87adb42a3cd871aeca098a40f8f318be16ed7faf47089","observation_id":"a1dfc3db-0bbc-4035-8f6b-d1486760f8a8","resolution":{"observed_at":"2026-08-06T20:52:41.240149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.215299Z","title":"Fast and efficient facial expression recognition using a gabor convolutional network,","venue":null,"work_id":"6421209d-717a-4302-814b-3ad8197ebad2","year":1954},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.696977Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ff5758a24fe59ffac913d9800950d210d5ae0650c24e29a96e264f954a212ec0","observation_id":"fa4248c7-14bb-4255-9b3a-2d37ee3d23f0","resolution":{"observed_at":"2026-08-06T20:52:41.219909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.199829Z","title":"A two-stage spatiotemporal attention convolution network for continuous dimensional emotion recognition from facial video,","venue":null,"work_id":"0f45b7c7-3ae9-4657-ab82-c6065002fe0a","year":2021},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.701306Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:9850d3ce5b545ec33b7ec21e65644b1772cc7568848bee40cf1f6977f0365881","observation_id":"e1bde50f-de73-4b90-9bdc-dd5670c2c3b4","resolution":{"observed_at":"2026-08-06T20:52:41.205048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.182707Z","title":"Representation learning with con- trastive predictive coding,","venue":null,"work_id":"086ddbc7-55e1-4580-8b74-1f72ce159cd8","year":2019},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.705539Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:50ad8858f6e89359d1d70969347593776941384443856128bfcd525ea351a994","observation_id":"aae9e007-ba95-4a18-ac88-bc7371266aff","resolution":{"observed_at":"2026-08-06T20:52:41.187876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.166287Z","title":"Bosphorus database for 3d face analysis,","venue":null,"work_id":"bf33d608-4c91-46c3-90d0-2cd6c758ed5a","year":2008},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.709988Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:c222ba79e8276be8f8797107f05e4821470afd4d68cb1c3b01eac7659b3ff868","observation_id":"657eb013-04b5-4f8d-b3fb-678883ff768c","resolution":{"observed_at":"2026-08-06T20:52:41.171453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.151626Z","title":"A 3d facial expression database for facial behavior research,","venue":null,"work_id":"47485c93-f664-4fbe-b4fa-a237bb3f2ca4","year":2006},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.714219Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:d95d3cfb83512de2b6abd32a95f10b9982bd41aec7fb5e107a84e97035dce4a4","observation_id":"bf624bc0-d3a5-4c1c-907f-ba2a9536382c","resolution":{"observed_at":"2026-08-06T20:52:41.155857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.137351Z","title":"Bp4d-spontaneous: a high-resolution spontaneous 3d dynamic facial expression database,","venue":null,"work_id":"8364d117-9645-4a56-9ed2-e254b266c59c","year":2014},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.718148Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:f3efdd1137a5d5532df07ffe091b2822eaa023d3dd950334a549d24c77270d33","observation_id":"27f9065a-3760-4084-aa0f-c07a27983127","resolution":{"observed_at":"2026-08-06T20:52:41.141816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.123278Z","title":"Mag- nifying subtle facial motions for effective 4d expression recognition,","venue":null,"work_id":"3795b650-ea3a-4902-8a4f-de1751fbb580","year":2017},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.722296Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:62e242fccd25b7bd95fed4ea60ae8e7e88e847b8859f65cce007d77274f7d75b","observation_id":"a6ab89e3-2df5-4bd6-bcd4-f0c6c542bfb2","resolution":{"observed_at":"2026-08-06T20:52:41.127516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.106879Z","title":"Landmarks-assisted collaborative deep framework for automatic 4d facial expression recognition,","venue":null,"work_id":"8e12a533-5e82-426f-8a22-b2d5bf629d67","year":2020},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.726687Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:04a2db0be5a48e8a6d9148674b23dbeb9602db8c80693e03fca810e5ffa3c194","observation_id":"d94f9648-41d1-4b1a-aba9-5c34d963b0c9","resolution":{"observed_at":"2026-08-06T20:52:41.112487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.092542Z","title":"Towards reading beyond faces for sparsity-aware 3d/4d affect recognition,","venue":null,"work_id":"74c057df-6ba7-4656-9be6-af5c18f6b395","year":2021},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.731211Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:bac9937f23238d6705abe15161765685639c676de211e81562c96a754abe84a1","observation_id":"f4b2b3d1-4a02-42ad-a5b2-600ca031bdef","resolution":{"observed_at":"2026-08-06T20:52:41.097002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.077364Z","title":"Disentangling 3d/4d facial affect recognition with faster multi-view transformer,","venue":null,"work_id":"639b50df-e89c-4f37-a4e5-c4982384c619","year":1913},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.735269Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:1aa91d4343c4814efab6a5ce7a2b550f5254db5cd393be937863ebb5e8cb8042","observation_id":"620d8af1-9ec5-41d6-b218-9026425ca506","resolution":{"observed_at":"2026-08-06T20:52:41.082248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01203","last_updated":"2025-06-01T22:47:11Z","snapshot_observed_at":"2026-08-07T11:47:50.535123Z","submitted_at":"2025-06-01T22:47:11Z","title":"Self-Supervised Multi-View Representation Learning using Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"cited_work":{"arxiv_id":"2506.01203","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.01203","snapshot_observed_at":"2026-08-06T20:52:40.889301Z","title":"Self-Supervised Multi-View Representation Learning using Vision-Language Model for 3D/4D Facial Expression Recognition","venue":"cs.CV","work_id":"6238eefb-f285-426a-a1c1-2c8d7305c02f","year":2025},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.739904Z"},"links":{"cited_paper":"/paper/2506.01203","citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ae2a93f47d662ce0505b2c67f4297f1b6f62bfab81b758ce21e842e73bf7c0e2","observation_id":"a5589240-9241-4bde-b6e7-41a5fe1af375","resolution":{"observed_at":"2026-08-06T20:52:40.894287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09336","last_updated":"2025-05-14T12:31:21Z","snapshot_observed_at":"2026-08-07T15:45:27.236916Z","submitted_at":"2025-05-14T12:31:21Z","title":"Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"cited_work":{"arxiv_id":"2505.09336","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.09336","snapshot_observed_at":"2026-08-06T20:52:40.868272Z","title":"Unsupervised Multiview Contrastive Language-Image Joint Learning with Pseudo-Labeled Prompts Via Vision-Language Model for 3D/4D Facial Expression Recognition","venue":"cs.CV","work_id":"fb8eec01-4c54-419d-ad4a-27476d4bc058","year":2025},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.744822Z"},"links":{"cited_paper":"/paper/2505.09336","citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:6306b91dd769c179283aff62ecafe65ee11365c1dcb4f811f1e2ea3806bb01dc","observation_id":"da82a192-593c-41c7-aa4f-79910e7334b7","resolution":{"observed_at":"2026-08-06T20:52:40.873049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19739","last_updated":"2025-04-28T12:36:14Z","snapshot_observed_at":"2026-08-07T15:58:37.185956Z","submitted_at":"2025-04-28T12:36:14Z","title":"Contrastive Language-Image Learning with Augmented Textual Prompts for 3D/4D FER Using Vision-Language Model","version":1},"cited_work":{"arxiv_id":"2504.19739","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19739","snapshot_observed_at":"2026-08-06T20:52:40.844552Z","title":"Contrastive Language-Image Learning with Augmented Textual Prompts for 3D/4D FER Using Vision-Language Model","venue":"cs.CV","work_id":"afbf3e67-b9ee-4b2b-ab70-a15e21ee684b","year":2025},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.749811Z"},"links":{"cited_paper":"/paper/2504.19739","citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:846d66485a08406f44172e98e3ddd49d8d5e82b8e6ee910d585738d7f09f86c6","observation_id":"0024b4d0-c503-4169-87c9-614c53ce3dc0","resolution":{"observed_at":"2026-08-06T20:52:40.851195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.063277Z","title":"Action recognition with dynamic image networks,","venue":null,"work_id":"ce002bc3-f628-46ef-885c-1b51edc92ad5","year":2017},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.754421Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ab8342a89756b7fdad737cc7efa0e4d1b732f1789130934bef76f86208ac009f","observation_id":"82b9d392-e194-462d-bb5f-d62e17830f75","resolution":{"observed_at":"2026-08-06T20:52:41.067497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.033065Z","title":"Automatic 3d facial expression recognition using geometric scattering representation,","venue":null,"work_id":"c5bb262a-8bc2-4c68-a1b4-018a3455c17e","year":2015},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.764600Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:bb7f915d930c9e32bb24d7daae577239c8b3055c46244967ac9c6aae2acaa57e","observation_id":"74b9187e-474b-4794-9ef4-655172eb28c6","resolution":{"observed_at":"2026-08-06T20:52:41.037571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.018042Z","title":"Self-supervised learning via multi-view facial ren- dezvous for 3d/4d affect recognition,","venue":null,"work_id":"123d0cf3-2832-42ed-86d0-b0e6466a4d54","year":2021},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.769570Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:96f587685c3bb24e46a7c7ae1c78114f33b4dea53c2f5110ad6d51ae235117bd","observation_id":"0f91d0d7-684d-4ed1-8411-98c237668a19","resolution":{"observed_at":"2026-08-06T20:52:41.022870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.002958Z","title":"Automatic 4d facial expression recog- nition via collaborative cross-domain dynamic image network,","venue":null,"work_id":"78d20fc7-3c35-4f2d-bda6-0b6f0ff6306a","year":2019},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.774593Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:547d57664624c8731f77ca9ea009fe87d921db8339d9deb350bfdb7436d47a61","observation_id":"f5836757-1bca-48d4-a456-5da3d85dd658","resolution":{"observed_at":"2026-08-06T20:52:41.007671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.986563Z","title":"Texture and geom- etry scattering representation-based facial expression recognition in 2d+3d videos,","venue":null,"work_id":"59466167-3e70-4c34-83be-261a0b7ec57d","year":2018},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.778562Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:ddc9c599aac85e4f22804df81867e71f0e5fb53ac563e0f02605d1ddfc074f41","observation_id":"1f980043-d512-443d-bb32-f25ec4b95b77","resolution":{"observed_at":"2026-08-06T20:52:40.991349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.969854Z","title":"Automatic 4d facial expression recognition using dct features,","venue":null,"work_id":"84e1764d-9aeb-4828-aa4e-434e3f92fe01","year":2015},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.783197Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:d848af3f41984b77ae76f5484424ec9935ef1839d68edc5f21aeb4695544ae7c","observation_id":"cc6d24f2-b246-447d-baee-f7d21ac30c51","resolution":{"observed_at":"2026-08-06T20:52:40.975041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:41.048513Z","title":"Muscular movement model- based automatic 3d/4d facial expression recognition,","venue":null,"work_id":"e41a3be0-280b-4ffc-a438-3d240031b41e","year":2016},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.787593Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:3659d2e9ffd6c3ce01f457b19512c0291c92b532f074e220910b5ec89824a40e","observation_id":"6b7f458d-15be-4abb-931e-6ade54b3e35c","resolution":{"observed_at":"2026-08-06T20:52:41.052915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.953802Z","title":"Sparse coding-based represen- tation of lbp difference for 3d/4d facial expression recognition,","venue":null,"work_id":"965f2f70-3b86-4393-a681-ada9d5a79624","year":2019},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.792634Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:7db0b707e0dbe745251a23d3e5fd3befacd55187cd365eb51e1df7180fbdde39","observation_id":"13d3e003-612f-4b56-999a-0ef622bcae9b","resolution":{"observed_at":"2026-08-06T20:52:40.958732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.936823Z","title":"An effective methodology for dynamic 3d facial expression retrieval,","venue":null,"work_id":"c3fc715f-7076-4872-b208-6c25ddbf7ef8","year":2016},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.797399Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:dc441e2a4094b8130075fe5d83fe1ae44aae55350ec8077eb9d37f0269a6dd0a","observation_id":"0f26568a-e8e2-42d4-a2e2-c9a4d836778f","resolution":{"observed_at":"2026-08-06T20:52:40.942258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.920091Z","title":"Mag- nifying subtle facial motions for effective 4d expression recognition,","venue":null,"work_id":"546ae624-c29d-4f6d-a503-a30724d55ed4","year":2017},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.801947Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:be96f5364b9d18d108b1fee840f6fdd8b916471fba49365a5026e5b907c21266","observation_id":"acb9ce09-d224-49f0-bb2a-a23ee6d17fdb","resolution":{"observed_at":"2026-08-06T20:52:40.925415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:52:40.904584Z","title":"4dme: A spontaneous 4d micro-expression dataset with mul- timodalities,","venue":null,"work_id":"ab31a85e-f6f7-4937-855d-0e146fe1c51e","year":2022},"citing_paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:40.806226Z"},"links":{"citing_paper":"/paper/2507.01673"},"observation_digest":"sha256:45f46166e7158da70f68bfda5f31f391d45e87892969757bb3b3142e85e9d828","observation_id":"d634c385-7629-4dc7-9163-36c9c4de231f","resolution":{"observed_at":"2026-08-06T20:52:40.909136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01673","last_updated":"2025-07-02T12:55:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T20:43:41.469024Z","submitted_at":"2025-07-02T12:55:09Z","title":"Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":3,"verified_fuzzy":48},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.01673."}