{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/position-wise-feed-forward-layer/papers/15","list_of":"/method/position-wise-feed-forward-layer","method":"Position-Wise Feed-Forward Layer","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":15,"pages_in_order":139,"rows_per_page":100,"rows":[1401,1500],"of":13895,"counts":{"archive_papers_tagged":13895,"with_a_code_link":6514,"where_syntology_ran_a_sample":2229,"not_listed_spam_title":0,"listed":13895,"listed_where_code_ran":2229,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1902,"every_run_a_failure_of_syntologys_instrument":327,"listed_with_a_run_with_no_instrument_failure":1902,"listed_every_run_a_failure_of_syntologys_instrument":327,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/position-wise-feed-forward-layer","prev":"/method/position-wise-feed-forward-layer/papers/14","next":"/method/position-wise-feed-forward-layer/papers/16","papers":[{"paper":null,"slug":"a-novel-shape-guided-transformer-network-for","title":"A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images","date":"2024-12-31","arxiv_id":"2501.00360","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-study-on-context-length-and-efficient","title":"A Study on Context Length and Efficient Transformers for Biomedical Image Analysis","date":"2024-12-31","arxiv_id":"2501.00619","n_code_links":0,"syntology":null},{"paper":null,"slug":"echoes-in-ai-quantifying-lack-of-plot","title":"Echoes in AI: Quantifying Lack of Plot Diversity in LLM Outputs","date":"2024-12-31","arxiv_id":"2501.00273","n_code_links":0,"syntology":null},{"paper":null,"slug":"gpt-4-on-clinic-depression-assessment-an-llm","title":"GPT-4 on Clinic Depression Assessment: An LLM-Based Pilot Study","date":"2024-12-31","arxiv_id":"2501.00199","n_code_links":0,"syntology":null},{"paper":null,"slug":"innovative-silicosis-and-pneumonia","title":"Innovative Silicosis and Pneumonia Classification: Leveraging Graph Transformer Post-hoc Modeling and Ensemble Techniques","date":"2024-12-31","arxiv_id":"2501.00520","n_code_links":0,"syntology":null},{"paper":null,"slug":"probing-visual-language-priors-in-vlms","title":"Probing Visual Language Priors in VLMs","date":"2024-12-31","arxiv_id":"2501.00569","n_code_links":0,"syntology":null},{"paper":"/paper/storm-spatio-temporal-reconstruction-model","slug":"storm-spatio-temporal-reconstruction-model","title":"STORM: Spatio-Temporal Reconstruction Model for Large-Scale Outdoor Scenes","date":"2024-12-31","arxiv_id":"2501.00602","n_code_links":1,"syntology":null},{"paper":null,"slug":"why-are-positional-encodings-nonessential-for","title":"Why Are Positional Encodings Nonessential for Deep Autoregressive Transformers? Revisiting a Petroglyph","date":"2024-12-31","arxiv_id":"2501.00659","n_code_links":0,"syntology":null},{"paper":null,"slug":"an-unsupervised-anomaly-detection-in","title":"An Unsupervised Anomaly Detection in Electricity Consumption Using Reinforcement Learning and Time Series Forest Based Framework","date":"2024-12-30","arxiv_id":"2501.00107","n_code_links":0,"syntology":null},{"paper":"/paper/averagelinear-enhance-long-term-time-series","slug":"averagelinear-enhance-long-term-time-series","title":"AverageTime: Enhance Long-Term Time Series Forecasting with Simple Averaging","date":"2024-12-30","arxiv_id":"2412.20727","n_code_links":1,"syntology":null},{"paper":null,"slug":"casesumm-a-large-scale-dataset-for-long","title":"CaseSumm: A Large-Scale Dataset for Long-Context Summarization from U.S. Supreme Court Opinions","date":"2024-12-30","arxiv_id":"2501.00097","n_code_links":0,"syntology":null},{"paper":"/paper/facilitating-large-language-model-russian","slug":"facilitating-large-language-model-russian","title":"Facilitating large language model Russian adaptation with Learned Embedding Propagation","date":"2024-12-30","arxiv_id":"2412.21140","n_code_links":1,"syntology":null},{"paper":null,"slug":"position-information-emerges-in-causal","title":"Position Information Emerges in Causal Transformers Without Positional Encodings via Similarity of Nearby Embeddings","date":"2024-12-30","arxiv_id":"2501.00073","n_code_links":0,"syntology":null},{"paper":"/paper/freqmixformerv2-lightweight-frequency-aware","slug":"freqmixformerv2-lightweight-frequency-aware","title":"FreqMixFormerV2: Lightweight Frequency-aware Mixed Transformer for Human Skeleton Action Recognition","date":"2024-12-29","arxiv_id":"2412.20621","n_code_links":1,"syntology":null},{"paper":null,"slug":"nlp-based-regulatory-compliance-using-gpt-4-0","title":"NLP-based Regulatory Compliance -- Using GPT 4.0 to Decode Regulatory Documents","date":"2024-12-29","arxiv_id":"2412.20602","n_code_links":0,"syntology":null},{"paper":"/paper/open-sora-democratizing-efficient-video","slug":"open-sora-democratizing-efficient-video","title":"Open-Sora: Democratizing Efficient Video Production for All","date":"2024-12-29","arxiv_id":"2412.20404","n_code_links":2,"syntology":{"ran":3,"of":3,"n_ran_checked":3,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["hpcaitech/open-sora"],"state":"community repositories only","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["listed"]}}},{"paper":"/paper/a-fuzzy-rank-based-ensemble-of-cnn-models-for-1","slug":"a-fuzzy-rank-based-ensemble-of-cnn-models-for-1","title":"A fuzzy rank-based ensemble of CNN models for MRI segmentation","date":"2024-12-28","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"adversarial-robustness-for-deep-learning","title":"Adversarial Robustness for Deep Learning-based Wildfire Prediction Models","date":"2024-12-28","arxiv_id":"2412.20006","n_code_links":0,"syntology":null},{"paper":null,"slug":"ddd-gendt-dynamic-data-driven-generative","title":"DDD-GenDT: Dynamic Data-driven Generative Digital Twin Framework","date":"2024-12-28","arxiv_id":"2501.00051","n_code_links":0,"syntology":null},{"paper":null,"slug":"efficient-multi-agent-collaboration-with-tool","title":"Efficient Multi-Agent Collaboration with Tool Use for Online Planning in Complex Table Question Answering","date":"2024-12-28","arxiv_id":"2412.20145","n_code_links":0,"syntology":null},{"paper":null,"slug":"real-time-calibration-model-for-low-cost","title":"Real-time Calibration Model for Low-cost Sensor in Fine-grained Time series","date":"2024-12-28","arxiv_id":"2412.20170","n_code_links":0,"syntology":null},{"paper":"/paper/segkan-high-resolution-medical-image","slug":"segkan-high-resolution-medical-image","title":"SegKAN: High-Resolution Medical Image Segmentation with Long-Distance Dependencies","date":"2024-12-28","arxiv_id":"2412.19990","n_code_links":1,"syntology":null},{"paper":null,"slug":"transformer-based-contrastive-meta-learning","title":"Transformer-Based Contrastive Meta-Learning For Low-Resource Generalizable Activity Recognition","date":"2024-12-28","arxiv_id":"2412.20290","n_code_links":0,"syntology":null},{"paper":"/paper/velora-a-low-rank-adaptation-approach-for","slug":"velora-a-low-rank-adaptation-approach-for","title":"VELoRA: A Low-Rank Adaptation Approach for Efficient RGB-Event based Recognition","date":"2024-12-28","arxiv_id":"2412.20064","n_code_links":1,"syntology":null},{"paper":"/paper/vistabnet-adapting-vision-transformers-for","slug":"vistabnet-adapting-vision-transformers-for","title":"VisTabNet: Adapting Vision Transformers for Tabular Data","date":"2024-12-28","arxiv_id":"2501.00057","n_code_links":1,"syntology":null},{"paper":null,"slug":"feature-alignment-based-knowledge","title":"Feature Alignment-Based Knowledge Distillation for Efficient Compression of Large Language Models","date":"2024-12-27","arxiv_id":"2412.19449","n_code_links":0,"syntology":null},{"paper":"/paper/generative-pretrained-embedding-and","slug":"generative-pretrained-embedding-and","title":"Generative Pretrained Embedding and Hierarchical Irregular Time Series Representation for Daily Living Activity Recognition","date":"2024-12-27","arxiv_id":"2412.19732","n_code_links":1,"syntology":null},{"paper":null,"slug":"hidformer-transformer-style-neural-network-in","title":"Hidformer: Transformer-Style Neural Network in Stock Price Forecasting","date":"2024-12-27","arxiv_id":"2412.19932","n_code_links":0,"syntology":null},{"paper":"/paper/optimizing-local-global-dependencies-for","slug":"optimizing-local-global-dependencies-for","title":"Optimizing Local-Global Dependencies for Accurate 3D Human Pose Estimation","date":"2024-12-27","arxiv_id":"2412.19676","n_code_links":1,"syntology":null},{"paper":"/paper/revisiting-pca-for-time-series-reduction-in","slug":"revisiting-pca-for-time-series-reduction-in","title":"Revisiting PCA for time series reduction in temporal dimension","date":"2024-12-27","arxiv_id":"2412.19423","n_code_links":1,"syntology":null},{"paper":"/paper/toward-adaptive-reasoning-in-large-language-1","slug":"toward-adaptive-reasoning-in-large-language-1","title":"Toward Adaptive Reasoning in Large Language Models with Thought Rollback","date":"2024-12-27","arxiv_id":"2412.19707","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["iQua/llmpebase"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/context-aware-deep-learning-for-multi-modal","slug":"context-aware-deep-learning-for-multi-modal","title":"Context-Aware Deep Learning for Multi Modal Depression Detection","date":"2024-12-26","arxiv_id":"2412.19209","n_code_links":1,"syntology":null},{"paper":"/paper/dapointr-domain-adaptive-point-transformer","slug":"dapointr-domain-adaptive-point-transformer","title":"DAPoinTr: Domain Adaptive Point Transformer for Point Cloud Completion","date":"2024-12-26","arxiv_id":"2412.19062","n_code_links":1,"syntology":null},{"paper":null,"slug":"dual-channel-multi-attention-in-vit-for","title":"Dual Channel Multi-Attention in ViT for Biometric Authentication using Forehead Subcutaneous Vein Pattern and Periocular Pattern","date":"2024-12-26","arxiv_id":"2412.19160","n_code_links":0,"syntology":null},{"paper":"/paper/medec-a-benchmark-for-medical-error-detection","slug":"medec-a-benchmark-for-medical-error-detection","title":"MEDEC: A Benchmark for Medical Error Detection and Correction in Clinical Notes","date":"2024-12-26","arxiv_id":"2412.19260","n_code_links":1,"syntology":null},{"paper":"/paper/on-the-expressiveness-and-length","slug":"on-the-expressiveness-and-length","title":"On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages","date":"2024-12-26","arxiv_id":"2412.19350","n_code_links":1,"syntology":null},{"paper":"/paper/reversed-in-time-a-novel-temporal-emphasized","slug":"reversed-in-time-a-novel-temporal-emphasized","title":"Reversed in Time: A Novel Temporal-Emphasized Benchmark for Cross-Modal Video-Text Retrieval","date":"2024-12-26","arxiv_id":"2412.19178","n_code_links":1,"syntology":null},{"paper":"/paper/spectralkd-understanding-and-optimizing","slug":"spectralkd-understanding-and-optimizing","title":"SpectralKD: A Unified Framework for Interpreting and Distilling Vision Transformers via Spectral Analysis","date":"2024-12-26","arxiv_id":"2412.19055","n_code_links":1,"syntology":null},{"paper":"/paper/transformer-based-wireless-capsule-endoscopy","slug":"transformer-based-wireless-capsule-endoscopy","title":"Transformer-Based Wireless Capsule Endoscopy Bleeding Tissue Detection and Classification","date":"2024-12-26","arxiv_id":"2412.19218","n_code_links":1,"syntology":null},{"paper":null,"slug":"adopting-trustworthy-ai-for-sleep-disorder","title":"Adopting Trustworthy AI for Sleep Disorder Prediction: Deep Time Series Analysis with Temporal Attention Mechanism and Counterfactual Explanations","date":"2024-12-25","arxiv_id":"2412.18971","n_code_links":0,"syntology":null},{"paper":"/paper/dcis-efficient-length-extrapolation-of-llms","slug":"dcis-efficient-length-extrapolation-of-llms","title":"DCIS: Efficient Length Extrapolation of LLMs via Divide-and-Conquer Scaling Factor Search","date":"2024-12-25","arxiv_id":"2412.18811","n_code_links":1,"syntology":null},{"paper":"/paper/distortion-aware-adversarial-attacks-on","slug":"distortion-aware-adversarial-attacks-on","title":"Distortion-Aware Adversarial Attacks on Bounding Boxes of Object Detectors","date":"2024-12-25","arxiv_id":"2412.18815","n_code_links":1,"syntology":null},{"paper":null,"slug":"ec-diffuser-multi-object-manipulation-via","title":"EC-Diffuser: Multi-Object Manipulation via Entity-Centric Behavior Generation","date":"2024-12-25","arxiv_id":"2412.18907","n_code_links":0,"syntology":null},{"paper":null,"slug":"evaluating-the-adversarial-robustness-of-3","title":"Evaluating the Adversarial Robustness of Detection Transformers","date":"2024-12-25","arxiv_id":"2412.18718","n_code_links":0,"syntology":null},{"paper":null,"slug":"ister-inverted-seasonal-trend-decomposition","title":"Ister: Inverted Seasonal-Trend Decomposition Transformer for Explainable Multivariate Time Series Forecasting","date":"2024-12-25","arxiv_id":"2412.18798","n_code_links":0,"syntology":null},{"paper":"/paper/mtcae-dfer-multi-task-cascaded-autoencoder","slug":"mtcae-dfer-multi-task-cascaded-autoencoder","title":"MTCAE-DFER: Multi-Task Cascaded Autoencoder for Dynamic Facial Expression Recognition","date":"2024-12-25","arxiv_id":"2412.18988","n_code_links":1,"syntology":null},{"paper":null,"slug":"optimizing-large-language-models-with-an","title":"Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks","date":"2024-12-25","arxiv_id":"2412.18729","n_code_links":0,"syntology":null},{"paper":null,"slug":"position-aware-graph-transformer-for","title":"Position-aware Graph Transformer for Recommendation","date":"2024-12-25","arxiv_id":"2412.18731","n_code_links":0,"syntology":null},{"paper":null,"slug":"unic-adapter-unified-image-instruction","title":"UNIC-Adapter: Unified Image-instruction Adapter with Multi-modal Transformer for Image Generation","date":"2024-12-25","arxiv_id":"2412.18928","n_code_links":0,"syntology":null},{"paper":null,"slug":"using-large-language-models-for-automated","title":"Using Large Language Models for Automated Grading of Student Writing about Science","date":"2024-12-25","arxiv_id":"2412.18719","n_code_links":0,"syntology":null},{"paper":null,"slug":"autosculpt-a-pattern-based-model-auto-pruning","title":"AutoSculpt: A Pattern-based Model Auto-pruning Framework Using Reinforcement Learning and Graph Learning","date":"2024-12-24","arxiv_id":"2412.18091","n_code_links":0,"syntology":null},{"paper":"/paper/decentralized-intelligence-in-gamefi-embodied","slug":"decentralized-intelligence-in-gamefi-embodied","title":"Decentralized Intelligence in GameFi: Embodied AI Agents and the Convergence of DeFi and Virtual Ecosystems","date":"2024-12-24","arxiv_id":"2412.18601","n_code_links":1,"syntology":null},{"paper":"/paper/ditctrl-exploring-attention-control-in-multi","slug":"ditctrl-exploring-attention-control-in-multi","title":"DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation","date":"2024-12-24","arxiv_id":"2412.18597","n_code_links":1,"syntology":{"ran":2,"of":2,"n_ran_checked":0,"n_instrument":2,"unverified":0,"pointer_only":2,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified","official":{"repos":["tencentarc/ditctrl"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official","unlocated"]}}},{"paper":null,"slug":"evopat-a-multi-llm-based-patents","title":"EvoPat: A Multi-LLM-based Patents Summarization and Analysis Agent","date":"2024-12-24","arxiv_id":"2412.18100","n_code_links":0,"syntology":null},{"paper":null,"slug":"leveraging-convolutional-neural-network","title":"Leveraging Convolutional Neural Network-Transformer Synergy for Predictive Modeling in Risk-Based Applications","date":"2024-12-24","arxiv_id":"2412.18222","n_code_links":0,"syntology":null},{"paper":null,"slug":"leveraging-deep-learning-with-multi-head","title":"Leveraging Deep Learning with Multi-Head Attention for Accurate Extraction of Medicine from Handwritten Prescriptions","date":"2024-12-24","arxiv_id":"2412.18199","n_code_links":0,"syntology":null},{"paper":"/paper/multilingual-mathematical-reasoning-advancing","slug":"multilingual-mathematical-reasoning-advancing","title":"Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English","date":"2024-12-24","arxiv_id":"2412.18415","n_code_links":1,"syntology":null},{"paper":"/paper/segment-based-attention-masking-for-gpts","slug":"segment-based-attention-masking-for-gpts","title":"Segment-Based Attention Masking for GPTs","date":"2024-12-24","arxiv_id":"2412.18487","n_code_links":1,"syntology":null},{"paper":"/paper/tab-transformer-attention-bottlenecks-enable","slug":"tab-transformer-attention-bottlenecks-enable","title":"TAB: Transformer Attention Bottlenecks enable User Intervention and Debugging in Vision-Language Models","date":"2024-12-24","arxiv_id":"2412.18675","n_code_links":1,"syntology":null},{"paper":null,"slug":"timelyllm-segmented-llm-serving-system-for","title":"TimelyLLM: Segmented LLM Serving System for Time-sensitive Robotic Applications","date":"2024-12-24","arxiv_id":"2412.18695","n_code_links":0,"syntology":null},{"paper":"/paper/diffformer-a-differential-spatial-spectral","slug":"diffformer-a-differential-spatial-spectral","title":"DiffFormer: a Differential Spatial-Spectral Transformer for Hyperspectral Image Classification","date":"2024-12-23","arxiv_id":"2412.17350","n_code_links":1,"syntology":null},{"paper":null,"slug":"edge-ai-for-agriculture-lightweight-vision","title":"Edge-AI for Agriculture: Lightweight Vision Models for Disease Detection in Resource-Limited Settings","date":"2024-12-23","arxiv_id":"2412.18635","n_code_links":0,"syntology":null},{"paper":null,"slug":"fast-gradient-computation-for-rope-attention","title":"Fast Gradient Computation for RoPE Attention in Almost Linear Time","date":"2024-12-23","arxiv_id":"2412.17316","n_code_links":0,"syntology":null},{"paper":"/paper/layerdropback-a-universally-applicable","slug":"layerdropback-a-universally-applicable","title":"LayerDropBack: A Universally Applicable Approach for Accelerating Training of Deep Networks","date":"2024-12-23","arxiv_id":"2412.18027","n_code_links":1,"syntology":null},{"paper":"/paper/multimodal-preference-data-synthetic","slug":"multimodal-preference-data-synthetic","title":"Multimodal Preference Data Synthetic Alignment with Reward Model","date":"2024-12-23","arxiv_id":"2412.17417","n_code_links":1,"syntology":null},{"paper":"/paper/steinformer-spatial-temporal-interaction","slug":"steinformer-spatial-temporal-interaction","title":"STeInFormer: Spatial-Temporal Interaction Transformer Architecture for Remote Sensing Change Detection","date":"2024-12-23","arxiv_id":"2412.17247","n_code_links":1,"syntology":null},{"paper":null,"slug":"theoretical-constraints-on-the-expressive","title":"Theoretical Constraints on the Expressive Power of $\\mathsf{RoPE}$-based Tensor Attention Transformers","date":"2024-12-23","arxiv_id":"2412.18040","n_code_links":0,"syntology":null},{"paper":"/paper/token-statistics-transformer-linear-time","slug":"token-statistics-transformer-linear-time","title":"Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction","date":"2024-12-23","arxiv_id":"2412.17810","n_code_links":1,"syntology":null},{"paper":null,"slug":"uroadnet-dual-sparse-attentive-u-net-for","title":"URoadNet: Dual Sparse Attentive U-Net for Multiscale Road Network Extraction","date":"2024-12-23","arxiv_id":"2412.17573","n_code_links":0,"syntology":null},{"paper":"/paper/an-openmind-for-3d-medical-vision-self","slug":"an-openmind-for-3d-medical-vision-self","title":"An OpenMind for 3D medical vision self-supervised learning","date":"2024-12-22","arxiv_id":"2412.17041","n_code_links":1,"syntology":null},{"paper":null,"slug":"dr-encoder-encode-low-rank-gradients-with","title":"DR-Encoder: Encode Low-rank Gradients with Random Prior for Large Language Models Differentially Privately","date":"2024-12-22","arxiv_id":"2412.17053","n_code_links":0,"syntology":null},{"paper":"/paper/multifaceted-user-modeling-in-recommendation","slug":"multifaceted-user-modeling-in-recommendation","title":"Multifaceted User Modeling in Recommendation: A Federated Foundation Models Approach","date":"2024-12-22","arxiv_id":"2412.16969","n_code_links":1,"syntology":null},{"paper":null,"slug":"on-fusing-chatgpt-and-ensemble-learning-in","title":"On Fusing ChatGPT and Ensemble Learning in Discon-tinuous Named Entity Recognition in Health Corpora","date":"2024-12-22","arxiv_id":"2412.16976","n_code_links":0,"syntology":null},{"paper":null,"slug":"reconsidering-smt-over-nmt-for-closely","title":"Reconsidering SMT Over NMT for Closely Related Languages: A Case Study of Persian-Hindi Pair","date":"2024-12-22","arxiv_id":"2412.16877","n_code_links":0,"syntology":null},{"paper":null,"slug":"substationai-multimodal-large-model-based","title":"SubstationAI: Multimodal Large Model-Based Approaches for Analyzing Substation Equipment Faults","date":"2024-12-22","arxiv_id":"2412.17077","n_code_links":0,"syntology":null},{"paper":"/paper/survey-on-abstractive-text-summarization","slug":"survey-on-abstractive-text-summarization","title":"Survey on Abstractive Text Summarization: Dataset, Models, and Metrics","date":"2024-12-22","arxiv_id":"2412.17165","n_code_links":2,"syntology":null},{"paper":null,"slug":"tar3d-creating-high-quality-3d-assets-via","title":"TAR3D: Creating High-Quality 3D Assets via Next-Part Prediction","date":"2024-12-22","arxiv_id":"2412.16919","n_code_links":0,"syntology":null},{"paper":"/paper/flash3d-super-scaling-point-transformers","slug":"flash3d-super-scaling-point-transformers","title":"Flash3D: Super-scaling Point Transformers through Joint Hardware-Geometry Locality","date":"2024-12-21","arxiv_id":"2412.16481","n_code_links":1,"syntology":null},{"paper":null,"slug":"from-histopathology-images-to-cell-clouds","title":"From Histopathology Images to Cell Clouds: Learning Slide Representations with Hierarchical Cell Transformer","date":"2024-12-21","arxiv_id":"2412.16715","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-language-models-compression-via-low","title":"Lillama: Large Language Models Compression via Low-Rank Feature Distillation","date":"2024-12-21","arxiv_id":"2412.16719","n_code_links":0,"syntology":null},{"paper":null,"slug":"object-detection-approaches-to-identifying","title":"Object Detection Approaches to Identifying Hand Images with High Forensic Values","date":"2024-12-21","arxiv_id":"2412.16431","n_code_links":0,"syntology":null},{"paper":null,"slug":"paraformer-parameterization-of-sub-grid-scale","title":"Paraformer: Parameterization of Sub-grid Scale Processes Using Transformers","date":"2024-12-21","arxiv_id":"2412.16763","n_code_links":0,"syntology":null},{"paper":"/paper/stkdrec-spatial-temporal-knowledge","slug":"stkdrec-spatial-temporal-knowledge","title":"STKDRec: Spatial-Temporal Knowledge Distillation for Takeaway Recommendation","date":"2024-12-21","arxiv_id":"2412.16502","n_code_links":1,"syntology":null},{"paper":null,"slug":"vsformer-value-and-shape-aware-transformer","title":"VSFormer: Value and Shape-Aware Transformer with Prior-Enhanced Self-Attention for Multivariate Time Series Classification","date":"2024-12-21","arxiv_id":"2412.16515","n_code_links":0,"syntology":null},{"paper":null,"slug":"adaptable-and-precise-enterprise-scenario-llm","title":"Adaptable and Precise: Enterprise-Scenario LLM Function-Calling Capability Training Pipeline","date":"2024-12-20","arxiv_id":"2412.15660","n_code_links":0,"syntology":null},{"paper":null,"slug":"benchmarking-llms-and-slms-for-patient","title":"Benchmarking LLMs and SLMs for patient reported outcomes","date":"2024-12-20","arxiv_id":"2412.16291","n_code_links":0,"syntology":null},{"paper":null,"slug":"demystifying-the-potential-of-chatgpt-4","title":"Demystifying the Potential of ChatGPT-4 Vision for Construction Progress Monitoring","date":"2024-12-20","arxiv_id":"2412.16108","n_code_links":0,"syntology":null},{"paper":null,"slug":"explainable-ai-for-multivariate-time-series","title":"Explainable AI for Multivariate Time Series Pattern Exploration: Latent Space Visual Analytics with Temporal Fusion Transformer and Variational Autoencoders in Power Grid Event Diagnosis","date":"2024-12-20","arxiv_id":"2412.16098","n_code_links":0,"syntology":null},{"paper":null,"slug":"humanlike-cognitive-patterns-as-emergent","title":"Humanlike Cognitive Patterns as Emergent Phenomena in Large Language Models","date":"2024-12-20","arxiv_id":"2412.15501","n_code_links":0,"syntology":null},{"paper":"/paper/linguistic-features-extracted-by-gpt-4","slug":"linguistic-features-extracted-by-gpt-4","title":"Linguistic Features Extracted by GPT-4 Improve Alzheimer's Disease Detection based on Spontaneous Speech","date":"2024-12-20","arxiv_id":"2412.15772","n_code_links":1,"syntology":null},{"paper":"/paper/multi-dimensional-visual-prompt-enhanced","slug":"multi-dimensional-visual-prompt-enhanced","title":"Multi-dimensional Visual Prompt Enhanced Image Restoration via Mamba-Transformer Aggregation","date":"2024-12-20","arxiv_id":"2412.15845","n_code_links":1,"syntology":null},{"paper":null,"slug":"promptoptme-error-aware-prompt-compression","title":"PromptOptMe: Error-Aware Prompt Compression for LLM-based MT Evaluation Metrics","date":"2024-12-20","arxiv_id":"2412.16120","n_code_links":0,"syntology":null},{"paper":null,"slug":"seagrassfinder-deep-learning-for-eelgrass","title":"SeagrassFinder: Deep Learning for Eelgrass Detection and Coverage Estimation in the Wild","date":"2024-12-20","arxiv_id":"2412.16147","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-full-transformer-based-framework-for","title":"A Full Transformer-based Framework for Automatic Pain Estimation using Videos","date":"2024-12-19","arxiv_id":"2412.15095","n_code_links":0,"syntology":null},{"paper":"/paper/a-survey-of-rwkv","slug":"a-survey-of-rwkv","title":"A Survey of RWKV","date":"2024-12-19","arxiv_id":"2412.14847","n_code_links":1,"syntology":null},{"paper":null,"slug":"adaptive-prompt-tuning-vision-guided-prompt","title":"Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning","date":"2024-12-19","arxiv_id":"2412.14640","n_code_links":0,"syntology":null},{"paper":"/paper/associative-memory-inspires-improvements-for","slug":"associative-memory-inspires-improvements-for","title":"Associative memory inspires improvements for in-context learning using a novel attention residual stream architecture","date":"2024-12-19","arxiv_id":"2412.15113","n_code_links":1,"syntology":null},{"paper":"/paper/can-we-get-rid-of-handcrafted-feature","slug":"can-we-get-rid-of-handcrafted-feature","title":"Can We Get Rid of Handcrafted Feature Extractors? SparseViT: Nonsemantics-Centered, Parameter-Efficient Image Manipulation Localization through Spare-Coding Transformer","date":"2024-12-19","arxiv_id":"2412.14598","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":0,"n_instrument":3,"unverified":0,"pointer_only":3,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 3 where Syntology's instrument failed) · 0 unverified","official":{"repos":["scu-zjz/sparsevit"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/enhancing-masked-time-series-modeling-via","slug":"enhancing-masked-time-series-modeling-via","title":"Enhancing Masked Time-Series Modeling via Dropping Patches","date":"2024-12-19","arxiv_id":"2412.15315","n_code_links":1,"syntology":null},{"paper":null,"slug":"how-good-is-gpt-at-writing-political-speeches","title":"How good is GPT at writing political speeches for the White House?","date":"2024-12-19","arxiv_id":"2412.14617","n_code_links":0,"syntology":null}],"record_sha256":"31018b698bd249a3e2c9c0653321a412593b90a89533303649ca59924976b8e0","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}