| A Language‐Guided Multimodal Foundation Model for Zero‐Shot and Multi‐Task Brain Signal Analysis added by Syntology |
2026-09 (from id) |
mingzhi-c/metis-brain-signal-foundation-model/METIS.py 437c7011506995a3 |
ran · honoured contract
fingerprinted |
Apache-2.0 (permissive) |
| ENEAS: Embedding-guided Neural Ensemble for Adaptive Segmentation added by Syntology |
2026-09 (from id) |
speridlabs/eneas/eneas/vendor/SeC/inference/modeling_internlm2.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Faster Than Flash: Exploiting Attention Sparsity for Efficient Long-Context Decoding added by Syntology |
2026-09 (from id) |
qluoluo/faster-flash-decoding/ffd_core/modeling/llama.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| FireRedAudio: A General-Purpose Audio Language Model with Decoupled Continuous Representations for Understanding and Generation added by Syntology |
2026-08 (from id) |
FireRedTeam/FireRedAudio/fireredaudio/flow/x_transformers.py 1729f21cf5144f3d |
ran
fingerprinted |
Apache-2.0 (permissive) |
| Decoupled Vision-Language System for Multimodal Understanding and Generation added by Syntology |
2026-08 (from id) |
YifanXu74/Libra/libra/models/libra/modeling_libra.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models added by Syntology |
2026-07 (from id) |
SeunggeunKimkr/genuine-any-order/LatentMDM/model/latent_mdm.py 0c3c32d281da5332 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| 3D-Aware VLMs with Implicit and Explicit Geometries added by Syntology |
2026-07 (from id) |
Vegetebird/VLM-IE3D/common/utils.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Cross-Subject Modeling for Widefield Calcium Imaging via Atlas-Aligned Spatiotemporal Tokenization added by Syntology |
2026-07 (from id) |
ShanechiLab/WiCAT/wicat/models/transformer.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
no licence file found · pointer only |
| The Pitfall of Scaling Up: Uncovering and Mitigating Popularity Bias Amplification in Scaling Transformer-based Recommenders added by Syntology |
2026-06 (from id) |
Tiny-Snow/GenRec/src/genrec/models/model_seqrec/sasrec_sprint.py 91bc58efb8a6482c |
ran · our draft was wrong
fingerprinted |
GPL-3.0 (copyleft) · pointer only |
| Lost in a Single Vector: Improving Long-Document Retrieval with Chunk Evidence Aggregation added by Syntology |
2026-06 (from id) |
PunchlineAAAA/DICE/dream/modeling_dream.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Contextualizing Biological Language Models across Modalities via Logit-Space Contrastive Alignment added by Syntology |
2026-06 (from id) |
facebookresearch/esm/esm/rotary_embedding.py 437c7011506995a3 |
ran · honoured contract
fingerprinted |
MIT (permissive) |
| Focus When Necessary: Adaptive Routing and Collaborative Grounding for Training-Free Visual Grounding added by Syntology |
2026-06 (from id) |
TencentBAC/LazyMCoT/Qwen2.5/modeling_qwen2_5_vl_re_infer.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Deep Residual Injection for Full-Spectrum Forensic Signal Perception in Multimodal Large Language Models added by Syntology |
2026-06 (from id) |
KQL11/Deep-VRM/Models/DeepVRM/modeling_qwen2_5_vl.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Analyzing the Correlation Between Hallucinations and Knowledge Conflicts in Large Language Models added by Syntology |
2026-06 (from id) |
llaraspata/HallucinationDetection/src/model/LlaMa.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Your UnEmbedding Matrix is Secretly a Feature Lens for Text Embeddings added by Syntology |
2026-06 (from id) |
CentreChen/EmbFilter/models/modeling_llama_lr.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Your UnEmbedding Matrix is Secretly a Feature Lens for Text Embeddings added by Syntology |
2026-06 (from id) |
CentreChen/EmbFilter/models/modeling_mistral_lr.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| IR3DE: A Linear Router for Large Language Models added by Syntology |
2026-06 (from id) |
gensyn-ai/IR3DE/models/modeling_llama.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| CART: Context-Anchored Recurrent Transformer * A Parameter-Efficient Architecture with Learned Stability added by Syntology |
2026-06 (from id) |
ccapps42/CART/model/cart.py 4da1a1beab34982c |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation added by Syntology |
2026-06 (from id) |
SAI-Lab-NYU/DREAM-S/dream_s/model/cnets.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation added by Syntology |
2026-06 (from id) |
SAI-Lab-NYU/DREAM-S/dream_s/model/modeling_llama_kv.py b71b0ed70aa2939c |
ran
fingerprinted |
no licence file found · pointer only |
| Eigenvectors of Experts are Training-free Non-collapsing Routers added by Syntology |
2026-05 (from id) |
giangdip2410/SSMoE/SSMoE/Language/SSMoE-Embedding/models/modeling_deepseek.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| CHESS-WORLD-MODEL: A 10M-Game Benchmark for Exact State Tracking from Chess Move Sequences added by Syntology |
2026-05 (from id) |
Benjamin-Walker/Chess-World-Model/models/transformer.py 0d5b4082f0e044b9 |
ran
fingerprinted |
MIT (permissive) |
| JLT: Clean-Latent Prediction in Latent Diffusion Transformers added by Syntology |
2026-05 (from id) |
akatsuki-neo/JLT/util/model_util.py 58823d9435a8751b |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| One LR Doesn't Fit All: Heavy-Tail Guided Layerwise Learning Rates for LLMs added by Syntology |
2026-05 (from id) |
hed-ucas/Layer-wise-Learning-Rate/galore_utils/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| ChunkFT: Byte-Streamed Optimization for Memory-Efficient Full Fine-Tuning added by Syntology |
2026-05 (from id) |
misonsky/chunk/models/modeling_llama.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| One Model, Two Roles: Emergent Specialization in a Shared Recurrent Transformer added by Syntology |
2026-05 (from id) |
juchengshen/air/models/air/air_1net_L2x_H2x_input_token_prepend.py 5d0ae16200be190c |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| DualKV: Shared-Prompt Flash Attention for Efficient RL Training with Large Rollouts and Long Contexts added by Syntology |
2026-05 (from id) |
amazon-science/dualkv-flash-attn-for-rl/flash-attention/flash_attn/layers/rotary.py 163292f43a3c861b |
ran
fingerprinted |
licence not identified · pointer only |
| Beyond Instance-Level Self-Supervision in 3D Multi-Modal Medical Imaging added by Syntology |
2026-05 (from id) |
Ashespt/TACO/pretrain/TACO/models/modules.py a3ec43c12656acbb |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| MuonQ: Enhancing Low-Bit Muon Quantization via Directional Fidelity Optimization added by Syntology |
2026-05 (from id) |
YupengSu/MuonQ/src/models.py 986643c1063af44b |
ran
fingerprinted |
Apache-2.0 (permissive) |
| Mela: Test-Time Memory Consolidation based on Transformation Hypothesis added by Syntology |
2026-05 (from id) |
Musubi-ai/Mela/mela/model/commons.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment added by Syntology |
2026-05 (from id) |
piooip/SynerMedGen/modeling/bagel/siglip_navit.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
Apache-2.0 (permissive) |
| Beyond Steering Vector: Flow-based Activation Steering for Inference-Time Intervention added by Syntology |
2026-05 (from id) |
flas-ai/FLAS/src/flas/model.py e0782939cfb8d55c |
ran · honoured contract
fingerprinted |
Apache-2.0 (permissive) |
| ELSA: Exact Linear-Scan Attention for Fast and Memory-Light Vision Transformers added by Syntology |
2026-04 (from id) |
Dao-AILab/flash-attention/flash_attn/layers/rotary.py 163292f43a3c861b |
ran
fingerprinted |
BSD-3-Clause (permissive) |
| TTS-PRISM: A Perceptual Reasoning and Interpretable Speech Model for Fine-Grained Diagnosis added by Syntology |
2026-04 (from id) |
xiaomi-research/tts-prism/models/mimo_audio_tokenizer/modeling_rope_utils.py bc697b02f78768ac |
unverified |
Apache-2.0 (permissive) |
| R 2 -dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction added by Syntology |
2026-04 (from id) |
GATECH-EIC/R2-dLLM/dream/model/modeling_dream.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| DepCap: Adaptive Block-Wise Parallel Decoding for Efficient Diffusion LM Inference added by Syntology |
2026-04 (from id) |
X-Xia0828/DepCap/dream/model/modeling_dream.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| KV Packet: Recomputation-Free Context-Independent KV Caching for LLMs added by Syntology |
2026-04 (from id) |
ChuangtaoChen-TUM/KVPacket/kvpacket/kvcache/rope.py 803acdf586a5f2c3 |
unverified |
MIT (permissive) |
| Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference added by Syntology |
2026-04 (from id) |
qqtang-code/FluxAttention/fluxattn/training/modeling_flash_qwen.py ce8a56552eacab99 |
unverified |
MIT (permissive) |
| ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning added by Syntology |
2026-03 (from id) |
Xnhyacinth/ResAdapt/resadapt/allocator/aznet_v1.py fdd93453f92f9167 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Gumbel Distillation for Parallel Text Generation added by Syntology |
2026-03 (from id) |
hxixixh/gumbel-distill/models/dit_gumbel.py 8526ce179df04bd4 |
ran · honoured contract
fingerprinted |
no licence file found · pointer only |
| SERQ: Saliency-Aware Low-Rank Error Reconstruction for LLM Quantization SERQ: SALIENCY-AWARE LOW-RANK ERROR RECONSTRUCTION FOR LLM QUANTIZATION added by Syntology |
2026-03 (from id) |
acalabys/SERQ/modeling/modeling_gemma3.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| SR-TTT Does Not Learn Retrieval: A Correction and Mechanistic Post-Mortem of Surprisal-Aware Residual Test-Time Training added by Syntology |
2026-03 (from id) |
swamynathanvp/Surprisal-Aware-Residual-Test-Time-Training/sr_ttt_kaggle.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| SR-TTT Does Not Learn Retrieval: A Correction and Mechanistic Post-Mortem of Surprisal-Aware Residual Test-Time Training added by Syntology |
2026-03 (from id) |
swamynathanvp/Surprisal-Aware-Residual-Test-Time-Training/sr_ttt_v2.py 437c7011506995a3 |
ran · honoured contract
fingerprinted |
MIT (permissive) |
| SR-TTT Does Not Learn Retrieval: A Correction and Mechanistic Post-Mortem of Surprisal-Aware Residual Test-Time Training added by Syntology |
2026-03 (from id) |
swamynathanvp/Surprisal-Aware-Residual-Test-Time-Training/sr_ttt_fixed.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
MIT (permissive) |
| Stacked from One: Multi-Scale Self-Injection for Context Window Extension added by Syntology |
2026-03 (from id) |
Clement25/SharedLLM/modeling/modeling_llama_sharedllm_flash.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Accelerating LLM Pre-Training through Flat-Direction Dynamics Enhancement added by Syntology |
26 Feb 2026 |
SHUCHENZHU/LITE/peft_pretraining/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| RETLLM: Training and Data-Free MLLMs for Multimodal Information Retrieval added by Syntology |
2026-02 (from id) |
alivecat05/RETLLM/modeling_qwen2_5_vl.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| VIGiA: Instructional Video Guidance via Dialogue Reasoning and Retrieval added by Syntology |
2026-02 (from id) |
dmgcsilva/vigia/inference/model.py 766ad0e51b7a8f09 |
unverified |
no licence file found · pointer only |
| Large Causal Models for Temporal Causal Discovery added by Syntology |
2026-02 (from id) |
kougioulis/LCM/lcm_pytorch/models/misc/RotaryEmbedding.py eb0d65450ca1f1f9 |
unverified |
Apache-2.0 (permissive) |
| MoE-Spec: Expert Budgeting for Efficient Speculative Decoding added by Syntology |
2026-02 (from id) |
SafeAILab/EAGLE/eagle/modeling_eagle.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| SleepMaMi: A Universal Sleep Foundation Model for Integrating Macro-and Micro-structures added by Syntology |
2026-02 (from id) |
keondopark/SleepMaMi/models/transformer_modules.py b61de8836f3137b3 |
unverified |
no licence file found · pointer only |
| DAWN: Dependency-Aware Fast Inference for Diffusion LLMs added by Syntology |
2026-02 (from id) |
lizhuo-luo/DAWN/dream/model/modeling_dream.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| CoPE: Clipped RoPE as A Scalable Free Lunch for Long Context LLMs added by Syntology |
2026-02 (from id) |
hrlics/CoPE/modeling_cope.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| EEmo-Logic: A Unified Dataset and Multi-Stage Framework for Comprehensive Image-Evoked Emotion Assessment added by Syntology |
2026-02 (from id) |
workerred/EEmo-Logic/train/Stage_2/modeling_qwen2_5_vl.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference added by Syntology |
2026-01 (from id) |
fvliang/DART/dart/model/modeling_mixtral_kv.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference added by Syntology |
2026-01 (from id) |
fvliang/DART/dart/model/llama3_dart.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference added by Syntology |
2026-01 (from id) |
fvliang/DART/dart/model/modeling_llama_kv.py ded2d9e57bfdee4e |
unverified |
Apache-2.0 (permissive) |
| EEG-FM-Compass: Progress, Benchmarking, and Future Directions for EEG Foundation Models added by Syntology |
2026-01 (from id) |
Dingkun0817/EEG-FM-Benchmark/models/FM/EEGPT/Model_EEGPT.py c1f873b79cb6cd24 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| VidLaDA: Bidirectional Diffusion Large Language Models for Efficient Video Understanding added by Syntology |
2026-01 (from id) |
ziHoHe/VidLaDA/train/llada_v_prepare/files/modeling_llada.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Elastic Attention: Test-time Adaptive Sparsity Ratios for Efficient Transformers added by Syntology |
2026-01 (from id) |
LCM-Lab/Elastic-Attention/elasticattn/src/model_utils.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| MARS: Unleashing the Power of Speculative Decoding via Margin-Aware Verification added by Syntology |
2026-01 (from id) |
5SSjw/MARS/mars/model/cnets1.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| MARS: Unleashing the Power of Speculative Decoding via Margin-Aware Verification added by Syntology |
2026-01 (from id) |
5SSjw/MARS/mars/model/cnets.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| MARS: Unleashing the Power of Speculative Decoding via Margin-Aware Verification added by Syntology |
2026-01 (from id) |
5SSjw/MARS/mars/model/modeling_llama_kv.py ded2d9e57bfdee4e |
unverified |
MIT (permissive) |
| UniX: Unifying Autoregression and Diffusion for Chest X-Ray Understanding and Generation added by Syntology |
2026-01 (from id) |
ZrH42/UniX/modeling/unix/siglip_navit.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
MIT (permissive) |
| STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning added by Syntology |
2026-01 (from id) |
LingFengGold/STReasoner/base_model/Config-Qwen2.5-14B-Instruct/modeling_qwen2.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| FOAM: Blocked State Folding for Memory-Efficient LLM Training added by Syntology |
2025-12 (from id) |
zqOuO/FOAM/peft_pretraining/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| From Static Structures to Ensembles: Studying and Harnessing Protein Structure Tokenization added by Syntology |
2025-11 (from id) |
IDEA-XL/TokenMD/esm/layers/rotary.py 163292f43a3c861b |
ran
fingerprinted |
no licence file found · pointer only |
| LiveStar: Live Streaming Assistant for Real-World Online Video Understanding added by Syntology |
2025-11 (from id) |
yzy-bupt/LiveStar/inference/modeling_livestar_llm.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| IG-Pruning: Input-Guided Block Pruning for Large Language Models added by Syntology |
2025-11 (from id) |
ictnlp/IG-Pruning/src/models/dsr_modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Information-Theoretic Discrete Diffusion added by Syntology |
2025-10 (from id) |
Dongjae0324/infodis/model/rotary.py 8526ce179df04bd4 |
ran · honoured contract
fingerprinted |
no licence file found · pointer only |
| Edit Less, Achieve More: Dynamic Sparse Neuron Masking for Lifelong Knowledge Editing in LLMs added by Syntology |
2025-10 (from id) |
LiuJinzhe-Keepgoing/NMKE/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Sparser Block-Sparse Attention via Token Permutation added by Syntology |
2025-10 (from id) |
xinghaow99/pbs-attn/pbs_attn/patch/huggingface.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| MeCeFO: Enhancing LLM Training Robustness via Fault-Tolerant Optimization added by Syntology |
2025-10 (from id) |
pkumelon/MeCeFO/peft_pretraining/modeling_llama.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| AnyUp: Universal Feature Upsampling added by Syntology |
2025-10 (from id) |
identical code first harvested elsewhere 437c7011506995a3 |
ran · honoured contract
fingerprinted |
licence of this copy not recorded |
| Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model added by Syntology |
2025-10 (from id) |
RuipingL/Situat3DChange/SCReasoner/model/transformers.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
CC-BY-4.0 · pointer only |
| ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding added by Syntology |
2025-09 (from id) |
KangJialiang/ViSpec/vispec/model/modeling_mixtral_kv.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding added by Syntology |
2025-09 (from id) |
KangJialiang/ViSpec/vispec/model/cnets.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| ViSpec: Accelerating Vision-Language Models with Vision-Aware Speculative Decoding added by Syntology |
2025-09 (from id) |
KangJialiang/ViSpec/vispec/model/modeling_llama_kv.py b71b0ed70aa2939c |
ran
fingerprinted |
Apache-2.0 (permissive) |
| Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing added by Syntology |
2025-09 (from id) |
showlab/DIM/models/modeling_qwen2_5_vl.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision added by Syntology |
2025-08 (from id) |
Fr0zenCrane/UniCoT/modeling/qwen2/modeling_qwen2.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision added by Syntology |
2025-08 (from id) |
Fr0zenCrane/UniCoT/modeling/bagel/siglip_navit.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
Apache-2.0 (permissive) |
| FeDaL: Federated Dataset Learning for General Time Series Foundation Models added by Syntology |
2025-08 (from id) |
shengchaochen82/FeDaL/layers/SelfAttention_Family.py 06b7cb00db5681c0 |
unverified |
MIT (permissive) |
| arXiv:2507.23284 |
2025-07 (from id) |
mlvlab/BLiM/videochat_flash/modeling_qwen2_flash.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| arXiv:2507.22424 |
2025-07 (from id) |
PineTreeWss/SpecVLA/openvla/specdecoding/model/cnets.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| arXiv:2507.22424 |
2025-07 (from id) |
PineTreeWss/SpecVLA/openvla/specdecoding/model/modeling_llama_kv.py ded2d9e57bfdee4e |
unverified |
MIT (permissive) |
| arXiv:2507.10419 |
2025-07 (from id) |
Victorletzelter/LoRA-MCL/ALMA/modeling_xalma.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Flow-Anchored Consistency Models |
4 Jul 2025 |
ali-vilab/FACM/ldit/pos_embed.py 58823d9435a8751b |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| arXiv:2507.02581 |
2025-07 (from id) |
Ashespt/S2DC/Pretrain/models/modules.py a3ec43c12656acbb |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| Kwai Keye-VL Technical Report |
2 Jul 2025 |
kwai-keye/keye/keye-vl-8b-preview/modeling_keye.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| arXiv:2507.01299 |
2025-07 (from id) |
alibaba/EfficientAI/larosa/inference/modeling_llama_larosa.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Q-resafe: Assessing Safety Risks and Quantization-aware Safety Patching for Quantized Large Language Models |
25 Jun 2025 |
thecommonirin/qresafe/quant-with-ft/models/modeling_llama_quant.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
no licence file found · pointer only |
| LongWriter-Zero: Mastering Ultra-Long Text Generation via Reinforcement Learning |
23 Jun 2025 |
thudm/longwriter/train/patch/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Show-o2: Improved Native Unified Multimodal Models |
18 Jun 2025 |
showlab/Show-o/show-o2/models/modules.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| video-SALMONN 2: Captioning-Enhanced Audio-Visual Large Language Models |
18 Jun 2025 |
bytedance/video-salmonn-2/video_SALMONN2_plus/qwenvl/model/modeling_qwen2_5_vl.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention |
16 Jun 2025 |
minimax-ai/minimax-m1/modeling_minimax_m1.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| arXiv:2506.12687 |
2025-06 (from id) |
Yuzt-zju/CoCorrRec/model/cocorrrec/ttt.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
BSD-3-Clause (permissive) |
| Query-Focused Retrieval Heads Improve Long-Context Reasoning and Re-ranking |
11 Jun 2025 |
princeton-pli/QRHead/src/qrretriever/custom_modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| arXiv:2506.09351 |
2025-06 (from id) |
yuchenblah/DIVE/models/llama/modeling_llama.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Ming-Omni: A Unified Multimodal Model for Perception and Generation |
11 Jun 2025 |
inclusionai/ming/modeling_bailing_moe_v2.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark |
5 Jun 2025 |
QwenLM/Qwen2.5-Omni/low-VRAM-mode/modeling_qwen2_5_omni_low_VRAM_mode.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 recorded; this copy not marked cleared · pointer only |
| dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching |
17 May 2025 |
maomaocun/dLLM-cache/dllm_cache/hooks/cache_hook_LLaDA_V.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge |
28 May 2025 |
tutujingyugang1/ChatVLA_public/qwen2_vla/models/modeling_qwen2_vla.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Pretraining Language Models to Ponder in Continuous Space |
27 May 2025 |
identical code first harvested elsewhere b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
licence of this copy not recorded |
| Attributing Response to Context: A Jensen-Shannon Divergence Driven Mechanistic Study of Context Attribution in Retrieval-Augmented Generation |
22 May 2025 |
ruizheliUOA/ARC_JSD/llm_models/modeling_gemma2.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuning |
22 May 2025 |
jiaruzouu/transformercopilot/src/Decoder_Only/copilot/modeling_flax_llama.py 6b3f1075d5cc01c4 |
ran · honoured contract
fingerprinted |
MIT (permissive) |
| Emerging Properties in Unified Multimodal Pretraining |
20 May 2025 |
neverbiasu/ComfyUI-BAGEL/modeling/bagel/siglip_navit.py cec833a99feb528c |
ran · honoured contract
fingerprinted |
Apache-2.0 (permissive) |
| UniCTokens: Boosting Personalized Understanding and Generation via Unified Concept Tokens |
20 May 2025 |
arctanxarc/unictokens/models/phi.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation |
20 May 2025 |
opengvlab/videochat-flash/llava-train_videochat/llava/model/language_model/modeling_qwen2_flash.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Multi-Token Prediction Needs Registers |
15 May 2025 |
nasosger/mutor/language_modeling/src/models/llama_mutor.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Multi-Token Prediction Needs Registers |
15 May 2025 |
nasosger/mutor/language_modeling/src/models/gemma_mutor.py e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |
| Parallel Scaling Law for Language Models |
15 May 2025 |
identical code first harvested elsewhere e03d53ba9d4f9ae5 |
ran · our draft was wrong
fingerprinted |
licence of this copy not recorded |
| Unified Continuous Generative Models |
12 May 2025 |
LINs-Lab/UCGM/networks/pos_embed.py 58823d9435a8751b |
ran · our draft was wrong
fingerprinted |
Apache-2.0 (permissive) |
| Gated Attention for Large Language Models: Non-linearity, Sparsity, and Attention-Sink-Free |
10 May 2025 |
qiuzh20/gated_attention/modeling_qwen3.py b99eea6376d1e212 |
ran · our draft was wrong
fingerprinted |
MIT (permissive) |