Depth Anything-Unleashing the Power of Large-Scale Unlabeled Data Depth Anything是一种鲁棒的单目深度估计解决方案,其充分利用各种未标记的图像和预训练模型中丰富的语义先验,具有优异的零样本深度估计能力。 由香港大学、浙江大学等人提出。 网页版Demo 2024-02-11 #深度学习 #计算机视觉 #人工智能 #深度估计
Mamba---Linear-Time Sequence Modeling with Selective State Spaces 论文两位作者Albert Gu和Tri Dao,博士都毕业于斯坦福大学,导师为Christopher Ré。 Albert Gu现在是CMU助理教授,多年来一直推动SSM架构发展。他曾在DeepMind 工作,目前是Cartesia AI的联合创始人及首席科学家。 Tri Dao,以FlashAttention、FlashDecoding系列工作闻名,现在是普林斯顿助理教授,和Together A 2024-01-31 #深度学习 #人工智能 #自然语言处理
On Embeddings for Numerical Features in Tabular Deep Learning 该论文使用表格深度学习的一些新embedding。论文地址 出自NIPS 2022 Hardy Xu利用该方法获得了kaggle Playground Series - Season 3, Episode 26: Multi-Class Prediction of Cirrhosis Outcomes的第二名。 本文提出了两种不同的构建块,适用于构建数字特征的嵌入。第一种是分段线性编码,它为原始 2024-01-16 #机器学习 #深度学习 #人工智能 #表格学习
Self-Supervision is All You Need for Solving Rubik’s Cube 该论文使用NN来解魔方,耳目一新的方法。论文地址 TMLR 2023. 简单来说,该方法利用了组合搜索的一个基本特性:等概率的情况下路径越短,随机发生的可能性就越大。这意味着随机训练争夺的累积概率随着移动次数的减少而增加:$1/\mathbb{M}^N$,其中$\mathbb{M}$表示移动集,N表示路径长度。 2024-01-13 #深度学习 #人工智能
SC-NAFSSR 该论文来自同级的qzd等同学。论文地址 指导老师为金枝老师,发表于CVPR的wordshop论文。为CVPR的NTIRE 2023双目图像超分辨率挑战赛的第二名解决方案。 2023-08-02 #深度学习 #计算机视觉 #人工智能 #peer
Frozen Language Model Helps ECG Zero-Shot Learning 该论文来自同级的lj同学。一位将去哈佛的大佬。 论文地址:https://openreview.net/forum?id=UAr59yTUWR2 共同一作:lj和来自伦敦帝国理工学院地球科学与工程系的Che liu MIDL(The International Conference on Medical Imaging with Deep Learning)Oral,MIDL是一个非常年轻的医学图 2023-07-14 #深度学习 #人工智能 #peer #医学图像
机器学习科研的十年——陈天奇 陈天奇是机器学习领域著名的青年华人学者之一,本科毕业于上海交通大学ACM班,博士毕业于华盛顿大学计算机系,研究方向为大规模机器学习。TVM、MXNET、XGBoost 作者,CMU 助理教授,OctoML CTO。在gpt的潮流下,领导的团队提出了MLC LLM ,为在各类硬件上原生部署任意大型语言模型提供了解决方案,可将大模型应用于移动端(例如 iPhone)、消费级电脑端(例如 Mac)和 W 2023-07-11 #机器学习 #深度学习 #人工智能