学习 · 研究 · 工程

NEXUS.

AI 技术交流社区

AI Research & Engineering Community

关注 LLM 后训练算法、Agent、具身智能与推荐系统。

Mission · 愿景

连接不同高校的 AI 学习者与研究者。

NEXUS(纽带 / 核心)代表连接与协作。成员来自粤港澳、内地及海外, 在这里分享学习资料、交流研究问题,并开展项目实践。

22
来自不同院校
Member Institutions
4
技术方向
LLM · Agent · Embodied AI · RecSys
107
精选学习资料
持续补充中

Technical Areas · 技术方向

四个长期关注的技术方向。

LLM 后训练算法、Agent、具身智能与推荐系统。

01
LLM Algorithms
大模型后训练算法

关注监督微调、偏好优化、强化学习、数据构建与评测。

02
AI Agents
智能体

关注工具使用、任务规划、记忆、检索与多智能体协作。

03
Embodied AI
具身智能

关注视觉-语言-动作模型、机器人学习、感知、规划与控制。

04
Recommendation
推荐系统

关注召回、排序、用户建模、多目标优化与工业实践。

Member Institutions · 成员院校

来自全球顶尖高校的 AI 爱好者。

我们均正于以下院校追求 PhD / MPhil / MSc 学位(按加入顺序排列)。欢迎大家加入并一起进步。

×11
CUHK-SZ
香港中文大学(深圳)
×8
HKUST-GZ
香港科技大学(广州)
×4
FUDAN
复旦大学
UM
澳门大学
UESTC
电子科技大学
BUPT
北京邮电大学
SJTU
上海交通大学
NTU
南洋理工大学
TYUT
太原理工大学
×3
SUSTech
南方科技大学
TTU
德克萨斯理工大学
NUS
新加坡国立大学
PKU
北京大学
XMU
厦门大学
HKUST
香港科技大学
×2
CityU
香港城市大学
UCAS
中国科学院大学
×2
TJU
天津大学
CityU-DG
香港城市大学(东莞)
USTC
中国科学技术大学
PU
普渡大学
HKU
香港大学

Learning Resources · 学习资料

基础知识与方向资料。

覆盖基础知识、AI Infra,以及四个主要技术方向,持续补充中。

基础必修 Foundations 16 项
Course
CS336:从零构建大语言模型
斯坦福 · 哔哩哔哩
前往 →
Notes
CS336 学习笔记
知乎专栏
前往 →
Book
动手学深度学习 Dive into Deep Learning
李沐 · 在线书 + 代码
前往 →
Article
图解 Transformer
Jay Alammar
前往 →
Article
图解注意力机制与 Seq2Seq
Jay Alammar
前往 →
Code
The Annotated Transformer
Harvard NLP · 逐行代码注解
前往 →
Notes
DDA5001 机器学习课程笔记
香港中文大学(深圳)
前往 →
Article
图解量化 A Visual Guide to Quantization
Maarten Grootendorst
前往 →
Survey
MoE 综述:混合专家与大模型扩展
IEEE TKDE · 微信公众号
前往 →
Report
Qwen 技术报告解读
知乎
前往 →
Practice
LeetCode 热题 100
算法基础训练
前往 →
Guide
ARIS-in-AI-Offer:AI Offer 教程清单
GitHub · wanshuiyin
前往 →
Report
Kimi K3:Open Frontier Intelligence
Moonshot AI · 官方技术博客
前往 →
Cheat Sheet
Linux Commands Cheat Sheet
Red Hat Developer · 命令行速查
前往 →
Conference
ICLR 2027 Conference
ICLR · 官方网站
前往 →
Guide
ICLR 2027 投稿指南
知乎 · 截稿日期与投稿新规
前往 →
基础设施 Infra 26 项
Tool
LeetGPU:GPU 编程挑战
在线 CUDA / 算力练习平台
前往 →
Book
How to Scale Your Model:如何扩展你的模型
中文版 · GPU / 并行 / Roofline
前往 →
Docs
CUDA C++ 编程指南
NVIDIA 官方文档
前往 →
Docs
vLLM 中文站
高吞吐 LLM 推理引擎
前往 →
Course
MiniMind:从零理解 LLM 训练
minimind.wiki · 完整训练链路
前往 →
Repo
KernelBench:LLM 能写 GPU Kernel 吗
GitHub · Scaling Intelligence
前往 →
Article
矩阵乘法:从手搓到 CUTLASS 实现
峰子的乐园
前往 →
Article
从 305GB 到 7.4GB:KVCache 架构演进全景
博客园 · 银光
前往 →
Reference
GPU Glossary:GPU 术语表
中文版 · 硬件 / 架构速查
前往 →
Book
How to Scale Your Model:并行计算与分片
中文版 · Parallelism / Sharding
前往 →
Book
How to Scale Your Model:Roofline 模型
中文版 · 性能上限分析
前往 →
Docs
CUDA C++ 最佳实践指南
NVIDIA 官方文档
前往 →
Course
Modern GPU Programming for MLSys:GPU 执行模型
MLC.ai
前往 →
Article
vLLM 推理全流程图解
微信公众号
前往 →
Docs
vLLM Ascend 官方文档
vLLM · Ascend
前往 →
Repo
MinivLLM:极简 vLLM 实现
GitHub · Wenyueh
前往 →
Docs
昇腾开源文档中心
Ascend Open Source
前往 →
Repo
CUDA-Agent:高性能 CUDA Kernel 生成强化学习
GitHub · BytedTsinghua-SIA
前往 →
Benchmark
CANN-Bench:CANN 算子任务评测
AtomGit · GitCode
前往 →
Repo
DFlash:Block Diffusion for Flash Speculative Decoding
GitHub · z-lab
前往 →
Digest
KernelHive AI Systems Daily
KernelHive · AI 系统论文日报
前往 →
Case Study
DeepSeek-V4-Pro:国产算力集群全参数后训练
深圳河套学院 · 昇腾训练实践
前往 →
Paper
ConvRot:扩散 Transformer 的即插即用 4-bit 量化
OpenReview · 旋转量化
前往 →
Article
CUDA Kernel:如何设置 grid_size 与 block_size
知乎 · CUDA 编程
前往 →
Course
Kubernetes 一小时入门
哔哩哔哩 · 容器编排基础
前往 →
智能体 Agent 23 项
Course
Learn Harness Engineering
walkinglabs · AI 编程智能体工程化
前往 →
Article
18 种 RAG 技术实测对比
Level Up Coding · Fareed Khan
前往 →
Tutorial
TypeScript 基础语法
菜鸟教程 · Agent 工程语言基础
前往 →
Course
Hello-Agents:动手学智能体
Datawhale · 开源教程
前往 →
Index
The 2025 AI Agent Index
MIT · 智能体全景索引
前往 →
Repo
Awesome AI Model Routing
GitHub · LLM 路由方案合集
前往 →
Article
大模型 RAG 基础:信息检索、文本向量化及 BGE-M3 实践
Arthur Chiao
前往 →
Article
Coordinator 编排:Claude Code 并行工作线程解析
Claude 中文社区
前往 →
Article
多智能体协调器:Claude Code 如何编排并行工作线程
Claude Reviews Claude
前往 →
Index
Agent Skills:技能生态入口
agentskills.io
前往 →
Repo
opencode:开源 AI 编程 Agent
GitHub · anomalyco
前往 →
Guide
Agent Foundations 面试 Cheat Sheet
ARIS-in-AI-Offer
前往 →
Benchmark
Terminal-Bench:终端智能体能力评测
Stanford × Laude
前往 →
Paper
CoEvoSkills:共进化验证的自进化 Agent Skills
项目主页 · arXiv 2026
前往 →
Guide
Elasticsearch:从入门到进阶
CSDN · 检索基础设施
前往 →
Benchmark
MTEB:文本嵌入模型评测榜单
Hugging Face · mteb
前往 →
Paper Notes
STALE:LLM Agent 记忆何时失效
GitHub · shibing624
前往 →
Paper Notes
Evo-Memory:智能体测试时学习与自进化记忆
知乎 · 论文阅读笔记
前往 →
Repo
AI-Research-SKILLs:AI 研究与工程技能库
GitHub · Orchestra Research
前往 →
Paper
MemEvolve:智能体记忆系统的元进化
ICML 2026 · OpenReview
前往 →
Index
Agent Pulse:AI 行业关键变化与证据
GitHub · Barret Lee
前往 →
Paper
RLMOpt:递归语言模型驱动的自适应 Prompt 优化
arXiv · Autonomize AI × CMU
前往 →
Practice
华为云 AI 办公实践中心
华为云 · AI Agent 实战
前往 →
具身智能 Humanoid Robotics 18 项
Podcast
Danfei Xu 访谈:人类数据、行为克隆、机器人 GPT-3
WhynotTV Podcast · 哔哩哔哩
前往 →
Talk
UC Berkeley Ember Seminar:SONIC + BFM zero
小红书 · B 站同步
前往 →
Course
Robotic Manipulation
MIT CSAIL
前往 →
Docs
MoveIt Tutorials
MoveIt · ROS 机械臂规划
前往 →
Simulator
MuJoCo:Advanced Physics Simulation
DeepMind
前往 →
Docs
LIBERO:Lifelong Learning Algorithms
Lifelong Robot Learning
前往 →
Repo
LEGION:机器人终身强化学习
GitHub · Ghiara
前往 →
Dataset
Open X-Embodiment:机器人学习数据集与 RT-X 模型
Google DeepMind
前往 →
Survey
Awesome World Models for Embodied AI
GitHub · Li-Zn-H
前往 →
Repo
X-VLA:跨具身视觉-语言-动作模型
GitHub · 2toinf
前往 →
Talk
Data Pyramid & Data Flywheel for Robotic Foundation Models
UT Austin RPL · PDF
前往 →
Repo
Whole-Body Coordination for Legged Manipulators
GitHub · YoungYNG
前往 →
Dataset
TransCG:透明物体深度补全和抓取数据集
GraspNet
前往 →
Paper
Depth Anything V2:单目深度估计
arXiv
前往 →
Project
Marigold:Diffusion-Based Monocular Depth Estimation
Project Page
前往 →
Handbook
VLA-Handbook:视觉-语言-动作学习与面试手册
GitHub · sou350121
前往 →
Project
ASGrasp:透明物体重建与 6-DoF 抓取
ICRA 2024 · PKU EPIC
前往 →
Project
Reflective Planning:VLM 长程机器人操作规划
Cornell · CUHK · Yale · UC Berkeley
前往 →
大模型后训练 LLM Post-Training 16 项
Course
强化学习 · 大模型后训练版
walkinglabs · 含具身 RL 路线规划
前往 →
Article
强化学习入门:从马尔可夫到 PPO / DPPO
知乎
前往 →
Article
用 LLaMA 训练你自己的大语言模型
知乎
前往 →
Article
从零「手搓」一个大模型
微信公众号
前往 →
Interview
大模型 LLM 面经(实时更新)
飞书云文档
前往 →
Book
Modern LLM Notebook
walkinglabs · 现代 LLM 笔记
前往 →
Tool
Tianshou 天授:强化学习库
清华 · 模块化 RL 框架
前往 →
Chapter
为什么 base model 还不是 assistant
Hands-on Modern RL
前往 →
Guide
后训练介绍
StreamLake 文档
前往 →
Paper
DAPO:大规模开源 LLM 强化学习系统
arXiv · 论文 HTML
前往 →
Article
PPO:有了奖励模型,为什么还需要价值模型
微信公众号
前往 →
Article
On-Policy Distillation:Policy Gradient 视角
知乎
前往 →
Survey
On-Policy Distillation:2026 上半年综述
知乎 · 三万字长文
前往 →
Paper
OPD-Evolver:基于在策略蒸馏的智能体进化
arXiv · LV-NUS Lab
前往 →
Article
Off-Policy + On-Policy 两段式蒸馏
知乎 · 大模型蒸馏
前往 →
Paper Notes
REOPOLD:将 On-Policy Distillation 作为 RL 调优
知乎 · 训练稳定性解读
前往 →
推荐算法 Recommendation 8 项
Article
推荐系统简介
峰子的乐园
前往 →
Guide
推荐系统:机器学习模型完整指南
Towards Data Science
前往 →
Repo
工业界算法实践 Algorithm-Practice-in-Industry
GitHub · Doragd
前往 →
Dataset
Avazu CTR 点击率预测
Kaggle · 经典实战竞赛
前往 →
Challenge
快手 LLM-Rec 挑战赛 2026
Kuaishou · StreamLake
前往 →
Report
快手 OpenOneRec 技术报告
知乎
前往 →
Competition
腾讯广告算法大赛
Tencent Ads
前往 →
Course
推荐系统公开课:8 小时工业实践完整版
ShusenWang · 哔哩哔哩
前往 →

持续补充中 · 欢迎贡献。 这份清单覆盖大语言模型、AI Agent、机器人运动控制 / 具身及其他科研与工程实践资料,欢迎各位成员补充。

加入 NEXUS

通过 GitHub 参与讨论、协作与资料维护。

前往 GitHub →