An all-in-one blog for learning Large Language Models (LLMs)
An all-in-one blog for learning Large Language Models (LLMs)
An all-in-one blog for learning LLM ins and outs: tokenize, attention, PE, and more Project I've been diving deep into the internals of Large Language Models (LLMs) and started documenting my findings. My blog covers topics like: Tokenization techniques (e.g., BBPE) Attention mechanism (e.g. MHA, MQA, MLA) Positional encoding and extrapolation (e.g. RoPE, NTK-aware interpolation, YaRN) Architecture details of models like QWen, LLaMA Training methods including SFT and Reinforcement Learning If you're interested in the nuts and bolts of LLMs, feel free to check it out: http://comfyai.app/
Share cardActual performance
Launch Intel predictions
Analyze your own launch →Incorrect prediction on native model
Similar products
BadSeek – How to backdoor large language models
Explore large language models with 512MB of RAM
TEG, a linguistic game powered by large language models
Phare: A Safety Probe for Large Language Models
Chat with private and local large language models
A tool to give large language models better memory
Observability for teams building with large language models.
Tidbits, use large language models to filter through news
Open 3B language models from AMD
The rise of open source large language models