I am a senior research scientist at NVIDIA's Applied Deep Learning Research team working on reinforcement learning for LLMs. Before, I was a research scientist at Isomorphic Labs working on AI-first drug discovery. Prior to that, I was a PhD student at the University of Oxford working on multitask reinforcement learning with graph-based state-action representation. My scientific advisor was Shimon Whiteson. I'm also known as yobibyte. Ping me if you are interested in my work (yobibyte@mailbox.org). The head is clickable, btw.

links

machine learning

programming

setup

grad school

misc


-----BEGIN PGP PUBLIC KEY BLOCK-----

mDMEaozNKRYJKwYBBAHaRw8BAQdA0ftoVbsmHKxAmZ2f25zfINvp0uLr8XdRgctF
aS9JJs60H3lvYmlieXRlIDx5b2JpYnl0ZUBtYWlsYm94Lm9yZz6IrwQTFgoAVxYh
BPABBf82v7uE/J04zYygZzBxbfCTBQJqjM0pGxSAAAAAAAQADm1hbnUyLDIuNSsx
LjEyLDIsMwIbAwULCQgHAgIiAgYVCgkICwIEFgIDAQIeBwIXgAAKCRCMoGcwcW3w
k69gAP99Rs1hk5RiHNaEPOwicnZUQr4zJEfSOp9CNl3w80QuPgEA9I0oBFDzvvmZ
Tmoej8o7PEIQ1dGKIcZIta1QXWK6LAu4OARqjM0pEgorBgEEAZdVAQUBAQdAzdBf
csqLJXc6D+LZkpeS0vjUhhMgWkDNpkeKp1+Ok00DAQgHiJQEGBYKADwWIQTwAQX/
Nr+7hPydOM2MoGcwcW3wkwUCaozNKRsUgAAAAAAEAA5tYW51MiwyLjUrMS4xMiwy
LDMCGwwACgkQjKBnMHFt8JPAHQEAnVbXOOQxEIBOYpFl4OYEE5VYu4cioQdakrmj
y5nyucIA/jttAQoLo1VZz4exRb8BTqb3eCjERBs3y/6pboIAo58J
=5Sss
-----END PGP PUBLIC KEY BLOCK-----