I am a senior research scientist at NVIDIA's Applied Deep Learning Research team working on reinforcement learning for LLMs. Before, I was a research scientist at Isomorphic Labs working on AI-first drug discovery. Prior to that, I was a PhD student at the University of Oxford working on multitask reinforcement learning with graph-based state-action representation. My scientific advisor was Shimon Whiteson. I'm also known as yobibyte. Ping me if you are interested in my work (yobibyte@mailbox.org). The head is clickable, btw.
-----BEGIN PGP PUBLIC KEY BLOCK----- mDMEaozNKRYJKwYBBAHaRw8BAQdA0ftoVbsmHKxAmZ2f25zfINvp0uLr8XdRgctF aS9JJs60H3lvYmlieXRlIDx5b2JpYnl0ZUBtYWlsYm94Lm9yZz6IrwQTFgoAVxYh BPABBf82v7uE/J04zYygZzBxbfCTBQJqjM0pGxSAAAAAAAQADm1hbnUyLDIuNSsx LjEyLDIsMwIbAwULCQgHAgIiAgYVCgkICwIEFgIDAQIeBwIXgAAKCRCMoGcwcW3w k69gAP99Rs1hk5RiHNaEPOwicnZUQr4zJEfSOp9CNl3w80QuPgEA9I0oBFDzvvmZ Tmoej8o7PEIQ1dGKIcZIta1QXWK6LAu4OARqjM0pEgorBgEEAZdVAQUBAQdAzdBf csqLJXc6D+LZkpeS0vjUhhMgWkDNpkeKp1+Ok00DAQgHiJQEGBYKADwWIQTwAQX/ Nr+7hPydOM2MoGcwcW3wkwUCaozNKRsUgAAAAAAEAA5tYW51MiwyLjUrMS4xMiwy LDMCGwwACgkQjKBnMHFt8JPAHQEAnVbXOOQxEIBOYpFl4OYEE5VYu4cioQdakrmj y5nyucIA/jttAQoLo1VZz4exRb8BTqb3eCjERBs3y/6pboIAo58J =5Sss -----END PGP PUBLIC KEY BLOCK-----