Charlie Leeming
About
Passionate about Model Build and Model serve efficiency: Automating GPU right sizing, max TPS at req'd latency, lowest Cost/energy per Token
Passionate about Model Build and Model serve efficiency: Automating GPU right sizing, max TPS at req'd latency, lowest Cost/energy per Token