logoalt Hacker News

shaewestyesterday at 9:20 PM2 repliesview on HN

It's running a very small, non-reasoning model at the moment. But more generally, almost all LLMs argue on the hardware/model they are/are on.


Replies

metadatyesterday at 9:36 PM

What would tokens/sec performance look like for a reasoning model? An order of magnitude slower?

show 1 reply
dumberquestionsyesterday at 9:23 PM

Which model? Or how many active parameters?

show 2 replies