we're developing https://copperbench.org - an open-source benchmark for evaluating ai agents on real, verifiable hardware design tasks.
we're developing https://copperbench.org - an open-source benchmark for evaluating ai agents on real, verifiable hardware design tasks.
any idea how it stacks up against zoo / zookeeper?
https://zoo.dev/research/zookeeper
mmm, someone decided to reuse `zookeeper` name, seriously?