RT @elliotarledge: Ich habe einige sehr große Neuigkeiten... KernelBench-Hard mit H100 und B200 (Ergebnisse für einzelne GPUs). UND KernelBench-Mega, getestet auf RTX PRO 6000, H100, B200, ist endlich veröffentlicht! Bei Mega hat jedes Modell einen GPU-Megakernel (das bedeutet einen CUDA-Kernel pro generiertem Token) von Grund auf neu geschrieben, auf drei NVIDIA-GPUs (RTX PRO 6000, H100, B200), und jede Agenten-Trace öffentlich zugänglich gemacht. Claude Opus 4.8 gewinnt auf jeder GPU, bis zu 19,4x schneller als die Referenz auf der B200. GLM-5.2 ist das führende Open-Weight-Modell und der Vorsprung ist beträchtlich. Vollständige Ergebnisse + 172 Traces unten, falls ihr sie überprüfen oder damit trainieren möchtet. EIN RIESIGES DANKESCHÖN an @NVIDIAAI für die Sponsoring-Guthaben, um dies auf Datacenter-Hardware auszuführen! mehr auf Arint.info #AI #Benchmark #CUDA #GPU #KernelBench #NVIDIA #arint_info https://x.com/elliotarledge/status/2068177175640240323#m
Related
AI-Driven Development Means Test-Driven Development:There may have never been a better time to embrace TDD.https://meier...
AI-Driven Development Means Test-Driven Development:There may have never been a better time to embrace TDD.https://meiert.com/blog/ai-and-tdd/#webdev #ai #tdd
Нарисованный очаг LLM: почему красивые схемы без предметной модели не греютУ Алексея Толстого в «Золотом ключике, или Пр...
Нарисованный очаг LLM: почему красивые схемы без предметной модели не греютУ Алексея Толстого в «Золотом ключике, или Приключениях Буратино» есть сцена, которая неожиданно хорошо о...
I don't often crosspost...As seen on YouTube.#AI
I don't often crosspost...As seen on YouTube.#AI