I made a game where you build a CPU from logic gates7 hours agohttps://select.supply/game/chipbuilder
Running Doom on Our Custom CPU and Going Viral10 days agohttps://www.armaangomes.com/blogs/doom/团队从逻辑门开始设计了一款定制CPU,适配了DOOM源代码,并最初在FPGA上以0.7 FPS运行。主要挑战是内存大小(DDR3与BRAM)和速度;他们实现了两个缓存(指令缓存和数据缓存),并带有一个内存仲裁器来处理DDR3延迟。移植DOOM暴露了CPU的bug,例如无限循环、立即数计算错误和缓存覆盖问题;调试需要隔离程序的部分。硬件问题包括不稳定的DDR3接口(通过时钟域交叉和FIFO解决)和键盘输入问题(使用从笔记本电脑转发的UART)。优化措施包括提高时钟频率、修复取指阶段效率低下、添加乘法指令、流水线化缓存读取以及启用编译器优化,将FPS从0.7提升到15-20。团队计划实现乱序执行和更好的内存访问以达到30 FPS,并在构建基本GPU后可能移植《雷神之锤2》。
AI Innovators Adopt Nvidia Vera – Why Max Single-Threaded CPU at Scale Matters22 days agohttps://blogs.nvidia.com/blog/nvidia-vera-max-single-threaded-cpu-at-scale/为智能体AI时代设计的Max单线程CPU注重高单核性能,以加速AI智能体任务的执行。传统数据中心CPU优先考虑核心数量和成本效益,而非单线程性能,这可能导致依赖顺序执行的智能体循环任务速度变慢。NVIDIA Vera体现了这一新CPU类别,其Olympus核心比NVIDIA Grace的每周期指令数高出50%,并提供高内存带宽和可预测的延迟。Vera在负载工作场景下,单核持续性能比x86 CPU快1.8倍,从而加速了工具调用、代码执行和数据处理等任务。Perplexity的实际测试表明,Vera完成编码工作流的速度比x86 CPU快1.5倍,并发沙箱启动速度最高可快1.9倍。Vera还加速了CPU端数据处理工作负载,合作伙伴报告称其SQL分析速度比x86服务器快3倍,实时流处理延迟降低高达6倍。该CPU支持多样化的智能体工作负载,包括工具执行、数据处理和强化学习,所有这些都在单一架构上实现,并与NVIDIA GPU和存储处理器集成。NVIDIA计划未来通过Rosa CPU和Rigel核心进一步推进,旨在实现更高的单核性能,同时保持为智能体AI时代设计的效率。