新出现
本地运行大模型硬件门槛降低
开放权重模型(如MiniMax H3)与推理优化库(如AirLLM)正在让消费级硬件本地运行大模型成为现实,硬件门槛显著降低。
开发者无需高端GPU即可本地运行视频生成和70B级LLM,降低实验和部署成本,推动AI应用向边缘和本地化迁移。
- MiniMax H3 Day-0 Support in ComfyUI: Open Weights, Native Audio, and 2K Video Hacker News #3
- AirLLM 70B inference with single 4GB GPU Hacker News #4