扫描关注 【硅基能效】 公众号 获取最新的深度能效报告与算力地图
实时能效基准热点排行:正在监控全球硅基信号脉冲
谷歌算力分配内耗严重...
LACT is one of the popular third-party Linux GPU configuration and monitoring utilities that works across NVIDIA, AMD, and Intel graphics. This GUI provides GPU overclocking contro...
英伟达正试图把 AI 工厂变成一种新的资产类别——就像铁路、电网、数据中心一样,可以打包成金融产品卖给机构投资者。 黄仁勋在 X 上宣布与 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs 和 KKR 合作,目标是撬动超过 5000 亿美元的第三方资本来建设 AI 基础设施。英伟达自己承担最高 25% ...
HeteroFlow v2 推理服务的解决方案正式上线 HeteroFlow v2 是一款开源的异构算力调度平台,本次发布的推理服务功能针对上述三大痛点提供完整解决方案: **> 一句话总结:**用一套 OpenAI 兼容 API,统一调度 9 种厂商 GPU × 5 种推理引擎,原生支持多租户、计费、扩缩容、热加载。 三、核心能力详解1. OpenAI A...
从柔性本体走向跨本体基础智能,让任务与世界知识延续...
FastFlowLM is the open-source software for getting vision, audio, embedding, and MoE large language models up and running on AMD Ryzen AI NPUs. FastFlowLM 1.0 released today and is...
算力竞赛的天平,正在向电力倾斜...
一篇标题叫 "Position: LLMs Can't Jump" 的论文近日在 Hacker News 引起了众多程序员关注,讨论层层递进,从语言的有损编码一直聊到爱因斯坦的思考方式。 论文的核心论点很简单,但直接挑战了当前 AI 行业的底层假设:大语言模型的能力边界,不是算力不够,不是数据不够,而是语言本身就是人类体验的有损压缩。LLM 看到......
Neon 和 Castform 联合发布了一篇博客,展示了一个惊人的结果:一个 4B 参数的开源模型,经过 RL 后训练之后,在检索任务上的准确率追平了 GPT-5.6 Sol,但每次请求的成本只有对方的 1/100。 具体来说,GPT-5.6 Sol 做一次典型的多轮搜索请求需要超过 10 秒,端到端成本约 0.03 美元。对于需要反复搜索的 agent ...