Appearance
共 26 篇文章
OpenAI联合AMD、博通、英特尔、微软、英伟达发布多路径可靠连接(MRC)协议,解决大规模AI训练网络延迟和故障问题。协议采用多平面网络设计,将单一800Gb/s接口拆分为多链路,仅需两层交换机即可连接13.1万块GPU,网络故障恢复时间从秒级缩短至微秒级,已部署于NVIDIA GB200超级计算机和Oracle Cloud Infrastructure。
AI芯片创新企业Cerebras启动纳斯达克IPO,计划募资至少32.2亿美元,公司估值约266亿美元。这家以晶圆级芯片技术著称的公司已与OpenAI签署三年超200亿美元合同,标志着AI算力战争从软件延伸到硬件核心领域。
2026年5月7日,英伟达重新思考AI基础设施经济效益评估标准,强调每Token成本才是唯一重要指标,Blackwell平台每Token成本比Hopper降低35倍,每瓦Token产出提升50倍,标志着AI基础设施评估从传统算力指标转向实际产出指标。
AI芯片公司Cerebras宣布IPO路演,预计融资322亿美元。公司持晶圆级芯片独家技术,已签OpenAI三年200亿美元合同。瞄准英伟达GPU垄断下的AI训练专用芯片市场。
OpenAI联合5大芯片巨头发布MRC网络协议,通过OCP开源。该协议将AI超算故障恢复时间从秒级缩至微秒级,两层交换机连接13万GPU,解决大规模训练的网络瓶颈问题。
AI公司Recursive Superintelligence成立4个月估值40亿美元,Google GV领投、英伟达跟投,目标让AI自主完成科研全流程。顶级AI研究员年薪1500万美元,这个方向有望彻底改变科研经济模型。
AI芯片公司Cerebras正式递交美股IPO申请,计划融资32.2亿美元,已与OpenAI签署200亿美元芯片合作协议。与英伟达走差异化路线,不用HBM内存,主攻推理市场。
英伟达发布新AI推理平台,优化推理速度和成本。这是AI基础设施的重要更新。
英伟达CEO黄仁勋反驳AI末日论,表示人工智能正在创造就业机会,而非毁灭就业。他以历史为例,说明技术革命总是带来新工作类型。
英伟达2026年4月28日开源全模态推理模型Nemotron 3 Nano Omni,300亿参数单模型通吃视频/音频/图像/文本。吞吐量是同类9倍,目前免费用。
黄仁勋2026年5月4日再次反驳AI末日论,称AI是就业机会生成器。美国再工业化需要AI,任务自动化不等于工作消失。人们更可能被会用AI的人取代。
英伟达CEO黄仁勋公开反驳Anthropic CEO阿莫迪关于"AI替代50%入门白领"的预测,说"这种评论没有帮助,CEO容易产生上帝情结"。黄仁勋还批评"AI毁灭世界20%概率"的说法太荒谬。
英伟达CEO黄仁勋承认,公司在中国AI加速器市场份额已降至0%。他直言放弃中国市场"在战略上恐怕并不合理",出口管制产生了反效果。
Alphabet市值达4.6万亿美元逼近英伟达,期权市场预测5月15日可能登顶全球市值第一。受超预期财报提振,股价4月30日大涨10%。
英伟达在官方博客展示了用多Agent系统做油气藏仿真优化的方案。AI Agent 24/7无缝接力仿真流程,将原本需要数天的周期压缩到连续运转,工程师转型为"战略监督"角色。
英伟达市值突破5.26万亿美元创历史新高。作为AI芯片市场领导者,英伟达持续受益于全球AI数据中心建设浪潮,H100/H200系列供不应求,Blackwell架构芯片即将量产。
美国国防部与7家AI公司达成协议,将OpenAI、谷歌、英伟达、微软等公司的AI能力部署到机密网络。Anthropic因坚持安全原则被列为供应链风险被排除。
DeepSeek V4发布,以更低成本实现接近GPT-5性能,黄仁勋担忧的AI训练成本灾难正在成为现实:AI能力提升同时训练成本下降,格局重塑中。
2026年4月30日,银河通用拉着英伟达,把人形机器人最大的谎言拆穿了,揭示人形机器人技术瓶颈。
2026年4月30日,银河通用与英伟达合作,拆穿人形机器人最大谎言,揭示AI机器人能力与现实的差距。
2026年4月29日,英伟达发布全模态大模型,能在几秒内生成黄仁勋3分钟演讲,吞吐量是同类模型9倍。
英伟达BioNeMo团队开源Fold-CP上下文并行框架,将单个大分子系统拆分到多个GPU上并行处理,打破了传统生物分子建模在单个GPU显存限制下的瓶颈。该框架已在arXiv发表论文,支持多个主流蛋白质折叠模型的训练和推理加速。
英伟达发布Nemotron 3 Nano Omni开源全模态模型,采用30B-A3B混合MoE架构,Mamba-2与Transformer混合设计。单token仅激活约3B参数,视频推理吞吐量较其他开源全模态模型最高提升9.2倍,支持100万token上下文窗口,为企业AI Agent提供高效基础模型底座。
2026-04-27消息,英伟达RTX 5090 AI性能曝光,推理速度翻倍,消费级AI硬件迎来新标杆。
2026年4月20日报道,英伟达因显存短缺将游戏显卡产能削减最高40%,RTX 50 Super推迟至Q3。这可能是英伟达三十年来首次全年无游戏显卡新品,DRAM产能正全面转向AI专用内存。
2026年4月20日,SK海力士宣布量产192GB SOCAMM2内存模组,专为英伟达Vera Rubin AI平台设计。带宽比传统RDIMM提升超2倍,功耗降低75%以上,将从根本上解决大型语言模型推理中的内存瓶颈。