搜索:算力

共命中 50 条(服务端检索)
博通为 OpenAI 筹资 500 亿美元:AI 算力建设进入「债务驱动」时代
10 月 8 日《华尔街日报》与彭博社报道:博通正为 OpenAI 的定制 AI 芯片安排超 500 亿美元融资,与阿波罗、黑石等私募信贷机构早期洽谈;同日《金融时报》曝出 SpaceX 正洽谈约 400 亿美元买英伟达芯片,博通还在为 Anthropic 筹集 600 亿美元。芯片采购的钱开始大规模来自债券与私募信贷,而非利润与股权——AI 算力的融资结构正在换轨。本文梳理交易结构与「循环交易」争议。
行业动态 精选 · 原创 · 昨天 阅读 27·访客 27
OpenAI 的算力帝国账本:一万四千亿美元承诺、三家芯片厂兜底与十月刚开张的 AI 债务市场
一年时间,OpenAI 与英伟达、AMD、博通、甲骨文、微软签下约 1.4 万亿美元量级的算力承诺——芯片商既是供应商,又是投资人,如今还亲自组织债务融资。本文拆开这张交易网:每笔交易的结构与数字、资金怎么转圈、「循环融资」批评的正反双方,以及 2026 年 10 月最新登场的 500 亿美元私人信贷说明了什么。
行业动态 精选 · 原创 · 昨天 阅读 13·访客 13
算力的度量衡:从 FLOPS 到卡时,看懂算力新闻的单位
FLOPS、算力、卡时、集群规模混着说,是看懂算力新闻的第一道坎。本文厘清 FLOPS 与 FLOPs 一字之差的两个概念,给出 6ND 训练算力估算经验与卡时换算方法,解释峰值与有效算力之间的 MFU 差距,最后附一张看懂算力新闻的换算清单。
行业动态 精选 · 原创 · 3天前 阅读 20·访客 19
算力芯片格局速览:GPU、ASIC 与推理卡的分工
芯片发布一场接一场,参数眼花缭乱。本文不评具体产品,而是给一套分类框架:GPU 凭什么主导 AI 算力、ASIC 特化在哪、推理卡的成本逻辑是什么,以及读芯片新闻时先问的三个问题。
行业动态 精选 · 原创 · 3天前 阅读 13·访客 13
Scaling Laws 十问十答:算力、数据与参数的交换律
以十个问答讲清 Scaling Laws:幂律为什么可外推、Chinchilla 如何修正参数与数据的配比、6ND 公式怎么当算力换算器、数据枯竭与推理时算力这两条新变量,以及这门「经验定律」对大公司与创业者的不同含义。
研究前沿 精选 · 原创 · 3天前 阅读 13·访客 13
消息称 Anthropic 谈判租赁最高 1GW 算力,预计相关投资至少 400 亿美元
IT之家 9 月 26 日消息,据 The Information 报道,Anthropic 计划从一家由阿波罗全球管理公司控股的数据中心开发商处,租赁最高 1 吉瓦(Gigawatt,GW)算力,目前正处于早期谈判阶段。 据知情人士透露,…
行业动态 IT之家 · 9-26 阅读 21·访客 21
IDC评估中国AI算力管理平台:范式智能四项维度获满分,综合评分第一
范式成为《中国AI算力管理平台技术能力评估,2026》综合评分位列第一的厂商。]
行业动态 量子位 · 9-21 阅读 19·访客 17
全面追赶 OpenAI,消息称 Anthropic 计划在今年年底前拥有约 5 吉瓦可用算力、明年年底翻倍
IT之家 9 月 18 日消息,在争夺顶尖模型性能的较量中,OpenAI 与 Anthropic 的竞争已进入白热化阶段。而这场较量的核心,正是训练与部署这些模型不可或缺的基础设施 —— 算力。 据纽约时报消息,过去几年里,OpenAI 在…
行业动态 IT之家 · 9-18 阅读 20·访客 20
华为轮值董事长汪涛:华为 AI 战略的核心是算力,坚持硬件变现
IT之家 9 月 17 日消息,据财联社报道,华为副董事长、轮值董事长汪涛今日(9 月 17 日)在上海举行的华为全联接大会上介绍华为面向智能时代的重要部署: 一是华为 AI 战略的核心是算力,坚持硬件变现 ; 二是“超节点 + 集群”,打…
开源项目 IT之家 · 9-17 阅读 26·访客 26
“算力中国·年度卓越成就”发布 太初元碁超智融合计算系统入选
太初(杭州)集成电路有限公司新一代超智融合计算系统元碁Hypertintellix入选“算力中国·年度卓越成就”。]
行业动态 量子位 · 9-12 阅读 22·访客 18
算力词元贷加速全国推广,支持机房建设、GPU 服务器集群采购
IT之家 9 月 12 日消息,据央视财经今日报道,今年服贸会首次推出“金融 + 科创”的联展模式,让金融机构联合他们所赋能的科创企业同台参展。展台上除了金融产品,还有智能机械臂、运载火箭模型、人形机器人等硬科技,背后是 算力贷、算力保、投…
行业动态 IT之家 · 9-12 阅读 17·访客 14
中国工程院院士邬贺铨:2030 年中国算力有望占到全球 30%
IT之家 9 月 12 日消息,据中国算力大会官方,9 月 12 日,在 2026 中国算力大会主论坛上,中国工程院院士邬贺铨指出,智能体的出现带动了 Token 的消费。 今年 3 月,Token 的消费已经达到日均 140 万亿。随着技…
智能体 IT之家 · 9-12 阅读 20·访客 16
中国移动发布 AI 可信计算:提供多形态机密算力和机密 Token
IT之家 9 月 12 日消息,9 月 12 日,在 2026 中国算力大会主论坛上,中国移动正式发布 AI 可信计算( AITC ),并启动 AI 可信计算生态共建战略合作。 据介绍,中国移动率先布局 AI 可信计算,基于移动云全栈国产化…
研究前沿 IT之家 · 9-12 阅读 16·访客 14
AI算力硬合作,马斯克还是更相信中国制造
田, 晏林* 2026-10-04 14:12:22 来源:量子位 一种混搭的可能:英特尔继续供先进工艺,即前端用14A;后端再接台积电,来补工厂运营、良率、封装这些能力。 田晏林 发自 凹非寺 量子位 | 公众号 QbitAI 马斯克的…
行业动态 量子位 · 5天前 阅读 27·访客 27
Anthropic IPO 招股书曝光,巨额算力投入与安全隐忧并存
IT之家 9 月 29 日消息,据路透社看到的 Anthropic IPO 招股书文件显示,该公司正在豪押一个判断:人工智能对全球经济带来的变革,其深刻程度将会超过工业化、电力普及以及互联网。 但实现这一愿景所要付出的成本高得惊人。招股书披…
行业动态 IT之家 · 9-29 阅读 42·访客 42
一篇读懂 HBM:AI 算力的「内存墙」是怎么被摞高的
看 GPU 规格表,带宽那行数字比 FLOPS 更能决定大模型推理的快慢——HBM 用「立体堆叠 + 超宽接口」两个动作,把内存带宽做到了同代 DDR 的十几倍。本文拆解 HBM 的原理、四代演进、良率与封装的难点,以及它为什么既是 AI 芯片的标配,又是整条产业链最紧的瓶颈。
一叶一世界 精选 · 原创 · 昨天 阅读 6·访客 6
Reflection AI 发布开放权重模型 Beam:主打低算力成本,对标开放权重阵营中国模型
Reflection AI 发布开放权重模型 Beam,称效率为西方同类开放模型的 3-4 倍,权重本月放出,瞄准企业与主权 AI 市场。
大模型 TechCrunch · 3天前 阅读 24·访客 24
特斯拉签署 300 亿美元信贷协议,加码 AI 算力与太阳能产能
IT之家 9 月 30 日消息,据路透社报道,根据当地时间周二提交的一份监管文件,特斯拉已经签署总额达 300 亿美元(IT之家注:现汇率约合 2,016.47 亿元人民币)的信贷协议,其中包含一笔 200 亿美元(现汇率约合 1,344.…
行业动态 IT之家 · 9-30 阅读 12·访客 12
爆料称 AMD 为微软 XBOX Helix 和索尼 PS6 主机设计的芯片已流片,前者浮点算力纸面领先四成
IT之家 9 月 23 日消息,据外媒 Wccftech 今天(23 日)晚间报道,AMD 爆料者 Kepler_L2 透露,AMD 为 PlayStation 6 和 XBOX Helix 设计的芯片**现已完成流片**,两款主机有望明年…
行业动态 IT之家 · 9-23 阅读 16·访客 16
华为汪涛:华为要打造AI算力底座,只做好一颗芯片远远不够
CANN跨过拐点,华为补上软件生态]
行业动态 量子位 · 9-19 阅读 15·访客 15
无问芯穹与华环电子签署战略合作,共同探索国产异构算力AI基础设施新方向
协同布局AI基础设施]
行业动态 量子位 · 9-18 阅读 13·访客 13
博通 CEO 陈福阳回应 AI 放缓担忧:算力需求仍强劲,长期收入目标不变
IT之家 9 月 15 日消息,博通(Broadcom)首席执行官陈福阳(Hock Tan)于当地时间周一回应了市场担忧。针对前沿 AI 模型开发节奏有可能放缓会对这家芯片厂商业务造成冲击的疑问,他在接受 CNBC 采访时表态,公司仍维持长…
大模型 IT之家 · 9-15 阅读 24·访客 24
墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升算力效能,共创AI新经济
9月9日,墨芯人工智能亮相以"共创AI新经济"为主题的2026 Inclusion·外滩大会。]
研究前沿 量子位 · 9-11 阅读 32·访客 19
英伟达数据中心 GPU 产品线全景对比(2026):从 V100 到 Rubin 的七代算力跃迁
系统梳理英伟达数据中心级 GPU 从 Pascal 到 Rubin 的完整产品谱系,附七代完整规格对比表、中国市场特供线专题、AMD/Intel 竞品对比、选型指南与 TCO 数据,数据截至 2026 年 9 月。
行业动态 精选 · Proteus AI 深度研究 · 9-11 阅读 536·访客 372
打造10万卡国产算力集群推出JoyAI世界模型,京东发布物理AI建设最新成果
9月9日,以“JoyAI · 跃迁物理世界”为主题的JDDiscovery-2026京东全球科技探索者大会在北京举行]
行业动态 量子位 · 9-10 阅读 23·访客 18
国产AI4S计算平台登场亮相2026外滩大会 算力技术与人才布局双向发力
]
行业动态 量子位 · 9-9 阅读 19·访客 18
深度智控获宁德时代、沙特阿美战投等重磅加码,加速打造物理AI时代算力与能源底座
近日,物理AI企业深度智控(DeepCtrls)完成新一轮B+轮数亿元融资。
行业动态 量子位 · 9-8 阅读 15·访客 13
一篇读懂 FlashAttention:注意力为什么能又快又省显存
标准注意力的瓶颈不在算力而在显存读写:O(N²) 的注意力矩阵要在 HBM 里反复进出。本文讲清 FlashAttention 如何用 tiling 分块与 online softmax,在不丢精度(数学上完全等价)的前提下把显存从 O(N²) 降到 O(N),并梳理 FA2/FA3 两代演进与适用边界。
一叶一世界 精选 · 原创 · 2天前 阅读 7·访客 7
Anthropic 与 Akamai 达成 7 年 116 亿美元协议,扩充 CPU 算力
IT之家 9 月 26 日消息,云计算、网络安全、内容交付企业 Akamai 当地时间 24 日宣布大幅扩展与 Anthropic 的合作关系,两家公司签署了一份为期 7 年、价值 116 亿美元(IT之家注:现汇率约合 779.2 亿元人…
行业动态 IT之家 · 9-26 阅读 17·访客 17
国星宇航“星算”计划 02 组首批八星出征,近期择机发射
IT之家 9 月 10 日消息,国星宇航今日宣布,9 月 1 日,国星宇航在台州算力卫星创新基地举行“星算”计划 02 组首批 8 颗卫星出征仪式。 “星算”计划 02 组太空计算星座首批 8 颗卫星,均由国星宇航自主研制,并已通过中国信息…
研究前沿 IT之家 · 9-10 阅读 19·访客 17
KV Cache 争夺战:从 MHA 到 MLA,推理显存是怎么一省再省的
大模型解码阶段真正的瓶颈不是算力而是显存带宽——每生成一个 token,整段历史的 KV Cache 都要从显存重读一遍。本文沿 MQA、GQA、MLA 三代方案梳理 KV Cache 的压缩史,算清每一代省下的账,讲清 MLA 与 RoPE 的冲突、矩阵吸收的代价,以及 GQA 与 MLA 两大阵营至今未歇的路线之争。
大模型 精选 · 用户投稿 · 今天 阅读 2·访客 2
大模型价格战的底层逻辑:推理成本是怎么降下来的
同等能力的模型 API 价格在几年间下降了一个数量级以上,这不是赔本赚吆喝,而是推理成本结构性下降的传导。本文拆解大模型服务的成本结构,讲清硬件、推理效率、MoE 架构与规模化利用率四条降本路径,并给出开发者应对建议。
行业动态 精选 · 原创 · 3天前 阅读 16·访客 16
推理模型深度解析:从 o1 的豪赌到 RLVR,大模型是怎么学会「多想一会儿」的
2024 年 9 月 o1 用「先想一会儿」在 AIME 上打出 83% 对 13%,2025 年 1 月 DeepSeek-R1 把整套方法开源复现,到 2026 年 10 月,推理档位已成各大模型 API 的标准旋钮。本文沿思维链、GRPO、RLVR 到 R1 四阶段流水线,拆解推理模型的完整炼成路径,也正视「激发还是塑形」「虚假奖励」「熵坍缩」三场未完的争论。
大模型 精选 · 原创 · 今天 阅读 0·访客 0
MoE 的工业进化:从 1.6 万亿的 Switch Transformer 到 2.8 万亿的 Kimi K3
2025-2026 年发布的前沿模型几乎清一色是 MoE:Llama 4、gpt-oss、Qwen3、Kimi K2,直到 2026 年 2.78T 参数的 Kimi K3。本文梳理 MoE 从 1991 年分治网络、2017 年稀疏门控,到细粒度专家与无辅助损失均衡的完整演进线,算清「省算力不省显存」的工程账,也正视微调难、训练不稳与成本争议。
大模型 精选 · 用户投稿 · 今天 阅读 5·访客 5
微软发布 Surface Laptop Ultra,最高 128GB 统一内存可本地运行 1200 亿参数模型
微软举办特别发布会,推出搭载 NVIDIA RTX Spark Superchip 的 Surface Laptop Ultra(2599.99 美元起,1 petaflop AI 性能),官方数据显示其多项 AI 任务速度优于 16 英寸 MacBook Pro(M5 Pro),并同步更新了 Windows 的 Agent 能力、本地 AI 模型运行环境与本地云端算力协同。
行业动态 爱范儿 · 昨天 阅读 1·访客 1
微软与英伟达合作发布新一代 Surface 与 RTX Spark 平台,主打本地「无限智能」
微软与英伟达在 Windows 与 Surface 特别活动上发布专为本地 AI 设计的新硬件与 RTX Spark 计算平台,主张以一次买断的本地算力提供边际成本接近免费的「不限量智能」。
行业动态 爱范儿 · 昨天 阅读 1·访客 1
一篇读懂 CoWoS:卡住 AI 芯片出货脖子的,不是制程是封装
NVIDIA 新卡发布的节奏,很多时候不是被 4nm 产线决定的,而是被台积电一项叫 CoWoS 的 2.5D 封装产能决定的——它把 GPU 裸片和 HBM 并排装进同一个封装。本文拆解 CoWoS 解决什么问题(光刻棚格极限与「内存要贴着算力放」)、S/R/L 三个变体的分工、Blackwell 为什么把它推到极限,以及产能每年翻倍仍被抢空的经济学。
一叶一世界 精选 · 原创 · 昨天 阅读 10·访客 10
一篇读懂 MoE:大模型「大而不贵」的经济学
DeepSeek-V3 有 671B 参数,每个 token 却只动用 37B 的计算量——这不是营销话术,而是混合专家架构(MoE)把「模型容量」和「每 token 算力」拆开的结果。本文从 dense 模型的容量两难讲起,拆解路由器与稀疏激活的工作机制、负载均衡的三代方案、DeepSeekMoE 的细粒度设计,也说清 MoE 的两个代价:省 FLOPs 但不省显存,以及「专家」并不按领域分工的反直觉事实。
一叶一世界 精选 · 原创 · 昨天 阅读 1·访客 1
DLSS 5 正式版体验:十年没进步的游戏画面,英伟达怎么让它以假乱真?
过去十几年,我们一直在靠更精细的资产、更复杂的光照和更强的 GPU,一点一点把游戏推向真实。 今天的游戏之所以能做到这样的画面,本身就是模型、材质、动画、光照和算力不断堆叠的结果。 而 DLSS 5 带来的,是另一种非常直接的变化。 打开它…
行业动态 爱范儿 · 2天前 阅读 3·访客 3
Test-Time Scaling:让模型「多想一步」的三种姿势与一个天坑
推理时多花算力能换准确率:self-consistency 投票、过程奖励模型引导搜索、budget forcing 强制续想,三条路线各有边界。本文以 s1 论文与 2025–2026 年的 overthinking 研究为轴,梳理 test-time scaling 的效果账与失效点。
研究前沿 精选 · 原创 · 2天前 阅读 3·访客 3
深度研究:2026 年三季度全球 AI 投融资盘点
2026 年三季度全球风险投资 1590 亿美元、AI 占 64%;27 笔十亿美元级巨额轮创历史纪录,Databricks 与 SSI 各 50 亿美元领衔。钱加速流向算力与数据中心,应用层在巨额轮名单集体缺席;IPO 与并购通道同步打开,一二级市场估值分化开始显形。
行业动态 精选 · 原创 · 2天前 阅读 77·访客 75
手机上的大模型:端侧推理的芯片、量化与落地现状
从骁龙 8 Elite Gen 5 的 Hexagon NPU 到苹果 AFM 3 端侧模型家族,梳理 2026 年手机端侧大模型的硬件底座(NPU 算力与约 85 GB/s 的内存带宽瓶颈)、3B 级模型格局、4-bit 量化与主流端侧推理框架,以及哪些场景仍必须回云。
大模型 精选 · 原创 · 2天前 阅读 44·访客 41
Agent 的经济账:从按 token 到按结果的计费演进
Agent 任务是多轮模型调用加失败重试,token 成本数倍于单轮对话,计费模式因此成为行业难题。本文梳理按 token、订阅、按结果、按价值分成四种模式的风险分配,分析毛利结构,并给出买方评估供应商的三个关键问题。
行业动态 精选 · 原创 · 3天前 阅读 16·访客 16
一篇读懂投机解码:让大模型「先猜后验」的加速术
自回归解码每步只出一个 token,GPU 大量算力在等显存。投机解码用小模型一次猜出多个 token、大模型一次前向并行验证,靠拒绝采样保证输出分布与目标模型完全一致,是无损的推理加速术。本文讲清它的原理、加速比来源与适用边界。
一叶一世界 精选 · 原创 · 3天前 阅读 12·访客 12
中国电信 TeleAgent 深度研究报告:双轮驱动架构与千行百业落地
TeleAgent 是中国电信 TeleAI 推出的桌面系统级通用智能体,采用「息壤算力网络 + 本地轻量化引擎」双轮驱动架构。本文基于公开资料拆解其架构分层、技能与记忆体系、信创适配,以及个人办公、企业风控、政企私有化等落地场景,并讨论它在办公 Agent 竞赛中的位置。
智能体 精选 · 原创 · 3天前 阅读 28·访客 27
我国生成式人工智能用户规模突破 7 亿人,普及率超 50%
中国互联网络信息中心发布报告称,截至 2026 年上半年我国生成式 AI 用户规模超 7 亿、普及率超 50%,智能问答为最主流使用方式,智能算力规模同比大增 177%。
行业动态 IT之家 · 9-29 阅读 18·访客 18
黑客在暗网兜售 AI 模型访问权限,最低价仅有正版 3%
IT之家 9 月 28 日消息,据英国《金融时报》当地时间 26 日报道,非法获取 AI 模型和算力,正迅速成为网络犯罪黑市上最抢手的商品,黑客希望借助价格高昂的大模型实施勒索、网络战和间谍活动。 谷歌威胁情报团队首席分析师约翰 · 霍特奎…
大模型 IT之家 · 9-28 阅读 31·访客 31
亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源
henry* 2026-09-25 18:00:14 来源:量子位 大厂造芯,正在从交付芯片,走向更广泛的开放共建阶段。 henry 发自 凹非寺 量子位 | 公众号 QbitAI “这是目前中国算力性能最强的AI芯片,性能达到M890的…
开源项目 量子位 · 9-25 阅读 31·访客 31
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍
思邈* 2026-09-24 22:17:48 来源:量子位 1.5台6000D跑赢1台B300! 允中 发自 凹非寺 量子位 | 公众号QbitAI 随着大模型对算力需求持续攀升,**GPU卡的采购成本、供给约束持续加剧。** AI推理…
开源项目 量子位 · 9-24 阅读 34·访客 33
成立九年,中科类脑把积累装进Token工厂
衡宇* 2026-09-24 08:48:02 来源:量子位 乔不迟 发自 凹非寺 量子位 | 公众号 QbitAI 过去评价一座数据中心,行业习惯看三个指标: 卡数、算力规模和PUE(电能利用效率)。 大模型进入规模化推理阶段后,这套标…
研究前沿 量子位 · 9-24 阅读 28·访客 28