AI
AI
资讯
alishangtian.com
首页
大模型
智能体
开源项目
研究前沿
行业动态
专题
专题 · TOPICS
一叶一世界
48 篇
Agent 工程系统学习
14 篇
Agent 沙箱技术专题
13 篇
大模型基本功
39 篇
AI 推理与部署
23 篇
算法题解
36 篇
AI 编程实战
12 篇
RAG 实战手册
20 篇
后端技术
36 篇
模型微调实战
10 篇
推理模型
9 篇
端侧智能
8 篇
论文精读
11 篇
AI 行业观察
9 篇
AI 安全与攻防
20 篇
多模态之路
14 篇
具身智能与机器人
6 篇
Transformer 架构与算法优化
5 篇
AI for Science
7 篇
世界模型与视频生成
12 篇
AI 治理与合规
12 篇
开源模型全景
18 篇
Kubernetes 深入实践
6 篇
MLOps 与 LLM 工程化
7 篇
AI 音频与音乐
8 篇
对齐与后训练
11 篇
AI 硬件
3 篇
AI 办公与生产力
7 篇
自动驾驶与智能出行
4 篇
提示工程与上下文工程
14 篇
AI 芯片与算力
10 篇
模型评测与基准
7 篇
AI 搜索与答案引擎
5 篇
MCP 与 Agent 协议生态
21 篇
AI 医疗健康
1 篇
AI 与教育
2 篇
全部专题 →
主题色 · THEME
靛蓝(默认)
极光
落日
薰衣草
海洋
森林
暮橙
石墨
自定义
恢复默认
提交线索
agent
anthropic
openai
huggingface daily papers
gpu
ai安全
jake wharton
it之家
solidot
港股
搜索:
算力
共命中 50 条(服务端检索)
博通为 OpenAI 筹资 500 亿美元:AI
算力
建设进入「债务驱动」时代
10 月 8 日《华尔街日报》与彭博社报道:博通正为 OpenAI 的定制 AI 芯片安排超 500 亿美元融资,与阿波罗、黑石等私募信贷机构早期洽谈;同日《金融时报》曝出 SpaceX 正洽谈约 400 亿美元买英伟达芯片,博通还在为 Anthropic 筹集 600 亿美元。芯片采购的钱开始大规模来自债券与私募信贷,而非利润与股权——AI
算力
的融资结构正在换轨。本文梳理交易结构与「循环交易」争议。
行业动态
精选
· 原创 · 昨天
阅读 27
·
访客 27
OpenAI 的
算力
帝国账本:一万四千亿美元承诺、三家芯片厂兜底与十月刚开张的 AI 债务市场
一年时间,OpenAI 与英伟达、AMD、博通、甲骨文、微软签下约 1.4 万亿美元量级的
算力
承诺——芯片商既是供应商,又是投资人,如今还亲自组织债务融资。本文拆开这张交易网:每笔交易的结构与数字、资金怎么转圈、「循环融资」批评的正反双方,以及 2026 年 10 月最新登场的 500 亿美元私人信贷说明了什么。
行业动态
精选
· 原创 · 昨天
阅读 13
·
访客 13
算力
的度量衡:从 FLOPS 到卡时,看懂
算力
新闻的单位
FLOPS、
算力
、卡时、集群规模混着说,是看懂
算力
新闻的第一道坎。本文厘清 FLOPS 与 FLOPs 一字之差的两个概念,给出 6ND 训练
算力
估算经验与卡时换算方法,解释峰值与有效
算力
之间的 MFU 差距,最后附一张看懂
算力
新闻的换算清单。
行业动态
精选
· 原创 · 3天前
阅读 20
·
访客 19
算力
芯片格局速览:GPU、ASIC 与推理卡的分工
芯片发布一场接一场,参数眼花缭乱。本文不评具体产品,而是给一套分类框架:GPU 凭什么主导 AI
算力
、ASIC 特化在哪、推理卡的成本逻辑是什么,以及读芯片新闻时先问的三个问题。
行业动态
精选
· 原创 · 3天前
阅读 13
·
访客 13
Scaling Laws 十问十答:
算力
、数据与参数的交换律
以十个问答讲清 Scaling Laws:幂律为什么可外推、Chinchilla 如何修正参数与数据的配比、6ND 公式怎么当
算力
换算器、数据枯竭与推理时
算力
这两条新变量,以及这门「经验定律」对大公司与创业者的不同含义。
研究前沿
精选
· 原创 · 3天前
阅读 13
·
访客 13
消息称 Anthropic 谈判租赁最高 1GW
算力
,预计相关投资至少 400 亿美元
IT之家 9 月 26 日消息,据 The Information 报道,Anthropic 计划从一家由阿波罗全球管理公司控股的数据中心开发商处,租赁最高 1 吉瓦(Gigawatt,GW)
算力
,目前正处于早期谈判阶段。 据知情人士透露,…
行业动态
IT之家 · 9-26
阅读 21
·
访客 21
IDC评估中国AI
算力
管理平台:范式智能四项维度获满分,综合评分第一
范式成为《中国AI
算力
管理平台技术能力评估,2026》综合评分位列第一的厂商。]
行业动态
量子位 · 9-21
阅读 19
·
访客 17
全面追赶 OpenAI,消息称 Anthropic 计划在今年年底前拥有约 5 吉瓦可用
算力
、明年年底翻倍
IT之家 9 月 18 日消息,在争夺顶尖模型性能的较量中,OpenAI 与 Anthropic 的竞争已进入白热化阶段。而这场较量的核心,正是训练与部署这些模型不可或缺的基础设施 ——
算力
。 据纽约时报消息,过去几年里,OpenAI 在…
行业动态
IT之家 · 9-18
阅读 20
·
访客 20
华为轮值董事长汪涛:华为 AI 战略的核心是
算力
,坚持硬件变现
IT之家 9 月 17 日消息,据财联社报道,华为副董事长、轮值董事长汪涛今日(9 月 17 日)在上海举行的华为全联接大会上介绍华为面向智能时代的重要部署: 一是华为 AI 战略的核心是
算力
,坚持硬件变现 ; 二是“超节点 + 集群”,打…
开源项目
IT之家 · 9-17
阅读 26
·
访客 26
“
算力
中国·年度卓越成就”发布 太初元碁超智融合计算系统入选
太初(杭州)集成电路有限公司新一代超智融合计算系统元碁Hypertintellix入选“
算力
中国·年度卓越成就”。]
行业动态
量子位 · 9-12
阅读 22
·
访客 18
算力
词元贷加速全国推广,支持机房建设、GPU 服务器集群采购
IT之家 9 月 12 日消息,据央视财经今日报道,今年服贸会首次推出“金融 + 科创”的联展模式,让金融机构联合他们所赋能的科创企业同台参展。展台上除了金融产品,还有智能机械臂、运载火箭模型、人形机器人等硬科技,背后是
算力
贷、
算力
保、投…
行业动态
IT之家 · 9-12
阅读 17
·
访客 14
中国工程院院士邬贺铨:2030 年中国
算力
有望占到全球 30%
IT之家 9 月 12 日消息,据中国
算力
大会官方,9 月 12 日,在 2026 中国
算力
大会主论坛上,中国工程院院士邬贺铨指出,智能体的出现带动了 Token 的消费。 今年 3 月,Token 的消费已经达到日均 140 万亿。随着技…
智能体
IT之家 · 9-12
阅读 20
·
访客 16
中国移动发布 AI 可信计算:提供多形态机密
算力
和机密 Token
IT之家 9 月 12 日消息,9 月 12 日,在 2026 中国
算力
大会主论坛上,中国移动正式发布 AI 可信计算( AITC ),并启动 AI 可信计算生态共建战略合作。 据介绍,中国移动率先布局 AI 可信计算,基于移动云全栈国产化…
研究前沿
IT之家 · 9-12
阅读 16
·
访客 14
AI
算力
硬合作,马斯克还是更相信中国制造
田, 晏林* 2026-10-04 14:12:22 来源:量子位 一种混搭的可能:英特尔继续供先进工艺,即前端用14A;后端再接台积电,来补工厂运营、良率、封装这些能力。 田晏林 发自 凹非寺 量子位 | 公众号 QbitAI 马斯克的…
行业动态
量子位 · 5天前
阅读 27
·
访客 27
Anthropic IPO 招股书曝光,巨额
算力
投入与安全隐忧并存
IT之家 9 月 29 日消息,据路透社看到的 Anthropic IPO 招股书文件显示,该公司正在豪押一个判断:人工智能对全球经济带来的变革,其深刻程度将会超过工业化、电力普及以及互联网。 但实现这一愿景所要付出的成本高得惊人。招股书披…
行业动态
IT之家 · 9-29
阅读 42
·
访客 42
一篇读懂 HBM:AI
算力
的「内存墙」是怎么被摞高的
看 GPU 规格表,带宽那行数字比 FLOPS 更能决定大模型推理的快慢——HBM 用「立体堆叠 + 超宽接口」两个动作,把内存带宽做到了同代 DDR 的十几倍。本文拆解 HBM 的原理、四代演进、良率与封装的难点,以及它为什么既是 AI 芯片的标配,又是整条产业链最紧的瓶颈。
一叶一世界
精选
· 原创 · 昨天
阅读 6
·
访客 6
Reflection AI 发布开放权重模型 Beam:主打低
算力
成本,对标开放权重阵营中国模型
Reflection AI 发布开放权重模型 Beam,称效率为西方同类开放模型的 3-4 倍,权重本月放出,瞄准企业与主权 AI 市场。
大模型
TechCrunch · 3天前
阅读 24
·
访客 24
特斯拉签署 300 亿美元信贷协议,加码 AI
算力
与太阳能产能
IT之家 9 月 30 日消息,据路透社报道,根据当地时间周二提交的一份监管文件,特斯拉已经签署总额达 300 亿美元(IT之家注:现汇率约合 2,016.47 亿元人民币)的信贷协议,其中包含一笔 200 亿美元(现汇率约合 1,344.…
行业动态
IT之家 · 9-30
阅读 12
·
访客 12
爆料称 AMD 为微软 XBOX Helix 和索尼 PS6 主机设计的芯片已流片,前者浮点
算力
纸面领先四成
IT之家 9 月 23 日消息,据外媒 Wccftech 今天(23 日)晚间报道,AMD 爆料者 Kepler_L2 透露,AMD 为 PlayStation 6 和 XBOX Helix 设计的芯片**现已完成流片**,两款主机有望明年…
行业动态
IT之家 · 9-23
阅读 16
·
访客 16
华为汪涛:华为要打造AI
算力
底座,只做好一颗芯片远远不够
CANN跨过拐点,华为补上软件生态]
行业动态
量子位 · 9-19
阅读 15
·
访客 15
无问芯穹与华环电子签署战略合作,共同探索国产异构
算力
AI基础设施新方向
协同布局AI基础设施]
行业动态
量子位 · 9-18
阅读 13
·
访客 13
博通 CEO 陈福阳回应 AI 放缓担忧:
算力
需求仍强劲,长期收入目标不变
IT之家 9 月 15 日消息,博通(Broadcom)首席执行官陈福阳(Hock Tan)于当地时间周一回应了市场担忧。针对前沿 AI 模型开发节奏有可能放缓会对这家芯片厂商业务造成冲击的疑问,他在接受 CNBC 采访时表态,公司仍维持长…
大模型
IT之家 · 9-15
阅读 24
·
访客 24
墨芯人工智能亮相2026 Inclusion·外滩大会:以专用稀疏推理芯片提升
算力
效能,共创AI新经济
9月9日,墨芯人工智能亮相以"共创AI新经济"为主题的2026 Inclusion·外滩大会。]
研究前沿
量子位 · 9-11
阅读 32
·
访客 19
英伟达数据中心 GPU 产品线全景对比(2026):从 V100 到 Rubin 的七代
算力
跃迁
系统梳理英伟达数据中心级 GPU 从 Pascal 到 Rubin 的完整产品谱系,附七代完整规格对比表、中国市场特供线专题、AMD/Intel 竞品对比、选型指南与 TCO 数据,数据截至 2026 年 9 月。
行业动态
精选
· Proteus AI 深度研究 · 9-11
阅读 536
·
访客 372
打造10万卡国产
算力
集群推出JoyAI世界模型,京东发布物理AI建设最新成果
9月9日,以“JoyAI · 跃迁物理世界”为主题的JDDiscovery-2026京东全球科技探索者大会在北京举行]
行业动态
量子位 · 9-10
阅读 23
·
访客 18
国产AI4S计算平台登场亮相2026外滩大会
算力
技术与人才布局双向发力
]
行业动态
量子位 · 9-9
阅读 19
·
访客 18
深度智控获宁德时代、沙特阿美战投等重磅加码,加速打造物理AI时代
算力
与能源底座
近日,物理AI企业深度智控(DeepCtrls)完成新一轮B+轮数亿元融资。
行业动态
量子位 · 9-8
阅读 15
·
访客 13
一篇读懂 FlashAttention:注意力为什么能又快又省显存
标准注意力的瓶颈不在
算力
而在显存读写:O(N²) 的注意力矩阵要在 HBM 里反复进出。本文讲清 FlashAttention 如何用 tiling 分块与 online softmax,在不丢精度(数学上完全等价)的前提下把显存从 O(N²) 降到 O(N),并梳理 FA2/FA3 两代演进与适用边界。
一叶一世界
精选
· 原创 · 2天前
阅读 7
·
访客 7
Anthropic 与 Akamai 达成 7 年 116 亿美元协议,扩充 CPU
算力
IT之家 9 月 26 日消息,云计算、网络安全、内容交付企业 Akamai 当地时间 24 日宣布大幅扩展与 Anthropic 的合作关系,两家公司签署了一份为期 7 年、价值 116 亿美元(IT之家注:现汇率约合 779.2 亿元人…
行业动态
IT之家 · 9-26
阅读 17
·
访客 17
国星宇航“星算”计划 02 组首批八星出征,近期择机发射
IT之家 9 月 10 日消息,国星宇航今日宣布,9 月 1 日,国星宇航在台州
算力
卫星创新基地举行“星算”计划 02 组首批 8 颗卫星出征仪式。 “星算”计划 02 组太空计算星座首批 8 颗卫星,均由国星宇航自主研制,并已通过中国信息…
研究前沿
IT之家 · 9-10
阅读 19
·
访客 17
KV Cache 争夺战:从 MHA 到 MLA,推理显存是怎么一省再省的
大模型解码阶段真正的瓶颈不是
算力
而是显存带宽——每生成一个 token,整段历史的 KV Cache 都要从显存重读一遍。本文沿 MQA、GQA、MLA 三代方案梳理 KV Cache 的压缩史,算清每一代省下的账,讲清 MLA 与 RoPE 的冲突、矩阵吸收的代价,以及 GQA 与 MLA 两大阵营至今未歇的路线之争。
大模型
精选
· 用户投稿 · 今天
阅读 2
·
访客 2
大模型价格战的底层逻辑:推理成本是怎么降下来的
同等能力的模型 API 价格在几年间下降了一个数量级以上,这不是赔本赚吆喝,而是推理成本结构性下降的传导。本文拆解大模型服务的成本结构,讲清硬件、推理效率、MoE 架构与规模化利用率四条降本路径,并给出开发者应对建议。
行业动态
精选
· 原创 · 3天前
阅读 16
·
访客 16
推理模型深度解析:从 o1 的豪赌到 RLVR,大模型是怎么学会「多想一会儿」的
2024 年 9 月 o1 用「先想一会儿」在 AIME 上打出 83% 对 13%,2025 年 1 月 DeepSeek-R1 把整套方法开源复现,到 2026 年 10 月,推理档位已成各大模型 API 的标准旋钮。本文沿思维链、GRPO、RLVR 到 R1 四阶段流水线,拆解推理模型的完整炼成路径,也正视「激发还是塑形」「虚假奖励」「熵坍缩」三场未完的争论。
大模型
精选
· 原创 · 今天
阅读 0
·
访客 0
MoE 的工业进化:从 1.6 万亿的 Switch Transformer 到 2.8 万亿的 Kimi K3
2025-2026 年发布的前沿模型几乎清一色是 MoE:Llama 4、gpt-oss、Qwen3、Kimi K2,直到 2026 年 2.78T 参数的 Kimi K3。本文梳理 MoE 从 1991 年分治网络、2017 年稀疏门控,到细粒度专家与无辅助损失均衡的完整演进线,算清「省
算力
不省显存」的工程账,也正视微调难、训练不稳与成本争议。
大模型
精选
· 用户投稿 · 今天
阅读 5
·
访客 5
微软发布 Surface Laptop Ultra,最高 128GB 统一内存可本地运行 1200 亿参数模型
微软举办特别发布会,推出搭载 NVIDIA RTX Spark Superchip 的 Surface Laptop Ultra(2599.99 美元起,1 petaflop AI 性能),官方数据显示其多项 AI 任务速度优于 16 英寸 MacBook Pro(M5 Pro),并同步更新了 Windows 的 Agent 能力、本地 AI 模型运行环境与本地云端
算力
协同。
行业动态
爱范儿 · 昨天
阅读 1
·
访客 1
微软与英伟达合作发布新一代 Surface 与 RTX Spark 平台,主打本地「无限智能」
微软与英伟达在 Windows 与 Surface 特别活动上发布专为本地 AI 设计的新硬件与 RTX Spark 计算平台,主张以一次买断的本地
算力
提供边际成本接近免费的「不限量智能」。
行业动态
爱范儿 · 昨天
阅读 1
·
访客 1
一篇读懂 CoWoS:卡住 AI 芯片出货脖子的,不是制程是封装
NVIDIA 新卡发布的节奏,很多时候不是被 4nm 产线决定的,而是被台积电一项叫 CoWoS 的 2.5D 封装产能决定的——它把 GPU 裸片和 HBM 并排装进同一个封装。本文拆解 CoWoS 解决什么问题(光刻棚格极限与「内存要贴着
算力
放」)、S/R/L 三个变体的分工、Blackwell 为什么把它推到极限,以及产能每年翻倍仍被抢空的经济学。
一叶一世界
精选
· 原创 · 昨天
阅读 10
·
访客 10
一篇读懂 MoE:大模型「大而不贵」的经济学
DeepSeek-V3 有 671B 参数,每个 token 却只动用 37B 的计算量——这不是营销话术,而是混合专家架构(MoE)把「模型容量」和「每 token
算力
」拆开的结果。本文从 dense 模型的容量两难讲起,拆解路由器与稀疏激活的工作机制、负载均衡的三代方案、DeepSeekMoE 的细粒度设计,也说清 MoE 的两个代价:省 FLOPs 但不省显存,以及「专家」并不按领域分工的反直觉事实。
一叶一世界
精选
· 原创 · 昨天
阅读 1
·
访客 1
DLSS 5 正式版体验:十年没进步的游戏画面,英伟达怎么让它以假乱真?
过去十几年,我们一直在靠更精细的资产、更复杂的光照和更强的 GPU,一点一点把游戏推向真实。 今天的游戏之所以能做到这样的画面,本身就是模型、材质、动画、光照和
算力
不断堆叠的结果。 而 DLSS 5 带来的,是另一种非常直接的变化。 打开它…
行业动态
爱范儿 · 2天前
阅读 3
·
访客 3
Test-Time Scaling:让模型「多想一步」的三种姿势与一个天坑
推理时多花
算力
能换准确率:self-consistency 投票、过程奖励模型引导搜索、budget forcing 强制续想,三条路线各有边界。本文以 s1 论文与 2025–2026 年的 overthinking 研究为轴,梳理 test-time scaling 的效果账与失效点。
研究前沿
精选
· 原创 · 2天前
阅读 3
·
访客 3
深度研究:2026 年三季度全球 AI 投融资盘点
2026 年三季度全球风险投资 1590 亿美元、AI 占 64%;27 笔十亿美元级巨额轮创历史纪录,Databricks 与 SSI 各 50 亿美元领衔。钱加速流向
算力
与数据中心,应用层在巨额轮名单集体缺席;IPO 与并购通道同步打开,一二级市场估值分化开始显形。
行业动态
精选
· 原创 · 2天前
阅读 77
·
访客 75
手机上的大模型:端侧推理的芯片、量化与落地现状
从骁龙 8 Elite Gen 5 的 Hexagon NPU 到苹果 AFM 3 端侧模型家族,梳理 2026 年手机端侧大模型的硬件底座(NPU
算力
与约 85 GB/s 的内存带宽瓶颈)、3B 级模型格局、4-bit 量化与主流端侧推理框架,以及哪些场景仍必须回云。
大模型
精选
· 原创 · 2天前
阅读 44
·
访客 41
Agent 的经济账:从按 token 到按结果的计费演进
Agent 任务是多轮模型调用加失败重试,token 成本数倍于单轮对话,计费模式因此成为行业难题。本文梳理按 token、订阅、按结果、按价值分成四种模式的风险分配,分析毛利结构,并给出买方评估供应商的三个关键问题。
行业动态
精选
· 原创 · 3天前
阅读 16
·
访客 16
一篇读懂投机解码:让大模型「先猜后验」的加速术
自回归解码每步只出一个 token,GPU 大量
算力
在等显存。投机解码用小模型一次猜出多个 token、大模型一次前向并行验证,靠拒绝采样保证输出分布与目标模型完全一致,是无损的推理加速术。本文讲清它的原理、加速比来源与适用边界。
一叶一世界
精选
· 原创 · 3天前
阅读 12
·
访客 12
中国电信 TeleAgent 深度研究报告:双轮驱动架构与千行百业落地
TeleAgent 是中国电信 TeleAI 推出的桌面系统级通用智能体,采用「息壤
算力
网络 + 本地轻量化引擎」双轮驱动架构。本文基于公开资料拆解其架构分层、技能与记忆体系、信创适配,以及个人办公、企业风控、政企私有化等落地场景,并讨论它在办公 Agent 竞赛中的位置。
智能体
精选
· 原创 · 3天前
阅读 28
·
访客 27
我国生成式人工智能用户规模突破 7 亿人,普及率超 50%
中国互联网络信息中心发布报告称,截至 2026 年上半年我国生成式 AI 用户规模超 7 亿、普及率超 50%,智能问答为最主流使用方式,智能
算力
规模同比大增 177%。
行业动态
IT之家 · 9-29
阅读 18
·
访客 18
黑客在暗网兜售 AI 模型访问权限,最低价仅有正版 3%
IT之家 9 月 28 日消息,据英国《金融时报》当地时间 26 日报道,非法获取 AI 模型和
算力
,正迅速成为网络犯罪黑市上最抢手的商品,黑客希望借助价格高昂的大模型实施勒索、网络战和间谍活动。 谷歌威胁情报团队首席分析师约翰 · 霍特奎…
大模型
IT之家 · 9-28
阅读 31
·
访客 31
亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源
henry* 2026-09-25 18:00:14 来源:量子位 大厂造芯,正在从交付芯片,走向更广泛的开放共建阶段。 henry 发自 凹非寺 量子位 | 公众号 QbitAI “这是目前中国
算力
性能最强的AI芯片,性能达到M890的…
开源项目
量子位 · 9-25
阅读 31
·
访客 31
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍
思邈* 2026-09-24 22:17:48 来源:量子位 1.5台6000D跑赢1台B300! 允中 发自 凹非寺 量子位 | 公众号QbitAI 随着大模型对
算力
需求持续攀升,**GPU卡的采购成本、供给约束持续加剧。** AI推理…
开源项目
量子位 · 9-24
阅读 34
·
访客 33
成立九年,中科类脑把积累装进Token工厂
衡宇* 2026-09-24 08:48:02 来源:量子位 乔不迟 发自 凹非寺 量子位 | 公众号 QbitAI 过去评价一座数据中心,行业习惯看三个指标: 卡数、
算力
规模和PUE(电能利用效率)。 大模型进入规模化推理阶段后,这套标…
研究前沿
量子位 · 9-24
阅读 28
·
访客 28