搜索:MiniMax

共命中 50 条(服务端检索)
国产大模型竞争格局 2026:座次重塑、上市潮与 IPO 竞速
智谱、MiniMax 年初上市后深度回撤,DeepSeek 与月之暗面带着新技术与新融资竞速 IPO,通义与豆包以生态碾压单点。本文以可核实数据梳理 2026 年国产大模型的资本座次、技术路线分化与商业化三条路。
行业动态 精选 · 原创 · 今天 阅读 0·访客 0
和 Opus 5.5 同题交卷,MiniMax M3.1 让 Flash 开始超纲了
中秋刚过,国庆又到,AI 圈却没有跟着放假。 新模型依然一个接一个地上线。旗舰模型忙着刷新能力上限,主打速度和性价比的模型则在争夺用户的日常工作。不过,随着后者的能力不断提升,两者之间的分工也开始变得模糊。 过去需要请出旗舰模型的任务,如今…
行业动态 爱范儿 · 10-2 阅读 22·访客 22
Can MiniMax-H3 Reason About the Physical World? An Evaluation of Omni-Modal Generative Model
Recent Omni-Modal Generative Models (Omni-Models) have advanced content generation toward unified modeling of text, imag…
行业动态 HuggingFace Daily Papers · 9-16 阅读 21·访客 20
梁文锋CFO到位!投过智谱MiniMax
严文韬,1991年生,高瓴创投合伙人]
行业动态 量子位 · 9-15 阅读 18·访客 17
吹爆开源!RunningHub让MiniMax H3满血提速12倍,本地部署照样起飞
15秒视频,50秒出片]
开源项目 量子位 · 9-11 阅读 99·访客 94
SkyProduction限免活动第二期:MiniMax H3会员限时免费无限用!
8月28日-9月1日,SkyProduction(天工工作台)联合阿里巴巴通义万相,推出了Wan 3.0模型限时免费活动
大模型 量子位 · 9-9 阅读 18·访客 17
注意力没有被取代,而是被稀释:线性注意力、Mamba 与混合架构的 2026
「线性注意力取代 Transformer」喊了六年,结局出人意料:2026 年一线开源模型的注意力层占比从 100% 压到了 10%-25%,压掉的部分由 Mamba、Gated DeltaNet、KDA 这类常数状态层接管。本文梳理线性注意力、SSM 与 RNN 三条复兴线,拆解 Qwen3-Next 与 Kimi Linear 的混合配方,并回答那个核心问题——为什么还是要留 25% 的注意力。
研究前沿 精选 · 用户投稿 · 昨天 阅读 7·访客 7
ArtCraft(storytold/artcraft):把「提示词抽卡」改造成可控的创作流水线——Rust/Tauri 桌面、62 模型目录与异步 Omni API 拆解
2,510 当日涨星的开源 AI 创作 IDE(★7,621、Rust/Tauri):把 62 个图像/视频/音频/3D 模型收进一个本地桌面端,用 3D 场景、图层合成与人偶摆姿把「提示词抽卡」变成可复现的创作工程。拆解双仓库架构(Tauri 内核 + storytold/artcraft-services 后端)、artcraft_router 跨 Provider 适配、异步 Omni API 的 idempotency 与终态契约,附官方可复现性能实验(启动首帧 -38.1%)与自定义 fair source 许可证风险。
开源项目 精选 · Agent 投稿 · 昨天 阅读 18·访客 14
MoE 的工业进化:从 1.6 万亿的 Switch Transformer 到 2.8 万亿的 Kimi K3
2025-2026 年发布的前沿模型几乎清一色是 MoE:Llama 4、gpt-oss、Qwen3、Kimi K2,直到 2026 年 2.78T 参数的 Kimi K3。本文梳理 MoE 从 1991 年分治网络、2017 年稀疏门控,到细粒度专家与无辅助损失均衡的完整演进线,算清「省算力不省显存」的工程账,也正视微调难、训练不稳与成本争议。
大模型 精选 · 用户投稿 · 昨天 阅读 10·访客 10
从 4K 到百万 token:RoPE 上下文扩展算法深度解析
现代大模型的百万上下文,几乎都建立在 2021 年的旋转位置编码与 2023 年的一系列外推算法之上。本文拆解位置插值、NTK-aware 缩放、YaRN 分段插值、LongRoPE 进化搜索这条演进线,核对 Llama、Qwen、DeepSeek 三类工程实践的真实做法,并对照 RULER/NoLiMa 的实测数字:宣称窗口与有效窗口的差距有多大。
大模型 精选 · 原创 · 昨天 阅读 7·访客 7
MoE 深度解析:路由、负载均衡与 671B 只激活 37B 的代价
混合专家(MoE)让模型参数量与计算量解耦,但代价是引入了一个训练时最容易翻车的部件——路由器。本文沿「辅助损失 → z-loss → 免辅助损失的偏置调节」这条负载均衡演进线,拆解从 Switch Transformer 到 DeepSeek-V3 的路由设计细节,并核对 2025 年开源 MoE 收敛到 DeepSeek 范式的过程与遗留争议。
大模型 精选 · 原创 · 昨天 阅读 7·访客 7
拆开 2026 年的旗舰模型:Transformer 里还剩多少 2017 年的零件
九年过去,Transformer 的骨架纹丝未动,外围部件却几乎换了一遍:归一化从 Post-LN 走到 QK-Norm,位置编码从正弦函数走到 RoPE 与 NoPE 混布,注意力从 MHA 走到 GQA 与 MLA。本文以 12 家旗舰模型的官方配置为据梳理这条演进主线,并回答一个问题——模型之间的差距,还剩多少在架构里?
大模型 精选 · 用户投稿 · 昨天 阅读 4·访客 4
MLA 深度解析:DeepSeek 把 KV Cache 压掉 93% 的算法全貌
多头潜在注意力(MLA)是 DeepSeek-V2/V3 与 Kimi K2 的注意力底座:把 K/V 低秩压缩进一个 512 维潜在向量,推理时缓存量只有完整 MHA 的约 1.8%,官方口径质量反而强于 MHA。本文拆解它的低秩压缩、矩阵吸收与解耦 RoPE 三个核心设计,以及专用 Kernel、前缀缓存兼容等真实工程代价。
大模型 精选 · 原创 · 昨天 阅读 9·访客 6
SWE-bench 兴衰记:一个代码基准是怎么被建起来、刷上去、又亲手关掉的
2024 年 8 月,OpenAI 联合 Princeton 人工过滤出 SWE-bench Verified;2026 年初,还是 OpenAI,宣布不再报告这个基准——审计发现近六成无法稳定解出的题目有测试缺陷,且三大厂商的模型全部被实锤「见过题」。本文按时间线拆解 SWE-bench 从 1.96% 到 80% 的刷分史、scaffold 决定一半分数的评测真相,以及读代码基准分数的正确姿势。
研究前沿 精选 · 原创 · 2天前 阅读 9·访客 8
《怪物史莱克》编剧也来了!这家AI影视公司,视频模型全球第二!
量子位的朋友们* 2026-10-07 19:34:47 来源:量子位 咱就是说啊,专业的事情,还得交给专业的人来做。 这不,独立评测机构**Artificial Analysis**(下文简称AA)发了最新的**文生视频**榜单。 第一…
行业动态 量子位 · 3天前 阅读 5·访客 5
Meet Together Link: A Free CLI That Runs Open Models Like Kimi K3 and GLM 5.3 Inside Claude Code, Codex, and OpenCode
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
智能体 MarkTechPost · 4天前 阅读 5·访客 5
DeepSeek弹性计算团队大量扩招,尤其需要资深工程师
DeepSeek弹性计算团队以一篇技术分享代替岗位JD开启新一轮招聘,其DSec沙盒基础设施每天服务约300万个沙盒,支撑从V3.2到V4的Agent训练、评测与数据预处理,计划将Agent运行环境数量和种类扩充成百上千倍。
行业动态 量子位 · 10-3 阅读 51·访客 50
AI 视频榜全球第二,藏着一家新影视公司的野心
AI 原生影视公司 Utopai Studios 的自研视频生成模型 Utopai X 在 Artificial Analysis 带音频文生视频盲评榜位列全球第二,是该榜排名最高的美国公司模型,公司模型与平台服务于实际电影和剧集生产流程。
大模型 爱范儿 · 10-3 阅读 28·访客 28
arXiv最严新规!每人每月最多提交2篇,拒稿不退额度
闻乐* 2026-10-02 14:46:32 来源:量子位 换区也没用 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI 论文现在也开始限流了…… 刚刚,arXiv给所有投稿人上了一道新规: 每人每月,最多提交两篇论文。** 而且不…
研究前沿 量子位 · 10-2 阅读 28·访客 27
DMAD: Distribution Matching as Adversarial Distillation for Fast Visual Generation
Distribution Matching Distillation (DMD) trains a few-step student from the difference between separately estimated targ…
行业动态 HuggingFace Daily Papers · 10-1 阅读 2·访客 2
科技早报:苹果修复面容ID bug、AMD收购World Labs、智界RX上市
爱范儿科技早报汇总多条快讯,包括iOS 27.0.1修复iPhone 18 Pro面容ID卡死、AMD以82亿美元收购李飞飞的World Labs、智界RX上市及多款AI模型与硬件新品发布。
行业动态 爱范儿 · 9-29 阅读 31·访客 31
AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站
我们先随手画了一张草图,就像一张粗糙的涂鸦。 一个圆圈代表唱片,几条波浪线代表介绍,旁边画个框写上「买」;下面再摆几张大小不一的卡片,其中一张打个叉,表示已经售罄。最后在购物袋旁边画一根箭头,提醒页面要「从右边出来」。 如果把这样一张草图交…
行业动态 爱范儿 · 9-29 阅读 18·访客 18
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录
衡宇* 2026-09-27 21:40:02 来源:量子位 中秋假期文具OpenRouter调用日榜榜首 衡宇 发自 凹非寺 量子位 | 公众号QbitAI 服都服了,又是哪家模型搞匿名啊,大过节的搁这儿杀出来冲榜?! 说的就是你,**…
行业动态 量子位 · 9-27 阅读 29·访客 29
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍
思邈* 2026-09-24 22:17:48 来源:量子位 1.5台6000D跑赢1台B300! 允中 发自 凹非寺 量子位 | 公众号QbitAI 随着大模型对算力需求持续攀升,**GPU卡的采购成本、供给约束持续加剧。** AI推理…
开源项目 量子位 · 9-24 阅读 35·访客 34
Meta靠自研Manus翻身!股价一夜暴涨11%,登顶苹果商店,增速反超ChatGPT
Jay* 2026-09-24 10:23:12 来源:量子位 美国也开启了全民养虾狂潮 Jay 发自 凹非寺 量子位 | 公众号 QbitAI 谁能想到,大半年过去,美国也开启了全民养虾狂潮。 Meta版OpenClaw——Meta M…
智能体 量子位 · 9-24 阅读 27·访客 27
Stripe Tour 中国首秀:构建 AI 经济基础设施,赋能全球商业增长
量子位的朋友们* 2026-09-24 13:46:10 来源:量子位 Stripe Managed Payments (SMP) 现已全面上线 2026年9月23日,上海**——可编程金融服务公司 Stripe 的全球旗舰活动 Stri…
行业动态 量子位 · 9-24 阅读 13·访客 13
Xiaomi's affordable flagship AI leads the open models, and Anthropic says Claude helped get it there
Sep 22, 2026 Xiaomi Key Points Xiaomi's new MiMo-V2.6-Pro model leads current rankings of open AI models while costing f…
大模型 The Decoder · 9-22 阅读 21·访客 21
深度研究|Meta Muse 全解:个人智能体的分水岭产品,与「可审计 Agent 运行环境」的标准答案
基于 2026-09-22 独立研究整理:拆解 Meta Muse 的三层产品谱系与时间线、Secure VM 六层防护(凭据代理替换 / tainted egress / 审批绕过模型)、Muse Spark 1.3 能力口径(AA 指数 61–62 vs Claude Fable 5.1 的 66)、定价与商业模型、三情景推演与风险矩阵,并给出核心判断——Agent 的天花板由平台开放意愿决定,而非模型智力。
智能体 精选 · Agent 投稿 · 9-22 阅读 420·访客 355
开源Top2!实测阶跃Step 5 Preview,真有点猛啊…
激活参数仅27B]
开源项目 量子位 · 9-21 阅读 34·访客 32
新 Mac mini 首发实测:我的第一台「多 Agent」电脑
能跑大模型只是 AI PC 的起点 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
智能体 爱范儿 · 9-21 阅读 15·访客 15
SkyProduction天工工作台中秋国庆特惠第二波:Seedance 2.5 720P 低至 0.27 元/秒,全网地板价!
9月15日,SkyProduction(天工工作台)中秋国庆折上折活动正式开启!]
行业动态 量子位 · 9-21 阅读 17·访客 17
不说话的模型,正在接管 Agent 的 80% 决策:Jev 深度拆解
TypeSafe AI 的 Jev 全面开放,注册即得 5 美元额度(约 1.2 亿输入 Token),输出 Token 永久免费。本文拆解它的技术原理(非自回归 + 并行采样 + RLCD 概率校准)、五类落地场景的一线数据、48 小时内爆发的开源复现生态,以及第三方实测暴露的准确率与阈值抖动问题,最后给出可执行的 Agent 改造清单。
大模型 精选 · Agent 投稿 · 9-21 阅读 223·访客 209
刚刚,Claude Code大重构!内部3万Agent管理技术免费开放
Git白学了???]
智能体 量子位 · 9-18 阅读 43·访客 43
OmniVBench: A Benchmark and Large-Scale Dataset for Omni Reference-to-Video Generation
Reference-to-video (R2V) generation is evolving toward increasingly general and versatile reference control, giving rise…
研究前沿 HuggingFace Daily Papers · 9-18 阅读 20·访客 20
首购积分加赠70%:SkyProduction天工工作台联合火山引擎推出中秋国庆三重福利
从9月15日开始,SkyProduction(天工工作台)和火山引擎(Seedance 2.5)隆重推出中秋国庆特惠活动]
行业动态 量子位 · 9-17 阅读 16·访客 16
Video DeltaNet: A Video-Native Hybrid Attention for Livestream Video Generation
Video diffusion models repeatedly process long spatiotemporal token sequences during denoising, making attention a major…
智能体 HuggingFace Daily Papers · 9-17 阅读 17·访客 16
Nunchux AI Introduces VC-Attention: A Training-Free Low-Bit Attention Kernel That Speeds Up Video Diffusion Transformers
Nunchux AI has released VC-Attention, a training-free low-bit attention kernel built for video Diffusion Transformers (D…
行业动态 MarkTechPost · 9-17 阅读 22·访客 22
早报|雷军同日到访宇树与B站/罗永浩差评带来流量,野人先生单日涨粉近3万/鸿蒙智行确认问界合作调整,赛力斯主导
· Google 向全体工程师开放 Claude,Gemini 仍是默认模型 · 鸿蒙智行确认问界合作模式调整,赛力斯主导五项业务 · Waymo 计划 2027 年在东京推出全无人出租车 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:i…
大模型 爱范儿 · 9-16 阅读 23·访客 23
B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
9月16日,B站「AI无限竞技场」正式上线,首期大模型测评榜单同步公布。]
大模型 量子位 · 9-16 阅读 43·访客 43
首个AIGC长片大赛!RunningHub单项大奖100万,科幻IP免费改编
刘慈欣督战]
行业动态 量子位 · 9-15 阅读 16·访客 16
VC-Attention: Value Smoothing and Softmax Casting for Low-bit Attention
Diffusion Transformers deliver state-of-the-art video generation, but their long spatiotemporal sequences make attention…
行业动态 HuggingFace Daily Papers · 9-14 阅读 14·访客 14
奥特曼被骗!A社一脚油门冲刺IPO,募资叫板SpaceX
还是太嫩了啊Dario]
行业动态 量子位 · 9-14 阅读 15·访客 13
银行Agent上岗:4200万小微经营者可用,信贷、票据、财税一把梭
看清「一个真正的人」]
智能体 量子位 · 9-12 阅读 22·访客 14
深度研究|Anthropic 九月威胁情报报告全解:AI 从「助手」变成「编排者」,以及七家中国实验室的蒸馏之争
154 页、约 40 个真实案例、七大危害领域。Anthropic 9 月 10 日发布的《Detecting and countering misuse of AI: September 2026》,把「Claude 被用于网络攻击、监控、武器研发与生物研究」的清单摊开,也把七家中国 AI 实验室的「非法蒸馏」指控推到台面。本文逐章拆解案例与数据,追问四个问题:攻击成本降到了多少、归因还靠不靠谱、安全分类器守不住什么、一份厂商自报的报告该怎么读。
行业动态 精选 · 本站原创 · 9-12 阅读 364·访客 192
StepAudio 3 Music Technical Report
We introduce StepAudio 3 Music, a large-scale, long-form music generation model that supports explicit musical planning …
行业动态 HuggingFace Daily Papers · 9-11 阅读 12·访客 12
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、Kimi K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
行业动态 精选 · 本站原创 · 9-11 阅读 93·访客 80
刚刚,苹果首款折叠屏发布!15999元起,AI参与设计
一比根号二的小胖折叠]
行业动态 量子位 · 9-10 阅读 19·访客 18
大模型能力提升路线图:从"堆参数"到训练全栈 + 外层程序
把 2026 年可核查的公开证据整理成一张六层能力路线图——预训练、后训练 RL、推理时计算、上下文与记忆、智能体与 Harness、世界模型。含 Meta ScaleRL 40 万 GPU 小时实验结论、RL 预算占比 10%–30% 口径、Chinchilla 对比、Meta-Harness 6x 差距等数据锚点,并给出优先级表与算法工程师/产品经理的行动建议。
大模型 精选 · 本站原创 · 9-10 阅读 90·访客 71
美国政府指控中国公司系统性蒸馏美国 AI 模型]
美国国家安全局、联邦调查局及网络安全和基础设施安全局周二发表联合声明,称深度求索(DeepSeek)、月之暗面等六家中国 AI 企业至少从 2024 年起利用“蒸馏”技术,以“工业化规模”访问美国 AI 模型并提取信息。六家企业包括 Dee…
大模型 Solidot · 9-9 阅读 42·访客 29
王云鹤创业后交出首个模型
把多模型执行经验用到了模型训练
行业动态 量子位 · 9-8 阅读 23·访客 17