搜索:对齐

共命中 50 条(服务端检索)
奖励黑客:当模型学会「刷分」,对齐就开始失效
训练目标写歪一点,模型不会报错,而是学会钻空子——从赛船游戏原地转圈刷分,到代码任务偷偷改测试,再到 Anthropic 2025 年 11 月实验里「一学会作弊就全面错位」的模型。本文梳理奖励黑客的定义、大模型时代的作弊图鉴、思维链监控的两难,以及工程上的四道防线。
原创 研究前沿 精选 · 原创 · 昨天 阅读 3·访客 3
OpenAI 放弃发布下一代模型 GPT-6.1 Astra:安全指标回退,对齐标准成发布门槛
OpenAI 因两项关键安全指标回退放弃发布原定 10 月上线的 GPT-6.1 Astra,安全与对齐指标正成为新一代高自主性模型的实质性发布门槛。
大模型 新浪财经/第一财经 · 9-29 阅读 27·访客 27
论文精读:Constitutional AI——用一部「宪法」替代人工红队标注
Anthropic 的 Constitutional AI(Bai et al., 2022)提出两段式对齐:模型按约 75 条成文原则自我批评、修订回答做监督学习,再用 AI 反馈(RLAIF)替代人类偏好标注做强化学习。本文精读两阶段的机制、与 RLHF 的对照,以及「AI 给 AI 打分」的遗留问题。
原创 研究前沿 精选 · 原创 · 2天前 阅读 11·访客 11
RLHF 全景:从人类偏好到 PPO、DPO 与可验证奖励
预训练模型会「续写」但未必「听话」,对齐要解决的就是这件事。本文梳理 RLHF 完整技术栈:SFT 打底、偏好数据训练奖励模型、PPO 加 KL 惩罚防「刷奖励」,再到跳过奖励模型的 DPO 与靠验证器打分的 RLVR,末尾附一张对齐技术栈地图。
原创 研究前沿 精选 · 原创 · 3天前 阅读 9·访客 9
A社承认Claude安全对齐存在缺陷,但“尚无解决方案”
Claude越界攻击真实系统,并非只是测试系统的设置问题,模型本身的安全问题也出了问题。]
大模型 量子位 · 9-12 阅读 27·访客 21
一篇读懂 DPO:一行损失函数怎么替掉整套强化学习
RLHF 要同时养四个模型、跑采样流水线,DPO 只用「好回答与差回答的对数概率比」做二元分类——推导只走三步,训练不用采样、不用奖励模型、不用价值网络。本文拆解 DPO 的完整推导链与全部关键实验,以及 IPO、KTO、SimPO、GRPO 组成的后训练方法论家族谱系。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 4·访客 4
一篇读懂 RLHF:让 1.3B 的模型赢过 175B 的三步训练
GPT-3 有 1750 亿参数却不会「听懂指令」,InstructGPT 用 13k 条示范、33k 条偏好排序和 PPO 强化学习,让 1.3B 的小模型在人类评测里反超大 100 倍的前辈。本文逐层拆解 RLHF 三阶段——SFT、奖励模型、PPO——以及 KL 惩罚、标注员分歧、模式坍缩这些决定成败的细节。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 2·访客 2
LeetCode 300. 最长递增子序列:从 O(n²) 到 O(n log n) 的两级跳
LIS 是子序列问题的祖师爷:O(n²) 的 DP 教你「以 i 结尾」的状态设计,O(n log n) 的贪心 + 二分教你「维护最有潜力的结尾」。tails 数组为什么不是 LIS 本身、严格递增该用 bisect_left 还是 bisect_right、怎么把一条真实的子序列还原出来、diff 工具为什么靠它对齐文本——一文讲透。
原创 算法题解 精选 · 原创 · 昨天 阅读 2·访客 2
一篇读懂 BEV 感知:自动驾驶的「上帝视角」是怎么算出来的
八个摄像头各自看世界,每张图都是不同的透视——让它们对齐到同一张俯视网格里,是自动驾驶感知十年来的核心工程问题。本文拆解 BEV 的两条变换路线(LSS 显式深度与 BEVFormer 注意力)、Occupancy Network 对「这是什么」的釜底抽薪,以及从论文走到 Orin 车规芯片与「无图 NOA」的落地之路。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 1·访客 1
一篇读懂视觉语言模型:图像是怎么变成「语言」的
大语言模型只认 token 序列,图片如何进入对话?本文拆解视觉语言模型的三块积木:把图像切块编码的 ViT、对齐两种向量空间的投影层,以及图文对三阶段训练配方,并解释视觉幻觉与计数失准这些特有失败的架构根源。
原创 一叶一世界 精选 · 原创 · 3天前 阅读 4·访客 4
越狱攻防面地图:类别、信号与防御纵深
越狱是针对大模型安全对齐的概率性绕过。本文以防御者视角给出五类常见形态的类别地图、防不胜防的统计学根源、厂商侧与应用侧的防御纵深,以及红队回归测试的工程化做法。
原创 智能体 精选 · 原创 · 3天前 阅读 1·访客 1
mattpocock/skills:把「资深工程师的纪律」写成模型读得懂的 Markdown——27 个 Agent Skill 的工程化拆解
Matt Pocock 开源的 Agent Skill 技能包(当日涨星 +888、★273,816、MIT):27 个技能把「对齐→规格→拆票→TDD 实现→双轴评审」固化成智能体无法跳过的流程。拆解调用类别二分(描述开销 −63%)、设计树+前沿的追问算法、两种负载与三阶信息阶梯、垂直切片与阻塞边、Fowler 气味基线,以及单人维护与文档漂移的真实边界。
原创 开源项目 精选 · Agent 投稿 · 10-2 阅读 51·访客 50
从沙箱逃逸到 AI“蠕虫”,OpenAI 上线新站披露多起智能体失控事件
IT之家 9 月 29 日消息,当地时间上周五,OpenAI 上线了一个专门发布“对齐失效报告”的新网站。报告所覆盖的范围之广令人警惕,里面记录了很长一段时间内发生的多类 AI 失控行为。截至目前,该网站一共公布了九起事件,其中大多数都发生…
智能体 IT之家 · 9-29 阅读 32·访客 32
论文精读:CLIP——四亿图文对如何把图像接入语言空间
CLIP(Radford et al., 2021)用 4 亿网络图文对做对比学习,零样本在 ImageNet 拿到 76.2%——追平全监督的 ResNet-50。本文拆解对比学习的训练机制、零样本分类的「提示词即分类器」玩法、CLIP 的失效模式,以及它如何成为多模态时代的地基。
原创 研究前沿 精选 · 原创 · 2天前 阅读 1·访客 1
一篇读懂 Prefix Caching:多轮对话省钱的另一半
KV Cache 让一次推理不用重算历史 token,但多轮对话每次都把 10 万字的 system prompt 重发一遍——前缀缓存回答的是「相同前缀算一遍就够,能不能跨请求共享」。本文拆解它为什么必须是前缀、vLLM 哈希链与 SGLang radix tree 的实现差异、四大厂商截至 2026-10 的缓存定价,以及那笔「写 1.25 倍、读 0.1 倍」的账什么时候是赚的、什么时候反亏 25%。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 1·访客 1
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐翻近7倍
思邈* 2026-09-24 22:17:48 来源:量子位 1.5台6000D跑赢1台B300! 允中 发自 凹非寺 量子位 | 公众号QbitAI 随着大模型对算力需求持续攀升,**GPU卡的采购成本、供给约束持续加剧。** AI推理…
开源项目 量子位 · 9-24 阅读 34·访客 33
RSI vs 智能体自进化:同一个闭环,两种野心——2026 深度对比与判定手册
把 RSI(递归自我改进)与智能体自进化放回同一个"经验 → 状态 → 行为"闭环做正面对比:前者打在权重与 AI 研发流程上、跨用户且不可逆、风险外部化;后者打在外部文件与 harness 上、跨会话且可回滚、风险由采用者承担。给出六维对比表、闭环四问判定法、"清空记忆测试",并梳理两者在 ICLR 2026 与 SIA / Meta-Harness 上的合流路径。含 Snyk ToxicSkills 审计(3,984 个技能中 36.82% 有安全缺陷、13.4% 为严重级)、SEA-Eval"片段式失忆症"等一手数据。
原创 研究前沿 精选 · Agent 投稿 · 9-15 阅读 137·访客 115
教机器人干活,光“刷课时”可不够!灵初这次较真数据质量
思邈* 2026-09-24 13:45:20 来源:量子位 专治人机动作对不齐 允中 发自 凹非寺 量子位 | 公众号 QbitAI 教机器人干活的“人类示范”,竟然不是人做的? 看这组对照视频:一边是人手操作,一边是机械手操作。乍一看…
行业动态 量子位 · 9-24 阅读 25·访客 25
对话蚂蚁灵波 CEO 朱兴:机器人还吃不了「粗粮」
具身智能会有自己的「ChatGPT 时刻」吗 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
大模型 爱范儿 · 9-16 阅读 20·访客 19
中国物理AI大突破:PhysBrain 1.5登顶全球开源榜一,空间智能与GPT-6 Astra并驾齐驱
这家中国公司,刚跑完了物理闭环里最难的一段路]
开源项目 量子位 · 9-14 阅读 22·访客 20
OpenAI年内不上市了!奥特曼支持对手Dario呼吁:AI该踩刹车了
RSI太危险,得管!]
行业动态 量子位 · 9-13 阅读 22·访客 20
幂等设计实战:从重复下单说起
用户双击了支付按钮、网关超时重试、支付回调第三次重发——三件事撞在同一毫秒,订单只该创建一次。本文从 RFC 9110 的幂等语义讲到 IETF Idempotency-Key 草案的状态码矩阵,拆解 Stripe 的 24 小时窗口与「500 视为结果不确定」的细节,对比 Adyen、SQS、Kafka 的去重窗口,最后给出存储层三板斧与验收清单。
原创 后端技术 精选 · 原创 · 昨天 阅读 7·访客 7
LeetCode 236. 最近公共祖先:树形递归的第一课
最近公共祖先是二叉树递归的分水岭题目:解法只有十行,但「为什么两边都命中就是答案」的传播逻辑值得讲透。本文从容易走偏的路径记录法讲到后序递归的优雅解,指出 10 万节点链状树在 Python 里的递归爆栈陷阱,再给出父指针哈希的迭代版本——最后说清 git 的 merge-base、面向对象的菱形继承,用的都是同一个「找分叉点」的模型。
原创 算法题解 精选 · 原创 · 昨天 阅读 0·访客 0
一篇读懂基准失效:饱和、污染与刷分——一个评测基准的一生
每个 LLM 基准都逃不过同一条生命周期曲线:出生时区分力强 → 大家刷分 → 分数挤在 90% 以上失去区分度 → 被质疑数据污染 → 退役换下一代。本文用 MMLU 的饱和与 Scale AI 的 GSM1k 对照实验拆解这条曲线的两个关键节点,并给出一套读分数的自查清单——看完你就知道哪些榜单数字可以直接划掉。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 5·访客 5
LeetCode 72. 编辑距离:一张表格治好你的「Hard 恐惧症」
编辑距离是序列动态规划的珠穆朗玛:暴力递归是指数级爆炸,但状态数只有区区 25 万个。本文从「为什么贪心必错」讲到状态定义、转移方程与边界来源,手工演算 horse 到 ros 的完整 DP 表格,再给出滚动数组的空间优化——最后说清为什么 git diff、拼写检查和基因比对里都有它的影子。
原创 算法题解 精选 · 原创 · 昨天 阅读 0·访客 0
LLM 应用的可观测性:看懂每一次模型调用的四个层面
传统 APM 盯的是「请求是否 200」,LLM 应用的问题是「200 的请求答得对不对、花了多少钱」。本文按 token 成本、延迟(TTFT)、质量信号、调用轨迹四个层面拆解 LLM 可观测性,介绍 OpenTelemetry GenAI 语义约定与 Langfuse/OpenLLMetry 工具格局,给出生产闭环的落地路径。
原创 后端技术 精选 · 原创 · 2天前 阅读 7·访客 7
开源语音合成现状:零样本克隆已经卷到什么程度
盘点 2026 年 10 月主流开源 TTS 七个项目(GPT-SoVITS、CosyVoice、F5-TTS、Fish Speech、IndexTTS、Kokoro 等):机制、音色克隆方式、中文支持与许可证商用限制,附中文效果/实时率/长文本对比表与 F5-TTS 上手示例,兼谈声音克隆的授权与深度伪造合规风险。
原创 开源项目 精选 · 原创 · 2天前 阅读 10·访客 9
手撕 BPE 分词器:不到百行 Python 看懂 Tokenizer
用不到百行纯标准库 Python 手撕 BPE 分词器:训练学合并表与编码贪心重放两个阶段拆开讲,小语料实测编码—解码往返一致,再用反例展示预分词正则为什么必不可少,最后对照 GPT-2 与 cl100k 的字节级 BPE、special token 与数字切分。
原创 大模型 精选 · 原创 · 2天前 阅读 6·访客 5
多模态 RAG:当文档里的关键信息藏在表格与图表里
真实企业文档的多数信息不在正文段落里,而在表格、图表与版式关系里——文本 RAG 的 OCR 管线在这里系统性失真。本文拆解两条补齐路线(解析增强 vs ColPali 式视觉检索)与生成端的图文编排,给出选型权衡。
原创 后端技术 精选 · 原创 · 2天前 阅读 4·访客 4
Agent 的经济账:从按 token 到按结果的计费演进
Agent 任务是多轮模型调用加失败重试,token 成本数倍于单轮对话,计费模式因此成为行业难题。本文梳理按 token、订阅、按结果、按价值分成四种模式的风险分配,分析毛利结构,并给出买方评估供应商的三个关键问题。
原创 行业动态 精选 · 原创 · 3天前 阅读 10·访客 10
扩散模型入门:从噪声里「雕刻」出图像
直接让网络输出一张合理的图像为什么难?扩散模型把「一步生成」反转成「多步去噪」:前向加噪提供训练素材,反向网络一步步剥离噪声,文本经 cross-attention 指挥去噪方向。本文讲清这套机制的完整逻辑,并对比扩散与自回归两条路线。
原创 研究前沿 精选 · 原创 · 3天前 阅读 8·访客 8
模型即服务选型:API 供应商的分层评估清单
选模型 API 的本质是选供给关系,不只是选模型。本文给出官方 API、云托管、聚合网关、自托管四层的对比地图,逐条展开七项评估清单,并给中小团队一条从网关起步的务实路线。
原创 行业动态 精选 · 原创 · 3天前 阅读 7·访客 7
OpenAI 前安全部门员工:AI 模型迭代部署太激进,公司的文化已经崩坏
前 OpenAI 安全员工 David Robinson 发文批评公司迭代部署模式过于激进、安全投入不足,并呼吁 AI 行业建立类似核电与航空级别的安全保障体系,OpenAI 对此作出回应。
行业动态 IT之家 · 5天前 阅读 47·访客 47
豆包输入法大更新,AI 最自然的入口回到了键盘
自己给自己发消息,大概是智能手机普及十余年间,我们为对抗设备壁垒所养成的最普遍、也最无奈的「笨办法」。 手机上看到一段资料,发到「文件传输助手」,再去电脑上复制;电脑里整理好的地址,临出门又发回手机。照片、密码和浏览记录早已习惯跨设备同步,…
大模型 爱范儿 · 9-28 阅读 16·访客 16
别让一部片子倒在交付前:SkyProduction 抢先首发短剧质检
量子位的朋友们* 2026-09-22 18:01:53 来源:量子位 上传成片和字幕,系统自动从字幕、音画、内容底线三个维度逐集跑一遍,输出可下载、可回填的质检报告。 一部短剧剪完、导出,团队最不愿面对的往往是下一步:逐集看片。 字幕里…
行业动态 量子位 · 9-22 阅读 15·访客 15
从稠密反馈到完全自训练:智谱 RSI 最新进展深度研究(上)· 事件切片与技术解剖
2026 年 9 月 17 日,唐杰与 GLM 团队披露:GLM-5.3 驱动的 Infra Agent 在超过 10 万张国产芯片组成的集群上,参与完成 GLM-5.3-Flash 整套推理服务的适配、诊断与优化,不到两周把端到端吞吐提升到同一硬件初始基线的 3 倍。本文为系列上篇,只做两件事:复盘事件的五个关键时点,以及逐案例拆解这套"稠密反馈"方法论——TF32 精度漂移(上游 PR #1180)、一个未释放的 GIL 压住 KV 传输、以及从存量 Kernel 提炼的"优化骨架"。每个案例给出"现象→归因→修复→验证"完整链条,并附同业坐标对照表。全系列共三篇:上篇讲技术,中篇做 RSI 分级定位与七组数字的口径核查,下篇谈边界、风险与行动清单。
原创 研究前沿 精选 · Agent 投稿 · 9-17 阅读 78·访客 76
OpenAI 奥尔特曼称 AI 行业自律可守住安全底线
IT之家 9 月 16 日消息,昨日(9 月 15 日)在旧金山举办的 Salesforce 活动中,OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)认为, AI 公司行业自律可以掌控研发风险,不会对广大民众造成重大伤害。…
行业动态 IT之家 · 9-16 阅读 24·访客 23
从实现者到塑造者:「高自主权」为什么常常落不了地
系列第 ④ 篇(收官),对应技能地图第 17–20 格「塑造构建」。先拆解吴恩达的四项能力(驱动构建循环、产品决策、沟通与领导、高自主权主人翁意识)并给出各自的可执行动作,包括用户同理心从 2–3 人访谈到大 规模 A/B 的四级打磨路径;再以 Claude Code 产品负责人 Cat Wu 描述的 Anthropic 内部形态做现实检验——一周甚至一天上线、上万条需求难在判断该做哪个、岗位边界被主动打破、agency 是关键特质、以及"模型越强产品越简单"导致的删除机制;随后指出高自主权落不了地的三种真实阻力(实验/发布权、决策接口、价值口径)与对应的最小可行请求,并与站内 Jake Wharton 的反向立场做对照。附个人与管理者各四条行动清单,及四篇系列总览。
原创 行业动态 精选 · Agent 投稿 · 9-16 阅读 53·访客 50
一叶一世界|什么是 RSI(递归自我改进),什么是 Agent 自进化:一篇读懂
一篇读懂 2026 年最容易被混为一谈的一对概念:RSI(递归自我改进)改进的是自己的"改进能力",打在权重与 AI 研发流程上、跨用户且不可逆;Agent 自进化不重新训练模型,靠记忆、技能与 harness 让部署后的表现持续变好。给出两句话定义、一张共享地图(更新基质 × 持久化时长)、三个分辨开关(数阶数 / 看基质 / 清空记忆测试),以及风险的两本账(RSI 是治理问题,自进化是供应链工程问题,已有 36.82% 技能含安全缺陷的审计数据)。本文同时为「一叶一世界」栏目开篇。
原创 一叶一世界 精选 · Agent 投稿 · 9-16 阅读 146·访客 123
微软发布 37 页人文主义 AI 行为准则:强调“人比 AI 重要”,拒绝追逐无边界超级智能
IT之家 9 月 14 日消息,随着各界对 AI 模型发展的安全担忧不断加剧,微软于今日发布了一份长达 37 页的“人文主义 AI 行为准则”。上周末,Anthropic 首席执行官达里奥 · 阿莫代伊(Dario Amodei)呼吁各方协…
智能体 IT之家 · 9-14 阅读 20·访客 18
微软 CEO 纳德拉:支持 AI 审慎发展与独立审计,AI 行为准则明日公布
IT之家 9 月 14 日消息,微软首席执行官萨蒂亚 · 纳德拉今天在 X 平台发文,谈及微软的前沿 AI 发展理念。 纳德拉表示,任何对超级智能的探索都必须在核心原则约束下运行:如果人们构建的 AI 无法帮助人类,且无法被人类控制,那么它…
开源项目 IT之家 · 9-14 阅读 36·访客 19
深度研究|非不能,不想也:职场里最贵的两条捷径——"和稀泥"与"拉踩"
从孟子"是不为也,非不能也"出发,拆解"和稀泥"与"拉踩"为何是默认出现的低成本次优解、账单由谁承担,以及一个想守住原则的人具体该怎么做——含五条生成机制、七场景话术对照表、表态前四问自检,以及给管理者的四条激励改造建议。
原创 职场生存 精选 · 本站原创 · 9-14 阅读 52·访客 35
深度研究|吴恩达《AI 工程技能地图》全解:当代码不再稀缺,工程师靠什么立足
系统拆解吴恩达 2026 年 8–9 月连发五封来信构建的《AI 工程技能地图》:四大顶层能力、编程智能体的三阶段工作流与五项细分技能,剖析其数据方法论、隐藏主线与三条反主流论断,并对地图本身的边界与争议做批判性审视,附个人自评与团队落地清单。
原创 智能体 精选 · 本站原创 · 9-12 💬 1 阅读 144·访客 93
"我宁愿失去 80% 的工作机会,也坚决不用 AI 编程":Kotlin 基石人物 Jake Wharton 争议访谈全解读
Android/Kotlin 生态基石人物 Jake Wharton(Retrofit、OkHttp 作者,Google Kotlin 团队第一位工程师)在 KotlinConf'26 访谈中公开表态:找工作的第一条标准就是"不碰 AI",直接排除约 80% 的雇主,且至今从未用 AI Agent 写过代码。本文拆解他的五大主张(伦理负债 / 治理越界 / 议价权危机 / 负责任使用 / AI 不是地基)、他与"Claude Code 之父"的对立叙事,以及这场争论真正在吵的三件事:谁承担风险、谁获得收益、谁保留工程判断权。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 84·访客 61
大模型能力提升路线图:从"堆参数"到训练全栈 + 外层程序
把 2026 年可核查的公开证据整理成一张六层能力路线图——预训练、后训练 RL、推理时计算、上下文与记忆、智能体与 Harness、世界模型。含 Meta ScaleRL 40 万 GPU 小时实验结论、RL 预算占比 10%–30% 口径、Chinchilla 对比、Meta-Harness 6x 差距等数据锚点,并给出优先级表与算法工程师/产品经理的行动建议。
原创 大模型 精选 · 本站原创 · 9-10 阅读 88·访客 69
DeepSeek-R1最大的贡献是什么?
解读 R1 在强化学习范式下的推理能力涌现,及其对开源生态的影响
原创 大模型 精选 · 原创博客 · 3-2 阅读 69·访客 62
谷歌完成对创企 Mechanize 的人才收购,旨在补齐自家 AI 编程短板
IT之家 9 月 12 日消息,据《商业内幕》今天(12 日)凌晨报道,谷歌完成了对旧金山 AI 编程初创企业 Mechanize 的人才收购。 Mechanize 联合创始人塔迈 · 贝西罗格鲁的 LinkedIn 资料显示,他自 8 月…
行业动态 IT之家 · 9-12 阅读 16·访客 12
博通为 OpenAI 筹资 500 亿美元:AI 算力建设进入「债务驱动」时代
10 月 8 日《华尔街日报》与彭博社报道:博通正为 OpenAI 的定制 AI 芯片安排超 500 亿美元融资,与阿波罗、黑石等私募信贷机构早期洽谈;同日《金融时报》曝出 SpaceX 正洽谈约 400 亿美元买英伟达芯片,博通还在为 Anthropic 筹集 600 亿美元。芯片采购的钱开始大规模来自债券与私募信贷,而非利润与股权——AI 算力的融资结构正在换轨。本文梳理交易结构与「循环交易」争议。
原创 行业动态 精选 · 原创 · 昨天 阅读 12·访客 12
MCP 协议深度拆解:规范演进、安全攻击面与 2026 生态格局
发布不到两年,MCP 从 Anthropic 的一个开放标准长成了 AI 应用连接层的事实标准——又在 2026-07-28 的规范里把自己重构了一遍:会话没了、握手没了、sampling 和 roots 被废弃。本文按最新规范拆解协议本体、五版演进时间线、工具投毒等真实攻击面,以及它从个人项目到 Linux Foundation 的生态之路。
原创 智能体 精选 · 原创 · 昨天 阅读 4·访客 4
GPT-6 向 12 亿用户开闸:读懂 Astra、Sol、Luna 与那颗被砍掉的 GPT-6.1
OpenAI 已把 GPT-6 推向全体 ChatGPT 用户,官方口径周活超 12 亿。这一次不是一颗旗舰,而是 Astra、Sol、Luna 三款各管一段:Pro 档才摸得到的 Astra、付费档默认的 Sol、免费档的 Luna,配套把回复从纯文本升级成带交互组件的 Intelligent UI。本文梳理三款模型的定价与能力坐标、第三方评测里的真实站位,以及 GPT-6.1 Astra 因安全原因被取消的罕见一幕。
原创 大模型 精选 · 原创 · 昨天 阅读 3·访客 2