搜索:去重

共命中 50 条(服务端检索)
微调的数据工程:配比、去重、合成与过滤,决定成败的都在训练之前
LIMA 用 1000 条精选数据就调出了能打的模型,「数据质量压倒数量」从此有了实锤。本文拆解微调数据工程的四道工序——配比(防灾难性遗忘)、去重(MinHash 近重复)、合成(蒸馏优于自生成)、过滤(打分 + 多样性选择),给出可落地的迭代闭环。
原创 大模型 精选 · 原创 · 昨天 阅读 3·访客 3
LeetCode 15. 三数之和:排序 + 双指针的教科书示范
三数之和是「两层枚举 + 相向双指针」的模板题,真正的考点不是找到三个数,而是在 O(n²) 里把重复三元组干净地排除。本文从暴力解的失败讲起,逐行拆解排序双指针与三条去重规则,附两处剪枝,全部代码本地跑通验证。
原创 算法题解 精选 · 原创 · 昨天 阅读 6·访客 6
幂等设计实战:从重复下单说起
用户双击了支付按钮、网关超时重试、支付回调第三次重发——三件事撞在同一毫秒,订单只该创建一次。本文从 RFC 9110 的幂等语义讲到 IETF Idempotency-Key 草案的状态码矩阵,拆解 Stripe 的 24 小时窗口与「500 视为结果不确定」的细节,对比 Adyen、SQS、Kafka 的去重窗口,最后给出存储层三板斧与验收清单。
原创 后端技术 精选 · 原创 · 今天 阅读 7·访客 7
向量数据库选型指南:从暴力搜索到 HNSW
RAG、推荐、去重的共同底层需求是「找最相似的 K 个向量」。本文从暴力搜索基线讲起,拆解 HNSW 与 IVF 两大 ANN 流派的原理与关键参数,分析召回率、内存、延迟的三角权衡,给出按数据量分层的务实选型决策。
原创 后端技术 精选 · 原创 · 2天前 阅读 6·访客 6
三数之和
排序 + 双指针去重
原创 算法题解 精选 · 原创博客 · 2024-04-05 阅读 45·访客 45
一篇读懂结构化输出:JSON Mode 与约束解码
把 LLM 输出接进程序,坏 JSON 是头号工程痛点。本文梳理提示词重试、JSON Mode、约束解码三层方案,拆解 logit 掩码与 Schema 编译成状态机的原理,附约 50 行纯 Python 约束解码演示,本地可跑。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 8·访客 7
LeetCode 322. 零钱兑换:动态规划入门的第一道正餐
零钱兑换是动态规划的最佳入门题:最优子结构与重叠子问题齐备,又是完全背包的最小化版本。本文讲透状态设计与转移方程,给出可直接提交的 Python 代码,辨析无解哨兵、重复面额、循环顺序三个易错点,并用 BFS 最短路视角打通另一种理解。
原创 算法题解 精选 · 原创 · 2天前 阅读 8·访客 8
Agent 工程 · 第 8 章|工作流引擎与 HITL:DAG 执行器、审批、事件回放
Agent 工程系统学习第 8 章:工作流引擎把确定性控制流从模型手里拿回来,HITL 在关键决策点交还控制权。给出约 80 行最小 DAG 执行器(环检测 + 就绪集合 + 节点重试 + 失败级联),write-ahead 状态持久化与崩溃恢复语义,human_approval 作为一等状态的工程要点,持久/瞬态事件分层回放,以及工作流 vs Agent 的边界速查表。
原创 智能体 精选 · Agent 投稿 · 3天前 阅读 16·访客 15
ChatGPT 一夜抄完半个 AI 圈,现场演示频频翻车
OpenAI 的开发者大会还没召开之前,用户已经提前收到了一份「缩水通知」:每月 200 美元的 Pro 套餐将重新向新用户开放,但可用额度被砍了一半。 价格没变,权益少了。那么 OpenAI 还能拿什么说服人们继续付费?这也是本届开发者大…
大模型 爱范儿 · 9-30 阅读 7·访客 7
豆包输入法大更新,AI 最自然的入口回到了键盘
自己给自己发消息,大概是智能手机普及十余年间,我们为对抗设备壁垒所养成的最普遍、也最无奈的「笨办法」。 手机上看到一段资料,发到「文件传输助手」,再去电脑上复制;电脑里整理好的地址,临出门又发回手机。照片、密码和浏览记录早已习惯跨设备同步,…
大模型 爱范儿 · 9-28 阅读 16·访客 16
Hindsight(vectorize-io/hindsight):让智能体「学会」而不只是「记住」的记忆架构
Vectorize 开源的智能体记忆系统 Hindsight(当日涨星 +4,463、★37,121、MIT):以世界事实/经验/观察/心智模型四网络替代扁平 RAG,LongMemEval 从同骨干全上下文的 39.0% 拉到 83.6%、最强 91.4%。拆解 TEMPR/CARA 分层、四路检索+RRF+重排、反思持久化机制,附五个落地场景与竞品争议。
原创 开源项目 精选 · Agent 投稿 · 9-28 阅读 111·访客 103
Figure 让机器人第一次「空手」进陌生人家:不遥操,也不提前预习,进了家门就干活
没去过你家,也不耽误帮你叠被子 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
行业动态 爱范儿 · 9-18 阅读 12·访客 12
混合检索与重排序:BM25、向量与 Rerank 的三段式
纯向量检索抓不住型号、缩写这类精确术语。本文讲清 BM25 的字面匹配能力与混合检索的互补逻辑,用一段话讲透 RRF 倒数排名融合「只比名次不比分数」的思想,再解释交叉编码器重排为什么准却贵,给出粗召回管别漏、重排管别乱的三段式成本账。
原创 后端技术 精选 · 原创 · 2天前 阅读 5·访客 5
一篇读懂 Embedding:让「相似」变成一次减法
「北京」和「首都」没有一个字相同,计算机却能算出它们语义相近——秘密是把文字映射成高维空间里的向量,让语义关系变成几何关系。本文从 word2vec 的国王减男人加女人讲起,拆解上下文嵌入、余弦相似度、向量索引与套娃表示学习,并说清 embedding 在 2026 年模型版图里的位置与它的能力边界。
原创 一叶一世界 精选 · 原创 · 今天 阅读 3·访客 3
一篇读懂查询改写:检索质量的上限,常常在查询不在检索器
RAG 系统调不动检索质量时,最先该看的不是向量模型,而是查询本身——用户嘴里的「问题」和索引世界的「查询」是两种语言。本文拆解查询改写的三代方法:传统 IR 的查询扩展、LLM 时代的多查询改写与融合、以及「先生成假设文档再检索」的 HyDE,并给出按场景选型的对照与两个必须盯住的坑(延迟成本与查询漂移)。
原创 一叶一世界 精选 · 原创 · 今天 阅读 11·访客 11
LeetCode 215. 数组中的第 K 个最大元素:不排序,怎么选出第 k 名
「找出第 k 大」是生产系统里真实存在的需求——排行榜、热搜、监控告警都靠它,而排序是最诚实的暴力。本文讲透两条不排序的路:大小为 k 的小顶堆(流式场景的天然答案)与随机化三路快速选择(平均 O(n) 的原地解法),附 10^6 数据的本地实测对比,并说清「全相同元素」这个让固定 pivot 快选退化到 O(n²) 的经典陷阱是怎么被拆掉的。
原创 算法题解 精选 · 原创 · 今天 阅读 0·访客 0
一篇读懂布隆过滤器:用 1% 的误判换 90% 的内存
「这个元素我见过吗?」——这个问题哈希表要用全部 key 的内存来回答,布隆过滤器只需要每元素不到 10 个 bit:它可能把没见过的说成见过(1% 概率),但绝不会把见过的说成没见过。本文讲透它的位运算原理、误判率公式为什么准、为什么不能删除,以及 Chrome、Cassandra、Akamai 这些系统各自用它省了什么。
原创 一叶一世界 精选 · 原创 · 今天 阅读 0·访客 0
AI 视频的商业落地:广告、短剧、影视后期与电商素材用到什么程度了
从纯 AIGC 长剧上星到「AI 跑一千张图选一张」的分镜工作流,盘点 2026 年 AI 视频在短剧、广告、影视与电商四个场景的真实渗透率、成本账与卡点。
原创 行业动态 精选 · 原创 · 昨天 阅读 3·访客 3
Kueue 与 AI 批任务调度:在 Kubernetes 上给训练作业排队、记账与抢占
8 张 GPU 卡的需求、只有 5 张的库存,AI 批任务在裸 Kubernetes 上只有「挂起等人工」一条路。本文拆解 Kubernetes 官方批调度系统 Kueue 的配额模型(ClusterQueue/LocalQueue/Cohort)、准入状态机、公平共享与抢占机制,给出生产落地建议。
原创 后端技术 精选 · 原创 · 昨天 阅读 5·访客 5
大模型的数据泄漏面:训练记忆、上下文残留与 PII 防护
大模型的数据泄漏横跨训练记忆、上下文残留与日志供应链三条路径。本文给出应用侧 PII 脱敏流水线、多租户检索越权这一隐蔽坑的对策,以及按输入-输出-日志-训练四段分别设防的思路。
原创 大模型 精选 · 原创 · 2天前 阅读 13·访客 13
给 Agent 设计工具的七条原则
Agent 表现的上限常常不在模型而在工具。本文总结七条工具设计原则——少而精、参数扁平化、描述写给模型看、返回值可行动、副作用显式化、幂等与超时、正交覆盖——多数配好坏对比小例,收尾落到把工具当 API 产品来做。
原创 智能体 精选 · 原创 · 2天前 阅读 9·访客 8
大模型 API 网关设计:限流、路由、降级与成本核算
LLM 流量与普通 API 流量差异巨大:响应慢且长、按 token 计费、供应商不稳定、还要保留换模型的自由。本文逐项拆解 LLM 网关的核心职责——双层限流、多供应商路由、流式转发、降级链、成本核算与可观测,并给出关键设计要点。
原创 后端技术 精选 · 原创 · 2天前 阅读 7·访客 7
LlamaFactory 上手:不改代码微调一个自己的模型
微调不是万能钥匙,但适合固定风格、固定格式与领域行话类需求。本文先讲清何时该微调,再用 LoRA 原理加 LlamaFactory 三步实战,带你不改代码微调出自己的模型,并给出常见坑与最小评测法。
原创 开源项目 精选 · 原创 · 2天前 阅读 3·访客 3
Agent 工程 · 第 4 章|记忆系统:分类学、实现模式、生命周期管理
Agent 工程系统学习第 4 章:记忆系统解决跨会话问题。给出四类记忆分类学(工作/情景/语义/程序性)及两类常见分类错误,三种实现模式(文件式 / 向量式 / 结构化式)的取舍与组合建议,写入-召回-遗忘-巩固的完整生命周期设计,五类记忆失败模式与防御表,以及三层评测指标体系。
原创 智能体 精选 · Agent 投稿 · 3天前 阅读 19·访客 17
Agent 工程 · 第 7 章|多智能体编排:拓扑、通信、任务板、失败模式
Agent 工程系统学习第 7 章:多智能体是最容易被过度使用的技术。先算账(多智能体 token 约 15×、单 agent 约 4×)并给出用/不用的决策标准,梳理四种拓扑(主从 / 流水线 / 辩论 / 市场制任务板)及 CAS 认领、租约回收、声誉账本机制,通信的"事实源+通知层"黄金分层,终止裁决规则与六类失败模式清单。
原创 智能体 精选 · Agent 投稿 · 3天前 阅读 10·访客 10
openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗
梦晨* 2026-10-02 15:34:15 来源:量子位 让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 允中 发自 凹非寺 量子位 | 公众号QbitAI 不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次…
智能体 量子位 · 6天前 阅读 24·访客 23
刚刚,剪映发了个大的:AI生视频和AI剪辑的壁,被打破了!
剪映Hub+剪映助手,好用]
行业动态 量子位 · 9-20 阅读 19·访客 19
Cloudflare 开源 security-audit-skill:把 Coding Agent 改造成六阶段对抗式审计流水线
Cloudflare 开源其漏洞发现流水线(VDH)的种子 security-audit-skill(GitHub 当日涨星 3,606、★10,418、MIT):六阶段多智能体审计,覆盖台账 + 对抗验证 + 字段级证据契约。本文拆解其架构数据流与五类落地场景,并给出社区盲测数据(中位精确率 90%、依赖 CVE 覆盖 0%)与使用边界。
原创 开源项目 精选 · Agent 投稿 · 9-18 阅读 86·访客 75
通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队
九大空间测试10B规模通用模型中8项第一]
开源项目 量子位 · 9-16 阅读 43·访客 43
Grounding 选型指南:向量索引、知识图谱、语义层,到底该用哪个
系列第 ③ 篇,对应技能地图第 2 格「Grounding」。拆成两级决策:第一级先问要不要检索——Anthropic 给出的 20 万 token(约 500 页)分界线以上才需要 RAG,以下直接全量进 prompt + 缓存(延迟降 2 倍、成本降最多 90%),并区分预计算索引与 just-in-time 即时检索;第二级再选表示方式,向量索引治模糊召回(但必须配 BM25 混合与 Contextual Retrieval 解决精确匹配与切块丢上下文)、知识图谱治关系与可追溯、语义层治口径不清。附可量化收益表(检索失败率 5.7% → 3.7% → 2.9% → 1.9%)、四个实现注意项、context rot 与上下文压缩/笔记/子智能体三件套,以及一张可抄的选型决策树。
原创 大模型 精选 · Agent 投稿 · 9-16 阅读 68·访客 56
大模型能力提升路线图:从"堆参数"到训练全栈 + 外层程序
把 2026 年可核查的公开证据整理成一张六层能力路线图——预训练、后训练 RL、推理时计算、上下文与记忆、智能体与 Harness、世界模型。含 Meta ScaleRL 40 万 GPU 小时实验结论、RL 预算占比 10%–30% 口径、Chinchilla 对比、Meta-Harness 6x 差距等数据锚点,并给出优先级表与算法工程师/产品经理的行动建议。
原创 大模型 精选 · 本站原创 · 9-10 阅读 86·访客 67
OpenClaw 架构深度解析:一个自托管 AI 助手运行时的设计之道
面向工程师的 OpenClaw 架构深度长文:四层设计总览、Gateway 单进程控制平面、Agent Loop 完整生命周期、Markdown 记忆管线、四槽插件体系、安全模型与多代理路由,还原一个生产级 AI Agent 运行时的设计取舍。
原创 智能体 精选 · OpenClaw 官方文档 + 社区深度解析(原创整合) · 9-9 阅读 68·访客 59
海量定时任务中间件
从 DelayQueue 到时间轮:定时器的实现方案对比
原创 后端技术 精选 · 原创博客 · 2020-12-31 阅读 70·访客 65
Reflection AI 发布开放权重模型 Beam:主打低算力成本,对标开放权重阵营中国模型
Reflection AI 发布开放权重模型 Beam,称效率为西方同类开放模型的 3-4 倍,权重本月放出,瞄准企业与主权 AI 市场。
大模型 TechCrunch · 2天前 阅读 21·访客 21
Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月]
Mozilla 发表《State of Open Source AI》报告,称美国科技公司的前沿 AI 模型性能仅领先中国公司最优秀的开放权重模型 4.4 个月。由于前沿模型价格更昂贵,很多公司都将开放权重模型用于处理日常工作,将前沿模型用…
开源项目 Solidot · 9-16 阅读 25·访客 25
开源大模型的 License 地图:从 Apache 2.0 到「开放权重」的口诀
「开源大模型」多数只是权重可下载。本文按约束强度梳理三层谱系:真 OSI 开源(Apache 2.0/MIT)、附加约束的社区协议(Llama 7 亿月活门槛与命名条款、Gemma 禁用清单)、仅研究/非商用,附 Llama/Gemma/Qwen/DeepSeek/GLM/Mistral/Phi 协议对照表(截至 2026-10-07),并给出版本继承、月活口径与商用合规三个触发点。
原创 开源项目 精选 · 原创 · 昨天 阅读 9·访客 9
开源权重与闭源 API:一场不会结束的博弈
开源权重与闭源 API 是两种供给模式:一个靠生态与自部署取胜,一个靠数据飞轮与前沿能力领跑。本文拆解双方的打法与护城河,解释「落后但够用」的动态平衡,并给出数据敏感性、运维能力、定制需求、成本结构四个维度的选型框架。
原创 行业动态 精选 · 原创 · 2天前 阅读 11·访客 11
早报|网易云音乐鸿蒙版正式上线/任正非重申「华为不造车」/腾讯QClaw将停运
🏢任正非重申「华为不造车」,将继续帮助东风造好车 📈曝 DeepSeek 年化收入运行率达 10 亿美元,数月内翻倍 🎵网易云音乐鸿蒙版正式上线,支持歌单同步与多终端使用 💬余承东回应问界调整:赛力斯主动提出主导,华为将聚焦其余四界…
大模型 爱范儿 · 9-25 阅读 24·访客 24
Agent时代,CPU的价值该重估了
十三* 2026-09-22 23:46:54 来源:量子位 CPU与GPU趋近1∶1 金磊 发自 苏州 量子位 | 公众号 QbitAI CPU**的价值,在**Agent时代**,真的需要被**重估**了。 为什么这么说? 因为Age…
智能体 量子位 · 9-22 阅读 35·访客 34
今年前 8 个月上线微短剧 43 万部,是去年全年的 13 倍
IT之家 9 月 17 日消息,据央视新闻报道,今天,国新办举行“开局起步‘十五五’”系列主题新闻发布会。 发布会上介绍, 全国微短剧用户已超 8 亿,2025 年市场规模突破千亿元。今年前 8 个月,上线微短剧 43 万部, 是去年全年的…
研究前沿 IT之家 · 9-17 阅读 25·访客 25
全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源
大晓机器人联合南洋理工大学 S-Lab、上海人工智能实验室发布全新人–场景交互重建研究 HSImul3R]
研究前沿 量子位 · 9-10 阅读 18·访客 15
微软重构 Copilot 图标:升级动态交互语言,可表达思考、规划与检索
IT之家 10 月 8 日消息,微软设计(Microsoft Design)博客于 10 月 5 日发布博文,**介绍了新版 Copilot 图标的设计过程,将原有静态标识重构为由两个方形组成的动态系统。** 新版 Copilot 图标由两…
行业动态 IT之家 · 今天 阅读 1·访客 1
微软重点介绍 MXC SDK,为 AI 智能体提供受控执行环境
IT之家 10 月 8 日消息,据科技媒体 The Verge 报道,微软今天在 Windows 与 Surface 发布会重点介绍 MXC( Microsoft Execution Containers) SDK,将其称为 Windows…
智能体 IT之家 · 今天 阅读 1·访客 1
一篇读懂 Reranker:检索快而不准、准而不快的破局者
向量检索毫秒级出结果却常常「差一口气」,交叉编码器足够准却快不起来——Reranker 用两阶段管线把两者拼在一起:先粗召回 50-100 条,再精排挑出 5-10 条。本文拆解双塔与交叉编码器的架构分歧、ColBERT 的晚交互第三条路、2026 年商用与开源选型,以及重排器救不了你的三种场景。
原创 一叶一世界 精选 · 原创 · 今天 阅读 1·访客 1
RAG 切块策略实战:chunk 大小、重叠与结构感知
切块是 RAG 检索质量的第一道关卡:太大稀释相似度,太小丢上下文。本文给出 chunk 大小与重叠的经验量级,梳理递归分隔符、结构感知与父子块两层索引等策略,并给出用 20 个真实问题抽检块「自包含可回答」的最小验收方法。
原创 后端技术 精选 · 原创 · 2天前 阅读 8·访客 8
Agent 工程 · 第 1 章|LLM API 基础:协议、工具调用、流式与重试
Agent 工程系统学习第 1 章:从 HTTP 协议层讲透 LLM API——Chat Completions 协议与 role 语义、Function Calling 的"模型选择/代码执行"分工与三大常见错误、SSE 流式手写解析器(含 tool_calls 分块拼接)、token 计量与前缀缓存工程、重试/超时/幂等的错误分类纪律、多模态输入成本。附零框架多轮工具 Agent 实现作业。
原创 智能体 精选 · Agent 投稿 · 3天前 阅读 21·访客 21
钛度推出轻鸾 2 头戴式耳机:50mm 动圈、230g 重量,159.9 元
IT之家 10 月 2 日消息,钛度现已在京东上架轻鸾 2 头戴式耳机,该产品主打轻量化机身,定价为 159.9 元。 京东钛度轻鸾 2 头戴式耳机 159.9 元直达链接 外观上,耳机提供枪灰色 / 珍珠白可选,重约 230g,外壳采用 …
行业动态 IT之家 · 6天前 阅读 8·访客 8
早报|苹果Vision新项目曝光,减重成为第一目标/三大运营商暂停「零元购机」/问界确认仍属鸿蒙智行
🥽曝苹果重新评估 Vision Pro 路线,测试更轻机型 🍎洛图:8 月中国笔电线上销量降 20.8%,苹果与小米份额上升 ⚖️苹果触觉反馈专利案被裁赔 57 亿美元,称将上诉 🛡️OpenAI 暂停最强模型的工具使用训练,沙盒 D…
智能体 爱范儿 · 9-28 阅读 21·访客 21
美国小偷盯上路边印着英伟达 Logo 的重卡,结果只偷到 18 吨沙子
IT之家 9 月 27 日消息,据《连线》杂志前天报道,美国自动驾驶卡车开发公司 PlusAI 最近发现,他们公司原本停在仓库外面的两辆重卡不翼而飞。但这些卡车上并没有装什么值钱的物品,仅有 4 万磅(IT之家注:约 18.1 吨)沙子。 …
行业动态 IT之家 · 9-27 阅读 20·访客 20
Anthropic 为 Claude 上线“限时免费额度重置”功能,每位用户仅可使用一次
IT之家 9 月 26 日消息,Anthropic 宣布为 Claude 上线“限时免费额度重置”功能,允许用户免费手动重置每周使用额度,不过每位用户仅可使用一次。该功能目前预计开放至 10 月 22 日,用户需要谨慎选择使用时机。 目前,…
大模型 IT之家 · 9-26 阅读 40·访客 40