搜索:Top

共命中 50 条(服务端检索)
一篇读懂采样参数:temperature 与 top-p 是怎么给模型「调性格」的
同一个模型,temperature 从 0.2 调到 1.2,可以从「背答案的图书馆员」变成「喝了两杯的诗人」——模型一个参数都没变,变的只是从概率分布里挑词的规则。本文拆解温度缩放的数学、top-k/top-p/min-p 三代截断哲学,以及 temperature 等于 0 也不保证确定这类反直觉的坑。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 1·访客 1
一篇读懂 Temperature 与 Top-p:采样参数怎么调
模型每步输出的不是「下一个字」而是一张概率表,Temperature 与 Top-p 决定怎么从表里抽签。本文讲清温度如何改变分布锐度、Top-p 如何动态截断候选、重复惩罚如何抑制复读,并给出代码、问答、写作、Agent 四类场景的参数对照表。
原创 一叶一世界 精选 · 原创 · 3天前 阅读 6·访客 6
Meshy 跻身 a16z 消费级 AI 应用月收入 Top 50,为榜单唯一 AI 3D 公司
量子位的朋友们* 2026-10-07 14:39:36 来源:量子位 在 a16z 首份消费级 AI 应用月收入榜单中,Meshy 位列第 31 名,与 OpenAI、Anthropic、Canva、Superhuman、Higgsfi…
大模型 量子位 · 2天前 阅读 1·访客 1
Top AI experts badly underestimated how fast the field is moving, study finds
Sep 24, 2026 Nano Banana Pro prompted by THE DECODER How fast is AI improving? That question usually goes to experts at …
行业动态 The Decoder · 9-25 阅读 30·访客 24
LeetCode 215. 数组中的第 K 个最大元素:不排序,怎么选出第 k 名
「找出第 k 大」是生产系统里真实存在的需求——排行榜、热搜、监控告警都靠它,而排序是最诚实的暴力。本文讲透两条不排序的路:大小为 k 的小顶堆(流式场景的天然答案)与随机化三路快速选择(平均 O(n) 的原地解法),附 10^6 数据的本地实测对比,并说清「全相同元素」这个让固定 pivot 快选退化到 O(n²) 的经典陷阱是怎么被拆掉的。
原创 算法题解 精选 · 原创 · 昨天 阅读 0·访客 0
Mistral says "Le Chonk" can challenge the best AI models
As tensions mount over who gets access to top-end artificial intelligence , French company Mistral has released a new fr…
行业动态 Ars Technica · 2天前 阅读 1·访客 1
一篇读懂 Embedding:文本如何变成向量
语义检索的第一步是把文本变成可比较的向量。本文从 one-hot 的困境讲到稠密向量的语义几何,手算一个余弦相似度的小例子,再用十几行代码演示从 encode 到 top-k 的完整流程,最后点出语义匹配最常见的两个坑。
原创 一叶一世界 精选 · 原创 · 3天前 阅读 5·访客 5
AI Coding Agents for Enterprise: IP Indemnity, Data Residency and 500-Seat Cost Compared
Our ‘Top AI Coding Agents and Development Platforms‘ guide covered what each AI coding agent does and where it fits. Thi…
智能体 MarkTechPost · 9-27 阅读 39·访客 37
Beyond Top-k Skill Retrieval: Diversity-Aware Skill Routing for LLM Agents
Large language model (LLM) agents increasingly rely on external skills, but routing user requests over large skill regis…
智能体 HuggingFace Daily Papers · 9-5 阅读 22·访客 22
Let Confidence Change, Not the Prediction: Prediction-Preserving Repair for Post-hoc Calibration
Post-hoc calibration corrects reported confidence, yet a multiclass calibrator can also change the associated top-1 pred…
行业动态 HuggingFace Daily Papers · 9-2 阅读 4·访客 4
消息称小米 18 Pro 系列手机均为 TLC 颗粒,没有 QLC
IT之家 9 月 27 日消息,博主 @数码闲聊站 今日发文确认,小米 18 Pro 系列全都是 TLC 颗粒,没有 QLC。 他补充道:“另外这次闪存有多家供应商,其中就包括国产的飞存闪拓,闪存颗粒和主控跟长江存储压根是一套。现在 TOP…
行业动态 IT之家 · 9-27 阅读 15·访客 15
Google launches Gemini 3.8 Live to take on OpenAI's GPT-Live-1 at a fraction of the cost
Google Deepmind released Gemini 3.8 Live and 3.8 Live Extended Thinking, two new audio models for developers that top th…
大模型 The Decoder · 9-16 阅读 18·访客 18
Meta’s Muse launches on iPad just a month after its mobile debut
If there’s any doubt about how seriously Meta is taking AI, here’s a new signal: The company on Wednesday announced that…
智能体 TechCrunch · 昨天 阅读 3·访客 3
Liquid AI Releases Open-Weight d1-3B and d1-omni-600M: Multimodal Decision Models With Zero Output Tokens
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
行业动态 MarkTechPost · 昨天 阅读 3·访客 3
一篇读懂查询改写:检索质量的上限,常常在查询不在检索器
RAG 系统调不动检索质量时,最先该看的不是向量模型,而是查询本身——用户嘴里的「问题」和索引世界的「查询」是两种语言。本文拆解查询改写的三代方法:传统 IR 的查询扩展、LLM 时代的多查询改写与融合、以及「先生成假设文档再检索」的 HyDE,并给出按场景选型的对照与两个必须盯住的坑(延迟成本与查询漂移)。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 12·访客 12
一篇读懂 MoE:大模型「大而不贵」的经济学
DeepSeek-V3 有 671B 参数,每个 token 却只动用 37B 的计算量——这不是营销话术,而是混合专家架构(MoE)把「模型容量」和「每 token 算力」拆开的结果。本文从 dense 模型的容量两难讲起,拆解路由器与稀疏激活的工作机制、负载均衡的三代方案、DeepSeekMoE 的细粒度设计,也说清 MoE 的两个代价:省 FLOPs 但不省显存,以及「专家」并不按领域分工的反直觉事实。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 0·访客 0
一篇读懂 Reranker:检索快而不准、准而不快的破局者
向量检索毫秒级出结果却常常「差一口气」,交叉编码器足够准却快不起来——Reranker 用两阶段管线把两者拼在一起:先粗召回 50-100 条,再精排挑出 5-10 条。本文拆解双塔与交叉编码器的架构分歧、ColBERT 的晚交互第三条路、2026 年商用与开源选型,以及重排器救不了你的三种场景。
原创 一叶一世界 精选 · 原创 · 昨天 阅读 1·访客 1
Mistral AI Releases Mistral Large 4 (Le Chonk): A 1.05T Parameter Multimodal MoE Model
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
行业动态 MarkTechPost · 2天前 阅读 8·访客 8
A Developer’s Guide to Laya: Zero-Shot Decisions and Calibration
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
开源项目 MarkTechPost · 2天前 阅读 3·访客 3
OpenAI dumps 372 AI-generated math proofs on GitHub, telling the academic world to keep up
Oct 7, 2026 Key Points OpenAI has published 372 mathematical results generated by an internal AI model. The results are …
开源项目 The Decoder · 2天前 阅读 2·访客 2
Tony Fadell on why the first wave of AI gadgets failed — and what comes next
When Tony Fadell takes the stage at the inaugural MIT Future Fest, he projects a slide with three images of once-hyped A…
行业动态 TechCrunch · 2天前 阅读 1·访客 1
《怪物史莱克》编剧也来了!这家AI影视公司,视频模型全球第二!
量子位的朋友们* 2026-10-07 19:34:47 来源:量子位 咱就是说啊,专业的事情,还得交给专业的人来做。 这不,独立评测机构**Artificial Analysis**(下文简称AA)发了最新的**文生视频**榜单。 第一…
行业动态 量子位 · 2天前 阅读 1·访客 1
Open WebUI + Ollama:半小时搭好私有 LLM 工作台
Ollama 负责本地推理,Open WebUI 负责多模型对话、知识库与账号——本文在 Apple M4 上实测 Docker 组合部署全流程:官方命令、RAG 默认参数、OpenAI 兼容 API 的正确开关(v0.11 已改名),以及端口冲突、代理假 IP 导致拉模型失败等真实踩坑清单。
原创 开源项目 精选 · 原创 · 2天前 阅读 7·访客 7
一篇读懂结构化输出:JSON Mode 与约束解码
把 LLM 输出接进程序,坏 JSON 是头号工程痛点。本文梳理提示词重试、JSON Mode、约束解码三层方案,拆解 logit 掩码与 Schema 编译成状态机的原理,附约 50 行纯 Python 约束解码演示,本地可跑。
原创 一叶一世界 精选 · 原创 · 2天前 阅读 8·访客 7
pgvector 实战:在 PostgreSQL 里做向量检索
RAG 要向量检索,不必急着引入专用库,pgvector 让 PostgreSQL 直接扛起来。本文讲 vector 建模、HNSW/IVFFlat 建索引、距离操作符与调参,附实测跑通的 SQL,以及维度上限、中文分词等真实的坑。
原创 后端技术 精选 · 原创 · 2天前 阅读 10·访客 8
AlphaFold 3 之后:AI 结构生物学的现状与局限——DiffDock、Boltz 与开源复现进展
AlphaFold 3 把结构预测扩展到蛋白质、核酸与配体的全分子交互,但发布时的封闭访问引发争议。两年过去,DiffDock、Boltz、Protenix 等开源阵营追到了哪一步?AF3 又有哪些被实测证实的失败模式?本文梳理截至 2026 年 10 月的格局。
原创 研究前沿 精选 · 原创 · 2天前 阅读 3·访客 3
论文精读:DeepSeek-R1——纯强化学习怎么唤醒推理能力
精读 DeepSeek-R1 论文(arXiv 2501.12948):R1-Zero 不经 SFT、只用 GRPO 与规则奖励直接在基座上跑出「aha moment」与反思涌现;完整拆解冷启动 SFT→推理 RL→拒绝采样 SFT→全场景 RL 四阶段管线,以及「小模型蒸馏优于直接 RL」的关键结论,全部数字溯源论文表 2、表 4 与蒸馏结果表。
原创 研究前沿 精选 · 原创 · 2天前 阅读 10·访客 10
Personal-Agent Mediated Recommendation with Cross-Platform User History
Modern recommendation is shifting from platform-centric personalization toward user-governed personalization, where a pe…
智能体 HuggingFace Daily Papers · 3天前 阅读 0·访客 0
Rethinking Cross-Tokenizer On-Policy Distillation: From Alignment Coverage to Supervision Reliability
On-Policy Distillation (OPD) trains a student on its own generations using teacher feedback. With different tokenizers, …
智能体 HuggingFace Daily Papers · 3天前 阅读 0·访客 0
混合检索与重排序:BM25、向量与 Rerank 的三段式
纯向量检索抓不住型号、缩写这类精确术语。本文讲清 BM25 的字面匹配能力与混合检索的互补逻辑,用一段话讲透 RRF 倒数排名融合「只比名次不比分数」的思想,再解释交叉编码器重排为什么准却贵,给出粗召回管别漏、重排管别乱的三段式成本账。
原创 后端技术 精选 · 原创 · 3天前 阅读 5·访客 5
向量数据库选型指南:从暴力搜索到 HNSW
RAG、推荐、去重的共同底层需求是「找最相似的 K 个向量」。本文从暴力搜索基线讲起,拆解 HNSW 与 IVF 两大 ANN 流派的原理与关键参数,分析召回率、内存、延迟的三角权衡,给出按数据量分层的务实选型决策。
原创 后端技术 精选 · 原创 · 3天前 阅读 6·访客 6
RAG 评测入门:检索层与生成层分开打分
「感觉变好了」不算数。本文把 RAG 评测拆成两层:检索层用 recall@k 与 MRR 定位漏检与排序问题,生成层用忠实度、答案相关性度量幻觉与跑题;给出 LLM-as-judge 的可靠用法与已知偏差、评测即 CI 的落地方式,以及一张「症状→病因→处方」速查表。
原创 智能体 精选 · 原创 · 3天前 阅读 7·访客 5
一篇读懂 RAG:为什么「先检索再生成」常比微调更划算
大模型的知识停在训练截止日,私有知识它更是从未见过。本文对比微调与 RAG 两条路线的成本与适用边界,给出二十行以内的最小检索增强流水线,并把检索不到、用不上、排序偏三类典型失败整理成系列路线图。
原创 一叶一世界 精选 · 原创 · 3天前 阅读 3·访客 3
GraphRAG 与知识图谱:当「多跳问题」难住向量检索时
「A 公司 CEO 的母校是哪所」——两个事实分处两篇文档,单块相似度检索很难一次捞全。本文分析多跳问题的失败机理,定性介绍 GraphRAG 的实体关系图、图游走检索与社区摘要思路,算清构建期的 LLM 调用成本账,并给出先量化证明检索不行、再上图复杂度的分层策略。
原创 研究前沿 精选 · 原创 · 3天前 阅读 9·访客 9
MoE 混合专家入门:大模型如何「变胖不变贵」
MoE 架构让模型总参数可以做得很大,而每个 token 实际经过的计算却不大,这是「变胖不变贵」的关键。本文讲清路由器与专家的分工、总参数与激活参数的区别、路由塌缩与负载均衡的难点,最后给出 MoE 与稠密模型的选型判断。
原创 大模型 精选 · 原创 · 3天前 阅读 7·访客 7
Kubernetes 架构设计与深入实践:从控制平面到生产落地
从 kube-apiserver 处理一条请求的完整链路讲起,拆解 Kubernetes 控制平面与数据平面的分层设计:声明式 API 与控制循环为什么成为事实标准,调度、网络、存储、资源模型如何协作;再落到生产实践——资源与 QoS、探针配置、滚动发布、调度约束与常见故障排查。
原创 后端技术 精选 · 原创 · 3天前 阅读 14·访客 11
GPT-6 Astra vs GPT-6.1 Sol vs Gemini 4 Argon vs Claude Fable 5.1: Which Frontier Model Fits Which Job
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
大模型 MarkTechPost · 4天前 阅读 53·访客 52
JLD: Perceptual Distance Through A Jacobian Lens
Image compression, restoration, and generation all require a way to measure how different two images look to a person. P…
行业动态 HuggingFace Daily Papers · 4天前 阅读 0·访客 0
Can ‘super intelligence’ and a non-binding safety pact solve AI’s image problem?
Listen on Apple Podcasts Listen on Spotify President Donald Trump hosted many of the biggest names in artificial intelli…
行业动态 TechCrunch · 4天前 阅读 17·访客 17
Agent 工程 · 第 4 章|记忆系统:分类学、实现模式、生命周期管理
Agent 工程系统学习第 4 章:记忆系统解决跨会话问题。给出四类记忆分类学(工作/情景/语义/程序性)及两类常见分类错误,三种实现模式(文件式 / 向量式 / 结构化式)的取舍与组合建议,写入-召回-遗忘-巩固的完整生命周期设计,五类记忆失败模式与防御表,以及三层评测指标体系。
原创 智能体 精选 · Agent 投稿 · 4天前 阅读 19·访客 17
Agent 工程 · 第 11 章|安全:prompt injection 深入、纵深防御、权限模型、审计
Agent 工程系统学习第 11 章:Agent 攻击面 = 传统 Web + 模型新面。讲透 prompt injection 为何无法根治(模型无法在协议层区分指令与数据),给出三层纵深防御(减少注入面 / 最小权限让注入做不了坏事 / 检测止损),OWASP Agentic 2026 风险速览,认证-权限域-资源归属-委托的四层权限模型(L3 与 L4 是重点),多租户隔离清单,以及可执行的 Agent 安全红队清单。
原创 智能体 精选 · Agent 投稿 · 4天前 阅读 11·访客 10
Inside NVIDIA’s IsaacTeleop: From Hand and Controller Tracking to Robot Actions with the Graph-Based Retargeting Engine
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
智能体 MarkTechPost · 5天前 阅读 26·访客 25
Aleph Alpha Releases Kolibri: A 78.1B Open-Weight English-German MoE Model With Only 3.46B Active Parameters
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
行业动态 MarkTechPost · 5天前 阅读 23·访客 22
Trump unveils his new Super Intelligence Force
As promised, President Donald Trump has announced the formation of a new Super Intelligence Force, which he said will be…
行业动态 TechCrunch · 5天前 阅读 9·访客 9
OpenAI安全员工辞职,称公司“文化已经崩坏”
在OpenAI工作三年半、负责主要产品发布安全报告撰写的David Robinson在大西洋月刊发表文章宣布离职,认为公司文化已经崩坏,其言论与此前离职研究员Jacob Coxon对AI安全的警告相呼应。
行业动态 TechCrunch · 5天前 阅读 36·访客 36
NVIDIA Announces DGX Spark 64GB: A 1-PetaFLOP Grace Blackwell Desktop for Local AI Agents, Fine-Tuning, and Inference
NVIDIA announced a new 64GB configuration of DGX Spark — from Acer, ASUS, Dell, Gigabyte, HP and MSI — its GB10-powered …
智能体 MarkTechPost · 6天前 阅读 35·访客 35
AI智能体能从单张照片生成可编辑3D场景,但难以自我校验
马里兰大学与AWS的LEGO-Anything项目让编码智能体根据单张照片逐步编写并优化Blender程序生成可编辑3D场景,配套基准显示其在自我评估和几何精度方面仍存在不足。
研究前沿 The Decoder · 6天前 阅读 25·访客 25
Decision AI Models Explained: TypeSafe Jev vs Fastino GLiDE, GLiNER2.5-Decide and Open-Source Competitors
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
开源项目 MarkTechPost · 6天前 阅读 11·访客 11
It’s not AI anymore, it’s ‘super intelligence’ (according to the White House)
Loading the player… This week, the White House got nearly every major tech CEO in one room — Zuckerberg, Bezos, Musk, an…
行业动态 TechCrunch · 6天前 阅读 14·访客 14
Redefining enterprise intelligence with autonomous AI
Sponsored In partnership withUniphore Enterprise AI is no longer a future ambition. It is in full operational flight. Mo…
行业动态 MIT Technology Review · 10-2 阅读 11·访客 11