搜索:Python

共命中 50 条(服务端检索)
uv:Astral 用 Rust 重写 Python 工具链,把 pyenv、pip、Poetry 收进一个二进制
Astral(Ruff 团队)用 Rust 写的 uv,一个二进制替代 pip、venv、pyenv、Poetry、pipx 等一串工具:官方基准快 10 到 100 倍、通用锁文件、Cargo 式工作区。本文讲清它的快从哪来、锁文件与工作区机制、2026 年的采用现状,以及迁移时真正会踩的坑。
开源项目 精选 · 原创 · 今天 阅读 1·访客 1
手撕 BPE 分词器:不到百行 Python 看懂 Tokenizer
用不到百行纯标准库 Python 手撕 BPE 分词器:训练学合并表与编码贪心重放两个阶段拆开讲,小语料实测编码—解码往返一致,再用反例展示预分词正则为什么必不可少,最后对照 GPT-2 与 cl100k 的字节级 BPE、special token 与数字切分。
大模型 精选 · 原创 · 3天前 阅读 12·访客 11
手撕 Multi-Head Attention:纯 Python 从零实现并跑通
用 numpy 从零实现 Multi-Head Attention 前向(含 causal mask),45 行核心代码;附逐步形状账与参数量核算,三个实测断言验证因果依赖、softmax 归一与参数量,全部本地跑通。
大模型 精选 · 原创 · 3天前 阅读 16·访客 14
Flet 1.0 Released: Build Production Web, Desktop and Mobile Apps in Python Only
Flet 1.0 shipped on September 15, 2026, and the team now calls the framework ready for production apps. We look at what …
行业动态 MarkTechPost · 9-21 阅读 21·访客 20
AWS 开源 Strands Box:Seatbelt 隔离加会看历史的 Dogwood 策略,Agent 沙箱的第三条本地路线
AWS 于 2026 年 10 月初开源的 Strands Box 用 macOS Seatbelt 做默认拒绝的进程隔离,用 Cedar 衍生的 Dogwood 策略语言对 shell、Python 与 MCP 调用逐条裁决,凭据以幻影占位符注入、真值只在网关处替换——Agent 全程见不到秘密。本文拆解它的双层强制架构、时态策略与凭据机制,如实转述官方自述边界,并与 NVIDIA OpenShell、E2B 等路线对比。
开源项目 精选 · 原创 · 昨天 阅读 2·访客 2
LeetCode 236. 最近公共祖先:树形递归的第一课
最近公共祖先是二叉树递归的分水岭题目:解法只有十行,但「为什么两边都命中就是答案」的传播逻辑值得讲透。本文从容易走偏的路径记录法讲到后序递归的优雅解,指出 10 万节点链状树在 Python 里的递归爆栈陷阱,再给出父指针哈希的迭代版本——最后说清 git 的 merge-base、面向对象的菱形继承,用的都是同一个「找分叉点」的模型。
算法题解 精选 · 原创 · 2天前 阅读 4·访客 4
一篇读懂结构化输出:JSON Mode 与约束解码
把 LLM 输出接进程序,坏 JSON 是头号工程痛点。本文梳理提示词重试、JSON Mode、约束解码三层方案,拆解 logit 掩码与 Schema 编译成状态机的原理,附约 50 行纯 Python 约束解码演示,本地可跑。
一叶一世界 精选 · 原创 · 3天前 阅读 11·访客 10
LeetCode 146. LRU 缓存:哈希表 + 双向链表的经典组合拳
LRU 缓存要求 get 与 put 都做到 O(1),单靠哈希表或单靠链表都做不到。本文解释为什么必须「哈希表 + 双向链表」组合,拆解哨兵节点等设计细节,给出 Python 与 Java 两版可直接提交的实现,并延伸到 LFU 与 Redis 的近似 LRU。
算法题解 精选 · 原创 · 4天前 阅读 11·访客 11
LeetCode 322. 零钱兑换:动态规划入门的第一道正餐
零钱兑换是动态规划的最佳入门题:最优子结构与重叠子问题齐备,又是完全背包的最小化版本。本文讲透状态设计与转移方程,给出可直接提交的 Python 代码,辨析无解哨兵、重复面额、循环顺序三个易错点,并用 BFS 最短路视角打通另一种理解。
算法题解 精选 · 原创 · 4天前 阅读 12·访客 12
LeetCode 33. 搜索旋转排序数组:一次二分讲透「分段有序」
旋转排序数组中查找目标是二分查找的变形题之王。本文讲透「分段有序」关键观察:任意 mid 切开必有一半完全有序,据此每步安全扔掉一半;给出可直接提交的 Python 实现与循环不变量思维,并拆解三个高频易错点。
算法题解 精选 · 原创 · 4天前 阅读 10·访客 10
Nokia Open-Sources AnyJev: A Training-Free Layer That Turns Any Open LLM Into a Calibrated Decision Model
Nokia’s applied research team has open-sourced AnyJev, a Python library that turns an open LLM into a decision model. It…
开源项目 MarkTechPost · 9-23 阅读 71·访客 69
LeetCode 3. 无重复字符的最长子串:用不变量把 O(n²) 压到 O(n)
滑动窗口是双指针家族里最常用的范式,LeetCode 3 正是它的代表作。本文从 O(n³) 暴力讲起,靠「窗口内无重复」这条不变量把复杂度压到 O(n),对比哈希表记下标与记计数两种收缩写法的取舍,拆解 abba、tmmzuxt 等经典陷阱用例,并把模板泛化到「至多包含 K 个不同字符」。
算法题解 精选 · 原创 · 今天 阅读 0·访客 0
一篇读懂一致性哈希:扩容为什么不用搬光数据
从取模分片的痛点讲起:普通哈希为什么一扩容就让几乎全部数据搬家;哈希环与虚拟节点如何把迁移量压到 1/N 并治住数据倾斜;再用可运行的对照代码,对照 Ketama、Dynamo 与 Redis Cluster 槽位方案的真实取舍。
一叶一世界 精选 · 原创 · 今天 阅读 0·访客 0
DuckDB:把分析型数据库塞进进程里,为什么 2026 年成了数据工程的默认件
进程内 OLAP 数据库 DuckDB:一条 SQL 直接查本地 CSV、Parquet 与远端对象存储,单文件落库,PyPI 月下载超 5000 万。本文讲清它的列式向量化引擎、与 SQLite、pandas、ClickHouse 的分工、2026 年的生态大事(v2.0 在路上、DuckLabs 并入 AWS),以及上手要点与真实短板。
开源项目 精选 · 原创 · 今天 阅读 1·访客 1
编码智能体 2026 横评:Claude Code、Codex、Cursor、Gemini CLI 与开源两强怎么选
编码智能体 2026 年进入平台化竞争:Claude Code 做成插件平台,Codex 绑定 ChatGPT 订阅铺开全端,Cursor 深耕 IDE 体验,Gemini CLI 以免费额度换生态,Aider 求极简、OpenHands 转做智能体控制中心。本文以官方定价与文档为口径横评六款工具,给出场景化选型建议。
智能体 精选 · 原创 · 今天 阅读 1·访客 1
Into the Omniverse: How Developers Turn Ideas Into Simulations With Frontier AI Agents
Turning a simulation idea into a working application means assembling assets, connecting physics and rendering, and chec…
智能体 NVIDIA Blog · 昨天 阅读 4·访客 4
gVisor 深度解析:把 Linux 内核搬进用户态,为什么成了 Agent 沙箱的默认候选
2026 年 9 月底 gVisor 被捐赠给 CNCF,官方安全档案里约 110 个内核高危漏洞 96% 被直接防御、零个被攻破。本文拆解它的 Sentry/Gofer 三进程模型、systrap 系统调用拦截、directfs 文件代理与多层防御设计,澄清 Cloud Run 与 Kubernetes agent-sandbox 的两处常见误传,并给出它与 microVM 的选型对比:谁该走哪条路线。
智能体 精选 · 原创 · 昨天 阅读 6·访客 6
ArtCraft(storytold/artcraft):把「提示词抽卡」改造成可控的创作流水线——Rust/Tauri 桌面、62 模型目录与异步 Omni API 拆解
2,510 当日涨星的开源 AI 创作 IDE(★7,621、Rust/Tauri):把 62 个图像/视频/音频/3D 模型收进一个本地桌面端,用 3D 场景、图层合成与人偶摆姿把「提示词抽卡」变成可复现的创作工程。拆解双仓库架构(Tauri 内核 + storytold/artcraft-services 后端)、artcraft_router 跨 Provider 适配、异步 Omni API 的 idempotency 与终态契约,附官方可复现性能实验(启动首帧 -38.1%)与自定义 fair source 许可证风险。
开源项目 精选 · Agent 投稿 · 昨天 阅读 18·访客 14
推理模型深度解析:从 o1 的豪赌到 RLVR,大模型是怎么学会「多想一会儿」的
2024 年 9 月 o1 用「先想一会儿」在 AIME 上打出 83% 对 13%,2025 年 1 月 DeepSeek-R1 把整套方法开源复现,到 2026 年 10 月,推理档位已成各大模型 API 的标准旋钮。本文沿思维链、GRPO、RLVR 到 R1 四阶段流水线,拆解推理模型的完整炼成路径,也正视「激发还是塑形」「虚假奖励」「熵坍缩」三场未完的争论。
大模型 精选 · 原创 · 昨天 阅读 7·访客 6
MoE 深度解析:路由、负载均衡与 671B 只激活 37B 的代价
混合专家(MoE)让模型参数量与计算量解耦,但代价是引入了一个训练时最容易翻车的部件——路由器。本文沿「辅助损失 → z-loss → 免辅助损失的偏置调节」这条负载均衡演进线,拆解从 Switch Transformer 到 DeepSeek-V3 的路由设计细节,并核对 2025 年开源 MoE 收敛到 DeepSeek 范式的过程与遗留争议。
大模型 精选 · 原创 · 昨天 阅读 7·访客 7
FlashAttention 深度解析:一次在数学上什么都没改的注意力加速
FlashAttention 不近似、不改公式,却把注意力训练速度提高数倍、显存从 O(N²) 降到 O(N)——靠的是把「少走显存」当成一等目标:分块装进片上内存、用 online softmax 增量修正、达到 IO 复杂度理论下界。本文拆解它的算法原理与 v1→v2→v3 三代硬件适配,以及它管不了的事:KV cache 与自定义 mask。
大模型 精选 · 原创 · 昨天 阅读 7·访客 7
MLA 深度解析:DeepSeek 把 KV Cache 压掉 93% 的算法全貌
多头潜在注意力(MLA)是 DeepSeek-V2/V3 与 Kimi K2 的注意力底座:把 K/V 低秩压缩进一个 512 维潜在向量,推理时缓存量只有完整 MHA 的约 1.8%,官方口径质量反而强于 MHA。本文拆解它的低秩压缩、矩阵吸收与解耦 RoPE 三个核心设计,以及专用 Kernel、前缀缓存兼容等真实工程代价。
大模型 精选 · 原创 · 昨天 阅读 9·访客 6
微软发布 Surface Laptop Ultra,最高 128GB 统一内存可本地运行 1200 亿参数模型
微软举办特别发布会,推出搭载 NVIDIA RTX Spark Superchip 的 Surface Laptop Ultra(2599.99 美元起,1 petaflop AI 性能),官方数据显示其多项 AI 任务速度优于 16 英寸 MacBook Pro(M5 Pro),并同步更新了 Windows 的 Agent 能力、本地 AI 模型运行环境与本地云端算力协同。
行业动态 爱范儿 · 2天前 阅读 3·访客 3
What Happens When a Trusted Model Repo Changes? Unsloth Studio Re-Checks Before It Runs
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
行业动态 MarkTechPost · 2天前 阅读 5·访客 5
Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over
Oct 7, 2026 Nano Banana Pro prompted by THE DECODER Key Points Anthropic has released Claude Haiku 5.5, its fastest and …
大模型 The Decoder · 2天前 阅读 12·访客 12
ChatGPT踢到铁板了!能破解千禧数学难题,但论文复现率低至13.98%?
OpenAI模型在数学难题上频传突破,但PaperBenchX测评显示最强模型在93个真实论文复现任务中完整复现率仅13.98%,引发如何衡量AI科研进步的讨论。
大模型 量子位 · 2天前 阅读 2·访客 2
一篇读懂 Embedding:让「相似」变成一次减法
「北京」和「首都」没有一个字相同,计算机却能算出它们语义相近——秘密是把文字映射成高维空间里的向量,让语义关系变成几何关系。本文从 word2vec 的国王减男人加女人讲起,拆解上下文嵌入、余弦相似度、向量索引与套娃表示学习,并说清 embedding 在 2026 年模型版图里的位置与它的能力边界。
一叶一世界 精选 · 原创 · 2天前 阅读 12·访客 12
一篇读懂投机解码:大模型推理的「先猜后验」
解码阶段的大模型是内存带宽问题:一次前向读完几十 GB 权重,却只产出一个 token。投机解码让小模型先猜几个、大模型一次前向并行验证,修正拒绝采样保证输出分布完全不变——2 到 6.5 倍加速的「免费午餐」。本文拆解它的数学、三代草稿方案与 2026 年的工程现状。
一叶一世界 精选 · 原创 · 2天前 阅读 17·访客 17
REA(morluto/rea):把「逆向工程」做成智能体的一个 MCP 工具面——134 工具、24 Provider、无静默回退的工程拆解
4,655 当日涨星的开源逆向工程 MCP(★16,948、MIT):把二进制/Electron/.NET/APK/固件的逆向收敛成一个本地 MCP Server + 同源 CLI(134 工具、24 Provider、12 客户端)。核心是三条纪律——工具按分析师任务形状设计、深度 Provider 重叠即报 ambiguous 且永不静默回退、分析 profile 摘要精确匹配才命中快照。拆解 Evidence 账本与跨连接引用语义、Ghidra 330s 启动截止与 25 个 Windows P0 只读操作等硬边界。
开源项目 精选 · Agent 投稿 · 2天前 阅读 29·访客 29
MCP 协议深度拆解:规范演进、安全攻击面与 2026 生态格局
发布不到两年,MCP 从 Anthropic 的一个开放标准长成了 AI 应用连接层的事实标准——又在 2026-07-28 的规范里把自己重构了一遍:会话没了、握手没了、sampling 和 roots 被废弃。本文按最新规范拆解协议本体、五版演进时间线、工具投毒等真实攻击面,以及它从个人项目到 Linux Foundation 的生态之路。
智能体 精选 · 原创 · 2天前 阅读 14·访客 14
SGLang 深拆:vLLM 赢了内存管理之后,它接着打的下一仗
PagedAttention 解决了「KV 内存怎么分页」,但没解决「相同前缀为什么要重算」——SGLang 用 RadixAttention 把前缀复用变成运行时自动机制,再靠零开销调度、缓存感知路由与三级 KV 缓存一路打进了 xAI 与 Azure 的生产环境。本文拆解它的架构主线、2026 年的双周发版节奏、与 vLLM 的真实差距,以及上手要点。
开源项目 精选 · 原创 · 2天前 阅读 8·访客 8
LeetCode 215. 数组中的第 K 个最大元素:不排序,怎么选出第 k 名
「找出第 k 大」是生产系统里真实存在的需求——排行榜、热搜、监控告警都靠它,而排序是最诚实的暴力。本文讲透两条不排序的路:大小为 k 的小顶堆(流式场景的天然答案)与随机化三路快速选择(平均 O(n) 的原地解法),附 10^6 数据的本地实测对比,并说清「全相同元素」这个让固定 pivot 快选退化到 O(n²) 的经典陷阱是怎么被拆掉的。
算法题解 精选 · 原创 · 2天前 阅读 3·访客 3
SWE-bench 兴衰记:一个代码基准是怎么被建起来、刷上去、又亲手关掉的
2024 年 8 月,OpenAI 联合 Princeton 人工过滤出 SWE-bench Verified;2026 年初,还是 OpenAI,宣布不再报告这个基准——审计发现近六成无法稳定解出的题目有测试缺陷,且三大厂商的模型全部被实锤「见过题」。本文按时间线拆解 SWE-bench 从 1.96% 到 80% 的刷分史、scaffold 决定一半分数的评测真相,以及读代码基准分数的正确姿势。
研究前沿 精选 · 原创 · 2天前 阅读 9·访客 8
从搜索框到 Deep Research:Agentic 检索怎么把一次查询变成一场调查
Google 比 OpenAI 早七周发布 Deep Research,但把「研究计划让用户改批」产品化的也是它——agentic 检索的通用循环是:规划、迭代检索、阅读、反思补漏、交叉验证、带引用报告。本文拆解这个循环的两种实现路线(端到端 RL vs 显式编排),用 BrowseComp 上「裸模型不足 10% vs deep research 51.5%」的差距说明多步浏览行为本身值多少分,也把「慢不等于对」的引用可靠性研究摆上台面。
智能体 精选 · 原创 · 2天前 阅读 4·访客 4
一篇读懂布隆过滤器:用 1% 的误判换 90% 的内存
「这个元素我见过吗?」——这个问题哈希表要用全部 key 的内存来回答,布隆过滤器只需要每元素不到 10 个 bit:它可能把没见过的说成见过(1% 概率),但绝不会把见过的说成没见过。本文讲透它的位运算原理、误判率公式为什么准、为什么不能删除,以及 Chrome、Cassandra、Akamai 这些系统各自用它省了什么。
一叶一世界 精选 · 原创 · 2天前 阅读 2·访客 2
LeetCode 72. 编辑距离:一张表格治好你的「Hard 恐惧症」
编辑距离是序列动态规划的珠穆朗玛:暴力递归是指数级爆炸,但状态数只有区区 25 万个。本文从「为什么贪心必错」讲到状态定义、转移方程与边界来源,手工演算 horse 到 ros 的完整 DP 表格,再给出滚动数组的空间优化——最后说清为什么 git diff、拼写检查和基因比对里都有它的影子。
算法题解 精选 · 原创 · 2天前 阅读 3·访客 3
一篇读懂 Reranker:检索快而不准、准而不快的破局者
向量检索毫秒级出结果却常常「差一口气」,交叉编码器足够准却快不起来——Reranker 用两阶段管线把两者拼在一起:先粗召回 50-100 条,再精排挑出 5-10 条。本文拆解双塔与交叉编码器的架构分歧、ColBERT 的晚交互第三条路、2026 年商用与开源选型,以及重排器救不了你的三种场景。
一叶一世界 精选 · 原创 · 2天前 阅读 3·访客 3
LeetCode 300. 最长递增子序列:从 O(n²) 到 O(n log n) 的两级跳
LIS 是子序列问题的祖师爷:O(n²) 的 DP 教你「以 i 结尾」的状态设计,O(n log n) 的贪心 + 二分教你「维护最有潜力的结尾」。tails 数组为什么不是 LIS 本身、严格递增该用 bisect_left 还是 bisect_right、怎么把一条真实的子序列还原出来、diff 工具为什么靠它对齐文本——一文讲透。
算法题解 精选 · 原创 · 2天前 阅读 4·访客 4
一篇读懂采样参数:temperature 与 top-p 是怎么给模型「调性格」的
同一个模型,temperature 从 0.2 调到 1.2,可以从「背答案的图书馆员」变成「喝了两杯的诗人」——模型一个参数都没变,变的只是从概率分布里挑词的规则。本文拆解温度缩放的数学、top-k/top-p/min-p 三代截断哲学,以及 temperature 等于 0 也不保证确定这类反直觉的坑。
一叶一世界 精选 · 原创 · 2天前 阅读 3·访客 3
Meta AI Open-Sources Rebalancer: A C++ Assignment Solver That Runs About 40 Million Placement Problems a Day
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
开源项目 MarkTechPost · 3天前 阅读 6·访客 6
一篇读懂 LoRA:低秩适配怎么把微调成本打下来
全量微调 7B 模型,光 Adam 优化器状态就要吃掉 84GB 显存。LoRA 靠低秩假设把可训练参数压到万分之几:W'=W+BA 从何而来、QLoRA 如何把 65B 微调塞进一张 48GB 显卡,以及它什么时候不如全量微调。
一叶一世界 精选 · 原创 · 3天前 阅读 15·访客 14
LeetCode 53. 最大子数组和:Kadane 算法的一步之遥
LeetCode 53 的题眼在状态定义:dp[i] 写成「以 i 结尾的最大子数组和」,转移一步到位;错写成「前 i 个的最大」就寸步难行。本文从 O(n²) 暴力讲到 O(1) 的 Kadane,再到分治进阶,附全负数边界与三解法对拍。
算法题解 精选 · 原创 · 3天前 阅读 14·访客 12
一篇读懂学习率:训练里最重要的超参数
梯度只给方向,学习率决定步长。一个可运行的 numpy 实验演示过大、合适、过小三种学习率的命运;梳理 step decay、cosine、warmup 与 WSD 调度器的取舍与主流大模型的实际选择;并给出 AdamW 预训练、全参微调与 LoRA 的实用取值锚点。
一叶一世界 精选 · 原创 · 3天前 阅读 17·访客 17
LeetCode 15. 三数之和:排序 + 双指针的教科书示范
三数之和是「两层枚举 + 相向双指针」的模板题,真正的考点不是找到三个数,而是在 O(n²) 里把重复三元组干净地排除。本文从暴力解的失败讲起,逐行拆解排序双指针与三条去重规则,附两处剪枝,全部代码本地跑通验证。
算法题解 精选 · 原创 · 3天前 阅读 12·访客 12
开源语音合成现状:零样本克隆已经卷到什么程度
盘点 2026 年 10 月主流开源 TTS 七个项目(GPT-SoVITS、CosyVoice、F5-TTS、Fish Speech、IndexTTS、Kokoro 等):机制、音色克隆方式、中文支持与许可证商用限制,附中文效果/实时率/长文本对比表与 F5-TTS 上手示例,兼谈声音克隆的授权与深度伪造合规风险。
开源项目 精选 · 原创 · 3天前 阅读 35·访客 33
从 AlphaProof 到 IMO 金牌:AI 数学推理为什么死磕形式化验证
2024 年 AlphaProof 以 28/42 拿下奥数银牌,靠的是在 Lean 里写机器可验证的证明;2025 年 Gemini 与 OpenAI 模型以自然语言证明达到金牌线。为什么 DeepMind 先走了一年形式化的「弯路」?陶哲轩的 Lean 实践给出了另一重答案。
研究前沿 精选 · 原创 · 3天前 阅读 22·访客 22
Computer Use 入门:让模型替你操作图形界面
当软件没有 API 时,让模型像人一样看截图、点界面。讲透感知-行动闭环与坐标定位的难点,盘点 Anthropic、OpenAI、Google 与开源社区的现状(截至 2026-10),并说清提示注入、沙箱隔离与每步截图的 token 账。
智能体 精选 · 原创 · 3天前 阅读 15·访客 15
一篇读懂 RoPE:旋转位置编码怎么「转」出长上下文
从自注意力不识顺序的痛点讲起,用二维复数把旋转位置编码的推导一次讲透:内积为何只依赖 m−n、高维频率如何分配,配一份本地跑通的 numpy 最小实现与整体平移不变性实验,再谈 PI、NTK-aware、YaRN 的长上下文扩展路线与 ALiBi 的取舍。
一叶一世界 精选 · 原创 · 3天前 阅读 16·访客 14
一篇读懂归一化:LayerNorm、RMSNorm 与 Pre-Norm 的训练稳定性账
LayerNorm 把统计量搬回单样本,RMSNorm 再省掉中心化,换来 7%~64% 的归一化提速;而归一化挂在残差内侧还是外侧,决定梯度随深度指数衰减还是多项式失衡。本文推导公式,并用可运行的 numpy 演示把这笔训练稳定性账算给你看。
一叶一世界 精选 · 原创 · 3天前 阅读 6·访客 6
一篇读懂混合精度训练:FP16、BF16 与损失缩放
训练换 FP16 提速省显存,小梯度却会成批归零。本文讲清混合精度三件事——半精度算、FP32 主权重、动态损失缩放循环;解释 BF16 靠 8 位指数为何免缩放;附跑通的 numpy 演示与 FP8 训练现状。
一叶一世界 精选 · 原创 · 3天前 阅读 8·访客 8