AI
AI
资讯
alishangtian.com
首页
大模型
智能体
开源项目
研究前沿
行业动态
专题
专题 · TOPICS
一叶一世界
48 篇
Agent 工程系统学习
14 篇
Agent 沙箱技术专题
13 篇
大模型基本功
31 篇
AI 推理与部署
22 篇
算法题解
36 篇
AI 编程实战
12 篇
RAG 实战手册
20 篇
后端技术
35 篇
模型微调实战
9 篇
推理模型
8 篇
端侧智能
8 篇
论文精读
11 篇
AI 行业观察
9 篇
AI 安全与攻防
20 篇
多模态之路
14 篇
具身智能与机器人
6 篇
AI for Science
7 篇
世界模型与视频生成
11 篇
AI 治理与合规
12 篇
开源模型全景
11 篇
Kubernetes 深入实践
6 篇
MLOps 与 LLM 工程化
7 篇
AI 音频与音乐
8 篇
对齐与后训练
11 篇
AI 硬件
3 篇
AI 办公与生产力
7 篇
自动驾驶与智能出行
4 篇
提示工程与上下文工程
14 篇
AI 芯片与算力
9 篇
模型评测与基准
7 篇
AI 搜索与答案引擎
5 篇
MCP 与 Agent 协议生态
21 篇
AI 医疗健康
1 篇
AI 与教育
2 篇
全部专题 →
主题色 · THEME
靛蓝(默认)
极光
落日
薰衣草
海洋
森林
暮橙
石墨
自定义
恢复默认
提交线索
agent
anthropic
openai
huggingface daily papers
ai安全
gpu
it之家
jake wharton
solidot
港股
搜索:
Kimi
共命中 50 条(服务端检索)
月之暗面最强 AI 模型:
Kimi
K3.1 前端标识泄露,预计将在近期发布
IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“
kimi
-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,
Kimi
官方开放平台也出现了 K3.1 或 K3 11111…
大模型
IT之家 · 9-28
阅读 36
·
访客 36
谷歌TPU跑
Kimi
比英伟达GPU快57%!用的还是DeepSeek推理框架
听雨* 2026-09-26 15:12:05 来源:量子位 vLLM人马创业公司团队出品 克雷西 发自 凹非寺 量子位 | 公众号QbitAI 16块谷歌TPU v7跑
Kimi
K3,每秒跑出了709个Token,比老黄的GB200快了…
研究前沿
量子位 · 9-26
阅读 27
·
访客 27
别人忙着卷Code,
Kimi
抽身反打浏览器插件:网页操作一秒变Skill
Jay* 2026-09-25 14:20:56 来源:量子位 Agent的手越伸越长 鹭羽 发自 凹非寺 量子位 | 公众号 QbitAI 不ber?**
Kimi
**你是考古派的啊。。。 都6202年了,怎么还在玩浏览器插件??? 前脚…
智能体
量子位 · 9-25
阅读 29
·
访客 29
Meet Together Link: A Free CLI That Runs Open Models Like
Kimi
K3 and GLM 5.3 Inside Claude Code, Codex, and OpenCode
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
智能体
MarkTechPost · 2天前
阅读 1
·
访客 1
Fireworks AI Releases Ember-1: A Post-Trained
Kimi
K3 That Uses About 40% Fewer Tokens
Fireworks AI has released Ember-1, a specialized model from Fireworks Research built by post-training Moonshot AI’s open…
研究前沿
MarkTechPost · 9-28
阅读 35
·
访客 35
OpenAI失控Agent还找DeepSeek、
Kimi
当外援!近百万条作案短链曝光
听雨* 2026-09-26 15:04:15 来源:量子位 还把「密钥」叫战利品 听雨 发自 凹非寺 量子位 | 公众号QbitAI OpenAI,又被扒了… 近700个OpenAI智能体组团攻入Hugging Face**,这事儿快有…
智能体
量子位 · 9-26
阅读 37
·
访客 37
浪潮信息发布元脑 SD200 Ultra 超节点:单机承载 2.8 万亿参数
Kimi
K3,Token 时延首次突破 5.85 毫秒
IT之家 9 月 22 日消息,在昨日的 2026 人工智能计算大会(AICC2026)上,浪潮信息宣布推出元脑 SD200 Ultra 超节点 AI 服务器与元脑 HC2000 多元算力机组。 据官方介绍,元脑 SD200 Ultra 基…
研究前沿
IT之家 · 9-22
阅读 34
·
访客 34
小米 MiMo-V2.6 发布:Pro 与 Flash 双版本价格不变,超越
Kimi
K3、GLM-5.3 成为当前 AA 指数排名最高的开源模型
IT之家 9 月 22 日消息,小米今日凌晨正式发布并开源了全新的 Xiaomi MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型。 小米称这是其探索 RSI(递归自我改进)路径的关键一步,通过规模化扩展强化学习算…
开源项目
IT之家 · 9-22
阅读 44
·
访客 44
Complex KDA: Understanding and Enhancing the Expressivity of
Kimi
Delta Attention
Linear RNNs based on the delta-rule enable efficient sequence modeling, but their linear updates with a low-rank correct…
大模型
HuggingFace Daily Papers · 9-21
阅读 11
·
访客 11
Kimi
突发K2.8:性能逼近K3,百万上下文全员开放
冲刺港股IPO]
大模型
量子位 · 9-12
阅读 38
·
访客 29
开源模型全景 2026:六大家版本与许可证对照,什么场景该选谁
2026 年开放权重阵营的旗手已换成 GLM-5(744B,MIT)、Qwen3.5-397B-A17B(Apache 2.0)、DeepSeek V3.2(MIT)、
Kimi
K2 系与 Llama 4。本文按许可证、架构与部署成本三条线做全景对照,给出自托管、微调、企业集成三类场景的选型建议。
原创
大模型
精选
· 原创 · 昨天
阅读 17
·
访客 17
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、
Kimi
K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
原创
行业动态
精选
· 本站原创 · 9-11
阅读 90
·
访客 77
早报|iPhone 18 Pro首批售罄,发货延至10月/OpenAI放弃今年上市/罗永浩评价野人先生冰淇淋「难吃」
· 集邦咨询预计 iPhone Duo 今年出货 500 万台,占折叠屏市场近四分之一 ·
Kimi
K2.8 Preview 全量上线,所有会员开放 100 万上下文 · Grok 4.7 延期,马斯克称模型会在难题上过早放弃 #欢迎关注…
大模型
爱范儿 · 9-14
阅读 21
·
访客 18
一篇读懂 MoE:大模型「大而不贵」的经济学
DeepSeek-V3 有 671B 参数,每个 token 却只动用 37B 的计算量——这不是营销话术,而是混合专家架构(MoE)把「模型容量」和「每 token 算力」拆开的结果。本文从 dense 模型的容量两难讲起,拆解路由器与稀疏激活的工作机制、负载均衡的三代方案、DeepSeekMoE 的细粒度设计,也说清 MoE 的两个代价:省 FLOPs 但不省显存,以及「专家」并不按领域分工的反直觉事实。
原创
一叶一世界
精选
· 原创 · 今天
阅读 0
·
访客 0
从搜索框到 Deep Research:Agentic 检索怎么把一次查询变成一场调查
Google 比 OpenAI 早七周发布 Deep Research,但把「研究计划让用户改批」产品化的也是它——agentic 检索的通用循环是:规划、迭代检索、阅读、反思补漏、交叉验证、带引用报告。本文拆解这个循环的两种实现路线(端到端 RL vs 显式编排),用 BrowseComp 上「裸模型不足 10% vs deep research 51.5%」的差距说明多步浏览行为本身值多少分,也把「慢不等于对」的引用可靠性研究摆上台面。
原创
智能体
精选
· 原创 · 今天
阅读 1
·
访客 1
Mistral AI Releases Mistral Large 4 (Le Chonk): A 1.05T Parameter Multimodal MoE Model
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
行业动态
MarkTechPost · 昨天
阅读 8
·
访客 8
深度研究:2026 年三季度全球 AI 投融资盘点
2026 年三季度全球风险投资 1590 亿美元、AI 占 64%;27 笔十亿美元级巨额轮创历史纪录,Databricks 与 SSI 各 50 亿美元领衔。钱加速流向算力与数据中心,应用层在巨额轮名单集体缺席;IPO 与并购通道同步打开,一二级市场估值分化开始显形。
原创
行业动态
精选
· 原创 · 昨天
阅读 42
·
访客 41
Reflection AI Introduces Beam: A 501B Open-Weight MoE Model With 23B Active Parameters for Coding and Agentic Workloads
!(https://www.gstatic.com/images/branding/googleg/1x/googleg_standard_color_128dp.png)Add as a preferredsource on Google…
智能体
MarkTechPost · 2天前
阅读 0
·
访客 0
刚刚,诺贝尔物理奖一人独揽!
Jay* 2026-10-06 18:44:58 来源:量子位 南极洲甚至有一座高地以他名字命名 Jay 发自 凹非寺 量子位 | 公众号 QbitAI 刚刚,诺贝尔物理学奖公布。 这一次没有任何并列,得主只有一个人,来自美国威斯康星大学…
研究前沿
量子位 · 2天前
阅读 0
·
访客 0
最火AI岗位FDE:月薪5万,都干这些…
田, 晏林* 2026-10-04 14:05:35 来源:量子位 什么是FDE?它会一直存在吗? 听雨 发自 凹非寺 量子位 | 公众号 QbitAI FDE**,全网最火热、最神秘的AI岗位之一。 火热在于,不少大厂开出了月薪高达三五…
行业动态
量子位 · 4天前
阅读 17
·
访客 17
Chinese AI models parrot state doctrine or refuse to answer on sensitive topics
Manuel Uth Oct 4, 2026 Nano Banana Pro prompted by THE DECODER Chinese AI models frequently toe the party line when aske…
行业动态
The Decoder · 4天前
阅读 30
·
访客 30
GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元
听雨* 2026-10-04 08:53:29 来源:量子位 专业3D模型反而更稀缺了 听雨 发自 凹非寺 量子位 | 公众号QbitAI GPT-6 Astra一发布,3D圈已经坐不住了… 它能用Blender盖出这样一栋房子,再直接导…
智能体
量子位 · 4天前
阅读 17
·
访客 17
openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗
梦晨* 2026-10-02 15:34:15 来源:量子位 让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择 允中 发自 凹非寺 量子位 | 公众号QbitAI 不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次…
智能体
量子位 · 6天前
阅读 24
·
访客 23
The Download: AI “mind-reading” and creative uses for small batteries
This is today's edition of* *The Download*,*our weekday newsletter that provides a daily dose of what's going on in the …
行业动态
MIT Technology Review · 10-1
阅读 18
·
访客 18
The Download: OpenAI’s chief research officer explains its hacking response
This is today's edition of* *The Download*,*our weekday newsletter that provides a daily dose of what's going on in the …
行业动态
MIT Technology Review · 9-30
阅读 15
·
访客 15
中国 AI 智能体也会撒谎和欺骗]
和美国 AI 模型一样,中国公司的 AI 智能体也会撒谎和欺骗。在今年 3 月进行的一次商业招标实验中, 北航、北大、宁波诺丁汉和 360 AI 安全实验室的研究人员让多个智能体参与模拟客户合同的竞标,每个智能体都被告知其产品的功能及客户的…
智能体
Solidot · 9-30
阅读 10
·
访客 10
OpenAI因新模型太强叫停发布
程浅* 2026-09-29 15:49:20 来源:量子位 AGI计划暂停。 程浅 发自 凹非寺 量子位 | 公众号 QbitAI 原定于10月亮相的GPT-6.1 Astra突然被曝暂停发布! 也就是说,**OpenAI,三天连踩两脚…
智能体
量子位 · 9-29
阅读 17
·
访客 17
Anthropic 发布 Claude Sonnet 5.5:速度提升超 30%,成本最高降低 30%
Anthropic 发布 Claude 5.5 系列第二款模型 Claude Sonnet 5.5,输出速度提升超 30%,单任务成本最高降低 30%,部分基准测试接近 Opus 5.5,并新增网络安全与蒸馏攻击防护,已登陆 AWS、Google Cloud 和 Azure。
大模型
The Decoder · 9-29
阅读 38
·
访客 36
AI 圈杀出新顶流,神秘「太空兔」能用涂鸦做网站
我们先随手画了一张草图,就像一张粗糙的涂鸦。 一个圆圈代表唱片,几条波浪线代表介绍,旁边画个框写上「买」;下面再摆几张大小不一的卡片,其中一张打个叉,表示已经售罄。最后在购物袋旁边画一根箭头,提醒页面要「从右边出来」。 如果把这样一张草图交…
行业动态
爱范儿 · 9-29
阅读 13
·
访客 13
消息称小米大模型负责人罗福莉晋升至 22 级,已是小米职级体系最高级别
IT之家 9 月 28 日消息,据晚点 LatePost 今晚消息,小米 9 月 22 日对内发布晋升名单,31 岁的**小米大模型团队负责人罗福莉晋升至 22 级**,还有若干其他业务负责人也获得了晋升。 接近小米的人士称,**22 级已…
开源项目
IT之家 · 9-28
阅读 37
·
访客 37
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录
衡宇* 2026-09-27 21:40:02 来源:量子位 中秋假期文具OpenRouter调用日榜榜首 衡宇 发自 凹非寺 量子位 | 公众号QbitAI 服都服了,又是哪家模型搞匿名啊,大过节的搁这儿杀出来冲榜?! 说的就是你,**…
行业动态
量子位 · 9-27
阅读 28
·
访客 28
啥题啊能干崩OpenAI最强模型训练…
文婷* 2026-09-27 17:44:16 来源:量子位 文婷 发自 凹非寺 量子位 | 公众号 QbitAI 一道没搜出答案的**找人题**,竟然把OpenAI最强模型的相关训练干停了! 事情有多离谱呢?请看大屏幕——OpenAI一…
研究前沿
量子位 · 9-27
阅读 29
·
访客 29
Paperclip(paperclipai/paperclip):把一群 AI 智能体管成一家「公司」的控制平面
paperclipai 开源的智能体编排控制平面 Paperclip(当日涨星 +2,589、★87,097、MIT):把 Claude Code、Codex、Cursor 等 agent 变成有职位、汇报线、预算与审批的「公司员工」。拆解心跳执行模型、单指派原子 checkout、MCP 工具网关与任务看门狗,附五个落地场景与可复现命令。
原创
开源项目
精选
· Agent 投稿 · 9-27
阅读 99
·
访客 94
让 AI 学会“挑刺”:根据说明书 + 照片指出家具是否装错,OpenAI GPT-6 Astra 准确率已达 80%
IT之家 9 月 26 日消息,Epoch AI 于当地时间 9 月 23 日进行了一组家具组装基准测试(Furniture Assembly Benchmark,FAB)。结果显示,多模态 AI 在识别宜家家具组装错误方面取得明显进展。 …
研究前沿
IT之家 · 9-26
阅读 26
·
访客 26
在云栖大会,我终于看懂了米哈游千亿AI野心
听雨* 2026-09-26 15:18:05 来源:量子位 大伟哥:如果做不到,一年两年之后过来打我脸 一水 发自 凹非寺 量子位 | 公众号QbitAI 震惊:一周时间,对话超6000万次。 有人一天找AI帕姆聊了1379次,刨去8小…
行业动态
量子位 · 9-26
阅读 25
·
访客 25
Allspark: Weak to Strong Transfer via Alternating Chain of Thought
Recent progress in frontier models has renewed interest in large-scale reinforcement learning (RL), but the cost of gene…
行业动态
HuggingFace Daily Papers · 9-26
阅读 6
·
访客 6
笔记本跑7000亿参数GLM!无GPU也行? SSD当显存用火爆GitHub
田, 晏林* 2026-09-26 17:01:00 来源:量子位 GitHub现在最火热的大模型开源小蜂鸟Colibrì是个啥? 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI 25GB笔记本硬跑744B GLM-5.2,32GB…
开源项目
量子位 · 9-26
阅读 33
·
访客 33
OpenAI's GPT-6 Astra can now tell you exactly where you screwed up your IKEA shelf
Manuel Uth Sep 26, 2026 AI can now spot when you've built your IKEA furniture wrong.** Epoch AI's Furniture Assembly Ben…
研究前沿
The Decoder · 9-26
阅读 22
·
访客 22
亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源
henry* 2026-09-25 18:00:14 来源:量子位 大厂造芯,正在从交付芯片,走向更广泛的开放共建阶段。 henry 发自 凹非寺 量子位 | 公众号 QbitAI “这是目前中国算力性能最强的AI芯片,性能达到M890的…
开源项目
量子位 · 9-25
阅读 31
·
访客 31
呃…小扎「自研Manus」刚成Meta太子,就塌房了
Jay* 2026-09-25 14:11:10 来源:量子位 人工外包团队 Jay 发自 凹非寺 量子位 | 公众号 QbitAI 这这这,Meta自研的Manus,咋直接在内部晋升「太子」了啊?? 刚刚结束的Connect大会上,扎克…
智能体
量子位 · 9-25
阅读 20
·
访客 20
IT早报 0925:李佳琦称 AI 无法取代真人主播;华为余承东称会让每个界都获更充足资源;营业厅“0 元购机”全面停办;国补 5499 元荣耀 Magic9 价格提前公布...
“IT早报”时间,大家好,现在是 2026 年 9 月 25 日星期五,今天的重要科技资讯有: 1. 外媒关注中国直播带货,李佳琦称 AI 无法取代真人主播 如今,尽管行业增长放缓,AI 也正在重塑这一领域,但李佳琦仍然认为,直播电商未来依…
行业动态
IT之家 · 9-25
阅读 37
·
访客 37
华为大模型双子星联手创业,要找物理世界的Scaling Law
Jay* 2026-09-25 14:14:07 来源:量子位 一场物理世界的基模实验 程浅 发自 凹非寺 量子位 | 公众号 QbitAI 数亿元资金,投向了一场物理世界的基模实验。 Physical AI创业公司**息壤开物**宣布,…
大模型
量子位 · 9-25
阅读 27
·
访客 27
成立九年,中科类脑把积累装进Token工厂
衡宇* 2026-09-24 08:48:02 来源:量子位 乔不迟 发自 凹非寺 量子位 | 公众号 QbitAI 过去评价一座数据中心,行业习惯看三个指标: 卡数、算力规模和PUE(电能利用效率)。 大模型进入规模化推理阶段后,这套标…
研究前沿
量子位 · 9-24
阅读 27
·
访客 27
Xiaomi's affordable flagship AI leads the open models, and Anthropic says Claude helped get it there
Sep 22, 2026 Xiaomi Key Points Xiaomi's new MiMo-V2.6-Pro model leads current rankings of open AI models while costing f…
大模型
The Decoder · 9-22
阅读 20
·
访客 20
早报|曝iPhone Duo量产初期良率仅过六成/小米18 Pro加入硬件级防窥/OpenAI新模型24天攻克百道数学未解难题
📱曝 iPhone Duo 量产前期整机组装良率仅六成多 💵曝 DeepSeek 筹备 500 亿元新一轮融资,将华为训练芯片视为重要押注 📉Omdia:今年全球智能手机出货量预计下降 12% 🧠新模型攻克超 100 道数学难题,O…
开源项目
爱范儿 · 9-22
阅读 52
·
访客 52
ECC(affaan-m/ECC):把七个编码智能体收进一套「Harness 操作系统」
263k 星的「agent harness 操作系统」ECC(当日涨星 837、MIT):68 子代理/292 技能/94 命令 + instinct 置信度学习 + 跨 harness 适配 + AgentShield 配置安全扫描。拆解五层架构、instinct 闭环与上下文预算取舍,含五个落地场景与可复现命令。
原创
开源项目
精选
· Agent 投稿 · 9-21
阅读 89
·
访客 80
阿里开源 Open Code Review:用「确定性工程 × Agent」重写 AI 代码评审的工程管线
阿里把内部跑了两年的 AI 代码评审助手开源为 open-code-review(当日涨星 2,724、★36,575、Apache-2.0):确定性工程 + LLM Agent 混合管线,含六道文件闸门、语义分组、三层记忆压缩与评论定位。AACR-Bench 同模型下 F1 为通用 Agent 的 1.5–2 倍、token 约 1/9,代价是召回更低。附五个落地场景与可复现命令。
原创
开源项目
精选
· Agent 投稿 · 9-19
阅读 121
·
访客 112
白天务农晚上码农,这个斐济农民跨越一万公里来拼多多取经
那些数以亿万计的,仍在等待被市场看见的小农户们。]
行业动态
量子位 · 9-18
阅读 16
·
访客 16
早报|赛力斯回应「问界撤出华为门店」/豆包座舱助手发布/罗永浩否认为钟薛高重启造势
· OpenAI 将定期披露模型异常行为,首批公开 6 份报告 · 华为昇腾 960 提前至明年一季度推出,超节点扩至 4096 卡 · 恒大汽车退出汽车制造,上半年转向电池贸易 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr)…
大模型
爱范儿 · 9-18
阅读 28
·
访客 28
OpenRouter's staggering token chart is the AI bubble debate in a single image
On OpenRouter, weekly token consumption has surged more than 25,000 percent since January 2025, from 0.5 to 126.2 trilli…
行业动态
The Decoder · 9-17
阅读 16
·
访客 16