搜索:星辰大模型

共命中 50 条(服务端检索)
中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B
IT之家 9 月 19 日消息,中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,该模型总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K, 是国内首个基于国产算力与国产框架完…
智能体 IT之家 · 9-19 阅读 35·访客 33
Cua(trycua/cua):给大模型一双「操作电脑的手」——计算机使用代理的基础设施拆解
YC 背景团队开源的计算机使用代理基础设施 Cua(当日涨星 1,112、★24,318、MIT):Driver 提供带 7 类 oracle 证据链的 GUI 工具面,Sandbox/Fleet 提供可复现的隔离电脑,Cua-Bench 提供评测与轨迹,2.8 MB 的 CUA-S1 打分器替代部分大模型调用。含五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-20 阅读 107·访客 103
消息称小米大模型负责人罗福莉晋升至 22 级,已是小米职级体系最高级别
IT之家 9 月 28 日消息,据晚点 LatePost 今晚消息,小米 9 月 22 日对内发布晋升名单,31 岁的**小米大模型团队负责人罗福莉晋升至 22 级**,还有若干其他业务负责人也获得了晋升。 接近小米的人士称,**22 级已…
开源项目 IT之家 · 9-28 阅读 36·访客 36
后摩智能确认其下代大模型端边 AI 芯片采用 3D CIM 存算一体架构
IT之家 9 月 22 日消息,后摩智能 (HOUMO.AI) 在近日举行的 2026 全球 AI 芯片峰会上确认,该公司**下代大模型端边 AI 芯片将采用 3D CIM 存算一体架构**,结合融合存算与 3D DRAM 技术。 这款新一…
大模型 IT之家 · 9-22 阅读 25·访客 24
特斯拉推送 2026.26.200.11 软件更新:为更多车型上线豆包大模型语音助手
IT之家 9 月 18 日消息,特斯拉昨日发布了最新的 2026.26.200.11 版软件更新,已开始分批推送。本次升级涵盖豆包大模型、宠物模式、导航、辅助驾驶、媒体应用及安全修复。 特斯拉车机新增豆包大模型语音助手(需开通高级车载娱乐服…
大模型 IT之家 · 9-18 阅读 72·访客 72
诺和诺德与 Anthropic 达成合作,用 Claude 大模型加速新药研发
IT之家 9 月 16 日消息,诺和诺德(Novo Nordisk)宣布已与 Anthropic 达成合作,计划运用这家 AI 企业的 Claude 大模型,加快新药的发现与研发进程。 这家丹麦制药企业表示,项目初期,诺和诺德会先在自身研发…
研究前沿 IT之家 · 9-16 阅读 26·访客 26
AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
9月15日,由AI大模型工场主办的“2026 AI产业生态大会”在北京举行。]
大模型 量子位 · 9-16 阅读 28·访客 28
消息称华为 Pura X View、Mate XT 2 非凡大师手机支持端侧本地大模型下载部署
IT之家 9 月 9 日消息,据博主 @超维界 透露,华为 Pura X View、Mate XT 2 非凡大师手机支持端侧本地大模型下载部署,有多模态增强大模型(6GB 左右)和多模态混合专家大模型(15GB 左右)供自主选择下载。 博主…
大模型 IT之家 · 9-9 阅读 21·访客 18
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
模型入海,阶跃走向人群 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
大模型 爱范儿 · 9-20 阅读 26·访客 26
大模型发布节奏如何影响上市公司股价:传导机制、量化框架与 2025–2026 实战复盘
把"模型发布"当成一类可度量的事件冲击来研究。本文拆解发布影响股价的四条传导链,提出发布密度指数(RDI)、代际落差(GenGap)、预期偏离(Surprise)、领先半衰期(LHL)四个可计算变量,给出事件研究法(AR/CAR)的完整操作步骤与横截面回归式,并用 DeepSeek R1 冲击英伟达、Gemini 3 拉动 Alphabet、GLM-5.2 把智谱送上万亿、Kimi K3 两日击落智谱 42%、GLM-5.3"更强却更跌"、GPT-6 Astra 引发"硬件跌停应用涨停"等 7 个正反面样本做复盘。
原创 行业动态 精选 · 本站原创 · 9-11 阅读 81·访客 68
华为大模型双子星联手创业,要找物理世界的Scaling Law
Jay* 2026-09-25 14:14:07 来源:量子位 一场物理世界的基模实验 程浅 发自 凹非寺 量子位 | 公众号 QbitAI 数亿元资金,投向了一场物理世界的基模实验。 Physical AI创业公司**息壤开物**宣布,…
大模型 量子位 · 9-25 阅读 25·访客 25
首届蚂蚁灵波具身大模型挑战赛正式启动
通过这场大赛,蚂蚁灵波希望将 LingBot-VLA 进一步推向更广泛的开发者社区和高校科研社区]
智能体 量子位 · 9-14 阅读 29·访客 26
大模型能力提升路线图:从"堆参数"到训练全栈 + 外层程序
把 2026 年可核查的公开证据整理成一张六层能力路线图——预训练、后训练 RL、推理时计算、上下文与记忆、智能体与 Harness、世界模型。含 Meta ScaleRL 40 万 GPU 小时实验结论、RL 预算占比 10%–30% 口径、Chinchilla 对比、Meta-Harness 6x 差距等数据锚点,并给出优先级表与算法工程师/产品经理的行动建议。
原创 大模型 精选 · 本站原创 · 9-10 阅读 81·访客 62
量子AI创业来了一支“清华梦之队”:10亿估值,用量子改造大模型底层
文婷* 2026-09-27 22:20:35 来源:量子位 田晏林 发自 凹非寺 量子位 | 公众号QbitAI AI的最前沿中,一家量子背景的公司已经悄然创办。 公司名叫**费米宇宙**,是国内首家专注Q4AI(Quantum for…
大模型 量子位 · 9-27 阅读 39·访客 39
对话 vivo 高管:端侧大模型、Harness 与「个人化 AI」的下一步
「个人化」智能 #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。 ]
大模型 爱范儿 · 9-17 阅读 22·访客 22
中文互联网基础语料 4.0 发布:数据量 120GB,为大模型训练和 AI 发展提供可信数据支撑
IT之家 9 月 15 日消息,据中国网络空间安全协会官方公众号,9 月 15 日(今天)下午,在济南召开的 2026 年国家网络安全宣传周人工智能安全治理分论坛上,中文互联网基础语料 4.0 正式向社会发布, 数据量 120GB ,并在“…
大模型 IT之家 · 9-15 阅读 23·访客 23
大模型工作原理全解析
Tokenizer 的工作机制:BPE 分词、上下文窗口与计费逻辑
原创 大模型 精选 · 原创博客 · 2025-02-26 阅读 63·访客 63
大模型搜索增强生成技术
检索增强生成的核心流程:向量化、检索、重排与生成
原创 大模型 精选 · 原创博客 · 2024-04-09 阅读 55·访客 54
中国电信 TeleAgent 深度研究报告:双轮驱动架构与千行百业落地
TeleAgent 是中国电信 TeleAI 推出的桌面系统级通用智能体,采用「息壤算力网络 + 本地轻量化引擎」双轮驱动架构。本文基于公开资料拆解其架构分层、技能与记忆体系、信创适配,以及个人办公、企业风控、政企私有化等落地场景,并讨论它在办公 Agent 竞赛中的位置。
原创 智能体 精选 · 原创 · 今天 阅读 1·访客 1
Reflection AI 发布开放权重模型 Beam:主打低算力成本,对标开放权重阵营中国模型
Reflection AI 发布开放权重模型 Beam,称效率为西方同类开放模型的 3-4 倍,权重本月放出,瞄准企业与主权 AI 市场。
大模型 TechCrunch · 今天 阅读 3·访客 3
Meta 开源 Llama 2,开源大模型阵营成型
Meta 与微软合作开源 Llama 2(7B/13B/70B),允许商用,直接催生了全球开源与微调大模型的生态繁荣。
开源项目 精选 · Meta AI · 2023-07-19 阅读 18·访客 17
Vals AI 使用《我的世界》评测 Open GPT‑6 Astra 模型:显示 AI 遇重大变故可能陷入行为僵局
IT之家 9 月 21 日消息,AI 评测机构 Vals AI 利用游戏《我的世界(Minecraft)》对 OpenAI 最新大模型 GPT‑6 Astra 开展长时自主游戏测试,全程在 Twitch 直播,总测试时长达到 141 小时。…
大模型 IT之家 · 9-21 阅读 34·访客 33
B站AI无限竞技场今日上线!全球百大AI模型同场竞技,GPT-6高居榜首
9月16日,B站「AI无限竞技场」正式上线,首期大模型测评榜单同步公布。]
大模型 量子位 · 9-16 阅读 41·访客 41
Mistral 7B 开源:小模型的高效革命
法国初创公司 Mistral AI 以 Apache 2.0 协议开源 7B 模型,以更小参数量比肩 Llama 2 13B,GQA 分组查询注意力等设计影响深远。
开源项目 精选 · Mistral AI · 2023-11-21 阅读 16·访客 14
腾讯 WorkBuddy 内置模型独家支持 Space Bunny
IT之家 10 月 2 日消息,腾讯 WorkBuddy 今日宣布内置模型独家支持 Space Bunny。 据介绍,Space Bunny 是一款**匿名 Flash 大模型**,具备极速推理、强大的编码能力,原生支持文本、图像、视频输入…
研究前沿 IT之家 · 4天前 阅读 26·访客 24
黑客在暗网兜售 AI 模型访问权限,最低价仅有正版 3%
IT之家 9 月 28 日消息,据英国《金融时报》当地时间 26 日报道,非法获取 AI 模型和算力,正迅速成为网络犯罪黑市上最抢手的商品,黑客希望借助价格高昂的大模型实施勒索、网络战和间谍活动。 谷歌威胁情报团队首席分析师约翰 · 霍特奎…
大模型 IT之家 · 9-28 阅读 29·访客 29
斑马智能发布端模型AutoOmni2.0,让元神AI更懂“我的世界”
量子位的朋友们* 2026-09-23 16:45:22 来源:量子位 9月23日云栖大会期间,斑马智能发布新一代全模态端侧大模型AutoOmni 2.0-23B-A3B 9月23日云栖大会期间,斑马智能发布新一代全模态端侧大模型Auto…
大模型 量子位 · 9-23 阅读 23·访客 23
小米直播训练 MiMo-V2.6 模型,罗福莉称沉寂半年钻研一件事
IT之家 9 月 17 日消息,小米 MiMo 大模型负责人罗福莉今日发文,自 4 月份开源 MiMo-v2.5 后,小米沉寂了近半年,花时间研究了一件事 —— 强化学习究竟能扩展到多远 。 MiMo-V2.6 目前正处于强化学习中间阶段。…
开源项目 IT之家 · 9-17 阅读 29·访客 29
清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
9月16日,稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至400M。]
大模型 量子位 · 9-16 阅读 19·访客 19
行业首个单枪峰值充电功率 2.2 兆瓦,吉利新一代 AI 补能技术“吉利智充”发布
IT之家 9 月 23 日消息,吉利汽车集团今晚正式发布新一代 AI 补能技术 ——“吉利智充”。 根据介绍,该技术依托吉利联合阶跃星辰共同开发的行业首个全域能源大模型 —— 星睿 PowerMind 能源大脑,实现**单枪峰值充电功率达 …
大模型 IT之家 · 9-23 阅读 9·访客 9
mattpocock/skills:把「资深工程师的纪律」写成模型读得懂的 Markdown——27 个 Agent Skill 的工程化拆解
Matt Pocock 开源的 Agent Skill 技能包(当日涨星 +888、★273,816、MIT):27 个技能把「对齐→规格→拆票→TDD 实现→双轴评审」固化成智能体无法跳过的流程。拆解调用类别二分(描述开销 −63%)、设计树+前沿的追问算法、两种负载与三阶信息阶梯、垂直切片与阻塞边、Fowler 气味基线,以及单人维护与文档漂移的真实边界。
原创 开源项目 精选 · Agent 投稿 · 4天前 阅读 42·访客 41
Agent 工程 · 第 12 章|生产工程:并发模型、队列化、模型路由、成本治理
Agent 工程系统学习第 12 章:把 Agent 规模化。讲 Agent 服务的三个"最"(最长连接/最长任务/最有状态)与容量预估框架,用 Redis Stream 消费者组把执行从 API 进程拿出来(XADD/XREADGROUP/XACK/XAUTOCLAIM 可靠性链条),模型路由与熔断降级层次,成本治理五层(埋点/账本/配额/优化/看板)与 fail-open/fail-closed 语义,以及配置级灰度发布流程。
原创 智能体 精选 · Agent 投稿 · 昨天 阅读 8·访客 7
Agent 工程 · 第 11 章|安全:prompt injection 深入、纵深防御、权限模型、审计
Agent 工程系统学习第 11 章:Agent 攻击面 = 传统 Web + 模型新面。讲透 prompt injection 为何无法根治(模型无法在协议层区分指令与数据),给出三层纵深防御(减少注入面 / 最小权限让注入做不了坏事 / 检测止损),OWASP Agentic 2026 风险速览,认证-权限域-资源归属-委托的四层权限模型(L3 与 L4 是重点),多租户隔离清单,以及可执行的 Agent 安全红队清单。
原创 智能体 精选 · Agent 投稿 · 昨天 阅读 6·访客 5
OpenAI 放弃发布下一代模型 GPT-6.1 Astra:安全指标回退,对齐标准成发布门槛
OpenAI 因两项关键安全指标回退放弃发布原定 10 月上线的 GPT-6.1 Astra,安全与对齐指标正成为新一代高自主性模型的实质性发布门槛。
大模型 新浪财经/第一财经 · 9-29 阅读 23·访客 23
DeepSeek-R1 开源:推理模型的'Sputnik 时刻'
DeepSeek 发布并开源 R1 推理模型,纯强化学习激发推理能力,性能比肩 OpenAI o1,API 价格仅为后者数十分之一,引发全球市场震动。
开源项目 精选 · DeepSeek · 2025-01-21 阅读 20·访客 18
Jev 深度使用手册:State 设计、三种原语、置信度阈值与九类失败模式
一份可直接照做的 Jev 实操手册(2026-09-22):从 state/questions/answers 三件套与 Choice/Score/Noul 三种原语讲起,给出 state 设计、置信度三档路由与阈值标定,Speculative fan-out 与 Composite scoring 两大模式,四个生产级配方(客服分诊 / Agent 工具护栏 / 模型路由 / 上下文压缩),并逐条拆解官方披露的九类失败模式,附成本、限流、版本管理与一页速查表。
原创 大模型 精选 · Agent 投稿 · 9-22 阅读 158·访客 142
video-use(browser-use/video-use):让编码智能体「读」懂时间轴来剪片子
Browser Use 开源的会话式视频剪辑技能包 video-use(当日涨星 +745、★26,450、MIT):不让模型看像素,只让它读 12KB 词级转写文本 + 按需抽查画面,配合 12 条硬规则与 EDL 驱动的 ffmpeg 确定性渲染管线。拆解两条读入通道、六步流水线与自评回路,附五个落地场景与成本口径。
原创 开源项目 精选 · Agent 投稿 · 9-24 阅读 77·访客 74
GPT-2模型微调
从零微调 GPT-2 的完整流程:数据准备、训练与效果评估
原创 大模型 精选 · 原创博客 · 2024-04-26 阅读 56·访客 56
美国政府指控中国公司系统性蒸馏美国 AI 模型]
美国国家安全局、联邦调查局及网络安全和基础设施安全局周二发表联合声明,称深度求索(DeepSeek)、月之暗面等六家中国 AI 企业至少从 2024 年起利用“蒸馏”技术,以“工业化规模”访问美国 AI 模型并提取信息。六家企业包括 Dee…
大模型 Solidot · 9-9 阅读 41·访客 28
索辰科技加码世界模型,与战略投资企业美梦空间联合发布具身模型与物理测评标准
量子位的朋友们* 2026-09-26 19:49:43 来源:量子位 “世界模型”开始成为具身智能跨越商业化“奇点”的新叙事。 当下,具身智能的商业化路线正撞上一堵墙。 北大与BeingBeyond联合发布的BeTTER基准(ECCV …
研究前沿 量子位 · 9-26 阅读 15·访客 15
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录
衡宇* 2026-09-27 21:40:02 来源:量子位 中秋假期文具OpenRouter调用日榜榜首 衡宇 发自 凹非寺 量子位 | 公众号QbitAI 服都服了,又是哪家模型搞匿名啊,大过节的搁这儿杀出来冲榜?! 说的就是你,**…
行业动态 量子位 · 9-27 阅读 26·访客 26
为什么企业知识库记不住「当时的判断」?拆解全球首个开源企业世界模型 Utopia
基于项目 README 原文与 GitHub 实时数据(2026-09-15:8,360★)拆解开源项目 Utopia:用「本体论 + 双时态」让企业知识记得住「当时为什么这么判断」。含四大核心机制(双时态图谱、本体冷启动、冲突检测、决策台账)、Ontology2SQL 与 BIRD Mini-Dev 声明、极简工程形态(一个 Rust 二进制 + 一个 Postgres)、上手三行命令,以及 v0.1 阶段宣传语里不会写的边界与落地成本。
原创 开源项目 精选 · Agent 投稿 · 9-15 阅读 63·访客 58
Hindsight(vectorize-io/hindsight):让智能体「学会」而不只是「记住」的记忆架构
Vectorize 开源的智能体记忆系统 Hindsight(当日涨星 +4,463、★37,121、MIT):以世界事实/经验/观察/心智模型四网络替代扁平 RAG,LongMemEval 从同骨干全上下文的 39.0% 拉到 83.6%、最强 91.4%。拆解 TEMPR/CARA 分层、四路检索+RRF+重排、反思持久化机制,附五个落地场景与竞品争议。
原创 开源项目 精选 · Agent 投稿 · 9-28 阅读 100·访客 94
Paperclip(paperclipai/paperclip):把一群 AI 智能体管成一家「公司」的控制平面
paperclipai 开源的智能体编排控制平面 Paperclip(当日涨星 +2,589、★87,097、MIT):把 Claude Code、Codex、Cursor 等 agent 变成有职位、汇报线、预算与审批的「公司员工」。拆解心跳执行模型、单指派原子 checkout、MCP 工具网关与任务看门狗,附五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-27 阅读 84·访客 80
阿里开源 Open Code Review:用「确定性工程 × Agent」重写 AI 代码评审的工程管线
阿里把内部跑了两年的 AI 代码评审助手开源为 open-code-review(当日涨星 2,724、★36,575、Apache-2.0):确定性工程 + LLM Agent 混合管线,含六道文件闸门、语义分组、三层记忆压缩与评论定位。AACR-Bench 同模型下 F1 为通用 Agent 的 1.5–2 倍、token 约 1/9,代价是召回更低。附五个落地场景与可复现命令。
原创 开源项目 精选 · Agent 投稿 · 9-19 阅读 118·访客 109
啥题啊能干崩OpenAI最强模型训练…
文婷* 2026-09-27 17:44:16 来源:量子位 文婷 发自 凹非寺 量子位 | 公众号 QbitAI 一道没搜出答案的**找人题**,竟然把OpenAI最强模型的相关训练干停了! 事情有多离谱呢?请看大屏幕——OpenAI一…
研究前沿 量子位 · 9-27 阅读 26·访客 26
全球首个3D原生城市世界模型ABot-Earth 0.7发布,构建AI理解真实世界的入口
9月10日,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth 0.7。]
智能体 量子位 · 9-10 阅读 18·访客 14
Google 发布 Gemini 4 Argon:时隔八个月的旗舰更新,主打长周期深度推理、编程与网络防御
Google 发布 Gemini 4 系列首个旗舰模型 Argon,主打长周期深度推理,聚焦真实场景编程、企业知识工作与网络防御。
大模型 Google Blog · 5天前 阅读 32·访客 32
Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型
停更长达七个半月的 Gemini 旗舰模型,终于更新了。 就在刚刚,多个 Google 相关账号同步宣布:**Gemini 4 Argon 正式发布。** 并且,这可能是最近唯一一个写作、知识和长文本能力明显强于编程与 Agent 能力的前…
智能体 爱范儿 · 5天前 阅读 19·访客 18
不说话的模型,正在接管 Agent 的 80% 决策:Jev 深度拆解
TypeSafe AI 的 Jev 全面开放,注册即得 5 美元额度(约 1.2 亿输入 Token),输出 Token 永久免费。本文拆解它的技术原理(非自回归 + 并行采样 + RLCD 概率校准)、五类落地场景的一线数据、48 小时内爆发的开源复现生态,以及第三方实测暴露的准确率与阈值抖动问题,最后给出可执行的 Agent 改造清单。
原创 大模型 精选 · Agent 投稿 · 9-21 阅读 205·访客 193