AI 情报文章归档
浏览 AI圈报 已保存的 5733 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5733
正式分类6
精选内容3361
全部文章
第 34 / 144 页 · 每页 40 条
论文研究普通
Apodex 1.1 将执行环境作为智能体扩展新维度
Apodex 1.1 将任务状态置于模型消息历史之外,把可执行环境本身作为扩展面,而非仅给智能体增加工具。该模型在 GDPVal、FrontierFinance 和 FrontierScience-Research 上分别提升 9.3、5.6 和 8.3 分。其训练环境包含真实文件、搜索和代码世界,具备状态转换、工具预算、失败条件和任务级验证器,使训练分布包含完整工作轨迹而非仅提示词与答案配对。
信息来源:X:Rohan Paul (@rohanpaul_ai)
论文研究普通
PACE-Bench:动态物理环境下智能体代码自适应评测
清华NLP团队推出PACE-Bench,评测智能体在物理参数突变后修改代码重新适应的能力,含36个基础任务和144组源→目标环境对。最佳成绩为Reflexion+Qwen3-14B的35.9% Pass@2,GPT-5.5达66.7%但仍失败三分之一。基准显示,基于最新模拟结果的反馈比单纯"多思考"更有效,且更多信息并不能消除重新设计的瓶颈。
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · GPT / Qwen
模型发布 / 更新精选
GLM-5.3-Flash:前沿智能进入普惠时代
智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。
信息来源:智谱:研究(网页内嵌数据) · Claude / GLM
教程 / 实战普通
DAIR.AI 推出首个交互式 AI 智能体教程
学习 AI 智能体始于理解基础知识,然后动手构建。 我们推出首个交互式 AI 智能体教程,帮助你学习构建智能体技能。
信息来源:X:DAIR.AI (@dair_ai)
观点 / 方法普通
首个交互式AI智能体教程发布
很高兴推出我们的首个交互式AI智能体教程。 学习构建高效的智能体技能。 首先学习理论,然后在我们的新智能体游乐场中使用Pi构建技能。 接下来我应该覆盖哪个主题?
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
Qwen 开源 Qwen3.8-Flash-Next,SGLang 提供 Day-0 支持
Qwen 团队开源多模态 MoE 模型 Qwen3.8-Flash-Next,作为 Qwen4 架构的早期预览版。该模型采用 125B 参数主模型加 51B N-gram Embedding,每 token 激活 6B 参数,共 48 层,MoE 层使用 512 个专家和 top-10 路由。
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
观点 / 方法普通
宇树机器人股价暴跌45%,估值泡沫引质疑
宇树机器人上市首日股价飙升629.4%,市值一度达618亿美元,但一周内蒸发近半,目前较IPO高点下跌45%。公司虽有真实产品、工厂和利润,但投资者预期已远超技术现实。其股价已成为中国人形机器人行业的定价锚,STAR市场流动性稀缺与无涨跌幅限制加剧了投机波动。
信息来源:X:X.PIN (@thexpin)
模型发布 / 更新普通
通义千问发布 Qwen3.8-Flash,开源 Qwen4 架构早期预览
通义千问发布 Qwen3.8-Flash,作为 Qwen4 架构的早期预览并开源权重。模型总参数 125B 加 51B N-gram 嵌入,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,SWE-bench Pro 得分 62.5,反超 Claude Opus 4.6 Max 的 53.4。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Qwen / Claude
模型发布 / 更新普通
阿里发布 Qwen3.8 Flash 多模态 MoE 模型
阿里巴巴发布 Qwen3.8 Flash,一款 125B 参数的多模态 MoE 模型,原生支持 262K 上下文,可通过 YaRN 扩展至 1M。API 定价为每百万输入 token $0.16、输出 token $0.47。该模型基于新架构构建,是 Qwen4 架构的前身,在 DeepSWE 1.1 和 SWE-bench Pro 上分别得分 58.7 和 62.5。
信息来源:X:Testing Catalog (@testingcatalog) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 登顶六大动画评测
阿里云 Wan3.0 在六大动画类别评测中均排名第一,同时在写实视频生成方面表现优异。KoyalAI CEO Mehul Agarwal 从专业电影制作视角对其进行了测试,Wan3.0 现已上线 KoyalAI 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
Qwen3.8-Flash-Next 发布,SGLang 首日支持
通义千问发布 Qwen3.8-Flash-Next,SGLang 即日支持部署。该模型为 125B 主模型,含 51B N-gram 嵌入,每 token 激活 6B 参数。N-gram 嵌入几乎不增加计算成本即可扩展容量,并可通过异步预取驻留内存;GDN+QSA 混合注意力兼顾长任务效率与检索精度。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态普通
MiniMax:M3 Pro 参数规模预计提升至约 3T,大规模国产算力集群将很快上线
MiniMax 在中期业绩电话会上透露,M3 Pro 参数规模预计提升至约 3T,并将扩大强化学习和长程任务训练以提高泛化能力与智能上限。公司正推进 M3 和 H3 的国产芯片适配,大规模国产算力集群将很快上线并逐步承担真实生产流量。2026 财年上半年营业总收入 1.17 亿美元,同比增长 283.1%,亏损收窄 11%。
信息来源:IT之家(RSS)
行业动态普通
宇树"弟子"击败"师傅",世界人形机器人运动会自由搏击首金产生
第二届世界人形机器人运动会自由搏击赛项产生首金,40公斤级决赛中,华北电力大学赛队遥控操作宇树科技G1机器人,凭更优算法战胜宇树科技自家赛队夺冠。比赛使用相同机器人本体,比拼各队算法二次开发水平。该项目今年由表演赛升级为正式竞技项目,设40、58、80公斤级等多个组别,每场三回合、每回合2分钟。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Glean 发布 50+ 新功能,以企业上下文驱动 AI 任务执行
Glean 在 Glean:GO 大会发布 50+ 新功能,核心是将企业知识与模型、智能体结合,为每项任务匹配正确的信息和执行路径。其基准测试显示,相比 Claude Cowork,Glean 将 token 成本降低 81%,且 78% 的情况下更受青睐。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Claude
模型发布 / 更新普通
OxAlpha新模型挑战DeepSeek
OxAlpha 是来自中国 Z.ai 的 GLM 新迭代版本。 它将改变你快速运行长时智能体的方式。 --- bloomberg.com/news/articles/2026-08-26/china-s-z-ai-made-ox-alpha-stealth-model-that-rivals-deepseek 来源:X:Rohan Paul (@rohanpaul_ai)
信息来源:X:Rohan Paul (@rohanpaul_ai) · DeepSeek / GLM
观点 / 方法普通
机器人"大脑"初创公司正走出自己的 GPT-2 时代
物理 AI 领域正经历投资热潮与数据危机并存的阶段,开发者试图借鉴前沿 AI 实验室经验,通过更多数据、算力与强化学习场景推动模型进步。Antioch 创始人认为该领域仍处于"GPT-2 时代",而自动驾驶公司正凭借数据优势切入人形机器人赛道。业内对垂直聚焦与通用路线存在分歧,但普遍认为高质量训练数据是当前最大瓶颈。
信息来源:TechCrunch:AI(RSS) · GPT
行业动态普通
8.64 秒!天工 Ultra 再破人类百米世界纪录
北京人形机器人创新中心的天工 Ultra 在第二届世界人形机器人运动会 100 米(大型组)比赛中以 8.64 秒夺冠,再度超越人类世界纪录并包揽金银牌。该成绩比博尔特的 9.58 秒人类纪录快 0.94 秒,也是其继开幕式 9.39 秒、复赛 8.86 秒后第三次刷新纪录。团队通过升级关节电机、构型、散热及小脑控制能力实现提速。
信息来源:IT之家(RSS)
观点 / 方法普通
Perplexity 本地优先智能体:本地掌权云端参谋
Perplexity 推出 Portable Computer,一台运行 27B 模型的本地设备,能读文件、调工具、执行长期任务。针对小模型跑 Agent 易失忆的问题,它改写整套工作方式:说明写短、按需加载能力,文件与工具调度留在本机,需云端模型时先征询用户再发送必要内容。设计思路是本地模型负责执行与保管权限,云端模型仅作参谋。
信息来源:X:小北 (@frxiaobei)
模型发布 / 更新普通
Qwen3.8-Flash-Next 获 vLLM 首发支持
通义千问 Qwen3.8-Flash-Next 获 vLLM 首发(day-0)支持,已在 NVIDIA 和 AMD GPU 上验证。该超稀疏多模态 MoE 模型拥有 125B 总参数、6B 激活参数、262K 原生上下文(经 YaRN 可扩展至 1M),并附带可卸载的 51B N-gram 表。模型现可通过 `vllm/vllm-openai:qwen38-flash-next` 镜像运行。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · OpenAI / Qwen / NVIDIA
模型发布 / 更新普通
Recraft V4 Styles 上线 OpenRouter
Recraft V4 Styles 已在 OpenRouter 上线。 精确模式遵循纹理、构图、色彩和渲染,而不仅仅是整体外观。可使用来自其他生成器、品牌素材或现有资产的 1-10 个参考。 来自 @recraftai 的 Styles、Vector、Pro 和 Pro Vector 如下 ↓ https://openrouter.ai/recraft
信息来源:X:OpenRouter (@OpenRouter)
模型发布 / 更新普通
Qwen3.8-Flash-Next 获 SGLang 首发支持
非常感谢 @sgl_project 的首日支持!🙌 Qwen3.8-Flash-Next 今日即可通过 SGLang 部署。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态普通
Meta 因员工抵制与智能体表现不佳叫停 AI 裁员计划
路透社披露,Meta 曾计划以代号"Project OT"用 AI 替代更多岗位,将部分团队规模缩减至多 60%,由少数"人才密集"小组监督虚拟 AI 员工。5 月 19 日晚,CEO 马克·扎克伯格在首轮裁员前叫停原定 11 月的第二轮裁员。智能体未达预期生产力、投资者批评巨额 AI 预算及员工公开抵制促使计划逆转,内部士气评分从 74% 降至 55%。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新普通
Qwen3.8-Flash-Next:6B激活参数击败Claude Opus 4.6 Max
Qwen3.8-Flash-Next 正式发布,这是一款高度稀疏的 MoE 模型,总参数 125B 外加 51B N-gram 嵌入,但每个 token 仅激活 6B 参数。
信息来源:X:Kim (@kimmonismus) · Qwen / Claude
产品发布 / 更新普通
开发者用 MiniCPM4.1-8B 构建 ToneBridge 学中文应用
开发者 @jingzi_zhao_x 基于 MiniCPM4.1-8B 构建了 ToneBridge,一款面向中文学习者的 AI 助手,提供上下文感知的句子纠错与个性化学习。该应用聚焦自然表达、语气和社交语境,支持拼音、英文解释及音频播放,展示了小语言模型在教育领域的应用潜力。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
产品发布 / 更新普通
QueryStory 想让企业相信 AI 给出的答案
由前 Google 工程师 Shapor Naghibzadeh 联合创立的 QueryStory 今日走出隐身模式,旨在用 LLM 将企业复杂数据库的分析过程整合为有据可依的叙事,弥合企业对 AI 答案的信任鸿沟。
信息来源:TechCrunch:AI(RSS)
行业动态普通
Arga 为企业 AI 智能体构建更优训练环境
Arga 宣布完成 1000 万美元种子轮融资,由 General Catalyst 领投,Box Group、Emergence、Gradient 和 SV Angel 参投。该公司为 Salesforce、Workday 和邮件客户端等企业软件构建全尺寸数字孪生训练环境,保留权限系统和 web hooks,以便在多个系统间更稳健地训练 AI 智能体。
信息来源:TechCrunch:AI(RSS)
行业动态普通
商汤 2026 年上半年首次盈利:归母净利润 6.07 亿元同比扭亏转盈
商汤 2026 年上半年实现归母净利润 6.07 亿元,上市以来首次实现 IFRS 口径盈利,同比扭亏转盈。期内营收 29.11 亿元,同比增长 23.4%,毛利率提升至 41.4%;生成式 AI 收入 23.27 亿元,占总收入 79.9%,经常性收入 11.45 亿元,同比增长 124.4%。
信息来源:IT之家(RSS)
观点 / 方法普通
openclaw 读取日历报错:空值语义未定义
排查 openclaw 读取日历报错发现,上游因"今天没有日程"不生成文件,下游见"文件不存在"判为"读取失败",两边单看都没错,接起来却报错。问题本质是"没有数据、没拿到数据、读取失败"三种状态未提前定义,对系统而言都只是空值。AI 系统越复杂,组件间状态与异常定义越关键。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新普通
Glean 运行时路由降 81% token 成本
Glean 将"用多少智能"的决策移入运行时,其基准测试覆盖 180+ 企业任务,显示相比 Claude Cowork 可降低 81% token 成本,且 78% 情况下更受偏好。每查询成本 $0.58,对比 Claude Cowork 的 $2.98。该基准并非模型对模型,而是固定模型推理对比"上下文+路由"系统。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
模型发布 / 更新普通
Qwen3.8-Flash-Next发布,6B激活超越Claude Opus 4.6
Qwen3.8-Flash-Next正式发布,这是一款高度稀疏MoE开源多模态模型,总参数125B加51B n-gram嵌入,每token仅激活6B参数,原生256K上下文可经YaRN扩展至1M。
信息来源:X:Kim (@kimmonismus) · Qwen / Claude
模型发布 / 更新普通
阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9
阿里通义千问团队发布 Qwen3.8-Flash,这是一款 125B 参数的多模态 MoE 模型,每 token 激活 6B 参数,原生支持 262,144 tokens 上下文,并可通过 YaRN 扩展至 1M tokens。
信息来源:IT之家(RSS) · Qwen
行业动态普通
OpenRouter 神秘模型 Ox Alpha 确认为智谱 GLM-5.3 Flash
OpenRouter 近期上线的神秘模型 Ox Alpha 实为智谱 AI 的 GLM-5.3 Flash。该模型以零成本高性能登顶在线使用榜,被指可与 DeepSeek 竞争。
信息来源:X:Testing Catalog (@testingcatalog) · DeepSeek / GLM
行业动态普通
亲俄深度伪造视频让乌克兰议员"开口"求和
亲克里姆林宫的Telegram频道正传播两段AI生成的深度伪造视频,内容为乌克兰议员安德烈·列乌斯和伊万·尤纳科夫"哀叹战争并呼吁和平"。据NewsGuard报道,视频两周内获得13万次观看,并带有不自然眨眼、声音平淡等AI痕迹。此类伪造无论是否被识破,都会侵蚀公众对信息的信任。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新普通
通义千问发布 Qwen3.8-Flash,多模态 MoE 模型,Qwen4 架构早期预览
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览,现已开放权重。该模型总参数量 125B,每 token 仅激活 6B,原生上下文 262K,可扩展至 1M;训练成本仅为 Qwen3.7-Plus 的 1/9,并在编码和办公任务上表现更优。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
模型发布 / 更新精选
Qwen3.8-Flash-Next 开源:Qwen4 架构早期预览
通义千问开源 Qwen3.8-Flash-Next,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览。该模型采用 GDN + QSA 混合注意力等四项升级,总参数 125B,每 token 激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。
信息来源:Qwen:Blog Retrieval(API) · Qwen
行业动态普通
AMD 确认两款 Zen 6 处理器沿用 AM5 插槽:Olympic Ridge 与 Medusa1 亮相官网
AMD 官方文档确认两款 Zen 6 客户端处理器将沿用 AM5 插槽:面向台式机的 Olympic Ridge 与定位灵活的 Medusa1 APU。Olympic Ridge 可能首次在桌面端集成 NPU,并取消入门级核显;Medusa1 同时支持移动端 FP10 和桌面端 AM5。AMD 已将 AM5 支持周期延长至"至少 2029 年"。
信息来源:IT之家(RSS)
产品发布 / 更新普通
听力科技初创公司 Legato 携 1200 万美元融资及 AI 听力眼镜亮相
Legato 于周三走出隐身模式,获得 1200 万美元融资并首次展示其 AI 听力眼镜 Legato Frames。该眼镜将专利听力辅助技术集成于镜架镜腿,采用 AI 系统区分背景噪音与人声,仅放大说话声,预计今年秋季晚些时候上市。产品面向轻中度听力损失人群,售价将远低于传统助听器,并可能通过眼科诊所购买时享受视力保险报销。
信息来源:TechCrunch:AI(RSS)
行业动态普通
中国 Moonshot AI 与微软、亚马逊、谷歌洽谈云托管协议
中国 AI 初创公司 Moonshot AI 正与微软、亚马逊和谷歌洽谈收入分成协议,拟将其模型 Kimi K3 托管至 Azure、AWS 和 Google Cloud 平台,并向 K3 服务收取最高 30% 的收入分成。若达成,这将是首家与美国主要云厂商达成此类协议的中国 AI 公司。目前谈判尚处早期阶段,收入分成、数据访问及 token 使用追踪等问题仍未敲定。
信息来源:The Decoder:AI News(RSS) · Kimi
观点 / 方法普通
Cerebras CEO 谈 AI 加速器供应链三大瓶颈
Cerebras 联合创始人兼 CEO Andrew Feldman 指出 AI 加速器行业三大供应链瓶颈:HBM 内存、CoWoS 封装产能及台积电 3nm 制程。Cerebras 通过架构选择基本规避了全部三项--不依赖 HBM 和 CoWoS,当前芯片采用 5nm 制程而非 3nm。这使其供应链状况与主流 GPU 系统截然不同。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
去AI味最佳实践:角色锚定与节奏控制
阿易 AI Notes 用 Apodex 1.1 实测总结去AI味方法,核心是角色+场景锚定、长短句交替、禁止词清单、注入人味信号及多轮人工微调。Apodex 1.1 已开源多 Agent 架构(35B 权重+单机 harness),8 个 Agent 并行跑 AI 副业实测,满足 A 级证据标准的成功案例为 0,并支持本地部署。
信息来源:X:阿易 AI Notes (@AYi_AInotes)