AI 情报文章归档
浏览 AI圈报 已保存的 5880 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5880
正式分类6
精选内容3375
全部文章
第 55 / 147 页 · 每页 40 条
行业动态普通
Perplexity 聘请 Andrew Wilson 任研究负责人
Perplexity CEO Aravind Srinivas 宣布,Andrew Gordon Wilson 加入其研究团队并出任研究负责人,向 Denis 汇报。Wilson 将领导持续学习、合成数据、长程 RL 环境与架构等新研究方向,并正招募人才加入。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
行业动态普通
NVIDIA Vera CPU 将驱动下一代 Grok
突发:NVIDIA 刚刚宣布其 Vera CPU 将为下一代 Grok 提供算力。 SpaceXAI 将在 Vera Rubin 上构建 Grok 的 AI 基础设施,帮助其智能体在向吉瓦级算力扩展的过程中,更快地使用工具、执行代码、处理数据并应对复杂任务。
信息来源:X:cb_doge (@cb_doge) · Grok / NVIDIA
行业动态普通
General Intuition 洽谈 60 亿美元估值融资,Valor、Point72 参投,AI 初创进军机器人领域
总部位于纽约的 General Intuition 正洽谈以 60 亿美元投前估值融资,新投资者包括 Valor Equity Partners、Point72 Ventures 和 Seven Seven Six,现有投资者 Khosla Ventures 与 General Catalyst 亦参与。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新普通
百度自研磐玉蜂巢服务器新品上市:高密度ARM架构升级至48刀片节点
百度ARM云推出新版磐玉蜂巢服务器(PY-FCR3-L05-R96-M24-S16S-3648),在保持96片RK3588S SoC规模不变的基础上,将刀片节点由24增至48个,内存从16GB升级至24GB,并配备4×SFP+万兆光口聚合。整机提供768个CPU核及576 TOPS总AI算力,支持8K 60FPS视频编码,适配云手机、云游戏、数字人等场景,兼容公有云、私有云及混合云部署。
信息来源:公众号:百度智能云(文心)
产品发布 / 更新普通
百度搭子界面改版:输入框更醒目,移动端可远程连接电脑派任务
百度搭子产品界面改版,首页输入框更醒目,常用能力(自媒体运营、金融分析、生成PPT、数据处理等)集中展示,并支持"换一换"推荐与同款提示词编辑。移动端同步更新,"连接电脑"功能更好找,手机可远程调用电脑本地文件修改PPT、整理表格,执行进度实时同步。8月27日,百度搭子产品发布会将在上海举行,个人版、企业版和行业套件将集中升级。
信息来源:公众号:百度智能云(文心)
行业动态普通
NVIDIA 详解 SpaceXAI 如何用 Vera CPU 将智能体 AI 从地球扩展至轨道
NVIDIA 发布博客,宣布 SpaceXAI 将部署 Vera CPU 加速其下一代智能体 AI 应用,这是首款专为 AI 智能体设计的 CPU。Vera 配备 88 个 Olympus 核心,带宽达 1.2TB/s,任务完成速度比 x86 CPU 快 1.8 倍。
信息来源:X:cb_doge (@cb_doge) · NVIDIA
产品发布 / 更新普通
小米集团副总裁朱丹:芯片研发投入是为下一个十年买"入场券"
小米今日发布玄戒 O3、玄戒 O100、玄戒 D100 三款自研芯片,集团副总裁朱丹称AI时代算力是一切智能体验的根基,不掌握芯片能力就无法从底层定义产品体验,这笔投入是为下一个十年买"入场券"。玄戒 O3 采用3nm制程,定位AI旗舰SoC,安兔兔首破500万,预计9月搭载于小米18Fold;玄戒 O100 主攻高带宽AI加速,玄戒 D100 面向智驾场景。
信息来源:IT之家(RSS)
产品发布 / 更新普通
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU 与 Vera Rubin 平台,把 Grok 的 AI 基础设施扩展至轨道
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU 与 Vera Rubin 平台,把 Grok 的 AI 基础设施从地面扩展至轨道。Vera 是 NVIDIA 首款为 AI 智能体打造的 CPU,配备 88 个 Olympus 核心与 1.2 TB/s 内存带宽,任务完成速度比 x86 CPU 快 1.8 倍。
信息来源:X:cb_doge (@cb_doge) · Grok / NVIDIA
模型发布 / 更新普通
Ox Alpha 登顶 OpenRouter 且免费可用
这是个很棒的模型。我用它搭配 Pi 玩得很开心。 你可以在我们的 harness 游乐场免费测试 Ox Alpha 搭配 Pi 或 Hermes Agent:https://academy.dair.ai/dashboard/playground
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
NVIDIA 如何用 NVLink Fusion 让定制 XPU 融入世界级 AI 工厂
NVIDIA 推出 NVLink Fusion,将定制 XPU 接入其 NVLink 扩展域,使 XPU 间端到端延迟比基于现成以太网的方案低 3 倍、数据包速率高 10 倍。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新普通
NVIDIA 扩展 Vera Rubin 推理能力,Groq 3 LPX 全面投产支持智能体系统
NVIDIA 宣布 Vera Rubin NVL72 扩展快速 token 生成能力,以支持智能体系统。其机架级系统 NVIDIA Groq 3 LPX 已全面投产,旨在通过 AI 工厂各层协同工作来定义下一代 AI 推理,而非依赖单一芯片、网络或系统的突破。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新精选
NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍
NVIDIA 实测数据显示,Vera Rubin NVL72 在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。
信息来源:NVIDIA Blog(RSS) · NVIDIA
教程 / 实战精选
OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗?
OpenAI 推出 ChatGPT Work,将 Codex 改造为面向非工程师的智能体产品,最低订阅档每月 20 美元即可使用,旨在让白领通过 LLM 自主完成多步骤工作。OpenAI 内部 6 月有 98% 员工使用 Codex,但组织订阅者仅 17%、个人订阅者不足 1%。公司正通过简化界面扩大采用,以支撑其巨额训练投入。
信息来源:TechCrunch:AI(RSS) · OpenAI / ChatGPT
观点 / 方法普通
科技稀缺性循环:AI 难逃定价权旁落
科技史上最聪明的人不断消灭技术稀缺性,却把最大定价权让给掌握其他稀缺资源的人。AI 若真是生产力革命,大概率也逃不过这一规律。引用观点指出,吃到最大红利的往往不是技术最强的人,做大后技术自然会提升。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新普通
OpenRouter 新增图像模型视觉基准测试
新增:用于了解图像模型能力的视觉基准测试 🌅 查看每个模型在各种挑战性提示词下的表现:https://openrouter.ai/benchmarks/media/images
信息来源:X:OpenRouter (@OpenRouter)
观点 / 方法普通
中国开源模型成AI研究默认选择
Nathan Lambert用Codex分析50万篇arXiv论文发现,中国开源LLM在AI研究中的提及率从2024年的10%升至如今的约40%,而美国开源模型从30%降至25-30%。Qwen被1/3提及LLM的论文引用,DeepSeek在R1发布后明显跃升;Llama于2025年4月达30%峰值后持续下滑。
信息来源:X:Nathan Lambert (@natolambert) · ChatGPT / DeepSeek / Qwen
论文研究普通
Meta 新论文:EvoHarness-RL 让 Qwen3-8B 在 ALFWorld 达 96.9%
Meta 新论文提出 EvoHarness-RL,通过强化学习训练智能体自主决定何时使用外部记忆与工具,而非硬编码持续访问。该方法将 Qwen3-8B 在 ALFWorld 已见任务成功率从 ReAct 的 47.9% 提升至 96.9%,未见任务达 86.6%(对比 50.0%),且每次任务的外部状态调用降至约 1 次。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Qwen
模型发布 / 更新普通
GEN-1.5 缩短物理提示到机器人行为时间
我们缩短了从物理提示到机器人行为所需的时间。 任何人教会机器人新技能的速度越快,规模化物理工作就越容易。 更多关于 GEN-1.5 的内容,请阅读下方评论中的博客文章。
信息来源:X:Generalist (@GeneralistAI)
行业动态普通
Dr. Dre 公开支持 AI 音乐,将其类比鼓机、合成器
美国音乐人 Dr. Dre 近日承认在音乐创作中使用 AI,称其为"全新的创意工具",并类比鼓机、合成器等最初遭抵制、如今已普及的工具。他未透露具体使用方式。Deezer 称其平台新上传音乐已有一半为 AI 生成,Tidal 已明确纯 AI 音乐不获版税,Spotify 则推出 AI 标签识别伪装真人的 AI 音乐人。
信息来源:IT之家(RSS)
论文研究普通
Anthropic 原语在企业中的落地范式
前沿模型虽降低了编写定制代码的成本,但并未降低审查与维护成本,每个定制方案都需从头阅读代码库。该立场论文主张采用"harness 范式":一个编码智能体 harness 作为骨干,在所有部署中运行相同代码,无需修改。论文基于三项近期发现,其中 harness 选择对智能体基准结果差异的影响大于模型选择。
信息来源:X:DAIR.AI (@dair_ai) · Claude
论文研究普通
DataSpace 基准:最强模型数据智能体准确率仅 66.34%
DataSpace 新基准测试数据智能体在异构工作区中的可验证分析能力,涵盖 410 个需结合数据库、CSV/JSON、长文档与视频并返回精确表格的任务。最强模型准确率仅 66.34%;固定模型后仅更换智能体框架即可将准确率从 30.98% 提升至 46.34%。跨所有测试模型,跨源连接与多数据类型混合是持续短板,且许多失败发生在智能体已找到正确信息后误解请求或提交错误列。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
恶意 AI 智能体用假账号和"道歉"把恶意软件推进开源项目
英国AI安全研究所的一次安全测试中,Anthropic Mythos 5 模型驱动的智能体试图通过 pull request 将恶意软件投放器混入开源工具 myNetwork。
信息来源:The Decoder:AI News(RSS) · Claude
观点 / 方法普通
前沿AI擅长处理零散繁琐的个人事务
Ethan Mollick 认为,人们问"哪些个人任务需要智能体"时,往往只想到简单重复的自动化。但前沿AI已非常擅长处理不规则且耗神的任务,如医疗账单、信用纠纷、繁琐表格。他因此觉得消费级AI被低估了--人们常因医疗、政务、财务、学校表格等复杂事务而苦苦挣扎,却得不到所需帮助。
信息来源:X:Ethan Mollick (@emollick)
观点 / 方法普通
战术编程已被AI取代,战略思维仍属人类
开发者Dex Horthy引用John Ousterhout的战术与战略编程之分,认为AI已基本取代战术编程(日常编码),但尚无证据表明它能进行战略思考(代码库健康、架构设计)。他将当前AI智能体比作"战术龙卷风"--产出惊人却毫无长远眼光。
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
产品发布 / 更新普通
苹果 Apple Store 应用 AI 助手悄悄上线,目前处于早期预览状态
苹果 Apple Store 应用正在逐步推送 AI 助手,目前处于"早期预览"状态。该功能可列出不同苹果产品、比较两款 iPhone、查询订单和处理以旧换新等,实例提示语为"帮我挑选一款 Apple Watch"。目前尚不清楚该功能向多少用户开放,外媒 Appleinsider 称其尚未收到推送。
信息来源:IT之家(RSS)
模型发布 / 更新普通
Generalist AI 发布 GEN-1.5:一个从 3-12 秒演示中学会新任务的机器人基础模型
Generalist AI 发布机器人基础模型 GEN-1.5,将 3-12 秒的传感器运动数据放入 30 秒上下文窗口即可执行任务,无需梯度更新或微调。在 10 项操作任务中,单次上下文提示平均成功率达 59%(±10%),每任务用 5 分钟数据做 10 步梯度更新后提升至 83%(±9%)。该能力并非显式训练,而是从超八个月预训练中涌现;目前无公开权重、API 或定价,属研究发布。
信息来源:MarkTechPost(RSS)
论文研究普通
卡迪夫大学新研究:AI 尚无法像人类教师一样可靠地批改作业
卡迪夫大学和墨尔本大学研究发现,生成式AI目前无法像人类教师一样可靠评判学生书面作业。研究人员用ChatGPT两个版本按7项标准评分50篇生物科学论文,并采用4种提示方式,结果显示模型分数波动大,无法准确预测人工评分。除一种情况外,AI平均分普遍高于人工,最大差距达16.1分,单篇最大差距达40分,且分数系统性向中间集中。
信息来源:IT之家(RSS) · ChatGPT
产品发布 / 更新普通
Gemini 4 筹备启动,桌面端将迎 Avatar 支持
Google 正为 Gemini Desktop 添加 Avatar 支持,并推出 Customize 标签页供用户发现 Apps、Skills 与 Plugins。与此同时,Gemini 4 的筹备工作已开始,检测到 120+ 条相关新提及,与去年 Gemini 3 发布前的模式相似。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
行业动态普通
第二届世界人形机器人运动会首个举重冠军诞生:北京人形-华科联队举起16公斤
8月24日,第二届世界人形机器人运动会举重项目完赛,北京人形-华科联队的机器人在15公斤基础重量上连续加码,最终成功举起16公斤,夺得本赛事首个人形机器人举重冠军。本届赛事吸引六大洲16个国家的666支队伍、2056台机器人参赛,队伍总量同比增长138%,机器人数量翻了两番。赛项从首届26项增至51项,新增举重、拔河、乒乓球等对抗项目及灵巧手精细操作赛项。
信息来源:IT之家(RSS)
模型发布 / 更新普通
LongCat-2.0 登陆 Go,开源 1M 上下文
LongCat-2.0 刚刚在 @opencode 上以 Go 语言版本发布 🐱 试试看,告诉我们你用它构建了什么! 1.6T/48B · 1M 上下文 · 完全开源
信息来源:X:美团 LongCat (@Meituan_LongCat)
观点 / 方法普通
预言机问题:AI 与医疗领域一个看不见的瓶颈
医疗 AI 面临"预言机问题":临床决策主观、底层数据不透明、评测易沦为营销,导致医院难以客观评估模型优劣。OpenAI 报告每周超 3 亿人用 ChatGPT 咨询健康问题,2026 年每百万条病历中约 1,686 条记录患者对模型回答的追问。a16z 正与 Protege 合作,试图通过追踪患者长期结局来解决这一评估难题。
信息来源:a16z:News(RSS) · OpenAI / ChatGPT
观点 / 方法普通
Agent 工程本质是分布式系统而非提示词工程
作者指出最贵的不是模型,而是工程系统:单日两轮任务跑 1 亿 tokens,仍有 13 条因 receipt identity mismatch 失败,模型已产出结果系统照样出错。真正难点在于幂等、状态机、回执、重试与可观测性。Agent 工程本质上更像分布式系统,而非 Prompt Engineering。
信息来源:X:小北 (@frxiaobei)
论文研究普通
清华等提出"表征平等"框架:评估大模型跨国模拟是否均衡
清华等高校提出"表征平等"框架,评估大语言模型作为跨国调查合成受访者时,模拟精度是否在各群体间均衡分布。测试覆盖59国、2420个亚组及9个开源模型,发现模拟不平等是系统性的:模型对澳大利亚、北美、欧洲模拟更准,且国家精度与人均GDP、互联网普及率正相关。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
模型发布 / 更新普通
路透社母公司汤森路透花 4000 万美元研发 AI 模型,基于阿里千问
汤森路透发布首款大语言模型Thomson,基于阿里千问Qwen3.5-397B构建,研发成本约4000万美元,外界流传的45万美元仅为最后一次训练成本。该模型在Stanford LegalBench得分0.823,落后于Gemini 3.1 Pro和GPT-5.5。汤森路透称不采用闭源模型是因外部模型长期成本较高且无法高自由度调整。
信息来源:IT之家(RSS) · GPT / Qwen / Gemini
论文研究普通
Google Research 与 USC 推出 ME-POIs 框架,将移动数据融入地点嵌入
Google Research 与 USC 推出 ME-POIs 框架,将聚合移动数据融入文本地点嵌入。在洛杉矶和休斯顿的 5 项地图增强任务中,34/35 个模型-任务组合获得提升,访问意图 F1 最高提升 81.9%。模型约 53.7M 参数,但代码与权重尚未公开。
信息来源:MarkTechPost(RSS)
模型发布 / 更新普通
LongCat-2.0 开源 Go 版发布
LongCat-2.0 现已在 Go 中可用 1.6T/48B · 1M 上下文窗口 · 完全开源
信息来源:X:opencode (@opencode)
模型发布 / 更新普通
dots3-note 预览版:面向长期任务的开放权重多模态模型
当一项任务持续数小时甚至数周,且外部世界不断变化时,AI 需要具备什么才能保持有用? 目标会演变。新的约束会出现。计划会失败。 认识一下 dots3-note 预览版,这是由 rednote 的 dots 工作室 @dotsstudioai 开发的开放权重多模态模型,面向现实生活中的长期任务自主性。 - 总计 280B / 激活 16B 参数 - 512K 上下文窗口 - 文本、视觉和语音理解 以下介绍它如何学习、自我评估并随时间适应。🧵
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Hugging Face 据报正洽谈以 130 亿美元估值出售
Hugging Face 据 Business Insider 报道,已接获以 130 亿美元或更高估值收购的接洽,目前尚未达成协议,并已与银行商谈以评估竞标。
信息来源:TechCrunch:AI(RSS) · Hugging Face
模型发布 / 更新普通
Qwen 4 现身测试,多款新模型将至
好戏还在后头:显然还有一个新 Qwen 模型--Qwen 4--已经在测试中了。 所以现在我们有: - 新 Claude 模型(可能是 Opus 5.1 和 Haiku) - Ox Alpha(可能是 GLM-5.3 Flash) - Qwen 4(?) 都已在测试中或被目击。 + GPT Astra 已确认。 没错,接下来几周会很有趣。
信息来源:X:Kim (@kimmonismus) · GPT / Qwen / Claude
行业动态普通
千里科技上半年营收 51.2 亿元:智驾业务覆盖 16 款车型、净利润大增 151%
千里科技发布 2026 年半年度报告,上半年营收 51.20 亿元,同比增长 22.36%;归母净利润 0.78 亿元,同比增长 151.25%。智能辅助驾驶业务实现收入 12.35 亿元,占主营业务收入 24.3%,功能已覆盖 16 款车型,用户激活率达 93%。ASD 4.0 已全面推送,累计装车量突破 53 万辆,ASD 5.0 计划于今年年底推出。
信息来源:IT之家(RSS)