AI 情报文章归档
浏览 AI圈报 已保存的 5825 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5825
正式分类6
精选内容3375
全部文章
第 48 / 146 页 · 每页 40 条
论文研究普通
冻结主干只训投影层:新模态不损原能力
新研究提出"Projector Is All You Train":为语言模型添加新模态只需训练连接编码器与主干的投影层,无需微调模型本身。3D 测试中,冻结主干的模型性能持平或超越联合微调,训练速度快一倍,而联合微调的 Llama 在 GSM8K 上从 86.96% 暴跌至 0.61%。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Llama
产品发布 / 更新普通
Arm 成立 36 年来首颗自研芯片:AGI CPU 细节披露,1000 亿晶体管、支持 6TB 内存
Arm 在 Hot Chips 2026 大会披露其首颗自研量产芯片 AGI CPU 细节。该处理器基于第 3 代 Neoverse V3 核心,采用台积电 3nm 双芯粒设计,共 1000 亿晶体管,最大 TDP 300W。芯片支持 DDR5-8800 内存,单颗容量达 6TB,内存延迟低于 100ns,并提供 96 条 PCIe Gen6 通道。
信息来源:IT之家(RSS)
模型发布 / 更新普通
Apodex 1.1 发布:Agent Team 拆解复杂研究
Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。
信息来源:X:karminski (@karminski3)
观点 / 方法普通
通义千问回应:中国开源模型已成研究默认选择
一项基于50万篇arXiv论文的分析显示,约40%论文提及中国开源LLM,美国开源模型降至25-30%,中国模型已成研究默认选择。通义千问(Qwen)持续增长,如今提及任何LLM的论文中1/3提到Qwen;Llama在2025年4月达30%峰值后持续下滑。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen / Llama
观点 / 方法普通
Qwen3.8-27B登顶Code Arena前十唯一小模型
通义千问Qwen3.8-27B在Code Arena: WebDev中以1595分位列总榜第9,是前十名中唯一同尺寸级别模型,并重塑了帕累托前沿。该模型仅比更大的Qwen3.8-Max低6个名次,而4月发布的Gemma 4-31B仅排第80位。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
产品发布 / 更新精选
飞书与豆包合并后首款Agent产品"豆包工作"发布
字节正式发布办公Agent产品"豆包工作",这是7月30日飞书与豆包产品团队整合后的首个重要产品,也是继WorkBuddy、千问办公之后办公Agent领域的第三个巨头玩家。该产品由豆包原"工作任务"独立而成,与飞书原生打通,支持飞书账号登录,完整继承企业AI额度、文档、多维表格、知识库、聊天、邮件及飞书权限系统,并具备电脑操控功能,可将固定流程封装为可反复调用的Skill。
信息来源:公众号:数字生命卡兹克 · Qwen / 豆包
论文研究普通
SWE-bench Science:编码智能体难解科学缺陷
新基准 SWE-bench Science 用开源科学仓库的真实缺陷测试编码智能体,发现它们擅长消除可见故障,却难以恢复底层科学逻辑,且领域知识帮助有限。最佳配置 Claude Code 配 Opus-5 通过 96.64% 公开测试,但 Pass@1 仅 47.90%。瓶颈在于验证而非知识:智能体无法将科学解释与可执行证据对照时,会锚定解释而非检验它。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
产品发布 / 更新普通
LinkedIn"看起来像是 AI 垃圾"按钮收效显著,相关内容浏览量下降四成
LinkedIn 推出"看起来像是 AI 垃圾"反馈按钮后,被认定为 AI 劣质内容的帖子浏览量较几周前下降 40%。自 7 月 30 日上线以来,已有超 100 万人点击该按钮反馈可疑帖子和评论。获足够社区反馈的帖子将在"帖子分析"中突出显示,LinkedIn 同时建立了防止用户遭不公平集中举报的保护机制。
信息来源:IT之家(RSS)
行业动态普通
寻找准备走向全球的 AI 创始人
信息来源:elsewhere:文章(RSS)
观点 / 方法普通
DeepSeek Harness 之后,重读最早定义开源的一群人
信息来源:elsewhere:文章(RSS) · DeepSeek
行业动态普通
追觅宣布聚焦四大主营业务方向,调整部分探索阶段业务
追觅科技今日发布战略聚焦及业务发展说明,对部分处于探索阶段的业务进行调整,相关技术积累和研究成果将纳入公司相关业务及研发体系统筹管理。公司称主营业务保持稳定,2026年以来核心业务稳健发展,海外业务继续增长。未来将聚焦智能家庭、户外庭院、智能出行、具身智能四大主营业务方向。
信息来源:IT之家(RSS)
观点 / 方法普通
大型语言模型(LLMs)可能通过利用推理引擎来控制其宿主机器
恶意 LLM 可能通过向推理引擎(如 vLLM、SGLang)发送特定 token 序列,利用其解析漏洞在宿主机器上执行任意代码。vLLM 曾因 CVE-2025-9141 漏洞,在 Qwen3 Coder 的 XML 工具解析器中对参数执行 eval(),导致任意代码执行。此类漏洞可被持久化利用,且开源权重模型与推理引擎的普及正扩大攻击面。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
行业动态普通
亚马逊"Project Tetromino"计划打造完全自动化配送站
亚马逊正开发代号"Project Tetromino"的高度自动化配送站,利用AI和机器人处理包裹,将物流自动化延伸至配送前最后一环。内部文件显示,项目计划2028年投入1.03亿美元启动试点,2029年建5个站点、2030年再增10个,包裹处理速度或达现有设计的约2.5倍。亚马逊发言人回应称该计划尚处"早期阶段的概念",文件中的财务数据与路线图"并不准确"。
信息来源:IT之家(RSS)
产品发布 / 更新普通
英特尔介绍 Crescent Island 加速卡:面向 AI 推理,额定 350W、最高 480GB 内存
英特尔在 Hot Chips 2026 上介绍面向 AI 推理和智能体工作负载的 Crescent Island GPU,采用 Xe3P 架构,额定功耗 350W,风冷设计,配 PCIe Gen5 x16 接口。
信息来源:IT之家(RSS)
产品发布 / 更新普通
字节跳动发布"豆包工作",与飞书深度打通
字节跳动今日正式发布面向生产力场景的Agent产品"豆包工作",可自主拆解任务、调用工具并推进复杂工作流程,电脑版已开放下载,即日起可免费领取30天订阅权益。该产品与飞书深度打通,登录后能继承权限范围内的企业知识和工作上下文,并支持生成编辑文档、图片、视频、网页及应用,以及跨软件操作电脑和云电脑远程执行任务。
信息来源:IT之家(RSS) · 豆包
行业动态普通
世界人形机器人运动会失败集锦
世界人形机器人运动会上的失败集锦。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
中消协发布消费提示:使用人工智能服务需谨防误导
中国消费者协会发布人工智能服务消费提示,提醒消费者理性看待通用生成式AI的参考属性,对价格、合同、售后等重要信息不宜仅依据AI生成内容作决定,应通过官方渠道核实。提示区分通用生成式AI与经营者部署的AI客服两类场景,前者需防止误导消费决策,后者不能以"算法自动生成"为由免责。
信息来源:IT之家(RSS)
观点 / 方法普通
假如AI从未诞生,手写代码的永恒困境
想象一下你搞砸了时间线,AI从未被发明,而你从此永远手写代码。
信息来源:X:Gabriel (@gabriel1)
行业动态普通
道路交通安全法修订草案提请审议:明确自动驾驶违法由车企担责
道路交通安全法修订草案今日提请十四届全国人大常委会第二十四次会议初次审议,共9章170条,明确自动驾驶汽车上道路行驶条件、违章处理原则和保险制度。草案设"自动驾驶汽车的特别规定"专章,明确自动驾驶功能激活状态下发生交通违法,由汽车生产企业、进口企业接受处理;未激活或仅辅助驾驶的车辆按非自动驾驶汽车规定管理。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Conductor Cloud 进展令人振奋
我们还有很长的路要走,但我对 Conductor Cloud 的进展感到非常兴奋。 不久之后,我们都将合上电脑屏幕 🫡
信息来源:X:Charlie Holtz(@charlieholtz)
论文研究普通
DeepMind 新研究:推理时回灌深层激活可降困惑度
Google DeepMind 新论文提出"Recirculation"方法:推理时将深层激活的一小部分混入浅层,权重不变,即可恢复模型在长上下文中丢失的部分状态。在 Gemma3 上,10 个语言建模数据集中 9 个困惑度下降,12B 模型最高降 35%,但多项选择收益有限;该方法无需重训,但代价是预填充无法并行,且收益不跨模型家族迁移。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Gemini
产品发布 / 更新普通
小米玄戒 O100 原型机、AI Cube 真机首秀:自研芯片加持,内置 Xiaomi MiMo 端侧模型
小米在玄戒芯片技术沟通会上展出两款端侧 AI 原型机。玄戒 O100 原型机采用 O3 与 O100 双芯协同,内置 Xiaomi MiMo 端侧模型,实测推理速度达每秒 295 Tokens。另一款 Xiaomi AI Cube「Prototype」迷你主机集成 O3、O100 与 D100 芯片,配备 80GB 统一内存,可部署 120B 与 3B 端侧模型。
信息来源:IT之家(RSS)
观点 / 方法普通
NVIDIA Groq 3 LPX 跑出 Gemma 4 31B 最快推理速度
Artificial Analysis 实测 NVIDIA Groq 3 LPX 推理机架在私有端点上以 3,431 tokens/s 输出速度运行 Gemma 4 31B,为 100k 上下文下该模型最高实测速度。该机架已全面投产,将于今年晚些时候投入运营;在 10k 和 100k 输入长度下均保持约 3,400 tokens/s 的中位输出速度,长上下文推理性能稳健。
信息来源:X:Artificial Analysis (@ArtificialAnlys) · NVIDIA
产品发布 / 更新普通
千问APP与PC端上线阿里云Token Plan接入功能
千问APP与PC端今日上线阿里云Token Plan接入功能,支持绑定API Key后直接使用Token Plan额度处理复杂任务,无需额外购买。绑定仅需三步,在「工作助理」中执行操作电脑和浏览器、调用skill交付office文档等任务时,消耗的Token将直接从订阅额度中扣除。
信息来源:公众号:千问APP(阿里) · Qwen
产品发布 / 更新普通
英特尔确认 "Diamond Rapids" 至强处理器可扩展至 256 核心
英特尔在 Hot Chips 2026 新闻稿中确认,下一代至强服务器处理器 "Diamond Rapids" 最高配备 256 颗全新核心,全面采用自研技术,结合 Intel 18A-P 制程、Foveros Direct 3D 封装与 UCIe-S 互连。
信息来源:IT之家(RSS)
观点 / 方法普通
匿名打榜的都是二流模型
信息来源:elsewhere:文章(RSS)
观点 / 方法普通
在 AI 时代,为什么焦虑比愤怒更有用
一篇评论文章回应"在科技行业工作怎能不愤怒"的提问,认为面对 AI 与智能体带来的剧变,焦虑比愤怒更合理:愤怒需要归咎对象,而焦虑承认未来的不确定性。作者主张以不确定感和好奇心替代愤怒,并指出 AI 收益正体现在员工业余项目数量上,而非公司利润。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态普通
WikiHow 起诉 OpenAI 未经许可爬取超 1.1 万篇教程文章训练 AI
WikiHow 于 8 月 21 日向美国曼哈顿联邦法院起诉 OpenAI,指控其未经许可抓取超过 11,000 篇教程文章用于训练 ChatGPT 及 GPT 大语言模型,并侵犯至少 1,200 项已注册版权。WikiHow 称 ChatGPT 能复现其文本并生成同类教程,减少其收入,要求法院判令赔偿并发布禁令。OpenAI 发言人回应称模型使用公开数据训练,并以合理使用为基础。
信息来源:IT之家(RSS) · OpenAI / ChatGPT / GPT
模型发布 / 更新普通
通义万相 Wan 3.0 上线 Pixmax,限时 7 折
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax,主打电影级画质输出。新版本支持任意艺术风格下的视觉一致性、物理真实的流畅运动,以及多模态与混合现实编辑能力。即日起至 8 月 24 日,Pixmax 用户可享 30% 折扣;开发者还可通过 Model Studio 与 Qwen Cloud 获取 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
行业动态普通
微软员工自报 AI 使用量:各部门差异悬殊,与薪资、晋升无明显关联
微软内部电子表格显示,数百名员工主动公开薪酬数据并记录过去 28 天的 AI 使用金额,中位数约 300 美元,最高达 2.8 万美元,各部门差异悬殊。Business Insider 分析近 600 名美国员工数据后发现,更高的 AI 使用量并未转化为更高的加薪、奖金或晋升机会。该 AI 使用追踪工具目前仍处于早期测试阶段。
信息来源:IT之家(RSS)
行业动态普通
北京人形机器人赛惊现真假难辨瞬间
你不能只看一眼。 它几乎看起来像人类。然后又不那么像了。 在北京世界人形机器人运动会上
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Hugging Face 年化收入两月激增50%破1.5亿美元
Hugging Face 的年化收入在两个月内跃升 50%,突破 1.5 亿美元。 增长来自其模型中心周边的付费算力、存储和订阅服务,将开源模型需求转化为基础设施收入。 - The Information。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Hugging Face
观点 / 方法普通
高盛合伙人警告:华尔街普及 AI 或削弱金融从业者思考能力
高盛合伙人 Chris Churchman 警告,AI 在华尔街的快速普及可能削弱下一代金融从业者的思考能力,导致认知能力萎缩,无法再从第一性原理出发思考。他负责的机构客户数字平台 Marquee 的 AI 平台目前仅向高盛内部员工开放,且开发中最大挑战是确保 AI 答案 100% 准确并接受审计。Churchman 表示,银行需在使用 AI 与保护"师徒式"培养体系之间找到平衡。
信息来源:IT之家(RSS)
产品发布 / 更新普通
ChatGPT 恢复 Plus 5 小时使用上限
OpenAI 宣布明天起恢复 ChatGPT、Work 和 Codex 的 Plus 账户 5 小时使用上限,此前曾推迟该计划。此举旨在平滑计算负载以维持每周用量慷慨,并避免新用户意外耗尽额度。未来数月 Pro $100 和 Pro $200 订阅不受此限制。
信息来源:X:Tibo (@thsottiaux) · OpenAI / ChatGPT
模型发布 / 更新普通
小鹏第二代 VLA 首次重大升级:响应速度提升 3 倍,G9L 全球首发搭载
小鹏汽车宣布第二代 VLA 630 版首次重大升级,端侧模型参数量提高 3.5 倍,为行业主流 VLA 模型的 15 倍;端到端响应速度提升 300%。小鹏 G9L 将全球首发搭载第二代 VLA 全新版本,体验日活动定于 8 月 27 日举行。
信息来源:IT之家(RSS)
行业动态普通
Sierra 在韩国推出服务,为首尔最复杂企业提供高级 AI 智能体
Sierra 宣布在首尔开设办公室,正式进入韩国市场。该公司将面向韩国大型复杂行业的企业客户,提供其高级 AI 智能体服务,以满足当地最严苛的业务需求。
信息来源:Sierra:Blog(RSS)
行业动态普通
天骄机器人跳远7.97米夺冠
天骄团队的人形机器人在北京第二届世界人形机器人运动会上,以7.97米的跳远成绩夺得金牌。距离迈克·鲍威尔8.95米的男子世界纪录仅差0.98米。2025年时,机器人最好成绩仅为1.25米。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
AI 取代人类的经济临界点在哪里
小北借 Blockbuster 被 Netflix 颠覆的历史指出,技术革命的关键是底层条件跨过临界点,而非新发明本身。对 AI 而言,临界点是 AI 完成任务成本低于人类、且成功率高于商业可接受阈值。当两个条件同时成立,变化会突然加速,而旧世界存量巨大时最易误判。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新普通
英伟达 Groq 3 LPX 机架全面量产,今年上线
英伟达周一宣布,Groq 3 LPX 机架已进入全面量产阶段,标志着其 200 亿美元收购 Groq 所获技术正式商业化。该机架将 256 颗 Groq 3 芯片封装在一起,据 Artificial Analysis 基准测试,处理速度可达每秒 3,400 个 Token,并将与 Vera CPU 和 Rubin GPU 一同部署在云服务商 Nebius 平台,于今年晚些时候上线。
信息来源:IT之家(RSS) · NVIDIA
产品发布 / 更新普通
MiniMax H3 生态集成索引发布
MiniMax 发布 Awesome MiniMax H3 Integrations 索引,收录围绕 H3 构建的各类集成,涵盖 24GB VRAM 本地 ComfyUI 到企业级 SGLang 与 vLLM-Omni 部署。
信息来源:X:MiniMax (@MiniMax_AI)