AI 情报文章归档
浏览 AI圈报 已保存的 5794 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5794
正式分类6
精选内容3375
全部文章
第 44 / 145 页 · 每页 40 条
产品发布 / 更新普通
OpenAI 与博通共研的 Jalapeño 推理芯片亮相,称性能超越英伟达 GB300
OpenAI 在 Hot Chips 大会公布与博通共研的推理芯片 Jalapeño 首批基准测试成绩,在 SemiAnalysis InferenceX 测试中,其单用户 token 处理量和每千瓦吞吐量均超过现有顶尖推理处理器。
信息来源:IT之家(RSS) · OpenAI / NVIDIA
模型发布 / 更新普通
阿里千问预告明晚开源基于下一代 Qwen4 架构的多模态 MoE 模型 Qwen3.8-Flash-Next
阿里千问将于北京时间 08 月 26 日 23:00 在魔搭社区开源 Qwen3.8-Flash-Next 及 Qwen3.8-Flash-Next-FP8 两个版本。该模型是基于下一代 Qwen4 架构构建的多模态 MoE 模型,官方提前发布架构改进,以便社区为完整 Qwen4 模型家族做好准备。
信息来源:IT之家(RSS) · Qwen
行业动态普通
Gatik AI 完成 1 亿美元融资,无人驾驶货运商业化提速
自动驾驶卡车公司 Gatik AI 完成 2 亿美元 D 轮融资,估值达 10 亿美元,投资方包括卡塔尔投资局(QIA)、ARK Invest 等。公司已累计完成超 10 万次完全无人驾驶订单,准时交付率达 99% 以上,签约收入达 6 亿美元,百事可乐(PepsiCo)等客户已在实际业务中依赖其无人驾驶货运服务。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Gatik 无人驾驶货运运营透明度提升
Gatik 使其无人驾驶货运运营更加透明,用户现可实时查看所有在途卡车动态,并观看其客户供应链内部拍摄的视频系列。该公司近期完成由 QIA 和 Koch Disruptive Technologies 领投的 2 亿美元 D 轮融资,估值达 10 亿美元,百事等客户已在使用其服务。
信息来源:X:Testing Catalog (@testingcatalog)
模型发布 / 更新普通
Qwen 3.8-Flash-Next 将于明天发布(125B a6B)
通义千问(Qwen)宣布 Qwen 3.8-Flash-Next 将于明天发布,该模型参数规模为 125B a6B。模型页面已上线 ModelScope 平台,引发 Hacker News 社区关注,目前获得 103 个 HN 点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
产品发布 / 更新普通
Prime Intellect 开源自我改进框架 Prime Agent
Prime Intellect 推出开源自我改进框架 Prime Agent,面向长时程智能体任务。其持续 IPython REPL 让模型以编程方式处理自身上下文,Continual Harness 跨轨迹保留历史、记忆、技能与提示词,使改进持续累积。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
OpenAI自研推理芯片Jalapeño在速度和能效上超越英伟达GB200和GB300
OpenAI称其首款自研推理芯片Jalapeño在速度和能效上已超越英伟达GB200和GB300系统。在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T模型上,Jalapeño在峰值吞吐下每瓦特AI工作量提升1.5-1.9倍,端到端延迟降低1.7-3.6倍;高交互负载性能提升2.1-4.1倍。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / DeepSeek
产品发布 / 更新普通
Prime Agent:开源自改进智能体框架发布
Prime Intellect 发布开源自改进智能体框架 Prime Agent,通过持久 IPython REPL 和 Continual Harness 实现跨轨迹累积改进。同模型下 ARC-AGI-3 RHAE Best@1 从 30% 提升至 95.5%,并在长上下文编码、GPU 内核生成等任务上匹配或超越原生框架。
信息来源:X:DAIR.AI (@dair_ai)
行业动态普通
Gatik 获 2 亿美元融资,无人驾驶货运加速
Gatik 完成 2 亿美元 D 轮融资,估值达 10 亿美元,由 QIA 和 Koch Disruptive Technologies 领投。该公司已在得州、亚利桑那、阿肯色和加拿大实现每日无人驾驶中程货运,超 10 万次交付零安全员,准时率超 99%,现有合同收入超 6 亿美元。资金将用于扩充现有线路车队,以满足超出供给的客户需求。
信息来源:X:Kim (@kimmonismus)
产品发布 / 更新普通
OpenAI Jalapeño 芯片能效达 GB300 的 104 倍
OpenAI 称其新 Jalapeño 芯片在匹配 DeepSeek R1 解码速度下,每千瓦吞吐量达 NVIDIA GB300 的 104.3 倍(12258 对 118 tokens/s/kW)。该芯片功耗 700W,低于 GB300 的 1400W,计划年底部署,Gen 2 已在开发中。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / DeepSeek / NVIDIA
模型发布 / 更新普通
商汤 SenseNova U1.5 Lite 开源并上线 Token 计划
商汤 SenseNova U1.5 Lite 已开源并上线 Token 计划,提供免费公开测试版,每 5 小时可享 1,500 次请求。该模型支持图像生成与编辑一体化,具备参考图驱动创作、复杂指令跟随、原生 2K/4K 输出及自动提示词优化等能力。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
产品发布 / 更新普通
OpenAI Jalapeño 芯片基准测试显示:为大规模快速推理而生
OpenAI 在 Hot Chips 大会上公布自研推理芯片 Jalapeño 的首批基准测试结果。在 Semianalysis 的 InferenceX 基准上,Jalapeño 每用户 token 数和每千瓦吞吐量均超过当前最先进的 Nvidia Blackwell 系统。该芯片由 OpenAI 与 Broadcom 合作开发,预计 2026 年底小规模部署,2027 年更大规模上线。
信息来源:TechCrunch:AI(RSS) · OpenAI / NVIDIA
产品发布 / 更新普通
WorkBuddy 接入 Notion 工作区
WorkBuddy 现已连接 @NotionHQ。 将你散落在 Notion 工作区的文档、笔记和知识,汇入 WorkBuddy 中的答案与操作。 你的工作区变得更加互联。
信息来源:X:Tencent WorkBuddy (@WorkBuddy_AI)
观点 / 方法普通
OpenAI Jalapeño 自研芯片优于英伟达
OpenAI Jalapeño:优于英伟达 Blackwell OpenAI 自研 ASIC 与 Rubin 对比,Jalapeño 的 TCO、每 MW 吞吐量,以及火辣细节 https://newsletter.semianalysis.com/p/openai-jalapeno-better-than-nvidia
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI / NVIDIA
观点 / 方法普通
摩根大通看好 SpaceX 与 Grok 4.6 前景
摩根大通维持对 SpaceX 的增持评级,称对 Grok"越来越乐观",并预计 Grok 4.6 以显著低于同行的成本提供前沿智能。该行估计 Cursor 年经常性收入约 40 亿美元,其数据已让近期 Grok 模型出现"切实改进"。摩根大通预计 2026 年底前每月发布新模型,12 月推出的 Grok 5 将带来重大性能提升。
信息来源:X:cb_doge (@cb_doge) · Grok / Cursor
行业动态普通
腾讯相关人士回应"IEG 重组 AI 游戏部门":报道大量失实,"成立新部门"系误读
针对"腾讯互动娱乐事业群(IEG)重组 AI 游戏部门"的报道,腾讯相关人士回应称内容存在大量失实,所谓"成立新部门"系误读。该人士表示,游戏技术公线本就设有游戏 AI 引擎部,长期对外招募 AI 专业人才,聚焦游戏研运管线的 AI 提效与玩法创新。
信息来源:IT之家(RSS)
观点 / 方法普通
a16z 分享幻灯片:智能是原语,应用是扩散层
a16z 发布由 Danco 制作的幻灯片《Intelligence is the Primitive. Applications are the Diffusion Layer》,原为面向小范围受众准备。幻灯片概述了当前应用层与消费级应用的总体态势,并称若反响良好将定期发布此类内容。
信息来源:a16z:News(RSS)
观点 / 方法普通
超大规模厂商明年资本支出或超万亿美元
我们看到超大规模厂商在资本上投入了大量资金。 他们正在购买土地、购买大量设备、在全球各地雇佣建筑承包商,而这笔投入明年将达到或超过一万亿美元的资本支出。
信息来源:X:SemiAnalysis (@SemiAnalysis_)
观点 / 方法普通
MiniCPM5-1B 双 LoRA 定制化智能助手
开发者 JacobLinCool 为 MiniCPM5-1B 定制两个 LoRA 适配器,将其改造为面向不同项目流程的专用 AI 助手。一个 LoRA 使其成为创意顾问,辅助探索相关项目、对比相似案例与规划方案;另一个 LoRA 使其成为竞赛分类器,分析 README 与代码以识别赛道、奖项及完成状态。该项目展示了轻量微调结合任务适配如何解锁小模型的专用潜力。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
产品发布 / 更新普通
OpenAI 称其 Jalapeño 芯片推理响应速度优于竞品
OpenAI 发布博客称,其与 Broadcom 合作打造的 AI 推理芯片 Jalapeño 在 InferenceX 基准测试中,性能优于 Nvidia GB200/GB300 超级芯片。
信息来源:The Verge:AI(RSS) · OpenAI / NVIDIA
行业动态普通
Anthropic 因罢工警告让旧金山员工居家办公
Anthropic 在收到罢工警告后让旧金山员工回家。该指令覆盖周一和周二,此前承包商 Allied Universal 警告 Anthropic,其保安可能罢工。 - businessinsider 但代表保安的 SEIU 工会对这一警告提出了异议。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
产品发布 / 更新普通
苹果正式推出 M5 Ultra 芯片,最高 36 核 CPU/80 核 GPU,1.2 TB/s 统一内存带宽
苹果今日在新款 Mac Studio 中推出 M5 Ultra 芯片,首次采用 UltraFusion 技术构建四芯片架构,最高 36 核 CPU、80 核 GPU,统一内存带宽达 1.2 TB/s,比 M3 Ultra 高出 50%。该芯片 AI 峰值 GPU 计算性能较 M3 Ultra 最高提升 4.5 倍,支持 512GB 统一内存,可在设备端运行参数量达数千亿的大语言模型。
信息来源:IT之家(RSS)
论文研究普通
AutoSaddler:自动优化智能体框架的微软新论文
微软等机构提出 AutoSaddler,将智能体框架视为代码,通过失败轨迹离线自动生成补丁,优化提示词、工具配置和控制逻辑。在 GAIA2、SWE-Bench Pro、Terminal-Bench 2.0 上分别提升 9.0、9.6、10.0 分。研究显示深度调试优于浅层反思,定向编辑优于无约束编辑。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
苹果推出M6与M5 Ultra芯片,将更多AI推理移至Mac桌面端
苹果推出M6和M5 Ultra芯片,将更多AI推理移至Mac桌面端。M5 Ultra Mac Studio最高可配256GB统一内存,10月将推出512GB版本;M6作为苹果首款2nm芯片首发于Mac mini,配备12核CPU、12核GPU及双16核神经引擎。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Meta 付费 AI 智能体 Hatch 即将上线,新模型 Watermelon 定于 10 月发布
Meta 将于未来几周推出 AI 智能体 Hatch,并在 10 月发布新模型 Watermelon。Hatch 是 OpenClaw 智能体的消费版,可接入 DoorDash、Etsy、Reddit、Yelp 和 Outlook 等平台,提供健身追踪或行程规划等可定制仪表盘功能。Meta 正考虑分层定价,其中高级订阅最高可达每月 $199.99。
信息来源:The Decoder:AI News(RSS)
产品发布 / 更新普通
苹果正式推出 M6 芯片:12 核 CPU,单线程性能全球领先
苹果今日在新款 Mac mini 中推出 M6 芯片,这是其首款采用 2 纳米制程的芯片,配备 12 核 CPU、12 核 GPU 及双 16 核神经引擎。与 M5 相比,M6 单线程性能全球最快,多线程性能最高提升 1.2 倍,GPU 在 AI 场景下峰值性能提升近 30%,支持最高 32 GB 统一内存和 170 GB/s 内存带宽。
信息来源:IT之家(RSS)
观点 / 方法普通
用AI将大型功能拆解为可独立合并的小PR
Dex Horthy分享其生产级大型功能的AI驱动开发流程:先产出研究与产品大纲文档,让AI智能体通宵实现、审查与争论,再通过循环反馈打磨。随后与智能体协作将2万+行实现拆分为3-9个独立PR,逐个(1k-3k行)进行反馈、打磨与代码审查。引用@jlongster观点:AI将大任务拆成可独立落地的小型堆叠PR,快速构建大功能后逐项精修至生产就绪,此前拆分工作极为繁重。
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
产品发布 / 更新普通
苹果推出全新 Mac Studio,可选 M5 Max 或 M5 Ultra 处理器,19999 元起售
苹果发布全新 Mac Studio 专业台式机,可选 M5 Max 或 M5 Ultra 芯片,AI 性能最高提升至 4.3 倍,存储速度最高提升 2 倍。M5 Ultra 版配备最多 80 核 GPU 与 512GB 统一内存,支持 Thunderbolt 5 集群部署。
信息来源:IT之家(RSS)
产品发布 / 更新普通
苹果全新 Mac mini 发布:可选 M6 或 M5 Pro 芯片,6999 元起售
苹果今日发布全新 Mac mini,可选 M6 或 M5 Pro 芯片,6999 元起售。搭载 M6 芯片的版本 AI 性能最高提升 4 倍,存储与图形处理速度提升 2 倍,CPU 性能提升 40%;M5 Pro 版本面向专业工作流,支持最高 64GB 统一内存。两款机型均支持 Wi-Fi 7 和蓝牙 6,8 月 27 日起预购,9 月 22 日发售。
信息来源:IT之家(RSS)
产品发布 / 更新普通
苹果推出 M6 与 M5 Ultra 芯片,本地 AI 性能大幅跃升
苹果推出 M6 与 M5 Ultra 芯片,主打本地 AI 性能跃升。M6 的 LLM 提示词处理速度较 M4 提升最高 4.8 倍,内存带宽增至 170GB/s,配备 12 核 CPU/GPU、双 16 核神经引擎及最高 32GB 统一内存。
信息来源:X:Kim (@kimmonismus)
产品发布 / 更新普通
高通下一代骁龙旗舰平台 CPU 技术公开:Oryon 最高主频 5GHz,全球移动端最快
高通预热全新骁龙 8 系旗舰移动平台,新一代 Qualcomm Oryon CPU 最高主频达 5GHz,成为首个迈过该门槛的移动 CPU,并引入 FlexCache 全新缓存架构。该 CPU 为完全定制设计,每个核心拥有独立时钟域,可独立进行频率扩展。FlexCache 将 L2 缓存统一为所有核心共享的缓存池,可动态调整资源分配,以提升智能体 AI、游戏、多任务及视频编辑等场景性能。
信息来源:IT之家(RSS)
产品发布 / 更新普通
广汽领程联合新石器开发的首款无人车 X6 下线,拥有 6 立方米装载空间
广汽领程与新石器联合开发的首款无人车 X6 在广州从化工厂正式下线。该车聚焦城市末端配送与支线物流场景,拥有 6 立方米装载空间,可满足电商、生鲜、商超、药品等多场景配送需求。双方合作的 12 立方米、20 立方米无人车后续也将陆续推出。
信息来源:IT之家(RSS)
产品发布 / 更新普通
VoxCPM2 推出 ComfyUI 插件,支持低显存推理与 LoRA 微调
开发者 @maxar2032 发布 ComfyUI_VoxCPM_SM 插件,让 VoxCPM2 在 ComfyUI 中实现低显存推理与 LoRA 微调。该插件支持 INT4/INT8 及 GGUF 量化格式,便于本地部署,并可通过节点化工作流用自定义语音数据微调。项目代码已开源在 GitHub,模型托管于 HuggingFace。
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · Hugging Face
产品发布 / 更新精选
Apple 推出搭载 M5 Max 与 M5 Ultra 的全新 Mac Studio
Apple 发布搭载 M5 Max 与全新 M5 Ultra 的 Mac Studio,AI 性能最高提升 4.3 倍,图形性能提升 1.8 倍,存储速度提升 2 倍。M5 Ultra 版本支持最高 512GB 统一内存与 1.2TB/s 内存带宽,可完全在设备端运行大型 LLM;四台集群可带来最高 3 倍分布式 AI 推理速度提升。新品今日起接受预购,9 月 22 日开售。
信息来源:Apple:Newsroom(RSS)
产品发布 / 更新普通
苹果新款桌面电脑专为本地 AI 开发设计
苹果今日发布新款 Mac mini 和 Mac Studio,并推出两款新芯片:M6 是 M 系列首款 2nm 芯片,M5 Ultra 则成为该系列中面向 AI 负载的最强芯片。两款桌面电脑凭借统一内存架构和片上系统的高速 CPU/GPU,在本地 AI 推理和软件开发中颇受欢迎。
信息来源:Ars Technica:AI(RSS)
模型发布 / 更新普通
阿里云AI Spotlight回归,Wan3.0视频生成
AI Spotlight 携 Wan3.0 回归 Wan3.0 帮你将现有素材转化为可塑、可打磨、可激活的视频。创作视频不再意味着从零开始。 即刻体验:Qwen Cloud: https://click.qwencloud.com/m/20000002025/ Model Studio: https://click.alibabacloud.com/m/20000002017/ #LetsWanIt #AlibabaCloud #Wan3 #QwenCloud #AISpo…
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
行业动态普通
Accel 投资的 Keenable 为 AI 智能体索引整个网络
由前 Yandex 高管 Andrey Styskin 与 Matthias Petri 创立的 Keenable 走出隐身模式,获 Accel 领投的 2600 万美元种子资金。该公司已构建超 1000 亿文档的网页搜索索引,API 已被多家 AI 实验室在训练及运行时使用,并计划年底前将 15 人团队规模翻倍。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新精选
Apple 发布 M6 与 M5 Ultra,性能与 AI 算力大幅跃升
Apple 推出首款 2nm 芯片 M6,搭载 12 核 CPU、12 核 GPU 及双 16 核神经引擎,统一内存带宽最高 170GB/s,多线程性能较 M5 提升 1.2 倍。M5 Ultra 采用首款四芯片封装架构,最高 36 核 CPU、80 核 GPU,带宽达 1.2TB/s,较 M3 Ultra 提升 50%。两款芯片分别用于新款 Mac mini 与 Mac Studio。
信息来源:Apple:Newsroom(RSS)
行业动态普通
荣耀晒人形机器人运动会百米战果:"元气仔"预赛夺冠,"闪电"再破人类纪录
荣耀官微宣布,第二届世界人形机器人运动会百米预赛中,荣耀机器人元气仔以12.02秒夺冠并包揽前四名;闪电在100米复赛跑出8秒94,再次打破人类纪录。不过北京人形机器人创新中心的天工机器人以8.86秒刷新复赛纪录。赛事由北京市人民政府和中央广播电视总台等联合主办,共设50个赛项。
信息来源:IT之家(RSS)
论文研究普通
加权记忆树:提升长任务智能体推理准确率
论文提出 Weighted Memory Tree,通过为每条记忆打分并在未被选中时衰减其权重,而非简单堆叠记忆层级,来提升长任务 LLM 智能体的推理能力。该方法在多个模型上均优于线性历史和未打分树,同时降低提示词成本并提高准确率。
信息来源:X:Rohan Paul (@rohanpaul_ai)