AI 情报文章归档
浏览 AI圈报 已保存的 5760 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5760
正式分类6
精选内容3361
全部文章
第 40 / 144 页 · 每页 40 条
观点 / 方法普通
Luma AI 新作《蓝色时刻》亮相
在蓝色时刻,一名杀手穿过大理石地板,去终结那份他从未想过质疑的契约。 "L'heure Bleue"由 Bryan Soegondo @DreamLabLA 创作,使用 Luma 制作。
信息来源:X:Luma AI (@LumaLabsAI)
观点 / 方法普通
SemiAnalysis 揭秘 OpenAI Jalapeño 芯片
SemiAnalysis 长文披露 OpenAI 自研 Jalapeño 芯片,称其面向数十万亿参数模型与百万级 token 上下文设计,并质疑 CUDA 在 AI 可自写代码优化新架构下的存续。该芯片以每瓦性能为核心,目标让数千芯片协同为单一推理机,其每兆瓦输出 token 吞吐已超越英伟达 Vera Rubin 公布数据。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / NVIDIA
产品发布 / 更新普通
OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.7 倍
OpenAI 首款自研推理芯片 Jalapeño 性能首秀,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型测试中,每瓦 AI 吞吐量较 GB200 和 GB300 高出 1.5 至 1.9 倍,端到端延迟约为对比系统的 28% 至 59%。
信息来源:IT之家(RSS) · OpenAI / GPT / DeepSeek
产品发布 / 更新普通
NVIDIA 发布 Jetson Orin Nano 2 机器人计算机,双倍算力或四成节能
NVIDIA 推出面向入门级边缘 AI 的 Jetson Orin Nano 2 机器人计算机,预计 2027H1 以模组及开发套件形态上市。该产品采用与 Orin Nano Super 相同外形规格,AI 推理算力为前代 2 倍,标准模式下达 78 TOPS,集成 8 核 Arm CPU 和 8GB 内存;若性能控制在前代水平,功耗仅 15W,为前代的 60%。
信息来源:IT之家(RSS) · NVIDIA
论文研究普通
评测框架无中立:同一模型得分31%到89%
新论文揭示评测框架(harness)对模型得分影响巨大:12个开源模型在26种同等合理的配置下回答相同3,679道题,仅改变选项顺序、提示词措辞和答案读取方式,gemma4-31b得分即可从31%波动至89%。配置敏感题目承载了相邻模型间95.7%的差距,4个模型在某种配置下可排第一。基准压缩方法筛选的题目恰是最易受配置影响的,压缩基准实则在挑选脆弱项。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
曝 OpenAI 已预训练 Bel 模型:超 10T 参数,冲击通用人工智能
消息源 @synthwavedd 爆料称,OpenAI 已完成下一代模型 Bel 的预训练,该模型是 Doug 的直接继任者,总参数超过 10T,并计划将其打造为 GPT-6 之后的基座模型,甚至冲击 AGI 阈值。消息源认为,这些探索可能让 Anthropic 感到压力,OpenAI 认为面对即将发布的 Astra,Anthropic 没有拿得出手的应对方案,主要受算力条件所限。
信息来源:IT之家(RSS) · OpenAI / GPT / Claude
论文研究普通
无中立基准:配置变化致模型排名大幅波动
一项研究让12个开源权重模型在26种同等合理的基准配置下回答ARC、HellaSwag、MMLU和TruthfulQA的3,679道题,仅改变选项顺序、提示词措辞及答案读取方式。gemma4-31b的得分随配置在31%至89%间波动,四个模型在某种配置下排名第一。配置敏感题目承载了相邻模型间95.7%的差距,基准压缩方法筛选出的题目恰是最易受配置影响的。
信息来源:X:DAIR.AI (@dair_ai)
产品发布 / 更新普通
Anthropic 更新 Claude 记忆机制,打通 Cowork 与聊天的记忆功能
Anthropic 宣布更新 Claude Cowork 与聊天功能之间的记忆机制,将两个系统的记忆功能打通,实现统一管理。Cowork 在云端执行任务时可访问 Claude 从聊天记录中记住的信息,反之亦然。涉及健康状况、个人信念等敏感话题的记忆默认关闭,但用户可在"记忆"设置中手动开启;Free、Pro 和 Max 套餐默认开启记忆功能,Mac 和 iOS 平台同样支持。
信息来源:IT之家(RSS) · Claude
观点 / 方法普通
传闻称OpenAI与Anthropic新模型能力飞跃
Kim援引多方消息称,OpenAI与Anthropic尚未发布的模型能力将实现全面显著跃升,传闻还称上下文与记忆问题已被"解决",并出现可持续学习的自我改进模型。引用推文称未来8个月内或将再现o3到fable级别的能力跨越。作者强调这些仅为传闻,无实证,但来源日益频繁且包括可靠人士。
信息来源:X:Kim (@kimmonismus) · OpenAI / Claude
产品发布 / 更新普通
OpenAI 发布适用于 ChatGPT Work 和 Codex 的 Admin 插件,管理员可通过对话管理用户和权限
OpenAI 面向 ChatGPT Work 和 Codex 推出 Admin 管理插件,工作区管理员可直接通过对话调整设置、管理用户和权限、分析使用情况并生成报告。该插件支持查看活动数据与额度使用、管理成员和群组、控制访问权限,以及审批额度申请。目前 Admin 插件已上线 ChatGPT Work 的 Plugins 插件目录。
信息来源:IT之家(RSS) · OpenAI / ChatGPT
产品发布 / 更新普通
Claude 推出跨 Chat 与 Cowork 统一记忆
Claude 更新了跨 Claude Chat 和 Cowork 的统一记忆功能,用户可决定记忆内容。设置中新增敏感话题记忆开关,记忆按类别拆分,并在设置中新增独立标签页,用户可直接在记忆浏览器界面告诉 Claude 要记住什么。
信息来源:X:Testing Catalog (@testingcatalog) · Claude
观点 / 方法普通
韩国稳居全球AI竞赛第三,多家实验室模型得分超30
韩国在全球AI竞赛中稳居第三,仅次于美国和中国,得益于本土人才、公共投资及主权AI基础模型项目。Motif Technologies的Motif 3(47分)和Upstage的Solar Pro 4(42分)成为中美以外最高分模型,SK Telecom的A.X K2(35分)和LG的K-EXAONE 2.0(31分)亦表现突出。
信息来源:X:Artificial Analysis (@ArtificialAnlys)
论文研究普通
Prime Agent 技术报告:记忆层级机制解析
Prime Agent 发布技术报告,该 harness 曾助 Opus 5 在 ARC-AGI-3 达 95.5%。其核心机制为记忆层级:模型权重与活动上下文之下,设持久 IPython 会话及磁盘存储的历史、技能与提示词库,模型通过代码在各层级间移动状态。长输入作为 REPL 变量留存,供智能体搜索与转换,将长上下文工作转为信息管理问题。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
Claude Code v2.1.246 发布:修复 Bash 通配符权限、全屏模式与后台会话等多项问题
Claude Code v2.1.246 发布,新增 Bash 允许规则中通配符的启动警告、/permissions 的 Auto 模式标签页,并在回合时长行显示完成时间。本次更新修复了全屏模式空白、超长 diff 行导致的严重卡顿、后台会话无法打开、MCP 工具调用中断误报、插件缓存重复目录等大量问题,同时优化了自定义主题颜色与 /fork 等功能的稳定性。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新普通
Claude Morning Brief 功能开始向部分用户推送
Morning Brief 功能似乎正在向部分 Claude 用户逐步推出。 Morning Brief 基于定时任务运行,引导用户自定义偏好设置和 Connectors 以拉取数据。 你也收到了吗?👀
信息来源:X:Testing Catalog (@testingcatalog) · Claude
产品发布 / 更新普通
ChatGPT Work 可安全登录网站账号
ChatGPT Work 现可调用其计算机和浏览器,在网页及移动端安全登录网站,全程不接触用户名或密码。用户可让其代办理水电开通、预约 DMV 或护照、查询保险报销、预约医生、处理车辆登记续期、提交报销单据等 20 余项事务。
信息来源:X:Greg Brockman (@gdb) · ChatGPT
观点 / 方法普通
Apodex 1.1 分析 221 个 MATS 项目:中国开放权重模型采用率升至 50.55%
Apodex 1.1 端到端研究了 221 个 MATS 项目,发现中国模型实质性采用率从 2023 年的 4.35% 升至 2025 年的 50.55%,2026 年截至 8 月为 65.52%。
信息来源:X:马东锡 NLP (@dongxi_nlp)
行业动态普通
OpenAI WebMCP 挑战赛启动直播预告
准备好开黑了吗? 欢迎参加 WebMCP 挑战赛启动直播。 我们将介绍 WebMCP 开放标准,展示一些构建成果,并介绍奖项以及如何与我们一同开黑。 https://x.com/i/broadcasts/1qGoNYbWdkvKv
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
行业动态普通
/show-me 两周安装量破 5000
两周时间,/show-me 安装量已突破 5000!
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
观点 / 方法普通
马斯克盛赞 Grok Bot 获好评
对 Grok @Bot 的好评。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
行业动态普通
OpenAI Build Week 获奖项目揭晓
我们激动地宣布 OpenAI Build Week 获奖者 🥁 认识八个获奖项目背后的开发者,看看他们用 Codex 构建了什么。 https://openai.com/build-week
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新普通
OpenRouter 上线 Makora 推理服务商
新的推理服务商:@makora_ai 现已上线 OpenRouter。 首批提供:• DeepSeek V4 Flash • GLM 5.2 FP8 • GLM 5.2 NVFP4 • Kimi K3 通过 Makora 路由:https://openrouter.ai/provider/makora
信息来源:X:OpenRouter (@OpenRouter) · DeepSeek / GLM / Kimi
教程 / 实战普通
GitHub 如何在生产前评估 LLM:秘密扫描实战经验
GitHub 分享了为真实世界秘密扫描场景评估 LLM 的经验教训。评估聚焦于模型在实际任务中的表现,而非仅依赖基准测试分数。文章强调了在部署前进行针对性测试的重要性,以确保模型能有效识别敏感信息并满足生产环境需求。
信息来源:GitHub Blog
观点 / 方法普通
Cohere CEO 谈多伦多大学与 AI 之路
你是如何从破解 PlayStation 一路走到加拿大领先大语言模型公司 CEO 的?去多伦多大学。 "当你进入@多伦多大学,你就是在 AI 中成长起来的。"--@aidangomez
信息来源:X:Cohere(@cohere)
观点 / 方法普通
Tutti VM多智能体协作体验分享
1/ 好吧,这件事我憋了几天了,我觉得得聊聊: 这是我见过的用于多用户、多智能体协作的最酷的产品之一。 今天我和朋友在 Tutti · VM http://www.tutti.sh 上搭建了一整个落地页,全程没离开过聊天窗口去找图片、复制文件,或者向别人解释我在做什么。 视频在下面,但让我拆解一下实际发生了什么:
信息来源:X:Kim (@kimmonismus)
行业动态普通
世界人形机器人运动会:跑步破纪录与起火摔倒同台上演
第二届世界人形机器人运动会于8月22日至26日在北京举行,参赛机器人在百米赛跑中击败博尔特的人类纪录,但也有机器人因无法及时停下而撞上障碍物摔倒,部分甚至腰部断裂、火花四溅或起火。赛事还测试了洗衣晾衣等实用场景,机器人速度落后于人类,显示主办方意在展示人形机器人的商业潜力。
信息来源:Ars Technica:AI(RSS)
产品发布 / 更新普通
Claude 记忆功能升级:跨聊天与Cowork统一
一个小改进:记忆功能现在更简单、更强大。尽情享受吧!
信息来源:X:Boris Cherny (@bcherny) · Claude
行业动态普通
TeraFab 得州二期三期协议落地,投资近 480 亿美元
TeraFab 与得州签署二期、三期协议,合计投资约 476.77 亿美元,此前 168 亿美元仅对应一期。项目为 SpaceX 主导的垂直整合半导体设施,参与方含 Tesla、SpaceX 和 xAI,四期总规划约 1190 亿美元。两期预计共创造 1234 个直接岗位,建设期分别定于 2029-2031 和 2032-2034 年。
信息来源:X:cb_doge (@cb_doge) · Grok
产品发布 / 更新普通
ChatGPT 推出 100 美元商务高级席位
应大家要求,ChatGPT 现已推出 100 美元的商务席位!无 5 小时限制,更多用量等。
信息来源:X:Greg Brockman (@gdb) · ChatGPT
行业动态普通
OpenRouter 新 Logo 多版本下载指南
轻松下载我们新 Logo 的各种版本:https://openrouter.ai/brand 提供浅色模式、深色模式和灰度版本。
信息来源:X:OpenRouter (@OpenRouter)
行业动态普通
Anthropic 拟以 30 万亿美元市场机遇推介 IPO
WSJ:Anthropic 预计将向 IPO 投资者推介一个 30 万亿美元以上的市场机遇,该市场建立在 AI 可覆盖的人类工作之上。 他们是从 AI 模型可能执行的全部工作范围来估算这一市场的,他们认为这一范围远超当前在 AI 软件上的支出。 作为对比,SpaceX 在其 IPO 文件中将总可寻址市场定为 28.5 万亿美元,其中 26.5 万亿美元与 AI 相关。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
产品发布 / 更新普通
ChatGPT 推出 Business Premium Seats 企业版
OpenAI 推出 ChatGPT Business Premium Seats,面向团队和小公司的 $100/席位套餐,功能对标 Pro $100 计划。
信息来源:X:Tibo (@thsottiaux) · OpenAI / ChatGPT
行业动态普通
OpenAI 联合多家平台推出 WebMCP 黑客松
WebMCP 挑战赛来了。 我们与 @ChromiumDev、@CloudflareDev、@ShopifyDevs、@vercel、@render 和 @Netlify 合作,举办一场为期 10 天的黑客松。 奖品包括:35,000 美元现金奖励、Codex Micros、ChatGPT Pro 订阅,以及来自我们支持者的更多奖品。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
论文研究普通
Perplexity 便携电脑智能体获英伟达支持
Perplexity 发布本地优先智能体 Portable Computer,搭载端侧 27B 模型,在真实知识工作基准上得分 82.6%,超越开源方案 Pi 和 Hermes;后训练版 PPLX 27B 达 85.4%。Perplexity CEO 感谢英伟达在 DGX Spark 上的合作,并推动开放生态以支持高性价比开源权重模型、推理框架及统一内存硬件。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas) · NVIDIA
产品发布 / 更新普通
ChatGPT 浏览器扩展新增支持 Edge、Brave 等浏览器
OpenAI 宣布 ChatGPT 浏览器扩展现已支持 Microsoft Edge、Brave、Opera 和 Vivaldi 浏览器。用户可将浏览器标签页上下文带入 ChatGPT 桌面端任务,让 Codex 基于当前页面内容工作,并可通过侧边聊天使用完整 ChatGPT 功能。Opera 的侧边聊天功能即将推出。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
观点 / 方法普通
新高端职业:编写技能而非制作幻灯片
新的高端职业将类似于麦肯锡,但你的工作是编写能改进工作流程的技能,而不是制作幻灯片来改进它们。 企业中的每个环节都将变成赢家游戏,而不是"求求你别搞砸"的游戏。
信息来源:X:Gabriel (@gabriel1)
产品发布 / 更新普通
Grok 4.6 上线 OpenCode Go 限时免费
Grok 4.6 现已可在 OpenCode Go 上使用 每 5 小时可获得一百次 69 请求
信息来源:X:opencode (@opencode) · Grok
产品发布 / 更新普通
我们造了一颗芯片,而且它很快
我们造了一颗芯片,而且它很快。
信息来源:X:Sam Altman (@sama)
产品发布 / 更新普通
ChatGPT 推出 100 美元 Business Premium 席位
OpenAI 推出 ChatGPT Business Premium Seats,每个席位月费 100 美元,面向小企业和初创公司。该计划提供更强大的工具、更快的工作流,以及以往大公司才能使用的功能,并可按团队需求灵活扩展。
信息来源:X:Sherwin Wu(@sherwinwu) · OpenAI / ChatGPT
产品发布 / 更新普通
ChatGPT 推出 Business Premium 席位
推出 ChatGPT Business Premium 席位 新的 100 美元 Premium 席位对小企业和初创公司来说是一个颠覆性的改变--让精简团队获得更好的工具、更快的流程,以及曾经只有大公司才能拥有的能力。 一个灵活的方案,随你团队的雄心一同扩展。 https://chatgpt.com/pricing/?type=team
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT