AI 情报文章归档
浏览 AI圈报 已保存的 5760 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5760
正式分类6
精选内容3361
全部文章
第 41 / 144 页 · 每页 40 条
行业动态普通
Codex 费率被重置,官方不再公告
哈哈什么?秘密重置。查一下你的 codex 费率。它们已经被重置了。到这一步,我们那位老哥甚至都不再公告它们了。
信息来源:X:Kim (@kimmonismus)
行业动态普通
马斯克TeraFab芯片厂在得州进入协议阶段
马斯克旗下TeraFab在得州正式进入协议阶段,州政府已公布与州长办公室、Anderson-Shiro CISD及TeraFab AI签署的34页税务协议。该协议将TeraFab定位为下一代垂直整合半导体制造与先进计算设施,建设期为2026年12月1日至2028年12月31日,并设2029至2038年十年税收优惠期,要求1298万美元履约保证金。
信息来源:X:cb_doge (@cb_doge)
行业动态普通
OpenAI数据中心负责人离职
WSJ:OpenAI 的数据中心负责人已离开公司。 Chris Malone 于 2025 年 3 月加入,在 OpenAI 宣布 Stargate 基础设施项目后不久,于上周离职。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI
观点 / 方法普通
OpenAI Jalapeño:优于英伟达 Blackwell
OpenAI 发布 Jalapeño,宣称其性能优于英伟达 Blackwell。该芯片在推理任务中展现出显著优势,具体参数与基准分数未在原文中披露。Jalapeño 的推出标志着 OpenAI 在自研芯片领域迈出关键一步,可能对现有 GPU 市场格局产生影响。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / NVIDIA
产品发布 / 更新普通
Perplexity 发布 Portable Computer:可在 NVIDIA DGX Spark 本地运行智能体平台,本地步骤零 token 费用
Perplexity 发布 Portable Computer,将智能体平台完整本地化部署于 NVIDIA DGX Spark,本地模型处理的步骤不产生按 token 计费。
信息来源:MarkTechPost(RSS) · NVIDIA
行业动态普通
Stability AI 获 7600 万美元 B 轮融资,环球音乐、索尼音乐、EA 参投
Stability AI 完成 7600 万美元 B 轮融资,累计融资总额达 2.32 亿美元。本轮投资方包括环球音乐集团、索尼音乐集团、华纳音乐集团和游戏巨头 EA,以及 AMD Ventures 和 Pacific Alliance Ventures。公司计划将资金用于扩展"创意制作"产品套件和专业服务部门。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新普通
OpenAI 完成超 10T 参数"Bel"预训练
OpenAI 据报已完成代号"Bel"的下一代预训练模型,总参数超 10T,规模接近 GPT-4.5,预计成为 Astra 与 GPT-6 的基础。Anthropic 因算力受限,被认为今年内难以应对 Astra 的公开推出,但预计明年初可重回领先。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / Claude
论文研究普通
上下文压缩如何破坏智能体安全规则
研究测量了20个生产级智能体配置中上下文压缩的实际破坏效果:Claude Code在Sonnet 4.6上经一轮压缩后仅保留53%的安全规则,五轮后降至10%。其提出的Knowledge Triage方案按类型分类知识库各行并分配独立保留策略,在任意压缩比下多保留2-4倍安全规则,五轮召回率达96%。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Claude
产品发布 / 更新普通
Keenable 推出独立网页搜索 API 与 Time Machine
Keenable 为 AI 实验室和智能体推出独立网页搜索 API,基于自研爬虫、索引和排序栈,覆盖超 1000 亿文档,获 Accel 领投 2600 万美元种子轮,美国东部 p95 延迟低于 250ms。同步发布 Time Machine 功能,可将搜索结果回退至指定时间点的网页状态。Web Search API 与 Web Query Language 现已上线,9 月底前免费。
信息来源:X:Testing Catalog (@testingcatalog)
行业动态普通
OpenAI 曝光俄罗斯利用 ChatGPT 开展的隐蔽影响力行动
OpenAI 曝光并封禁了一批通过 VPN 从俄罗斯访问 ChatGPT 的账户,这些账户利用该模型生成内容,推广亲克里姆林宫叙事,为据称位于以色列的智库"国际伯克研究所"(IBI)造势。
信息来源:The Decoder:AI News(RSS) · OpenAI / ChatGPT
产品发布 / 更新普通
Suno Studio 2.0 融合传统 DAW 与最新技术
Suno Studio 2.0 弥合了传统 DAW 表现方式(如 MIDI 输入和实时音频效果)与我们最新技术之间的差距。 演奏它、调整它、完善它。🎹🎧 #Suno #SunoStudio2 #MusicTech #DAW
信息来源:X:Suno (@suno)
产品发布 / 更新普通
Gemini macOS 应用新增语音听写与摘要功能
在 macOS 版 Gemini 应用中,直接用语音在任意窗口内听写、总结文件并改写文案。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新普通
Perplexity 便携电脑智能体研究发布
新研究:Portable Computer 是一款本地优先的智能体,用于私密且经济高效的工作。 凭借设备端 27B 模型,我们的框架在真实知识工作中得分 82.6%,超越了开源框架 Pi 和 Hermes。我们后训练的 PPLX 27B 达到 85.4%。
信息来源:X:Perplexity (@perplexity_ai)
行业动态普通
Anthropic 因安全团队可能罢工,要求员工居家办公
Anthropic 因安全团队可能举行罢工,已要求员工居家办公。此举源于公司内部安全团队与管理层之间的紧张关系,罢工威胁可能影响公司运营。目前尚不清楚罢工是否最终成行,以及 Anthropic 将如何应对潜在的安全保障缺口。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新普通
Grok Bot 桌面端上线 DeepLink 插件
刚刚为 Grok @Bot 在桌面端上线了 deeplinks(移动端即将推出)! 试试安装 X 插件:grokbot://app/v1/plugin/add?id=49086599 当然还有 pstack:grokbot://app/v1/plugin/add?id=9717366
信息来源:X:Lauren Tan (@poteto) · Grok
行业动态普通
SpaceX 两大超级项目投资超千亿美元
SpaceX 三周内宣布两大超级项目,合计投资至少 1168 亿美元:得州 Terafab 全球最大芯片制造厂,路易斯安那州 Starbase 全球最大航天港。预计创造超 1.4 万个直接和间接岗位,其一生产用于地球和太空的 AI 芯片,另一支持每年数千次 Starship 发射。
信息来源:X:cb_doge (@cb_doge)
产品发布 / 更新精选
OpenWorker 新版发布,内置网络安全智能体
Andrew Ng 旗下开源智能体 OpenWorker 发布新版,强化安全工作流。其 harness 完全开源,安全团队可审计无后门。新版内置代码漏洞扫描、依赖供应链注入检测和云安全配置检查三类网络安全智能体,并支持本地运行开源权重模型以保护敏感代码。
信息来源:X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)
产品发布 / 更新普通
OpenAI Jalapeño芯片能效超越Vera Rubin
OpenAI 在 Hot Chips 大会上发布的全新 Jalapeño 芯片,在每兆瓦输出吞吐量上超越了 Vera Rubin 七月份的结果。(1/7)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI
产品发布 / 更新普通
GPT-Astra 用 Codex 优化 Jalapeño 芯片内核
OpenAI 博客透露,GPT-Astra 使用 Codex 编写并优化低层内核,让三款此前未规划的开放权重模型在两个月内于 Jalapeño 芯片上达到高性能。在选定的注意力与混合专家模块中,其实现比现有的人类专家代码快 1.5-1.8 倍。Jalapeño 在 OpenAI 自测中已超越 Nvidia GB200/GB300,计划 2026 年底部署。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / NVIDIA
产品发布 / 更新普通
Replit 免费模式:做更多,忧更少
在免费模式下,你实际上可以做得更多,同时担忧得更少。就是这么简单。
信息来源:X:Replit (@Replit)
模型发布 / 更新普通
Skild S1 机器人基础模型:视频即提示词
Skild 发布机器人基础模型 S1,用视频演示替代语言指令来定义任务。只需提供 1 段人类视频,S1 即可直接执行长达 10 分钟的多步骤新任务,无需重新训练或微调。若规模化,基础模型训练的高昂数据成本可摊薄至数千个新任务,有望改变机器人学习的经济性。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
LangSmith Engine 智能体问题检测能力提升 2 倍
LangSmith Engine 现可将智能体问题检测能力提升 2 倍以上,并提出更有效的修复建议。该引擎新增 Slack 与 Linear 工作流支持,同时提供自托管部署选项。
信息来源:LangChain:Blog(RSS)
产品发布 / 更新普通
OpenAI Jalapeño 芯片实测性能亮眼
OpenAI 首款自研推理芯片 Jalapeño 已在实验室完成实测,从概念到真实负载表现优异。该芯片在更高吞吐和更低延迟上实现"每瓦特更多智能",并与 Cerebras 深度合作推动 /ultrafast 高速推理,满足大量客户需求。
信息来源:X:Tibo (@thsottiaux) · OpenAI
产品发布 / 更新普通
OpenAI 自研推理芯片 Jalapeño 据称在推理基准测试中超越 Nvidia Blackwell 和 Rubin
OpenAI 在 Hot Chips 大会上首次展示自研推理芯片 Jalapeño 的基准测试结果,该芯片在每瓦吞吐量和 token 延迟上据称超越 Nvidia Blackwell 和 Rubin。
信息来源:The Decoder:AI News(RSS) · OpenAI / NVIDIA
论文研究普通
WebDev-Skills-Bench 评测:Agent 技能是否真的有用
WebDev-Skills-Bench 在 50 个 Web-Bench 项目和 1000 个有序任务上测试 31 个公开 WebDev 技能,发现注入目标技能使平均 Pass@2 下降 1.3% 至 4.2%,token 成本增加 72% 至 394%。对照实验将损害归因于长度干扰和内容误导两类失败模式,且技能排名在模型间迁移性弱。
信息来源:X:DAIR.AI (@dair_ai)
行业动态普通
Runway AI 峰会九月旧金山召开
更多演讲者将加入 Runway AI 峰会。今年九月在旧金山,来自机器人、自动驾驶、营销和基础设施领域的行业领袖将齐聚一堂,用一天时间探讨 AI 如何重塑智能与世界的交汇方式。 点击下方链接了解更多并注册。
信息来源:X:Runway (@runwayml)
行业动态普通
开发者冲击PR世界纪录仅剩6天
刚刚拿下了历史第4名的位置。距离打破2000个PR的世界纪录还有6天。
信息来源:X:Lauren Tan (@poteto)
产品发布 / 更新普通
OpenRouter 模型变体新增优先服务层支持
TIP 💡 我们的 :nitro 和 :floor 模型变体接入服务层级,而不仅仅是排序 示例:"~openai/gpt-latest:nitro" 将许多功能打包进一个模型标识中: 1. ~latest 别名解析为最新的 gpt 模型 2. :nitro 按实测吞吐量对端点排序 3. (新功能):nitro 将优先服务层端点纳入池中,与默认端点一同比拼速度
信息来源:X:OpenRouter (@OpenRouter) · OpenAI / GPT
产品发布 / 更新普通
Anthropic 合并聊天与 Claude Cowork 记忆系统,Claude 跨场景自动记住信息
Anthropic 宣布将聊天与 Claude Cowork 的记忆系统合并,Claude 在一个场景记住的信息会在另一场景自动可用,用户可查看、编辑或删除已保存记忆。更新后,Claude 会在对话过程中实时添加记忆主题,而非结束时总结。默认不存储健康、种族、政治等敏感信息,该功能默认在 Free、Pro 和 Max 套餐的网页、桌面及移动端启用。
信息来源:TechCrunch:AI(RSS) · Claude
产品发布 / 更新普通
Claude Code 将支持 Agents.MD 与系统提示词修改
Anthropic 正提升 Claude Code 的可扩展性,将支持用户轻松使用 Agents.MD 或修改系统提示词。团队认为不同模型族的系统提示词对性能影响显著,且 Claude Code 已为各模型配置不同提示词。短期内用户可在 Claude.MD 中通过 @Agents.MD 调用。
信息来源:X:Thariq (@trq212) · Claude
产品发布 / 更新普通
Krea 上线 Wan 3.0,支持 20 参考图与 30 秒带音频生成
Wan 3.0 现已登陆 Krea。 支持 20 张参考图像,以及 30 秒带音频的生成,成本仅为同类质量模型的零头。 立即体验 👇
信息来源:X:Krea AI (@krea_ai)
行业动态普通
OpenAI 为 ChatGPT Plus 用户恢复 Codex 和 ChatGPT Work 的 5 小时使用限制
OpenAI 宣布自明日起,为 ChatGPT Plus 订阅者恢复 Codex 和 ChatGPT Work 的 5 小时使用限制,此前数周仅保留每周用量上限。达到 5 小时或每周上限后,用户可等待重置或购买额外额度,OpenAI 也会不定期免费重置。Pro $100 和 Pro $200 订阅在未来数月内不受此 5 小时限制影响。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / ChatGPT
产品发布 / 更新普通
Meta AI 推出 MetaRoCE:面向 AI 规模以太网的全新 RDMA 传输协议
Meta 发布 MetaRoCE,一种为 AI 工作负载设计的全新 RDMA 传输协议,将网络视为有损链路,把排序、路径选择与恢复下沉到网卡,仅需交换机支持 ECN 与 ECMP。在 64 节点 AMD GPU 集群运行 RCCL 集合通信时,1% 丢包率下仍保持约 86% 吞吐量。Meta 将通过 Open Compute Project(OCP)发布规范、合规测试套件及参考软件实现。
信息来源:MarkTechPost(RSS) · Llama
行业动态普通
Anthropic 向投资者兜售超 30 万亿美元潜在营收
WSJ 报道,Anthropic 正向投资者推介超 30 万亿美元的潜在营收机会,超过 SpaceX 的 28.5 万亿美元估值。Testing Catalog 推测其中很大一部分将来自企业级业务,并好奇 OpenAI 是否有机会超越这一数字。
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI / Claude
产品发布 / 更新普通
OpenAI Jalapeño芯片实现效率与速度双提升
自发布我们的首款定制推理芯片 Jalapeño 以来,我们一直在对其及周边系统进行测试。 结果显示这是一项重大进步:每瓦特带来更多智能,响应速度更快,在同一架构中同时实现更高吞吐量和更低延迟,且不牺牲效率。
信息来源:X:OpenAI (@OpenAI) · OpenAI
观点 / 方法普通
AI软件工厂设计模式直播第71期
软件工厂设计模式:🦄 真正可用的 AI 第 71 期 https://x.com/i/broadcasts/1AGRnZYnYNrGl
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
产品发布 / 更新普通
Claude 记忆统一,Cowork 共享聊天上下文
Claude 现在在聊天和 Claude Cowork 之间拥有统一的记忆,由你决定其中包含什么内容。 把任务交给 Cowork,它会从 Claude 在聊天中已经了解的信息开始:你讨论过的项目、你经理的偏好,或者上个季度的客户。
信息来源:X:Claude (@claudeai) · Claude
行业动态普通
Anthropic IPO 或寻求 2 万亿美元估值
Anthropic 可能在 IPO 时向投资者宣称,Claude 等 AI 模型未来可执行的工作对应超 30 万亿美元潜在市场,超过 SpaceX 的 28.5 万亿美元估值。该公司或寻求约 2 万亿美元估值,并募资至多 1000 亿美元。
信息来源:X:Kim (@kimmonismus) · Claude / Grok
观点 / 方法普通
人形机器人金属腿上的纯粹意志力
金属腿上的纯粹意志力 手腕上的力感应必须直接接入平衡控制器 还有,当绳索角度变化时,机器人多么迅速地重新调整臀部重心
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
OpenClaw 回归在即,社区期待发布
本周。 【引用 @realcaptmarbles】:OpenClaw 看起来回来了,很期待。发布吧!
信息来源:X:Peter Steinberger (@steipete)