AI 情报文章归档
浏览 AI圈报 已保存的 5645 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5645
正式分类6
精选内容3360
全部文章
第 121 / 142 页 · 每页 40 条
行业动态精选
Coinbase裁员14%,主要原因之一是AI
Coinbase宣布裁员约14%,CEO Brian Armstrong指出裁员源于市场周期与AI变革的双重压力。公司需在加密市场低迷期调整成本,同时拥抱AI提升效率:AI已让工程师几天完成以前数周工作,非技术团队也能编码。为此,Coinbase将转型为"AI原生"组织,压缩管理层至最多5级,取消纯管理岗位,组建小型高协同团队,并尝试"一人团队"模式。此次重组旨在构建更精简、敏捷的AI核心运营模式。
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新精选
GPT-5.5即时版全面推送 更简洁智能
GPT-5.5 Instant 开始向所有 ChatGPT 用户推出。 更简洁。记忆更佳。更个性化。 而且对话体验顺畅得多。真的。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT / GPT
模型发布 / 更新精选
GPT-5.5即时版开始推送升级
GPT-5.5 Instant 正在 ChatGPT 中逐步推出。 这是一次重大升级,以更温暖、更自然的语调为您提供更智能、更清晰、更个性化的答案。 同时它也更加简洁,这正是我们所了解到的用户需求。我们相信您会喜欢与它对话。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
Grok 4.3正式上线API 速度与智能双突破
Grok 4.3 现已在 xAI API 上线。这是我们迄今为止最快、最智能的模型。 它在 @ArtificialAnlys 排行榜上的智能体工具调用和指令遵循方面位居榜首,并在 @ValsAI 的企业领域(如判例法和公司金融)中排名第一。 Grok 4.3 支持 100 万令牌的上下文窗口,定价为输入每百万令牌 1.25 美元,输出每百万令牌 2.50 美元。 创建 API 密钥并开始构建:http://console.x.ai/team/default/api-keys
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
产品发布 / 更新精选
Claude托管智能体新增功能:梦想、成果与多智能体编排
Anthropic为其Claude托管智能体平台推出三项核心更新。"梦想"功能通过回顾会话历史提取模式,使智能体能够自我改进。"成果"功能允许开发者设定成功标准,智能体据此进行自我评估与修正,内部测试显示其显著提升了任务成功率和输出质量。"多智能体编排"功能支持主智能体将复杂任务分解,并分配给配备专用工具的子智能体并行处理。这些更新旨在以最小人工干预,增强智能体处理复杂任务的能力。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Claude使用限制提升及与SpaceX达成算力合作
Anthropic与SpaceX达成合作,获得其Colossus 1数据中心超300兆瓦(含逾22万块NVIDIA GPU)的算力。此举使Claude Code的Pro、Max等多档计划的五小时速率限制立即翻倍,并取消了高峰时段限流;Claude Opus的API速率也大幅提升。公司还公布了与亚马逊、谷歌、微软等科技巨头的一系列大规模算力协议,总投资额巨大。为满足企业客户的合规需求,算力扩张计划也将覆盖亚洲和欧洲地区。
信息来源:Anthropic:Newsroom(网页) · Claude / NVIDIA
产品发布 / 更新精选
金融与保险智能体解决方案
Anthropic发布了十个针对金融服务耗时任务的预置智能体模板,涵盖制作推介书、撰写信贷备忘录、KYC文件筛查及月末关账等。这些模板可作为Claude Cowork和Claude Code的插件,或作为Claude托管智能体的配置指南,帮助团队在数天内部署应用。Claude现通过Microsoft 365插件支持在Excel、PowerPoint等Office应用间无缝工作,并扩展了合作伙伴生态,新增数据连接器和MCP应用,使智能体能直接调用实时金融数据。这些更新与Cla…
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
Claude金融模板上线 助力投研与月结
金融服务新功能:现成的Claude智能体模板,可用于构建推介方案、执行估值审核、月末结账等任务。 可将它们作为插件安装到Cowork和Claude Code中,或使用我们的操作指南在生产环境中以托管智能体形式运行。
信息来源:X:Claude (@claudeai) · Claude
行业动态精选
Apple Manufacturing Academy 加速 AI 在美国供应链中的应用
苹果制造学院举办首届春季论坛,汇聚美国制造商共同推动人工智能在供应链中的部署。该计划旨在通过知识共享与协作,加速供应链的智能化转型,提升效率与韧性。论坛聚焦于实际应用案例,探讨如何将AI技术整合至生产、物流与库存管理等核心环节,以应对复杂的供应链挑战。
信息来源:Apple:Newsroom(RSS)
行业动态精选
Google Chrome 被曝未经用户同意悄然安装 4 GB AI 模型
据隐私倡导网站报道,Google Chrome 浏览器在未经任何提示或用户同意的情况下,于后台自动下载并安装了一个名为"Nano"、体积达 4 GB 的人工智能模型。该行为旨在增强本地AI功能,但完全隐蔽的安装过程占用了用户设备存储空间,且未提供任何选项或通知,引发了对其数据隐私风险及软件更新透明度的广泛担忧。此事件在Hacker News上获得高度关注,突显了公众对科技公司单方面安装行为的普遍不安。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
GPT-5.5 Instant:更智能、更清晰、更个性化
ChatGPT的默认模型已更新为GPT-5.5 Instant。新版模型能提供更智能、更准确的答案,并有效减少了幻觉现象。同时,用户获得了更强的个性化控制能力,使交互体验更贴合个人需求。此次升级标志着模型在理解精度与响应定制化方面取得了显著进步。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
GPT-5.5 Instant 系统卡片
OpenAI 于2026年5月5日发布了最新即时模型 GPT-5.5 Instant。该模型在网络安全、生物与化学防范两个类别首次被定位为"高能力"级别,并为此实施了相应的安全防护措施。其整体安全缓解方案与此系列前代模型相似。官方明确,不存在名为 GPT-5.4 Instant 的模型,其主要对标基线是 GPT-5.3 Instant。为避免混淆,GPT-5.5 模型被特指为 GPT-5.5 Thinking。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
产品发布 / 更新精选
通过 MRC(多路径可靠连接)解锁大规模 AI 训练网络
OpenAI 发布了名为 MRC 的新型超级计算机网络协议,旨在提升大规模 AI 训练集群的韧性与性能。该协议通过开放计算项目公开,支持在数千个 GPU 间建立高效、可靠的多路径连接,能自动绕过故障链路,将网络有效带宽提升最高达 30%,同时显著降低训练作业因网络问题中断的概率。MRC 的设计目标是应对万卡级集群的复杂网络挑战,为下一代大模型训练提供基础设施支持。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
GPT 5.5成本激增49-92%,长提示词效率提升
我们分析了GPT 5.5与GPT 5.4,发现成本增加了49-92%。 GPT 5.5价格翻倍的影响因模型生成长提示时补全令牌减少了19-34%而有所缓解。 更多分析请见:https://openrouter.ai/announcements/gpt55-cost-analysis
信息来源:X:OpenRouter (@OpenRouter) · GPT
观点 / 方法精选
Anthropic实现AI驱动研发闭环,人类角色转向监督与设计
Anthropic内部研发已由Claude主导,工程师基本不再手写代码,转而专注于编写提示词、审查代码和确定架构。这使得其工程师效率达到行业十倍以上,仅52天就推出50多个重大功能。这标志着递归自我改进(RSI)迈出关键一步:AI接管了生产自身的整个工厂。人类角色从生产者转变为监督者。结合OpenAI的Auto-review,一个能自我运行和改进的AI闭环正在形成。Anthropic CEO指出,未来仅约5%的开发者能留在核心领域,核心价值将转向驾驭和设计整个智能系统的系统…
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI / Claude
观点 / 方法精选
分享一个免费下载任何 YouTube 视频的GitHub开源项目,非常实用🔥
开源项目Voice-Pro将多语言视频创作流程大幅简化。用户输入YouTube链接后,该工具可在本地自动完成视频下载、人声分离、语音转文字、翻译、声线克隆及配音合成,全程不到两分钟。它将原本需要多个付费工具协作的复杂流程,整合为一个免费、本地化的高效解决方案,显著提升了创作者的工作效率。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
行业动态精选
奥特曼与布罗克曼被指在OpenAI进行自我交易,涉嫌背叛马斯克
推文指控萨姆·奥特曼和格雷格·布罗克曼在OpenAI非营利架构下进行自我交易。2017年,布罗克曼秘密持有Cerebras股份,并同期推动OpenAI与之合并,却未向埃隆·马斯克披露个人利益。2025年末至2026年,OpenAI与Cerebras签署了总额超200亿美元的合作协议并提供贷款,直接助推Cerebras估值从80亿飙升至近270亿美元。布罗克曼在宣誓证词中承认交易讨论期间自己是Cerebras投资者,但无法提供任何向马斯克披露此利益的邮件、聊天或文字记录。此举…
信息来源:X:cb_doge (@cb_doge) · OpenAI
论文研究精选
Stochastic KV Routing: 实现自适应深度方向的缓存共享
为降低大语言模型推理时KV缓存的高昂内存开销,研究提出了一种沿模型深度维度优化的新方法。该方法通过随机KV路由,在Transformer模型的各层之间动态共享KV缓存,而非每层保留完整独立缓存。实验表明,在保持模型质量基本不变的前提下,该方法能将KV缓存的内存占用减少高达50%,为降低大模型服务成本提供了与现有时间轴压缩、淘汰技术正交的新优化路径。
信息来源:Apple Machine Learning Research(RSS)
论文研究精选
OpenSeeker-v2:利用高信息量、高难度轨迹突破搜索智能体的极限
本研究提出了一种仅通过监督微调(SFT)训练前沿搜索智能体的高效方法。该方法基于三项关键数据合成改进:扩展知识图谱规模、增加工具集以及进行严格的低步数过滤。仅使用1.06万条数据训练的OpenSeeker-v2,在四个基准测试中均取得了领先性能,全面超越了采用复杂CPT+SFT+RL流程训练的同类模型。这是首个由纯学术团队仅通过SFT实现的、在同等模型规模与范式下的顶尖搜索智能体,其模型权重将开源以促进社区研究。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
优化软件工厂
软件工程团队中AI与人力比例的选择核心在于韧性而非吞吐量。在10/90比例下,约20名工程师使用Copilot等AI工具,保持传统层级结构;50/50比例时,12名工程师管理代理群,角色转向解决方案架构;90/10比例则仅需3名工程师核心操控自主代理,负责生成、测试和部署,无管理层级。高AI比例虽提升效率,但知识集中于少数人,团队利用率达100%,一旦人员离职将引发严重风险。借鉴制造业70-90%利用率原则,保持冗余可增强系统稳健性。因此,目前大多数初创公司不宜过度依赖AI。
信息来源:Tomer Tunguz 博客(VC 分析)
论文研究精选
RLDX-1技术报告
为提升视觉-语言-动作模型在复杂现实任务中的功能覆盖,研究团队推出通用机器人策略RLDX-1。该模型基于多流动作变换器架构,整合运动感知、记忆决策与物理传感等异构模态,并辅以合成罕见场景数据、仿人操作学习流程及实时推理优化等系统设计。在仿真与真实测试中,RLDX-1全面超越前沿模型π_{0.5}和GR00T N1.6,尤其在ALLEX人形机器人任务上取得86.8%的成功率,显著高于对照模型的约40%,标志着其在接触密集型动态灵巧操作领域取得关键进展。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
当公司里每个人都是关键人物时
本文探讨了初创公司工程团队中AI与人力比例变化带来的结构性风险。当AI占比从10%提升至90%时,团队从20名工程师的传统层级结构,演变为仅由3名工程师核心操控大量自主代理的无管理层模式。核心权衡在于系统韧性而非吞吐量:将编排知识高度集中于极少数人,等同于以100%的利用率运行,一旦关键人员离职将造成33%的"制度记忆"损失。文章借鉴制造业保持70-90%利用率以维持系统稳健的经验,建议大多数初创公司应避免过早采用极高AI占比的模式,因为其中缺乏冗余和缓冲空间。
信息来源:Tomer Tunguz 博客(VC 分析)
产品发布 / 更新精选
购买ChatGPT广告的新方式
OpenAI扩展ChatGPT广告服务,推出自助广告管理平台测试版,新增CPC竞价功能和增强的广告效果测量工具。新平台注重隐私保护,确保广告内容与用户对话相互独立,帮助广告主更精准地定位目标受众并优化广告投放效果。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
观点 / 方法精选
OpenAI 发布 Realtime Prompting Guide:实时语音智能体提示指南
OpenAI 发布 Realtime Prompting Guide,指导如何为实时语音智能体编写提示词,涵盖 Realtime 2 推理、前置指令(preambles)、工具调用和精确实体捕获(exact entity capture)等关键功能。该指南旨在帮助开发者更有效地构建和优化基于语音的 AI 交互体验。
信息来源:OpenAI Developers(RSS) · OpenAI
产品发布 / 更新精选
Grok语音API上线情感化声音克隆功能
两种声音。一种来自人类。一种来自AI。你能猜出哪个是AI克隆的吗?👇 具备丰富自然情感的语音克隆功能,现已在Grok Voice API上线。 http://x.ai/news/grok-custom-voices
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
产品发布 / 更新精选
v2.1.128版本更新
本次更新包含多项功能优化与错误修复。主要功能上,`/color` 命令支持无参数随机选色,`/mcp` 命令显示已连接服务器的工具数量,`--plugin-dir` 参数新增支持 `.zip` 插件包。用户体验方面,优化了 `/model` 选择器的显示。关键问题修复包括:解决了通过标准输入传输超大文件时导致的崩溃循环、修复了长 URL 在全屏模式下无法逐行点击的问题,以及修正了并行 Shell 工具调用中一个命令失败会错误取消同级调用的问题。此外,还处理了 MCP 服务器…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新精选
语音克隆技术上线 真假难辨
两种声音。一种来自人类。一种来自AI。你能猜出哪个是AI克隆的吗?👇 具备丰富自然情感的声音克隆功能,现已在Grok Voice API上线。 http://x.ai/news/grok-custom-voices
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
产品发布 / 更新精选
Gemini API支持Webhooks简化长时应用开发
告别持续轮询!在构建复杂、长期运行的智能体应用时,使用 Gemini API 中的 Webhooks 来消除 API 流量的浪费,并简化编排逻辑。🙌
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
产品发布 / 更新精选
GB300 NVL72实测性能达GB200的2.7倍,凸显端到端实测价值
在行业标准推理引擎vLLM上的测试显示,NVIDIA GB300 NVL72的实测端到端性能已达GB200 NVL72的2.7倍。尽管其纸面参数仅显示NVFP4算力提升约1.5倍、HBM容量增加1.5倍且带宽相同,但在大多数服务商实际运行的中段负载区间,凭借全栈优化的复合增益,GB300实现了远超理论算力提升的性能飞跃。此次测试基于NVIDIA、Inferact和CoreWeave为开源项目提供的临时GB300系统完成,结果印证了端到端实测性能才是衡量硬件效能的黄金标准,而…
信息来源:X:SemiAnalysis (@SemiAnalysis_) · NVIDIA
行业动态精选
OpenAI 与 PwC 合作重塑 CFO 办公室
OpenAI 与普华永道宣布合作,旨在通过AI智能体帮助企业自动化财务工作流程、改进预测、强化控制并实现首席财务官职能的现代化。双方将把OpenAI的企业版ChatGPT等工具整合到普华永道的服务中,为数千名员工提供高级AI访问权限,以处理财务分析、税务、咨询等任务。这一合作标志着专业服务公司首次大规模应用生成式AI,目标是提升效率、减少人工错误并推动财务职能的战略转型。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
Claude平台推出无密钥验证方案
管理API密钥是我们从客户那里听到的最主要的安全顾虑之一。 今天我们为Claude平台推出无密钥认证:通过CLI在浏览器中进行身份验证,或让工作负载使用其现有的云身份(AWS、GCP、Azure或任何OIDC令牌提供者)。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
观点 / 方法精选
Replit无需幻灯片快速生成演示文稿
你可以在 Replit 中构建完整的商业计划书演示文稿,无需触碰任何幻灯片。 只需描述你想要的内容,在聊天中迭代修改,可视化编辑,然后导出为 PPTX、Google Slides 或 PDF(或发布实时链接)。 以下是具体操作方式👇
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
创意速成:Nano Banana 2助力产品原型实现
从构想到原型,借助Gemini中的Nano Banana 2,将您独特的产品愿景变为现实。🪀
信息来源:X:Gemini (@GeminiApp) · Gemini
观点 / 方法精选
《Python深度学习》开放免费在线阅读
我撰写《Deep Learning with Python》旨在成为理解深度学习工作原理及最佳应用方式的权威指南。数以万计的人通过这本书开启了职业生涯。已售出12万册,更有数百万人下载阅读。 现在可以免费在线阅读:https://deeplearningwithpython.io/
信息来源:X:Francois Chollet (@fchollet)
产品发布 / 更新精选
桌面AI代理KroWork发布:将对话转化为持久本地软件,解决会话即失痛点
新推出的桌面AI代理KroWork旨在解决传统AI代理工作流随会话结束而消失的核心痛点。用户通过自然语言描述任务,AI即可自动构建并执行端到端工作流,最终可将完整流程保存为名为"Kro App"的持久性本地应用程序。该软件可一键安装至系统菜单,像常规软件一样运行,后续使用无需消耗tokens或重新构建。所有流程均在用户本地设备运行,无云端依赖,不泄露数据,且无需编程背景。其核心理念是实现从"聊天"到"交付"的跨越,将对话转化为用户真正拥有的可重用资产。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新精选
实时视频对话代理诞生
实时视频智能体已到来。 今天,我们将分享如何构建Runway Characters,让你能将一张图片转化为一个完全富有表现力、可对话的视频智能体,以每秒24帧的高清画质流畅播放。端到端延迟仅需1.75秒。 了解更多信息请见下文。
信息来源:X:Runway (@runwayml)
产品发布 / 更新精选
KroWork:将对话转化为本地桌面应用的AI智能体
KroWork是一款创新的桌面AI智能体,其核心在于"应用固化"能力,能将对话直接转化为持久可用的本地软件。它不止于生成代码建议,而是端到端自主执行任务,并将完整工作流保存为名为"Kro App"的独立应用。用户一键安装后,该应用即可像常规软件一样运行,无需重复消耗tokens或重建流程。所有操作均在本地设备完成,无需编程背景,且数据完全脱离云端。这标志着AI从对话助手向能构建并交付实体软件的工具转变。
信息来源:X:Kim (@kimmonismus)
观点 / 方法精选
金融服务行业Claude部署指南发布
Anthropic发布金融服务行业Claude部署指南,详细介绍了Claude系列产品在金融研究、交易、承销、理赔及月末结算等场景的应用方案。指南包含产品矩阵、10个预置金融智能体模板(如招股书生成器、KYC筛查器等),并分享了AIG、澳大利亚联邦银行等机构的实践案例。同时,提供基础、试点、扩展三阶段实施路线图,旨在协助企业决策者与工程师规划AI落地路径,提升运营效率。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
Claude Token 榜:迪士尼「榜一大哥」9 天 46 万次,Meta 月烧 60 万亿
迪士尼内部上线AI使用看板,追踪员工调用Claude的频率和token消耗。数据显示,一名员工在9个工作日内调用Claude约46万次,平均每1.7秒一次。与此同时,迪士尼正裁员约1000人。硅谷正流行"tokenmaxxing"文化,比拼AI token消耗量。Meta内部统计显示,其8.5万名员工在30天内消耗了60万亿token,价值约900亿美元;Uber的年度34亿美元AI预算在4个月内耗尽。报告显示,Claude用户中非程序员用途已超半数。
信息来源:IT之家(RSS) · Claude
观点 / 方法精选
Redis 数组类型交互式体验平台上线
Redis创始人Salvatore Sanfilippo提交了为Redis新增数组数据类型的PR,引入了包括ARCOUNT、ARDEL、ARGREP等在内的18个新命令。其中最引人注目的是ARGREP命令,它利用新集成的TRE正则表达式库,可直接在服务器端对数组值进行正则搜索。目前该功能已在一个分支中实现,开发者Simon Willison借助Claude Code构建了一个交互式在线沙盒,通过运行在浏览器中的WASM版Redis子集,供用户体验这些新命令。Salvator…
信息来源:Simon Willison 博客 · Claude