AI 情报文章归档
浏览 AI圈报 已保存的 5591 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5591
正式分类6
精选内容3485
全部文章
第 131 / 140 页 · 每页 40 条
观点 / 方法精选
(1/N) We're launching Dreamverse. Most AI video models take minutes to generate a 5 s 1080p clip. In…
(1/N) 我们正在推出 Dreamverse。大多数 AI 视频模型需要数分钟才能生成一段 5 秒 1080p 的片段。而在 4.5 秒内,我们就能在单张 GPU 上生成 30 秒 1080p 的片段。
信息来源:X:Sky Computing Lab (@haoailab)
产品发布 / 更新精选
FastVideo推出Dreamverse原型,实现"氛围导演"式实时视频生成
FastVideo团队发布Dreamverse原型界面,引入创新的"氛围导演"工作流。该模式允许用户通过自然语言实时、迭代地引导视频生成,如更换背景或调整运镜,无需编写复杂的长提示词。其核心是全新的实时推理栈,能在单GPU上以约4.55秒生成5秒1080p视频,速度快于观看时间,从而将生成过程从被动等待转变为实时导演体验。团队认为,视频生成的未来在于让创作速度跟上想象速度,快速的反馈循环比单纯追求模型性能更能催生优质作品。
信息来源:X:Sky Computing Lab (@haoailab)
模型发布 / 更新精选
推出 GPT-5.4 mini:
OpenAI 发布 GPT-5.4 mini,已在 ChatGPT、Codex 及 API 上线。针对编程、计算机使用、多模态理解与 subagents 优化,速度较 GPT-5 mini 提升 2 倍。
信息来源:X:Greg Brockman (@gdb) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
GPT-5.4 mini 今日上线 ChatGPT、Codex 及 API
GPT-5.4 mini 今日在 ChatGPT、Codex 和 API 中可用。针对编程、计算机使用、多模态理解和子代理场景优化,推理速度比 GPT-5 mini 快 2 倍。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT / GPT
论文研究精选
Hugging Face开源现状:2026年春季
Hugging Face发布了一篇关于其平台开源生态的博客文章。该文由Hugging Face官方撰写并发布在其自有平台上,内容聚焦于2026年春季的开源发展状态。文章具体分析了平台上的模型、数据集及开源社区活动趋势,但未提供详细的量化指标或具体产品发布信息。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
MiniMax M2.7:自我进化的早期回声
M2.7是M2系列中首个深度参与自身进化的模型。它能构建复杂的智能体框架,完成精细的生产力任务,尤其在软件工程方面表现突出,其SWE-Pro基准测试得分56.22%,接近Opus的最佳水平。模型的办公软件处理能力在开源模型中领先,GDPval-AA的ELO分数为1495。M2.7能保持97%的技能遵循率,处理超过40个、每个超过2000 token的复杂技能。该模型通过内部研究智能体框架,实现了"分析-修改-评估"的自主迭代优化循环,在内部评估中提升了性能。
信息来源:MiniMax:Blog(网页)
论文研究精选
Holotron-12B - 高吞吐计算机使用智能体
H公司发布了多模态计算机使用模型Holotron-12B。该模型基于NVIDIA开源的Nemotron-Nano-12B-VL模型,使用专有数据混合进行训练,专注于在交互环境中高效感知、决策和行动。其采用混合状态空间模型与注意力机制架构,在单张H100 GPU上实现了比前代Holo2-8B高2倍以上的吞吐量,在100并发基准测试中达到每秒8900个token。在WebVoyager基准测试中,性能从基线的35.1%提升至80.5%,在定位和导航基准上也显著提升。模型已通过N…
信息来源:Hugging Face:Blog(RSS) · NVIDIA / Hugging Face
模型发布 / 更新精选
推出 GPT-5.4 mini 和 nano
GPT-5.4 mini 与 nano 发布,为 GPT-5.4 的轻量高速版本,针对编程、工具调用、多模态推理及高并发 API 和子代理任务优化。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
模型发布 / 更新精选
Codex 现已支持 Subagents:有趣且能极速完成大量工作
Codex 新增 Subagents 功能,支持创建专业子代理并行处理任务,保持主上下文窗口整洁,并可实时引导单个代理,让工作流大幅提速。
信息来源:X:Greg Brockman (@gdb)
模型发布 / 更新精选
它也很聪明,但是……我基本同意这个观点,并且在 5.3 升级到 5.4 的过程中深有体会
GPT 5.4 虽强,但最突出的是人性化特质。相比已擅长编程的 5.3,5.4 更受欢迎的关键在于个性而非纯能力。用户声称想要高效自闭症天才程序员,实际渴望的是有性格的互动体验。
信息来源:X:Sam Altman (@sama) · GPT
模型发布 / 更新精选
GPT-5.4 API 首周表现亮眼
GPT-5.4 API 上线首周日处理量达 5T tokens,流量超过去年同期整个 API 总量,年化新增净收入突破 10 亿美元,增速创 OpenAI 模型发布历史纪录。
信息来源:X:Sam Altman (@sama) · OpenAI / GPT
观点 / 方法精选
直接动手做就行
Sam Altman 称赞 Codex 团队是硬核构建者,产品实力过硬,圈内硬核开发者已纷纷转向使用,使用量正快速增长。
信息来源:X:Greg Brockman (@gdb)
模型发布 / 更新精选
GPT-5.4 在 API 中的增速超越以往所有模型:上线一周内日处理 5T tokens…
GPT-5.4 上线一周内日处理 token 量达 5T,超过去年同期整个 API 的总量,年化新增净收入达 10 亿美元,增速创历史纪录。模型质量出色,值得试用。
信息来源:X:Greg Brockman (@gdb) · GPT
教程 / 实战精选
推荐:10万人亲测好用的原版OpenClaw安装器
Kimi支持的个人开发者开源项目OneClaw下载量突破10万,提供一键安装包,1分钟即可在本地部署原版OpenClaw,无需命令行或环境配置。功能包括纯净卸载、自由切换模型、远程控制,支持连接飞书、企微、钉钉、QQ、Kimi Claw;内置2万+技能的技能商店,可无损迁移记忆和Skills。Kimi提供包月方案和API按需购买。使用地址:oneclaw.cn。
信息来源:公众号:月之暗面(Kimi) · Kimi
模型发布 / 更新精选
Sam Altman 承认:实现 AGI 需要超越规模扩展的重大突破
OpenAI CEO Sam Altman 坦言,仅靠扩大模型规模无法达到 AGI,必须在架构层面实现重大创新。这一表态标志着 AI 发展范式的关键转向,承认当前"越大越好"的扩展策略已遇瓶颈。Altman 强调"是时候寻找新的架构了",暗示基于 Transformer 的现有技术路径难以通向通用人工智能,行业需要颠覆性技术突破而非单纯堆砌算力与参数。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI
论文研究精选
GLM-5-Turbo:龙虾增强的基座模型
智谱发布GLM-5-Turbo基座模型,代号"龙虾",强化工具调用、复杂指令拆解、定时任务与高吞吐长链路执行能力,推出ZClawBench基准测试。支持通过BigModel.cn、Z.ai及AutoClaw客户端接入,Coding Plan Max将于本月内支持Pro版。
信息来源:智谱:研究(网页内嵌数据) · GLM
模型发布 / 更新精选
未来两周,Claude 在周末及工作日 PT 5-11 点外使用额度翻倍
Claude 宣布未来两周内,周末及工作日太平洋时间(PT)5-11 点外的使用额度将翻倍。这是 Anthropic 对用户的感谢回馈,旨在缓解高峰时段压力的同时提升非高峰时段体验。
信息来源:X:Boris Cherny (@bcherny) · Claude
模型发布 / 更新精选
🤯 现可通过手机在笔记本电脑上启动 Claude Code 会话
Claude Code 推出远程控制功能,运行 `claude remote-control` 后可直接在手机 App 上启动电脑端新会话。该功能已向 Max、Team 及 Enterprise 用户(v2.1.74+)开放,目前需先在手机配置 GitHub,启动速度优化中。
信息来源:X:Boris Cherny (@bcherny) · Claude
模型发布 / 更新精选
Show HN: Context Gateway - 自动压缩 AI Agent 上下文再送入 LLM
YC 孵化的 Compresr 发布 Context Gateway,在 AI Agent 与 LLM 间自动压缩过长对话历史。后台预计算实现即时压缩,支持 Claude Code、Cursor 等,默认 75% 上下文阈值触发。curl 一键安装,TUI 向导配置。
信息来源:Hacker News:AI 热帖 · Claude / Cursor
模型发布 / 更新精选
🎁 周五快乐 -- Opus 4.6 1M 现已成为 Max、Team 及企业版 Claude Code 用户的默认模型
Claude Code 向 Max、Team 和企业版订阅用户默认启用 Opus 4.6 1M 模型,支持 100 万 token 上下文窗口。Pro 与 Sonnet 用户可通过 /extra-usage 指令手动开启该功能。
信息来源:X:Boris Cherny (@bcherny) · Claude
模型发布 / 更新精选
Claude Opus 4.6 与 Claude Sonnet 4.6 正式开放 100 万上下文窗口
Claude Opus 4.6 和 Claude Sonnet 4.6 的 100 万 token 上下文窗口现已正式开放(GA),用户可在这两款模型上使用百万级上下文处理能力。
信息来源:X:Claude (@claudeai) · Claude
行业动态精选
Dylan Patel - 深度剖析 AI 算力扩展的三大瓶颈
Dylan Patel 深度解析了制约 AI 算力规模扩张的三大核心瓶颈:电力基础设施限制、先进制程芯片产能不足以及网络互联带宽瓶颈。尽管 NVIDIA H100 已发布三年,受供需严重失衡及新一代芯片交付延迟影响,其市场价格与战略价值持续攀升,当前实际价值甚至超过发布初期。文章指出,这些结构性约束正重塑 AI 基础设施的投资逻辑与部署节奏。
信息来源:Dwarkesh Patel:Podcast & Blog(RSS) · NVIDIA
模型发布 / 更新精选
Claude 可直接在对话中构建交互式图表和图示
Claude 新增交互式图表与图示生成功能,支持在聊天中直接创建可视化内容。该功能今日起以 beta 形式向所有套餐用户开放,包括免费版。
信息来源:X:Claude (@claudeai) · Claude
观点 / 方法精选
事物的形态
盘点当前阶段的核心现状与关键特征,基于现有趋势分析接下来可能发生的重要变化与未来走向。
信息来源:Ethan Mollick:One Useful Thing(RSS)
模型发布 / 更新精选
Claude for Excel 与 Claude for PowerPoint 实现无缝同步
Claude for Excel 和 Claude for PowerPoint 新增跨文件上下文同步功能。同时打开多个文件时,对话上下文自动共享,可直接从表格提取数据构建演示文稿,无需重复说明操作步骤。
信息来源:X:Claude (@claudeai) · Claude
产品发布 / 更新精选
预期:IDE 时代已终结 / 现实:我们需要一个更大的 IDE
不是 IDE 时代结束,而是需要能管理 AI Agent 的"更大 IDE"。编程基本单位从文件变为 Agent,人类在更高层级编程。Karpathy 呼吁打造"Agent 指挥中心"式 IDE,支持多 Agent 状态监控、工具切换和用量统计。
信息来源:X:Andrej Karpathy (@karpathy)
模型发布 / 更新精选
Claude 新增交互式图表、图解与可视化功能
Claude 推出可视化功能测试版,支持在对话中实时生成交互式图表、图解等视觉内容,无需代码即可随对话调整修改。该功能不同于可下载的 Artifacts,以内联临时形式辅助理解当前话题,默认向所有套餐用户开启。同时 Claude 还新增食谱、天气等主题格式,并支持在对话内直接交互 Figma、Canva 和 Slack 等应用。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
设计可抵御提示注入的 AI agent
ChatGPT 防御提示注入与社会工程的方法:在 agent 工作流中约束高风险操作并保护敏感数据,避免 AI 智能体因恶意提示泄露信息或执行危险动作。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
从模型到智能体:为 Responses API 配备计算机环境
OpenAI 基于 Responses API、shell 工具与托管容器构建 agent runtime,支持文件处理、工具调用及状态管理,实现安全可扩展的智能体计算机环境部署。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
模型发布 / 更新精选
当今前沿推理模型的配方与 AlphaGo 惊人相似:
当今前沿推理模型的训练路径与 AlphaGo 高度一致:先模仿大量人类数据,再扩展推理计算(从蒙特卡洛树搜索到思维链),最后用强化学习突破模仿上限。Demis Hassabis 称,十年前 AlphaGo 的"第37步"预示 AI 可攻克真实科学难题,这些思路对构建 AGI 仍至关重要。
信息来源:X:Noam Brown (@polynoamial)
论文研究精选
Anthropic 成立 The Anthropic Institute
Anthropic 宣布成立 The Anthropic Institute,由联合创始人 Jack Clark 担任 Public Benefit 负责人并领导。该机构整合 Frontier Red Team、Societal Impacts 和 Economic Research 团队,利用构建前沿 AI 系统的独特信息优势,研究 AI 对就业、经济、法律及治理的挑战,并与外部合作应对风险。同时聘请 Matt Botvinick、Anton Korinek 等专家,探索…
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
十年前,AlphaGo 在首尔的传奇对局标志着现代 AI 时代的开启
十年前的 AlphaGo 首尔对局开启现代 AI 时代,标志性的"第37手"证明 AI 已能攻克科学等现实难题,其技术理念仍是构建 AGI 的核心基础。
信息来源:X:Demis Hassabis (@demishassabis)
模型发布 / 更新精选
Gemini 推出更新,让 Google Workspace 更个性化、实用且协作更高效
Gemini 为 Google Workspace 推出多项 AI 功能:支持选择来源秒级生成 Doc 草稿、9 倍速构建复杂 Sheets、提示词生成品牌风格 Slide 布局,Drive 搜索现可直接显示摘要答案。今日起向 Ultra 和 Pro 订阅者开放英文版 beta,Docs/Sheets/Slides 全球可用,Drive 仅限美国。
信息来源:X:Sundar Pichai (@sundarpichai) · Gemini
模型发布 / 更新精选
改进前沿 LLM 的指令层级
IH-Challenge 训练模型优先处理可信指令,改进指令层级、安全可控性,并提升对提示词注入攻击的抵抗能力。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
ChatGPT 推出数学与科学学习新方式
ChatGPT 新增数学与科学交互式可视化解释功能,支持实时探索公式、变量及概念,帮助学生更直观地理解理科知识。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
行业动态精选
Advanced Machine Intelligence(AMI Labs)新创公司正式亮相
AMI Labs 宣布获 10.3 亿美元种子轮融资,由 Cathay Innovation、Bezos Expeditions 等领投,创欧洲公司种子轮纪录。公司致力于开发基于世界模型的新型 AI 系统,具备理解世界、持久记忆、推理规划及可控安全能力,团队分布于巴黎、纽约、蒙特利尔和新加坡。
信息来源:X:Yann LeCun (@ylecun)
观点 / 方法精选
i'm joining forces with @ylecun and an incredible group of people to start AMI Labs @amilabs. AMI …
我与 @ylecun 和一群杰出人士联手创立 AMI Labs @amilabs。
信息来源:X:谢赛宁 (@sainingxie)
模型发布 / 更新精选
Hugging Face Hub 正式推出 Storage Buckets 存储服务
Hugging Face Hub 发布 Storage Buckets,这是一种为机器学习工作流设计的可变、类 S3 的对象存储服务。它基于 Xet 存储后端,能对跨文件共享内容的 ML 工件进行高效去重,从而节省带宽、加速传输并降低存储成本。该服务还提供"预暖"功能,可将数据预先迁移至靠近计算资源的云区域,以提升分布式训练等场景的效率。目前支持 AWS 和 GCP,用户可通过 CLI 或 Python 库在 2 分钟内快速创建和同步存储桶。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
保持令牌流动:16个开源强化学习库的教训
同步强化学习训练中,数据生成是主要瓶颈,如在320亿参数模型上生成3.2万令牌样本需数小时,导致训练GPU闲置。业界主流解决方案是将推理与训练解耦到不同GPU池,通过rollout缓冲区连接并异步传输权重。本文调研了16个实现此模式的开源库,从编排原语、缓冲区设计、权重同步协议、陈旧数据处理、部分rollout支持、LoRA支持及分布式训练后端七个维度比较。关键发现:Ray在编排层占主导(8/16库使用),NCCL广播是默认权重传输方式,LoRA训练支持普遍不足,而分布式M…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究精选
LeRobot v0.5.0: 扩展每一个维度
Hugging Face 发布了 LeRobot v0.5.0 版本。该版本在数据集、模型、任务和社区四个维度上进行了全面扩展。具体包括:引入了新的现实世界和模拟数据集,推出了支持多任务学习的模型,并扩展了任务范围至移动操作和双臂协调。社区方面,提供了更易用的库、演示应用和教学资源。此次更新的核心目标是降低机器人技术的应用门槛,推动其民主化发展。
信息来源:Hugging Face:Blog(RSS) · Hugging Face