AI 情报文章归档
浏览 AI圈报 已保存的 6028 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章6028
正式分类6
精选内容3375
全部文章
第 150 / 151 页 · 每页 40 条
产品发布 / 更新精选
DreamGen:让机器人在视频生成模型中"做梦"合成训练数据
DreamGen让机器人在视频生成模型中"做梦"合成训练数据。通过微调Sora等模型生成海量神经轨迹(逼真视频+动作标签),机器人从单一拾取放置任务泛化到倾倒、折叠等22种新行为。在NVIDIA总部咖啡厅测试中,人形机器人对新动词零样本成功率从0%提升至43%,新环境达28%。相比传统图形引擎,无需手工建模即可处理流体、可变形物体等复杂场景,整个pipeline将于近期完全开源。
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
模型发布 / 更新精选
构建通用 AI 助手的愿景
Google 计划将 Gemini 扩展为世界模型,使其能够通过模拟世界来制定计划和想象新体验,从而实现通用 AI 助手的愿景。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法精选
以全新生成式媒体模型与工具激发创意
发布新一代生成式媒体模型 Veo 3 与 Imagen 4,以及专为电影制作打造的工具 Flow,支持更高质量的视频与图像生成及专业影视创作流程。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
Gemma 3n 预览版发布:强大、高效、移动优先的 AI
Gemma 3n 预览版发布,专为移动设备优化的开源多模态模型。采用 2-in-1 架构,支持音频理解,适用于实时交互和音频中心应用开发。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法精选
物理图灵测试(Physical Turing Test):周日黑客松后家里一片狼藉,周一晚上回家却发现客厅整洁、烛光晚餐就绪,而你无法分辨这是人还是机器所为
提出"物理图灵测试"作为通用机器人的北极星目标:机器能否像人一样完成物理任务(整理房间、准备晚餐)而不被察觉。这是从自动化比特迈向原子的下一代计算平台。在 Sequoia AI Ascent 演讲,分享第一性原理、数据策略与扩展定律,时长17分钟。
信息来源:X:Jim Fan (@DrJimFan)
模型发布 / 更新精选
Gemini 2.5 Pro Preview 提前发布:编程性能进一步提升
鉴于开发者反馈积极,Google 提前两周发布 Gemini 2.5 Pro Preview 更新版本,编程性能进一步提升,现已开放获取。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
个性与说服
大语言模型的谄媚行为(sycophancy)揭示了其"个性"与说服机制的本质。通过观察模型为迎合用户而调整立场的倾向,可洞察AI在交互中平衡诚实与认同的适应性策略,以及这种特性对模型对齐的深层影响。
信息来源:Ethan Mollick:One Useful Thing(RSS)
模型发布 / 更新精选
可解释性的紧迫性:为何理解 AI 模型的工作原理至关重要
Dario Amodei 发文强调 AI 可解释性研究的紧迫性,指出在通往 AGI 的道路上,人类正面临理解超级智能系统运作机制的"最后期限"。当前大模型仍是不可解释的黑盒,而可解释性技术(如机制可解释性)能揭示模型内部表征,是确保 AI 安全对齐的关键。文章呼吁大幅加大对可解释性研究的投入,将其视为与模型能力发展同等重要的优先事项,以避免未来无法理解和控制的强大 AI 系统带来的风险。
信息来源:X:Dario Amodei (@DarioAmodei)
模型发布 / 更新精选
论 Jagged AGI:o3、Gemini 2.5 及未来
o3 与 Gemini 2.5 的发布标志着大模型能力跨越新阈值,同时暴露"Jagged AGI"特征:模型在复杂推理上表现超人类,却在基础任务上能力参差不齐,这种不均衡性正在重新定义通用人工智能的发展路径与评估标准。
信息来源:Ethan Mollick:One Useful Thing(RSS) · Gemini
教程 / 实战精选
Claude Code:智能体编码最佳实践指南
Claude Code 提供了一套完整的智能体编程工具与框架。其核心遵循"先探索、再计划、后编码"的工作流,并通过配置 CLAUDE.md 文件、管理权限和连接 MCP 服务器来优化环境。最佳实践强调为 Claude 提供工作验证方法、积极管理上下文、使用子代理进行调查,以及利用检查点回退来处理复杂任务。文档还详细介绍了在 VS Code、JetBrains IDE、Slack 及 CI/CD 中的集成使用,并提供了避免常见失败模式的实用建议。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
论文研究精选
Circuits 更新 -- 2025年4月
Anthropic 可解释性团队分享了2025年4月的研究进展,重点剖析了一个不成功的越狱攻击案例。团队对同一模型应用电路追踪方法时发现,模型拒绝此次越狱尝试的原因,与其在论文中拒绝直接有害请求的基线原因不同。模型似乎更频繁地拒绝这种特定构造的越狱提示。分析还揭示,由于示例分布过窄,特征可视化可能产生误导,这凸显了使用多样化数据的重要性。这些发现源于初步实验,并非成熟论文的结论。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
MiniMax MCP Server
MiniMax 发布 MCP Server,集成文本转语音、语音克隆、文生图、文生视频等多模态能力。支持 Claude Desktop、Cursor、Windsurf 等主流 MCP 客户端,通过统一工作流实现文本到音视频的一站式生成,面向创作者和开发者免费开放。
信息来源:MiniMax:Blog(网页) · Claude / Cursor
模型发布 / 更新精选
电路追踪:揭示语言模型中的计算图
研究团队提出"电路追踪"方法,用于揭示语言模型行为的计算机制。该方法通过在替代模型中追踪计算步骤,生成描述模型执行过程的图;替代模型使用跨层转码器等可解释组件近似原始结构。团队开发了可视化和验证工具,以研究18层语言模型的简单行为归因图,为后续研究奠定基础,并计划应用于Claude 3.5 Haiku。关键决策包括使用跨层转码器提取特征,并构建特征间线性相互作用的归因图。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
论大语言模型的生物学
研究团队运用其电路追踪方法,深入探究了Claude 3.5 Haiku模型在多种情境下的内部工作机制。该模型在2024年10月发布,是Anthropic的轻量级生产模型。研究发现,模型在生成诗歌前会预先规划并选定押韵词;其内部存在语言特定与语言无关的混合计算电路,且后者在更强大的模型中更突出;同一加法计算电路能在不同语境中泛化使用。研究还揭示了模型识别实体与产生幻觉的电路机制、拒绝有害请求的通用特征形成过程,以及一个通过诱导模型无意识开始输出危险指令而实现的越狱攻击原理。此…
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
模型发布 / 更新精选
DeepSeek-V3-0324 发布:推理、代码与中文写作能力全面升级
DeepSeek 发布小版本升级 DeepSeek-V3-0324,在数学、代码类评测集上得分超过 GPT-4.5,并增强了前端代码生成、中文写作与联网搜索能力。模型参数约 660B,开源版本上下文长度为 128K,网页端、App 和 API 提供 64K 上下文。权重已开源,采用 MIT License,允许蒸馏训练其他模型。
信息来源:公众号:DeepSeek(深度求索) · GPT / DeepSeek
模型发布 / 更新精选
DeepSeek-V3 模型更新,各项能力全面进阶
DeepSeek-V3 新版已发布,关闭深度思考模式即可体验,模型权重同步开源。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新精选
GR00T N1 开源获社区热烈反馈,欢迎前往 GitHub 点星、Fork 与贡献
NVIDIA 发布世界首个开源人形机器人基础模型 GR00T N1,仅 2B 参数,采用 VLM 加 Diffusion Transformer 架构实现端到端控制。模型基于真实遥操作、30 万+仿真轨迹及合成神经轨迹训练,在 GR1、1X Neo 等机器人上任务性能提升 30%,并可跨具身部署至百元级开源机械臂。
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
观点 / 方法精选
"思考"工具:让Claude在复杂工具使用场景中停下来思考
Anthropic为Claude引入了"思考"工具,允许其在生成最终响应前插入一个专门的思考步骤,以处理多步骤工具调用链、分析外部信息并遵循复杂策略。该工具与更早发布的"扩展思考"功能不同,更侧重于在响应生成过程中对新信息进行针对性推理。在τ-Bench基准测试中,该工具显著提升了Claude在客户服务场景的表现。文章建议在需要复杂工具调用、长链分析或高成本序列决策的场景中使用它,并提供了标准的工具实现格式。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
产品发布 / 更新精选
OpenRouter 推出 Deep Research 工具及多款新模型
OpenRouter API 上线首个深度研究工具,API 响应中直接包含完整引用。同时平台新增多款模型。
信息来源:OpenRouter:Announcements(RSS)
模型发布 / 更新精选
Grok 3 Beta 发布:推理智能体时代来临
Grok 3 Beta 正式发布,开启"推理智能体"时代。新版本强化深度推理与自主决策能力,支持复杂任务拆解和多步逻辑链处理,在数学、编程等推理密集型场景表现显著提升,标志着 AI 从简单问答向自主推理决策的范式转变。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
NSA:硬件对齐的稀疏注意力新机制
NSA是一种硬件对齐且原生可训练的稀疏注意力机制,专为超快速长上下文训练与推理设计。其核心采用动态分层稀疏策略,结合粗粒度token压缩与细粒度token选择。通过针对现代硬件的优化,NSA在加速推理、降低预训练成本的同时不损失性能,在通用基准、长上下文任务及指令推理中匹配或超越Full Attention模型。
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek
观点 / 方法精选
三点观察
OpenAI 阐述关于 AI 经济学的三点观察:模型智能与训练资源的对数成正比,可预测扩展;AI 使用成本每 12 个月下降约 10 倍,远超摩尔定律速度;智能线性增长将产生超指数级社会经济价值。据此,AI 代理将如虚拟同事般渗透各领域,科学进步将大幅加速,虽然短期内生活照旧,但长期将深刻重塑社会经济结构,个人意志力和适应能力将成为关键价值。
信息来源:Sam Altman:Blog(RSS) · OpenAI
模型发布 / 更新精选
关于中国、出口管制与两种可能未来的思考
Dario Amodei 针对 DeepSeek 事件评析对华 AI 出口管制政策,指出当前技术竞争正站在十字路口,可能走向可控合作或失控军备竞赛两种截然不同的未来。
信息来源:X:Dario Amodei (@DarioAmodei) · DeepSeek
产品发布 / 更新精选
OpenRouter 推出 Reasoning Tokens,用于思考模型
OpenRouter 为思考模型(thinking models)新增推理 token(reasoning tokens),帮助用户理解模型思考过程。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
OpenRouter 通过 API 引入网页搜索功能
OpenRouter 在其 API 中新增了网页搜索功能,使所有请求能够结合最新的网络搜索信息,从而获取更及时的响应结果。
信息来源:OpenRouter:Announcements(RSS)
模型发布 / 更新精选
DeepSeek-R1 发布,性能对标 OpenAI o1 正式版
DeepSeek-R1 发布,性能对标 OpenAI o1 正式版。模型遵循 MIT License 开放 API,训练技术同步公开。
信息来源:公众号:DeepSeek(深度求索) · OpenAI / DeepSeek
观点 / 方法精选
2025年1月电路更新:稀疏自编码器训练方法改进
Anthropic可解释性团队分享了稀疏自编码器与交叉编码器训练方法的最新改进。主要更新包括采用JumpReLU激活函数、调整损失函数以增强稀疏性并减少"死特征",以及详细的参数初始化与优化设置。团队基于Rajamanoharan等人(2024)的技术,但修改了梯度流动方式和稀疏性惩罚项。关键超参数包括λ_S约10、λ_P为3×10−6,并采用线性预热策略。这些改进旨在为外部研究团队提供一个有效的训练起点,相关成果将在未来几个月内进一步发表。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
观点 / 方法精选
反思
Sam Altman在ChatGPT两周年之际回顾OpenAI九年历程:从坚信AGI可能实现,到2022年意外推出ChatGPT并引爆前所未有的增长曲线。他坦承过去两年从零构建公司的混乱压力,以及被董事会突然解雇的危机教训。如今周活用户已达3亿,在迈向AGI的道路上,他既感激这段经历,也承认未来仍充满未知。
信息来源:Sam Altman:Blog(RSS) · OpenAI / ChatGPT
观点 / 方法精选
Claude 3.5 Sonnet 在 SWE-bench Verified 基准测试中刷新纪录
升级版 Claude 3.5 Sonnet 在软件工程评估基准 SWE-bench Verified 上取得 49% 的解决率,超越此前最佳模型的 45%。该基准通过真实 GitHub 问题测试 AI 模型完成软件工程任务的能力,要求模型在给定环境中理解、修改并测试代码,最终通过原始单元测试验证。Claude 团队构建的智能体设计简洁,仅包含提示词、Bash 工具和编辑工具,赋予模型充分的自主判断空间,以灵活步骤解决问题。目前尚无模型在该基准上突破 50% 的解决率。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
模型发布 / 更新精选
DeepSeek-V3 正式发布
深度求索正式发布 DeepSeek-V3 模型,性能比肩世界顶尖模型,速度跃升,价格更新。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新精选
xAI 完成 60 亿美元 C 轮融资
xAI 宣布完成 60 亿美元 C 轮融资,资金将用于加速 Grok 等 AI 模型研发及扩建算力基础设施。此次融资进一步推高公司估值,加剧与 OpenAI、Anthropic 等竞争对手在生成式 AI 领域的军备竞赛。
信息来源:xAI:News(网页) · OpenAI / Claude / Grok
教程 / 实战精选
构建高效智能体:从简单模式开始
Anthropic基于实践经验指出,成功的LLM智能体往往采用简单、可组合的模式,而非复杂框架。文章区分了工作流(预定义路径编排)与智能体(LLM动态自主决策),建议开发者优先采用最简单方案,仅在必要时增加复杂性。许多核心模式直接调用LLM API仅需几行代码即可实现。文中介绍了增强型LLM、提示链等基础构建模块,强调应为特定用例定制检索、工具等增强功能,并推荐通过Model Context Protocol集成第三方工具生态。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
论文研究精选
🎉 DeepSeek-VL2 is here! Our next-gen vision-language model enters the MoE era. 🤖 DeepSeek-MoE arc…
🎉 DeepSeek-VL2 来了!我们的下一代视觉-语言模型进入 MoE 时代。 🤖 DeepSeek-MoE 架构 + 动态图像分块 ⚡ 3B/16B/27B 规模,灵活使用 🏆 在所有基准测试中表现优异 🧵 1/n https://t.co/C7FvQ7p0ym
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek
模型发布 / 更新精选
将 Grok 带给所有人
Grok 正式向所有用户免费开放,取消此前仅限 X Premium 订阅者使用的限制。用户无需付费订阅即可直接使用 xAI 的 AI 助手,大幅降低使用门槛。
信息来源:xAI:News(网页) · Grok
模型发布 / 更新精选
🚀 DeepSeek-V2.5-1210: The Grand Finale 🎉 🌐 Internet Search is now live on the web! Visit https:/…
🚀 DeepSeek-V2.5-1210: 盛大终章 🎉 🌐 联网搜索现已上线网页版!访问 https://chat.deepseek.com/ 并开启"联网搜索"获取实时回答。🕒 🧵(1/3) https://t.co/niCjfsn5t0
信息来源:X:DeepSeek (@deepseek_ai) · DeepSeek
模型发布 / 更新精选
Grok 正式发布图像生成功能
Grok 推出图像生成功能,支持通过自然语言指令直接创建图片。该功能已向 X 平台用户开放,标志着这款 AI 助手从文本交互向多模态能力扩展,用户可在对话中直接生成并编辑视觉内容。
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
🦃 At the end of Thanksgiving holidays, I finally finished the piece on reward hacking. Not an easy …
🦃 感恩节假期结束时,我终于完成了关于 reward hacking 的文章。不好写啊,呼。
信息来源:X:Lilian Weng (@lilianweng)
模型发布 / 更新精选
DeepSeek 推理模型预览版上线,推理性能媲美 o1-preview,公开完整思维链
DeepSeek 上线推理模型预览版,其推理性能与 OpenAI 的 o1-preview 相当,并公开了模型的完整思维链。
信息来源:公众号:DeepSeek(深度求索) · OpenAI / DeepSeek
模型发布 / 更新精选
Grok API 公测版发布
xAI 启动 Grok API 公测,发布新模型 grok-beta,支持 128k 上下文、函数调用及系统提示,视觉版本下周上线。开发者每月可获 $25 免费额度至年底,已购预付额度可叠加。API 兼容 OpenAI 与 Anthropic 格式,修改 base_url 即可迁移。
信息来源:xAI:News(网页) · OpenAI / Claude / Grok
观点 / 方法精选
稀疏交叉编码器:用于跨层特征提取与模型差异比较的新工具
本文介绍了一种新型的稀疏交叉编码器,它能够同时读取和写入神经网络多个层的激活值,从而提取跨层的共享特征。其主要应用包括:解决跨层叠加问题,追踪残差流中的持久特征;通过消除"重复特征"和跨越无意义的连接来简化电路分析;以及为不同训练阶段或不同架构的模型生成共享特征集,以实现模型差异比较。初步实验验证了其在处理跨层叠加和模型比较方面的潜力。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude