AI 情报文章归档
浏览 AI圈报 已保存的 5733 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5733
正式分类6
精选内容3361
全部文章
第 103 / 144 页 · 每页 40 条
行业动态精选
Anthropic提交IPO申请,标志AI走向企业级应用
Anthropic提交IPO申请,标志生成式AI从研究风险投资阶段转向成熟企业级应用。私人市场模型开发者此前优先快速迭代与算力性能,上市后将使工程目标与标准企业采购流程对齐,引入结构化发布周期和可预测计费模式。
信息来源:Artificial Intelligence News(RSS) · Claude
产品发布 / 更新精选
OpenClaw 与微软合作进入企业生态
"你现在可以在公司内部运行 OpenClaw 了。" 宣布我们与 @Microsoft 的合作,将 OpenClaw 带入微软和 Windows 生态系统。Claws 现在可以在企业环境中安全运行。
信息来源:X:OpenClaw (@openclaw)
产品发布 / 更新精选
GitHub Copilot应用:智能体原生的桌面体验
在微软 Build 2026 大会上,GitHub 发布了新的工具和更新,并将 Copilot 应用定位为"智能体原生的桌面体验"。其核心目标是让 AI 智能体能够以用户已经习惯的方式进行工作。
信息来源:GitHub Blog
教程 / 实战精选
Claude Code团队实践:智能体编程如何重塑工程组织与流程
在Code w/ Claude SF 2026活动上,Claude Code工程团队分享了将智能体编程设为默认工作方式后带来的流程与结构变革。核心变化包括:规划转向即时(JIT)模式,强调快速原型与反馈;上下文收集变为"先问Claude";代码审查中Claude处理风格与测试,人工专注于法律、安全等专业判断。新范式下,工程瓶颈从编写代码转向验证、审查与安全维护。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
LangChain 发布 Rubrics:让 AI 智能体自我评估并修正工作
LangChain 推出 Rubrics,通过 RubricMiddleware 为智能体运行添加自我评估循环。用户可设定评分标准并配置评分器,在需要高正确性的任务中获得可靠输出。
信息来源:LangChain:Blog(RSS)
产品发布 / 更新精选
OpenAI Codex Sites 功能发布
构建应用从未如此简单。 通过 Sites,Codex 可以将你的工作、想法和计划转化为一个交互式网站或应用,你的团队可以通过一个 URL 进行探索、使用和分享。 该功能将首先向 Business 和 Enterprise 计划推出,之后会更广泛地扩展。
信息来源:X:OpenAI (@OpenAI) · OpenAI
产品发布 / 更新精选
DigitalOcean AI云服务上线OpenRouter
⚡ 新增服务商:DigitalOcean 的 AI-Native Cloud 现已在 OpenRouter 上线。 提供高性能推理,覆盖热门开源权重模型。在 DeepSeek V3.2 的输出速度和延迟方面排名第一(数据来自 @ArtificialAnlys)。 查看其数据并试用模型:https://openrouter.ai/provider/digitalocean
信息来源:X:OpenRouter (@OpenRouter) · DeepSeek
观点 / 方法精选
Anthropic 用 Claude 赋能自助数据分析
Anthropic 使用 Claude 自动化了 95% 的业务分析查询,整体准确率约 95%。其关键在于构建智能体分析栈(agentic analytics stack),通过数据基础层、维护验证流程和技能(skills)分别解决概念-实体歧义、数据过时和检索失败三大错误来源。相比编码场景,数据分析的难点在于将用户问题映射到正确的数据实体,而执行 SQL 反而是简单的。Anthropic 的数据科学团队因此得以专注于因果建模、预测和机器学习等战略工作。
信息来源:Claude:Blog(网页) · Claude
教程 / 实战精选
Claude Cowork 入门最佳实践
Anthropic 增长营销负责人 Austin Lau 介绍了非技术知识工作者使用 Claude Cowork 的最佳实践。Claude Cowork 是面向文档、电子表格等多步骤任务的 AI 助手,用户无需编程技能,将其指向文件夹或连接已有应用即可委托任务。与用于快速问答和头脑风暴的 Chat 以及面向开发者的 Claude Code 不同,Claude Cowork 适用于需要产出交付物、涉及多个文件或应用、可重复执行的场景。Lau 给出了判断任务是否适合的五项检查清…
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
Claude Code技能使用经验:Anthropic内部实践
Anthropic 分享了内部使用 Claude Code 的 Skills(技能)功能的经验。Skills 是指令、脚本和资源的文件夹,智能体可发现并调用它们以提升准确性和效率。Anthropic 内部已有数百个活跃使用的技能,它们可归为九类,包括库和 API 参考、产品验证、数据获取与分析、业务流程与团队自动化、代码脚手架与模板、代码质量与审查等。最佳技能专注于单一类别,涵盖过多功能会混淆智能体。团队发现,投入时间优化验证类技能对 Claude 输出质量的提升最显著。
信息来源:Claude:Blog(网页) · Claude
模型发布 / 更新精选
Gemma 4 12B:开发者指南
Gemma 4 12B 是一款密集多模态模型,专为消费级设备上的高性能本地 AI 执行而设计。其采用新颖的无编码器架构,绕过传统视觉和音频编码器,将多模态数据直接输入大语言模型主干。
信息来源:Google Developers Blog(RSS)
模型发布 / 更新精选
Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型
Gemma 4 12B 是 Google DeepMind 最新推出的中等规模多模态模型,采用无编码器统一架构,原生支持音频输入。其基准测试性能接近 26B MoE 模型,但内存占用不到一半,仅需 16GB 显存或统一内存即可在消费级笔记本上本地运行。模型内置多 token 预测(MTP)drafter 以降低延迟,基于 Apache 2.0 开源许可发布,已累计超过 1.5 亿次下载。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法精选
洪水韧性新篇章:Google 开源水文建模框架
Google Research 在 GitHub 开源了其水文建模框架,这是一个基于 PyTorch 的 Python 包,采用与 Flood Hub 河段洪水预报相同的模型架构和训练数据。该框架允许研究者和预报员训练 AI 洪水预报模型、添加新模型与数据,并已与捷克水文气象研究所(CHMI)等合作测试。开放模型架构和训练管线旨在让各国气象水文部门在保留数据完全控制权的同时,整合基于 AI 的洪水预报。
信息来源:Google Research:Blog(网页)
论文研究精选
AI驱动的网络威胁映射:LLM ATT&CK Navigator的洞察
Anthropic分析了832个因违反政策被封禁的恶意账户(2025年3月至2026年3月),将其活动映射到MITRE ATT&CK框架的全部14种战术和482种子技术。风险评分显示,中等及以上风险行为者比例从上半年的33%跃升至下半年的56%,增长集中在横向移动、凭证窃取、webshell等高危技术。Agentic scaffolding使攻击链实现自主编排--2025年11月一次间谍活动风险评分达100,所用技术数量却与中等风险者相当。MITRE ATT&CK框架尚未覆…
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
观点 / 方法精选
Gary Marcus:为什么事情终将崩塌
知名人工智能批评者Gary Marcus在其关于可信赖AI的专栏中,探讨了人工智能发展面临的根本性挑战。文章开篇即指向问题的核心,指出相关数学理论的局限性与人类心理的复杂性,是导致AI系统最终可能出现问题的根源。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
模型发布 / 更新精选
MAI-Image-2.5 launches at No. 2 for image editing on Arena
信息来源:Microsoft AI:官方博客(网页)
观点 / 方法精选
商汤开源SenseNova-Skills AI办公技能套件
商汤开源了AI办公技能套件SenseNova-Skills。这是一个为任何技能兼容智能体(如OpenClaw与HermesAgent)设计的开源技能集合,提供四大核心功能:图像信息图表生成(可镜像参考风格)、数据分析(支持多表解析、清洗与可视化)、PPT创建(生成大纲内容并智能排版,输出可编辑文件)以及深度研究(跨学术、技术、社交等多源搜索并生成报告)。该技能套件现已完全开源。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
模型发布 / 更新精选
Holo3.1:快速本地计算机使用智能体
Holo3.1 是基于 Qwen 模型家族的计算机使用智能体系列,旨在提升在桌面、网页和移动环境中的鲁棒性。新模型提供 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次发布量化检查点,包括 FP8、Q4 GGUF 和 NVFP4,以优化本地推理。在 AndroidWorld 基准测试中,35B-A3B 模型得分从 67% 提升至 79.3%。在 DGX Spark 上,NVFP4 量化相比 BF16 实现 1.74 倍 token 吞吐量提升,并将平均步骤时间从 …
信息来源:Hugging Face:Blog(RSS) · Qwen / Hugging Face
行业动态精选
Nathan Lambert离开Ai2,结束2.5年OLMO等项目工作
Ai2(Allen Institute for AI)研究员Nathan Lambert宣布离职。他在Ai2工作超过2.5年,期间主导或参与了OLMO和Tulu等开源模型项目,称其为职业生涯的巅峰。他表示将暂时休息,未来仍会继续深耕开源模型与开放科学领域。
信息来源:X:Nathan Lambert (@natolambert)
产品发布 / 更新精选
MiniCPM-V 4.6 现已支持 vLLM v0.22.0
MiniCPM-V 4.6 现已完全支持 vLLM v0.22.0! 无需自定义分支,无需额外编译。 只需拉取预构建包即可运行。 非常感谢 @vllm_project 的顺畅集成! 🤝 🤗 http://huggingface.co/openbmb/MiniCPM-V-4.6
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · Hugging Face
行业动态精选
Anthropic扩展Project Glasswing计划
Anthropic正将其Project Glasswing计划扩展至约150个新组织,此前首批约50个合作伙伴。新伙伴分布于十五个多国家,覆盖电力、水务、医疗、通信和硬件等关键基础设施行业。这些合作伙伴的共同点在于,其代码库若遭成功攻击,后果可能极其严重,影响或超1亿人。项目旨在利用Claude Mythos Preview等前沿模型扫描漏洞并协助修复,以应对AI驱动的网络安全挑战。同时,Anthropic推出了基于Claude Opus 4.8等公开模型的Claude S…
信息来源:Anthropic:Newsroom(网页) · Claude
论文研究精选
世界模型与语言模型:论具体推理与抽象推理的互补性
本研究探讨了世界模型与多模态大语言模型在预测未来状态时的互补性。世界模型可生成具体的视觉未来轨迹,但可能视觉合理却任务错误;多模态大语言模型则擅长抽象推理。为此,研究提出了"受控的具体推理"框架,并构建了VRQABench和OpenWorldQA两个基准。同时,提出了Privileged-Future On-Policy Self-Distillation(PF-OPSD)方法,该方法在训练时利用真实未来视频作为特权上下文评估推理轨迹,但部署时无需真实未来。实验结果显示,P…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
蚂蚁 inclusionAI 开源万亿参数 MoE 基座模型 Ling-2.6-1T-base
Ling-2.6-1T-base 是蚂蚁 inclusionAI 开源的万亿参数 MoE 基座模型(总参约 1T,激活 63B)。它由 Ling-2.0-1T-base 升级而来,采用 Lightning Attention 与 MLA 以 7:1 混合的线性注意力架构,经约 9.6T token 的迁移预训练、持续预训练和中训练,上下文窗口从 4K 分阶段扩展至 256K。在 MMLU(86.82)、SimpleQA、LongBenchv2(43.54)等基准上超越前代。…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
Building a hill-climbing machine: Launching seven new MAI models
信息来源:Microsoft AI:官方博客(网页)
论文研究精选
Anthropic可解释性研究:区分因果效应相似的特征
Anthropic可解释性团队介绍了其Circuits研究的新进展。为区分那些激活模式相似但因果效应不同的模型特征,团队提出一种新方法。该方法通过分析特征的下游连接来预测其实际影响,并使用基于共激活统计的TWERA(虚拟权重)对连接进行加权排序。实验表明,借助下游连接信息能更准确地判断哪个特征会引导特定输出。此方法为识别模型内部真正的因果组件提供了新途径。
信息来源:Anthropic:Transformer Circuits(可解释性研究) · Claude
产品发布 / 更新精选
Codex 赋能每一种角色、工具和工作流
OpenAI 的 Codex 新增了插件、站点和注释等功能。这些新功能旨在帮助分析师、营销人员、设计师、投资者等各类团队,利用 AI 完成更多工作。Codex 进一步拓展其作为 AI 编码工具的应用场景,以支持更广泛的角色、集成更多工具并优化现有工作流。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
行业动态精选
SK会长崔泰源:SK海力士计划未来五年内晶圆产能翻倍
SK海力士会长崔泰源宣布,计划在未来五年内将整体晶圆产能提高一倍,以应对AI普及带来的持续存储供应短缺。他预测AI数据中心和AI PC的普及将持续拉动存储需求,供需紧张局面可能延续至2030年。SK海力士将投入大规模资金用于设备、建设等扩张,尽管面临前置时间长(新建晶圆厂至少三年)和资源成本上涨等挑战。目前,SK海力士市值已首次突破1万亿美元。
信息来源:IT之家(RSS)
模型发布 / 更新精选
商汤 SenseNova U1 发布信息图专用模型
感谢使用我们的模型来创建这些复杂的图表和图表。 看到具有挑战性的信息被转化为清晰、准确和可读的视觉效果真是太棒了。这就是我们的目标。😄
信息来源:X:商汤 SenseTime (@SenseTime_AI)
观点 / 方法精选
基于 Codex 的开源 AI 技能"清理垃圾.skill":自动扫描电脑生成 HTML 报告,一键清理垃圾
作者基于 Codex 创建并开源了"清理垃圾.skill",可对 Mac 和 Windows 电脑进行只读扫描,自动生成可交互的 HTML 报告,将文件按优先级分为绿灯(可自动清理)、黄灯(建议手动)、红灯(跳过)。在作者的 MacBook Air 上扫出近 120 GB 垃圾,其中 96.7 GB 为 B 站离线缓存视频,而 CleanMyMac 仅检出 15.8 GB。用户可在网页上逐项或一键清理,全程需二次确认,项目已开源至 GitHub。
信息来源:公众号:数字生命卡兹克
论文研究精选
KPop:用对称二元KL散度解决大模型强化学习的训练推理不一致问题
蚂蚁百灵团队提出KPop方法,应对大模型强化学习中训练与推理引擎概率分布不一致导致的训练崩溃。KPop用对称二元KL散度替代IcePop的固定比值阈值,仅需一个超参数,对稀有token自适应宽容、对高频token严格约束。在Ring-flash-2.0(总参100B)上支撑800+步稳定RL训练,SWE-bench Verified从70.8%提升至76.28%。
信息来源:公众号:蚂蚁百灵(Ling)
行业动态精选
OpenAI + Amazon Bedrock:
OpenAI的GPT-5.5、GPT-5.4及Codex编程智能体现已在Amazon Bedrock平台正式上线。开发者可通过Bedrock的下一代推理引擎部署这些模型,享受自动扩展能力。具体应用包括使用GPT-5.5和GPT-5.4构建能处理多步骤编码、数据分析和知识工作的自主AI智能体,或将Codex编程智能体集成至开发工作流,并通过Bedrock进行所有模型调用。该服务按token计费,支持弹性扩展。
信息来源:X:Greg Brockman (@gdb) · OpenAI / GPT
观点 / 方法精选
Karpathy 分享学习方法论
🎯 Andrej Karpathy 谈如何学习。
信息来源:X:Rohan Paul (@rohanpaul_ai)
论文研究精选
ACTS:面向高效可控LLM推理的智能体链式思维引导
ACTS将推理引导建模为马尔可夫决策过程,控制器智能体在推理中自适应引导冻结的推理器。控制器每步观察推理轨迹与剩余预算,发出含推理策略和引导短语的动作,实现预算感知的推理控制。控制器通过合成轨迹初始化,并经强化学习优化。在多个基准上,ACTS以显著token节省匹配全思考性能,实现可控的精度-效率权衡。代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
开放模型的繁荣生态
根据OpenRouter平台数据,自2025年以来,开放模型使用量显著增长。最新数据显示,开放权重模型产生了69.1%的token使用量,闭源模型为30.9%。新模型的发布会吸引开发者测试,推动token使用量达到新的平台期。开放模型市场内部竞争激烈,领导地位频繁更迭,如DeepSeek的早期优势在2025年末至2026年初被MiniMax与Kimi模型取代,随后MiMo、Qwen、腾讯Hy3、阿里巴巴及Arcee等模型的发布再次改变了份额格局。尽管开放模型目前仍只占推理总…
信息来源:Tomer Tunguz 博客(VC 分析) · DeepSeek / Qwen / Kimi
论文研究精选
Ultralytics YOLO26:统一实时端到端视觉模型
Ultralytics YOLO26 采用双头设计实现原生无 NMS 的端到端推理,彻底移除 DFL,获得更轻检测头与无约束回归范围。训练结合混合 Muon-SGD 优化器 MuSGD、转向推理头的 Progressive Loss 及保证小物体正样本的 STAL 标签分配。支持检测、实例分割、姿态估计、定向检测和分类,提供 5 种尺度(n/s/m/l/x)及开放词汇扩展 YOLOE-26。全部尺度在 COCO 上达 40.9-57.5 mAP,T4 TensorRT 延迟…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
Sam Altman强调AI发展应以人为本
Sam Altman在采访中表示,AI不应被设计为追求脱离人类需求的目标,人类必须始终处于AI发展的中心。他批判了行业内"AI将摧毁大量工作"等言论,认为人们担忧的并非AI带来的好处,而是自身在未来的角色、经济前景与自主权。他指出,AI行业的失败在于未能清晰解释人类如何在每一步保持对未来的控制权,以及如何在AI时代继续拥有充实、有意义的生活。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新精选
MiniMax M3 模型上线 Cloudflare AI Gateway
M3 on Cloudflare AI Gateway, day one ⚡ 前沿编码能力,1M 上下文,原生多模态,现在一次 fetch 即可调用。 是时候构建些东西了。 🦞
信息来源:X:MiniMax (@MiniMax_AI)
行业动态精选
Alphabet计划筹资800亿美元用于AI建设
Alphabet计划通过出售股票筹集800亿美元资金,以支持其人工智能建设。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新精选
ChatGPT 新增长文编辑与保存功能
长文写作需要更多空间。 现在你可以在全屏模式下编辑更长的文章,并将其保存到你的资料库中,以便稍后继续。
信息来源:X:ChatGPT (@ChatGPTapp) · ChatGPT
产品发布 / 更新精选
Google AI Studio 新增 Gmail 等应用构建能力
我们刚刚上线了在 @GoogleAIStudio 内直接构建连接 Gmail、Drive、Sheets 等应用的功能,无需跳转其他网站,你可以直接在 AI Studio 内添加测试人员,完整的公开分享功能即将推出!!
信息来源:X:Logan Kilpatrick (@OfficialLoganK)