AI 情报文章归档
浏览 AI圈报 已保存的 5702 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5702
正式分类6
精选内容3361
全部文章
第 109 / 143 页 · 每页 40 条
论文研究精选
为什么MiniMax大语言模型无法说出"马嘉祺"?稀疏Token遗忘的内部调查
MiniMax M2系列大语言模型在生成时无法输出稀疏token"嘉祺"(如"马嘉祺")。内部调查排除tokenizer对齐问题,发现根因是后训练阶段对低频token的生成概率产生抑制。该问题已在后续模型更新中修复,并顺带解决了其他小语种混合问题。
信息来源:MiniMax:Blog(网页)
行业动态精选
Anthropic任命KiYoung Choi为韩国代表董事
Anthropic宣布任命KiYoung Choi为韩国代表董事,以支持其即将在首尔开设的办公室。根据Anthropic的经济指数,韩国是Claude.ai全球最活跃的市场之一,其使用率超过人口规模预期的3.5倍,主要用于技术和创意领域。KiYoung Choi此前曾担任Snowflake韩国区总经理,在Google Cloud、Adobe等公司拥有超过30年的科技行业领导经验。他将在韩国领导市场战略,支持本地企业和初创公司应用Claude,例如法律科技公司Law&Comp…
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
Code w/ Claude 伦敦活动:重塑开发体验
在Code w/ Claude 伦敦活动上,Anthropic 宣布了 Claude Managed Agents 的两项新能力:自托管沙箱(公开测试版)和 MCP 隧道(研究预览)。这两项功能使 AI 智能体的工具执行环境与企业私有网络内的 MCP 服务器连接均可运行在客户自有基础设施或指定托管服务商处。活动还介绍了如何通过 Claude Code、优化思维预算以及模型努力级别来提升开发体验。目前,包括 Spotify、Base44 和 Legora 在内的客户已在使用这…
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
教皇的AI通谕并非真正关于AI
教皇Leo XIV的首道通谕,将AI作为诊断工具,以剖析权力集中、民主侵蚀以及科技精英阶层根据自身利益塑造世界等更深层的问题。
信息来源:TechCrunch:AI(RSS)
行业动态精选
教皇里奥呼吁在AI时代保持"深刻的人性"
教皇里奥十四世在首份重要通谕《Magnifica Humanitas》中警告了AI及不受约束的技术力量带来的风险。该通谕于2026年5月15日发布,是教皇关于"在人工智能时代守护人"的宣言。文件重点讨论了AI驱动战争的危险、AI对劳动的影响,以及建立新的法律和伦理框架来规范技术的必要性,强调AI的快速普及正造成经济和社会动荡,对个人的保护不足威胁着人类尊严。
信息来源:The Verge:AI(RSS)
行业动态精选
教皇与Anthropic携手,共探AI时代人类未来
梵蒂冈举行活动,教皇 XIV 与 Anthropic 联合创始人 Christopher Olah 对话,宣布双方将合作引导人类应对AI时代。教皇强调在差异中相互聆听是希望的标志,共同审视时代与人类未来的重大问题。Christopher Olah 指出AI存在大规模替代人类劳动的现实可能性,并观察到模型展现出功能上类似喜悦、恐惧等人类情感的"内部状态",认为这需要持续审视。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
模型发布 / 更新精选
inclusionAI 发布 SingGuard 系列模型
inclusionAI 发布 SingGuard 系列模型,首个版本为 SingGuard-4b。该模型是一种策略自适应多模态 LLM 护栏,将安全策略作为运行时输入而非固定训练分类,支持对文本、图像、图文、多语言、查询侧和响应侧进行安全评估。SingGuard 采用动态推理流程,可先快速输出首 token 安全信号,再继续生成更精确的判断。在涵盖多模态安全、图像安全、文本查询安全、文本响应安全、多语言查询安全及多语言响应安全的六大类基准测试中,SingGuard 达到平均…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
SingGuard: 策略自适应多模态护栏模型族开源
SingGuard 是一个策略自适应的多模态护栏模型族,包含 Sing-Guard-4b 和 Sing-Guard-8b 两个版本。它将安全策略作为运行时输入而非固定分类,部署团队可自定义自然语言规则而无需重训练模型。支持文本、图像、图文、多语言以及查询端与响应端的安全评估,提供快速和快慢结合两种推理模式。在涵盖多模态安全、纯图像安全、文本查询/响应安全、多语言查询/响应安全六大类基准上取得平均 SOTA 表现。模型已开源至 HuggingFace 和 ModelScope。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
inclusionAI 发布 SingGuard-8b 策略自适应多模态安全护栏模型族
inclusionAI 发布 SingGuard-8b,一个策略自适应(policy-adaptive)的多模态 LLM 安全护栏模型族,支持文本、图像、图文、多语言、查询侧和响应侧的安全评估。SingGuard 将活跃安全策略作为运行时输入,部署团队无需重训模型即可按默认或自定义自然语言规则进行审核。模型采用动态推理流程,先快速路由输出初步安全信号,再在需要时继续生成更精确的判断。在六大基准类别上,SingGuard 取得平均 SOTA 性能,并展现出对运行时策略的强适应…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
蚂蚁 inclusionAI 发布策略自适应多模态安全护栏模型 Sing-Guard-8b
SingGuard 是蚂蚁 inclusionAI 推出的策略自适应多模态大语言模型安全护栏模型族(版本 Sing-Guard-8b),支持纯文本、纯图像、图文混合、多语言查询与回复的安全评估。其核心设计将安全策略作为运行时输入,部署团队可基于默认分类或自定义自然语言规则评估内容,无需重新训练模型。模型内置 fast-slow 动态推理流程:首 token 路由快速输出安全信号,需深度推理时继续生成更精确的最终判断。在涵盖多模态安全、纯图像安全、文本查询与回复安全、多语言查…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
inclusionAI 发布 SingGuard 系列模型,首版为 SingGuard-2b
inclusionAI 发布 SingGuard 系列模型,首个版本为 SingGuard-2b,用于文本、图像、图文、多语言及查询/回复侧的安全评估。SingGuard 将安全策略作为运行时输入而非固定训练分类,支持部署团队在不重新训练模型的情况下,依据默认或自定义自然语言规则进行内容审核。该模型在多项多模态安全基准上取得平均最优性能,支持快速首 token 路由与深度推理结合的动态推理流程,兼容 Transformers 和 vLLM 的 chat 消息输入。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
inclusionAI 发布 Sing-Guard-2b:策略自适应多模态大模型安全护栏
inclusionAI 开源了 Sing-Guard 模型家族,版本包括 Sing-Guard-2b 和 Sing-Guard-8b。该模型将安全策略作为运行时输入,支持文本、图像、图文及多语言场景的查询侧
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
论文研究精选
Google DeepMind 的 AlphaProof Nexus 以几百美元的成本解决数十年未解的数学问题
Google DeepMind 的 AlphaProof Nexus 自主解决了 9 个开放的 Erdős 问题,其中包括两个困扰数学界 56 年的难题。其推理成本低至每个问题仅需几百美元。系统通过 Lean 编译器验证每个证明步骤,而非使用 OpenAI 的自然语言方法。当前的整体问题解决成功率为 2.5%。
信息来源:The Decoder:AI News(RSS) · OpenAI / Gemini
模型发布 / 更新精选
蚂蚁 inclusionAI 开源 SingGuard 多模态安全护栏模型族
蚂蚁集团 inclusionAI 开源了 SingGuard 多模态安全护栏模型族,包含 2B、4B 和 8B 三个版本。SingGuard 将安全策略作为运行时输入而非训练时固定分类,部署团队无需重新训练即可按默认分类或自定义自然语言规则评估内容。模型支持文本、图像、图文、多语言、查询侧和回复侧的安全审核,采用"快-慢"动态推理机制。SingGuard 在多模态安全、图像安全、文本查询安全、文本回复安全、多语言查询安全及多语言回复安全基准上达到平均 SOTA 性能。模型基…
信息来源:蚂蚁 inclusionAI:GitHub 新仓库 · Qwen
模型发布 / 更新精选
蚂蚁 inclusionAI 开源多模态安全护栏模型 SingGuard
SingGuard 是蚂蚁 inclusionAI 开源的多模态安全护栏模型族,提供 2B、4B、8B 三个参数版本。它将安全策略作为运行时输入,支持文本、图像、图文、多语言及查询/回复侧的安全评估,无需重新训练即可适配不同规则。采用快慢动态推理机制,在低延迟场景下输出紧凑判断,对模糊或高风险内容进行策略引导的推理。在多模态安全、图像安全、文本查询与回复安全、多语言查询与回复安全等基准上达到 SOTA 平均性能。模型已上架 HuggingFace 和 ModelScope。
信息来源:蚂蚁 inclusionAI:GitHub 新仓库 · Hugging Face
模型发布 / 更新精选
Grok V9-Medium模型完成训练即将发布
Grok基础模型V9-Medium(1.5T)已完成训练。评估结果良好。补充训练中加入了大量Cursor数据,后续还会有更多。 微调正在进行中,强化学习将在几天后开始。预计2到3周内公开发布。 这将比当前服务所有Grok生产流量的0.5T v8-small模型有重大改进,尤其在复杂编码任务上。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok / Cursor
论文研究精选
华为何庭波"韬定律"论文发布,逻辑折叠技术提升芯片性能
华为何庭波在ISCAS 2026上提出"韬定律",并介绍逻辑折叠(LogicFolding)技术。该技术通过三维空间拓扑重组提升芯片性能,不依赖新光刻工艺。在麒麟2026芯片测试中,晶体管密度从155 MTr/mm2提升至238 MTr/mm2,性能核心能效提高41%,最大时钟频率提升近13%。论文显示,麒麟2027芯片已进入Silicon状态,后续规划包括麒麟2028、2029。AI芯片方面,昇腾990计划在2030年左右引入逻辑折叠,硬件集成预计到2035年提高超过10…
信息来源:IT之家(RSS)
论文研究精选
感知图像编解码器:实用学习型图像压缩中的关键因素
苹果公司的研究探讨了感知图像编解码器,分析其在实用学习型图像压缩中的关键作用。该研究聚焦于提升压缩效率与视觉质量平衡的实际需求。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
面壁智能联合清华等开源中国首个基于华为昇腾训练的 1.58-bit 端侧大模型 BitCPM-CANN
信息来源:IT之家(RSS)
观点 / 方法精选
Codex可自动取消订阅,过程很解压
使用计算机使用功能,你可以让 Codex 取消你不再需要的订阅。观看过程非常愉快。没有特指哪个,对所有订阅都有效。
信息来源:X:Tibo (@thsottiaux)
观点 / 方法精选
Harness、Scaffold 与 AI 智能体术语辨析
本文旨在厘清 AI 智能体领域中易混淆的关键术语。文章指出,模型(如 Claude、GPT)本身是无记忆、无循环的大语言模型。其行为由"Scaffolding"(行为定义层,如系统提示、工具描述)塑造,而"Harness"(执行层)负责调用模型、处理工具调用与控制循环,是智能体运行的核心。两者结合,模型才能成为智能体。文章以 Claude Code、Codex 为例,说明同一模型搭配不同 Harness 会产生迥异体验,并提出了 Agent = Model + Harnes…
信息来源:Hugging Face:Blog(RSS) · GPT / Claude / Hugging Face
论文研究精选
WBench:面向交互式世界模型评估的多轮基准
WBench 是一个用于系统评估交互式世界模型的多轮基准。它提出了一个五维评估框架,涵盖视频质量、场景设定遵循度、交互指令遵循度、一致性与物理符合性。该基准包含 289 个测试案例与 1,058 轮交互,覆盖了多样化的场景、风格、主体及第一/第三人称视角。评估使用 22 个结合专业视觉模型与大型多模态模型的自动子指标,所有指标均经过人工校验。对 20 个 SOTA 模型的评测发现,目前尚无模型在所有维度上表现均优。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
通过奖励倾斜分布匹配强化少步生成器
本文提出奖励倾斜分布匹配蒸馏(RTDMD),这是一个将分布匹配蒸馏与奖励引导强化学习统一应用于少步流生成器的两阶段框架。该方法通过最小化到奖励倾斜教师分布的KL散度,自然分解为分布匹配项与奖励最大化项。第一阶段引入环境一致分布匹配蒸馏(AC-DMD),在子区间进行分布匹配,并通过一致性正则化辅助分数模型追踪生成器分布。第二阶段联合优化两项,并推导混合策略梯度及步子集GRPO(SubGRPO)以降低方差。在SD3、SD3.5和FLUX.2上的实验表明,RTDMD仅用4步推理即…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
行业动态精选
DeepSeek将对其旗舰AI模型实施永久性75%折扣
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · DeepSeek
观点 / 方法精选
面向 Codex 的自我优化提示词框架
这是一个结构化的提示词,用于指导 Codex 自动分析其历史记录以识别并固化重复工作流。该框架要求 Codex 回顾会话、Memories 等数据,找出重复、耗时且有明确复用价值的任务。筛选标准包括至少出现两次、输入稳定、可提升效率等。最终,Codex 应以"技能"、子智能体或自动化工具等最小实用形式创建或扩展现有资产,避免冗余。流程包括生成候选清单、执行创建,并汇报结果与待验证项。
信息来源:X:Greg Brockman (@gdb)
行业动态精选
TrapDoor供应链攻击:AI助手成新型攻击面
一场名为"TrapDoor"的协调供应链攻击同时袭击了npm、PyPI和Crates.io,涉及34个恶意包,旨在窃取加密货币、AI和安全开发者的钱包、SSH密钥和云凭证。攻击的新手段是向流行开源项目提交Pull Request,注入被操纵的`CLAUDE.md`和`.cursorrules`配置文件。当开发者克隆仓库并使用Claude Code或Cursor等AI助手时,AI智能体会将这些文件当作可信指令执行,可能在开发者不知情下运行恶意命令。这是首次将AI助手作为攻击面。
信息来源:X:Kim (@kimmonismus) · Claude / Cursor
观点 / 方法精选
Anthropic联合创始人Chris Olah在教皇通谕发布会上的讲话
Anthropic联合创始人Chris Olah在梵蒂冈出席教皇Leo XIV关于AI的通谕发布会。他指出,所有前沿AI实验室都面临商业、研究及地缘政治等多重压力,这可能与做正确的事相冲突,因此外部监督至关重要。他强调,AI模型并非像飞机那样被工程化构建,而是基于人类语言和思想"生长"出来的,其内在性质可能复杂难解。他提出三个需审慎思考的问题:如何确保AI发展的全球收益公平分享、如何思考AI时代的人类繁荣,以及AI模型内在性质的本质。他呼吁社会各界,尤其是宗教与民间团体,严…
信息来源:Anthropic:Newsroom(网页) · Claude
观点 / 方法精选
格雷格·布罗克曼:那段差点让OpenAI覆灭的72小时
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
观点 / 方法精选
Claude Code自动模式:多任务并行的关键技巧
人们常问我,用好Claude Code的最大技巧是什么。 如今我的头号技巧是:使用自动模式。 自动模式意味着不再有权限提示。它是实现"多Claude并行"的关键构件:启动一个会话,然后在其运行时,并行处理另一个会话。
信息来源:X:Boris Cherny (@bcherny) · Claude
模型发布 / 更新精选
StepAudio实时语音发布,能听懂你的语气与言外之意
StepAudio 2.5 Realtime 是一款实时语音交互模型。其核心优势在于能感知用户的副语言特征,如语气、节奏、停顿甚至轻叹,从而理解话语背后的真实意图。该模型支持通过 API 高度定制角色人格与说话风格,内置超过10,000种可组合的预置角色,并提供5种开箱即用的预设角色供体验。同时,模型经过RLHF优化,能在复杂的角色扮演压力测试中稳定保持设定的人设。支持中英文双语交互。
信息来源:X:阶跃星辰 StepFun (@StepFun_ai)
产品发布 / 更新精选
Replit Agent与Squidler集成,实现全自动化AI质量保障
Replit Agent与Squidler已完成集成,形成一套完整的AI驱动质量保障闭环。用户可通过自然语言描述应用功能,由Replit Agent负责构建。构建完成后,Squidler会像真实用户一样对线上应用进行自动化测试,无需编写任何测试脚本。测试中发现的问题会自动反馈给Replit Agent进行修复。该流程已通过Squidler加入Replit的MCP库正式上线,实现了从构建、测试到修复的全自动化,显著降低了应用测试与维护的门槛。
信息来源:X:Replit (@Replit)
行业动态精选
消息称 Anthropic 最快下周完成逾 300 亿美元融资,有望推动估值反超 OpenAI
据彭博社报道,Anthropic即将完成一轮超300亿美元的融资,最快可能于下周敲定。此轮融资将使其估值突破9000亿美元,正式超越OpenAI,成为全球估值最高的AI初创企业。融资的迅速推进反映了市场的强烈追捧。同时,公司营收高速增长,预计第二季度营收将达109亿美元,环比增长超一倍,有望迎来首个盈利季度。
信息来源:IT之家(RSS) · OpenAI / Claude
行业动态精选
微软称,使用人工智能的成本高于支付人工工资
微软发布报告指出,在特定工作场景中,部署和使用人工智能(AI)的成本目前已高于支付相应的人工工资。报告分析了基于"tokens"(令牌)和"agents"(智能体)的AI使用模式,发现其综合开销超过了雇佣人类员工完成同类任务的费用。这一发现揭示了当前企业应用AI技术面临的现实经济挑战。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Models.dev:一个关于人工智能模型规格、定价和功能的开源数据库
近期发布了开源数据库Models.dev,专门收录人工智能模型的各项规格、定价及功能信息。该项目在GitHub公开,便于开发者查询和比较不同AI模型。其在Hacker News社区获得101点关注度,显示出技术社区对这类集中化、透明化的模型信息资源的较大兴趣。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
AI 替代入门级工作:科技行业受裁员冲击最重,74% CEO 冻结或缩减招聘
奥纬咨询研究发现,AI工具正被广泛用于入门级任务,导致企业招聘重心转向高级岗位,年轻人求职难度加大。科技行业受冲击最严重,74%的CEO已冻结或缩减招聘。计划削减初级岗位的比例从17%跃升至43%,而招聘转向中层岗位的比例则升至30%。尽管超90%的企业在部署AI,但多数仍处试点阶段。报告警告,过快裁员或忽视初级人才储备,可能对人才梯队造成长远风险。
信息来源:IT之家(RSS)
模型发布 / 更新精选
NVIDIA 发布 Nemotron-Labs Diffusion 系列模型,支持三种生成模式
NVIDIA 发布 Nemotron-Labs Diffusion 系列,含 3B、8B、14B 文本模型和 8B 视觉-语言模型(VLM),均采用商用友好的 NVIDIA Nemotron Open Model License 或 NVIDIA Source Code License。模型支持自回归、扩散(逐块并行生成后逐步精炼)和自推测(扩散草拟候选 token 再自回归验证)三种模式。8B 模型平均准确率比 Qwen3 8B 提升 1.2%,扩散模式每次前向传递的 t…
信息来源:Hugging Face:Blog(RSS) · Qwen / NVIDIA / Hugging Face
论文研究精选
AlphaProof Nexus:用形式化验证驱动AI数学证明搜索
Google DeepMind提出了AlphaProof Nexus系统,它将大型语言模型与Lean形式化验证工具相结合。该系统允许LLM在生成证明的过程中,不断读取Lean的编译错误并进行修正,还可调用更强的工具辅助解决子问题。这一机制迫使模型将每一步逻辑都转化为可编译、可验证的代码,从而将其角色从"令人信服的叙述者"转变为"候选方案生成器"。在针对353个Erdős问题和492个开放猜想的测试中,系统成功解决了9个Erdős问题并证明了44个序列猜想。该研究展示了形式化…
信息来源:X:Rohan Paul (@rohanpaul_ai) · Gemini
行业动态精选
黄仁勋:AI 基建年度开支要冲到 4 万亿美元!
英伟达发布2027财年Q1财报,营收816亿美元,同比增长85%,净利润583亿美元,翻两倍多,市值达5.7万亿美元,已超德国2026年GDP预测。黄仁勋预测,超大规模云厂商的AI基建年度开支将从当前的1万亿美元,增长至3-4万亿美元,远超华尔街预期。财报同时显示,数据中心业务营收752亿美元,占比超九成。值得注意的是,AI基建的高能耗正推高居民电费,数据中心用电成本转嫁效应已初步显现。
信息来源:IT之家(RSS) · NVIDIA
产品发布 / 更新精选
动作捕捉与角色动画制作更轻松
动作捕捉和角色动画制作从未如此简单。 持续构建,更多功能即将推出!
信息来源:X:Viggle AI (@ViggleAI)
产品发布 / 更新精选
v2.1.149 更新摘要
本次 v2.1.149 更新包含功能增强、企业设置和多项修复。新增 `/usage` 命令的使用量分类显示功能,可区分技能、子代理、插件及每个 MCP 服务器的消耗;`/diff` 详情视图支持键盘滚动;Markdown 输出兼容 GFM 任务列表。企业版新增 `allowAllClaudeAiMcps` 设置以加载云 MCP 连接器。修复了 PowerShell 权限绕过、Git 工作树沙盒写入白名单越界、脚本路径含空格时 `otelHeadersHelper` 静默失败…
信息来源:Claude Code:GitHub Releases(RSS) · Claude