AI 情报文章归档
浏览 AI圈报 已保存的 5771 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5771
正式分类6
精选内容3361
全部文章
第 93 / 145 页 · 每页 40 条
产品发布 / 更新精选
Google Cloud 发布多项 Data Agent 新工具,助力 AI 工作流
Google Cloud 发布一系列 Data Agent 新工具,帮助开发者利用企业数据构建 AI 智能体。新功能包括 BigQuery 中 Conversational Analytics 的扩展支持、已正式上线的 Data Engineering Agent,以及预览版的 Database Observability Agent。
信息来源:Google Cloud:Databases(RSS)
产品发布 / 更新精选
SageCTF:最强大CTF挑战AI智能体
UC Santa Barbara与UC Berkeley团队基于OpenSage框架构建了CTF专用智能体SageCTF。在DEF CON CTF 2026资格赛中,SageCTF以单人玩家身份尝试15道挑战,成功攻克7道、恢复8个flag,总计1,743分,排名前5%,超越全部自评"不使用AI"或"低AI"的175支团队。在50道近期CTF挑战的对比测试中,SageCTF以Claude-Opus-4.6为主模型,在相同预算(每道$200/10小时)下解出39道,而Clau…
信息来源:Berkeley RDI:Blog(AI 安全与评测) · Claude
观点 / 方法精选
智能体AI治理:你的API密钥就是护栏
智能体AI使用量将在未来两年急剧上升,但治理滞后--仅五分之一企业拥有成熟治理模型。典型事故:销售智能体重试失败调用后自行升级到GPT-5.5,一夜消耗200美元。API路由层位于智能体与模型之间,是强制执行预算上限、模型白名单、提供方准入和请求日志的理想点。IBM报告指出97%遭遇AI安全事件的组织缺乏AI访问控制。最小可行治理方案:为每个智能体工作流分配独立API密钥,在API密钥层面实现预算控制、模型准入和审计追踪。
信息来源:OpenRouter:Announcements(RSS) · GPT
论文研究精选
Anthropic:智能体编码中专业知识回报持续存在
Anthropic 基于约40万次 Claude Code 交互会话(2025年10月至2026年4月)分析发现:人类主导规划决策(做什么),Claude 主导执行决策(怎么做)。领域专业知识越强,模型每次指令完成的工作量越多。各类职业完成任务的成功率与软件工程师平均相近;领域专家成功率更高,但与中级用户差距不大。七个月间调试会话占比下降近一半,使用转向端到端智能体任务(部署运行代码、分析数据、编写非代码文档),典型任务价值平均上升约25%。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
行业动态精选
Nvidia 加入 AI 债务热潮,发行 200 亿美元债券
Nvidia 计划通过自 2021 年以来的首次债券发行筹集至少 200 亿美元,消息援引知情人士透露。此举标志着 Nvidia 加入 AI 领域的债务融资热潮。
信息来源:The Decoder:AI News(RSS) · NVIDIA
行业动态精选
76位网络安全专家联名要求撤销美国政府对Anthropic最强模型的出口禁令
76名网络安全专家联名致信美国政府,要求撤销对Anthropic的Fable和Mythos模型的出口管制令,称此举将最强模型从防御者手中夺走,在对手快速进步时非常危险。美国政府近日以国家安全为由要求Anthropic限制出口,Anthropic已暂停全球用户访问。Mythos预览时仅约50家公司可用,后扩展至15国约150组织;其公开版Fable设有严格防护栏,几乎阻止所有网络安全提示。专家认为白宫可能依据亚马逊一篇未公开论文,但该论文仅让模型修复开源代码中已知漏洞,未展示…
信息来源:TechCrunch:AI(RSS) · OpenAI / GPT / Claude
观点 / 方法精选
MiniMax 开源原生多模态旗舰模型 M3,总参数 428B
MiniMax 上周五开源 M3 模型权重,并发布 MSA 稀疏注意力技术论文。M3 总参数 428B、激活参数 23B,是首个从 Step 0 进行多模态混合训练的开源模型,发布两周即在 Artificial Analysis 综合智能指数上位列全球开源模型第一。目前输出速度已从约 30 TPS 提升至约 80 TPS,官方称还将继续提速 30-40%。
信息来源:公众号:MiniMax(稀宇科技)
模型发布 / 更新精选
MiniMax 开源 M3 模型权重及 MSA 技术论文
MiniMax 上周五开源了 428B 总参数、23B 激活参数的 M3 模型权重,同步发布 MSA(MiniMax Sparse Attention)技术论文,该架构显著降低长上下文计算成本。M3 是首个从预训练阶段就进行文本、图像等多模态交错混合训练的开源模型。发布两周后,M3 在 Artificial Analysis 综合智能指数、GDPval-AA 排行榜均获开源模型第一,Code Arena WebDev 跻身帕累托最优序列,Vals.AI 榜单居国产模型首位。…
信息来源:公众号:MiniMax(稀宇科技)
行业动态精选
Salesforce以36亿美元收购AI客服平台Fin
Salesforce宣布以36亿美元收购AI客服平台Fin(前身为Intercom)。Fin提供可跨实时聊天、WhatsApp、短信、电话、Slack等多渠道解决客户问题的AI智能体。Salesforce计划利用Fin的技术和团队增强其企业级Agentforce平台,该平台允许企业构建自定义AI智能体以自动化任务。交易预计在Salesforce 2027财年第四季度(即2027年初)完成。Fin联合创始人兼CEO Eoghan McCabe将继续担任CEO,研发负责人Des…
信息来源:TechCrunch:AI(RSS)
观点 / 方法精选
Skydio CEO Adam Bry:硅谷不应为无人机使用画红线
Skydio是美国最大的无人机制造商,主攻公共安全、军事、能源、基建巡检等企业市场。CEO Adam Bry表示,特朗普政府去年底禁止中国产无人机后,廉价消费级无人机几乎消失,Skydio产品成为主要替代方案。公司认为无人机正从工具转向自主基础设施--通过机库、远程操控和软件整合实现规模化应用,AI在其中扮演关键角色。访谈还涉及Skydio与军方合作的态度,以及自主技术如何带动公司扩张。
信息来源:The Verge:AI(RSS)
行业动态精选
美国白宫因中国访问担忧对Anthropic Mythos模型实施出口限制
Semafor报道称,美国白宫因担忧中国关联团体访问Anthropic的Mythos模型,决定对其施加出口限制。另一风险是外部团体可能通过知识蒸馏窃取模型能力。此前美国商务部指令Anthropic禁用Fable 5和Mythos 5,因发现越狱可让模型透露网络安全帮助。Anthropic反驳称越狱并非普遍性,其他公开模型也能提供类似能力。限制将持续至美国政府加强国家安全系统,预计未来几周内。Anthropic承认当前任何模型供应商都无法实现完美防越狱。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
行业动态精选
Pokémon Go 玩家扫描数据用于训练军事无人机导航 AI
Pokémon Go 玩家自愿提交的数百万份 3D 扫描数据训练了 Niantic Spatial 的视觉定位基础模型。该模型与国防承包商 Vantor 的 Raptor 软件及卫星地形数据组合,形成共享坐标系统,在 GPS 信号被干扰、欺骗或阻断时仍能为无人机等设备导航。早期测试显示误差降低 70%,精度约 1.5 米,且对标准信号干扰免疫。Vantor 于 2026 年 2 月获得美国陆军 2.17 亿美元合同用于"One World Terrain"项目。Nianti…
信息来源:The Decoder:AI News(RSS)
观点 / 方法精选
OpenRouter Presets:当模型下线时保持 AI 智能体运行
Anthropic 在 Claude Fable 5 发布仅数天后便对其进行了限制。如果代码硬编码模型 slug,该限制也会导致服务中断。OpenRouter 的 Presets 功能将模型选择移至服务器端,使用户无需重新部署即可切换模型、设置回退策略并强制执行数据策略。
信息来源:OpenRouter:Announcements(RSS) · Claude
模型发布 / 更新精选
Kimi K2.7 Code 高速版上线:输出速度约 5-6 倍,API 定价为普通版 2 倍
Kimi K2.7 Code 高速版已上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景下约 180 Token/s,短上下文可达 260 Token/s,API 定价为普通版的 2 倍。
信息来源:公众号:月之暗面(Kimi) · Kimi
产品发布 / 更新精选
6倍速!Kimi K2.7 Code 高速版已上线
Kimi K2.7 Code 高速版上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景约 180 Token/s,短上下文可达 260 Token/s。API 定价为普通版 2 倍,模型 ID:kimi-k2.7-code-highspeed。Kimi Code Plan 用户可通过「抢先体验计划」使用,用量消耗为普通版 3 倍。使用须开启思考模式,关闭会报错或回退至 K2.6。庆祝发布,Kimi API 开放平台推出为期三周充赠活动,充值 500 元及以上享 …
信息来源:公众号:月之暗面(Kimi) · Kimi
产品发布 / 更新精选
Flash-KMeans:IO感知的精确K-Means,在GPU上比FAISS快200倍以上
UC Berkeley与UT Austin团队开源Flash-KMeans(Apache 2.0,`pip install flash-kmeans`),精确实现标准Lloyd's k-Means,通过重构GPU数据流而非改变数学或近似来提速。在NVIDIA H200上,端到端速度比最佳基线快17.9×,比cuML快33×,比FAISS快200×以上。其FlashAssign核避免物化完整N×K距离矩阵,将IO复杂度从O(NK)降至O(Nd+Kd),单核加速最高21.2×;…
信息来源:MarkTechPost(RSS) · NVIDIA
观点 / 方法精选
AI裁员浪潮成为火药桶
今年科技公司已累计裁员约15万人,日均974人,速度比去年快44%;上月裁员近4万创两年新高,AI连续三个月被列为裁员首要原因。Block近半数员工被裁后,CEO Jack Dorsey否认AI是根源,Marc Andreessen则称AI只是"银弹借口"。Uber裁撤23%人事部门,但此前CTO透露AI编码预算四个月内耗尽。与此同时,AI芯片商Cerebras上市首日市值达670亿美元,SpaceX上市市值2.1万亿美元,Anthropic和OpenAI估值均约1万亿美元…
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude
行业动态精选
美对Anthropic出口管制,加拿大总理卡尼称过度依赖少数模型存在风险
美国实施出口禁令,禁止所有外国用户访问Anthropic的最新AI模型。加拿大总理卡尼表示,这凸显了过度依赖少数几个强大AI工具的风险,呼吁在AI模型领域追求冗余和多样性,并将当前局面类比为2008年金融危机暴露出的银行间系统性关联。
信息来源:IT之家(RSS) · Claude
产品发布 / 更新精选
Grok Build 推出 Agent Dashboard 管理多个编码会话
xAI 为 Grok Build 推出 Agent Dashboard,提供单一屏幕管理多个编码会话。仪表板按状态分组(等待输入、工作中、空闲),每行显示状态标记、名称、分支、权限模式和当前操作。选中会话可打开 peek 面板查看最新输出并直接回复,等待输入的会话支持用箭头键或数字键选择选项。底部输入框用于分派新会话,支持设置模型、启动计划模式或自动批准编辑。通过 `grok dashboard`、`/dashboard` 或 `Ctrl+\` 打开,关闭后会话继续运行,重…
信息来源:xAI:News(网页) · Grok
行业动态精选
Anthropic顶级模型Mythos与Fable因出口管制下线
美国当局干预Anthropic,出口管制导致其顶级模型Mythos和Fable下线。Anthropic紧急派高级技术人员赴华盛顿,试图说服官员模型可被安全控制,成为AI地缘政治实时测试案例。市场关注周一反应:伊朗协议推高股市,但Anthropic事件可能引发大幅上涨或恐慌。
信息来源:X:Kim (@kimmonismus) · Claude
观点 / 方法精选
Codex 自主设定目标,通用化元提示
Codex 可以查看并设置它自己的 /goal。 我们所构建的一切,也都是作为该智能体的工具而构建的。 这是元提示的一种泛化,即让智能体根据你的意图自行设定任务。
信息来源:X:Tibo (@thsottiaux)
观点 / 方法精选
纳德拉:AI组织经济学与Token资本
Satya Nadella 关于 AI 组织经济学和"token capital"的好文 真正的竞争不在于模型质量本身,而在于模型周围的循环:那些教会系统什么对企业重要的工作流、反馈、判断、例外、失败和私有测试。 这需要私有评估、私有强化循环和可查询的机构记忆。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新精选
里约热内卢市政府 AI 模型 Rio3.5 在基准测试中击败 Qwen3.7
里约热内卢市政府开发的 AI 模型 Rio3.5,在近期基准测试中超越了 Qwen3.7。该消息源自 Hacker News 上的一篇帖子,指出 Rio3.5 在多项评测中表现优于 Qwen3.7。目前尚未公开具体的测试细节或基准名称。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
行业动态精选
OpenAI 推出合作伙伴网络 OpenAI Partner Network
OpenAI 宣布推出 OpenAI Partner Network,并投资 1.5 亿美元支持全球合作伙伴构建、销售和交付 AI 解决方案。该计划设立 Select、Advanced、Elite 三级合作伙伴层级,提供 Codex、网络安全、智能体等专业方向认证,并试点 Forward Deployed Experts 项目以支持复杂企业部署。目标在 2026 年底前培训认证 30 万名顾问。案例显示,Paychex 借助 Bain 和 OpenAI 的方案将等待时间降低…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
白宫AI监管决定被指偏袒OpenAI与亚马逊
白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展"主权AI"甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、…
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI / Claude
观点 / 方法精选
不,并不是每个人都在所有事情上都使用人工智能
Gabriel Weinberg 发文反驳"AI 已被所有人用于所有任务"的流行说法,指出 AI 的实际普及度和使用场景远低于社交媒体所渲染的程度。该帖在 Hacker News 获得 116 个点赞,反映社区对 AI 过度宣传的反思。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
下一代投机解码:DFlash 与 Spec V2
Z Lab、Modal 与 SGLang 团队联合发布 DFlash 投机解码模型和 SGLang 的默认 Spec V2 引擎。DFlash 采用块扩散+KV 注入并行生成整块 draft token,在 Qwen 3.5 397B-A17B(BF16)的 HumanEval 数据集上、并发 1 时吞吐量达到基线的 4.3
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
论文研究精选
伯克利RDI发布Agents' Last Exam基准
2026年6月,伯克利RDI发布Agents' Last Exam(ALE)基准,包含1,500余项源于真实工作的任务,覆盖55个非体力职业。对Fable 5、GPT-5.5、Composer 2.5等前沿智能体的测评显示:在最困难层级成功率均为0%;整体任务表现接近,但单任务成本差异巨大(Fable 5约$15.70,GPT-5.5约$3.80,Composer 2.5约$1.33)。CLI子集ALE-CLI最佳通过率仅25.2%。主要失败模式是智能体未验证输出即宣称完成…
信息来源:Berkeley RDI:Blog(AI 安全与评测) · GPT
观点 / 方法精选
Satya Nadella:没有生态的前沿不稳定
微软CEO Satya Nadella认为,AI驱动的平台转变首次实现人与数字系统间的认知循环。企业需同时构建人力资本(知识、判断、关系)与token资本(自有的AI能力),且人力资本不会贬值,反而随token资本增长而增值。真正的机会在于建立人力资本与token资本复合增长的学习循环--企业应能替换通用模型而不丢失已内化的专家知识,通过私有评估和强化学习让模型从内部真实轨迹中持续提升。他警告,若所有价值被少数模型吞噬,将重演全球化空心化悲剧,呼吁构建前沿生态系统,让每家企…
信息来源:X:Satya Nadella (@satyanadella)
行业动态精选
Anthropic 暂停新模型访问,印度辩论 AI 未来
Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。
信息来源:TechCrunch:AI(RSS) · Claude
行业动态精选
Meta 开始撤销 20 亿美元收购 Manus 的交易
据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新精选
智谱GLM-5.2开源发布,支持1M上下文
智谱发布最强开源模型GLM-5.2,面向所有GLM Coding Plan用户(Lite/Pro/Max)开放。该模型支持真正可用的100万上下文窗口,在长程任务独立完成方面保持领先,适合构建复杂AI智能体应用,也是国产最强编码模型的核心引擎。面对外部封锁限制,智谱强调科学全球性、AGI不应被高墙垄断,采取激进开源态度。GLM-5.2的开源与API预计下周同步上线。
信息来源:X:Testing Catalog (@testingcatalog) · GLM
产品发布 / 更新精选
Suno 音轨分离:从零生成更纯净
重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW。
信息来源:X:Suno (@suno)
产品发布 / 更新精选
Fusion API:半价达Fable级智能
推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Paca:一款适用于人机协作的轻量级 Jira 替代方案
Paca 是一款面向人类与 AI 智能体协作场景的轻量级项目管理工具,旨在替代 Jira。项目已开源并托管于 GitHub,支持团队通过直观界面协同管理任务,特别针对 AI 参与工作流进行了优化。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Harness 开发者工具网站 phistory.cc 收录多版本提示词
发现了一个对于 Harness 开发者似乎很有用的网站 https://phistory.cc/ 里面有 Claude Code、OpenCode、Codex、Pi、OpenClaw、Hermes 等各种 Harness 的各个版本的 system prompt 以及 tool schema。 Tip: 点击右上角"Trace"是看上去比较舒服的另一个视图。
信息来源:X:Tianyi Cui(@tianyi) · Claude
行业动态精选
谷歌Android安全负责人因反对军事AI合作辞职
谷歌Android平台安全负责人René Mayrhofer辞职,他在5月18日内部告别信中指责公司"丧失道德指针",批评谷歌悄悄放弃碳中和目标(因AI模型能耗),并与美国战争部签署允许AI用于"任何合法目的"的协议。今年4月下旬谷歌宣布向五角大楼提供AI用于机密工作,2025年2月更新AI原则时移除了不使用AI开发武器或监控工具的承诺。Mayrhofer担忧谷歌AI产品可能被用于针对公民的大规模监控,包括自己和家人。
信息来源:IT之家(RSS)
行业动态精选
扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快
路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来"几乎肯定会犯更多错误"。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。
信息来源:IT之家(RSS) · Llama
模型发布 / 更新精选
GLM-5.2 全量开放:智谱最强开源模型支持 1M 上下文
智谱发布迄今能力最强的开源模型 GLM-5.2,支持真正可用的 1M 上下文,并在长程任务中继续保持领先,同时也是其最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM
模型发布 / 更新精选
智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源
GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Max、团队版)。API 将于下周上线,模型下周正式开源,遵循 MIT 协议。
信息来源:公众号:智谱(GLM) · GLM