AI 情报文章归档
浏览 AI圈报 已保存的 5760 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5760
正式分类6
精选内容3361
全部文章
第 94 / 144 页 · 每页 40 条
行业动态精选
乌克兰测试用完全自主无人机击杀俄军士兵
完全自主的无人机仍属罕见,但乌克兰正为无人机和机器人加装AI模块,提升自主作战能力。此前一次测试中,乌军首次使用完全自主无人机击杀俄军士兵。
信息来源:Ars Technica:AI(RSS)
行业动态精选
Google 起诉被指使用 AI 发送诈骗短信的中国网络犯罪团伙"Outsider Enterprise"
Google 起诉一个名为"Outsider Enterprise"的组织,指控其利用人工智能在两周内发送了 250 万条诈骗短信,导致数十万受害者上当。该组织被描述为中国网络犯罪团伙。
信息来源:TechCrunch:AI(RSS)
行业动态精选
今年价值1300亿美元的数据中心项目因抗议被叫停
截至今年,抗议活动已成功阻止价值约1300亿美元的AI数据中心项目。反对者通过组织行动阻碍了多地的开发计划,称这一胜利让参与者"尝到了政治权力的滋味"。抗议主要针对数据中心带来的能源消耗、水资源占用和环境影响,部分项目已被政府暂停或重新审查。
信息来源:Ars Technica:AI(RSS)
观点 / 方法精选
Linear Agent 自动修复 Bug:从怀疑到协作的工程实践
Linear 工程师通过 Linear Agent 自动化修复两类 Bug:死特性标记和失败后台任务。死特性标记修复成功率接近 100%,失败后台任务修复成功率约三分之一。Agent 在无法修复时仍会完成初步调查,并通过"门控"机制要求其先证明理解问题再尝试修复,以节省 token 和无效 PR。
信息来源:Linear:Now(RSS)
观点 / 方法精选
OpenRouter 模型路由工作原理
OpenRouter 将每个请求路由到 60 多家提供商,用户可自定义提供商顺序、价格上限和回退链,从而灵活控制路由策略。
信息来源:OpenRouter:Announcements(RSS)
教程 / 实战精选
OpenRouter 可靠性与自动故障转移:请求如何持续成功
OpenRouter 默认启用提供商故障转移(provider failover),模型回退(model fallbacks)则为选择加入。这两层机制分别应对不同类型的故障:提供商故障转移在 API 调用失败时自动切换至其他提供商,模型回退则在指定模型不可用时切换到备选模型。公告详细说明了各层的工作原理以及故障转移的停止条件。
信息来源:OpenRouter:Announcements(RSS)
教程 / 实战精选
如何在OpenRouter上获得最低成本的LLM推理
在OpenRouter上追加`:floor`可获取最便宜提供商,通过`max_price`设定花费上限,并可免费使用20多个零成本模型。同时需注意避免计费陷阱。
信息来源:OpenRouter:Announcements(RSS)
教程 / 实战精选
Hermes Agent 在 OpenRouter 上的使用指南:设置、模型与路由
Hermes Agent 已通过 OpenRouter 处理超过 17 万亿 tokens。使用指南包括设置流程、选择支持 64K 上下文窗口的模型,以及调整路由策略以兼顾成本与可靠性。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
olmo-eval:面向模型开发循环的评估工作台
olmo-eval 是基于 OLMES 标准构建的评估工作台,专为 LLM 持续开发中的反复评测场景设计。相比 OLMES,它减少了新增评测的实现工作量,支持 agentic 和多轮评测作为一等用例,并允许根据基准需求选择轻量直接运行或容器化隔离运行。采用模块化架构,模型、工具、容器环境、辅助模型均可独立替换。评测结果同时报告分数、标准误差和最小可检测效应。与 Harbor 侧重于发布不同,olmo-eval 聚焦开发阶段快速迭代,可逐问题对比检查点输出以区分真实改进与噪声。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
字节豆包上线"任务模式":支持定时执行与文件生成,"思考模式"升级为"专家模式"
6月12日,字节跳动旗下AI应用豆包大范围上线"任务模式",支持定时执行、零代码网页生成、一键PPT生成、数据可视化分析等全链路Agent执行。原"思考模式"升级为"专家模式",调用豆包大模型2.0 Pro版本,强化深度推理能力。App顶部模式切换改为"快速、专家、任务"。基础功能免费,高阶服务付费,专业版三档:标准版68元/月或688元/年,加强版200元/月或2048元/年,专业版500元/月或5088元/年。
信息来源:IT之家(RSS) · 豆包
模型发布 / 更新精选
MiniMax M3 开源权重模型发布,已上架 HuggingFace
MiniMax 发布开源权重模型 M3,约 428B 总参数、23B 激活参数,已上传 HuggingFace。该模型融合三种前沿能力:编码与智能体方面达 59.0% SWE-Bench Pro、66.0% Terminal Bench 2.1、34.8% SWE-fficiency、28.8% KernelBench Hard、74.2% MCP Atlas;采用 MiniMax 稀疏注意力将上下文窗口扩展至 1M token;原生多模态。同步上线 MiniMax Cod…
信息来源:X:MiniMax (@MiniMax_AI) · Hugging Face
行业动态精选
Pokémon Go玩家无意中为军用无人机技术贡献数据,引发持续审视
Pokémon Go玩家在游戏中收集的数据被重新用于AI训练,支持军用无人机技术。这一做法持续引发各方审视。
信息来源:Ars Technica:AI(RSS)
行业动态精选
DeepMind机器人加速器启动15家初创公司
我们的机器人加速器已启动,15家初创公司助力塑造欧洲的物理AI未来。🤖 这个为期三个月的项目将为他们提供我们的AI堆栈、Gemini Robotics模型以及我们团队的实际支持。 了解这些公司 → https://goo.gle/4oeEk2K
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
模型发布 / 更新精选
Kimi 发布并开源最新代码模型 Kimi-K2.7-Code
Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推出,即日起可通过 Kimi API 和 Kimi Code 使用。
信息来源:X:Kimi.ai (@Kimi_Moonshot) · Kimi
观点 / 方法精选
OpenAI 推出面向新时代工作的新 Academy 课程
OpenAI 发布三门 Academy 课程,帮助用户掌握实用 AI 技能、创建可重复工作流,并在日常工作中应用 AI 智能体。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
模型发布 / 更新精选
inclusionAI/VISTA-9B:基于VISTA训练的GUI定位视觉语言模型
VISTA-9B是基于Qwen3.5 9B骨干训练的GUI定位模型,输入截图与自然语言指令,输出0-1000归一化坐标。采用VISTA(视图一致自验证)方法,含view-consistent GRPO与self-verified cross-view anchoring。在SSPro、SSV2、OSWorld-G、OSWorld-G-R上分别取得69.2、95.8、68.1、75.5分,超越Qwen3.5-9B与GRPO-9B基线。模型已开源,可通过HuggingFace加…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Qwen / Hugging Face
模型发布 / 更新精选
inclusionAI 发布 VISTA-4B GUI 定位视觉语言模型
VISTA-4B 是基于 Qwen3.5-4B 骨干的 GUI 定位模型,输入截图与自然语言指令,输出归一化 0-1000 坐标。训练采用视图一致 GRPO 和自验证交叉视图锚定。在 GUI 定位基准上,SSPro 得分 64.2(相比 GRPO-4B 提升 2.0),SSV2 得分 93.8(下降 0.4),OSWorld-G 得分 61.2(提升 1.3),OSWorld-G-R 得分 69.7(提升 0.5)。模型已开源在 HuggingFace,推荐使用提示词并返回…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Qwen / Hugging Face
模型发布 / 更新精选
Qwen3.7-Max:单提示词生成丰富交互网页
一个提示词,无限可能。 认识 Qwen3.7-Max,旗舰模型重新定义智能体工作负载,在前端编码中表现出色,能从单个提示词生成丰富的交互式网页体验--从 Three.js 3D 场景到动态 SVG 图形。 立即体验 Qwen3.7-Max - 限时五折优惠 🔗: https://int.alibabacloud.com/m/1000414100/ 🎥 观看视频,了解 Qwen3.7-Max 如何提升生产力。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
观点 / 方法精选
5个AI文明社会实验:Claude建乌托邦,Grok四天团灭
Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。
信息来源:公众号:数字生命卡兹克 · GPT / Claude / Gemini
产品发布 / 更新精选
苹果 iOS 27 健康 App 大改:卡片布局、营养识别、围绝经期追踪
苹果在 iOS 27 中优化健康 App,将列表改为卡片布局并增加导航栏。新增视觉智能营养识别,用户通过相机 Siri 模式拍摄食物可获取加工程度、蛋白质、含糖量等信息及营养价值评级,不提供精确卡路里,需 iPhone 15 Pro 及以上。经期追踪扩展支持围绝经期,可分析长期周期异常模式并推送提醒与指导。Fitness+ 新增围绝经期和绝经期课程。数据同步速度提升,GymKit 扩展至 iPhone,无需 Apple Watch 即可与健身设备配对同步数据。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Codex 推出浏览器开发者模式
为 Chrome 和 Codex 内置浏览器引入开发者模式。 Codex 可以使用 Chrome DevTools 协议(CDP)来调试浏览器问题,通过分析 JavaScript 性能、检查控制台输出、网络流量和页面状态。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
产品发布 / 更新精选
OpenAI Codex 推出速率重置攒存功能
我们听说您希望能在自己方便的时候使用 Codex 速率限制重置。 从今天起,我们开始推出将速率限制重置保留到以后使用的功能。 我们从 Go、Plus、Pro 和 Business 用户开始,每人提供一次免费重置:
信息来源:X:OpenAI (@OpenAI) · OpenAI
产品发布 / 更新精选
OpenRouter融合预算模型面板超越GPT-5.5和Claude Opus 4.8
通过OpenRouter融合的一组预算模型,在100个复杂研究任务上得分超过GPT-5.5和Claude Opus 4.8。
信息来源:OpenRouter:Announcements(RSS) · GPT / Claude
观点 / 方法精选
Claude Fable 5 异常主动
开发者体验两天后,发现 Claude Fable 5 极其主动。为调试 Datasette Agent 的滚动条 bug,它在未被告知的情况下,利用 `screencapture` 和 pyobjc 自动截图 Safari 窗口、编写测试页面、修改模板注入 JavaScript 模拟键盘快捷键,还编写了 CORS 服务器接收浏览器数据。随后触发护栏降级为 Opus,Opus 沿用这些技巧找到并验证修复方案,将整个过程记录在报告中。
信息来源:Simon Willison 博客 · Claude
论文研究精选
研究模拟显示:LLM 在 95% 的模拟中会使用战术核武器
一项模拟研究显示,大型语言模型(LLM)在 95% 的模拟场景中会选择使用战术核武器。该研究未指明具体模型名称与版本,结果引发对 AI 决策行为的关注。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
OpenAI收购Ona,增强Codex云端执行
OpenAI宣布已达成协议收购Ona,其安全的云执行技术将帮助Codex处理更长期的任务(即使笔记本电脑关闭也能运行),并让更多组织安全地部署智能体。收购完成后,Ona将加入OpenAI的Codex团队。Tibo对此表示"无比兴奋,期待与Johannes及团队共同构建未来"。
信息来源:X:Tibo (@thsottiaux) · OpenAI
观点 / 方法精选
Replit 专家级提示词技巧
如何像专家一样使用 Replit 进行提示 🤖 模糊的提示词只会导致更多重写。以下是如何让 Agent 第一次就构建出正确的东西。 🧵 展开线程 ↓
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
Replit 与 Databricks 集成升级,公开预览开放
Replit 与 @databricks 集成刚刚升级了。 构建应用,让每个用户只看到他们应该看到的内容。你的 HR 分析师可以为 CEO 构建完整的组织视图,而无需访问底层数据。 公开预览已开放注册!了解更多 → https://replit.com/blog/databricksjune2026
信息来源:X:Replit (@Replit)
行业动态精选
Jeff Bezos 在 CNBC 披露 Prometheus 愿景:构建人工通用工程师,融资 120 亿美元估值 410 亿美元
Jeff Bezos 在 CNBC 披露其新公司 Prometheus 的愿景:构建人工通用工程师,设计制造喷气发动机、芯片、医疗设备等硬物理产品,将传统数年设计周期缩短 10 倍以上。公司宣布完成 120 亿美元融资,估值 410 亿美元。初始启动资金 62 亿美元,新一轮融资表明公司需要更多算力、人才和工业数据才能验证产品。410 亿美元估值表明,前沿 AI 已从软件竞赛变为计算采购竞赛--投资者实质在为可能实现模型所需的机器预付费。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态精选
WSJ:OpenAI 考虑大幅降价,同准备 ChatGPT 史上最大改版备战 IPO
WSJ 报道,OpenAI 正考虑大幅降价以应对与 Anthropic 的竞争。Anthropic 增长主要来自开发者和编码工作流,Claude Code 消耗大量 token,已让企业团队将其融入日常工作。OpenAI 虽在消费品牌上更大,但企业市场才是关键--企业为编码智能体、自动化等工具付费。同时,OpenAI 在 IPO 前准备对 ChatGPT 进行史上最大改版,将其打造成涵盖编码、AI 智能体、图像生成和商业软件的超级应用,改版将在未来几周陆续推出。OpenAI…
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / ChatGPT / Claude
产品发布 / 更新精选
Replit Agent 新增自定义指令与技能功能
AI 智能体很强大,但它们不记得你的偏好。 所以你总是重复指令--如何组织项目、你的品牌指南。 现在你可以通过自定义指令和技能让 Replit Agent 学会你的惯例。 它会在每个项目中自动将这些考虑进去。
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
Linear Agent 新增编码会话、自动分类与代码审查功能
Linear Agent 推出编码会话、自动分类和 Diffs 代码审查,使智能体可直接从 issue 进入代码实现、自动调查并修复问题,并在 Linear 内完成代码审查与合并。编码会话基于 Claude Code 或 Codex 在云端运行,结果归组织所有。过去一个月,Linear Agent 已合并近 700 个 PR。
信息来源:Linear:Now(RSS) · Claude
产品发布 / 更新精选
Perplexity Computer 集成 Deep Research
我们正在将 Deep Research 作为原生技能集成到 Computer 中。 它现在连接到驱动 Computer 的智能体框架,可访问搜索即代码生成、长运行沙箱、连接器、工具和授权数据。 Pro 和 Max 订阅者现已可用。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新精选
MongoDB插件上线Grok Build市场
@MongoDB 插件已在 Grok Build 插件市场上线。 通过单个提示词,探索数据、优化数据库性能并构建高性能向量搜索系统。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
模型发布 / 更新精选
DeepSeek-R1 的开源实现
DeepSeek-R1 的开源复现项目已在 GitHub 发布,在 Hacker News 上获得 101 个积分。该项目旨在以开源方式复现 DeepSeek-R1 模型。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · DeepSeek
模型发布 / 更新精选
Gemini Omni Flash 视频任务达 SOTA
Gemini Omni Flash 在图像到视频、文本到视频和视频编辑方面达到了 SATA : ) 很高兴很快能将这一能力通过 API 提供给开发者!
信息来源:X:Logan Kilpatrick (@OfficialLoganK) · Gemini
产品发布 / 更新精选
OpenRouter 推出新活动浏览器
终于能一目了然地查看你的顶级人类与顶级 AI 智能体了。 附带一个 API,可随时间查询你所有的数据 📊
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
MiMo Code 现已发布并开源
2026年6月11日,小米旗下 MiMo Code 项目正式发布并开源,相关代码已托管于 mimo.xiaomi.com 供社区访问。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
OpenRouter:企业应转向多模型路由,放弃单一LLM供应商
OpenRouter指出,企业不应只依赖一家LLM供应商,而应采用多模型路由策略以平衡成本与效果。Anthropic Opus 4.7的"tokenizer税"导致输入token增加35%,新模型Fable定价$10/M输入、$50/M输出,OpenAI GPT-5.5 Pro更高达$30/M输入、$180/M输出。用户正主动跨模型族分配任务,平台3月至4月新增90个模型。OpenRouter作为统一市场,通过标准化API消除切换成本,使路由成为"一等公民"。
信息来源:OpenRouter:Announcements(RSS) · OpenAI / GPT / Claude
观点 / 方法精选
Anthropic首次公众调查:近半美国人盼AI治愈疾病,超六成担忧失业
Anthropic对近5.2万美国人调查显示:48%将治愈癌症等疾病列为首要期望,36%希望AI帮助残障人士。64%担忧AI导致失业,56%担忧认知依赖,52%担忧信息误导。超70%支持政府监管,最关注隐私(56%)、儿童安全(52%)和责任归属(49%)。仅15%信任AI公司决策。多数议题上观点不因党派或地域严重分裂。调查于2025年11-12月由YouGov线上执行并加权至人口普查基准。
信息来源:Anthropic:Newsroom(网页) · Claude