AI 情报文章归档
浏览 AI圈报 已保存的 5676 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5676
正式分类6
精选内容3361
全部文章
第 115 / 142 页 · 每页 40 条
产品发布 / 更新精选
OpenRouter BYOK三大升级 支持多密钥轮换
OpenRouter BYOK 三项重大升级 🔑 1/ 可在同一工作空间为同一服务商添加多个密钥,并设置调用顺序。 便于在速率限制间轮换、区分开发与生产凭证,或在团队账户间分配使用量!
信息来源:X:OpenRouter (@OpenRouter)
行业动态精选
微软研究院发布AI新工具与模型
微软研究院的新工具、模型、代码库和论文现已发布。 使用AI和智能体?值得关注: • MSR AI Frontiers的MagenticLite • 智能体化GitHub工作流 • 验证优先智能体 • 意义匹配微调 • AI转型与经济发展
信息来源:X:Microsoft Research (@MSFTResearch)
行业动态精选
英国多部门联合警告:当前最先进 AI 模型网络攻击能力已远超专业人员,企业应做好防范措施
英国财政部、英格兰银行及金融行为监管局联合警告,当前最先进的AI模型已具备远超普通专业人员的网络攻击能力,其攻击速度更快、范围更广、成本更低。若被恶意利用,将严重威胁企业运营安全、客户数据、金融市场稳定性乃至整个金融体系。英格兰银行行长安德鲁·贝利此前已点名Anthropic的Mythos产品,网络安全专家亦警告此类AI可能强化复杂攻击,对银行业及金融技术体系构成新挑战。
信息来源:IT之家(RSS) · Claude
产品发布 / 更新精选
X平台开源"For You"信息流推荐算法
X平台在GitHub开源了其"For You"信息流的最新推荐算法。该算法融合来自已关注账号的内容和通过相似性搜索发现的网络外内容,并利用基于Grok架构的Phoenix Transformer模型进行统一评分。模型通过分析用户近期互动,同时预测点赞、回复、转发等多种互动概率,并综合成最终相关性分数。排序过程包括候选内容收集、上下文信息补充、AI模型评分、多样性调整及垃圾信息过滤等步骤。此次开源提供了完整的可运行管道、预训练模型、内容理解服务及内置广告混合模块,核心计算完全…
信息来源:X:cb_doge (@cb_doge) · Grok
观点 / 方法精选
飞书开源CLI工具45天获万星,AI操作可见可控引关注
飞书开源命令行工具lark-cli在45天内获得超过1万GitHub star,成为国内首个破万星的办公套件开源项目。该工具允许AI通过命令行直接操作飞书,执行建群、建文档等任务,且每一步操作都可预览、可审查,与云端不可见的MCP模式形成对比。其主干代码已合并10位外部开发者的贡献,而同类产品钉钉和企业微信则为零。这种可见、可控的特性被视为开发者放心将任务交给AI Agent的前提,预示着一句话指令驱动完整项目流程成为可能。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
观点 / 方法精选
Show HN: 根据基准测试排名,为您的硬件寻找最适合的本地 LLM
一个名为"WhichLLM"的开源工具已在GitHub发布,可根据用户硬件配置推荐最适合的本地大语言模型。该工具通过基准测试对各类模型进行排名,帮助用户依据自身设备的性能指标选择最优模型。项目在Hacker News上获得116点热度,显示出社区对本地化AI部署效率工具的积极关注。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
克劳德(法律事务)
Anthropic公司在GitHub上开源了专为法律领域优化的AI模型"Claude for Legal"。该模型能更准确地处理法律文本、合同及案例摘要,旨在提升法律从业者效率。此消息在Hacker News上获得105个投票点数,显示出技术社区对其在法律科技领域应用潜力的关注。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
观点 / 方法精选
自动化代码审查实现问题到修复全流程
这改变了游戏规则。通过codex自动审查和crabbox,我现在几乎可以全自动化地从问题定位到修复。(是的,这会消耗大量token) 【引用 @steipete】:编写了一个循环运行codex/review的技能,直到不再出现错误为止。 注意事项:它不会为你修复系统架构,所以你仍然需要以BRAIN作为主模型。https://github.com/steipete/agent-scripts/blob/main/skills/codex-review/SKILL.md
信息来源:X:Peter Steinberger (@steipete)
模型发布 / 更新精选
蚂蚁集团提出 ARGenSeg-8B:基于自回归图像生成模型的图像分割框架
蚂蚁集团推出 ARGenSeg-8B,一种将多模态理解与像素级感知统一的自回归图像生成分割框架。它利用多模态大语言模型(MLLM)输出视觉 token,并通过通用 VQ-VAE 解码为分割掩码,使分割完全依赖 MLLM 的像素级理解。采用 next-scale-prediction 策略并行生成视觉 token,降低推理延迟。在多个分割数据集上超越此前最优方法,推理速度显著提升。论文已被 NeurIPS 2025 接收,模型已发布在 HuggingFace。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
行业动态精选
为 OpenAI 累计投入超 1000 亿美元,纳德拉称微软当年投资时"没人愿意下注"
在"马斯克诉奥尔特曼"庭审中,微软企业发展负责人确认,微软对OpenAI的累计投入已超过1000亿美元,其中包括130亿美元原始投资及大量Azure基础设施成本。此次合作已为微软带来约300亿美元营收。CEO纳德拉表示,微软是在"没人愿意下注"时承担了风险。双方已续签非独家协议,微软不再支付收入分成,并将OpenAI的分成上限设为到2030年累计380亿美元,此举较原协议节省约970亿美元。此外,微软正评估收购AI初创公司以补强人才,并调整资源投向自研模型与超级智能领域。
信息来源:IT之家(RSS) · OpenAI
论文研究精选
SenseNova-U1空间智能突破,开源最大空间问答数据集
主推文赞扬了创新者在前沿领域的探索。引用的推文具体指出,SenseNova-U1在空间智能能力上取得进展,其关键基准测试表现超越了Qwen3.5等强劲基线。同时,团队开源了目前最大的空间问答数据集SenseNova-SI-8M,并邀请业界在CVPR会议进行线下交流。
信息来源:X:商汤 SenseTime (@SenseTime_AI) · Qwen
模型发布 / 更新精选
Ring-2.6-1T 正式开源:蚂蚁百灵发布万亿级思考模型
蚂蚁百灵开源万亿级思考模型 Ring-2.6-1T,重点强化 Agent 执行能力,在 PinchBench 和 ClawEval 上达到开源 SOTA。模型支持 high 与 xhigh 两档推理强度,并采用异步 Async RL 架构结合升级版棒冰算法提升训练效率。权重已开源至 Hugging Face 和 ModelScope,Chat 体验现已开放。
信息来源:公众号:蚂蚁百灵(Ling) · Hugging Face
产品发布 / 更新精选
ChatGPT 推出全新个人理财体验
OpenAI 为美国地区的 ChatGPT Pro 用户推出个人理财功能预览版。用户可安全连接个人金融账户,获取基于自身财务状况、目标和优先级生成的 AI 洞察与指导。该体验通过账户关联实现个性化分析,标志着 ChatGPT 正式向个人金融助手领域拓展。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
将Grok接入Hermes智能体
xAI宣布,用户现可将Grok订阅账户接入Nous Research的开源自改进智能体Hermes Agent。该集成对所有订阅层级开放,允许用户在Hermes环境中直接使用Grok 4.3进行文本对话与高级推理、调用其文本转语音功能生成语音回复,并利用Grok Imagine创建图像与视频。Hermes Agent可持久运行于电脑、沙盒或VPS,具备跨会话长期记忆能力,并能连接WhatsApp、Discord等通讯平台。用户通过安装Hermes Agent并选择Grok提…
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
推理的一阶导数:AI浪潮下的增长逻辑
AI推理是当今规模最大、增长最快的技术市场,预计七年内将达到2500亿美元。直接销售或转售推理服务的公司增长迅猛,如Anthropic和谷歌云。在AI时代前的软件公司中,Datadog和Twilio作为"推理的一阶导数"脱颖而出:Datadog的LLM可观测产品数据量近一季增长近两倍,其约20%的AI客户贡献了约80%的年度经常性收入;Twilio则通过AI重构的语音服务吸引客户。当前周期呈现高度集中特点,少数客户能驱动巨大收益。对于非AI原生公司,核心战略在于如何转售推理…
信息来源:Tomer Tunguz 博客(VC 分析) · Claude
论文研究精选
PAGER:弥合点精确几何图形界面控制中的语义-执行鸿沟
研究针对需要点级精度的几何图形界面控制任务,揭示了现有视觉-语言模型存在的语义-执行鸿沟:通用模型动作类型准确率高但任务成功率极低。为此,我们构建了包含4,906个问题、超过22.4万次像素级动作的PAGE Bench基准,并提出了拓扑感知智能体PAGER。该智能体通过依赖结构规划与像素级执行分解任务,结合像素接地监督调优与精度对齐强化学习,将任务成功率提升至最强通用基线的4.1倍,步骤成功率从GUI专用智能体的不足9%提高到62%以上,实现了点精确GUI控制的新突破。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
教程 / 实战精选
业务运营团队如何使用 Codex
业务运营团队可利用 Codex,将实际工作输入转化为多种关键文档。该工具能够基于真实工作内容,自动生成项目简报、战略更新报告、领导决策包以及进度更新等材料。这一应用展示了 Codex 如何将日常运营数据与沟通需求直接连接,提升文档创建效率与一致性,帮助团队更专注于核心业务决策。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
教程 / 实战精选
数据科学团队如何使用 Codex
Codex 能够帮助数据科学团队根据实际工作输入,自动化生成根本原因简报、影响报告、关键绩效指标备忘录、范围分析以及仪表板规格文档。该工具将自然语言描述转化为结构化分析框架,提升了从数据查询到报告生成的工作流效率,使团队能更快速地将业务问题转化为可执行的数据分析方案。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
论文研究精选
突破舒适区:面向RLVR的高效策略引导探索框架NudgeRL
强化学习与可验证奖励范式面临探索效率瓶颈。为此,研究团队提出NudgeRL框架,其核心是"策略助推"技术,通过为每次策略采样注入轻量级策略级上下文,引导模型产生多样化推理轨迹,无需依赖昂贵的外部监督。该框架进一步提出一个统一目标,将奖励分解为上下文间与上下文内组件,并通过蒸馏目标将有效行为迁移回基础策略。在五个高难度数学基准测试中,NudgeRL的表现优于标准GRPO方法,其效果相当于后者使用高达8倍采样预算的结果,且平均表现超过了依赖特权信息的Oracle引导基线,证明了…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
在 Windows 上构建安全有效的沙箱以启用 Codex
OpenAI 为 Windows 平台上的 Codex 构建了一个安全沙箱环境。该沙箱通过严格控制文件访问权限和实施网络限制,确保了代码生成与执行过程的安全性。这一举措使得基于 Codex 的编码助手能够以高效且受控的方式运行,在提供强大编程辅助功能的同时,有效隔离了潜在风险,保障了用户系统的安全。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
教程 / 实战精选
销售团队如何使用 Codex
销售团队可利用 Codex 基于实际工作输入,自动生成一系列关键销售文档。具体功能包括创建管道简报、会议准备材料、预测审核、客户计划以及停滞交易诊断。这一应用将日常沟通与数据转化为结构化、可操作的销售支持内容,帮助团队提升效率与决策质量。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
观点 / 方法精选
API提示预缓存加速首令牌生成
减少API长提示首令牌生成时间的实用技巧:预热提示缓存。 在用户提示前发送系统提示。Claude会将其写入缓存,但跳过生成任何输出。 当真实用户请求到达时,将直接命中预热缓存。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
OpenCode与Qwen 3.6 Plus再度免费开放
OpenCode x Qwen 3.6 Plus - 再次免费 上次各位把我们的容量当成了自助餐。 我们找到了更多GPU。第二轮。
信息来源:X:opencode (@opencode) · Qwen
产品发布 / 更新精选
Claude 代理工具 v2.1.142 版本更新
Claude 代理工具发布 v2.1.142 版本。本次更新新增了 `--add-dir`、`--settings`、`--model` 等 8 个用于配置后台会话的命令行标志,并将 Fast 模式的默认模型升级为 Opus 4.7。插件功能得到增强,拥有根目录 `SKILL.md` 的插件现可被识别为技能,插件详情面板会显示其提供的 LSP 服务器。此外,版本修复了超过 15 项问题,包括 MCP 工具超时设置失效、后台会话在系统休眠后异常断开、守护进程升级后无法正常退出…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新精选
Luma Agents高效生成电商素材全流程
更多产品。更多市场。更多格式。再无瓶颈。 定义需求。设定风格。Luma Agents 从此处理所有电商活动素材。 立即扩展 → http://lumalabs.ai/app
信息来源:X:Luma AI (@LumaLabsAI)
产品发布 / 更新精选
ChatGPT移动端新增Codex功能
ChatGPT手机应用中推出Codex功能!
信息来源:X:Sam Altman (@sama) · ChatGPT
产品发布 / 更新精选
Codex推出自动化钩子与程序化令牌
Codex正变得更易于围绕用户代码实现自动化与定制。其核心更新包括"钩子"功能,允许在任务关键节点运行脚本,以进行工作验证、扫描密钥、记录对话或按仓库定制行为。同时,面向商业和企业团队推出"程序化访问令牌",提供范围化凭证,可从ChatGPT工作区设置创建,用于CI/CD、发布流程和内部自动化,支持设置过期或撤销,并将使用情况关联回工作区。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
产品发布 / 更新精选
ChatGPT移动端预览Codex编程助手
你们一直期待的功能来了… 现已在预览版推出:ChatGPT移动应用中的Codex。 从ChatGPT移动应用启动新工作、查看输出、引导执行并批准后续步骤。Codex将持续在你的笔记本电脑、Mac mini或开发机上运行。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT
模型发布 / 更新精选
IBM 发布 Granite Embedding Multilingual R2 开源多语言嵌入模型
IBM 发布两个 Apache 2.0 开源多语言嵌入模型:97M 参数的紧凑型(granite-embedding-97m-multilingual-r2)在 MTEB Multilingual Retrieval 上得 60.3 分,超越所有开放子 1 亿参数模型;311M 全尺寸模型(granite-embedding-311m-multilingual-r2)得 65.2 分,在 500M 以下开放模型中排第二,并支持 Matryoshka 维度。两者均基于 Mod…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
行业动态精选
OpenEvidence覆盖65%美国医生,shadow AI模式引关注
OpenEvidence已覆盖65%的美国医生,4月单月临床场景使用达2700万次,平均每位医生每月使用41次。平台由医生个人通过执业编号在手机上注册,医院最初不知情,Mount Sinai的AI负责人称此为shadow AI,表示其早在基层普及。医院后来才追签企业合作,OpenEvidence强调这是美国医疗史上首次让大多数医生自愿采用单一技术平台的突破。合作伙伴包括NEJM、JAMA、NCCN和Wiley,为此提供了支持。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新精选
Kimi发布支持多款AI编程助手的浏览器扩展
Kimi发布了Kimi Web Bridge,这是一款可与多种代理协同工作的新浏览器扩展,包括Claude Code、Hermes、Codex、Kimi Code CLI等。 一浏览器通用于所有 👀 试用地址:http://kimi.com/features/webbridge 及Chrome网上应用店。
信息来源:X:Testing Catalog (@testingcatalog) · Claude / Kimi
产品发布 / 更新精选
Recraft AI V4.1上线OpenRouter平台
现已在 OpenRouter 上线:@recraftai V4.1! 包含六款新图像生成模型:追求高美学的 V4.1 和 V4.1 Pro,用于 SVG 插画的 V4.1 Vector 和 V4.1 Pro Vector,以及优先考虑克制风格的产品图像的 V4.1 Utility 和 V4.1 Utility Pro。 照片级真实感更自然,渐变更平滑,简短提示词能更准确地命中目标,无需过多手动调整。
信息来源:X:OpenRouter (@OpenRouter)
教程 / 实战精选
在法律行业全面部署Claude:产品指南与实施路线图
2026年报告显示,法律团队生成式AI使用率已从44%跃升至87%。为应对日益复杂的工作,法律行业正将Claude应用于合同审阅、并购尽调及诉讼准备等核心流程,并通过多款产品组合提升效率:Chat用于即时研究,Claude Cowork处理跨文件协作,Microsoft 365插件集成办公套件,Platform支持定制应用开发。Anthropic同步发布法律行业部署指南,涵盖产品矩阵、12个预设业务领域插件及三阶段实施路线图,并解答数据托管与权限保护等关键问题。
信息来源:Claude:Blog(网页) · Claude
行业动态精选
Anthropic与盖茨基金会达成2亿美元合作,聚焦全球健康与教育
Anthropic与盖茨基金会建立为期四年、总额2亿美元的合作,通过资金、Claude使用额度及技术支持,共同推进全球健康、生命科学、教育及经济流动项目。合作重点包括改善中低收入国家约46亿人口的基本医疗,利用AI加速疫苗与疗法研发,并开发公共卫生数据集等公共产品。在教育领域,双方将为美国、撒哈拉以南非洲和印度的K-12学生开发AI教学工具。经济流动方面则关注提升小农户生产力及美国职业技能认证。首批成果预计今年晚些时候发布。
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
计算机直连Snowflake实现实时数据洞察
计算机现已连接至Snowflake。 可基于实时仓库数据开展端到端工作,通过SQL、源表、筛选器和指标获取答案。 这就像一支随时待命的个人数据科学团队,从公司实时数据中提供精准答案。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新精选
Kimi推出网页桥接扩展 支持多平台交互
认识Kimi网页桥接--Kimi的浏览器扩展。 现在智能体可以像人类一样与网站互动:搜索、滚动、点击、输入并完成任务。 支持Kimi Code CLI、Claude Code、Cursor、Codex、Hermes等平台。 现已在http://kimi.com/features/webbridge和Chrome应用商店上线。
信息来源:X:Kimi.ai (@Kimi_Moonshot) · Claude / Kimi / Cursor
观点 / 方法精选
克劳德代码与《代码书》技能:有针对性的技能培养
开发者发布了一款名为"克劳德代码与《代码书》技能"的GitHub工具,旨在通过刻意练习提升编程技能。该工具利用AI模型生成特定主题的代码示例与解释,帮助用户进行针对性学习。项目在Hacker News上获得104点热度,关注度较高。其核心变化在于将传统的广泛学习转化为聚焦、可重复的技能训练模式,通过结构化练习提升学习效率。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
随时随地使用 Codex
用户现可通过 ChatGPT 移动应用随时随地使用 Codex。该功能支持跨设备和远程环境实时监控、引导及批准编码任务,实现了对编程工作的无缝移动端管理。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
行业动态精选
AI 热潮引发民怨:七成美国民众反对家门口建数据中心
盖洛普调查显示,高达七成美国民众反对在住宅附近建设数据中心,反对率较去年大幅上升,抵触情绪甚至超过对核电站的接受度。全美已有69个辖区出台暂停令,多地项目因抗议和监管纠纷延期。数据中心建设推高批发电价,导致用电成本激增,并引发空气污染、水资源消耗等担忧。尽管白宫要求AI企业承担配套成本,但仅为无约束力承诺,未来审批将更严苛。
信息来源:IT之家(RSS)
模型发布 / 更新精选
SenseNova U1技术报告发布,基于MoE架构开放模型权重
由联合创始人兼首席科学家李沐博士领导的团队发布了SenseNova U1技术报告,详细阐述了其架构、训练方案与创新突破。此次开源同步发布了基于混合专家模型(MoE)的新权重,旨在推动AI领域的透明度、可复现性与进一步创新。团队希望通过开放共享促进整个社区的技术发展。
信息来源:X:商汤 SenseTime (@SenseTime_AI)