AI 情报文章归档
浏览 AI圈报 已保存的 5751 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5751
正式分类6
精选内容3361
全部文章
第 97 / 144 页 · 每页 40 条
观点 / 方法精选
GitHub Copilot CLI 推出自定义 AI 智能体,将一次性终端提示转化为可重复工作流
GitHub Copilot CLI 新增自定义 AI 智能体功能,使 CLI 能够理解开发者的技术栈和团队工作流,将一次性终端提示转变为可重复、可审查的流程。
信息来源:GitHub Blog
论文研究精选
Google Research提出审计机器遗忘新框架
Google Research 在 AISTATS 2026 发表正则化 f-散度核检验,用于高效审计 LLM 等模型的机器遗忘。该方法通过统计两样本检验判断模型是否真正"忘记"特定训练数据,避免完全重训的巨大成本。相比最大均值差异等现有工具,新框架理论上可在任意样本量下自然控制假阳性,且假阴性风险随可用样本增加可靠收敛至零,解决了大规模模型审计中计算成本过高的问题。
信息来源:Google Research:Blog(网页)
产品发布 / 更新精选
智能体表面的演进:使用 Claude Managed Agents 构建
Anthropic 推出 Claude Managed Agents,一套可组合 API 套件,用于构建和部署生产级智能体。该产品从早期简单 API 演进至 Claude Agent SDK,再到将智能体调度层与代码执行沙箱解耦的 Managed Agents。通过只追加日志的会话机制,Managed Agents 解决了托管伸缩、会话持久化、文件系统管理、执行隔离、凭证安全与可观测性等生产部署挑战。团队借助该方案可在数天内完成从原型到生产环境的转化,无需自建基础设施。
信息来源:Claude:Blog(网页) · Claude
教程 / 实战精选
Gemini 2.5 Flash API - 定价、快速入门与提供商比较
Gemini 2.5 Flash API 支持配置思考预算(thinking budgets),用户可跨提供商进行比较,并在5分钟内完成首次API调用。
信息来源:OpenRouter:Announcements(RSS) · Gemini
模型发布 / 更新精选
Cohere发布North Mini Code:面向开发者的开源编码模型
Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。
信息来源:Hugging Face:Blog(RSS) · Qwen / Hugging Face
行业动态精选
里程碑式德国裁决:Google AI Overviews 被视为谷歌自身言论,需为错误回答承担责任
德国地方法院裁定,Google 对其 AI 概览生成的内容直接承担法律责任,不能援引搜索引擎运营商原有的有限责任保护。涉案 AI 概览错误地将两家出版商与欺诈行为关联,且相关声明未出现在任何链接来源中。该裁决可能为全球 AI 生成内容责任认定树立先例。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新精选
Gemini 3.5 Live Translate 发布
说 hello, hola, 你好--欢迎 Gemini 3.5 Live Translate:我们最新的音频模型,专为快速跨语言交流而构建。🌐
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
模型发布 / 更新精选
Claude Mythos 即将发布,Fable 精简版同日登场
确认,Claude Mythos 将在接下来几小时内揭晓。 【引用 @steph_palazzolo】: 独家:一个名为 Claude Fable 的精简版 Mythos 今天推出。它价格昂贵--是 Opus 的两倍--但或许不像人们从最初 Mythos 定价(Opus 的 5 倍)所想的那样昂贵。 更多内容及 Apple WWDC 见 AI Agenda: https://www.theinformation.com/newsletters/ai-agenda/anthr…
信息来源:X:Kim (@kimmonismus) · Claude
行业动态精选
全新汽车品牌AIVA发布,火山引擎助力打造AI汽车新体验
由赛力斯、宁德时代等多方产业资本组建的AI出行品牌AIVA正式发布。火山引擎提供豆包大模型、智能座舱等技术服务。概念车AIVA Origin Concept亮相,首款量产车AIVA ME7将于2026年内亮相,全系覆盖20万元以上市场。AIVA提出"AI定义汽车"路径,让汽车成为具身AI生命体。火山引擎副总裁表示,人与汽车的关系将实现交互、智能、感受三方面根本转变。未来双方将围绕AI交互、智能体验、情感陪伴深度共创。
信息来源:公众号:火山引擎 · 豆包
产品发布 / 更新精选
Claude Code 支持嵌套子智能体
刚刚在 Claude Code 中实现了嵌套子智能体支持。 开始更多实验智能体启动其他智能体,以便更好地管理上下文。初始深度上限为 5,将在今天的发布中推出。 欢迎反馈!
信息来源:X:Boris Cherny (@bcherny) · Claude
行业动态精选
百度搭子DuMate获中国信通院企业级Claw能力评估最高4+级
2026年6月,百度智能云旗下百度搭子DuMate V3.4.0通过中国信通院「可信AI-企业级Claw能力评估」,获最高评级4+级,为国内首批。评估依据《智能助理智能体(Claw)技术和应用要求 第2部分 企业级Claw能力》(AIIA/T 0295-2026),覆盖智能体、工程化部署、服务、业务融合、运行管理五大能力域。百度搭子支持多智能体分工协作、容器化批量部署、多租户隔离与三级差异化授权、企业知识库接入、全链路日志审计等能力,企业级智能助手服务能力获国家级权威认可。
信息来源:公众号:百度智能云(文心)
观点 / 方法精选
腾讯混元发布UniRL:统一多模态强化学习基础设施
腾讯混元推出UniRL,一个支持统一多模态模型的强化学习基础设施,并发布两个新算法DRPO和Flow-DPPO。UniRL通过单个后训练循环(生成→评分→优势→更新→同步)覆盖扩散/流匹配模型、LLM/VLM及统一多模态模型(如Hunyuan-Image 3和Bagel)。模型与算法作为独立轴,可实现模型×算法的组合覆盖。框架支持可插拔rollout引擎(训练侧/SGLang/vLLM-Omni)、FSDP2分片和三种部署模式。FlowDPPO针对流/扩散模型引入基于精确散…
信息来源:X:腾讯混元 (@TencentHunyuan)
产品发布 / 更新精选
火山引擎TRAE Work企业版正式上线,面向全员提供AI办公平台
火山引擎将TRAE Solo品牌升级为TRAE Work企业版,发布面向企业的AI办公平台。平台提供Work和Code两种模式:Work模式面向产品、运营、市场等非技术岗位,支持上传.pptx、.xlsx、图片等多种格式混合输入直接输出PPT或文档,支持语音讨论自动整理结构化纪要,支持按天或按周自动运行的数据整理和报告生成;Code模式面向开发者和业务同学,可用自然语言描述需求直接生成页面或小应用。桌面端、网页端和移动端多端同步。企业后台可统一配置模型、用量限额、上传内部文…
信息来源:公众号:火山引擎
教程 / 实战精选
一个Agent如何通过链式调用两个HuggingFace Space构建3D巴黎画廊
一个编码Agent调用HuggingFace上的两个Space,从零构建了展示巴黎地标3D高斯散点图的交互式画廊。Agent先用ideogram-ai/ideogram4生成每个纪念碑的黑色背景图像,再通过VAST-AI/TripoSplat从单张图像重建3D高斯散点(.ply),自动完成坐标系校正、取景、压缩为.ksplat(体积缩小约3倍),并构建基于Three.js的滚动切换、拖拽旋转查看器,最终部署为静态Space。整个过程无需客户端库,每个Space通过`agen…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
观点 / 方法精选
仅凭一份文档,Qwen3.7-Max 从 0 交付双端应用
在无设计稿和后端代码的条件下,Qwen3.7-Max 仅凭一份约 15 万字的产品调研文档,于隔离环境中全自动完成移动端与 Web 端两套真实应用从 0 到 1 交付,单端耗时约 4 小时,中途无人工接管。模型不具备图像理解能力,通过像素坐标反推布局约束实现界面还原。实验采用"分阶段注入约束→逐层验收→带错纠正"的闭环控制系统:任务拆分为规划、架构、编码等阶段,验收覆盖静态检查、编译自检(0 error)、路由完整性(Web 端 34 条路由全部可达)、功能扫描及真机冷启动…
信息来源:公众号:通义实验室(千问) · Qwen
观点 / 方法精选
NeuroBait:微调AI助手,为ADHD大脑点燃多巴胺火花
NeuroBait是基于Google gemma-3-12b-it微调的AI对话助手,旨在帮助ADHD患者克服"知道该做什么但无法开始"的执行功能障碍。采用16-bit LoRA(r=16, alpha=16)在Unsloth上训练3个epoch,学习率2e-4,最大序列长度2048,使用单张H100 80GB GPU。数据集为基于真实ADHD场景手工合成的少量数据。部署于Hugging Face Space(ZeroGPU),使用Gradio和标准transformers…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
教程 / 实战精选
NVIDIA cuTile Python 教程:在 Colab 中构建用于向量加法、矩阵加法和矩阵乘法的 Tiled GPU 内核
该教程基于 NVIDIA cuTile Python 实现了分块 GPU 内核编程工作流,在 Colab 环境中配置 GPU、驱动、CUDA 及 cuTile 可用性后,分别构建了 tiled 向量加法、矩阵加法和矩阵乘法核函数,并以 PyTorch 作为回退保持 notebook 可执行。每一步均通过 PyTorch 验证结果正确性,并基准测试了各阶段的中位运行时间。
信息来源:MarkTechPost(RSS) · NVIDIA
观点 / 方法精选
编码智能体:用循环设计替代直接提示
每月提醒:你不应再手动提示编码智能体了,而应设计循环来驱动它们。有人已经在写嵌套循环了吗?
信息来源:X:Tibo (@thsottiaux)
行业动态精选
AI 编程独角兽 Cursor 欧洲总部落子伦敦,SpaceX 手握 600 亿美元收购选择权
Cursor 将欧洲总部设在伦敦,计划招聘约 200 名员工,并在巴黎、慕尼黑等地开设小型办事处。SpaceX 拥有以 600 亿美元收购 Cursor 的选择权,或支付 100 亿美元开展全新合作。Cursor 目前 B2B 年化营收约 26 亿美元,客户包括英国航空、英国石油、诺基亚等。公司强调数据留存欧洲本地以满足监管合规,其平台支持用户用自然语言生成代码,主打模型中立,竞争对手包括 GitHub Copilot、OpenAI 和谷歌的同类产品。
信息来源:IT之家(RSS) · OpenAI / Cursor
产品发布 / 更新精选
ChatGPT上线交互图表、全屏编辑等多项新功能
ChatGPT团队持续每周推进更新,最新一批功能已全部上线。新增内容包括:交互式漂亮图表、全屏写作编辑并保存至个人库、长对话自动生成目录、支持附带附件编辑消息。Plus/Pro用户现可长按发送键选择模型的智能/努力级别。iOS端聊天输入框响应速度也得到提升。团队表示将持续倾听用户反馈并快速迭代。
信息来源:X:Tibo (@thsottiaux) · ChatGPT
模型发布 / 更新精选
Xiaomi MiMo-V2.5-Pro 携手 TileRT:1T 模型首次突破 1000 tokens/s 输出速度
Xiaomi MiMo-V2.5-Pro 的 UltraSpeed 模式与 TileRT 联合发布,让 1T 参数旗舰模型输出速度首次突破 1000 tokens/s,仅用一个标准 8 卡通用 GPU 节点实现。
信息来源:公众号:小米 MiMo
模型发布 / 更新精选
小米 MiMo 与 TileRT 联合发布 UltraSpeed 模式,1T 模型输出突破 1000 tokens/s
小米 MiMo 与 TileRT 联合发布 MiMo-V2.5-Pro-UltraSpeed 模式,使 1T 参数旗舰模型输出速度首次突破 1000 tokens/s。模型侧采用 FP4 混合量化(仅量化 MoE Expert)与 DFlash 块级 masked 并行推测解码(coding 场景平均接受长度 6.30 tokens);系统侧 TileRT 引入常驻内核引擎与异构流水线协作。API 限时开放(2026 年 6 月 9 日至 23 日),定价为 MiMo-V2…
信息来源:公众号:小米 MiMo · Hugging Face
行业动态精选
OpenAI 秘密提交 IPO 申请,奥特曼旗下 Tools for Humanity 裁员
OpenAI 近日秘密提交 IPO 申请。其 CEO 山姆·奥特曼旗下的 Tools for Humanity 公司正裁员,该公司因虹膜扫描项目 World 及加密货币 Worldcoin 知名,投后估值 25 亿美元,获 Andreessen Horowitz 等投资。因营收困境,公司缩减规模。海外监管方面,肯尼亚以隐私和金融风险为由叫停运营,韩国因违反隐私法规罚款 83 万美元。
信息来源:IT之家(RSS) · OpenAI
论文研究精选
FrontierCode 在 Hacker News 获 101 分
cognition.ai 的 FrontierCode 项目在 Hacker News 上获得 101 个 points。目前公开信息仅包含项目名称和来源,具体功能、技术细节或性能数据尚未披露。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
Elon Musk 详解 SpaceX AI1 轨道 AI 数据中心卫星方案
Elon Musk 首次详细解释 SpaceX 的 AI1 轨道 AI 数据中心卫星:峰值功率 150 kW,持续计算功率约 120 kW,相当于一个 NVIDIA GB300 机架;太阳能板效率 250 W/m2;双面散热器排热 1,400 W/m2。通过激光链路实现约 1 Tbps 互联,低轨 600-800 km 高度往返延迟 6-8 ms。由 Starship 发射,计划部署多达百万颗卫星,2027 年底前实现量产。近地目标为吉瓦级轨道 AI 算力,长期向太瓦级推进。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
行业动态精选
两部门:到2026年底人形机器人等重点产品完成应用验证并常态部署
工信部、国资委6月8日联合发布通知,目标到2026年底,人形机器人等重点产品在代表性场景完成应用验证并开启常态部署,形成百个以上高价值场景,万台级规模落地。要求各省级地区选取不少于20个场景单元(覆盖两类领域),央企不少于10个。围绕打造实景实训空间、组建创新应用联合体、攻关作业技能、加强验证部署、强化要素保障、凝练经验等六大任务展开,鼓励"人形机器人即服务"等商业创新。
信息来源:IT之家(RSS)
观点 / 方法精选
FrontierCode 基准测试:AI 编程评估新标准--维护者审核通过率最高仅 13.4%
Cognition 发布 FrontierCode 基准测试,重新定义 AI 编程评估:由 20 多位顶级开源维护者手工制作 150 个任务(每个耗时 40+ 小时),依据 3000 多条规则判断维护者是否愿意合并代码。该基准指出 SWE-Bench 等超半数通过测试的代码实为不可维护的垃圾。结果中 Claude Opus 4.8 在最高难度档获 13.4%,GPT-5.5 为 6.3%,其余模型 1%-5%。这意味着即便最强模型,近九成代码仍无法通过有经验维护者审核。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · GPT / Claude
论文研究精选
快手开源 Kwai Keye-VL-2.0-30B-A3B:面向长视频理解与智能体智能的 MoE 多模态模型
快手开源 Kwai Keye-VL-2.0-30B-A3B,一个 MoE 多模态基础模型,激活仅 3B 参数,专为长视频理解和智能体智能设计。模型首次将 DeepSeek Sparse Attention (DSA) 适配到 GQA 多模态架构,实现无损 256K 上下文处理,并通过可扩展视频 I/O、异构 ViT-LM 并行及自定义 DSA 内核优化吞吐与计算开销。引入跨模态多教师在策略蒸馏(MOPD)结合 Context-RL 和 Video-RL,缓解多任务对齐中的灾…
信息来源:HuggingFace Daily Papers(社区热门论文) · DeepSeek / Hugging Face
产品发布 / 更新精选
Gopuff与SpaceXAI推出Go AI购物助手
Gopuff与SpaceXAI合作推出Go智能购物助手,内置于Gopuff应用,由Grok文本、音频和图像模型驱动。Go结合Grok的推理、语音和图像生成能力与Gopuff的13年需求智能,利用X和网络实时信号。它可在用户打开应用前根据历史偏好和天气等信号构建个性化购物车,并包含基于Grok Imagine的超逼真视觉购物信息流。Go目前在美国iOS和Android端可用,随后在英国推出。
信息来源:xAI:News(网页) · Grok
论文研究精选
i1:面向强文生图模型的简单且完全开源配方
i1 是一个 3B 参数的文本到图像扩散模型,仅使用公开数据集训练。在 GenEval、DPG、PRISM、CVTG-2K 和 LongText 五个基准上,i1 性能与领先模型相当,平均比最佳现有完全开源模型高 29.5 个百分点。研究基于 300 余项控制实验(超 700K TPU v6e 小时),发现等权重混合 curated 数据集是强默认配置、更大文本编码器适配器以极少参数提升性能。i1 的检查点、训练与推理代码及数据处理流程已全部开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
Flow-DPPO: 面向流匹配模型的散度近端策略优化
针对流匹配模型中在线强化学习比率裁剪策略约束不当的问题,Flow-DPPO 提出用散度近端约束替代。关键洞察是流模型每步策略为高斯分布,可精确计算新旧策略间的 KL 散度。Flow-DPPO 采用非对称散度掩码,仅在梯度更新偏离信任区域且超阈值时阻止更新。实验表明,Flow-DPPO 获得更高奖励,KL 近端效率更优,缓解了灾难性遗忘,促进多目标均衡,并能在比率裁剪失效时支持稳定的多轮训练。代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
DeLM:去中心化多智能体系统框架
DeLM是一种去中心化多智能体系统框架,通过并行智能体、共享已验证上下文和任务队列避免中央控制器瓶颈。智能体异步认领子任务、读取累计进展、执行局部推理并写回紧凑的已验证更新。在SWE-bench Verified上,DeLM在Avg.@1、Pass@2和Pass@4指标中均取得最佳性能,相比最强基线提升最多10.5个百分点,每任务成本降低约50%。在LongBench-v2多文档问答上,DeLM在四个前沿模型家族中取得最高平均准确率,提升最多5.7个百分点。代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
Embodied-R1.5:通过具身基础模型演化物理智能
Embodied-R1.5是一个统一具身基础模型,将具身认知、任务规划、纠错与指向能力整合在单一架构中。基于三条自动化数据构建流水线,团队搭建超过150亿模型token的数据系统,并设计多任务平衡强化学习方案以缓解异构任务冲突。其Planner-Grounder-Corrector闭环框架使模型能在长周期任务中自主执行并自我纠正。仅8B参数的Embodied-R1.5在24个具身VLM基准中的16个上达到SOTA,超越Gemini-Robotics-ER-1.5与GPT-5…
信息来源:HuggingFace Daily Papers(社区热门论文) · GPT / Gemini / Hugging Face
观点 / 方法精选
将 GitHub CI 迁移到 Hugging Face Jobs
本文介绍了如何将 GitHub Actions 的 CI 作业迁移到 Hugging Face Jobs 上运行,以解决 GitHub Actions 速度慢、缺乏 GPU 支持等问题。通过使用 huggingface/jobs-actions 桥接,将 GitHub Actions 的 job 转为临时自托管运行器:GitHub App 监听 `workflow_job.queued` webhook,dispatcher Space 验证后启动对应硬件(CPU 或 t4…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究精选
混合LLM中的注意力失忆:CoT微调破坏长距离召回及修复方法
CoT监督微调系统性地降低混合线性注意力模型(如HypeNet、Jet-Nemotron)的长上下文召回能力。在NIAH任务上,HypeNet-9B的S2@256K从67.2%降至9.4%,原因是CoT-SFT使注意力梯度偏向短程模式,破坏长程路由的W_Q和W_K投影。QK-Restore方法无需训练,从微调前检查点恢复W_Q和W_K,保留其余参数;Procrustes变体平衡路由保留与推理适应。在HypeNet-5B上,QK-Restore将S3@256K从65.4%提升…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
Apple Core AI 框架
一篇关于 Apple Core AI 框架的 Hacker News 帖子获得 109 个点赞。帖子内容包含一张苹果开发者 OG 图片和一个指向 Apple Core AI Framework 官方文档的链接(developer.apple.com)。该帖子由 buzzing.cc 中文翻译,发布于 2026 年 6 月 8 日 02:47(UTC)。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Claude Code v2.1.169 发布
Claude Code v2.1.169 新增 `--safe-mode` 标志及环境变量,用于禁用所有自定义配置以排查问题;新增 `/cd` 命令,可在不破坏提示词缓存的情况下切换工作目录;新增 `disableBundledSkills` 设置隐藏内置技能。修复了企业 MCP 策略在重连、IDE 配置及首次会话中不被强制的问题,以及 macOS 用户每轮约 30-50ms 的 UI 卡顿、Windows 下 `claude -p` 和 Git 凭证弹窗等多项 bug。改…
信息来源:Claude Code:GitHub Releases(RSS) · Claude
观点 / 方法精选
OpenAI计划到2028年由AI主导研究
Sam Altman关于OpenAI未来路径的新博客称,到2028年3月,其大量研究将由AI完成。 该路径主要有3个目标:构建自动AI研究员,利用它加速科学和生产,然后给每个人一个个人AGI,帮助处理工作、学习、编程、商业、健康文书和决策。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI
产品发布 / 更新精选
Apple 推出新智能能力、Xcode 生产力功能及平台改进以辅助应用开发
Apple 今天推出了新的智能能力、Xcode 中扩展的生产力功能以及平台改进,旨在协助应用开发。
信息来源:Apple:Newsroom(RSS)
产品发布 / 更新精选
Viggle API 上线:任意角色任意动作秒级生成
推出 Viggle API。 给任意角色添加任意动作,一次 API 调用--数秒内即可激活。 可接入 Claude、Codex 或你正在构建的任何智能体。起价 $0.01/秒。 注册即获 100 次免费额度。 转发 + 关注 + 评论,10 位中奖者再获 100 次! 了解更多👇
信息来源:X:Viggle AI (@ViggleAI) · Claude