AI 情报文章归档
浏览 AI圈报 已保存的 5794 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5794
正式分类6
精选内容3375
全部文章
第 91 / 145 页 · 每页 40 条
论文研究精选
OpenAI与哈佛等合作研究:o3 Deep Research模型辅助诊断儿童罕见病,额外诊断率4.8%
波士顿儿童医院、哈佛大学与OpenAI合作,在《NEJM AI》发表研究。团队使用OpenAI o3 Deep Research推理模型重新分析376例此前未确诊的罕见病案例,产出基于证据的候选解释。经专家评审、额外检测和临床确认,医生在18例中建立诊断,额外诊断率达4.8%。研究显示,AI辅助工作流可帮助专家在未解病例中生成可检验假设,使定期再分析更具可扩展性。模型不直接诊断或做临床决策,仅提供证据链供专家审查。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
DeepSeek 识图模式正式上线 App 和网页端
DeepSeek 识图模式于6月18日在网页和 App 端正式上线,与快速模式、专家模式并列。开启后用户可直接上传图片让 DeepSeek 识别图像,能力超越简单文字提取。目前 App 端仍显示"图片理解功能内测中",网页端无此提示。该模式背后的多模态模型技术细节于今年4月公开,核心框架为"Thinking with Visual Primitives(以视觉原语思考)"。
信息来源:IT之家(RSS) · DeepSeek
产品发布 / 更新精选
cuTile Rust:安全无数据竞争的 GPU 内核系统
cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。它通过 `#【cutile::module】` 宏将内核 AST 嵌入主机二进制,在运行时经 CUDA Tile IR JIT 编译为 GPU cubin。可变张量在启动前分割,不可变张量共享,启动器在 GPU 工作期间保持所有权。在 NVIDIA B200 上,逐元素操作达 7 TB/s(约 91% 峰值带宽),GEMM 达 2 PFlop/s(约 92%…
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen / NVIDIA
模型发布 / 更新精选
统一科学大模型 LOGOS 正式开源
LOGOS 是由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源的基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B 仅用 1/56 参数量即在多个任务上超越 NatureLM,逆合成预测 Top-1 准确率达 74.8%。模型涵盖 7 类模态、44.87B tokens 预训练语料,无需 3D 坐标,已开源模型权重、推理代码与技术报告。
信息来源:公众号:通义实验室(千问) · Qwen
模型发布 / 更新精选
首个统一科学大模型 LOGOS 正式开源
LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域专用方法:口袋条件配体生成纯序列范式首次超越3D扩散模型,超越NatureLM(8×7B);逆合成预测Top-1准确率74.8%;口袋位点识别仅靠序列达58.5% Top-n准确率;MOF材料生成NBB提升至17.78%。模型采用统一词汇表将蛋白质、小分子等编码为离散Token…
信息来源:公众号:通义实验室(千问) · Qwen
产品发布 / 更新精选
深入解析 Midjourney Scanner 技术内幕
我们全新"Midjourney Scanner"的技术深潜。
信息来源:X:Midjourney (@midjourney)
行业动态精选
Noam Shazeer 加入 OpenAI,告别 Google
Noam Shazeer 宣布将加入 OpenAI,期待与那里的优秀团队合作。离开 Google 是一个艰难的决定,他为 Google 的团队和共同取得的成就感到自豪。
信息来源:X:Jason Liu (@jxnlco) · OpenAI
行业动态精选
上交所发布指引:AI大模型企业可适用科创板第五套上市标准
上海证券交易所6月17日发布指引,支持尚未形成稳定收入的优质人工智能大模型企业通过科创板第五套上市标准发行上市。申报企业需在行业地位、产业链优势、目标市场需求、研发进度及关键指标方面具备突出竞争力。指引明确,申报时至少有一个大模型产品已完成上线发布并实现规模化应用,以验证商业模式可行性。下一步,上交所将在中国证监会指导下推进符合标准的企业上市。
信息来源:IT之家(RSS)
产品发布 / 更新精选
苹果 Xcode 27 核心首次深度集成 AI 智能体:支持自然语言修 Bug、构建 App
在 2026 年 WWDC 期间,苹果发布 Xcode 27,其核心组件首次整合 AI 智能体,能理解 Swift 语言并通过多轮自然语言对话辅助开发。AI 可跨多个文件修改整个代码库,也能根据提示与资源生成应用设计并独立构建完整应用,建成后仍可通过对话添加特效、动画等。Xcode 27 支持接入 Anthropic、OpenAI 和 Google 等第三方 AI 模型,同时引入 Core AI 框架提供现代 Swift API 调用端侧模型,并升级开源框架 MLX。
信息来源:IT之家(RSS) · OpenAI / Claude
行业动态精选
Transformer 共同作者 Noam Shazeer 加入 OpenAI
OpenAI 首席研究官 Mark Chen 宣布,Transformer 架构共同作者、MoE 与高效解码技术先驱 Noam Shazeer 将加入 OpenAI,领导架构研究。Shazeer 本人确认了这一决定,并表示离开 Google 团队是艰难选择。
信息来源:X:Mark Chen(OpenAI 首席研究官,@markchen90) · OpenAI
教程 / 实战精选
超越 LoRA:如何选择最佳参数高效微调技术?
参数高效微调(PEFT)技术中,LoRA 占据绝对主导:Hugging Face Hub 上 20,834 张提及单一 PEFT 技术的模型卡中 20,509 张指向 LoRA(98.4%);外部站点 10,000 个检查点中 95.0% 是 LoRA;GitHub 搜索 `from peft import` 代码片段的 71.3% 结果为 LoRA。但研究者宣称其他技术超越 LoRA 的论文结果具备偏向性--调整学习率即可让 LoRA 匹配更优技术。Hugging Fac…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
xAI 发布 Grok for Word 插件
xAI 将 Grok 引入 Microsoft Word,推出免费 365 插件。用户可将笔记转为结构化文档、重写文本以提升清晰度与简洁性,也能通过插件搜索网页、X 平台或生成图表。插件支持连接 SharePoint 和 Google Drive 等外部来源,还可用于 PowerPoint 和 Excel。
信息来源:xAI:News(网页) · Grok
论文研究精选
HumanScale:自我中心人类视频在具身预训练中可超越真实机器人数据
HumanScale项目比较了自我中心人类视频与遥操作真实机器人轨迹作为具身基础模型预训练数据源。经精心设计的过滤与标注流程后,基于自我中心数据预训练的模型在真实机器人动作预测上验证损失降低24%,分布内任务成功率高52.5%,分布外任务成功率高90%。研究验证了一种可扩展范式:先以人类视频预训练学习多样世界表征,再以少量标注机器人数据微调对齐动作空间。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
AI 智能体够格吗?在自有工具上评测开源模型
Hugging Face 发布面向 AI 智能体使用场景的基准测试框架,以 transformers 库为案例评估库的智能体友好度。框架使用 pi coding agent 与开源模型驱动,通过 Hugging Face Jobs 分散任务确保硬件一致。评估关注 agent 完成任务的成本、延迟、token 使用量和失败率,而非仅最终结果。此前 hf CLI 经优化后 agent token 使用量减少 1.3-1.8 倍(最高 6 倍),该框架旨在验证类似优化对 tran…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
行业动态精选
泄露文件显示OpenAI年营收130亿但亏损远超收入
OpenAI 2025年营收130.7亿美元(2024年37亿),但研发成本达191.8亿(含向微软支付105.9亿),收入成本(推理计算)75亿,销售营销成本57.3亿,运营亏损209.2亿。2025年净亏损约390亿,扣除约300亿一次性会计费用后约80亿。2025年3月获1220亿融资(估值8520亿)。ChatGPT周活超9亿,付费约5000万。为控制成本已关闭Sora视频模型并削减非核心业务。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / ChatGPT
行业动态精选
库克:AI 浪潮引发存储芯片价格暴涨,iPhone 等苹果产品涨价已"不可避免"
苹果CEO库克确认,AI热潮导致存储芯片严重短缺和价格暴涨,苹果产品涨价已"不可避免"。库克未透露涨价具体细节。华尔街日报指出,全球AI巨头大幅增加资本开支,高带宽内存需求激增,挤压消费电子芯片供应。自2024年以来内存和存储芯片价格已翻四倍,涨势预计延续至2027年。研究机构估算,下一代iPhone 18 Pro售价或需增加约270美元。苹果已在上月提高Mac Mini起售价。摩根士丹利预测,今年美国智能手机和PC价格将上涨15%。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Claude Code v2.1.181 发布
Claude Code v2.1.181 发布,新增 `/config key=value` 语法允许在提示中直接设置任意配置项,新增 `sandbox.allowAppleEvents` 选项使沙盒命令支持 Apple Events,新增 `CLAUDE_CLIENT_PRESENCE_FILE` 环境变量用于抑制移动端推送通知。内置 Bun 运行时升级至 1.4,改进了长段落流式输出(逐行显示)和 API 连接中断后自动重试。子 agent 面板优化:空闲 agent …
信息来源:Claude Code:GitHub Releases(RSS) · Claude
产品发布 / 更新精选
GitHub 发布 CC0-1.0 开源多语言仓库级数据集,覆盖 README、Issue 和 PR
GitHub 推出一个新的仓库级数据集,采用 CC0-1.0 许可证,旨在帮助研究人员和开发者发现跨 README、Issue 和 Pull Request 的多语言开发者内容,加速多语言 AI 开发。
信息来源:GitHub Blog
产品发布 / 更新精选
Claude Design与Replit联动,设计变应用
在Claude中设计。在Replit中构建。 你现在可以将Claude Design中的设计发送到Replit,将其变成一个可工作的应用。
信息来源:X:Replit (@Replit) · Claude
观点 / 方法精选
Matt Pocock 开源 skills v1:将技能描述 Token 成本降低 63%
Matt Pocock(Total TypeScript 作者)开源了 skills v1,将技能描述的 Token 成本降低 63%。该工具包将技能分为模型可调用和用户可调用,新增 /codebase-design、/domain-modeling、/grilling 三项技能;重写 /writing-great-skills;将 /diagnose 更新为 /diagnosing-bugs 并改为模型可调用;新增 /ask-matt 路由技能,帮助 AI 自动判断时机触…
信息来源:X:阿易 AI Notes (@AYi_AInotes)
行业动态精选
Anthropic与DeepMind CEO呼吁G7组建AI联盟排除中国
Dario Amodei(Anthropic)与Demis Hassabis(Google DeepMind)在G7闭门会议上呼吁组建美国主导的联盟,为人工智能制定全球规则和标准。Amodei指出,该联盟应以前沿模型和硬件(包括芯片及其他关键组件)的访问权限为手段,将中国排除在外。这一主张被评论为高技术新冷战的开端,竞争方将从根本上被剥夺参与权。
信息来源:X:Kim (@kimmonismus) · Claude / Gemini
行业动态精选
Anthropic员工指责特朗普政府针对他们
白宫上周五通知Anthropic,基于国家安全担忧,要求在不到90分钟内下架其新AI模型Fable 5和Mythos 5。公司内部员工群聊信息混乱,最初称外国公司可能获取系统访问权限,随后又指模型被发现重大漏洞。六天后,约3000名员工仍缺乏明确答案。CEO Dario Amodei与特朗普政府会面,但周一和周二讨论后未获突破。Anthropic声明将继续与政府官员会面,并承诺"与政府持续合作"。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新精选
Vercel 发布开源 AI 智能体框架 Eve:每个智能体就是一个文件目录
Vercel 发布开源 AI 智能体框架 Eve(npm 包,Apache-2.0 许可)。Eve 采用文件系统优先设计:每个智能体对应一个磁盘目录,目录结构直接映射模型、指令、工具、技能、连接、子智能体等能力,无需额外注册代码。内置六大生产级能力:持久执行(每步检查点,崩溃后可恢复)、沙箱计算、人机审批、安全连接(支持 MCP 和 OpenAPI)、多通道(Slack、Discord、Teams 等)以及追踪与评估(OpenTelemetry)。Vercel 内部运行了上…
信息来源:MarkTechPost(RSS)
产品发布 / 更新精选
Midjourney V8.1 发布大批次草稿模式
我们发布了 V8.1 的新大批次草稿模式。该新模式可让你生成 24 张低分辨率图像,价格仅为标准分辨率四图 Midjourney 任务的一半。当你喜欢某张图像时,只需按下 "Vary" 即可获得全分辨率的新版本。尽情享受吧!
信息来源:X:Midjourney (@midjourney)
论文研究精选
NVIDIA GEAR实验室发布ENPIRE:8个Codex智能体自主控制机器人完成物理实验
NVIDIA GEAR实验室推出ENPIRE系统,首次实现物理世界自主研究。系统让8个Codex智能体控制8台机器人,配备GPU和token预算。安全方面采用硬运动极限切断和扭矩受限夹爪两层硬件保障,支持通宵无人运行。奖励函数通过视觉分类器离线固定并冻结,防止智能体作弊。实时监测机器人利用率(MRU)、token利用率(MTU)和GPU利用率,以Tokens-to-Success和Time-to-Success评估效率。ENPIRE自主完成扎带、整理细针、安装GPU等高精度…
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
产品发布 / 更新精选
Google发布99美元Gemini智能音箱
Google推出首款专为Gemini打造的智能音箱Google Home Speaker,售价99.99美元。支持自然语言请求和多步指令,可在说话中途纠正,并具备连续对话功能。内置10种新声音。高级AI功能需订阅Google Home Premium(月费10美元或年费100美元),包括Gemini Live自由对话、Nest摄像头活动摘要等。即日起预售,本月发货。
信息来源:TechCrunch:AI(RSS) · Gemini
产品发布 / 更新精选
Claude Enterprise 推出企业托管 MCP 连接器授权管理
Claude Enterprise 推出企业托管授权功能,管理员可通过身份提供商(率先支持 Okta)为整个组织配置 MCP 连接器。用户首次登录 Claude 时自动获得授权,无需手动操作,实现零接触设置。该功能基于 Model Context Protocol 的 Enterprise-Managed Authorization 扩展构建,支持 Asana、Atlassian、Canva、Figma、Granola、Linear、Supabase 等 MCP 提供商,S…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Claude Code 现已支持 artifacts
从今日起,Claude Code 可将工作进度生成为 artifacts--实时、可分享的交互式网页,涵盖 PR 走查、系统说明、仪表盘、发布清单等。artifacts 基于会话完整上下文(代码库、连接器、对话)自动构建,更新时页面原地刷新,同事即时可见。默认仅作者可见,可分享给组织内成员,由管理员通过组织层级开关和角色权限管控。内部测试中最常见用例为调试:工程师调查事件,Claude Code 分析日志并发布包含时间线、嫌疑提交和错误率图表的 artifact,团队无需再…
信息来源:Claude:Blog(网页) · Claude
论文研究精选
Anthropic Project Fetch 第二阶段:Claude Opus 4.7 自主完成任务,速度比人类团队快约20倍
Anthropic 发布 Project Fetch 实验第二阶段结果。在2024年8月原始实验中,配备 Claude Opus 4.1 的人类团队在操控四足机器人时显著超越无 AI 团队。新实验中,Claude Opus 4.7 无需人类协助即完成所有任务,速度比最快人类团队快约20倍,比无 Claude 团队快37倍以上,编码量减少近10倍。模型在传感器连接、路径规划等环节表现出色,但在精确移动沙滩球等闭环控制任务上仍存在困难。这些进展源于通用模型规模化,而非针对机器人…
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
论文研究精选
CyberGym-E2E:AI智能体端到端网络安全能力的大规模真实世界基准
CyberGym-E2E 是一个包含920个真实漏洞、覆盖139个开源项目的大规模端到端网络安全基准。任务要求AI智能体在真实代码库中自行定位漏洞、生成触发崩溃的概念验证并编写补丁。测试表明:若直接给出漏洞位置,最强配置可修复约80%漏洞;但若需自行发现,端到端成功率急剧下降--Claude Opus 4.5仅19.2%,最新模型在37%-66%之间。智能体可能发现替代漏洞,且存在部分浅层补丁。所有漏洞已事先公开披露并修复。
信息来源:Berkeley RDI:Blog(AI 安全与评测) · Claude
观点 / 方法精选
驾驭 Claude Code:CLAUDE.md、技能、钩子、规则、子智能体等
Claude Code 提供七种自定义指令方式:CLAUDE.md(根目录始终加载,子目录按需加载)、规则(无范围或路径范围)、技能(按需调用,共享 token 预算)、子智能体(隔离上下文运行并返回最终消息)、钩子(生命周期事件触发,绕过压缩)、输出样式(注入系统提示,永不压缩)和附加系统提示(CLI 标志,仅单次有效)。每种方式在加载时机、压缩行为、上下文成本和适用场景上各有不同,例如 CLAUDE.md 适合存放构建命令与编码规范,路径范围规则避免无关上下文消耗,子智…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Omnigent开源:AI智能体团队元框架
编程的未来不是单一智能体,而是一个完整的AI团队。 Omnigent让你在一个实时会话中运行一个智能体团队:Claude Code、Codex、Cursor、Pi,以及你自己的智能体。 它是一个面向AI智能体的元框架,基于我们内部的Databricks开发工具构建,现已开源给所有人。 由传奇人物@matei_zaharia和Databricks AI团队打造。没错,Matei仍然编写大量代码,包括Omnigent和我们产品的前端代码。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · Claude / Cursor
模型发布 / 更新精选
MolmoMotion:语言引导的3D运动预测模型
MolmoMotion基于Molmo 2骨干网络,输入视频帧、物体上的3D点标记及文字动作指令(如"移动并旋转桌上放水果的木碗"),预测未来数秒内这些点的3D轨迹。提供两个变体:自回归的MolmoMotion-AR逐步预测坐标,流匹配的MolmoMotion-FM通过连续空间变换处理多可能性运动。同时发布MolmoMotion-1M数据集(含116万视频的3D点轨迹及动作描述)和PointMotionBench基准测试(2700个人工验证视频片段)。模型权重、数据集和基准测…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究精选
Google 医学推理 AI 系统 AMIE 新研究:从诊断迈向长期疾病管理
今日发表在《自然》杂志上的研究展示了 Google 的医学推理 AI 系统 AMIE(Articulate Medical Intelligence Explorer)从单次诊断对话演进到长期疾病管理的能力。AMIE 利用 Gemini 模型的长上下文能力,整合共情对话智能体和深度思考管理推理智能体,可交叉引用数百页临床指南。在盲测中,AMIE 与 21 名初级保健医生相比,在整体管理推理上匹配临床医生,在计划精确性和指南一致性上得分显著更高。
信息来源:Google Blog:AI(RSS) · Gemini
教程 / 实战精选
如何在 OpenRouter 上使用 OpenAI Codex CLI
Codex CLI 支持自定义 OpenAI 兼容提供商,只需在 config.toml 中配置即可将请求路由到 OpenRouter。用户无需修改 Codex 本身,就能获得提供商故障转移、使用跟踪以及跨所有模型的统一密钥。
信息来源:OpenRouter:Announcements(RSS) · OpenAI
产品发布 / 更新精选
阿里云发布HappyOyster 1.0:一句话生成可实时交互的数字世界
6月17日,阿里云发布开放式世界模型HappyOyster 1.0(快乐生蚝)。该产品基于原生多模态架构,支持多模态输入与音视频联合生成,可在生成过程中持续接收用户指令并实时响应画面。它深度学习物理世界状态转移规律,保持人物和环境长程一致性。官网开放"实时导演"与"世界探索"两种玩法:前者可随时叫停改写故事、与虚拟男友实时互动等;后者支持自由漫游、滑板冲刺、翼装滑翔、骑马奔驰、攻击打怪等交互。该产品已于今年4月16日开放内测,即日起至7月17日官网不定期掉落体验积分。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Strands Robots SDK:用单一智能体打通 Hugging Face Hub 到物理机器人
AWS(Apache 2.0)开源的 Strands Robots SDK 将 LeRobot 栈封装为 AgentTools,构建统一智能体。默认用 MuJoCo 模拟(无需硬件),mode="real" 切换至真实机器人。可记录演示数据为 LeRobotDataset 并推送 Hugging Face Hub,运行 GR00T 或 LerobotLocal 策略推理,经 Zenoh mesh 广播命令到多台机器人。模拟与硬件代码完全一致,只需改一个关键字参数。示例可在笔…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Kickart 3.0发布,让广告视频创作更精准高效
火山引擎一站式营销创作平台Kickart 3.0(原"创作Agent")正式上线,升级为对话式视频生成模式,用户可通过多轮对话调整商品图、故事板等,用自然语言生成营销视频。新增"爆款裂变"能力,上传视频链接后自动拆解爆款逻辑并重构至新商品视频,支持抖音电商内容合规与质量预审核。平台开放SaaS、API及Skill等多种交付方式,并已接入Seedance 2.0 mini,助力降低广告营销成本。
信息来源:公众号:火山引擎
模型发布 / 更新精选
GLM-5.2:为长周期任务而生
GLM-5.2 发布,支持 1M token 上下文,采用 IndexShare 架构--每 4 个稀疏注意力层共用一个轻量索引器,将 1M 上下文下每 token FLOPs 降低 2.9 倍;MTP 层改进使推测解码接受长度提升 20%。长周期编码基准上,FrontierSWE 落后 Opus 4.8 仅 1%、领先 GPT-5.5 1%;PostTrainBench 仅次于 Opus 4.8;SWE-Marathon 落后 Opus 4.8 13% 但排名第二。标准编…
信息来源:Hugging Face:Blog(RSS) · GPT / GLM / Hugging Face
模型发布 / 更新精选
MiniMax 发布 MSA 稀疏注意力方法,开源推理内核并推出 MiniMax-M3 模型
MiniMax 发布 MSA(MiniMax Sparse Attention),一种构建在 Grouped Query Attention 上的稀疏注意力方法。它将注意力分解为索引分支与主分支:索引分支以块粒度(默认 128 token)为每个 GQA 组选择 16 个 token 块(固定预算 2048 个键值 token),主分支仅在这些块上执行精确 softmax 注意力。MSA 在 109B 参数 MoE 模型上训练,开源了面向 NVIDIA SM100 GPU …
信息来源:MarkTechPost(RSS) · NVIDIA