AI 情报文章归档
浏览 AI圈报 已保存的 5805 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5805
正式分类6
精选内容3375
全部文章
第 88 / 146 页 · 每页 40 条
产品发布 / 更新精选
JoyAI 上线「欢乐足球季」:上传一张照片即可生成赛场动态视频
JoyAI APP 上线「欢乐足球季」主题活动,用户上传一张人像照片即可生成沉浸式赛场动态视频,支持肢体动作拟合、环境动态渲染与专业运镜。活动提供近 20 款视频模板,覆盖看台抓拍、进球庆祝、足球手势舞等玩法,并同步上线近 50 款足球主题聊球智能体。上线首周互动量日均增长率超 158%。
信息来源:公众号:京东JoyAI
模型发布 / 更新精选
百度发布Unlimited OCR:3B参数MoE模型,KV缓存恒定实现长文档高效解析
百度推出Unlimited OCR,一个3B参数的MoE模型,推理时仅激活500M参数。其核心创新Reference Sliding Window Attention(R-SWA)将KV缓存大小固定为Lm + n(n默认128),内存和延迟不随输出长度增长。模型基于DeepSeek OCR继续训练4000步,支持32K最大长度,通过DeepEncoder实现16倍token压缩。在OmniDocBench v1.5上整体得分93.23,超出DeepSeek OCR基线6.2…
信息来源:MarkTechPost(RSS) · DeepSeek / Hugging Face
行业动态精选
Anthropic称阿里巴巴非法获取了Claude AI模型的功能
Anthropic指控阿里巴巴未经授权提取了其Claude AI模型的能力。该指控基于Anthropic的调查,认为阿里巴巴通过逆向工程或其他手段复制了Claude的核心技术。目前阿里巴巴尚未公开回应。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
论文研究精选
OpenAI内部报告:智能体Codex如何改变工作
OpenAI 在2025年8月至2026年6月间观察到,智能体产品 Codex 取代 ChatGPT 成为主要工作工具,各部门输出 token 中 Codex 占比从不足10%升至99.8%。80.6%个体用户曾发起预计等效人类工作时间超30分钟的请求,70.2%超1小时,25.6%超8小时;99百分位用户每日生成超60小时 agent turns。非开发者用户增长迅猛:个体用户增长137倍,组织用户增长189倍。Legal、Finance、Recruiting 部门在20…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
OpenRouter MCP 服务器发布
OpenRouter 推出 MCP 服务器,为编程智能体提供实时模型数据、基准排名、定价和文档查询。开发者通过一键安装(支持 Claude Code、Codex CLI、Cursor 等客户端),即可在编辑器内完成模型筛选、价格对比和测试推理,无需切换标签页。服务器整合 Artificial Analysis、Design Arena 及 OpenRouter 自身排名数据,例如推荐 GLM-5.2 作为性价比最佳的编码模型。工具集包括 models-list、model-…
信息来源:OpenRouter:Announcements(RSS) · GPT / DeepSeek / Claude
产品发布 / 更新精选
盈透证券(Interactive Brokers)与 Grok 集成:组合分析、情景建模与实时交易指令生成
盈透证券(Interactive Brokers)近日与 Grok 集成,用户可在几分钟内免费关联现有账户,无需注册新账户。通过自然语言与 Grok 对话,可完成组合收益分析(如股息与利息预测)、行业/地区/经济事件的风险敞口情景建模、市场趋势研究,并直接生成对冲订单等实时交易指令,实现从数据洞察到执行决策的一体化。
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
AI被认为会取代工程岗位,但新数据显示工程是2025年最具韧性的岗位
风投机构SignalFire追踪8000万家公司数百万员工数据发现,工程是2025年最具韧性的岗位。大型科技公司总招聘较2019年下降25%,工程岗仅降11%;工程岗占Alphabet、Meta等12家"Tech Majors"新招员工的55%(2019年为46%)。早期初创公司2025年工程师招聘比2019年增长7%。Anthropic CEO警告AI可能消灭一半入门级白领,但该公司经济主管称尚未看到显著影响。NVIDIA CEO黄仁勋表示AI让工程师更忙碌,是杰文斯悖论…
信息来源:TechCrunch:AI(RSS) · Claude / NVIDIA
产品发布 / 更新精选
Notion 使用 Cursor SDK 嵌入编码智能体
Notion 通过 Cursor SDK 在数周内将编码智能体嵌入产品。用户可在文档中@Cursor、在讨论串中提及或向数据库指派任务,Cursor 即可端到端完成规划、构建、测试、验证并自动创建 PR。集成基于一套 Provider 无关的智能体框架,Notion 的讨论串对应一个 Cursor 智能体,每条消息对应一次智能体运行;结果通过 SSE 流式传输,支持断连恢复。Cursor SDK 提供与生产环境相同的模型、运行时和远程 MCP 支持,让 Notion 无需自…
信息来源:Cursor Blog · Cursor
产品发布 / 更新精选
Perplexity推出Computer for Counsel
推出 Computer for Counsel。 Computer 现在连接了律师日常使用的研究数据库、文档工具和案件管理系统。可从中提取可引用来源:@midpageAI、@LegalZoom、@Docusign、@netdocuments 等。 所有 Pro 和 Max 订阅用户均可使用。
信息来源:X:Perplexity (@perplexity_ai)
行业动态精选
在与Anthropic的纠纷中,NSA失去了对Mythos的访问权限
美国国家安全局(NSA)因与人工智能公司Anthropic的纠纷,失去了对Mythos系统的访问权限。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
模型发布 / 更新精选
GPT-5.5 Instant重大升级:对话更智能有趣
OpenAI 推出 GPT-5.5 Instant 新版本,能更好理解问题意图、处理复杂约束,并改进购物与本地推荐。今日向付费用户推送,明日覆盖免费用户。
信息来源:X:Greg Brockman (@gdb) · OpenAI / GPT
模型发布 / 更新精选
GPT-5.5 Instant 新版本,对话更有趣
我们为你带来了新版 GPT-5.5 Instant,它现在聊起天来有趣多了。 我们最常用的模型现在能更好地理解问题背后的意图,并相应地调整回应。 它也能更可靠地处理复杂约束,让购物和本地推荐更加实用和连贯。 今天向付费用户推送,明天向免费用户推送。
信息来源:X:OpenAI (@OpenAI) · OpenAI / GPT
产品发布 / 更新精选
OpenAI 首款自研 AI 芯片 Jalapeño 发布
OpenAI 设计并制造了其首款 AI 芯片:Jalapeño。该芯片由 OpenAI 从零设计,与 Broadcom 合作量产,专为支撑 ChatGPT、Codex、API 及未来智能体产品的大语言模型工作负载而打造。芯片是 AI 经济的基础,自研芯片扩展了 OpenAI 从产品到模型再到基础设施的全栈平台,将助力扩展智能、服务更多人、并扩大 AI 的可及性。主推文:「劲爆。」
信息来源:X:Tibo (@thsottiaux) · OpenAI / ChatGPT
产品发布 / 更新精选
Figma在Config 2026押注人类判断,画布AI能力却来自第三方
Figma在Config 2026将设计画布扩展至代码、动画、3D深度和着色器效果,并集成去年收购的Weave工作流系统。新功能包括Code Layers(代码与设计并存)、Motion动画、深度层、Shader及Generative Plugins。协作方面,团队可搜索复用AI提示词、保存工作流为技能、共享插件。Figma的AI功能依赖Anthropic、OpenAI和Google等外部模型,推理成本挤压利润率。同时,Anthropic等公司的竞争产品可直接生成界面,构成…
信息来源:The Decoder:AI News(RSS) · OpenAI / Claude
产品发布 / 更新精选
Gemini 3.5 Flash 引入 computer use 功能
Google DeepMind 宣布,computer use 现作为内置工具集成于 Gemini 3.5 Flash,开发者可构建跨浏览器、移动端和桌面的智能体,实现视觉感知、推理与操作。此前该功能仅以独立模型形式存在于 Gemini 2.5。3.5 Flash 已支持函数调用及 Search、Maps 等内置工具,新增的 computer use 可提升持续软件测试和跨专业应用知识工作等长周期企业自动化任务的性能。安全方面采用针对性对抗训练,并可选配两项企业防护系统:要…
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法精选
LangChain 发布 AI 智能体记忆构建实用指南:短期记忆、长期记忆与 LangSmith 追踪分析
LangChain 发布了一份关于 AI 智能体记忆构建的实用指南,涵盖短期记忆、长期记忆与追踪分析。指南介绍了如何通过 LangSmith 帮助智能体在多次运行间持续改进,并重点讨论了短期记忆(如对话上下文)与长期记忆(如用户偏好存储)的实现方法。该指南为开发者提供了在 LangChain 框架中集成记忆模块的具体技术路径。
信息来源:LangChain:Blog(RSS)
观点 / 方法精选
NVIDIA NeMo AutoModel:一行代码加速Transformer MoE模型微调
NVIDIA NeMo AutoModel 是基于 Transformers v5 的开源库,添加 Expert Parallelism、DeepEP 融合 all-to-all 调度和 TransformerEngine 内核。在 MoE 模型微调中,相比原生 v5,训练吞吐量提升 3.4-3.7 倍,GPU 内存减少 29-32%,仅需改动一行 import。在 16 节点 128 张 H100 上全微调 Nemotron 3 Ultra 550B A55B 时,v5 …
信息来源:Hugging Face:Blog(RSS) · Qwen / NVIDIA / Hugging Face
产品发布 / 更新精选
Runway发布Agent 2.0
Runway发布Agent 2.0,帮助营销人员创建、测试和优化广告、视频及营销活动。品牌营销人员可在对话中开发活动概念、生成变体并自动本地化;绩效营销人员可上传创意并导入Meta、YouTube、TikTok或Google广告数据,由Agent分析后生成下一轮待测广告。社交媒体营销人员可一次性生成一周内容,自动裁切为9:16、16:9、1:1等格式;产品营销人员可借助Agent确定定位角度并构建活动资产。Agent 2.0面向所有用户开放。
信息来源:Runway:News(网页)
观点 / 方法精选
OpenRouter 零数据留存(ZDR)实践:97 款新模型,流量占比近半
OpenRouter 的零数据留存(ZDR)保证用户提示词和模型响应不被存储,元数据一般安全。自 1 月以来新增 97 款支持 ZDR 的模型,月度 token 量增长 4.3 倍,约占全部路由流量一半。ZDR 在三个层面执行:账户级(整个供应商开启)、护栏级(按 API Key 或组织成员限定)、单次请求级(传参数仅路由至 ZDR 端点)。企业用户可灵活选择控制粒度,避免锁定单一供应商。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
Mistral AI 为 Connectors 推出多项安全与可控新能力
2026年6月24日,Mistral AI 发布 Connectors 多项新能力:Enriched admin controls(GA)支持按工作空间设置连接器访问权限并单独开关工具;API keys with connector scopes(GA)防止自动化 AI 工作负载中身份冒充;Multi-account connectors(GA)允许单个连接器绑定多个账户;Connectors Debugger(公开预览)对 MCP 连接器进行端到端根因分析;Connect…
信息来源:Mistral AI:News(网页) · Mistral
观点 / 方法精选
里德·霍夫曼称SpaceX"不是一家人工智能公司",xAI则是"彻底的灾难"
LinkedIn联合创始人、Anthropic和OpenAI投资者Reid Hoffman在播客中公开批评SpaceX和xAI。他指出SpaceX"不是一家人工智能公司",6月12日上市后收购AI编程工具Cursor属于"花钱买相关性";xAI则是"彻底的灾难",所有11位联合创始人已离职,Grok模型在基准测试中落后于Anthropic和OpenAI。他还批评美国政府6月11日以出口管制为由强制Anthropic下架Fable和Mythos模型,理由仅为Amazon CE…
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / Claude / Grok
观点 / 方法精选
字节跳动技术副总裁洪定坤:AI Coding 的实践与探索
在火山引擎Force大会,字节跳动技术副总裁洪定坤分享AI Coding实践。过去一年,字节AI代码贡献率增长6倍,tokens消耗增长5倍,但过度关注单一指标可能失真--TRAE团队代码超90%由AI生成,人均需求吞吐率仅提升60%。900次实验显示,主流Coding模型组合代码正确率超80%,但可交付性仅40-60分;结合Harness基建后提升至80分。AI降低编程门槛但需优化指标、治理、协作。字节探索原型驱动开发,能力沉淀至TRAE(日均Token消耗5.6万亿,增…
信息来源:公众号:火山引擎
模型发布 / 更新精选
Hy3 preview:混元大模型重建的第一步
2026年4月23日,腾讯混元发布并开源 Hy3 preview 语言模型。该模型为快慢思考融合的混合专家模型,总参数295B,激活参数21B,支持256K上下文。在复杂推理、指令遵循、上下文学习、代码与智能体能力上大幅提升,在 SWE-Bench Verified、Terminal-Bench 2.0、BrowseComp 等基准中取得强竞争力结果。模型已在元宝、CodeBuddy 等产品上线,API 个人版 Token Plan 最低 28 元/月。权重和代码已在 Gi…
信息来源:腾讯混元:Research(API) · Hugging Face
产品发布 / 更新精选
火山引擎推出Agent Ready基础设施,AgentKit与ArkClaw企业版升级
火山引擎在FORCE大会推出面向企业智能应用的Agent Ready基础设施,构建AI云与Agent三层架构。AgentKit升级提供Identity、Runtime、Sandbox、Evaluation等模块,实现Agent可靠、可控、可衡量。Identity已接入数千家身份体系,Runtime支持长程任务和分钟级12万沙箱并发。ArkClaw企业版集成Agent广场、技能中心与企业知识库,支持IDP/SSO/OAuth及飞书、钉钉等IM入口统一管控。实践案例:海底捞门店…
信息来源:公众号:火山引擎
行业动态精选
Legion起诉特朗普政府:强迫Anthropic关闭Fable 5和Mythos 5缺乏法律依据
法律科技公司Legion起诉特朗普政府,指控其强迫Anthropic对外国公民关闭Fable 5和Mythos 5模型缺乏法律依据。核心论点是访问托管AI模型不等同于出口模型权重、源代码或技术数据,用户仅接收推理文本输出。政府声称Fable 5可审查代码漏洞,Legion反驳称这是几乎所有旗舰LLM的典型用途。诉讼还指出:出口管制法规不涵盖托管模型或其文本输出;若动用IEEPA紧急权力则违反法定限制,且未宣布国家紧急状态;指令任意、过度,可能与特朗普6月2日明确拒绝强制政府…
信息来源:X:Kim (@kimmonismus) · Claude
论文研究精选
DFlash:块扩散草稿模型实现最高15倍吞吐量提升
DFlash 由 UC San Diego 团队提出,是一种用于投机解码的轻量块扩散草稿模型。它一次前向推理生成整块 token,再由目标模型并行验证,保证输出无损。相比 EAGLE-3,DFlash 实现最高 2.5 倍加速,在 Qwen3-8B 等多种模型上平均无损加速超过 6 倍(MATH-500 达 6.08×)。在 NVIDIA Blackwell 上(TensorRT-LLM),gpt-oss-120b 模型吞吐量提升最高 15 倍,约为 EAGLE-3 的 1…
信息来源:MarkTechPost(RSS) · GPT / Qwen / NVIDIA
观点 / 方法精选
MiniCPM-V 4.6 在 Apple Core AI 上高速运行
🥳感谢分享,@MLBoy_DaisukeMajima 🚀 MiniCPM-V 4.6 在设备上以这样的速度运行,实在令人印象深刻--尤其是在 Apple Core AI 上以不到 2B 参数跑出。 干得漂亮,推动高效多模态 AI 向前发展。🫡
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
产品发布 / 更新精选
OpenAI 与 Broadcom 联合发布 LLM 推理芯片 Jalapeño
OpenAI 与 Broadcom 发布首款自研推理加速器 Jalapeño,专为当前及未来 LLM 从头设计。早期测试显示,其性能功耗比大幅优于现有 SOTA。工程样片已在实验室以目标频率和功耗运行 GPT-5.3-Codex-Spark 等负载。芯片从设计到流片仅用 9 个月,并利用 OpenAI 模型加速部分流程。OpenAI 计划从 2026 年起与 Microsoft 等合作伙伴部署千兆瓦级数据中心,推出多代计算平台。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
模型发布 / 更新精选
OpenAI ChatGPT 语音最大规模升级:双向AI语音模型 Bidi 1 已上线测试
6月23日,部分用户反馈 ChatGPT 网页版和 App 版上线了双向 AI 语音模型 Bidi 1,位于设置模型选择器中,与标准语音和高级语音并列。该模型支持边说话边监听,用户可在对话中途打断并发出新指令,例如要求从1数到10时中途喊停倒数,模型会立即切换执行。OpenAI 尚未官宣,预计本周启动更大范围测试。
信息来源:IT之家(RSS) · OpenAI / ChatGPT
模型发布 / 更新精选
Qwen-AgentWorld 开源:让 Agent 学会"先预测,再行动"
通义实验室开源首个原生语言世界模型 Qwen-AgentWorld,覆盖 MCP、Search、Terminal、SWE、Web、OS、Android 七大领域,基于超 1000 万条真实交互轨迹,经 CPT → SFT → RL 三阶段训练。
信息来源:公众号:通义实验室(千问) · Qwen
模型发布 / 更新精选
inclusionAI 发布 SingGuard 系列模型,首个版本为 SingGuard-0.8b
inclusionAI 在 HuggingFace 发布 SingGuard 系列模型,首个版本为 SingGuard-0.8b。该模型将安全策略作为运行时输入而非训练时固定分类,支持文本、图像、图文、多语言、查询侧和响应侧六类场景的安全评估。SingGuard 采用动态推理流程,支持快速首 token 路由输出即时安全信号,并在需要深度推理时继续生成更精确的判断。在涵盖多模态安全、图像安全、文本查询安全、文本响应安全、多语言查询安全和多语言响应安全的六类基准测试中,Sin…
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
产品发布 / 更新精选
今天,豆包正式推出专业版
豆包专业版基于豆包2.1系列大模型上线,面向复杂办公与生产力场景。办公任务模式接入可执行Agent任务的豆包2.1模型,支持操作本地电脑、浏览器、调用Skills技能、定时任务,内置Office办公套件,并可生成带后端数据库的在线应用。免费用户可体验豆包2.1 Turbo版办公任务模式,专业版接入豆包2.1 Pro模型。定价:标准套餐68元/月(连续包月),加强套餐200元/月,高级套餐500元/月。大学生认证后标准套餐38元/月,持续6个月。
信息来源:公众号:豆包(字节) · 豆包
产品发布 / 更新精选
豆包正式推出专业版:接入豆包 2.1 Pro,支持办公任务模式
豆包专业版正式上线,基于豆包 2.1 系列大模型,提供更高生产力额度,并接入豆包 2.1 Pro 模型。全新办公任务模式支持操作本地电脑、浏览器、调用 Skills 技能和定时任务,内置 Office 套件,可生成分享应用网站。专业版采用三级阶梯定价,标准套餐连续包月 68 元,加强套餐 200 元,高级套餐 500 元。
信息来源:公众号:豆包(字节) · 豆包
论文研究精选
Causal-rCM:自回归视频扩散蒸馏的统一教师强制与自强制开源方案
Causal-rCM将扩散蒸馏框架rCM扩展至自回归视频扩散,提出教师强制(TF)与自强制(SF)互补训练范式,并发布统一开源算法与基础设施。通过自定义掩码FlashAttention-2 JVP内核,首次实现基于教师强制的连续时间一致性模型(sCM/MeanFlow)用于自回归视频扩散,收敛速度比离散时间版本快10倍。蒸馏后的2步因果Wan2.1-1.3B模型在仅1或2步采样下取得VBench-T2V分数84.63,仅使用合成数据即达到帧级和块级流式视频生成SOTA。该方…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
FFASR 排行榜发布:真实远场条件下 ASR 评测
Treble Technologies 与 Hugging Face 联合推出 FFASR(Far-Field ASR)排行榜,这是首个开源社区驱动的真实远场声学条件 ASR 评测基准。传统近场评测无法反映混响、背景噪声和麦克风距离带来的性能下降。FFASR 使用混合波模拟引擎生成声学数据,涵盖 14 种房间(20-470 m3)和三个信噪比级别(远场高 SNR >14 dB、中 SNR 8-12 dB、低 SNR <6 dB),加上近场干燥条件,共四类条件决定主排名。另有…
信息来源:Hugging Face:Blog(RSS) · NVIDIA / Hugging Face
论文研究精选
AI招聘工具存在种族偏见和系统性排斥;黑人占比26%,亚裔占比15%
一项覆盖340万人、400万份申请、150家雇主和1700个职位的大规模实地研究发现,AI招聘筛选工具存在显著的种族歧视:26%的黑人申请者和15%的亚裔申请者遭遇算法对其族群的系统性排斥;若AI按推荐率最高群体(通常为白人)标准执行,将有4万份额外申请进入下一轮。多数雇主依赖同一第三方供应商算法,形成"算法单一文化",导致10%提交4份申请者被所有职位拒绝。对比同期未用AI的招聘数据(8.3万份申请、108家财富500强企业),未发现此类模式。研究呼吁对算法招聘进行独立监…
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Runway推出Seedance 4K等三款新模型
Seedance 4K。Seedance Mini。Kling 3.0 Turbo。现已推出。 全球最佳模型,汇聚一处。 使用优惠码 30RUNWAY,前三个月可享七折优惠。 通过下方链接开始使用。
信息来源:X:Runway (@runwayml)
行业动态精选
Oracle因AI应用裁员21000人,债务驱动云基础设施投资
Oracle在截至5月31日的财年裁员21000人,员工总数降至141,000人,降幅12.9%。公司称AI技术的采用导致劳动力缩减,同时重组成本达18亿美元,同比增长481%。Oracle计划2026年通过债务和股权筹集450至500亿美元,扩建Oracle Cloud Infrastructure,服务OpenAI、xAI、AMD、Nvidia、Meta等客户。公司债务超1200亿美元。分析人士指出裁员有助于改善现金流,但Oracle也承认大规模裁员可能带来生产力下降、…
信息来源:Ars Technica:AI(RSS) · OpenAI / Grok / NVIDIA
模型发布 / 更新精选
FastWan-QAD:单卡5090上1.8秒生成5秒视频
Sky Computing Lab 发布 FastWan-QAD 视频生成模型系列,基于 FastVideo 的量化感知蒸馏(QAD)方案训练。在单张 NVIDIA GeForce RTX 5090 上,端到端生成一段 5 秒 480P 视频仅需 1.8 秒。模型、代码及博客已开源。
信息来源:X:Sky Computing Lab (@haoailab) · NVIDIA
模型发布 / 更新精选
Krea 2 技术报告正式发布
我们的技术报告已发布。 深入解析创建 Krea 2 所用的数据、架构及训练技巧。 https://www.krea.ai/blog/krea-2-technical-report
信息来源:X:Krea AI (@krea_ai)