AI 情报文章归档
浏览 AI圈报 已保存的 5721 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5721
正式分类6
精选内容3361
全部文章
第 32 / 144 页 · 每页 40 条
观点 / 方法普通
Glean 分析 37 模型企业任务性价比
Glean 发布了一项帕累托前沿分析,涵盖 37 个模型及推理配置在 1,000 项企业任务中的表现。 分析发现,最便宜与最昂贵前沿模型之间的差距为 36 倍,而质量分数仅提升 22%。 完整分析 👀
信息来源:X:Testing Catalog (@testingcatalog)
论文研究普通
用 WikiBench 评估 OpenWiki:维基文档能否提升编码智能体表现
LangChain 自建 WikiBench 基准,测试生成式维基文档对编码智能体的辅助效果。将维基与源代码搭配使用,得分高于仅用源代码,且成本更低。
信息来源:LangChain:Blog(RSS)
模型发布 / 更新普通
Qwen3.8-Flash 75GB 内存本地运行
一款高性能 125B 模型现在仅需 75GB 内存即可本地运行!感谢 @UnslothAI 的 Day-0 支持。🥳
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
模型发布 / 更新普通
Anthropic 悄然向部分用户推送 Claude Fable 5.1
ANTHROPIC 🔥:看起来现在有更多用户在后台从 Claude Fable 5 被路由到 Claude Fable 5.1。 > 一些用户发现 Fable 5 模型的知识截止日期已更新,指向一次静默发布。 快了?👀
信息来源:X:Testing Catalog (@testingcatalog) · Claude
观点 / 方法普通
LiveKit 集成 Grok 语音模型构建智能体
在 LiveKit 中使用 Grok 语音模型构建实用的语音智能体,完整支持 ZDR。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
产品发布 / 更新普通
Replit 与 Slack 合作推出 Code 智能体
即将推出:Replit x @SlackHQ Code 我们将把全球最强大的智能体带到团队构建、协作和分享的地方。 因为每个人都应该能够快速创造--即使在你的工作区中也是如此。
信息来源:X:Replit (@Replit)
教程 / 实战普通
Our ChatGPT and OpenClaw Guides Just Got an Overhaul
信息来源:Every:最新文章(网页) · ChatGPT
论文研究精选
MiniMax-H3 在 8×H200 上基准测试:无损加速 1.95×,最高 6.24×(SSIM 0.76-0.91)
SGLang Diffusion 团队在 8×NVIDIA H200 上对 MiniMax-H3 视频生成进行基准测试,其密集无损路径较 Diffusers 快 1.85-1.95×,无近似损失。
信息来源:LMSYS:Blog(Chatbot Arena 团队) · NVIDIA
论文研究普通
Google Earth AI 推出行星预测引擎:自动化全球地理空间建模
Google Earth AI 发布实验性研究能力行星预测引擎(PPE),可自主执行从数据发现到模型训练的完整地理空间建模流程,将复杂预测模型的构建时间从数周缩短至数分钟。
信息来源:Google Research:Blog(网页)
产品发布 / 更新普通
Anthropic 扩大对科学家的支持:开放 1 万席位免费及优惠 Claude 订阅
Anthropic 宣布大幅扩展对科研社区的支持,通过新的 Claude 科学家团队计划,为全球科学家开放 1 万个免费或折扣订阅席位,有效期一年。标准席位免费,5 倍用量上限的高级席位每月 15 美元。同时,其 AI for Science 项目将资助范围从生物学扩展至其他领域,单个项目最高可获 5 万美元积分。
信息来源:Anthropic:Newsroom(网页) · Claude
模型发布 / 更新普通
智谱Ox Alpha开源,屠榜模型揭晓
彭博确认匿名屠榜的Ox Alpha是智谱GLM系列新迭代,今晚开源权重。该模型上线首日登顶OpenRouter调用量榜首,打破DeepSeek 56天霸榜纪录,前五大应用累计调用达4万亿Token;DeepSWE基准10任务过8个(80%),支持104.8万Token超长上下文和多模态。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · DeepSeek / GLM
观点 / 方法普通
OpenAI 预计今年底实现 AGI,Astra 已可自主科研
OpenAI CEO Sam Altman 表示,公司预计在 2026 年底前拥有一个可称为 AGI 的内部系统。OpenAI 已基于其基准内部构建了自主 AI 研究员 Astra,能实现实验想法、运行实验并返回结果,或完成原本需人类研究员一周的工作。Altman 预测 Astra 将带来最大影响,成为首个"以有意义方式发明新事物"的模型。
信息来源:X:Kim (@kimmonismus) · OpenAI
观点 / 方法普通
Grok Bot 凭据保险库:密钥不暴露给模型
Grok Bot 新增凭据保险库,可安全存储密钥,模型在调用时经特殊访问路径,全程不接触明文凭据。用户指令触发工具调用时,主机仅凭工具名查找对应 API key 并构造真实 HTTP 请求,凭据只在最终构造处出现。该方案简化了智能体密钥管理,被视为推动大规模采用的关键创新。
信息来源:X:Eric Zakariasson (@ericzakariasson) · Grok
行业动态普通
Waymo:无人驾驶出租车严重事故率仅为人驾的 1/16,下一站慕尼黑
Waymo 公布数据称,其完全自动驾驶车队累计超 3.5 亿公里,造成重伤事故数量仅为人类驾驶员的 1/16,导致行人受伤事故数量为 1/14。慕尼黑将成为其继英国和日本之后第三个海外市场,初期车辆由人工驾驶进行道路测绘,计划明年底前后正式启动商业网约车服务。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Particle 推出 Radar:让播客可搜索、可供 AI 智能体使用
Particle 推出播客搜索引擎 Radar,可转录并理解 13 万多个播客的音频内容,提取关键引述和高光片段,并支持按人物、公司、品牌等实体追踪提及与设置提醒。Radar 已吸引对冲基金等 API 客户,定价为每席位每月 29 美元,企业版每月 399 美元含 20 席位,API 用户另议。Radar 还提供播客广告搜索、政治倾向分析等工具,未来计划扩展至 YouTube 视频等音频形式。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新普通
阿里云发布 Qwen3.8-Flash 多模态 MoE 模型
阿里云发布 Qwen3.8-Flash,一款多模态 MoE 模型,为 Qwen4 架构的早期预览,现已开放权重。该模型拥有 125B 参数,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。其 API 定价为每百万输入 token 0.16 美元、输出 0.47 美元,原生支持 262K 上下文,可扩展至 1M。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
观点 / 方法普通
蚂蚁百灵Ling-3.0-tiny登移动端智能前沿
据Artificial Analysis,Ling-3.0-tiny位于移动端智能-速度帕累托前沿:在iPhone 17 Pro上16K上下文得分59,耗时5.7秒。同时以66分在64K智能评测中排名第一。将更强智能带入更小设备。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
观点 / 方法普通
OpenAI 推出 $visualize 可视化功能
$visualize 【引用 @kagigz】:如果你和我一样是视觉型学习者,这条就是为你准备的! 在 ChatGPT Work/Codex 中试试 `$visualize`,把任何信息变成漂亮的可视化图表 https://www.youtube.com/watch?v=jzmNh8lbSp8
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
论文研究普通
英特尔 18A-P 工艺详解:0.5V 低电压频率跃升 30%,Diamond Rapids 与 Nova Lake 率先搭载
英特尔在 Hot Chips 2026 上公布 18A-P 制程细节,基于量产芯片测试,该制程在 0.5V 工作电压下实现 30% 频率提升,相同功耗下性能提升超 9%,相同性能下功耗降低超 18%。18A-P 通过 RibbonFET 晶体管、背面供电及新增金属层等手段优化,将率先用于 Diamond Rapids 至强和 Nova Lake 酷睿处理器,计划于 2027 年推出。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Perplexity Computer 推出背景 Dream 智能体
Perplexity Computer 为 Max 用户推出后台 Dream 智能体,持续从文件和连接应用中摄取上下文,构建多跳上下文图谱。新评测显示正确性提升 9.3 点、时效性提升 8.0、召回率提升 8.9,同时 token 消耗减少 15%。其自改进记忆系统 Brain 可将会话、文件和来源编译为结构化知识库。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
模型发布 / 更新精选
Qwen3.8-Flash 开源,Qwen4 架构预览
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
模型发布 / 更新普通
Z.ai 揭晓 Ox Alpha 实为 GLM-5.3-Flash
Z.ai 证实此前神秘模型 Ox Alpha 实为 GLM-5.3-Flash,其每日 100 万亿 token 的流量由数万块国产 AI 芯片支撑,而非 NVIDIA GPU 集群。
信息来源:X:Rohan Paul (@rohanpaul_ai) · GLM / NVIDIA
模型发布 / 更新普通
微信开源多模态嵌入模型 WeMM-Embedding
微信开源其多模态嵌入模型 WeMM-Embedding,9B 版本在 MMEB-v2 和 MMEB-v3 双榜登顶。2B 小版本跑分超越上一代 8B 开源顶流,靠几亿级数据对齐与细粒度蒸馏实现。该模型已部署于视频号、公众号、朋友圈和电商搜索推荐,支持文字、多图、长视频混合输入,维度截断至 256 维仍保留近 99% 性能,可大幅降低向量数据库存储与检索成本。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
教程 / 实战普通
如何让 LLM 提速 3 倍:投机解码原理详解
投机解码通过让一个小模型预先草拟多个候选 token,再由大模型在单次前向传播中并行验证,可将生成速度提升 2-3 倍,且输出在统计上与单独运行大模型完全一致。70B 参数模型每生成一个 token 需从 GPU 内存读取约 140 GB 权重,而生成阶段计算利用率仅 20-40%,投机解码正是利用这部分闲置算力。文章还探讨了草稿来源的四种方式及投机解码失效的场景。
信息来源:ByteByteGo(RSS)
观点 / 方法普通
Viktor 如何从访谈中挖掘未发布观点
Kim 将一段 Google I/O 访谈交给 AI 员工 Viktor,后者对比其已发布内容,找出三个未用观点并定位到访谈具体时间点。Kim 采纳其中两个,并强调 Viktor 未编造观点,而是找到其原有想法并追溯来源。
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新普通
Qwen3.8-Flash-Next 与 GLM-5.3-Flash 发布,开源模型逼近前沿
Qwen3.8-Flash-Next(125B MoE,6B 激活)在 8/9 项基准上超越 Claude Opus 4.6 Max;GLM-5.3-Flash(320B 总参,18B 激活)在 Terminal-Bench 2.1 得 84.3 分,逼近 Opus 4.8 的 85.0。两者均为 MIT 许可、原生多模态、1M 上下文,但完整权重需专业工作站或本地服务器才能运行。
信息来源:X:Kim (@kimmonismus) · Qwen / Claude / GLM
产品发布 / 更新普通
Perplexity Brain 记忆系统评测提升显著
Brain 是 Perplexity Computer 的自我改进记忆系统。它将会话、文件和来源编译成结构化的知识维基。 新的评测基于我们最初的结果,正确性提升 9.3 分,时效性提升 8.0 分,召回率提升 8.9 分,同时 token 使用量减少 15%。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新普通
Google Cloud 在 Cloud TPU 上为长上下文多模态嵌入推理实现企业级精度
Google Cloud 将原生 TPU 支持集成进 vLLM,并针对 Qwen3 Embedding 模型系列优化,在 Cloud TPU 上实现长上下文(文本 4K+、多模态 15K+ tokens)多模态嵌入推理。
信息来源:Google Developers Blog(RSS) · Qwen
观点 / 方法普通
比尔·盖茨新文呼吁制定连贯AI计划,Gary Marcus称其呼应自身观点
Gary Marcus盛赞比尔·盖茨新文章,称其呼应了自己2024年著作《Taming Silicon Valley》的诸多主题。盖茨强调当前决策的持久重要性,指出AI在生物恐怖主义、深度伪造、虚假信息、网络攻击等方面的风险,并警告"AI可能阻碍孩子发展、取代人际关系"。盖茨呼吁建立国内外AI治理框架,并让公民社会而非仅政府和科技公司参与制定系统性计划。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法普通
ChatGPT Work 登录网站不泄露密码,权限如酒店门卡
ChatGPT Work 现可在网页和移动端登录网站办事,官方强调 ChatGPT 全程看不到用户名和密码。作者以酒店门卡类比:Agent 应只获限时、限范围的访问权限,而非长期凭证。当前不少 Agent 系统仍将 API Key、Cookie 直接塞进运行环境,相当于交出总钥匙,后续还需管清可进网站、权限时长、操作确认与收回机制。
信息来源:X:小北 (@frxiaobei) · ChatGPT
模型发布 / 更新普通
Qwen3.8-Flash:高效多模态MoE模型,Qwen4架构早期预览
阿里发布Qwen3.8-Flash,一款多模态MoE模型,也是Qwen4架构的早期预览,现已开源权重。该模型总参数量125B,每token仅激活6B,原生上下文262K,可扩展至1M。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Qwen
论文研究普通
AWS 新研究量化智能体切换成本
AWS AI Labs 新论文提出"交接税"(handoff tax)概念,量化智能体运行中在弱模型与强模型间切换的实际代价。在 Claude 和 GPT 模型配对测试中,全程轨迹升级仅能恢复弱强模型间不到一半的质量差距,却带来显著成本溢价;而降级切换则处于更优的成本-质量平衡点。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · GPT / Claude
行业动态普通
第二届世界人形机器人运动会闭幕:智元首次参赛登顶双榜第一,超 2500 小时真实数据免费开放
第二届世界人形机器人运动会8月26日晚在北京国家速滑馆闭幕,16国666支队伍、2056台机器人围绕51个赛项竞技。首次参赛的智元机器人凭借全量产机型斩获18金16银12铜,位列金牌榜和奖牌榜双第一。组委会发布全球首个世界级人形机器人运动会全量数据集,总时长超2500小时,涵盖12个应用场景,免费向社会开放。
信息来源:IT之家(RSS)
模型发布 / 更新普通
阿里 Qwen 团队发布 Qwen3.8-Flash-Next:125B 多模态 MoE 模型,仅 6B 参数激活,预览 Qwen4 架构
阿里 Qwen 团队发布开源权重多模态 MoE 模型 Qwen3.8-Flash-Next,125B 主干搭配 51B N-gram 嵌入表和 4B 多 token 预测模块,每个 token 仅激活 6B 参数,被视为 Qwen4 架构的早期预览。
信息来源:MarkTechPost(RSS) · Qwen
产品发布 / 更新普通
ChatGPT 上线赠送积分功能
ChatGPT 用户现在可以赠送积分 🔥 用户可选择购买积分数量。积分可通过链接或电子邮件赠送。 > "接收者的账户必须使用相同币种才能领取此礼物。" > "如果礼物在 30 天内未被领取,你将收到自动退款。积分在领取后 365 天过期。" 现在人人都可以当 @thsottiaux 了 👀
信息来源:X:Testing Catalog (@testingcatalog) · ChatGPT
观点 / 方法普通
教师需更新对AI能力与普及的认知
我知道这对那些从未要求AI改变现状的教师来说要求很多,但如果你在教书,且过去6个月里没有更新你对AI能做什么(多得多)、它的错误率(低得多)以及它在学生中的普及度(几乎全覆盖)的认知,你需要更新了。
信息来源:X:Ethan Mollick (@emollick)
行业动态普通
Krea AI 扩充创意团队招聘启事
我们正在扩充创意团队 寻找动态设计师、电影制作人和 AI 创作者。 点击下方申请 👇
信息来源:X:Krea AI (@krea_ai)
模型发布 / 更新普通
前 Meta 科学家创办的 Perceptron 推出工业视觉模型 Isaac 0.5
由两位前 Meta FAIR 研究员创立的 Perceptron 推出视觉模型 Isaac 0.5,帮助机器在仓库、工厂等工业环境中感知、推理并行动,支持视觉引导机器人导航及提取视频信息。该模型以开放权重发布,训练数据含百万小时通用视频与 ego video。公司近期完成 2100 万美元融资。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新普通
可灵AI带你进入前所未见的世界
欢迎来到一个你从未见过的世界 👀
信息来源:X:可灵 Kling AI (@Kling_ai)
行业动态普通
Cohere参与德国联邦内阁会议共商AI发展
加拿大和德国不仅仅是在讨论技术的未来。 我们正在建设它。
信息来源:X:Cohere(@cohere)