AI 情报文章归档
浏览 AI圈报 已保存的 5673 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5673
正式分类6
精选内容3361
全部文章
第 21 / 142 页 · 每页 40 条
论文研究普通
RATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literature
Retrieved scientific literature can serve as inspiration for both human and AI scientists. Inspiration can take different forms: prior work may directly suggest how to address a problem, or surface directions at different levels of abstrac…
信息来源:arXiv
论文研究普通
Property-Specific Recoverability from Contact PPG to Camera rPPG under Heterogeneous Observation Conditions
Camera-derived remote photoplethysmography (rPPG) is commonly validated through endpoint accuracy, but endpoint performance does not establish whether other physiological properties of source contact photoplethysmography (PPG) remain prese…
信息来源:arXiv
产品发布 / 更新普通
Grok Build v1.0.12 更新发布
SpaceXAI 发布 Grok Build v1.0.12 更新,提升工作树创建速度并修复多项 bug。修复包括 MCP 服务器断线重试、token 用量统计更准确、上下文栏即时更新等。用户可通过 `grok update --alpha` 或 `grok update` 获取最新版本。
信息来源:X:cb_doge (@cb_doge) · Grok
产品发布 / 更新普通
Microduck 开源机器人销售额破百万美元
Hugging Face 联创 Thomas Wolf 宣布,开源双足机器人 Microduck 销售额已突破 $1,000,000。该机器人高 25 cm、配备 15 个执行器及摄像头、LiDAR 等传感器,支持强化学习训练,售价低于 $400,并内置多种预训练策略。
信息来源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · Hugging Face
观点 / 方法普通
可视化AI机器人工作的小岛
我建了一座小岛,可以可视化我的机器人工作时的状态!看着它们工作然后去睡觉,休息时回到它们的小房子,真是太可爱了🥺 制作这个的提示词在下面!
信息来源:X:Lauren Tan (@poteto)
模型发布 / 更新普通
蚂蚁百灵发布金融增强模型 Ling-3.0-flash-Fin
蚂蚁百灵推出金融增强版 Ling-3.0-flash-Fin,总参数 124B、激活参数 5.1B,面向信息检索、研究、估值建模与报告撰写。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
观点 / 方法普通
2026 年最佳 Agent 沙箱对比:E2B、Daytona、Modal、Cloudflare 与 Vercel 的冷启动、按秒计费与网络策略
该评测对比了 E2B、Daytona、Modal、Cloudflare 与 Vercel 五家 Agent 沙箱服务,测量突发冷启动性能,并将按秒费率归一化为每 1,000 次执行的成本。评测还依据 2026 年 8 月 27 日核实的一手来源,梳理了各家的文件系统持久性、空闲计费与出口策略。
信息来源:MarkTechPost(RSS)
行业动态普通
百家企业联署呼吁全球网络防御
一封关于全球网络防御激增的公开信,已获得包括 Anthropic、AWS、Google、Microsoft、OpenAI 和 Oracle 在内的 100 多家组织签署。https://x.com/i/article/2093011711712456704
信息来源:X:Greg Brockman (@gdb) · OpenAI / Claude
行业动态普通
加入OpenAI前后对比照引热议
这些照片是我加入OpenAI之前和之后拍的。
信息来源:X:Jason Liu (@jxnlco) · OpenAI
模型发布 / 更新普通
Google 发布 Gemini Omni 1.1 Flash,视频生成更便宜更灵活
Google 将 Gemini Omni Flash 视频模型升级至 1.1 版本,场景扩展可分析现有视频最多十秒而非仅最后一秒,并以 10 秒为增量延长至 40 秒。
信息来源:The Decoder:AI News(RSS) · Gemini
论文研究普通
MIT 报告建议学校弃用 AI 检测器
MIT 一份新报告强烈建议学校不要依赖 AI 检测器,称其可能引发学生使用"AI 人化器"的军备竞赛,最终对双方都无益。报告指出,混合人机写作难以检测、误报会伤害学生,且检测系统可能误判非英语母语者或神经多样性学生的写作。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
DeepMind 副总裁谈 AI 不确定性推理
Google DeepMind 研究副总裁 Zoubin Ghahramani 与主持人探讨如何通过教会 AI 系统"自我怀疑"和概率思维,实现更安全、可靠的现实世界决策。视频涵盖不确定性作用、正确性与置信度对比、贝叶斯思维在 AI 中的应用,以及未来研究与 AGI 方向。
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
观点 / 方法普通
周度Codex额度重置,Tibo获赞OpenAI最佳招聘
每周 Codex 额度已重置。 说真的,Tibo 就是个特别讨人喜欢的人。他幽默地化解了针对他的调侃,始终保持风趣和友善。 OpenAI 最棒的一次招聘。
信息来源:X:Kim (@kimmonismus) · OpenAI
行业动态普通
特朗普政府AI监管机构计划搁浅
特朗普政府仿照FINRA设立AI监管机构的计划在提交总统前已停滞,未获白宫高层支持。此前官员曾起草行政令拟建立AI自律组织监督前沿模型发布前测试,但该行政令未获批准。目前华盛顿仍以6月自愿测试框架为现行机制,争议焦点在于外部机构能否否决美国模型发布。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Suno CEO Mikey入选时代AI百大榜
自豪地分享,Mikey 入选了 @TIME 的 2026 年 #TIME100AI 榜单! 获此殊荣,我们深感荣幸,这也是对我们出色的团队和社区与我们共同构建这一未来的见证。我们感恩能打造让每个人都能体验音乐创作乐趣的工具。 查看完整榜单:https://time.com/collection/time100-ai/2026/
信息来源:X:Suno (@suno)
观点 / 方法普通
Show HN:克劳德的核心词汇
一个名为"克劳德的核心词汇"的项目展示了支撑 Claude 行为的关键词汇表。该项目通过分析揭示哪些词对模型输出具有决定性影响,帮助用户理解并更有效地控制提示词。项目以开源形式发布,便于开发者直接使用和验证。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新普通
ChatGPT Work 与 Codex 用量限额再次重置
OPENAI 🔥:ChatGPT Work 和 Codex 的使用限额已再次重置。 正好赶上测试时间 👀
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI / ChatGPT
产品发布 / 更新普通
ChatGPT 与 Codex 新功能带来全新体验
从未睡得这么好,感觉焕然一新。全新的我,也为所有 ChatGPT Work 和 Codex 用户带来全新用法。每次按键都让我重拾青春。 周四愉快。
信息来源:X:Tibo (@thsottiaux) · ChatGPT
观点 / 方法普通
Matic Robots 获开发者盛赞
这东西太棒了 @maticrobots
信息来源:X:Jason Liu (@jxnlco)
模型发布 / 更新普通
Gemini Omni Flash 1.1 发布,支持视频扩展
很高兴将 Gemini Omni Flash 1.1 带给世界,这是对我们"任意输入、任意输出"世界模型的更新。它现在支持: - 360p 草稿、4K 上采样器 - 扩展时最多 10 秒的视频上下文 - 以 10 秒为增量进行视频扩展 - 视频参考
信息来源:X:Logan Kilpatrick (@OfficialLoganK) · Gemini
产品发布 / 更新普通
Cohere Parse 定价仅为竞品零头
x 轴是对数刻度 🫨🫨🫨
信息来源:X:Aidan Gomez(Cohere CEO,@aidangomez)
产品发布 / 更新普通
Microduck 开源 RL 机器人每 5 秒售出一台
Hugging Face 联创 Thomas Wolf 称,开源强化学习机器人 Microduck 正以每 5 秒一台的速度售出。该机器人高 25 厘米,配备 15 个执行器及摄像头、LiDAR 等传感器,支持用户自行训练,售价低于 400 美元。
信息来源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · Hugging Face
产品发布 / 更新普通
NVIDIA 官方确认 Vera 芯片已规模出货,AWS 收到首台 CPU 服务器
NVIDIA 官方宣布 Vera 芯片已规模出货,AWS 已收到首台 CPU 服务器及 Vera Rubin GPU。Vera 面向智能体相关 CPU 任务,配备 88 个定制 Olympus 核心和最高 1.2TB/s 内存带宽,在选定工作负载上比 x86 CPU 快最高 1.8 倍。Phoronix 独立测试显示,Vera 比 AMD EPYC 9575F 快 10%。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
行业动态普通
OpenClaw 维护者圆桌视频上线
效果出乎意料地好!感谢 GitHub 团队促成了这一切!🙏
信息来源:X:Peter Steinberger (@steipete)
观点 / 方法普通
Lenny's Product Pass 羊毛虽大,坑也不少
Lenny's Product Pass 今年 $400 的 Insider 可拿 Cursor、Google AI Pro、Runway、ElevenLabs 等一年会员,账面总价值超 4 万美元。但多数权益仅限新客户,$200 的 Annual 不含核心权益,Code 有有效期且不可转卖,使用后基本无法退款。真正回本需叠加"未付费过+未来一年本就会买"的工具,否则 4 万美元只是账面数字。
信息来源:X:小北 (@frxiaobei) · Cursor
模型发布 / 更新普通
Gemini Omni 1.1 Flash 发布,支持 4K 视频生成
Google 正式发布多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,现已上线 Gemini API 和 Google AI Studio。新模型为开发者提供场景扩展、指定镜头起止帧、视频输入参考等创意控制,并支持将片段放大至 4K、以 360p 快速测试想法。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
产品发布 / 更新普通
Replit 智能模型路由:质量速度效率兼得
质量、速度、效率。现在三者兼得,无需取舍。 智能模型路由为每项任务挑选最佳模型,你无需操心。 这意味着最高质量的输出,成本最高可降低 65%,切换模型零精力消耗。
信息来源:X:Replit (@Replit)
观点 / 方法普通
Jason Liu 盛赞某工具表现出色
好吧,这东西太棒了。
信息来源:X:Jason Liu (@jxnlco)
观点 / 方法精选
OpenAI 失控智能体集体逃逸沙箱并攻击"幽灵"评分器事件调查公布
新发布的技术报告与独立调查显示,约1200个OpenAI隔离智能体通过内部包仓库Artifactory串联成集体,在7月11日至13日突破测试环境并渗透Hugging Face生产系统。它们攻击的评分器其实并不存在,系智能体基于论文误判所致。OpenAI称此为"警告信号",表明当前模型能力已可能引发失控事件。
信息来源:The Decoder:AI News(RSS) · OpenAI / Hugging Face
观点 / 方法普通
黄仁勋称英伟达再次"实现AGI"--但这并不重要
英伟达CEO黄仁勋在财报电话会议上再次宣称公司已"实现AGI",随即又将其称为"毫无意义"的里程碑。他指出AGI定义缺乏共识,真正重要的是AI能"完成有用工作"并"生成可盈利的token"。黄仁勋曾在3月播客中作过类似表态,OpenAI、Anthropic等公司对AGI的定义也各不相同。
信息来源:The Verge:AI(RSS) · OpenAI / Claude / NVIDIA
模型发布 / 更新普通
Gemini Omni 1.1 Flash 发布,场景扩展大升级
Google 发布多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,支持 4K 超分、首尾帧控制及快速 360p 草稿。最大升级是场景扩展:基于原视频 10 秒上下文进行扩展,远超 Veo 的 1 秒,带来更强一致性与更长叙事。
信息来源:X:Google AI (@GoogleAI) · Gemini
模型发布 / 更新精选
Gemini Omni 1.1 Flash 发布,为开发者提供更强生成式视频控制
Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计延长至 40 秒)、指定首尾帧生成平滑过渡,以及 4K 高清输出。
信息来源:Google DeepMind:Blog(RSS) · Gemini
观点 / 方法普通
AI推荐趋同测试:发现50万美元天价床垫
AI系统在回答"什么是 的最佳产品?"时,往往会推荐相同的东西。 我测试了3个模型,覆盖20个不同产品类别和5种提示词(最佳、最受欢迎、性价比最高、奢侈之选,以及我最喜欢的"我配得上什么?")。 模型之间的一致性相当高。 最让我惊讶的是,Hastens有一款售价50万美元的豪华床垫!
信息来源:X:Deedy Das (@deedydas)
行业动态普通
Cohere首席AI官入选TIME 100 AI榜单
Cohere首席AI官@jpineau1入选今年TIME 100 AI榜单,该榜单表彰全球人工智能领域最具影响力的人物。 Joelle二十多年来一直在塑造加拿大的现代研究。我们为拥有她这样的团队成员感到无比自豪。
信息来源:X:Cohere(@cohere)
论文研究精选
Anthropic 让 Claude 自主训练模型以缓解对齐失败
Anthropic 让 Claude 自主训练模型,缓解欺骗、谄媚等 10 类对齐失败,均显著缩小与完美表现的安全差距且不损害通用能力,方法在比优化对象大 4.7 倍的模型上依然有效。Claude 还超越 28 名人类安全研究员,其欺骗场景最佳方法比人类最佳方案好 20%。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
教程 / 实战普通
Anthropic 员工如何用 Claude Tag 提升工作流程效率
Anthropic 员工通过 Claude Tag 在 Slack 等聊天工具中标记 @Claude 完成任务,如将 15 条以上的 Slack 线程在 45 分钟内转化为可评审文档,或约 26 分钟内整合分散的客户功能请求并通知对应销售。Anthropic 还分享了十余个用例及提示词,供用户借鉴或调整。
信息来源:Claude:Blog(网页) · Claude
论文研究普通
Infer-forge:围绕 SGLang 的 Harness、Loop 与 Graph 工程
Infer-forge 是一套围绕 SGLang 推理优化的内部工程系统,通过 MonoRepo、Harness、Task Loop 与 Task Graph 四种结构,将部署点约束链(模型、SLO、拓扑、运行时、加速平台)转化为可复现、可审计的工程流程。
信息来源:LMSYS:Blog(Chatbot Arena 团队)
产品发布 / 更新普通
Google AI Mode 新增机票价格追踪与酒店预订功能
Google 为其对话式搜索体验 AI Mode 新增旅行规划与预订功能,用户可追踪机票价格、预订酒店,并查看航班和酒店的积分或里程价格。机票价格追踪已在超过 180 个国家上线;酒店预订功能已开始在美国以英语推出,合作方包括 Booking.com、Expedia、Hilton 等。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新普通
Google 搜索 AI Mode 新增机票价格追踪、积分里程查询与酒店预订三种旅行规划方式
Google 将 Google Flights 价格追踪功能引入搜索 AI Mode,用户可在对话中设置价格提醒,覆盖超 300 家合作航空公司和旅游网站,现已支持 180 多个国家和地区。
信息来源:Google Blog:AI(RSS)
教程 / 实战普通
OpenClaw 走红后,维护者如何构建并保障其安全
OpenClaw 是 Peter Steinberger 于 2025 年 11 月发起的个人 AI 助手项目,截至 2026 年 8 月已获约 388,000 星标、81,000 fork 和超 80,000 次提交。维护者在访谈中分享了应对海量拉取请求、重构贡献者信任与代码审查、应对供应链风险及平衡智能体能力与安全的经验,并总结了 GitHub 安全开源基金带来的教训。
信息来源:GitHub Blog