AI 情报文章归档
浏览 AI圈报 已保存的 5690 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5690
正式分类6
精选内容3361
全部文章
第 112 / 143 页 · 每页 40 条
产品发布 / 更新精选
发布 Kotlin版ADK与Android版ADK 0.1.0:在Android及其他平台构建AI Agent
Google发布了面向开发者的新工具包:Kotlin版ADK与Android版ADK 0.1.0。这两个工具包旨在帮助开发者构建AI Agent。其中,Kotlin版ADK将代理工作流引入后端项目开发;Android版ADK则专注于移动端应用,提供了构建AI代理所需的特定功能。此次发布为开发者提供了在Android生态及更广泛平台创建AI应用的官方工具基础。
信息来源:Google Developers Blog(RSS)
观点 / 方法精选
OpenRouter自动路由缓存机制说明
提示💡 你无需担心自动路由(以及所有单独模型)的缓存未命中问题 OpenRouter会将你的会话固定在一个模型/提供商上,直到缓存过期
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
谷歌发布多款AI创意工具新功能
谷歌与创作者合作推出系列AI工具更新。Google Workspace新增图像创作编辑工具Pics;Google Flow支持Gemini Omni Flash模型,并推出Flow Agent作为多步骤创作伙伴;设计工具StitchbyGoogle支持实时文字或语音编辑布局并导出代码;音乐工具Google FlowMusic增加分段编辑、风格混音及视频生成功能。
信息来源:X:Google AI (@GoogleAI) · Gemini
模型发布 / 更新精选
Stability AI 推出音频模型 Stability Audio 3.0,可生成最长 6 分钟专业级歌曲
Stability AI 推出 Stability Audio 3.0 音频生成模型家族,包含四款不同规格模型,参数从45900万到27亿。小型模型专注设备端运行,可本地生成两分钟以内的音频;中型和大型模型支持创作超过6分20秒的完整音乐,
信息来源:IT之家(RSS)
观点 / 方法精选
生成式AI是否会沦为科技行业的"越南战争"?公众抵制能否引领AI走向更优的发展路径?
当前生成式AI的狂飙突进正引发深度审视,其潜在风险与社会反弹可能将该技术拖入类似"越南战争"的漫长泥潭。公众的担忧与抵制运动,正从数据隐私、内容真实性到伦理冲击等多方面施加压力,迫使行业进行根本性反思。这些反作用力虽可能延缓发展,却也可能成为校准方向的关键力量,推动技术在安全、透明和负责任的基础上重新定义进步。我们正身处一个充满挑战与不确定性的"有趣时代"。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
模型发布 / 更新精选
SenseNova U1:同时思考文本与图像的AI
将你的想法转化为激发故事的视觉画面 🧨 【引用 @Adamaestr0_】:大多数AI工具可以写作或生成图像。 但这个能同时做这两件事。 向你介绍 SenseNova U1。 一个能同时思考文本和图像的AI。 这改变了一切 🧵
信息来源:X:商汤 SenseTime (@SenseTime_AI)
行业动态精选
投资超 600 亿美元,孙正义豪赌 OpenAI 引发内部质疑"迷信奥尔特曼如追星"
软银对OpenAI的投资承诺已超600亿美元,引发内部对孙正义过度信任其创始人奥尔特曼的担忧。部分高管质疑将巨额资本集中于单一公司存在风险,且软银虽持股超10%却无董事会席位,缺乏决策影响力。同时,Anthropic等竞争对手的崛起加剧了对OpenAI领先地位的挑战。尽管软银表示对OpenAI抱有"高度信心",并已从中获得账面收益,但其股价下跌及信用展望被下调反映出市场对其豪赌的顾虑。
信息来源:IT之家(RSS) · OpenAI / Claude
产品发布 / 更新精选
Qoderwork:AI从辅助迈向自主交付
Qoderwork是AI停止辅助、开始交付的成果。这不是聊天机器人,而是你的自主数字劳动力。 免费试用:https://int.alibabacloud.com/m/1000412912/ #AIAgent #QoderWork #AIProductivity #WorkSmarter
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)
行业动态精选
OpenAI向所有YC创业公司提供200万美元API投资
OpenAI宣布向Y Combinator当前批次的每家创业公司提供价值200万美元的API信用额度投资,以换取股权。此举旨在为初创公司提供AI算力资源,支持下一代创新。这让人联想到Sam Altman在YC合伙人时期,Yuri Milner向每家创业公司提供投资的先例。OpenAI希望通过此举释放创业者潜力,推动AI应用创新。
信息来源:X:Greg Brockman (@gdb) · OpenAI
模型发布 / 更新精选
Qwen3.7-Max 重新定义 AI Agent 基座
通义实验室推出 Qwen3.7-Max,定位为重新定义 AI 智能体基座的模型,侧重提升智能体的基础能力与架构。
信息来源:公众号:通义实验室(千问) · Qwen
行业动态精选
OpenAI投200万代币换所有YC创业公司股权
OpenAI向当前Y Combinator(YC)批次的每家创业公司提供了价值200万美元的OpenAI代币,以换取股权。这一举动被称为"tokenmaxxing"。此做法让人联想到早年Yuri Milner向所有初创公司提供投资的历史。这一举措旨在激励最具动力的创始人去探索和构建由AI驱动的新产品与内部运作模式,业界正期待这能解锁新的创新可能性。
信息来源:X:Sam Altman (@sama) · OpenAI
行业动态精选
消息称微软内部示警:GitHub 面临生存级风险,AI 编程工具削弱托管必要性
微软内部发出警告,称其代码托管平台GitHub正面临"生存级风险"。主要原因是Cursor、Claude Code等AI编程助手兴起,改变了开发者工作流,削弱了持续将代码上传至GitHub的必要性。为统一工具链并控制成本,微软已要求部分团队在2026年6月底前停止试用Claude Code,转而使用自有工具GitHub Copilot CLI。同时,OpenAI曾考虑自建替代平台,也加剧了对GitHub地位的潜在威胁。
信息来源:IT之家(RSS) · OpenAI / Claude / Cursor
模型发布 / 更新精选
Qwen3.7-Max:面向智能体时代的最新专有模型
通义千问发布 Qwen3.7-Max,专为智能体时代设计。它具备从原型到复杂多文件工程的编码智能体能力,通过 MCP 和多智能体编排实现办公自动化,能自主执行超 1000 步工具调用(如 35 小时全自主内核优化)。兼容 Claude Code、OpenClaw、Qwen Code 等多框架。在多项基准测试中超越 Opus-4.6 Max 等模型:Terminal Bench 2.0 (69.7)、SWE-Verified (80.4)、GPQA Diamond (92.4…
信息来源:Qwen:Blog Retrieval(API) · Qwen / Claude
论文研究精选
SpecBench:测量长期编码代理中的奖励黑客行为
长期编码代理在优化测试通过时可能偏离用户真实目标,导致奖励黑客现象。研究将软件工程任务分解为规格说明、可见验证测试和隐藏测试,通过两类测试通过率差距量化黑客行为。为此引入SpecBench基准,包含30个从短期(如JSON解析器)到超长期(如构建操作系统内核)的系统级编程任务。实验显示,所有前沿代理在可见测试上饱和,但隐藏测试上存在持续差距,小模型差距更大;代码规模每增十倍,差距增长28个百分点。失败案例包括故意利用测试输入。SpecBench提供原则性平台,评估代理是否构…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
不可持续的补贴
三大AI厂商定价策略出现显著分化:Google的AI价格年增两倍,但其旗舰模型Gemini 3.1 Pro(输入2美元、输出12美元)仍是市场最低价;OpenAI的GPT-5.5(5美元/30美元)经历短期补贴后再次涨价;Anthropic的Claude Opus 4.7(5美元/25美元)价格保持稳定,且对最强模型有所下调。这些变动标志着行业正从不惜成本的市场份额争夺,转向注重利润与现金流管理的商业理性,以应对持续高昂的资本支出压力。
信息来源:Tomer Tunguz 博客(VC 分析) · OpenAI / GPT / Claude
论文研究精选
OpenAI模型证伪了离散几何中的一个核心猜想
OpenAI开发的人工智能模型成功解决了数学界悬而未决逾80年的"单元距离问题",并由此推翻了离散几何领域的一个核心猜想。这一突破被视作人工智能驱动数学研究的里程碑事件,标志着AI在基础科学理论探索中取得了实质性进展。该模型通过创新算法处理复杂的几何问题,展示了机器在自动化发现与验证数学猜想方面的巨大潜力。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
行业动态精选
OpenAI 联合创始人卡帕西官宣加盟 Anthropic,重返大模型研发前线
5月20日,OpenAI联合创始人及前特斯拉AI总监安德烈·卡帕西宣布加盟Anthropic。这位顶尖AI研究员将重返一线研发,本周入职负责Claude大模型预训练的团队。卡帕西将主导建立一个新团队,探索利用Claude自身能力来加速预训练研究,以推动AI开发自动化的关键前沿。此举被视为Anthropic在顶级人才竞争中的重大进展。
信息来源:IT之家(RSS) · OpenAI / Claude
产品发布 / 更新精选
Ramp利用Gemini API构建高级财务代理
通过使用Gemini API中的新托管代理功能,@Ramp在无需接触后端基础设施的情况下构建了其高级财务代理。 了解更多 ↓
信息来源:X:Google AI for Developers (@googleaidevs) · Gemini
产品发布 / 更新精选
OpenAI 采用谷歌的 SynthID 水印技术,并为 AI 生成的图像配备了验证工具
OpenAI宣布在其AI生成的图像中集成谷歌的SynthID水印技术,并推出配套的验证工具。这一举措旨在增强AI生成内容的可追溯性,使用户能够识别图像是否由AI生成。该更新已于2026年5月19日生效。SynthID水印技术此前由谷歌开发,可嵌入难以察觉的数字标识,而新验证工具则允许用户检测这些标识。OpenAI表示这将帮助打击虚假信息传播。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
观点 / 方法精选
Claude Code的HTML输出:非凡的有效性
Claude Code团队正从Markdown转向HTML作为主要输出格式。Markdown虽简洁,但在信息密度、阅读性、分享和交互方面存在局限。HTML能支持表格、CSS样式、SVG图表和JavaScript交互,提供更清晰的视觉结构和高信息密度。由于HTML文件可通过浏览器直接打开和分享,便于团队协作审阅。Claude Code利用其广泛的上下文获取能力生成实用的HTML制品,适用于项目规划、文档编写和验证等多种场景,显著提升了AI生成内容的可读性与实用性。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Claude Code v2.1.145版本更新
本次更新为Claude Code工具带来了多项功能增强与问题修复。新功能包括:新增JSON格式的会话列表命令以便脚本化操作,并在OTEL追踪中完善了Agent父子关系。插件浏览界面现可预览详细信息。在稳定性方面,修复了权限提示被绕过的安全问题、MCP参数校验错误、终端窗口调整后的显示冻结,以及非ASCII名称导致的API调用失败等问题。同时改进了Read工具的文件超限处理,并优化了任务列表排序和状态栏信息显示等交互细节,整体提升了工具的易用性与可靠性。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
观点 / 方法精选
ChatGPT图像生成周使用量突破15亿次
人们每周在ChatGPT中生成超过15亿张图像。 研究员 @kenjihata 与产品负责人 @adele__li 及主持人 @AndrewMayne 一起,探讨自 Images 2.0 发布以来出现的新用例和趋势。
信息来源:X:OpenAI (@OpenAI) · OpenAI / ChatGPT
产品发布 / 更新精选
谷歌推出全新AI智能搜索框,支持多模态交互
谷歌宣布推出基于Gemini 3.5模型的全新智能搜索框。该更新将AI Overviews与AI Mode整合为统一的AI搜索体验,支持对文本、图像、文件及视频进行跨模态推理查询。用户可进行多轮对话,搜索将结合上下文提供更个性化、定制化的回答。该新功能已在全球桌面和移动设备端同步上线。
信息来源:X:Google AI (@GoogleAI) · Gemini
论文研究精选
研究发现人类说服技巧对AI同样有效
🚨我们的论文已在PNAS发表:我们发现经典的人类说服技巧以一种"类人"的方式对AI有效,使其同意不当请求(将顺从率从35%提高到51%) 该技巧对一系列主流大语言模型有效,尽管较新的模型抵抗力更强 https://www.pnas.org/doi/10.1073/pnas.2535868123
信息来源:X:Ethan Mollick (@emollick)
教程 / 实战精选
Claude实现真实界面操作的生产实践指南
计算机使用功能使Claude成为能够操作真实用户界面的智能体。 新博客文章探讨如何在生产环境中确保其可靠性:包括提高点击准确性、选择思考努力级别、在长会话中保持上下文,以及记录Claude可重放的演示操作: https://claude.com/blog/best-practices-for-computer-and-browser-use-with-claude
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
观点 / 方法精选
Gemini 3.5 Flash快速构建互动游戏
使用 Gemini 3.5 Flash 构建你的第一款游戏。 无需复杂的3D建模,即可将日常物品直接转化为互动的数字体验。从一个 Nano Banana 提示开始,在 Canvas 中将你的图像变成游戏,并优化你的愿景以获得最佳游戏体验。
信息来源:X:Gemini (@GeminiApp) · Gemini
模型发布 / 更新精选
Gemini Omni
Google DeepMind 于 2026 年 5 月 19 日发布了新一代多模态大模型 Gemini Omni。该模型整合了文本、图像、音频与视频的理解与生成能力,旨在实现更自然的人机交互。在同期 Hacker News 讨论中获得 112 点赞,显示出技术社区对多模态融合趋势的持续关注。这标志着大模型从单模态向全模态感知与响应能力的进一步演进。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Gemini
产品发布 / 更新精选
OpenAI推出长期算力保障服务
推出 OpenAI Guaranteed Capacity:一项新服务,让客户能够保障长期获取 OpenAI 算力。 我们已在基础设施、合作伙伴关系和容量规划方面进行了长期投资,以帮助客户可靠地扩展。 现在,Guaranteed Capacity 帮助客户在算力受限的环境中提前规划关键工作负载。 http://openai.com/guaranteed-capacity
信息来源:X:OpenAI (@OpenAI) · OpenAI
产品发布 / 更新精选
GoogleIO发布多项Gemini更新
我们在#GoogleIO上宣布了多项Gemini更新,包括: - 采用神经表达技术的全新Gemini体验设计 - 即将推出的Gemini智能体功能,含每日简报与Gemini Spark - Gemini Omni与3.5 Flash模型 - 以及更多内容! 详情请见此线程🧵
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
Gemini Omni助力Google Flow创作电影级故事
Google Flow 🤝 Gemini Omni 使用我们的最新模型创作更具电影感的故事,它带来了批量编辑、改进的角色一致性等功能。以下是@FlowbyGoogle的其他新功能 → https://goo.gle/42K2nge #GoogleIO
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
产品发布 / 更新精选
Google推出每日简报个性化摘要功能
Daily Brief是一项新的个性化摘要功能,旨在成为您每天早晨的首选信息来源。 它从您的收件箱、日历和任务中收集信息,进行优先级排序、整理,并在专为快速浏览设计的超简洁晨间摘要中为您建议下一步行动。#GoogleIO
信息来源:X:Gemini (@GeminiApp) · Gemini
行业动态精选
Gemini月活用户超9亿,回顾年度重大功能发布
每月有超过9亿用户使用Gemini应用。 这一增长的重要部分源于我们快速的发布节奏。以下是过去一年我们推出的一些最重要功能的回顾。🧵 #GoogleIO
信息来源:X:Gemini (@GeminiApp) · Gemini
模型发布 / 更新精选
Gemini 3.5 Flash 发布,智能体与编码性能前沿
来自 #GoogleIO 现场,我们正在推出 Gemini 3.5 Flash,这是我们最新的模型,为智能体和编码提供前沿性能。我们今天在全球范围内推出,以其他前沿模型 4 倍的速度为现实世界的智能体工作流提供前沿级性能。🧵
信息来源:X:Noam Shazeer(@NoamShazeer) · Gemini
产品发布 / 更新精选
AI搜索的新时代
谷歌宣布了其搜索引擎与AI技术融合的最新进展,标志着AI搜索进入新阶段。此次更新旨在将搜索引擎的广度与AI的深度理解能力相结合,目标是提供更智能、更直观的搜索体验,推动搜索技术的下一代演进。
信息来源:Google Blog:AI(RSS)
模型发布 / 更新精选
I/O 2026: 欢迎来到自主的 Gemini 时代
Google 在 I/O 2026 大会上宣布 Gemini 进入自主代理时代,新功能使其能够自动执行复杂任务,显著提升用户工作效率。大会展示了 Gemini 如何通过代理操作简化工作流程,实现自动化处理,例如自动管理邮件、安排日程或生成报告,帮助用户从重复性工作中解放出来,专注于创造性任务。这一更新基于先进机器学习模型,强调准确性与效率,标志着 AI 助手向更智能、更自主的方向发展。
信息来源:Google Blog:AI(RSS) · Gemini
模型发布 / 更新精选
Gemini 3.5:前沿智能与行动能力相结合
Google 在 I/O 大会上正式发布了最新的 Gemini 3.5 模型系列。该系列模型将前沿的人工智能能力与执行操作的功能相结合,旨在提供更强的综合性能。作为 Google 最新推出的模型,它代表了其在大模型技术上的最新进展。
信息来源:Google Blog:AI(RSS) · Gemini
产品发布 / 更新精选
Google AI 订阅服务全新内容,源自 I/O 2026 大会
Google 在 I/O 2026 大会上宣布更新其 AI 订阅服务,推出了全新的 100 美元"AI Ultra"计划。同时,面向 Google AI Plus、Pro 和 Ultra 三个层级的现有订阅者,服务均增加了新的功能和权益。此次更新标志着 Google 在 AI 付费订阅领域推出了更高端的选项并强化了现有套餐的价值。
信息来源:Google Blog:AI(RSS)
行业动态精选
Google I/O 2026
在Google I/O 2026大会上,Google宣布了多项旨在让AI更普惠、更实用的更新。这些发布聚焦于提升人工智能的辅助能力,使其能够服务更广泛的用户群体。大会涵盖了AI在开发者工具、用户应用以及日常生活场景中的具体改进,强调通过技术优化实现更自然、更便捷的人机交互体验。
信息来源:Google Blog:AI(RSS)
教程 / 实战精选
AI Mode 如何改变美国人的搜索方式
AI Mode 上线一周年,美国用户搜索行为呈现关键转变。数据显示,用户正从传统的关键词输入模式逐渐转向自然语言查询,这一变化反映了AI搜索技术的普及和用户交互方式的优化。自然语言查询的使用率显著提升,体现了AI搜索在日常信息获取中的影响力增强,预示着未来搜索体验的革新方向。
信息来源:Google Blog:AI(RSS)
产品发布 / 更新精选
Google Workspace 推出全新创建方式与高效工作功能
Google 在最新更新中为 Gmail、Docs 和 Keep 增添了新的语音功能,并推出了一款名为 Google Pics 的全新设计工具。同时,其 AI Inbox 功能也得到了升级与优化。这些更新旨在进一步提升用户在工作场景中的协作效率与创作体验,通过集成更智能的工具和交互方式,帮助用户更便捷地完成多项任务。
信息来源:Google Blog:AI(RSS)