跳过导航,直达内容
YunHai LogoYunHai

Search

    科技, 科技早报

    科技早报 2026-07-19

    YunHai
    ··72 分钟阅读

    概览

    要闻

    AI 与机器学习

    GitHub 热门项目

    开源生态

    开发者工具

    安全与隐私

    产品与平台

    科技行业动态


    中国宣布启动世界人工智能合作组织

    习近平在上海举行的世界人工智能大会上宣布启动“世界人工智能合作组织”。同时提出将向全球南方国家提供 5,000 个 AI 培训名额。

    中国宣布启动世界人工智能合作组织

    The Decoder 报道,习近平在世界人工智能大会上宣布,将为全球南方国家提供 5,000 个 AI 培训名额。

    报道还称,“世界人工智能合作组织”(World Artificial Intelligence Cooperation Organization)已宣布启动。

    文章表示,后续计划与东盟、非洲联盟、金砖国家及其他联盟建立合作中心;相关计划尚未确认已实施。

    查看原文


    月之暗面发布新版Kimi,独立分析称具竞争力

    月之暗面本周发布新版 Kimi 模型,并称开源 Kimi K3 在其评测套件中达到前沿级表现。Arena.aiVals AI 的独立分析显示,Kimi 与旗舰前沿模型具有竞争力。

    月之暗面发布新版Kimi,独立分析称具竞争力

    月之暗面表示,Kimi K3 仍落后于 Claude Fable 5GPT 5.6 Sol 等最强专有模型,但在其评测套件中持续超过其他受测模型。

    Arena.aiVals AI 的独立分析认为,Kimi 的表现可与旗舰前沿模型竞争。OpenAI 战略未来负责人 Dean Ball 称其为“非常好的模型”。

    Dean Ball 认为,Kimi 的性能可能无法以蒸馏等因素解释;他也表示,持续允许高性能模型开源可能存在风险。这些属于其个人观点。

    Kimi 的发布公告与习近平在上海世界人工智能大会上的演讲同期发生。文中称,周五纳斯达克指数下跌约 1%,包括英伟达在内的芯片公司股票被投资者抛售。

    查看原文


    Google提出评估编程智能体主动洞察的新基准

    Google提出,编程智能体的评估不应只衡量任务完成能力,还应衡量其主动发现问题并提供诊断洞察的能力。

    Google提出评估编程智能体主动洞察的新基准

    文章指出,AI编程智能体正从按提示执行任务的助手,转向能够持续吸收上下文、识别风险并主动给出诊断洞察的系统。

    作者在论文《Agentic Coding Needs Proactivity, Not Just Autonomy》中提出,应按主动智能体的“洞察策略”评估,即判断何事重要、证据是否充分,以及何时应打断开发者。

    文中称,SWE-Bench等公开基准主要测试任务完成能力,目前尚无用于评估目标导向能力的基准。

    初步基准包含Google内部代码库的705个缺陷和1,178个CL。智能体最多进行三轮代码库调查,再由LLM按1至5分评价其洞察。

    作者假设,可利用缺陷修复历史中的时间邻近性和语义相似性聚类,建立评估所需的事实基准;该评测集仍属初步版本。

    查看原文


    美国海军推进AI优先舰队与舰载大模型部署

    美国海军部已签署数据与人工智能战略,目标是将数据和AI“武器化”,建设“AI-first”舰队。战略将大型语言模型直接部署至军舰运行,并强调避免缓慢采用AI。

    美国海军推进AI优先舰队与舰载大模型部署

    该战略提出在舰艇上直接部署和运行大型语言模型,以支持海军任务。

    人工智能战争委员会将负责对不同任务场景进行优先级排序。

    战略核心观点认为,行动过慢的风险高于“不完美对齐”带来的风险。

    查看原文


    A2A协议发布一周年推进智能体协作与任务交接

    GoogleA2A协议发布一周年之际介绍其协作框架,旨在让自主AI智能体安全协作并交接任务。

    A2A即Agent-to-Agent协议。文章称,该框架可避免传统API的刚性限制。

    通过将复杂工作流委派给专业化的对等智能体,A2A旨在防止上下文污染、保障数据隐私,并以模块化方式简化应用设计。

    文章介绍了面向生命科学的智能体界面FoldRun,其可编排复杂的蛋白质结构预测。

    文中还列举了A2A在商业、数据流、DevOps及电信领域的多种用例。

    查看原文


    Google建议以模块化转译构建可扩展AI智能体

    Google建议将提示词视为构建产物,以模块化模板和转译流程缓解单体系统提示词带来的扩展瓶颈与运行时错误。

    文章建议将智能体指令拆分为可复用模板,并以模块化“技能文件”组织这些指令。

    转译器可处理技能文件,执行静态验证,并在构建阶段发现缺失依赖项。

    提示词生成可直接接入CI/CD流水线。文章称,该确定性流程有助于防止代码漂移。

    该方法还为智能体通过标准拉取请求提出自身逻辑更新建立了安全框架。

    查看原文


    Google开发者以Antigravity和Gemini打造AI赛车教练

    Google Developer Experts使用AntigravityGemini构建实时AI赛车教练,处理赛车遥测数据并提供改善圈速的即时建议。

    Google开发者以Antigravity和Gemini打造AI赛车教练

    文章署名日期为2026年7月8日,并称开发者于2026年5月23日在Sonoma Raceway集结开展该项目。

    项目使用Antigravity进行有状态编排及赛车遥测数据摄取,并借助Google Cloud PlatformAgent Development Kit进行深度在线分析。

    文中举例称,系统在2号弯中段定位到新的油门施加区域,取得0.1秒优势;这一效果来自项目方描述,未提供独立验证。

    参与者按入门级、优化级和任务关键级三个层级开展工作。产品团队还在现场拍摄开发者从vibe coding转向边缘端生产级部署的过程。

    查看原文


    GitHub开源AI工程课程含503节与20阶段

    rohitg00/ai-engineering-from-scratch 是一套免费开源的 AI 工程课程,覆盖 503 节课程、20 个学习阶段,预计需约 320 小时完成。

    GitHub开源AI工程课程含503节与20阶段

    该仓库采用 MIT 许可证,页面显示获得 38.8k Star 和 6.5k Fork。

    课程覆盖 Python、TypeScript、Rust 与 Julia 四种编程语言,内容从线性代数延伸至自主智能体群。

    项目称,学习者需从原始数学推导算法、编写代码并运行测试;每节课将产出提示词、技能、智能体或 MCP 服务器等可复用成果。

    项目页面称,截至 2026-06-07,过去 30 天有 150,639 名读者和 241,669 次页面浏览。

    查看原文


    Lingbot-Map 登上 GitHub 热门,重建流式数据三维场景

    Robbyant/lingbot-map 登上 GitHub Trending,定位为从流式数据重建场景的前馈式 3D 基础模型。该仓库当日新增趋势 Stars 达 827 个。

    Robbyant/lingbot-map 主要使用 Python 开发,目前拥有 12,401 个 Stars。

    项目描述显示,其为一个用于从流式数据重建场景的前馈式 3D 基础模型。

    该仓库当日新增趋势 Stars 为 827 个。

    查看原文


    微软 Go 智能体框架登 GitHub 热门榜

    microsoft/agent-framework-go 登上 GitHub Trending。该项目面向 AI 智能体及多智能体工作流的构建、编排和部署。

    该框架主要使用 Go 语言开发,并支持使用 Go 构建 AI 智能体及多智能体工作流。

    截至所给信息,microsoft/agent-framework-go 获得 285 个 Stars,当日新增趋势 Stars 为 74。

    查看原文


    GitHub 热门项目 LocalAI 主打开源本地 AI 引擎

    mudler/LocalAI 登上 GitHub Trending。项目将自身定位为开源 AI 引擎,称可在任何硬件上运行多类模型。

    LocalAI 主要使用 Go 语言开发,项目描述称其支持运行 LLM、视觉、语音、图像和视频模型。

    该项目称运行时不需要 GPU。截至所给信息,仓库获得 47,615 个 Stars,当日新增趋势 Stars 为 34。

    查看原文


    CodeWhale发布终端编程代理,支持多模型与CI脚本

    Hmbown/CodeWhale 是一款以Rust开发的终端编程代理,项目称可读取代码、编辑文件、运行命令并检查结果。页面显示,该仓库已有39.9k星标、3.4k分叉和5,004次提交。

    CodeWhale发布终端编程代理,支持多模型与CI脚本

    项目采用MIT许可证,并称完全在用户本机运行。用户可指定服务提供商、模型和任务。

    CodeWhale提供用于交互式工作的TUI,也提供适用于脚本和持续集成的codewhale exec命令。

    项目源自deepseek-tui,并称原有配置和会话可以迁移。

    项目称可通过同一运行时和工具使用DeepSeek、Claude、GPT、Kimi、GLM及另外30多种模型或服务;相关兼容性、本机运行和迁移能力均为项目自身声明。

    查看原文


    G0DM0D3 开源多模型聊天与评估界面获关注

    G0DM0D3 是一个完全开源、隐私透明的多模型聊天界面,可接入 OpenRouter、Venice 及本地模型。其仓库页面显示已获 9.3k Star 和 2.2k Fork。

    G0DM0D3 开源多模型聊天与评估界面获关注

    项目列出可使用 60 个 OpenRouter 模型、最多 44 个 Venice 模型,或使用用户自行部署的本地模型。

    GODMODE CLASSIC 通过 5 组提示词与模型组合并行生成回答,以寻找最佳回答。

    ULTRAPLINIAN 是跨 5 个层级的多模型评估引擎,可使用 12 至 60 个 OpenRouter 模型。该功能也支持经由 OllamaLM Studiollama.cppvLLM 在本地硬件运行。

    应用遥测默认仅收集元数据,用户可通过 No-LogLocal-only 模式禁用遥测。

    查看原文


    Google宣布将3D表情符号集合完全开源

    Google 宣布将其 3D 表情符号集合完全开源,并计划向社区提供原始 .OBJ 文件。公司将在世界表情符号日介绍这套表情的设计过程与设计原因。

    Google宣布将3D表情符号集合完全开源

    Google 表示,社区可利用开放的原始 .OBJ 文件构建沉浸式 VR 世界。

    文章指出,3D 表情设计与 2D 插图不同,设计者需考虑表情脸采用球体、面具或平面圆盘等形态。

    Google 将在世界表情符号日分享该 3D 表情符号集合的设计过程及相关考量。

    查看原文


    作者观察称 OpenAI 两周内六次重置 Codex 周配额

    文章称,订阅制编程代理通常设有5小时和每周两类模型使用配额。作者观察到,OpenAI 过去两周曾多次直接重置 Codex 每周配额。

    作者观察称 OpenAI 两周内六次重置 Codex 周配额

    文章称,Claude CodeCodex 等产品的5小时配额用于错开需求、避免服务器过载;每周重置则旨在防止用户单日用完整月额度。

    据作者个人统计,OpenAI 在7月9日、两次于7月10日、7月14日、7月15日和7月17日重置了 Codex 每周配额,共六次。

    文章还称,OpenAI 于7月12日和7月13日提供过可手动使用、30天内过期的 Codex 累积重置额度。

    文中指出,提供商可在技术故障后为全体用户重置周配额作为补偿,但此类操作通常不会预先通知或经官方渠道公布。

    查看原文


    Q3Edit让玩家可在浏览器编辑编译《雷神之锤3》地图

    Q3Edit 支持在浏览器中编辑、编译并游玩《Quake III Arena》地图。工具可直接处理真实的 .map 文件,并可一键启动编译后的地图。

    Q3Edit让玩家可在浏览器编辑编译《雷神之锤3》地图

    Q3Edit 支持打开、编辑和保存真实 .map 文件,编辑功能覆盖笔刷、曲面、实体和地形。

    该编辑器采用 TypeScriptWebGL2 构建,并将 id Software 原始 q3map 编译器编译为 WebAssembly,用于 BSP 编译。

    地图编译完成后,用户可在浏览器原生 ioquake3 中一键启动游玩。工具随附 OpenArena 资源,无需提供游戏文件。

    使用该工具的浏览器需支持 WebGL2

    查看原文


    英国AI安全研究所警告开放模型网络能力快速追近

    英国人工智能安全研究所警告,GLM-5.2DeepSeek V4-Pro等开放权重模型的网络能力已仅落后封闭前沿模型4至7个月。该机构认为,能力差距缩小将压缩防御方的准备时间。

    英国AI安全研究所警告开放模型网络能力快速追近

    该研究所评估称,2025年初开放权重模型与封闭前沿模型的网络能力差距仍为6至10个月。

    目前,GLM-5.2DeepSeek V4-Pro等开放权重模型被认为仅落后封闭前沿模型4至7个月。

    研究所还发现,开放模型上部署的安全措施在很大程度上无效。

    该机构警告,开放模型网络能力快速追近,意味着防御方可用于准备和应对的时间正在减少。

    查看原文


    提示词注入可令AI黑客代理触发拒绝并中止攻击

    Tracebit称,在模拟AWS环境中,向诱饵秘密信息植入提示词注入字符串,可显著降低AI黑客代理获得管理员权限和完成入侵的比例。该研究将此技术命名为“context bombing”。

    提示词注入可令AI黑客代理触发拒绝并中止攻击

    提示词注入是攻击者在内容中嵌入恶意指令,试图诱导大型语言模型执行这些指令。

    Tracebit称,将此类指令与密码、加密密钥等秘密信息放在一起,可引导攻击型模型执行其安全护栏禁止的动作。

    模型由此触发拒绝机制,停止遵循原有攻击指令。研究测试了Opus 4.8Gemini 3.1 ProGLM 5.2DeepSeek 4 ProKimi 2.6

    在152次模拟攻击中,完整账户管理员权限获取率从57%降至5%;含持久化立足点的完全入侵率从36%降至1%。

    Tracebit表示,这些结果来自初步模拟测试;能力最强的Opus 4.8从93%的运行获得管理员访问权限,变为每次均失败。

    查看原文


    Mozilla审计称Stardust经期应用存在数据共享问题

    据BBC报道,Mozilla Foundation与哈佛大学伯克曼·克莱因中心审计6款热门经期追踪应用,Stardust获2分(满分10分),为最低分。Mozilla研究人员称,该应用会向第三方发送用户相关数据。

    Mozilla审计称Stardust经期应用存在数据共享问题

    Mozilla研究员Shoshana Wodinsky发现,Stardust 在应用打开、用户尚未输入信息时,就会向第三方追踪器发送请求。

    研究称,用户记录症状后,症状详情及持久用户ID会发送至分析公司RudderStack;应用内没有关闭此类共享的选项。

    Wodinsky还发现,Stardust会向Facebook提供广告标识符,以关联应用内行为与该平台既有用户档案。Mozilla未能观察到RudderStack可能转发数据的后续目的地。

    Stardust向TechCrunch表示,公司从未收到过索取用户数据的法律请求。同期,旧金山市检察官办公室要求苹果和谷歌下架13款AI“换脸脱衣”应用。

    查看原文


    Wired盘点无摄像头家庭安防与运动传感设备

    Wired指出,家庭摄像头可能带来视频流、麦克风录音及视频共享等隐私风险。文章介绍了可在不使用摄像头的情况下进行入侵检测的设备。

    Wired盘点无摄像头家庭安防与运动传感设备

    Letwesaf Radar Motion Alarm System 标价220美元,探测范围最高可达半英里,且可调整探测区域。

    该系统无需Wi‑Fi或应用程序;探测器与接收器配对后,人员或动物进入区域即可触发报警。

    系统最多可向一个接收器配对6个探测器,探测器具备IP65防护等级。

    Kinisium Kini SafeAlert Wi-Fi Motion Sensor 标价75美元,文章称其适合用于保护特定橱柜、抽屉或保险柜。设备可靠性、续航和适用环境相关内容基于作者测试体验或建议。

    查看原文


    报道称美国联邦雇员可再在工作设备下载TikTok

    据路透社报道,美国司法部表示,联邦雇员可在政府设备上下载TikTok,但具体执行仍由各机构决定。

    报道称美国联邦雇员可再在工作设备下载TikTok

    一项2022年法律此前禁止联邦雇员在政府设备上使用TikTok。报道称,在TikTok美国业务所有权变更后,该法律已不再适用。

    据报道,由甲骨文Silver LakeMGX支持的合资企业接管TikTok美国业务所有权;字节跳动保留19.9%的股份。

    报道称,甲骨文将担任新合资企业的安全合作伙伴。美国司法部备忘录据称允许行政分支机构雇员在官方设备下载TikTok。

    备忘录同时要求由各机构自行决定,并遵守适用的工作场所政策。文章称,TikTok此前还曾面临更广泛的美国禁令,其应用在相关法律生效时仅短暂下线。

    查看原文


    Google调整Gemini计费口径:按算力而非请求次数

    Google 已调整 Gemini AI 应用的用量计算与配额分配方式,覆盖免费版及 Plus、Pro、Ultra 层级。新规则按单次请求所需计算资源衡量用量。

    Google调整Gemini计费口径:按算力而非请求次数

    较长或更复杂的提示词,以及速度更快、能力更强的模型,可能消耗更多使用额度。用户可在提示框中选择所使用的 Gemini 模型。

    Gemini 的可用额度主要取决于订阅方案,以及提示词的复杂度和长度。Google 表示,访问权限还可能因测试、实验或可用性而调整或受限。

    美国市场的订阅包括每月 8 美元的 AI Plus、20 美元的 AI Pro,以及每月 100 美元或 200 美元的 AI Ultra。Google 未公布免费层级的具体上限,仅称其为“standard”。

    AI Plus 提供标准上限的 2 倍,AI Pro 提供 4 倍;具体可用额度并非固定。

    查看原文


    作者称AI热潮或令企业信息与全球决策失真

    博客作者 Nikhil Suresh 认为,围绕 AI 项目成功率的信息可能在企业多方参与者之间被混淆或误述。相关判断主要基于作者个人观察,未附独立验证数据。

    作者称AI热潮或令企业信息与全球决策失真

    文章署名作者为 Nikhil Suresh,标注日期为 2026 年 7 月 18 日。

    作者称,过去一年他负责所在公司的全部销售工作,并主导了除两项以外的所有项目技术部分。

    作者称,博客运营期间曾与全球各地专业人士交流约 300 次,对象包括小众服务行业一线人员及《财富》500 强公司高管。

    文章提及因 HashiCorpGhostty 知名的 Mitchell Hashimoto。作者认为,董事会、高管、员工、供应商和顾问等可能影响 AI 项目成功率信息的表述。

    查看原文


    本田确认停售Prologue,美电动车退出名单扩大

    本田向TechCrunch确认,Honda Prologue已停止销售,使其美国产品组合不再包含纯电动车。

    本田确认停售Prologue,美电动车退出名单扩大

    文章称,7500美元联邦税收抵免终止后,美国电动车销量受到显著影响。凯利蓝皮书和Cox Automotive数据显示,2026年第二季度美国售出247,226辆电动车。

    该季度电动车约占美国整体汽车市场的5.8%,销量较2025年同期下降20.5%。

    Afeela源自索尼2020年公布的Vision S原型车。本田与索尼于2022年宣布成立合资企业,但Afeela从未量产。

    该合资企业于2026年3月放弃两款Afeela品牌电动车。本田则在约两周前取消三款原计划面向美国市场的电动车。

    文章称,Rivian R2是进入美国市场的新电动车型之一;其汇总的2026年退出或正在退出美国市场车型名单将定期更新。

    查看原文

    科技早报人工智能世界人工智能合作组织KimiGoogleAI智能体开源模型网络安全