# https://www.mechlabs.cn llms-full.txt ## Engineering Intelligence # 星知 ![logo](https://www.mechlabs.cn/logo.png) ![home-bg](https://www.mechlabs.cn/_next/static/media/home.c0f13d96.jpg) # 开启工程智能新时代 ![home-btn](https://www.mechlabs.cn/_next/static/media/home-btn.8e8af661.png)[开始体验](https://www.mechlabs.cn/chat) #### 国内首个工程机械垂直行业大模型 星知大模型是国内首个专为工程机械行业定制的垂直大语言模型。涵盖主流品牌和型号的设备详细参数,聚焦行业施工方案,精准对接每一环节,助力项目管理、设备选型与施工决策。 01 #### 行业深度专业,数据驱动决策 星知大模型采用领先的增强检索生成技术,结合行业深度数据分析,为工程项目提供智能化解决方案。它不仅能够实时提取机械设备参数,还能根据需求生成精准的施工方案,让您轻松应对复杂项目需求。 02 #### 智能查询,实时响应 不论是设备选型、施工计划,还是行业技术标准,星知大模型通过强大的自然语言处理能力,快速响应用户需求,提供实时、精准的答案,提升工程效率与决策质量。 03 #### 持续更新,动态进化 星知大模型实时从行业数据源中提取最新的机械设备信息和施工技术规范,确保您的每一次查询都能获得最准确、最时效的内容,帮助企业在快速变化的市场中保持竞争力。 04 ### 核心优势 Core Advantages ![right](https://www.mechlabs.cn/_next/static/media/home-right.71713f04.png) ### 产品特点 Product Feature - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature0.132e090a.png) #### 精准查询与智能推荐 借助丰富的行业大数据积累,星知大模型能够从海量行业数据中快速提取并生成所需信息,为用户提供精准的设备参数、施工流程、技术规范等内容。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature1.690f1186.png) #### 定制化方案与设备选型 根据不同项目需求,自动生成定制化的施工方案和设备配置推荐,从项目初期到施工完成,全程助力提升施工质量与效率。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature2.df331d7c.png) #### 智能辅助,提升决策效率 提供全程智能决策支持,从方案设计到设备采购,每一项决策都得到模型的精准指导,显著减少人工干预,提高决策速度。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature3.533b8c69.png) #### 强大的技术支持与实时反馈 内建技术支持系统,随时根据用户反馈优化模型,确保持续的功能升级和行业前瞻性。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature0.132e090a.png) #### 精准查询与智能推荐 借助丰富的行业大数据积累,星知大模型能够从海量行业数据中快速提取并生成所需信息,为用户提供精准的设备参数、施工流程、技术规范等内容。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature1.690f1186.png) #### 定制化方案与设备选型 根据不同项目需求,自动生成定制化的施工方案和设备配置推荐,从项目初期到施工完成,全程助力提升施工质量与效率。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature2.df331d7c.png) #### 智能辅助,提升决策效率 提供全程智能决策支持,从方案设计到设备采购,每一项决策都得到模型的精准指导,显著减少人工干预,提高决策速度。 - ![characteristics](https://www.mechlabs.cn/_next/static/media/feature3.533b8c69.png) #### 强大的技术支持与实时反馈 内建技术支持系统,随时根据用户反馈优化模型,确保持续的功能升级和行业前瞻性。 ### 适用场景 Applicable Scene - ![scenes](https://www.mechlabs.cn/_next/static/media/scene0.c2bb126b.png) #### 工程公司 在项目管理、设备选型、施工方案设计等环节,星知大模型为工程公司提供全方位智能支持,大幅提升工作效率与项目精度。 - ![scenes](https://www.mechlabs.cn/_next/static/media/scene1-dark.cb5930d2.png) #### 设备采购商 通过星知大模型精准查询各大品牌设备的详细参数与性能,帮助采购商做出最佳选型决策,降低采购风险。 - ![scenes](https://www.mechlabs.cn/_next/static/media/scene2-dark.e5e70371.png) #### 施工现场 在施工现场,星知大模型作为智能助手,实时提供设备参数、施工方案与技术支持,确保项目进度和质量的可控性。 - ![scenes](https://www.mechlabs.cn/_next/static/media/scene3-dark.ad6309b5.png) #### 建筑与工程师团队 在建筑与工程设计过程中,星知大模型帮助工程师快速获取行业知识,提供智能化的施工方案建议,从而提升施工设计的精准度与可靠性。 ![home-global-small](https://www.mechlabs.cn/_next/static/media/home-global-small.f1da7d90.png)![home-global](https://www.mechlabs.cn/_next/static/media/home-global.d94e85d6.png) ### 为什么选择星知大模型? Why choose us? ![model-bg](https://www.mechlabs.cn/_next/static/media/model-bg.5e13ea9e.png) ![scenes](https://www.mechlabs.cn/_next/static/media/model0.5c23713d.png) #### 创新的行业引领者 星知大模型是国内首个专为工程机械行业定制的垂直大语言模型,为行业内的设备采购、施工设计、项目管理提供全方位智能支持。 ![model-bg](https://www.mechlabs.cn/_next/static/media/model-bg.5e13ea9e.png) ![scenes](https://www.mechlabs.cn/_next/static/media/model1.340ca0ff.png) #### 精准、高效、智能 高效的查询与推荐系统,支持用户快速获取最准确的设备与施工方案信息,提升整体工作效率,减少资源浪费。 ![model-bg](https://www.mechlabs.cn/_next/static/media/model-bg.5e13ea9e.png) ![scenes](https://www.mechlabs.cn/_next/static/media/model2.b2c4721d.png) #### 全面的数据整合 集成了海量机械行业数据,包括设备参数、施工方案、技术标准等,确保您的每一个决策都建立在最全面的数据基础上。 ![model-bg](https://www.mechlabs.cn/_next/static/media/model-bg.5e13ea9e.png) ![scenes](https://www.mechlabs.cn/_next/static/media/model3.18227054.png) #### 无缝对接,智能提升 星知大模型能够与现有的企业管理系统无缝对接,为您提供智能化的设备与施工方案推荐,优化企业的工作流与运营效率。 ## User Login # 星知 ![logo](https://www.mechlabs.cn/logo.png) [![logo-dark](https://www.mechlabs.cn/_next/static/media/logo-dark.88d61b58.png)](https://www.mechlabs.cn/) ![ball-1](https://www.mechlabs.cn/_next/static/media/login-ball1.bef5a475.png)![ball-2](https://www.mechlabs.cn/_next/static/media/login-ball2.9490f295.png)![ball-3](https://www.mechlabs.cn/_next/static/media/login-ball3.d554530a.png)![ball-4](https://www.mechlabs.cn/_next/static/media/login-ball4.cc7005bc.png) # 用户登录 ![login-smile](https://www.mechlabs.cn/_next/static/media/login-smile.c23b2ec0.png) 手机号 短信验证码 获取验证码 登录 ## AI Conversation Solutions # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 人工智能 ## 改变对话方式 体验下一代AI对话,让沟通更智能、更高效 ![scan](https://www.mechlabs.cn/_next/static/media/home-scan.6e3943d4.webp) ![scan](https://www.mechlabs.cn/_next/static/media/home-particle.535cd93c.webp) [立即开始](https://www.mechlabs.cn/agent/dashboard/agent) ## 智能对话 ### 革命性的AI对话体验 我们的智能对话系统采用最先进的自然语言处理技术,能够理解上下文、捕捉细微语义,并提供精准、有见地的回应。 无论是日常交谈、专业咨询还是创意激发,它都能成为您的得力助手。 - •上下文理解,自然对话 - •多场景应用,跨学科交流 - •个性化回答,贴近用户需求 - •持续学习,不断进化 ## 实时语音 ### 自然流畅的语音交互 我们的实时语音系统打破了人机交互的界限,为您带来前所未有的自然对话体验。 先进的语音识别和合成技术让您可以像与真人交谈一样与AI助手进行交流。 - •高精度语音识别,准确捕捉每一个字词 - •自然语音合成,流畅清晰的发音 - •实时响应,零延迟交互 - •情感识别,理解语气和语境 ## AI Innovations News # 星知 ![logo](https://www.mechlabs.cn/logo.png) [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ \\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 据智能涌现消息,美团正在加速其AI战略布局,即将推出一款名为"NoCode"的AI编程工具,并已悄然注册了"nocode.cn"域名,目前该网站正处于灰度测试阶段,预示这款面向非技术用户的全新产品即将正式面世。该工具由美团研发质量与效率团队打造,定位于新兴的"Vibe Coding(氛围编程)"赛道,通过对话式交互实现应用构建,主打"人人可用"的AI编程体验。不同于Cursor这类以开发者为中心的辅助编程工具,也区别于Devin所代表的AI自主编程路径,美团的"NoCode"更接近于近期在行业内受到关注的Lovable产品,面向非程序员用户,强调通过自然语言多轮对话完成代码生成、部署和修改。据接近项目的人士透露,美团推出这款产品的核心动因,是希望将AI编程的能力普及至更广泛的用户群体,尤其是其平台上大量的中小商家和运营人员,让他们像点外卖一样简单地开发和使用自定义工具。\\ \\ — 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ \\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 在最近的一次公开讲话中,谷歌的CEO桑达尔・皮查伊透露,公司的Gemini AI应用程序的月活跃用户数量已经超过4亿。这一数据的公布无疑为Gemini AI的成功增添了光彩,并显示出消费者对这一人工智能技术的强烈兴趣。Gemini AI不仅在用户量上取得了显著的成绩,还在全球范围内实现了广泛的覆盖。根据皮查伊的介绍,该AI应用已经在200多个国家和地区正式推出,服务范围涵盖了超过15亿的用户。值得一提的是,Gemini AI的语言支持已经扩展到超过40种语言,最近新增了阿拉伯语、中文、马来语和乌尔都语等多种语言的支持。这一举措不仅提升了用户的使用体验,还让更多用户能够轻松获取信息和服务,展示了谷歌在推动人工智能技术普及方面的决心。\\ \\ — 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ \\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ Shopify在最近的一次发布会上宣布推出一项创新的生成式人工智能功能,名为"AI商店构建器"。这一新工具旨在帮助商家通过输入描述性的关键词,快速搭建自己的在线商店,极大简化了电子商务的建设过程。这一AI商店构建器的最大亮点是,它能够根据用户输入的关键词,自动生成三种不同的商店布局。每个布局都包含了相应的图片和文本内容,这样商家就可以在短时间内完成店铺的设计,减少了大量的时间和资源投入。Shopify的产品副总裁Vanessa Lee表示,这种基于AI的商店构建工具是针对商家在建站过程中常遇到的困难而设计的。此外,Shopify在人工智能领域的投资并不仅限于此次发布的工具,公司已经推出了多种基于AI的解决方案,覆盖从图像生成到库存管理等多个方面。\\ \\ — 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ \\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 近日,Meta 公司发布了其全新 J1系列模型,这是一项旨在提升 AI 判断能力的创新技术。通过结合强化学习和合成数据的训练方法,J1模型不仅在判断的准确性上取得显著进步,还在公平性方面表现出色。随着大型语言模型技术的不断发展,"LLM-as-a-Judge" 的新模式,使 AI 模型能够对其他语言模型的输出进行审查,成为强化学习、基准测试和系统对齐的重要工具。Meta 的 J1团队开发了一个包含22000个合成偏好对的数据集,并引入了 Group Relative Policy Optimization(GRPO)算法,简化了训练流程。测试结果显示,J1的表现远超同行,在 PPE 基准测试中,J1-Llama-70B 的准确率达到了69.6%,不仅超过了 DeepSeek-GRM-27B 和 EvalPlanner-Llama-70B,还显示了即使是较小的 J1-Llama-8B 也有62.2% 的成绩。\\ \\ — 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) [![Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理](https://static.jxxqtech.com/static/h-aether/news/27-1.png)\\ \\ Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理\\ \\ 作为人工智能领域的先锋,Anthropic于2025年5月22日正式发布了Claude4系列模型,包括Claude Opus4和Claude Sonnet4,开启了编码、复杂推理和 AI 代理的新篇章。Claude Opus4被誉为全球最佳编码模型,能够持续高效地处理复杂的长时间任务和代理工作流。而 Claude Sonnet4则是对 Sonnet3.7的重大升级,能够更精准地响应用户指令,展现出卓越的编码和推理能力。据官方介绍,Claude4系列已于发布当日对所有付费计划用户开放,而Claude Sonnet4还向免费计划用户提供,极大地降低了体验门槛。在SWE-bench Verified测试中,Claude4系列表现出色,达到了行业领先水平,特别是在处理复杂软件问题时展现了无与伦比的稳定性与精准性。\\ \\ — 2025/05/23](https://www.mechlabs.cn/news-article/anthropic-launches-claude4-series-featuring-opus4-and-sonnet4-leading-in-coding-complex-reasoning-27) [![仅20B参数!字节推出Seed1.5-VL多模态模型,实现38项SOTA](https://static.jxxqtech.com/static/h-aether/news/26-1.png)\\ \\ 仅20B参数!字节推出Seed1.5-VL多模态模型,实现38项SOTA\\ \\ 在上海举办的火山引擎 FORCE LINK AI 创新巡展上,字节跳动正式发布了最新的视觉-语言多模态模型——Seed1.5-VL。该模型凭借其出色的通用多模态理解和推理能力,成为此次活动的焦点。Seed1.5-VL 的显著特点是其增强的多模态理解与推理能力,在视觉定位和推理的速度与准确性上有了显著提升。此外,新增的视频理解和多模态智能体功能,使其在处理复杂任务时表现更加出色。尽管 Seed1.5-VL 的激活参数仅为20B,但其性能已经达到了与 Gemini2.5Pro 相当的水平。在60个公开评测基准中,Seed1.5-VL 在38个任务上取得了 SOTA 表现,尤其是在视频理解、视觉推理和多模态智能体能力方面,均处于行业领先地位。在推理成本方面,其推理输入价格为每千 tokens 仅0.003元,输出价格为每千 tokens 仅0.009元,极具性价比。目前,Seed1.5-VL 已在火山引擎全面开放 API,开发者只需登录后选择 Doubao-1.5-thinking-vision-pro,即可快速调用其能力,构建自己的 AI 视觉助手、巡检系统、交互 Agent 或下一代智能摄像头。\\ \\ — 2025/05/16](https://www.mechlabs.cn/news-article/only-20b-parameters-bytedance-releases-seed1-5-vl-multimodal-model-achieving-38-sota-results-26) [![腾讯混元携手科研机构推出首个多模态统一CoT奖励模型并开源](https://static.jxxqtech.com/static/h-aether/news/25-1.jpg)\\ \\ 腾讯混元携手科研机构推出首个多模态统一CoT奖励模型并开源\\ \\ 近日,腾讯混元在与上海 AI Lab、复旦大学及上海创智学院的合作下,正式推出了全新研究成果 —— 统一多模态奖励模型(Unified Reward-Think),并宣布全面开源。这一创新模型不仅具备了强大的长链推理能力,还首次实现了在视觉任务中 "思考" 的能力,使得奖励模型能够更准确地评估复杂的视觉生成与理解任务。统一多模态奖励模型的推出,标志着奖励模型在各类视觉任务中的应用达到了新的高度。过去,许多视觉任务往往面临评估不准确和推理能力不足的问题。而这一新模型的研发,正是为了克服这些局限性。通过深度学习和多模态融合技术,模型能够在多种视觉任务中进行跨任务的泛化与推理,提高了可解释性。该项目的开源内容包括模型、数据集、训练脚本和评测工具,这将有助于推动相关领域的进步与创新。科研人员和开发者可以基于此模型进行深入研究,探索更多应用场景。腾讯混元的这一举动,也体现了其在人工智能领域持续的创新和开放态度,随着这一模型的发布与开源,未来在多模态 AI 研究、视觉任务评估等方面,将会看到更多的可能性和应用前景。\\ \\ — 2025/05/16](https://www.mechlabs.cn/news-article/tencent-hunyuan-partners-with-research-institutions-to-launch-first-multimodal-unified-cot-reward-model-and-open-source-25) [![Google 将 Gemini AI 助手扩展至Wear OS和Google TV,开启全新智能体验](https://static.jxxqtech.com/static/h-aether/news/24-1.png)\\ \\ Google 将 Gemini AI 助手扩展至Wear OS和Google TV,开启全新智能体验\\ \\ 在刚刚结束的 Android Show 上,恰逢 Google I/O 开发者大会前夕,Google 宣布了一个备受期待的消息:其最新的人工智能助手 Gemini 即将登陆 Wear OS 智能手表和 Google TV。这一举措是 Google 计划在所有设备和平台上逐步取代 Google Assistant 的重大步骤。用户们早已期待这一时刻,现在终于可以在多种设备上与 Gemini 进行互动。在 Wear OS 智能手表上,Gemini 让用户在无法使用手机的情况下也能方便地使用智能助手,只需简单地与手表对话,无需严格按照特定的指令。而在 Google TV 上,Gemini 将带来个性化的内容推荐,让家庭观影体验更加愉悦。用户可以询问适合儿童观看的动作片,或让孩子提问太阳系的问题,Gemini 则会自动播放相关的教育视频。此外,Google 还将 Gemini 集成到 Android XR 平台,未来用户在使用头戴式设备时也能享受到这一智能助手的服务。Android 团队的高管 Guemmy Kim 表示,当第一款搭载 Android XR 的头显在年底上市时,用户将能够在几分钟内创建出丰富多彩的假期计划。\\ \\ — 2025/05/16](https://www.mechlabs.cn/news-article/google-extends-gemini-ai-assistant-to-wear-os-and-google-tv-opening-up-new-intelligent-experiences-24) [![Self-Refine方法再度成为热点:通过自我批评提升LLM输出质量](https://static.jxxqtech.com/static/h-aether/news/23-2.png)\\ \\ Self-Refine方法再度成为热点:通过自我批评提升LLM输出质量\\ \\ Self-Refine方法因其通过自我批评与反思显著提升大语言模型(LLM)输出质量,再度成为AI研究热点。这一创新框架让单一LLM通过生成、反馈、优化的循环,自主迭代输出,无需额外训练或外部工具即可实现约20%的性能提升。Self-Refine对包括GPT-4在内的先进模型均有效,引发了开发者与研究者的广泛讨论。Self-Refine的核心在于一个自我循环提示法,通过单一LLM扮演三个角色实现输出优化:生成初始回答、自我批评与反馈、基于反馈优化。该方法无需监督训练数据或强化学习,仅通过提示工程即可实现,极大地降低了应用门槛。测试表明,该方法在代码优化、对话生成、数学推理等七项任务中,平均提升约20%的表现,部分任务(如代码可读性)提升高达40%。该方法已在多种场景中展现出强大潜力,如代码优化、对话生成、文本生成等,并且通过多维度反馈确保输出符合任务要求。开源代码进一步降低了开发者的接入成本。\\ \\ — 2025/05/16](https://www.mechlabs.cn/news-article/self-refine-method-regains-spotlight-enhancing-llm-output-quality-through-self-criticism-23) [![苹果推出革命性 AI 模型 Matrix3D:轻松将 3 张照片转化为 3D 场景](https://static.jxxqtech.com/static/h-aether/news/22-1.png)\\ \\ 苹果推出革命性 AI 模型 Matrix3D:轻松将 3 张照片转化为 3D 场景\\ \\ 苹果机器学习团队与南京大学和香港科技大学合作,推出了一款名为 Matrix3D 的先进 AI 模型。该模型的主要功能是从少量的2D 照片中重建真实的物体和场景,用户只需提供三张照片,便能自动生成详细的3D 重建效果。Matrix3D 改变了传统3D建模的做法,它将图像、相机参数以及深度数据等所有环节统一整合,采用一个统一的架构来处理这些信息,减少了中间步骤,使得重建过程更加顺畅可靠。在训练方法上,Matrix3D 运用了掩码学习策略,灵感来源于早期的 Transformer 基础 AI 系统,通过随机隐藏部分输入数据,促使模型学习如何"填补空白",增强了其适应性。测试结果显示,即使在数据集较小或不完整的情况下,Matrix3D 也能够有效学习关键特征,为沉浸式技术的应用提供了实质性的潜力。在 Apple Vision Pro 等头显设备中,Matrix3D 能够创建真实感十足的虚拟场景,从而提升用户体验。\\ \\ — 2025/05/16](https://www.mechlabs.cn/news-article/apple-launches-revolutionary-ai-model-matrix3d-easily-converting-3-photos-into-3d-scenes-22) [![谷歌承认:即使网站选择退出,仍用搜索数据训练 AI](https://static.jxxqtech.com/static/h-aether/news/21-1.jpg)\\ \\ 谷歌承认:即使网站选择退出,仍用搜索数据训练 AI\\ \\ 科技巨头谷歌在近日的一场联邦反垄断审判中承认,即使网站出版商明确选择不让其内容用于人工智能模型训练,谷歌仍会利用其搜索引擎收集的数据进行 AI 训练,包括备受争议的 AI Overviews 功能。这一承认由谷歌旗下人工智能实验室 DeepMind 的副总裁伊莱·柯林斯在作证时做出。司法部律师戴安娜·阿吉拉尔在质询中指\\ \\ — 2025/05/09](https://www.mechlabs.cn/news-article/google-admits-train-ai-with-search-data-even-if-websites-opt-out-21) [![Reddit在搜索栏中引入AI助手,告别繁琐搜索](https://static.jxxqtech.com/static/h-aether/news/20-1.jpg)\\ \\ Reddit在搜索栏中引入AI助手,告别繁琐搜索\\ \\ 随着互联网的发展,搜索引擎似乎变得愈发臃肿,广告和推销内容的增多让用户感到困扰。如今,很多人已经习惯在寻找信息时先选择 "谷歌一下,某某某 Reddit"。这不仅是一种幽默,也反映了人们对 Reddit 这一社区的信赖,因为用户提供的信息往往更为真实和有用。为了解决这一问题,Reddit 在去年的时候推出了 "Redd\\ \\ — 2025/05/09](https://www.mechlabs.cn/news-article/reddit-introduces-ai-assistant-in-the-search-bar-to-bid-farewell-to-tedious-searches-20) [![Anthropic推出"Integrations"连接应用,Claude新增"高级研究"深挖信息](https://static.jxxqtech.com/static/h-aether/news/19-1.jpg)\\ \\ Anthropic推出"Integrations"连接应用,Claude新增"高级研究"深挖信息\\ \\ Anthropic周四发布重大更新,为旗下AI聊天机器人Claude引入全新的应用连接方式"Integrations",并扩展了"深度研究"功能至"Advanced Research",使Claude能够搜索网络、企业账户等更广泛的数据源。"Integrations"和"Advanced Research"目前面向Cl\\ \\ — 2025/05/09](https://www.mechlabs.cn/news-article/anthropic-launches-integrations-connectivity-application-claude-adds-advanced-research-to-dig-deep-into-information-19) [![数学推理新标杆!DeepSeek-Prover-V2 实现数学证明的飞跃](https://static.jxxqtech.com/static/h-aether/news/18-1.png)\\ \\ 数学推理新标杆!DeepSeek-Prover-V2 实现数学证明的飞跃\\ \\ 在人工智能领域,最近一项重磅技术发布引发广泛关注 ——DeepSeek-Prover-V2。这一模型不仅在推理性能上取得了显著提升,还被誉为通向人工通用智能(AGI)的关键一步。DeepSeek-Prover-V2在推理能力和训练效率上都进行了革命性的创新,给数学推理研究带来了新的希望。DeepSeek-Prover-\\ \\ — 2025/05/09](https://www.mechlabs.cn/news-article/a-new-benchmark-for-mathematical-reasoning-deepseekproverv2-makes-a-leap-in-mathematical-proofs-18) [![澳大利亚电台首创 AI DJ,半年内无人识破真相!](https://static.jxxqtech.com/static/h-aether/news/17-1.png)\\ \\ 澳大利亚电台首创 AI DJ,半年内无人识破真相!\\ \\ 澳大利亚知名电台 CADA 近期推出了一位名为 Thy 的 AI DJ,该 DJ 由 AI 语音生成器 ElevenLabs 打造。Thy 自2024年11月开始主持节目《Workdays with Thy》,并在六个月内表现得极为逼真,以至于听众无人察觉他实际上是人工智能。ElevenLabs 的技术原理十分简单,用\\ \\ — 2025/05/09](https://www.mechlabs.cn/news-article/australian-radios-first-ai-dj-no-one-saw-through-the-truth-within-half-a-year-17) [![DeepSeek-Prover-V2-671B 模型开源,数学推理领域迎来新突破](https://static.jxxqtech.com/static/h-aether/news/16-1.png)\\ \\ DeepSeek-Prover-V2-671B 模型开源,数学推理领域迎来新突破\\ \\ 中国 AI 初创公司 DeepSeek 再次掀起开源 AI 领域的热潮,正式发布其最新开源模型 DeepSeek-Prover-V2-671B。这一拥有6710亿参数的超大规模语言模型,专为数学推理和问题解决设计,展现了 DeepSeek 在高效 AI 开发上的持续创新能力。根据社交媒体上的最新讨论,这一模型被认为是 \\ \\ — 2025/05/08](https://www.mechlabs.cn/news-article/deepseekproverv2671b-model-is-open-source-ushering-in-a-new-breakthrough-in-the-field-of-mathematical-reasoning-16) [![通义灵码接入Qwen3:上线编程智能体 集成魔搭MCP广场](https://static.jxxqtech.com/static/h-aether/news/15-1.png)\\ \\ 通义灵码接入Qwen3:上线编程智能体 集成魔搭MCP广场\\ \\ 通义灵码团队宣布其编程智能体全面支持Qwen3,并上线了全新的编程智能体功能。这一智能体具备自主决策、环境感知和工具使用等能力,能够根据开发者的诉求,使用工程检索、文件编辑、终端等工具,端到端地完成编码任务。此外,通义灵码还支持开发者配置自己的MCP工具,更加贴合开发者的工作流程,并集成魔搭MCP广场,开发者可以一键下\\ \\ — 2025/05/08](https://www.mechlabs.cn/news-article/tongyi-lingma-connects-to-qwen3-online-programming-agent-integration-magic-build-mcp-square-15) [![清华与星动纪元联合发布首个 AIGC 机器人大模型 VPP](https://static.jxxqtech.com/static/h-aether/news/14-2.png)\\ \\ 清华与星动纪元联合发布首个 AIGC 机器人大模型 VPP\\ \\ 近日,清华大学叉院的 ISRLab 与北京星动纪元科技有限公司携手推出了首个 AIGC(人工智能生成内容)机器人大模型 ——VPP(视频预测策略)。这一创新成果在2025年国际机器学习大会(ICML2025)上荣获 Spotlight 论文奖,显示出其在全球 AI 研究领域的前沿地位。AIGC 技术近年来迅速崛起,从生\\ \\ — 2025/05/08](https://www.mechlabs.cn/news-article/tsinghua-university-and-xingdong-era-jointly-released-the-first-aigc-robot-large-model-vpp-14) [![Grok语音模式全面上线 马斯克更改X昵称造势](https://static.jxxqtech.com/static/h-aether/news/13-1.jpg)\\ \\ Grok语音模式全面上线 马斯克更改X昵称造势\\ \\ 近日,人工智能领域迎来新动态,Grok正式宣布其语音模式已在Grok应用程序中完成全面部署。此次更新面向所有iOS用户以及Android平台的SuperGrok订阅者开放,让更多用户能够体验到这一新功能。就在Grok语音模式上线之际,特斯拉和SpaceX首席执行官埃隆·马斯克也做出一个引人关注的举动,他将自己在社交平台\\ \\ — 2025/05/08](https://www.mechlabs.cn/news-article/grok-voice-mode-is-fully-launched-musk-changes-x-nickname-to-build-momentum-13) [![Midjourney V7推出全新功能 "Omni-Reference",让图像生成更灵活](https://static.jxxqtech.com/static/h-aether/news/12-1.png)\\ \\ Midjourney V7推出全新功能 "Omni-Reference",让图像生成更灵活\\ \\ 在图像生成领域,Midjourney 近期推出了一项名为 "Omni-Reference"(全向参考)的新功能,为用户带来了更大的创作自由。这一全新图像引用系统不仅是 V6版本中 "角色参考" 功能的升级版,更是赋予用户在创作过程中对图像元素的精准控制。核心功能:全向参考与多元素支持Omni-Reference通过先进\\ \\ — 2025/05/08](https://www.mechlabs.cn/news-article/midjourney-v7-launches-new-feature-omnireference-to-make-image-generation-more-flexible-12) [![AI生物大模型ProGen3:重新定义蛋白质设计的未来](https://static.jxxqtech.com/static/h-aether/news/11-1.jpg)\\ \\ AI生物大模型ProGen3:重新定义蛋白质设计的未来\\ \\ 生物计算公司ProFluent近日推出了ProGen3,这是一款强大的生成式蛋白质语言模型(PLM),有望在抗体、工业酶及基因编辑领域带来重大突破。研究表明,ProGen3的规模和设计优化使其能够生成功能强大的新型蛋白质,甚至重塑我们对生物学的理解。该模型的训练数据来自Profluent Protein Atlas v1数据集,包含34亿个全长蛋白质和1.1万亿个氨基酸标记,成为目前最全面的蛋白质数据集之一。随着模型规模扩大,ProGen3能生成更多样化且功能真实的蛋白质,如ProGen3-46B生成的蛋白质多样性比小模型高出近两倍。在实际应用中,研究团队利用ProGen3设计了一系列高质量抗体,这些抗体在多项属性上与已获批准药物相当,且展现优越的开发性。此外,团队还开发出一种仅由592个氨基酸组成的紧凑型基因编辑器,能实现精准的基因编辑。专家认为,随着此类模型的持续扩展,将为药物发现、酶工程和工业生产等领域带来更多突破性进展。\\ \\ — 2025/4/25](https://www.mechlabs.cn/news-article/ai-biology-model-progen3-redefining-the-future-of-protein-design-11) [![Grok大更新!视觉能力、多语言音频处理与实时搜索功能震撼上线](https://static.jxxqtech.com/static/h-aether/news/10-1.png)\\ \\ Grok大更新!视觉能力、多语言音频处理与实时搜索功能震撼上线\\ \\ 由xAI打造的生成式人工智能聊天机器人Grok迎来了一次里程碑式的更新,其功能全面升级,不仅新增了视觉处理能力,还实现了多语言音频处理以及语音模式下的实时搜索功能。此次更新标志着Grok在多模态AI领域的重大突破,为用户提供了更智能、更便捷的交互体验。Grok的视觉处理能力是此次更新的核心亮点之一,用户可以通过上传图片,让Grok分析复杂视觉内容,例如解读数据图表、识别物体或将视觉信息转化为可执行代码。多语言音频处理方面,Grok通过集成"VoiceWave"扩展,现支持145种以上语言的实时语音交互,覆盖全球主要语种。语音模式下新增的实时搜索功能依托DeepSearch技术,让用户能够通过语音指令即时从网络和X平台获取最新信息。技术上,Grok3的训练依托Colossus超级计算机,配备20万个NVIDIA H100GPU,通过大规模强化学习优化了其推理能力,在多个基准测试中超越了包括GPT-4o、Gemini1.5和Claude3.5Sonnet在内的多个竞品模型。\\ \\ — 2025/4/25](https://www.mechlabs.cn/news-article/grok-major-update-vision-capabilities-multilingual-audio-processing-and-real-time-search-functions-10) [![Character.AI发布AvatarFX模型:让静态人物图像栩栩如生地"开口交谈"](https://static.jxxqtech.com/static/h-aether/news/9-1.jpg)\\ \\ Character.AI发布AvatarFX模型:让静态人物图像栩栩如生地"开口交谈"\\ \\ Character.AI日前正式推出创新视频生成模型AvatarFX,这项突破性技术能将静态图像转换为具有高度真实感的会说话视频角色,为图片中的人物赋予动态表情、精准的唇形同步及自然的肢体动作。AvatarFX核心采用最新扩散模型驱动的动态生成引擎,通过精选数据集训练,结合前沿音频条件化、知识蒸馏与优化推理策略,使用户能以极高速度生成高保真且时间一致性强的视频内容。该模型适用于长叙事序列和多角色对话场景,并提供多种音频选项以增强体验沉浸感。平台内置强大安全控制机制,确保创作环境健康可靠。操作便捷的用户界面允许创作者仅通过上传一张起始图片并配置音频,即可生成生动视频,支持多角色参与和连续对话,为个人项目、社交媒体内容或教学演示提供极具创意的表达空间。\\ \\ — 2025/4/25](https://www.mechlabs.cn/news-article/character-ai-launches-avatarfx-model-making-static-images-of-people-talk-9) [![Ostris推出Flex.2-preview:8B参数扩散模型引领ComfyUI工作流新革命](https://static.jxxqtech.com/static/h-aether/news/8-1.png)\\ \\ Ostris推出Flex.2-preview:8B参数扩散模型引领ComfyUI工作流新革命\\ \\ Ostris团队近日发布Flex.2-preview,这是一款搭载8亿参数的文本到图像扩散模型,专为ComfyUI工作流量身定制。据专业分析,该模型在基于线条、姿态和深度的精确控制生成方面表现卓越,同时支持通用控制与高级图像修补功能,沿袭了从Flux.1Schnell经OpenFlux.1到Flex.1-alpha的精细微调进化路径。值得一提的是,Flex.2-preview已在Hugging Face平台完全开源,采用开放的Apache2.0许可协议并提供灵活的工作流整合能力,迅速成为AI创意社区关注焦点。Flex.2-preview核心亮点包括:通用控制系统支持线条、姿态与深度指导;高级图像修补能力;与ComfyUI的无缝集成;以及高效的图像生成表现。技术上,该模型延续了Flux系列的架构优势,同时通过架构精简与控制系统整合实现了更灵活的应用场景,支持从艺术创作到商业设计的多种用途,部署门槛低且性能表现优异,为开源AI艺术创作开辟了新可能。\\ \\ — 2025/4/25](https://www.mechlabs.cn/news-article/ostris-releases-flex-2-preview-8b-parameter-diffusion-model-revolutionizing-comfyui-workflows-8) [![mcp-server-weread开源工具实现Claude与微信读书无缝连接,推动阅读体验与人工智能深度结合](https://static.jxxqtech.com/static/h-aether/news/7-1.jpg)\\ \\ mcp-server-weread开源工具实现Claude与微信读书无缝连接,推动阅读体验与人工智能深度结合\\ \\ 近期,创新工具mcp-server-weread在Twitter引起广泛关注,该工具成功打通Anthropic的Claude AI与微信读书平台,使用户能够直接在AI环境中访问并利用微信读书的笔记和阅读数据,为知识工作者带来全新体验。mcp-server-weread作为开源项目,通过建立本地服务器,将微信读书中的笔记、划线及评论以结构化形式导入Claude,实现高效数据处理。Claude凭借强大的分析能力,可基于导入数据生成内容总结、提取关键观点或进行知识关联分析。Twitter社区对该工具的"简便操作"和"高度自定义"特性给予高度评价。其核心优势包括:自动数据同步、结构化信息处理、完善的隐私保护以及丰富的AI交互场景。众多用户已将此工具与Obsidian或Notion等应用集成,构建个性化知识管理体系,为研究人员、职场人士、内容创作者及技术爱好者提供了实用价值。\\ \\ — 2025/4/25](https://www.mechlabs.cn/news-article/mcp-server-weread-tool-enables-seamless-interaction-between-claude-and-wechat-reading-notes-promoting-deep-integration-of-reading-and-ai-7) [![阿里达摩院AI模型DAMO PANDA荣获FDA"突破性医疗器械"认证,解决胰腺癌早期检测难题](https://static.jxxqtech.com/static/h-aether/news/6-1.jpg)\\ \\ 阿里达摩院AI模型DAMO PANDA荣获FDA"突破性医疗器械"认证,解决胰腺癌早期检测难题\\ \\ 阿里巴巴人工智能模型DAMO PANDA日前获美国食品药品监督管理局(FDA)授予"突破性医疗器械"认证,标志着阿里巴巴在智能医疗领域取得重大突破,也是中国领军科技企业首获此项国际权威认可。DAMO PANDA由阿里达摩院自主研发,专注于胰腺癌早期筛查,通过先进算法精确分析CT图像中的微小病变,有效识别早期胰腺癌征兆。众所周知,胰腺癌因初期症状隐匿,一直被视为医学界难以攻克的难题,传统影像学检查对早期微小病灶的发现能力有限。而DAMO PANDA借助深度学习技术,能在普通CT扫描中准确捕捉并标识病灶,即使是极早期的细微病变也难以逃过其"法眼"。该技术的广泛应用将显著提升胰腺癌早期发现率,为临床干预赢得宝贵时间窗口,彰显了中国AI技术在全球医疗创新领域的强劲实力。\\ \\ — 2025/4/18](https://www.mechlabs.cn/news-article/alibaba-ai-model-damo-panda-receives-fda-breakthrough-device-designation-tackling-early-pancreatic-cancer-screening-challenges-6) [![字节重磅推出豆包1.5深度思考大模型:融合多模态能力,推理延迟更低](https://static.jxxqtech.com/static/h-aether/news/5-1.jpg)\\ \\ 字节重磅推出豆包1.5深度思考大模型:融合多模态能力,推理延迟更低\\ \\ 4月17日,在火山引擎AI创新巡展杭州站活动中,字节跳动旗下火山引擎总裁谭待隆重发布豆包1.5・深度思考模型。该模型在数学、编程、科学推理等专业领域及创意写作任务中均表现出色。采用MoE(混合专家)技术架构,总参数规模达200亿,而激活参数仅需20亿,大幅低于业内同类产品,使推理成本获得显著优势。新模型还整合视觉理解技术,提供分析地貌、辅助点餐、生成项目管理流程图等多种实用功能。同时,火山引擎升级了豆包文生图3.0版本,带来更精美文字排版、更高清晰度的图像生成以及2K图片直出能力。值得一提的是,模型视频搜索能力得到提升,可迅速在视频内容中定位所需信息。据谭待介绍,截至2025年3月,豆包大模型日均tokens使用量已超12.7万亿,较初期增长106倍,彰显其强大市场影响力。\\ \\ — 2025/4/18](https://www.mechlabs.cn/news-article/bytedance-releases-doubao-1-5-deep-thinking-model-multimodal-deep-thinking-low-latency-5) [![AI音乐新纪元:Deezer平台近两成新曲出自人工智能之手](https://static.jxxqtech.com/static/h-aether/news/4-1.jpg)\\ \\ AI音乐新纪元:Deezer平台近两成新曲出自人工智能之手\\ \\ 根据法国音乐流媒体巨头Deezer最新发布的数据报告,该平台约18%的新上传音乐作品完全由AI创作,清晰呈现出人工智能在音乐创作领域的迅猛崛起。统计显示,每日有超过20,000首AI生成曲目涌入平台,几乎是四个月前数量的两倍之多。Deezer创新主管Aurelien Herault表示,AI生成内容持续大量涌入平台且无减缓迹象,公司已于今年一月推出专门检测工具,能有效筛选纯AI创作内容,确保在面向970万用户的推荐系统中过滤这类作品。与此同时,AI技术在创意产业的迅速扩张也引发诸多法律争议,多家音乐巨头已对Suno和Udio等AI音乐工具发起版权侵权诉讼,众多知名音乐人亦公开表达担忧,警示AI音乐可能边缘化人类艺术家,此类争议同样延伸至好莱坞电影产业。\\ \\ — 2025/4/18](https://www.mechlabs.cn/news-article/ai-music-era-arrives-18-percent-of-new-songs-on-deezer-platform-created-by-artificial-intelligence-4) [![人工智能赋能医疗行业革新:Hellocare.ai、SignalFire等企业获得巨额融资支持](https://static.jxxqtech.com/static/h-aether/news/3-1.jpg)\\ \\ 人工智能赋能医疗行业革新:Hellocare.ai、SignalFire等企业获得巨额融资支持\\ \\ 近期,健康科技领域涌现多笔重磅投资,彰显人工智能在医疗范畴的迅猛发展与广泛落地。知名早期风投机构SignalFire成功募集10亿美元资金,专注扶持以AI为核心的创业项目,使其管理资产规模达到30亿美元,凸显了其行业领导地位。SignalFire投资组合涵盖多家医疗创新企业,如Grow Therapy与Health Gorilla等。与此同时,Hellocare.ai也斩获4700万美元融资,致力于开发AI驱动的远程医疗解决方案,目前已在70余家医疗机构部署应用。此外,Thatch(4000万美元)、Silna Health(2700万美元)及Layer Health(2100万美元)等新兴公司同样获得可观资金支持,分别专注于个性化健康保险服务、智能医疗账单管理及AI辅助医疗记录审核等领域。随着这些创新科技不断涌现,医疗行业正加速向智能化、个性化服务模式转型。\\ \\ — 2025/4/18](https://www.mechlabs.cn/news-article/ai-empowers-healthcare-industry-development-hellocare-ai-signafire-and-other-companies-secure-major-funding-3) [![理想同学MindGPT 3.0震撼发布:深度思考能力与DeepSeek比肩](https://static.jxxqtech.com/static/h-aether/news/2-1.jpg)\\ \\ 理想同学MindGPT 3.0震撼发布:深度思考能力与DeepSeek比肩\\ \\ 近日,理想汽车宣布旗下智能伴侣"理想同学"进行重大更新,搭载的MindGPT3.0模型全面升级并向用户开放使用。此次提升不仅标志着理想汽车在人工智能领域取得又一重大突破,还为广大车主提供了更为智能、便捷的交互体验。据官方透露,MindGPT3.0模型在性能方面实现了突破性进展,其深度思考能力尤为突出。该模型性能可与业内顶尖的DeepSeek-V3-0324(短思维链)及DeepSeek-R1(长思维链)相媲美,展现了理想汽车在AI领域的强大技术实力。用户现可通过理想同学手机应用及网页版免费体验这款全新模型,领略其带来的智能交互新体验。\\ \\ — 2025/4/18](https://www.mechlabs.cn/news-article/ideal-classmate-mindgpt-3-released-with-deep-thinking-capabilities-comparable-to-deepseek-2) [![工程机械行业首家!机械星球率先推出自研星知大模型,并完成DeepSeek接入](https://mmbiz.qpic.cn/sz_mmbiz_jpg/GHibRsnEol85Ol5XosiamzA3GlXoXqgGj7g3pAjTwqJa7xtUJMXTQD62x8wcFQplyj0xW6Lvw5qv8KlZXX3nUZiaQ/640?wx_fmt=jpeg&from=appmsg&tp=webp&wxfrom=10005&wx_lazy=1&wx_co=1)\\ \\ 工程机械行业首家!机械星球率先推出自研星知大模型,并完成DeepSeek接入\\ \\ 近日,机械星球率先推出自主研发的星知大模型,这是国内首个工程机械垂直行业大模型。机械星球•星知大模型,通过植入"深度思考模式",全面升级工程行业用户的数智化体验,重新定义设备智慧化租赁、高效施工方案等工程作业场景,旨在助力传统且复杂的工程机械行业,让方案更科学、让作业更安全、让施工更智能。此前星知大模型,已接入通义千问等多个大模型,并于日前完成深度求索(DeepSeek)R1大模型的接入,实现行业深度融合,为行业率先开启了"AI+工程机械"的无限可能!\\ \\ — 2025/4/15](https://www.mechlabs.cn/news-article/first-in-construction-machinery-industry-mechanical-planet-launches-self-developed-xingzhi-llm-1) ## User Login # 星知 ![logo](https://www.mechlabs.cn/logo.png) [![logo-dark](https://www.mechlabs.cn/_next/static/media/logo-dark.88d61b58.png)](https://www.mechlabs.cn/) ![ball-1](https://www.mechlabs.cn/_next/static/media/login-ball1.bef5a475.png)![ball-2](https://www.mechlabs.cn/_next/static/media/login-ball2.9490f295.png)![ball-3](https://www.mechlabs.cn/_next/static/media/login-ball3.d554530a.png)![ball-4](https://www.mechlabs.cn/_next/static/media/login-ball4.cc7005bc.png) # 用户登录 ![login-smile](https://www.mechlabs.cn/_next/static/media/login-smile.c23b2ec0.png) 手机号 短信验证码 获取验证码 登录 ## Meituan NoCode Tool # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable — 2025/05/23 据智能涌现消息,美团正在加速其AI战略布局,即将推出一款名为"NoCode"的AI编程工具,并已悄然注册了"nocode.cn"域名,目前该网站正处于灰度测试阶段,预示这款面向非技术用户的全新产品即将正式面世。 ![美团NoCode AI编程工具](https://static.jxxqtech.com/static/h-aether/news/31-1.png) ## 聚焦"Vibe Coding"新赛道 该工具由美团研发质量与效率团队打造,定位于新兴的"Vibe Coding(氛围编程)"赛道,通过对话式交互实现应用构建,主打"人人可用"的AI编程体验。 不同于Cursor这类以开发者为中心的辅助编程工具,也区别于Devin所代表的AI自主编程路径,美团的"NoCode"更接近于近期在行业内受到关注的Lovable产品,面向非程序员用户,强调通过自然语言多轮对话完成代码生成、部署和修改。"NoCode"可用于数据分析、原型设计、运营工具搭建和门户网站构建等场景,其技术架构采用了具备复杂逻辑推理能力的Code Agent,可智能调度文件检索、日志分析和数据库查询等任务,在执行深度上进行了进一步优化。 ## 普及AI编程能力至更广用户群体 据接近项目的人士透露,美团推出这款产品的核心动因,是希望将AI编程的能力普及至更广泛的用户群体,尤其是其平台上大量的中小商家和运营人员,让他们像点外卖一样简单地开发和使用自定义工具。 该产品最早起源于2023年美团内部的AI黑客松活动,起初仅服务于公司内部研发,如今已实现与美团技术体系的打通,并在多个业务线的真实场景中投入使用。一些运营和地推人员已借助"NoCode"实现自主开发功能原型,有效满足了长尾需求。 ## 美团AI战略全面布局 美团CEO王兴曾在2025年3月的财报会议中首次全面公开AI战略,提出"AI at Work""AI in Products"与"Building LLM"三大方向。"NoCode"正是"AI in Products"的代表项目,而"AI at Work"方面,美团也同步推进了名为"CatPaw"的AI开发工具,用于服务内部技术团队。 数据显示,在"CatPaw"上线后,美团研发团队的AI代码生成占比已达50%,研发人员周活跃率超过80%,AI对整体开发效率的提升显著。 据悉,"NoCode"并非美团AI战略的终点。美团高层近期不断加码AI方向,核心本地商业CEO王莆中也在牵头研发一款AI原生的"专属生活小秘书"产品。伴随"LongCat"大模型持续迭代,以及对AI人才的大规模招募,美团或将在AI领域迎来更密集的产品发布周期。 # 最新发布 [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) [![Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理](https://static.jxxqtech.com/static/h-aether/news/27-1.png)\\ Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/anthropic-launches-claude4-series-featuring-opus4-and-sonnet4-leading-in-coding-complex-reasoning-27) ## Gemini AI User Milestone # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户 — 2025/05/23 在最近的一次公开讲话中,谷歌的CEO桑达尔・皮查伊透露,公司的Gemini AI应用程序的月活跃用户数量已经超过4亿。这一数据的公布无疑为Gemini AI的成功增添了光彩,并显示出消费者对这一人工智能技术的强烈兴趣。 ![谷歌Gemini AI](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg) ## 全球影响力持续扩大 Gemini AI不仅在用户量上取得了显著的成绩,还在全球范围内实现了广泛的覆盖。根据皮查伊的介绍,该AI应用已经在200多个国家和地区正式推出,服务范围涵盖了超过15亿的用户。这意味着,Gemini AI能够为来自不同文化和语言背景的用户提供便利,进一步推动了全球化的步伐。 ## 多语言支持拓展用户体验 值得一提的是,Gemini AI的语言支持已经扩展到超过40种语言,最近新增了阿拉伯语、中文、马来语和乌尔都语等多种语言的支持。这一举措不仅提升了用户的使用体验,还让更多用户能够轻松获取信息和服务,展示了谷歌在推动人工智能技术普及方面的决心。 ## 技术创新响应市场需求 谷歌一直以来致力于在AI领域的创新和发展,Gemini AI的成功不仅是其技术实力的体现,更是市场需求的响应。随着更多国家和地区用户的加入,Gemini AI将继续朝着更广泛的应用和更智能化的方向发展。 在未来,谷歌可能会进一步推出更多功能,增强Gemini AI的交互性和实用性,帮助用户更好地满足日常生活和工作中的需求。可以预见,Gemini AI的迅猛发展将会在各个行业产生深远的影响。 Gemini AI的快速崛起反映了人工智能技术在现代社会中日益重要的地位,谷歌的这一创新成果值得我们期待其未来的发展。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) [![Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理](https://static.jxxqtech.com/static/h-aether/news/27-1.png)\\ Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/anthropic-launches-claude4-series-featuring-opus4-and-sonnet4-leading-in-coding-complex-reasoning-27) ## Shopify AI Store Builder # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Shopify推出全新AI工具,让在线商店建设变得更简单 — 2025/05/23 Shopify在最近的一次发布会上宣布推出一项创新的生成式人工智能功能,名为"AI商店构建器"。这一新工具旨在帮助商家通过输入描述性的关键词,快速搭建自己的在线商店,极大简化了电子商务的建设过程。 ![Shopify AI商店构建器](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg) ## 自动生成多种商店布局 这一AI商店构建器的最大亮点是,它能够根据用户输入的关键词,自动生成三种不同的商店布局。每个布局都包含了相应的图片和文本内容,这样商家就可以在短时间内完成店铺的设计,减少了大量的时间和资源投入。过去,商家在设计网站时需要进行繁琐的点击、拖拽和文本填写,但有了这一AI工具,整个过程可以实现全自动化。 ## 解决商家建站困境 Shopify的产品副总裁Vanessa Lee表示,这种基于AI的商店构建工具是针对商家在建站过程中常遇到的困难而设计的。传统的建站方式对于许多商家来说是一个挑战,而通过使用AI,商家只需提供一些开放性的问题,便可以获得最佳的店铺设计方案。这样的变革无疑会为希望开设在线商店的商家们带来极大的便利。 ## 全面的AI产品布局 此外,Shopify在人工智能领域的投资并不仅限于此次发布的工具。公司已经推出了多种基于AI的解决方案,覆盖从图像生成到库存管理等多个方面。这种全面的AI产品布局,不仅展示了Shopify在电商领域的前瞻性,也希望能吸引更多的商家加入他们的平台。 Shopify的这一新功能将会极大提升商家们的工作效率,让更多人能够轻松创建出个性化的在线商店,借助现代技术实现商业梦想。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) [![Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理](https://static.jxxqtech.com/static/h-aether/news/27-1.png)\\ Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/anthropic-launches-claude4-series-featuring-opus4-and-sonnet4-leading-in-coding-complex-reasoning-27) ## Meta J1 Series Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Meta推出J1系列模型,最强"AI法官"上线 — 2025/05/23 近日,Meta 公司发布了其全新 J1系列模型,这是一项旨在提升 AI 判断能力的创新技术。通过结合强化学习和合成数据的训练方法,J1模型不仅在判断的准确性上取得显著进步,还在公平性方面表现出色。此次发布的消息由科技媒体 marktechpost 报道,令人瞩目。 ![Meta J1系列模型](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg) ## AI从信息查询到评估判断 随着大型语言模型(LLM)技术的不断发展,AI 的应用范围也在不断拓展,从传统的信息查询逐步转向评估和判断。这种被称为 "LLM-as-a-Judge" 的新模式,使 AI 模型能够对其他语言模型的输出进行审查,成为强化学习、基准测试和系统对齐的重要工具。这一模式虽然前景广阔,但也面临诸多挑战,比如判断的一致性和推理深度不足。 ## 创新训练方法突破瓶颈 Meta 的 J1模型在解决这些挑战上做出了显著的创新。传统的评估方法往往依赖于人工标注数据,但其收集成本高且耗时。因此,J1团队开发了一个包含22000个合成偏好对的数据集,其中包括17000个来自 WildChat 的语料和5000个数学查询。这一做法极大提升了模型的泛化能力。 此外,J1引入了 Group Relative Policy Optimization(GRPO)算法,简化了训练流程,并通过位置无关学习的方式消除了因答案顺序而导致的偏见。 ## 性能测试远超同行 测试结果显示,J1的表现远超同行。在 PPE 基准测试中,J1-Llama-70B 的准确率达到了69.6%,不仅超过了 DeepSeek-GRM-27B 和 EvalPlanner-Llama-70B,还显示了即使是较小的 J1-Llama-8B 也有62.2% 的成绩,远高于 EvalPlanner-Llama-8B 的55.5%。 J1在多个基准测试中表现优异,展现了其在可验证和主观任务上的强大能力。 ## 未来展望 通过这一系列创新,Meta 的 J1模型无疑为未来 AI 的应用奠定了更坚实的基础,尤其是在处理复杂的推理任务和伦理决策方面。 业内专家预测,随着J1系列模型的推出,AI评估技术将迎来新的发展阶段。J1模型不仅能够作为独立的评估工具,还可能被整合到更多AI应用中,提供更加公平、准确的判断支持。 Meta表示,未来将继续优化J1模型,并探索在更多复杂场景下的应用可能性,推动AI技术在评估判断领域的进一步发展。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理](https://static.jxxqtech.com/static/h-aether/news/27-1.png)\\ Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/anthropic-launches-claude4-series-featuring-opus4-and-sonnet4-leading-in-coding-complex-reasoning-27) ## Claude4 Series Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Anthropic发布Claude4系列模型:Opus4和Sonnet4领跑编码与复杂推理 — 2025/05/23 作为人工智能领域的先锋,Anthropic于2025年5月22日正式发布了Claude4系列模型,包括Claude Opus4和Claude Sonnet4,开启了编码、复杂推理和 AI 代理的新篇章。Claude Opus4被誉为全球最佳编码模型,能够持续高效地处理复杂的长时间任务和代理工作流。而 Claude Sonnet4则是对 Sonnet3.7的重大升级,能够更精准地响应用户指令,展现出卓越的编码和推理能力。 ![Claude4系列模型](https://static.jxxqtech.com/static/h-aether/news/27-1.png) ## Claude4系列:性能全面升级 Claude4系列被誉为Anthropic迄今为止最强大的模型组合。据官方介绍,Claude Opus4是当前全球顶尖的编码模型,能够在复杂、长时间运行的任务中持续工作数小时,展现出卓越的自主编码能力。例如,在处理复杂的开源项目时,Claude Opus4能够自主编码近七小时,显著提升了AI在软件开发中的实用性。 与此同时,Claude Sonnet4作为Claude Sonnet3.7的重大升级,不仅在编码能力上表现优异,还在推理能力上实现了显著提升。相比前代,Sonnet4在执行任务时提供了更高的控制力,用户可以更灵活地调整模型的行为,以适应不同场景的需求。 ## SWE-bench Verified认证:行业标杆 Claude4系列在SWE-bench Verified测试中表现出色,这一测试专门用于评估模型解决真实软件问题的能力。 官方数据显示,Claude Opus4和Claude Sonnet4均达到了行业领先水平,特别是在处理复杂软件问题时展现了无与伦比的稳定性与精准性。 这一成就不仅巩固了Anthropic在AI编码领域的领导地位,也为开发者提供了更可靠的工具,助力从简单脚本到大型项目开发的全面应用。 ## 定价与可用性:面向更广用户群 Anthropic宣布,Claude4系列已于发布当日对所有付费计划用户开放,而Claude Sonnet4还向免费计划用户提供,极大地降低了体验门槛。 这一策略反映了Anthropic推动AI技术普及的决心,让更多开发者、研究者和普通用户能够体验到前沿AI的强大功能。 ## 市场反响:期待与争议并存 X平台上的讨论显示,业界对Claude4系列的发布反响热烈。部分用户对Claude4是否能超越OpenAI的最新模型(如o3)表示怀疑,但更多人对其在编码和推理领域的表现充满期待。 此前,Anthropic的CEO Dario Amodei曾在采访中暗示新模型"Neptune"的到来,而此次Claude4的发布似乎印证了这一猜测,引发了广泛的关注与讨论。 Claude4系列的发布不仅是Anthropic技术实力的体现,也为AI在软件开发、科学研究和日常任务处理中的应用开辟了新可能。其强大的编码能力和灵活的控制机制,或将推动AI从辅助工具向核心生产力的角色转变。然而,面对OpenAI等竞争对手的持续压力,Claude4系列能否在实际应用中兑现其承诺,仍需时间验证。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Seed1.5-VL Model Release # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 仅20B参数!字节推出Seed1.5-VL多模态模型,实现38项SOTA — 2025/05/16 在上海举办的火山引擎 FORCE LINK AI 创新巡展上,字节跳动正式发布了最新的视觉-语言多模态模型——Seed1.5-VL。该模型凭借其出色的通用多模态理解和推理能力,成为此次活动的焦点,吸引了众多业界专家和开发者的关注。 ![bytedance-seed-model](https://static.jxxqtech.com/static/h-aether/news/26-1.png) ## 增强的多模态理解与推理能力 Seed1.5-VL 的显著特点是其增强的多模态理解与推理能力。与之前的版本相比,Seed1.5-VL 在视觉定位和推理的速度与准确性上有了显著提升。此外,新增的视频理解和多模态智能体功能,使其在处理复杂任务时表现更加出色。 字节跳动的技术团队表示,Seed1.5-VL已经能够处理包括图像问答、图表理解、视觉推理、视频理解等多种复杂任务,且响应速度和准确性均有显著提升。模型的视觉理解能力不仅限于识别图像中的物体,还能理解物体之间的空间关系、场景上下文以及隐含的视觉信息。 ## 超高性能与低成本优势 尽管 Seed1.5-VL 的激活参数仅为20B,但其性能已经达到了与 Gemini2.5Pro 相当的水平。在60个公开评测基准中,Seed1.5-VL 在38个任务上取得了 SOTA(state-of-the-art)表现,尤其是在视频理解、视觉推理和多模态智能体能力方面,均处于行业领先地位。 在推理成本方面,Seed1.5-VL 也表现出色,其推理输入价格为每千 tokens 仅0.003元,输出价格为每千 tokens 仅0.009元,极具性价比。这一低成本优势使得Seed1.5-VL在大规模商业应用场景中极具竞争力,能够满足企业在控制成本的同时提升AI能力的需求。 ## 便捷的 API 接入与实际应用案例 目前,Seed1.5-VL 已经在火山引擎全面开放 API,开发者只需登录后选择 Doubao-1.5-thinking-vision-pro,即可快速调用其能力,构建自己的 AI 视觉助手、巡检系统、交互 Agent 或下一代智能摄像头。 为验证 Seed1.5-VL 的实际性能,记者进行了多项测试。通过上传一张货架图片,Seed1.5-VL 能够迅速识别出特定产品并计算其价格。在复杂的公务员图形推理题目中,Seed1.5-VL 也显示出了其强大的推理能力,能够在短时间内捕捉并推导出其中的规律,完成难度较大的逻辑任务。 火山引擎的产品负责人表示:"我们已经看到许多企业客户利用Seed1.5-VL开发出创新应用,如智能仓储系统能够自动识别并记录货物状态,零售业的智能货架分析系统可以实时监控商品陈列和库存状况,医疗影像辅助诊断系统则能帮助医生更准确地解读医学影像。" ## 技术架构与训练细节 Seed1.5-VL 作为 Seed 系列最新一代多模态模型,经过在超过3T token 的多模态数据上进行预训练,展现出在图像问答、图表理解、视觉推理等多个任务上的卓越表现。该模型由三个核心组件构成,包括视觉编码模块 SeedViT、用于视觉特征投影的多层感知机(MLP)适配器以及基于 MoE 架构的大语言模型 Seed1.5-LLM。 技术团队介绍,模型采用了混合专家(MoE)架构,虽然总参数量较大,但在实际推理过程中只激活一小部分专家参数,这使得Seed1.5-VL能够在保持高性能的同时大幅降低计算成本。此外,团队还针对多模态场景优化了视觉特征的提取和融合方法,显著提升了模型在复杂视觉场景下的理解能力。 ## 行业影响与未来展望 业内专家认为,Seed1.5-VL的发布标志着中国在多模态大模型领域又迈出了重要一步。与国际顶尖模型相比,Seed1.5-VL不仅在性能上达到了同等水平,在成本效益方面甚至更具优势,这对于推动多模态AI技术的广泛商业应用具有重要意义。 字节跳动表示,未来将继续优化Seed系列模型,重点提升其在长视频理解、多轮多模态对话等方面的能力,并计划拓展更多垂直领域应用,如教育、医疗、工业等。同时,还将进一步降低模型的使用门槛,让更多开发者能够便捷地将多模态AI能力集成到自己的产品中。 随着字节跳动持续在AI领域的投入,Seed1.5-VL的推出不仅展示了其技术实力,也预示着多模态AI应用将在更广泛的商业场景中落地,为各行业的智能化转型带来新的可能性。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Open-source Multimodal Reward Model # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 腾讯混元携手科研机构推出首个多模态统一CoT奖励模型并开源 — 2025/05/16 近日,腾讯混元在与上海 AI Lab、复旦大学及上海创智学院的合作下,正式推出了全新研究成果 —— 统一多模态奖励模型(Unified Reward-Think),并宣布全面开源。这一创新模型不仅具备了强大的长链推理能力,还首次实现了在视觉任务中 "思考" 的能力,使得奖励模型能够更准确地评估复杂的视觉生成与理解任务。 ![tencent-hunyuan-reward-model](https://static.jxxqtech.com/static/h-aether/news/25-1.jpg) ## 突破性的多模态统一架构 统一多模态奖励模型的推出,标志着奖励模型在各类视觉任务中的应用达到了新的高度。过去,许多视觉任务往往面临评估不准确和推理能力不足的问题。而这一新模型的研发,正是为了克服这些局限性。通过深度学习和多模态融合技术,模型能够在多种视觉任务中进行跨任务的泛化与推理,提高了可解释性。这意味着,在进行图像生成、图像理解等任务时,模型能够更全面地考虑各种因素,从而作出更为合理的判断。 腾讯混元的研究团队表示,该模型采用了创新的"思考链"(Chain-of-Thought,CoT)机制,能够像人类一样通过分步思考来解决复杂问题。与传统奖励模型相比,Unified Reward-Think能够在评估过程中展示明确的思考路径,使模型决策更加透明和可追溯。 ## 多任务泛化能力 这一模型的另一大亮点是其卓越的多任务泛化能力。在技术简报中,研究团队展示了模型在各种不同类型视觉任务中的表现,包括图像描述评估、视觉问答质量判断、图像生成评价等。测试结果表明,Unified Reward-Think不仅在各项基准测试中表现出色,还能够在未见过的新任务上展现良好的迁移学习能力。 复旦大学的研究人员指出:"该模型不需要针对每种具体任务进行专门训练,而是能够基于统一框架理解不同视觉任务的本质要求,这极大地提高了模型的实用性和部署效率。" ## 开源内容与社区影响 该项目的开源不仅使得科研人员可以自由使用这一模型,还为整个 AI 社区的研究提供了更广阔的平台。腾讯混元表示,开源内容包括模型、数据集、训练脚本和评测工具,这将有助于推动相关领域的进步与创新。科研人员和开发者可以基于此模型进行深入研究,探索更多应用场景。 上海AI Lab的负责人表示:"我们希望通过开源这一模型,促进学术界和产业界在多模态AI领域的交流与合作。统一奖励模型的框架可以作为未来研究的基础,推动整个领域的发展。" ## 产业应用前景 在实际应用方面,统一多模态奖励模型有望在多个领域发挥重要作用。腾讯混元团队提到,该模型可以应用于内容创作辅助、智能教育、医疗影像分析等领域,帮助提高AI系统的输出质量和可靠性。 例如,在设计创意生成领域,模型可以评估生成内容的质量、创意性和合规性;在医疗影像分析中,它能够对AI诊断结果进行合理性评估,提供更透明的判断依据;在教育场景中,模型可以对学生的视觉理解任务给出更加细致和有建设性的反馈。 ## 未来发展与行业趋势 此外,腾讯混元的这一举动,也体现了其在人工智能领域持续的创新和开放态度。在全球范围内,人工智能技术的快速发展,促使各大科技公司纷纷加大研发力度,推出更具前瞻性的技术与应用。腾讯混元此次开源的统一多模态奖励模型,正是这一潮流的缩影。 上海创智学院的研究人员评论道:"奖励模型是推动AI系统持续进化的关键组件,特别是在RLHF(基于人类反馈的强化学习)框架下。腾讯混元这次推出的统一多模态奖励模型填补了视觉领域中的一个重要空白,为构建更加智能的视觉系统铺平了道路。" 随着这一模型的发布与开源,未来在多模态 AI 研究、视觉任务评估等方面,我们将会看到更多的可能性和应用前景。研究团队表示,他们将继续优化模型性能,扩展支持的任务类型,并与社区密切合作,推动AI技术在视觉领域的进一步发展。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Gemini AI Expansion # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Google 将 Gemini AI 助手扩展至Wear OS和Google TV,开启全新智能体验 — 2025/05/16 在刚刚结束的 Android Show 上,恰逢 Google I/O 开发者大会前夕,Google 宣布了一个备受期待的消息:其最新的人工智能助手 Gemini 即将登陆 Wear OS 智能手表和 Google TV。这一举措是 Google 计划在所有设备和平台上逐步取代 Google Assistant 的重大步骤。用户们早已期待这一时刻,现在终于可以在多种设备上与 Gemini 进行互动。 ![google-gemini-expansion](https://static.jxxqtech.com/static/h-aether/news/24-1.png) ## Wear OS 上的 Gemini 体验 Google 表示,这次扩展将极大丰富用户体验,让他们在不依赖手机的情况下也能方便地使用智能助手。以 Wear OS 智能手表为例,当你在做饭时双手沾满面粉,或在骑自行车时无法使用手机时,Gemini 能够轻松助你一臂之力。用户只需简单地与手表对话,无需严格按照特定的指令。 例如,在健身房的更衣室,你可以轻松设定提醒:"记得我今天要用43号储物柜。" 同时,Gemini 还可以连接到各种应用,让你在锻炼过程中随时获取信息。相比传统的语音助手,Gemini 在理解上下文和处理复杂查询方面有着显著优势,使得交互更加自然流畅。 ## Google TV 上的个性化体验 而在 Google TV 上,Gemini 将带来个性化的内容推荐,让家庭观影体验更加愉悦。用户可以向助手询问适合儿童观看的动作片,或让孩子提问太阳系的问题,Gemini 则会自动播放相关的教育视频,帮助他们扩展知识。 同时,Gemini 的上线还将帮助用户更高效地管理时间和内容,让整个家庭都受益于这一智能助手的多功能性。例如,用户可以通过语音要求 Gemini 在特定时间提醒家人观看重要节目,或者询问关于正在观看的电影的背景信息和演员资料。Gemini 的强大语言理解能力使得这些交互变得自然而直观。 ## Android XR 平台的 Gemini 集成 此外,Google 还将 Gemini 集成到 Android XR 平台,未来用户在使用头戴式设备时也能享受到这一智能助手的服务。这意味着用户可以通过 Gemini 获取旅行建议,观看视频,查找地图等信息,大大提升了沉浸式体验的便利性。 Android 团队的高管 Guemmy Kim 在简报会上表示,当第一款搭载 Android XR 的头显在年底上市时,用户将能够在几分钟内创建出丰富多彩的假期计划。例如,说出"我想计划一次去夏威夷的旅行",Gemini 便能生成包含航班、酒店和活动建议的完整行程,同时在虚拟环境中展示相关景点的图像和视频。 ## 多设备生态系统的协同发展 这一系列的更新将极大增强 Google 设备之间的互联互通,提升用户的整体体验。Google 产品管理总监表示,Gemini 的多设备部署是该公司"环境计算"愿景的重要组成部分,旨在让用户无论使用什么设备,都能获得连贯一致的AI助手体验。 据悉,Gemini 将首先在高端 Wear OS 设备上推出,包括 Pixel Watch 系列和三星 Galaxy Watch 系列,随后逐步扩展到其他兼容设备。而 Google TV 的 Gemini 集成将通过系统更新逐步推送到所有支持的设备上。 ## 隐私和数据安全考量 针对用户关心的隐私问题,Google 强调,所有 Gemini 功能都遵循严格的数据保护标准。在 Wear OS 等便携设备上,许多基本功能可以在设备本地处理,无需将数据发送到云端。用户还可以通过账户设置随时查看、管理或删除他们的 Gemini 活动历史记录。 期待未来几个月内 Gemini 的正式上线,给我们的生活带来更多便利和乐趣。随着 AI 技术的不断发展,Google 的跨设备 Gemini 助手将为用户创造更加智能、便捷的数字生活体验。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Self-Refine Method Spotlight # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Self-Refine方法再度成为热点:通过自我批评提升LLM输出质量 — 2025/05/16 Self-Refine方法因其通过自我批评与反思显著提升大语言模型(LLM)输出质量,再度成为AI研究热点。这一创新框架让单一LLM通过生成、反馈、优化的循环,自主迭代输出,无需额外训练或外部工具即可实现约20%的性能提升。Self-Refine对包括GPT-4在内的先进模型均有效,引发了开发者与研究者的广泛讨论。 ![self-refine-method](https://static.jxxqtech.com/static/h-aether/news/23-2.png) ## 核心机制:三步循环实现自我优化 Self-Refine的核心在于一个自我循环提示法,通过单一LLM扮演三个角色实现输出优化: 生成初始回答:模型根据输入提示生成初步输出。 自我批评与反馈:模型评估自身输出,识别不足并提供具体改进建议。 基于反馈优化:利用反馈进一步完善输出,循环直至满足预设的"足够好"标准。 Self-Refine无需监督训练数据或强化学习,仅通过提示工程即可实现,极大地降低了应用门槛。测试表明,该方法在代码优化、对话生成、数学推理等七项任务中,平均提升约20%的表现,部分任务(如代码可读性)提升高达40%。社交媒体反馈显示,开发者对其 **简单性** 和 **通用性** 尤为赞赏。 ## 广泛应用:从代码到对话的全能提升 Self-Refine已在多种场景中展现出强大潜力: **代码优化**:通过迭代改进代码结构与逻辑,GPT-4性能提升8.7个单位,代码可读性提升13.9个单位。 **对话生成**:初始对话输出仅25%受人类青睐,经Self-Refine优化后提升至75%。 **文本生成**:在情感分析与故事创作中,输出质量提升21.6个单位,文本更具逻辑性与吸引力。 Self-Refine通过多维度反馈(如情感强度、逻辑清晰度)确保输出符合任务要求。例如,在生成宣传口号时,模型可通过反馈调整语气,使其更具感染力。开源代码进一步降低了开发者的接入成本。 ## 技术优势与局限:依赖基础模型能力 Self-Refine的独特优势在于其自给自足的设计:单一模型完成生成、反馈与优化,摆脱了对外部数据或工具的依赖。这使其特别适合资源受限的场景,如边缘设备或独立开发环境。 然而,社交媒体讨论指出,Self-Refine的性能高度依赖基础模型的能力,较弱的模型(如早期LLM)可能无法有效生成可操作反馈。此外,迭代过程可能引入延迟与计算成本,需权衡质量与效率。 ## 行业背景:自我优化领域的竞争 Self-Refine的发布正值LLM自我优化技术蓬勃发展。CRITIC框架通过外部工具(如搜索引擎)增强自纠能力,而SELF方法则引入自主进化训练,允许模型生成训练数据。Self-Refine以其无训练需求和高通用性在竞争中占据一席之地,尤其受到初创公司与独立开发者的青睐。 然而,内在自纠(仅依赖模型自身能力)的效果在复杂任务中仍有局限,未来可能需结合外部反馈进一步提升。 ## AI自我进化的起点 Self-Refine的成功标志着LLM从被动生成向主动优化的转型。未来Self-Refine可能扩展至多模态任务(如图像与语音生成),或通过与Chain-of-Thought等技术的结合提升复杂推理能力。 然而,模型需克服反馈质量不均与迭代效率的挑战,尤其在实时应用场景中。开源社区的持续贡献将推动其快速迭代与普及。 研究人员表示,随着AI技术的发展,这种自我优化的方法可能成为未来大语言模型标准功能的一部分,进一步提高AI系统的实用性和可靠性。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Apple's Matrix3D Model # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 苹果推出革命性 AI 模型 Matrix3D:轻松将 3 张照片转化为 3D 场景 — 2025/05/16 苹果机器学习团队与南京大学和香港科技大学合作,推出了一款名为 Matrix3D 的先进 AI 模型。该模型的主要功能是从少量的2D 照片中重建真实的物体和场景,为用户提供高质量的3D 输出。这一创新技术将为增强现实、虚拟现实以及元宇宙应用带来全新可能。 ![apple-matrix3d-model](https://static.jxxqtech.com/static/h-aether/news/22-1.png) ## 简化的3D重建流程 用户只需提供三张照片,Matrix3D 便能自动生成详细的3D 重建效果。这一过程不仅简化了3D 建模的操作步骤,也为各类应用领域带来了新的机遇,同时推动了 AI 技术的进一步发展。 在传统的3D 建模中,通常需要使用摄影测量技术,通过多张照片进行测量和建模。然而,目前的流程往往依赖于多个独立模型,例如姿态估计和深度预测,这种分散的方法容易导致效率低下和误差。Matrix3D 则改变了这一传统做法,它将图像、相机参数(如拍摄角度和焦距)以及深度数据等所有环节统一整合,采用一个统一的架构来处理这些信息,减少了中间步骤,从而使得重建过程更加顺畅可靠。 研究人员指出,这种整合设计显著降低了人为错误的风险,并提高了整体性能。通过统一的框架处理所有数据,Matrix3D能够更准确地理解照片之间的空间关系,从而生成更精确的3D模型。 ## 创新的训练方法 在训练方法上,Matrix3D 运用了掩码学习策略,灵感来源于早期的 Transformer 基础 AI 系统。这种技术通过随机隐藏部分输入数据,促使模型学习如何 "填补空白",增强了其适应性。即使在数据集较小或不完整的情况下,Matrix3D 也能够有效学习关键特征。 苹果研究团队特别强调了模型的迁移学习能力,这意味着Matrix3D可以将在一类物体上学到的知识应用到从未见过的新物体上。例如,模型可能在训练时从未接触过特定类型的建筑物,但仍能基于其对通用3D几何结构的理解来生成该建筑物的准确3D模型。 ## 应用前景与实际表现 测试结果显示,Matrix3D 的表现非常出色。用户只需输入三张照片,该模型便可生成精细的3D 重建效果,涵盖物体和整个环境。这为沉浸式技术的应用提供了实质性的潜力。例如,在 Apple Vision Pro 等头显设备中,Matrix3D 能够创建真实感十足的虚拟场景,从而提升用户体验。研究者认为,这种能力将进一步推动元宇宙和增强现实的发展。 除了消费者应用外,Matrix3D还有望在专业领域发挥重要作用。在建筑设计、文物保护、医学成像和城市规划等领域,快速准确的3D重建技术可以大幅提高工作效率。例如,考古学家可以通过几张古文物的照片快速创建其3D模型,而不必依赖昂贵的专业设备。 ## 结合苹果生态系统的未来展望 苹果公司计划将Matrix3D技术整合到其现有的产品生态系统中。未来,iPhone和iPad用户可能能够使用内置的应用程序拍摄几张照片,然后立即生成高质量的3D模型。这些模型可以直接在Apple Vision Pro中查看,或导出用于其他3D应用程序。 专家预测,随着Matrix3D的进一步发展和优化,未来用户可能只需一张照片就能生成完整的3D场景。这将为创意内容创作者、游戏开发者和AR应用开发者提供前所未有的便利,大幅降低3D内容制作的门槛,推动沉浸式内容的普及和创新。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Google AI Training Controversy # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 谷歌承认:即使网站选择退出,仍用搜索数据训练 AI — 2025/05/09 科技巨头谷歌在近日的一场联邦反垄断审判中承认,即使网站出版商明确选择不让其内容用于人工智能模型训练,谷歌仍会利用其搜索引擎收集的数据进行 AI 训练,包括备受争议的 AI Overviews 功能。 这一承认由谷歌旗下人工智能实验室 DeepMind 的副总裁伊莱·柯林斯在作证时做出。司法部律师戴安娜·阿吉拉尔在质询中指出,即使出版商选择不让 DeepMind 使用其数据进行大型语言模型训练,这些相同的数据仍然会被谷歌搜索部门用于其自身的人工智能项目。 ![](https://static.jxxqtech.com/static/h-aether/news/21-1.jpg) 阿吉拉尔援引一份2024年的内部文件显示,谷歌已收集了高达1600亿个文本单元用于人工智能训练。尽管其中一半(800亿个)据称因出版商的选择退出而被删除,但柯林斯的证词表明,这800亿个文本单元仍在谷歌内部用于人工智能训练,只是不再用于 DeepMind。 更令人担忧的是,谷歌为网站提供的唯一阻止其人工智能抓取内容的方法,竟然是彻底从谷歌搜索引擎的索引中移除。对于任何依赖网络流量的网站而言,这几乎等同于“死刑”,根本不构成真正的选择。 谷歌方面暗示,这种做法仅仅是广泛使用的“robots.txt”文件的工作方式所致。该文件用于指示网络爬虫可以访问网站的哪些部分,而这些爬虫既服务于搜索引擎的数据收集,也服务于当前的人工智能训练。谷歌发言人在一份声明中表示,公司通过完善的网络标准 robots.txt,为出版商提供了管理其在搜索中内容的方式。 值得注意的是,去年一名联邦法官已裁定谷歌在搜索引擎市场存在非法垄断,滥用其主导地位排挤竞争对手并抬高广告价格。目前,监管机构正在考虑如何打破这一垄断,可能的措施包括迫使谷歌出售 Chrome 浏览器、禁止其与其他公司签订默认搜索引擎协议,或强制其共享部分数据。 此次审判的新进展进一步凸显了谷歌如何利用其在美国高达90% 的搜索引擎市场份额,通过其人工智能计划实现自身目标。如果网站避免其内容被谷歌人工智能抓取的唯一途径是放弃在谷歌搜索结果中的展示,从而切断与绝大部分网络用户的联系,这无疑为谷歌的垄断行为再添一项证据。教育网站 Chegg 近期也提出了类似的指控,声称谷歌利用其垄断地位迫使其免费提供内容以训练人工智能工具。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Reddit AI Search Assistant # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Reddit在搜索栏中引入AI助手,告别繁琐搜索 — 2025/05/09 随着互联网的发展,搜索引擎似乎变得愈发臃肿,广告和推销内容的增多让用户感到困扰。如今,很多人已经习惯在寻找信息时先选择 “谷歌一下,某某某 Reddit”。这不仅是一种幽默,也反映了人们对 Reddit 这一社区的信赖,因为用户提供的信息往往更为真实和有用。 为了解决这一问题,Reddit 在去年的时候推出了 “Reddit Answers” 功能,这是一种结合人工智能的工具,旨在为用户提供更为简洁的回答。此前,用户只能在 Reddit 特定的区域访问该功能。但近日,Reddit 宣布将把这一 AI 工具整合进主搜索栏中,让用户在搜索时能够更轻松地获取信息。 ![](https://static.jxxqtech.com/static/h-aether/news/20-1.jpg) Reddit 首席执行官史蒂夫・哈夫曼(Steve Huffman)在公司第一季度的财报电话会议上表示:“我们正在努力将其整合到 Reddit 的核心搜索体验中,以进一步简化用户从提问到获得答案的路径。” 这项变革意味着用户只需在主搜索框中输入问题,系统将会提供相应的 “Reddit Answers” 或者更传统的 Reddit 回应,具体取决于搜索内容。 这一看似小小的改动,实际上将显著提升用户的搜索效率。通过省去访问其他页面的步骤,用户能够更快速地找到所需信息。或许在不久的将来,这将改变我们在搜索时的习惯,减少我们同时输入 “Reddit” 一词的需求。 综上所述,Reddit 正通过这一变革,努力为用户提供更优质的搜索体验,而这也让人们对未来的搜索方式充满期待。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Claude's New Features # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Anthropic推出“Integrations”连接应用,Claude新增“高级研究”深挖信息 — 2025/05/09 Anthropic周四发布重大更新,为旗下AI聊天机器人Claude引入全新的应用连接方式“Integrations”,并扩展了“深度研究”功能至“Advanced Research”,使Claude能够搜索网络、企业账户等更广泛的数据源。 ![](https://static.jxxqtech.com/static/h-aether/news/19-1.jpg) “Integrations”和“Advanced Research”目前面向Claude Max、Team和Enterprise计划用户开放Beta测试,Pro版用户也将很快体验到。此外,Anthropic还提高了其AI驱动的编码工具Claude Code的Max用户使用频率限制。 这两项新功能是Anthropic追赶谷歌Gemini和OpenAI ChatGPT等竞争对手的关键举措。据报道,Anthropic的目标是在 2027 年实现 345 亿美元的营收,尽管目前进展良好,但仍有提升空间。 “Integrations”基于Anthropic的MCP协议,该协议允许AI模型从业务工具、内容存储库和应用开发环境等来源获取数据以完成任务。通过MCP,“Integrations”允许开发者创建和托管应用服务器,增强Claude的功能,并方便用户发现和连接这些服务器。Anthropic表示,连接工具后,Claude能更深入地理解用户的工作背景,包括项目历史、任务状态和组织知识,并能在此基础上执行操作。首批合作伙伴提供了Atlassian、Zapier、Cloudflare、Intercom、Square和PayPal等集成,例如Atlassian集成允许Claude在Confluence工作区中汇总和创建页面,而Zapier集成则能将Claude连接到Atlassian的应用自动化工作流。 新增的“高级研究”功能则允许Claude抓取“数百个”内部和外部来源,在 5 到 45 分钟内生成关于特定主题的“更全面”的报告。Anthropic指出,高级研究可以利用Claude新扩展的连接器进行跨集成搜索,并且在使用Claude桌面应用程序时,还能搜索通过MCP连接的本地驱动器。Claude在整合信息时会提供清晰的引文和原始资料链接。 近期,聊天机器人领域涌现出众多深度研究工具,如Gemini、微软Co  pilot和xAI Grok。这些工具的核心是具备“推理”能力的AI模型。Anthropic之前的研究工具速度较快,但结果相对浅显,部分原因在于其未使用推理模型。此次“高级研究”的推出,有望提升Claude在信息深度挖掘方面的能力。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## New Benchmark in Math # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 数学推理新标杆!DeepSeek-Prover-V2 实现数学证明的飞跃 — 2025/05/09 在人工智能领域,最近一项重磅技术发布引发广泛关注 ——DeepSeek-Prover-V2。这一模型不仅在推理性能上取得了显著提升,还被誉为通向人工通用智能(AGI)的关键一步。DeepSeek-Prover-V2在推理能力和训练效率上都进行了革命性的创新,给数学推理研究带来了新的希望。 ![image.png](https://static.jxxqtech.com/static/h-aether/news/18-1.png) DeepSeek-Prover-V2提供了两种不同规模的模型:671B 和7B 参数。特别是671B 参数的版本,其推理性能在 DeepSeek-V3-Base 的基础上得到了显著增强,适用于更复杂的数学问题。而7B 版本则基于 DeepSeek-Prover-V1.5-Base 构建,支持高达32K 的上下文长度,能够处理更为复杂的推理任务。 DeepSeek-Prover-V2的核心在于其训练方法 —— 递归与强化学习的结合。该模型能够将复杂的数学定理拆解为一系列子目标,并通过智能算法选择最优解。在冷启动阶段,DeepSeek-V3会首先提示模型将复杂问题分解为可管理的小目标,随后利用强化学习整合这些小目标的证明,从而形成一个完整的思维链。 该技术不仅提高了数学证明的效率,还揭示了 AI “黑盒” 行为的内在逻辑。通过优化算法,DeepSeek-Prover-V2能够在推理过程中实现更快的计算速度和更高的智能性。这种创新方法预计将推动 AI 领域的重大突破,使得未来的 AI 能够处理更为复杂的数学问题,甚至有可能在几年内达到人类无法理解的高级数学水平。 DeepSeek-Prover-V2还建立了名为 ProverBench 的基准数据集,包含325道题目。其中包括来自 AIME 竞赛的数论和代数题目,以及精选的教科书例题。这一数据集不仅评估高中竞赛和本科阶段的数学水平,更为数学推理的研究提供了丰富的素材。 https://github.com/deepseek-ai/DeepSeek-Prover-V2/tree/main # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AI DJ in Australia # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 澳大利亚电台首创 AI DJ,半年内无人识破真相! — 2025/05/09 澳大利亚知名电台 CADA 近期推出了一位名为 Thy 的 AI DJ,该 DJ 由 AI 语音生成器 ElevenLabs 打造。Thy 自2024年11月开始主持节目《Workdays with Thy》,并在六个月内表现得极为逼真,以至于听众无人察觉他实际上是人工智能。 ElevenLabs 的技术原理十分简单,用户只需上传一段录音,系统便能生成相应的语音模型。随后,用户输入文字,AI 就可以用该声音将文字朗读出来。CADA 利用这一技术,让 Thy 以 “音乐专家” 的身份策划节目,而并未明确告知听众 Thy 的真实身份。 ![电台用AI DJ当主持人: 6 个月无人识破!](https://static.jxxqtech.com/static/h-aether/news/17-1.png) 据悉,Thy 的声音和形象是基于 ARN Media 公司财务部门的一位真实员工,而并非完全虚构的角色。节目上线以来,Thy 已吸引了至少7.2万名听众。然而,这种做法引发了一些争议,澳大利亚配音演员协会的副主席公开批评 ARN Media,认为听众应当享有诚实与透明的信息,而不应该在事后才发现他们收听的节目主持人实际上是 AI。 随着 AI 技术的发展,电台行业似乎进入了一个新的时代。在信息传播日益便捷的今天,听众是否能够接受这样的 “虚拟主持人”,值得进一步思考与探讨。虽然 Thy 成功地为电台节目增添了趣味性,但是否会影响人们对电台的信任度,这也成为一个亟待回答的问题。 在这种背景下,电台如何利用 AI 技术保持竞争力,同时又确保与听众之间的信任关系,将是未来发展的重要课题。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## DeepSeek's New Open-Source Model # 星知 ![logo](https://www.mechlabs.cn/logo.png) # DeepSeek-Prover-V2-671B 模型开源,数学推理领域迎来新突破 — 2025/05/08 中国 AI 初创公司 DeepSeek 再次掀起开源 AI 领域的热潮,正式发布其最新开源模型 DeepSeek-Prover-V2-671B。这一拥有6710亿参数的超大规模语言模型,专为数学推理和问题解决设计,展现了 DeepSeek 在高效 AI 开发上的持续创新能力。根据社交媒体上的最新讨论,这一模型被认为是 DeepSeek 在数学领域的重要里程碑,或将推动全球 AI 研究与应用的进一步发展。 ![](https://static.jxxqtech.com/static/h-aether/news/16-1.png) **模型亮点:专注数学推理,性能卓越** DeepSeek-Prover-V2-671B 是 DeepSeek 针对数学问题解决量身打造的最新力作。社交媒体上流传的信息显示,该模型在复杂数学推理任务中表现出色,能够处理从基础代数到高等数学的广泛问题。这一模型继承了 DeepSeek 一贯的高效设计理念,结合其开源特性,为学术界和开发者提供了强大的工具。 与前代模型相比,DeepSeek-Prover-V2-671B 在参数规模上进一步扩展,同时优化了推理能力和生成效率。据悉,该模型采用了先进的 多头潜注意力(Multi-head Latent Attention, MLA) 架构,通过压缩键值缓存(KV Cache)降低推理过程中的内存占用和计算开销。这种设计不仅提升了模型性能,还使其在资源受限的环境下依然能够高效运行。 **开源战略:推动全球 AI 生态发展** DeepSeek 一直以开源为核心战略,DeepSeek-Prover-V2-671B 的发布延续了这一传统。社交媒体上,开发者们对这一开源举措表示高度赞赏,认为其6710亿参数的规模和开放访问的特性,将显著降低 AI 研究的进入门槛。DeepSeek 的开源模型不仅为学术研究提供了宝贵资源,也为企业开发者在教育、科研和工业应用中提供了灵活的解决方案。 值得注意的是,DeepSeek 的开源举措正在全球范围内引发连锁反应。此前,DeepSeek 的 V3和 R1模型已因其低成本高性能的特点,挑战了 OpenAI 等西方 AI 巨头的市场地位。如今,DeepSeek-Prover-V2-671B 的发布进一步巩固了其在开源 AI 领域的领导地位。 **市场反响:开发者热情高涨** 社交媒体上的反馈显示,DeepSeek-Prover-V2-671B 的发布迅速引发了 AI 社区的热烈讨论。开发者们表示,该模型在数学推理领域的表现令人印象深刻,尤其是在解决复杂证明和优化问题时展现了强大的潜力。有评论指出,DeepSeek 可能正计划通过这一模型“解决所有数学问题”,凸显了其在专业领域的雄心。 此外,DeepSeek-Prover-V2-671B 的发布恰逢 DeepSeek 加速新模型研发的阶段。社交媒体上流传的消息称,DeepSeek 可能在近期推出另一款重磅模型 DeepSeek-R2,进一步扩展其在通用 AI 和专业领域的布局。 DeepSeek 的崛起不仅改变了 AI 开发的成本结构,也重塑了全球 AI 竞争格局。2025年初,DeepSeek 凭借 R1模型以不到600万美元的训练成本,实现了媲美 OpenAI 等公司的高性能表现,引发了市场震动。如今,DeepSeek-Prover-V2-671B 的发布进一步证明了其技术实力和战略眼光。 项目:https://huggingface.co/deepseek-ai/DeepSeek-Prover-V2-671B/tree/main # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Qwen3 Programming Integration # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 通义灵码接入Qwen3:上线编程智能体 集成魔搭MCP广场 — 2025/05/08 通义灵码团队宣布其编程智能体全面支持Qwen3,并上线了全新的编程智能体功能。这一智能体具备自主决策、环境感知和工具使用等能力,能够根据开发者的诉求,使用工程检索、文件编辑、终端等工具,端到端地完成编码任务。此外,通义灵码还支持开发者配置自己的MCP工具,更加贴合开发者的工作流程,并集成魔搭MCP广场,开发者可以一键下载MCP服务。 通义灵码的编程智能体提供了多种会话模式,包括问答模式、文件编辑模式和智能体模式,开发者可以根据不同场景和问题难度自由切换模式,实现工作效率的最大化。该智能体能够自动感知工程框架、技术栈、所需代码文件和错误信息等工程内信息,无需手动添加工程上下文,任务描述更加轻松。此外,它还可以自主使用十多种内置编程工具,例如读写文件、代码查询和错误排查等,同时支持MCP工具配置。 ![](https://static.jxxqtech.com/static/h-aether/news/15-1.png) 在执行编码任务时,通义灵码的编程智能体可以自主决策需要执行的命令,自动完成命令编写并运行终端,大幅提升编码任务的执行效率。它还可以根据开发者的任务描述,自主进行任务拆解和工程内多个代码文件的修改,通过多次对话进行逐步迭代或快照回滚,与灵码协同完成编码任务。此外,该智能体支持基于大模型的自主记忆能力,在开发者与灵码的对话过程中,灵码会逐步形成针对开发者个人、工程、问题等相关的丰富记忆,越用越懂你。 通义灵码搭载了国内首个混合推理模型Qwen3,该模型采用混合专家(MoE)架构,总参数量235B,激活仅需22B。Qwen3在推理、指令遵循、工具调用、多语言能力等方面均大幅增强,登顶全球开源大模型王座。在官方的测评中,Qwen3创下所有国产模型及全球开源模型的性能新高,在奥数水平的AIME25测评中,Qwen3斩获81.5分,刷新开源纪录;在考察代码能力的LiveCodeBench评测中,Qwen3突破70分大关,表现甚至超过Grok3;在评估模型人类偏好对齐的ArenaHard测评中,Qwen3以95.6分超越OpenAI-o1及DeepSeek-R1。 通义灵码支持魔搭社区2400+MCP服务,拓宽能力边界。它支持AI自主调用MCP工具,只需自然语言描述任务,通义灵码即可自主规划并调用相应MCP工具,实现从任务描述到代码生成、环境构建等全过程自动化。此外,它还深度集成了国内最大的MCP中文社区——魔搭MCP广场,涵盖开发者工具、文件系统、搜索、地图等十大热门领域2400+MCP服务,全面拓宽AI编码助手能力边界,更加贴合开发者工作流程。 目前,通义灵码插件下载量超1500万,累计生成超30亿行代码,服务上万家企业。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AIGC Robot Model Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 清华与星动纪元联合发布首个 AIGC 机器人大模型 VPP — 2025/05/08 近日,清华大学叉院的 ISRLab 与北京星动纪元科技有限公司携手推出了首个 AIGC(人工智能生成内容)机器人大模型 ——VPP(视频预测策略)。这一创新成果在2025年国际机器学习大会(ICML2025)上荣获 Spotlight 论文奖,显示出其在全球 AI 研究领域的前沿地位。 ![](https://static.jxxqtech.com/static/h-aether/news/14-2.png) AIGC 技术近年来迅速崛起,从生成式文本模型到视频生成技术,其应用范围不断扩大。而 VPP 的诞生标志着这一技术的应用迈向了具身智能机器人领域。VPP 的独特之处在于其利用了海量互联网视频数据进行训练,使得机器人能够在接收到简单指令后,实时预测未来场景并执行相应动作。例如,用户只需说出 “给我盛一碗热腾腾的鸡汤”,VPP 模型便能让机器人完成这一任务。 根据 ICML2025的统计,今年的 Spotlight 论文评选竞争激烈,投稿总数超过12000篇,而获奖论文仅占2.6%。VPP 通过将视频扩散模型的泛化能力引入机器人操作策略,创新性地解决了传统推理速度的瓶颈,实现了机器人实时预测和动作执行的能力,显著提升了策略的泛化性。 VPP 的学习框架分为两个阶段,首先利用视频扩散模型学习预测性视觉表征,然后通过 Video Former 和 DiT 扩散策略进行动作学习。这种方法使得机器人不仅能快速响应用户指令,还能在不同的人形机器人平台之间自如切换,极大降低了对高质量实机数据的依赖,推动了机器人技术的商业化进程。 在基准测试中,VPP 的表现也令人瞩目。在 Calvin ABC-D 基准测试中,其任务完成平均长度达到4.33,成功率显著高于现有技术,展现出其卓越的性能。此外,VPP 的多任务学习能力也在真实环境中得到了验证,能够完成100多种复杂的灵巧操作任务。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Grok Voice Mode Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Grok语音模式全面上线 马斯克更改X昵称造势 — 2025/05/08 近日,人工智能领域迎来新动态,Grok正式宣布其语音模式已在Grok应用程序中完成全面部署。此次更新面向所有iOS用户以及Android平台的SuperGrok订阅者开放,让更多用户能够体验到这一新功能。 就在Grok语音模式上线之际,特斯拉和SpaceX首席执行官埃隆·马斯克也做出一个引人关注的举动,他将自己在社交平台X上的昵称更改为“groklon rust”,同时还更换了头像。这一行为被外界猜测是在为Grok语音模式的更新进行造势宣传。 ![](https://static.jxxqtech.com/static/h-aether/news/13-1.jpg) Grok的语音模式为用户带来了全新的交互体验。用户可以通过自然语言与人工智能进行对话,这种对话方式更加直观、高效,方便用户获取所需信息。该模式提供了两种不同的声音选项,分别是Ara和Grok,并且支持个性化设置。用户不仅能够自定义相关说明,还可以将自己与Grok的对话内容分享出去。 不仅如此,Grok的语音模式具备强大的学习能力。在与用户的日常互动过程中,Grok会不断分析用户的需求和行为模式,从而持续优化自身的表现,为用户提供更加精准、贴合个人需求的服务。 此前,马斯克旗下的人工智能公司xAI曾宣布,Grok将免费向公众提供服务,不过这一免费政策将持续到服务器无法承受更多用户访问为止。与此同时,X Premium和SuperGrok订阅用户将享有更多特权,其中就包括优先使用Grok的语音模式。这一举措可以看作是对付费用户的一种补偿和激励,鼓励更多用户选择付费订阅服务。 目前,Grok的语音模式提供了多达11种选择,其中包含“Storyteller”(讲故事者)、“Unhinged”(放纵不羁)等模式。在这11种模式中,有2种18+模式——“Unhinged”和“Sexy”格外引人关注。“Unhinged”模式以激烈对喷的交互方式为特点,而“Sexy”模式则凭借调情风格吸引了不少用户。这些多样化的模式让用户能够根据自己的需求和喜好,选择不同风格的AI个性进行互动,极大地增强了互动的趣味性和个性化程度。 此外,Grok还新增了语音字幕功能。这一功能得到了不少用户的好评,甚至被部分用户称赞为学习英语的好工具。通过语音字幕,用户可以更清晰地理解对话内容,对于想要提升英语听力和阅读能力的用户来说,无疑提供了很大的便利。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Midjourney V7 Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Midjourney V7推出全新功能 “Omni-Reference”,让图像生成更灵活 — 2025/05/08 在图像生成领域,Midjourney 近期推出了一项名为 “Omni-Reference”(全向参考)的新功能,为用户带来了更大的创作自由。这一全新图像引用系统不仅是 V6版本中 “角色参考” 功能的升级版,更是赋予用户在创作过程中对图像元素的精准控制。 ![](https://static.jxxqtech.com/static/h-aether/news/12-1.png) **核心功能:全向参考与多元素支持** Omni-Reference通过先进的图像参考系统,为用户提供了前所未有的创作控制力。其主要亮点: 精准元素指定:用户可上传参考图像(如人物、动物、武器或车辆),通过提示明确要求“将此元素放入图像”,生成结果高度匹配参考特征。 多样化支持:支持人物、动物、非人类生物、道具、车辆、物体,甚至整套角色造型或风格元素,适用范围远超V6的角色参考。 多对象生成:支持单张图像包含多个对象(如两个角色)或上传多张参考图像,提示中明确描述即可生成复杂场景。 灵活权重调整:通过“全向权重”(--ow)参数(范围0-1000,默认100)控制参考图像的影响强度,低权重(如--ow25)适合风格转换(如照片转动漫),高权重(如--ow400)确保面部或服装细节高度一致。 生态兼容性:无缝集成个性化(Personalization)、风格化(--stylize)、风格参考(--sref)与情绪板(Moodboards),支持多模态创作。 社区测试显示,Omni-Reference将一张“赛博朋克战士”参考图像与“未来城市”场景结合,生成的人物面部、装备与光影高度一致,细节保留率达90%以上,远超V6角色参考的表现。 **技术架构:V7专属与多模态融合** Omni-Reference作为Midjourney V7的旗舰功能,依托最新的生成模型与图像处理技术。其核心技术包括: V7模型支持:仅在Midjourney V7(需手动切换至V7模式)上运行,结合235B参数模型(推测)提升图像细节与提示遵循度,优于V6.1的默认设置。 多模态参考系统:通过CLIP-ViT与潜在扩散模型(LDM)解析参考图像,提取人物、物体或风格特征,支持跨模态生成(如实拍转插图)。 动态权重控制:Omni-Weight(--ow)基于注意力机制动态调整参考影响,结合--stylize与--exp参数优化风格与表现力,避免高权重下的质量下降。 多对象解析:利用分割模型(如SAM)与多提示权重(--iw、--sref URL1::2)处理复杂场景,确保多个参考对象在生成图像中的准确呈现。 MCP潜力:支持Model Context Protocol(MCP),未来可与Qwen-Agent或F-Lite集成,扩展至动态场景生成与工具调用。 Omni-Reference的多对象支持与权重调整使其超越了Gen-4References的静态图像混合,其与V7模型的深度融合进一步巩固了Midjourney在AI图像生成领域的领先地位。 **应用场景:从艺术创作到商业设计** Omni-Reference的强大功能使其在多种场景中展现出广泛潜力。其主要应用: 叙事艺术与影视:生成一致性角色(如“科幻电影中的机器人”)或物体(如“中世纪剑”),适配故事板设计与概念艺术,助力Unity或Blender工作流。 游戏开发:快速生成统一风格的角色、道具或场景(如“RPG游戏中的龙与城堡”),缩短资产制作周期,适合独立开发者与AAA工作室。 广告与电商:将产品(如手表)或品牌Logo融入多样化场景(如“沙漠日落”),提升Shopify或Instagram营销视觉吸引力。 数字艺术与NFT:创作一致性角色或风格化物体(如“蒸汽朋克飞船”),适配OpenSea等平台,满足收藏家需求。 教育与虚拟现实:生成历史场景(如“古罗马战士与战车”)或VR交互对象,增强教学与沉浸式体验。 社区案例显示,一位艺术家利用Omni-Reference将“蒸汽朋克机械狗”与“维多利亚时代街道”结合,生成的图像保留了机械细节与环境氛围,创作时间缩短约60%。Omni-Reference与Genie2的3D环境生成结合,或可扩展至实时交互内容创作。 **上手指南:快速部署与创作** Omni-Reference现已通过Midjourney V7(需Standard或Pro订阅)在Web与Discord平台开放,暂不支持Fast Mode、Draft Mode或Vary Region(V6.1)。用户可按以下步骤上手: 切换V7模式:在Midjourney Web界面(midjourney.com)设置中选择V7,或在Discord输入--v7。 上传参考图像:Web界面点击Imagine Bar的图像图标,拖拽PNG/JPEG图像至“Omni-Reference”区域;Discord输入--oref <图像URL>(需先上传至Discord或Imgur)。 设置提示与权重:输入描述性提示(如“战士持剑站在雪山,赛博朋克风格”),添加--ow100(默认)或调整至25-400,结合--sref或--stylize增强风格。 多对象生成:上传含多个对象的图像或多张图像,在提示中明确描述(如“战士与龙”),确保对象特征清晰。 优化与反馈:若细节丢失,增加--ow(如400)或补充提示描述;开发者可通过Hugging Face社区(huggingface.co/midjourney)提交反馈。 社区建议为风格转换使用低权重(--ow25)并强化提示描述(如“动漫风格,蓝发”),高权重(--ow400)适合精确复制面部或服装。Omni-Reference不支持精细细节(如特定雀斑或Logo),需通过提示补充,且测试阶段可能存在不稳定性,建议关注Midjourney更新。 **社区反响与改进方向** Omni-Reference发布后,社区对其一致性与多元素支持给予高度评价。开发者称其“将AI图像生成的一致性推向新高度,简化了复杂场景创作”,尤其在叙事艺术与游戏开发中的表现被认为是“颠覆性突破”。 然而,部分用户反馈多对象生成可能出现细节混淆,建议增强分割精度。社区还期待支持Niji6(动漫模型)、视频生成与实时3D兼容性。Midjourney回应称,Omni-Reference将每周迭代,计划优化多对象解析与细节保留,未来或支持Draft Mode与视频生成。Omni-Reference可能与Claude的语音模式或NIM Operator2.0的微服务整合,构建从创作到部署的闭环生态。 **未来展望:AI艺术创作的里程碑** Omni-Reference的推出标志着Midjourney在图像生成一致性与用户控制力上的重大飞跃。其多元素支持与V7生态集成不仅挑战了F-Lite与Gen-4References的生成灵活性,还通过开源社区的反馈机制加速了技术迭代。社区已在探讨将其与MiMo-7B的推理能力或Genie2的3D生成结合,构建从静态图像到交互世界的综合平台。长期看,Omni-Reference可能演变为“AI创作市场”,提供共享参考模板与API服务,类似Hugging Face的生态模式。期待2025年Omni-Reference在视频支持、多模态交互与低资源优化上的突破。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AI Protein Design Revolution # 星知 ![logo](https://www.mechlabs.cn/logo.png) # AI生物大模型ProGen3:重新定义蛋白质设计的未来 — 2025/4/25 在生命科学的前沿,AI技术正在引发一场革命。最近,生物计算公司ProFluent推出了ProGen3,这是一款强大的生成式蛋白质语言模型(PLM),它有望在抗体研发、工业酶合成及基因编辑技术领域带来重大突破。研究显示,ProGen3的规模和设计优化能够生成功能强大的新型蛋白质,甚至重塑我们对生物学基本构建模块的理解。 ![ai-biology-model-progen3](https://static.jxxqtech.com/static/h-aether/news/11-1.jpg) ## 蛋白质设计的关键挑战 蛋白质是生命体内的关键分子,负责多种生理功能。从催化生物化学反应到识别入侵病原体,它们的作用不可小觑。然而,设计全新的氨基酸序列以实现自然界中未曾出现的功能,如新型药物或超稳定的工业酶,一直面临巨大挑战。传统的蛋白质设计方法往往依赖于现有结构的修改,创新空间有限。ProGen3的出现,为解决这一根本性问题提供了全新思路。 ## 突破性的数据基础 ProGen3的训练数据来自一个名为Profluent Protein Atlas v1的庞大数据集,该数据集包含34亿个全长蛋白质和1.1万亿个氨基酸标记,成为目前业内最全面的蛋白质数据集之一。研究表明,随着模型规模的扩大,ProGen3能够生成更为多样化且功能真实的蛋白质序列。例如,ProGen3-46B生成的蛋白质多样性比小型模型高出近两倍,显示出更广泛的生物学应用潜力。 ProFluent的研究团队采用了创新的训练方法,使模型能够理解蛋白质序列中的长距离依赖关系和复杂的空间构型信息,这是此前蛋白质语言模型的主要局限所在。通过整合序列数据与结构信息,ProGen3能够在理解生物学原理的基础上,提出符合物理化学规律的创新设计。 ## 实际应用中的优异表现 在实际应用验证中,研究团队通过ProGen3设计了一系列高质量的抗体。这些抗体不仅在亲和力、稳定性、可溶性等多项关键属性上与已获批准的临床药物相当,还展现出了优越的可开发性,挑战了传统抗体设计的技术限制。此类"从零设计"的能力为解决困扰制药行业的靶点可成药性问题提供了新的可能性。 更为引人注目的是,研究团队还利用ProGen3开发出一种紧凑型的基因编辑器,仅由592个氨基酸组成,远小于目前主流CRISPR系统的体积,同时保持了精准的基因编辑能力。这一成果不仅验证了ProGen3在设计复杂功能蛋白方面的能力,也为基因治疗领域提供了潜在的技术突破,特别是在递送系统容量有限的情况下。 ## 未来展望 ProGen3的推出标志着蛋白质设计领域进入了一个由AI驱动的新时代。ProFluent的研究者们认为,随着计算资源的进一步提升和数据集的持续扩充,这类模型的能力还将获得显著提升。在不远的将来,我们有望看到更多AI设计的生物分子在药物研发、酶工程、生物材料和可持续工业生产等领域发挥关键作用。 值得注意的是,ProFluent公司已宣布将为学术研究提供有限访问ProGen3的途径,这种开放态度有望加速整个生命科学领域的创新步伐,让更多研究人员能够借助AI工具探索生物学的未知领域。随着技术的进一步成熟,我们或许将见证由AI启发的全新生物学范式的诞生。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Grok Major Update # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Grok大更新!视觉能力、多语言音频处理与实时搜索功能震撼上线 — 2025/4/25 由xAI打造的生成式人工智能聊天机器人Grok迎来了一次里程碑式的更新,其功能全面升级,不仅新增了视觉处理能力,还实现了多语言音频处理以及语音模式下的实时搜索功能。这一更新标志着Grok在多模态AI领域的重大突破,为用户提供了更智能、更便捷的交互体验。以下将详细解析此次更新的亮点与意义。 ![grok-major-update](https://static.jxxqtech.com/static/h-aether/news/10-1.png) ## 视觉能力突破 Grok的视觉处理能力是此次更新的核心亮点之一。尽管早在2024年4月,xAI曾宣布Grok-1.5Vision(Grok-1.5V)具备处理文档、图表、截图和照片等视觉信息的能力,但该版本从未向公众开放。如今,Grok的视觉功能正式上线,用户可以通过上传图片,让Grok分析复杂视觉内容,例如解读数据图表、识别物体或将视觉信息转化为可执行代码。这不仅提升了Grok在实际场景中的应用价值,还使其在空间理解和视觉推理任务中表现出色,特别是在RealWorldQA基准测试中展现了领先优势。 值得一提的是,Grok的视觉能力与其实时数据获取功能结合,能够进一步增强其在新闻分析、社交媒体内容解读等场景中的表现。例如,用户可以上传一张新闻图片,Grok即可结合X平台上的实时信息,提供背景分析与事件解读。 ## 多语言音频处理:145+种语言的语音交互新体验 Grok的多语言音频处理功能同样令人瞩目。通过集成"VoiceWave"扩展,Grok现支持145种以上语言的实时语音交互,包括英语、西班牙语、法语、日语、汉语、土耳其语和印地语等,覆盖全球主要语种。这一功能不仅实现了自然流畅的语音对话,还支持语音转文本、语音重放以及同步文本高亮显示,极大提升了用户体验。 对于需要跨语言沟通的用户而言,Grok的多语言音频处理无疑是一大福音。无论是学习新语言、处理多语言客户服务,还是进行国际化的内容创作,Grok都能以原生发音和可调节的语速与语调,提供个性化语音响应。据悉,该功能已通过Chrome Web Store的扩展程序实现,用户可通过简单的语音指令激活并自定义交互设置。 ## 语音模式实时搜索:DeepSearch赋能即时信息获取 Grok在语音模式下新增的实时搜索功能,进一步巩固了其作为"真相探寻者"的定位。依托DeepSearch技术,Grok能够通过语音指令即时从网络和X平台获取最新信息,生成准确、详尽的回答。相比传统的文本输入,语音搜索让用户能够更快速地获取实时趋势、新闻动态或热点话题的洞察。 例如,当用户询问"最近的科技新闻"时,Grok不仅能以语音形式快速回应,还能引用X平台上的最新帖子和网络资源,确保信息的时效性与可信度。此外,DeepSearch的透明推理过程允许用户查看Grok的逻辑推导步骤和来源文档,进一步提升了信息的可信度。 ## 功能背后的技术支撑:Colossus超算与强化学习 此次更新的成功离不开xAI在技术层面的持续投入。Grok3的训练依托Colossus超级计算机,配备20万个NVIDIA H100GPU,计算能力是前代模型的10倍。这使得Grok在处理复杂任务时速度更快、准确性更高,特别是在需要多模态融合的场景中表现出色。 此外,Grok3通过大规模强化学习(RL)优化了其推理能力,能够在几秒到几分钟内完成错误纠正、方案探索和答案生成。这种"像人类一样思考"的能力,让Grok在数学、科学和编码等领域的基准测试中,超越了包括GPT-4o、Gemini1.5和Claude3.5Sonnet在内的多个竞品模型。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AvatarFX Model Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Character.AI发布AvatarFX模型:让静态人物图像栩栩如生地"开口交谈" — 2025/4/25 Character.AI日前正式推出创新视频生成模型AvatarFX,这项突破性技术能将静态图像转换为具有高度真实感的会说话视频角色,为图片中的人物赋予动态表情、精准的唇形同步及自然的肢体动作。 ![character-ai-launches-avatarfx-model-making-static-images-of-people-talk](https://static.jxxqtech.com/static/h-aether/news/9-1.jpg) ## 先进扩散模型驱动的动态生成技术 AvatarFX的核心是其尖端的基于扩散模型的动态生成引擎。该技术依托经过严格筛选的高质量数据集进行训练,融合了创新的音频条件化处理、知识蒸馏和优化推理策略,使得用户能够以极高的处理速度生成高保真、时间连贯性强的视频内容。无论是处理长序列的叙事场景,还是构建多个角色之间的复杂对话,AvatarFX都能够完美应对,带来令人惊艳的视觉体验。 ## 多样化音频选择,提升沉浸式体验 为了增强用户的互动体验,AvatarFX特别集成了丰富的音频功能选项。无论是清晰的男声、柔和的女声,还是各种风格化的声音类型,用户都可以根据创作需求自由搭配,定制专属的角色声音特征。这种多元化的选择方案,使故事叙述更加生动感人,大幅提升内容的吸引力与感染力。 在技术快速迭代发展的同时,AvatarFX团队也高度重视用户的安全体验。平台内置了全面的安全控制措施与内容审核机制,确保用户在创作过程中不会接触到任何不当或有害内容。通过对生成工具的严格监控与全面审核,AvatarFX致力于为每位创作者提供一个安全、健康的创意环境,让所有用户都能放心表达自己独特的想法与故事。 ## 简便直观的用户操作流程 AvatarFX的使用方式设计得极为简洁直观。创作者只需上传一张角色的初始图片,并配置相应的音频素材,系统便能立即生成一段栩栩如生的交互视频。平台完全支持多角色参与和连续对话场景,用户可以充分发挥想象力,构建丰富多彩的互动叙事体验。 想要亲身体验AvatarFX带来的创新视觉表达方式?用户可以直接访问Character.AI官方网站,亲自尝试这一突破性的交互叙事工具。无论是应用于个人创意项目、社交媒体内容制作,还是教育培训演示,AvatarFX都能提供卓越的便捷性和无限的创意可能。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Ostris Flex.2-preview Release # 星知 ![logo](https://www.mechlabs.cn/logo.png) # Ostris推出Flex.2-preview:8B参数扩散模型引领ComfyUI工作流新革命 — 2025/4/25 Ostris团队近日发布Flex.2-preview,这是一款搭载8亿参数的文本到图像扩散模型,专为ComfyUI工作流量身定制。据专业分析,该模型在基于线条、姿态和深度的精确控制生成方面表现卓越,同时支持通用控制与高级图像修补功能,沿袭了从Flux.1Schnell经OpenFlux.1到Flex.1-alpha的精细微调进化路径。值得一提的是,Flex.2-preview已在Hugging Face平台完全开源,采用开放的Apache2.0许可协议并提供灵活的工作流整合能力,迅速成为AI创意社区关注焦点。 ![ostris-releases-flex-2-preview](https://static.jxxqtech.com/static/h-aether/news/8-1.png) **核心功能:通用控制与工作流无缝整合** Flex.2-preview凭借其强大的控制能力与原生ComfyUI支持,重新定义了文本到图像生成的工作方式。其主要功能亮点包括: • 综合控制系统:内置线条(Canny)、姿态与深度控制功能,允许创作者通过控制图像精确引导生成结果,如基于深度图生成立体感场景或基于线稿创建精细插图 • 先进图像修补技术:支持高质量区域修补,用户可通过掩码指定特定区域进行内容替换或修复,例如将图中的狗替换为"白色机器人犬坐在长凳上" • ComfyUI工作流融合:模型针对ComfyUI平台优化设计,提供完整的节点化工作流支持,简化复杂任务配置,如文生图、图生图与控制网络的协同组合 • 高效率生成能力:基于精简的8亿参数架构,生成1024x1024高清图像仅需50步推理过程,适合配备16GB显存的消费级GPU运行 专业测试显示,用户利用Flex.2-preview的控制节点成功生成了一幅"赛博朋克城市夜景",通过深度图与线条控制实现了高度一致的构图效果,充分展示了该模型在创意设计领域的巨大潜力。 **技术架构:从Flux.1Schnell到Flex.2的演进历程** Flex.2-preview基于Black Forest Labs开发的Flux.1Schnell基础,经历了多阶段精细微调与性能优化。其技术演进包括: • 架构精简:继承Flux.1的整流流变换器(Rectified Flow Transformer)架构,采用8个双变换器块设计(相比Flux.1-dev的19个更为轻量),通过专用指导嵌入器(Guidance Embedder)消除了对传统分类器自由引导(CFG)的依赖 • 控制与修补系统整合:采用16通道潜在空间设计,结合噪声潜在表示、VAE编码的修补图像、掩码与控制输入信号,共计49个输入通道,支持高度灵活的控制与修补工作流 • 开源与自定义训练:通过AI-Toolkit提供完整微调工具集,开发者可绕过指导嵌入器进行定制化训练,生成特定风格或主题的模型变体,同时保留Apache2.0许可的商业友好特性 • 推理性能优化:支持FP8与bfloat16精度运算,通过TorchAo的8位量化技术显著降低内存占用,有效提升在RTX3090等主流硬件上的推理速度 Flex.2-preview的轻量级设计与通用控制能力使其成为ComfyUI生态系统的理想选择,相较于Flux.1Schnell在复杂工作流中展现出更高的灵活性与适应性。 **应用场景:从艺术创作到商业设计的全方位覆盖** Flex.2-preview的多功能特性使其适用于广泛的创意与商业应用场景: • 数字艺术与插画创作:艺术家可通过线条与深度控制快速生成概念艺术或精细插图,特别适合游戏美术设计与动画预可视化 • 品牌广告设计:利用图像修补功能高效调整广告素材,如替换产品元素或背景环境,同时保持整体品牌视觉一致性 • 影视内容制作:支持基于姿态控制的角色设计与场景构建,加速故事板创作与视觉效果开发流程 • 教育与产品原型设计:为教学演示或产品概念提供低成本高效率的图像生成方案,使学生与初创企业能够快速迭代视觉创意 用户反馈显示,Flex.2-preview在处理复杂提示词(如"蒸汽朋克机械师在工厂修理机器人")时,生成图像的细节表现与控制精准度明显超越OpenFlux.1,特别是在人物手部与文本元素生成方面接近专业商业模型水平。其与XLabs的ControlNet无缝集成能力进一步扩展了工作流的多样性与创作可能。 **上手指南:快速部署与ComfyUI集成方法** Flex.2-preview的部署过程对ComfyUI用户非常友好,硬件建议配置为16GB显存(推荐RTX3060或更高规格显卡)。开发者可通过以下步骤快速上手: 1\. 从Hugging Face下载Flex.2-preview.safetensors模型文件(huggingface.co/ostris/Flex.2-preview),放置于ComfyUI/models/diffusion\_models/目录 2\. 确保ComfyUI已更新至最新版本(可通过ComfyUI Manager的"Update All"功能),并安装必要的CLIP模型(t5xxl\_fp16.safetensors与clip\_l.safetensors)与VAE编码器模型(ae.safetensors) 3\. 下载官方提供的flex2-workflow.json工作流配置,拖入ComfyUI界面加载预设工作流,配置提示词与控制图像(如深度图或线条稿) 4\. 运行推理过程,根据需要调整control\_strength参数(推荐值0.5)与guidance\_scale参数(推荐值3.5),生成1024x1024分辨率图像 专业用户建议使用Diffusers官方示例代码或ComfyUI的Flex2Conditioning节点以获得最佳生成效果。首次运行时需确保已安装torch、diffusers与transformers等基础库,并验证工作流中的节点连接完整性。 **性能对比:超越前代与同类产品** Flex.2-preview在性能表现上显著优于其前代模型OpenFlux.1与Flux.1Schnell。与主流扩散模型的对比结果如下: • 图像质量评估:在VBench标准测试中,Flex.2-preview的CLIP评分(0.82)接近Flux.1-dev(0.84),明显优于Flux.1Schnell(0.79),尤其在手部细节处理与复杂场景构图方面表现更为出色 • 控制精度测试:结合XLabs ControlNet使用时,Flex.2在Canny边缘检测与深度控制任务中的一致性指标超越InstantX的Flux.1-dev-Controlnet-Union-alpha约8个百分点 • 推理速度对比:生成1024x1024分辨率图像(50步采样)平均耗时20秒(RTX3090显卡,FP8精度),比Flux.1-dev快约15%,特别适合需要快速迭代的创作场景 • 资源占用情况:8亿参数规模与FP8量化技术使其内存需求仅为Flux.1-dev的60%左右,更加适合普通消费级硬件环境运行 Flex.2-preview的性能平衡性使其在开源模型生态中占据独特位置,尤其适合需要高精度控制能力与快速生成效率的专业工作流程。 **社区反响与未来改进方向** Flex.2-preview发布后,创作社区对其灵活控制能力与开源精神给予高度评价,开发者称赞其"将ComfyUI工作流潜力发挥到极致",特别是在艺术创作与图像修补任务中的表现令人印象深刻。 然而,部分专业用户反馈指出,模型对高度复杂提示词的语义理解仍有提升空间,建议进一步增强T5编码器的提示处理能力。社区还期待Flex.2能够支持视频序列生成与更广泛的ControlNet整合功能(如精确姿势估计)。 Ostris开发团队已回应这些建议,表示下一版本将优化多模态提示处理机制并引入动态阈值调整技术,进一步提升生成结果的稳定性与一致性。业内预测,Flex.2系列有望与Hailuo Image处理引擎或混元3D渲染系统的控制模块结合,构建更为完整的跨模态创作生态。 **未来展望:开源AI艺术创作的持续进化** Flex.2-preview的发布充分展示了Ostris团队在开源AI图像生成领域的创新能力。其从Flux.1Schnell到Flex.2的技术演进路径展现了社区驱动开发模式的巨大潜力,尤其是在ComfyUI生态系统中的深度整合能力为创作者提供了无限可能性。 随着AI-Toolkit工具集的持续迭代,Flex.2系列有望成为微调定制与个性化生成的行业标准模型。创新社区已在积极探讨将其与MCP协议框架结合,构建统一的AI艺术工作流标准,类似RunComfy这样的在线平台或将进一步降低使用门槛。 业界期待Flex.2在2025年推出的正式版本能在多分辨率支持与实时交互生成方面取得突破性进展,为开源AI艺术创作工具生态带来新一轮革新。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Claude and WeChat Integration # 星知 ![logo](https://www.mechlabs.cn/logo.png) # mcp-server-weread开源工具实现Claude与微信读书无缝连接,推动阅读体验与人工智能深度结合 — 2025/4/25 近期,创新工具mcp-server-weread在Twitter平台引起广泛关注与讨论。这款实用工具成功打通了Anthropic旗下Claude人工智能与微信读书平台之间的数据壁垒,使用户能够直接在AI环境中访问并充分利用微信读书的笔记和阅读数据,为知识工作者和阅读爱好者带来了全新的交互体验。 ![mcp-server-weread](https://static.jxxqtech.com/static/h-aether/news/7-1.jpg) ## mcp-server-weread:构建微信读书与Claude的智能桥梁 作为一款开源工具,mcp-server-weread旨在消除微信读书数据与先进AI系统之间的隔阂。该工具通过在本地环境建立专用服务器,允许用户将微信读书中积累的笔记、划线内容及个人评论以结构化形式无缝导入Claude智能助手。 Claude凭借其强大的自然语言处理能力,能够基于这些导入数据进行深度内容分析、生成精准摘要,甚至提供个性化的知识洞察。例如,用户可轻松将特定书籍的阅读笔记传输至Claude,请求AI生成系统化读书总结、提炼核心观点,或与个人已有知识体系进行智能关联。相较于传统的手动复制粘贴操作,mcp-server-weread极大提高了知识处理效率,同时确保了数据的完整性与用户隐私安全。 值得一提的是,Twitter社区对该工具的评价高度集中在"操作简便"与"自定义性强"两大特点,开发团队还提供了详尽的部署指南,有效降低了技术实施门槛。 ## 功能亮点:从数据智能提取到AI深度互动 mcp-server-weread的核心竞争力在于其功能的全面性与与Claude的深度整合。根据Twitter上用户分享的体验,该工具主要包含以下几项突出优势: • 智能数据同步:支持按需或定时从微信读书自动拉取最新笔记和阅读数据,无需人工导出操作,确保信息时效性 • 精准结构化处理:将笔记、划线和评论按照书籍、章节等多维度科学整理,便于Claude进行精确分析和理解 • 完善隐私保护机制:数据处理全过程在用户本地服务器完成,避免敏感信息外泄风险 • 多样化AI互动场景:用户可通过Claude实现笔记智能总结、跨书内容比对、主题自动提取,甚至结合外部知识库生成深度分析报告 Twitter平台上,一位资深用户分享了其实际应用案例:通过mcp-server-weread,他将《原则》一书的阅读笔记导入Claude系统,AI不仅生成了条理分明的内容摘要,还基于笔记内容提出了与其个人工作情境紧密结合的实用建议。这种创新的"阅读+AI"模式,正在重新定义知识管理的效率与深度。 ## 应用场景:知识管理与效率提升的新范式 mcp-server-weread的出现,为多个用户群体提供了显著的实用价值。根据用户反馈分析,以下人群尤其受益: • 学术研究者与学生:快速整理阅读笔记,形成系统化的学习资料 • 职场专业人士:高效提炼书籍精华,将理论与实践工作紧密结合 • 内容创作人员:基于读书笔记生成灵感,辅助内容创作过程 • 技术爱好者:探索AI与知识管理的创新融合方式 许多用户已经将mcp-server-weread与其他知识管理工具(如Obsidian或Notion)进行了灵活整合,打造出高度个性化的知识处理系统。这种开放式的工具生态进一步扩展了其应用潜力与价值空间。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## DAMO PANDA FDA Approval # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 阿里达摩院AI模型DAMO PANDA荣获FDA"突破性医疗器械"认证,解决胰腺癌早期检测难题 — 2025/4/18 ![](https://static.jxxqtech.com/static/h-aether/news/6-1.jpg) 阿里巴巴人工智能模型DAMO PANDA日前获美国食品药品监督管理局(FDA)授予"突破性医疗器械"认证,标志着阿里巴巴在智能医疗领域取得重大突破,也是中国领军科技企业首获此项国际权威认可。 DAMO PANDA由阿里达摩院自主研发,专注于胰腺癌早期筛查,通过先进算法精确分析CT图像中的微小病变,有效识别早期胰腺癌征兆。众所周知,胰腺癌因初期症状隐匿,一直被视为医学界难以攻克的难题,传统影像学检查对早期微小病灶的发现能力有限。而DAMO PANDA借助深度学习技术,能在普通CT扫描中准确捕捉并标识病灶,即使是极早期的细微病变也难以逃过其"法眼"。 这一创新AI模型的成功研发与应用,预计将极大提升全球胰腺癌早期检出率,及时发现高风险人群,为医生提供更早干预的可能性。阿里巴巴在此领域的重大突破不仅填补了国际医学研究的空白,更推动了人工智能技术在医疗健康领域的深度融合,展现了中国科技企业在国际医疗技术创新赛道上的领先水平。 FDA对DAMO PANDA的权威认定,既是对该技术先进性和安全性的高度肯定,也为其在全球医疗市场的广泛应用奠定了坚实基础。随着这项尖端技术的逐步推广与普及,未来有望为全球胰腺癌患者的早期发现与治疗带来革命性变革。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Doubao 1.5 Released # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 字节重磅推出豆包1.5深度思考大模型:融合多模态能力,推理延迟更低 — 2025/4/18 ![](https://static.jxxqtech.com/static/h-aether/news/5-1.jpg) 4月17日,在火山引擎AI创新巡展杭州站活动中,字节跳动旗下火山引擎总裁谭待隆重发布豆包1.5・深度思考模型。此次发布会吸引了大量行业专业人士关注,谭待在现场详细展示了该模型在多个应用场景的卓越表现。 据官方介绍,豆包1.5模型在数学计算、代码编程、科学推理等专业领域,以及创意文案写作等任务中,均展现出非凡能力。这款全新模型采用了MoE(混合专家)技术架构,总参数规模达到200亿,而实际激活参数仅为20亿,显著低于行业内同类模型的参数体量,因此在推理运算成本方面也具备明显竞争优势。 在发布会上,谭待全面介绍了豆包1.5深度思考模型的多项强大功能,特别是结合视觉理解技术提供的丰富应用场景。这些功能不仅可通过照片智能分析地理地貌特征,还能在用户旅行时辅助点餐选择,甚至帮助企业高效生成项目管理流程图,大幅提升各类场景下的使用体验。 此外,火山引擎还同步对豆包文生图模型进行了3.0版本全面升级。此次更新带来更精美的文字排版效果、更细腻的图像生成质量,以及直接输出2K高清图片的能力,为用户提供更加丰富多样的视觉创作体验。 更值得关注的是,新版本模型的视频内容搜索能力获得显著提升,用户在进行信息查询时,系统能够精准定位视频中的相关内容并快速提取答案。这一智能功能极大提高了用户获取信息的效率与便捷性。 根据谭待的官方数据披露,豆包大模型的使用规模正以惊人速度增长。截至2025年3月,豆包大模型日均tokens使用量已突破12.7万亿,相较于产品发布初期,增长幅度高达106倍。这一亮眼数据充分反映了豆包模型在市场中的广泛认可与强大影响力。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AI Music Revolution # 星知 ![logo](https://www.mechlabs.cn/logo.png) # AI音乐新纪元:Deezer平台近两成新曲出自人工智能之手 — 2025/4/18 ![](https://static.jxxqtech.com/static/h-aether/news/4-1.jpg) 根据法国音乐流媒体巨头Deezer最新发布的数据报告,该平台约18%的新上传音乐作品完全由AI创作,清晰呈现出人工智能在音乐创作领域的迅猛崛起。统计显示,每日有超过20,000首AI生成曲目涌入平台,几乎是四个月前数量的两倍之多。 Deezer创新主管Aurelien Herault表示,AI生成内容持续大量涌入流媒体平台且无减缓迹象。他进一步透露,公司已于今年一月推出专门检测工具,能有效筛选纯AI创作内容,确保在面向970万用户的推荐算法中过滤这类作品。 然而,随着AI技术在创意产业的迅速扩张,相关法律纠纷也随之增多。众多艺术家、创作者及版权持有方指责AI企业在未获授权且未提供补偿的情况下,擅自使用受版权保护的作品训练其模型。音乐创作工具Suno与Udio已成为法律诉讼的焦点,环球音乐集团、华纳音乐集团及索尼音乐等全球音乐巨头均对这些AI创业公司提起大规模版权侵权诉讼,指控它们在训练AI系统时未经许可使用其录音作品。 Deezer的检测技术能够精准识别来自Suno和Udio的输出内容,进一步保障艺术家权益。同时,包括比莉・艾利什、妮琪・米娜和史蒂夫・旺达在内的数十位知名音乐人,曾于去年联合发表公开信,强烈警告基于其作品训练的AI音乐系统可能"摧毁创作性",并使人类艺术家面临被边缘化的风险。 这种争议不仅局限于音乐行业,AI的广泛应用同样在好莱坞及电影制作领域引发热议。今年奥斯卡颁奖典礼上,围绕AI技术在多部提名影片制作与增强过程中的应用,已引发激烈讨论。值得一提的是,2023年好莱坞编剧与演员群体曾发起规模空前的罢工行动,要求加强对AI使用的限制与保护措施。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## AI Empowers Healthcare Innovation # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 人工智能赋能医疗行业革新:Hellocare.ai、SignalFire等企业获得巨额融资支持 — 2025/4/18 ![](https://static.jxxqtech.com/static/h-aether/news/3-1.jpg) 近期,健康科技领域涌现多笔重磅投资,彰显人工智能在医疗范畴的迅猛发展与广泛落地。其中,知名早期风投机构SignalFire成功募集10亿美元资金,专注扶持以AI为核心的创业项目。这笔资金注入使SignalFire的管理资产规模达到30亿美元,凸显了其在行业中的领导地位。 SignalFire的投资组合涵盖多家医疗创新企业,包括Grow Therapy与Health Gorilla等。该机构借助其独特的机器学习平台Beacon AI,分析亿万用户数据,捕捉市场动向并发掘新锐人才。SignalFire创始人兼CEO Chris Farmer表示,当越来越多传统风投机构转向后期投资时,SignalFire坚持在早期阶段给予AI创始人全方位支持,助力他们实现快速成长。 与此同时,Hellocare.ai也在融资浪潮中脱颖而出,该公司刚刚斩获4700万美元资金,致力于开发人工智能驱动的远程医疗解决方案。其技术已在70余家医疗系统中成功部署,支持远程护理、虚拟会诊等多种服务模式。Hellocare.ai领导层指出,其全面整合的技术架构结合AI与灵活的临床团队模式,能够大幅提升医疗服务的效能与品质。 此外,其他几家创新企业也获得了显著融资支持,包括Thatch(4000万美元)、Silna Health(2700万美元)和Layer Health(2100万美元)。Thatch专注于帮助企业提供定制化健康报销计划,使员工能够自主选择合适的医疗保险方案;Silna Health则利用人工智能技术简化医疗账单管理流程,大大提高了服务效率;Layer Health则致力于通过AI优化医疗记录审核工作,提升临床决策的准确性与速度。 随着这些前沿技术的不断涌现与应用,医疗行业正快速迈向更加智能化、精准化和个性化的服务新时代。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## MindGPT 3.0 Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 理想同学MindGPT 3.0震撼发布:深度思考能力与DeepSeek比肩 — 2025/4/18 ![](https://static.jxxqtech.com/static/h-aether/news/2-1.jpg) 近日,理想汽车宣布旗下智能伴侣"理想同学"进行重大更新,搭载的MindGPT3.0模型全面升级并向用户开放使用。此次提升不仅标志着理想汽车在人工智能领域取得又一重大突破,还为广大车主提供了更为智能、便捷的交互体验。 据官方透露,MindGPT3.0模型在性能方面实现了突破性进展,其深度思考能力尤为突出。该模型性能可与业内顶尖的DeepSeek-V3-0324(短思维链)及DeepSeek-R1(长思维链)相媲美,展现了理想汽车在AI领域的强大技术实力。用户现可通过理想同学手机应用及网页版免费体验这款全新模型,领略其带来的智能交互新体验。 MindGPT3.0的提升不仅体现在技术性能上,更在于为用户打造的创新交互方式。该模型支持结构化思维链可视化,使用者能够清晰地观察理想同学的推理过程,如同拥有了一位"透明化"的智能助手。同时,MindGPT3.0还具备自我反思与二次检索功能,能够在理解用户需求的基础上,进一步完善回答,提供更加准确、全面的信息。此外,该模型对语音输入的识别能力和容错率也获得了显著提高,即使面对不清晰的语音指令,也能精准把握用户意图。 在处理复杂指令方面,MindGPT3.0同样表现卓越。其强大的深度思考能力使任务规划更加合理化,能够更高效地执行复杂问答指令。同时,生态工具的全面升级也为用户带来更多便利,如实时股票、票务等信息的快速查询,让用户在享受智能对话的同时,轻松获取所需资讯。另外,连续对话效果的大幅提升,也让用户与理想同学的互动更加顺畅自然。 特别值得一提的是,MindGPT3.0还特别引入了无关历史对话过滤技术。理想汽车通过实验研究发现,在多轮对话情境下,部分开源深度思考模型存在强行关联用户上文无关输入的问题,导致回复包含不相关信息,影响整体体验。而MindGPT3.0则能够主动对历史对话进行分析反思,有效筛选与当前问题无关的信息,从而确保回复的精准度,解决了用户在实际使用中的一大困扰。这一创新功能的加入,无疑使理想同学在智能交互领域迈出了更为稳健的步伐。 # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## Xingzhi Model Launch # 星知 ![logo](https://www.mechlabs.cn/logo.png) # 工程机械行业首家!机械星球率先推出自研星知大模型,并完成DeepSeek接入 — 2025/4/15 ![图片](https://mmbiz.qpic.cn/sz_mmbiz_gif/GHibRsnEol86Zbd6EdicI4sUV8SbDZ1h6xzRKmQuJicJduYbVqtucPicPS16hksNUJtm1xUD48DttR8WAE17ics6FVg/640?wx_fmt=gif&from=appmsg&&wx_lazy=1&wx_co=1&)近日,机械星球率先推出自主研发的 **星知大模型**,这是 **国内首个工程机械垂直行业大模型。** 机械星球•星知大模型,通过植入“深度思考模式”,全面升级工程行业用户的数智化体验,重新定义设备智慧化租赁、高效施工方案等工程作业场景,旨在助力传统且复杂的工程机械行业,让方案更科学、让作业更安全、让施工更智能。此前星知大模型, **已接入通义千问等多个大模型**,并于日前完成深度求索(DeepSeek)R1大模型的接入,实现行业深度融合,为行业率先开启了“AI+工程机械”的无限可能! ![](https://mmbiz.qpic.cn/sz_mmbiz_jpg/GHibRsnEol85Ol5XosiamzA3GlXoXqgGj7g3pAjTwqJa7xtUJMXTQD62x8wcFQplyj0xW6Lvw5qv8KlZXX3nUZiaQ/640?wx_fmt=jpeg&from=appmsg) 机械星球•星知大模型,依托平台积累的近10万商家及海量的全品类设备供给,以及涵盖主流品牌和型号的设备详细参数,聚焦行业施工方案,精准对接每一环节,助力项目管理、设备选型与施工决策。此次的技术升级将带来四大突破—— **1.深度数据分析,施工决策智能化** 星知大模型涵盖海量机械行业数据,包括设备参数、技术标准、施工方案、合同模板等,可以根据具体的施工场景和不同的项目需求,提供定制化的施工解决方案与精准的设备匹配,保证施工过程的高效化、安全化、智能化。 **2.海量行业数据,查询设备高效化** 强大的自然语言处理能力,丰富的机械设备数据库,不论是查询设备选型、施工计划,还是行业技术标准,星知大模型可以实时响应用户需求,提供精准、专业的回答,让复杂的工程问题“一问即解”。 **3.动态实时更新,数据获取精准化** 星知大模型会根据行业动态,及时更新机械设备信息和施工技术规范,为用户提供更精确、更及时的数据信息。机械星球此前发布的“租价大全”功能,就依托于大模型中的海量商家与客户的成交数据及设备租赁行情,提供实时的动态租价询价及价格走势预测,极大方便客户进行设备寻租和项目预算制定。 **4.支持用户反馈,确保服务便利化** 星知大模型内建技术支持系统,随时根据用户反馈优化模型,提升服务性能,确保持续的功能升级和行业前沿数据更新。接下来,围绕工程机械设备租赁、施工方案等场景,星知大模型还将运用于具体的应用和功能,并集成到机‍械星球小程序和APP中,方便用户快速便捷使用。 无论是建筑师团队、工程师团队、工程公司还是设备采购商、施工现场人员,星知大模型都将成为您的智能AI工程助手,向您提供专业的行业知识、智能的施工方案、精准的设备参数与高效的技术支持,保证方案作业的科学与高效。 同时,机械星球也将为有需要的企业和想要进行数智化的工程机械行业商户,提供星知大模型、DeepSeek等大模型的私有化定制部署服务,共同推动工程机械行业数字化、智能化。 ![](https://mmbiz.qpic.cn/sz_mmbiz_jpg/GHibRsnEol85Ol5XosiamzA3GlXoXqgGj7IznLCIy96xaqJK7vYTdG77hS3lqxojDQJmGW2qpksuwC7aYnvvbOAQ/640?wx_fmt=jpeg&from=appmsg) 作为一家以科技驱动,赋能工程机械多场景下的交易和运营服务的平台,机械星球始终坚持 **“引领工程服务变革,快乐建设美好世界”** 的使命,在成立之初,就开始了AI领域的布局和探索,积极助力行业数字化转型升级。 未来,星知将接入更多大模型,并进一步深化与DeepSeek的全面融合,持续在算力优化、模型压缩、多模态交互的场景化应用等方面发力,让星知大模型成为更多用户的AI工程助手。 **关注我们,获取行业前沿动态及品牌新近活动** ![图片](https://mmbiz.qpic.cn/sz_mmbiz_gif/GHibRsnEol86icgUE2yR7eRibGHmosIQLg44oMdjhUJWibx9XgVTH2qgXQUlya8hTVicd7vbxUDUZpF3ichHpicicK2icQg/640?wx_fmt=gif&from=appmsg&&wx_lazy=1&wx_co=1&) # 最新发布 [![美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable](https://static.jxxqtech.com/static/h-aether/news/31-1.png)\\ 美团AI编程工具"NoCode"即将上线,对话式开发工具对标Lovable\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meituan-ai-programming-tool-nocode-to-be-launched-soon-dialogue-based-development-tool-benchmarking-lovable-31) [![谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户](https://static.jxxqtech.com/static/h-aether/news/30-1.jpg)\\ 谷歌CEO宣布:Gemini AI月活用户突破4亿,覆盖15亿全球用户\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/google-ceo-announces-gemini-ai-monthly-active-users-exceed-400-million-reaching-1-5-billion-global-users-30) [![Shopify推出全新AI工具,让在线商店建设变得更简单](https://static.jxxqtech.com/static/h-aether/news/29-1.jpg)\\ Shopify推出全新AI工具,让在线商店建设变得更简单\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/shopify-launches-new-ai-tool-making-online-store-creation-simpler-29) [![Meta推出J1系列模型,最强"AI法官"上线](https://static.jxxqtech.com/static/h-aether/news/28-1.jpg)\\ Meta推出J1系列模型,最强"AI法官"上线\\ \\ 2025/05/23](https://www.mechlabs.cn/news-article/meta-launches-j1-series-models-the-strongest-ai-judge-goes-online-28) ## 星知 Login Page # 星知 ![logo](https://www.mechlabs.cn/logo.png) [![logo-dark](https://www.mechlabs.cn/_next/static/media/logo-dark.88d61b58.png)](https://www.mechlabs.cn/alpha) ![ball-1](https://www.mechlabs.cn/_next/static/media/login-ball1.bef5a475.png)![ball-2](https://www.mechlabs.cn/_next/static/media/login-ball2.9490f295.png)![ball-3](https://www.mechlabs.cn/_next/static/media/login-ball3.d554530a.png)![ball-4](https://www.mechlabs.cn/_next/static/media/login-ball4.cc7005bc.png) Email Login # Phone Login ![login-smile](https://www.mechlabs.cn/_next/static/media/login-smile.c23b2ec0.png) Phone NumberCrown Code Verification Code Get code Login