
新闻速递

本周热点
1.首部《中国数据产权制度蓝皮书(2022)》发布
2.发布行业大模型,推出向量数据库,星环科技开启下一个十年新征程
3.央国企大咖齐聚,共探信创与数智化转型升级之路
大数据
4.Elastic发布Elasticsearch Relevance Engine,为AI革命提供高级搜索能力
5.GreptimeDB v0.3 正式发布,首次分布式能力全面提升
6.Snowflake推出政府和教育数据云,已推出了七个行业特定版本数据云
7.腾讯捐赠编译器基础软件,为中国开发者“添了双筷子”
8.金融数据预测平台「Mosaic」完成2600万美元C轮融资
9.星环科技与新网银行签署战略合作协议,共建“大数据和人工智能联合实验室”
数据库
10.华为云发布新一代分布式数据库GaussDB,给世界一个更优选择
11.TiDB 7.1 LTS 发版:为关键业务提供业务稳定性和多租户场景支持
12.DataStax通过矢量搜索进一步增强AI应用能力
数据安全
13.冯登国院士:数据安全新方向——数据使用安全
14.Velotix的数据安全模块化方法推动了数据效率和民主化
15.全知科技正式发布《数据安全作战地图》知识图谱
16.CyberArk:99% 的组织预计今年会出现与身份相关的泄露
17.谷歌推出安全人工智能框架SAIF ,帮助保护人工智能技术
AI
18.当LLM遇到Database:阿里达摩院联合HKU推出Text-to-SQL新基准
19.Salesforce推出AI Cloud服务,提供可信的、开放的、面向企业的生成式AI
20.智源「悟道3.0」大模型系列问世,这次不拼参数,开源开放成为主角
21.中国电科发布生成式人工智能大模型“小可”
22.360发布认知型通用大模型“360智脑4.0” 全面接入360全家桶
23.英伟达、甲骨文、Salesforce投资与谷歌相关的生成人工智能创业公司Cohere
24.CoreWeave筹集了2亿美元,用于增强在云中训练AI模型的能力
本周热点

1.首部《中国数据产权制度蓝皮书(2022)》发布

中国首部《中国数据产权制度蓝皮书》发布。该蓝皮书由人民数据结合自身实践探索,联合浙江大学网安学院撰写,从理论、研究、产业等多角度、广视野对我国数据产权制度的研究内容、发展现状、存在问题、确权方式、技术发展、产业实践、国际视野等方面进行梳理和探究,为各界在数据产权制度建设方面提供一定参考。
蓝皮书从公共数据、企业数据、个人数据、技术四个方面深入解析数据产权制度建设的方式。公共数据方面,分析当前公共数据的使用情况,界定公共数据概念,了解分共数据使用的主要方式等。企业数据方面,聚焦企业数据概念及特征、企业数据现有的产权机制现状,分析企业数据产权机制运行规则及坚守的原则,探讨企业数据分类分级发展现状及使用原则。个人信息数据方面,分析个人数据的法定规范和定义,深入解读个人数据现有的产权机制现状,探讨个人信息数据产权机制取得的成果和存在的痛点,明确个人信息采集以及处理与应用的原则,推动个人数据产权机制建设。技术发展与应用方面,分析现有技术在数据产权层面的探索经验,发现隐私计算对数据要素流通具有重要支撑作用等。

2.发布行业大模型,推出向量数据库,星环科技开启下一个十年新征程

5月26日,星环科技的“向星力·未来数据技术峰会(FDTC)”在上海成功举办。因为疫情,星环科技已经有3年没有举办这种大型线下活动了,这是疫情之后也是该公司上市后首次举办这一大型活动。同时,今年还是星环科技成立10周年,对于星环科技还有继往开来的意义,因此,星环科技为此次大会倾注了大量心血。
而从大会现场看,星环科技也的确给我们带来了惊喜。大会上,星环科技一口气发布了众多创新产品,包括金融大模型“无涯”、大数据分析大模型“求索”、向量数据库和配套的大模型开发工具Sophon LLMOps,实现湖、仓、集一体化和多模架构的星环大数据基础平台TDH 9.3、分布式图数据库StellarDB 5.0等,尤其是“无涯”和“求索”两个行业大模型和向量数据库的发布,让人眼前一亮。

3.央国企大咖齐聚,共探信创与数智化转型升级之路

在向星力·未来数据技术峰会 (FDTC)上举办的行业信创闭门论坛,吸引了来自中石油昆仑数智、石化盈科、中化信息、北京市昌久律师事务所等的业界大咖,围绕央国企数智化转型和信创话题,展开了深度交流。
中石油销售公司遵循“统一管理、共享共用、灵活敏捷”原则,建立了全国统一的计算资源池、数据采集机制、数据架构,为全国和各地区用户提供标准的数据资源和数据计算能力,实现“全国统一、灵活运营”的整体建设目标,探索了大数据营销平台、自助分析平台、智能报告平台、数据管理与服务等应用场景。
石化盈科将其打造的梧桐数智分析平台和星环科技湖仓集一体化平台两者优势融合,共同打造企业数智化转型平台,支撑市场监测分析、经营管理分析、数据动态监测、市场研判分析等业务场景。
在“线上中化”数字化战略的指引下,近年来中化信息通过大数据平台、治理体系、数据湖、数据资产平台等项目建设,持续推进数据洞察平台落地,支撑业务服务优化和业务模式创新。
大数据

4.Elastic发布Elasticsearch Relevance Engine,为AI革命提供高级搜索能力

新推出的Elasticsearch Relevance Engine(ESRE),是一种创建高度相关的AI搜索应用程序的新功能。ESRE 建立在Elastic在搜索领域的领导地位以及超过两年的机器学习研究和开发基础之上。Elasticsearch Relevance Engine 结合了AI的最佳实践和Elastic的文本搜索。
ESRE为开发人员提供了一整套将复杂的检索算法和与大型语言模型(LLM)集成的能力。不仅如此,ESRE使用Elastic的简单、统一API,开发人员可以立即开始以提高搜索相关性,因为这些API已经得到 Elastic 社区的信任和广泛应用。
Elasticsearch Relevance Engine 的可配置功能可通过以下方式提高相关性:
·应用高级相关性排名功能,包括BM25f,这是混合搜索的关键组成部分。
·使用Elastic的向量数据库创建、存储和搜索密集向量。
·使用各种自然语言处理(NLP)任务和模型处理文本。
·让开发人员在 Elastic 中管理和使用自己的 transformer 模型,以适应业务特定的上下文。
·通过API与第三方转换器模型集成(如OpenAI的GPT-3和4),从 Elasticsearch 集群中汇总的客户数据存储的检索内容中提取直观摘要。
·使用Elastic的开箱即用的Learned Sparse Encoder 模型实现基于ML的搜索,无需训练或维护模型,可在各种领域提供高度相关、语义化的搜索。
·与第三方工具集成,例如 LangChain,以帮助构建复杂的数据管道和生成式AI应用程序。

5.GreptimeDB v0.3 正式发布,首次分布式能力全面提升

在 4 月中旬发布的 v0.2 版本中,GreptimeDB的主要目标集中在单机、PromQL 兼容、写入性能优化等方面。而在 GreptimeDB v0.3 版本的关键词则是 “分布式”,也就是所有的能力或是更新均在分布式版本上提供,分布式提供了单机版本不具备的扩展性、高可用性和容错性等):
·分布式性能优化:实现了Region级别的高可用性,提供了快速的容灾切换调度。同时也对分布式写入性能进行了优化。
·查询能力提升:包括支持分布式查询优化、重要SQL查询 (如 TopK) 的改善以及优化数据压缩策略来加快查询速度。
·稳定性增强:为了增加系统的健壮性和可靠性,引入了 Procedure 框架来保障多步操作的最终一致性。同时提供了更细粒度的 Hybrid-flush 策略以提高写入的稳定性,并增加了更多性能指标度量的埋点来提升系统的可观测性,支持如 Tokio console 等工具。

6.Snowflake推出政府和教育数据云,已推出了七个行业特定版本数据云

Snowflake推出了专门为政府机构和教育机构设计的数据云版本,也是该供应商平台的第七个行业特定版本。
Snowflake成立于 2012 年,是一家数据云供应商,随着金融服务数据云的推出,于2021 年开始开发其平台的行业特定版本。最近,它于4月推出了垂直行业版本的制造平台,并于1月推出了电信平台。
在同一时期,Snowflake的竞争对手Databricks也推出了五个面向特定行业的数据湖房平台版本,最近一次是在四月份用于制造业。
与Snowflake平台的先前行业特定版本一样,政府和教育数据云具有预构建的功能,将其与供应商的通用数据云区分开来,旨在更好地满足给定垂直领域的组织需求。
为了使各级政府机构能够满足安全性和合规性标准,Snowflake的平台已获得FedRAMP Moderate和StateRAMP High状态。FedRAMP 和 StateRAMP 是提供标准化云安全措施的授权程序。

7.腾讯捐赠编译器基础软件,为中国开发者“添了双筷子”

6月11日,在2023开放原子全球开源峰会上,腾讯正式宣布将打磨多年的Java应用操作系统“OpenKona”捐赠给开放原子开源基金会,联合基金会以及数以百万计开发者,共建国产编译器基础软件,推动数字基础设施加速突破。
早在2019年上半年,腾讯就开始投身OpenKona的研发。目前,腾讯内部超90%的JDK为OpenKona,部署量超过百万服务器实例,涉及全部的业务线,并服务超过120家外部公司。
相对OpenJDK,OpenKona支持国产CPU和操作系统,包括ARM、X86等;操作系统的适配方面,支持银河麒麟操作系统、统信UOS以及腾讯自研服务器操作系统TencentOS Server。OpenKona国密套件还首次实现了从基础算法簇到公钥基础设施,再到安全通信协议的全链路国密特性。

8.金融数据预测平台「Mosaic」完成2600万美元C轮融资

Mosaic.tech是一个金融数据预测平台,提供预测报告功能,以协助财务战略和规划。mosaic .tech结合了大数据和机器学习,提供预测报告功能,平衡竞争环境,并为初创企业提供工具和见解。它的一键集成和实时分析提供了清晰的见解和直接的建议。Mosaic为业务最重要的动态提供了更大的可见性。

9.星环科技与新网银行签署战略合作协议,共建“大数据和人工智能联合实验室”

星环科技与新网银行签署战略合作协议,双方共建大数据和人工智能联合实验室,合作开展基于大数据和人工智能的创新项目,联合进行人才培养,共同推动大数据和人工智能技术驱动的银行行业创新,开展大数据平台与人工智能平台软件、技术和培训等相关服务等。
星环科技与新网银行共建“大数据与人工智能联合实验室”,开展大数据与人工智能技术在金融场景下业务和技术创新探索。通过联合实验室孵化新产品,开展创新试点工程,形成能成为金融行业标杆的系统解决方案和应用创新产品。联合实验室拟合作内容包括基于图挖掘与分析技术的交易数据库与图数据库在金融场景应用探索、新市民金融服务动态分析、隐私计算平台互联互通、机器视觉模型自动化构建、金融数据挖掘与分析、金融建模探索等。
同时,新网银行与星环科技将开展基于大数据和人工智能的创新项目合作。双方针对特定的技术、商业模式创新需求,探讨业界最优实践技术方案,帮助新网银行打造行业领先技术架构,辅助星环科技完善行业解决方案。创新项目的内容优先使用包括图数据库、交易数据库以及分析型数据库、模型可解释性系统、图挖掘与可视化平台、机器视觉建模平台等,双方将共享创新项目的最佳实践成果,促进双方利益最大化。
数据库

10.华为云发布新一代分布式数据库GaussDB,给世界一个更优选择

华为云正式发布新一代分布式数据库GaussDB,通过多维度的技术创新,在行业实践中构筑了高可用、高安全、高性能、高弹性、高智能的技术优势,而在数据库替换场景中,又具备易部署、易迁移的特性。
在高可用方面,GaussDB创新了存算分离架构,采用华为云底座存储硬件级、实时数据同步复制技术,并结合分布式强一致算法,实现了分布式架构下同城双集群、双活备份,可在突发状况下确保数据零丢失(RPO=0)。
在高安全方面,GaussDB提供了业界首个纯软件形态的全密态数据库,并且是国内唯一一个通过CC EAL4+的认证的数据库,标志着其设计和源代码达到了国际最高安全水平。在全密态数据库上,GaussDB还发明了多项专利,例如,通过数学算法直接在密文空间进行查询和运算,极大提升了密文数据处理效率,相比业界同类产品性能领先35%以上。
在高性能方面,GaussDB打造的Ustore存储引擎,从数据库自研内核架构实现创新,确保了数据库高性能,极低抖动。在招商银行的现场实际业务测试中,GaussDB在性能遥遥领先的前提下,相比国内其他厂商抖动率减少85.6%,真正实现了全天候的无抖动。
此外,金融行业传统数据库存储的过程代码往往达到千万行量级,如果仅靠人工进行语法改造,将存在非常大的风险不确定性。为此,GaussDB构建了一站式的迁移自动化工具链,通过自动语法转换工具UGO、数据迁移工具DRS、流量回放建模工具等,让传统数据库更容易更平滑的迁移到GaussDB上,相比传统作业模式,应用改造成本降低90%以上。

11.TiDB 7.1 LTS 发版:为关键业务提供业务稳定性和多租户场景支持

TiDB 7.1 LTS是 2023 年度发布的首个 LTS(Long Term Support) 版本,汇集了来自 20+ 个真实场景带来的功能增强,累计优化和修复 140+ 功能,旨在提升关键业务的稳定性和性能,帮助开发人员和数据库管理员提高生产力并进一步降低总体拥有成本(TCO)。用户可在生产环境中使用 TiDB 7.1。
TiDB 7.1 为您带来:
·更稳定地支持关键业务负载,为 DBA 提供多工作负载稳定性控制,并显著改善尾部延迟;
·以更少的资源提供更佳的性能,通过架构增强实现更高的吞吐以及更快的在线 DDL。
此外,TiDB 7.1 企业版增强了数据库审计功能,通过更细粒度的事件过滤控制、更友好的过滤条件设置方式、新增的 JSON 文件输出格式以及审计日志的生命周期管理,大幅提升系统的审计能力。

12.DataStax通过矢量搜索进一步增强AI应用能力

实时人工智能公司DataStax宣布其数据库即服务Astra DB现在支持矢量搜索,这代表了该公司在增强对AI工作负载(包括使用LLM的工作负载)支持方面的飞跃。
矢量搜索是一种使用上下文和含义(而不是关键字或文字值)的搜索方法,可激发低延迟搜索和强大的信息访问。矢量搜索利用嵌入(将语义概念表示为矢量)来搜索非结构化数据集。
矢量搜索中的嵌入允许自然语言成为开发人员搜索体验的支柱。在DataStax的Cassandra引入矢量搜索之后,开发人员可以结合嵌入、矢量存储和生成AI模型的强大功能,以显示以自然语言传递的相关信息。Cassandra按含义搜索的能力在生成AI应用程序时进一步激发了新的可能性。
许多其他矢量数据库不同,Astra DB 不仅面向全球规模和可用性而构建,还支持管理敏感数据的最严格的企业级要求,包括 HIPAA、PCI 和 PII 法规。因此,对于管理敏感用户信息并希望构建有影响力的生成式人工智能应用程序的初创公司和企业来说,这是一个理想的选择。
数据安全

13.冯登国院士:数据安全新方向——数据使用安全

近日,在2023中关村论坛——数据安全治理与发展分论坛上,冯登国院士做了主题为:数据安全新方向:数据使用安全的分享。
数据使用安全现在需求迫切,像云计算、大数据等信息应用场景的发展,迫切需要对使用中的数据进行保护。移动、物联网等设备数量的不断扩大,迫切需要对使用者的数据进行保护。
数据使用安全也受到了高度的关注,像工业界与学术界已经发现了多起影响深远的基于内存数据的攻击手段,这些都极大地增加了人们对使用中的数据安全的关注。2021年的一项调查看到,使用安全成为当前数据安全领域的前沿的一个研究方向。
与保存、传输中的数据不同,使用中的数据,包括其在内存处理器中进行计算时的形态的机密性和完整性的保护,也就是运行态数据的安全,或者流动的数据安全技术现在还是一个薄弱环节,是一个短板。包括像同态加密、可信执行环境、联邦学习安全、安全多方计算、密文检索等技术,有的是不够可靠,有的是实现的性能不能满足现实的需求。
我们应该在坚持自主可控、安全可信的这个防护理念的基础上,要不断深刻认识数据安全的内涵。大数据时代的数据安全,不仅包括传统的机密性、完整性、可用性,也包括隐私性和敏感性,不仅包括防止数据泄露的隐私性和敏感性,也包括数据分析的隐私性和敏感性。

14.Velotix的数据安全模块化方法推动了数据效率和民主化

人工智能数据安全公司Velotix正在为Velotix安全平台推出三层架构,旨在推动组织走向全自动数据访问。通过这种模块化设计,Velotix使企业无论处于数据治理之旅的哪个阶段,都可以开始自动化和控制合规访问,同时降低重大风险。
Velotix平台内的这一增强功能是对数据安全法规对生成大量数据的企业施加的日益复杂的回应。通过数据治理的阶段方法,Velotix允许组织利用平台内的特定功能,以最好地有利于他们在安全和自动化旅程中的当前位置。
Velotix数据安全平台中的新模块涵盖三个领域:数据发现和自动标记、由AI提供支持的访问管理和策略数据库管理。

15.全知科技正式发布《数据安全作战地图》知识图谱

全知科技《数据安全作战地图——全链路数据流动安全》知识图谱正式上线。图谱基于全链路数据流动安全的理解和思考,从底层基础认知、风险要点剖析到技术能力实施、建设避坑指南等模块入手,进行了体系化的知识点梳理总结,可以帮助企业用户获得以下技能点:
找到正确的思路。全链路数据流动安全建设范围很大,如果没有清晰的体系思路,就无法有效的落地安全能力。图谱基于数据流动安全建设关键点的洞察,以真实技术实践和丰富理论体系为基础进行了归纳总结,助你找到最佳建设实施路径。
获得更好的总结。图谱构建了全链路数据流动概念认知-数据流动风险剖析-技术能力实施要点-应用实践价值4大模块,涵盖了数据流动风险认识、技术能力体系、建设实施误区等多个要点,强力直击企业认知盲区和痛点,助力撬动更高效、高质的数据流动安全建设。

16.CyberArk:99% 的组织预计今年会出现与身份相关的泄露

根据CyberArk的一份报告,当前的经济状况和技术发展表明,基于身份的网络安全风险有所增加。根据该报告,几乎所有(99%)预计今年会出现与身份相关的妥协,这源于经济驱动的削减,地缘政治因素,云采用和混合工作。
大多数人(58%)表示,这将作为数字化转型计划的一部分,如云采用或遗留应用迁移。超过三分之二 (68%) 的组织预计 2023 年会出现员工流失驱动的网络问题,这加剧了来自心怀不满的前员工或可利用的剩余凭证的新一波内部威胁担忧。

17.谷歌推出安全人工智能框架SAIF ,帮助保护人工智能技术

谷歌宣布推出安全人工智能框架(SAIF),这是一个保护人工智能系统的概念框架。谷歌是生成式人工智能聊天机器人Bard的所有者,也是人工智能研究实验室DeepMind的母公司,他表示,公共和私营部门的框架对于确保负责任的参与者保护支持人工智能进步的技术至关重要,以便在实施人工智能模型时,它们是默认安全的。这家科技巨头声称,其新的框架概念是朝着这个方向迈出的重要一步。
SAIF 旨在帮助降低特定于 AI 系统的风险,例如模型盗窃、训练数据中毒、通过即时注入进行恶意输入以及提取训练数据中的机密信息。“随着人工智能功能越来越多地融入世界各地的产品中,坚持一个大胆而负责任的框架将变得更加重要,”谷歌在一篇博客中写道。
此次发布之际,生成式人工智能的进步及其对网络安全的影响继续成为头条新闻,成为组织和政府的焦点。对这些新技术可能带来的风险的担忧包括使用先进的自学算法共享敏感业务信息的潜在问题,以及使用它们显着增强攻击的恶意行为者。
AI

18.当LLM遇到Database:阿里达摩院联合HKU推出Text-to-SQL新基准

阿里巴巴联合香港大学等机构推出了面向大规模真实数据库的全新基准 BIRD , 包含95 个大规模数据库及高质量的 Text-SQL pair,数据存储量高达33.4 GB。之前最优的模型在 BIRD 上评估仅达到 40.08%,与人类 92.96% 的结果还有很大差距,这证明挑战仍然存在。
除了评估 SQL 正确性外,作者还增加了 SQL 执行效率的评估,期待模型不仅可以写正确的 SQL,还能够写出高效的 SQL。
目前,BIRD的数据、代码、榜单都已经开源,在全球的下载量已超10000。BIRD在推出之始,就引发了Twitter上的广泛关注与讨论。

19.Salesforce推出AI Cloud服务,提供可信的、开放的、面向企业的生成式AI

6月12日,Salesforce宣布推出AI Cloud,这是Salesforce通过生成式AI增强客户体验和公司效率的最快、最值得信赖的方式。AI Cloud是一套经过优化的功能,可在所有应用程序和工作流中提供可信、开放和实时的生成体验。
AI Cloud的新Einstein GPT Trust Layer解决了生成式AI相关的风险问题,使客户能够满足其企业数据安全和合规性需求。这种功能和安全性的独特结合巩固了Salesforce作为排名第一的AI CRM的地位。
AI Cloud的核心是Einstein,这是世界上第一个用于CRM的AI,现在每周为Salesforce应用程序提供超过1万亿次预测。借助生成式AI,Einstein帮助提高每个公司和员工在销售、服务、营销和商业领域的生产力和效率。
另据报道,该公司专注于生成式AI的风险投资基金将由3月份宣布的最初的2.5亿美元增加到5亿美元。

20.智源「悟道3.0」大模型系列问世,这次不拼参数,开源开放成为主角

智源发布了完整的悟道 3.0 大模型系列,并进入到了全面开源的新阶段。此次悟道 3.0 包含的项目有「悟道・天鹰」(Aquila)语言大模型系列、FlagEval (天秤)大模型语言评测体系以及「悟道・视界」视觉大模型系列。此外 FlagOpen 飞智也带来了开源大模型技术体系最新进展。
因此在悟道 3.0 大模型系列中,智源发布并全面开源「悟道・天鹰」(Aquila)语言大模型系列和「悟道・视界」视觉大模型系列,与多个高校和科研院所合作构建 FlagEval(天秤)开源大模型评测体系与开放平台,加之 FlagOpen 飞智大模型技术开源体系,通过全方位的大模型技术、评测体系以及更广泛的开源生态,服务于大模型行业发展。

21.中国电科发布生成式人工智能大模型“小可”

中国电科所属电科太极在京发布生成式人工智能大模型产品“小可”,面向党政企行业用户,辅助开展智能化业务,支撑特种场景辅助决策,助力党政企用户行业应用智能化转型升级。
据介绍,“小可”突出“行业化、专业化、国产化、私有化”特点,目前已推出对话问答、搜索整编、会议纪要生成、拟文助手、编码助手、智能标绘等系列智能应用,以解决相关领域重复性工作繁多、基于个人经验决策不够科学、工作效率不高等痛点,满足降本增效、流程优化和工作创新等需求。

22.360发布认知型通用大模型“360智脑4.0” 全面接入360全家桶

“让数字人‘周鸿祎’作为我们公司的新闻发言人,说对了算我的,说错了算他的”,6月13日,三六零(下称“360”)公司召开360智脑大模型应用发布会,认知型通用大模型“360智脑4.0”亮相,360AI数字人正式发布。360集团创始人周鸿祎现场创建了自己的数字分身作为“360发言人”。周鸿祎表示,数字分身拥有他本人完整的私人知识库,能够复刻他的思维方式和人生经历,是有“灵魂”的数字人。
发布会同时宣布360智脑在多模态等关键能力上完成迭代,将全面接入“360全家桶”。360AI数字人背后是“360智脑4.0”强大的多模态能力的支撑。周鸿祎表示,GPT时代中国自研大模型弯道超车的关键在于发展多模态。目前,360已具备跨模态生成能力,包括文字处理能力、图像处理能力、语音处理能力以及视频处理能力,可实现文生文、文生图、文生表、图生图、图生文、视频理解等功能。会上,360智脑“文生视频”多模态功能国内首发,任何文字脚本都可生成视频,不受专业技能和素材限制,展示了“无中生有”的能力。

23.英伟达、甲骨文、Salesforce投资与谷歌相关的生成人工智能创业公司Cohere

Cohere是一家专注于企业的生成式人工智能初创公司,创始人来自谷歌大脑,在C轮风险投资中筹集了2.7亿美元资金。其中投资者包括AI巨头英伟达。四年前,Cohere赢得了1.75亿美元的投资,投资这包括Oracle和Salesforce。
Cohere的人工智能工具可以为文案写作、搜索和摘要提供动力,并通过关注企业对专有数据被输入大型语言模型的担忧,将自己与OpenAI区分开来。OpenAI需要大量数据来训练其模型,它正在与企业客户合作解决这些问题。
该公司还与大公司签署协议,将其人工智能技术嵌入从科技到金融服务的各个领域,同时为企业数据提供防火墙。据报道,该公司还在开发其人工智能的开源版本。

24.CoreWeave筹集了2亿美元,用于增强在云中训练AI模型的能力

CoreWeave是一家专为大规模GPU加速工作负载而构建的专业云提供商,它宣布已获得额外的200亿美元资金,以推动其专门的云基础设施,以使用AI训练,服务推理和微调模型。
据供应商称,该公司提供专为计算密集型工作负载构建的解决方案,这些解决方案比更大、更通用的云提供商更快、更便宜。
CoreWeave的无服务器编排层使其成为急于将产品推向市场的AI初创公司的一个有吸引力的选择,因为团队可以在短短五秒内启动工作负载,同时提高可移植性,减少开销并降低管理复杂性。

春华秋实!

扫码关注
大数据应用
从现在开始

End




