介绍
印度的基础模型机会结合了 22 种预定语言、多种文字、广泛的代码切换、大量语音人口和高度多样化的数字工作流程。在印地语或英语中表现良好的模型在泰米尔语公共服务交流、马拉地语农业咨询任务、孟加拉语财务文件、泰卢固语客户呼叫或多语言工程记录中仍然可能会失败。商业尽职调查需要明确的用户、语言、任务和结果,然后才需要模型排名。
公共基础设施扩大了可用基础。 IndiaAI 使命涵盖计算、数据集、本土模型、应用程序开发、技能、启动融资以及安全和可信 AI [7-13]。 AIKosh 提供了一个国家数据集、模型和开发资源平台[14-16]。 AI4Bharat发布了印度语言的开放数据集、翻译系统和评估资源[17-22]。这些举措可以降低发展障碍。公司价值仍然需要证据证明特定团队将这些资源转化为可接受的工作和现金。
提供商格局包括不同的技术和商业地位。 Sarvam 描述了在印度训练的模型和全栈主权平台 [23-27]。 Tech Mahindra 报告了其印度河项目在印地语和方言方面的工作[28-31]。 BharatGen 描述了多语言模型和公共研究成果 [32-34]。提供商的陈述形成了尽职调查的假设。独立测试、合同、工作负载遥测和收集决定这些功能是否支持投资案例。
投资者或董事会的决定是公司是否控制一个可重复的系统,将多语言能力转化为可接受的结果、贡献和现金。该系统包括数据权限、评估、产品集成、分发、部署、计算和模型更新。本文将这些要素与估值和交易设计联系起来。
1 定义投资决策和范围
尽职调查室的第一份文件应说明该决定。成长型投资者可能正在决定是否为模型所有者、应用程序公司或主权部署平台提供资金。战略买家可能会寻求数据、人才、客户访问权或运营控制权。公共赞助商可能需要国家能力、印度语言包容性、韧性或生产力。这些目标创造了不同的价值测试。
外围应识别法人实体、股东、存储库、模型权重、标记器、数据管道、评估系统、部署软件、合同、计算协议和客户义务。它应该显示哪些资产是自有的、获得许可的、开放权重的、合作伙伴控制的或特定于客户的。共享品牌和国家协会不能解决合法所有权或可转让性问题。
运营模式也很重要。公司可以训练通用模型、调整第三方权重、编排多个模型、销售应用程序或运营私有实例。每个职位都会产生不同的资本需求和防御能力。估值应将收入、成本和风险分配给实际层,而不是分配给无差别的印度语言 AI 叙述。
2 在衡量绩效之前先细分多语言能力
印度语言能力应按语言、文字、方言、语域、代码转换、音译、语音、光学字符识别、手写、检索和领域术语进行细分。预定语言覆盖范围是一个有用的清单。它不显示模型是否执行客户所需的任务、人口和格式。每个收入群体都需要更狭窄的能力定义。
评估应保留用户群体、输入质量和错误后果。 IndicGenBench 涵盖了 29 种印度语言的生成任务,而 IndicQA 和 MILU 则测试问答和文化相关知识的其他方面[18-22]。已发表的研究报告了不同语言和任务之间的有意义的差距。综合平均值可能会隐藏商业上重要的语言或工作流程中的严重弱点。
客户测试使用建议的模型版本、提示、检索、工具、延迟、安全性和人工审核规则。它应该包括影响性能的代码切换、命名实体、数字、日期和本地术语。结果应按队列保留,以便以后的模型更改可以与可接受的基线进行比较。
3 构建语料权账本
训练和适应数据应按来源、所有者、许可证、目的、管辖权、收集方法、允许使用、保留、删除和模型版本进行记录。公开可用性不能替代许可。合同应涵盖模型开发、商业使用、衍生品、再许可、交易转让和相关审计。
印度语语料库可以包含书籍、新闻、公共记录、社交媒体、转录语音、呼叫中心录音、教育材料、技术手册和客户文档。每个类别都有不同的权利和隐私问题。方言和语音数据集可能包含个人数据或敏感上下文。客户提供的数据可以支持检索或微调,而无需创建可转让的公司资产。
账本应区分原始数据、清理后的数据集、注释、合成数据、反馈和派生评估集。它应该识别重复或污染的基准材料。买家应该能够跟踪已发布的模型到相关数据集版本和批准。如果来源不完整,模型应包括删除、替换、重新培训和重新评估受影响能力所需的成本和时间。
4 通过替换和收入证据评估专有语料库
当合法访问稀缺时,数据集具有战略价值,数据可以提高所需的能力,并且公司可以将这种改进用于商业用途。单独的成交量是一个较弱的指标。较小的、最新的且经过仔细注释的语料库可能比较大的重复或低质量文本更有用。重置成本应包括采购、权利、清洁、注释、质量保证、存储、评估和消耗时间。
收入证据需要从语料库到工作流程的链接。公司应该表明,定义的数据集可以提高接受度、减少审核工作、提高转化率、支持更高的价格或保护保留。分析应控制模型、提示、检索和产品变更。客户特定的改进可能对合同很有价值,但对于更广泛的平台来说却无法实现。
估值时应避免将相同的优势计算两次。语料库收益可以出现在预测收入、贡献或期权价值中。仅当该方法排除这些现金流量或确认明确的可转让权利时,额外的资产溢价才适用。 IAS 38和IFRS 13提供了相关的会计和公允价值原则,而交易分析仍然需要针对公司特定的法律和财务建议[1-5]。
5 设计方言和领域评价系统
评估系统应该从用例验收标准开始。对于受监管的文档工作流程,这些措施可能包括提取准确性、有根据的答案、引文完整性、禁止披露、延迟、成本和人工审核时间。对于语音来说,单词错误率很有用,尽管任务完成和升级对客户来说可能更重要。对于内容生成而言,事实性、术语、语气和批准努力可以决定价值。
测试人群应代表影响使用的国家、年龄组、口音、代码转换、脚本变化和文档质量。本土审稿人需要明确的规则和裁决程序。应衡量审稿人之间的一致性。客户机密示例需要访问控制和许可使用记录。
公司应该维护版本化的记分卡和失败分类法。平均基准的改善不应掩盖高价值群体的退化。发布决策应包括能力、安全、成本和合同承诺。当评估缩短客户的调查时间并指导模型路由、适应和人工审查时,它就成为一种运营资产。
6 将模型基准转换为分布证据
证据阶梯从可重复的评估开始,并通过演示、受控试点、用户验收、生产、发票、收集和更新进行。每个阶段都支持不同的结论。下载、宣布的合作伙伴关系、备忘录和资助实验可能会表现出兴趣或学习。合同生产和收集的现金支持商业案例。
应按路线绘制分布:直接企业销售、政府计划、州、云市场、电信提供商、系统集成商、软件合作伙伴和开发人员采用。分类账应说明哪一方控制客户关系、数据、计费、实施、支持和续订。当最低限度的活动、经济和账户所有权不明确时,分销协议的价值有限。
采用文件应记录客户实体、部门、国家、语言、工作流程、模型版本、接受门槛、用户、数量、价格、直接成本、实施工作量和现金。预测转化应遵循观察到的群体。免费或资助支持的使用应与商业收入区分开来,同时记录其技术学习。
7 衡量客户采用率和保留率
使用情况应按照客户购买的水平来衡量。相关单位可以包括已接受的文件、已解决的联系人、已完成的申请、节省的分析师时间或已审核的交易。代币数量可以调节计算成本,但它本身很少解释客户价值。免费使用和促销积分应与付费活动分开。
保留分析应使用合同队列并区分模型、应用程序和服务收入。即使底层模型是可替代的,客户也可能会因为数据集成、支持或转换成本而续订。相反,开放权重部署可以保留客户控制权,同时减少经常性许可证收入。公司应解释保留的来源以及维护它的成本。
定价证据应包括标价、折扣、实施、最低承诺、容量预留、支持、接受信用和收款。收入确认和兑现时间可能存在重大差异。 IFRS 15 提供了识别合同和履约义务的框架;公司特定的会计结论需要专业判断 [4].
8 定义主权和公共基础设施期权价值
主权期权价值应分解为权利和经营能力。相关要素包括印度法律控制、模型和软件权利、数据位置、密钥控制、计算访问、发布权限、安全操作、连续性、可移植性以及在外部中断期间支持公共或受监管客户的能力。在印度举办托管服务是这一地位的一个组成部分。
公共基础设施可以通过负担得起的计算、数据访问、采购途径和共享语言资源来创造选择价值。 IndiaAI 计算门户为符合条件的用户列出了云、存储、模型操作和语言服务 [10-13]。估价应反映实际分配、补贴期限、服务条款、生产利用和更新风险。公布的国家产能数量与一家公司合同可用的产能不同。
客户的需求决定经济价值。政府工作流程可能需要本地管理、审计和连续性。受监管的机构可能需要隐私、可解释性、人工审查和经过测试的恢复。商业工作流程可能会优先考虑语言质量、延迟和总成本。每项声称的主权优势都应与资格、收入、成本或可衡量的风险降低挂钩。
9 测试私有部署和可移植性
私有部署可以采用客户云、主权云、专用托管容量、本地基础设施或混合系统的形式。尽职调查团队应在建议的环境中重现具有代表性的工作负载。它应该衡量质量、延迟、吞吐量、安全性、监控、恢复、更新过程和成本。
可移植性测试应确定模型许可证、容器映像、专有依赖项、标记器、检索服务、审核、可观察性、加速器和网络要求。对权重的控制并不能建立对整个服务的控制。客户和供应商应就每一层的操作人员以及事故发生后的恢复人员达成一致。
财务分析应将许可、实施、容量、托管服务和支持分开。私有部署可以创建更大的合同和更长的保留时间。在验收之前,他们还可能需要定制工程、库存、并行模型版本和营运资金。最低价格和维护储备应反映实际配置。
10 重建计算和推理经济学
计算分析应协调公共分配、商业云、预留加速器和自有基础设施。证据包括分配函、提供商发票、加速器类型、有效可用性、利用率、存储、网络、软件、支持和终止权利。 IndiaAI 预算机表明,不同的工作负载和配置具有不同的每小时价格和操作特征 [11]。标题 GPU 数量并不能确定生产能力。
推理成本应按可接受的工作流程单元进行测量。时间表应包括输入和输出令牌、语音、检索、工具、缓存、护栏、重试、人工审查、空闲容量和服务积分。语言混合可以改变标记化和任务长度。语音和文档工作流程添加了仅令牌成本度量可能会错过的预处理和后处理。
培训经济学需要一个项目分类账。每次运行都应记录目标、数据集版本、计算、经过的时间、评估、发布决策、客户相关性和现金效果。公共补贴应与基本资源成本分开显示。资本计划应确定在准入条件或市场价格发生变化时达到下一个技术和商业门槛所需的资金。
11 将开放重量访问与拥有的优势分开
开放权重模型可以降低开发成本,支持私有部署并拓宽生态系统。它们还可以使基线功能更容易重现。尽职调查团队应阅读适用的许可证并验证确切的版本。权重的开放获取并不意味着对每个数据集、工具、商标或托管服务的权利不受限制。
使用开放权重的公司仍然可以通过合法领域数据、评估、工作流程集成、分发、支持和受控部署来构建持久价值。应测试每个优势的可转移性和客户相关性。适应制品和客户微调需要明确的所有权和保密条款。
替代测试应询问有能力的竞争对手需要多长时间才能用另一个模型重现已接受的工作流程。它应包括数据访问、评估、集成、安全审批、客户迁移和支持。短期的技术替代仍然可能涉及长期的商业转型。估值应该对两者进行建模。
12 协调隐私安全和人类责任
印度基金会模型工作流程可以处理个人、机密和受监管的信息。 《2023年数字个人数据保护法》和《2025年数字个人数据保护规则》建立了国家数据保护框架和分阶段实施要求[35-38]。职责取决于实体、处理目的、数据和启动条款。具体部署需要当前的法律建议。
控制措施应涵盖目的、通知、同意(如适用)、最小化、访问、加密、保留、删除、传输、事件响应和供应商管理。训练、检索、记录和反馈是不同的处理活动。在没有授权基础、合同明确性和技术执行的情况下,客户提示和输出不应输入培训或评估数据集。
印度储备银行的 FREE-AI 工作致力于解决金融领域的负责任和道德问题 AI [39-41]。 NIST 和 ISO 提供互补的风险管理结构 [42-47]。对于后续决策而言,人的责任仍然是必要的。公司应定义审查、升级、覆盖和事件所有权,并衡量控制措施是否以每种部署的语言运行。
13 评估配电权和公共采购
印度的市场路线因客户和州而异。它们可以包括直接企业承包、中央和州政府采购、公共数字平台、云市场、电信提供商、银行、系统集成商和软件公司。预测应显示谁控制每条路线的帐户、计费、实施、数据和续订。
公共计划可以提供访问、参考部署和共享基础设施。他们还可以介绍资格条件、里程碑接受、预算时间和集中度。备忘录或批准的项目应按其可执行范围、资金、接受过程和支付机制进行分类。政府协会本身并不能建立经常性收入。
分配价值应遵循观察到的转化、贡献和保留。收入分享、实施成本、账户所有权、排他性和终止权都属于队列模型。不利的情况应包括延迟奖励、政策变化、补贴减少、渠道利润压力和合作伙伴替代。
14 重视人才和多语言研究操作系统
印度语言基础模型的开发取决于研究人员、数据工程师、语言学家、评估人员、安全专家、基础设施工程师和产品团队。批判性知识可以由一小群人来讨论。公司应规划角色、就业和发明权、访问权限、继承、保留以及替换每项能力所需的时间。
研究操作系统应保存实验记录、数据版本、代码、模型制品、评估、发布决策和事件学习。买家应该能够重现定义的构建并解释版本之间的更改。仅存在于个人帐户或非正式消息中的文档削弱了可转移性。
人才价值应该通过保留和重建能力的成本来体现,而不是通过忽视未来薪酬的单独溢价来体现。预测应包括有竞争力的薪酬、相关签证、计算支持和管理能力。强大的系统可以减少关键人员的暴露,并将个人专业知识转化为组织能力。
15 构建四个印度基金会样板案例
多语言企业应用程序编程接口平台在覆盖范围、开发人员访问、可靠性和价格方面展开竞争。受监管的工作流程专家通过更强大的评估和文档服务于较少数量的银行、保险、医疗保健或公共管理任务。这家公共基础设施集成商为政府和受监管客户提供受控模型服务。语音和边缘网络专注于语音、辅助接入和低带宽分配。
每个案例都应该根据客户群体进行建模。假设包括转换、接受数量、价格、计算、实施、支持、研究、数据、隐私、营运资金和融资。语言扩展增加了可寻址的工作流程,同时增加了评估、支持和发布义务。分销可以降低客户获取成本,同时让合作伙伴能够控制经济和更新。
案例是决策工具。管理层应该用公司证据取代每一个假设,并指定一个所有者。董事会应定义在案例之间移动计划的事件,包括特定语言的验收、生产转换、签署的最低承诺、计算分配、渠道性能或延迟收集。
16 构建综合财务模型
该模型应将技术和商业分类账与收入、贡献、运营费用、资本支出、营运资本和融资联系起来。客户收入应与合同、验收、发票和现金保持一致。计算应符合使用情况和提供商条款。研究和语料库支出应与项目计划相协调。
现金时机可以决定可行性。在客户接受之前,公共或受监管的部署可能需要评估、安全、集成和专用容量。该模型应按计划显示里程碑计费、应收账款、供应商条款和流动性。当成本先于收款时,有利可图的合同可能会造成融资缺口。
基本案例应使用观察到的队列表现。上行仍应取决于证据和资金。下行趋势应包括转换较弱、价格较低、推理和支持成本较高、权利补救、产能延迟和融资轮次放缓。管理层的回应应该具体并考虑成本。
17 对证据状态应用评估方法
当收入、成本和再投资都可以支持时,贴现现金流可以对现有群体进行估值。市场方法可以提供背景,尽管模型所有权、数据权利、部署、增长、利润和资本密集度的差异限制了简单的收入倍数。重置成本分析可以帮助评估语料库和工程资产,而无需证明收入价值。
当价值取决于未来的技术和商业大门时,期权方法很有用。各州可以包括接受的试点、可重复的付费部署、规模化队列和战略分配。每个国家都需要根据其经济状况确定概率、时机、资本要求和企业价值。当可观察事件发生时,概率应该发生变化。
这些方法应该协调一致。评估日期、货币、债务、租赁、承诺、赠款、信贷和非经营资产应明确。公共支持或计算访问应仅包含在其条款和可用期限内。 IFRS 13和国际估值准则为公允价值和估值工作提供了相关原则[1-3]。
18 说明印度基金会模型经济学
假设的企业平台年收入为 185 亿印度卢比,贡献为 76 亿印度卢比。其规模支持最大的研究、数据和合规计划,假设耗资 62 亿印度卢比。该受监管专家的收入为 125 亿印度卢比,贡献为 47.5 亿印度卢比。文件、整合和专家支持在融资前保持现金为负 4 亿印度卢比。
该公共基础设施集成商的收入为 98 亿印度卢比,贡献为 31 亿印度卢比,融资前现金为负 12 亿印度卢比。该语音和边缘网络的收入为 72 亿印度卢比,贡献为 19 亿印度卢比,现金为负 16.5 亿印度卢比。收入下降本身并不意味着战略价值下降。投资者必须评估语言获取、分布和未来群体是否证明所需资本的合理性。
每个数字都是为了说明而创建的管理假设。这些案例不是对任何提供商的观察,也不是对印度市场的预测。真正的分析需要合同、验收记录、工作量遥测、计算条款、工资单、数据权利、发票、收款和资助的运营计划。
19 分别重视数据权利采用和主权选择
该框架分离了三个价值源。数据权限支持可再现能力和补救控制。采用证据支持收入质量和客户效用。主权选择权支持特定买家的准入、连续性和战略灵活性。如果没有明显的经济效果,同一事实不应被归入多个类别。
权利评分应衡量所有权链、允许使用、可转让性、可追溯性和补救措施。采用分数应衡量接受度、产出、贡献、收集和更新。主权期权评分应衡量控制力、可移植性、容量、安全性和客户资格。权重取决于投资主题。
这些分数是治理辅助工具,而不是估值公式。它们帮助识别缺失的证据和情况。现金流和期权模型将经过验证的效果转化为价值。委员会应记录哪些证据改变了收入、成本、风险、概率或资本。
20 围绕证据进行结构投资和考虑
投资部分可以使资金与语料库清理、可重复评估、可接受的部署、最低客户承诺和容量保持一致。收购对价可以结合基础价值、托管、保留和或有付款。里程碑应使用客观的数据源和定义的测量周期。
陈述应涉及所有权、许可证、数据来源、隐私、模型版本、安全、客户、计算和就业权利。赔偿分配财务风险,同时将运营补救留给公司。威胁核心能力的权利例外可能需要成交条件或价格调整,而不是一般保证。
如果后续部分未发放,资本计划应保护客户。董事会应避免产生无资金资助的服务义务的结构。工具、税务和会计处理需要相关司法管辖区当前的专业建议。
21 管理投资后的价值
投资后治理应使用与尽职调查相同的证据架构。董事会包应报告语料库权利例外、语言和领域评估、接受的工作流程、签约群体、贡献、集合、计算、事件、跑道和融资。模型发布和材料客户配置应得到负责的批准。
在模型、数据、部署、客户使用、监管、产能或资金发生重大变化后,公司应更新估值案例。新版本发布或供应商变更后,历史分数可能会变得陈旧。注明日期的异常登记册应显示所有者、补救措施以及对客户承诺的影响。
治理应保持以决策为导向。董事会需要改变资本配置、客户义务和企业价值的变量。详细的账本提供了可审计性。主要报告应解释经济后果和所需采取的行动。
结论
印度多语言基础模型的价值取决于互联操作系统。合法且可转移的数据支持能力。针对特定任务的评估证明了适应性。客户验收、发票、收款和续订证明采用。经过测试的部署、安全性和可移植性支持控制。计算和资金决定了系统能否继续运行。
基准、国家协会和参数量表仍然是有用的信号。它们的经济意义取决于它们支持的权利、工作流程和现金。投资者应重视经过验证的客户群和受控选项,同时通过明确的证据门为技术进步提供资金。
拟议的框架为董事会提供了一种区分语料库价值、采用价值和主权期权价值的实用方法。它还使假设场景与观察到的证据有所不同。当权利被清除、部署被接受以及现金被收集时,所产生的交易案例可以被更新。
印度多语言模型权利和出处登记册
登记册应包含来源、所有者、许可证、管辖权、收集方法、个人数据类别、允许的培训和改编、商业使用权利、再许可、转让、保留、删除、数据集版本、模型版本和批准。它应包括原始数据、清理数据、注释数据、合成数据和反馈数据。每个异常都应该有一个所有者、客户影响和补救计划。
公司应通过将选定的模型发布追溯到数据集证据来测试登记册。当源记录无法复制时,静态策略是不够的。测试还应涵盖主要训练运行和客户特定微调后添加的数据。访问和保密应反映合同义务。
对于材料缺口,管理层应估计更换数据、标签、计算、评估、延迟和客户后果。该时间表应将可移动源与以印度语言或域功能为中心的数据集区分开来。这种区别会影响保证、储备、价格和成交条件。
语言域和工作流程评估文件
该文件应定义用户群体、国家/地区、方言、语域、脚本、域、任务、结果、模型、提示、检索、工具、人工审核、接受阈值和测试日期。它应该保留示例、审阅者资格、协议、失败和发布决定。应检查基准污染和与训练数据的重叠。
客户测试应与公共基准保持不同。公共套件有助于比较已发布条件下的技术能力。客户接受度衡量合同工作流程内的绩效。当它们的范围和限制被阐明时,两者都是有用的。
该文件应将每个接受的评估与产品配置、合同和支持义务联系起来。较新的版本应与可接受的基线进行比较。材料回归应根据适用的合同触发发布决定和客户沟通。
收养合同及收养台账
账本应追踪每个客户从合格机会开始,经过勤勉、试点、验收、生产、发票、收款、续订等过程。它应包含实体、部门、国家、工作流程、模型、语言变体、数量、价格、折扣、直接成本、实施工作、合作伙伴份额、应收账款和责任所有者。
预测准确性应按群组来衡量。管理层应将原始概率、奖励日期、生产日期、收入、贡献和收款与实际结果进行比较。持续的延迟应该会改变管道转换和营运资本假设。
免费、赠款资助、战略和商业工作负载应单独确定。高使用率的免费服务可以在不证明定价的情况下创建技术学习。政府计划可以根据预算和接受度创建采购准入。董事会应该了解每个群体的经济状况。
分发部署和连续性档案
档案应说明合法所有权、托管、模型和软件权利、管理员访问权限、加密密钥控制、计算优先级、数据位置、分包商、支持、事件响应、恢复、可移植性和退出。每个断言都应链接到合同、测试或受控操作记录。
应在建议的环境中恢复代表性工作负载并定时。练习应涵盖模型制品、检索、审核、监控、身份、秘密、网络和数据。例外情况应向客户和服务表明后果。
档案应区分控制权和位置。印度的基础设施在产能、软件或管理方面仍然依赖外国供应商。分布式组件仍然可以通过可执行的权利和经过测试的替代方案进行管理。商业主张应与实际控制地位相符。
计算资金和交易文件
计算文件应协调预订、可用加速器、利用率、发票、信用、存储、网络、能源、支持、位置、服务水平、续订和终止。预测容量应与客户量和研究计划相匹配。受限和不利的情况应包括采购延迟和利用率降低。
资本文件应通过证据门显示项目资金、营运资金、债务和股权。它应该确定如果赠款、分配或融资轮次被延迟,仍然存在的义务。董事会应保留足够的流动性,用于合同客户服务和有序补救。
交易室应连接所有权、数据权限、模型版本、评估、客户、计算、安全、员工、融资和预测年份。每个委员会的声明都应链接到注明日期的来源和负责任的所有者。这种联系使得评估案例能够在证据发生变化时发生变化。
财务模型还应该在技术事件和现金之间建立一座桥梁。新模型的发布可能会在改变客户收入之前增加研究成本。权利例外可能需要重新培训、评估和客户沟通。容量预留可以提高连续性,同时创建固定承诺。每个事件都应该有一个注明日期的假设、一个负责任的所有者和一个明确的预测线。这座桥梁让董事会能够区分技术里程碑和财务资助的运营计划。
管理层应维护一份预测年份文件。该文件应记录每个决策日期使用的客户、工作量、数量、价格、直接成本、实施、收集和融资假设。实际结果应与原案和最新修订案进行比较。对转换、交付或收集的持续乐观应该会减少管理层估计的权重。预测纪律很重要,因为在技术兴趣和付费采用之间的差异变得明显之前,模型公司可能会消耗大量现金。
交易文件应包括严重但合理的连续性案例。该案件可能包括失去语料库许可证、延迟主要客户、临时容量限制、所需的安全补救措施和融资缓慢。公司应该确定将保留的服务、将推迟的研究、客户所需的现金以及董事会可以做出的决定。这项练习测试主权定位是否得到运营弹性的支持,以及拟议的资本结构是否能够承担客户合同产生的义务。
委员会应在投资后关闭证据循环。条件、赔偿、保留和里程碑应分配给所有者,并根据尽职调查中使用的相同记录进行审查。如果客户验收门释放对价,验收证据应与产品版本、合同和现金计划保持一致。如果维权补救结束了异常,公司应展示受影响的数据、模型和评估路径。保留这种可追溯性的治理使以后的融资、收购和监管审查更加可靠。
最后,证据室应该将观察结果与情景分开。合同、发票、藏品、模型制品、许可证和测试结果都是观察结果。在事件发生之前,转换率、续订、未来价格、研究成功和企业价值仍然是假设。每个情景都应说明其依据、日期和敏感性。这种分离有助于投资委员会更新概率,而无需重写历史记录或将假设结果呈现为当前市场事实。

拟议的框架;结论需要公司特定的技术、商业、法律和财务证据。

管理假设(单位:千万印度卢比);数字并非市场观察预测或估值结论。

管理假设(单位:千万印度卢比);负现金表明融资需求。

管理假设(单位:千万印度卢比);总概率加权值为 754 亿印度卢比。

提议的顺序;时机应遵循客户监管基础设施和融资限制。
| 成分 | 所需证据 | 估值问题 | 主要风险 |
|---|---|---|---|
| 模型和软件 | 存储库权重许可证分配发布记录 | 拥有什么能力并且可以转让什么能力 | 开放或受限的依赖关系 |
| 数据与评估 | 出处许可版本语言和任务测试 | 能力可以被复制和捍卫吗 | 缺少权利或不受支持的履行 |
| 工作流程采用 | 验收合同发票收款续订 | 哪些能力创造付费需求 | 飞行员被误认为是周期性经济学 |
| 分布和计算 | 渠道条款 分配利用率 托管连续性 | 能否经济地接触和服务客户 | 合作伙伴能力或补贴集中度 |
| 治理和安全 | 隐私角色图测试事件批准 | 义务能否得到大规模证明 | 补救中断或责任 |
拟议的尽职调查结构;要求取决于公司客户和交易。
| 部分 | 证据示例 | 商业用途 | 勤勉度限制 |
|---|---|---|---|
| 正式书面语言 | 受控推理提取和生成测试 | 政府媒体教育和文件 | 平均分可以隐藏领域失败 |
| 地区语言和言语 | 母语审稿人对话和演讲评估 | 服务中心助理和外勤业务 | 语言标签可以隐藏口音变化 |
| 代码转换和罗马化 | 混合语言和罗马化任务集 | 商务支持和数字渠道 | 拼写和标记化有所不同 |
| 领域语言 | 客户语料库术语和接受度 | 银行法健康工程 | 机密测试不得转移 |
| 文件和多式联运 | 音频文件图像和任务完成证据 | 公共服务档案和运作 | 组件准确性与工作流程实用程序不同 |
每个部分都需要一个任务和特定于客户的证据标准。
| 场地 | 所需证据 | 控制 | 决策用途 |
|---|---|---|---|
| 验证和验收 | 协议输出审核签核 | 版本化模型工作负载和语言 | 转换和效用 |
| 合同和计费 | 签署订单价格条款发票服务水平 | 实体和术语协调 | 收入和更新 |
| 渠道及配送成本 | 合作伙伴共享计算实施评估支持 | 发票和分配调节 | 捐款和现金 |
| 收藏 | 应收账款结算银行收据 | 账龄余额和异常所有者 | 流动性和客户质量 |
| 保留 | 续订使用已接受的结果和支持 | 队列和配置连续性 | 工作流程价值的持久性 |
建议的客户级分析的最低证据字段。
| 案件 | 收入 | 贡献 | 研究数据和合规性 | 融资前现金 |
|---|---|---|---|---|
| 多语言企业API平台 | 1850 | 760 | 620 | 95 |
| 受监管的工作流程专家 | 1250 | 475 | 410 | -40 |
| 公共基础设施集成商 | 980 | 310 | 360 | -120 |
| 语音和边缘网络 | 720 | 190 | 300 | -165 |
管理假设(单位:千万印度卢比);数字并非市场观察预测或估值结论。
| 物品 | 千万印度卢比 | 需要证据 |
|---|---|---|
| 收入 | 1250 | 客户合同验收发票和现金台账 |
| 计算和模型交付 | -335 | 工作负载遥测提供商发票和分配 |
| 数据评估和合规性 | -155 | 人员供应商权利和计划记录 |
| 实施伙伴和支持 | -285 | 项目时间合作伙伴结算及服务证据 |
| 扣除中央成本之前的贡献 | 475 | 协调一致的客户群体时间表 |
管理假设(单位:千万印度卢比);不包括中央研究销售管理融资和税收。
| 证据状态 | 企业价值 | 可能性 | 加权值 |
|---|---|---|---|
| 绘制语言权利并接受试点 | 1800 | 25% | 450 |
| 可重复的付费工作流程 | 5200 | 35% | 1820 |
| 规模化的多语言队列 | 11000 | 25% | 2750 |
| 战略公共和企业分销 | 16800 | 15% | 2520 |
| 全部的 | 100% | 7540 |
管理假设(单位:千万印度卢比);这不是一个估值结论。
| 门 | 所需证据 | 资本或对价回应 | 决策后措施 |
|---|---|---|---|
| 权利和控制 | 分配许可证数据出处复制构建 | 成交条件或受保护部分 | 例外和受控释放 |
| 工作流程采用 | 接受试点签署订单生产发票收集 | 验证后的基值 | 转换贡献和现金 |
| 语言和领域质量 | 受控评估和客户验收 | 里程碑资金 | 接受的结果和审查费用 |
| 隐私安全和责任 | 角色图测试事件恢复和补救 | 预留保留或分阶段释放 | 例外和关闭 |
| 计算与分发 | 分配条件利用成本渠道和退出测试 | 资金储备或价格调整 | 可接受的任务成本和连续性 |
拟议的框架;实际工具需要现行法律税务会计和财务建议。
来源
- 国际财务报告准则基金会。 IFRS 13 公允价值计量。 阅读主要来源
- 国际财务报告准则基金会。有关根据 IFRS 13 计量非上市权益工具的教育材料。 阅读主要来源
- 国际评估标准理事会。国际估值标准。 阅读主要来源
- 国际财务报告准则基金会。 IFRS 15 客户合同收入。 阅读主要来源
- 国际财务报告准则基金会。 IAS 38 无形资产。 阅读主要来源
- 国际财务报告准则基金会。 IAS 36 资产减值。 阅读主要来源
- 印度政府新闻信息局。内阁批准 IndiaAI 使命。 2024 年 3 月 7 日。 阅读主要来源
- 印度政府新闻信息局。 IndiaAI 任务支出和计算基础设施。 2024 年 3 月 7 日。 阅读主要来源
- 电子和信息技术部。印度人工智能专家组报告。 阅读主要来源
- 印度AI。印度人工智能计算门户。 阅读主要来源
- 印度AI。适合计算用户的 Ready Reckoner。 2026 年 3 月。 阅读主要来源
- 印度AI。计算最终用户分配。 阅读主要来源
- 印度政府新闻信息局。 IndiaAI Mission 通过经济实惠的计算和启动支持扩展了 AI 生态系统。 2026 年 3 月 25 日。 阅读主要来源
- 艾科什。关于国家数据集平台。 阅读主要来源
- 艾科什。 IndiaAI 使命和大学参与。 阅读主要来源
- 印度人工智能影响力峰会。公平获取基础 AI 资源。 阅读主要来源
- AI4巴拉特印度理工学院马德拉斯。研究计划。 阅读主要来源
- AI4巴拉特印度理工学院马德拉斯。机器翻译研究和 IndicTrans2。 阅读主要来源
- 辛格 H 等。印度基因基准。 2024 年。 阅读主要来源
- 辛格·AK等人。 IndicQA 基准。 2024 年。 阅读主要来源
- 维尔玛·S等。 MILU 多语言理解基准。 2024 年。 阅读主要来源
- 阿拉瓦帕利 A 等。 IndicSentEval。 2024 年。 阅读主要来源
- 萨尔瓦姆AI。 Sarvam M 技术报告。 2025 年 5 月 23 日。 阅读主要来源
- 萨尔瓦姆AI。介绍一下梧桐。 2026 年 2 月 20 日。 阅读主要来源
- 萨尔瓦姆AI。萨尔瓦姆愿景。 2026 年 2 月 5 日。 阅读主要来源
- 萨尔瓦姆AI。与印度各邦的主权AI伙伴关系。 2026 年 2 月 8 日。 阅读主要来源
- 萨尔瓦姆AI。 B 系列公告。 2026 年 6 月 15 日。 阅读主要来源
- 马恒达科技。梧桐项目启动。 2024 年 6 月 28 日。 阅读主要来源
- 马恒达科技。梧桐项目。 阅读主要来源
- 马恒达科技。 2023 年至 2024 年综合年度报告。 阅读主要来源
- 马恒达科技。梧桐项目白皮书。 阅读主要来源
- 艾科什。 Param2 17B 型号卡。 阅读主要来源
- 巴拉特将军BharatGen 计划。 阅读主要来源
- 印度政府科学技术部。国家跨学科网络物理系统任务。 阅读主要来源
- 电子和信息技术部。 2023 年数字个人数据保护法。 阅读主要来源
- 电子和信息技术部。 2025 年数字个人数据保护规则。 阅读主要来源
- 电子和信息技术部。 2025 年数字个人数据保护规则的解释性说明。 阅读主要来源
- 电子和信息技术部。 2025 年至 2026 年年度报告。 阅读主要来源
- 印度储备银行。免费-AI委员会报告。 2025 年 8 月。 阅读主要来源
- 印度储备银行。 2024 年至 2025 年年度报告。 阅读主要来源
- 印度储备银行。关于 AI 的负责任和道德支持的声明。 2024 年 12 月 6 日。 阅读主要来源
- 国家标准与技术研究所。人工智能风险管理框架。 阅读主要来源
- 国家标准与技术研究所。生成 AI 配置文件 NIST AI 600-1。 阅读主要来源
- 国际标准化组织。 ISO IEC 42001 人工智能管理系统。 阅读主要来源
- 国际标准化组织。 ISO IEC 23894 人工智能风险管理。 阅读主要来源
- 国际标准化组织。用于分析和机器学习的 ISO IEC 5259 数据质量。 阅读主要来源
- 经合组织。经合组织 AI 原则。 阅读主要来源
- 联合国教科文组织。关于人工智能伦理的建议。 阅读主要来源
- 世界知识产权组织。人工智能和知识产权。 阅读主要来源
- MLCommons。 MLPerf 推理基准。 阅读主要来源

