No SAP Datasphere, toda a aquisição, preparação e modelagem de dados ocorre dentro das áreas do. Vamos explorar o uso de áreas no SAP Datasphere.
Conceito de área

As áreas são ambientes de trabalho virtuais seguros que:
fornecer isolamento para objetos de metadados e recursos de área.
definir as configurações de cota de armazenamento, utilização de recursos de controle e classe de carga de trabalho.
manter conexões do sistema de origem específicas da área e uma dimensão de tempo comum.
gerenciar o acesso do usuário para membros da área em combinação com funções com escopo.
ativar compartilhamento de dados e configurações de conversão de moeda com outras áreas.
Os dados da área não podem ser acessados fora da área, a menos que sejam compartilhados com outra área ou expostos para consumo.

Você pode criar áreas com diferentes tipos de armazenamento:
Banco de dados SAP HANA (disco e in-memory): use o armazenamento de banco de dados SAP HANA (em disco e in-memory) para necessidades tradicionais de armazenamento de dados. Você aloca armazenamento em disco e memória, define uma prioridade e pode limitar quanta memória e quantos threads suas instruções podem consumir.
Arquivos de data lake do SAP HANA: áreas de arquivo são destinadas a carregar e preparar grandes quantidades de dados em uma área de staging de entrada de baixo custo e são armazenadas no repositório de objetos do SAP Datasphere. Você aloca recursos de computação.
Definição da área
Quando você define um espaço, o ID do espaço pode conter um máximo de 20 caracteres e não pode ser modificado posteriormente. Os caracteres válidos para o ID da área são: A - Z, 0 - 9 e _. O nome do espaço contém um máximo de 30 caracteres e pode ser alterado a qualquer momento.
Vamos explorar várias configurações ao definir uma área.

Em uma área com tipo de armazenamento Banco de dados SAP HANA (disco e in-memory), o tamanho do armazenamento precisa ser definido. O tamanho de armazenamento padrão é 2 GB para armazenamento em disco e 1 GB para armazenamento in-memory. Usando os botões + e -, você pode alterar o tamanho em 1 GB. Se você precisar ampliar ou reduzir em tamanhos menores, também pode modificar o tamanho em incrementos de 100 MB editando diretamente os valores com uma casa decimal.

Em uma área, os usuários podem ser atribuídos com uma função de administrador de área. Com essa função, eles podem gerenciar usuários, criar conexões com sistemas de origem, proteger dados com controles de acesso a dados e gerenciar outros aspectos da área. Como pré-requisito, um administrador precisa atribuir uma função com escopo à área.
Nota
Funções com escopo são objetos em seus próprios direitos e permitem que os usuários tenham um conjunto diferente de privilégios dependendo da área atribuída, por exemplo, ser modelador na área A e visualizador na área B.

Usuários do banco de dados
Usuários com uma função de administrador de área podem criar usuários do banco de dados. Um usuário de banco de dados no SAP Datasphere é um usuário técnico que fornece acesso seguro ao banco de dados SAP HANA Cloud subjacente usando o esquema Open SQL, permitindo que ferramentas e aplicativos externos se conectem diretamente aos dados da área por meio de protocolos SQL padrão.
Você pode definir como um usuário do banco de dados pode usar a funcionalidade de esquema Open SQL:
- Ativar acesso de leitura (SQL)
- Ativar acesso de escrita (SQL, DDL, DML)
- Ativar Automated Predictive Library e Predictive Analysis Library
- Ativar logs de auditoria para operações de leitura/alteração
Para cada área, você precisa definir um usuário de banco de dados dedicado porque cada usuário só pode acessar o esquema de banco de dados específico da área correspondente.
Nota
Containers HDI
Um container HDI (SAP HANA Deployment Infrastructure) no SAP Datasphere é um ambiente de banco de dados isolado e seguro que armazena artefatos de tempo de design, por exemplo, tabelas e visões, e seus objetos de catálogo de tempo de execução implementados correspondentes. Os containers HDI funcionam como unidades de armazenamento especializadas para artefatos de desenvolvimento de banco de dados, fornecendo uma abordagem declarativa para definir objetos de banco de dados e garantir uma implementação consistente no banco de dados SAP HANA Cloud subjacente.
Você pode ativar o acesso a containers HDI em sua área. Modeladores podem usar artefatos HDI como fontes para visões e clientes HDI podem acessar dados de área.

Você pode criar uma tabela relacionada ao tempo para sua área.
Informações como anos, trimestres, meses e dias enriquecem ainda mais seus modelos fornecendo informações adicionais relacionadas ao tempo. Ao criar hierarquias com base em uma resolução específica, as dimensões de tempo também permitem que você detalhe as histórias. Você pode criar uma tabela de dimensão de tempo dentro de uma área que, em seguida, permite adicionar as dimensões de tempo aos seus objetos nas ferramentas de modelagem. Uma tabela de tempos é criada somente uma vez por área.

Você pode controlar seus dados criando um log de auditoria.
Você pode escolher se deseja que um log de leitura ou um log de alterações seja criado para uma área. Você poderá ver quem efetuou modificações em seus dados ou quem leu os dados. Isso é para os dados criados em sua área. Para dados provenientes de clientes de terceiros, um log de auditoria individual deve ser criado editando seu usuário do banco de dados.
Os arquivos de log são salvos em um log de auditoria do SAP HANA. Este log deve ser mapeado para uma área se você quiser ler os dados. Recomendamos a criação de uma área dedicada somente para logs de auditoria. Dessa forma, você pode garantir que somente usuários elegíveis possam visualizar os dados. Mapeie o log de auditoria para essa área em Administração→Auditoria e selecione a área dedicada na lista suspensa.
Priorização de espaço

O gerenciamento de carga de trabalho no SAP Datasphere permite que os administradores controlem a alocação de recursos, as prioridades de processamento e os limites de instrução para áreas a fim de otimizar o desempenho e evitar a contenção de recursos. Isso garante uma distribuição de carga de trabalho equilibrada e impede que operações individuais consumam recursos excessivos do sistema.
Com a priorização de áreas, você pode decidir a importância da sua área em comparação com outras áreas.
As áreas enviam consultas ou jobs para o banco de dados. Em seguida, o banco de dados deve decidir qual job ou consulta deve ser tratado primeiro. As consultas de áreas importantes podem ser favorecidas, ou seja, serão processadas mais rapidamente do que as consultas de outras áreas. As áreas com prioridade 5 têm a prioridade mais alta disponível. A configuração mais baixa é 1.
Você pode definir limites máximos de total de threads e memória que as instruções em execução simultânea na área podem consumir. Você pode selecionar uma das seguintes opções:
Padrão: a configuração padrão fornece limites de recursos generosos e, ao mesmo tempo, impede que qualquer área individual sobrecarregue o sistema. A configuração padrão é aplicada por padrão a novas áreas.
Personalizado: você pode definir limites de total máximo personalizado de threads e de memória que as instruções em execução simultânea na área podem consumir.