Version 26.7 de ClickHouse, 2026-07-22. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- L’accès à S3 depuis le SQL utilisateur ne résout plus par défaut les propres informations d’authentification cloud du serveur (environnement, IMDS/IRSA, profil d’instance, fichiers de config AWS, STS basé sur
role_arn, métadonnées OAuth GCP) ; une telle requête doit utiliser des informations d’authentification explicites ouNOSIGN. Les collections nommées définissent désormais par défautuse_environment_credentialssur0. Le comportement précédent peut être rétabli requête par requête avecuse_environment_credentials = 1(ou globalement via la config<s3>) en combinaison avec le nouveau paramètre serveurs3_allow_server_credentials_in_user_queries(désactivé par défaut). Les informations d’authentification de config fournies explicitement et provisionnées par l’opérateur ne sont pas affectées. Au démarrage du serveur ou lors deRESTORE, une table persistanteS3/S3Queue, un disque S3 dynamique ou unDataLakeCatalogdont la définition résout de telles informations d’authentification est chargé anonymement (inaccessible jusqu’à ce que de nouvelles informations d’authentification soient fournies) au lieu d’interrompre le démarrage ; ce comportement est contrôlé par le nouveau paramètre serveurs3_load_table_anonymously_if_credentials_restricted(activé par défaut). #106855 (Raúl Marín). - Le glob
**/(n’importe quel nombre de répertoires) correspond désormais aussi au même répertoire. Auparavant,**/dans les motifs glob n’était pas traité comme un cas particulier, doncdata/**/file.txtne correspondait pas àdata/file.txt(zéro niveau de répertoire). #97676 (Alexey Milovidov). - Le format d’archive de sauvegarde
zip/zipxest désormais refusé pour les sauvegardes stockées sur un stockage objet — destinations directesS3(...)/AzureBlobStorage(...)et destinationsDisk(...)reposant sur S3 ou Azure — aussi bien pourBACKUPque pourRESTORE. Zip nécessite un accès aléatoire pour lire son répertoire central, ce qui est très lent sur un stockage objet. Utilisez plutôt un format basé sur tar, commetar.gz. #101770 (Yash ). - Étend la plage prise en charge de
DateTime64de[1900-01-01, 2299-12-31]à[0000-01-01, 9999-12-31]. Les valeurs en dehors de l’ancienne plage sont désormais calculées correctement (via cctz) au lieu d’être ramenées à la borne la plus proche. Avec une précision de 8 ou 9, la plage reste plus étroite, car les ticks sont stockés enInt64(avec une précision à la nanoseconde, le maximum reste2262-04-11). Compatibilité descendante : si vous utilisiez auparavant des dates/heures hors plage, mais que vous vous appuyiez sur les règles de saturation très spécifiques à l’intérieur de l’ancienne plage, gardez à l’esprit que les résultats changent désormais pour être plus corrects. #107907 (Alexey Milovidov). AggregatingMergeTreerejette désormais, au moment de la création de la table, les schémas dans lesquels une colonne ne fait partie ni de la clé de tri ni d’une mesure d’état d’agrégation (AggregateFunction/SimpleAggregateFunction). De telles colonnes sont silencieusement réduites à une valeur arbitraire lors des fusions en arrière-plan, ce qui produit des résultats erronés pour les requêtes qui font unGROUP BYdessus ou les utilisent dans un filtre. Définissezallow_dimensions_outside_sorting_key = 1pour rétablir le comportement précédent. Closes #751. #108087 (Alexey Milovidov).- Supprime la configuration de l’ordonnancement des workloads basée sur la config (les sections de config serveur
resourcesetworkload_classifiers). Utilisez plutôt les requêtesCREATE RESOURCEetCREATE WORKLOAD. Les sections de config obsolètes sont ignorées avec un avertissement. #108286 (Sergei Trifonov). - ClickHouse utilise désormais systématiquement le hachage unifié de déduplication des insertions, aussi bien pour les insertions synchrones que pour les insertions asynchrones ; les anciens comportements de déduplication par insertion ont été supprimés. Le paramètre serveur
insert_deduplication_versionest conservé comme garde-fou de migration : le serveur refuse de démarrer s’il est défini sur une valeur legacy (old_separate_hashesoucompatible_double_hashes). Pour effectuer une mise à niveau depuis une version qui utilisait une valeur legacy, exécutez d’abord une version qui prend en chargecompatible_double_hashes(qui écrit à la fois les hachages legacy et le hachage unifié). Pour les tables répliquées, exécutez-la pendant au moinsreplicated_deduplication_window_seconds(une heure par défaut ; les fenêtres par défaut conservent les hachages unifiés de toutes les insertions sur cette durée, ce qui est considéré comme suffisant pour une boucle de nouvelle tentative d’insertion). Pour les tables non répliquées avecnon_replicated_deduplication_window> 0, cette fenêtre est basée sur le nombre d’insertions plutôt que sur le temps ; exécutez donccompatible_double_hashespendant au moins ce nombre d’insertions. Supprimez ensuite le paramètre (ou définissez-le surnew_unified_hash) avant de passer à cette version. #108361 (Sema Checherinda). Si vous n’avez jamais définiinsert_deduplication_version, vous pouvez ignorer ce point. - Suppression des fonctions obsolètes depuis longtemps
snowflakeToDateTime,snowflakeToDateTime64,dateTimeToSnowflakeetdateTime64ToSnowflake. Elles ont été dépréciées dès la v24.6 au profit desnowflakeIDToDateTime,snowflakeIDToDateTime64,dateTimeToSnowflakeIDetdateTime64ToSnowflakeID, qu’il faut désormais utiliser à la place. Le paramètreallow_deprecated_snowflake_conversion_functions(qui permettait auparavant de les réactiver) est désormais obsolète et n’a plus aucun effet. #108711 (Alexey Milovidov). - Le paramètre
use_legacy_to_timevaut désormais0par défaut ;toTimeconvertit donc les valeurs vers le type de donnéesTimeau lieu de convertir une valeur date-heure en date fixe. Le comportement legacy reste disponible via la fonctiontoTimeWithFixedDateou en définissantuse_legacy_to_time = 1. #108729 (Alexey Milovidov). - Les modèles Naive Bayes (utilisés par
naiveBayesClassifier) sont désormais configurés sous forme de dictionnaire avec le layoutNAIVE_BAYES, construit au chargement à partir d’une table de comptes de n-grammes pré-agrégés par classe, au lieu de l’ancienne configuration côté serveur (un fichier de configuration XML référençant des fichiers de modèle.binsérialisés), qui n’est plus prise en charge — les modèles existants doivent être recréés sous forme de dictionnaires. Trois nouvelles fonctions s’ajoutent ànaiveBayesClassifier:naiveBayesClassifierWithProbrenvoie la classe prédite avec sa probabilité,naiveBayesClassifierWithAllProbsrenvoie chaque classe avec sa probabilité, etnaiveBayesNgramssegmente le texte en n-grammes de la même façon que le dictionnaire, afin de construire les données d’entraînement à partir de texte brut étiqueté. En outre, plusieurs optimisations de performances ont été appliquées : sur un modèle de langue à trigrammes de points de code de 9.7 MiB, il utilise ~49× moins de mémoire (de 1.84 GiB à 38 MiB), se charge ~11× plus vite et classe ~11× plus vite. #108773 (Nihal Z. Miaji). - La fonction
hasColumnInTablen’accepte plus les arguments optionnelshostname,usernameetpasswordpour vérifier une colonne sur un serveur distant arbitraire ; seule la formehasColumnInTable(database, table, column)reste disponible. Le mode distant supprimé posait un problème de sécurité : il permettait à n’importe quel utilisateur de déclencher des connexions sortantes vers des hôtes arbitraires et exposait des identifiants dans les journaux de requêtes, sans être protégé par le moindre privilège. #110881 (Alexey Milovidov).
Nouvelle fonctionnalité
- Ajout de
EXPLAIN ANALYZEpour analyser les performances des requêtes : la requête est exécutée et les métriques d’exécution réelles sont affichées dans le format habituel du plan de requête. #106586 (Kirill Kopnev). #110668 (Kirill Kopnev). - Ajout de la prise en charge des clauses
WHEREdans les définitions de projections. Les projections avecWHEREne matérialisent que les lignes correspondant au prédicat, et l’optimiseur peut les utiliser (en fonction du coût) lorsque leWHEREde la requête implique leWHEREde la projection. #102347 (S Bala Vignesh). - Ajout du paramètre
skip_unavailable_shards_mode(également disponible comme paramètre du moteurDistributed) pour contrôler quelles exceptions provenant d’un shard distant sont ignorées silencieusement lorsqueskip_unavailable_shardsest activé. #79091 (cjw). - Ajout de la fonction d’agrégation
groupFormat, qui met en forme les lignes de chaque groupe à l’aide d’un format de sortie spécifié et renvoie le résultat sous forme de chaîne. #93201 (Yang Hu). - Ajout de
AWS_MSK_IAMcomme valeur prise en charge pourkafka_sasl_mechanism, permettant à ClickHouse de s’authentifier auprès d’Amazon MSK à l’aide de rôles IAM sans avoir à gérer les identifiants SASL/SCRAM. #96100 (kalavt). - Ajout du combinator de fonction d’agrégation
-Tuple, qui applique indépendamment la fonction d’agrégation sous-jacente à chaque élément d’une colonneTupleet renvoie unTupledes résultats, en préservant les noms des éléments :sumTuple(t)pourt = (a, b)renvoie(sum(a), sum(b)). Les fonctions d’agrégation avec plusieurs arguments prennent un tuple par argument, apparié par position :corrTuple((a1, a2), (b1, b2))renvoie(corr(a1, b1), corr(a2, b2)). Contrairement à-ForEachsur desArray, les éléments peuvent avoir des types différents, et les types de résultat ainsi que les noms sont préservés pour chaque élément. #98190 (RinChanNOW). - Les index de texte prennent désormais en charge un argument
postprocessor— une expression arbitraire qui transforme chaque jeton après la tokenisation (par exemple,lower). #98939 (Jimmy Aguilar Mena). #108606 (Jimmy Aguilar Mena). - Ajout de la table système
system.stemmers, qui répertorie toutes les langues pouvant être spécifiées pour la fonctionstem. #100611 (Jimmy Aguilar Mena). - Ajout de la prise en charge de
WITH TIESpourLIMITnégatif. #100930 (Nihal Z. Miaji). - Ajout de la prise en charge des opérateurs postfixes SQL standard
AT TIME ZONEetAT LOCALcomme sucre syntaxique pourtoTimeZone. L’expressionexpr AT TIME ZONE zoneest désormais équivalente àtoTimeZone(expr, zone), etexpr AT LOCALest équivalente àtoTimeZone(expr, timeZone()). #106092 (lizepeng). - Le table engine
URLet la table functionurlaiguillent désormais vers le backend approprié en fonction du schéma de l’URL :file://est pris en charge par le moteurFile,s3:///gs:///gcs:///oss://parS3,az:///azure:///abfss:///abfs://parAzureBlobStorage,hdfs://parHDFS, ethttp(s)://par le moteurURLcomme auparavant. Le paramètreurl_baseest appliqué avant l’aiguillage selon le schéma. Seuls les schémas S3 résolus par lesurl_scheme_mapperspar défaut sont aiguillés ; les autres schémas de fournisseurs S3-compatible (cos,obs, …) ne le sont pas et nécessitent d’utiliser directement le moteur ou la fonctions3. #106093 (Alexey Milovidov). - Ajout des table engines
RemoteetRemoteSecure, équivalents persistants des table functionsremoteetremoteSecure.CREATE TABLE ... ENGINE = Remote('addresses', db, table, ...)fonctionne désormais en plus deCREATE TABLE ... AS remote(...). #106189 (Alexey Milovidov). - Ajout des commandes indépendantes du moteur
SYSTEM STOP,SYSTEM START,SYSTEM PAUSE,SYSTEM CANCELetSYSTEM REFRESH, ainsi que de leurs variantes globales... ALL BACKGROUNDà l’échelle du serveur, pour contrôler l’activité en arrière-plan des tablesKafka,RabbitMQ,NATS,S3Queue/AzureQueueet des vues matérialisées actualisables via une interface unifiée. Pour les vues matérialisées actualisables, elles servent d’alias aux commandes existantesSYSTEM ... VIEW. Dans le cadre de la prise en charge de ces contrôles pour NATS, les tables JetStream n’acquittent désormais les messages qu’après un insert réussi (au moins une fois ; auparavant, les messages étaient acquittés automatiquement à la livraison et pouvaient être perdus si l’insert échouait). Un nouveau paramètrenats_wait_for_flush_interval(par défautfalse, ce qui préserve le comportement précédent à faible latence) permet, en option, de garder un cycle de consumption ouvert pendant tout l’intervalle de flush au lieu d’effectuer un flush dès que la queue est vide. Un nouveau paramètrenats_commit_on_selectfait qu’unSELECTdirect sur une table JetStream consomme (acquitte) les messages qu’il lit. #107476 (Samuel Krempaský). - Ajout de la prise en charge, dans les table functions et table engines
mysql,postgresqletsqlite, d’une query fournie par l’utilisateur (au lieu d’un nom de table) et transmise telle quelle à la base de données externe, soit sous forme de sous-requête(SELECT ...), soit sous la formequery('SELECT ...'). La structure de la table résultante est déduite du résultat de la requête, et une telle table est en lecture seule. Closes #46758. Basé sur l’implémentation initiale de Denis Vidiaev (#79652). #107740 (Alexey Milovidov). - Ajout d’onglets dans l’UI Web de ClickHouse (Play) pour travailler avec plusieurs requêtes à la fois. Les onglets, leurs titres, paramètres, état actif et petits snapshots de résultats sont conservés entre les rechargements (les résultats volumineux et les images ne sont pas restaurés), s’intègrent à l’historique du navigateur et à l’URL, et peuvent être changés avec la molette de la souris. #107826 (Alexey Milovidov).
- Introduction du table engine
QueryRunner. Les enregistrements insérés dans une tableQueryRunnerreprésentent des requêtes que le moteur exécute. Le moteur peut être utilisé pour l’exécution asynchrone de requêtes, l’exécution par lots de requêtes générées, l’acheminement de requêtes vers des clusters distants, des benchmarks, du fuzzing et des tests avec trafic fantôme. #107888 (Miсhael Stetsyuk). - Ajout du format de sortie
GeoJSONpour écrire des documentsFeatureCollectionGeoJSON, en produisant une entité par ligne. L’unique colonne de type géométrique (Point,LineString,MultiLineString,Polygon,MultiPolygon,RingouGeometry) devient lageometryde chaque entité ; une colonne nomméeiddevient l’idde l’entité ; et toutes les autres colonnes deviennent lespropertiesde l’entité, sachant qu’une unique colonne de type objet nomméeproperties(unJSON,MapouTuplenommé) est écrite directement comme objetproperties. UnRingest écrit comme unPolygonà un seul anneau. Le nouveau paramètreformat_geojson_validate_geometry(activé par défaut) contrôle si les géométries qui ne constituent pas des formes GeoJSON valides — comme unPolygonavec moins de quatre points ou un anneau dePolygonnon fermé — sont rejetées à la lecture et à l’écriture. De plus, le format d’entréeGeoJSONdéduit désormais la colonneidcommeNullable(String)au lieu deString, de sorte qu’une entité dont le membre"id"est absent ou explicitement défini ànullest lue commeNULLet reste distincte d’une chaîne vide"". Basé sur l’implémentation initiale de Mark Needham (#98124). #108065 (Nihal Z. Miaji). - Ajout de la fonction
dotProductTransposed(aliasscalarProductTransposed) qui calcule le produit scalaire approximatif entre une colonneQBitet un vecteur de référence, en complément des fonctions existantesL2DistanceTransposedetcosineDistanceTransposed. #108100 (Alexey Milovidov). Ajout des fonctions de distance transposée quantifiéecosineDistanceTransposedQuantized,L2DistanceTransposedQuantizedetdotProductTransposedQuantized, qui opèrent sur unQBit(Int8)de codes Lloyd-MaxquantizeBFloat16ToInt8, en déquantifiant les codes stockés à la volée. Un vecteur de référence en virgule flottante constitue la requête en pleine précision, comparée avec une précisionFloat32(une requêteFloat64est ramenée à cette précision) ; une référenceArray(Int8)est elle-même déquantifiée, pour une distance quantifiée symétrique de type quantized-vs-quantized. #109405 (Alexey Milovidov). - Ajout d’un paramètre
strideoptionnel au type de donnéesQBit(QBit(T, dimension, stride)), qui stocke les groupes de dimensions dans des flux séparés, afin qu’une recherche vectorielle puisse lire efficacement uniquement les premières dimensions (par exemple pour les Matryoshka embeddings). Les fonctions de distance transposée acceptent un quatrième argument optionnelused_dimspour lire un nombre réduit de dimensions. #108103 (Alexey Milovidov). - Ajout de la prise en charge du type d’élément
Int8dans le type de donnéesQBit, permettant le stockage et la recherche vectorielle par distance transposée (L2DistanceTransposed,cosineDistanceTransposed) sur des vecteurs d’entiers 8 bits quantifiés. #108105 (Alexey Milovidov). - Nouvelle fonction
randomHadamardTransform(vector[, seed[, output_dims]]): une transformée de Hadamard aléatoire déterministe d’un vecteur flottant — une rotation orthogonale qui préserve la norme, utile pour le prétraitement des embeddings avant la quantification et, lorsqu’elle est tronquée, comme projection aléatoire de Johnson–Lindenstrauss / Hadamard aléatoire sous-échantillonnée. #108227 (Alexey Milovidov). - Prise en charge de la configuration du chargement différé des dictionnaires au cas par cas avec le paramètre
dictionary_lazy_loaddans la définition du dictionnaire, remplaçant le paramètre serveur globaldictionaries_lazy_load, afin que certains dictionnaires puissent être chargés de façon différée tandis que d’autres sont chargés immédiatement. #108314 (Miсhael Stetsyuk). - Ajout d’une page de recherche intégrée à la documentation, disponible à l’emplacement
/docsde l’interface HTTP, qui fournit une recherche instantanée dans la tablesystem.documentationet affiche la documentation de Reference (avec coloration syntaxique, formules mathématiques et liens croisés). #108345 (Alexey Milovidov). - Ajout de la fonction
xxHash64Spark, qui calcule des valeursxxHash64compatibles avec Spark pour les entréesStringetNULLà l’aide de la graine42et renvoieInt64. #108436 (Lalit Yadav). ALTER USER,ALTER ROLEetALTER SETTINGS PROFILEacceptent désormaisSET name = valuecomme alias deMODIFY SETTING name = value. Cela modifie les paramètres individuellement, sans toucher aux autres, contrairement à la clauseSETTINGSseule, qui remplace l’intégralité de la liste des paramètres. Cela réduit le risque d’effacer accidentellement d’autres paramètres d’un utilisateur. #108722 (Groene AI).- Prise en charge de
ALTER TABLE ... MODIFY CONSTRAINT [IF EXISTS] name CHECK exprpour modifier sur place l’expression d’une contrainte existante. #108768 (Alexey Milovidov). - Web UI : ajout d’un commutateur de codage couleur par colonne (l’icône 🌈 dans l’en-tête d’une colonne) pour basculer entre barres, heatmap, catégoriel et aucune visualization. Les modes sélectionnés sont mémorisés dans l’URL et l’historique du navigateur. #108873 (Alexey Milovidov).
Keepergère désormais correctement l’opcodeCreateContainer(19) deZooKeeper, derrière un nouveau flag de featurecreate_containerà activer explicitement (désactivé par défaut, commecreate_ttl). Une fois activé après une mise à niveau complète de l’ensemble, les clientsZooKeeperexternes (par ex. JavaZooKeeper3.9+) peuvent créer des nœuds conteneurs surKeeperau lieu de recevoirConnectionLoss; les nœuds conteneurs renvoient la valeur sentinelleephemeralOwnerattendue, et un thread de GC en arrière-plan sur le leader supprime automatiquement les conteneurs sans enfants. Une requêteCreatesimple portant le flag de mode de créationCONTAINERsans opcode 19 continue d’être rejetée (ZBADARGUMENTS) : aucun clientZooKeeperconnu n’émet cette combinaison. Il s’agit uniquement d’une compatibilité de protocole côté serveur : le clientZooKeeperpropre à ClickHouse (zkutil) reste inchangé et ne dispose d’aucune API pour créer lui-même des nœuds conteneurs. #108908 (unintended).- Ajout des fonctions
geoToUTM,UTMToGeo,geoToMGRSetMGRSToGeopour convertir entre les coordonnées géographiques WGS84 et les systèmes de coordonnées UTM et MGRS. #108939 (Alexey Milovidov). - Ajout de la fonction
digits(n, offset[, length]), qui renvoie les chiffres denà partir de l’offsetindexé à partir de 1 surlengthchiffres, ou jusqu’à la fin du nombre silengthest omis. #109012 (Umang Agrawal). - Ajout de la fonction arithmétique
sqrpour calculer le carré d’un nombre. #109061 (Lalit Yadav). - Ajout d’une nouvelle fonction
dictGetRoot, qui renvoie l’ancêtre le plus haut (la racine) d’une clé dans un dictionnaire hiérarchique. Il s’agit d’un équivalent pratique dedictGetHierarchy(dict_name, key)[-1]. #109459 (Alexey Milovidov). - Ajout des commandes
SYSTEM UNLOAD DICTIONARYetSYSTEM UNLOAD DICTIONARIESpour libérer la mémoire des dictionnaires sans supprimer leur définition. Les dictionnaires seront rechargés de manière différée lors du prochain accès. #109639 (Matheus Nerone). - Ajout des fonctions
geometryIntersectCartesianetgeometryIntersectSpherical, qui indiquent si deux géométries s’intersectent. Contrairement àpolygonsIntersectCartesian/polygonsIntersectSpherical, elles acceptent n’importe quel type de données géométriques (Point,LineString,MultiLineString,Ring,Polygon,MultiPolygon), y compris le type communGeometry, et les deux arguments peuvent être de types différents. #110062 (Alexey Milovidov). - Les paramètres de requête (substitutions
{name:Type}) peuvent désormais être utilisés comme valeurs de paramètre, à la fois dans la clauseSETTINGSd’une requête (telle queSELECTouINSERT) et dans des requêtesSETautonomes, par exempleSELECT ... SETTINGS max_threads = {threads:UInt64}etSET max_threads = {threads:UInt64}. #108760 (Alexey Milovidov).
Fonctionnalité expérimentale
- Expansion des caractères génériques pour la fonction de table
urlet le moteur de tableURL: les caractères génériques dans le chemin de l’URL sont développés en listant les pages d’index HTTP (listes de répertoires HTML ou en texte brut) et en extrayant les URL correspondantes, avec des limites sur la taille de la page d’index et le nombre de répertoires lus. Activé par le paramètreallow_experimental_url_wildcard_from_index_pages. #95181 (Yue Ni). - Les index de texte peuvent désormais stocker les positions des jetons (l’argument d’index
support_phrase_search) pour permettre une correspondance exacte des expressions avec des lectures directes pour la fonctionhasPhrase. Nécessite d’activer le paramètreMergeTreeallow_experimental_text_index_phrase_search. #103172 (Elmi Ahmadov). L’argument a d’abord été introduit sous le nompositions. #109900 (Elmi Ahmadov). - Prise en charge de la compaction des fichiers manifestes pour les tables
IcebergviaOPTIMIZE TABLE ... MANIFEST(protégée par le paramètreallow_experimental_iceberg_compaction). Résout #95174. #98178 (Smita Kulkarni). Correction deOPTIMIZE TABLE ... MANIFESTpour les tablesIceberglorsque les tuples de partition du manifeste ne correspondent pas à leur spécification de partition. #111368 (Smita Kulkarni). - Ajout d’une variante Real Doubles (RD) et d’un argument facultatif
ALP(AUTO|STD|RD)au codec expérimentalALP.ALPseul sélectionne désormais automatiquement entre le schémaSTDexistant etRD, au lieu d’utiliser systématiquementSTD. #99654 (Nazarii Piontko). - Ajout d’un cache SLRU en mémoire pour les fichiers de métadonnées
Paimondésérialisés (manifest lists et manifestes). Lorsqu’il est activé via le paramètreuse_paimon_metadata_files_cache, les requêtes répétées sur la même tablePaimonévitent de retélécharger et de réanalyser les métadonnées depuis l’object storage. #104657 (XiaoBinMu). - Ajout de « drivers » pour les fonctions définies par l’utilisateur exécutables. Un driver déclaré dans
<user_defined_executable_function_drivers_config>peut être utilisé dansCREATE FUNCTION name ARGUMENTS (...) RETURNS T ENGINE = DriverName(...) AS '...code...'pour compiler ou autrement traiter un extrait de code utilisateur au moment de la création de la fonction, et produire une UDF exécutable. La configuration résultante est stockée dans<dynamic_user_defined_executable_functions_path>, et la requête d’origine est conservée sous la formeATTACH FUNCTIONafin que la fonction survive aux redémarrages du serveur. Un driverc_function_bodyde preuve de concept compile et exécute des corps de fonctions C dans des conteneurs Docker isolés en modeexecutable_pool. Basé sur l’implémentation initiale de Daniil Timižev (#77128). #105131 (Alexey Milovidov). - Exécute
SELECT count(*) FROM t WHERE col <op> default(col)à partir des statistiques de parcimonie par colonne dansserialization.json, sans aucune analyse des données, lorsque le prédicat partitionne exactement la colonne entre valeurs par défaut et non par défaut (avec le nouveau paramètre expérimentaloptimize_trivial_count_with_sparsity_filter, désactivé par défaut). #105890 (Raúl Marín). - Les requêtes d’API de la Query API Prometheus vers
/api/v1/queryet/api/v1/query_rangesont désormais enregistrées danssystem.query_logavec les métriquesread_rowsetread_bytes. #106611 (James Cunningham). - Le chemin de lecture expérimental
ReaderExecutor(use_reader_executor, désactivé par défaut) peut désormais maintenir ouverte une connexion à une source distante et la réutiliser pour des lectures séquentielles, réduisant ainsi le nombre de requêtes vers l’object storage lors des parcours. #107735 (Sema Checherinda). Il prend également désormais en charge la lecture de fichiers chiffrés, avec un cache global des en-têtes de chiffrement configuré par le paramètre serveurencryption_header_cache_sizeet vidé parSYSTEM DROP ENCRYPTION HEADERS CACHE. #109702 (Sema Checherinda). - Prise en charge des lectures basées sur un plan de requête distribué pour
SELECT ... FINALsur les tables de la familleMergeTreelorsquemake_distributed_planest activé. #108148 (Alexander Gololobov). - Ajout d’une exécution expérimentale des répliques parallèles basée sur le plan pour les requêtes
MergeTree. #108504 (Igor Nikonov). - Ajout de la famille expérimentale de codecs vectoriels
Quantizeet d’une réécriture optionnelle de recherche vectorielle approximative en deux étapes sur des flux compagnons quantifiés. #108565 (Shankar Iyer). - Réactivation du codec de compression avec perte à erreur bornée expérimental
SZ3pour les colonnesFloat32/Float64(et leurs tableaux), initialement implémenté par Konstantin Vedernikov (#83088). Il nécessiteallow_experimental_codecs. #108788 (Alexey Milovidov). Correction de la lecture des données compressées avecSZ3('ALGO_LORENZO_REG', ...), qui échouait auparavant avecCORRUPTED_DATA, et suppression d’un comportement indéfini lors de la compression de valeurs en virgule flottante non finies (NaNet infinis). #110762 (Alexey Milovidov). - Ajout du codec expérimental
ZXC— un codec LZ asymétrique avec une compression lente et une décompression très rapide, offrant un taux de compression compris entreLZ4etZSTD. Il nécessiteallow_experimental_codecs = 1, etsystem.compression_codecsle signale comme expérimental. #110620 (Alexey Milovidov). #111007 (Alexey Milovidov). - Vous pouvez désormais vous authentifier auprès de OneLake à l’aide d’un bearer token obtenu au préalable via le paramètre
onelake_bearer_token, au lieu deonelake_client_idetonelake_client_secret. Cela évite de partager un secret client de longue durée. Le token n’est pas renouvelé ; la base de données doit donc être recréée une fois qu’il expire. #109104 (Asya Shneerson). - Les AI functions ne prennent plus la named collection comme premier argument positionnel. Les informations d’authentification proviennent des paramètres
ai_function_text_default_credentials/ai_function_embedding_default_credentialsou d’une clécredentialsdans un argument final facultatifMap(String, String), qui transporte également les paramètres ajustables (model,max_tokens,temperature,system_prompt,instructions,dimensions). #109232 (George Larionov). La fonctionaiEmbedprend désormaismodelcomme argument positionnel obligatoire (aiEmbed(text, model[, params])) au lieu de le lire depuis la named collection, ce qui garantit la reproductibilité des embeddings. #110619 (George Larionov). - Correction de
data_uncompressed_bytespour les index de saut empaquetés dansskp_idx.packed(viapacked_skip_index_max_bytes) : la taille non compressée signalée correspondait en réalité à la taille compressée, ce qui pouvait également empêcher l’activation dedistributed_index_analysis. #109272 (Raúl Marín). - Ajout d’un stockage expérimental de data part empaquetées pour les tables
MergeTree, qui regroupe la plupart des fichiers d’une part dans une archive uniquedata.packedau lieu d’un fichier par flux (les projections et quelques fichiers de service, tels quetxn_version.txt, sont toujours écrits séparément). Il est contrôlé par les paramètresmin_bytes_for_full_part_storage,min_rows_for_full_part_storageetmin_level_for_full_part_storage, et est désactivé par défaut. Une fois qu’une table écrit des parts empaquetées, les anciennes versions du serveur ne peuvent plus les lire ; l’activation de ce format empêche donc de revenir à une version antérieure du serveur. #108118 (Raúl Marín). - Ajout d’une table function expérimentale
eval, qui évalue une expression constante en query string et exécute l’unique requêteSELECTainsi obtenue. La fonctionnalité est désactivée par défaut et peut être activée avec le paramètreallow_experimental_eval_table_function. Auteur : Yue Ni. #110132 (Alexey Milovidov). - Ajout de la prise en charge de la compression
zstdau handler HTTP expérimental Prometheus remote-write v1. #110907 (James Cunningham). - L’écriture dans les tables
DeltaLake(paramètreallow_experimental_delta_lake_writes) est passée en bêta. #107034 (Kseniia Sumarokova). - Ajout des
ProfileEventsDistributedPlanRemoteTasks,DistributedPlanLocalExecutionetDistributedPlanHostsUsedpour observer l’exécution des plans de requête distribués expérimentaux (make_distributed_plan). #107985 (Shankar Iyer). - Suppression du stockage expérimental basé sur RocksDB dans Keeper (
experimental_use_rocksdb). Un nouveau stockage sur disque plus performant arrive bientôt. #108000 (Michael Kolupaev). - L’analyse d’index distribuée (fonctionnalité expérimentale contrôlée par le paramètre
distributed_index_analysis) envoie désormais les longues listes de noms de data part aux serveurs distants sous forme de scalaires, au lieu de les intégrer au query text. Cela évite d’éventuels échecs dus aux limitesmax_ast_elements/max_query_sizeet supprime le surcoût lié au parsing de l’AST. #110419 (Azat Khuzhin). - Optimisation des fonctions d’aggregation expérimentales
timeSeries*ToGrid: les buckets sont désormais alignés à la fois sur le step et sur la window, et l’aggregation finale est nettement plus rapide lorsque la window est beaucoup plus grande que le step. Le format de serialization de l’aggregation state a été modifié de manière incompatible (ces fonctions sont expérimentales). #106724 (Vitaly Baranov). - Les target tables externes d’une table
TimeSeriessont désormais enregistrées comme dépendances référentielles : comme pour les materialized views, cela empêche de supprimer une target table externe avant la tableTimeSeriesqui la référence (sicheck_referential_table_dependenciesest activé). #108388 (Vitaly Baranov). - Ajout de la fonction PromQL
increase. #111023 (Vitaly Baranov).
Amélioration des performances
- Les
JOINpeuvent désormais utiliser l’index de clé primaire ou les skip indexes de la table de gauche pour écarter des granules. Contrôlé par le paramètreenable_join_runtime_filters_index_analysis. #109085 (Shankar Iyer). - La sérialisation et la désérialisation de vecteurs de types trivialement sérialisables utilisent désormais un seul appel d’E/S sur le tampon au lieu de traiter les éléments un par un. #89842 (Jimmy Aguilar Mena).
- Optimisation des recherches inverses dans les dictionnaires : un prédicat d’égalité constant tel que
WHERE dictGet(dict, attr, key_expr) = valueest désormais directement replié en constante en un filtre sur la clé (key_expr = const,key_expr IN [...]ouWHERE 0) au lieu d’être réécrit en sous-requêteIN (SELECT ... FROM dictionary(...)), et le chemin constant dedictGetKeyss’exécute désormais en parallèle. #91164 (Nihal Z. Miaji). - Ajout d’un nouveau paramètre
merge_tree_generic_exclusion_search_max_stepsqui limite le nombre d’étapes que l’algorithme de recherche par exclusion générique consacre à l’analyse de l’index de clé primaire de chaque part de données. Le budget est d’abord consommé sur les plus grandes plages de clés restantes, de sorte que même un petit budget permet d’écarter l’essentiel des données ; les plages qui n’ont pas été entièrement analysées sont lues en entier, de sorte que le résultat de la requête reste correct mais que davantage de granules peuvent être lus. La limite est appliquée de manière souple : elle peut être dépassée d’au plusmerge_tree_coarse_index_granularityétapes, plus une étape pour chaque plage en laquelle la part est déjà divisée (par exemple, par le cache des conditions de requête). La valeur par défaut 0 signifie que le nombre d’étapes est illimité. #92779 (Michael Jarrett). - Les requêtes avec
ORDER BYetLIMITsur des vues au-dessus de tablesDistributedutilisent désormais l’optimisation de fusion de flux triés : leORDER BY/LIMITexterne est poussé dans la requête interne d’une vue simple, de sorte que chaque shard trie ses données localement et que le coordinateur fusionne des flux prétriés au lieu d’effectuer un tri complet. #94102 (matanper). optimize_or_like_chainest désormais activé par défaut. Clôt #87779. #94517 (Alexey Milovidov).- Marque les tables de logs système
MergeTreenon répliquées avec rotation et sans TTL commetable_readonlyafin d’éviter des opérations en arrière-plan inutiles. Le paramètreMergeTreetable_readonlysupprime désormais également toute activité en arrière-plan sur une tableMergeTreesimple — fusions ordinaires, TTL (DELETE/MOVE/recompression) et de recompression, mutations en arrière-plan et déplacements de parts en arrière-plan — et rejette les commandes de partition modifiantes (ATTACH/MOVE/DROP/DROP DETACHED/FETCH/REPLACE PARTITIONainsi queMOVE PARTITION ... TO TABLEvers la table), en plus des insertions, mutations etOPTIMIZEqu’il rejetait déjà. Par conséquent, une tabletable_readonlyavec un TTL ne supprime plus ses données expirées tant que le paramètre est activé. #95079 (Mathuranath Metivier). - Améliore les performances de récupération d’un seul enregistrement utilisateur dans
system.userslorsque le serveur compte de nombreux utilisateurs. #96699 (Alistair Evans). - La lecture ordonnée avec des replicas parallèles utilise désormais la même logique que la lecture locale pour diviser la table en
max_threadsparts, afin d’améliorer le parallélisme. #101434 (Nikita Taranov). - Utilise les bornes de l’index minmax de partition pour élaguer davantage de granules lors de l’analyse de la clé primaire des tables
MergeTree, lorsqu’une colonne de la clé primaire est aussi une colonne d’entrée de la clé de partition. Par exemple, dans une tableMergeTreeavecORDER BY (id, event_time)etPARTITION BY toYYYYMM(event_time), ClickHouse utilisera l’index minmax de partition surevent_timependant l’analyse de l’index de clé primaire afin de prendre des décisions d’élagage des granules plus pertinentes. Contrôlé par le nouveau paramètreuse_partition_minmax_for_primary_key_pruning(activé par défaut). #103480 (UnamedRus). - Active le cache des conditions de requête pour les requêtes qui utilisent le filtrage dynamique Top-K (
ORDER BY ... LIMIT n). L’entrée du cache est partitionnée selon les paramètres du plan Top-K, de sorte qu’une même requête réutilise les résultats mis en cache du filtreWHERE, tandis qu’unLIMIT, une colonne de tri ou un ordre de tri différent produit une nouvelle entrée. #104478 (Alexey Milovidov). - Ajout du paramètre
use_constant_folding_in_index_analysis(désactivé par défaut). Lorsqu’il est activé, l’analyse de la clé primaireMergeTree, deMinMaxet des index de saut replie, séparément pour chaque part, les constantes au niveau de la partition dans le prédicat de filtre, ce qui améliore l’élagage pour les filtres dont les branches dépendent des valeurs de partition, par ex.(a = 1 AND b >= 1) OR (a = 2 AND b > 10)avecPARTITION BY a. #104582 (Mikhail Artemenko). - Pousse
LIMITdans aggregation-in-order pour permettre un arrêt anticipé lorsque la cléGROUP BYcorrespond à la cléORDER BYet à la clé de tri de la table, réduisant significativement le nombre de lignes lues. #104859 (Konstantin Bogdanov). - La mise à jour des profile events est désormais jusqu’à 30 fois plus rapide, grâce à l’utilisation d’opérations atomiques par CPU pour les compteurs globaux du serveur et par utilisateur. Contrôlé par le paramètre serveur
user_profile_events_per_cpu(il utilise environ 640 KiB par utilisateur sur 64 cœurs, donc avec un très grand nombre d’utilisateurs, il peut être judicieux de le laisser désactivé). #105056 (Azat Khuzhin). - Active
allow_aggregate_partitions_independentlypar défaut. Lorsqu’une cléGROUP BYest adaptée à la clé de partition, ClickHouse peut agréger chaque partition indépendamment et ignorer l’étape de fusion globale. Des heuristiques d’exécution ignorent automatiquement l’optimisation lorsque la disposition des partitions la rend défavorable (trop peu de partitions, trop de partitions ou tailles de partitions fortement déséquilibrées). #105128 (Alexey Milovidov). - Les requêtes de vector search avec rescoring (
vector_search_with_rescoring = 1) calculent désormais la distance exacte uniquement pour les lignes renvoyées par le vector index, en appliquant un filtre exact sur la position des lignes au lieu d’un rescoring en brute-force des lignes voisines du même granuleMergeTree. #105591 (Sergey Kuznetsov). #108846 (Sergey Kuznetsov). - Améliore les performances de l’algorithme de jointure
partial_mergesur les clésFixedStringen comparant des séries de valeurs d’un seul coup au lieu d’un appel de comparaison par valeur. #105737 (Artem Zuikov). SHOW TABLESetsystem.tablessur les catalogues de data lake (Iceberg REST, Glue, Unity, Hive, Paimon) transmettent désormais au catalog les prédicats liés à l’espace de noms, évitant ainsi un balayage complet du catalog. Résout #105022. #106029 (Smita Kulkarni).- Limiter la mémoire non suivie par CPU afin d’éviter le surengagement de mémoire et les erreurs de mémoire insuffisante (les limites sont configurées avec les paramètres serveur
max_per_cpu_untracked_memoryetper_cpu_untracked_memory_thread_buffer). #106055 (Azat Khuzhin). - Accélérer les opérateurs qui parcourent un flux trié pour repérer des séquences de valeurs de clé identiques —
DISTINCTin order,LIMIT BYin order, negativeLIMIT BYin order, les joinsfull_sorting_mergeetpartial_merge. #106502 (Nihal Z. Miaji). - Implémentation d’un lecteur et d’un writer natifs pour les formats
ArrowetArrowStream, sans utiliser la bibliothèque Apache Arrow, ce qui évite des copies et conversions de données supplémentaires. Il s’agit désormais du comportement par défaut (paramètresinput_format_arrow_use_native_readeretoutput_format_arrow_use_native_writer) et il est plus rapide, aussi bien en lecture qu’en écriture. #106522 (Alexey Milovidov). - Réactiver LTO pour jemalloc après correction d’une corruption du cache de thread apparue avec LTO, ce qui améliore les performances. #106898 (Azat Khuzhin).
- Réduction de l’utilisation mémoire et amélioration des performances des
JOIN. Le côté droit d’un hash join utilise désormais une référence de ligne compacte de 8 octets basée sur un index, de sorte que les entrées de la table de hachage des joinsALLsont aussi petites que celles des joinsANY, quel que soit le type de clé. Mesuré sur de grosses requêtes de joinparallel_hash— joinsINNERetANYsur des tables de 100 à 300 millions de lignes avec des clésUInt64etString, avec des clés à la fois uniques et dupliquées : la requête médiane est devenue environ 12 % plus rapide et a utilisé environ 15 % de mémoire de pointe en moins, sans qu’aucune requête ne devienne plus lente. Les joinsINNERsur des clésUInt64ont le plus progressé (médiane d’environ 21 % plus rapide avec 38 % de mémoire en moins). #107189 (Harikrishnan Prabakaran). - Les clés de jointure
LowCardinality(String)non-Nullable à une seule colonne sont désormais prises en charge nativement dans le hash join. #107264 (Nikita Taranov). - Ajout de l’algorithme d’énumération de l’ordre des joins
dpsub(programmation dynamique sur des sous-ensembles), qui fournit des plans de join optimaux avec moins de surcoût d’optimisation quedpsizeet prend en charge les joins non internes. #107351 (Fisnik Kastrati). - Accélérer le chargement du cache du système de fichiers au démarrage en encodant la taille de chaque fichier de cache dans son nom (
<offset>_<size>), ce qui évite unstatpar fichier. Le chargement des fichiers de cache écrits par des versions plus anciennes reste pris en charge. #107415 (Alexey Milovidov). - Amélioration des performances de
arrayElementsurArray(LowCardinality(String))et des fonctionsLIKEde map sur desMapavec des clés ou des valeursLowCardinality(String), en évitant la matérialisation inutile des chaînes. #107450 (Michael Jarrett). - Éviter de convertir une aggregation à un niveau en aggregation à deux niveaux lorsque l’utilisation mémoire est faible, en suivant la mémoire de l’état d’aggregation lui-même plutôt que celle de l’ensemble de la requête. #107490 (Hechem Selmi).
- Accélérer l’analyse des requêtes d’aggregation : la clé de cache des statistiques de taille de la table de hachage d’aggregation est désormais calculée à partir du plan de requête, au lieu de construire l’AST complet de la requête. #107643 (Dmitry Novik).
- Améliore considérablement les performances de
INTERSECT ALLetEXCEPT ALL(le mode par défaut deINTERSECTetEXCEPT) en indexant le multiensemble sur la valeur de la ligne au lieu de hacher chaque ligne avec SipHash. #107649 (Raúl Marín). - Reconstruit les filtres de ROW POLICY sans conserver le verrou du cache, ce qui améliore la scalabilité des requêtes lors d’opérations concurrentes
CREATE ROW POLICYetDROP ROW POLICY. #107917 (Azat Khuzhin). - Accélère les fonctions
match,extract,extractAll,replaceRegexpOneetreplaceRegexpAllpour les expressions régulières simples en les compilant en code natif avec LLVM. Contrôlé par le nouveau paramètrecompile_regular_expressions(activé par défaut) ; les motifs en dehors du sous-ensemble pris en charge reviennent automatiquement au moteur RE2. #108004 (Alexey Milovidov). - Accélère la décompression ZSTD sur AArch64 (ARM) pour les colonnes avec de petits offsets de correspondance, comme les colonnes d’entiers à largeur fixe, en vectorisant avec NEON les copies chevauchantes à offset court. Par exemple, la décompression d’une colonne
UInt64est jusqu’à ~2,3× plus rapide sur AWS Graviton 4. #108049 (Alexey Milovidov). - Utilise la bibliothèque
libdeflatepour la compression et la décompression gzip/zlib/deflate, ce qui les accélère (compression ~1,15× avec un meilleur ratio, décompression ~1,4–1,5×) pour les données.gz/HTTP/url/s3et le codec GZIP de Parquet. #108074 (Alexey Milovidov). - Améliore les performances des requêtes de recherche textuelle combinées à un filtre sur la primary key. #108114 (Anton Popov).
- Utilise les statistiques d’exécution collectées lors de la première exécution d’une requête pour optimiser les exécutions suivantes : l’algorithme de join
hashpeut automatiquement basculer versparallel_hashen fonction des statistiques collectées. #108125 (Hechem Selmi). La taille des JOIN runtime filters est optimisée à l’aide de la taille de la hash table issue des statistiques d’exécution du join, contrôlée par le nouveau paramètrejoin_runtime_filter_size_from_hash_table_stats. #108313 (Hechem Selmi). - Améliore la vitesse de décompression LZ4 pour les colonnes de taille fixe à faible cardinalité. #108175 (Nikita Taranov).
- Accélère les fonctions
trimLeft/trimRight/trimBothutilisant les espaces par défaut (ainsi que leurs aliasltrim/rtrim/trim) : les lignes consécutives ne nécessitant aucun trimming sont copiées en un seul batch, et l’analyse des espaces ligne par ligne n’est effectuée que pour les lignes qui ont réellement un espace au début ou à la fin. #108177 (Groene AI). - Améliore les performances de
replaceAlletreplaceRegexpAlllorsque le motif est un seul caractère et que le remplacement est lui aussi un seul caractère (par exemplereplaceRegexpAll(s, ' ', '_')). Ces remplacements ne modifient plus la structure de la chaîne : la colonne est donc désormais copiée une seule fois, et les octets correspondants sont réécrits sur place au lieu d’exécuter une boucle de recherche pour chaque correspondance. #108178 (Groene AI). - Améliore les performances de la fonction
pointInPolygonavec un polygone constant. Le cache des polygones prétraités est désormais indexé sur les arguments constants bruts, de sorte qu’un polygone constant n’est analysé qu’une seule fois (en cas de cache miss) au lieu de l’être à nouveau pour chaque bloc d’entrée. #108184 (Groene AI). - Accélère l’analyse de la représentation canonique de date-heure
YYYY-MM-DD hh:mm:ssen mode best-effort (date_time_input_format = 'best_effort',cast_string_to_date_time_mode = 'best_effort'), qui est le mode par défaut. Cela corrige une régression des performances d’analyse introduite lorsque ces valeurs par défaut sont passées debasicàbest_effort. #108187 (Groene AI). - Évite de maintenir les compteurs de sélectivité de
system.predicate_statistics_logsur le chemin de lectureMergeTreelorsque la fonctionnalité est désactivée (predicate_statistics_sample_rate = 0, valeur par défaut). Cela supprime une mise à jour atomique par granule et unpopcountde filtre enO(rows)à chaque lecture, corrigeant une régression de performances particulièrement visible sur AArch64. #108190 (Groene AI). - Accélère l’analyse des nombres à virgule flottante à partir de texte avec
precise_float_parsing = 1, au point de la rendre aussi rapide, voire plus rapide, que l’analyseur par défaut sur presque toutes les entrées. Met également à jour la bibliothèquefast_floatintégrée vers la version v8.2.10. #108205 (Raúl Marín). - Utilise la bibliothèque
simdutfpour les fonctions d’encodage et de décodage base64, ce qui améliore leurs performances. #108333 (Konstantin Bogdanov). - Optimise
DISTINCTpour les clés coûteuses à forte cardinalité. #108366 (Nihal Z. Miaji). - Dans les builds non Linux (macOS et FreeBSD), jemalloc ne purge plus les pages sales de manière agressive (un appel système
madviseparfree) ; il utilise désormais un thread de purge en arrière-plan avec undirty_decay_msfini, comme sur Linux. Cela accélère considérablement les charges de travail à forte rotation d’allocations, comme les CTE récursives (~2x sur un benchmark de CTE récursive sur macOS), avec un impact RSS négligeable. #108430 (Alexey Milovidov). - Accélère la planification des requêtes par l’analyseur pour les expressions qui référencent le même alias
WITHou répètent de nombreuses fois la même sous-expression (par exemple, des chaînesif/multiIfprofondément imbriquées), en évitant de reconstruire les sous-expressions partagées lors de la construction du DAG d’actions. #108523 (Dmitry Novik). - Les Runtime Filters sont désormais construits sur les clés d’égalité même lorsque la clause
ONcontient aussi des prédicats de non-égalité, ce qui réduit le nombre de lignes entrant dans la jointure par hachage pour les jointures combinant des conditions d’égalité et de non-égalité.LEFT ANTI JOINn’est pas affecté. #108579 (Antonio Álvarez Caballero). - Active
-fno-math-errnoglobalement dans toute la base de code, ce qui permet au compilateur de mieux optimiser les fonctions mathématiques. #108628 (Nikita Taranov). - Abaisse le seuil de préchargement logiciel pour les tables de hachage utilisées pour l’aggregation et les jointures, de
4 * L2 cache sizeàL2 cache size, de sorte que le préchargement soit activé dès que la table de hachage ne tient plus dans le cache L2. Cela corrige une régression surGROUP BYetJOINavec des tables de hachage de taille moyenne (~1-8 MiB) sur les plateformes dont le cache L2 déclaré est grand (par ex. AArch64 avec un cache L2 de 2 MiB). #108655 (Groene AI). - Amélioration des performances des fonctions de fenêtre. Les requêtes de fenêtre sur des tables larges incluant
SELECT *utilisent désormais nettement moins de mémoire et s’exécutent plus rapidement. Les agrégats de fenêtre, notammentquantile*,uniq*etgroupArray, sont plus rapides avecOVER ()etOVER (ORDER BY ... RANGE ...). La fonctioncume_distest également plus rapide, et les fenêtres utilisantPARTITION BYouORDER BYoffrent désormais de meilleures performances sur les colonnes comportant de nombreuses valeurs répétées. #108688 (Nihal Z. Miaji). - Analyse des requêtes accélérée pour les requêtes comportant de nombreuses chaînes
ANDde comparaisons, ou de très longues chaînesANDde comparaisons : l’optimisationoptimize_and_compare_chainest désormais limitée par un budget de travail (nouveau paramètreoptimize_and_compare_chain_max_hash_work) au lieu de hacher une grande partie de l’arbre de requête, et la résolution des lambdas ne recalcule plus les hachages du corps des lambdas pour son garde-fou de récursion. #108757 (Alexey Milovidov). - Correction d’une régression de performances lors de la lecture de colonnes
JSON/Dynamicavec plusieurs threads : une recherche par valeur du paramètreinput_format_binary_max_type_complexityprovoquait une contention sur le comptage de références dans le contexte de requête partagé, sérialisant les lectures parallèles ; la valeur du paramètre est désormais mise en cache par thread. #108797 (Seva Potapov). - Correction d’une régression de performances (introduite dans #71781) où la lecture de nombreux petits fichiers depuis l’object storage via
s3et d’autres fonctions de table ne faisait plus de prefetching et revenait à des lectures synchrones, ralentissant considérablement les lectures mono-thread et à faible concurrence de très nombreux petits fichiers. #108872 (Nikita Fomichev). Le prefetch initial des petits objets est désormais également lancé lorsque les lectures depuis l’object storage passent par le cache du système de fichiers (filesystem_cache_name), de sorte que les lectures de nombreux petits fichiers (par ex. l’ingestionS3Queue) avec le cache activé ne sont plus synchrones ni limitées par la latence. #109478 (Nikita Fomichev). - Analyse des littéraux de tableaux et de tuples profondément imbriqués en temps linéaire plutôt qu’en temps quadratique. #108892 (Alexey Milovidov).
- Réduction de la surcharge due à la contention sur les verrous dans l’algorithme de jointure
parallel_hash. #108938 (Hechem Selmi). - Accélération de
estimateCompressionRatiopour les colonnes encodées enT64en calculant analytiquement la taille compressée au lieu de compresser. #109054 (Raufs Dunamalijevs). - Suppression d’un goulot d’étranglement mono-thread à l’étape de redistribution des plans de requête distribués : chaque flux amont répartit désormais ses lignes indépendamment par compartiment de destination au lieu de faire transiter l’ensemble du flux de données par une seule transformation. #109206 (Alexander Gololobov).
- Réduction de l’utilisation du CPU au repos du serveur Keeper. #109255 (Michael Kolupaev).
- Accélération de la sérialisation et des fusions de colonnes
JSONdont les données partagées contiennent de nombreux chemins clairsemés : lors de l’aplatissement des données partagées en colonnes par chemin, le parcours, pour chaque ligne, de toutes les colonnes de chemin accumulées est supprimé, et les lacunes sont remplies en bloc au lieu d’insérer des valeurs par défaut cellule par cellule. #109341 (Groene AI). - Réduction de la surcharge CPU liée à l’évaluation des expressions pour les requêtes comportant un grand nombre de colonnes (par exemple, une recherche vectorielle sur une colonne
QBitavec un petit stride, où chaque vecteur est développé en centaines de sous-colonnes de plans de bits, toutes passées à un unique appel*DistanceTransposed). #109380 (Alexey Milovidov). - Amélioration des performances des fonctions Geo H3 (
h3ToGeoBoundary,h3ToGeo,h3CellAreaM2/h3CellAreaRads2,geoToH3) en calculant les paires sinus/cosinus conjointement et en supprimant les appels trigonométriques redondants dans les transformations de coordonnées. Les résultats restent inchangés (strictement identiques bit pour bit). #109399 (Alexey Milovidov). - Amélioration des performances, jusqu’à 7 fois, des comparaisons (
<,>,<=,>=) sur les types entiers larges (Int128,UInt128,Int256,UInt256et les types qui en dérivent, commeDecimal128), ainsi que de la conversion d’entiers signés enInt256(jusqu’à 7 fois sur des données de signes mixtes), en rendant le code de comparaison et d’extension de signe sans branchement. #109474 (Manuel). - Optimisation de
uniqCombined(y compris dans le cas d’une aggregation sans clés) et deuniqHLL12. #109794 (Anton Popov). #109831 (Anton Popov). - Les fonctions
arraySortetarrayReverseSortsont plusieurs fois plus rapides sur des Array numériques (y comprisDecimaletDateTime64) lorsqu’elles sont appelées sans lambda. #109832 (Manuel). - Accélération de
addDays,addWeeks,subtractDaysetsubtractWeekssur les valeursDateTimeetDateTime64dans les fuseaux horaires à décalage fixe (comme UTC) grâce à un chemin rapide arithmétique. #109836 (Manuel). - Optimisation de l’analyse de l’index textuel. #109886 (Anton Popov).
- Parallélisation du traitement des lignes non appariées dans l’algorithme de join
parallel_hashdans deux cas supplémentaires : en présence d’un filtre résiduel, et dans le cas de petites join keys (table de hachage à un seul niveau). #110008 (Hechem Selmi). - Les réponses intégrées de l’interface web (l’interface Play, les tableaux de bord et les handlers de fichiers statiques) sont désormais compressées selon l’en-tête
Accept-Encodingdu client, à l’aide de zstd, gzip, deflate, brotli, lz4, xz, snappy ou bzip2. Par exemple, la page/playpasse d’environ 350 KB non compressés à moins de 120 KB avec zstd, ce qui réduit les temps de chargement sur les connexions lentes. Les réponses déjà compressées ne sont pas modifiées, etVary: Accept-Encodingest émis pour un partitionnement correct du CDN et du cache. #110108 (Sayantanu Dey). - Place un filtre sous une window function ou sous
LIMIT BYlorsque c’est sans risque : un prédicat écrit au-dessus (unWHEREexterne autour de la subquery, ou une conjonction dansQUALIFY) qui ne référence que les colonnesPARTITION BYde la window, ou uniquement les key columns deLIMIT BY(pourLIMIT n BYavecn >= 1et sansOFFSET), atteint désormais le stockage et active le pruning par primary key et par partition, les skip indexes et les projections. Par exemple,SELECT ... row_number() OVER (PARTITION BY key ORDER BY ts) AS rn ... QUALIFY rn = 1 AND key = 'x'ne lit plus toute la table et n’applique plus la window à l’ensemble des données. #110114 (Groene AI). #110116 (Groene AI). - Avec
join_use_nulls = 1, unWHEREqui rejette les nulls et référence des colonnes des deux côtés d’un OUTER JOIN (par ex.WHERE l.k = 42 AND r.k = 42) convertit désormais la jointure enINNER(ouLEFT/RIGHT) et permet le pruning par primary key, comme avecjoin_use_nulls = 0. Auparavant, cette conversion était ignorée dans ce cas et les deux tables étaient lues intégralement. #110121 (Groene AI). - Les fonctions avec un seul argument
Nullablenon constant partagent désormais la null map de l’argument avec le résultat, au lieu d’en allouer une nouvelle et de la fusionner. #110151 (Manuel). - Évite une allocation sur le tas à chaque vérification d’hyperrectangle lors de l’analyse de l’index de primary key, ce qui accélère le filtrage des marques de 5 à 26 % selon la forme de la query. #110153 (Manuel).
- Améliore les performances des fonctions
arrayMinetarrayMaxsur des Array numériques d’environ 1,3 à 1,5x grâce à une réduction vectorisée au lieu d’une boucle de comparaison élément par élément. #110163 (Manuel). - Vectorise la décompression du codec
Delta. Le décodage est désormais 1,5 à 5 fois plus rapide pour les types de données 8/16/32 bits, ce qui rend les scans de colonnes compressées avecDeltajusqu’à 20 % plus rapides. #110189 (Manuel). - Accélère les fonctions de recherche de chaînes (
like,position,match,countSubstrings,hasToken, etc.) sur des colonnesEnumavec une aiguille constante en ne recherchant que les noms d’enum distincts, puis en réappliquant les résultats à chaque row, au lieu d’effectuer la recherche sur chaque row. #110325 (Alexey Milovidov). - Accélère les fonctions d’agrégation
groupBitOr/groupBitAnd/groupBitXoret la family des variances (varPop,varSamp,stddevPop,stddevSamp,skewPop,skewSamp,kurtPop,kurtSamp,covarPop,covarSamp,corr) grâce à un traitement vectorisé par lots : jusqu’à 4x plus rapide avec le combinator-Ifsur des conditions imprévisibles, et jusqu’à 3x plus rapide pour la family des variances sans celui-ci. #110461 (Manuel). - Accélère l’analyse du text index (l’étape qui détermine quels granules lire) : utilise une recherche par exclusion au lieu d’itérer sur tous les granules, et évite de créer un bitmap temporaire pour chaque vérification de plage. #110530 (Anton Popov).
- Prendre en compte la taille sur disque des sous-colonnes
Mapdans l’optimisation automatique dePREWHERE. Cela corrige une régression de performances dePREWHEREintroduite dans #99200. Fait partie de #110462. #110623 (Pavel Kruglov). - Accélérer l’analyse syntaxique des valeurs
UUIDà partir de texte (par ex.JSONExtractversLowCardinality(UUID),toUUID,CAST AS UUID) en validant et en convertissant les chiffres hexadécimaux en un seul passage au lieu de deux. #110625 (Groene AI). - Améliorer significativement les performances des fonctions d’agrégation
timeSeries*ToGridgrâce à des implémentations plus rapides du tri et des tables de hachage. #110875 (Nikita Mikhaylov). - Les requêtes comme
SELECT * FROM t WHERE idutilisent désormais l’index pour ignorer des blocs de données sur la colonneid. Corrige #89222. #89603 (Aditya Chopra). - Ajout du paramètre
query_plan_merge_expression_into_join(activé par défaut) pour permettre la fusion d’étapes d’expression dans des étapesJOINlors de l’optimisation du réordonnancement des jointures. Cela permet de réordonner les jointures à travers des sous-requêtes qui encapsulent des jointures (par ex., lorsqu’unJOINse trouve dans une sous-requête avec des colonnes calculées), ce qui améliore l’optimisation des arbres de jointures complexes. #98533 (Vladimir Cherkasov). - Optimiser les chaînes
ANDavec plusieurs conditions de comparaison sur la même expression : détecter les contradictions (par ex.a < 3 AND a > 5→false) et supprimer les conditions redondantes (par ex.a = 3 AND a < 5→a = 3). #99736 (Xiaozhe Yu). - Les CTE matérialisées référencées depuis plusieurs branches d’une requête
UNIONsont désormais matérialisées une seule fois et partagées entre toutes les branches. Auparavant, chaque branche recevait sa propre copie de la CTE, qui était intégrée directement puis évaluée séparément. #102107 (Dmitry Novik). - Les threads de
BackgroundSchedulePoolsont désormais créés à la demande plutôt que tous en une seule fois au démarrage du serveur. Un nouveau paramètre du serveur,background_schedule_pool_initial_size(par défaut16), contrôle le nombre de workers pré-lancés ; le pool s’agrandit jusqu’àbackground_schedule_pool_sizesi nécessaire. Cela réduit le nombre de threads inactifs sur les serveurs peu chargés. Corrige #85265. #105066 (Alexey Milovidov). - Ignorer les chargements inutiles de mark files pour la sérialisation avancée des données partagées du type
JSON. #107051 (Pavel Kruglov). - Le cache des polygones constants prétraités pour la fonction
pointInPolygonest désormais partagé entre les requêtes et les threads, et sa taille est limitée par le nouveau paramètre serveurpoint_in_polygon_cache_size(256 MiB par défaut,0désactive le cache, modifiable à l’exécution). Auparavant, le cache conservait jusqu’àmax_threadscopies de chaque polygone prétraité, grossissait sans limite avec des polygones distincts et n’était jamais libéré avant le redémarrage du serveur. Il peut être vidé avecSYSTEM DROP POINT IN POLYGON CACHE, et son utilisation actuelle est exposée danssystem.metricssous les nomsPointInPolygonCacheBytes,PointInPolygonCacheCellsetPointInPolygonCacheSizeLimit. Clôture #106393. #107247 (Nihal Z. Miaji). - Keeper ne conserve plus son verrou interne sur les snapshots pendant la sérialisation et l’écriture d’un snapshot sur disque, ni lors du déplacement de snapshots entre disques. Ainsi, les transferts de snapshots vers d’autres nœuds et le traitement Raft ne sont plus bloqués par la création locale de snapshots. #107595 (Antonio Andelic).
- Parallélisation de l’éviction en arrière-plan du cache du système de fichiers (contrôlée par les paramètres
keep_free_space_ratio). Ajout d’un nouveau paramètrekeep_free_space_eviction_threadspour contrôler le parallélisme, et augmentation de la valeur par défaut dekeep_free_space_remove_batchde100à250. #108147 (Kseniia Sumarokova). - Limitation du nombre de parts préparées simultanément dans la copie Azure Blob Storage en lecture puis écriture (utilisée par les backups lorsqu’une copie native n’est pas disponible) à
max_inflight_parts_for_one_file, afin d’éviter une utilisation excessive de la mémoire lorsque de nombreux fichiers volumineux sont copiés en parallèle. #108232 (Smita Kulkarni). - Activation globale des trois caches de l’index de texte — auparavant, ils n’étaient activés qu’au sein des requêtes. De plus, la taille du cache des posting lists est désormais nulle, ce qui le désactive de fait à nouveau, car les posting lists sont volumineuses et leur mise en cache est trop coûteuse. #108274 (Robert Schulze).
- Ajout d’une compression en flux des marks en mémoire pendant leur chargement afin de réduire le pic d’utilisation mémoire. Clôture #108285. #108325 (Pavel Kruglov).
- Le nouveau paramètre du cache du système de fichiers
reserve_granularity(4 MiB par défaut) réserve de l’espace à l’avance dans des granules plus grossiers, ce qui réduit la contention sur les verrous dans le chemin critique de réservation d’espace du cache du système de fichiers. #108369 (Kseniia Sumarokova). - Réduction de la quantité de mémoire utilisée par les métadonnées du cache du système de fichiers (par file segment et par clé). #108477 (Kseniia Sumarokova).
- Les requêtes vers
system.iceberg_historyavec des filtresWHEREsur les colonnesdatabaseettablen’accèdent désormais qu’aux bases de données correspondantes, ce qui peut faire gagner du temps si vous avez de nombreuses bases de données distantes sans rapport sur le serveur. #108492 (Den Kalantaevskii). - Suppression de verrous inutiles dans le cache du système de fichiers afin de réduire la contention sur les verrous. #108932 (Kseniia Sumarokova).
- Réduction de l’utilisation mémoire lors du traitement des métadonnées de
BACKUPetRESTORE. L’ouverture d’une sauvegarde (pourRESTOREou comme base d’unBACKUPincrémental) analyse désormais les métadonnées.backupsous forme de flux au lieu de les charger dans un arbre de document XML en mémoire, ce qui évite, pour les sauvegardes volumineuses (en particulier incrémentales), d’allouer un arbre DOM de plusieurs gigaoctets. #109107 (Julia Kartseva). La finalisation d’unBACKUPne copie plus non plus les informations sur tous les fichiers dans un vecteur temporaire, ce qui, pour des sauvegardes portant sur des millions de fichiers, consommait temporairement plusieurs gigaoctets. #109861 (Julia Kartseva). L’écriture des entrées de sauvegarde ne copie plus non plus la liste des informations de fichiers de l’hôte actuel. #111162 (Julia Kartseva). - Réduction de la consommation mémoire dans l’agrégateur. #109224 (Konstantin Vedernikov).
- Prise en charge du cache des conditions de requête pour les fichiers
Parquetlocaux lus via le moteur de tableFile(auparavant pris en charge uniquement pour l’object storage et les lacs de données). #109247 (Alexey Milovidov). - Réduction de l’utilisation mémoire du cache d’en-têtes d’index textuel d’un facteur de 2 à 2,5. Davantage d’en-têtes de parties de données tiennent dans le cache (paramètre
text_index_header_cache_size), ce qui réduit les lectures disque pour les requêtes de recherche textuelle. #109332 (Anton Popov). - Les fonctions de distance vectorielle transposées
L2DistanceTransposed,cosineDistanceTransposedetdotProductTransposedappliquent désormais l’optimisation de lecture partielle par bit plane aux colonnesNullable(QBit), en ne lisant que les bit planes demandés au lieu de la colonne entière. #109358 (Alexey Milovidov). IS NOT DISTINCT FROMetIS TRUEutilisent désormais la clé primaire et les index MinMax pour élaguer les granules, comme=. Auparavant,k IS NOT DISTINCT FROM 42et(k = 42) IS TRUEeffectuaient un parcours de tous les granules. #110006 (Groene AI).- Les connexions mutualisées ne sont plus pingées avant chaque utilisation. Cela supprime un aller-retour
Ping-Pongqui était ajouté à chaque connexion réutilisée, réduisant ainsi la latence des distributed queries et declickhouse-benchmark. Une connexion mutualisée obsolète est détectée au moyen d’unpollavec délai nul (une vérification non bloquante qui n’ajoute aucun aller-retour) puis rétablie par reconnexion. #110068 (Alexey Milovidov). - Correction de reconnexions intempestives de connexions HTTP keep-alive mutualisées via TLS (HTTPS, S3). La vérification d’obsolescence de la connexion utilisait
pollsur le socket, ce qui signalait à tort comme fermée une connexion sécurisée active transportant un enregistrement TLS post-handshake non lu (un ticket de session ouKeyUpdate) ; elle utilise désormais unMSG_PEEKnon bloquant sur les sockets simples etSSL_peek/SSL_has_pendingsur les sockets TLS, ce qui détecte aussi correctement un arrêt TLS ordonné et un enregistrement TLS arrivé seulement partiellement. #110402 (Alexey Milovidov). - Les requêtes accélérées par le filtrage dynamique TopK (
ORDER BY ... LIMIT k) exploitent désormais plus pleinement le cache des conditions de requête : le cache est alimenté même lorsque la lazy materialization est appliquée à la requête, et ces requêtes peuvent réutiliser des entrées précédemment écrites par une requête ordinaire ayant le même prédicatWHERE. #110507 (Shankar Iyer). - Un motif
LIKE/NOT LIKEsans jokers (%,_) utilise désormais une plage exacte de clé primaire ; il lit donc le même nombre de granules que le prédicat=/!=équivalent, au lieu d’une plage de préfixe plus large. #107077 (Groene AI). - Correction d’une contention redondante sur le verrou d’un segment de fichier (une régression de performances introduite en 26.1) lors de la lecture des données via le cache du système de fichiers. #109577 (Kseniia Sumarokova).
- Correction d’un problème où les skip indexes définis sur des sous-colonnes
Tuplen’étaient pas utilisés lorsque le champ était accédé viatupleElement(t, 'name'),tupleElement(t, N)out.N, alors que le tuple complet était également lu dans la même requête (par ex.SELECT *). Toutes ces formes élaguent désormais les granules de la même manière que l’accès à la sous-colonne nomméet.name. #110056 (Groene AI). - Correction des requêtes lentes
ORDER BY ... LIMITsur les tablesDistributedlorsqueprefer_localhost_replicasélectionne une replica locale : la limite préliminaire a été supprimée du plan du shard local, ce qui empêchait la lazy materialization et le filtrage top-K dynamique. #110136 (Michael Jarrett). - Correction d’un problème où le text index n’était pas utilisé pour l’opérateur
ILIKElorsque l’index était défini sur une expression plutôt que sur une simple colonne (par exempleassumeNotNull(col)avec un preprocessorlower(...)) : de telles requêtes lisaient tous les granules au lieu d’utiliser l’index. Cela résout #110350. #110595 (Elmi Ahmadov). - Réduction de la contention sur les verrous dans le cache du système de fichiers : les requêtes lisant depuis le cache ne se bloquent plus sur le verrou de la file de priorité lors de la mise à jour de la priorité LRU d’une entrée. #109065 (Antonio Andelic).
- Les text index queries qui utilisent une expression
postprocessorservant uniquement de filtre (par exempleif(..., '', token)) écartent désormais les tokens vides d’emblée au lieu de les matérialiser ligne par ligne, ce qui améliore les performances. #109049 (Elmi Ahmadov). - Réduction de la contention sur les verrous dans les files des journaux système, ce qui réduit la tail latency des requêtes sur les clusters chargés. #110539 (Sean Haynes).
- Amélioration des performances des fonctions de recherche de sous-chaînes (
position,countSubstrings,multiSearch*,replaceAll,replaceOne, ainsi que leurs variantes insensibles à la casse et UTF-8) avec une aiguille non constante, jusqu’à 1,5x, grâce à l’utilisation de chercheurs de chaînes basés sur SIMD sur le chemin par ligne au lieu d’une implémentation naïve. #110580 (Raúl Marín). - La lazy materialization s’applique désormais aux requêtes
ReplacingMergeTreeavecFINAL, un filtre et un petitLIMIT, même sansORDER BY. Les colonnes non nécessaires au filtre et à la fusionFINALne sont récupérées que pour les lignes restantes après la limite, ce qui accélère fortement ces requêtes lorsqu’elles sélectionnent des colonnes larges avec un filtre sélectif. Contrôlé parquery_plan_optimize_lazy_materializationetquery_plan_max_limit_for_lazy_materialization. #110722 (Nikolai Kochetov). - Amélioration des performances d’async insert lorsque la déduplication est activée et qu’un flush est réparti sur plusieurs partitions : ClickHouse réutilise désormais les hachages de déduplication calculés d’une partition à l’autre au lieu de les recalculer pour chacune d’elles. #111150 (Valery Petrov).
Amélioration
- Ajout d’un paramètre
input_format_csv_missing_nullable_as_empty_string(désactivé par défaut). Lorsqu’il est activé, une valeur manquante dans une colonneNullable(String)d’une entrée CSV est lue comme uneStringvide au lieu deNULL, indépendamment deinput_format_csv_empty_as_default. #58225 (kevinyhzou). #107577 (Alexey Milovidov). - Les fonctions
toDateOrNull,toDateTimeOrNullettoDateTime64OrNullacceptent désormais des arguments entiers de tous les types entiers natifs (interprétés de la même manière que partoDate,toDateTimeettoDateTime64, avec un argument de fuseau horaire facultatif) et renvoientNULLpour les valeurs hors plage du type de résultat. Par exemple,toDateTimeOrNull(1583851242, 'Asia/Shanghai')renvoie2020-03-10 22:40:42ettoDateTimeOrNull(4294967296)renvoieNULL. #79791 (Jitendra). - Ajout d’une colonne
is_wildcardà la tablesystem.grantspour indiquer si un privilège utilise une correspondance par préfixe avec caractère générique (par ex.GRANT SELECT ON db*.*). Auparavant, les privilèges avec joker et les privilèges exacts portant sur le même nom étaient indiscernables danssystem.grants. Résout #92835. #98577 (DQ). - Autorise la compression Snappy dans l’interface HTTP (
Accept-Encoding: snappy) et ajoute le paramètresnappy_modepour choisir entre le format de blocs Hadoop Snappy et le format de tramage Snappy pour les E/S Snappy génériquesfile/url. #100752 (Alexey Milovidov). - Ajout de la compatibilité avec l’ancien analyseur via le paramètre
analyzer_compatibility_allow_non_aggregate_in_having. S’il est activé, les conditions non agrégées sont déplacées deHAVINGversWHERE. #104232 (Dmitry Novik). - Ajout d’un nouveau paramètre serveur
memory_worker_rss_speculative_reserve_ratio(valeur par défaut :1.0) qui amène le memory tracker global à réserver spéculativement de la mémoire au-delà du RSS observé lorsque la croissance du RSS dépasse la comptabilisation du tracker entre deux échantillons. Ainsi, les allocations obtiennentMEMORY_LIMIT_EXCEEDEDplus tôt et le kernel OOM-killer a moins de chances de se déclencher en premier. Définissez le ratio sur0pour désactiver cette réservation spéculative. #104976 (Alexey Milovidov). - Ajout de métriques Prometheus optionnelles pour l’activité d’éviction du cache du système de fichiers (
filesystem_cache_evictions_total,filesystem_cache_evicted_bytes_total,filesystem_cache_evicted_segment_hits,filesystem_cache_evicted_segment_size_bytes, ainsi que leurs variantes par utilisateur étiquetées avecuser_id), exposées par cache viasystem.dimensional_metrics,system.histogram_metricset l’endpoint Prometheus. Elles sont contrôlées par les paramètres de configuration du cache diskexpose_prometheus_eviction_metricsetexpose_prometheus_eviction_metrics_per_user(tous deux désactivés par défaut), qui peuvent être activés ou désactivés à l’exécution viaSYSTEM RELOAD CONFIG. #105020 (Sacheendra Talluri). - Fait de
EXPLAIN [PLAN] actions=1, compact=1, pretty=1la valeur par défaut. #105036 (Kirill Kopnev). - Met à niveau
delta-kernel-rs(la bibliothèque derrière l’intégrationDeltaLake) vers la version v0.23.0. #105861 (Smita Kulkarni). - Ajout des commandes
duetwcàclickhouse-disks. Elles affichent respectivement la taille totale en octets d’un fichier ou répertoire donné, ainsi que le nombre d’octets, de lignes et de mots dans un fichier. #106268 (Asya Shneerson). - Ajout d’une nouvelle métrique asynchrone
UntrackedMemory(visible danssystem.asynchronous_metrics) qui signale la mémoire déjà allouée par les threads mais pas encore comptabilisée dans le compteur global de suivi de la mémoire : chaque thread accumule localement de petites allocations et les signale par lots. Cela aide à expliquer les écarts entreMemoryTrackinget l’utilisation mémoire réelle du processus. Les messages d’erreurMEMORY_LIMIT_EXCEEDEDincluent désormais aussi la quantité de mémoire non suivie, ce qui permet de mieux comprendre pourquoi une requête ou le serveur a atteint sa limite mémoire. #106386 (Miсhael Stetsyuk). - Mise à niveau de ClickStack (l’interface utilisateur d’observability) vers la version 2.28.0. #106406 (Aaron Knudtson).
- Ajout de la prise en charge de
BFloat16dansdotProductet amélioration de ses performances grâce au batching du chemin SIMD. #106569 (Nikita Taranov). - Les paramètres
max_named_collection_num_to_throw,max_table_num_to_throw,max_replicated_table_num_to_throw,max_view_num_to_throw,max_dictionary_num_to_throwetmax_database_num_to_throwpeuvent désormais être modifiés sans redémarrage du serveur. #106821 (Maxim Orlovsky). - Prise en charge des valeurs
REDUCED_REDUNDANCY,STANDARD_IA,ONEZONE_IA,GLACIER_IRetEXPRESS_ONEZONE(en plus deSTANDARDetINTELLIGENT_TIERING) pour le paramètres3_storage_class_name. #107251 (Aditya Kumar). - Ajout du paramètre de création
materialized_postgresql_use_extended_date_and_time_typespour le moteur de base de donnéesMaterializedPostgreSQL. Par défaut (activé), les colonnes PostgreSQLdate/timestampsont inférées commeDate32/DateTime64; le définir à0lors duCREATE DATABASEinfère à la place les types plus étroitsDate/DateTime. Ce paramètre ne s’applique pas au moteur de tableMaterializedPostgreSQL. #107428 (Alexey Milovidov). - Le quantificateur de tableau
SOME/ALL(expr OP SOME(array)/expr OP ALL(array)) prend désormais aussi en charge les prédicats de comparaison par mot-cléIS DISTINCT FROMetIS NOT DISTINCT FROM, ainsi que les prédicats de recherche de chaînesLIKE,ILIKE,NOT LIKE,NOT ILIKEetREGEXP, réécrits enarrayExists/arrayAll. #107454 (Alexey Milovidov). - Correction d’une fuite mémoire qui se produisait lors de l’échec de l’ouverture d’une base de données SQLite (par exemple, lorsque la table function
sqliteou le moteur de base de donnéesSQLitereçoit un chemin qui ne peut pas être ouvert). #107807 (Alexey Milovidov). - Dans l’interface Web (
play.html), l’indication du raccourci d’exécution affiche désormaisCmd+Entersur Mac etCtrl+Entersur les autres plateformes, au lieu de toujours afficherCtrl/Cmd+Enter, et la partie, +Shift to run alln’est affichée que lorsqu’il y a plusieurs requêtes. #107817 (Alexey Milovidov). #108957 (Alexey Milovidov). - Le moteur de table
Aliasprend désormais en charge la lecture avec des répliques parallèles lorsque la table cible appartient à la familleMergeTree. #107830 (Kai Zhu). - Ajout du type de statistiques de colonne
uniq_v2— une alternative légère aux statistiquesuniq, basée sur le sketchuniqCombined64. #107863 (Han Fei). Le type de statistiques de colonneminmaxest désormais obsolète et la valeur par défaut deauto_statistics_typesa été modifiée enbasic, uniq_v2. #108680 (Han Fei). - Les fonctions d’IA (
aiGenerate,aiEmbed,aiClassify,aiExtract,aiTranslate) réessaient désormais les défaillances réseau transitoires (réinitialisations de connexion, échecs de connexion TLS, dépassements de délai, adresses inaccessibles) lorsqueai_function_max_retriesest défini, conformément au comportement de nouvelle tentative de la fonction de tableurl. Auparavant, seules les réponses d’erreur HTTP côté fournisseur faisaient l’objet d’une nouvelle tentative. #107927 (Alexey Milovidov). INSERTdans une tableMergeTreerespecte désormais l’annulation de requête etmax_execution_timelors de l’écriture d’un grand nombre de parts, au lieu de risquer de continuer à s’exécuter longtemps après avoir été interrompu. #107929 (Michael Kolupaev).- Dans l’interface Web (
play.html), l’icône du terminal Web peut désormais être ouverte dans un nouvel onglet du navigateur par un clic de molette ou avec Ctrl/Cmd/Shift+clic. #108006 (Alexey Milovidov). - La génération SQL par IA dans le client n’envoie plus le paramètre
temperature, sauf s’il est explicitement défini viaai.temperaturedans la configuration. Cela corrige la génération SQL par IA pour les modèles qui rejettent le paramètretemperature. #108014 (Alexey Milovidov). - Ajout de la table
system.masking_policieset de l’introspectionSHOW MASKING POLICIESaux builds open source. Les politiques de masquage elles-mêmes restent une fonctionnalité de ClickHouse Cloud ; la table est donc vide dans les builds open source, mais les requêtes d’introspection n’échouent plus avec une erreur. #108030 (Alexey Milovidov). - Le consumer Kafka basé sur Keeper randomise désormais l’ordre dans lequel il acquiert des verrous temporaires de partition entre les répliques, ce qui améliore l’équité de la distribution des partitions et réduit la contention sur les verrous. Auparavant, le mélange prévu n’avait aucun effet. #108033 (Alexey Milovidov).
- Ajout de l’autocomplétion dans l’interface Web (
play.html), basée sursystem.completionset l’analyseur lexical SQL basé sur WASM. #108059 (Alexey Milovidov). clickhouse-clientetclickhouse-localaffichent désormais, à mesure de la saisie, des indications d’autocomplétion (texte « fantôme » en ligne) pour la suggestion la plus pertinente lorsque le curseur se trouve à la fin de la saisie. Les suggestions les plus pertinentes (utilisées récemment et identifiants déjà présents dans la requête) sont classées en tête. Naviguez avec Haut/Bas (ou Ctrl-Haut/Ctrl-Bas) ; acceptez une indication unique ou sélectionnée avec Tab ou Flèche droite, et une indication sélectionnée avec Entrée ; Tab ouvre aussi la liste de complétion classique. Ce comportement est contrôlé par la nouvelle option--hints(activée par défaut ; nécessite--highlight). #108070 (Alexey Milovidov).- Prise en charge de la fonction
lengthpour le type de donnéesQBit— elle renvoie la dimension du vecteur sous forme de constante. #108071 (Alexey Milovidov). Prise en charge deCASTd’unQBitvers unArray, avec reconstruction du vecteur d’origine — l’inverse de la conversion existante deArrayversQBit. #108072 (Alexey Milovidov). - Les requêtes adressées aux catalogs REST de data lakes (comme OneLake) incluent désormais un en-tête ClickHouse
User-Agent. #108117 (Konstantin Vedernikov). arrayFoldrespecte désormais l’annulation de requête etmax_execution_time. Auparavant, un fold sur un array très long s’exécutait entièrement dans un seul appel de fonction et ne pouvait pas être interrompu ;KILL QUERYet les limites de temps étaient donc ignorés jusqu’à la fin du fold. #108192 (Groene AI).MVTEncodeGeomaligne désormais la géométrie sur la grille de pixels entiers avant le découpage et découpe les polygones avec la bibliothèquewagyu, de sorte que la sortie découpée soit valide (les anneaux auto-intersectants sont réparés) et alignée sur les bords, comme dans PostGISST_AsMVTGeom. #108248 (Saarthak Gupta).- Ajout de
ProfileEventsde pré-exécution de requête par phase :QueryParseMicroseconds,QueryAnalysisMicroseconds,QueryPlanBuildMicrosecondsetQueryPipelineBuildMicroseconds. Ils indiquent où le temps est passé avant l’exécution de la requête (parsing, analyse, construction du plan de requête, construction du pipeline) et sont disponibles danssystem.query_logetsystem.events. #108282 (Jordi Villar). - Les opérations
ALTER TABLEqui produiraient des métadonnées de table dépassantmax_query_sizesont désormais rejetées à l’avance, ce qui évite que des tables deviennent impossibles à charger pour des composants tels que la distribution DDL et la récupération de répliques. #108283 (Andrew Kravchuk). - Ajout des colonnes
settingsetengine_settingsàsystem.backupsetsystem.backup_log.settingsexpose les réglages spécifiques de backup/restore demandés pour une opération (par ex.allow_s3_native_copy,deduplicate_files,structure_only), etengine_settingsexpose les réglages effectivement utilisés par le lecteur et le rédacteur du moteur de backup (par ex. les réglages de requête S3 tels queallow_native_copy, qui peuvent différer de ceux demandés après fusion de la configuration de l’endpoint). Cela permet de voir avec quels réglages une opérationBACKUP/RESTOREa réellement été exécutée. #108334 (Julia Kartseva). - Ajout d’une colonne
sourceàsystem.documentationcontenant le chemin du fichier source dans lequel la documentation de chaque entité est définie. La table documente désormais également les codecs de compression, les profile events, les métriques courantes, les métriques asynchrones, ainsi que les system tables elles-mêmes (avec leurs colonnes), et la documentation des settings inclut maintenant leur type et leur valeur par défaut. #108346 (Alexey Milovidov). Une valeur par défaut vide pour un setting est désormais affichée comme chaîne vide au lieu de backticks vides. #108708 (Alexey Milovidov). - Prise en charge des lectures asynchrones depuis des réplicas distants (
async_socket_for_remote) sur macOS grâce à l’implémentation des primitives de sondage basées sur epoll par-dessuskqueue. Cela permet aux distributed queries de lire les shards en parallèle sur macOS au lieu de le faire en série. #108403 (Raúl Marín). - Prise en charge de
BFloat16dans les fonctions mathématiques binaires. #108442 (Zhang Yifan). MergeTreepeut désormais lire un flux compressé dont les blocs utilisent différents codecs. Il s’agit du prérequis côté lecture pour la sélection adaptative des codecs (#105404). #108592 (Raufs Dunamalijevs).- La valeur automatique de
max_threadset de settings similaires est désormais affichée danssystem.settingssous la formeauto(8)au lieu de'auto(8)'; les apostrophes qui l’entouraient étaient un artifact de longue date intégré à la valeur. La compatibilité entre versions est préservée : l’ancienne forme entre guillemets reste acceptée lors de l’analyse des settings reçus de serveurs plus anciens. #108657 (Alexey Milovidov). - Plusieurs améliorations d’ergonomie pour la Web UI
/schema: chargement du schéma avec Entrée, barres de défilement adaptées au thème, noms de table lisibles, regroupement cohérent par database des tables indépendantes, absence de sélection de texte pendant le glisser-déposer, et formulaire d’authentication de styleplay(Credential Management API, credentials fournies via l’URL avec suppression du mot de passe, et validation des credentials en direct). #108724 (Alexey Milovidov). - Le mode d’application lazy de la posting-list du text index n’est plus expérimental et peut être sélectionné avec
text_index_posting_list_apply_mode = 'lazy'sansallow_experimental_text_index_lazy_apply. Le setting de seuil de densité a été renommé detext_index_density_thresholdentext_index_lazy_intersection_density_threshold. #108814 (Anton Popov). - Ajout d’un type de catalog
delta_sharingàDataLakeCatalogpour le REST endpoint Iceberg de Databricks Delta Sharing, dont les namespaces sont plats et qui ignore le filtre d’énumérationparent. Utilisez-le à la place decatalog_type = 'rest'pour de tels endpoints, sans quoiSHOW TABLESrisquerait de se bloquer. #108865 (Seva Potapov). - Ajout d’une nouvelle option
clickhouse-client/clickhouse-local--echo-query-separatorqui affiche un séparateur personnalisé avant la query formatée affichée en écho, ce qui permet de distinguer plus facilement la query saisie de sa version reformatée affichée en écho. Désactivée par défaut. #108888 (David Meng). - Améliorations du panneau des bases de données de la Web UI : le nombre de tables est désormais affiché entre parenthèses à côté du nom d’une base de données lorsqu’elle est dépliée. #108891 (Alexey Milovidov). Un bouton d’actualisation à côté d’une base de données dépliée recharge sa liste de tables. #108958 (Alexey Milovidov). Lorsque le panneau est rouvert, les bases de données précédemment dépliées sont restaurées. #108964 (Alexey Milovidov).
- Permet de calculer le bénéfice combiné des skip indexes dans
EXPLAIN WHATIF: il affiche le ratio de données correspondant à l’intersection de tous les index hypothétiques existants qui conviennent. #108934 (Yarik Briukhovetskyi). - Correction de la réinitialisation de la position de défilement horizontal de la table de résultats dans la Web UI après avoir cliqué sur un lien dans une cellule puis être revenu à la page. #108941 (Alexey Milovidov).
- Le database engine
MySQL, le table engine et la table function associent désormais les column types spatiaux de MySQL (LINESTRING,POLYGON,MULTILINESTRING,MULTIPOLYGONet le type génériqueGEOMETRY) aux types géométriques ClickHouse correspondants au lieu deString. Ce comportement est contrôlé par le nouveau drapeaugeometrydu paramètremysql_datatypes_support_level, activé par défaut.POINTcontinue d’être toujours converti enPoint. La colonne génériqueGEOMETRYest associée au type génériqueGeometry; la lecture d’une valeur dont le sous-type n’a pas d’équivalent dans ClickHouse (MULTIPOINT,GEOMETRYCOLLECTION) lève une exception au moment de la lecture. #108944 (Alexey Milovidov). - Web UI (
play.html) : navigation complète au clavier — navigation avec les touches fléchées dans le panneau des bases de données et la table de résultats, accès au clavier aux boutons de la barre d’outils, au sélecteur de thème et au menu de téléchargement, ainsi que contours de focus visibles. #108972 (Alexey Milovidov). - HTTP interface : lorsque des credentials sont fournis à la fois via des paramètres d’URL (
user/password) et un en-têteAuthorization, les paramètres d’URL ont désormais la priorité au lieu que la requête soit rejetée. Cela corrige l’échec du téléchargement des résultats depuis la Web UI (play.html) avecAUTHENTICATION_FAILED(erreur 516) lorsque le navigateur a mémorisé des identifiants Basic. #108980 (Alexey Milovidov). - Restaure
show_data_lake_catalogs_in_system_tablescomme paramètre ne contrôlant que la visibilité deDataLakeCatalogdanssystem.tables,system.columnsetsystem.completions. Ajout deshow_remote_databases_in_system_tables, activé par défaut, pour permettre aux utilisateurs de masquer séparément les bases de donnéesMySQLetPostgreSQLdans ces tables système. #109082 (Pablo Marcos). - Utilise par défaut l’algorithme précis d’analyse des flottants (valeur représentable la plus proche) et applique le paramètre
precise_float_parsingaux input formats (CSV,TSV,JSON,VALUES, …) ainsi qu’aux littéraux numériques, et pas seulement àtoFloat*/CAST. Définissezprecise_float_parsing = 0pour retrouver le comportement précédent, plus rapide dans certains cas mais moins précis. Ferme #60146. Ferme #74647. Ferme #68914. #109086 (Raúl Marín). - Une requête avec un seul CTE est désormais formatée avec les mêmes retours à la ligne et la même indentation qu’une requête avec plusieurs CTE. Auparavant,
WITH a AS (...)gardait le CTE sur la même ligne queWITH, tandis qu’avec deux CTE ou plus,WITHétait placé sur sa propre ligne et chaque CTE était indenté. #109092 (Groene AI). - Web UI : lorsque la complétion en surbrillance est identique au mot déjà saisi, ou au même mot avec une casse différente (par ex.
HASHproposé pourhash), appuyer sur Flèche droite/Tab/Entrée ne réécrit plus le mot et n’est plus absorbé par l’autocomplétion — la touche déplace le curseur ou insère un saut de ligne comme prévu. #109106 (Alexey Milovidov). #109384 (Alexey Milovidov). - Ajout dans la Web UI (
play.html) de la mise en surbrillance des parenthèses arc-en-ciel, des crochets correspondants, des identifiants correspondants et des groupes de chiffres, comme dansclickhouse-client. #109108 (Alexey Milovidov). - Dans la Web UI,
TabetShift+Tabajoutent et retirent désormais une indentation de 4 espaces aux lignes sélectionnées. #109110 (Alexey Milovidov). - Web UI : la position d’une erreur de syntaxe dans l’éditeur de requête est mise en surbrillance avec un fond rouge. La surbrillance disparaît dès que l’utilisateur redonne le focus à l’éditeur. #109112 (Alexey Milovidov).
clickhouse-compressor --statet la détection du codec par défaut pour les anciennes parts signalent désormais les en-têtes de block corrompus comme une corruption, au lieu d’une erreur de fin de fichier trompeuse. #109157 (Raufs Dunamalijevs).- ClickHouse Keeper respecte désormais le paramètre
os_collect_psi_metricset n’effectue pas la collecte des métriques PSI lorsqu’il est désactivé. #109179 (Maxim Orlovsky). - Dans la Web UI, lorsque les onglets de requête sont affichés, les paramètres de connexion (hôte, utilisateur, mot de passe) sont masqués derrière un bouton en forme de clé dans l’angle supérieur droit et affichés dans un menu déroulant à la demande. #109243 (Alexey Milovidov).
- Web UI : afficher un résultat à valeur unique (une ligne, une colonne, par ex.
SHOW CREATE TABLE) sur toute la hauteur au lieu de le limiter à trois lignes. #109245 (Alexey Milovidov). - Dans la Web UI, cliquer sur une table dans le panneau des bases de données avec le bouton central de la souris, avec Shift, ou avec le modificateur d’ouverture dans un nouvel onglet propre à la plateforme (Cmd sur macOS, Ctrl ailleurs) ouvre désormais sa requête dans un nouvel onglet de la Web UI. #109246 (Alexey Milovidov).
- Le cache des conditions de requête pour les fichiers
Parquetdistants (stockage objet) utilise désormais l’ETag en plus du chemin, afin que l’écrasement d’un objet sur place ne serve plus de résultats obsolètes depuis le cache. #109310 (Alexey Milovidov). - Dans la Web UI, les chaînes vides et les NULL ne sont plus colorés dans le mode de coloration catégorielle. #109342 (Alexey Milovidov).
- Web UI : en cliquant sur l’icône d’une table dans le panneau des bases de données, on affiche désormais la liste de ses colonnes, avec des icônes de type, une barre de taille proportionnelle à la taille compressée, et une infobulle indiquant les tailles compressée et non compressée ainsi que le taux de compression. #109346 (Alexey Milovidov).
- Web UI : afficher le titre complet de l’onglet dans une infobulle au survol lorsqu’il est tronqué. #109354 (Alexey Milovidov).
- Dans la Web UI, un clic molette sur le titre d’un onglet (ou un Ctrl/Shift/Cmd+clic) duplique désormais l’onglet. #109357 (Alexey Milovidov).
- Web UI : redimensionner uniformément les zones de progression finale et de statistiques de requête afin d’éviter des retours à la ligne maladroits lorsque la fenêtre du navigateur est étroite. #109363 (Alexey Milovidov).
- Web UI : sélectionner une base de données dans le panneau des bases de données l’utilise désormais comme base de données par défaut pour les requêtes exécutées depuis l’éditeur. #109372 (Alexey Milovidov).
- Prise en charge de
reinterpretd’unArrayd’éléments de taille fixe vers unString, l’inverse dureinterpretexistant d’unString/FixedStringvers unArray. #109383 (Alexey Milovidov). - Dans la Web UI, ne pas afficher les bascules de code couleur par colonne lorsque le résultat ne contient qu’une seule ligne au maximum. #109385 (Alexey Milovidov).
- Autoriser
CASTentre des typesQBitqui diffèrent par le type d’élément et/ou le stride, tant que la dimension reste identique (par exempleCAST(x AS QBit(Float64, N))à partir d’unQBit(Float32, N)). Les changements portant uniquement sur le stride sont sans perte ; les changements de type d’élément suivent la sémantique de conversion correspondante d’Array(par exemple,Float32versBFloat16peut entraîner une perte de précision, etaccurateCast/accurateCastOrNullrejettent les lignes qui ne sont pas représentables exactement). #109387 (Alexey Milovidov). - Les fonctions
quantizeBFloat16ToInt8etdequantizeInt8ToBFloat16acceptent désormais aussi des argumentsArrayetQBit, en appliquant le codec Lloyd-Max à l’ensemble du vecteur (et en renvoyant unArray/QBitdu type d’élément correspondant), en plus des surcharges scalaires existantes. #109398 (Alexey Milovidov). - Web UI : le lien Documentation inclut désormais le nom de l’utilisateur courant dans l’URL. #109419 (Alexey Milovidov).
- Prise en charge de
arraySum,arrayAvgetarrayProductpour lesArraydeBFloat16. #109420 (Alexey Milovidov). - Le spécificateur de format
%f, de style MySQL, dansparseDateTime/parseDateTime64(et leurs variantesOrZero/OrNull) accepte désormais entre 1 et 6 chiffres fractionnaires, interprétés comme des microsecondes alignées à gauche comme dansSTR_TO_DATEde MySQL, au lieu d’exiger exactement 6 chiffres. Correction également du mauvais alignement des tablesPrettyCompactdans les exemples de documentation des fonctions intégrées. #109421 (Alexey Milovidov). - Web UI : les onglets de requête sont désormais persistants : chaque onglet conserve son résultat affiché (y compris les images et les graphiques) ainsi que sa requête en cours d’exécution lorsque vous changez d’onglet puis y revenez, et les requêtes longues continuent de s’exécuter en arrière-plan. Les titres des onglets affichent une icône de chargement, une barre de progression et une coche de validation pour leur requête. #109425 (Alexey Milovidov).
- Web UI : affiche correctement une erreur lorsqu’une requête échoue après qu’une partie de son résultat a déjà été transmise en flux, au lieu d’afficher une
SyntaxError: Unexpected end of JSON inputcôté client (ou, avechttp_write_exception_in_output_format, de marquer à tort la requête en échec comme réussie). #109430 (Alexey Milovidov). - Ajout de colonnes épinglées dans la Web UI : une colonne peut être épinglée depuis son en-tête afin de rester visible (fixée sur le bord) pendant le défilement horizontal de la table de résultats. #109439 (Alexey Milovidov).
- Dans le tableau de bord avancé (
/dashboard), les graphiques de métriques spécifiques peuvent désormais être ajoutés directement à partir du nom de la métrique tel qu’il apparaît dans le code source ou la documentation, ce qui facilite l’ajout de plusieurs métriques lors des sessions de débogage. #109449 (Mikhail Artemenko). - Web UI : correction d’un problème de fermeture de la liste déroulante des paramètres de connexion lors de la sélection de texte à la souris, puis d’un glissement au-delà de sa bordure. #109451 (Alexey Milovidov).
- Web UI : le survol de l’en-tête d’une colonne de la table de résultats affiche désormais le nom complet de la colonne et son type dans une infobulle, afin que les en-têtes tronqués puissent être lus en entier. #109463 (Alexey Milovidov). Correction également du tronquage avec des points de suspension des titres d’en-tête de colonne, même lorsque la colonne était suffisamment large pour afficher le titre complet. #110397 (Alexey Milovidov).
- Prise en charge, dans les builds macOS, des dictionnaires de cache SSD (layout
SSD_CACHE) et du moteur de tableFileLog. #109493 (Raúl Marín). - Web UI : ne restaure pas les onglets contenant des requêtes vides à l’ouverture de la page. #109529 (Alexey Milovidov).
- Correction des suggestions d’autocomplétion illisibles à la saisie et des couleurs vives dans le client interactif sur les terminaux dont
TERMne contient pas256(par exemple Ghostty, kitty, Alacritty, foot) : les couleurs vives sont désormais systématiquement émises sous forme de codes de couleur aixterm, au lieu de revenir à gras + couleur sombre, que les terminaux modernes affichent comme une couleur sombre difficile à lire sur fond sombre. #109622 (Alasdair Brown). - Activation des arènes jemalloc par CPU et du profilage des allocations dans les builds macOS. #109684 (Raúl Marín).
- Autorise la modification de certains paramètres d’authentification d’une base de données de catalogue de data lake
OneLakeavecALTER DATABASE ... MODIFY SETTING. #110019 (alesapin). - Le moteur
Hivelit désormais les métadonnées des fichiersORC(index min/max, nombres de lignes) avec le lecteurORCnatif de ClickHouse au lieu de l’adaptateurORCApache Arrow. #110086 (Alexey Milovidov). - Taille du binaire réduite d’environ 10,5 Mo en exécutant les opérations de comparaison et arithmétiques sur des paires de types mixtes rarement utilisées (
Decimalpar rapport à un entier d’une largeur différente, ainsi que les paires impliquantInt128/UInt128/Int256/UInt256) via une conversion vers un type commun au lieu d’un kernel compilé dédié à chaque combinaison de types. Les paires de même type, les paires courantes, ainsi queplus/minus/multiply, limitées par la mémoire, conservent leurs kernels dédiés ; les résultats, les types de résultat et les cas exceptionnels restent inchangés. #110131 (Alexey Milovidov). - Une sous-requête à droite de
INdont l’unique colonne est un tableau avec une dimension de plus que l’argument de gauche est désormais interprétée comme l’ensemble des éléments du tableau (comme un littéral de tableau ou une fonction renvoyant un tableau), au lieu d’échouer avec une erreur déroutante d’incompatibilité de types. Par exemple,x IN (SELECT groupArray(x) FROM ...)fonctionne désormais. #110169 (Alexey Milovidov). - La lecture depuis un moteur de table
SQLiteou une fonction de tablesqlitene monopolise plus inutilement un cœur de CPU entier lorsque la base de données SQLite est verrouillée par une autre connexion. La lecture reste désormais inactive en attendant le verrou et peut toujours être annulée. #110248 (Groene AI). - Arrondit à trois chiffres les valeurs de temps écoulé, de débit et de ratio dans les messages de journalisation et d’exception, afin que des nombres comme
1.345844286 sec.ne soient plus affichés avec leur précision complète. #110277 (Alexey Milovidov). - Dans la Web UI (Play),
BFloat16est désormais reconnu comme un nombre à virgule flottante et ses colonnes sont alignées à droite et colorées en conséquence. #110433 (Alexey Milovidov). - Prise en charge de la clause
SETTINGSpour le moteur de tablePostgreSQLet la fonction de tablepostgresql(par exempleSETTINGS postgresql_connection_pool_size = 50), ce qui assure une parité fonctionnelle avec le moteurMySQL. #110614 (Alexey Milovidov). SHOW CREATE TABLE(ainsi queSHOW CREATE VIEW/SHOW CREATE DICTIONARY) suggère désormais, dans le message d’erreur, une table au nom similaire lorsque la table demandée n’existe pas, comme le font déjà les requêtesSELECT. #110633 (Alexey Milovidov).- Active par défaut le paramètre
merge_selector_enable_heuristic_to_lower_max_parts_to_merge_at_once: le merge selector réduit désormais automatiquement le nombre maximal de parts à fusionner en une seule fois en fonction du niveau de remplissage de la partition. Voir #91163. #110726 (Mikhail Artemenko). - Accepte les commandes de nettoyage PostgreSQL
RESET,UNLISTENetDISCARDcomme des opérations sans effet dans le PostgreSQL wire protocol au lieu d’échouer avec une erreur de syntaxe. Cela améliore la compatibilité avec des drivers tels que Skunk, qui envoientRESET ALLetUNLISTEN *lors de l’établissement et du nettoyage de la connexion. #110780 (Alexey Milovidov). - Modifie la valeur par défaut du paramètre
auto_statistics_typesdebasic, uniqàbasic, uniq_v2. #110878 (Han Fei). randomHadamardTransformcalcule désormais une transformée exacte préservant la longueur pour toute longueur de vecteur dont le plus grand facteur impair est au plus égal à 64 (par exemple3584 = 512 * 7, courant dans les modèles d’embedding), étendant ainsi les familles précédentes2^N,2^k * {12, 20}et2^k * 9. Une transformée complète d’une longueur qui ne peut pas être représentée exactement lève désormais une exception au lieu de compléter silencieusement avec des zéros jusqu’à un vecteur plus long ; passezoutput_dimspour calculer une projection tronquée d’une longueur arbitraire. #111006 (Alexey Milovidov).- Correction d’une exception
LOGICAL_ERRORlors de la sauvegarde d’une base de donnéesReplicateden cours de suppression et de recréation simultanées ; ces sauvegardes échouent désormais proprement avecCANNOT_GET_REPLICATED_DATABASE_SNAPSHOT. #100651 (Alexey Milovidov). - Affiche désormais l’erreur réelle sous-jacente lorsqu’une archive zip ne peut pas être extraite (par exemple, lorsque l’archive est lue depuis S3 et que le read buffer refuse un seek). Auparavant, l’erreur réelle était masquée par le message générique
Couldn't unpack zip archive: Code = -100/Couldn't open zip archive. #105103 (Groene AI). - Correction d’un message trompeur “Maybe you meant X?” après un redémarrage du serveur (ou
DETACH DATABASE/ATTACH DATABASE) : la suppression d’une table déjà supprimée pouvait suggérer comme alternative le nom qui venait d’être supprimé. #106238 (Groene AI). - Correction d’une logical error (
Logical error: 'removed', provoquant l’arrêt du serveur dans les builds de débogage) dans la queue de suppression des tables en arrière-plan, déclenchée lorsque le même UUID explicite est réutilisé dans plusieurs queryCREATE OR REPLACE TABLE, ce qui place dans la queue plusieurs tables supprimées partageant cet UUID. #107031 (Groene AI). - Correction d’une logical error
Inconsistent AST formattingqui pouvait arrêter le serveur dans les builds de débogage et avec sanitizer lorsqu’une lambda avec alias était utilisée comme opérande d’un operator d’accès (élément de tuple.Nou élément de tableau[]) à une position autre que la première dans une liste d’expressions, par ex.SELECT 1, ((p0, p1) -> p0 AS a7).4[3] FROM t. #107092 (Groene AI). - Une cluster table function (
urlCluster,fileCluster,s3Cluster, …) imbriquée dans une autre distributed query, telle queclusterAllReplicas(..., urlCluster(...)), est désormais rejetée avec une erreurBAD_ARGUMENTSau lieu d’échouer avec une logical error (Distributed task iterator is not initialized). #107107 (Groene AI). OPTIMIZE ... DRY RUNinterrompu par un timeout de query (max_execution_timeavectimeout_overflow_mode = 'break') renvoie désormaisTIMEOUT_EXCEEDEDau lieu d’une logical error liée àrows_sources(qui arrêtait le serveur dans les builds de débogage/avec sanitizer). #107114 (Groene AI).- Fin de la journalisation d’une erreur bénigne
Net Exception: Socket is not connectedpendant la finalisation d’une sessionZooKeepersur macOS.clickhouse keeper-clientn’affiche plus cette erreur parasite sur stderr à la fermeture. #107438 (Groene AI). - Correction d’un overflow d’entier signé lorsqu’une refreshable materialized view retente un refresh ayant échoué avec
refresh_retriesdéfini sur une très grande valeur (proche du maximum deInt64). L’overflow pouvait arrêter le serveur dans les builds avec le sanitizer de comportement indéfini. #108005 (Groene AI). - Corrige un
LOGICAL_ERROR(arrêt du serveur dans les builds de débogage/sanitizer) lorsqu’unJOINutilise l’opérateur de comparaison null-safe (<=>/IS NOT DISTINCT FROM) et que l’une des clés est une scalar subquery, par ex.... JOIN t2 ON (SELECT x FROM t1) <=> t2.k, avec l’ancien analyzer (enable_analyzer = 0). Une telle query renvoie désormais une erreurNOT_FOUND_COLUMN_IN_BLOCKnormale au lieu d’une erreur logique. #108123 (Groene AI). - Les queries de vector search qui sélectionnent la colonne
_distancerenvoient désormais une erreur appropriée au lieu d’échouer avec une erreur logique. #108423 (Robert Schulze). - Corrige un
std::future_error(The associated promise has been destructed prior to the associated state becoming ready) qui pouvait survenir et provoquer l’arrêt du serveur dans les builds de débogage et sanitizer lorsque la planification de la tâche asynchrone finale de finalisation du téléversement multipart S3/Azure échouait (par exemple en cas d’épuisement du pool de threads). La véritable erreur de planification est désormais signalée à la place. #108730 (Groene AI). - Évite une sortie excessive du server log ainsi qu’un message d’erreur démesuré lors de la compilation d’une très grande regular expression (par exemple un pattern
LIKEoumatchavec des centaines de milliers de wildcards) ; ces patterns échouent désormais avec une erreurCANNOT_COMPILE_REGEXPclaire. #108821 (Raúl Marín). - Corrige un comportement indéfini lors de la conversion en chaîne d’un packet type de protocol hors plage (par ex. dans les messages d’erreur
Unexpected packet from server/Received ... packet) pour une connection désynchronisée ou fuzzée. #108885 (Groene AI). - Corrige une erreur interne trompeuse (
Method getResultType is not supported for TABLE query tree node) lorsqu’une expression de table était utilisée comme argument de gauche de l’opérateurIN; ces queries produisent désormais un message d’erreur clair. #109412 (Alexey Milovidov). - Corrige la lecture d’une Iceberg table avec un metadata file dont le numéro de version ne contient que des chiffres mais dépasse la plage des entiers 32 bits (par exemple
v99999999999999999999.metadata.json). Un tel nom produisait auparavant unstd::out_of_range(STD_EXCEPTION) opaque au lieu d’une erreurBAD_ARGUMENTSclaire. #109619 (Groene AI). - Corrige une possible
Logical error: 'ReadBuffer is canceled. Can't read from it.'lorsqu’un input format basé sur des lignes (par ex.TSV/CSV) ne parvenait pas à parse l’entrée et que la lecture sous-jacente avait déjà été annulée (par exemple un chunk HTTP malformé ou un corps tronqué). La construction des diagnostics de parsing verbose ne lit plus depuis un buffer annulé. #109708 (Groene AI). - Les filter expressions de ROW POLICY utilisant
arrayJoin(ou son aliasunnest) sont désormais rejetées avec une erreur claire ; auparavant, de telles policies provoquaient une erreur logiquecolumn->size() == num_rowsau query time. #109753 (Raúl Marín). #109973 (Raúl Marín). - La lecture d’une Paimon table dont le schéma contient un Nested type non pris en charge (par exemple un champ
ROW) signale désormais une erreurBAD_ARGUMENTSclaire indiquant le type non pris en charge, au lieu d’un simpleDB::Exception. (OK)avec le code d’erreur 0 et aucun message. #109762 (Groene AI). - Correction d’un
LOGICAL_ERROR(std::length_error) lorsqu’une requête avec le paramètre expérimentalmake_distributed_plan = 1utilisait une valeur très élevée pourdistributed_plan_default_reader_bucket_countoudistributed_plan_default_shuffle_join_bucket_count. Ces valeurs sont désormais rejetées avecINVALID_SETTING_VALUE. #109770 (Groene AI). - Correction d’un
LOGICAL_ERROR(query tree node does not have valid source node) lorsqu’une CTE récursive résolvait un identifiant d’une portée externe comme colonne corrélée (avecallow_experimental_correlated_subqueries = 1). Ces requêtes renvoient désormais une erreurUNSUPPORTED_METHODexplicite. #109863 (Groene AI). - Correction d’un overflow d’entier signé lorsque
ORDER BY ... WITH FILLsaute un très grand intervalle sur une colonneInt64/UInt64(par exemple, un pas de 2 sur un intervalle proche de 2^63). L’overflow avait un comportement indéfini sous les sanitizers et rebouclait silencieusement dans les builds de production. #109937 (Groene AI). - Correction d’une erreur logique
Bad cast from type DB::FunctionNode to DB::ConstantNode(arrêt du serveur dans les builds de débogage/sanitizer) lors de l’exécution deSELECT ... ORDER BY ... WITH FILLsur une tableDistributedavec une faible valeur deoptimize_const_name_size. #109938 (Groene AI). - Correction d’une erreur logique
Invalid number of rows in Chunklorsqu’une cibleINTERPOLATEest un alias d’une colonneWITH FILLavec l’ancien analyseur (enable_analyzer = 0). Ces requêtes sont désormais rejetées avec une erreurINVALID_WITH_FILL_EXPRESSIONexplicite. #110103 (Groene AI). - Correction d’une erreur logique (arrêt du serveur dans les builds de débogage/sanitizer) lorsque les fonctions
indexHint/ignore/isZeroOrNullreçoivent un argument dont le type est résolu enNothing, par exemple dans des expressions commeindexHint(assumeNotNull(materialize(NULL))). #110192 (Groene AI). - Correction d’une erreur logique
Too large size (...) passed to allocatorqui pouvait se produire lorsqu’une valeur hors plage était définie pour un paramètre de taille de read buffer tel quemax_read_buffer_sizeoumax_read_buffer_size_local_fs. Ces valeurs sont désormais plafonnées à 256 MiB par la vérification de cohérence des paramètres, ainsi qu’au point de consommation pourINSERT ... FROM INFILE, qui lit les fichiers dansclickhouse-client, où cette vérification ne s’applique pas. #110207 (Alexey Milovidov). CHECK TABLEsignale désormais la corruption réelle pour une projection part dont les métadonnées n’ont pas pu être chargées, au lieu de l’erreur trompeuseColumns doesn't match ... Expected: 0 columns. #110262 (Raúl Marín).- Une incompatibilité de type lorsqu’une valeur lue depuis une source PostgreSQL (par exemple la table function
postgresqlou le table enginePostgreSQL) ne peut pas être analysée dans le type de colonne déclaré (par exemple une colonnetextdéclarée enInt32) est désormais signalée comme une véritable erreur de requête ; auparavant, cela interrompait le serveur dans les builds de débogage et sanitizer. #110264 (Groene AI). - Prise en charge du query profiler, des profileurs mémoire et de trace, ainsi que de la symbolisation de
system.trace_logsur macOS. #109825 (Raúl Marín). - Mise à jour de
chdigvers la v26.7.1 : traces de pile compressées pour le partage, motifs de requête, prise en charge de la mémoire à arènes séparées, améliorations de Perfetto et correctifs de compatibilité. #110938 (Azat Khuzhin). - Correction d’une inférence de monotonie incorrecte pour
intDivsur une clé non signée divisée par une constante signée, ce qui pouvait désactiver l’élagage de l’index de clé primaire pour les prédicatsIN/NOT INqui franchissent la limite signée du type de résultat ; les builds de Débogage pouvaient également déclencher uneLOGICAL_ERRORInvalid binary search result in MergeTreeSetIndex. #107586 (Groene AI). - Ajout du paramètre
allow_lossy_numeric_supertype(désactivé par défaut). Lorsqu’il est activé,if,multiIf,coalesce,ifNull,arrayetmap, appliqués à des arguments numériques qui n’ont pas de type commun sans perte (par exempleDecimaletFloat64, ouInt64etFloat64), renvoientFloat64au lieu deVariant, afin que le résultat puisse être utilisé avec des fonctions d’agrégation telles quesum,avg,minetmax. Les messages d’erreur pertinents des fonctions d’agrégation mentionnent désormais le paramètre par son nom. Clôt #106707. #107236 (Groene AI). - Démarrage du point de terminaison Prometheus (pour les configurations avec métriques uniquement) et de la collecte asynchrone des métriques avant le chargement des tables, afin que les métriques soient visibles pendant la phase de chargement des métadonnées, qui peut être longue. #108402 (Christoph Wurm).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Correction de l’échec de
TRUNCATE TABLEet deDROP PARTITIONsur les tables comportant de nombreux blocs de déduplication, lorsque leur suppression en une seule requête ZooKeeper pouvait dépasser la limite par défaut de 1 MB dejute.maxbuffer. #105991 (Clayton McClure). Cela ne vous concerne que si vous utilisez Apache ZooKeeper (non recommandé) au lieu de ClickHouse Keeper. - Correction de l’utilisation de noms de colonnes qualifiés (
database.table.column) dans la clauseWHEREdes mutations, commeDELETE FROMetALTER TABLE ... UPDATE/DELETE, sur les tables de la familleMergeTree; auparavant, ces requêtes échouaient avec une erreur de colonnes manquantes. Closes #71760. #109491 (Mikhail Artemenko). - Correction du cache des résultats de requête pour les requêtes PromQL. Le dialecte
promqlcontournait la vérification des fonctions non déterministes et pouvait renvoyer des résultats obsolètes ancrés surnow(); l’API HTTP Prometheus (/api/v1/query,/api/v1/query_range) ne stockait quant à elle jamais d’entrées de cache. #110887 (Nikita Mikhaylov). - Correction de l’échec du démarrage du serveur lorsque la variable d’environnement
TZest vide. Closes #68920. #68921 (Ardenwick). - Correction de l’échec du démarrage du serveur lorsqu’un database engine
Backupfait référence à une sauvegarde devenue indisponible (par exemple, lorsque ses fichiers ont été supprimés ou que le stockage sous-jacent est inaccessible). La base de données est désormais chargée sans tables au lieu d’empêcher le démarrage de l’ensemble du serveur. #83188 (Vitaly Orlov). - Lors de l’utilisation d’insertions en arrière-plan dans des tables avec l’engine
Distributed, les délais causés par des erreurs répétées lors de l’envoi de données vers des shards distants diminuent désormais une fois les erreurs résolues. Auparavant, le délai ne faisait qu’augmenter et n’était jamais réinitialisé. #87378 (Andrei Kochemirovskii). - Correction de
broken_data_filesdanssystem.distribution_queueet de la métriqueBrokenDistributedFilesToInsert, qui indiquaient toujours0pour les fichiers corrompus détectés lors de l’analyse de la queue async-insertDistributedau démarrage. #92124 (KG.Xu). - Correction de la récupération de la journalisation après une erreur de disque plein. Auparavant, lorsque le disque de logs était plein, ClickHouse entrait dans un état d’échec et inondait continuellement syslog de messages d’erreur (avec potentiellement plus de 100 GB/heure écrits), sans jamais récupérer même après la libération d’espace disque. Désormais, le système de journalisation récupère automatiquement dès que de l’espace disque redevient disponible, sans nécessiter de redémarrage du serveur. #93127 (jaehanbyun).
- Transmission des identifiants statiques S3 aux lectures de tables Unity
DataLakeCataloglorsquevended_credentialsest désactivé, évitant ainsi les échecs d’accès anonyme au stockage objet. #96910 (kgeg401). - Correction d’un crash dans le code d’analyse du schéma du table engine
DeltaLake. #97112 (Kseniia Sumarokova). - Correction d’un problème de sécurité où un client TCP non authentifié pouvait sonder l’existence de tables et l’état de la réplication via le port interserveur. #99854 (Shaohua Wang).
- Corrige une erreur de syntaxe lorsqu’un alias suit une sous-requête dans
DESCRIBE TABLE. Corrige #100031. #100205 (Yarik Briukhovetskyi). - Corrige une exception dans les sous-requêtes corrélées lorsque les colonnes externes deviennent
Nullableavecgroup_by_use_nullsetROLLUP/CUBE. #100365 (Alexey Milovidov). - Corrige un arrêt brutal du serveur (dans les builds avec sanitizer) et une perte silencieuse de données au démarrage de la table lorsqu’une part
MergeTreetransactionnelle annulée intersecte une part validée. #100992 (Tuan Pham Anh). - Corrige
indexOfAssumeSorted, qui renvoyait des résultats incorrects pour les colonnesArray(LowCardinality(String))dans les tablesMergeTree. #101771 (Yash ). - Corrige un élagage incorrect de la clé primaire lorsque la clé de tri d’une table enveloppe une colonne
DatedanstoDateTime(par exemple,ORDER BY toDateTime(date_column)) et qu’une requête filtre sur la colonne d’origine avec une comparaison commeWHERE date_column >= '...'.toDateTime(Date)déborde pour les valeursDateau-delà de la plage deDateTime(après2106-02-07), de sorte que la clé stockée n’est pas monotone ; ClickHouse n’utilise donc plus l’élagage par clé primaire pour cette combinaison clé/prédicat, car cela pourrait sinon exclure des granules contenant des lignes correspondantes. Clôt #101744. #101814 (Nihal Z. Miaji). - Corrige
intDivOrNull,moduloOrNulletpositiveModuloOrNull, qui renvoyaient0au lieu deNULL, ainsi queintDivOrNulletintDivOrZero, qui levaient une exception au lieu de renvoyerNULL/0, lorsque la division entraînait une exception en virgule flottante (division par zéro ouINT_MIN / -1), y compris pour des arguments mixtes signés/non signés. #101976 (Yarik Briukhovetskyi). - Corrige des exceptions
LOGICAL_ERRORlors de la lecture de tablesIcebergouDeltaLakedans des cas limites, tels que des mises à jour concurrentes des métadonnéesIcebergou des lectures via la fonction de tablemergesur des tablesDeltaLake. #102033 (Groene AI). - Corrige les requêtes HTTP sortantes (par ex. la fonction
aiGenerate, la fonction de tableurl, S3) qui échouaient avecNo route to hostsur des hôtes annonçant à la fois des adresses IPv4 et IPv6 lorsqu’une seule famille d’adresses était routable. Le pool de connexions HTTP bascule désormais vers l’adresse résolue suivante lorsque la première échoue avec une erreur réseau, au lieu de propager l’erreur dès la toute première requête. #103786 (Alexey Milovidov). - Corrige un arrêt brutal du serveur pendant
RESTOREde sauvegardes contenant des tables avec des dépendances cycliques. #103824 (Konstantin Bogdanov). - L’inférence de schéma pour les colonnes Arrow
time32/time64(par ex.SELECT * FROM file(..., 'Arrow')) infère désormaisTime64au lieu deDateTime64; tout ce qui, en aval, s’appuie sur l’ancien type inféré verra le nouveau type après une mise à niveau. De plus, les valeursTime/Time64peuvent désormais être exportées vers Arrow avec le type temporel Apache Arrow approprié, sélectionné selon la précision. Corrige #104038. #104316 (/bin/cat). - Correction d’une condition de concurrence entre
ALTER TABLE ... RENAME COLUMNet unOPTIMIZE TABLE ... FINALconcurrent (ou toute fusion en arrière-plan) dansMergeTree, qui pouvait remplacer silencieusement par des valeurs par défaut les données de la colonne renommée. #104822 (Groene AI). - Correction d’une erreur logique
Block structure mismatchlors d’unINSERTconcurrent alors qu’unALTER TABLE ... RENAME COLUMNest en cours, dans une base de donnéesAtomicaveclazy_load_tables = 1aprèsDETACH DATABASE/ATTACH DATABASE. #104852 (Groene AI). - Correction de
groupConcatlorsque les syntaxes paramétrique et à deux arguments sont mélangées, par ex.groupConcat(',', 2)(x, '/'): le paramètre de limite de lignes était silencieusement ignoré, si bien que toutes les lignes étaient renvoyées au lieu du nombre demandé ; le délimiteur du second argument remplace désormais correctement celui du paramètre. #104882 (Yarik Briukhovetskyi). - Correction d’une
LOGICAL_ERROR(Expected one block from input stream) levée parKILL QUERY/KILL MUTATION/KILL PART_MOVE_TO_SHARD/KILL TRANSACTIONlorsque leur clauseWHEREcontient une sous-requête évaluée pour chaque ligne, ou lorsquemax_block_sizeest suffisamment petit pour que leSELECTinterne sur la tablesystem.*concernée produise plus d’un bloc. #104927 (Groene AI). - Correction de
CASTd’unités d’intervalle plus petites vers des unités plus grandes, qui renvoyait des résultats incorrects (par exemple,CAST(toIntervalSecond(60) AS IntervalMinute)renvoyait0au lieu de1). Clôt #104986. #105058 (Yarik Briukhovetskyi). - Correction d’une erreur logique (
Assertion 'row < chunk.getNumRows()' failed) dans les requêtesLIMIT ... WITH TIESexécutées avec le pipeline de lecture dans l’ordre (optimize_read_in_order = 1etread_in_order_use_virtual_row_per_block = 1). #105102 (Groene AI). - Correction d’une fuite dans les vues matérialisées actualisables (
MATERIALIZED VIEW ... REFRESH ...) : la table interne temporaire qu’une actualisation écartait viaEXCHANGE TABLESne pouvait pas être supprimée si elle dépassaitmax_table_size_to_drop, si bien que chaque actualisation suivante créait encore une nouvelle table interne temporaire, faisant grossir le répertoire de données de la vue jusqu’à épuiser le disque. La suppression interne de la tâche d’actualisation contourne désormaismax_table_size_to_dropetmax_partition_size_to_drop; ces garde-fous s’appliquent toujours à unDROP TABLEde la vue elle-même lancé par l’utilisateur. Clôt #104900. #105106 (Groene AI). - Correction d’une erreur inattendue
DATA_TYPE_CANNOT_BE_USED_IN_KEYsur des requêtesALTERqui ne modifient pas la clé de tri (modification de paramètres, de commentaires, de codecs, ajout d’une colonne hors clé, etc.) pour les tablesMergeTreedont la clé de tri contient unSimpleAggregateFunction(ou un autre type autorisé uniquement avecallow_suspicious_primary_key = 1). #105111 (Groene AI). - Correction d’un use-after-free lors de l’interrogation des colonnes d’état des répliques de
system.clusters(telles queis_active,unsynced_after_recovery,recovery_time) pendant la suppression ou le détachement d’une base de donnéesReplicated. De plus, les exceptions Keeper bénignes ignorées dans ce chemin de code (la base de données affectée est traitée comme temporairement indisponible et ignorée) sont désormais journalisées au niveauInformationau lieu deError; elles ne sont donc plus transmises aux clients avec la valeur par défautsend_logs_level = 'warning'. #105149 (Groene AI). - Correction d’un problème où l’exécution de plusieurs instructions dans
clickhouse-local --ignore-errorréaffichait chaque instruction suivante dans le message d’erreur pour chaque erreur lexicale ou de parenthèses non appariées. #105480 (Groene AI). - Correction d’un plantage rare du serveur lorsque des vues matérialisées actualisables sont supprimées ou remplacées en parallèle de la planification de leur rafraîchissement. #105588 (Groene AI).
- Rejet de
ALTER TABLE ... DELETEetALTER TABLE ... UPDATEsur les tablesIcebergdont le format des fichiers de données n’est pasParquet, avec une erreurNOT_IMPLEMENTEDexplicite au lieu de faire planter le serveur ou de corrompre silencieusement la table. #105893 (Groene AI). - Correction de résultats erronés provenant d’une vue définie avec
EXCEPTouINTERSECTdont l’opérande est une chaîneUNION, aprèsDETACH/ATTACHou un redémarrage du serveur. Le formateur n’ajoutait pas de parenthèses autour des enfantsUNIONdeINTERSECT/EXCEPT, si bien que le SQL stocké était réanalysé avec une préséance inversée. #105935 (Groene AI). - Correction d’une mauvaise détection de données
JSONcommeTSKVlors de l’auto-détection du format. Clôt #100797. #106009 (Pavel Kruglov). - Interdiction de créer directement un index de saut
minmaxsur des colonnesJSON— cela pouvait ensuite faire échouer des insertions avec une exceptionNO_COMMON_TYPElorsque des tableaux de types mixtes étaient insérés. Créez plutôt l’index sur des sous-colonnes typées (par ex.INDEX idx json.field TYPE minmax). #106094 (linhaojie). - Correction d’une erreur logique (
Parsed partition value ... doesn't match partition value for an existing part with the same partition ID) déclenchée parOPTIMIZE TABLE ... PARTITION ...et d’autres requêtes qui déterminent une valeur de partition, sur des tables avec une clé de partition de typeTime. #106202 (Groene AI). - Correction d’une partie de données incorrectement marquée comme ayant une projection cassée après qu’un lightweight delete n’a laissé aucune partie de projection — soit lorsque la projection est reconstruite avec zéro ligne en sortie, soit lorsqu’elle est supprimée (
lightweight_mutation_projection_mode = 'rebuild'/'drop'). Cet état cassé désactivait auparavant l’optimisation des projections pour les requêtes sur cette partie. #106273 (Shaohua Wang). - Correction de
removeDirectorysur les disques de stockage objetplain(tels ques3_plain) qui supprimait tous les fichiers d’un répertoire non vide comme si la suppression était récursive ; la suppression d’un répertoire non vide échoue désormais avecCANNOT_RMDIR, et la suppression récursive traite explicitement son contenu. #106281 (RinChanNOW). - Correction d’une erreur logique (
Part ... doesn't exist) qui pouvait faire arrêter le serveur pendant la récupération d’unINSERTavec quorum à la suite d’une erreur matérielle Keeper lorsque le quorum était simultanément marqué comme ayant échoué. #106424 (Alexey Milovidov). - Corrige une exception
LOGICAL_ERRORliée à des noms de colonnes dupliqués lors de l’application de row policies. #106438 (János Benjamin Antal). - Corrige un problème où
CREATE OR REPLACE TABLEetREPLACE TABLElaissaient une table_tmp_replace_*orpheline sur le disque et remplaçaient la table d’origine par une table vide lorsque la table cible existante dépassaitmax_table_size_to_drop. La vérification de taille s’effectue désormais avant l’échange, de sorte qu’un dépassement interrompt proprement l’opération avec le nom de table visible par l’utilisateur dans l’erreur. #106782 (Groene AI). - Corrige le fait que
JSON_QUERY/JSON_VALUE/JSON_EXISTSrenvoyaientDynamicau lieu deString/UInt8pour des argumentsDynamic. Clôt #106461. #106877 (Pavel Kruglov). - Corrige des résultats erronés lors de l’exécution d’une query sur une table
ReplacingMergeTreeavecFINALet un filtre sur un text index lorsquequery_plan_optimize_lazy_finalétait activé. L’optimization lazy deFINALconstruisait des étapes de lecture qui ne reproduisaient pas le direct read depuis le text index, si bien que le filtre éliminait toutes les lignes correspondantes. #106894 (Jimmy Aguilar Mena). - Applique
query_masking_rulesaux messages ajoutés aux exceptions, afin que les identifiants encodés dans l’URL dans les suffixes(in file/uri ...)des erreurs provenant des table functionsjdbc/odbcne soient pas divulgués lorsque des masking rules sont configurées. #106916 (Gaurav Dubey). - Corrige le marquage de parts comme cassées et détachées lors de tout rechargement de part (redémarrage du server,
DETACH/ATTACH) pour les tables ayant une colonneLowCardinality(Nullable(...))dans la partition key. Depuis la version 26.5, le fichier d’index minmax par part n’était pas écrit lorsque le minimum et le maximum d’une telle colonne étaientNULL, alors que la vérification de cohérence de la part exigeait toujours ce fichier. Les parts écrites par les versions affectées ne disposent pas du fichier d’index minmax et doivent toujours être rattachées manuellement. Clôt #106837. #106945 (Pedro Ferreira). - Corrige une
LOGICAL_ERROR(Unexpected expression in JOIN ON section. Expected boolean (UInt8), got 'Nothing') lorsqu’un prédicat non-équiJOIN ... ONfait référence à une colonne de typeNothing, par exemple une colonne produite parARRAY JOIN []. #106981 (Groene AI). - Corrige une
LOGICAL_ERRORrare (Attempt to release query context that does not exist) ainsi que le crash du server associé lors de la lecture de tablesMergeTreevia un cache disk de filesystem créé avecenable_filesystem_query_cache_limit = 1. #107028 (Groene AI). - Corrige un crash du server lors du déplacement d’une part vide vers un disk
plain_rewritable(par exemple, avecALTER TABLE ... MOVE PARTITION ... TO DISKpour une part vide conservée parremove_empty_parts = 0). #107040 (Groene AI). - Corrige un ordre des lignes incorrect dans les queries
ORDER BYsurUNION ALLavecoptimize_read_in_orderetread_in_order_use_virtual_rowactivés. Clôt #106879. #107053 (Vladimir Cherkasov). - Correction d’une
LOGICAL_ERROR(Unsupported argument types) dans la fonctiongeohashesInBoxlorsque ses arguments de coordonnées mélangeaient des valeurs constantes et non constantes, ou lorsqu’une coordonnée était de typeBFloat16. Les argumentsFloat32mixtes const/non-const fonctionnent désormais, et les argumentsBFloat16sont rejetés avec un message d’erreur explicite. #107063 (Groene AI). - Correction de résultats erronés (lignes dupliquées) pour
SELECT DISTINCTsur unGROUP BYavecWITH CUBE,WITH ROLLUPouGROUPING SETSsur les mêmes clés. L’optimisationquery_plan_remove_redundant_distinctne supprime plusDISTINCTdans ces cas, car les modificateurs de regroupement produisent des lignes supplémentaires dont les colonnes clés prennent leurs valeurs par défaut, ce qui peut entrer en collision avec de vraies valeurs de groupe. #107072 (Groene AI). - Correction d’un résultat erroné dans un
OUTER JOINlorsque le filtreWHEREest une conjonction contenant un terme constant (par exemplep AND 1, ouWHERE p QUALIFY NULLlorsqueQUALIFY NULLest fusionné dansWHERE). Le terme constant pouvait être poussé du côté non préservé de la jointure puis supprimé du filtre post-jointure, si bien que la jointure produisait des lignes sans correspondance dont les colonnes du côté concerné prenaient leurs valeurs par défaut, et ces lignes passaient alors incorrectement le filtre. #107084 (Groene AI). - Correction d’un problème où les fonctions définies par l’utilisateur
executable_poolconfigurées avec<lifetime>ne prenaient pas en compte les modifications du script sous-jacent. Auparavant, seulSYSTEM RELOAD FUNCTIONSrelisait un script modifié ; les rechargements périodiques via<lifetime>continuaient d’exécuter l’ancienne version. #107087 (Groene AI). - Correction d’une exception
LOGICAL_ERROR(Cannot find input column ... on its position in inputs of expression actions DAG) pour une sous-requête scalaire corrélée sur une source projetant deux fois le même identifiant de colonne (par ex.SELECT number, *) lorsquecorrelated_subqueries_default_join_kind = 'left'. #107112 (Groene AI). - Correction d’une situation de concurrence sur le collecteur de traces global du serveur entre le démarrage du profileur par un thread de travail et l’arrêt du serveur. #107307 (Groene AI).
- Les sauvegardes incrémentielles ne stockent plus les identifiants
S3dans le localisateur<base_backup>du fichier de métadonnées.backup. Les sauvegardes créées avecuse_same_s3_credentials_for_base_backup = 1, ou avec des identifiants explicites de sauvegarde de base correspondant à ce localisateur, stockent désormais un marqueur non secret et sont restaurées sans paramètres supplémentaires au moment de la restauration ; pour les sauvegardes créées avec des identifiants explicites de sauvegarde de base différents ou des arguments supplémentaires d’authentification de base, transmettez-les àRESTOREavec le paramètrebase_backup. Les sauvegardes créées par d’anciennes versions avec des identifiants intégrés restent restaurables. #107357 (Pablo Marcos). - Correction d’un problème où l’en-tête
CSVWithNamesetCSVWithNamesAndTypescomportait moins de colonnes que les données lorsqueoutput_format_csv_serialize_tuple_into_separate_columnsest activé (par défaut). L’en-tête (et la ligne des types) aplatit désormais les colonnesTupleen champs feuille avec des noms en notation pointée (par ex.t.a,t.b), afin que le nombre de colonnes de l’en-tête corresponde à celui des données. Un nouveau paramètreoutput_format_csv_header_serialize_tuple_into_separate_columns(par défaut1) contrôle ce comportement et peut être défini sur0pour rétablir l’ancien en-tête à nom unique. #107371 (Groene AI). - Correction de la lecture des tables
Icebergv3 dont les data filesParquetcontiennent des colonnes réservées de lignage des lignes (telles que_row_id) ; le lecteurParquetnatif ne lève plusICEBERG_SPECIFICATION_VIOLATIONpour les ID de champ réservés qui ne font pas partie du schéma de table. #107377 (Greg Maher). - Correction d’un rare arrêt brutal du server pendant l’extinction (
std::future_error:The associated promise has been destructed prior to the associated state becoming ready), causé par le retrait d’une tâche planifiée de la file d’attente d’un thread pool avant son exécution. #107383 (Groene AI). - Correction des engines de table et de database
MaterializedPostgreSQLafin qu’une table ou une database unique puisse être répliquée à partir d’un schéma PostgreSQL autre que celui par défaut (materialized_postgresql_schema), y compris lorsque des tables portant le même nom existent dans plusieurs schémas d’une même database (auparavant, elles partageaient une publication et un replication slot, ce qui provoquait des interférences). #107425 (Alexey Milovidov). - Correction d’un problème où
MaterializedPostgreSQLarrêtait la replication d’une database entière (avecLOGICAL_ERROR: Columns number mismatch) lorsqu’une seule table répliquée avait vu sa structure changer pendant que le server était arrêté. Désormais, seule la table concernée est ignorée et peut être récupérée avecDETACH/ATTACH. #107427 (Alexey Milovidov). - Le
BACKUPd’une databaseMaterializedPostgreSQLne reste plus bloqué indéfiniment avecTable ... were created or changed its definition during scanning, et sauvegarde désormais effectivement les données de la table (via leReplacingMergeTreesous-jacent), qui peuvent être restaurées sous forme deReplacingMergeTreestandalone. #107433 (Alexey Milovidov). - Correction d’une régression où le paramètre
compatibility = '26.6'(qui active implicitement la partition strategyhive) acceptait silencieusement{_partition_id}dans les chemins de table S3/object storage au lieu de leverBAD_ARGUMENTS. #107437 (Lefteris). - Correction d’une fuite mémoire dans le
mongo-c-driverfourni, qui pouvait se produire lors de la lecture depuis MongoDB (par exemple via un Dictionary MongoDB ou la table functionmongodb) si une erreur de lecture pouvant donner lieu à un réessai était suivie de l’échec de la nouvelle sélection du server lors du réessai. #107448 (Groene AI). - Correction d’une exception lors de l’insertion dans une table
Icebergdont les metadata avaient été créées par un external engine et omettaient les tableaux optionnelssnapshots,metadata-logousnapshot-log. Ces insertions réussissent désormais au lieu d’échouer. #107473 (Shaohua Wang). - Correction de
DELETE FROM(lightweight delete), qui exigeait le privilegeALTER UPDATEen plus deALTER DELETE. Un utilisateur disposant uniquement deALTER DELETEpeut désormais exécuterDELETE FROM, conformément à la documentation. #107491 (Shaohua Wang). - Correction de
NOT_FOUND_COLUMN_IN_BLOCKlors de la lecture de fichiers partitionnés Hive avecuse_hive_partitioning = 1et une clauseWHERE/PREWHEREqui filtre un column réel (non virtuel) alors qu’un column de partition Hive est également sélectionné. #107505 (Groene AI). - Correction d’une
LOGICAL_ERROR(Different order of columns in UNION subquery) lorsque l’ancien analyzer (enable_analyzer = 0) lit un sous-ensemble de columns à partir d’une subquery dont les branchesUNIONsont des set operationsINTERSECT/EXCEPT. #107511 (Groene AI). - Correction d’un problème où les valeurs
NULLétaient silencieusement converties en chaînes vides lors de l’insertion de donnéesArrow/ORCdans une columnLowCardinality(Nullable(...)). Il s’agissait d’une régression introduite en version 26.5. #107532 (Jimmy Aguilar Mena). - Corrige une erreur logique (
Stream ... variant_discr ... is not found) qui pouvait survenir lors de la fusion ou de la lecture d’une partMergeTreeproduite par une mutation sur une table avec une colonneDynamic. #107562 (Alexey Milovidov). - Corrige une erreur logique (
WhichDataType(const_type).isArray()) lors de l’analyse de la clé primaire lorsquepointInPolygonest appelé avec un argument de polygone constant d’un type conteneur tel queVariantouDynamic(par exemple,pointInPolygon((x, y), if(c, [(0, 0), ...], NULL))). #107589 (Groene AI). - Corrige une erreur logique (
Last stored last_written_position in meta file ... is bigger than current last_written_pos) dans le moteurFileLogqui pouvait se produire lorsqu’un fichier surveillé était supprimé puis recréé en réutilisant le même inode. #107617 (Groene AI). - Corrige un arrêt rare du serveur (
std::future_error:The associated promise has been destructed prior to the associated state becoming ready) pendant le traitement des requêtes du client ZooKeeper, lorsqu’une requête Keeper asynchrone était abandonnée lors de son envoi, par exemple en cas de pression mémoire. #107647 (Groene AI). - Corrige
RESTOREpour les tablesReplicatedMergeTreeafin que les parts au contenu dupliqué issues d’une sauvegarde soient conservées au lieu d’être dédupliquées silencieusement. #107652 (Pablo Marcos). - Corrige le filtre de jointure à l’exécution qui produisait des résultats incorrects pour les colonnes
JSON. Closes #107646. #107663 (Pavel Kruglov). - Corrige des résultats incorrects pour des requêtes distribuées sélectionnant des colonnes
ALIASpartageant une sous-expression commune : les colonnes pouvaient être mal alignées et les valeurs renvoyées sous la mauvaise colonne. #107675 (Vladimir Cherkasov). - Les quotas indexés par
normalized_query_hashcomptabilisent désormais toutes les ressources (read_rows,read_bytes,result_rows,result_bytes,execution_time,written_bytes,errors) par modèle de requête, comme les compteurs du nombre de requêtes, au lieu de les imputer à un compartiment unique partagé par utilisateur. #107681 (Alexey Milovidov). - Corrige une erreur logique
Block structure mismatch in UnionStep stream(arrêt du serveur sur les builds de débogage/avec sanitizer,Code: 49sur les builds de release) qui se produisait lorsque des branches sœurs d’unUNION/INTERSECT/EXCEPTne différaient que par leur prédicatWHEREet que le prédicat d’une branche était réduit à une colonneConst. #107719 (Groene AI). - Corrige des erreurs logiques (
Bad cast) causées par une suppression incohérente deLowCardinalityimbriqué dans des colonnesVariantetDynamic, par exemple dansconcat,formatet l’analyse de la clé primaire. Closes #107598. #107773 (Pavel Kruglov). - Corrige un fort déséquilibre dans la répartition du travail avec les répliques parallèles lorsque le cluster contient des répliques inactives (par exemple, des entrées obsolètes laissées après l’autoscaling). Ces répliques ne sont désormais plus prises en compte par le coordinateur de lecture, de sorte que le travail est réparti entre les répliques en ligne au lieu de s’accumuler sur une seule. #107805 (Alexey Milovidov).
- Corrige l’exception
Not-ready Set is passed as the second argumentqui pouvait se produire lorsque la construction d’un ensemble pour une sous-requêteINéchouait silencieusement pendant l’analyse de la clé primaire (par exemple, en cas de timeout de sous-requête avecoverflow_mode = 'break'), laissant cet ensemble définitivement non construit dans le pipeline de requête. #107924 (Alexey Milovidov). - Corrige un plantage du serveur dans le pushdown de prédicat (
enable_optimize_predicate_expression, ancien analyseur) lorsqu’une sous-requêteUNIONapparaît dans une conditionJOIN ... ON. #107930 (Groene AI). - Corrige des erreurs intempestives
CHECKSUM_DOESNT_MATCHet de lectureParquet(et, pour certains formats, des résultats silencieusement erronés) lorsqu’un objet S3 ou S3-compatible (par ex. GCS) est remplacé sur place pendant sa lecture. Ces lectures échouent désormais avec une erreur claire, pouvant donner lieu à un réessai, au lieu de renvoyer des données reconstituées à partir de deux versions de l’objet ; ce comportement est contrôlé par le nouveau paramètres3_validate_etag_on_read(activé par défaut). #107934 (Shaohua Wang). - Corrige un échec de
SELECTavecNOT_FOUND_COLUMN_IN_BLOCKsur une table dotée d’un index de skipping de donnéessetlorsqu’une ROW POLICY la filtre à l’aide d’une condition toujours vraie combinée à une vérification sur une colonne non indexée. #107971 (Shaohua Wang). - Corrige l’analyse des paramètres de commande des fonctions définies par l’utilisateur exécutables afin que les placeholders dont le nom est vide ou invalide ne soient pas acceptés comme paramètres. #107983 (Goutam Adwant).
- Corrige une régression de performances pour les sous-colonnes
MapavecPREWHERE. Clôt #107912. Causée par #99200. #107988 (Pavel Kruglov). - Corrige une écriture hors limites lors de la lecture d’une colonne
Variantà partir d’un blocNativemal formé dont les discriminateurs référencent un index de variante inexistant. #107991 (uwezkhan). - Corrige des résultats de requête erronés dus à un élagage incorrect de la clé primaire et des partitions lorsque
toStartOfDay,toStartOfISOYear,toDaysSinceYearZero,toRelativeSecondNum,toRelativeMinuteNum,toRelativeHourNum,toRelativeWeekNum,toRelativeDayNum,toMonthNumSinceEpochoutoYearNumSinceEpochest appliqué à une colonne cléDate32contenant des dates en dehors de la plage que la fonction peut représenter (en particulier les dates antérieures à1970-01-01). Ces fonctions se déclarent monotones auprès de l’index primaire, mais auparavant elles bouclaient pour de tels arguments, de sorte que l’index pouvait élaguer des granules qui contenaient en réalité des lignes correspondantes ; elles saturent désormais aux limites de leur type de résultat et restent monotones sur toute la plageDate32. #108018 (Nihal Z. Miaji). - Correction de
accurateCastOrNullpour unTupledont l’élément estDynamic/Variant: un véritableNULLsource était traité comme un échec de conversion. Pour un élément cibleNullable, unNULLsource reste désormais un élémentNULL(comme avec une source simpleTuple(Nullable(...))) ; pour un élément cible nonNullable, unNULLsource met désormais l’ensemble du tuple à null au lieu de produire la valeur par défaut de l’élément ; les échecs d’analyse/de dépassement de capacité mettent toujours l’ensemble du tuple à null. #108023 (Groene AI). Correction également d’une erreur logique lors du cast d’une colonneDynamicouVariantimbriquée dans unTuplevers un type d’élément nonNullableavecaccurateCastOrNullouaccurateCastOrDefault. #108061 (Alexey Milovidov). - Correction de
numericIndexedVectorPointwiseMultiply, qui renvoyait un résultat vide lors d’une multiplication par un vecteur composé uniquement de1avec une configuration BSI (bit-sliced index) différente. #108027 (Alexey Milovidov). - Correction de
toTime64et deCAST(... AS Time64), qui ne bornaient pas les valeurs hors plage à la plageTime64dans les modes de dépassement de capacitésaturateetignore, ce qui pouvait produire des valeurs s’affichant de manière identique mais comparées comme différentes. #108028 (Alexey Milovidov). getClientHTTPHeaderest désormais correctement traité comme non déterministe, de sorte que son résultat n’est plus réutilisé à tort par le cache de résultats de requête. #108029 (Alexey Milovidov).clickhouse-client --port 9440active de nouveau automatiquement une connexion sécurisée (TLS) ; ce comportement avait été cassé par une refactorisation qui ne transmettait plus le port à la vérification de la connexion sécurisée. #108032 (Alexey Milovidov).- Une erreur transitoire lors de l’actualisation des data parts d’une table en lecture seule n’arrête plus définitivement la tâche d’actualisation en arrière-plan. #108034 (Alexey Milovidov).
- Correction des avertissements de surcharge mémoire/CPU/mutation dans
system.warnings, qui avaient un cycle de métriques asynchrones de retard (et étaient absents au premier cycle). #108035 (Alexey Milovidov). - La table function
mongodbaccepte désormaisoid_columnslorsqu’il est passé comme argument nommé (par ex.oid_columns='_id'), au lieu de le rejeter avecBAD_ARGUMENTS. #108039 (Alexey Milovidov). - Correction d’une exception
Bad cast from type DB::ColumnNullable to DB::ColumnVector<...>(erreur logique) lorsqu’un astérisque qualifié (t.*) sélectionne une cléJOIN USINGet que ce join est imbriqué sous un joinPASTE/CROSS/par virgule ou un join externeON, avecjoin_use_nulls = 0. #108043 (Groene AI). - Correction de la gestion incorrecte des assertions de largeur nulle (
\b,^,$) dans les fonctions regexp « match all »extractAll,extractAllGroupsVertical,extractAllGroupsHorizontal,countMatchesetsplitByRegexp. Par exemple,extractAll('new york is the greatest', '\b(\w)')renvoie désormais correctement la première lettre de chaque mot au lieu de toutes les lettres. #108047 (Alexey Milovidov). - Correction de
CREATE TABLE ... AS SELECTsur les bases de donnéesAtomic, qui laissait une table vide lorsque la requête échouait — par exemple lorsque l’utilisateur n’a pas accès à une table référencée dans une sous-requête. Auparavant, une nouvelle tentative indiquait que la table existait déjà au lieu de renvoyer l’erreur d’origine. La table est désormais créée via une table temporaire et ne devient visible qu’une fois entièrement remplie. #108048 (Alexey Milovidov). - Autorise les requêtes sur un dictionnaire
range_hashedoucomplex_key_range_hashedutilisant une plageDateTime64,Decimalou en virgule flottante avec un argument correspondant pourdictGet/dictHas. Auparavant, ces requêtes échouaient avecmust be convertible to Int64, et les intervalles ouverts des plagesDecimal/DateTime64renvoyaient incorrectement la valeur par défaut. #108052 (Alexey Milovidov). - Correction d’une exception (
CANNOT_PARSE_TEXT) lors du chargement d’un dictionnaire avec une clé composite dont les colonnes de clé ne sont pas les premières colonnes dans la définition du dictionnaire, avec une sourceClickHouselocale utilisant une requête explicite. Les colonnes source sont désormais mises en correspondance avec la structure du dictionnaire par nom plutôt que par position. #108053 (Alexey Milovidov). - Correction de l’échec de la fonction de table
valuesavecARGUMENT_OUT_OF_BOUNDlorsqu’un littéral décimal qui n’est pas exactement représentable dans une colonne flottante étroite (comme0.1pour une colonneFloat32) est utilisé, par ex.SELECT * FROM values('x Float32', 0.1). Ces valeurs sont désormais acceptées et converties vers la valeur représentable la plus proche, conformément àCASTetINSERT ... VALUES. #108055 (Alexey Milovidov). - Correction d’une
LOGICAL_ERROR(No available columns) lors de l’exécution deSELECT count()(ou d’autres requêtes triviales) sur une table pour laquelle l’utilisateur ne dispose d’un accèsSELECTque sur une colonneALIAS. #108056 (Alexey Milovidov). - Correction de
mapFilter,mapSort(et ses variantes) etmapConcat, qui supprimaientLowCardinalitydes types de clé et de valeur d’unMap. Auparavant,mapFiltersur une colonneMap(LowCardinality(String), String)renvoyaitMap(String, String), ce qui pouvait corrompre les métadonnées d’une table créée viaCREATE TABLE ... AS SELECTet faire échouerCHECK TABLE. #108057 (Alexey Milovidov). - Correction de résultats incorrects lors de l’utilisation de
hasTokensur des index de texte avec un tokenizer autre quesplitByNonAlpha. #108066 (Robert Schulze). - Correction d’un blocage de
SYSTEM RELOAD DICTIONARIES(etRELOAD DICTIONARY) lorsque de nombreux dictionnaires MySQL définis en XML partageaient un même pool de connexions viashare_connection. Ces pools respectent désormaisconnection_pool_sizeetconnection_wait_timeout(5 secondes par défaut) définis dans la configuration, comme les dictionnaires définis via des named collections. #108083 (Alexey Milovidov). - Autorise
EXISTS <dictionary>pour un utilisateur qui ne possède que le privilègeSHOW DICTIONARIESsur le dictionnaire (auparavant,SHOW TABLESétait requis). #108084 (Alexey Milovidov). - Correction de
CREATE TABLE dst AS src SETTINGS ...(et de variantes similaires avecORDER BY/PARTITION BYmais sansENGINEexplicite), qui omettait silencieusement le moteur, les clauses de stockage de la table source (comme leTTLde la table et les clés) ainsi que les paramètres. Le moteur et les clauses de stockage non redéfinies sont désormais hérités de la table source, et les paramètres spécifiés sont fusionnés par-dessus ceux de la table source. #108085 (Alexey Milovidov). - Correction d’un échec de
INSERTdans des tablesMergeTreeavecfilesystem error: in rename: Permission deniedsur des systèmes de fichiers basés sur Windows (WSL, CIFS/SMB, montages bind Docker Desktop), causé par le rédacteur de part qui laissait des descripteurs de fichier ouverts lors du renommage du répertoire de part. #108089 (Alexey Milovidov). - Correction d’un crash (déréférencement de pointeur nul) lors d’une requête sur une table
Hivesans clauseWHERE, par ex.SELECT * FROM hive_table. #108094 (Alexey Milovidov). - Correction d’un
LOGICAL_ERROR(“Unexpected return type from if”) lors de la lecture d’une colonne avecapply_mutations_on_fly = 1après unALTER UPDATE col = ... WHERE <cond>avec une condition non constante ou fausse, suivi deALTER MODIFY COLUMN col <new type>. #108128 (Groene AI). - Correction de
toStartOfIntervaletdateTrunc, qui renvoyaient une valeur arrondie au lieu du début de l’intervalle contenant la valeur lorsque l’entrée avait une précision plus fine que l’unité d’intervalle ; par ex.toStartOfInterval(toDateTime64('2023-10-09 10:11:12.000999', 6), INTERVAL 1 millisecond)renvoyait10:11:12.001au lieu de10:11:12.000. La surcharge avec une origine explicite était également affectée. Ferme #103535. #108186 (Yarik Briukhovetskyi). - Masquage des informations sensibles dans la colonne
view_querydesystem.query_views_log. #108214 (Valerii Mordovskii). - Correction d’un blocage sur une table
MergeTreeattachée avec un skip indexhypothesishérité (un type d’index supprimé conservé uniquement pour la compatibilité avecATTACH). Auparavant, unDELETElightweight,OPTIMIZE, unINSERTsimple ou unSELECTfiltré sur une telle table échouait avecILLEGAL_INDEX(“Index of type ‘hypothesis’ is no longer supported”), et la mutationDELETEétait relancée indéfiniment. L’index obsolète est désormais traité comme inerte : il est conservé tel quel lors des merge/mutation, ignoré à l’insert et lors de la planification des requêtes, et peut toujours être supprimé avecALTER TABLE ... DROP INDEX. #108217 (Groene AI). - Correction du paramètre
type_json_allow_duplicated_key_with_literal_and_nested_object, qui ne fonctionnait pas avec des chemins typés dansJSON. #108218 (Pavel Kruglov). - Correction d’un
LOGICAL_ERROR(Different list of shards in child plans) lors de l’exécution d’une requête avecmake_distributed_plan = 1sur une tableMergeTreeayant une projection normale/agrégée. #108256 (Groene AI). - Correction de
replaceRegexpOneetreplaceRegexpAllafin que.corresponde par défaut aux caractères de nouvelle ligne, conformément aux autres fonctions d’expressions régulières. #108265 (linjiayu1025-collab). - Correction d’une erreur logique lors du cast d’un
Array(Dynamic)ou d’unArray(Variant)enQBitavecaccurateCastOrNull, p. ex.accurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI). index_granularity_bytesest désormais respecté pour les colonnes d’étatAggregateFunction. Auparavant, la limite en octets des granules était ignorée pour ces colonnes (par exemple les étatsuniqExactdans les tablesAggregatingMergeTreeet les projections d’agrégation), ce qui produisait des granules bien plus volumineux que la limite configurée et augmentait l’amplification de lecture ainsi que la mémoire utilisée à l’exécution de la requête. #108297 (Groene AI).- Correction du fait que les conditions des
UPDATE/DELETElightweight étaient évaluées deux fois, ce qui pouvait entraîner un comportement incorrect pour les conditions non déterministes et du travail supplémentaire pour les conditions déterministes. Clôt #86032. #108323 (ofeliacode). - Correction d’une exception dans un gestionnaire HTTP prédéfini lorsqu’un en-tête dont l’expression régulière
headers_regexpautorise une valeur vide est absent de la requête. #108324 (Vitaly Baranov). - Correction de
arrayPartialSortavec un argument de limite non constant. #108327 (Vitaly Baranov). - Correction d’un
INSERTannulé ouKILLé qui continuait à s’exécuter longtemps pendant la construction d’un index de saut (par exemple un indexset(0)non borné sur une colonne à forte cardinalité). La construction de l’index s’arrête désormais rapidement lorsque la requête est annulée. #108351 (Shaohua Wang). - Correction d’un
SELECTdepuis la fonction de tableprimesqui ne répondait pas à l’annulation : avec unstep(ou unelimit) important, la requête pouvait continuer à s’exécuter longtemps aprèsKILL QUERYou un délai d’expiration. Elle s’arrête désormais rapidement. #108353 (Shaohua Wang). - Correction de l’analyse des noms de type dont le nom contient la sous-chaîne
INT(par exemple un nom de type de style fonction, commequantileInterpolatedWeighted, utilisé à la place d’un type de données). Ces noms étaient confondus avec des types entiers MySQL et leur premier groupe d’arguments(...)était silencieusement interprété comme un modificateur de largeur d’affichage, ce qui pouvait casser l’aller-retour du formatage de la requête. #108354 (Groene AI). - Correction d’une incohérence où un
ARRAY JOINmal formé suivi d’une virgule et d’une liste de tables entre parenthèses était analysé à tort comme un CROSS JOIN au lieu d’être rejeté. #108365 (Raúl Marín). - Masquage des arguments secrets de fonctions telles que
encrypt,decryptetHMACdans la sortie deEXPLAIN actions,EXPLAIN headeretEXPLAIN PIPELINElorsqueformat_display_secrets_in_show_and_selectest désactivé (par défaut). #108386 (Raúl Marín). - Correction de
CREATE OR REPLACEd’une vue matérialisée actualisable avec une cibleTO: elle était rejetée à tort parce que la table cible appartient déjà à la vue en cours de remplacement. #108392 (Nikolay Degterinsky). - Correction d’un plantage du serveur (
Received signal 4, instruction illégale) pouvant être déclenché par un flux du protocole TCP natif malformé ou désynchronisé. L’adresse initiale fournie par le client est désormais validée pour s’assurer qu’il s’agit bien d’unhost:portnumérique avant d’être analysée, au lieu de laisser un port non numérique atteindre la fonction libc piégéegetservbyname. #108410 (Groene AI). - Correction d’un plantage du serveur pendant l’arrêt lorsqu’une base de données qui s’arrête lève une exception (par exemple lorsqu’un flush de table rencontre un délai d’expiration ZooKeeper). Le reste de la séquence d’arrêt n’est désormais plus ignoré, de sorte que les logs système sont vidés et leurs threads rejoints avant la sortie du serveur. #108417 (Groene AI).
- Correction de fonctions d’expression régulière (
match,extract,extractAll,replaceRegexpOne,replaceRegexpAll, etc.) qui renvoyaient silencieusement des résultats erronés lorsque le motif contenait un octet NUL (\0). Le NUL est désormais traité comme un octet littéral ordinaire, conformément à RE2. #108427 (Alexey Milovidov). - Correction de
clickhouse-local, qui renvoyait une réponse vide aux requêtes HTTPOPTIONSlorsqu’aucunhttp_options_responsen’était configuré, ce qui amenait l’UI web (/play) à afficher la connexion comme rompue alors même que les requêtes fonctionnaient. #108428 (Alexey Milovidov). - Correction d’une exception
LOGICAL_ERROR(“Invalid action query tree node …”) lorsqu’une requête distribuée dédupliquait à la fois des colonnesALIASdupliquées et structurellement identiques, et référençait une fonction de table avec un argument de collection nomméekey = value(par exempleoss(s3_conn, filename = '...')). #108435 (Groene AI). - Correction d’un plantage du serveur (
LOGICAL_ERROR: 'Unexpected exception in refresh scheduling') pouvant se produire au démarrage lorsqu’une vue matérialisée actualisable coordonnée dans une base de donnéesReplicatedétait attachée à un Keeper ne prenant pas en charge l’indicateur de fonctionnalitéMULTI_READ(par exemple après une rétrogradation de Keeper). La vue est désormais arrêtée proprement au lieu d’entraîner l’arrêt brutal du serveur. #108441 (Groene AI). - Correction de l’erreur
NOT_FOUND_COLUMN_IN_BLOCK(par ex.Column _part not found) lors de la sélection de colonnes virtuelles dans une tableMergeTreeavec des réplicas parallèles, y compris viaSELECT *avecasterisk_include_virtual_columns = 1. #108451 (Groene AI). SYSTEM RESET DDL WORKERrequiert désormais le nouveau privilègeSYSTEM RESET DDL WORKER. Auparavant, tout utilisateur authentifié (y compris les utilisateursreadonly) pouvait l’exécuter et réinitialiser de manière répétée l’état du worker DDL, bloquant ainsi le DDLON CLUSTER. #108460 (Groene AI).- Restriction du chemin du modèle de
catboostEvaluateau répertoireuser_files, comme pour la fonction de tablefileet les sources de dictionnaire. Auparavant, la fonction acceptait un chemin arbitraire dans le système de fichiers sans vérification de confinement, ce qui permettait de sonder l’existence de fichiers en dehors deuser_fileset d’en déclencher la lecture. Les modèles doivent désormais se trouver dansuser_files. #108463 (Groene AI). - La fonction
hasColumnInTablerequiert désormais le privilègeSHOW COLUMNSsur la table cible, le même droit requis parDESCRIBEetSHOW CREATE TABLE. Auparavant, tout utilisateur pouvait appelerhasColumnInTablepour sonder les noms de colonnes et tester l’existence de la table et de la base de données sans aucun contrôle d’accès. #108464 (Groene AI). - Correction d’une allocation mémoire excessive lors de la désérialisation d’états malveillants de fonctions d’agrégation pour
mannWhitneyUTest,rankCorr,largestTriangleThreeBuckets,quantileGK,sequenceMatch/sequenceCountetgroupArrayIntersect. Un état mal formé pouvait déclarer un nombre d’éléments énorme et amener le serveur à tenter d’allouer des dizaines de gigaoctets à partir de quelques octets d’entrée ; ces états sont désormais rejetés avecTOO_LARGE_ARRAY_SIZE. #108465 (Groene AI). - Validation de la cible de redirection d’une réponse S3
301 Moved Permanentlypar rapport àremote_url_allow_hosts(RemoteHostFilter). Auparavant, la gestion des 301 par le SDK AWS suivait l’endpoint fourni par l’attaquant dans la réponse (en-têteLocationou élément<Endpoint>) sans vérification de l’hôte, si bien qu’un serveur S3-compatible malveillant ou compromis pouvait rediriger ClickHouse vers un hôte arbitraire (SSRF). Le chemin de redirection 307 effectuait déjà cette vérification ; les deux chemins ont désormais un comportement cohérent. #108466 (Groene AI). - Correction d’une fuite d’identifiants : les anciens réglages
storage_aws_access_key_id,storage_aws_secret_access_key,storage_catalog_credentialetstorage_auth_headerdu moteur de base de donnéesDataLakeCatalogs’affichaient en plaintext danssystem.databases.engine_fulletSHOW CREATE DATABASE. Ils sont désormais masqués sous la forme[HIDDEN]. #108470 (Groene AI). - Correction de l’identification des utilisateurs
ssl_certificateafin qu’un unique joker*corresponde exactement à un seul composant de nom (RFC 6125 6.4.3). Auparavant, un joker dans un sujet SANCNouDNS:(par exemple*.corp.example.com) correspondait aussi à des noms comportant plusieurs libellés, tels queevil.deep.corp.example.com, permettant au détenteur d’un certificat pour un sous-domaine plus profond de s’authentifier comme l’utilisateur joker. La correspondanceURI:SAN reste inchangée. #108472 (Groene AI). - Correction d’une injection SQL dans le MySQL wire protocol : l’argument
SHOW TABLE STATUS LIKEet la valeurSET <mysql_setting>envoyés via la MySQL interface (port 9004) sont désormais analysés puis à nouveau placés entre guillemets, au lieu d’être concaténés tels quels dans la query réécrite. Correction également deKILL QUERY <id>via la MySQL interface, qui ignorait silencieusement les identifiants de connexion à plusieurs chiffres. #108474 (Groene AI). - Les valeurs sensibles transmises comme paramètres de chaîne de requête HTTP (par exemple la liaison de paramètre de query
param_*, telle queparam_secret_key/param_aws_secret_access_key, le paramètrepasswordou les paramètressignaturede type S3) ne sont plus écrites telles quelles danssystem.text_logou les OpenTelemetry spans. La ligne de journalRequest URImasque désormais les valeurs des paramètres dont les noms semblent sensibles, en les remplaçant par[HIDDEN]. #108475 (Groene AI). - Application de la configuration
http_forbid_headerspendant l’inférence de schéma pour la fonction de tableurlet le moteur de stockageURL. Auparavant, un en-tête interdit était quand même envoyé sur le réseau pendant l’inférence du schéma (par exemple avec le formatRegexpouDESCRIBE), et son response body pouvait être répercuté dans une erreur d’analyse, divulguant des secrets. Le filtre d’en-tête est désormais vérifié avant tout accès réseau sur ce chemin d’inférence, conformément au comportement existant deurlCluster. #108476 (Groene AI). - Correction de résultats erronés lors de l’utilisation de
SELECT ... SAMPLE ...avec le query condition cache (réglageuse_query_condition_cache, activé par défaut). #108488 (Groene AI). - Correction d’un crash du serveur (dépassement de pile) provoqué par des expressions profondément imbriquées telles que
[[[ ... ]]]ouarray(array( ... ))lorsquemax_parser_depthest défini sur une valeur élevée. #108493 (Raúl Marín). - Correction d’un blocage indéfini du moteur de table
RabbitMQlors d’unDROP TABLEou de l’arrêt du serveur lorsque le broker fermait la connexion AMQP en raison de heartbeats manqués, sans envoyer de TCP RST. Tous les appels bloquants de la boucle d’événements ont désormais un délai d’expiration de 30 secondes, de sorte que l’arrêt se termine toujours. #108497 (Aly Ayman). - Les requêtes secondaires exécutées dans le cadre de requêtes internes seront désormais journalisées comme des requêtes internes. #108506 (Miсhael Stetsyuk).
- Le moteur de table
ArrowFlightet la fonction de tablearrowFlightrespectent désormais la liste d’autorisation<remote_url_allow_hosts>. Auparavant, l’hôte et le port de la connexion n’étaient pas validés, de sorte qu’une requête pouvait atteindre des hôtes ne figurant pas dans la liste d’autorisation. #108507 (Groene AI). - Les commandes du MySQL wire protocol
COM_FIELD_LIST(mysql_list_fields) etCOM_INIT_DB(USE database) appliquent désormais le même contrôle d’accès que leurs équivalents SQL (SHOW COLUMNS/DESCRIBEetUSE). Auparavant, elles pouvaient divulguer les noms de colonnes de tables pour lesquelles l’utilisateur ne disposait que d’autorisations partielles sur les colonnes, et changer la base de données courante sans le privilègeSHOW DATABASES. #108508 (Groene AI). http_forbid_headersest désormais évalué sans tenir compte de la casse. Les noms d’en-tête HTTP ne sont pas sensibles à la casse, donc l’interdiction deAuthorizationbloque désormais aussiauthorization,AUTHORIZATIONet les autres variantes de casse. Les motifsheader_regexpconfigurés sont désormais mis en correspondance sans tenir compte de la casse, sans nécessiter de drapeau(?i)explicite. #108509 (Groene AI).- Correction d’un crash du serveur (faute de segmentation) pouvant se produire lorsqu’une requête distribuée référençait une CTE
MATERIALIZEDpas encore matérialisée comme table externe et que la source distante était créée de manière paresseuse. #108547 (Groene AI). - Correction de résultats erronés lorsque le cache des conditions de requête (
use_query_condition_cache = 1) réutilisait une exclusion de marques dérivée d’un skip index pour une requête qui exécutait un ensemble différent de skip indexes, par exemple avecuse_skip_indexes = 0,ignore_data_skipping_indicesou un modeuse_skip_indexes_for_disjunctionsdifférent. Les entrées de cache dérivées de skip indexes sont désormais indexées par l’ensemble effectif des skip indexes exécutés. #108548 (Groene AI). - Correction de plusieurs bugs dans
changeYear,changeMonth,changeDay,changeHour,changeMinuteetchangeSecondavec des argumentsDateTime64: la colonne de résultat était créée avec l’échelle par défaut, codée en dur à 3, au lieu de l’échelle de l’argument, ce qui entraînait uneLOGICAL_ERROR(writeSlice expects same column types) lorsque le résultat était passé àarrayPushBack/arrayPushFront/arrayConcat; les entrées avec une précision à la nanoseconde (échelle 9) déclenchaientDECIMAL_OVERFLOW; et les entrées sous-seconde antérieures à l’époque Unix renvoyaient une seconde calendaire incorrecte. Correction également detimeSlotssurDateTime64, qui ignorait l’échelle de l’argument optionnelSizedans son type de retour déclaré et renvoyait des timestamps incorrects pour l’échelle la plus élevée dansSize. #108551 (Groene AI). #108681 (Takumi Hara). #108994 (Groene AI). - Corrige l’erreur
NOT_FOUND_COLUMN_IN_BLOCKlorsqu’un prédicat composé reçoit un alias dansGROUP BYpuis est référencé à nouveau, avecenable_identifier_resolve_cacheactivé (par défaut). #108553 (Groene AI). - Corrige une erreur logique (
Equal values are not contiguous within the range assumed to be sorted) lors de l’exécution deDISTINCTsur une lectureSTREAM(SELECT DISTINCT ... FROM table STREAM). Les optimisations de lecture ordonnée ne sont plus appliquées aux lecturesSTREAM, qui produisent les lignes dans l’ordre de commit plutôt que dans l’ordre de la clé de tri. #108568 (Groene AI). - Corrige les projections qui renvoyaient la valeur par défaut du type d’une colonne (par ex.
0) au lieu de sa valeurDEFAULTdéclarée (par ex.-1) dans deux cas : lors de la lecture d’une colonne ajoutée avecALTER TABLE ... ADD COLUMN ... DEFAULTaprès la création de la projection (les lectures depuis la table de base étaient déjà correctes), et après expiration duTTLde la colonne sur une Wide part. #108569 (Shaohua Wang). #109013 (Shaohua Wang). - Corrige une erreur
ReadBuffer is canceled. Can't read from it.qui pouvait survenir lorsqu’un envoi vers S3 (par exemple une sauvegarde) était retenté après une erreur de lecture passagère. #108573 (Groene AI). - Corrige
ATTACH PARTITION ... FROM, qui rejetait les tables dont les clés primaires sont équivalentes mais déclarées différemment (l’une avecPRIMARY KEYexplicite, l’autre implicite viaORDER BY). #108590 (Jordi Orihuela). - Corrige l’échec de la lecture directe depuis l’index de texte lorsque plusieurs index de texte sont partiellement matérialisés. Corrige #108530. #108607 (Anton Popov).
- Corrige une fuite de métadonnées où
DESCRIBE loop('db', 'table')etDESCRIBE loop(<inner table function>)contournaient la vérification d’accèsSHOW COLUMNS/ à la source, permettant à un utilisateur non privilégié de lire le schéma des colonnes d’une table. #108624 (Groene AI). - Corrige la colonne virtuelle
_etagpour les moteurs de tableS3QueueetAzureQueue: elle était déclarée mais jamais renseignée, doncSELECT _etagrenvoyait toujours une chaîne vide. Elle renvoie désormais l’ETag de l’objet, comme le moteurS3et la fonction de tables3. #108625 (Groene AI). - Corrige la lecture des fichiers
Arrow,ArrowStreametORCbasés sur Arrow dont la colonne timestamp utilise un décalage UTC numérique fixe (par ex.+05:30,-08:00,00:00) ou le marqueur non IANAfixedcomme fuseau horaire, ce qui échouait auparavant avecCannot load time zone ...(BAD_ARGUMENTS). #108633 (Groene AI). - Corrige une exception (
LOGICAL_ERROR: Join is supported only for pipelines with one output portouNOT_IMPLEMENTED: MergeJoinAlgorithm is not implemented for strictness Semi) lorsquejoin_algorithm = 'full_sorting_merge'était utilisé pour une jointureSEMI/ANTI, y compris les jointures produites par la décorrélation d’une sous-requête corréléeEXISTS.full_sorting_mergerefuse désormais les combinaisons de strictness/kind qu’il ne peut pas exécuter, afin que le planificateur se rabatte sur un autre algorithme activé ou indique que la jointure ne peut pas être exécutée. #108658 (Groene AI). - Correction d’un heap buffer overflow lors de la construction d’un text index avec
positions = 1sur un grand nombre de jetons courts distincts. #108659 (Groene AI). - Une query qui lit depuis S3 ou écrit vers S3 et qui est annulée (par ex. par
KILL QUERY) alors qu’une requête S3 est en cours est désormais signalée comme annulée au lieu de renvoyer une erreur réseau/S3 trompeuse. En particulier, un backup ou un restore vers S3 annulé signale désormaisBACKUP_CANCELLED/RESTORE_CANCELLEDdanssystem.backups. #108673 (Julia Kartseva). - Correction d’un échec au démarrage : une base de données
DataLakeCatalogcréée par une ancienne version (25.12 ou antérieure) avec unauth_headermal formé ne pouvait pas être attachée après une mise à niveau vers 26.2 ou une version ultérieure, ce qui empêchait le serveur de démarrer.auth_headern’est désormais validé que lors deCREATE, et lors deATTACH, le catalog est construit de manière différée à la première utilisation au lieu de l’être au démarrage ; ainsi, une seule base de données catalog mal configurée ou inaccessible ne bloque plus le démarrage du serveur. #108674 (Groene AI). - Correction d’une erreur logique (
Sort order of blocks violated) lors d’une fusion, ainsi que de lectures incorrectes, lorsqu’un élémentLowCardinalitynon nullable d’une colonneNullable(Tuple(...))est utilisé comme sous-colonne (par exemple comme clé de tri). #108679 (Groene AI). - Correction d’un possible crash (use-after-free) lorsque
SYSTEM FLUSH DISTRIBUTEDs’exécute en même temps qu’unDROP TABLEsur la même tableDistributed. #108684 (Groene AI). - Correction d’un crash dans le décodage Base64 de la clé de compte Azure, via
azureBlobStorage(ainsi que les table functions et stockages Azure associés), lorsque la clé n’est pas un Base64 valide : un octet>= 0x80provoquait une lecture hors limites, et tout octet invalide entraînait un comportement indéfini. Les clés invalides sont désormais rejetées proprement. #108716 (Groene AI). - Correction de l’erreur
NUMBER_OF_COLUMNS_DOESNT_MATCHlorsqu’une subquery sur une tableDistributedlit deux colonnesALIASou plus qui se développent en une même expression (par exemplea1 String ALIAS toString(x), a2 String ALIAS toString(x)) et que la subquery alimente une query externe, par ex.SELECT count() FROM (SELECT a1, a2 FROM dist GROUP BY a1, a2). #108725 (Groene AI). - Correction de
CREATE OR REPLACE MATERIALIZED VIEW ... POPULATE, qui laissait la nouvelle vue désabonnée de sa table source, ce qui ignorait silencieusement chaque ligne insérée après le remplacement. #108728 (Alexey Milovidov). - Correction d’une exception (
Cannot find sharding key column, et dans les builds de débogage et avec sanitizer, un arrêt du serveur) lorsque la clé de sharding d’une tableDistributedest une expression que l’analyzer réduit à une constante, par exempleif(1, toInt32(id), toInt32(id) + 1), avecoptimize_skip_unused_shards = 1. #108737 (Groene AI). - Correction d’une erreur logique (
Bad cast from type DB::ColumnNullable to DB::ColumnString) et de résultats potentiellement erronés lors de l’utilisation degroup_by_use_nullsavec une clé de groupement constanteLowCardinalitydansGROUPING SETS/ROLLUP/CUBE. #108771 (Alexey Milovidov). - Correction de l’élagage des partitions et de la clé primaire, qui se désactivait silencieusement lorsqu’une colonne de clé
LowCardinality(FixedString)(ouLowCardinality(Nullable(FixedString))) était enveloppée dans une fonction de clé, par exemplePARTITION BY sipHash64(k) % NavecWHERE k = 'literal'. Ces requêtes analysaient alors toutes les partitions au lieu de les élaguer. #108777 (Groene AI). - Correction d’une erreur logique (arrêt du server dans les builds de débogage et avec sanitizer) lorsqu’un
INSERT ... SELECTvia une tableAlias, ou vers une tableTimeSeries, était annulé sans exception, par exemple avectimeout_overflow_mode = 'break'. #108783 (Groene AI). #108796 (Shaohua Wang). - Correction d’une erreur logique
Bad cast from type DB::ColumnSparse to DB::ColumnString(arrêt du server dans les builds de débogage et avec sanitizer) lorsquegroupConcatest appliqué à unTupledont l’élémentStringest stocké de façon sparse. #108790 (Groene AI). - Correction de
TYPE_MISMATCHdansmapFilter,mapSort,mapReverseSort,mapPartialSortetmapConcatlorsqu’une valeurMapcontient uneMapimbriquée avecLowCardinality, par ex.mapFilter((k, v) -> 1, map('a'::LowCardinality(String), map('x'::LowCardinality(String), 'y'))). #108798 (Groene AI). - Correction du fait que
insert_quorum = 'auto'ne rejetait pas immédiatement les inserts lorsque moins de la majorité des répliques étaient en vie. Ces inserts échouent désormais immédiatement avecTOO_FEW_LIVE_REPLICASau lieu d’écrire une part locale puis d’expirer plus tard avecUNKNOWN_STATUS_OF_INSERT. #108800 (Gagan Dhakrey). - Correction d’un bogue où la ligne
WITH TOTALSd’unJOINpouvait contenir des valeurs par défaut (telles que0) au lieu des valeurs constantes provenant d’une sous-requête constante sur un côté de la jointure. Le résultat incorrect n’apparaissait que pour certains ordres de jointure ou avec le paramètrequery_plan_join_swap_table. #108807 (Vladimir Cherkasov). - Correction d’une faute de segmentation (déréférencement de pointeur nul) pouvant se produire lorsque l’arrêt du server s’exécutait en parallèle de l’arrêt d’une table
S3Queue/AzureQueue. #108810 (Miсhael Stetsyuk). - Correction d’un arrêt au démarrage (
Cannot allocate ThreadStack,EINVAL) sur des builds glibc exécutés sur des CPU avec une grande taille de pile de signaux (par exemple Intel Sapphire Rapids / Granite Rapids avec un noyau compatible AMX), où la taille de la pile alternative de signaux n’était pas arrondie à un multiple de la taille de page. #108813 (Groene AI). - Correction de l’échec occasionnel des requêtes distribuées avec
UNEXPECTED_PACKET_FROM_SERVER(expected TablesStatusResponse, got ProfileInfo) lorsqu’une connexion laissée désynchronisée par une requête précédemment annulée était réutilisée depuis le pool. #108854 (Alexey Milovidov). - Correction d’une erreur logique (une exception dans les builds de release, un arrêt du serveur dans les builds de débogage et avec sanitizer) qui pouvait se produire lors d’un appel de fonction avec plus d’un argument
LowCardinalitysur une table distribuée, par exempleconcatAssumeInjective((SELECT toLowCardinality('p')), s)utilisée comme cléGROUP BYavec la table functionremote. Les messages étaientDefault functions implementation for LowCardinality is supported only with a single LowCardinality argumentouExpected the argument ... to have N rows, but it has M. #108871 (Groene AI). - Correction de
reinterpret(x, 'Decimal128(scale)')(ainsi que des ciblesDecimal32/Decimal64/Decimal256/DateTime64) qui produisait une colonne de résultat dont l’échelle interne était celle de la source au lieu de l’échelle cible demandée lorsque la source et la cible avaient le même type physique. Les valeurs étaient correctes, mais l’objet colonne était structurellement incohérent avec son type déclaré. #108878 (Groene AI). - Correction d’une
LOGICAL_ERROR(New empty part is about to materialize but the directory already exist) qui pouvait provoquer l’arrêt du serveur dans les builds de débogage et avec sanitizer lorsqu’une opérationDROP/DETACH/MOVE/REPLACE PARTITIONsur une tableMergeTrees’exécutait après qu’une précédente opération du même type avait été interrompue (par exemple à la suite d’une transaction annulée ou d’un crash) et avait laissé derrière elle un répertoiretmp_empty_<part>obsolète. Le répertoire obsolète est désormais récupéré au lieu de provoquer un échec. #108879 (Groene AI). - Correction de ClickHouse Keeper, qui renvoyait un
dataLength = 0incorrect dans leStatdes réponsesCreate2, ainsi que du client ClickHouse ZooKeeper, qui ne désérialisait pas leStatdes réponsesCreate2. #108909 (unintended). - Correction de
clickhouse-local, qui rejetait une valeur d’option vide écrite juste après=(par exemple--format_csv_null_representation='') ; il se comporte désormais comme--format_csv_null_representation ""etSET format_csv_null_representation = ''. #108910 (Vismay). - Correction d’une
LOGICAL_ERROR(Inconsistent AST formatting) qui provoquait l’arrêt du serveur dans les builds de débogage et avec sanitizer lors du formatage d’un type de donnéesTuplemélangeant des éléments nommés et non nommés (par exempleTuple(a UInt8, UInt16)). #108915 (Groene AI). - Correction d’un défaut de segmentation lors de la fusion d’états d’agrégation
uniqExactavecGROUPING SETS,ROLLUPouCUBEetmax_threads > 1. #108928 (Raúl Marín). - Correction de résultats potentiellement erronés ou de lectures hors limites lorsqu’un
INSERTest annulé après une erreur au milieu d’un lot (par exemple dans les tablesBuffer, les insertions asynchrones ou les moteursKafka/RabbitMQ/FileLog) alors que la réplication paresseuse des colonnes (enable_lazy_columns_replication) est activée. #108935 (Groene AI). join_any_take_last_rowest désormais respecté par tous les chemins de jointure basés sur le hachage pris en charge, y compris les jointures qui utilisent automatiquement le spilling to disk. #108936 (János Benjamin Antal).- Correction d’un bogue dans l’analyseur où
FINALsur une table d’unJOIN(par ex.FROM t1 FINAL JOIN t2) était incorrectement appliqué également aux autres tables jointes, ce qui pouvait ralentir ce type de requêtes. #108979 (Vladimir Cherkasov). - Corrige un
LOGICAL_ERROR(“Impossible de trouver la colonne__grouping_setdans l’en-tête de MergingAggregatedTransform avec grouping sets”, ou “Les informations de chunk n’étaient pas définies pour le chunk dans MergingAggregatedTransform”) qui pouvait se produire, avec l’analyseur désactivé, pour unUNION ALL/INTERSECT/EXCEPToù une branche utiliseGROUP BY GROUPING SETSavec des répliques parallèles et une autre branche utiliseFINAL. #109003 (Groene AI). - Corrige un
LOGICAL_ERRORdans le planificateur automatique des répliques parallèles qui pouvait se produire lorsqueautomatic_parallel_replicas_modeest activé en même temps queparallel_replicas_min_number_of_rows_per_replicaest supérieur à 0. #109011 (Groene AI). - Corrige une allocation mémoire excessive lors de l’inférence de schéma du format
MsgPack: une entrée corrompue dont l’en-tête de tableau/map/chaîne/binaire déclare un très grand nombre d’éléments ne provoque plus une allocation unique de plusieurs gigaoctets et est rejetée comme entrée malformée. Cela corrige une situation de mémoire insuffisante dans les builds de release (ainsi qu’un arrêtallocation-size-too-bigavec les sanitizers). #109019 (Groene AI). - Corrige le fait que
use_client_time_zoneétait ignoré pour les littéraux de chaîneDateTime/DateTime64interprétés côté serveur (INSERTasynchrone, littérauxSELECT). Le client propage désormais son fuseau horaire local sous la forme desession_timezonelorsqueuse_client_time_zoneest activé, afin que l’analyse côté serveur corresponde au cheminINSERTsynchrone. #109051 (Groene AI). - Corrige l’erreur
NOT_FOUND_COLUMN_IN_BLOCKlorsquequery_plan_optimize_lazy_finalest activé en même temps qu’un filtreWHEREpartiellement déplacé versPREWHERE(viaoptimize_move_to_prewhere_if_final). #109073 (Groene AI). - Corrige une erreur lors de l’utilisation d’un astérisque qualifié comme
b.*dans une requête oùbest un alias de table (ou de sous-requête/CTE) qui partage son nom avec une colonne non composite d’une autre table. Ces requêtes n’échouent plus et sélectionnent correctement toutes les colonnes deb. #109078 (Vladimir Cherkasov). - Corrige une erreur logique
Block structure mismatch in JoinStep(un arrêt du serveur dans les builds de débogage et avec sanitizer) lorsqu’une sous-requête corrélée est décorrélée en jointure et que la relation source porte plusieurs fois le même nom de colonne, par exempleWITH t AS (SELECT number, * FROM numbers(3)) SELECT *, (SELECT t.number WHERE t.number >= 0) FROM taveccorrelated_subqueries_default_join_kind = 'right'. #109114 (Groene AI). - Corrige un blocage où une requête lisant via le filesystem cache pouvait continuer à attendre un téléchargement en cours après avoir été annulée avec
KILL QUERY, et où la suppression d’une refreshable materialized view — ou l’exécution deSYSTEM STOP VIEWsur celle-ci — dont le rafraîchissement était bloqué dans une telle attente pouvait elle aussi se bloquer. #109116 (Murphy). - Corrige le fait que le paramètre
parallel_view_processingétait ignoré lors de l’insertion dans une table avec des materialized views — depuis la version 25.10, les vues s’exécutaient toujours en parallèle, quel que soit ce paramètre. #109170 (Antonio Andelic). - Corrige une incohérence du parseur où une liste de colonnes
INSERTacceptait un sélecteur de colonnes qualifié écrit sous la formet.* LIKE '<pattern>'/t.* ILIKE '<pattern>'mais rejetait sa forme canoniquet.COLUMNS('<regexp>'), rompant l’aller-retour du format de requête (et provoquant un arrêt du serveur dans les builds de débogage et avec sanitizer). #109176 (Groene AI). - Correction des incréments non monotones de
ProfileEvents: les compteursNetworkReceiveBytesetAIOWriteBytespouvaient être incrémentés d’une valeur négative (avec bouclage vers une valeur énorme) en cas de délai d’attente sur socket ou d’échec AIO, etMemoryOvercommitWaitTimeMicrosecondsétait mesuré avec une horloge non monotone. #109180 (Azat Khuzhin). - Correction de l’inférence de schéma pour les formats
Arrow,ArrowStream,Avroainsi que pour les lecteurs héritésORCetParquet, qui renvoyaientNullable(Tuple)pour des colonnes de structure nullables alors que le typeNullable(Tuple)n’est pas autorisé (allow_experimental_nullable_tuple_typeest désactivé).DESCRIBErenvoyait un type queCREATE TABLErejetait, si bien que la création d’une table ou l’insertion de données à l’aide du schéma inféré échouait avec l’erreurNullable Tuple type is not allowed. #109185 (Nihal Z. Miaji). - Correction d’un résultat incorrect pour les sous-requêtes corrélées
EXISTSet les sous-requêtes scalaires lorsque la corrélation apparaissait uniquement dans la projection de la sous-requête, avec une clauseWHEREnon corrélée (la sous-requête pouvait s’évaluer à false /NULLpour chaque ligne). Corrige #105760. #109186 (Dmitry Novik). - Correction de
CREATE USER ... HOST LIKE 'a', 'b'(et de l’équivalentALTER USER), qui ne conservait silencieusement que le premier motif. Tous les motifsHOST LIKEspécifiés sont désormais stockés dans la liste d’autorisation des hôtes de l’utilisateur. #109187 (Groene AI). - Correction d’un index de texte défini sur
mapValues(map)oumapKeys(map)qui n’était silencieusement pas utilisé lorsqu’une table était interrogée via une table utilisant le moteurDistributedavec l’analyseur. L’index était utilisé pour la table locale et via les fonctions de tablecluster/remote, mais une requête passant par une table utilisant le moteurDistributedl’ignorait (et échouait avecINDEX_NOT_USEDsousforce_data_skipping_indices). #109188 (Groene AI). - Correction d’une fausse
LOGICAL_ERROR(There was an error on <host>: Cannot obtain error message (probably it's a bug)) qui pouvait arrêter le serveur dans les builds de débogage et avec sanitizer lors de l’exécution d’une requête DDL sur une base de donnéesReplicated, alors que son nœud d’étatfinishedpar hôte dans Keeper avait déjà été nettoyé. #109192 (Groene AI). - Correction des ratios
SAMPLEavec un exposant dont la magnitude débordeInt32(par ex.SAMPLE 1e-3000000000), qui étaient silencieusement traités commeSAMPLE 1. #109197 (Raúl Marín). - Correction de la vérification d’accès pour
SYSTEM PREWARM PRIMARY INDEX CACHE ... ON CLUSTER, qui exigeait à tort le privilègeSYSTEM PREWARM MARK CACHEau lieu deSYSTEM PREWARM PRIMARY INDEX CACHE. #109198 (Raúl Marín). - Correction des requêtes
ALTERqui échouaient pour les tablesMergeTreecréées avec un paramètrediskpersonnalisé (SETTINGS disk = disk(...)). Corrige #63019. #109199 (Mikhail Artemenko). - Correction d’un crash du serveur lorsque des états des fonctions d’agrégation
cramersV,cramersVBiasCorrected,contingencyoutheilsUissus d’un contexte de fenêtre (OVER ()) et d’une agrégation simple sont combinés via des opérations ensemblistes chaînées (EXCEPT,INTERSECT) ou desUNION ALLimbriqués, puis lus, par exemple via le combinateur-Merge. #109200 (Groene AI). - Correction d’un résultat erroné pour
ANY JOINavec une conditionONconstante (p. ex.t1 ANY INNER JOIN t2 ON 1) : la requête renvoyait le produit cartésien complet au lieu du résultat deANY JOIN. #109207 (Vladimir Cherkasov). - Correction d’un crash du serveur lors d’un insert asynchrone avec déduplication lorsque
optimize_on_insertvide le bloc inséré (par exemple, des lignes dont la somme est nulle dansSummingMergeTree). #109229 (Den Kalantaevskii). - Correction de
SYSTEM DROP REPLICAetSYSTEM DROP DATABASE REPLICA ... FROM ZKPATHafin qu’ils rejettent les chemins ZooKeeper vides ou limités à la racine au moment de l’analyse avecBAD_ARGUMENTS, acheminent les chemins Keeper auxiliaires vers le Keeper nommé et normalisent les chemins Keeper afin que les vérifications locales d’autoprotection ne puissent pas viser la mauvaise réplique ni contourner la protection prévue. #109230 (Groene AI). - Correction de la priorité des paramètres S3 afin qu’un bloc de point de terminaison
<s3>à portée d’URL prenne le pas sur les valeurs par défaut<s3>de niveau supérieur. #109251 (Bharat Nallan). - Correction d’un bogue où les valeurs
DEFAULTdes colonnes n’étaient pas appliquées pourINSERT INTO TABLE FUNCTION(par exempleremoteoufile) avec des donnéesVALUESintégrées lorsque le serveur analyse lui-même ces données intégrées (send_table_structure_on_insert_with_inline_data = 0). UnNULLexplicite inséré dans une colonne nonNullableavec unDEFAULTdevenait0au lieu de la valeur par défaut déclarée. Le comportement est désormais identique à celui d’unINSERTdans une table simple et du protocole HTTP. #109258 (Groene AI). - Correction de l’échec de
CREATE TABLE ... AS SELECTdepuiss3Cluster(et d’autres fonctions de table de cluster commefileCluster/urlCluster) avecNOT_FOUND_COLUMN_IN_BLOCKdans une base de donnéesReplicated. #109266 (Groene AI). - Correction de
SHOW TABLESetSELECT ... FROM system.tables, qui renvoyaient des résultats différents pour les bases de données de catalogue de data lake : les tables que ClickHouse ne peut pas lire sont désormais masquées de manière cohérente dans les deux cas. #109273 (Smita Kulkarni). - Correction d’un bogue où la fusion d’une table
MergeTreeavec des projections alors que le paramètreenable_block_number_columnouenable_block_offset_columnest activé produisait des parties de projection contenant une colonne parasite_block_number/_block_offset. La partie de projection fusionnée ne correspondait alors plus à la définition de la projection ni aux parties de projection produites par insert, de sorte queCHECK TABLEetOPTIMIZE ... DRY RUNla signalaient comme corrompue (CORRUPTED_DATA). #109284 (Groene AI). - Autorise la lecture d’un
arrayAvro d’enregistrements{key, value}à deux champs dans une colonneMapde ClickHouse. Il s’agit de l’encodage produit par Iceberg et Spark pour unMAP<K, V>avec une clé non chaîne (les maps natives d’Avro ne prennent en charge que les clés de type chaîne). Auparavant, un tel fichier pouvait être lu commeArray(Tuple(key, value)), mais pas commeMap(K, V), ce qui échouait avecType Map(...) is not compatible with Avro array. #109289 (Groene AI). - Correction d’un crash du serveur sur
CREATE HYPOTHETICAL INDEX ... TYPE set(etngrambf_v1/tokenbf_v1) lorsque l’argument d’index requis était omis. Ces instructions sont désormais rejetées avec une erreur explicite. #109294 (Groene AI). - Correction d’une
LOGICAL_ERROR(Current component is empty) qui pouvait être déclenchée par des opérations de mutation telles queKILL MUTATIONsur une tableMergeTreestockant ses métadonnées dans Keeper, lorsque le paramètre serveurenforce_keeper_component_trackingest activé. #109297 (Groene AI). - Correction de la lecture de timestamps
ORCau-delà d’environ l’année 2262 dans une colonneDateTime64avec une échelle inférieure à 9. Le lecteurORCnatif convertissait auparavant chaque timestamp via un intermédiaire fixeDateTime64(9), ce qui entraînait un dépassement de capacité deInt64à l’échelle de la nanoseconde et rejetait ces valeurs avecVALUE_IS_OUT_OF_RANGE_OF_DATA_TYPE, même lorsque l’échelleDateTime64demandée (par exempleDateTime64(6), telle que produite par Iceberg) peut représenter la valeur. Les timestamps sont désormais lus directement à l’échelle demandée, etdate_time_overflow_behaviorest respecté même lorsque l’échelle cible ne peut pas contenir la valeur. #109302 (Groene AI). clickhouse-local, lorsqu’il agit comme serveur (aprèsSYSTEM START LISTEN HTTP), utilise désormais le format de sortie par défautTabSeparatedpour les connexions HTTP, commeclickhouse-server, au lieu de la valeur par défaut interactivePrettyCompact. Cela corrige la connexion àclickhouse-localvia HTTP avec des pilotes tels queclickhouse-connect. La session interactive dans le terminal continue d’afficher les résultats enPrettyCompact. #109362 (Alexey Milovidov).- Correction d’un échec transitoire
Code: 499 ... InvalidPart(S3_ERROR) lors des téléversements multipart vers S3. MinIO peut brièvement signaler comme manquante une part qui vient d’être téléversée lors deCompleteMultipartUpload; cette erreur fait désormais l’objet de nouvelles tentatives, comme leNoSuchKeydéjà géré, dans les limites des3_max_unexpected_write_error_retries. #109364 (Groene AI). - Correction de l’erreur
UNKNOWN_IDENTIFIERsurALTER TABLE ... DROP COLUMNlorsqu’une autre colonne possède une expressionDEFAULTouMATERIALIZEDqui définit et référence un alias inline. #109374 (Alexey Milovidov). - Correction d’une data race (et du rare crash qui en résultait) dans la fusion parallèle des aggregate states
uniqExactavec des sets à deux niveaux, qui pouvait se produire avecGROUPING SETS,ROLLUPetCUBE. #109389 (Groene AI). - Correction d’une erreur (
NOT_FOUND_COLUMN_IN_BLOCK, oustd::bad_function_calldans les versions plus anciennes) lors de l’exécution deCREATE TABLE ... ON CLUSTER ... AS SELECTlisant une tableDistributedsur un cluster comportant au moins deux shards. #109407 (Alexey Milovidov). - Correction des fusions pour les tables avec
TTL ... GROUP BY(rollup) : les parts déjà entièrement agrégées pouvaient être replanifiées pour fusion indéfiniment, et les tables avec des colonnesMATERIALIZEDou des colonnes virtuelles persistantes activées étaient traitées incorrectement — ces colonnes sont désormais agrégées avecany. Clôt #105647. #109410 (Mikhail Artemenko). #109532 (Mikhail Artemenko). - Correction de
INavec une simple colonne de type Array comme argument de droite, qui renvoyait silencieusement un résultat incorrect (toujours faux) ou levait une exception, afin quex IN arrse comporte commehas(arr, x). #109416 (Alexey Milovidov). - Correction des erreurs
UNKNOWN_IDENTIFIERsur les opérationsALTER TABLE(RENAME/ADD/MODIFY COLUMN, ainsi queMATERIALIZE INDEXsur une table avec des parts récemment insérées) pour les tablesMergeTreeavec un index min-max implicite sur les colonnes virtuelles persistantes_block_number/_block_offset(activé paradd_minmax_index_for_block_number_column/add_minmax_index_for_block_offset_column). #109428 (Groene AI). #110236 (Groene AI). - Correction d’une
LOGICAL_ERRORdansarrayFoldsur un argumentArray(LowCardinality(T))non constant (par exemplearrayFold((acc, x) -> acc + x, materialize([1, 2, 3]::Array(LowCardinality(Int64))), toInt64(0))), qui échouait avecArguments of 'plus' have incorrect data types(provoquant un arrêt du serveur dans les builds debug et avec sanitizer). #109462 (Groene AI). - Correction de
CHECK TABLEsur une tableReplicatedMergeTreequi signalait une part saine comme corrompue lorsqu’une erreur ZooKeeper transitoire pouvant donner lieu à un réessai (par exemple une perte de connexion) survenait pendant la vérification ; ces erreurs sont désormais remontées comme des erreurs de requête pouvant donner lieu à un réessai. #109465 (Alexey Milovidov). - Correction de segfaults dans
groupArrayLastMergeet la fonction d’agrégationlargestTriangleThreeBuckets: la désérialisation des états de fonctions d’agrégation est désormais validée, de sorte qu’un état corrompu ne provoque pas d’accès mémoire hors limites. #109485 (Miсhael Stetsyuk). #109492 (Miсhael Stetsyuk). - Correction de la non-application de la limite globale
max_rows_in_join/max_bytes_in_joinpour l’algorithme de jointureparallel_hash, où une requête avecjoin_overflow_mode = 'throw'pouvait réussir silencieusement au lieu de leverSET_SIZE_LIMIT_EXCEEDED. #109488 (Hechem Selmi). - Correction de la lecture de tables Paimon partitionnées par une colonne
BIGINTdont la valeur ne tenait pas dansInt32. Ces valeurs de partition étaient tronquées (par exemple9223372036854775807devenait-1), ce qui produisait un chemin de partition incorrect et échouait avec une erreur de système de fichiers. #109510 (Groene AI). - Correction d’un crash lors de la lecture de tables Iceberg avec des fichiers de suppression par égalité. Si une colonne était Nullable dans le fichier de suppression par égalité mais non Nullable dans le schéma de table (ou inversement), les valeurs lues depuis le fichier de suppression étaient insérées dans une colonne d’un type différent via un cast non vérifié (confusion de type de colonne), ce qui corrompait la colonne et faisait planter le serveur. #109551 (Miсhael Stetsyuk).
- Correction du fait que
connect_timeoutainsi que les timeouts de lecture et d’écriture MySQL n’étaient pas pris en compte : une tentative de connexion à un serveur MySQL qui ne répondait pas pouvait rester bloquée plus de deux minutes même avecconnect_timeout = 1, car les signaux périodiques du Sampling query profiler réinitialisaient en permanence l’échéance interne du poll du client MySQL. #109592 (Shaohua Wang). - Correction d’un
LOGICAL_ERROR(creation_csn is not set while removal_csn is set to 1) qui pouvait être levé lorsqu’unTRUNCATEnon transactionnel s’exécutait en parallèle d’une transaction non validée ayant inséré dans la même table. Un telTRUNCATEne supprime désormais plus les parts créées par des transactions pas encore validées. #109598 (Tuan Pham Anh). - Correction des erreurs
TYPE_MISMATCHlors de la lecture de colonnesParquetde type struct dont la nullabilité physique diffère du type ClickHouse demandé : un groupeParquetnon nullable peut désormais être lu commeNullable(Tuple(...)), et le lecteurParquetnatif peut lire une struct physiquement nullable (un groupeParquetOPTIONAL) commeNullable(Tuple(...)). #109615 (Groene AI). #109898 (Groene AI). - Correction d’une perte silencieuse de données lorsqu’un
INSERT ... VALUESdans un flux multi-requêtes est suivi d’un commentaire SQL final (par exempleVALUES (1) -- comment) dans le chemin d’analyse des insertions intégrées côté serveur (send_table_structure_on_insert_with_inline_data = 0). Le commentaire final était interprété comme des données de ligne au-delà du;final, ce qui faisait que les requêtes suivantes du flux étaient ignorées silencieusement. #109643 (Groene AI). - Correction d’un segfault lorsqu’une requête arrive dans un court intervalle pendant l’arrêt du serveur après une erreur au démarrage. #109675 (Miсhael Stetsyuk).
- Correction d’index de skipping obsolètes (
text,bloom_filter, etc.) et de projections après la matérialisation de lightweight updates avecALTER TABLE ... APPLY PATCHES. Auparavant, les fichiers d’index et de projection qui dépendent d’une colonne mise à jour par patch restaient inchangés, de sorte que les requêtes qui les utilisaient pouvaient renvoyer des résultats erronés (par ex.hasTokenomettant une ligne mise à jour, ou une projection renvoyant des agrégats obsolètes une fois la patch part consommée supprimée). #109709 (Groene AI). - Correction de
system.tables, qui ignorait silencieusement certaines bases de données pour les utilisateurs disposant d’autorisations par base lorsque la requête ne lisait que les colonnesname/database. Introduit dans la version 26.2. #109723 (Samay Sharma). - Correction d’un
LOGICAL_ERRORlors de l’écriture d’une colonneLowCardinality(Time)au formatArrowavecoutput_format_arrow_low_cardinality_as_dictionary = 1. #109730 (Groene AI). - Correction de
ObjectStorageQueue/AzureQueue(et de la table functionazureBlobStorage) qui ignoraient silencieusement des objets lorsque l’object storage renvoyait une page de listing vide accompagnée d’un token de continuation. Azure Blob Storage se comporte ainsi (par ex. lorsqu’un listing franchit une limite de partition interne), et l’itérateur de liste asynchrone traitait la page vide comme la fin du listing et abandonnait le token. Il suit désormais le token de continuation. #109761 (Gal Ben Moshe). - Correction du partition pruning qui ne renvoyait aucune ligne pour les Iceberg tables partitionnées par une colonne d’horodatage (
DateTime64). #109764 (Den Kalantaevskii). - Correction d’une exception
ILLEGAL_COLUMNdans la fonctionconvpour les argumentsFixedString; ils sont désormais correctement convertis enString. Closes #109670. #109771 (hp). - La fonction
getClientHTTPHeadertraite désormais les noms d’en-tête comme insensibles à la casse, conformément à la RFC 9110 ; en particulier, l’en-têteauthorizationest désormais filtré quelle que soit la casse. Clôt #103957. #109791 (Mikhail f. Shiryaev). - Correction de
max_execution_time(avectimeout_overflow_mode = 'throw') qui, dans certains cas, n’annulait jamais une requête : lorsque le surveillant interne des délais d’expiration attendait déjà une requête avec une échéance plus lointaine, une requête avec une échéance plus proche enregistrée ensuite pouvait être entièrement ignorée, ce qui lui permettait de s’exécuter bien au-delà de sa limite de temps. #109792 (Shaohua Wang). - Correction du nom de fichier des fichiers de métadonnées Iceberg compressés avec gzip. ClickHouse les écrivait sous la forme
v{N}.gzip.metadata.json(le jeton HTTPContent-Encoding), alors que la spécification Iceberg attend l’extensiongz, soitv{N}.gz.metadata.json. En conséquence, Spark et les autres lecteurs du catalogue Hadoop ne pouvaient pas trouver les métadonnées écrites par ClickHouse. ClickHouse écrit désormaisv{N}.gz.metadata.jsonet continue à lire l’ancien nomgzippour assurer la rétrocompatibilité. #109812 (Groene AI). - Correction de l’erreur
NOT_IMPLEMENTED(“Method getDataAt is not supported for Nullable(String)”) qui pouvait être levée par une jointure avecenable_join_runtime_filters = 1(activé par défaut depuis la version 26.2) lorsque la clé de jointure côté build étaitLowCardinality(Nullable(...))avec des valeursNULLet que le filtre d’exécution se rabattait sur son bloom filter. #109824 (Groene AI). - Les moteurs de base de données externes (par ex.
PostgreSQL) ne poussent plus les comparaisons de plage (>=,>,<=,<) sur les colonnesUUID. ClickHouse et les bases de données externes ordonnent les UUID différemment, de sorte que ce pushdown supprimait silencieusement des lignes du résultat ; ces prédicats sont désormais évalués par ClickHouse à la place. #109833 (Vismay). - Correction d’un crash du serveur lorsqu’une expression lambda était passée là où une fonction d’ordre supérieur attend une valeur concrète (par exemple l’accumulateur de
arrayFold, comme dansarrayFold(lambda, arr, another_lambda)). Ces requêtes sont désormais rejetées avecILLEGAL_TYPE_OF_ARGUMENTau lieu de provoquer un crash lorsqueenable_analyzer = 0. #109840 (Groene AI). - Correction de la fonction de table
icebergLocalet du moteurIcebergLocal, qui déclaraientazureau lieu delocalcomme type de stockage objet, ce qui les faisait échouer à la vérification du type de disque (Disk type doesn't match) lorsqu’ils étaient utilisés avec un disque local viaSETTINGS disk = '...'. #109872 (Pedro Ferreira). - Correction de la lecture des tables Iceberg partitionnées plusieurs fois par la même colonne source (par exemple
PARTITIONED BY (hours(ts), ts)). Ces tables échouaient auparavant avecCannot add column ...: column with this name already exists (ILLEGAL_COLUMN). #109895 (Groene AI). - Correction de résultats de requête erronés causés par l’index de clé primaire, qui élaguait incorrectement des granules pour les tables avec une colonne clé inversée (
DESC) lorsque les parts n’avaient pas de marque finale (granularité non adaptative,index_granularity_bytes = 0). #109901 (Nihal Z. Miaji). - Correction de
generateRandomStructure, qui produisait occasionnellement une chaîne de structure invalide avec deux types de données concaténés (par exempleDecimal32(7)IPv4) lorsque l’imbrication des types dépassait la limite interne de profondeur, ce qui rendait le résultat impossible à parser. #109928 (Groene AI). - Correction de l’erreur
NOT_IMPLEMENTED(Method getDataAt is not supported for Nullable(String) in case if value is NULL) lorsqu’un indextextest construit surArray(LowCardinality(Nullable(String)))(y compris les champsNestedstockés ainsi) et qu’un tableau indexé contient un élémentNULL. Les élémentsNULLdu tableau sont désormais ignorés lors de la construction de l’index, comme pourArray(Nullable(String)). #110055 (Groene AI). - Correction de résultats erronés lorsqu’un skip index
minmaxest construit sur une colonneLowCardinality(Nullable(...)): les prédicatsWHERE/PREWHERE/HAVING ... IS NULLpoussés vers le stockage éliminaient auparavant tous les granules et renvoyaient 0 ligne, alors même que la colonne contenait des valeursNULL. #110061 (Groene AI). - Correction de
distinct_overflow_mode = 'break':DISTINCTrenvoie désormais le résultat partiel accumulé jusqu’à la limite et cesse de lire la source, comme indiqué dans la documentation. Auparavant, le chunk qui dépassaitmax_rows_in_distinct/max_bytes_in_distinctétait ignoré (résultats tronqués ou vides) et la requête continuait à lire et à insérer dans l’ensemble de hachage jusqu’à la fin de l’entrée, ce qui pouvait aboutir àMEMORY_LIMIT_EXCEEDED. #110075 (Sergey Kuznetsov). - Correction d’une logical error
ChunkInfoRowNumbers does not existsurOPTIMIZE TABLEd’une Iceberg table contenant un fichier de données dans un format autre que Parquet (par ex.ORC) plus récent que tous les position delete files. #110107 (Alexey Milovidov). - Correction de
max_bytes_in_distinctetmax_bytes_in_set: les clés de type chaîne sont stockées dans une arena qui n’était pas prise en compte par les contrôles de limite, si bien queDISTINCT/INsur des clés de chaîne pouvaient utiliser une quantité de mémoire dépassant la limite en octets de l’intégralité du payload des clés (sans borne sur leur longueur). Les limites tiennent désormais compte de l’arena, conformément à la documentation ; les queries sur des clés de chaîne proches de la limite en octets peuvent maintenant l’atteindre plus tôt (à juste titre). #110120 (Sergey Kuznetsov). - Correction d’une
LOGICAL_ERROR(Bad cast from type ColumnLowCardinality to ColumnString) lorsqueidentity(ou le résultat d’une scalar subquery) encapsule une valeur contenant unLowCardinalityimbriqué et que la requête utiliseWITH TOTALS/WITH ROLLUP. #110138 (Groene AI). - Correction de la lecture des fichiers
Npyavec des dimensions internes de taille nulle : le nombre de lignes matérialisées et les résultats decount, optimisés ou non, sont désormais cohérents. #110146 (Yanjun Qiu). - Correction d’une explosion quadratique du temps d’exécution (et d’une absence de prise en compte de
max_execution_time) dans aggregation in order lors d’un regroupement sur plusieurs clés dont le sort order n’est qu’un préfixe de la grouping key. #110159 (Alexey Milovidov). - Correction d’une logical error (
Unexpected number of columns in result sample block) lorsqu’un filtre contenant une correlated subquery (par exempleexists((SELECT ...))) est optimisé avecconvert_query_to_cnfouoptimize_and_compare_chain. #110187 (Alexey Milovidov). - Correction d’une exception (
UNION mode UNION_DEFAULT must be normalized) lorsqu’une mutationDELETEouALTER UPDATEutilisait une opération ensembliste (UNION/UNION ALL/UNION DISTINCT/EXCEPT/INTERSECT) à l’intérieur d’une sous-requête dans sa conditionWHEREou dans une attributionUPDATE. #110196 (Alexey Milovidov). - Correction d’une erreur logique
ReadBuffer is canceled. Can't read from it.(arrêt du serveur dans les builds debug/sanitizer) qui pouvait se produire lors de la lecture d’une archive zip (par ex. pendantRESTOREdepuis une sauvegarde zip) après l’échec en cours de flux d’une lecture précédente de la même archive. #110197 (Groene AI). - Correction d’un arrêt lent du serveur et d’un
KILL MUTATIONqui ne répondait pas lorsqu’une mutation avecx IN (subquery)construisait le Set de la sous-requête pendant l’analyse de la clé primaire ; la construction du Set est désormais annulée rapidement. #110198 (Alexey Milovidov). - Keeper rejette désormais les paramètres de coordination
max_requests_batch_sizeetmax_requests_append_sizelorsqu’ils sont définis à0, au lieu de rester bloqué dans une boucle infinie d’append-entries dans une configuration multi-nœuds. #110200 (Alexey Milovidov). - Correction d’une erreur
NOT_FOUND_COLUMN_IN_BLOCKlors de l’utilisation deGROUP BY ALLsur une expression tuple avecORDER BY. #110206 (Alexey Milovidov). - Correction d’une erreur
NOT_FOUND_COLUMN_IN_BLOCKsurINSERTdans une table ayant une contrainteCHECKqui référence une sous-colonne (telle quex.nulld’une colonneNullableouarr.size0d’unArray). #110208 (Alexey Milovidov). - Correction de la lecture des tables Iceberg dont l’ordre de tri par défaut référence une colonne nécessitant des guillemets (par ex.
@timestamp). Ces tables étaient illisibles, car leORDER BYde stockage synthétisé était construit à partir du nom brut de la colonne et échouait à l’analyse avecSYNTAX_ERROR. #110233 (Groene AI). - Correction de
system.tablespour une base de donnéesDataLakeCatalog(Iceberg/Glue), qui interrompait toute la requête, ou omettait silencieusement des tables, lorsque les métadonnées d’une seule table ne pouvaient pas être résolues. Une telle table reste désormais listée par nom avec des valeurs par défaut/NULLpour les colonnes nécessitant l’objet de stockage ouvert (engine,total_rows, etc.), quelle que soit la valeur dedatabase_datalake_require_metadata_access. L’accès direct à la table défectueuse signale toujours l’erreur. #110242 (Groene AI). - Correction d’un possible plantage (heap-buffer-overflow) lorsqu’une colonne d’état de fonction d’agrégation de la famille
quantileTDigestétait utilisée comme cléGROUP BYet sérialisée de manière concurrente par plusieurs threads. #110263 (Groene AI). - Correction de l’échec de
INSERTdans une table Microsoft Fabric / OneLakeDataLakeCatalogavecIncorrectEndpointError(HTTP 400) en dirigeant les écritures ADLS Gen2 (DFS) vers l’hôte de l’endpoint.dfsplutôt que vers l’hôte.blob. Remarque : avecremote_url_allow_hosts, les deux hôtes Fabric.blob(lecture) et.dfs(écriture) doivent être autorisés pourINSERT. #110290 (Mohammad Lareb Zafar). - Correction d’un arrêt du serveur lors de l’analyse de certaines requêtes PRQL (
SET dialect = 'prql'). Une panique dans le compilateurprqlcinterrompait le processus au lieu d’être signalée comme une erreur de requête. #110316 (Groene AI). - Correction de résultats de requête silencieusement erronés lorsqu’une projection part écrite avant la modification de l’ensemble des colonnes de la projection (par exemple après une mise à niveau entre des versions qui matérialisent différemment la source d’une colonne
ALIAS, ou après qu’unALTER TABLE ... MODIFY COLUMNa redéfini une colonneALIASutilisée par une projection) était lue via la projection ou fusionnée : la colonne manquante était remplie avec des valeurs par défaut au lieu des données réelles. Ces parts sont désormais lues depuis la table de base, et les fusions reconstruisent la projection à partir des données de base. #110328 (Shaohua Wang). - Correction du non-respect de
max_execution_timeparORDER BY ... WITH FILLet de sa lenteur à s’annuler lors de la génération d’une grande plage de remplissage (en particulier avecINTERPOLATE). #110332 (Alexey Milovidov). - Correction d’une erreur logique (un arrêt du serveur dans les builds debug/sanitizer) lorsqu’un
ALTERà plusieurs commandes, tel queUPDATE ..., DELETE ..., était exécuté sur une table Iceberg. De telles mutations sont désormais rejetées avec une erreurNOT_IMPLEMENTEDexplicite. #110347 (Groene AI). - Correction d’un bogue du parser où
COMMENTétait interprété à tort comme un alias implicite lorsqu’une requêteSELECTse terminait directement après un simple identifiant de table (par ex.... FROM t COMMENT 'x'), provoquant une erreur de syntaxe trompeuse au lieu d’appliquer le commentaire à la vue ou à la table. #110372 (Aditya Kumar). - Correction d’un plantage du serveur (débordement natif de pile) lors de la copie ou de la destruction d’un littéral
Array/Tuple/Map/Objectprofondément imbriqué, par exemple dans une requête contenant un littéral très profondément imbriqué avec une valeur élevée demax_parser_depth. #110393 (Raúl Marín). - Correction de deux cas où la vector search pouvait renvoyer moins de lignes que prévu : des valeurs de
vector_search_index_fetch_multiplierinférieures à 1.0 pouvaient tronquer à zéro le nombre de fetch calculé et produire un résultat vide (ces valeurs sont désormais rejetées), et l’optimisation de vector search est désormais ignorée pour les requêtesLIMIT ... WITH TIES, car elle limitait la recherche à exactement N candidats et supprimait les lignes à égalité avec la N-ième ligne. #110452 (Tamish Mhatre). #110453 (Tamish Mhatre). - Correction de l’erreur logique
Expected CommonSubplanReferenceStep to reference CommonSubplanStep, de l’erreurSubplan cannot be used to build pipelineet de l’erreur logiqueTrying to extract chunk from ChunkBuffer before all inputs are finishedpourIN (subquery)lorsque la sous-requête contient une sous-requête corrélée et que le Set est construit pendant l’analyse d’index. #110491 (Alexey Milovidov). - Correction de la substitution des query parameters dans les définitions d’une clause
WINDOWnommée. Auparavant, les paramètres à cet endroit restaient silencieusement non substitués, et un paramètreIdentifiernon défini pouvait entraîner l’exceptionLogical error: '!part.empty()'pendantEXPLAIN SYNTAX. #110506 (Alexey Milovidov). - Correction de l’échec du démarrage du serveur pour les tables
MergeTreesur des object storage disks lorsqu’un fichier résidueltxn_version.txt.tmpavait corrompu les métadonnées au niveau du disk. #110519 (Alexey Milovidov). - Correction d’une erreur logique dans le filesystem cache (
Expected file ... not to exist) qui pouvait se produire lorsqu’un téléchargement du cache en arrière-plan échouait avec une erreur sans rapport avec le système de fichiers (par exemple lors de l’exécution deOPTIMIZEsur une table Iceberg), laissant derrière lui un fichier de cache orphelin vide. #110549 (Groene AI). - Correction de la lecture d’un flux au format
Nativecorrompu dont le nombre de typesDynamicou le nombre de cheminsJSON/Objectest proche deSIZE_MAX: ces entrées malformées sont désormais rejetées avec une erreurINCORRECT_DATAexplicite au lieu d’unstd::length_errornon intercepté. #110590 (Alexey Milovidov). - Correction d’un plantage du serveur dans le database engine
MaterializedPostgreSQLqui pouvait se produire lorsqu’une table était detached (ou que sa structure était modifiée) alors qu’elle était encore en file d’attente pour la synchronisation. #110596 (Alexey Milovidov). - Correction du mauvais fonctionnement de
SET param_<name>dans le client (et des options--param_<name>) lorsque le nom du paramètre correspond à un setting name intégré tel quelimit,offset,max_threadsoulog_comment. Selon le setting en conflit, la query échouait avecCANNOT_PARSE_QUOTED_STRING, la valeur était normalisée silencieusement (par ex.max_threads=0devenaitauto(N)), ou un alias de setting était perdu. Un tel paramètre cassait également tous lesSET param_*suivants dans la même session. #110597 (Raúl Marín). - Correction de la lecture des subcolumns d’une column ayant une expression
DEFAULTet non matérialisée dans une part (par ex. aprèsALTER TABLE ADD COLUMNou pendantALTER TABLE MATERIALIZE COLUMN) : la subcolumn était remplie avec les valeurs par défaut du type au lieu de l’expressionDEFAULTévaluée, et les fonctions de distance vectorielle transposées (cosineDistanceTransposedet autres) sur de telles columnsQBitéchouaient avec l’erreurSIZES_OF_ARRAYS_DONT_MATCH. Cela clôt #110634. #110636 (Alexey Milovidov). - Correction d’une erreur
LOGICAL_ERRORInvalid partition key size: 0qui pouvait faire échouer unINSERTdans une tableMergeTreepartitionnée avecnon_replicated_deduplication_windowactivé, lorsqu’un lot d’async insert n’était dédupliqué que partiellement (certaines valeursinsert_deduplication_tokenétaient des doublons et d’autres étaient nouvelles). #110651 (Groene AI). - Un flush d’asynchronous insert en arrière-plan s’interrompt désormais rapidement lorsqu’il est tué avec
KILL QUERY; auparavant, le flush d’une charge utile volumineuse mise en tampon continuait son analyse jusqu’au bout et ignorait l’annulation. #110652 (Shaohua Wang). - Correction de résultats erronés avec
GROUP BYetoptimize_aggregation_in_order, ainsi qu’avecDISTINCTetoptimize_distinct_in_order, au-dessus d’un JOINpartial_merge. L’optimisation de lecture dans l’ordre était propagée à travers le partial-merge join, qui retrie son entrée de gauche selon la clé de jointure et ne préserve donc pas l’ordre d’origine du flux de gauche ; les lignes étaient donc regroupées incorrectement. #110671 (Groene AI). - Correction d’un overflow d’entier signé dans
toStartOfIntervalavec un nombre d’intervallesMONTH,WEEKouDAYextrême sur des valeursDate/Date32/DateTime64. #110688 (Groene AI). - Corrige l’erreur
NOT_FOUND_COLUMN_IN_BLOCKpour les requêtes avec une sous-requête dansFROMlorsque des parallel replicas s’exécutent en modecustom_key_sampling/custom_key_range. De telles requêtes (par ex.SELECT * FROM (SELECT id, k, v FROM t WHERE id < 20) ORDER BY k) échouaient auparavant avecNot found column __table2.id in block .... #110690 (Groene AI). - Corrige le rejet par
readWKTdes chaînes WKT précédées d’espaces (par ex.readWKT(' POINT(1 2)')), alors qu’elles sont acceptées par les lecteurs typésreadWKTPoint/readWKTPolygon/… ainsi que par la grammaire WKT. #110706 (Groene AI). - Corrige une logical error (
Column ... already added for reading, un arrêt du server dans les builds de Débogage/sanitizer) lorsque le même prédicat d’index texte est utilisé à la fois dansPREWHEREetWHEREd’une requête sur une tableMergereposant sur une tableDistributed. #110710 (Groene AI). - Corrige l’erreur
NOT_FOUND_COLUMN_IN_BLOCKpour les fonctions de distance transposées sur des colonnesQBit(telles quecosineDistanceTransposed) appelées avec une sous-requête scalaire ou un Reference vector constant lorsque les parallel replicas sont activées. Cela clôt #110719. #110729 (Alexey Milovidov). - Corrige une
LOGICAL_ERRORrare (Unexpected number of parts to remove from parts_queue; un arrêt du server dans les builds de Débogage/sanitizer) surReplicatedMergeTreelorsque deux opérations de partition (par exemple deux requêtesMOVE PARTITION/REPLACE PARTITION, ou l’une d’elles en concurrence avec unDROP_RANGEen arrière-plan) annulaient en même temps la vérification en arrière-plan des parts sur des plages qui se chevauchent. #110738 (Groene AI). - Corrige une logical error
Hash is not set for serializationqui pouvait se produire lorsqu’une colonne avec un codecQuantized(...)était encapsulée dans une autre serialization, par exemple dans une tableMergesur des sources dont la colonne de même nom a des types différents (fusionnés dans unVariant). #110776 (Groene AI). - Corrige un blocage du server lors de la multiplication de l’état d’une aggregate function
median/quantilepar une constante entière énorme (par ex.medianState(x) * 18446744073709551615). La requête ne répondait plus à l’annulation et pouvait s’exécuter indéfiniment. #110779 (Groene AI). - Corrige un crash du server (division entière par zéro) lorsqu’un quota avec un intervalle de longueur nulle (par exemple
CREATE QUOTA q FOR INTERVAL 0 SECOND MAX queries = 1000) était consommé. Une durée d’intervalle de quota non positive est désormais rejetée lors de la création du quota. #110846 (Pedro Ferreira). - Corrige le fait que
throwIf(notLike(col, pattern))(et d’autresthrowIfappliqués à une fonction) lançait systématiquement une exception lorsquecolestLowCardinality. L’implémentationLowCardinalitypar défaut exécutaitthrowIfsur le Dictionary entier, qui contient toujours la default value réservée même lorsqu’aucune ligne n’y fait référence ; ainsi, une valeur non nulle dans cet emplacement inutilisé faisait lever une exception parthrowIfpour des données qui ne satisfont pas la condition. #110864 (Groene AI). - Propage les rôles actifs d’une requête (
SET ROLEou le paramètrerole) aux nœuds distants lors des lectures sur répliques parallèles et des lecturesDistributedsur un cluster sécurisé par un secret interserveur ; auparavant, les nœuds distants revenaient aux rôles par défaut de l’utilisateur, ce qui évaluait les politiques de lignes de manière incohérente par rapport à l’initiateur. #110867 (Nikolay Degterinsky). - Correction d’un problème dans les tables Iceberg qui produisaient des ID de champ dupliqués après
ALTER TABLE ... ADD COLUMNlorsque le schéma initial contient des champs imbriqués (Tuple/Array/Map).last-column-idenregistre désormais l’ID de champ maximal attribué, y compris aux enfants imbriqués, de sorte qu’une colonne ajoutée ultérieurement ne réutilise plus l’ID d’un champ imbriqué et que les lectures n’échouent plus avecICEBERG_SPECIFICATION_VIOLATION(Duplicate field id). #110884 (Groene AI). - Correction d’un plantage dans les builds FIPS lors de l’utilisation d’une clé SSH Ed25519 (
CREATE USER ... IDENTIFIED WITH ssh_key ... TYPE 'ssh-ed25519', ou d’une telle clé dansusers.xml). Ed25519 n’est pas approuvé par FIPS ; ces clés sont désormais rejetées avec une erreurLIBSSH_ERRORexplicite. #110891 (Konstantin Bogdanov). - Corrige les résultats en précision réduite des fonctions de distance transposées sur les colonnes
QBit(cosineDistanceTransposed,L2DistanceTransposed,dotProductTransposed). Les valeurs tronquées àprecisionplans de bits étaient reconstruites en complétant les bits supprimés par des zéros, ce qui biaisait chaque valeur reconstruite vers zéro et devenait pathologique à faible précision : pourQBit(BFloat16)avec une précision de 1, seul le bit de signe subsistait, de sorte que chaque valeur était reconstruite en±0.0et que la distance devenait la même constante pour chaque ligne, sans aucune information de classement. Les valeurs tronquées sont désormais reconstruites vers le point médian borné de la cellule de précision restante (codesInt8bruts vers le centre de leur cellule ; les zéros exacts et les infinis sont préservés), de sorte qu’uneprecisionplus faible échange de la précision contre de la vitesse sans produire de résultats fortement biaisés. Les résultats en pleine précision restent inchangés. Cela clôt #110898. #110911 (Alexey Milovidov). - Corrige un plantage du serveur (use-after-free) lors d’un arrêt propre après l’exécution de requêtes sur des tables Iceberg depuis des sessions qui utilisaient également des tables temporaires. #110914 (Miсhael Stetsyuk).
- Correction de
LOGICAL_ERROR: Cannot sum Bools(arrêt du serveur dans les builds debug/sanitizer) lors de la fusion d’aggregate statessumMap/sumMapWithOverflow/sumMapFilteredavec des valeursBoolqui avaient été sérialisées dans l’ancien format d’état (version 0). Le même correctif corrige également deux cas silencieux de résultats erronés avec des étatsBoolversion 0 : les clés de map de typeBooln’étaient pas dédupliquées entre les états, et la compaction des valeurs nulles supprimait les mauvaises entrées. #110922 (Groene AI). - Correction d’un plantage lorsqu’une aggregate function avec le combinator
-Tupleétait utilisée avecRESPECT NULLSet produisait un état intermédiaire (-State, agrégation distribuée,WITH ROLLUP/WITH CUBE). La fonction combinée portait le nom de la mauvaise variante d’état, de sorte que son typeAggregateFunctionsérialisé était résolu à nouveau vers une disposition mémoire incompatible lors d’un aller-retour. #110930 (Groene AI). - Corrige le cas où
PREWHERE(et les politiques au niveau des lignes) sur une colonne Iceberg renommée par schema evolution renvoyait silencieusement0ligne pour d’anciens data files. Ces requêtes renvoient désormais les lignes correctes, comme avecWHERE. #110941 (Groene AI). - Corrige une
LOGICAL_ERROR(LazyMaterializingTransform: Number of rows in lazy chunk N does not match number of offsets M) qui pouvait se produire pour les requêtes de vector search avecvector_search_with_rescoring = 1, combiné à la lazy materialization, lorsque plusieurs distances étaient ex æquo. #111003 (Groene AI). - Corrige la lecture des données
Arrow/ArrowStreamavec des colonnes imbriquéesArray/Mapvides produites par Apache Arrow Java < 19.0.0 (fourni avec Apache Spark), auparavant rejetées avec une erreurINCORRECT_DATAindiquant que le tampon d’offsets était trop petit. #111101 (Raúl Marín). - Corrige des lectures obsolètes sur les disks
plain_rewritablelorsque le page cache est activé. #111105 (Mikhail Artemenko). - Corrige l’erreur
CANNOT_CONVERT_TYPEpour les constantes de typeVariant(y comprisGeometry) dans les distributed queries et les requêtes avec parallel replicas. #111136 (Nikita Fomichev). - Corrige un bug où la lecture de fichiers volumineux depuis HDFS pouvait échouer ou être incorrecte lorsqu’une seule read request dépassait la limite de taille 32 bits de
hdfsPread(INT_MAX). #98470 (Arup Chauhan). - Corrige l’utilisation incorrecte du text index pour les comparaisons d’égalité avec une aiguille vide. #108340 (Robert Schulze).
- Corrige un blocage dans
SYSTEM SYNC MERGESavec le merge selectorManuallorsqu’une fusion planifiée ne pouvait pas être placée dans un background pool saturé. #108770 (Alexey Milovidov). - Corrige
ATTACH TABLE ... AS REPLICATED, qui écartait des données committed et ressuscitait des rows antérieures à la mutation lorsqu’un fichiertxn_version.txt.tmpstale était laissé dans une data part. #108772 (Alexey Milovidov). - Corrige une possible race condition dans
ALTER TABLE ... MOVE PARTITION TO TABLEavec des tablesMergeTreenon répliquées, qui pouvait produire des data parts intersecting, car le commit des parts déplacées et l’allocation du numéro de bloc n’étaient pas sous le même lock. #108922 (Mikhail Artemenko). - Corrige la lecture des tables
Icebergécrites par Databricks UniForm, qui écrit un schéma placeholder dégénéré (avec une liste de champs vide) dans les manifest files. #108945 (Konstantin Vedernikov). - Corrige un use-after-free lors de la lecture d’une table
Hivenon partitionnée avec plusieurs threads. #109164 (Alexey Milovidov). - Corrige le fait que le log level de la console n’était pas rétabli après le démarrage du server lorsque
logger.startup_console_log_levelest défini : le niveau était récupéré depuis la mauvaise clé de configuration, si bien que la console restait au Startup level élevé pendant toute la lifetime du server. Corrige #103472. #109858 (Garrett Thomas). - Corrige des anomalies d’isolation des snapshots dans les transactions de metadata du disk
plain_rewritable. Corrige #92055. #110948 (Mikhail Artemenko). - Corrige un plantage (
front() called on an empty vector) dansclickhouse-client --loginlorsque l’hôte n’était pas fourni explicitement via l’argument--host, par exemple s’il provenait de--connection, du fichier de configuration ou de la variable d’environnementCLICKHOUSE_HOST. Closes #103603. #110279 (Christoph Wurm). - Corrige une erreur logique (
!part.empty()) lorsqu’un argument lambda est un identifiant entre accents graves dont le nom contient un point (par exemple__table1.). Une telle requête produisait auparavant une exception gérée dans les builds de release et faisait avorter le serveur dans les builds de débogage et avec sanitizer lors du formatage d’un message d’erreur. #108735 (Groene AI). - Corrige un
LOGICAL_ERROR(No set is registered for key) dansALTER TABLE ... DROP COLUMN, les mutationsALTER TABLE ... DELETE/UPDATEet lesDELETE FROMlégers, sur des tables ayant une colonneALIASdont l’expression utilise l’opérateurIN(y compris via une autre colonneALIAS). #111039 (Pedro Ferreira). - Corrige une perte de données silencieuse avec les insertions asynchrones et la déduplication (
async_insert=1,async_insert_deduplicate=1). Lorsque plusieurs entrées async-insert avec des valeursinsert_deduplication_tokendistinctes étaient regroupées dans un seul flush écrivant dans des partitions disjointes, chaque token était enregistré dans le journal de déduplication de chaque partition touchée par le flush, et non pas uniquement dans la partition où aboutissaient ses propres lignes. Une insertion ultérieure réutilisant l’un de ces tokens dans une partition dans laquelle elle n’avait jamais écrit était alors silencieusement dédupliquée. Les tokens ne sont désormais enregistrés que pour la partition où leurs lignes ont effectivement été écrites. Closes #111031. #111049 (Groene AI). - Corrige une exception
LOGICAL_ERROR(ScatterExchangeStep should have one source shard, got 8) et des lignes dupliquées lors de requêtes sur une tableMergereposant sur des tables ou vuesDistributed, avec le paramètre expérimentalmake_distributed_plan = 1. Closes #107946. #108401 (Groene AI). - Sérialise une colonne
Nullable(Tuple(...))comme un seul champCSVau lieu de l’aplatir en colonnes distinctes. Auparavant, une valeur non nulle était écrite sous forme de plusieurs champsCSV, tandis queNULLcorrespondait à un unique\N, ce qui produisait un nombre de colonnes dépendant de la ligne et cassait les en-têtesCSVWithNames/CSVWithNamesAndTypesainsi que les allers-retours. #108959 (Groene AI). - Corrige une erreur logique (
KeyCondition uses PREWHERE output) dans le lecteurParquetv3 lorsqu’une condition de clé au niveau du format fait référence à une colonne qui n’est pas lue depuis le fichierParquet. #109267 (Groene AI). - Corrige des résultats incorrects pour les lectures via des fonctions de table avec
FINALouSAMPLEsousserialize_query_plan = 1. Corrige également la clé de cache des statistiques de table de hachage d’agrégation pour les fonctions de table afin que différentes fonctions de table ne partagent plus la même entrée de préallocation. #109847 (Azat Khuzhin). - Corrige le nettoyage d’un
BACKUP ... TO Memory(...)qui échoue avant la finalisation : la sauvegarde en échec restait enregistrée, empêchant ainsi la réutilisation de son nom. #109947 (Julia Kartseva). - Correction de l’arithmétique sur des intervalles extrêmes pour
WITH FILL STEPet les fonctions d’intervalle date/heureadd*/subtract*: les deltas hors plage ne reposent plus sur un dépassement de capacité signé, etWITH FILLavec un pasYEARénorme ne se bloque plus en faisant reculer le calendrier. #110158 (Groene AI). - Correction des erreurs
411 Length Requiredprovenant des services Azure : le transport HTTP Azure basé sur Poco définit désormaisContent-Lengthà partir du corps de la requête pour les clients SDK qui ne le définissent pas eux-mêmes, comme Azure Key Vault. #110299 (Konstantin Bogdanov). - L’optimisation lazy de
FINAL(query_plan_optimize_lazy_final, désactivée par défaut) n’est plus appliquée lorsque la requête lit dans l’ordre de la clé de tri, car son plan de remplacement ne préserve pas cet ordre et pouvait renvoyer des résultats mal ordonnés. Elle n’est pas non plus appliquée lorsqu’unLIMITinférieur au nombre de lignes à lire s’applique directement à l’étape de lecture, où le passage obligatoire de construction de l’ensemble empêche l’arrêt anticipé. #110576 (Nikolai Kochetov). - Correction de
readWKTetreadWKTPoint, qui renvoyaient des coordonnées non initialisées (scalaire) ou reprises de la ligne précédente (vectorisé) pourPOINT EMPTY.POINT EMPTYest désormais rejeté avecCANNOT_PARSE_TEXT, car lePointde ClickHouse est unTuple(Float64, Float64)fixe sans représentation vide. #110692 (Groene AI). - Correction d’une mauvaise gestion du fuseau horaire lors de la matérialisation des colonnes du côté droit dans les hash joins. Corrige #111033. #111074 (Yarik Briukhovetskyi).
- Correction de résultats
count()erronés et de lignes ignorées lorsqu’une cléString(ouFixedStringplus étroit) ou un skip index minmax est filtré par une comparaison avec une constanteFixedStringplus large, par exempletoFixedString('abc', 257) = string_col. L’élagage sur clé primaire et minmax construisait la plage à partir de la constante complétée par des NUL et sautait à tort des granules correspondants. #111106 (Groene AI). - Correction des inserts asynchrones au format
Nativeafin qu’une entrée mise en tampon devenant incompatible aprèsALTER ... MODIFY COLUMNne fasse plus échouer tout le lot. Corrige #111064. #111108 (Mikhail f. Shiryaev). - Correction de
CREATE OR REPLACEd’un Dictionary avec un objet d’un autre type : l’opération échouait avecCANNOT_DETACH_DICTIONARY_AS_TABLEalors que le remplacement avait déjà été validé, laissant une table orpheline_tmp_replace_*. #111142 (Nikolay Degterinsky). - Correction de
INCOMPATIBLE_TYPE_OF_JOINpour un joinANYsur une table utilisant le engineJoinlorsqu’un filtreWHEREsur une colonne du côté droit permettait au planner de requête de réécrire le join enSEMIouANTI. Une table utilisant le engineJoina une strictness déclarée fixe qui ne peut pas être modifiée ; cette conversion est donc désormais refusée pour de telles tables. #111362 (Groene AI). - Correction de la table function
format, qui ne renvoyait aucune colonne lorsque les données d’entrée étaient analysées en zéro ligne (par exemple un document JSON vide ou uneFeatureCollectionGeoJSON sans features). Elle renvoie désormais un résultat vide avec les bonnes colonnes au lieu de leverNOT_FOUND_COLUMN_IN_BLOCK. Corrige #111390. #111428 (Groene AI).
Amélioration de la compilation/des tests/du packaging
- Les builds avec sanitizer capturent désormais le rapport du sanitizer dans le buffer global
sanitizer_report, afin que l’analyzer de core dumps puisse le lire depuis le core dump. #109333 (Miсhael Stetsyuk). - Compiler
muslà partir du code source au lieu d’utiliser des binaires intégrés. #97452 (Konstantin Bogdanov). - Utilisation des implémentations SIMD de
memcmp/memcpy/memmove/memset/bcmp/memmemfournies par LLVM-libc. #107566 (Konstantin Bogdanov). Correction d’une corruption silencieuse dememmovedans les builds de débogage-O0(-DDEBUG_O_LEVEL=0) sur les machines avec AVX-512. #110904 (Konstantin Bogdanov). - Suppression des usages de la bibliothèque
curldans l’ensemble du codebase et des bibliothèques tierces intégrées. #108296 (Konstantin Bogdanov). - Mise à jour de
mariadb-connector-cvers la version 3.4.9. #108328 (Konstantin Bogdanov). - Mise à jour de
libsshvers la version 0.12.0. #108329 (Konstantin Bogdanov). - Correction d’un blocage lors du
COMMITd’une transaction sous macOS. #108375 (Raúl Marín). - Ajout d’une option CMake
COMPRESS_DEBUG_SECTIONSqui compresse les sections de débogage DWARF dans les fichiers objets (-gz), activée automatiquement lorsque le compilateur le prend en charge, afin de réduire la taille des répertoires de builds de débogage ; les binaires finaux restent non compressés, donc la symbolisation des stack traces à l’exécution n’est pas affectée. #109306 (Murphy). La toolchain LLVM intégrée est désormais compilée avec zlib, de sorte que son clang prend en charge-gz=zlib, et le lien symboliqueclang++-21manquant a été ajouté. #109596 (Murphy). - Les builds de débogage compilent désormais les crates Rust intégrées avec des informations de débogage réduites (
debug = 1, niveaulimitedde cargo) et sans cache incrémental (REDUCE_RUST_DEBUG_INFO, activé par défaut), ce qui réduit la taille des artéfacts de build Rust (~12 → ~7 GB à partir de zéro) et empêche la croissance non bornée du cache cargo entre les recompilations. Définissez-DREDUCE_RUST_DEBUG_INFO=OFFpour restaurer les informations DWARF complètes et la compilation incrémentale. #109471 (Murphy). - Prise en charge de l’exchange de distributed query en streaming et des lectures
STREAMsous macOS. #109769 (Raúl Marín). - Passage de
libarchivede la version 3.8.7 à la version 3.8.8. #109874 (Robert Schulze). - Passage de
c-aresde la version 1.34.6 à la version 1.34.8. #109905 (Robert Schulze). - Mise à jour de
krb5pour corriger CVE-2026-40355 et CVE-2026-40356. #109910 (Robert Schulze). - Suppression de la dépendance tierce
libpng.FORMAT PNGutilise désormais un petit encodeur PNG intégré (s’appuyant sur le zlib fourni) à la place. #110051 (Alexey Milovidov). - Suivi des allocations C brutes (ne passant pas par
operator new) dans le memory tracker sur macOS en encapsulant la zone malloc de jemalloc, afin que les limites mémoire leur soient bien appliquées. #110370 (Raúl Marín). - Les Docker images
-distrolesspourclickhouse-serveretclickhouse-keepersont désormais construites à partir de l’étape de production sans shell ; auparavant, elles étaient construites à partir de l’étape de débogage et incluaient/busybox/sh. Clôt #105677. #105678 (ashishch432). - Mise à jour de
abseil-cppvers la version LTS20260526.0. #108991 (Konstantin Bogdanov).
Version de ClickHouse 26.6, 2026-06-25. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- Cette modification supprime la fonctionnalité
allow_experimental_query_deduplication. Cette fonctionnalité était expérimentale depuis longtemps, n’avait pas de tests et ne sera pas prise en charge (les tests initiaux étaient instables et ont été supprimés dans #49579). #99398 (Igor Nikonov). - La fonctionnalité
SYSTEM INSTRUMENTbasée sur XRay utilise désormaisargumentsau lieu deparameters: la colonnesystem.instrumentation.parametersa été renommée enarguments, et la syntaxeSYSTEM INSTRUMENT ADD ... HANDLER PARAMETERS ...a été renommée enSYSTEM INSTRUMENT ADD ... HANDLER ARGUMENTS .... Les requêtes ou automatisations qui utilisent l’ancienne colonne ou l’ancienne syntaxe doivent être mises à jour pour utiliser les nouveaux noms ; les anciens ne sont plus pris en charge. #103854 (Pablo Marcos). - Le paramètre
show_data_lake_catalogs_in_system_tablesa été renommé enshow_remote_databases_in_system_tableset son périmètre a été élargi : lorsque sa valeur est 0 (valeur par défaut), les bases de donnéesMySQLetPostgreSQLsont elles aussi masquées danssystem.tables,system.columnsetsystem.completions, en plus des catalogues de data lake. L’ancien nom du paramètre est conservé comme alias. #104416 (Pablo Marcos). - La build x86 par défaut cible désormais x86-64-v3 (AVX2) au lieu de x86-64-v2 (SSE4.2). Cela nécessite un CPU prenant en charge AVX2 (Intel Haswell ou plus récent, AMD Excavator ou plus récent). Si votre CPU ne prend pas en charge AVX2, utilisez la build
amd64compat, qui cible le x86-64 standard. #105019 (Raúl Marín). - Rejette les
Dynamic/Variantimbriqués dans les agrégatsmin/maxet les indexesminmax. Auparavant, seuls lesDynamic/Variantde niveau supérieur étaient vérifiés. Closes #104747. #105468 (Pavel Kruglov). icebergHasheticebergBucketrejettent désormais les argumentsInt128,UInt128,Int256,UInt256etDecimal256avec une erreur explicite. Auparavant, ils tronquaient silencieusement les valeurs de plus grande taille et produisaient des hash en collision. La spec Iceberg ne définit le hachage que pour les entiers sur 32 ou 64 bits et les décimaux avec une précision allant jusqu’à 38 ; convertissez enInt64ouDecimal128pour conserver le comportement précédent pour les valeurs compatibles. #105866 (Raúl Marín).- Ajout d’un contrôle granulaire de l’écho des requêtes dans la CLI. L’option
--echoaccepte désormais une valeur booléenne facultative et fonctionne à la fois en mode interactif et en batch mode. Les nouvelles options--echo-formattedet--echo-query-idcontrôlent respectivement si les requêtes affichées en écho sont formatées et si lequery_idest imprimé. L’option--hilite/--highlightcontrôle désormais aussi la mise en surbrillance des requêtes affichées en écho. En conséquence,--echoest maintenant une option à valeur booléenne ; une requête positionnelle placée juste après--echosans valeur explicite est donc interprétée comme sa valeur. Utilisez plutôt--echo --query "..."ou--echo=false. #106191 (Alexey Milovidov). - Suppression des fonctions KQL (Kusto) expérimentales
array_sort_ascetarray_sort_desc, ainsi que de leurs backends SQLkql_array_sort_ascetkql_array_sort_desc. Ces fonctions étaient expérimentales, de qualité médiocre, et à l’origine de bugs de correction et d’analyse syntaxique. Les requêtes qui utilisent ces noms renvoient désormaisUNKNOWN_FUNCTION. #108101 (Groene AI). ALTER TABLE ... REPLACE PARTITION ... FROM ...ne supprime plus silencieusement les données de la partition de destination lorsque la table source ne contient aucune part dans la partition demandée. Auparavant, une telle requête supprimait la partition de destination sans rien écrire à la place — un piège pouvant entraîner une perte de données. Elle est désormais rejetée avecBAD_ARGUMENTSpar défaut. Pour rétablir l’ancien comportement d’effacement silencieux, définissez le nouveau paramètreallow_replace_partition_from_empty_source = 1, ou définissezcompatibilitysur26.5ou une version antérieure ; pour supprimer explicitement les données de destination, utilisezALTER TABLE ... DROP PARTITION. #104939 (Groene AI).- La valeur par défaut du paramètre serveur
insert_deduplication_versionpasse decompatible_double_hashesànew_unified_hash. La déduplication des insertions s’applique désormais à l’ensemble du bloc inséré (par insert) plutôt qu’à chaque part/partition : une nouvelle tentative du même insert est toujours dédupliquée, mais deux inserts différents qui produisent une part identique ne sont plus dédupliqués entre eux, et des inserts des mêmes lignes dans un ordre différent ne sont plus dédupliqués. Définissezinsert_deduplication_version = compatible_double_hashespour rétablir le comportement précédent. Les instances mises à niveau directement depuis une version dont la valeur par défaut étaitold_separate_hashesdoivent d’abord fonctionner aveccompatible_double_hashesjusqu’à ce que la plus longue fenêtre de déduplication pertinente soit écoulée avant de s’appuyer surnew_unified_hash. #107886 (Sema Checherinda).
Nouvelle fonctionnalité
- Ajout de la prise en charge des requêtes continues sur les tables
MergeTree, mises en œuvre via une série de lectures d’instantanés. Il s’agit d’une première étape vers une prise en charge générale des requêtes en continu. #105114 (Mikhail Artemenko). - Ajout d’index de saut hypothétiques (what-if). Utilisez
CREATE HYPOTHETICAL INDEX ... ON t (expr) TYPE ...pour définir un index de saut virtuel limité à la session, puisEXPLAIN WHATIF SELECT ...pour estimer son taux de saut et son coût sans le matérialiser. Les index définis sont visibles dans la nouvelle tablesystem.hypothetical_indexes. #104608 (Yarik Briukhovetskyi). - Ajout d’une interface web intégrée
/schemaàclickhouse-serverqui visualise le graphe de dépendances entre les tables, les vues matérialisées, les vues matérialisées actualisables, les dictionnaires, les tables distribuées et les vues. #105276 (Nikita Mikhaylov). - Ajout de la prise en charge du format de sortie
PNG, permettant de restituer directement les résultats d’une requête sous forme d’images PNG. #74691 (Maksim Dergousov). - Ajout de la détection de l’agent IA de développement (Claude Code, Cursor, Codex, Gemini CLI, Goose, etc.) ayant invoqué
clickhouse-clientouclickhouse-local, sur la base des variables d’environnement. L’agent détecté est signalé dans la nouvelle colonneclient_agentdesystem.query_log,system.query_thread_logetsystem.processes. #106619 (Alexey Milovidov). - Ajout d’une nouvelle table système
system.documentationqui regroupe dans une seule table la documentation de référence intégrée des composants uniformes du système (fonctions, moteurs de table, types de données, paramètres, formats et autres), la documentation étant rendue en Markdown. #107463 (Alexey Milovidov). - Ajout du format d’entrée
GeoJSONpour lire des documentsFeatureCollectionGeoJSON, en produisant une ligne par entité avec les colonnesid(String),geometry(Geometry) etproperties(Nullable(JSON)). Les géométriesPoint,LineString,MultiLineString,PolygonetMultiPolygonsont lues dans le type natifGeometryde ClickHouse.GeometryCollectionetMultiPoint, que le typeGeometryne peut pas représenter, lèvent une exception par défaut, ou peuvent être stockés sous forme deNULLvia le paramètreinput_format_geojson_unsupported_geometry_handling. Contribue à #91533. #98124 (Mark Needham). - Ajout de fonctions pour servir directement des Mapbox Vector Tiles depuis SQL :
MVTEncodeGeomprojette une géométrie dans l’espace pixel d’une tuile de carte et la découpe,MVTEncodeagrège les géométries projetées d’un groupe dans les octets binaires d’une tuile monocouche, etMVTBoundingBox/MVTBoundingBoxMercatorrenvoient la boîte englobante d’une tuile afin d’y restreindre les lignes. Les géométries de type point, ligne et polygone sont prises en charge. Également disponible sous les alias PostGISST_AsMVTGeometST_AsMVT. #106107 (Saarthak Gupta). clickhouse-localprend désormais en charge les requêtesSYSTEM START LISTENetSYSTEM STOP LISTEN, ce qui permet de le transformer en serveur acceptant des connexions TCP et HTTP. #101143 (Alexey Milovidov).- Ajout d’une commande interactive
helpàclickhouse-clientetclickhouse-local. La saisie dehelp <name>(ou/help,man,/man) affiche dans le terminal la documentation d’une fonction, d’un moteur de table, d’un type de données, d’un format, d’un paramètre ou d’un autre composant, rendue à partir de Markdown avec coloration syntaxique SQL. Lorsque le terme est ambigu, toutes les correspondances sont affichées ; s’il est introuvable, des noms similaires sont suggérés. #108042 (Alexey Milovidov). - Prise en charge de l’écriture dans Azure Data Lake Storage Gen2. #105406 (Konstantin Vedernikov).
- Ajout du format
RowBinaryWithNamesAndTypesAndDefaultspour une meilleure prise en charge de l’évolution du schéma. #105736 (Mark Zitnik). - Implémentation de
ADD ENUM VALUESdans les requêtesALTER TABLEafin de simplifier l’ajout de nouvelles valeurs à un typeEnumexistant, sans devoir redéfinir toutes les valeursEnumactuelles. #93830 (Ilya Golshtein). - La vue matérialisée actualisable prend désormais en charge
REFRESH DEPENDS ON, afin de déclencher des actualisations en fonction des actualisations d’une autre RMV plutôt que selon une planification temporelle. (REFRESH EVERY ... DEPENDS ONexistait déjà, mais ne pouvait pas être utilisé de manière fiable pour ce cas d’usage.) Voir la documentation deCREATE MATERIALIZED VIEW. #104440 (Michael Kolupaev). - Ajout de la prise en charge de la sélection de colonnes par motif de nom avec
* LIKE '<pattern>'et* ILIKE '<pattern>', y compris les formes qualifiées telles quetable.* LIKE '<pattern>'ettable.* ILIKE '<pattern>'.LIKEfait correspondre les noms de colonnes en respectant la casse,ILIKEsans tenir compte de la casse. #104569 (Yue Ni). - Ajout de la syntaxe
ESCAPE, qui définit un caractère d’échappement personnalisé dans un motifLIKE, afin de traiter%et_comme des caractères littéraux plutôt que comme des caractères génériques. #99774 (Ilya Yatsishin). - Ajout des paramètres de table
MergeTreematerialize_projections_on_insertetmaterialize_projections_on_merge. Lorsquematerialize_projections_on_insert = 0, lesINSERTn’effectuent pas la construction des projection parts, ce qui améliore le débit d’insertion pour les tables comportant de nombreuses projections. Lorsquematerialize_projections_on_merge = 1, une fusion reconstruit une projection absente de toutes ses parts sources, de sorte que les projections peuvent être construites lors des fusions plutôt qu’à l’insertion. Les fusions continuent de ne combiner que les parts qui partagent le même ensemble de projections. #100993 (Christoph Wurm). - Ajout d’un nouveau paramètre
MergeTreeimmuable,allow_tuple_element_aggregation, désactivé par défaut. Lorsqu’il est activé,SummingMergeTree,AggregatingMergeTreeetCoalescingMergeTreeaplatissent récursivement les colonnesTupleet agrègent chaque élément feuille indépendamment pendant les fusions, exactement comme s’il s’agissait d’une colonne de premier niveau :SummingMergeTreeen fait la somme,AggregatingMergeTreefusionne son état de fonction d’agrégation, etCoalescingMergeTreeconserve sa dernière valeur non-NULL. Le paramètre doit être spécifié au moment de la création de la table et est ignoré silencieusement par les engines qui ne le prennent pas en charge. #98039 (johnjing). - Nouvelles fonctions
quantizeBFloat16ToInt8etdequantizeInt8ToBFloat16: un codec scalaire qui compresse les composantes d’embedding en 8 bits à l’aide d’un quantificateur gaussien de Lloyd-Max à 256 niveaux, à partir duquel des codes Int4/Int2/binary peuvent être extraits par troncature de bits. #108102 (Alexey Milovidov). - Ajout des fonctions
arrayTopKetarrayBottomK: -arrayTopK(k, array)renvoie les K plus grands éléments par ordre décroissant -arrayBottomK(k, array)renvoie les K plus petits éléments par ordre croissant. #104563 (Vitaly Baranov). - Ajout d’une nouvelle table système
system.iceberg_filesexposant les métadonnées par fichier des tablesIceberg, avec une ligne par fichier de données ou de suppression dans le snapshot courant de chaque table. Cela clôt #98777. #104415 (Asya Shneerson). - Ajout de la table
system.constraints, qui fournit des informations sur toutes les contraintesCHECKetASSUMEde l’ensemble des tables, y compris le nom, le type et l’expression de la contrainte. #105337 (Pedro Ferreira). - Ajout d’une nouvelle table
system.dictionary_layoutsqui répertorie les layouts de dictionnaire disponibles, ainsi que leur documentation intégrée (description,syntax,examples,introduced_in,related). #106182 (Alexey Milovidov). - Ajout d’une nouvelle table
system.dictionary_sourcesqui répertorie les sources de dictionnaire disponibles, ainsi que leur documentation intégrée (description,syntax,examples,introduced_in,related). #106184 (Alexey Milovidov). - Ajout d’une nouvelle table
system.data_skipping_index_typesqui répertorie les types d’index de saut de données disponibles, ainsi que leur documentation intégrée (description,syntax,examples,introduced_in,related). #106186 (Alexey Milovidov). - Ajout d’une nouvelle table
system.disk_typesqui répertorie les types de disque disponibles, ainsi que leur documentation intégrée (description,syntax,examples,introduced_in,related). #106187 (Alexey Milovidov). - Implémentation de
SYSTEM RESTART DISK <name>: cette commande recharge désormais les métadonnées en mémoire d’un disque et réanalyse les data parts des tables readonly-replica qui s’y trouvent. Cela permet à une replica readonly d’une table sur un stockage partagéplain_rewritablede voir à la demande les données écrites par un autre serveur, sans attendrerefresh_parts_intervalni redémarrer le serveur. #106645 (Jordi Villar). - La syntaxe de style PostgreSQL
expr OP SOME(array)/expr OP ALL(array)(avec un côté droit qui n’est pas une sous-requête) est désormais prise en charge et réécrite enhas/NOT haspour=/<>, ou en lambdasarrayExists/arrayAllpour les autres opérateurs de comparaison.ANYn’est pas accepté pour la forme tableau, caranyest aussi une fonction d’agrégation ; utilisezSOMEà la place. La forme sous-requête deANY/SOME/ALLcontinue d’être abaissée enIN/NOT IN. #105129 (Alexey Milovidov). - Ajout de deux nouvelles stratégies
load_balancing,hostname_longest_common_prefixethostname_longest_common_suffix, qui privilégient la replica dont le hostname partage le plus long préfixe commun (respectivement suffixe commun) avec le hostname de l’initiateur. Elles sont utiles lorsque le centre de données est encodé sous forme de préfixe ou de suffixe dans des hostnames dont les segments numériques ont une longueur variable, et que les stratégies existantesnearest_hostnameethostname_levenshtein_distancesélectionnent la mauvaise replica. #107360 (Denny [DBA at Innervate]). - Ajout des informations sur le certificat client TLS (subjects, numéro de série, issuer et période de validité) dans la table
system.session_logafin d’améliorer l’observabilité de l’authentification par certificat. #107679 (Alexey Milovidov). - Ajout d’un identifiant facultatif
external_idpour l’accès S3 basé sur les rôles. #106941 (Elian Gidoni). - Ajout d’un nouveau setting
S3Queue,after_processing_move_preserve_path. Lorsqu’il est activé avecafter_processing='move'etafter_processing_move_prefix, les objets traités sont déplacés en conservant l’intégralité de leur path source sous le préfixe de destination, au lieu d’être aplatis pour ne conserver que le nom du fichier. #105354 (Asya Shneerson). - Ajout du server setting
message_queue_disable_insertionpour désactiver l’insertion depuis les engines de file de messages (Kafka,RabbitMQ,NATS) vers les materialized views attachées. Utile dans les scénarios de replica en lecture seule. #104911 (JIaQi Tang). - Ajout de
LOCALTIMEetLOCALTIMESTAMP(syntaxe SQL standard / PostgreSQL).LOCALTIMESTAMPest un alias denow()(renvoieDateTime) ;LOCALTIMErenvoie l’heure courante sous forme de valeurTime. #106139 (Thomas Cabral). - Ajout de
date_part('unit', expr)comme sucre syntaxique pourEXTRACT(unit FROM expr). Les unités d’Interval standard ainsi que les extensions PostgreSQL (epoch,dow,doy,isodow,isoyear,century,decade,millennium) sont toutes prises en charge. #105127 (Alexey Milovidov). - Prise en charge de
EXTRACT(TIMEZONE_HOUR FROM dt)etEXTRACT(TIMEZONE_MINUTE FROM dt), compatibles avec PostgreSQL, pour extraire les composantes heure et minute d’un décalage de timezone, ainsi que deEXTRACT(<unit> FROM INTERVAL n <unit>)/date_part('<unit>', INTERVAL n <unit>)pour extraire la valeur d’un interval. #106227 (Vinayak Joshi). - Ajout des alias d’agrégation
min_byetmax_bypourargMinetargMax. #105712 (Joey Yu). Ces alias sont stupides, les vrais ingénieurs utilisent les noms d’origine de ClickHouse. - Ajout de
REGEXP_SUBSTRcomme alias insensible à la casse deregexpExtractpour la compatibilité avec Oracle/MySQL/Snowflake. #105122 (Alexey Milovidov). - Ajout de
SESSION_USERcomme alias insensible à la casse decurrentUser()pour la compatibilité PostgreSQL / SQL standard. #106081 (Takumi Hara). - Prise en charge d’un modificateur final
NULL/NOT NULLdansALTER TABLE ... ADD/MODIFY COLUMN, à l’image deCREATE TABLE. #106150 (Takumi Hara). - Vous pouvez désormais utiliser la fonction
h3PolygonToCellsWithContainmentde h3 pour bénéficier de son nouvel algorithme, qui prend en charge les modes de containment basés sur le centre, entièrement contenus et avec chevauchement. #104455 (Youssef Kadry). - Ajoute les flags
IPV4_PREFIX_BITS and IPV6_PREFIX_BITSlorsque le keying est effectué à partir deIP_ADDRESSouFORWARDED_IP_ADDRESS. #89270 (Aditya Chopra). formatReadableTimeDeltaaccepte désormais en entrée une expressionINTERVALd’un type autre queMonthetYear. #64315 (Francisco J. Jurado Moreno).- L’utilisateur peut désormais spécifier un argument de précision facultatif pour les fonctions
formatReadableSize,formatReadableDecimalSizeetformatReadableQuantity, afin de contrôler le nombre de chiffres après la virgule. La valeur par défaut est 2, ce qui préserve le comportement antérieur. #104648 (Antonio Filipovic). - Ajoute le paramètre
output_format_float_precisionpour contrôler le nombre de chiffres décimaux dans la sortie texte des nombres à virgule flottante. #99721 (phulv94). - Ajout du paramètre
output_format_always_write_decimal_point_in_float_and_decimalpour toujours afficher un point décimal pour les nombres à virgule flottante et les nombresDecimaldans les formats texte, même lorsque la valeur est un nombre entier. Par exemple, produit1.au lieu de1. Désactivé par défaut. #62614 (Ilya Yatsishin). - Ajoute la prise en charge de nouveaux éléments de configuration de handler HTTP
<url_prefix>et<full_url_prefix>(correspondent à tous les paths sous un path de base, utile par exemple pour les handlers Prometheus), ainsi que de<url_regexp>,<full_url_regexp>et<headers_regexp>. L’ancienne forme<url>regex:...</url>est désormais obsolète. #107492 (Vitaly Baranov). - Prend en charge les statistiques
basic, une statistique compacte par colonne qui stocke les min/max numériques, la longueur moyenne des chaînes et le nombre de valeurs NULL lorsque cela s’applique. #106048 (Han Fei). - Prend en charge les nœuds TTL dans ClickHouse Keeper, activables via le flag de feature
create_ttl. #100397 (Konstantin Vedernikov). - Introduit une fonctionnalité de réservation de mémoire pour les workloads. Consultez la documentation sur la planification des workloads. #82414 (Sergei Trifonov).
Fonctionnalité expérimentale
- Exécution distribuée des requêtes en plusieurs étapes : le planificateur divise le plan de requête en étapes reliées par des échanges scatter / broadcast / gather / shuffle et envoie les fragments du plan aux nœuds worker. Les données entre les étapes sont transmises en flux via TCP ou via des fichiers temporaires dans un stockage objet partagé ; ce mécanisme prend en charge les hash joins distribués en mode shuffle et broadcast, l’agrégation shuffle et le tri distribué. Cette fonctionnalité est expérimentale et désactivée par défaut. #106020 (Alexander Gololobov). Le moteur expérimental de plan de requête distribué (
make_distributed_plan) peut désormais utiliser, pour chaque worker, un port distinct pour la répartition des tâches et les échanges en streaming, configuré par réplique dans<remote_servers>avecstateless_worker_portetstreaming_exchange_port. Lorsqu’ils ne sont pas définis, les anciens ports au niveau du serveur (stateless_worker_client.portetdistributed_query.streaming_exchange_port) sont utilisés. Cela permet d’exécuter plusieurs workers sur un même hôte. #107885 (Alexander Gololobov). - Ajout de l’algorithme expérimental de réordonnancement des join
dphyppour les inner joins comme option du paramètrequery_plan_optimize_join_order_algorithm, ainsi que du paramètrequery_plan_optimize_join_order_max_searched_plans, qui borne la recherche de l’ordre des join et bascule vers l’algorithme suivant de la chaîne lorsque cette limite est dépassée ; définissez-le sur0pour conserver le comportement précédent de recherche non bornée. #98798 (Alexander Gololobov). - Ajout de la fonction
aiEmbedpour utiliser des API de LLM afin de générer des embeddings directement depuis ClickHouse. #102922 (George Larionov). - Ajout d’un canary OOM Linux expérimental : un processus enfant sacrificiel que le Linux OOM killer cible avant le processus principal du serveur. Lorsqu’il est activé avec
oom_canary_enable, il réduit la pression mémoire en purgeant les caches de l’allocateur, en annulant les requêtes, en annulant les fusions et en enregistrant un événement danssystem.crash_log. La réponse à l’OOM nécessite une preuve d’OOM-kill dansmemory.eventsde cgroup v2. #101942 (Peng). - L’interface de terminal web à l’adresse
/webterminalest désormais une fonctionnalité de production et elle est activée par défaut. Elle est contrôlée par le nouveau paramètre serveurenable_webterminal; l’ancien paramètreallow_experimental_webterminalest obsolète, mais reste pris en charge pour assurer la backward compatibility. Pour désactiver le endpoint, définissezenable_webterminalsurfalse. #106255 (Alexey Milovidov). - Les endpoints HTTP PromQL permettent désormais de spécifier la base de données et la table via des query parameters d’URL (
database=,table=, outable=db.table). Le repli implicite précédent vers la tabledefault.prometheusest supprimé : si ni la config du handler ni l’URL ne spécifient de table, le handler renvoie désormaisThe time series table name is not set. Pour conserver l’ancien comportement, configurez<table>default.prometheus</table>ou passeztable=...dans l’URL. #107553 (Vitaly Baranov). - Ajout de la prise en charge de la fonction PromQL
histogram_quantiledans les fonctions de tableprometheusQueryetprometheusQueryRange. Cela permet de calculer des quantiles sur les buckets d’histogrammes Prometheus classiques identifiés par le labelle. #103477 (Joe Smith). - Ajout du mode d’application lazy des posting lists pour le text index. Lorsqu’il est activé via
SET allow_experimental_text_index_lazy_apply = 1etSET text_index_posting_list_apply_mode = 'lazy', les posting lists sont décodées à la demande à la granularité des blocs compressés à l’aide d’une approche basée sur un curseur, au lieu d’être entièrement matérialisées en Roaring Bitmaps, ce qui réduit l’utilisation mémoire et le temps CPU pour les text index queries sélectives. #100035 (Peng). - Ajout de la prise en charge de l’ABI AssemblyScript pour les UDF WebAssembly. Vous pouvez essayer l’ABI AssemblyScript sans installer la toolchain localement en utilisant le playground dans le navigateur, qui compile le code AssemblyScript et charge le module WebAssembly obtenu dans une instance locale de ClickHouse. #104606 (Vladimir Cherkasov).
- Possibilité d’attacher des handlers Prometheus au port HTTP principal avec un préfixe facultatif. #104975 (James Cunningham).
- Ajout du setting expérimental
MergeTreepacked_skip_index_max_bytes, qui regroupe les petits substreams d’indices de saut dans une archive uniqueskp_idx.packedpar part, ce qui réduit la pression sur les inodes lorsque de nombreux indices de saut sont définis sur une table. La décision est prise par substream au moment de l’écriture : les substreams dont la taille sérialisée reste sous le threshold sont placés dans l’archive, tandis que les plus gros conservent le layout standaloneskp_idx_<name>.idx2/.mrk2. Une même part peut mélanger les layouts. Les indices full-text ne sont pas pris en charge et restent toujours stockés fichier par fichier. La valeur par défaut est 0 (packing désactivé). #105321 (Raúl Marín). - Prise en charge de la sérialisation
Bufferspour les UDF WebAssembly avecABI BUFFERED_V1, et ajout dewebassembly_udf_enable_fuelcomme setting persisted de fonction UDF WASM. #105574 (Antonio Andelic). - Ajout d’un setting expérimental
use_reader_executor(désactivé par défaut) qui fait passer les reads par un nouveauReaderExecutorbasé sur un pipeline, au lieu de la chaîne legacy de read buffers. #106570 (Sema Checherinda). Ajout de metrics d’observabilité pour le chemin de lecture expérimentaluse_reader_executor, y compris un KPI modélisé de coût de lecture (ReaderExecutorModeledCostMsPerRequestedMiB). #106968 (Sema Checherinda). Introduction du bufferChainedBuffersderrière le chemin de lecture expérimentaluse_reader_executor, avec une metricReaderExecutorChainedBufferBytes. #107210 (Sema Checherinda). - L’ordre de tri décroissant dans les sorting keys
MergeTree(par ex.ORDER BY (time DESC, key)) est désormais toujours pris en charge et ne nécessite plus le setting expérimentalallow_experimental_reverse_key, désormais Obsolete. #106440 (Nikita Mikhaylov). Nullable(Tuple(...))est désormais Beta. Désactivé par défaut ; définissezenable_nullable_tuple_type = 1pour l’utiliser. #107754 (Nihal Z. Miaji).
Amélioration des performances
- Divers changements apportés à Keeper le rendent globalement environ 2x plus rapide (meilleur traitement par lots, mise en pipeline des messages vers le leader, mise en pipeline des ajouts au journal). #101757 (Michael Kolupaev).
- Réduit le surcoût par query pour les requêtes
SELECTsimples (parsing, analyse et planification). Par exemple,SELECT count() FROM hitssur une seule connection est environ 50 % plus rapide. #104513 (Raúl Marín). - Optimise l’analyse de l’index de clé primaire pour les clés primaires longues et à forte cardinalité. Pour une clé primaire longue, le temps d’exécution de l’analyse d’index dépend désormais principalement de la complexité du filter de la query (les key columns qu’elle utilise réellement), et non de la longueur de la clé primaire — ainsi, étendre la sorting key n’ajoute qu’un surcoût négligeable à l’analyse d’index pour les queries qui ne filtrent que sur quelques-unes de ses columns. Pour une clé primaire à forte cardinalité, lorsque ClickHouse ne conserve en mémoire qu’un préfixe sélectif des key columns et ne charge pas les suivantes, l’analyse d’index fonctionne désormais uniquement sur ce préfixe in-memory au lieu de la clé entière. L’optimization est activée par défaut et peut être désactivée avec le nouveau setting
use_lightweight_primary_key_index_analysis. Closes #65103. #91836 (Nihal Z. Miaji). - La build x86 par défaut cible désormais x86-64-v3 (AVX2) au lieu de x86-64-v2 (SSE4.2). Cela nécessite un CPU prenant en charge AVX2 (Intel Haswell ou version ultérieure, AMD Excavator ou version ultérieure). Si votre CPU ne prend pas en charge AVX2, utilisez la build
amd64compat, qui cible le x86-64 standard. #105019 (Raúl Marín). - Utilise
ipnsortetdriftsort(tri stable) — des ports C++ des implémentations de tri de la bibliothèque standard de Rust — pour les tris par comparaison à usage général. AccélèreORDER BYsur les columns non numériques et les tris stables, et élimine un cas défavorable sur des entrées triées dans l’ordre inverse. #106650 (Alexey Milovidov). - Nouvelle optimization de
GROUP BYpour les clés à forte cardinalité réparties uniformément, qui répartit les lignes entre les threads en hachant la grouping key, de sorte que chaque thread agrège un sous-ensemble disjoint de clés sans phase de merge. Définissezenable_sharding_aggregator = 1pour l’activer. #104233 (Nihal Z. Miaji). - Active le prefetching de la hash table pour les queries
GROUP BYavec clé de type chaîne, améliorant d’environ 8 % les performances d’aggregation sur des chaînes à forte cardinalité. #101007 (Le Zhang). - Réduit le pic d’utilisation mémoire lors du merge de résultats partiels d’aggregation à deux niveaux avec de grands aggregate states (par ex.
groupArray), en libérant progressivement les états source de chaque bucket pendant le merge au lieu de tous les conserver jusqu’à la fin. #102330 (Yuri Fedoseev). - La représentation en mémoire de
EnumDataTypea été optimisée. L’empreinte mémoire des tables contenant le typeEnumpeut être réduite jusqu’à un facteur 10 pour le composantEnum. Le temps nécessaire pour retrouver le nom à partir de la valeur (nombre) est similaire ou plus rapide. La recherche par nom est légèrement plus lente, mais ce mode d’accès est moins courant. #95668 (Ilya Yatsishin). - Ajoute un cache de résolution d’identifiants afin d’éviter les résolutions d’identifiants redondantes pendant la query analysis. #88043 (Max Justus Spransy).
- Amélioration des performances de l’analyse des requêtes sur des tables comportant de nombreuses colonnes : évite de calculer les hachages des nœuds de colonne (qui incluent l’expression complète de la table source) lorsque ce n’est pas nécessaire. L’analyse de sous-requêtes
SELECT *imbriquées sur une table avec ~1200 colonnes est désormais environ 50 fois plus rapide. #106957 (Dmitry Novik). - Accélération de l’analyse des requêtes comportant de nombreux appels de fonction, ou des appels de fonction profondément imbriqués, grâce à la suppression d’un hachage redondant de l’arbre de requête du cache de résolution des fonctions. #107516 (Dmitry Novik).
- Correction des longs blocages à la connexion et au démarrage des requêtes avec le stockage d’accès répliqué lorsque de nombreuses entités d’accès (row policies, rôles, quotas, settings profiles) changent en même temps. Chaque cache par entité est désormais recalculé une seule fois par lot de notifications au lieu d’une fois par entité modifiée, supprimant ainsi un travail quadratique qui pouvait maintenir le verrou d’accès pendant plusieurs minutes. #107672 (Azat Khuzhin).
- Partage du
FixedHashMapdu hash join comme JOIN runtime filter du côté probe. Lorsque la hash table du côté build est (ou peut être convertie en)FixedHashMap, elle est publiée comme runtime filter et remplace leSet/BloomFilterqueBuildRuntimeFilterStepinstallerait autrement. Contrôlé par le nouveau paramètrejoin_runtime_filter_from_fixed_hash_table(valeur par défaut :true). #105640 (Xiaozhe Yu). - Application lazy des index de selector et de replication dans le cas d’un
JOINsuivi d’unLIMITsélectif, d’unTopNou d’un autreJOIN. Pour contrôler le nombre de colonnes de charge utile permettant d’activer l’indexation lazy du selector, utilisez le paramètrequery_plan_min_columns_for_join_lazy_indexing(0 signifie que l’optimization est désactivée). Pour contrôler leLIMITauquel l’optimization s’applique, utilisez le paramètrequery_plan_max_limit_for_join_lazy_indexing. #106566 (Hechem Selmi). - Le réordonnancement des JOIN par DP (programmation dynamique) est désormais autorisé avec les parallel replicas. #105889 (Nikita Taranov).
- Amélioration du query plan lorsque JOIN utilise des Runtime Filters (
enable_join_runtime_filtersactivé par défaut) : le modèle de coût de réordonnancement des jointures voit désormais au-delà deWindowTransform(et des autres plan steps qui préservent les rows) dans le sous-arbre droit et utilise le nombre de rows sous-jacent ainsi que le NDV par column au lieu de se rabattre sur l’absence de STATISTICS. #107229 (UnamedRus). - Dévirtualisation de l’émission des rows non jointes dans les jointures RIGHT et FULL en les regroupant par lots. #105679 (Hechem Selmi).
- Prise en charge des méthodes compactes
keys32etkeys64dansHashJoin. #107202 (Nikita Taranov). - Prise en charge des méthodes compactes
keys32etkeys64dansSet. #107564 (Nikita Taranov). - Gestion plus optimale des nullable columns dans l’aggregation. #106015 (Nikita Taranov).
- Amélioration des performances des requêtes
LIMIT BY. #103349 (Nihal Z. Miaji). - Accélère les requêtes
ORDER BY ... LIMIT BYen exécutantLIMIT BYdans chaque flux trié parallèle pendantSortlorsque les colonnes deLIMIT BYforment un préfixe deORDER BY. Cela réduit le nombre de lignes passant par la fusion de tri finale et par les étapes de pipeline en aval. Cette optimisation est contrôlée par le nouveau paramètrequery_plan_push_limit_by_into_sort(activé par défaut). #104000 (Nihal Z. Miaji). - Accélère les requêtes
SELECT ... LIMIT N BY <cols>lorsque<cols>sont un préfixe de la clé de tri de la table, ou le deviennent après queWHERE col = consta fixé les colonnes de tête. Lorsque cette option est activée,MergeTreelit les données dans l’ordre de la clé primaire etLIMIT BYfiltre d’abord en mode streaming avec une mémoire en O(1) par flux trié, ce qui élimine l’essentiel des données, puis exécute finalement unLIMIT BYordinaire sur les données réduites pour obtenir le résultat final. Contrôlé par le nouveau paramètreoptimize_limit_by_in_order(activé par défaut). #105135 (Nihal Z. Miaji). - Accélère les requêtes
LIMIT BYsur les tablesMergeTreepartitionnées en exécutantLIMIT BYdans le flux de chaque partition en parallèle, au lieu de fusionner tous les flux en un seul avant d’appliquer la limite. Cela s’applique lorsque l’expression de partition est une fonction déterministe des colonnes deLIMIT BY, de sorte qu’aucun groupeLIMIT BYne puisse s’étendre sur deux partitions. Contrôlé par le nouveau paramètreallow_limit_by_partitions_independently(activé par défaut). #105126 (Nihal Z. Miaji). - Accélère les requêtes
LIMIT BYen supprimant les expressions de clé redondantes : une clé qui est une fonction déterministe des autres clés est supprimée (par ex.LIMIT 5 BY x, f(x)devientLIMIT 5 BY x), et une fonction injective d’une clé est remplacée par son argument (par ex.LIMIT 5 BY toString(x)devientLIMIT 5 BY x). Cela permet d’évaluer moins d’expressions, et à moindre coût, par ligne. Contrôlé par les nouveaux paramètresoptimize_limit_by_function_keysetoptimize_injective_functions_in_limit_by, tous deux activés par défaut. #106818 (Nihal Z. Miaji). - Accélère l’agrégation distribuée, la répartition en buckets des jointures
grace_hashet le partitionnement parallèle des fenêtres en remplaçant le hachage des colonnes par chunk par un kernel utilisant le CRC32C matériel. #106538 (Harikrishnan Prabakaran). - Optimise
L1Distance,L2Distance,L2SquaredDistance,LinfDistanceetcosineDistancepour les arguments de type Array grâce à une auto-vectorisation multi-cible sur x86-64-v4/v3. Pour les arguments Array non constants, toutes saufLpDistance, qui utilisestd::powavec un exposant déterminé à l’exécution, peuvent désormais utiliser des kernels vectorisés par le compilateur. Les chemins rapides existants AVX-512 et Sapphire RapidsBFloat16à arguments constants pourL2DistanceetcosineDistancesont conservés. #101310 (Peng). - Amélioration des performances des fonctions
{Norm}DistanceetdotProduct. #106007 (Nikita Taranov). - Amélioration des performances de la fonction
arrayNorm. #106211 (Nikita Taranov). - Les performances de
dotProductont été améliorées dans certains cas. #106210 (Nikita Taranov). - Amélioration des performances des chemins AVX-512 const-left pour
L2DistanceetcosineDistancesurArray(Float32),Array(Float64)etArray(BFloat16)lorsque la longueur du tableau est un multiple exact de la largeur de traitement vectoriel. #104625 (Sergey Kuznetsov). - Activation de la génération de code AVX-512 pour AMD et amélioration de la génération de code pour
arrayDistance. #106505 (Nikita Taranov). - Amélioration des performances des fonctions
L2DistanceTransposedetcosineDistanceTransposedpour le type de donnéesQBit. #106701 (Raufs Dunamalijevs). - Amélioration des performances des fonctions
encrypt,decrypt,tryDecrypt,aes_encrypt_mysqletaes_decrypt_mysqljusqu’à un facteur de 10, en récupérant les performances perdues lors de la migration de BoringSSL vers OpenSSL 3.x (24.4). #107339 (Konstantin Bogdanov). - Amélioration des performances des fonctions
encrypt,decryptethalfMD5en évitant les recherches implicites du provider OpenSSL pour chaque ligne dans OpenSSL 3.x. #99105 (Konstantin Bogdanov). - Ajout d’une implémentation SIMD de
SHA1qui calcule le hachage de plusieurs entrées en parallèle à l’aide d’AVX-512, augmentant ainsi le débit. #105459 (Joanna Hulboj). - Ajout d’un backend AArch64 ASIMD/NEON pour l’implémentation multi-buffer de
MD5. #105563 (Venkata Vineel ). - Regroupement des blocks source avant le calcul de la projection pendant
MATERIALIZE PROJECTIONafin de réduire le nombre de projection parts temporaires et le surcoût des fusions. Accélération d’environ 3,4x sur une table de 50 M de lignes. #100047 (Amos Bird). - Réduction de la latence de
INSERTpour les tablesMergeTreeavec des index de saut sur les colonnesORDER BYen évitant les permutations redondantes de colonnes lors de l’écriture des parts (~17 % sur des workloads de type traces). #101101 (Amos Bird). - Activation des chemins de code SIMD d’Arrow (NEON sur ARM, SSE4.2/AVX2/AVX512 sur x86) et utilisation de ceux-ci pour accélérer le décodage des colonnes Parquet
FLOAT/DOUBLEencodées enBYTE_STREAM_SPLIT. #106376 (Raúl Marín). - Amélioration des performances d’insertion pour les colonnes
LowCardinalityavec des indexbloom_filter. #106410 (Michael Jarrett). - Parallélisation des copies de blobs dans
DiskObjectStorageTransaction::copyFileà l’aide d’un thread pool par disk. #105089 (Asya Shneerson). - Évite la lecture du contenu des fichiers lors de l’utilisation du input format
Oneavec des table functions de type fichier commefileets3. #105157 (Yue Ni). - Accélération d’environ 3x du démarrage de
clickhousesur macOS en n’exportant pas les symboles dynamiques, que l’éditeur de liens dynamique traiterait sinon à chaque lancement. #107768 (Raúl Marín). - Accélération du chargement du filesystem cache au démarrage en évitant une ouverture de répertoire redondante pour chaque clé de cache. #107414 (Alexey Milovidov).
- Accélération du chargement du filesystem cache au démarrage en permettant aux threads chargés du listage des répertoires d’aider au chargement des métadonnées du cache une fois le listage terminé, au lieu de laisser la moitié des threads inactifs. #107416 (Alexey Milovidov).
- Réduction du surcoût au démarrage du processus
clickhousegrâce à la mise à jour de la bibliothèque WasmEdge intégrée, qui ne génère plus de secret de hash aléatoire dans un initialiseur global à chaque démarrage. #107869 (Raúl Marín). - La primary key de
MergeTreeet les skip indexes peuvent désormais éliminer des granules pour les filters oùifNulloucoalesceencapsule une condition, commeifNull(key = 0, 0)oucoalesce(key = 0, 0). De tels prédicats — souvent générés par des générateurs de query pour transformer une comparaison potentiellementNULLen booléen déterminé — étaient auparavant opaques pour l’index analysis et ne permettaient pas d’ignorer des granules. Cela étend le paramètre existantallow_key_condition_coalesce_rewrite(activé par défaut). Corrige #106264. #106272 (Andy Zhao). - L’évaluation des skip indexes sur les types
DateTime64devrait consommer moins de CPU en 26.6. #107707 (Shankar Iyer). - Amélioration des performances de l’analyse du text index dans les recherches multi-token grâce à l’optimisation du traitement des tokens rares. #98226 (Anton Popov).
- Utilisation d’un cache pour les segments compressés des listes de publication du text index. #106299 (Anton Popov).
- Amélioration des performances de la generic exclusion search pour les queries qui sélectionnent de grandes plages consécutives de la table. #93813 (Michael Jarrett).
- Les clients
S3ayant le même endpoint et le même bucket partagent un cache, ce qui évite les découvertes de région en double. Corrige #92482. #96802 (Andrey Zvonov). - Si une query contient
has(<constant array>, <expr>), l’analyzer transformera le nœud pour utiliser une implémentationinplus rapide lorsque c’est possible. #97341 (Shankar Iyer). - Lorsqu’un nouveau job est planifié dans
ThreadPool, le worker thread devenu idle le plus récemment (LIFO) est réveillé plutôt qu’un thread arbitraire. Cela réduit la fragmentation mémoire due aux caches d’allocator par thread. L’ordre de traitement des jobs reste inchangé. #100177 (Alexey Milovidov). - Amélioration des performances des runtime filters approximatifs et des Bloom filter indexes. #100201 (Christoph Viebig).
ASOF JOINpeut désormais utiliser l’algorithme de joinparallel_hash, en parallélisant la phase de construction sur des valeurs distinctes de clé d’égalité. Auparavant,ASOFétait systématiquement exclu deparallel_hash. #105375 (Greg Maher).- Évite de lire des entrées non bornées pour les queries
INTERSECTetEXCEPTlorsqu’une entrée vide permet de savoir que le résultat sera vide. #105393 (Yue Ni). - Ajout de
constinitpour divers bloqueurs deMemoryTracker. #105490 (Azat Khuzhin). - Amélioration des performances de
bitmapContainspour les étatsgroupBitmapautres queUInt64, en évitant les appels répétés àrb_maxlors des vérifications de plage. #105960 (Yue Ni). - Accélération des requêtes discontinues sur les colonnes
LowCardinalityreposant sur un dictionnaire unique. #103662 (Ivan Babrou). - Ajout d’un chemin rapide pour la phase de probe de
HashJoinlorsque le block ne contient qu’une seule ligne. #106008 (Nikita Taranov). - Les prédicats de requêtes telles que
SELECT ... FROM view(SELECT ... FROM remote(...)) WHERE ...sont désormais propagés à la query envoyée au shard distant. L’optimizationallow_push_predicate_ast_for_distributed_subqueriesne couvrait pas le cas des table functions. #105986 (Nikolai Kochetov). - Activation par défaut de
enable_join_transitive_predicates. #103724 (Alexander Gololobov). - Ajout de la prise en charge des fonctions
multiSearchAny,multiSearchAnyUTF8etmultiMatchAnydans les text indexes. Amélioration également de l’analyse des text indexes pour la fonctionmatch: les Patterns comportant des groupes alternatifs permettent désormais d’ignorer davantage de granules. #106279 (Anton Popov). - Autorise la fusion dans le PREWHERE existant, lors d’un second passage de l’optimiseur, des filters introduits après la sélection PREWHERE initiale (predicate pushdown, runtime filters, ou PREWHERE explicite plus un WHERE défini par le planificateur), au lieu de les conserver comme une étape Filter distincte au-dessus de la lecture
MergeTree. #105445 (Yarik Briukhovetskyi). - Le
QueryConditionCacheenregistre désormais individuellement les granules filtrés, y compris dans les lots de lecture qui ne passent que partiellement PREWHERE, ce qui réduit le nombre de marks relus par les queries suivantes avec la même condition. #105335 (Han Fei). - Ajout du paramètre Keeper
nuraft_use_bg_thread_for_snapshot_io, activé par défaut, afin queNuRaftlise les objets snapshot depuis un background thread plutôt que depuis les worker threads de Raft. #106285 (Antonio Andelic). - Réduction du pic d’utilisation mémoire lors de l’application des snapshots reçus dans ClickHouse Keeper avec
KeeperMemoryStorage. #105851 (Antonio Andelic). - Redirige les allocations LLVM/JIT vers une Arena jemalloc dédiée. Réduit la fragmentation RSS causée par l’entrelacement des structures de suivi JIT de longue durée avec les allocations de query de courte durée. Ajoute de nouvelles métriques asynchrones
jemalloc.jit_arena.active_bytes,jemalloc.jit_arena.dirty_bytes,CompiledExpressionCacheBytesMaxetCompiledExpressionCacheCountMaxpour l’observabilité.SYSTEM DROP COMPILED EXPRESSION CACHEsupprime désormais également les instances CHJIT sous-jacentes et purge l’Arena JIT. #104113 (Raúl Marín). - Correction d’une memory reservation excessive lors de la lecture de colonnes
Nullable(String)encodées par dictionnaire sparse depuisParquetavec le lecteur native V3. #102805 (Francisco). - Correction de
CREATE TABLE ... CLONE AS (and REPLACE / ATTACH PARTITION ... FROM)sur les disques chiffrés, qui copiait les données au lieu de créer des liens physiques. #106731 (Nikita Mikhaylov). - Amélioration de l’estimation de la cardinalité dans l’optimiseur du plan de requête : une colonne produite par une fonction déterministe à un seul argument (par ex.
toYear(date)) hérite désormais du nombre de valeurs distinctes de son argument comme borne supérieure, au lieu d’être laissée sans statistiques, ce qui permet un réordonnancement des jointures plus précis. #107757 (Alexander Gololobov). - Réduction de la surcharge CPU de la journalisation asynchrone à des débits de logs élevés en ne notifiant le consommateur de logs qu’au passage d’une file d’attente vide à non vide, au lieu de le faire à chaque message. #107352 (Nikita Mikhaylov).
- Suppression des calculs redondants pendant l’exécution des requêtes dans davantage de scénarios. #106113 (Yarik Briukhovetskyi).
- Parallélisation du traitement du résultat d’une CTE récursive : un
GROUP BYou toute autre opération sur un grand résultatWITH RECURSIVEn’est désormais plus limité à un seul thread. #107694 (Alexey Milovidov). - Amélioration des performances de la recherche de sous-chaîne insensible à la casse (
positionCaseInsensitiveUTF8,ILIKE,multiSearchAnyCaseInsensitiveUTF8et fonctions associées) grâce à l’ajout d’un chemin SIMD NEON sur ARM et d’un kernel AVX2 plus large sur x86. #107882 (Raúl Marín). - Correction d’une régression d’environ 16 % du débit du codec à virgule flottante
FPCsur ARM, introduite lorsque ses tables de prédiction ont commencé à utiliserVectorWithMemoryTracking. #108182 (Groene AI).
Amélioration
- Le
MemoryWorkerd’arrière-plan met désormais à jour périodiquement la hard memory limit du serveur en fonction de la memory usage actuelle et de la quantité de mémoire que le noyau signale comme disponible, afin que ClickHouse laisse de la place aux autres processus exécutés sur le même hôte. La formule est(resident memory + system MemAvailable) * max_server_memory_usage_to_ram_ratio. Le même server settingmax_server_memory_usage_to_ram_ratiocontrôle à la fois la limite au démarrage et l’ajustement dynamique ; définissez-le sur0pour désactiver les deux. Pour ne conserver que la limite statique au démarrage/rechargement (le comportement des versions précédentes), définissez le nouveau server settingmemory_worker_dynamic_hard_limitsur0. #104964 (Alexey Milovidov). - Prise en charge du client PostgreSQL C# dans le protocole
PostgreSQL. Cela clôt #18611. #80785 (Konstantin Vedernikov). - Les mutations utilisent désormais l’analyseur. #98884 (Nikolai Kochetov).
- Ajout d’un contrôle granulaire de l’affichage des queries en écho dans la CLI. L’option
--echoaccepte désormais une valeur booléenne facultative et fonctionne à la fois en mode interactif et en batch mode. Les nouvelles options--echo-formattedet--echo-query-idcontrôlent respectivement le formatage des queries affichées en écho et l’affichage duquery_id. L’option--hilite/--highlightcontrôle désormais également la mise en évidence des queries affichées en écho. Effet secondaire :--echoest maintenant une option à valeur booléenne ; une query positionnelle placée directement après un--echoseul est donc traitée comme sa valeur. Utilisez plutôt--echo --query "..."ou--echo=false. #106191 (Alexey Milovidov). - Prise en charge de la schema evolution avec des vérifications de cohérence concurrentes pour les catalogs de data lake. #106102 (Konstantin Vedernikov).
- Prise en charge du cache disk pour les table engines Data Lake. #102017 (RinChanNOW).
- Correction de la lecture des données de table pour les databases
DataLakeCatalogaveccatalog_type = 'onelake', via l’utilisation par défaut de l’endpoint Blob OneLake (.blob.fabric.microsoft.com). Définissezonelake_use_blob_endpoint = falsepour conserver le comportement précédent avec l’endpoint DFS (.dfs.fabric.microsoft.com). #106843 (Konstantin Vedernikov). - Mise à jour de la valeur par défaut du setting
persistent_processing_node_ttl_secondsdeS3(Azure)Queue, de1 hourà6 hours(ce qui correspond au délai de nettoyage après un redémarrage non propre du service, etc.). La valeur par défaut précédente convenait pour le ttl des processing nodes, mais elle est également utilisée pour le ttl du verrou de bucket, qui peut être conservé plus longtemps ; par conséquent, 1 heure n’était pas suffisant. #106838 (Kseniia Sumarokova). - Réduction de la taille par défaut du metadata cache
Iceberg, de 1 Go à 128 Mo. #106492 (Konstantin Vedernikov). - Propagation du
query_idde la tâche streamingS3Queueaux inserts des tables dépendantes. #106494 (Christoph Wurm). - Renseigne
used_storagesdanssystem.query_logavec le nom du storage engine lors de l’exécution de queries sur des tables viaDataLakeCatalog. #100706 (Melvyn Peignon). - Vous pouvez vérifier quelles valeurs de ‘operation’ et de ‘summary’ possèdent les snapshots d’Iceberg. Utile pour les tests et le débogage. #106246 (Den Kalantaevskii).
- Finalise la requête finale de téléversement multipart
S3de manière asynchrone via le gestionnaire de tâches, afin qu’elle puisse se chevaucher avec le téléversement de la dernière part au lieu de s’exécuter en série pendant la finalisation. #105487 (Asya Shneerson). - Ajout de quatre nouveaux paramètres de table
MergeTreepour contrôler les paramètres par défaut des index de texte :text_index_dictionary_block_size,text_index_dictionary_block_frontcoding_compression,text_index_posting_list_block_sizeettext_index_posting_list_codec. Ces paramètres permettent d’ajuster le comportement des index de texte au niveau de la table sans devoir spécifier de paramètres dans chaque définition d’index. Les arguments explicites définis par index gardent la préséance. #100626 (Anton Popov). - Autorise les projections à surcharger d’autres paramètres
MergeTree(compression, format des parts, sérialisation) au-delà deindex_granularity, avec une liste blanche des paramètres autorisés et une validation. #101170 (Amos Bird). - Ajout des colonnes
current_projection,current_projection_progress,projections_completedetprojections_remainingàsystem.mergespour exposer la progression des fusions de projections. #102611 (Amos Bird). - Correction de
PREWHEREavec une sous-requêteINsur les colonnes de clé primaire qui n’utilisait pas l’index de clé primaire pour l’élagage des granules, provoquant des parcours complets de la table au lieu de lire uniquement les granules pertinentes. #102570 (Nikita Mikhaylov). - La fonction
h3PolygonToCellsapplique désormais la taille maximale du tableau à tous les polygones d’unMultiPolygon, valide les codes de retour de la bibliothèque H3 sous-jacente et rejette les argumentsMultiLineStringau lieu de renvoyer silencieusement un résultat vide. #106399 (Raúl Marín). - Ajoute une nouvelle table
system.keeper_snapshots, réservée à Keeper, contenant des informations sur les snapshots locaux de ClickHouse Keeper. #105571 (Miсhael Stetsyuk). - Ajoute une nouvelle table
system.keeper_changelogs, réservée à Keeper, contenant des informations sur les fichiers de changelog locaux de ClickHouse Keeper (journal Raft). #105617 (Miсhael Stetsyuk). - Ajoute une table
system.keeper_cluster, réservée à Keeper. Elle contient une ligne par membre du cluster Raft tel qu’il est vu par le Keeper actuel. #105646 (Miсhael Stetsyuk). - Ajoute davantage d’événements de profil Keeper (server-side + client-side) pour les watches. Clôt #97703. #105336 (Konstantin Vedernikov).
- Ajout de
coordination_settingspour Keeper afin de limiter l’admission des log entries non validées deNuRaftet le throttling des sondes arrière append-entries. #106108 (Antonio Andelic). - Ajoute le paramètre
enable_compressionpour la fonction de tablemysql, le moteur de tableMySQL, le moteur de base de donnéesMySQL, le dictionnaireSOURCE(MYSQL)et les named collections. Lorsqu’il est activé, ClickHouse négocie la compression au niveau du protocole MySQL pour toutes les données transférées via la connexion. #103229 (Bernard Lim). - Réduction de la latence d’annulation des query exécutées via le PostgreSQL wire protocol :
KILL QUERYinterrompt désormais la sérialisation de la sortie au sein d’un seul chunk au lieu d’attendre que le chunk entier soit envoyé au client. #106535 (Roman Vasin). - Réduction de la latence d’annulation des query exécutées via le MySQL wire protocol :
KILL QUERYinterrompt désormais la sérialisation de la sortie au sein d’un seul chunk au lieu d’attendre que le chunk entier soit envoyé au client. #107228 (Roman Vasin). - Correction de la lecture de la longueur de
auth_responselors du handshake MySQL, où un octet de longueur>= 128était interprété comme une valeur de plusieurs gigaoctets parce qu’il était lu comme uncharsigné. #107384 (uwezkhan). MaterializedPostgreSQLmappe désormais les colonnes PostgreSQLnumeric(p, 0)avec une précision supérieure à 76 (par ex.numeric(78, 0), utilisé pour des entiers 256 bits) versInt256dans ClickHouse au lieu d’échouer avec “Precision too big”. Les valeurs qui ne tiennent pas dansInt256sont rejetées avec une erreur explicite. #107431 (Alexey Milovidov).- Envoie une exception au client lorsque l’établissement de la TCP connection échoue. #107317 (Nikolai Kochetov).
- Les utilisateurs peuvent désormais insert des champs
FixedAvropour les variantes d’entiers 8 bits/16 bits/32 bits/64 bits. #98139 (Patrick Pichler). - Le format
AvroConfluenteffectue désormais des retries via le Confluent Schema Registry HTTP client en cas d’échecs transitoires (timeouts de transport, connexion refusée, erreurs DNS, HTTP5xx/408/429) avec un backoff exponentiel, au lieu d’abandonner l’INSERT dès le premier incident réseau. Les nouveaux settingsformat_avro_schema_registry_max_retries(par défaut5) etformat_avro_schema_registry_retry_initial_backoff_ms(par défaut100) contrôlent cette politique. Les erreurs de validation de schéma (HTTP409, JSON Avro mal formé) restent fatales. #106661 (Groene AI). - Enregistre les privileges dans
system.query_log.used_privilegespour tous les contrôles d’accès granted, y compris ceux qui passent par le chemin non bloquantisGranted(checkAccessWithFilter). Auparavant, seuls les privileges vérifiés via des points d’entrée bloquants (checkAccess/checkGrantOption) étaient enregistrés, ce qui rendaitREAD ON FILE/READ ON S3/READ ON AZURE/READ ON URLinvisibles dans le journal d’audit pourDESCRIBE,CREATE TABLE ASet les query similaires qui utilisent les table functionsfile/s3/azure/url. L’application des contrôles d’accès ne change pas. #104693 (Alexey Bakharew). - Ajout des métriques asynchrones
TotalUncompressedBytesOfMergeTreeTablesetTotalUncompressedBytesOfMergeTreeTablesSystem, qui indiquent la taille totale non compressée des données stockées dans les tables de la famille MergeTree. #106364 (Alexey Milovidov). - Ajoute l’événement de profil
GlobalMemoryLimitExceededafin que les operators puissent surveiller quand la memory limit globale du serveur est atteinte. #106466 (Sacheendra Talluri). - Renseigne les compteurs
ProfileEventsExecutableUserDefinedFunction*pour les UDFexecutable_pool. Le nombre d’invocations par appel, le temps écoulé et le temps d’attente dans le pool, l’utilisation CPU et le pic de mémoire des processus enfants, ainsi que les octets stdin/stdout sont désormais visibles danssystem.query_log.ProfileEvents. #105010 (Xu Jia) #105618 (Ilya Andreev). - Ajout des métriques asynchrones
ExecutableUserDefinedFunctionMemoryResidentBytesetExecutableUserDefinedFunctionProcesses, qui indiquent la mémoire résidente (VmRSS) et le nombre de processus actifs des fonctions définies par l’utilisateurexecutableetexecutable_pool, y compris les processus descendants et les workers inactifs du pool. #107300 (Hanzi Jiang). - Ajout de trois métriques async disponibles uniquement sous Linux —
MemoryThreadStacksCount,MemoryThreadStacksVirtualetMemoryThreadStacksResident— qui distinguent la mémoire de pile pthread du reste de la mémoire anonyme. Activées viaasynchronous_metrics_enable_heavy_metrics. Nécessite Linux 5.17+ (prctl(PR_SET_VMA_ANON_NAME)) ainsi qu’un/proc/self/smapslisible ; sinon, les métriques sont absentes et la limitation est signalée danssystem.warnings. #106230 (Raúl Marín). - Expose les métriques asynchrones
MemoryThreadStacks*(taille résidente/virtuelle et nombre de piles de threads) sur macOS. #107752 (Raúl Marín). - Les moteurs de table disposent désormais d’une documentation intégrée, consultable via les nouvelles colonnes
description,syntax,examples,introduced_inetrelatedde la tablesystem.table_engines. #106177 (Alexey Milovidov). - Les moteurs de base de données disposent désormais d’une documentation intégrée, consultable via les nouvelles colonnes
description,syntax,examples,introduced_inetrelatedde la tablesystem.database_engines. #106178 (Alexey Milovidov). - Les types de données disposent désormais d’une documentation intégrée, consultable via les nouvelles colonnes
description,syntax,examples,introduced_inetrelatedde la tablesystem.data_type_families. #106180 (Alexey Milovidov). - Les formats d’entrée/sortie disposent désormais d’une documentation intégrée, consultable via les nouvelles colonnes
description,examples,introduced_inetrelatedde la tablesystem.formats. #106181 (Alexey Milovidov). - Les combinateurs de fonctions d’agrégation disposent désormais d’une documentation intégrée, consultable via les nouvelles colonnes
description,syntax,examples,introduced_inetrelatedde la tablesystem.aggregate_function_combinators. #106185 (Alexey Milovidov). - Ajout de l’option en ligne de commande
--chimeàclickhouse-client,clickhouse-localet au client intégré. Lorsqu’une requête se termine (avec succès ou avec erreur) après avoir duré au moins N secondes, le client écrit le caractère de contrôle ASCIIBEL(\x07) sur stderr. Selon les préférences de l’utilisateur, le terminal peut alors émettre un son ou afficher un flash visuel. Activée par défaut avec un seuil de 5 secondes ; passez--chime Npour définir un seuil personnalisé ou--chime 0pour la désactiver. Résout #92718. #104545 (Groene AI). - Dans
clickhouse-client, lorsque le terminal ne prend pas en charge le collage entre crochets, les sauts de ligne d’une requête multiligne collée sont désormais intégrés au même tampon d’édition au lieu de faire passer à l’invite de continuation pour chaque ligne. La requête collée reste sous une seule invite, et les touches fléchées permettent de naviguer d’une ligne à l’autre. Il s’agit d’une amélioration au mieux, qui repose sur le comportement habituel du collage avec tampon TTY. #104299 (Alexey Milovidov). Fonctionne désormais aussi lorsque la coloration syntaxique est désactivée (--highlight 0). #106665 (Alexey Milovidov). - Ajoute un contrôle du pager à l’exécution, de type MySQL, pour
clickhouse-client/clickhouse-local. #105706 (Azat Khuzhin). clickhouse-clientrespecte désormais les terminaux non UTF-8 : lorsque l’encodage des caractères du terminal n’est pas UTF-8 (par exemple avecLANG=C), les formatsPrettyreviennent à des bordures de grille ASCII au lieu d’afficher des caractères Unicode de tracé de boîtes qui corrompraient le terminal. #106213 (Alexey Milovidov).- Assainit les chaînes d’affichage fournies par le serveur dans le traitement du paquet
Hellodeclickhouse-client(nom du serveur, fuseau horaire, nom d’affichage, patterns et messages des règles de mot de passe) afin qu’un serveur malveillant ne puisse pas injecter des octets que le client afficherait tels quels, et limite leur taille pour se prémunir contre des allocations non bornées. #105243 (Raúl Marín). - L’interface Web affiche désormais le résultat sous forme d’image lorsqu’une requête utilise un format de sortie d’image tel que
FORMAT PNG, au lieu d’afficher les octets bruts sous forme de table. #107638 (Alexey Milovidov). - Ajoute le paramètre
output_format_pretty_use_nbsp_for_paddingpour rendre les caractères de remplissage de mise en page dans les formatsPrettyde type tableau sous forme deU+00A0NO-BREAK SPACE lorsqueoutput_format_pretty_grid_charsetvautUTF-8. Cela permet à une sortiePrettycopiée de conserver l’alignement du tableau dans les outils qui compressent les espaces ordinaires. Le paramètre est désactivé par défaut, et la sortie avec le jeu de caractèresASCIIconserve les espaces ordinaires. #103559 (Ashrith Bandla). - Le script d’installation universel installe désormais aussi
clickhousectldans~/.local/binsur Linux et macOS, avec un lien symboliquechctl. DéfinissezCLICKHOUSE_ONLY=1pour l’ignorer. #105399 (Alasdair Brown). - Correction d’une erreur parasite
Syntax error: Unterminated quoted stringqui pouvait se produire de manière intermittente lors de l’installation de ClickHouse viacurl https://clickhouse.com/ | shalors qu’un binaireclickhouseexistait déjà dans le répertoire courant. #106417 (Alexey Milovidov). - Corrige la hauteur du panneau de gauche sur la page
play.htmllorsque le terminal web est ouvert, afin que le bouton de bascule du terminal en bas reste visible. #105087 (Alexey Milovidov). - Évite de sélectionner l’unique requête dans l’interface Web après son exécution. #105711 (Joey Yu).
- L’interface SQL Web agrandit désormais l’éditeur de requêtes lorsqu’une requête dépasse d’au plus 30 % la hauteur actuelle de l’éditeur. #105713 (Joey Yu).
- Dans l’interface web, disposer horizontalement les icônes du menu inférieur (Terminal web et GitHub) lorsque le panneau de gauche est déployé, afin de laisser plus d’espace vertical à la liste des bases de données et des tables. #106427 (Alexey Milovidov).
- Dans l’interface web (
play.html), la toucheEscapedésactive désormais la cellule actuellement sélectionnée dans le tableau de résultats. #107777 (Alexey Milovidov). - Améliorations du panneau des bases de données dans l’interface SQL web (Play) : une infobulle sur l’icône de la base de données, un bouton pour masquer le panneau, des noms de bases de données et de tables cliquables sur toute leur largeur, et une correction du décalage de largeur du panneau lors de l’apparition de la barre de défilement. #108013 (Alexey Milovidov).
- Ajout d’un paramètre serveur (
min_allocation_size_to_throw_on_memory_limit) pour permettre à toute allocation de leverMEMORY_LIMIT_EXCEEDED; cela devrait aider à éviter les OOM. #105265 (Azat Khuzhin). - Autoriser l’authentification
NONEpour SSH (ce qui évite de demander un mot de passe aux utilisateursno_password). #105476 (Azat Khuzhin). - Réinitialiser la liste des groupes supplémentaires dans
clickhouse suavant l’abandon des privilèges, afin d’aligner le comportement sur celui de/bin/suetsudo. Auparavant, le processus après abandon des privilèges héritait des groupes supplémentaires de l’utilisateur appelant. #105247 (Raúl Marín). - Ajout de la prise en charge de
BFloat16pour les fonctions de prédicat numériques (isFinite,isNaN). #105391 (Mohamed Hussain S). - Réduire la consommation mémoire des dictionnaires polygonaux (
polygon_index_cell,polygon_index_each) et faire en sorte quesystem.dictionaries.bytes_allocatedreflète correctement l’index de recherche qu’ils construisent. #105431 (Raúl Marín). - Corrige les consumers du Kafka table engine qui continuaient à utiliser un poll interval court après l’attribution des partitions, afin qu’ils reviennent à la valeur configurée de
kafka_poll_timeout_mset évitent des polls à vide excessifs, des parts insérées plus petites et une surcharge de merge supplémentaire après les rééquilibrages. #100431 (sugaf1204). - Identifier les colonnes par leur position (plutôt que par leur nom) lors de la suppression des colonnes inutilisées dans le query plan. Cela permet de supprimer les colonnes inutilisées même en présence de noms de colonnes dupliqués. #100586 (János Benjamin Antal).
- ClickHouse lève désormais une exception appropriée lorsqu’on tente d’utiliser
table_readonlyavec des engines répliqués, avec une meilleure gestion des exceptions pour les DDL queries (etDatabaseReplicated) liées à ce paramètre. #100950 (alesapin).OPTIMIZE TABLE ... ON CLUSTERet les autres DDL ne se bloquent plus lorsque la target table atable_readonly = 1. Le paramètre lève désormais un nouveau code d’erreur dédié,TABLE_IS_PERMANENTLY_READ_ONLY, queDDLWorkertraite comme non réessayable (contrairement àTABLE_IS_READ_ONLY, transitoire, qui survient lors de déconnexions temporaires de ZooKeeper pourReplicatedMergeTree). Le paramètretable_readonlyest également désormais explicitement rejeté pourReplicatedMergeTree, à la fois lors de la création et viaALTER MODIFY SETTING. Suite de #97652. #105109 (Alexey Milovidov). - Correction des actualisations de vues matérialisées actualisables qui pouvaient échouer avec
UNKNOWN_TABLEaprès le remplacement de la table cible (par exemple viaEXCHANGE TABLESou une suppression suivie d’une recréation) : l’actualisation résout désormais la table cible par son nom au lieu de s’appuyer sur un UUID obsolète. #102724 (Seva Potapov). - Ajout d’un paramètre
wait_for_part_commit_in_dependent_materialized_views(par défautfalse). Lorsqu’unSELECTde vue matérialisée relit sa propre table source (par exemple via unINNER JOINsur la source), la cascade pouvait manquer la ligne en cours d’insertion, car la part insérée n’est validée qu’après l’exécution des vues dépendantes. L’activation de ce paramètre valide la part avant le déclenchement des vues dépendantes, afin qu’elles voient la ligne en cours d’insertion, au prix d’un parallélisme d’insertion moindre. #105943 (Elmi Ahmadov). - Ne plus masquer les erreurs fatales (par ex.
MEMORY_LIMIT_EXCEEDED) danstryDeserialize. #106808 (Azat Khuzhin). - Vérification différée du droit
CREATE TEMPORARY TABLEdansInverseDictionaryLookupPass. #107098 (Azat Khuzhin). - Correction d’une erreur
ILLEGAL_TYPE_OF_ARGUMENTpour les requêtes distribuées avecserialize_query_plan = 1contenant une lambda avec un argument constant (par ex.arrayMap(t -> t.2, ...)). Les colonnes constantes des nœudsINPUTd’ActionsDAGsont désormais préservées lors de la sérialisation du plan de requête. #107124 (Alexey Milovidov). - La désérialisation des états des fonctions d’agrégation
contingency,cramersV,cramersVBiasCorrectedettheilsUvérifie désormais que les décomptes stockés forment une table de contingence cohérente et lève une exceptionCORRUPTED_DATAdans le cas contraire. Ferme #106899. #107185 (Nihal Z. Miaji). - Préservation des codes d’erreur d’origine pour les exceptions encapsulées dans
arrow::Status. #107267 (Azat Khuzhin). - Prise en charge de
keyed_by_normalized_query_hashpour les quotas définis dans la configuration serveur statique (users.xml), en cohérence avec la syntaxe DDL existanteCREATE QUOTA ... KEYED BY normalized_query_hash. #107654 (Alexey Milovidov). - Le paramètre de compatibilité n’applique plus les paramètres obsolètes ; ils ne sont donc plus marqués comme modifiés et ne génèrent plus d’avertissements d’obsolescence. #107737 (Maxim Orlovsky).
- Les insertions asynchrones n’enregistrent plus la liste complète des
query_idau niveautrace/debug, ce qui, depuis la version 26.2, pouvait faire explosertext_logsur les services avec un trafic important d’insertions asynchrones. Les lignes détaillées sont désormais consignées au niveautest. #107852 (Sema Checherinda). - Amélioration du cache du système de fichiers : les entrées de priorité invalidées n’épinglent plus
KeyMetadata. Suite de #106387. #107903 (Kseniia Sumarokova). - Amélioration des métriques de
FileCache. #106116 (Kseniia Sumarokova). - Ne plus afficher le préambule “Stack trace (when copying this message, always include the lines below):” dans les messages d’exception lorsque la trace de pile est en réalité vide. #106524 (Alexey Milovidov).
- Correction d’un possible débordement dans
roundUpToMultiplelors du calcul de l’alignement des limites du cache du système de fichiers pour de très grands offsets. #92579 (Bharat Nallan). EXPLAIN SYNTAXformate désormais systématiquement les opérateurs comme des appels de fonction dans la sortie d’explication (par exempleplus(1, 2)au lieu de1 + 2). #94681 (Mohamed Abdelhalim ).- Amélioration des suggestions de noms de table dans les messages d’erreur : le nom exact n’est plus proposé, et le nom de la base de données est désormais inclus dans la suggestion (par ex. “Maybe you meant
other_db.my_table?”). #95116 (Mathuranath Metivier). - Amélioration du message d’erreur pour les identifiants non résolus dans les requêtes sans clause
FROM, avec une suggestion d’en ajouter une. #101769 (Yash ). - Ajout d’une option
EXPLAIN PIPELINEpour compacter les chaînes de processeurs répétées. #104662 (Yue Ni). - Correction d’une lecture avec dépassement de tampon du tas lors de la construction d’un message d’erreur de syntaxe (
UTF8::computeWidthImplviaparseQuery.cpp), qui se produisait lorsque le parseur revenait en arrière au-delà du premier point-virgule / jeton de fin de flux ; les builds de release assemblaient alors des octets provenant de la mémoire voisine du tas dans l’erreur affichée, tandis que les builds ASan s’arrêtaient. #105086 (Groene AI). - La stratégie de partitionnement Hive devient la valeur par défaut via le paramètre de compatibilité
file_like_engine_default_partition_strategy. #86746 (Kseniia Sumarokova). - Utilisation d’une pile de thread plus grande (8 MiB) sur macOS pour s’aligner sur la valeur par défaut de Linux, ce qui corrige de rares plantages du serveur dus à un débordement de pile pendant la compilation JIT. #107033 (Raúl Marín).
- La limite de taille du stockage temporaire de
clickhouse-localn’est plus codée en dur à 1 GiB. La valeur par défaut passe à 1 TiB et peut être configurée avec le paramètre serveurmax_temporary_data_on_disk_size. #106689 (Alexey Milovidov). - Ajout de la commande
read-checksumsàclickhouse-disks. Elle lit le fichierchecksums.txtd’unMergeTreeDataPartet l’affiche sous forme de table lisible, séparée par des tabulations. #106901 (Asya Shneerson). - Ajout d’une commande
read-bitmapàclickhouse-disks. #107834 (murphy-4o). - Chdig : activation de TLS pour les connexions sécurisées (auparavant, cela entraînait soit “unknown setting
skip_verify”, soit “connection reset by peer”). #105864 (Azat Khuzhin). chdigv26.5.1. #105918 (Azat Khuzhin).chdigv26.6.1 -{asynchronous_,}metric_log, formes de requêtes, cartes de chaleur, logs/traces stockés sur disque (auparavant, cela pouvait utiliser >40GiB pour 1 heure de traces). #107678 (Azat Khuzhin).- La configuration du serveur (
programs/server/config.xml) définit désormaiskeep_alive_timeoutà 30 (au lieu de 10), en l’alignant sur la valeur par défaut effectivement documentée et implémentée. #107779 (Dan Checkoway). - La valeur par défaut du paramètre serveur
disk_connections_rcvbufest passée de0(autotuning TCP du kernel) à204800(200 KB), ce qui plafonne le tampon de réception TCP par socket pour les connexions disque de stockage objet (S3/Azure/GCS). #107859 (Sema Checherinda). - L’optimiseur
PREWHEREregroupe désormais les conjoncts qui font référence au même ensemble de colonnes avant d’estimer la sélectivité, afin que des conditions commea > 2500 AND a < 2502soient évaluées ensemble comme une plage combinée plutôt que comme deux prédicats indépendants, ce qui produit une estimation de sélectivité plus précise. #106337 (Han Fei). - Ajout d’implémentations de sockets sécurisés et non sécurisés compatibles avec silk fiber. #107680 (Miсhael Stetsyuk).
- Correction d’un message d’erreur illisible (arguments inversés) et d’une faute de frappe dans la fonction
nested. #108031 (Alexey Milovidov). - Ajout d’une commande
sedàclickhouse-disksqui applique une expression sed à un chemin donné, sur place. #107131 (Asya Shneerson). - Ajout du paramètre
materialized_postgresql_use_extended_date_and_time_types, défini au moment de la création, pour le moteur de base de donnéesMaterializedPostgreSQL. Par défaut (activé), les colonnes PostgreSQLdate/timestampsont inférées commeDate32/DateTime64; le définir à0au moment duCREATE DATABASEinfère les types plus étroitsDate/DateTime. #107428 (Alexey Milovidov).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Rend possible la suppression des detached parts avec le suffixe
tryN. #58957 (János Benjamin Antal). - Corrige une exception
MULTIPLE_EXPRESSIONS_FOR_ALIASpour les requêtes avec des alias de projection dupliqués (par exempleSELECT *, day + 365 AS day) dans des sous-requêtes imbriquées lors de l’exécution avec des répliques parallèles. #80310 (Alexey Milovidov). - Corrige un bug où
splitMultipartQueryrenvoyait une erreur “Empty query” pour les requêtes se terminant par un commentaire après un point-virgule. #85491 (Yarik Briukhovetskyi). - Corrige une exception avec les
ARRAY JOIN:Function writeSlice expects same column types for GenericArraySlice and GenericArraySink, qui se produit lorsque des types numériquesLowCardinalitysont utilisés (issue #57243). #91784 (Jimmy Aguilar Mena). - Corrige l’exception
NOT_FOUND_COLUMN_IN_BLOCKlors de l’utilisation deLIMIT BYavec des colonnes constantes en combinaison avecDISTINCTetORDER BY, avec le nouvel analyzer. #93195 (Ashrith Bandla). - Corrige la création silencieuse de colonnes
NOT NULLenNullablelorsquedata_type_default_nullable = 1et que la table est créée dans une base de donnéesReplicatedou viaON CLUSTER. #97572 (xiaohuanlin). - Corrige la stabilité de la connexion HiveCatalog en ajoutant un mécanisme de nouvelle tentative automatique et une logique de reconnexion pour gérer les erreurs TTransportException lors de la communication avec Hive Metastore. #98471 (Dmitriy Borisenko).
- Corrige la fonction
nested(utilisée en interne parARRAY JOIN) qui supprimaitLowCardinalitydes types de colonnes, ce qui faisait queArray(LowCardinality(String))devenaitArray(String)en sortie. Clôt #95582. #98974 (Yash ). - Corrige l’exception “Distributed task iterator is not initialized” lors de l’utilisation de
url,s3ou de table functions similaires dans des requêtes avec répliques parallèles activées. #100146 (Alexey Milovidov). - Corrige une exception de logical error lors de la lecture d’Iceberg tables dont la version du format a été mise à niveau par un outil externe (par ex. Spark). #100407 (Alexey Milovidov).
- Les functions
like,ilike,notLike,notILikeetmatchprennent désormais en charge un haystack constant avec une needle non constante (par ex.'foo' LIKE pattern_column), ce qui provoquait auparavantILLEGAL_COLUMN. #100479 (Yash ). - Corrige un nombre de lignes erroné renvoyé par une requête
MaterializedViewavecquery_plan_enable_optimizations = 0lorsque la vue mappe une colonne entière vers une colonneBool. #100692 (Maksim Moisiuk). - Corrige une exception (
LOGICAL_ERROR: 'PREWHERE passed to format that doesn't support it') lors de la lecture d’Iceberg tables contenant des fichiers de données ORC avec la PREWHERE optimization activée. #101206 (Groene AI). - Correction d’une condition de concurrence dans RestCatalog. #101216 (Smita Kulkarni).
- Correction de l’erreur
NOT_FOUND_COLUMN_IN_BLOCKlors d’une sélection depuis une VIEW sur une table avec une projection normale. #101218 (Amos Bird). - Correction de métadonnées obsolètes dans FileLog lorsqu’un fichier est supprimé puis recréé. #101408 (Azat Khuzhin).
- Correction d’une réorganisation des jointures qui supprimait silencieusement les lignes non appariées d’un
RIGHT/LEFT JOINlorsqu’il était joint par virgule (produit cartésien) à une autre table, par ex.t1 RIGHT JOIN t2 ON t1.c = t2.c, t3. La requête renvoyait auparavant le résultat d’une jointure interne au lieu de celui d’une jointure externe. #101684 (Groene AI). - Correction du fait que la clause
FORMATétait consommée parINSERTau lieu de s’appliquer à la sortie deEXPLAINdansEXPLAIN INSERT INTO ... SELECT ... FORMAT .... #101772 (Yash ). - Correction d’une sélection incorrecte du codec de compression pour les parts
MergeTreelorsque le paramètredefault_compression_codecau niveau de la table était explicitement configuré. Les parts écrites à l’insert, lors des merges et pour les projections utilisaient le codec par défaut global du server au lieu du paramètre défini au niveau de la table (la part vide produite par une mutation supprimant entièrement les données est désormais également couverte). #101784 (Yash ). - Rejet des valeurs
Float64négatives (par ex.-100.5) dans les workload settings commemax_bytes_per_second,max_cpus, etc. Auparavant, seuls les entiers négatifs étaient validés, ce qui permettait à des flottants négatifs de créer silencieusement des nœuds de scheduler défectueux. Résout #101825. #101842 (Groene AI). - Correction d’une
LOGICAL_ERROR(“Port is not connected”, code 49) qui pouvait survenir lors de l’exécution de requêtes impliquant une VIEW avec agrégation dans un JOIN. #102574 (Jimmy Aguilar Mena). - Correction de métadonnées de part incohérentes après des mutations sur des colonnes avec des serializations non par défaut. #102817 (Eduard Karacharov).
- Correction d’un problème où la mise à jour des métadonnées avant l’exécution d’une mutation permet de résoudre #96806. #102882 (Smita Kulkarni).
- Correction d’un problème où les requêtes SELECT étaient nettement plus lentes lorsque des
INSERTconcurrents étaient en cours d’exécution. Auparavant, un pipelineINSERTréservait des CPU slots jusqu’àmax_threadsau démarrage de la requête, même lorsque la plupart des slots n’étaient jamais utilisés, ce qui privait de ressources les SELECT concurrents. L’allocation des CPU slots est désormais pilotée par la demande : le pipeline ne demande des slots qu’au moment où il exécute réellement du travail parallélisable. Cela s’applique à la fois au contrôle de la concurrence et au scheduler CPU préemptif pour les workloads. Le nouveau server settingconcurrent_threads_lazy_allocation(par défauttrue) sert de mécanisme de rollback. #102928 (Seva Potapov). - Correction de la propagation de
NULLlors de la lecture de sous-colonnes extraites de colonnesNullable(Tuple(...)). Par exemple, pourtup Nullable(Tuple(s Nullable(String))),SELECT tup.srenvoie désormais correctementNULLdans les lignes où le tuple externe estNULL, au lieu de valeurs parasites. Cela couvre tous les types d’élément pouvant représenterNULL:Nullable,Dynamic,VariantetLowCardinality(Nullable(...)). Clôture #105356. #102942 (Nihal Z. Miaji). - Renvoie désormais
INCORRECT_DATAau lieu deLOGICAL_ERRORlorsque les données fournies par le client au format Native sont tronquées ou mal formées. #102975 (János Benjamin Antal). - Ajout d’une vérification d’annulation à l’opération de lecture d’ObjectStorage. Clôture #98165. #103016 (Smita Kulkarni).
- Prise en compte de
input_format_binary_max_type_complexitylors du décodage des paramètres de fonctions d’agrégation. Clôture #102903. #103026 (Pavel Kruglov). - Correction de l’inférence de nullabilité pour les colonnes geo dans le lecteur Parquet basé sur Arrow. Clôture #101845. #103032 (Pavel Kruglov).
- Correction de
recursiveRemoveLowCardinality, qui effaçait les noms personnalisés des types geometry (par ex.LineStringvsRing,MultiLineStringvsPolygon), ce qui entraînait une mauvaise interprétation du type geometry. Clôture #103207. #103041 (Joanna Hulboj). - Correction d’un problème où
input_format_max_block_size_bytesétait silencieusement ignoré lors de l’analyse deINSERTlorsquemax_insert_block_size_bytesvaut0(valeur par défaut). Ce paramètre limite désormais correctement la taille des blocs produits par les formats d’entrée orientés lignes. #103068 (Kirill Kopnev). - Correction d’un problème où ClickHouse produisait parfois des tokens GSSAPI invalides en raison d’une suppression incorrecte des octets nuls de fin. #103114 (Michael Jarrett).
- Correction du repliement de constantes au niveau de l’analyseur pour les fonctions à court-circuit (
if,multiIf,and,or, etc.), afin que les branches statiquement inatteignables ne lèvent plus d’exceptions au moment de l’analyse. Par exemple,WITH 0 AS n SELECT multiIf(n = 0, 0, intDiv(100, n))renvoie désormais correctement0au lieu d’échouer avec une erreur de division par zéro. #103157 (Peng). EXPLAIN SYNTAXdéveloppe les vues paramétrées. #103263 (Jordi Villar).- Correction d’une corruption de données lors de l’écriture de fichiers Parquet (et d’autres formats avec pied de page, comme ORC et Arrow) vers HDFS via
INSERT INTO FUNCTION hdfs(...). Depuis la version 26.1,WriteBufferFromHDFSne vidait pas son tampon de travail lors definalize(), si bien que jusqu’auxDBMS_DEFAULT_BUFFER_SIZEderniers octets de chaque fichier étaient silencieusement perdus, y compris le pied de pagePAR1de Parquet. La lecture de tels fichiers renvoyaitNot a Parquet file (wrong magic bytes at the end of file). #103268 (Groene AI). - Corrige des résultats erronés et une possible erreur logique pour les sous-requêtes corrélées lorsqu’une limite de taille de jointure (
max_rows_in_join/max_bytes_in_join) est définie avecjoin_overflow_mode = 'break'. La jointure créée en interne pour évaluer une sous-requête corrélée ignore désormais ces limites utilisateur, et ne peut donc plus s’arrêter prématurément ni supprimer des lignes. #103322 (Groene AI). - Corrige un bogue où
ALTER TABLE ... MODIFY SETTINGsur une tableEmbeddedRocksDBpouvait enregistrer une valeur de paramètre invalide dans le fichier de métadonnées de la table, même lorsque le serveur rejetait la requête. Au redémarrage suivant du serveur, la table ne pouvait plus être attachée à cause deCANNOT_PARSE_BOOL(ou d’une erreur d’analyse similaire) et, dans les bases de données où les échecs de chargement sont fatals, le serveur refusait de démarrer. Les valeurs de paramètre invalides sont désormais rejetées avant toute écriture des métadonnées. #103417 (Groene AI). - Corrige un arrêt brutal du serveur lors de la création d’une table avec un moteur de stockage sur object storage (
AzureBlobStorage,DeltaLakeAzure,S3,HDFS) utilisant un nombre d’arguments non pris en charge. Le serveur renvoie désormais une erreurNUMBER_OF_ARGUMENTS_DOESNT_MATCHexplicite au lieu de s’interrompre dans les builds debug/sanitizer. #103544 (Groene AI). - Corrige un plantage du serveur lors de l’analyse des paramètres des types de données
JSONetDynamiclorsque l’arbre syntaxique abstrait (AST) était structurellement mal formé (par exemple produit par l’AST fuzzer) : l’expression de paramètreequals(name, value)pouvait se retrouver avec moins de deux enfants, queDataTypeObjectetDataTypeDynamicdéréférençaient alors sans vérification des limites. #103545 (Groene AI). - Corrige des erreurs logiques dans l’analyzer en cas de collision de noms de colonnes dans une lambda utilisée dans
PREWHERE. Clôt #103584. #103627 (Pavel Kruglov). - Corrige l’erreur sporadique
Logical error: 'Database <name> not found'provenant deDataLakeConfiguration::getCataloglorsqu’une table avec moteurIcebergest chargée dans une base de données classique pendant le chargement asynchrone des métadonnées. #103775 (Groene AI). - Corrige les erreurs
MULTIPLE_EXPRESSIONS_FOR_ALIASrenvoyées par des répliques distantes lors de l’exécution de requêtes qui référencent des alias de projection dansPREWHERE/WHERE/HAVING/QUALIFY(par ex.SELECT x AS a, y AS b, (a AND b) AS c FROM t PREWHERE c) ou de requêtesSELECT *sur des auto-jointures avec des noms de colonnes en conflit, avec des répliques parallèles etparallel_replicas_local_plan = 0. Clôt #74324. #103806 (Groene AI). - Corrige un arrêt brutal du serveur lorsqu’une requête utilise des comparaisons imbriquées
coalesce/ifNull(par ex.WHERE coalesce(a, b, coalesce(c, d), e) = const) sur une tableMergeTreeavec plusieurs skip indexesminmaxetuse_skip_indexes_for_disjunctions = 1. La réécriture par skip index de<op>(coalesce(...), const)est désormais appliquée récursivement aux arguments internes decoalesce, de sorte que la RPNKeyConditionde chaque index corresponde à celle du modèle, comme le suppose déjà le code de suivi des disjonctions. #103929 (Groene AI). - Correction d’un problème où
max_rows_to_transferetmax_bytes_to_transferétaient silencieusement ignorés pour les requêtesGLOBAL INetGLOBAL JOINavec le nouvel analyseur. Les paramètres lèvent désormaisSET_SIZE_LIMIT_EXCEEDED(ou interrompent l’exécution, selontransfer_overflow_mode) lorsque la table externe matérialisée dépasse la limite configurée, conformément au comportement de l’ancien analyseur. Clôt #103333. #104119 (Groene AI). - Correction de lectures excessives de métadonnées de catalogue/S3 lorsqu’une instruction
INSERTou DDL référence une table inexistante dans une base de données de catalogue DataLake avecshow_data_lake_catalogs_in_system_tablesactivé. Le mécanisme de suggestion en cas de faute de frappe chargeait l’intégralité des métadonnées Iceberg de chaque table pour tout le catalogue, ce qui pouvait épuiser la mémoire sur les grands catalogues. #104124 (DQ). - Correction d’un plantage (
LOGICAL_ERROR“Columns are assumed to be of identical types, but they are different in Nullable” dans les builds de débogage, un SIGSEGV dû à un pointeur nul dansColumnString::compareAtdans les builds de release) et d’un résultat erroné pouvant se produire dans des requêtes utilisantdirectjoin_algorithmavec une tableMergeTreeà droite, lorsque le plan de requête réordonnait les colonnes pendant l’optimisation. Les colonnes du côté droit pouvaient se retrouver dans des emplacements associés à de mauvais noms, de sorte qu’un filtre ou une comparaison sur la clé de jointure voyait une colonne du mauvais type. Problème révélé par AST fuzzer sous l’identifiant STID 2139-5111 et signalé dans #107272. #104174 (Groene AI). - Rejet d’un identifiant de partition entier hors plage pour
Date, au lieu d’un overflow silencieux ou d’uneLOGICAL_ERRORlors deALTER. #104250 (Azat Khuzhin). - Désactivation de
additional_table_filtersavec les répliques parallèles et l’analyseur, en l’absence de sérialisation du plan de requête. Auparavant, cela pouvait conduire à des résultats incorrects. #104296 (Azat Khuzhin). - Correction de
dictGetOrNull, qui écrasait silencieusement les autres colonnes de la projectionSELECTavecNULLlorsqu’il était appelé avec une colonne de cléNullabledont les valeurs sont absentes du dictionnaire. La fonction modifiait sur place une null map aliasée en entrée ; elle effectue désormais un clonage profond de la colonne de résultat avant la mutation. Clôt #73633. #104327 (Groene AI). - Correction d’une patch part corrompue après
ALTER TABLE ... DROP PARTITION ID 'patch-...', suivi deDETACH/ATTACH TABLE. Auparavant, la part de couverture vide était écrite sanspartition.datnisource_parts.dat, ce qui entraînait une entréebroken-on-start_patch-...danssystem.detached_partsaprès l’attachement suivant ou le redémarrage du serveur. Clôt #93132. Clôt #102103. #104353 (Groene AI). - Correction de
INSERTen streaming avecinput_format_max_block_wait_mspour l’interfaceHTTPet pourINSERT SELECT FROM input, afin que les blocs d’entrée partiels soient vidés avant la fin de la requête. #104534 (Alexey Milovidov). - Correction d’un bug où des requêtes combinant
arrayJoinavecORDER BY ... LIMITaprès unJOINpouvaient renvoyer silencieusement zéro ligne. L’optimisation du query plan qui remonte l’évaluation d’une fonction au-dessus deSortingStepne s’applique plus lorsque l’expression remontée contientarrayJoin, cararrayJoinpeut modifier le nombre de lignes. Clôture #82279. #104558 (Groene AI). - Correction d’un arrêt brutal rare du server lors de la destruction d’une table de la famille
MergeTree. L’arrêt pouvait se produire lorsqueshutdownlevait une exception avant que le scheduler de tâches en arrière-plan ne soit complètement arrêté : une tâche en arrière-plan se déclenchant dans cet intervalle très bref pouvait dispatcher un appelvirtualvia un objet de stockage partiellement détruit et déclencher__cxa_pure_virtual. #104561 (Groene AI). - Correction d’un résultat incohérent dans une subcolumn combinée
JSONavec un type hint contenant une valeur nulle. #104584 (Pavel Kruglov). - Correction de résultats erronés ou d’une projection non utilisée lorsqu’une projection agrégée contient plusieurs agrégats
sumIfavec des conditionsIN (...)différentes. #104765 (Jimmy Aguilar Mena). - Correction d’un nombre de lignes erroné provenant de
arrayJoin()utilisé dansJOIN ON: le résultat était multiplié une fois de trop par la longueur du tableau. #104785 (Shaohua Wang). - Correction de
deltaSumTimestamp, qui renvoyait des résultats erronés pour des types entiers signés passant par zéro. Résout #104750. #104830 (Konstantin Bogdanov). - Correction d’une incompatibilité de structure de bloc dans UnionStep après une descente de filtre avec des constantes NULL. Clôture #104821. #104853 (Pavel Kruglov).
- Correction de
Logical error: 'Metadata is not initialized'levée parDELETE FROMsur une tableIceberg,DeltaLakeouHudifraîchement attachée dont le metadata file est corrompu ou impossible à charger. Une exception standard visible par l’utilisateur est désormais renvoyée à la place, et le server continue de fonctionner. Clôture #104891. #104917 (Groene AI). - Correction du fait que
max_memory_usage_soft_limitn’était pas mis à jour on-the-fly lorsque la configuration changeait. La soft memory limit était calculée une seule fois au démarrage puis mise en cache, si bien que les rechargements ultérieurs de la config n’avaient aucun effet. Après cette correction, la limite est recalculée et appliquée immédiatement à chaque rechargement de config, sans nécessiter de redémarrage de Keeper. #104940 (Kai Zhu). - Correction de la résolution des symboles JIT sur macOS afin que la compilation JIT de sort, expression et aggregate n’échoue plus avec
CANNOT_COMPILE_CODE: Could not find symbol _<name>. #104946 (Alexei Fedotov). - Correction d’une exception (
Received signal 6 (abort)dans le durcissement des vecteurs, observable sous la forme deTuple::back()sur un vecteur vide) lors de l’exécution d’une query de la formeSELECT ... FROM <Distributed table> WHERE/HAVING/GROUP BY ... (sharding_key_column IN tuple())avecoptimize_skip_unused_shards_rewrite_inactivé sous le nouvel analyzer. #104966 (Alexey Milovidov). - Correction d’un arrêt du serveur
Logical error: 'Inconsistent AST formatting'(STID 1941-1bfa) sur des requêtes commeCREATE TABLE t (c0 Int CODEC(not((not(materialize(1), materialize(2)))), ZSTD)) ENGINE = Memorydans les builds de débogage / avec sanitizers. Le formateur n’émet plus de parenthèses externes redondantes autour d’un appel à la fonctiontuple(...)à plusieurs arguments apparaissant dans les listes d’arguments deCODEC/STATISTICS/BACKUP_NAME(où la forme opérateur(a, b)est désactivée), ce qui préserve la stabilité de l’aller-retour format-analyse-format. #104991 (Groene AI). - Correction de
NOT_FOUND_COLUMN_IN_BLOCKlevée parALTER TABLE ... MATERIALIZE INDEXsur des parts créées en 25.8 et contenant un skip index sur une colonne ajoutée via unALTER TABLE ... ADD COLUMNdistinct. La mutation lit désormais correctement toutes les colonnes requises par chaque skip index et projection préexistants sur la part lors du recalcul forcé. Clôt #104872. #105039 (Groene AI). - Correction de deux cas de
LOGICAL_ERROR: Reading from materialized CTE 'X' before it has been materializedlevés par des requêtes avecenable_materialized_cte: (1) un materialized CTE réutilisé filtré parIN (subquery)sur un autre materialized CTE, et (2) un materialized CTE référencé à la fois directement et dans un filtreWHERE ... IN (...)qui atteint une primary key MergeTree via une sous-requêteINimbriquée.EXPLAINsur les mêmes requêtes était également affecté, car les bogues se déclenchaient pendant l’optimisation du plan. Clôt #101940, clôt #102320. #105041 (Dmitry Novik). - Correction de l’estimation de la sélectivité
PREWHEREdes statistiquescountminpour les colonnesFloat32. Deux bogues faisaient que les statistiquescountminproduisaient silencieusement des estimations erronées pour les colonnesFloat32:ConditionSelectivityEstimatorignorait complètement les statistiques lorsque le type de la colonne (Float32) était plus étroit que le type du littéral (Float64), revenant à la sélectivité par défaut et ignorant le sketch ; etStatisticsCountMinSketch::estimateEqualhachait les N premiers octets d’un objetField, maisFieldstockeFloat32commeFloat64(NearestFieldType<Float32>=Float64), de sorte que le motif d’octets utilisé au moment de la requête différait des octetsFloat32réellement stockés lors du build. #105047 (Han Fei). - Les requêtes
ATTACH TABLE name <clauses>;qui fournissent des clauses de stockage (ORDER BY,PARTITION BY,PRIMARY KEY,SAMPLE BY,TTL,UNIQUE KEYou lesSETTINGSde l’engine) sansENGINElèvent désormaisBAD_ARGUMENTSau lieu de rattacher silencieusement la table avec sa définition stockée et d’ignorer les clauses fournies par l’utilisateur. LesSETTINGSde session au niveau de la requête (commelog_comment) sont toujours appliqués. UtilisezATTACH TABLE t;pour rattacher la table avec les métadonnées stockées, ouALTER TABLE t MODIFY SETTING ...aprèsATTACHpour modifier les settings. #105068 (Groene AI). - Correction d’un use-after-free dans
runningAccumulatelorsqu’il est appelé sur une colonne dont la fonction d’agrégation renvoie son propre état (par ex.uniqStateOrDefaultState,sumStateOrDefaultState,uniqStateForEachState). #105085 (János Benjamin Antal). - Correction d’un bogue dans l’UI Web (
play.html) : l’exécution d’une requête alors que le curseur se trouvait après l’unique;final signalait “empty query” au lieu d’exécuter la requête. #105107 (Alexey Milovidov). - Correction de
LOGICAL_ERROR: 'No user in current context, it's a bug'lorsqu’unCREATE TABLE ... AS SELECTà l’intérieur d’une base de donnéesReplicatedlit depuissystem.current_rolesousystem.enabled_roles. La requête aboutit désormais et renvoie un ensemble de résultats vide dans ce contexte interne de worker DDL. #105150 (Groene AI). - Correction de
ILLEGAL_TYPE_OF_ARGUMENTlors de la fusion des états d’agrégationquantileExactWeightedInterpolated,quantileDDouquantilePrometheusHistogramavec leurs équivalents au plurielquantilesXxxMerge(et inversement). Les variantes au singulier et au pluriel de ces trois familles de quantiles partagent le même état d’agrégation interne, mais n’étaient pas répertoriées dans la table interne de correspondance des noms. La fusion d’états entre fonctions — ainsi que l’optimisation de fusion de fonctions pour ces familles — était donc rejetée. #105189 (Groene AI). - Correction de résultats incorrects de
toStartOfWeek,toLastDayOfWeek,toMonday,toStartOfMonth,toLastDayOfMonth,toStartOfQuarterettoStartOfYearpour des argumentsDate32etDateTime64dont le résultat sort de la plageDate: au lieu de déborder vers des dates arbitraires, les résultats antérieurs à1970-01-01sont désormais limités à1970-01-01, et les résultats postérieurs à2149-06-06à2149-06-06. Cela corrige également des résultats de requête erronés (parts et granules incorrectement élaguées) lorsque de telles fonctions étaient utilisées dansWHEREsur une cléDate32ouDateTime64contenant des valeurs hors plage. #105244 (Yarik Briukhovetskyi). - Correction d’une erreur logique dans
arrayRemovelorsque le premier argument est un tableau deVariantdont les alternatives sont toutes incompatibles avec le type du second argument et quevariant_throw_on_type_mismatchest désactivé. La fonction traite désormais la comparaison comme “jamais égale” et renvoie le tableau inchangé au lieu de déclencher un échec deassertTypeEqualitycôté serveur. #105248 (Groene AI). - La requête peut désormais s’exécuter avec succès même si
FileCachene parvient pas à créer certains répertoires sur le disque pour la mise en cache. #105250 (Den Kalantaevskii). - Correction d’un arrêt du serveur avec
Assertion 'px != 0' faileddansExtremesTransformlorsqu’une requête avecextremes = 1rencontre une exception (par exempleMEMORY_LIMIT_EXCEEDED) alors que la transformation construit ses colonnes d’extrêmes à partir du premier bloc. Le client reçoit désormais l’exception d’origine au lieu de faire planter le serveur. #105264 (Groene AI). LEFT ANTI JOINrenvoie désormais correctement la colonne de clé de jointure du côté droit avec des valeurs par défaut pour les lignes sans correspondance, au lieu de dupliquer la valeur de clé de gauche. Auparavant,SELECT a.x AS l, b.x AS r FROM a LEFT ANTI JOIN b ON a.x = b.xpouvait renvoyerr = a.xpour les lignes sans correspondance alors qu’il devait renvoyer la valeur par défaut (0pourInt32,''pourString,NULLpourNullable). Seule la colonne de clé de jointure était affectée ; les colonnes non clés du côté droit recevaient déjà correctement leurs valeurs par défaut. Le même bogue apparaissait dansRIGHT ANTI JOINchaque fois que l’optimiseur inversait les côtés. Clôt #99959. #105278 (Groene AI).- Corrige une perte de données dans
clickhouse-locallorsqu’il est redémarré à plusieurs reprises avec un--default_databaseautre quedefault(par exempleclickhouse-local --path X -- --default_database=mydb) : la recherche de l’UUID persisté de la base de données était codée en dur surmetadata/default, si bien qu’un nouvel UUID était généré à chaque redémarrage et que les tables de l’exécution précédente devenaient invisibles. Clôt #101831. #105284 (Groene AI). - Corrige une erreur logique
Mutation ofMemorytable produced incomplete outputdéclenchée lors de l’exécution deALTER TABLE <memory_table> APPLY PATCHESouALTER TABLE <memory_table> APPLY DELETED MASK. Les tablesMemoryne possèdent ni patch parts ni masques de suppression ; ces deux commandes sont donc désormais correctement traitées comme des opérations sans effet. #105286 (Groene AI). - Corrige les requêtes longues avec Unity Catalog en transmettant un paramètre
table_iddans la requête. #105303 (Konstantin Vedernikov). - Corrige
CANNOT_CONVERT_TYPEpourMergesurMergesurDistributedavecdistributed_group_by_no_merge=1. #105330 (Azat Khuzhin). - Corrige le fait que
clickhouse localetclickhouse clientignoraient silencieusement--query/-qlorsqu’un argument de fichier positionnel était également fourni. Les deux formes produisent désormaisBAD_ARGUMENTSde manière cohérente. #105334 (Raúl Marín). - Corrige le fait que
REPLACE TEMPORARY TABLEcréait silencieusement une nouvelle table lorsque la cible n’existait pas. L’instruction génère désormaisUNKNOWN_TABLE, conformément à la sémantique deREPLACE TABLE. UtilisezCREATE OR REPLACE TEMPORARY TABLEpour conserver le comportement create-or-replace. #105373 (Groene AI). - Corrige l’échec de lectures longues (par ex.
INSERT ... SELECT) depuis une base de donnéesDataLakeCatalogaveccatalog_type = 'glue', avec une erreurExpiredTokenune fois les credentials de session AWS STS capturés au chargement des métadonnées de la table arrivés à expiration. Les credentials AWS STS sont désormais actualisés en cours de requête, de sorte que ces lectures se poursuivent après l’expiration du token. #105381 (Pratima Patel). - Corrige une erreur logique avec
LIMIT BYnégatif dans certains cas lorsqu’il est utilisé avecARRAY JOIN. #105403 (Nihal Z. Miaji). - Corrige la surévaluation de
read_bytes(ainsi que des octets/s dérivés affichés danssystem.query_log, la barre de progression, etc.) lors de la lecture de Parquet files. L’implémentation précédente signalait la taille compressée totale du row group à chaque bloc, si bien que la lecture de K colonnes sur N était surcomptée d’un facteurN / K. Le total est désormais calculé uniquement sur les colonnes sélectionnées. Corrige également le suivi de progression au niveau du fichier pour les Iceberg tables, qui auparavant ne signalait jamais la taille du fichier de données. #105413 (Groene AI). - Corrige un segfault possible du serveur dans les cluster table functions (
s3Cluster,urlCluster,fileCluster, …) lorsque le planificateur produit unSELECTavec l’indicateurrecursive_withactivé mais sans expressionWITH. Clôt #105370. #105433 (Groene AI). - Corrige un résultat incorrect de
countDistinct/uniqExactsur des colonnesNullablelorsquecount_distinct_optimization = 1(le groupe NULL était compté à tort). #105439 (Raúl Marín). - Correction d’un heap-buffer-overflow lors de la lecture de fichiers Arrow ou ArrowStream avec des offsets intermédiaires corrompus dans une colonne binaire ou de type chaîne, ainsi que d’un déréférencement de pointeur nul lors de la lecture de colonnes Arrow géolocalisées. #105449 (Raúl Marín).
- Validation des types
Dynamic/Variantdans la windowPARTITION BY; cela n’était auparavant pas vérifié lorsqueallow_suspicious_types_in_group_byest désactivé. Clôture #105028. #105450 (Pavel Kruglov). - Correction du non-fonctionnement de
input_format_json_empty_as_defaultdans les formats JSONStrings*. Clôture #104913. #105453 (Pavel Kruglov). - Correction de l’insert de
NULLdans une colonneVariantvia le formatVALUESlors de l’analyse des expressions. Clôture #104909. #105455 (Pavel Kruglov). - Correction de
dictGetOrDefault, qui levaitCANNOT_INSERT_NULL_IN_ORDINARY_COLUMNlorsque l’argument par défaut est une expressionNullableet queshort_circuit_function_evaluationest activé, avec un mélange de clés de dictionnaire trouvées et introuvables. #105461 (Raúl Marín). - Correction de la troncature silencieuse de valeurs dans les colonnes
Dynamiclorsque le reader de texteQuoted(Values) bascule versStringpour des types inférés incomplets commeMap(Array(Nothing), ...). Auparavant, ce mécanisme de repli entourait le field brut par une concaténation naïve de'...', si bien qu’une apostrophe interne (toujours présente dans ce type de repli) fermait prématurément la chaîne entre guillemets et faisait perdre le reste de la valeur. #105463 (Groene AI). - Correction d’un SIGSEGV lors de la lecture de subcolumns
Dynamicdepuis une tableMemorycompressée aprèsALTER. Clôture #104901. #105464 (Pavel Kruglov). - Correction de
toFloat64/toUInt32/toString/etc. surDynamic, qui ignoraitcast_keep_nullable. Clôture #104789. #105467 (Pavel Kruglov). - Ajout de
skip_first_linesà la clé de cache du schéma pour les formatsWithNames. Clôture #104527. #105469 (Pavel Kruglov). - Correction d’un segfault du server dans
uniqStateOrNull/uniqStateOrDefault/uniqOrNullState(et des chaînes de combinators similaires suruniq) lorsqu’ils sont utilisés avecGROUP BY ... WITH ROLLUP,WITH CUBEouWITH TOTALSet un argumentNullable. #105470 (Groene AI). - Correction de l’exception
NOT_FOUND_COLUMN_IN_BLOCKlors de l’utilisation combinée deORDER BY ... WITH FILL INTERPOLATEetLIMIT N BYavec l’analyseur activé. Clôture #103474. #105481 (Yakov Olkhovskiy). - Correction de
toStartOfMillisecondettoStartOfMicrosecond, qui renvoyaient un résultat décalé de près d’une seconde pour les valeursDateTime64négatives (antérieures à l’époque Unix), ainsi que du signed-integer-overflow signalé parUndefinedBehaviorSanitizerdanstoStartOfSecond,toStartOfMillisecondettoStartOfMicrosecondpour des entréesDateTime64proches deINT64_MIN. #105482 (Groene AI). - Ajout d’un nouveau paramètre de compatibilité
analyzer_compatibility_prefer_alias_over_subcolumn(désactivé par défaut). Lorsqu’il est activé, le nouvel analyseur privilégie l’interprétation par préfixe d’alias plutôt que les correspondances avec des sous-colonnesTuple/ des colonnes à notation pointée pour les identifiants en plusieurs parties, rétablissant ainsi le comportement de l’interpréteur précédent. Cela évite les erreursAMBIGUOUS_IDENTIFIER(et apparentées) lorsqu’une requête joint une table dont le nom correspond à une table interne d’une CTE/sous-requête utilisantSELECT *sur une jointure, où des colonnes renommées via l’astérisque (par ex.b.id) feraient sinon fuiter les identifiants de la table interne dans la portée externe. #105491 (Vladimir Cherkasov). - Une requête de recherche vectorielle exécutée avec l’optimisation index only renvoie désormais la valeur correcte pour
L2Distance()si elle figure dans la listeSELECT. La fonction renvoyait à tort la valeur de distance L2-squared. Notez que la requête de recherche vectorielle renvoyait bien les résultats dans le bon ordre ; seules les applications récupérant et interprétant explicitement la valeurL2Distance()voyaient la valeur au carré. #105495 (Shankar Iyer). - Correction d’un problème rare dans le nouveau moteur de table Kafka, où les messages pouvaient être traités incorrectement lors de la réattribution des partitions d’un topic, ce qui pouvait entraîner des messages ignorés après un rollback d’offset. #105500 (János Benjamin Antal).
- Correction d’une exception (
Trying to execute PLACEHOLDER actionerreur logique) lorsqu’une CTEMATERIALIZEDdont le corps est une sous-requête corrélée est utilisée comme opérande droit deIN. Une telle CTE est désormais rejetée au moment de l’analyse, de façon cohérente avec le fait que le même motif est déjà rejeté lorsque la CTE est référencée directement dansFROM. #105518 (Groene AI). - Correction de la compression stdout/stdin qui n’était pas appliquée lorsque le format était explicitement spécifié. Closes #104441. #105528 (Pavel Kruglov).
- Correction d’un segfault dans la désérialisation de
singleValueOrNullpour le typeJSON. Closes #103630. #105535 (Pavel Kruglov). - Correction de
clickhouse-format --backslash, qui supprimait silencieusement les donnéesINSERTVALUES. Closes #103533. #105536 (Pavel Kruglov). - Correction de
variant_throw_on_type_mismatch/dynamic_throw_on_type_mismatch=false, qui n’interceptait pas les exceptions pendant l’exécution de la fonction. Closes #103484. #105543 (Pavel Kruglov). - Correction du fait que
input_format_try_infer_datetimesétait ignoré lors de l’insertion dans des données partagées enJSON. Closes #103221. #105544 (Pavel Kruglov). - Correction de
histogram, qui produisait des résultats incorrects pour de petites entrées non triées. Closes #103109. #105548 (Pavel Kruglov). - Correction du retour circulaire de
DateTimepour les valeurs hors plage dansJSONExtractet lors des désérialisations de texte. Closes #103094. #105551 (Pavel Kruglov). - Correction de l’utilisation de la table d’insertion dans les fonctions de table lorsque
optimize_trivial_insert_selectest activé. Closes #103083. #105555 (Pavel Kruglov). - Correction de l’expression
CASE, qui renvoyait la brancheELSEau lieu duTHENcorrespondant lorsque l’expression et une valeurWHENétaient toutes deuxNULL. #105556 (Raúl Marín). - Correction d’un crash dans
replxxprovoqué par l’atteinte de la limiteFD_SETSIZEdeselect(désormais remplacé parpoll). Auparavant, avec SSH ou le terminal Web activé, cela pouvait faire planter le serveur. #105559 (Azat Khuzhin). - Matérialisation des sous-colonnes dans
executePartitionByExpressionavant l’exécution de l’expression. Closes #103057. #105573 (Pavel Kruglov). - Correction de l’exception
NOT_FOUND_COLUMN_IN_BLOCKlorsqu’une expressionTTLfait référence à une sous-colonne. #105578 (Pavel Kruglov). - Correction d’un crash du serveur (SIGSEGV), exploitable par tout utilisateur disposant des droits
CREATE TABLE, lors de l’envoi deCREATE TABLE ... TO INNER UUID '...'sans clauseENGINEvia HTTP ou le protocole natif. Le même bug faisait également planter le client. Le parser signale désormais une erreurBAD_ARGUMENTSappropriée au lieu de déréférencer un pointeur nul. #105579 (Groene AI). - Correction de la perte des données accumulées entre les lignes par la fonction de fenêtre
estimateCompressionRatio. Closes #101738. #105581 (Pavel Kruglov). - Correction d’un crash lors de l’insertion de tuples de tailles différentes dans la même clause VALUES dans une colonne
String. Closes #101727. #105582 (Pavel Kruglov). - L’extraction des valeurs de partition Hive respecte désormais le paramètre
cast_string_to_date_time_modeet accepte par défaut les timestamps ISO 8601 avec suffixes de fuseau horaire (p. ex.+0000,+00:00,Z) dans les clés de partition. #105584 (Alexey Milovidov). - Correction de l’erreur
NOT_IMPLEMENTEDsurtoStringà partir deDateTimeavec un Timezone contenant une valeurNULL. Closes #103712. #105587 (Yarik Briukhovetskyi). - Correction d’une lecture hors limites lors de la désérialisation Native d’une colonne
Dynamicaplatie. #105666 (Pavel Kruglov). - Corrige un
LOGICAL_ERROR(Unexpected return type from if) déclenché pendant la planification de la requête pour des expressionsifdont le type de résultat estVariantet dont la deuxième ou la troisième branche est unifà condition constante sur un littéralUInt64pouvant tenir dans unInt64. Clôt #105649. #105680 (Groene AI). - Corrige des résultats erronés lors de la lecture d’une table Iceberg avec
iceberg_use_version_hint = 1après qu’un autre writer (comme la table functionicebergLocal/icebergS3), sans ce paramètre, a fait avancer la table.version-hint.textest désormais maintenu synchronisé par chaque writer dès lors que le fichier existe, de sorte que les lecteurs suivants utilisant l’indice voient le dernier snapshot. #105682 (Groene AI). - Corrige un sous-comptage silencieux dans les requêtes
SELECTlorsqueuse_query_condition_cache = 1(par défaut). Une requête de la formePREWHERE pk_prefix = X WHERE non_pk IN (...)sur une colonne avec un bloom-filter skip index empoisonnait leQueryConditionCachepour le prédicatpk_prefix = X, de sorte qu’une requête bénigne ultérieureSELECT count() ... WHERE pk_prefix = Xrenvoyait un résultat incorrect, sous-compté. Affectait toutes les releases 26.x. #104781. #105686 (Groene AI). - Corrige
singleValueOrNullMerge, qui renvoyait une valeur concrète au lieu deNULLlors de la fusion d’un état ayant déjà observé plusieurs valeurs distinctes. #105734 (Minh Vu). - Corrige la récupération après erreur du input format
Templateaprès des lignes malformées. #105735 (Yue Ni). - Corrige un plantage dans la table function
mongodb, le stockage MongoDB et la dictionary source MongoDB lorsque le nom de la collection est vide ou contient des octets NUL. #105776 (Raúl Marín). - Corrige le nettoyage des snapshots
Keeperaprès des writes échouées afin que les snapshots partiels soient nettoyés en toute sécurité et que les writes échouées puissent être retentées sans faire avancerlatest_snapshot_meta. #105779 (Antonio Andelic). - Corrige le rejet de
ALTER TABLE ... CLEAR COLUMNpour les colonnescolumns_to_sumexplicites deSummingMergeTreeetCoalescingMergeTree. #105785 (Antonio Andelic). - Corrige une assertion dans
DatabaseCatalog::tryGetDatabase(et l’erreurUNKNOWN_DATABASEqui en résultait dans les builds de release) lors de la création d’une parameterized view dont le nom de la database est fourni via un query parameter, par exempleCREATE VIEW {db:Identifier}.v AS SELECT {p:UInt64}. Les Parameters dans les parties DDL de l’instructionCREATEsont désormais substitués au moment de la création, tandis que les paramètres dans le corps duSELECTrestent disponibles pour substitution au moment de l’appel de la vue. #105799 (Groene AI). - Corrige
Bad get: has Decimal32, requested Decimal128danssumMapetsumMapWithOverflowsur une colonneNested(... Nullable(Decimal(P, S)))lorsque l’aggregate state est sérialisé (par ex. parallel replicas,sumMapStatevia un formatter d’état binaire, external aggregation). #105816 (Groene AI). - Correction des erreurs
Expected ColumnLowCardinality, got String/Bad cast from type DB::ColumnString to DB::ColumnLowCardinalitylorsqueapply_mutations_on_fly = 1est utilisé sur une table avec des mutationsUPDATE/DELETEà la volée en attente, mises en file avant une mutationALTER MODIFY COLUMN ... LowCardinality(...). #105847 (Raúl Marín). - Les écritures Iceberg préservent désormais les valeurs NULL dans les colonnes de partition
Nullable(T). Auparavant, un NULL écrit par ClickHouse apparaissait comme la valeur par défaut du type interne (0pourint) lorsqu’il était relu par Spark ou d’autres lecteurs Iceberg. Résout #105852. #105862 (Groene AI). - Correction du pushdown des filtres
ParquetetORCpour les prédicatsIN (subquery), ce qui permet à l’élagage des groupes de lignes, des pages et des filtres Bloom de fonctionner pour les lecturesfile,url,s3et depuis le stockage objet. #105863 (Arsen Muk). - Correction de la lecture ordonnée pour les tables
Merge(avec le nouvel analyseur). #105867 (Nikolai Kochetov). - Correction d’Iceberg v2 merge-on-read : les suppressions par position pouvaient renvoyer des lignes incorrectes lorsqu’un seul fichier de suppression référençait plusieurs fichiers de données et que plusieurs de ces fichiers de suppression s’appliquaient au même fichier de données. Le lecteur en streaming (
use_roaring_bitmap_iceberg_positional_deletes = 0) filtre désormais les lignes du fichier de suppression parfile_pathen C++ au lieu de s’appuyer sur l’élagage des groupes de lignes Parquet, ce qui rétablit l’invariant des positions croissantes. #105888 (Groene AI). - Correction de l’erreur
Cannot find columnpour les requêtes distribuées avec un filtreIN Array(...)dans le nouvel analyseur. #105894 (Nikolai Kochetov). - Correction d’un SIGSEGV dans
ALTER TABLE ... MODIFY COLUMN ... Nullable(...)sur les tablesMergeTreelorsqu’une colonne avecSTATISTICSest supprimée simultanément par un autreALTER. Résout #105912. #105917 (Groene AI). - Correction d’un plantage du serveur qui pouvait se produire lorsqu’une requête lisant depuis PostgreSQL — via la table function postgresql, le PostgreSQL table engine, ou un dictionnaire avec une source PostgreSQL — était annulée (par exemple avec KILL QUERY) et que l’annulation de la requête PostgreSQL distante échouait. #105949 (Rory Shanks).
- Correction de la mise en forme de
SYSTEM INSTRUMENT ADDafin que les arguments du gestionnaire soient séparés par un seul espace, et rejet des listes d’arguments d’instrumentationSLEEPinvalides comportant plus de deux valeurs ou une plage dans laquelle le minimum est supérieur au maximum. #105984 (Pablo Marcos). - Correction de résultats potentiellement erronés pour les requêtes qui combinent un OUTER JOIN avec un INNER JOIN ultérieur faisant référence au côté de l’outer join qui fournit les NULL. Le réordonnancement des jointures pouvait choisir un plan qui déplaçait les conditions de l’inner join dans la clause ON de l’outer join. #105992 (Vladimir Cherkasov).
- Correction d’un plantage possible dû à un littéral de chaîne trop volumineux envoyé dans la requête. #105996 (Nikita Taranov).
- Corrige l’exception
INVALID_WITH_FILL_EXPRESSIONlors de l’utilisation deINTERPOLATE ()(vide) avec un préfixe de tri dansORDER BYetuse_with_fill_by_sorting_prefixactivé. Les colonnes du préfixe de tri sont désormais correctement exclues de l’ensemble d’interpolation implicite, conformément au comportement deINTERPOLATE (col)lorsqu’une colonne est explicitement nommée. #106001 (Yakov Olkhovskiy). - Corrige l’échec silencieux des opérations de partition
ALTER TABLEpour les clés de partitionBool. Clôt #101722. #106004 (Pavel Kruglov). - Corrige
JSONExtractRawetJSONHaspour les cheminsJSONtypés avec des valeurs par défaut. Clôt #101721. #106005 (Pavel Kruglov). - Corrige l’ajout incorrect d’un préfixe ’/’ sur des chemins de base vides dans les configurations de data lake. Clôt #105989. #106013 (thewisenerd).
- Corrige le fait que le moteur de table
IcebergLocaldevienne en lecture seule après un cycleDETACH+ATTACHou un redémarrage du serveur, ce qui faisait échouer tous lesINSERTsuivants avecLocal object storage Local is readonly. (READONLY). #106016 (Groene AI). - Corrige les défaillances de
Keeperpendant le rattrapage d’un follower lorsque la nouvelle file de réponses du répartiteur de requêtes pouvait se remplir avant le démarrage du thread de réponse. #106049 (Antonio Andelic). - Meilleure compatibilité avec l’ancien analyzer. Si la table contient des colonnes comme
x.a Array, x.b Array, x String, les arrays sont désormais privilégiés pourARRAY JOIN x. #106069 (Nikolai Kochetov). - Corrige la désactivation silencieuse du cache du système de fichiers pour Azure Blob Storage (par ex. des tables Delta Lake sur Azure), car les métadonnées de l’objet n’incluaient pas l’ETag du blob. #106091 (thewisenerd).
- Corrige
system.dictionaries, qui renvoyait 0 ligne en cas de révocation partielle deSHOW DICTIONARIES. #106105 (Pavel Kruglov). - Corrige un plantage du serveur lors de l’exécution de requêtes sur des tables DeltaLake avec
allow_experimental_delta_kernel_rsactivé et un identifiant ou une option contenant des octets invalides (la FFI Rust paniquait au-delà de la frontièreextern "C"). #106109 (Raúl Marín). - Corrige des résultats incorrects pour les requêtes sur des tables dont le
ORDER BYcontient une fonction monotone décroissante telle que(c0 / -42)ouintDiv(c0, -42). Les prédicats sur la colonne sous-jacente (par exemplec0 < 0) pouvaient à tort élaguer des granules contenant des lignes correspondantes, produisant des résultats manquants. Clôt #106084. Clôt #106124. Clôt #106080. #106136 (Nihal Z. Miaji). - Corrige la prise en charge de l’utilisation des UDF SQL
WASMdans les définitions deMATERIALIZED VIEW. #106161 (Yue Ni). - L’Iceberg partition pruning gère désormais correctement les filtres
WHERE partition_col = (SELECT ... FROM ...)lorsque l’analyzer encapsule le résultat de la sous-requête scalaire dans un_CAST(Const, 'TargetType')interne avec des types source et cible identiques. Auparavant, ces filtres désactivaient l’élagage des partitions et déclenchaient un parcours complet de la table. #106204 (Groene AI). - Correction du paramètre
--query_idde clickhouse local pour permettre de spécifier un Query id personnalisé. #106205 (Yue Ni). - Correction d’un problème où la classe de stockage S3 (
s3_storage_class/s3_storage_class_name) était ignorée pour les objets écrits via multipart upload sur les disquesS3et le stockage objet, ce qui entraînait la création des objets volumineux avec la classeSTANDARDpar défaut. Le nom de l’option est désormais accepté aussi bien sous la formes3_storage_classques3_storage_class_namepour les disques, le stockage objet et les sauvegardes. #106214 (Alexey Milovidov). - Correction d’un problème où Keeper se bloquait parfois au démarrage lorsque le paramètre
nuraft_max_log_gap_in_streamétait défini sur une valeur autre que celle par défaut (la valeur par défaut est 0, c.-à-d. que le pipelining des requêtesappend_entriesest désactivé). #106220 (Michael Kolupaev). - Validation de l’état corrompu de la fonction d’agrégation
DDSketch(clés de bin) à l’insertion au lieu d’accepter des données malformées. #106236 (Yarik Briukhovetskyi). - Correction d’une incohérence du mode du coordinateur lorsque des sous-requêtes redéfinissent les paramètres in-order. #106243 (Nikita Taranov).
- Correction d’un problème où
optimize_skip_unused_shardsne s’appliquait pas (et oùforce_optimize_skip_unused_shardséchouait à tort) lorsqu’une tableDistributedétait interrogée via une tableMergeou la fonction de tablemerge, avec le prédicat appliqué à un niveau supérieur. #106250 (Nikolai Kochetov). - Correction de
INTERPOLATE (), qui renvoyaitINVALID_WITH_FILL_EXPRESSIONlorsque des colonnesORDER BYétaient aliasées dans la listeSELECTavec l’ancien analyzer. Ferme #106248. #106252 (Yakov Olkhovskiy). - Correction d’un arrêt brutal lors de la désérialisation d’un état
AggregateFunction(uniqTheta, ...)malformé depuis une entréeRowBinaryou un query parameter. L’entrée invalide est désormais rejetée avecCORRUPTED_DATAau lieu de remonter sous la forme d’unestd::exceptionet d’interrompre le processus viaabortOnFailedAssertion. #106260 (Groene AI). - Rejette désormais les octets
IntervalKindhors plage lors du décodage du typeRowBinaryWithNamesAndTypes(input_format_binary_decode_types_in_binary_format = 1) avec une erreurINCORRECT_DATAexplicite, au lieu de construire unDataTypeIntervalavec un type invalide susceptible de provoquer ensuite un comportement indéfini dans les chemins de hachage. #106261 (Groene AI). - Correction d’un problème de rollback en cas d’échec de downgrade de
SLRUdans26.1+. Correction de la priorité de séparation du cacheSystem/Dataavec la fonctionnalitékeep_free_space_ratio. #106286 (Kseniia Sumarokova). - Lire la sous-colonne
nullcomme un cheminJSONdansNullable(JSON)au lieu de la null-map. Clôt #106085. #106295 (Pavel Kruglov). - Correction de
RestCatalog::empty, qui renvoyait un résultat incorrect lorsqu’un REST catalog Iceberg contenait des tables. #106301 (Lefteris). - Correction d’une exception pour les requêtes
INNER JOINavec une tableMergeTreede gauche vide lorsqueenable_parallel_replicas,query_plan_use_new_logical_join_stepetquery_plan_optimize_join_order_algorithm = 'greedy'sont activés. #106338 (Nikolai Kochetov). - Correction d’une conversion incorrecte de valeurs
Float16subnormales enFloat32(par ex. lors de leur lecture depuis des fichiers Numpy.npy), causée par un décalage de mantisse d’un bit. #106343 (Joanna Hulboj). - Correction d’un plantage et d’une possible erreur
NOT_FOUND_COLUMN_IN_BLOCKlorsque l’optimisation basée sur les contraintes (optimize_using_constraints) est utilisée avec des sous-requêtes corrélées. #106349 (Raúl Marín). - Correction d’une lecture hors limites dans
sipHash64Keyed,sipHash128KeyedetsipHash128ReferenceKeyedlors du hachage d’une colonne dont tous les tableaux sont vides et dont la clé n’est pas constante. #106355 (Raúl Marín). - Correction de
SYSTEM RELOAD CONFIG, qui supprimait les paramètres Azure Blob Storage propres à chaque endpoint (commeuse_native_copy), ce qui faisait ignorer les paramètres configurés d’un disque pourBACKUP/RESTOREjusqu’au redémarrage du serveur. #106357 (Julia Kartseva). - Correction de
regexpExtract(haystack, pattern)afin que les patterns sans groupe de capture renvoient la correspondance complète au lieu de leverINDEX_OF_POSITIONAL_ARGUMENT_IS_OUT_OF_RANGE. #106374 (Groene AI). - Correction de l’exception
LOGICAL_ERRORlors du prétéléchargement du cache lorsqu’un objet S3 distant est remplacé par un contenu plus court entre son énumération et sa lecture. #106375 (Nikita Fomichev). - Correction de l’augmentation de l’utilisation mémoire dans le cache du système de fichiers. #106387 (Kseniia Sumarokova).
- Correction de plusieurs lectures hors limites du tas dans le lecteur du format Arrow IPC (
ArrowColumnToCHColumn). Un fichier Arrow malformé pouvait déclarer plus de lignes que ses buffers n’en contiennent, déclarer des longueurs d’éléments enfants list/struct/map incohérentes avec leur parent, fournir des offsets de liste non monotones ou tronquer un bitmap de validité enfant, provoquant ainsi des lectures au-delà de la fin des allocations du tas. Cela pouvait être exploité par tout utilisateur disposant du privilègeSELECTviafile(),format(), les fonctions de table ou des entrées ArrowFlight. Tous les buffers de données, offsets, view-struct et validity-bitmap sont désormais validés avant tout accès brut par pointeur, et la cohérence des formes et offsets list/struct/map est vérifiée. #106395 (Raúl Marín). - Correction des sauvegardes échouant avec
FILE_DOESNT_EXISTlorsque la cible REPLACE d’une vue matérialisée actualisable est collectée sur une base de données Replicated ou Shared dont la vue matérialisée n’est pas encore instanciée sur la réplique qui lance la sauvegarde. #106411 (Julia Kartseva). - Correction d’une erreur logique
Column identifier ... is already registeredlorsqu’un prédicat de mutation (DELETE/UPDATE) contient une sous-requêteIN/EXISTSqui lit à partir d’une expression de table par défaut imbriquée dans une autre sous-requête. #106414 (Alexey Milovidov). - Correction d’une erreur logique (
Left and right columns have same names) dans l’optimiseur de l’ordre des jointures, qui pouvait survenir pour des jointures exécutées avec des répliques parallèles lorsque deux relations du graphe de jointure partagent des noms de colonnes. #106418 (Alexey Milovidov). - Correction d’une erreur logique lors de la construction d’un dictionnaire polygonal à partir de données source contenant des coordonnées de points
NaNou infinies. Ces coordonnées sont désormais rejetées avec un message d’erreur explicite. #106423 (Alexey Milovidov). - Correction d’un bug où les colonnes
used_privilegesetmissing_privilegesdesystem.query_logpouvaient contenir des chaînes de privilèges issues, par fuite, de requêtes antérieures sans rapport, exécutées par un autre utilisateur, sur une autre base de données ou dans une autre session. #106425 (Alexey Milovidov). - Les fonctions
base58Encode,base58DecodeettryBase58Decoderespectent désormaismax_execution_timeet l’annulation de requête sur les entrées volumineuses, et rejettent les entrées de plus de 10 KB au lieu de s’exécuter pendant très longtemps. La limite est configurable via le nouveau paramètrefunction_base58_max_input_size(0la désactive). #106428 (Alexey Milovidov). - Correction de résultats sporadiquement incorrects pour les requêtes
ORDER BY ... DESClors de la lecture de wide parts en ordre inverse avecread_in_order_use_virtual_row_per_block = 1et unmax_block_sizefaible. #106429 (Vladimir Cherkasov). - Correction d’une exception
NOT_FOUND_COLUMN_IN_BLOCKlors de l’interrogation d’une table Iceberg ou S3 avec unWHEREcomposé contenantIS NOT NULLsur une colonne absente de la listeSELECT, avec le Native reader Parquet V3. #106443 (Shaohua Wang). - Permet à l’utilisateur de spécifier des en-têtes pour
HTTPDictionaryà l’aide de named collections. #106459 (Jan Rada). - Correction d’un cas où un worker thread pouvait rester attaché à un groupe de threads obsolète après l’échec partiel de
CurrentThread::attachToGroup, ce qui entraînait ensuite l’échec de tâches sur le même thread avecThread is already attached to a group. #106462 (Mikhail f. Shiryaev). - Correction d’une exception lorsqu’une requête de vector search utilise un vector index ainsi qu’un autre skip index comme
minmax, avecuse_skip_indexes_on_data_read = 1. #106473 (Shankar Iyer). - Les valeurs d’énumération
Avromal formées sont désormais validées et rejetées avec une erreur, au lieu de provoquer une lecture hors limites et un arrêt lors de la désérialisation de donnéesAvrocorrompues. #106476 (Miсhael Stetsyuk). - Correction d’une progression surestimée lors de la lecture de tables Iceberg avec des filtres
_fileou_path. Auparavant, l’indicateur de progressiontotal_bytes_to_readincluait tous les fichiers du manifest, indépendamment du filtrage. #106491 (Pedro Ferreira). - Correction d’une
Bad cast exceptionpour les dictionnaires Redis qui utilisentSTORAGE_TYPE 'simple'avec un layoutcache/directet une clé chaîne unique (complexe) ; ces dictionnaires fonctionnent désormais, et les clés composites sur un stockagesimplesignalent maintenant une erreur explicite. #106501 (Vladimir Cherkasov). - Correction d’un bogue de résultats incorrects où
WHERE c0 = constne renvoyait aucune ligne pour les tables avecORDER BY f(c0)lorsquef(const)s’évalue à NaN, par exempleORDER BY sqrt(c0)avec une constante négative. L’analyse de la clé primaire élaguait à tort chaque granule et empoisonnait le cache des conditions de requête pour les requêtes suivantes. #106507 (Groene AI). - Correction du fait que
LIMIT WITH TIESetLIMIT WITH TIESfractionnaire ne respectaient pas la collation deORDER BY ... COLLATElors de la détermination des ex æquo. Les lignes égales selon la collation (par exemple'1'et'01'avec une collation numérique) étaient comparées octet par octet, si bien que certaines lignes ex æquo étaient exclues à tort du résultat. #106539 (Nihal Z. Miaji). - Correction des optimisations
DISTINCTin order etLIMIT BYin order (y comprisLIMIT BYnégatif) qui renvoyaient des résultats incorrects lorsque l’entrée était triée avec une collation (ORDER BY ... COLLATE). Les lignes égales selon la collation (par exemple'a'et'A'avec une collation insensible à la casse) sont ordonnées par clé de collation et ne sont pas adjacentes par valeur ; l’optimisation in order est donc désormais ignorée lorsqu’un collateur est utilisé. #106564 (Nihal Z. Miaji). - Correction de résultats incorrects pour
SELECT c, count() FROM t WHERE c GROUP BY csur des tables avec la projection implicite_minmax_count_projection, une projection d’agrégation explicite ou une projection normale : auparavant, chaque groupe se réduisait à une seule ligne avec une clé constante et le nombre total de lignes. #106590 (Groene AI). - Correction d’un bogue empêchant les utilisateurs d’utiliser des sous-requêtes scalaires dans le premier argument de
INlorsque le second argument est un tuple non constant. #106610 (Yarik Briukhovetskyi). - Correction de l’exception
Mutation ofMemorytable produced incomplete outputlevée lors de l’exécution de commandesALTER TABLE <memory_table>sans effet sur les données ligne par ligne sur un moteurMemory, à savoirAPPLY PATCHES,APPLY DELETED MASK,MATERIALIZE STATISTICS,MATERIALIZE INDEX,MATERIALIZE PROJECTIONetREWRITE PARTS. Les tablesMemoryne possèdent pas ces structures ; ces commandes sont donc désormais traitées comme des no-op. #106621 (Groene AI). - Correction du fait que
session_timezoneétait ignoré lors de la sérialisation des colonnesLowCardinality(DateTime)vers des formats texte (CSV, TSV, JSONEachRow, etc.). Auparavant, après la première écriture d’une colonneLowCardinality(DateTime)sur un serveur, chaque requête ultérieure écrivant une telle colonne affichait la chaîne d’heure locale dans le premier fuseau horaire rencontré, indépendamment desession_timezone. #106634 (Groene AI). - Correction d’une
LOGICAL_ERROR“Trying to get name of not a column:ExpressionList” levée par des requêtes qui passent un astérisque dansmultiIfà un argument de fonction de table, par exemplenumbers(multiIf(*, ...), 2). La requête rejette désormais ce sélecteur impossible à résoudre avecUNSUPPORTED_METHOD. #106647 (Groene AI). - Corrige un problème empêchant le server de démarrer avec
Too many marks in file ...skp_idx_idx.cmrk4, marks expected 0 (bytes size 0)lorsqu’une tableMergeTreecomporte une part d’index de saut avec zéro granule et un fichier de marks non vide sur le disque. #106675 (Groene AI). - Rejette les glob patterns
filepathologiques qui entraîneraient une récursion non bornée lors du listage des répertoires. Une profondeur de récursion maximale de 1000 est désormais imposée ; les query qui la dépassent lèventTOO_DEEP_RECURSIONau lieu de faire planter le server par débordement de pile. #106676 (Groene AI). - Corrige l’arrêt du server avec
Bad cast from type DB::ColumnNothing to DB::ColumnVector<char8_t>dansFunctionIf::executeForConstAndNullableConditionlorsque la conditionif/multiIfest réduite par évaluation constante àConst(Nullable(Nothing))(par exemple, un indice hors limites sur un tableau vide, commearraySort(x -> x, [])[toNullable(1)]). #106678 (Groene AI). - Corrige l’exception
'Trying to read from input() twice.'levée lorsque la table functioninputest encapsulée dans une CTE non matérialisée référencée à plus d’un endroit dans la query. La query est désormais rejetée avec une erreur expliciteINVALID_USAGE_OF_INPUTau moment de la planification.inputest un flux client à usage unique et ne peut être consommé que par une seule source dans le query plan. #106682 (Groene AI). - Fait en sorte que
FORMATs’applique aussi à la sortie deEXPLAINdansEXPLAIN ... INSERT ... SELECT ... FORMAT ..., y compris lorsqueSETTINGSprécèdeFORMATou lorsque le output format estValues. Suite de #101772. #106686 (Alexey Milovidov). - Corrige une rare erreur parasite
RESOURCE_ACCESS_DENIED(“Scheduler queue with resource request is about to be destructed”) pour une query qui avait en réalité obtenu l’accès à une ressource de workload, causée par la réutilisation d’un objet request thread-local qui conservait l’échec d’une request précédente. #106690 (Alexey Milovidov). - Corrige une condition de concurrence entre la destruction d’objets
INATSConsumeret les appels àINATSConsumer::onMsgsur ces objets via des callbacks dans la bibliothèque NATS. #106692 (Miсhael Stetsyuk). - Corrige
match,extract,extractAlletcountMatches, qui renvoyaient des résultats incorrects pour des regular expressions contenant des séquences d’échappement hexadécimales ou octales. #106709 (ofeliacode). - Le TLS Raft interne de Keeper respecte désormais le paramètre
openSSL.client.verificationMode. Auparavant, la vérification du certificat du pair était toujours activée pour la communication Raft inter-Keeper, indépendamment de ce paramètre ;noneétait donc ignoré silencieusement. Désormais,nonedésactive explicitement la vérification du certificat du pair Raft, tandis que l’absence de paramètre conserve le comportement précédent, sécurisé par défaut. Les configurations qui définissent explicitementnonecesseront de vérifier les certificats des pairs Raft après upgrade, conformément à l’intention de la configuration. #106726 (Antonio Andelic). - Corrige une logical error dans les scripts de démarrage de
SYSTEM RELOAD CONFIG. De plus, charge les scripts de démarrage lors deSYSTEM RELOAD CONFIG(fonctionnalité actuellement réservée à un usage interne). #106727 (Miсhael Stetsyuk). - Annule une modification qui faisait que
sumMap/ le combinator-Maprejetait les types de valeurs numériques portant des noms personnalisés (tels queSimpleAggregateFunction(sum, T)etBool) avec l’erreurILLEGAL_TYPE_OF_ARGUMENT: Values for -Map cannot be summed, ce qui cassait des agrégations qui fonctionnaient auparavant. #106729 (Nikita Fomichev). - Correction de plusieurs problèmes de sécurité mémoire et d’épuisement des ressources dans des readers de format accessibles à partir d’entrées non fiables : une lecture hors limites sur le heap dans le traitement de la longueur des niveaux de définition/répétition de
DataPageV2par le Parquet reader natif, un dépassement de pile sur des Parquet files avec des schémas profondément imbriqués, ainsi que des allocations qui ignoraientmax_memory_usagelors du parsing de géométries WKB/WKT GeoParquet et de chaînes/octets Avro. #106739 (Raúl Marín). - Correction d’un heap buffer overflow (crash du server) dans
decodeHTMLComponentlors du décodage de chaînes contenant les entités HTML expansives≫⃒ou≪⃒, exploitable par n’importe quel utilisateur avec un simpleSELECT. #106741 (Raúl Marín). - Rejette
CREATE TABLE,ALTER TABLE ADD INDEXetCREATE INDEXavecGRANULARITY 0pour les skipping indexes avec une erreurBAD_ARGUMENTSexplicite. Auparavant, cela déclenchait une exceptionInconsistent AST formattingdans les builds de débogage. #106783 (Groene AI). - Correction d’Azure BACKUP/RESTORE, qui ignorait les paramètres d’endpoint pour les disques
azure_blob_storageau format hérité. #106784 (Julia Kartseva). - Correction d’une exception
Bad castlors de l’élagage des parties à l’aide des statistiquesMinMaxlorsqu’une Key column estLowCardinalityet que la constante du predicate estLowCardinality(Nullable(...)). #106793 (Groene AI). - Correction de colonnes incohérentes (menant ensuite à
LOGICAL_ERROR) en cas d’exception (par ex.MEMORY_LIMIT_EXCEEDED) pendant le parsing. #106802 (Azat Khuzhin). - Correction du cas où, après configuration de
keeper_server.http_control.secure_port, le server renvoyait une réponse HTTP à des clients HTTPS. #106822 (linjiayu1025-collab). - Correction d’une logical error dans
parseDateTimeavec des octets d’entrée non ASCII. #106856 (Pavel Kruglov). - Correction de
SHOW CREATE ROW POLICY, qui produisaitrestrictive/permissiveen minuscules au lieu de majuscules, contrairement aux autres mots-clés. #106865 (Valery Petrov). - Correction du cas où les parallel replicas n’étaient pas appliquées à une vue avec
UNIONen raison d’une table vide dans leUNION. #106900 (Igor Nikonov). - Correction d’un crash du server (SIGSEGV) lors de la lecture de données
Protobuftronquées avecinput_format_allow_errors_num > 0. #106905 (Andrey Tsarevskiy | Андрей Царевский ). - Correction de l’exception
THERE_IS_NO_COLUMNpour les distributed queries impliquant l’optimizationoptimize_rewrite_aggregate_function_with_iflorsque le function argument de l’aggregate function nécessite un cast vers le typeNullable. #106908 (Yakov Olkhovskiy). - Corrige une exception (
LOGICAL_ERROR) dans le JOIN runtime filter lorsque la clé de jointure contient un typeVariantouDynamicimbriqué dans unTuple, unArrayou unMap, et que le côté droit de la jointure ne comporte qu’une seule valeur distincte. #106931 (Groene AI). - Corrige un dépassement d’entier signé (comportement indéfini) dans
arrayLevenshteinDistanceWeightedetarraySimilaritylorsque les tableaux de poids contiennent de grandes valeurs entières. La distance pondérée est désormais accumulée dans un entier large pour les poids entiers, de sorte que les grandes pondérations entières ne débordent plus et restent exactes. #106934 (Groene AI). - Corrige un crash du serveur (déréférencement de pointeur nul) lors de l’exécution de
TRUNCATEouDROPsur une tableEmbeddedRocksDBdont le handle RocksDB avait été libéré, par exemple une tableread_onlydont le répertoire de données avait été vidé par unTRUNCATEprécédent. #106940 (Groene AI). - Corrige une exception (
std::length_errorsignalée comme unLOGICAL_ERROR) lors de la lecture à partir d’une table function*Clustertelle queurlCluster, avec un paramètremax_streams_for_files_processing_in_cluster_functionstrès élevé. Le nombre de streams est désormais limité à une valeur raisonnable. #106946 (Groene AI). - Corrige un crash du serveur (déréférencement de pointeur nul de
DB::IConnections) dansRemoteQueryExecutorlorsqu’une distributed query est annulée juste avant d’être envoyée à un shard. #106950 (Groene AI). - Corrige le fait que
elapsed_ussoit toujours égal à zéro, ainsi que le sous-comptage deread_rows/read_bytes, danssystem.processors_profile_logetsystem.query_logpour les requêtes de flush d’asynchronous insert (AsyncInsertFlush). #106982 (Christoph Wurm). - Corrige un crash (
Source column is not Map/SIGSEGV) lors de la fusion de blocks triés contenant une columnVariantavec une varianteMapdont l’ordre de stockage local diffère de l’ordre global. #107011 (Groene AI). - Corrige une logical error
conflicted_part_name.has_value()levée lors d’un insert synchrone dans une tableReplicatedMergeTreelorsque l’inserted block avait été entièrement deduplicated et que le nœud de déduplication de la part en conflit avait déjà été supprimé (par exemple par unDROP PARTITIONconcurrent). #107026 (Groene AI). - Corrige une exception (logical error
this->visited_views == right->visited_views) surINSERTlorsque deux materialized views sur la même source table écrivent dans la même target table et qu’une vue dépendante lit cette table cible, avecmaterialized_views_squash_parallel_insertsactivé. #107027 (Groene AI). - Corrige une logical error
Block structure mismatch in UnionStep stream(arrêt du serveur sur les builds debug/sanitizer,Code: 49sur les builds de release) qui se produisait lorsqu’une branche d’unUNION/INTERSECT/EXCEPTlisait une column sérialisée enSparse, tandis que la branche sœur lisait cette même column comme une column complète (par exemple lors de l’alimentation d’une materialized view). #107041 (Groene AI). - Correction d’une exception
LOGICAL_ERRORlors d’un insert dans une table DeltaLake avec des colonnes qui ne correspondent pas à son schéma d’écriture (par exemple, une colonneNestedaplatie en subcolumns, ou une table function avec un sous-ensemble explicite de colonnes). Ces inserts échouent désormais avec une erreurINCOMPATIBLE_COLUMNSvisible par l’utilisateur. Clôture #87402. #107058 (Groene AI). - Correction de l’erreur
TYPE_MISMATCH(“Impossible de convertir la chaîne … en type …”) pour les queriesORDER BY <numeric column> ... LIMIT nlorsque la lazy materialization plaçait une autre colonne avant la colonne de tri. Le seuil top-K est désormais lu à partir de la bonne colonne de tri. #107060 (Groene AI). - Correction d’une erreur de syntaxe lorsqu’une clause
FORMAT,SETTINGSouINTO OUTFILEsuitSHOW ROW POLICIESouSHOW MASKING POLICIES(par ex.SHOW ROW POLICIES FORMAT TabSeparated). #107061 (Groene AI). - Correction d’un
ALTER TABLE ... RENAME COLUMN a TO b, RENAME COLUMN c TO acomposé qui réutilise un nom de colonne libéré (un “échange”) entre des colonnes de types différents. La part materialized enregistrait le mauvais column type, ce qui faisait ensuite échouer unSELECTavecConversion between numeric types and IPv6 is not supported(ou provoquait un arrêt au chargement de la part dans les builds de Débogage). #107064 (Groene AI). - Correction de résultats non déterministes de la fonction
roundDownlorsque le tableau de boundaries contientNaN. La même valeur d’entrée pouvait renvoyer une boundary finie ouNaNselon les rows voisines dans un lot. Les boundariesNaNsont désormais ignorées, de sorte que le résultat dépend uniquement des boundaries finies. #107065 (Groene AI). - Correction de
quantileTDigestetquantileTDigestWeighted, qui lançaientDECIMAL_OVERFLOWpour des argumentsDateetDateTimelorsque le quantile interpolé était fractionnaire mais restait dans la plage (par exemplequantileTDigestWeighted(date, weight)sur des valeurs qui tiennent toutes dans le type). Le résultat fractionnaire est désormais tronqué au type de résultat, conformément àquantilesTDigestWeighted; les véritables valeurs hors plage lèvent toujours une erreur. Clôture : #106722. #107066 (Groene AI). - Correction de
trimLeft,trimRightettrimBoth(ainsi que de leurs aliasltrim,rtrim,trim), qui lançaientTOO_LARGE_STRING_SIZElorsque le character set de trim personnalisé dépassait 16 caractères. Les ensembles de trim de toute longueur sont désormais de nouveau pris en charge. #107071 (Nikita Fomichev). - Correction de la troncature silencieuse de valeurs entières hors plage dans les définitions de type
Enum8/Enum16.Enum8('a' = 200)lève désormaisARGUMENT_OUT_OF_BOUNDau lieu de créer silencieusementEnum8('a' = -56). #107081 (Groene AI). - Correction d’un ordre de rows incorrect (et d’une
LOGICAL_ERROR“Rows are not sorted with permutation” dans les builds de Débogage) pour les queries multi-colonnesORDER BY ... LIMITqui trient sur des colonnesNullablelorsque plusieurs rows sont à égalité sur les premières colonnes. #107094 (Groene AI). - Correction d’une
LOGICAL_ERROR(Expected the argument N to have X rows, but it has Y) lors de l’exécution d’une fonction sur une colonneDynamicproduite par un JOIN surDynamic(par exemple les lignes non appariées d’unRIGHT/FULL JOIN, ou une sous-requêteEXISTScorrélée décorrélée en jointure). #107095 (Groene AI). - Correction d’une recréation intempestive de session ZooKeeper lors du rechargement de la configuration. #107096 (Azat Khuzhin).
- Le mutex n’est plus conservé pendant les lectures ZooKeeper lors de l’actualisation des entités d’accès. #107097 (Azat Khuzhin).
- Correction d’une exception
Logical error: Too large size passed to allocatorlors d’unINSERTdans une tableMergeTreelorsqueadaptive_write_buffer_initial_sizeest défini sur une valeur extrêmement élevée. La taille initiale adaptative du tampon d’écriture est désormais plafonnée à la taille maximale du tampon. #107104 (Groene AI). - Correction de
LOGICAL ERROR(Bad cast from type DB::ColumnString to DB::ColumnLowCardinality) lorsqu’une constanteVariantcontenant un membreLowCardinalityest comparée à une colonne clé dont l’expression de clé est une fonction déterministe non monotone (par exemple un skip indexminmaxsursipHash64(col)). #107111 (Groene AI). - Correction d’une erreur logique
Bad cast from type DB::IColumn const* to DB::ColumnNullable const*lorsqu’un astérisque qualifié (t.*) sur une cléJOIN ... USINGest passé à une aggregate function et que l’autre côté d’un OUTER JOIN a une cléNullable(avecjoin_use_nulls = 0). #107129 (Groene AI). - Correction des lots
ALTER TABLE ... ON CLUSTERqui mélangentMODIFY SETTING/RESET SETTINGavec une modification de commentaire (par exempleMODIFY COMMENT 'x', MODIFY SETTING old_parts_lifetime = 123) et qui n’étaient appliqués que sur la réplique leader, laissant les autres répliques diverger. Correction également d’unMODIFY COLUMN ... COMMENTpositionnel ou avecSETTINGSpar colonne, incorrectement classé comme simple modification locale des métadonnées de commentaire, ce qui excluait la réorganisation des colonnes des métadonnées répliquées et pouvait provoquerINCOMPATIBLE_COLUMNSau redémarrage d’une réplique. #107142 (Groene AI). - Correction d’une
LOGICAL_ERROR(“Table expression … data must be initialized”) déclenchée lorsqu’un sélecteur d’astérisque qualifié (par exemplex.*) référençait un CTE récursif par son nom dans son propre terme récursif. Ces sélecteurs développent désormais les colonnes de la table récursive, de la même manière qu’une colonne qualifiée (x.a) ou un sélecteur non qualifié (*) le fait déjà à cette position. #107144 (Groene AI). - Correction de résultats de la requête erronés causés par le query condition cache lorsque des mutations à la volée (
apply_mutations_on_fly) ou des patch parts filtraient des lignes avantPREWHERE. Une requête lue avecapply_mutations_on_fly = 1pouvait contaminer le cache, de sorte qu’une requête ultérieure avecapply_mutations_on_fly = 0et le même prédicat sautait des marques qu’elle aurait dû lire et renvoyait trop peu de lignes. La même correction couvre également les politiques de sécurité au niveau des lignes, qui sont ajoutées comme filtre avantPREWHERE: une requête exécutée sous une row policy restrictive pouvait contaminer le cache pour une requête ultérieure utilisant le même prédicat sans cette policy. #107145 (Groene AI). - Correction de
BACKUPversAzureBlobStorage: la copie d’un fichier de données à l’intérieur d’une sauvegarde écrivait l’objet de destination en dehors du répertoire de sauvegarde. Les vérifications de l’existence des objets de sauvegarde sur les destinationsS3utilisent désormais des requêtesHeadObjectexactes au lieu d’un listage par préfixe, ce qui évite les faux positifs avec des clés ayant des préfixes similaires. #107153 (Pablo Marcos). - Correction d’un dépassement d’entier signé dans
quantileExactExclusive,quantilesExactExclusive,quantileExactInclusiveetquantilesExactInclusive, qui pouvait produire un résultat erroné pour des entréesInt64couvrant une grande plage de valeurs. #107154 (Groene AI). - Correction d’une
LOGICAL_ERROR(“Unexpected exception in refresh scheduling”) qui pouvait placer le serveur dans une boucle de plantage au redémarrage lorsqu’une vue matérialisée actualisable a une dépendanceREFRESH ... DEPENDS ON <name>dont le nom non qualifié correspond à celui d’une table temporaire ou d’une CTE. #107156 (Groene AI). - S’assurer que les scripts de démarrage ne sont pas exécutés lors du rechargement de la configuration, car cela est sémantiquement incorrect, inattendu pour les utilisateurs et connu pour être source d’erreurs. #107187 (Miсhael Stetsyuk).
- Plafonnement de la valeur maximale de
queue_sizepour la pré-réservation. #107205 (Elian Gidoni). - Correction de l’erreur
Argument ... of GROUPING function is not a part of GROUP BY clausepour les requêtes qui utilisent la fonctiongroupingavec le paramètregroup_by_use_nullsactivé. #107206 (Nikolai Kochetov). - Correction de l’ordre incorrect des résultats pour
ORDER BYsurUNION ALLavecoptimize_read_in_orderactivé lorsque le pipeline d’union était réduit en raison du paramètremax_streams_for_union_step; cette réduction est désormais ignorée lorsque le plan s’appuie sur des output streamsUNIONtriés. Corrige #106880. #107208 (Vladimir Cherkasov). - Correction d’un possible déréférencement de pointeur nul lors de la résolution de la configuration du proxy pendant la phase tardive d’arrêt du serveur. #107231 (Pedro Ferreira).
- Correction des requêtes lightweight
UPDATEavec les parallel replicas héritées activées pour les tablesMergeTreenon répliquées. #107246 (Groene AI). - Correction d’un arrêt brutal du serveur (erreur logique
std::out_of_range) lors d’un insert dans une tableIcebergdont les noms de colonnes du bloc d’écriture ne correspondent pas aux identifiants de champ du schéma le plus récent (par exemple après qu’un processus d’écriture concurrent renomme une colonne dans la fenêtreiceberg_metadata_staleness_ms). L’insert échoue désormais avec une erreur de requête claire au lieu de faire planter le serveur. #107279 (Groene AI). - Correction du blocage à l’arrêt sur le serveur et en local, dû au fait que des thread pools statiques conservaient des idle threads indéfiniment si
max_*_thread_pool_free_size > 0. #107291 (Miсhael Stetsyuk). - Correction du fait que la table function
s3ignorait silencieusement une valeur positionnellepartition_strategyen minuscules (par ex.hive). #107297 (Julia Kartseva). - Correction de la gestion de
low_cardinality_allow_in_native_format=0dans la sérialisation parallèle des blocs. #107319 (Azat Khuzhin). - Corrige des résultats erronés (souvent vides) de
ORDER BY <col> LIMIT nlorsque l’optimisationuse_skip_indexes_for_top_kest active et qu’une part avec un skip indexminmaxsur la colonne de tri a eu des lignes supprimées par un lightweightDELETE. L’optimisation ne classe plus leminmaxobsolète des parts affectées par un lightweightDELETEavant les parts qui contiennent les premières lignes encore actives. #107320 (Groene AI). - Correction d’un bogue dans ClickHouse Keeper où les métadonnées du snapshot signalées via
last_snapshot(etzk_latest_snapshot_sizedansmntr) pouvaient revenir en arrière après l’installation d’un snapshot obsolète ou dupliqué, ce qui pouvait aussi permettre à un snapshot local avec le même index d’écraser sur place un fichier snapshot enregistré alors qu’il était encore en cours de diffusion vers un pair ou de téléversement vers S3. #107321 (Antonio Andelic). - Correction d’un possible dépassement de pile du serveur (crash) lors de la lecture d’un schéma ou d’une valeur profondément imbriqués dans les formats
MsgPack,BSON,ORC,Parquet,JSON,DeltaLake,IcebergetPaimon. De telles entrées profondément imbriquées sont désormais rejetées avec une exception. #107341 (Raúl Marín). - Corrige une possible logical error dans
SYSTEM SYNC DATABASE REPLICA ... STRICTet fait en sorte que le modificateurSTRICTprenne réellement effet pour les répliques de base de données. #107344 (Pedro Ferreira). - Corrige un arrêt du serveur dans les builds de débogage/sanitizer lors de la lecture d’une table
DeltaLakedont le schéma ClickHouse nomme une colonne absente du mapping de colonnes Delta, par exemple après le renommage ou la suppression d’une colonne dans le journal Delta. La query échoue désormais avec une erreurINCORRECT_DATAinterceptable à la place. #107347 (Groene AI). - Corrige
ORDER BY ... WITH FILL, qui produisait des lignes supplémentaires lorsqu’une colonneORDER BYsituée avant la colonne de remplissage utilisait une collationCOLLATE. Les lignes sont désormais groupées selon le préfixe de tri avec cette collation, conformément à l’ordre de tri. #107365 (Groene AI). - Correction d’un crash (
LOGICAL_ERRORdans les builds de débogage) et d’un bogue silencieux produisant des résultats erronés (dans les builds de release) lors de la lecture d’une table Iceberg dont les métadonnées réassocient unschema-idexistant à un schéma différent selon les versions de métadonnées. De telles métadonnées sont désormais rejetées avecICEBERG_SPECIFICATION_VIOLATION. #107370 (Groene AI). - Corrige une
LOGICAL_ERROR(Variant N (T) has size X, but expected Y) lorsqu’une fonction telle quetoStringouconcatest appliquée à une colonneVariantouDynamicqui contient une seule variante non vide ainsi que des NULL, et que la fonction renvoie sa colonne d’entrée inchangée. #107374 (Groene AI). - Corrige
Logical error: 'Duplicate announcement received for replica number N', qui pouvait se produire avec des replicas parallèles lorsqu’une scalar subquery contenait des sous-requêtes imbriquées lisant la même table. #107381 (Groene AI). - Corrige
getServerSettingafin de renvoyer la valeur effective courante des server settings modifiables à l’exécution (tels quemax_server_memory_usage,mark_cache_size,max_concurrent_queries, les tailles de thread pool, etc.), conformément à ce qui est signalé parsystem.server_settings. #107388 (Alexey Milovidov). - Correction de
arrayResizeavec un argument de tailleDecimal: la taille est désormais interprétée selon sa valeur réelle (par ex.arrayResize([1, 2, 3], 1.5::Decimal(2, 1))renvoie un élément) au lieu de la représentation brute non mise à l’échelle. #107389 (Alexey Milovidov). - Correction d’un
LOGICAL_ERROR(block.rows() == getRows()) déclenché lors d’unINSERTasynchrone dans une tableAliaslorsqueuse_strict_insert_block_limitsétait activé. #107400 (Groene AI). - Correction d’une erreur logique (
Unexpected return type from equals. Expected Nullable(UInt8). Got UInt8) lorsque l’optimisation de descente de disjonction (prédicat partiel) pousse une condition sur une cléUSINGdont le type est élargi par le JOIN. Correction également d’un crash du serveur (segmentation fault) dans l’analyseur lors de la résolution des identifiants dans des requêtesJOIN ... USINGcontenant des branchesif/multiIfconstantes faisant référence à des identifiants inconnus. #107407 (Groene AI). - Correction d’un heap buffer overflow (crash du serveur) dans
windowFunnellors de la finalisation d’un état de fonction d’agrégation forgé avec un type d’événement hors plage, exploitable par n’importe quel utilisateur avec un simpleSELECT. #107412 (uwezkhan). - Correction d’un comportement indéfini lorsqu’une valeur en virgule flottante non finie (telle que
nanouinf) est passée comme argument d’horodatage/de durée des fonctions de tableprometheusQuery/prometheusQueryRange. Un tel argument lève désormaisBAD_ARGUMENTSau lieu de produire un horodatage erroné. #107417 (Groene AI). - Correction de l’arrêt silencieux de la réplication des modifications par
MaterializedPostgreSQLlorsque le nom de la base de données ou de la table PostgreSQL contient des lettres majuscules (le consommateurpgoutputdemandait un nom de publication non cité et converti en minuscules, qui ne correspondait pas à la publication préservant la casse). #107423 (Alexey Milovidov). - Correction d’une exception (
Logical error: Not-ready Set is passed as the second argument for function 'in') lorsqu’une expression de clé (ORDER BY,PRIMARY KEY,PARTITION BYou unINDEXde saut) contenait un opérateurINavec une table à droite, par ex.ORDER BY (x IN some_table). De telles expressions de clé sont désormais rejetées lors de la création de la table. #107424 (Groene AI). - Correction de résultats incorrects produits par l’optimisation
optimize_rewrite_aggregate_function_with_ifpour les fonctions d’agrégation qui préservent les valeurs de charge utileNULL(la famille*_respect_nulls:anyRespectNulls,first_value_respect_nulls,anyLast_respect_nulls,last_value_respect_nulls). L’optimisation ne réécrit plusf(if(cond, x, NULL))sous la forme-Ifpour ces fonctions. #107430 (Groene AI). - Correction d’une exception parasite
filesystem error: in last_write_time: No such file or directorylors du listage d’un répertoire d’object storage sur disque local (par ex. une table Iceberg sur un disquelocal) pendant que des fichiers sont remplacés de manière concurrente. Une entrée supprimée en parallèle est désormais omise du listage au lieu de l’interrompre. #107432 (Groene AI). - Correction de l’erreur
THERE_IS_NO_COLUMNlorsqueoptimize_if_transform_strings_to_enum = 1et que l’expressionif/transformoptimisée sur des littéraux de chaîne est une cléGROUP BYouORDER BYsur une table Distributed ou avec des parallel replicas. #107455 (Groene AI). - Correction d’un rare plantage du serveur lors du traitement de
DISTINCT, qui pouvait se produire lorsqu’une allocation échouait (par exemple en cas d’atteinte d’une limite mémoire) pendant l’initialisation de l’ensemble des clés distinctes. #107467 (Groene AI). - Correction de
LOGICAL_ERROR: Unexpected return type from materialize(et d’erreurs similaires d’incompatibilité de type) lorsqueapply_mutations_on_fly = 1est utilisé sur une table avec unUPDATEon-fly en attente, dont la colonne cible est également lue comme entrée d’une fonction par unUPDATEon-fly antérieur, avant une mutationALTER MODIFY COLUMN ... LowCardinality(...). #107475 (Groene AI). - Correction d’identifiants AWS STS obsolètes lors de la lecture de tables
DeltaLakeviaS3: le moteur conserve désormais le clientS3muni d’identifiants fraîchement renouvelés lors de l’actualisation de son instantané, de sorte que les lectures de longue durée n’échouent plus après l’expiration du TTL du jeton STS. Le fournisseur d’identifiants STS assume-role prend désormais lui aussi en charge le rafraîchissement des identifiants pour tout accès àS3utilisant STS. #107480 (Elmi Ahmadov). - Correction de
SELECT ... FINALetOPTIMIZE TABLE ... FINAL, qui renvoyaient des lignes dupliquées après queCREATE TABLE ... CLONE AS,ATTACH PARTITION ... FROMouMOVE PARTITION ... TO TABLEavaient adopté des parts d’unMergeTreesimple dans unReplacingMergeTree,SummingMergeTreeouAggregatingMergeTree. Le merge level de la part adoptée est désormais réinitialisé à 0 lorsque les engines source et destination diffèrent, afin que la destination la déduplique lors de la fusion suivante. #107481 (Groene AI). - Correction d’un underflow d’entier dans le parser du PostgreSQL wire protocol, où un message avec un champ de longueur inférieur à 4 provoquait un bouclage de
size - 4et unresize/ignoresurdimensionné. #107485 (uwezkhan). - Le suivi de l’annulation de query est désormais meilleur pendant l’attente du quorum dans ReplicatedMergeTree. #107513 (Nikita Taranov).
- Correction de
Not-ready Set is passed as the second argument for function 'in'(LOGICAL_ERROR) lors de l’interrogation d’une table avec une cléPARTITION BYet une sous-requêteIN/NOT INincluse dans une expression plus large, par exempleWHERE (c0 IN (SELECT ...)) != 0. #107515 (Groene AI). - Correction de
currentUser(),user(),SESSION_USERetauthenticatedUser(), qui s’évaluaient en chaîne vide lors de la phase de vidage des asynchronous insert (avecasync_insert = 1). Cela affectait les expressions de colonneDEFAULT/MATERIALIZEDainsi que les materialized views qui référencent ces fonctions, lesquelles stockaient silencieusement une chaîne vide au lieu de l’utilisateur effectuant l’insert. #107541 (Groene AI). - Avec
enable_analyzer = 1(par défaut), interroger une table par son seul nom lorsqu’elle n’existe que dans une autre base de données suggère désormais la bonne table ; par exemple,SELECT * FROM functionsrenvoieMaybe you meant system.functions?. Auparavant, le nouvel analyseur renvoyait l’erreurUnknown table expression identifiersans suggestion, tandis que l’ancien analyseur fournissait déjà cette indication utile. #107550 (Groene AI). - La mémoire utilisée par la bibliothèque rapidjson (dans
prettyPrintJSON,JSONMergePatchet le parser JSON rapidjson) est désormais comptabilisée par le memory tracker, de sorte que les entrées pathologiques sont rejetées avecMEMORY_LIMIT_EXCEEDEDau lieu d’allouer de la mémoire sans limite. #107555 (Raúl Marín). - Corrige une
LOGICAL_ERROR(updateFormatPrewhereInfo called more than once) déclenchée lors de l’interrogation d’une sourcefile(),url()ou de stockage objet avec à la fois unPREWHEREexplicite et unWHERE, lorsqueoptimize_prewhere_after_pushdownétait activé. #107568 (Groene AI). - Corrige un crash (déréférencement de pointeur nul) pouvant se produire lorsqu’un plan de requête distribué était exécuté localement (
make_distributed_plan+distributed_plan_execute_locally) aveclog_formatted_queries = 1. #107570 (Groene AI). - Corrige un arrêt du serveur (
std::terminate, signal 6) pendant le démontage d’une requête avec plan distribué (make_distributed_plan = 1) lorsqu’une vérification d’état d’un worker ne parvenait pas à reprogrammer la vérification suivante (par exempleCANNOT_SCHEDULE_TASKà l’arrêt ouMEMORY_LIMIT_EXCEEDED). La requête échoue désormais proprement et le serveur continue de fonctionner. #107575 (Groene AI). - Ajout de vérifications de limites manquantes lors de l’analyse d’Elf et de DWARF. #107579 (Michael Kolupaev).
- Ajout de vérifications de limites manquantes dans le lecteur ORC. #107580 (Michael Kolupaev).
- Corrige une exception (
Digest does not matchlogical error) pouvant se produire avecRENAME TABLE,RENAME DATABASEouCREATE OR REPLACE TABLEimpliquant une tableTimeSeriesdans une base de donnéesReplicated. Le renommage d’une tableTimeSeriesest désormais pris en charge. #107583 (Groene AI). - Corrige un déni de service non authentifié par épuisement de la mémoire sur le port du protocole MySQL. #107599 (Shaohua Wang).
- Corrige
DROP TABLEsur une tableTimeSeriesdans une base de donnéesReplicated, qui laissait auparavant fuir les tables internes et faisait réessayer indéfiniment la tâche de suppression en arrière-plan (DROP TABLE ... SYNCrestait bloqué). #107604 (Groene AI). - Corrige deux problèmes de traversée de chemin dans le protocole de récupération de part répliquée, qui pouvaient permettre à une réplique malveillante d’écrire des fichiers en dehors du répertoire de la part. #107606 (Antonio Andelic).
- Corrige l’erreur ‘Account must be specified error’ lors de la lecture d’une table Delta Lake via Azure. #107620 (Smita Kulkarni).
- Corrige le cas où
ALTER TABLE ... REPLACE PARTITIONsur une tableMergeTreesimple ressuscitait les parts remplacées après un redémarrage du serveur, ce qui amenait la table à renvoyer à la fois les lignes de remplacement et les anciennes lignes remplacées. #107623 (Groene AI). - Corrige un crash du serveur lors de la lecture d’une vue matérialisée dont la cible est une table
Distributedalors que la requête s’exécute avecenable_analyzer = 0. #107653 (Groene AI). - Lorsque plusieurs quotas sont attribués au même utilisateur ou rôle, ils sont désormais tous appliqués conjointement (une requête est rejetée si l’un d’eux est dépassé), au lieu qu’un seul quota soit appliqué et choisi de manière non déterministe.
SHOW QUOTAetsystem.quota_usageaffichent désormais tous les quotas appliqués à l’utilisateur courant. #107664 (Alexey Milovidov). - Correction de
s3et des autres table functions de l’object storage qui renvoyaientLOGICAL_ERRORau lieu deBAD_ARGUMENTSlorsqu’un argument key-value était dupliqué, par exemples3('http://...', format = 'CSV', format = 'TSV'). #107670 (Groene AI). - Correction de l’interface MySQL, qui était inutilisable avec
MySQL Connector/J8.2.0 et les versions ultérieures (y compris 9.x). Le champinfodu paquetOKest désormais encodé avec sa longueur, comme sur le MySQL server, ce qui permet au JDBC driver de se connecter. #107693 (Alexey Milovidov). - Correction d’une
LOGICAL_ERROR(“Input nodes size mismatch in dag”) lorsqu’une query avecmake_distributed_plan = 1effectue une jointure sur une clé enveloppée dans une fonction dont les deux côtés n’ont pas de type commun (par exempleON intDiv(-1, t1.key) = t2.keyavec une clé de droite de typeUInt64). #107701 (Groene AI). - La lecture de données Arrow/ArrowStream avec des columns
String/Binaryvides produites par Apache Arrow Java < 19.0.0 (y compris Apache Spark) ne déclenche plus d’erreurINCORRECT_DATA. #107764 (Raúl Marín). - Correction d’une exception
BAD_GET(“Bad get: has String, requested UInt64”) lors de l’estimation des column statisticscountminlorsqu’une query compare une column à un literal d’un autre type qui n’est pas converti au préalable, commenumeric_col IN (SELECT '5')oustring_col IN (SELECT 5). #107793 (Groene AI). - Correction des table functions
odbcetjdbc, qui pouvaient rester bloquées pendant plusieurs minutes et ignorer l’annulation de query (KILL QUERY,max_execution_time) lorsque le bridge cessait de répondre pendant l’inférence de la structure de la table distante. #107809 (Alexey Milovidov). - Correction d’une exception (
Logical error: 'index >= result.start') lors du formatage d’une query mal formée qui mélange les formes positionnelle et nommée de l’argument secret des table functionss3/gcs, par exemples3('url', 'a', 'b', secret_access_key = 'c'). #107818 (Groene AI). - Correction du skip index
set, qui n’effectuait pas de pruning des granules sur les columnsLowCardinality. #107868 (Konstantin Bogdanov). - Correction de insert deduplication, qui calculait des hash incorrects pour les columns
StringetArrayavec le server settinginsert_deduplication_version = new_unified_hash: des inserts identiques pouvaient ne pas être dédupliqués, car le hash de déduplication dépendait de la position de la row dans le inserted block. #107915 (Sema Checherinda). - Correction de résultats incorrects de
ORDER BYsur des columnsNullableavec plusieurs clés de tri sur macOS (Apple Silicon), causés par une extension de signe manquante dans le comparateur de tri JIT-compiled. #107973 (Raúl Marín). - Correction d’une régression des performances lors de la lecture de columns
Dynamicavec plusieurs threads. Causée par #100730. Ferme #107942. #107997 (Pavel Kruglov). - Le paramètre de data lake obsolète
storage_catalog_urlest désormais correctement rejeté par la protection du catalog (auparavant, seulsstorage_catalog_typeetstorage_aws_access_key_idétaient vérifiés), et le message d’erreur liste tous les paramètres obsolètes. #108040 (Alexey Milovidov). - Correction d’une erreur logique
Bad cast from type DB::ColumnSparse to DB::ColumnVector<char8_t>lorsqu’une requêteLIKElit depuis un indextextvia le chemin de repli en lecture directe sur une colonne stockée en mode clairsemé. #108068 (Groene AI). - Exécute toujours les gestionnaires de fin de lot du cache d’accès, même pour un lot vide. #108124 (Azat Khuzhin).
- Correction d’une
LOGICAL_ERROR(Column identifier is already registered) pour certaines requêtes avecUNION ALL. #100770 (Shaohua Wang). - Correction d’une utilisation après libération du mutex de stockage du workload pendant l’arrêt du serveur. #101447 (Tuan Pham Anh).
- Correction d’un interblocage dans
ALTER DATABASE MODIFY COMMENTavec le catalogShared. #103683 (Nikolay Degterinsky). - Un identifiant vide entre guillemets Unicode déclenche désormais une
SYNTAX_ERRORau lieu deCANNOT_PARSE_QUOTED_STRING. #104173 (leonard9893). - Préserve les types de paramètres d’origine des fonctions d’agrégation
timeSeries*afin que les typesAggregateFunctionconservent correctement leur forme lors du cycle de rattachement de table et avec les répliques parallèles. #104812 (Vitaly Baranov). - Correction d’une
LOGICAL_ERRORpour une CTE matérialisée avecserialize_query_planet des répliques parallèles. #104896 (Igor Nikonov). - Correction d’un dépassement d’entier signé dans les fonctions
timeSeries*ToGridlorsque le paramètre de staleness (fenêtre) est proche deINT64_MAX. #105319 (Groene AI). - Une valeur du paramètre
compatibilityne rétablit plusapply_row_policy_after_finalàfalse, de sorte que les politiques de lignes sont désormais toujours appliquées correctement avecFINAL. #105637 (Yarik Briukhovetskyi). - Correction de
clickhouse chdig clienten respectantSETPGROUP/RESETIDS/SETSIGDEFdans le stubposix_spawn. #105858 (Azat Khuzhin). - Correction d’une exception lors des vérifications de cohérence de merge-tree sur les projections lorsque l’exécuteur de fusion/mutation n’était pas initialisé. #105919 (Mikhail Artemenko).
- Lors de l’analyse d’index sur les projections, l’index
minmaxest désormais chargé depuis la projection elle-même plutôt que depuis la part parente, ce qui produit des résultats corrects. #105940 (Mikhail Artemenko). - Correction d’une exception dans
addMonotonicChainpourmaterialize(monotonic_chain(...)). #106050 (Nikolai Kochetov). - Correction de l’échec de
RESTOREsur les sauvegardes incluant des dépendances deMASKING POLICY. #106086 (Julia Kartseva). - Correction d’une possible corruption de mémoire lors de l’expansion des fonctions SQL définies par l’utilisateur avec
prefer_column_name_to_aliasactivé. #106121 (Nikolai Kochetov). - Un dictionnaire utilisant la connexion bridge est désormais rechargé après un redémarrage du serveur, ce qui rétablit la connexion. Ferme #106151. #106152 (Pedro Ferreira).
- Correction du cache du système de fichiers pour
LocalObjectStorage. #106239 (Kseniia Sumarokova). - Correction de la source distante différée pour les fonctions de table avec
use_delayed_remote_source. #106470 (Nikolay Degterinsky). - Correction de
timeSeriesLastToGridpour les timestamps antérieurs au début de la grille et ceux situés hors de la fenêtre. #106504 (Vitaly Baranov). #106577 (Vitaly Baranov). - Correction d’une
LOGICAL_ERROR(Inconsistent AST formatting) sur un nom de fonction contenant des paramètres de requête. #106635 (Vitaly Baranov). - Correction d’une erreur logique lorsqu’une table est supprimée avant la désérialisation d’une tâche du plan distribué. #106944 (Alexander Gololobov).
- Utilisation d’une comparaison exacte pour les clés
GROUP BYdeNullable. #107050 (Nikolai Kochetov). - Correction d’une
LOGICAL_ERROR(Trying to get name of not a column) déclenchée lorsqu’un argument de fonction de table n’était pas une expression de colonne (par exemple, un sélecteur*non résolu provenant demultiIf/CASE). #107411 (Alexey Milovidov). - Correction de la croissance non bornée du cache des fuseaux horaires (
DateLUT) lorsque de nombreux noms de fuseaux horaires invalides distincts sont traités. #107464 (Alexey Milovidov). - Écriture de l’entrée
part_logavant de signaler qu’une simple mutationMergeTreeest terminée. #107741 (Azat Khuzhin). arrayFoldvérifie désormais la validité de son argument de type tableau en cas d’entrée malformée. #107932 (Michael Kolupaev).- Correction d’une rare situation de concurrence de données et d’une possible utilisation après libération dans le lecteur d’archive d’index de saut mis en cache d’une part
MergeTree, qui pouvait se produire lorsqu’une requête lisait des index de saut pendant que la part était déplacée ou renommée. #107995 (Raúl Marín). - Correction d’une régression des performances pour les sous-colonnes
MapavecPREWHERE. #107988 (Pavel Kruglov). - Corrige
parseDateTimeBestEffortavec un fuseau horaire qui déclenchaitCANNOT_PARSE_DATETIMEsur des lignes NULL detoString(Nullable(DateTime64)). #108310 (Yarik Briukhovetskyi). - Correction de la table function et de l’engine
ArrowFlight, qui rejetaient une named collection omettant la clé facultativedatasetavec l’erreurNo such key 'dataset'. #108041 (Alexey Milovidov). - Correction d’une logical error
Inconsistent AST formattingpour une window function sans argument dans une déclarationCODECou d’engine (par ex.CODEC(cume_dist() OVER (...))) ; cette fonction conserve désormais ses parenthèses afin que la query survive à un aller-retour format/parse. #107806 (Alexey Milovidov). - Corrige
hasTokenlorsqu’une aiguille contenant un séparateur renvoyait silencieusement des résultats via un text index au lieu de leverBAD_ARGUMENTS. #108189 (Jimmy Aguilar Mena). - Le paramètre
use_skip_indexes_on_data_readpeut désormais être rétabli à sa valeur par défaut d’avant la version 26.1 (false) via le paramètrecompatibility, ce qui offre une solution de repli en cas de régression des performances lorsque le chemin on-data-read empêche l’élagage des plages de marques des skip indexesminmax/set/bloom_filter. #108330 (egor romanov). - Correction d’un crash possible (déréférencement de pointeur nul) lorsque la redéfinition
database/dbd’une named collection passée àremote/remoteSecuren’est pas un nom de database constant, par ex.remote(nc, database = (SELECT 1)). La query échoue désormais avec une erreur explicite au lieu de provoquer un crash. #108271 (Groene AI). - Correction d’une refreshable materialized view qui pouvait se bloquer si la connection à ZooKeeper était perdue au mauvais moment. #108234 (Michael Kolupaev).
- Corrige
Bad cast from type DB::ColumnVector<...> to DB::ColumnTuplelors de la lecture d’une columnArray(Tuple(...))dont la valeur est remplie avec des valeurs par défaut, par ex. aprèsALTER TABLE ... ADD COLUMNou après une mutationALTER TABLE ... CLEAR COLUMNinachevée appliquée à la volée. #107232 (Groene AI). - Corrige une logical error
Bad cast from type DB::ColumnDynamic to DB::ColumnNullablelorsqu’une référence explicite à une cléJOIN ... USINGdont le common supertype estDynamicest passée à une aggregate function, par exemplecount(t.key) IGNORE NULLS. #107289 (Groene AI). - Corrige une perte silencieuse de données sur
MergeTreesimple (non répliqué) lorsqueREPLACE PARTITION,MOVE PARTITION,DETACH PARTITIONouDETACH PARTest exécuté sur une partition qui contient encore des correctifs lightweightUPDATEnon appliqués. Ces opérations rejettent désormais la commande, comme le fait déjàReplicatedMergeTree. #107386 (Groene AI). - Corrige un crash (SIGSEGV dans les builds release, assertion d’incompatibilité de type dans les builds debug) dans
hassur uneMapavec une cléDynamiclorsque l’argument de recherche estLowCardinality, par ex.has(map('a'::Dynamic, ...), toLowCardinality('b')). #107956 (Groene AI). - Correction d’un
LOGICAL_ERROR(“Block structure mismatch … betweenConvertingTransformandRemovingReplicatedColumnsTransform”) lors de l’insertion dans une vue matérialisée dont la table cibleTOdéclare une colonne avec unEnumplus large que celui produit par leSELECTde la vue. L’élargissement valide de l’Enumest désormais correctement appliqué. #107648 (Groene AI). - Correction de l’erreur
NUMBER_OF_COLUMNS_DOESNT_MATCHlors de l’interrogation d’une tableDistributed(ou de l’utilisation de parallel replicas) comportant plusieurs colonnesALIASqui se développent en une même expression et qui sont référencées conjointement avecORDER BY/GROUP BY/HAVING. #107913 (Yakov Olkhovskiy). - Correction d’un comportement indéfini (pointeur nul passé à
memcpy) dans les fonctionsdetectCharsetetdetectLanguageUnknownlorsque la chaîne d’entrée dépasse 32768 octets et qu’aucun jeu de caractères ne peut être détecté. #108250 (Groene AI). - Correction d’un
signed integer overflow(comportement indéfini) dansdateDiffavec les unitéshouretminute, sur des valeursDateTime64extrêmes proches des limites de la plageInt64. #108229 (Groene AI). - Correction de
Too many markspour un index de texte sur une merged part vide. #106867 (Azat Khuzhin). - Correction d’un
LOGICAL_ERROR(“Unexpected return type from if”) lors de la lecture d’une colonne avecapply_mutations_on_fly = 1après unALTER UPDATE col = ... WHERE <cond>avec une condition non constante ou fausse, suivi deALTER MODIFY COLUMN col <new type>. #108128 (Groene AI). - Correction d’un arrêt du serveur (
Logical errordansIColumn::insertFrom) lors du transtypage d’unArray(Dynamic)ou d’unArray(Variant)enQBitavecaccurateCastOrNull, par exempleaccurateCastOrNull(CAST(range(114), 'Array(Dynamic)'), 'QBit(Float32, 114)'). #108288 (Groene AI). - Correction d’une erreur de syntaxe lorsqu’un alias suit une sous-requête dans
DESCRIBE TABLE (...) AS .... #100205 (Yarik Briukhovetskyi). getClientHTTPHeaderest désormais correctement traité comme non déterministe, de sorte que son résultat n’est plus réutilisé à tort par le cache de résultat de la requête. #108029 (Alexey Milovidov).
Amélioration de la compilation/des tests/du packaging
- Compiler
delta-kernel-rsavec la featuredefault-engine-native-tlsafin que son propre client HTTP (reqwest) puisse réutiliser l’OpenSSL déjà lié à ClickHouse. Il ne s’agit que d’une activation partielle denative-tls:object_storeforce toujoursreqwest/rustls-tls-native-roots, de sorte quereqwestse retrouve avec les backendsnative-tlsetrustls.delta-kernel-rsreste désactivé sous MSan pour le moment, carringest toujours compilé viaobject_store(à la fois transitivement viarustlset directement pour la signature HMAC des requêtes AWS), et son assembleur écrit à la main ne génère pas les symboles requis par MSan (suivi en amont dans arrow-rs-object-store#585). #96856 (Austin Bonander). - Ajouter une optimisation post-édition de liens PGO (Profile-Guided Optimization) et BOLT (Binary Optimization and Layout Tool) pour le binaire
clickhouse. Les profils sont collectés à partir des workloads d’intégration continue et appliqués, dans la mesure du possible, lors des builds de release — les deux étapes reviennent à une sortie non optimisée si un profil est obsolète ou incompatible. À ce jour, PGO n’apporte aucun bénéfice. #100938 (Alexey Milovidov). - Ajouter le mode
--storageàclickhouse keeper-bench, qui exécute des benchmarks deKeeperStoragein-process (sans réseau, sans raft, sans machine à états), en utilisant les mêmes sections de configsetup/generatorque le mode réseau. #103081 (Michael Kolupaev). - Corriger la compilation avec
ENABLE_AWS_S3=OFF. #105390 (Yue Ni). - Mettre à jour
mongo-cxx-driververs r4.3.0. #105522 (Konstantin Bogdanov). - Corriger la compilation avec RapidJSON. #105674 (Ilya Golshtein).
- Accélérer la compilation en supprimant les inclusions transitives des en-têtes
base/largement utilisés et en retirant le code inutilisé dePoco/Logger.hembarqué. #105702 (Raúl Marín). - Mettre à jour
libxml2de 2.15.1 à 2.15.3. #105985 (Konstantin Bogdanov). - Utiliser
expat2.8.1 dans Poco. #105988 (Konstantin Bogdanov). - Mettre à niveau
thriftversv0.23.0. #105993 (Konstantin Bogdanov). - Utiliser le tag
postgresREL_18_4. #105994 (Konstantin Bogdanov). - Mettre à niveau
krb5vers 1.22.2. #106076 (Konstantin Bogdanov). - Mettre à jour le bundle
curlvers 8.20.0. #106077 (Konstantin Bogdanov). mariadb-connector-ca été mis à niveau vers la version 3.1.29. Tous les patchs pertinents pour ClickHouse ont été conservés. #106287 (Nikita Mikhaylov).- Mise à jour des digests de l’image de base distroless pour corriger des CVE dans libssl3t64. #106360 (Rahul Nair).
- Utilisation de
wasmtimev45.0.1. #106836 (Konstantin Bogdanov). openssla été mis à niveau vers la version 3.5.7. #106844 (Konstantin Bogdanov).- La compilation Docker distroless met désormais aussi à jour les tags flottants
:X.Y-distrolesset:X.Y.Z-distroless, et non plus seulement le tag de version complète. #106932 (Rahul Nair). - Désactivation de fonctionnalités
curlinutilisées, telles que l’authentification NTLM, les cookies, alt-svc, HSTS, DNS-over-HTTPS, netrc, MIME et AWS SigV4. #107226 (Konstantin Bogdanov). - Mise à jour de
NuRaftavec un correctif pour un livelock lors de l’installation d’un snapshot, qui survenait lorsque les E/S du snapshot s’exécutaient sur un thread d’arrière-plan. Le paramètre Keepernuraft_use_bg_thread_for_snapshot_ioreste désactivé par défaut ; l’intégration continue le randomise désormais pour couvrir les deux modes. #107338 (Antonio Andelic). - Correction de la compilation de
abseillorsque le chemin de checkout de ClickHouse contient une sous-chaîne correspondant à une extension d’en-tête. #107349 (zhiqiang). - Détermination de la taille du cache L2 à partir de
CPUIDsur x86_64 au lieu desysconf(_SC_LEVEL2_CACHE_SIZE), spécifique à glibc, qui n’est pas disponible avec musl libc. #107469 (Konstantin Bogdanov). - Augmentation de la taille de pile à 8 MiB pour les builds musl afin de prendre en charge des requêtes fortement imbriquées. #107470 (Konstantin Bogdanov).
- Dérivation de l’ensemble des symboles de bibliothèque C localisés dans les bibliothèques statiques Rust à partir des bibliothèques de référence réelles plutôt que d’une liste d’autorisation maintenue manuellement, afin de couvrir tous les builtins compiler-rt et les fonctions libm de la plateforme. #107571 (Raúl Marín).
- Basculement des images distroless du serveur et de Keeper vers
gcr.io/distroless/base-nossl-debian13afin qu’elles n’embarquent que les bibliothèques effectivement liées par ClickHouse et n’incluent plus celles que nous lions déjà statiquement. #107837 (Rahul Nair). - Réactivation de 50 stateless tests sur MacOS (
arm_darwin) qui étaient ignorés car obsolètes, et utilisation defsyncau lieu deF_FULLFSYNCpour la synchronisation des répertoires sur MacOS. #107887 (Raúl Marín).
Version 26.5 de ClickHouse, 2026-05-21. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- Les valeurs par défaut de
date_time_input_formatetcast_string_to_date_time_modeont été remplacées debasicparbest_effort. Les requêtes qui ne parvenaient auparavant pas à analyser des chaînes de date/heure non basiques (par ex.2024 April 4,Apr 15, 2020 10:30:00) peuvent désormais aboutir par défaut. Pour conserver l’ancien comportement d’analyse strict, définissez ces paramètres surbasic(ou utilisezcompatibility). #89334 (Alexey Milovidov). - Le nom d’élément de
Tuplenullest désormais interdit, car il entre en conflit avec le nom de sous-colonne utilisé pour les null maps deNullable, ce qui entraîne une résolution ambiguë des sous-colonnes. #98377 (Alexey Milovidov). - Ajout des paramètres
dynamic_disk_allow_from_env,dynamic_disk_allow_from_zk,dynamic_disk_allow_includepour interdire l’utilisation defrom_env,from_zketincludedans les disques dynamiques. Il s’agit d’un changement incompatible avec les versions précédentes, car il interdit désormais par défaut un comportement qui était auparavant autorisé par défaut. #99138 (Kseniia Sumarokova). - Vous ne pouvez plus utiliser le lecteur et le writer Parquet obsolètes basés sur Arrow. L’implémentation native sera utilisée à la place. #100949 (Alexey Milovidov).
SHOW CREATE TABLE tprivilégie désormais la table temporaire lorsque des tables permanente et temporaire nomméestexistent toutes deux et qu’aucune base de données n’est spécifiée, conformément au comportement existant deDESCRIBE TABLE. En outre, la syntaxeDESCRIBE TEMPORARY TABLEest désormais prise en charge. #100966 (Alexey Milovidov).- La valeur par défaut de
http_max_fieldsa été réduite de 1,000,000 à 1,000 et celle dehttp_max_field_name_sizede 128 KB à 4 KB afin de limiter l’utilisation de la mémoire en phase de pré-authentification par les connexions HTTP. Ajout des paramètreshttp_max_request_header_sizeethttp_headers_read_timeout. Les utilisateurs qui s’appuyaient sur les anciennes limites plus élevées peuvent les rétablir via les paramètres. #103285 (Sema Checherinda). - Ajout d’une colonne imbriquée
histogramsàsystem.metric_logqui capture un instantané de chaque métrique d’histogramme enregistrée par ligne, avec un nouveau paramètresystem_metric_log_show_zero_values_in_histogramspour contrôler l’émission des valeurs zéro. Cela rend la tablesystem.histogram_metric_logobsolète. #103770 (Miсhael Stetsyuk). CASTversDateTimeouDateTime64sans fuseau horaire explicite préserve désormais le fuseau horaire de son argument source (lorsque la source est unDateTime/DateTime64avec un fuseau horaire explicite), conformément au comportement des fonctionstoDateTime/toDateTime64. Ferme #55072. #104433 (Alexey Milovidov).- Suppression de la table function
kql. UtilisezSET dialect = 'kusto'pour exécuter des requêtes dans le dialecte KQL. #105101 (Alexey Milovidov). - Les window functions
RANKetDENSE_RANKrejettent désormais les arguments et lèventNUMBER_OF_ARGUMENTS_DOESNT_MATCH, conformément au standard SQL. Auparavant, des requêtes telles queRANK(x) OVER (ORDER BY id)étaient acceptées silencieusement, l’argument étant ignoré. Pour rétablir l’ancien comportement permissif, définissezallow_rank_dense_rank_arguments = 1. Ferme #49526. #104324 (Groene AI).
Nouvelle fonctionnalité
- Ajout d’un nouveau paramètre
max_bytes_ratio_before_external_join, calqué surmax_bytes_ratio_before_external_group_byetmax_bytes_ratio_before_external_sort. Il exprime le seuil de spill sur disque pour les hash joins sous forme de fraction de la mémoire disponible ; combiné au seuil absolumax_bytes_before_external_join, c’est le plus petit des deux seuils qui s’applique. #103862 (Alexey Milovidov). Le paramètrenew max_bytes_ratio_before_external_joinest désormais activé par défaut à 0.5, commemax_bytes_ratio_before_external_group_byetmax_bytes_ratio_before_external_sort. Les hash joins basculent automatiquement vers grace hash join dès que les données du côté droit dépassent la moitié de la mémoire système disponible (lorsque des limites mémoire sont configurées). #104285 (Alexey Milovidov). - Ajout de la fonction de table
filesystem. Elle permet de représenter la structure d’un répertoire sous forme de table, et d’interroger avec SQL les métadonnées et le contenu des fichiers. À l’origine #42039 par @perst20. Voir #42039. Voir #50208. #53610 (Alexey Milovidov). - Permet de passer des noms de fonction seuls à des fonctions d’ordre supérieur comme
arrayMap,arrayFilter, etc. Par exemple,arrayMap(negate, [1, 2, 3])est désormais équivalent àarrayMap(x -> negate(x), [1, 2, 3]). #101033 (Alexey Milovidov). - Ajout du paramètre
send_table_structure_on_insert_with_inline_dataet de l’option client--inline-insert-datapour permettre au serveur d’analyser lui-même les données INSERT inline via le protocole natif, en évitant l’aller-retour nécessaire pour récupérer la structure de la table et en améliorant les performances pour de nombreux petits inserts. #101034 (Alexey Milovidov). - Ajout des fonctions
tokenizeQueryethighlightQuerypour la tokenisation des requêtes SQL et la coloration syntaxique.tokenizeQueryrenvoie les tokens du lexer avec leurs offsets en octets et leurs types ;highlightQueryrenvoie des plages de coloration syntaxique basées sur le parser avec des catégories de surlignage (keyword, identifier, function, number, string, etc.). #101054 (Alexey Milovidov). - Ajout du paramètre
url_basepour résoudre les URL relatives dans la fonction de tableurlet le moteur de tableURL, conformément à la RFC 3986. #101113 (Alexey Milovidov). - Prise en charge des valeurs négatives dans la clause
LIMIT BYpour sélectionner des lignes à partir de la fin de chaque groupe plutôt que du début. Par exemple,LIMIT -2 BY idrenvoie les deux dernières lignes parid. Les offsets négatifs (LIMIT -1 OFFSET -1 BY id) et les signes mixtes (LIMIT -2 OFFSET 1 BY id) sont également pris en charge. #103222 (Nihal Z. Miaji). - Prise en charge de la fonction
json_valuepour produire des sorties entupleetarray, afin d’améliorer les performances de plusieurs requêtes JSON. #78362 (kevinyhzou). Prise en charge de l’argument JSONPath multi-cheminsTuple/ArraydansJSON_VALUE,JSON_EXISTSetJSON_QUERY, par @KevinyhZou. #101102 (Alexey Milovidov). - Introduction d’un nouveau paramètre
kafka_autodetect_client_rack. Lorsqu’il est défini, il détecte la zone de disponibilité via les mécanismes du cloud et la propage comme paramètreclient.rackdelibrdkafkaafin d’éviter les communications inter-zones. #81323 (Ilya Golshtein). - Ajout du type d’événement
Readàsystem.blob_storage_logpour suivre les opérations de lecture du stockage objet, contrôlé par le nouveau paramètreenable_blob_storage_log_for_read_operations. #96867 (Alexey Milovidov). - Les utilisateurs peuvent désormais voir les watches ZooKeeper émises par
clickhouse-servergrâce à la nouvelle tablesystem.zookeeper_watches. #99277 (Den Kalantaevskii). - Ajout de l’événement de profil
Shards, qui comptabilise le nombre de shards impliqués dans les distributed queries, totalisé sur l’ensemble des tables. #99470 (Alexey Milovidov). - Les UDF
WASMpeuvent être déclaréesDETERMINISTICet faire l’objet d’un repliement de constantes. #100005 (Vasily Chekalkin). - Ajout du paramètre
parallel_replicas_prefer_local_replica: lorsqu’il est désactivé, les répliques parallèles sont sélectionnées uniquement par l’algorithme de load balancing, ce qui permet même aux queriesmax_parallel_replicas = 1d’être dirigées vers un autre hôte. #100139 (Alexey Milovidov). - Ajout des server settings
{disk,storage,http}_connections_rcvbufet{disk,storage,http}_connections_sndbufpour contrôler la taille des tampons des sockets TCP sur les HTTP connections sortantes, ce qui permet aux opérateurs de surcharger l’autotuning du noyau et de plafonner l’utilisation mémoire par connexion. #100478 (Sema Checherinda). - Prise en charge de
CREATE OR REPLACE MATERIALIZED VIEWavec la même sémantique de permutation atomique queCREATE OR REPLACE TABLE. Fonctionne avec les tables internes, les tablesTO,POPULATE,REFRESHetON CLUSTER. #100539 (DQ). - Ajout des histogram metrics
s3_read_request_duration_microsecondsets3_read_request_bytespour observer la durée de vie des connexions des requêtes GET S3 et le volume d’octets consommés, visibles danssystem.histogram_metricset sur le Prometheus endpoint. #102058 (Sema Checherinda). - Ajout des table engines
Paimon,PaimonS3,PaimonAzure,PaimonHDFSetPaimonLocalavec prise en charge de l’Incremental read, reposant sur le suivi de progression des snapshots Keeper. Le mode incrémental ne renvoie que les nouvelles lignes depuis le dernier snapshot committed. Des lectures delta ciblées d’un snapshot sont disponibles viapaimon_target_snapshot_id, ainsi que des limites de snapshots par requête viamax_consume_snapshots. Le metadata refresh en arrière-plan est configurable avecpaimon_metadata_refresh_interval_sec. Contrôlé parallow_experimental_paimon_storage_engine. #102343 (XiaoBinMu). - Ajout d’un nouveau paramètre de Kafka table,
kafka_map_virtual_columns_on_write. Lorsqu’il est activé, les colonnes nommées_key,_timestamp,_headers.nameet_headers.valuedans le schéma de la Kafka table sont produites comme clé, timestamp et headers correspondants du message Kafka lors deINSERT, et sont exclues du message payload. #103243 (Alexey Milovidov). - Ajout des requêtes
SYSTEM PAUSE VIEW [db.]nameetSYSTEM PAUSE VIEWSpour les vues matérialisées actualisables. Contrairement àSYSTEM STOP VIEW,SYSTEM PAUSE VIEWn’interrompt pas l’actualisation en cours — l’actualisation déjà lancée est autorisée à aller jusqu’au bout, et seules les actualisations suivantes sont empêchées. L’annulation se fait viaSYSTEM START VIEWouSYSTEM START VIEWS, qui effacent désormais de manière uniforme les états arrêté et en pause. #103252 (Nikita Mikhaylov). - Ajout de la fonction
regexpPosition(avec les alias compatibles PostgreSQLregexpInstretregexp_instr) qui renvoie la position en octets de la N-ième correspondance regex dans une chaîne. Prend en charge le décalage de départ, le mode retour après correspondance, les flags regex et la sélection du groupe de capture. #104172 (Abhinav Agarwal). - Nouvelles fonctions
isPrimeetisProbablePrimepour les tests de primalité.isPrimerenvoie un résultat exact pour les entiers non signés jusqu’àUInt64.isProbablePrimeprend également en chargeUInt128etUInt256; pour ces types plus larges,0signifie assurément composé et1signifie probablement premier. Le deuxième argument facultatif deisProbablePrime,rounds, contrôle le niveau de confiance (plafonné à256) ; la valeur par défaut de25itérations borne le taux de faux positifs pour un composé aléatoire à moins de10^-15, etisProbablePrimepeut être annulée. #104234 (Nihal Z. Miaji). #104639 (Alexey Milovidov). #104806 (Nihal Z. Miaji). clearet/cleareffacent désormais le terminal dans les outils en ligne de commande clickhouse, au lieu d’être exécutés comme une requête erronée. #104318 (Tyler Hannan).- La fonction de table
filepeut désormais accepter unArray(String)de chemins dans les requêtesSELECT. #104442 (Yue). - Ajout des colonnes
deterministicethigher_orderà la tablesystem.functions. #104479 (Pedro Ferreira). - Ajout d’un paramètre facultatif de variante d’encodage à
bech32Encode(bech32/bech32m) et d’un mode de décodage brut àbech32Decodepour l’encodage d’adresses non-SegWit (par ex. Cosmos SDK, Injective, Osmosis). #98986 (Yash ). - Vous pouvez désormais écrire des données au format
AvroConfluent, qui était auparavant limité à l’entrée. Cela permet de produire directement depuis ClickHouse des messages Avro encadrés par Confluent Schema Registry, par exemple lors de l’écriture vers Kafka. Le schéma est automatiquement enregistré dans le registre. Utilisez le nouveau paramètreoutput_format_avro_confluent_subjectpour spécifier le nom du sujet. #101935 (János Benjamin Antal). - Ajout de la fonction
prettyPrintJSONpour mettre en forme une chaîne JSON dans un format lisible par l’humain. Utile pour les tableaux de bord ou les rapports, où le formatage nécessitait auparavant une étape supplémentaire côté client. Clôt #62523. #102594 (Dmitry Prokofyev). - Ajout de
STRING_AGGcomme alias insensible à la casse degroupConcat, pour la compatibilité avec PostgreSQL / le SQL standard. #105125 (Alexey Milovidov). - Les résultats de chaque sous-requête peuvent désormais être mis en cache indépendamment à l’aide de
SETTINGS use_query_cache = truesur des sous-requêtes spécifiques, sans mettre en cache l’intégralité de la requête englobante. Un nouveau paramètre,query_cache_for_subqueries = true, permet de propager en masseuse_query_cacheà toutes les sous-requêtes. Remarque :use_query_cachesur la requête englobante ne se propage plus automatiquement aux sous-requêtes. #99804 (Vincent Voyer). - Ajout de la coloration syntaxique basée sur un lexer dans l’éditeur de requêtes de l’interface web (
play.html), calquée sur les couleurs declickhouse-client. #105105 (Alexey Milovidov).
Fonctionnalité expérimentale
- Ajout d’une interface de terminal web expérimentale à
/webterminal, qui fournit dans le navigateur une session interactiveclickhouse-clientvia WebSocket. Désactivée par défaut ; activez-la avec le paramètre serveurallow_experimental_webterminal. Voir ici. #100277 (Alexey Milovidov). #105191 (Alexey Milovidov). #105059 (Alexey Milovidov). - Le moteur
Kafka2(expérimental, avec un stockage des offsets basé sur Keeper) prend désormais en charge les requêtesSELECTdirectes ainsi que le paramètrekafka_commit_on_select. #100276 (Alexey Milovidov). - Les UDF
WASMpeuvent désormais convertir un plus grand nombre de types numériques : les entiers plus petits en entiers plus larges (par ex.Int8versUInt64), et n’importe quel entier en nombre à virgule flottante (par ex.Int32versFloat32). #100435 (Vasily Chekalkin). - Prise en charge de la fonction
LIKEdans la requêteDELETE FROM system.webassembly_modules. #104397 (Vladimir Cherkasov). - Prise en charge des types géo pour
Iceberg. #103113 (Konstantin Vedernikov). - Ajout de la prise en charge des instructions préparées au serveur ArrowFlight SQL. #103047 (Yakov Olkhovskiy).
- Robustesse du parseur KQL (pour la prise en charge du langage Kusto) améliorée grâce à la préservation de la profondeur du parseur et des compteurs de retours arrière entre les étapes du parseur KQL, afin que les limites du parseur soient suivies de manière cohérente pour les requêtes KQL complexes. #103528 (Yakov Olkhovskiy).
Amélioration des performances
- Réutilisation du cache de métadonnées du footer Parquet lors de la lecture de fichiers Parquet locaux via la table function
fileou le table engineFile. Auparavant, le cache n’était consulté que pour les backends de stockage objet. #104260 (Alexey Milovidov). - Propagation de
ORDER BY ... LIMIT nà travers les jointuresLEFT/RIGHTlorsque la clé de tri ne référence que des colonnes du côté préservé par la jointure, ce qui limite le nombre de lignes que l’entrée de ce côté doit produire avant la jointure. Contrôlé par le nouveau paramètrequery_plan_top_k_through_join(activé par défaut). #104268 (Alexey Milovidov). - Activation par défaut des paramètres
use_top_k_dynamic_filteringetuse_skip_indexes_for_top_kafin d’améliorer les performances des requêtesORDER BY ... LIMIT N. #99537 (Alexey Milovidov). Restriction par défaut deuse_top_k_dynamic_filteringaux colonnes de tri de longueur fixe, afin d’éviter des régressions sur les requêtesORDER BY <var-length-column> LIMIT Noù le coût de comparaison du seuil pour chaque ligne dépasse les gains d’E/S. Le comportement précédent reste disponible via le nouveau paramètreuse_top_k_dynamic_filtering_for_variable_length_types. #104216 (Alexey Milovidov). - Utilisation de la fonctionnalité oversize-arena de
jemallocpour réduire les défauts de page. #103958 (Nikita Taranov). - Limitation du nombre de streams actifs simultanément dans
UNION ALLafin de réduire le pic d’utilisation mémoire. #100176 (Alexey Milovidov). - Légère optimisation du userspace page cache. #100300 (Alexey Milovidov). Désormais, le userspace page cache est toujours meilleur que l’OS page cache.
- Les lectures à froid depuis le stockage objet via le userspace page cache (
use_page_cache_for_object_storage = 1) sont désormais nettement plus rapides, car les défauts de cache consécutifs sont regroupés en une seule requête HTTP au lieu d’une requête par blocpage_cache_block_size. #104230 (Alexey Milovidov). - Accélération de l’analyse d’index impliquant des conversions de type et l’application de fonctions. Closes #55653. #100366 (Alexey Milovidov).
- Accélération des requêtes volumineuses sur les tables
Mergeportant sur un très grand nombre de tables sous-jacentes. Closes #32465. #100369 (Alexey Milovidov). - Suppression de la vtable des types de champs de paramètres, ce qui réduit d’environ 28x la taille de copie de
Settingset améliore la localité du cache grâce à une organisation en tableaux typés pour tous les types de paramètres. #102269 (Raúl Marín). - Ajout des paramètres
max_threads_min_free_memory_per_threadetmax_insert_threads_min_free_memory_per_threadpour réduire automatiquement le parallélisme des requêtes lorsque le serveur manque de mémoire libre. #100383 (Alexey Milovidov). - Réduction de l’utilisation mémoire sur les systèmes disposant de peu de mémoire (< 4 GiB). #100389 (Alexey Milovidov).
- Ajout de
OptimizeTrivialGroupByLimitPass. Pour les requêtes trivialesSELECT ... FROM t GROUP BY k LIMIT n(sansHAVING,ORDER BYni window functions), l’analyzer définit désormaismax_rows_to_group_by = n + offsetavecgroup_by_overflow_mode = 'any', de sorte que l’aggregation s’arrête dès quenclés distinctes ont été produites, au lieu de regrouper l’ensemble des données en entrée. Contrôlé par le nouveau paramètreoptimize_trivial_group_by_limit_query(activé par défaut). #104473 (Amos Bird) (Alexey Milovidov). - Index min-max implicite au niveau du granule pour les virtual columns
_part_offsetet_block_number, y compris pour les projections. Permet un pruning rapide des granules en fonction des prédicats sur les colonnes virtuelles. #103952 (Mikhail Artemenko). #104746 (Mikhail Artemenko). #105137 (Mikhail Artemenko). - Pour la famille de méthodes d’aggregation
prealloc_serialized, précalcule les hash par ligne pendant la passe de sérialisation par batch et les utilise pour (a) éviter de recalculer le hash dansemplaceKey/findKeyet (b) effectuer un software prefetch du bucket de la ligne suivante. Accélère l’aggregation multi-clés de chaînes/sérialisée en masquant la latence des défauts de cache de la hash table. #104475 (Amos Bird) (Alexey Milovidov). - Query condition cache pour les tables
Iceberg. #102115 (Konstantin Vedernikov). - Optimise
cramersV,cramersVBiasCorrected,theilsUetcontingencylorsqu’ils sont utilisés avec des window functions. Corrige #83521. #93384 (Nihal Z. Miaji). - Ajout d’une query optimization qui réécrit
tupleElement(dictGet('dict', ('a', 'b', 'c'), key), N)endictGet('dict', 'a', key), évitant de récupérer des dictionary attributes inutiles. Contrôlé par le paramètreoptimize_dictget_tuple_element(activé par défaut). #100186 (Alexey Milovidov). - Active le buffering pour les étapes de tri sur l’initiateur pour les distributed queries avec tri. #100661 (Nikita Taranov).
- Amélioration des performances pour
partial_mergeJOIN. #100945 (Artem Zuikov). - Réduction légère de la surallocation mémoire dans
partial_mergeJOIN. #100963 (Artem Zuikov). - Optimise les allocations/deallocations en mettant en cache les paramètres de sampling au lieu de parcourir toute la hiérarchie du traqueur mémoire. #101267 (Azat Khuzhin).
- Réduit le surcoût des allocations mémoire lors des multipart uploads S3 en préallouant les conteneurs internes de suivi. #101799 (Gagan Dhakrey).
- Ajoute un software prefetch dans la phase de probe du hash join afin de réduire la latence d’accès mémoire pour les grandes hash tables, contrôlé par le paramètre
enable_software_prefetch_in_join. #102444 (Xiaozhe Yu). - Optimisation du layout de
MemoryTracker, avec un gain de performances d’environ 25 %. #103464 (Azat Khuzhin). - Réécriture des prédicats
coalesce(a, b, ...) <op> constetifNull(a, b) <op> constavant l’analyse des index, afin que la clé primaire par colonne et les skip indexes sur chaque argument puissent élaguer les granules. Contrôlé par le nouveau paramètreallow_key_condition_coalesce_rewrite(activé par défaut). #103468 (Manuel). - Amélioration significative des performances des requêtes lors de la lecture de catalogs Iceberg avec de gros fichiers de métadonnées JSON grâce à l’optimisation du traitement des slashs échappés. #103998 (Mohaidoss).
- Évite le surcoût de l’index uncompressed cache lorsque le cache est désactivé (paramètre serveur
index_uncompressed_cache_size = 0, valeur par défaut). #104063 (Michael Kolupaev). - Correction des requêtes
ORDER BY ... LIMITavec une petite limite qui lisaient un nombre excessif de granules lorsqu’elles étaient combinées avec un filtreWHEREpeu sélectif. Auparavant, tout filtre au-dessus d’une lecture dans l’ordre désactivait le découpage des tâches par plage de marques, de sorte que le pipeline ne pouvait pas annuler entre les granules et lisait la part entière pour chaque flux. #104112 (Vladimir Cherkasov). - Correction de l’absence de réutilisation du cache des tailles de hash table après réordonnancement des côtés du JOIN. #104131 (Nikita Taranov).
- Lorsque
fsync_after_insertest activé, le fsync des fichiers de part est désormais effectué en parallèle via l’IO thread pool, ce qui accélère la finalisation des insertions sur les wide tables. Le chargement complet de ClickBenchhitsest environ 22 % plus rapide. #104137 (Alexey Milovidov). - Vectorisation de
find_first_symbols,find_first_not_symbols,find_last_symbols_or_null,find_last_not_symbols_or_nulletsplitIntosur AArch64 à l’aide de NEON. Auparavant, ces helpers n’avaient un chemin SIMD que sur x86 (SSE2 / SSE4.2) et retombaient sur une boucle scalaire sur ARM. Accélère le parsing TSV d’environ 2x, les fonctions d’URL etsplitByChard’environ 1,3x sur le dataset ClickBenchhits; le parsing de JSON très denses (cadence de champs inférieure à 16 octets) régresse légèrement, conformément au compromis SSE2 existant. #104228 (Alexey Milovidov). - La lecture de données via une colonne
ALIAStriviale (par ex.some_alias['key']oùsome_alias ALIAS m) emprunte désormais le même chemin de lecture par sous-colonne qu’une référence directe à la colonne sous-jacente, rétablissant d’importantes économies d’E/S pour les colonnes aliaséesMap,Array,TupleetNullable. #104245 (Raúl Marín). - Réduction de la contention sur les verrous dans le chemin de lecture asynchrone du système de fichiers distant en rendant
AsyncReadCounterslock-free par requête. #104374 (Nikita Mikhaylov). - Plan de requête légèrement amélioré pour le scan ordonné des projections. #103723 (Mikhail Artemenko).
- Extension de
optimizeUseNormalProjectionspour gérer également un cas spécifique où rien n’était filtré, mais où la clé de tri de la projection peut supprimer l’étape de tri du plan de requête. #104680 (Mikhail Artemenko). - Permet au sucre syntaxique
json.path[]et aux indications de type explicites de fonctionner correctement sur des pathsJSONtypés. #99179 (Pavel Kruglov). - Optimise
json.path[N].nested.path(qui se développe entupleElement(tupleElement(json.path[N], 'nested'), 'path')) enjson.path[].nested.path[N], ce qui permet de lire beaucoup moins de données. #99802 (Pavel Kruglov). - Optimise les vérifications d’accès
SHOW TABLESdanssystem.partsen déplaçant les vérifications de grants au niveau de la base de données hors de la boucle sur les tables. #100860 (Shaohua Wang). - Supprime une vérification d’accès
SHOW TABLESredondante par table dans la voie rapideSELECT name/SELECT database, namedesystem.tables. #100881 (Shaohua Wang). - Active la compilation JIT sur macOS. #100947 (Alexey Milovidov).
- Évite de différer la policy de ligne après
FINALlorsqu’elle dépend uniquement des colonnes de clé de tri et qu’elle est déterministe, et évite aussi le reportPREWHEREcorrespondant qu’elle imposait dans ce cas. #102884 (Yarik Briukhovetskyi). - Ajoute la prise en charge de
hasAnyethasAllcomme prédicats de filtre dans les index de texte. #103266 (Anton Popov). - Redirige l’état du tas MergeTree de longue durée de vie (métadonnées par part et par table) vers une arena jemalloc dédiée, exposée via les métriques asynchrones
jemalloc.mergetree_arena.*. Réduit la fragmentation de l’arena par défaut en régime stabilisé et évite que les survivants par part n’immobilisent des pages qui pourraient autrement expirer. #104136 (Raúl Marín). - Améliore la gestion des timeouts du client ZooKeeper sous forte charge lorsque de nombreuses requêtes sont pipelinées sur une seule session. Le client ZooKeeper utilise désormais un timeout basé sur la progression : tant que des données sont reçues du serveur dans
session_timeout_ms, l’attente est prolongée. Un plafond strict de3 * session_timeout_mspar requête continue de borner la latence côté appelant. Ferme #100466. #104351 (Antonio Andelic). - Déplace les indicateurs de trace par événement dans un tableau séparé et les alloue à la demande, réduisant ainsi le surcoût du tracing
ProfileEvents. #105030 (Azat Khuzhin). - Ajoute
compareTrackAtpourColumnDecimal, ce qui améliore les performances de comparaison des colonnesDecimal. #105110 (Artem Zuikov). - Ajoute une implémentation SIMD de
MD5(AVX2/AVX512) qui calcule le hash de plusieurs entrées en parallèle, améliorant ainsi le débit. #105161 (Joanna Hulboj).
Amélioration
- Amélioration de la sortie d’aide de toutes les applications ClickHouse :
--helprenvoie désormais systématiquement le code de sortie0, affiche sa sortie surstdout, etclickhouse --helpau niveau racine liste toutes les sous-commandes. Ajout d’une option--no-sudopourclickhouse start/restart(utile dans Docker), ainsi que d’une sous-commandeclickhouse help. Suite de #58244 par @qoega. #98148 (Alexey Milovidov). - La valeur par défaut de
input_format_column_name_matching_modepasse dematch_caseàauto. Les formats d’entrée qui font correspondre les noms de colonnes en entrée au schéma de la table (JSONEachRow,CSVWithNames,JSONColumns,BSONEachRow,RowBinaryWithNames, etc.) tentent désormais d’abord une correspondance sensible à la casse, puis basculent vers une correspondance insensible à la casse si aucune correspondance sensible à la casse n’est trouvée. Le comportement strict précédent est conservé souscompatibility. #104320 (Alexey Milovidov). - Ajout de
STDDEVcomme alias insensible à la casse destddevSamppour la compatibilité PostgreSQL/standard SQL. #105120 (Alexey Milovidov). - Ajout de
array_to_stringcomme alias insensible à la casse dearrayStringConcatpour la compatibilité PostgreSQL. #105121 (Alexey Milovidov). - Ajout de
unnestcomme alias insensible à la casse dearrayJoinpour la compatibilité PostgreSQL (forme d’appel de fonction). #105124 (Alexey Milovidov). - La barre de progression de
clickhouse-clientaffiche désormais, à côté de la RAM, les données temporaires utilisées sur disque (par ex. pour le tri externe, l’agrégation ou JOIN), avec en plus une ventilation par hôte pour les requêtes distribuées. #105190 (Alexey Milovidov). - Ajout de
system.predicate_statistics_log, un nouveau journal échantillonné de la sélectivité des filtres de prédicat et de l’élagage des granules d’index MergeTree par requête. Désactivé par défaut ; à activer via le paramètre serveurpredicate_statistics_sample_rate. Nécessaire pour les recommandations automatiques d’index et de projections. #98727 (Yarik Briukhovetskyi). - Autorise l’omission du shard local lorsqu’une table est manquante et que
skip_unavailable_shardsest activé. #100141 (Alexey Milovidov). - Ajout d’avertissements au démarrage (visibles dans
system.warnings) lorsqu’un ensemble mdraid Linux est en cours de resynchronisation ou se trouve dans un état dégradé, car ces deux situations peuvent affecter les performances des E/S disque ou indiquer des défaillances de disque. #100941 (Alexey Milovidov). - Les UDFs WASM apparaissent désormais dans
system.functionsavec les colonnesorigin(WasmUserDefined),syntax,argumentsetreturned_valuecorrectement renseignées à partir de leurs métadonnées de type ClickHouse. Auparavant, elles étaient soit absentes, soit listées en double avec une origine incorrecte. #101053 (Vasily Chekalkin). - La fonction de table
generate_seriesprend désormais en charge des valeurs de pas négatives pour générer des séquences décroissantes, par ex.SELECT * FROM generate_series(99, 0, -1). #101056 (Alexey Milovidov). - Correction des exceptions
Context has expiredlevées par certaines fonctions (dotProduct,formatRow,structureToCapnProtoSchema/structureToProtobufSchema, fonctions définies par l’utilisateur) lorsqu’elles sont utilisées dans des chemins d’exécution différée, tels que les expressionsDEFAULT/MATERIALIZEDet les paramètres du moteur de table, en veillant à ce que ces fonctions conservent une référence forte au contexte lorsque nécessaire. #101109 (Alexey Milovidov). - Correction d’erreurs logiques
Cache limits violatedintempestives sur des priorités créées avec des limites à zéro (comme la priorité du filesystem cache par requête utilisée lorsqueenable_filesystem_query_cache_limitest activé). #101428 (Alexey Milovidov). - Détection automatique de la région pour les endpoints
s3express. #101520 (Pradeep Chhetri). - Prise en charge des identifiants de champ pour les data files lors des écritures
Iceberg. Clôt #102322. #102362 (Konstantin Vedernikov). - Le panneau de gauche de la web UI (
play.html) défile désormais indépendamment, reste visible lorsque la page défile, et un clic sur une table fait défiler jusqu’à la zone de requête. #102498 (Alexey Milovidov). - Permet d’ouvrir l’interface Play dans un nouvel onglet via Ctrl/Cmd/Shift+clic ou clic du milieu sur le logo ClickHouse dans le panneau de gauche. #102501 (Alexey Milovidov).
- Nouvelles metrics pour suivre la mémoire utilisée par les primary keys des projections et l’index granularity des projections sur l’ensemble des tables. #102587 (Narasimha Pakeer).
- Application de
max_network_bandwidth_for_useretmax_network_bandwidth_for_all_usersaux lectures/écritures sur remote filesystem. #103080 (Azat Khuzhin). - Amélioration de la résilience des backups lorsque les Refreshable Materialized Views sont constamment rafraîchies, en prenant les décisions à partir de l’état instantané des tables plutôt que d’un état global. #103384 (Nikita Mikhaylov).
SELECT * FROM system.databasesrépertorie désormais toujours les databases du data lake catalog, indépendamment du paramètreshow_data_lake_catalogs_in_system_tables. Auparavant, elles étaient masquées par défaut, ce qui était incohérent avecSHOW DATABASES, qui les affichait toujours. #103444 (Alsu Giliazova).- Alignement de la valeur par défaut du server setting
concurrent_threads_soft_limit_ratio_to_coresdans le code sur la valeur fournie dansconfig.xml(2), afin que le scheduler de threads concurrentmax_min_fairpar défaut limite les threads de query processing à 2x le nombre de cœurs dès le départ, même lorsque leconfig.xmlfourni n’est pas utilisé. #103446 (Alexey Milovidov). - Robustesse améliorée du sanitizer dans le parser et dans certains cas limites des fonctions de chaîne, grâce à la gestion des entrées vides dans
getURLScheme, à l’évitement de l’arithmétique sur pointeur nul dans les vérificationsmax_query_sizedeLexer::nextToken, et à l’arrêt anticipé de l’évaluation de sous-séquence UTF-8 sur des haystacks vides avant le décodage. #103489 (Yakov Olkhovskiy). - Amélioration de la justesse de l’inférence de monotonie pour
divide(0, x)etintDiv(0, x): auparavant, ces fonctions étaient systématiquement considérées comme monotones, alors que0 / xn’est pas monotone sur tout intervalle incluant 0, car0 / 0n’est pas défini (NaN/Infpourdivide, exception de division par zéro pourintDiv). Cette hypothèse erronée amenaitKeyCondition::applyMonotonicFunctionsChainToRangeà produire des intervalles avecleft > right, ce qui déclenchait uneLOGICAL_ERRORInvalid binary search result in MergeTreeSetIndexdans les builds de débogage lorsqu’une expressionIN/NOT INsur la clé primaire encapsulait la clé dansdivide(0, key)ouintDiv(0, key). Les builds de release n’étaient pas affectés — l’assertion est conditionnée par#ifndef NDEBUG. #103621 (Groene AI). - Remplacement des métriques asynchrones
HTTPConnectionPool*TCP{Rcv,Snd}BufBytes_{p50,p75,p90,p95}par un histogramme à bucketshttp_pool_tcp_buf_bytes(labelsgroup,direction) danssystem.histogram_metrics. Les métriques asynchrones de total par groupe sont conservées. #103704 (Sema Checherinda). - Les paramètres du serveur
{disk,storage,http}_connections_{rcvbuf,sndbuf}sont désormais indiqués comme modifiables sans redémarrage danssystem.server_settings. Leurs valeurs peuvent être mises à jour viaSYSTEM RELOAD CONFIG; le mécanisme d’application à l’exécution était déjà en place depuis #100478. #103772 (Sema Checherinda). - Ajout de la prise en charge des symboles résolus (
Array(String)) dansflameGraph. #103816 (Azat Khuzhin). - Le client CLI peut désormais spécifier
<rainbow_parentheses>false</rainbow_parentheses>dans sa config, dans les environnements où les couleurs du terminal nuisent à la lisibilité des parenthèses (de même,clickhouse formatprend désormais en charge--no_rainbow_parentheses). #103851 (Larry Snizek). - Correction de la recherche UTF-8 insensible à la casse dans
MultiVolnitskyen annulant les insertions partielles deputNGramen cas d’échec et en basculant les needles en échec vers des searchers de repli, afin d’éviter un état incohérent. #103864 (Yakov Olkhovskiy). - Implémentation de
sched_getcpuviarseqTLS dans musl avec compatibilité glibc. #104016 (Azat Khuzhin). - Une refreshable materialized view Replicated en mode APPEND ne sera plus rafraîchie deux fois si la connexion à ZooKeeper est brièvement perdue pendant le rafraîchissement. #104051 (Michael Kolupaev).
- Les tables Distributed sans liste de colonnes explicite peuvent désormais valider les clés de sharding par rapport à la structure inférée de la table distante. #104111 (Yue).
- Correction du REST catalog avec le path
Azureabfss. #104120 (Konstantin Vedernikov). - Les paramètres d’authentication
role_arnetrole_session_namesont désormais pris en compte dans le client de snapshot S3 de Keeper, ce qui permet aux téléversements de snapshots d’utiliser une authentication STS basée surAssumeRole. #104140 (Alexey Milovidov). - Corrige une fuite de mémoire lors de l’exécution de requêtes avec des CTE
MATERIALIZED. #104153 (Alexey Milovidov). - Corrige l’exception
lowerUTF8/upperUTF8lors du traitement de grands jeux de données non ASCII (p. ex. lors de la création d’index de texte), lorsque le tampon de sortie accumulé dépasse 2 GiB ; rejette les lignes individuelles excessivement longues avec un message d’erreur clair. #104229 (Shaohua Wang). - Renforce le chargement des statistiques de colonnes de MergeTree face aux défaillances d’E/S transitoires afin d’éviter la désactivation permanente des optimisations fondées sur les statistiques pour les parts affectées. #104372 (zoomxi).
INSERT INTO ... SELECT FROM input(...)ne nécessite plus le grantCREATE TEMPORARY TABLE. #104470 (Alexey Milovidov).- Ajoute un nouveau paramètre MergeTree
concurrent_part_removal_threshold_for_remote_disk(par défaut16), utilisé à la place deconcurrent_part_removal_thresholdlorsqu’au moins une part en cours de suppression est stockée sur un disk distant. Le seuil précédent de100pouvait faire en sorte queDROP TABLEet d’autres opérations de suppression de parts sur des backends d’object storage restent bloqués pendant des dizaines de secondes, car les suppressions étaient effectuées en série alors que chacune correspond à un aller-retour réseau distinct. Le nouveau paramètre fait emprunter bien plus tôt le chemin de suppression en parallèle sur le stockage distant, tout en laissant inchangé le comportement sur disk local. #104676 (Groene AI). - Le nouveau paramètre
defer_partition_pruning_after_final(par défaut1) permet de désactiver le comportement introduit en 26.3 consistant à ne pas appliquer le partition pruning sousFINAL. Définissez-le sur0pour rétablir le partition pruning d’avant la version 26.3 — nettement plus rapide sur les workloads de journaux d’événements où les lignes ayant la même PK ne peuvent pas s’étendre sur plusieurs partitions.compatibility = '26.2'le bascule automatiquement à0. #104705 (Nikita Fomichev). - Corrige
intExp2, qui renvoyait des résultats erronés pour les entrées hors plage (shifts>= 64sous JIT, et entiers dont la valeur absolue dépasseINT_MAXsur les deux chemins de code). #105054 (Raúl Marín). - Met entre guillemets les arguments shell construits à partir des options CLI et des entrées analysées dans
clickhouse installetclickhouse git-import, afin que les paths, les noms d’utilisateur/groupe et les hashes de commit contenant des espaces ou des métacaractères shell soient correctement gérés. #105232 (Raúl Marín). - Le table engine
Aliasn’est désormais plus Experimental et est disponible sans le paramètreallow_experimental_alias_table_engine. #103488 (Alexey Milovidov). - Ajoute l’option
--queries-formatàclickhouse-benchmarkpour choisir entre le format d’entrée par défaut, avec échappement des tabulations et une requête par ligne (tsv), et l’analyse de l’entrée standard comme un script contenant plusieurs requêtes séparées par;(script). #99972 (Aleksandr Musorin). - Les opérateurs de Tuple appliqués élément par élément
tuplePlus,tupleMinus,tupleMultiply,tupleDivide,tupleModulo,tupleIntDivettupleIntDivOrZerosont désormais variadiques et acceptent deux tuples ou plus de même taille, avec une application élément par élément selon un left-fold. Auparavant, ils n’acceptaient que deux arguments exactement. #104659 (Aruj Bansal). - Ajout d’une nouvelle interface web intégrée à
/processors-profilequi visualise sous forme de carte de chaleur le pipeline de toute requêteSELECTpassée, à partir desystem.query_logetsystem.processors_profile_log. Chaque processeur est coloré en fonction de sonelapsed_uset affiche, au survol, des statistiques par processeur (lignes, octets, temps d’attente). #104614 (Nikita Mikhaylov). - Le réglage
query_plan_use_logical_join_step(et son aliasquery_plan_use_new_logical_join_step) est désormais obsolète et n’a plus aucun effet ; l’étape de jointure logique est désormais toujours utilisée. #104017 (Vladimir Cherkasov). - Le champ de saisie
userdansplay.htmlet les autres pages web intégrées (dashboard.html,jemalloc.html,merges.html,binary.html,webterminal.html) n’est plus prérempli avec le texte littéraldefault. Il affiche désormais un texte indicatifuseret reste vide par défaut. Lorsqu’il est laissé vide, la page n’envoie pas de paramètre d’URLuser=(et le JSON d’authentification de WebTerminal omet le champuser) ; le serveur applique donc son comportement habituel de repli vers l’utilisateurdefault, et les identifiants HTTP fournis par d’autres canaux (X-ClickHouse-User, HTTP Basic, configuration<handler><user>propre au handler) ne sont plus écrasés. #105254 (Alexey Milovidov). - Lecteur
ORC: dissociation de la lecture basée sur les offsets (readBigAt) deuse_prefetch, afin que les données encodées EC surHDFSpuissent être lues correctement même lorsqueuse_prefetch = false(par exemple par Gluten). #103348 (zhanglistar). - Les fichiers téléchargés depuis
play.htmlau formatCSVWithNamesutilisent désormais l’extension.csv. #103737 (JackFielding). - Validation des entrées renforcée pour le catalogue BigLake. #105117 (Konstantin Vedernikov).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Corrige le formatage incohérent en mémorisant si une expression était entre parenthèses. #92340 (Alexey Milovidov).
- Corrige la justesse de la comparaison entre les types Decimal et Float. #94293 (zoomxi).
- Autorise les arguments positionnels dans les requêtes distribuées. #94359 (simonmichal).
- Corrige un échec d’assertion dans
DatabaseCatalog::updateDependencieslors de la suppression puis de la recréation d’une vue matérialisée portant le même nom ; corrige également la perte silencieuse des dépendances de vue lors deRENAME TABLEouEXCHANGE TABLESlorsque les dépendances référentielles étaient vides. #98779 (Alexey Milovidov). - Corrige un arrêt du serveur (échec d’assertion dans
DatabaseCatalog::getTableImpl) qui survenait lors de la création d’une table viaON CLUSTERavec un UUID identique à celui d’une base de données existante. #98861 (xiaohuanlin). - Corrige l’utilisation des skip indexes lors de la lecture des données (avec le paramètre
use_skip_indexes_on_data_readactivé) et des patch parts existantes créées par des lightweight updates. #99543 (Alexey Milovidov). - Corrige l’exception “Not-ready Set” lorsqu’un filtre avec
IN (subquery)est déplacé vers PREWHERE par l’optimiseur de requêtes. #100375 (Alexey Milovidov). - Corrige l’erreur “Cannot find column” lors de l’utilisation conjointe de
ADD COLUMNetRENAME COLUMNdans une même instructionALTER TABLE. #100387 (Alexey Milovidov). - Corrige les vues mêlant les opérateurs
UNIONetINTERSECT/EXCEPT, qui renvoyaient des résultats incorrects aprèsDETACH/ATTACHou un redémarrage du serveur. #100390 (Alexey Milovidov). - Corrige l’exception “Trying to execute PLACEHOLDER action” qui pouvait survenir lors de tests de charge avec l’AST fuzzer lorsqu’une sous-requête corrélée apparaissait dans une clause IN. #100398 (Alexey Milovidov).
- Corrige une exception de type logical error lors de l’insertion dans une table Iceberg avec une colonne
Datepartitionnée par les transformationsyear,monthouday. #100404 (Alexey Milovidov). - Corrige l’utilisation d’un skip index avec des données incompatibles après qu’un
ALTER TABLE MODIFY COLUMNa modifié le type de la colonne, ce qui pouvait provoquer des plantages du serveur dans les builds avec sanitizer ou des résultats de requête incorrects. #100526 (Alexey Milovidov). - Corrige une fuite d’identifiants dans
query_logpour les table functionspaimonCluster,paimonS3Cluster,paimonAzureClusteretdeltaLakeS3. #100529 (JIaQi Tang). - Corrige le risque que
DROP TABLEsur des tables du moteur Kafka reste bloqué indéfiniment en raison d’un interblocage dansrd_kafka_consumer_close. #100604 (Alexey Milovidov). - Remplace la liste
source_table_enginescodée en dur par une résolution à l’exécution viaStorageFactoryetDatabaseFactory. Ajoutesource_access_typeàDatabaseFactory::EngineFeaturesafin queCREATE DATABASEavec des moteurs source (PostgreSQL, MySQL, S3, etc.) exige les mêmes droits d’accès aux sources queCREATE TABLE. Corrige le cas oùGRANT TABLE ENGINE ON *échouait avectable_engines_require_grant=false. Clôt #71544. #100746 (pufit). - Corrige un crash du serveur lors de la lecture d’une table dont la colonne
ALIAScontenait une sous-requête corrélée imbriquée dans un appel de fonction (par ex.ALIAS toString(intDivOrZero(x, (SELECT ...)))).CREATE TABLEetALTER TABLErejettent désormais toute sous-requête, à n’importe quelle profondeur, dans les expressions de colonneDEFAULT/ALIAS/MATERIALIZED, avecTHERE_IS_NO_DEFAULT_VALUE. Auparavant, la validation superficielle acceptait les sous-requêtes imbriquées, si bien que le cas corrélé provoquait un crash à la lecture et que le cas imbriqué non corrélé semblait fonctionner, mais pouvait entraîner un comportement inattendu ; les deux sont désormais rejetés au moment du DDL. #100753 (Groene AI). - Corrige un crash du serveur (
Logical error: Bad cast from type DB::FunctionNode to DB::ColumnNode) pouvant se produire lors de l’utilisation de requêtes avec des sous-requêtes corrélées sur des tables ayant des définitionsCONSTRAINT ... ASSUME, lorsque les paramètresoptimize_substitute_columnsetconvert_query_to_cnfsont activés. #100756 (Groene AI). - Corrige une exception pouvant se produire lors de l’insertion d’une ligne dans une colonne JSON, lorsque la ligne introduisait un nouveau champ dynamique en parallèle d’un champ typé avec une valeur incompatible, puis que la colonne était utilisée comme clé de GROUP BY. #100758 (Jimmy Aguilar Mena).
- Corrige le contournement silencieux de l’ordonnancement des E/S des workloads pour les écritures vers S3 / le stockage objet passant par le chemin
DiskObjectStorageTransaction(utilisé par les disquess3_with_keeperet explicitement lorsqueuse_fake_transaction=false). Auparavant, les écritures INSERT dans des tables MergeTree sur ces disques ignoraient la limitationCREATE RESOURCE/CREATE WORKLOAD, car le lien vers la ressource n’était jamais injecté dansWriteSettingspour le chemin d’écriture transactionnel. #100777 (JIaQi Tang). - Corrige une collision du cache de schéma partagé entre
ProtobufetProtobufList: lire d’abord un message au formatFORMAT Protobuf, puis au formatFORMAT ProtobufList, pouvait échouer, carProtobufListforçait le schéma mis en cache vers sa forme enveloppe.ProtobufListretombe désormais sur le type de message mis en cache lorsqu’aucun schéma d’enveloppe n’est disponible. #100849 (Callum Cooper). - Corrige un heap-buffer-overflow dans le pont Rust CXX dû à une incompatibilité d’ABI de
std::exception. #100931 (Azat Khuzhin). FunctionVariantAdaptorlève désormaisILLEGAL_TYPE_OF_ARGUMENTlorsque toutes les alternativesVariantsont incompatibles avec une fonction, au lieu de renvoyer silencieusementNullable(Nothing). Auparavant, un prédicatWHERE function(variant_col)dans lequel aucun type alternatif n’était compatible renvoyait 0 ligne sans erreur, tandis que le contexteSELECTéquivalent levait déjà correctement une erreur. #100939 (Vasily Chekalkin).TRUNCATE ALL TABLESn’échoue plus lorsque la base de données contient des vues. #100943 (Alexey Milovidov).- Corrige l’optimisation
optimize_rewrite_array_exists_to_hasafin de gérer correctement les cas d’incompatibilité de type (par ex. Date vs String) et la réactive par défaut. #100944 (Alexey Milovidov). - Corrige la priorité des paramètres S3 afin que les paramètres de disque de
storage_configurationremplacent la section globale<s3>, et que les paramètres au niveau utilisateur/profil/requête remplacent les deux. #100975 (Alexey Milovidov). - Corrige la sérialisation sparse qui perdait le signe du zéro négatif (-0.0) pour les colonnes BFloat16, Float32 et Float64. #100983 (Takumi Hara).
- Corrige deux bugs dans l’analyseur de géométrie WKT utilisé lors de la lecture de fichiers GeoParquet et Arrow encodés en WKT : les géométries
MULTILINESTRINGétaient incorrectement analysées commePolygon(ce qui provoquait une exception pour les typed columns et une corruption silencieuse des données pour les colonnesGeometrymixtes), et une chaîne WKT mal formée sans mot-clé de type déclenchait un comportement indéfini au lieu d’une erreur propre. #100997 (Vasily Chekalkin). - Corrige les requêtes
grouping/GROUPING SETSsur des tables Distributed avec un seul shard qui échouaient avec “Method executeImpl is not supported for ‘grouping’ function”. #101030 (Alexey Milovidov). - Corrige
LOGICAL_ERROR“Column identifier is already registered” dans le planificateur, qui pouvait survenir lorsque la même expression de table était traitée plusieurs fois. #101048 (Alexey Milovidov). - Corrige l’exception LOGICAL_ERROR “Column identifier is already registered” lorsque le paramètre
additional_result_filterest utilisé avec des requêtes UNION ou EXCEPT. #101051 (Alexey Milovidov). - Corrige un crash du serveur (Logical error: Bad cast from ColumnVector to ColumnNullable) lors de l’utilisation de
* APPLYavec des fonctions d’agrégation etgroup_by_use_nulls=1avec GROUPING SETS, ROLLUP ou CUBE. #101062 (Groene AI). - Corrige une boucle infinie lorsque
input_format_csv_skip_first_linesouinput_format_tsv_skip_first_linesdépasse le nombre de lignes du fichier. #101111 (Alexey Milovidov). - Corrige un accès hors limites dans l’optimisation de lazy materialization, qui pouvait provoquer une exception dans les versions de débogage. #101144 (Alexey Milovidov).
- Corrige l’inférence de type dans les CTE récursives : les types de colonnes sont désormais élargis itérativement via
getLeastSupertypeentre les parties non récursive et récursive duUNION ALLjusqu’à convergence, évitant ainsi un dépassement d’entier dans des expressions telles quex + 1. #101155 (Alexey Milovidov). - Limite à 256 MiB les paramètres de taille de bloc de compression MergeTree (max_compress_block_size, min_compress_block_size, marks_compress_block_size, primary_key_compress_block_size) afin d’éviter un crash du serveur lorsque des valeurs extrêmes sont définies via CREATE TABLE SETTINGS. #101159 (Groene AI).
- Corrige un crash LOGICAL_ERROR dans
QueryAnalyzer::resolve()lorsqu’une ROW POLICY utilise une sous-requête scalaire dans sa clauseUSING(par ex.USING (SELECT 1)). Clôt #100695. #101263 (Groene AI). - Corrige un comportement indéfini dans
MergeTreeDataPartWriterCompact::cancellorsqu’une allocation de stream échoue. #101292 (Alexey Milovidov). - Corrige un cas où le fuseau horaire n’était pas inclus lors de l’affectation dans l’instruction ALTER. Clôt #101328. En lien avec https://github.com/ClickHouse/ClickHouse/pull/100647. #101403 (Yarik Briukhovetskyi).
- Corrige un crash du serveur (LOGICAL_ERROR) pour les requêtes INSERT SELECT avec ORDER BY ALL lorsque le pipeline SELECT produit plusieurs streams. #101443 (Groene AI).
- Corrige des résultats de requête incorrects causés par le réordonnancement des join, qui poussait un filtre de INNER JOIN (ne référant que le côté préservé d’un outer join) dans la clause ON de l’outer join. #101504 (Vladimir Cherkasov).
- N’applique pas la lazy materialization pour les plans avec arrayJoin, ce qui pouvait empêcher le respect de la limit. Clôt #101608. #101644 (Vladimir Cherkasov).
- Corrige des résultats de requête JOIN incorrects lorsque l’optimisation
mergeFilterIntoJoinConditionsupprimait silencieusement une condition d’égalité WHERE avec des types incompatibles. #101652 (Xiaozhe Yu). - Corrige l’indice de test
error, qui ne fonctionnait pas pour les erreurs de syntaxe/d’analyse — auparavant,-- { error SYNTAX_ERROR }sur une requête mal formée échouait avec “Expected server error” au lieu de correspondre à l’erreur d’analyse côté client. #101675 (Groene AI). - Corrige le fait que
INTO OUTFILE ... TRUNCATEn’utilisait pas réellement un renommage atomique — l’écriture se faisait directement dans le fichier d’origine au lieu d’un fichier temporaire, si bien qu’en cas d’échec de la requête, le contenu d’origine était détruit. Désormais, les données sont écrites dans un fichier temporaire, puis renommées uniquement en cas de succès. #101884 (Pablo Marcos). - Corrige une exception
Unsupported DeltaLake type: varchar(n)lors de la lecture de tables Delta Lake dont le schéma contient des types de colonnes varchar(n) ou char(n). Ces types sont désormais mappés vers String, conformément à la manière dont le protocole Delta Lake les stocke sous forme de simples tableaux d’octets dans Parquet. #101973 (Flavio Malavazi). - Corrige une perte silencieuse de données lors de la lecture d’archives tar depuis S3 avec
schema_inference_mode=unionet des schémas Parquet hétérogènes — le parquet metadata cache réutilisait à tort les metadata du premier fichier pour tous les fichiers suivants de l’archive. #101990 (Ahaan Limaye). - Corrige un crash du serveur (LOGICAL_ERROR) lors de l’exécution de ALTER TABLE UPDATE/DELETE sur des tables Iceberg lorsqu’aucun SELECT ou INSERT n’avait été exécuté au préalable sur la table pendant la même durée de vie du serveur. #102113 (Alexey Milovidov).
- Corrige un possible crash lorsqu’une requête ALTER est exécutée sur des tables d’une base de données en mémoire (par ex. des tables temporaires). #102360 (Den Kalantaevskii).
- Correction de
formatQuery, qui produisait des grants dupliqués tels queGRANT FILE ON *.*, FILE ON *.* TO xau lieu deGRANT FILE ON *.* TO x, lors du formatage de grants READ/WRITE rétrocompatibles sur la même source. #102411 (Groene AI). - Corrige une perte de parallélisme pour l’agrégation après des requêtes
read-in-orderlorsquemax_streams_to_max_threads_ratioest supérieur à 1. #102467 (Alexey Milovidov). - Correction d’un crash (
LOGICAL_ERROR: Unknown virtual column) lors de la sélection de sous-colonnes (comme.nullpour Nullable,.size0pour Array, des éléments de tuple ou des clés/valeurs de map) depuis une table utilisant le table engine Buffer. #102470 (Groene AI). - Corrige l’exception “Cannot fold actions for projection” dans l’optimisation du réordonnancement des jointures lorsqu’un LEFT/RIGHT JOIN avec
join_use_nullsest combiné à d’autres jointures impliquant plus de deux tables. #102516 (Alexey Milovidov). - Correction d’un overflow silencieux dans les opérations scalaires pointwise sur numericIndexedVector (par ex.
numericIndexedVectorPointwiseAdd) lorsque le scalaire est hors plage. Ces entrées lèvent désormaisINCORRECT_DATAau lieu de renvoyer des valeurs corrompues. #102546 (FriendLey). - Corrige un formatage AST incohérent pour INSERT avec SAMPLE et OFFSET au niveau de la requête. Clôt #102523. #102547 (zoomxi).
- Corrige l’exception
LOGICAL_ERRORdansgroupConcatlors de la désérialisation d’un état de fonction d’agrégation malformé. #102558 (Christoph Wurm). - Désormais, les caractères parasites en fin de valeurs CSV Time64 ne sont plus acceptés avec
input_format_csv_use_default_on_bad_values=0. Clôt #102490. #102596 (Yarik Briukhovetskyi). - Corrige l’exception UNKNOWN_ELEMENT_OF_ENUM lors de l’insertion de la valeur par défaut dans une colonne JSON avec des paths typés Enum. Clôt #102359. #102687 (Pavel Kruglov).
- Corrige la corruption de columns_substreams.txt lors du renommage d’une colonne dans certains cas. Clôt #102259. #102689 (Pavel Kruglov).
- Corrige l’insertion dans le type de données Time lors du parsing JSON. Clôt #102016. #102690 (Pavel Kruglov).
- Corrige l’encodage hexadécimal de l’échantillon de contenu dans les noms de fichiers de schéma mis en cache. Clôt #101904. #102703 (Pavel Kruglov).
- Correction d’une violation de l’ordre de tri (crash en débogage, corruption silencieuse des données en release) lors d’une fusion
SummingMergeTreelorsque la cléORDER BYest une expression de hachage sur une colonneFloat32contenant des valeurs NaN de signalisation. #102791 (Groene AI). - Rend
DETACH DATABASE ... SYNCet d’autres opérations qui appellentwaitDetachedTableNotInUseannulables viaKILL QUERYet réactives à l’arrêt du serveur, évitant ainsi des blocages indéfinis lorsqu’une requête concurrente conserve une référence à une table. #102804 (Antonio Andelic). - Correction d’un résultat potentiellement incorrect pour
ANY RIGHT JOIN. #102893 (Nikita Taranov). - Correction de l’échec des requêtes S3 avec
ios_base::clear: unspecified iostream_category errorau lieu d’être retentées, en raison du fait que PocoBufferedStreamBuf::flushBufferne gérait pas les écritures partielles depuis la couche socket. #102894 (Sema Checherinda). - Correction de l’échec de la fonction de table
input('auto')via l’interface HTTP dans les requêtes INSERT SELECT. #102902 (Miсhael Stetsyuk). - Désactivation de l’optimisation triviale LIMIT avec les politiques de lignes/additional_table_filters (pour permettre une analyse d’index parallèle). #102921 (Azat Khuzhin).
- Masque la clé secrète dans la fonction SQL
HMAC. Correction de #102927. #102997 (Mikhail f. Shiryaev). - Correction de l’exception
MULTIPLE_EXPRESSIONS_FOR_ALIASlevée sur des requêtes distribuées qui référencent plusieurs fois le même appel àquantile(par ex. dansSELECT,HAVINGetORDER BY) avecoptimize_syntax_fuse_functionsactivé. #103014 (tanner-bruce). - Corrige un cas détecté par la CI où un set non prêt était transmis lorsque le filtre dépend de la colonne de gauche. Clôt #102966. #103029 (Yarik Briukhovetskyi).
- Correction de castOrNull vers JSON dans certains cas. Clôt #101818. #103036 (Pavel Kruglov).
- Correction de
SELECT DISTINCTqui renvoyait silencieusement des résultats incomplets lorsqu’une projection agrégée correspondait à la requête et que certaines parties de la table n’avaient pas de données de projection (par ex. la projection avait été ajoutée à une table contenant déjà des données, etMATERIALIZE PROJECTIONn’avait pas été exécuté). Clôt #102951. #103052 (Nihal Z. Miaji). - Correction de l’exception
TOO_FEW_ARGUMENTS_FOR_FUNCTIONlorsqu’un prédicatWHEREtel queAND(OR(A, A), A)se réduit à un seul argument de premier niveau lors de l’extraction des expressions communes dans l’analyseur. #103072 (Peng). - Correction de l’erreur logique
Function writeSlice expects same column types for GenericArraySlice and GenericArraySinkdéclenchée lors de l’évaluation deif/ifNullsur des tuples, des maps ou des arrays contenant un élémentQBit.ColumnQBit::structureEqualscomparait à tort le tuple interne d’une colonneQBità l’enveloppe externe de l’autre, si bien que des colonnesQBitstructurellement identiques étaient considérées comme différentes. #103084 (Groene AI). DETACH DATABASEavecdatabase_atomic_wait_for_drop_and_detach_synchronouslyrespecte désormaisKILL QUERYau lieu de rester bloqué indéfiniment lorsqu’une référence à une table est conservée. #103095 (Alexey Milovidov).- Correction d’un segfault lors de la suppression d’un module WASM à l’aide d’un prédicat qui n’est pas un identifiant (par ex.
WHERE 1=1). #103101 (Joe Redfern). - Correction d’une rupture de compatibilité ascendante où d’anciens clients échouaient avec
UNEXPECTED_PACKET_FROM_SERVERlors d’un insert dans un server plus récent viaremote()ou des distributed tables, en raison de l’appel inconditionnel àsendProgressà la fin deprocessInsertQuery. #103148 (Sema Checherinda). - Avec IN, un second argument tuple non constant ne doit pas CAST les éléments du tuple vers le type du membre de gauche, car cela peut provoquer un overflow. Clôt #103055. #103169 (Yarik Briukhovetskyi).
- Correction d’une utilisation de valeur non initialisée dans une fonction du protocol. #103187 (Pavel Kruglov).
- Correction de
LOGICAL_ERROR(Bad cast … to ColumnLowCardinality) lors de l’analyse d’index MergeTree lorsqu’une clauseWHEREcompare une key columnLowCardinalityà une constante cast vers un type contenant unLowCardinalityimbriqué (par exempleVariant(LowCardinality(Date), String)). #103211 (Groene AI). - Correction de
Logical error: 'index < bucket_count'dans la famille d’aggregate functionstimeSeries*ToGrid(par ex.timeSeriesResampleToGridWithStaleness,timeSeriesChangesToGrid,timeSeriesResetsToGrid,timeSeriesRateToGrid) lorsqu’elle est appelée avec des paramètres de timestamp extrêmes qui feraient déborder l’arithmétique signée sur 64 bits lors du calcul du nombre de buckets. Le nombre total de buckets de grille est également limité à 16 millions afin d’éviter des allocations mémoire accidentellement massives dues à des entrées malveillantes. #103223 (Groene AI). - Correction de l’exception
Logical error: 'Port is already connected'lors de l’expansion du pipeline dans le cheminFINALlazy deReplacingMergeTree. Le bug affectait les queries avecquery_plan_optimize_lazy_final = 1lorsqueReadFromMergeTree::initializePipelineinsérait des transformations internes (par ex. unResize) qui reliaient entre eux les processors du sous-pipeline, ce qui amenaitLazyUnorderedReadFromMergeTreeSource::expandPipelineà tenter de connecter des ports de sortie déjà connectés. #103230 (Groene AI). - Correction de résultats erronés de
LIMIT BYetDISTINCTlorsque l’entrée est unUNION ALLde subqueries triées. L’optimiseur de query plan traitait à tort une telle union comme globalement triée, ce qui entraînait le renvoi de lignes supplémentaires. #103231 (Nihal Z. Miaji). - Correction d’un crash possible lors du calcul des statistiques dans le Map type avec lazy replication. Clôt #102390. #103273 (Pavel Kruglov).
- Corrige une data race dans les sources de dictionnaires ClickHouse, MySQL, PostgreSQL et XDBC, où
clone() constlit etisModified() constécrit dans la même chaîneinvalidate_query_response. #103277 (Miсhael Stetsyuk). - Corrige une détection incorrecte de la monotonie pour
Date32. Clôt #101265. #103283 (Yarik Briukhovetskyi). - Limite à 64 KB les chaînes du paquet TCP Hello de pré-authentification et ajoute le paramètre serveur
handshake_timeout_millisecondspour limiter la durée totale du handshake, afin d’empêcher des clients non authentifiés de consommer une quantité excessive de mémoire ou de monopoliser des threads indéfiniment. #103284 (Sema Checherinda). - Corrige le cas où, dans les statistiques ColumnIndex de Parquet, min_value > max_value pour les colonnes String. #103334 (Saurabh Kumar Ojha).
- Corrige la gestion incorrecte des lignes NULL pour les entrées
Nullable(Tuple(...))dansflattenTupleettupleToNameValuePairs.flattenTuplepréserve désormais la null map externe afin que les lignes NULL restent NULL.tupleToNameValuePairschange désormais le type de valeur du résultat enNullable(T)lorsque c’est possible quand l’entrée estNullable(Tuple(...)), afin que les lignes NULL produisent[('a', NULL), ('b', NULL)]au lieu de[('a', 0), ('b', 0)]. Lorsque le type d’élément ne peut pas être encapsulé dansNullable(par exempleArray), des valeurs par défaut sont utilisées à la place de NULL. Clôt #103312. #103383 (Nihal Z. Miaji). - Vérifie les données Dynamic aplaties malformées dans le Native format. #103392 (Pavel Kruglov).
- Corrige un RPC périmé provoquant un blocage de la réplication après une synchronisation par snapshot. #103406 (Seva Potapov).
- Corrige un arrêt du serveur dû à
LOGICAL_ERROR“Cannot pop N rows from X” (dans les builds de débogage / avec sanitizer) lors de la lecture d’un document BSON malformé contenant une valeur dont le type BSON est incompatible avec le type de colonne cible dans une colonneNullable(T)ouArray(Nullable(T)). La ligne malformée produit désormais une exceptionILLEGAL_COLUMNpropre, comme prévu. #103418 (Groene AI). - Corrige un arrêt du serveur dans
arrayFilletarrayReverseFilllorsqu’ils sont appliqués à une colonneArray(String)dont la première ligne est vide, avec une lambda constante à false. La boucle aggregate / sous-tableau provoquait un underflow d’un indexsize_tversSIZE_MAX, ce qui entraînait ensuite une lecture hors limites dansColumnString::doInsertManyFrom. Même famille de bugs que #12263. #103424 (Groene AI). - Corrige les erreurs ACCESS_DENIED / UNKNOWN_TABLE dans les RMV APPEND en aval avec SQL SECURITY DEFINER lorsqu’un EXCHANGE d’un RMV REPLACE en amont bascule l’identité du stockage cible en cours de résolution. #103427 (Alexander Gololobov).
- Renseigne la colonne
_timeà partir de la fonction de tableurl. #103437 (Nikita Taranov). - Correction d’une lecture potentiellement hors limites dans le chemin de décompression du codec
ALPlors du traitement d’une entrée malformée avec une largeur de bit invalide. #103457 (Raufs Dunamalijevs). - Correction d’un bug où
SYSTEM SYNC FILESYSTEM CACHE '<name>' ON CLUSTER ...pouvait perdre le nom du cache lors du formatage de la requête, ce qui amenait les nœuds distants à synchroniser tous les caches du système de fichiers au lieu du seul cache demandé. #103469 (Asish Kumar). - Correction du traitement d’un chemin encodé en URL dans
deltaLakeAzure. Clôt #103509. #103525 (Smita Kulkarni). - Correction d’un heap-use-after-free lors de la multiplication d’un état
AggregateFunctionpar un entier (par ex.quantilesExactState(...) * N). La boucle d’exponentiation par dichotomie fusionnait l’état avec lui-même, ce qui n’est pas défini lorsque lemergede la fonction d’agrégation réalloue son stockage interne. Clôt STID 0988-40af. #103536 (Groene AI). - Correction d’un
LOGICAL_ERRORrare “Part X intersects previous part Y” déclenché au démarrage d’une tableReplicatedMergeTreelorsque deux parts vides inattendues sur disque avaient des plages de blocs qui se chevauchaient sans que l’une contienne l’autre. L’exception interrompait le thread d’attachement de la table et empêchait son démarrage. #103537 (Groene AI). - Correction de
Logical error: Incorrect mark rows for part ...(assertion de débogage uniquement) déclenché par des mutations sur des tablesMergeTreeavec une granularité d’index non adaptative (index_granularity_bytes = 0) dont la dernière mark de données était incomplète (cas reproduit de la manière la plus fiable viaDETACH/ATTACHsuivi d’un lightweightDELETE). #103538 (Groene AI). - Correction du cas où
clickhouse-localrenvoyait silencieusement 0 ligne lors de la lecture des pseudo-fichiers/procet/sysvia la fonction de tablefile()(par ex.SELECT * FROM file('/proc/cpuinfo', 'RawBLOB')). #103548 (Ashrith Bandla). - Correction de la gestion de l’argument
max_string_lengthpour le moteur de tableGenerateRandom. #103550 (Alex Kuleshov). - Correction du masquage des identifiants imbriqués dans les logs. #103552 (Vitaly Baranov).
- Correction de la détection de SVE utilisant des instructions SVE lorsqu’elles ne sont pas disponibles. #103568 (Raúl Marín).
- Correction de l’analyse des arguments de stockage de
GenerateRandom. #103574 (Konstantin Bogdanov). - Correction d’une boucle infinie dans
WITH FILLpour des données commençant par ±inf. #103580 (Konstantin Bogdanov). - Corrige
JSONExtractdans un typeVariant, qui tronquait silencieusement les nombres JSON à partie fractionnaire. Auparavant,JSONExtract('{"x": 3.14}', 'x', 'Variant(Int64, Float64)')renvoyaitInt64=3etJSONExtract('{"x": 3.14}', 'x', 'Variant(String, Int64)')renvoyaitInt64=3, en supprimant la partie fractionnaire. La valeur fractionnaire est désormais préservée sans perte : un membreFloat64/Decimalla prend en charge lorsqu’il est présent, sinon un membreStringcapture le JSON d’origine. Les typesVariantne contenant que des membres entiers (par ex.Variant(Int64, Int32)) et l’extraction directe d’entiers (JSONExtract(json, 'Int64'),JSONExtractInt, etc.) restent inchangés. #103620 (Groene AI). - Corrige
SYSTEM INSTRUMENT REMOVEsans arguments, qui produisaitstd::bad_optional_access(code d’erreur 1001) au lieu deSYNTAX_ERROR(code d’erreur 62). #103622 (Pablo Marcos). - Corrige une erreur logique / un comportement indéfini dans les
window viewwindowIDettumblelorsqu’elles sont appelées avec une chaîne de fuseau horaire comme 3e argument. #103641 (Alexey Milovidov). - La journalisation du client S3 traite désormais les réponses HTTP 400 qui incluent un en-tête x-amz-bucket-region non vide (région de signature SigV4 incorrecte) comme un simple cas informatif de mauvaise région, avec une ligne de journal plus explicite au lieu du chemin générique de type erreur. Le fournisseur d’identifiants d’identité web STS n’est ajouté à la chaîne d’identifiants S3 que lorsque l’identité web est configurée, ce qui réduit les avertissements parasites pour les déploiements qui ne l’utilisent pas. Clôt #99140. #103673 (MeltonSmith).
- Corrige
SYSTEM SYNC REPLICA <db>.<tbl> IF EXISTSpour qu’il réussisse silencieusement lorsque la base de données n’existe pas, conformément au comportement existant pour une table manquante et au précédent établi parDROP TABLE IF EXISTS. Auparavant, la requête levaitUNKNOWN_DATABASEmalgréIF EXISTS. Clôt #103629. #103689 (Groene AI). - Corrige l’erreur logique
Arguments of 'plus' have incorrect data typeslevée parFunctionBinaryArithmetic::executeImpl2lorsqu’une tableMergeTreeavaitArray(LowCardinality(...))dans sa clé de tri et qu’une clauseWHEREutilisaitplus/minusentre cette colonne et une constanteArrayd’un type d’élément différent.KeyCondition::getMonotonicityForRangesupprime désormaisLowCardinalityrécursivement avant d’invoquer le dispatch numérique interne. #103701 (Groene AI). - Corrige une condition de concurrence lors du redimensionnement dynamique du cache dans 26.1+. #103702 (Kseniia Sumarokova).
- Corrige un problème où les index de saut
textetbloom_filtersur des colonnesALIASdont l’expression contenait une lambda avec des constantes capturées (par ex.arrayMap((k, v) -> concat(k, '=', v), mapKeys(m), mapValues(m)))étaient silencieusement ignorés. #103708 (Anton Popov). - Corrige
positionetpositionCaseInsensitiveavec unstart_posproche deUINT64_MAX, qui pouvaient se bloquer ou provoquer une faute de segmentation en raison d’un dépassement dans l’arithmétique des pointeurs. #103766 (Raúl Marín). - Corrige un comportement indéfini lors de l’analyse de dateTime avec une double partie fractionnaire. #103773 (Yarik Briukhovetskyi).
- Correction d’une régression affectant l’exactitude des données dans la version 26.x :
ifetmultiIfcompilés en JIT avec un type de résultatDecimalet un littéral nonDecimal(entier ou flottant) dans l’une des branches renvoyaient silencieusement une valeur inférieure d’un facteur10^scale. Le chemin lent (sans JIT) n’était pas affecté. Solution de contournement pour les versions concernées :SET compile_expressions = 0. #103809 (Groene AI). - Corrige la transmission du tokenizer depuis le text index vers les fonctions prises en charge. #103826 (Elmi Ahmadov).
- Corrige des résultats erronés de
numbers,generate_serieset d’autres sources similaires respectant les plages lorsque la clauseWHEREutiliseINouNOT INsur un tuple dont les éléments se dédupliquent en une seule Key column (par exemple,WHERE tuple(number, number) NOT IN (tuple(1, 2))). Clôt #103660. #103835 (Groene AI). - Maintient le pic réel de mémoire du hash join avec spilling automatique sous
max_bytes_before_external_join. Auparavant, la préallocation pilotée par les statistiques, le doublement sur place de la hash table et les buckets en mémoire non bornés deGraceHashJoinpouvaient chacun faire dépasser à la query la limite configurée et déclencherMEMORY_LIMIT_EXCEEDED. #103838 (Alexey Milovidov). - Corrige un blocage à l’arrêt de
clickhouse-locallorsque les logs système (commetext_logoufilesystem_cache_log) sont configurés.SystemLogs::flushImplappelaitBaseDaemon::instance().flushTextLogs(), ce qui levaitstd::bad_casten dehors declickhouse-serveret laissait les threads de sauvegarde actifs jusqu’à ce quepthread_cond_destroybloque la destruction des files de logs système. #103874 (Alexey Milovidov). - Rejette les requêtes CTE
MATERIALIZEDdont le body aboutit à des column types inférés différents selon les références, avec une erreurTYPE_MISMATCHexplicite au lieu de faire planter le server avec uneLOGICAL_ERRORBad cast. Cela se produisait auparavant lorsque le body de la CTE référençait des identifiants de la portée externe (par exemple, un alias de la projection de la subquery appelante) qui étaient intégrés comme des constantes différentes selon la référence. #103879 (Groene AI). - Corrige une utilisation d’une valeur non initialisée dans les optimiseurs de query plan de conversion de JOIN (
tryConvertAnyOuterJoinToInnerJoin,tryConvertAnyJoinToSemiOrAntiJoin) lorsque le filter au-dessus d’unANYOUTERJOINcontient une fonction non deterministic telle querand,nowourowNumberInAllBlocks. L’optimiseur ne tente plus de constant-fold de tels filtres et laisse le JOIN inchangé, ce qui empêche aussi les conversions incorrectes enINNER/SEMI/ANTI JOINqui pouvaient supprimer silencieusement des rows. #103880 (Groene AI). - Corrige un use-after-free dans
StorageKafka2qui pouvait faire planter le server lorsqu’une session Keeper est remplacée pendant que le consumer détient des verrous éphémères de topic-partition. #103890 (Groene AI). - Correction d’une
LOGICAL_ERROR“Primary key type mismatch” levée lors d’une jointure avec une tableEmbeddedRocksDBviaJOIN ... USING (key)contre une subquery dont la Key column a un type différent (par ex.Nullable(UInt64),Int64,Decimal) de la primary key du stockage. Le planner refuse désormaisDirectKeyValueJoinen cas d’incompatibilité de type et se rabat surHashJoin, qui gère la conversion de type. #103928 (Groene AI). SET max_threads = DEFAULT(et de même pourmax_final_threadsetmax_parsing_threads) ne perd plus l’état auto. Auparavant, après la réinitialisation de l’un de ces paramètres,system.settingsaffichait le nombre de cœurs résolu (par ex.32) au lieu de'auto(32)', et le serveur se comportait comme si la valeur avait été explicitement définie. #103991 (Groene AI).- Correction de
SIZES_OF_ARRAYS_DONT_MATCHlors de la lecture de colonnesAggregateFunction(topK(N), String)dont l’alpha_sizepersisté avait été augmenté par un cycle deserialize+serialize antérieur à la version 25.12. #104002 (Raúl Marín). - Correction d’une vulnérabilité d’injection SQL dans les sources de dictionnaire PostgreSQL, Cassandra et XDBC : les clés de chaîne contenant des guillemets simples étaient échappées avec
\'(backslash), que ces backends interprètent comme un backslash littéral plutôt que comme une séquence d’échappement, ce qui permettait d’injecter du SQL arbitraire dans les requêtes de lookup de dictionnaire.ExternalQueryBuilderémet désormais l’échappement SQL standard''pour ces backends ; les sources de dictionnaire ClickHouse et MySQL continuent d’utiliser l’échappement par backslash. #104009 (Shaohua Wang). - Correction d’une incompatibilité de type possible dans l’agrégation lorsqu’un type de colonne était modifié vers ou depuis LowCardinality et que la projection min-max n’était pas reconstruite. #104013 (Nikita Taranov).
- Correction d’une boucle infinie d’optimisations de requête causée par l’absence de propagation de la prévention de suppression des colonnes inutilisées lors de la fusion des expressions. #104083 (János Benjamin Antal).
- Correction de
LOGICAL_ERRORdansStreamingStorageRegistry::renameTablelors du renommage par lot de tables de streaming (S3Queue, Kafka, RabbitMQ), en utilisant un suivi d’identité basé sur l’UUID plutôt que sur le nom. #104101 (Nikita Taranov). - Correction de résultats erronés lorsqu’une CTE construite avec
UNION ALLcontenait une brancheSELECT DISTINCTet que la requête externe ne projetait qu’un sous-ensemble des colonnes de la CTE. Le nouveau passRemoveUnusedProjectionColumnsPassde l’analyzer supprimait à tort la colonne non référencée de la projectionDISTINCTinterne, ce qui fusionnait en une seule des lignes qui auraient dû rester distinctes (même valeur dans la colonne projetée mais valeur différente dans la colonne supprimée). #104114 (Groene AI). - Correction de plusieurs problèmes de justesse dans des cas limites du paramètre
optimize_inverse_dictionary_lookup, où l’optimisation pouvait supprimer silencieusement des lignes ou masquer des exceptions. Ferme #103270. Ferme #103085. #104133 (Nihal Z. Miaji). - Correction d’une écriture hors limites lors de la désérialisation de l’état
quantileTiming. #104141 (Alexey Milovidov). - Correction d’un comportement indéfini lorsqu’une valeur
Float64hors plage est convertie vers un type entier large (UInt64,Int64,Int128,UInt128,Int256,UInt256). Auparavant, les valeurs égales àFloat64(numeric_limits<T>::max())(qui s’arrondit à une valeur supérieure au maximum réel) contournaient la vérification des limites et produisaient un UB lors du cast suivant. Cela affectait l’analyse des paramètres des fonctions d’agrégation (topK,histogram,uniqUpTo,groupArrayInsertAt, etc.), ainsi que les paramètres de type entier viaSET <setting> = <Float64>. Ferme #103817. #104154 (Groene AI). - Corrige l’exception
LOGICAL_ERROR“Unexpected return type from comparison. ExpectedUInt8. GotConst(Nullable(UInt8))” lors de la comparaison d’unTuple(Tuple(Nullable(...)))imbriqué (ou plus profondément) avec un littéralString. Le type de retour de la comparaison est désormais correctement inféré enNullable(UInt8), conformément au comportement à l’exécution. #104171 (Groene AI). - Corrige un arrêt du serveur (
UndefinedBehaviorSanitizer: reference binding to null pointer, segfault dans les builds de release) surSELECT ... FROM <ReplacingMergeTree(version, is_deleted)> FINAL PREWHERE is_deleted = <expr> AND <other column expr>lorsquequery_plan_optimize_lazy_final = 1. L’étape de lecture lazy-FINAL non intersectante perdait la colonneis_deleteddans son en-tête de sortie, car PREWHERE la consommait en entrée sans la réexposer en sortie. L’étapeaddIsDeletedFilteren aval déréférençait alors un pointeurActionsDAG::Nodenul. #104177 (Groene AI). - Lors de l’appel de la table system.failpoints, un failpoint était utilisé, ce qui pouvait le désactiver. #104237 (Pedro Ferreira).
- Corrige
MemorySanitizer: use-of-uninitialized-valuedans les fonctionsdetectLanguage*lorsque l’entrée contient un caractère UTF-8 se terminant exactement à la limite du buffer. #104257 (Raúl Marín). - Corrige une logical error (
Bad cast from type DB::CachedObjectStorage to DB::S3ObjectStorage) qui interrompait l’analyse des arguments des table functions et engines de data lake (icebergS3,deltaLakeS3, etc.) lorsqu’ils étaient appelés avecSETTINGS disk = '...'sur un disk dont l’object storage sous-jacent est encapsulé par un décorateur tel qu’un filesystem cache. Corrige aussi #89300. #104258 (Groene AI). - Corrige l’analyse des expressions d’indice entre parenthèses sur des colonnes nommées
values, par exemple(values['a']), afin qu’elles ne soient plus interprétées comme des expressions de table SQL standardVALUES. #104312 (Desel72). - Corrige un arrêt du serveur/
LOGICAL_ERRORdans le thread d’eviction en arrière-plan du filesystem cache (SLRUFileCachePriority::collectEvictionInfo) qui pouvait se produire lorsquekeep_free_space_size_ratiooukeep_free_space_elements_ratioétait suffisamment élevé pour déclencher une eviction alors que toutes les cache entries avaient déjà été promues dans la protected queue du SLRU (file probationary vide). #104313 (Groene AI). - Corrige les exceptions (
NOT_FOUND_COLUMN_IN_BLOCK,LOGICAL_ERROR,AMBIGUOUS_COLUMN_NAME) lors de l’utilisation de projections avec des vues UNION ALL, des window functions ou des collisions de noms entre alias et colonnes. Régression introduite par #88798. #104317 (Amos Bird). - Corrige un possible underflow dans l’analyse des arrays Postgres. #104322 (Grant Holly).
- Les fonctions qui renvoient un type non
Nullable(commeArray,TupleouMap) acceptent désormais des argumentsNullable. Les fonctions concernées incluentextractAll,extractAllGroups,extractAllGroupsHorizontal,extractAllGroupsVertical,extractGroups,splitByChar,splitByString,splitByRegexp,splitByWhitespace,splitByNonAlphaetalphaTokens. Les lignes d’entréeNULLproduisent la valeur par défaut du type de résultat (par ex. un tableau vide) au lieu de lever l’erreur “Nested type is not allowed inside Nullable type”. #104326 (Alexey Milovidov). - Correction des statistiques Iceberg pour les tables partitionnées. Cela clôt #104321. #104329 (Konstantin Vedernikov).
- Correction d’une erreur logique fatale au démarrage du serveur sur macOS (et sur des builds jemalloc similaires), où
Jemalloc::verifySetupsignalait à tort une incohérence dejemalloc_enable_background_threadsparce que les mallctls optionnelsbackground_thread/max_background_threadssont absents ; la vérification est désormais ignorée lorsque ces mallctls ne sont pas disponibles, etgetValuene laisse plus la sortie non initialisée en cas d’échec. Clôt #102183. #104330 (SAYON DEEP). - Correction d’une régression où des requêtes
SELECTavecmax_rows_to_read_leafetread_overflow_mode_leaf = 'throw'pouvaient lever à tortTOO_MANY_ROWS, même lorsqu’un skip index aurait réduit le volume lu sous la limite leaf. Les paramètres symétriques non-leaf (max_rows_to_read/read_overflow_mode) étaient déjà pris en charge. #104331 (Groene AI). toUUID,toUUIDOrNull,toUUIDOrZero,toUUIDOrDefault,CASTversUUIDetNullable(UUID),accurateCastOrNullversUUID, ainsi que les formats d’entrée qui analysent un UUID depuis du texte (Avro,MsgPack,JSONExtract, …) rejettent désormais les chaînes de la bonne longueur mais contenant des caractères non hexadécimaux. Auparavant, ces entrées étaient silencieusement transformées en UUID fabriqués en lisant au-delà de la fin de la table de correspondance des chiffres hexadécimaux ; désormais,toUUIDlèveCANNOT_PARSE_UUID, et les variantesOr*renvoientNULL/ le zero UUID / la valeur par défaut fournie. #104370 (Groene AI).- Correction de
Bad castLOGICAL_ERRORdanscaseWithExpression(et en SQLCASE expr WHEN ... THEN ... ELSE ...) lorsque le supertype des seules branches THEN et le supertype de l’ensemble (THEN + ELSE) se retrouvent dans des stockagesColumnDecimaldifférents — par exemple, des valeurs THEN(UInt16, Int8)avec un ELSE deDecimal(9, 2). Clôt #104335. #104378 (Groene AI). - Les défaillances internes signalées via
logExceptionBeforeStart(flushes d’insertions asynchrones, refresh de vues matérialisées, erreurs d’analyse levées lors de requêtes internes) incrémentent désormais correctement les ProfileEventsFailedInternalQuery,FailedInternalSelectQueryetFailedInternalInsertQuery, en plus des compteurs visibles par l’utilisateurFailedQuery,FailedSelectQueryetFailedInsertQuery. Auparavant, ces compteurs internes restaient à zéro pour les défaillances survenant avant le début de l’exécution de la requête, ce qui sous-estimait une grande catégorie de défaillances internes. #104399 (Groene AI). - Corrige l’erreur
Code: 36. BAD_ARGUMENTS Expected literal, got {name:Type}levée lorsqu’un query parameter est utilisé dans le paramètrebase_backupd’une instructionBACKUPouRESTORE(par ex.BACKUP ... SETTINGS base_backup = S3({backup_name:String}, ...)). La régression a été introduite dans26.1.5par la PR #99205. Clôt #103324. #104413 (Groene AI). - Corrige un arrêt brutal du serveur lors des écritures
IcebergLocal/IcebergS3quandALTER TABLE ... DROP COLUMNest suivi d’unINSERTaveciceberg_metadata_staleness_mssupérieur à zéro.ALTERinvalide désormais le cache local des fichiers de métadonnées Iceberg, afin que les lectures et écritures suivantes prennent en compte le nouveau schéma. #104419 (Groene AI). - Corrige
DROP ROLE,DROP USER,DROP SETTINGS PROFILE,DROP ROW POLICY,DROP QUOTAetDROP MASKING POLICYafin de supprimer les références à l’entité supprimée de toute autre access entity qui la référençait (par ex. la listeDEFAULT ROLEd’un utilisateur, la listeTOd’un settings profile, les bénéficiaires d’une row policy) et de persister ce nettoyage sur disque. Auparavant, l’état en mémoire semblait correct, carSHOW CREATEfiltre les UUID inconnus, mais les fichiers.sqlsur disque conservaient des entrées orphelinesID('<dropped-uuid>'), et les références réapparaissaient au redémarrage suivant du serveur, provoquant des erreursACCESS_ENTITY_NOT_FOUNDlors de l’exécution de distributed query. #104427 (Groene AI). - Corrige un arrêt brutal du serveur déclenché par
azureBlobStorage, le moteurAzureBlobStorageet DeltaLake sur Azure avec une connection string dont l’URLBlobEndpointcomporte un port vide, non numérique ou hors plage (par ex.BlobEndpoint=http://host:abc/). Le serveur renvoie désormais une erreurBAD_ARGUMENTSpropre au lieu de s’interrompre dans les builds debug/sanitizer. #104460 (Groene AI). - Autorise l’utilisation d’un identifiant non quoté comme nom d’utilisateur dans les table functions
remoteetremoteSecure, comme c’est déjà le cas pour les arguments de database et de table. Auparavant, une telle query échouait avec une erreur d’authentication trompeuse faisant référence à l’utilisateurdefault. #104465 (Alexey Milovidov). - Corrige
Logical error: Incorrect ASTSelectWithUnionQuery (modes: M, selects: N)déclenchée lorsque le corps d’une user-defined function SQL contient unUNION ALLimbriqué entre parenthèses (par ex.CREATE FUNCTION f AS x -> (SELECT 1 UNION ALL (SELECT 1 UNION ALL SELECT 1))). #104477 (Groene AI). - Corrige
uniqThetaIntersect, qui renvoyait la cardinalité du premier argument au lieu de0lorsque le deuxième argument est un étatuniqThetavide — par exemple le résultat deuniqThetaMergeStateIf(s, predicate)lorsque le prédicat exclut chaque ligne. #104529 (Groene AI). - Correction de
SHOW TABLESetsystem.tables, qui tronquaient silencieusement la liste pour les bases de donnéesDataLakeCatalogadossées à des catalogues REST Iceberg (iceberg-rest,onelake,biglake). Lorsque le serveur de catalogue paginait la réponselist-tablesoulist-namespaces(par exemple Microsoft Fabric / OneLake au-delà d’environ 50 tables par espace de noms), les tables des pages suivantes devenaient silencieusement invisibles pourSHOW TABLESetsystem.tables, alors qu’elles restaient interrogeables via unSELECTdirect.RestCatalogsuit désormais le jeton de continuationnext-page-tokendéfini par la spécification OpenAPI REST d’Iceberg, en cohérence avec le comportement existant dePaimonRestCatalogetUnityCatalog. #104531 (Groene AI). - La fonction de table
inputdéduit désormais sa structure à partir de la clauseFORMATde la requêteINSERTenglobante lorsque ce format possède un schéma fixe (LineAsString,RawBLOB,JSONAsString, etc.), de sorte que les utilisateurs n’ont plus à répéter la structure sous la formeinput('line String')pour ces formats. #104532. #104533 (Groene AI). - Mise à jour du type de données des champs dans l’historique d’Iceberg, de
Int32àInt64. Ferme #94176. #104579 (Smita Kulkarni). - Correction de
Inconsistent AST formattingLOGICAL_ERRORlors de l’analyse syntaxique d’un appel de fonction dans lequel une lambda suit une virgule, par exempleSELECT substring(x, `x` -> `x`). L’analyseur fusionnait auparavant silencieusement les arguments précédents avec le côté gauche de la lambda, produisant un appel à argument unique qui ne pouvait pas être réanalysé pour redonner le même AST. Il préserve désormais l’arité d’origine de la fonction. #104626 (Groene AI). CHECK TABLE tdonne désormais priorité à une tableTEMPORARYplutôt qu’à une table permanente du même nom lorsqu’aucun qualificatif de base de données n’est fourni, conformément à la priorité déjà utilisée parSHOW CREATE TABLE,DESCRIBE TABLE,OPTIMIZE TABLEetALTER TABLE. Auparavant,CHECK TABLE tignorait complètement les tables temporaires, ce qui entraînait un échec avecUNKNOWN_TABLEsur une table temporaireLogouFile, alors même que ces moteurs prennent en chargeCHECK. Suite de #100966. #104637 (Groene AI).- Correction de la boucle d’arrêt et de redémarrage de Keeper lorsque
get /keeper/availability_zoneest envoyé avecquorum_reads=trueà un Keeper sans<placement>configuré. #104663 (myeongjun). - Correction d’une condition de concurrence TOCTOU dans
FutureSetFromTuple::buildOrderedSetInplaceprovoquant une erreur logique. #104673 (Miсhael Stetsyuk). - Correction de plusieurs fonctions qui renvoyaient des résultats différents pour la même entrée selon que les arguments étaient passés sous forme de colonnes ou de constantes :
bitRotateLeft/bitRotateRight(comptes de décalage aux limites),length(FixedString)/concatWithSeparatoravec des entréesLowCardinality(Nullable),roundDownsur NaN etrightUTF8sur de l’UTF-8 invalide. #104710 (Raúl Marín). - Correction de
anyHeavy, qui renvoyait une valeur non dominante lorsque la valeur la plus fréquente était la valeur par défaut de la colonne et que les données étaient réparties sur plusieurspartsMergeTree(chemin de lecture de colonnes creuses). #104712 (Raúl Marín). - Corrige plusieurs défauts dans la gestion des contraintes de paramètres : les contraintes
MergeTreeSettingsdéclarées sur le nom canonique d’un paramètre pouvaient être contournées en écrivant via un alias de ce paramètre ; la vérification de contraintedisallowed_valueslançait une exception sur les chemins de limitation (requêtes secondaires, workersON CLUSTER, vuesSQL SECURITY DEFINER) au lieu d’ignorer silencieusement la modification. #104737 (Raúl Marín). - Corrige une exception
LOGICAL_ERROR(Metadata is not initialized) levée parOPTIMIZE TABLE,ALTER TABLE ... DELETE,ALTER TABLE ... ADD COLUMNet d’autres variantes deALTERsur une tableIceberg/IcebergLocal/DeltaLake/Hudiattachée à la demande dont les métadonnées n’avaient pas encore été chargées (généralement après un redémarrage du server, ou après l’échec d’une précédente écriture de métadonnées ayant laissé sur disque un fichier de métadonnées corrompu). L’opération s’exécute désormais normalement si les métadonnées se chargent correctement, ou expose l’échec de chargement sous-jacent sous la forme d’une exception ordinaire visible par l’utilisateur, au lieu d’interrompre le server dans les builds debug / sanitizer. #104738 (Groene AI). - Corrige un segfault dû à un bug de use-after-free dans
AvroConfluentRowInputFormat. #104751 (Miсhael Stetsyuk). - Les variantes scalaires de
numericIndexedVectorPointwiseMultiply,numericIndexedVectorPointwiseDivide,numericIndexedVectorPointwiseEqualetnumericIndexedVectorPointwiseNotEquallèvent désormaisINCORRECT_DATAlorsqu’elles sont appelées avec un scalaireUInt64supérieur àInt64::max. #104784 (FriendLey). - Corrige un bug où la redéfinition manuelle d’un paramètre via son alias (par ex.
SET enable_analyzer = 1au lieu deSET allow_experimental_analyzer = 1) après l’application d’un paramètrecompatibilitypouvait être annulée par une modification ultérieure du paramètrecompatibility. #104829 (Raúl Marín). - Corrige la désactivation du logger AWS après https://github.com/ClickHouse/ClickHouse/commit/0e8ad4355c9d. #104837 (Konstantin Bogdanov).
- Corrige trois fonctions supplémentaires qui renvoyaient des résultats différents pour une même entrée selon que les arguments étaient fournis sous forme de colonnes ou de constantes :
transform(et, par son intermédiaire,caseWithExpression) avec une valeur par défaut constanteDate/Date32/Enum/FixedString, les opérateurs de comparaison entre unStringet unFixedStringconstant, etif/ifNull/nullIfavec une brancheFixedStringsous une condition constante. #104858 (Raúl Marín). - Corrige l’arrêt du server avec
Bad cast from type DB::ColumnConst to DB::ColumnNullablelors du partition pruning pour les tablesMergeTreelorsque la partition expression contient une chaîne de fonctions qui se réduit à une unique valeur constante (commefloor(NULL, toRelativeYearNum(...))). #104861 (Groene AI). - Corrige une data race
ThreadSanitizerdans le constructeur par copie deContextData:table_function_resultsétait copié depuis l’objet source sans prendretable_function_results_mutex, de sorte qu’un writer concurrent deContext::executeTableFunctionpouvait entrer en concurrence avec la lecture non synchronisée dans le constructeur par copie. #104879 (Groene AI). - Corrige les vérifications de cohérence des data parts pour les types à structure dynamique et détecte les
columns_substreams.txtcorrompus. Nouvelle soumission de https://github.com/ClickHouse/ClickHouse/pull/103858 avec des modifications supplémentaires. #104888 (Pavel Kruglov). - Correction d’une condition de concurrence entre DROP et UNDROP dans DatabaseCatalog. #104915 (Azat Khuzhin).
- Correction du redimensionnement dynamique du filesystem cache avec des segments partiellement téléchargés, y compris la restauration de la comptabilisation après un échec d’éviction. #104921 (Antonio Andelic).
DETACH TABLEsur une temporary table (sans le mot-cléTEMPORARY) renvoie désormais correctementSYNTAX_ERROR, conformément au comportement deDETACH TEMPORARY TABLE. Auparavant, cela définissait silencieusement un indicateur interneis_detached, puis se terminait sans erreur. Pour supprimer une temporary table, utilisezDROP TEMPORARY TABLEouDROP TABLE(ce dernier résout la temporary table viaContext::ResolveExternal). Clôt #103475. #104943 (Groene AI).- La table function
filesystemrespecte désormaismax_memory_usage/max_server_memory_usagelors du chargement du contenu des fichiers. Auparavant, des lectures de contenu volumineuses ou de nombreuses lectures parallèles pouvaient dépasser la limite sans leverMEMORY_LIMIT_EXCEEDED, puis se faire tuer par l’OOM killer. #104956 (Alexey Milovidov). - Correction d’un
LOGICAL_ERRORdéclenché lors du filtrage desystem.detached_tablessuruuid(par ex.SELECT count() FROM system.detached_tables WHERE uuid = '...'). La query renvoie désormais le résultat attendu au lieu d’interrompre le server. #104979 (Groene AI). flattenTuplene lève plus deLOGICAL_ERRORlorsqu’elle est appelée sur un tuple dont la structure imbriquée ne contient que des feuillesTuple()vides (par ex.Tuple(c0 Array(Tuple()))ouTuple(c0 Tuple())). De telles entrées produisent désormais une exceptionILLEGAL_TYPE_OF_ARGUMENTvisible par l’utilisateur, expliquant que le résultat de l’aplatissement serait un tuple vide. #104989 (Groene AI).- Correction d’un arrêt brutal du server et d’un bug produisant des résultats incorrects en silence lors de l’exécution de queries sur
loop(remote(...))(ou toutloop()encapsulant un storage pouvant différer l’aggregation) avecGROUP BY. Le planner externe ajoutait auparavantMergingAggregatedStepen fonction de l’étape de processing signalée par le storage interne, maisLoopSourcematérialise toujours son select interne avecQueryProcessingStage::Completeet émet de simples chunks de colonnes, si bien queMergingAggregatedTransformdéclenchait unLOGICAL_ERROR(Chunk info was not set for chunk in MergingAggregatedTransform) avecenable_parallel_replicas = 1et supprimait silencieusement l’aggregation externe dans les autres cas. #105001 (Groene AI). clickhouse-benchmark --reconnect(forme simple, sans valeur) a été involontairement cassé en 25.4 par une modification qui transformait--reconnecten option entière, nécessitant une valeur. Cette forme fonctionne désormais à nouveau et équivaut à--reconnect=1(reconnexion à chaque query). #105006 (Groene AI).- Correction d’une sortie JSON mal formée pour les noms de colonnes se terminant par des séquences UTF-8 incomplètes. #105012 (Pablo Marcos).
- Correction d’une perte silencieuse de données après
EXCHANGE TABLESouCREATE OR REPLACE TABLEsur la source table d’une vue matérialisée. L’arête de dépendance entre la vue matérialisée et sa table source est désormais conservée sur le nom d’origine afin qu’elle continue à se déclencher lors des inserts. Régression introduite par #98779 ; rétablit le comportement antérieur à la régression. #105029 (Sema Checherinda). - Correction de
CANNOT_COMPILE_CODE Could not find symbol __fixunsdftilors de la compilation JIT d’expressions convertissant unFloatenUInt128, commetoUInt128(<Float64 expression>). Les builtins non signés de compiler-rt pour la conversion de flottants en entiers 128 bits manquaient dans le résolveur de symboles JIT. Corrige #105031. #105048 (Raúl Marín). - Correction de l’absence d’affichage par
clickhouse-localdes messages de log d’une requête en échec lorsquesend_logs_levelest défini. #105067 (Alexey Milovidov). - Correction de résultats incorrects lorsque la même vue paramétrée est référencée plus d’une fois dans la même requête avec des valeurs d’argument différentes. Auparavant, l’analyseur regroupait ces appels en un seul, supprimant silencieusement tous les filtres sauf le premier. #105170 (Alexey Milovidov).
- Correction de l’affichage en double de la ligne
TOTALSen bas du tableau de résultats dans l’interface webplay.html. #103803 (Alexey Milovidov). - Rejet des vecteurs non finis (
NaN,±Inf) lors de la recherche vectorielle (qu’il s’agisse des vecteurs recherchés ou des vecteurs de référence) ; ils provoquaient auparavant un comportement indéfini dansusearch. #104079 (Groene AI). - PromQL : correction de l’opérateur d’agrégation pour les vecteurs vides. #104425 (Vitaly Baranov).
- PromQL : correction de la gestion des erreurs dans l’API de requête Prometheus. #104741 (Vitaly Baranov).
- Correction d’une condition de concurrence dans
MergeTreeTransaction::afterCommitoù, après une perte de connexion entre l’écriture duCSNde commit dans ZooKeeper et la finalisation de la transaction, la réponseCOMMITpouvait parvenir au client avant que les nouveauxcreation_csn/removal_csnne deviennent visibles danssystem.parts. #104708 (Tuan Pham Anh). - Correction d’une croissance exponentielle de la mémoire dans l’analyseur KQL lors de la conversion d’un indexage de tableaux imbriqués (
arr[arr[arr[...]]]). #105142 (Alexey Milovidov). - Correction de résultats incorrects pour
RIGHT ANY JOINlorsque la table de droite comporte plusieurs lignes par clé et que le bloc de sortie est scindé en raison de limites de taille. Corrige #99431. #102064 (Vladimir Cherkasov). - Vérification du dépassement de pile dans le lecteur
Avrolors de la désérialisation de types imbriqués. #102417 (Pavel Kruglov). - Correction de lignes dupliquées dans
system.completionspour les paramètresMergeTree— chaque nom de paramètre apparaissait deux fois, cargetMergeTreeSettingsetgetReplicatedMergeTreeSettingsétaient tous deux exportés malgré des noms de paramètres identiques. Corrige #102013. #102015 (Groene AI). - Correction de
StorageObjectStorageQueue(S3Queue,AzureQueue), qui bloquait l’arrêt tant que les fichiers partiellement traités n’avaient pas été entièrement lus depuis l’object storage. La source interrompt désormais immédiatement la lecture lors de l’arrêt ; la déduplication garantit que les lignes déjà envoyées vers la table de destination avant l’arrêt ne sont pas dupliquées lorsque le fichier est retenté au démarrage suivant. #103126 (Tuan Pham Anh). - Correction des inserts multi-blocs dans le table engine
Aliasavecinsert_deduplication_token, afin que tous les blocks soient conservés. #103246 (Enric Calabuig). - Correction de
JSONHasetJSONExtractBoolsur les columnsJSONnatives, qui renvoyaient la valeur extraite (convertie enUInt8) au lieu de0/1. #103313 (zxuhan7). - Protection du input format
CustomSeparatedcontre les données malformées ou malveillantes qui omettentformat_custom_row_after_delimiter. La détection d’en-tête, l’inférence de schéma et les lignes avec un nombre variable de columns accumulaient auparavant des fields sans limite et pouvaient allouer plusieurs gigaoctets de mémoire avant d’échouer. Les lectures échouent désormais avecINCORRECT_DATAdès qu’une seule ligne contient plus de 1,000,000 fields. #103404 (Groene AI). - Correction de
RESTOREdes tablesMergeTreereplicated, afin que l’attachement des parts restaurées utilisebackup_restore_keeper_max_retriesau lieu du budget habituel de tentatives Keeper pour les insert. #104610 (Pablo Marcos). - Correction de résultats erronés pour
WHERE p AND <LowCardinality(Nullable(int)) constant>sur les tablesMergeTree. Auparavant, de telles queries renvoyaient zéro ligne, car le part pruning déduisait une valeur par défautNULLdu typeLowCardinality(Nullable(...))et synthétisait une gardenotEquals(x, NULL), ce qui élaguait chaque part. #104767 (Groene AI). - Correction d’un résultat d’aggregation incorrect lors d’un regroupement par une fonction non injective d’une column qui est aussi la partition key (par ex.
PARTITION BY aavecGROUP BY intDiv(a, 2)oua % 2). Les values provenant de partitions différentes mais correspondant au même groupe n’étaient pas fusionnées, ce qui produisait des lignes de groupe dupliquées avecallow_aggregate_partitions_independently = 1. #104869 (Nihal Z. Miaji). - Correction d’une condition de concurrence dans le transfert de snapshot de
Keeper, où un snapshot pouvait être supprimé ou déplacé pendant son envoi à un follower en cours de récupération. #104941 (Antonio Andelic). - Correction d’un bug silencieux produisant des résultats erronés dans
hilbertEncodeetmortonEncode, où un premier argumentTuplenon constant (masque de plage) utilisait les values de la ligne 0 pour piloter le décalage de bits de chaque ligne. Les fonctions calculent désormais les values du masque pour chaque ligne, de sorte que le résultat ne dépend plus du fait que l’entrée soit constante ni de la taille du block. #104992 (Groene AI). - Correction de
clickhouse-local, qui ignorait silencieusement la configuration au niveau utilisateur (profiles,users,quotas, paramètres de contrôle d’accès) lorsque le configuration file était détecté automatiquement à partir de./clickhouse-local.xml,~/.clickhouse-local/config.xmlou/etc/clickhouse-local/config.xml. Auparavant, ces paramètres n’étaient appliqués que lorsque--config-fileétait passé ou que./config.xmlexistait dans le current directory ; désormais, tous les chemins de discovery se comportent de manière cohérente. #105008 (Groene AI). - Correction d’un problème où les colonnes
BFloat16renvoyaient silencieusement zéro correspondance lorsqu’elles étaient comparées à un littéral de chaîne (par ex.WHERE bf16_col = '49.9'). #105042 (Raúl Marín). - Correction de
CLEAR COLUMNet de la gestion du TTL pendant les merges pourSummingMergeTree,AggregatingMergeTreeetCoalescingMergeTreelorsque les colonnes requises pour le merge sont absentes ou expirées. Clôt #101953. #105203 (Antonio Andelic). - Correction d’une situation de concurrence entre
DNSCacheUpdater::runetContext::reloadClusterConfiggrâce à l’ajout d’une vérification explicite contre les valeurs nulles pourshared->clusters_configavant son déréférencement. #105220 (Mikhail f. Shiryaev). - Correction de l’analyse
best_effortdes dates et heures pourtoDateTime64avec une précisionmsetns. #105233 (Kaviraj Kanagaraj). - Correction de
OSIOWaitMicroseconds, qui signalait l’attente d’E/S sur toute la durée de vie du thread au lieu de l’attente d’E/S par query. #105246 (Mikhail f. Shiryaev). - Le table engine
Hudigénère désormaisINCORRECT_DATA(une exception normale au niveau de la query) au lieu deLOGICAL_ERRORlorsqu’un fichier Parquet dans le répertoire de la table ne respecte pas la convention de nommage Hudi[FileId]_[FileWriteToken]_[Timestamp].[extension]. Auparavant, de tels noms de fichiers provoquaient une exception dans les builds de débogage. #105266 (Groene AI). - Correction d’un interblocage dans
ParallelFormattingOutputFormaten cas d’échec de planification : lorsquescheduleFormatterThreadForUnitWithNumberlève une exception (par ex.CANNOT_SCHEDULE_TASK), l’unité restait dans l’étatREADY_TO_FORMATsans thread de formatage pour la traiter, ce qui entraînait un blocage. L’appel de planification est désormais encapsulé danstry/catchet tout échec est redirigé viaonBackgroundExceptionafin que le collector s’arrête proprement. #105275 (Azat Khuzhin). - Correction d’une perte silencieuse de données dans les async inserts
Distributedlors de la récupération après un arrêt anormal : si le dernier fichier.bind’un batch sauvegardé était intact mais qu’un fichier intermédiaire était corrompu,DistributedAsyncInsertBatch::recoverBatchne validait que l’en-tête du dernier fichier, puissendBatchmarquait l’ensemble du batch — y compris les fichiers intacts — comme défectueux, entraînant la perte de leurs rows. L’en-tête de chaque fichier est désormais validé individuellement afin que seul le fichier réellement défectueux soit déplacé versbroken/et que les rows restantes atteignent le shard distant. #105281 (Groene AI). - Correction d’une régression dans
clickhouse extract-from-config --try: lorsque la config utilisait des attributsfrom_envet n’avait pas d’élémentinclude_from(ou en avait un pointant vers un fichier manquant), toutes les substitutionsfrom_envétaient silencieusement ignorées et renvoyaient des chaînes vides. Cela cassait la découverte du port dans le point d’entrée Docker en 26.2.5. Clôt #101704. #105283 (Groene AI). - Correction d’un échec de
INSERT INTOdans une tableSQLite, avec une erreur de syntaxe SQLite, lorsque la valeur insérée est unEnum, unJSONou uneAggregateFunctiondont la représentation textuelle contient une apostrophe. Le paramètreoutput_format_values_escape_quote_with_quoteest désormais respecté par les sérialisations correspondantes (auparavant, seulsStringetFixedStringle respectaient). #105285 (Groene AI). - Correction de
Code: 44. ILLEGAL_COLUMN: Cannot add column ...: column with this name already exists, déclenchée par des requêtes distribuées avecallow_push_predicate_ast_for_distributed_subqueries = 1(par défaut) lorsqu’un tupleGLOBAL INcorrespond à une sous-requête dont la projection contient des noms de colonnes en double, par ex.(x, y) GLOBAL IN (SELECT number, number FROM numbers(5)). #105290 (Groene AI). - Correction de
reinterpretversArray(LowCardinality(...)), qui renvoyait à l’exécution une erreurNOT_IMPLEMENTEDtrompeuse ; la fonction renvoie désormaisILLEGAL_TYPE_OF_ARGUMENTlors de la vérification des types. #105301 (Raúl Marín). minMap/maxMap(forme tableau) etminMappedArrays/maxMappedArraystraitent désormaisNaNde manière cohérente avecORDER BY:NaNest traité en dernier (renvoyé uniquement lorsque toutes les valeurs sontNaN). Auparavant, les résultats dépendaient de la position deNaNdans les données en raison de la sémantique de comparaison non ordonnée d’IEEE 754, et ne concordaient pas avec la forme à argumentMapdeminMap/maxMap, corrigée dans #100448. #105331 (Raúl Marín).- Correction d’une fuite de mémoire dans le cache
ColumnsDescriptionpropre à chaque table pour les tables de la familleMergeTreeavec des colonnesNested. Les entrées n’étaient jamais évincées au fil des cyclesALTER ADD COLUMN/DROP COLUMNlorsqueshare_nested_offsets = 1(par défaut). #105376 (Groene AI). - Correction de l’exception
BAD_ARGUMENTS“C’est un bug ! Seuls les types entiers sont pris en charge par__bitWrapperFunc”, déclenchée lorsqu’unSELECTavec un index de sautTYPE set(N)comporte un atomeWHEREdont le type de résultat estFloat,BFloat16ou tout autre type non entier (par exempleWHERE c0 + 0.1ouWHERE log(c0)). Dans ce cas, l’index de saut repasse désormais par le chemin de filtre normal. #105384 (Groene AI).
Amélioration de la compilation/des tests/du packaging
- Ne plus utiliser les bibliothèques et fichiers d’en-tête système de
compiler-rt. Résout #91475. #102857 (Konstantin Bogdanov). - Actualiser l’image de base Docker distroless pour corriger des CVE OpenSSL dans
libssl3t64. #103583 (Rahul Nair). - Récupérer de manière fiable la clé GPG lors des releases en chaînant plusieurs serveurs de clés Ubuntu, au lieu de subir des dépassements de délai sur
keyserver.ubuntu.com. #103834 (Mikhail f. Shiryaev). - Supprimer et interdire les vérifications
CMakeà la compilation (check_*,try_compile,try_run). Le compilateur et la chaîne d’outils étant fixes, la détection de fonctionnalités à la configuration est inutile et désormais bloquée à l’échelle du projet ; tout comportement spécifique à une version doit être explicitement conditionné parCMAKE_CXX_COMPILER_VERSION. #103980 (Alexey Milovidov). - Mettre à jour
libarchivede 3.8.6 à 3.8.7. #104047 (Robert Schulze). - Mettre à jour
mongo-c-driververs la version 2.3.0. #104300 (Raúl Marín). - Mettre à jour les dépendances LLVM pour 22.x. #104381 (Joshua Carp).
- Permettre la compilation sur macOS et FreeBSD des classes du client intégré et du descripteur PTY en utilisant les fonctions POSIX portables
posix_openpt/grantpt/unlockpt, et en supprimant les gardes#ifspécifiques à Linux. #104436 (Alexey Milovidov). - Mettre à niveau
librdkafkavers la version 2.14.1. #105222 (János Benjamin Antal).
Version de ClickHouse 26.4, 2026-04-30. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- L’opérateur
INutilise désormais une sémantique de valeur exacte pour le typeBool: seules les valeurs0et1de l’ensemble correspondent à des valeursBool. Auparavant, les valeurs numériques supérieures à255dans l’ensembleINétaient incorrectement ramenées àtruelors de la comparaison avecBool, si bien queSELECT CAST(1, 'Bool') IN (256)renvoyait 1. Désormais, il renvoie correctement0. Clôt #92980. #93115 (Ashrith Bandla). - La bibliothèque H3 a été mise à jour vers la v4, ce qui améliore la précision des calculs de longueur, de surface et d’autres mesures. Ce changement n’est pas rétrocompatible, car les nouveaux résultats diffèrent des précédents. #100348 (Alexey Milovidov).
- Interdit l’utilisation de
SELECTcomme identifiant non délimité dans un élément de la liste d’expressionsWITH. #101059 (Aruj Bansal). - Ce correctif modifie la manière dont la table Merge gérera les colonnes virtuelles. Si la table sous-jacente contient
_tableou_database, ces colonnes seront lues depuis le stockage ; sinon, elles seront remplies après l’étape de lecture à l’aide de l’étape d’expression. #101742 (Mikhail Artemenko). - L’opérateur
INrejette désormais aussi les conversionsDecimalavec perte à l’intérieur des types composites (Tuple,Array,Map), ce qui aligne son comportement sur celui des comparaisons scalaires de premier niveau. Auparavant, les vérifications de précision ne s’appliquaient qu’aux valeurs scalaires de premier niveau : par exemple,CAST('33.3', 'Decimal64(1)') IN (33.33)renvoyait correctement0, maisCAST(['33.3'], 'Array(Decimal64(1))') IN ([33.33])renvoyait incorrectement1, car la conversion avec perte se produisait à l’intérieur d’unArray. Désormais, les deux cas renvoient correctement0. #101812 (Nihal Z. Miaji). - Les valeurs par défaut de
http_max_fieldsont été réduites de 1,000,000 à 1,000 et celles dehttp_max_field_name_sizede 128 KB à 4 KB afin de limiter l’utilisation mémoire avant authentification par les connexions HTTP. Les paramètreshttp_max_request_header_sizeethttp_headers_read_timeoutont été ajoutés. Les utilisateurs qui dépendent des anciennes limites plus élevées peuvent les rétablir via les paramètres. #103285 (Sema Checherinda).
Nouvelle fonctionnalité
- Ajout du spilling automatique pour les hash joins et les parallel hash joins, en les convertissant en grace hash join lorsque la limite mémoire est atteinte. Ce comportement est contrôlé par
max_bytes_before_external_join. #97813 (János Benjamin Antal). - Ajout de la prise en charge d’Arrow Flight SQL. #91170 (Yakov Olkhovskiy).
- Ajout de la prise en charge de l’Incremental read pour les table engines
Paimon, avec suivi de progression des snapshots via Keeper, y compris des lectures delta ciblées de snapshots viapaimon_target_snapshot_id, et extension de la couverture des tests pour les scénarios de type mapping, de partition pruning et d’Incremental read. #93655 (XiaoBinMu). - La fonction
stemn’est plus expérimentale (auparavant, il fallait activer le paramètreallow_experimental_nlp_functions). #102399 (Jimmy Aguilar Mena). Vous pouvez désormais facilement appliquer la racinisation à tous les mots/tokens des colonnesString,FixedString,Array([Fixed]String),Nullable,LowCardinalityetConstavec la fonctionstem. #99137 (Jimmy Aguilar Mena). - Implémentation d’un nouveau comportement pour
max_insert_block_size_rows,max_insert_block_size_bytes,min_insert_block_size_rows,min_insert_block_size_byteslors du squashing, sous le paramètre de compatibilitéuse_strict_insert_block_limits. #94207 (Kirill Kopnev). - Ajout de la fonction
arrayAutocorrelation(arr [, max_lag]), qui calcule l’autocorrélation normalisée d’un tableau numérique pour chaque décalage. Prend en charge les types de tableaux d’entiers, de flottants et de décimaux. #94776 (Wenyu Chen). - Ajout de la fonction SQL
obfuscateQuery. Ferme #98010. #98305 (Xuewei Wang). - Ajout de la prise en charge des types Map et JSON/Object comme dictionary attributes. Les dictionnaires peuvent désormais stocker et récupérer des types complexes, notamment Map(String, String), Map(String, Array(String)), JSON et Nullable(JSON), dans les layouts FLAT et HASHED. #98627 (yanglongwei).
- Ajout de deux nouveaux MergeTree settings —
replicated_fetches_min_part_leveletreplicated_fetches_min_part_level_timeout_seconds— qui permettent aux répliques d’éviter de récupérer auprès de leurs pairs des parts fraîchement insérées (non fusionnées), réduisant ainsi la surcharge de réplication lors d’une ingestion intensive. #98625 (tanner-bruce). - Ajout de la prise en charge des skip indexes MergeTree pour les JSON columns à l’aide de JSONAllPaths avec les types d’index bloom_filter, tokenbf_v1, ngrambf_v1 et text (inversé), permettant de sauter des granules en fonction de l’ensemble des JSON paths présents dans chaque granule. #98886 (Pavel Kruglov).
- La fonction
printfprend désormais en charge les format strings non constants, ce qui permet d’utiliser des motifs de format différents pour chaque ligne selon les valeurs des colonnes. #98991 (Yash ). - Ajout d’un nouvel index de projection,
commit_order, qui réorganise les données dans l’ordre d’insertion. #99004 (Mikhail Artemenko). - Ajout de la fonction
highlight, qui entoure les occurrences des termes de recherche dans une chaîne de texte avec des balises HTML (par défaut<em>/</em>). Prend en charge la correspondance ASCII insensible à la casse, la fusion automatique des correspondances qui se chevauchent et des balises d’ouverture/fermeture personnalisées. #99131 (Peng). - Mise en œuvre de quotas par hash de requête normalisée pour protéger les services ClickHouse publics contre les abus. 1. Prise en charge de
NORMALIZED_QUERY_HASHcomme type de quota key — avec des buckets de quotas distincts pour chaque requête normalisée unique, de sorte queCREATE QUOTA q KEYED BY normalized_query_hashsuit chaque requête distincte indépendamment. 2. Prise en charge deQUERIES_PER_NORMALIZED_HASHcomme type de ressource de quota — limite le nombre maximal d’exécutions d’une même requête normalisée au cours d’un intervalle, de sorte queMAX queries_per_normalized_hash = 100empêche qu’un même query pattern soit exécuté plus de 100 fois. #99586 (Alexey Milovidov). - Les utilisateurs peuvent désormais écrire des requêtes avec
NATURAL JOIN, qui met automatiquement en correspondance toutes les colonnes portant le même nom et déduplique ces colonnes dans le résultat. #99840 (Peter Nguyen). - Prise en charge de
SET TIME ZONE 'tz'comme alias deSET session_timezone. #99883 (phulv94). - Ajout de la prise en charge des requêtes paramétrées dans l’interface web (
play.html) : les query parameters comme{name:Type}sont détectés et des champs de saisie s’affichent pour permettre de renseigner leurs valeurs. #100041 (Alexey Milovidov). - Prise en charge de la clause SQL standard
VALUEScomme expression de table dansFROM, par ex.SELECT * FROM (VALUES (1, 'a'), (2, 'b')) AS t(id, val). #100143 (Desel72). - Ajout d’unités compatibles PostgreSQL à l’opérateur
EXTRACT:EPOCH,DOW,DOY,ISODOW,ISOYEAR,WEEK,CENTURY,DECADE,MILLENNIUM. Correction également deEXTRACT(WEEK FROM date), qui renvoyait auparavant une erreur. #100274 (Alexey Milovidov). - Ajout de la prise en charge des littéraux d’intervalle composés conformes au standard SQL avec qualificateurs de plage
TO, par ex.INTERVAL '1:30' HOUR TO MINUTE. Ils sont décomposés en interne en sommes d’intervalles. #100453 (Desel72). - Ajout de metrics asynchrones pour la mémoire tampon TCP du noyau, en réception et en émission (
sk_rmem_alloc,sk_wmem_alloc), des sockets du pool de connexions HTTP, rapportées sous forme de percentiles p50/p75/p90/p95 et de totaux par groupe de connexions. #100575 (Sema Checherinda). - Ajout d’une interface web de profiling jemalloc pour ClickHouse Keeper, disponible à l’adresse
/jemallocsur le port HTTP control. #100606 (murphy-4o). - Mise en œuvre de la commande
SYSTEM FLUSH OBJECT STORAGE QUEUE db.table PATH 'x'pour les modes ordered et unordered. #100709 (Bharat Nallan). - Ajout de la fonction
JSONAllValues, qui renvoie toutes les valeurs d’une colonneJSONsous forme deArray(String), avec des valeurs sérialisées en représentation textuelle et ordonnées par nom de chemin. Ajout de la prise en charge d’un text index pour l’expressionJSONAllValuessur les colonnesJSON. Lorsqu’un text index est créé surJSONAllValues(json_column), il est automatiquement utilisé pour filtrer les requêtes sur les sous-colonnesJSON(par exemple,json_column.key1 = 'value'). #100730 (Anton Popov). - Ajout d’un nouveau paramètre
input_format_column_name_matching_mode, qui permet différents niveaux de sensibilité à la casse pour les input formats. #99346 (manerone). - Ajout de la commande
watchàclickhouse-keeper-client, avec prise en charge des watches dans les commandesget,existsetls. #100834 (Den Kalantaevskii). - Ajout de la requête
getChildrenRecursive(ListRecursive) à ClickHouse Keeper et de la commandelsràclickhouse-keeper-client. Cela résout #99916. #100998 (Konstantin Vedernikov). - Ajout de la nouvelle fonction
arrayTranspose, qui prend un tableau bidimensionnel (matrice) et le transpose :SELECT arrayTranspose([[1, 2, 3], [4, 5, 6]]). #101214 (Vitaly Baranov). - Le paramètre
auto_statistics_types mergetreea désormais pour valeur par défaut'minmax, uniq'— des statistiques minmax et uniq sont automatiquement créées pour toutes les colonnes adaptées dans les nouvelles tables -materialize_statistics_on_inserta désormais pour valeur par défaut false — les statistiques sont maintenant construites lors des merges plutôt qu’au moment de l’insert, ce qui réduit la surcharge des insertions. UtilisezSET materialize_statistics_on_insert = 1pour restaurer l’ancien comportement. #101275 (Han Fei). - Ajout du paramètre de refresh
prefer_dependency_replicapour les chaînes de dépendances de materialized views afin de réduire les données manquantes dues au retard de réplication entre replicas. #101591 (Seva Potapov). - Ajout d’une fonction
hasPhrase(aliasmatchPhrase) pour la recherche de phrases (séquences continues de jetons). La recherche se fait en brute-force, c.-à-d. qu’elle n’est pas encore prise en charge par le text index. #101997 (Elmi Ahmadov). - Ajout des histogram metrics
s3_read_request_duration_microsecondsets3_read_request_bytespour observer la durée de vie des connexions des requêtes GET S3 et le volume d’octets consommés, visibles danssystem.histogram_metricset sur le Prometheus endpoint. #102058 (Sema Checherinda). - Les valeurs
DateetDate32peuvent désormais être ajoutées à des valeursTimeetTime64à l’aide de l’opérateur+, produisant un résultatDateTimeouDateTime64. Par exemple,SELECT toDate('2024-01-15') + toTime('14:30:25')renvoie2024-01-15 14:30:25. Le résultat est calculé dans le session timezone, et les résultats hors plage sont gérés conformément au paramètredate_time_overflow_behavior. Résout #95914. #102421 (Nihal Z. Miaji). - Le text index est désormais GA et reste activé indépendamment du paramètre
compatibility, ce qui évite toute désactivation inattendue lors des restaurations depuis une sauvegarde ou en compatibility mode. #101518 (Nikita Fomichev).
Fonctionnalité expérimentale
- Ajout de
ALTER TABLE ... EXECUTE remove_orphan_filespour les tables Iceberg afin d’identifier et de supprimer du stockage objet les fichiers non référencés. #99127 (murphy-4o). - Ajout du paramètre
query_plan_optimize_join_order_randomize, qui randomise les statistiques utilisées pour réordonner les jointures, ce qui est utile pour les tests. #100643 (Vladimir Cherkasov). - Ajout de la prise en charge des fonctions d’IA dans ClickHouse, permettant aux utilisateurs d’appeler des points de terminaison OpenAI et Anthropic à l’aide de SQL.
aiGenerateest incluse comme première fonction de ce type. #100831 (George Larionov). - Ajout des fonctions d’IA
aiClassify,aiExtractetaiTranslatepour utiliser des API de LLM dans ClickHouse. #100832 (George Larionov). - Ajout de
system.histogram_metric_log, une nouvelle table système qui crée périodiquement des instantanés de toutes les métriques d’histogramme (par ex. les latences S3/Azure, les durées des étapes de traitement des requêtes Keeper). De plus, la colonnevaluedesystem.histogram_metricsdevientFloat64, car ce type est plus flexible et plus compatible avec le modèle de données Prometheus. #103046 (Miсhael Stetsyuk). La structure de la table est susceptible d’être modifiée dans les versions futures.
Amélioration des performances
- ClickHouse peut désormais effectuer le pruning de data parts entières dans les requêtes SELECT à partir des statistiques min/max. #94140 (zoomxi).
- Réduit la contention sur les verrous lors des opérations readonly sur les tables ReplicatedMergeTree avec des mutations terminées. #95771 (Eduard Karacharov).
- Respecte
optimize_read_in_orderlors de la lecture des projections. Clôture #89453. #95885 (Andrey Zvonov). - Série de petites améliorations pour le hash join et le concurrent hash join. #96663 (Yarik Briukhovetskyi).
- Optimise la transformation
DISTINCTen désactivant l’optimisation des colonnesLowCardinalitylorsque les données d’entrée sont presque toutes distinctes. #97113 (Nihal Z. Miaji). - Optimisation des performances des requêtes
LIKEsignalée dans #97723. Ces requêtes peuvent désormais utiliser des index de texte. #98149 (Elmi Ahmadov). - Les fonctions mathématiques vectorisées (
exp,log,sigmoid,tanh) sont désormais accélérées sur AArch64 (avec NEON/SVE), ainsi que sur FreeBSD/Darwin, où elles utilisaient auparavant un fallback scalaire plus lent. #98230 (Raúl Marín). - Les requêtes filtrant sur les colonnes de clé primaire de
MergeTreeavec des alternances regexp sur des chaînes littérales, telles que^(abc-1|abc-2), peuvent désormais utiliser le pruning de clé primaire lorsque les alternatives partagent un préfixe commun. #98988 (Yash ). - Généralise le filtrage dynamique top-k de
ORDER BY ... LIMITpour prendre en charge les typesNullable,StringetCOLLATE. #99033 (murphy-4o). - Accélère le hash join sur des clés
Int32etInt64de petite plage grâce à une hash table à index direct. #99275 (Hechem Selmi). - Requêtes discontinues plus rapides pour les colonnes
LowCardinalityavec un seul dictionnaire. #99285 (Ivan Babrou). - Accélère les fonctions
var*Stableetstddev*Stablepour les colonnesFloat64en dévirtualisant la boucle interne. Remarque : cela active des optimisations du compilateur (FMA/registres) qui modifient les résultats en virgule flottante au niveau des ULP. #99460 (Riyane El Qoqui). - Utilise l’encodage base58 optimisé de Firedancer pour les entrées de 32/64 octets (automatiquement pour
base58Encode). Permet d’utiliser le décodage base58 optimisé si le résultat décodé fait 32/64 octets (explicitement avecbase58Decode('...', 32)ou équivalent). #99461 (Joanna Hulboj). - Active des optimisations basées sur les sections de l’éditeur de liens (
-ffunction-sections,-fdata-sections,--icf=all) afin de réduire la taille du binaire et d’améliorer l’utilisation du cache d’instructions. #99474 (Alexey Milovidov). - Corrige le scaling négatif pour les requêtes courtes avec agrégation sur des machines dotées de nombreux cœurs. Lorsqu’une requête lit peu de marks, le pipeline ne s’étend plus jusqu’à
max_threadsaprès l’agrégation, ce qui évite le surcoût lié à des streams en grande partie vides. #99493 (Alexey Milovidov). - Améliore les performances des requêtes avec répliques parallèles en sélectionnant correctement la taille de la tâche de lecture. #99801 (Nikita Taranov).
- Autorise le prefetch lors de la lecture d’un fichier distant via le cache de pages en espace utilisateur. #99919 (Alexey Milovidov).
- Évite le calcul inutile de la sous-colonne
.sizedeStringlors de l’énumération des sous-colonnes. #99941 (Pavel Kruglov). - Rend la barre de progression de clickhouse-client moins saccadée lors d’une utilisation depuis un hôtel avec des clusters comportant un très grand nombre de répliques. #100145 (Alexey Milovidov).
- Démarre
MemoryWorkerdansclickhouse-locallorsque le cache de pages est activé, afin que le cache de pages en espace utilisateur puisse être effectivement utilisé. #100306 (Alexey Milovidov). - Optimise les requêtes en propageant la clause
LIMITdans leUNION ALL. #100364 (Alexey Milovidov). - Ajoute la prise en charge de la compilation JIT pour les comparaisons de colonnes
StringetFixedStringdansORDER BY, améliorant les performances du tri en phase de fusion de 6 à 17 % pour les clés de tri fortement basées sur des chaînes. Coécrit avec @lgbo-ustc. #100577 (Raúl Marín). - Lorsque
read_in_order_use_virtual_rowest activé avec le nouveau paramètreread_in_order_use_virtual_row_per_block, les informations de frontière des lignes virtuelles sont désormais émises après chaque block lu depuisMergeTree, ce qui permet à la fusion de reprioriser les sources en cours de stream pour les parts dont les données sont entièrement filtrées parWHERE/PREWHERE/JOIN. Ferme #99945. #100603 (Vladimir Cherkasov). - Conversion plus rapide de
FloatversStringpour les grandes valeurs entières en étendant le chemin rapideitoaavec un arrondi compatible avec dragonbox. #100649 (Raúl Marín). - Remplace
dragonboxparzmijpour une conversion deFloatenString1,5 à 3 fois plus rapide. #100650 (Raúl Marín). - Accélère la conversion de
Int128/UInt128en chaîne en remplaçant la division logicielle par la réduction de Barrett et en déroulant la boucle de conversion. #100671 (Raúl Marín). - Évite de lancer des threads redondants dans la fusion parallèle de
uniqExact. #100686 (Jiebin Sun). - Ajoute une fusion parallèle par lots pour
uniqExact. #100687 (Jiebin Sun). - Améliore la parallélisation des requêtes avec des views simples (reposant sur une table
MergeTreesous-jacente) exécutées avec des répliques parallèles. #100815 (Igor Nikonov). - Ajoute la prise en charge des répliques parallèles sur les vues simples (y compris les vues
UNION ALLéligibles sur des tablesMergeTree) lorsqueparallel_replicas_allow_view_over_mergetree=1. Cela permet de paralléliser la requête externe de la vue plutôt que la requête interne, ce qui accroît la parallélisation des requêtes entre les nœuds. #100958 (Igor Nikonov). - Optimise la lecture dans l’ordre de la clé primaire pour
full_sorting_mergelorsque des filtres avecINsont présents dans le plan de requête. #101261 (Nikita Taranov). - Optimise les allocations/désallocations en mettant en cache les paramètres d’échantillonnage au lieu de parcourir toute la hiérarchie du memory tracker. #101267 (Azat Khuzhin).
- Corrige une régression importante des performances d’INSERT lorsque
deduplicate_insert = 'enable'(par défaut depuis la version 26.2) en reportant le calcul du hash des données du squashing vers le sink et en utilisant le hachage par lots des colonnes viaupdateHashWithValueRange, ce qui réduit le surcoût d’environ 2,5 s à environ 0,5 s pour 5 M de lignes avec 22 colonnes. #101494 (Sema Checherinda). - Réduit le surcoût des verrous profilés en utilisant
try_lockpour éviter de mesurer les acquisitions sans contention et en supprimant la mesure du temps de détention. #101502 (Antonio Andelic). - Remplace les intrinsics AVX-512 écrites à la main dans
arrayDotProductpar des boucles auto-vectorisables indépendantes de la plateforme, avec ajout de la prise en charge d’AVX2 et d’ARM NEON. #101571 (Peng). - Améliore les performances de
INSERT VALUESpour les colonnesMap,ArrayetTuplelorsque les valeurs sont transmises sous forme de chaînes échappées (par ex.'{\'key\':1}'), en évitant un recours inutile au parser d’expressions SQL. #102119 (Joanna Hulboj). - Corrige une utilisation excessive du CPU par le table engine
RabbitMQ. #102711 (Jaap Elst). - L’optimiseur de l’ordre des JOIN déduit désormais les prédicats transitifs d’équi-jointure à partir des conditions de jointure existantes. Par exemple, avec
A.x = B.x AND B.x = C.x, l’équivalenceA.x = C.xest reconnue, ce qui permet à l’optimiseur d’envisager des jointures directes entre des tables connectées transitivement. Cela peut améliorer la qualité du plan pour les schémas en étoile et en flocon, où les tables de dimension sont reliées par une table de faits commune. La fonctionnalité est contrôlée par le nouveau paramètreenable_join_transitive_predicates(désactivé par défaut). #98479 (Alexander Gololobov). - Optimise
TRUNCATE DATABASE TABLES LIKEen pré-annulant les merges en parallèle. #98597 (Shaohua Wang). - Ajoute la prise en charge de la monotonie pour la multiplication, ce qui permet le pruning par clé primaire pour les expressions
key * constant. #98983 (Amos Bird). - Les dictionnaires de cache ne prennent plus de verrou exclusif dans
hasKeys; cela réduit la contention sur les verrous en utilisant un verrou partagé pour les lectures du cache. #100796 (liuguangliang). - Intègre en ligne la sous-requête VIEW dans le query tree afin de permettre l’application de davantage d’optimisations à la VIEW. #100830 (Dmitry Novik).
- Optimise le chargement du cache au démarrage du serveur. #101500 (Kseniia Sumarokova).
- Implémenter la matérialisation paresseuse des colonnes pour ReplacingMergeTree avec FINAL lorsque le prédicat est suffisamment sélectif. #101647 (Nikolai Kochetov).
- Réactiver l’optimisation
optimize_rewrite_array_exists_to_has(désactivée par défaut depuis la version 23.10). Elle réécritarrayExists(x -> x = elem, arr)enhas(arr, elem), bien plus rapide, et évite désormais correctement cette réécriture lorsque le type d’élément du tableau etelemne sont pas compatibles avechas(par ex.DatevsString), ce qui permet aux requêtes qui échouaient auparavant de continuer à fonctionner. Clôt #71431. #100944 (Alexey Milovidov).
Amélioration
- Sortie
EXPLAIN PLAN pretty=1améliorée : affichage des colonnes de sortie de la requête de niveau supérieur, des libellés/symboles des relations de join avec le nombre estimé de lignes de résultat et la localité, ainsi que des colonnes de sortie pour chaque étape de type join/source. Les changements couvrent la partie Information Deficit de #98117. #99462 (Kirill Kopnev). - Ajout du paramètre de table MergeTree
share_nested_offsets(par défauttrue). Lorsqu’il est défini surfalse, les colonnes Array avec des noms à points (par ex.n.a,n.b) sont traitées comme des colonnes indépendantes au lieu de partager des fichiers d’offsets et de vérifier l’égalité des tailles de tableaux selon l’ancienne sémantiqueNested. #98416 (Amos Bird). - Les utilisateurs peuvent désormais spécifier plusieurs méthodes d’authentification dans la configuration users.xml/yaml (en SQL, cela a toujours été possible). #91998 (Flip-Liquid).
- Rechargement automatique des connexions inter-nœuds Raft utilisant TLS. #93455 (Evgeny).
- Extension de
cast_keep_nullablepour fonctionner avec les types Dynamic/JSON. Lorsqu’il est activé, le CAST de NULL depuis des types pouvant être Nullable renvoie NULL ; sinon, NULL déclenche l’erreurCANNOT_INSERT_NULL_IN_ORDINARY_COLUMN. #96504 (Seva Potapov). - Réduction de l’empreinte mémoire des structures de données internes (objets
ISerialization) grâce à l’introduction d’un pool d’objets. #96563 (Nikita Mikhaylov). - Ajout de la prise en charge des champs
passwordetidentityà la config XML de keeper-client. #96800 (Grigorii Sokolik). - Amélioration des écritures
Icebergpour Unity Catalog. #98162 (Konstantin Vedernikov). - Ajout du paramètre
finalize_projection_parts_synchronouslypour permettre la finalisation synchrone des projection parts pendant INSERT, réduisant le pic d’utilisation mémoire pour les tables comportant de nombreuses projections tout en conservant par défaut le comportement asynchrone existant. #98228 (Amos Bird). - Ajout de la colonne
projections_duration_msàsystem.part_log, qui enregistre pour chaque projection la durée des opérations de merge/rebuild en millisecondes. #98292 (Amos Bird). - Amélioration de l’annulation des queries utilisant ExpressionTransform et NumbersRangedSource via KILL QUERY et l’annulation de query (Ctrl+C) dans clickhouse-client. #98908 (Roman Vasin).
- Remplacement de la liste codée en dur
source_table_enginespar une recherche à l’exécution viaStorageFactory::getAllStorages(). Cela ajoute des vérifications d’accès pour certains table engines manquants et clôt #71544. #98984 (pufit). - Ajout d’un paramètre pour contrôler le comportement en cas d’incompatibilité de type pour Variant et Dynamic (déclencher une exception ou renvoyer NULL). #99085 (Bharat Nallan).
- Améliore la compatibilité avec
Iceberget Spark : corrige les incohérences de gestion des chemins dues à l’utilisation conjointe des chemins de stockage et des chemins de métadonnées ; impose que les tablesIcebergenregistrent un emplacement de table qui soit soit une URL, soit un chemin absolu ; ajoute un mécanisme de repli pour le calcul de la taille des fichiers dansAzure, car certains lecteurs ClickHouse ne prennent pas en charge le comptage des octets après parcours ; gèreversion-hint.txtde manière compatible avec Spark ; introduit des abstractions au niveau des types afin de réduire à l’avenir les risques de confusion entre types de chemins ; ajoute des tests pourAzureetLocalqui vérifient l’interopérabilité entre moteurs sans téléversement ni téléchargement intermédiaires ; corrige l’utilisation des suppressions par position, qui reposait auparavant sur des heuristiques d’inférence de chemin là où cette approche n’est pas appropriée. #99163 (Daniil Ivanik). #100420 (Daniil Ivanik). - Corrige une possible condition de concurrence dans
IPartitionStrategy::cached_result, introduite dans https://github.com/ClickHouse/ClickHouse/pull/92844. #99400 (Arthur Passos). - Les utilisateurs peuvent désormais écrire des types de données Interval de ClickHouse au format Arrow. #99519 (Peter Nguyen).
- Ajoute la prise en charge native de l’importation et de l’exportation des types de données
UUIDaux formatsArrowetParquet. Les utilisateurs peuvent désormais interroger et transférer directement des données UUID entre ClickHouse et d’autres outils de données, sans conversion manuelle en chaîne ni solution de contournement. Ajoute également l’inférence logique automatique pour les UUID de premier niveau, ainsi que la prise en charge d’indices de schéma explicites pour les UUID imbriqués. #99521 (Ivan). - Prend en charge les archives
7zsur le stockage objet. Clôt #70968. #99600 (Alexey Milovidov). - Ajoute les ProfileEvents
ObjectStorageListedObjects,ObjectStorageGlobFilteredObjects,ObjectStoragePredicateFilteredObjectsetObjectStorageReadObjectspour l’introspection du pipeline de listage et de lecture des fichiers du stockage objet (S3,Azure, etc.). #99778 (Sema Checherinda). - Corrige l’échec de la fonction de table
mergeavec l’erreurUNKNOWN_IDENTIFIERlors de l’interrogation de colonnes qui ne sont pas présentes dans toutes les tables distribuées/distantes sous-jacentes. #99833 (Alexey Milovidov). - Le temps de commit est désormais inclus dans la métrique du temps total d’exécution des mutations pour ReplicatedMergeTree. Il avait été perdu après #96376. #99936 (alesapin).
- Ajoute un journal en écriture anticipée pour les objets blob en attente de suppression dans
MetadataStorageFromDisk, ce qui améliore la durabilité et la cohérence entre les métadonnées et le stockage objet distant lors de la suppression d’objets. #100019 (Maksim Kita). - Désactive AI SQL generation (commande
??) dans le client embarqué (protocoles SSH et WebSocket) afin d’empêcher l’accès aux variables d’environnement du serveur. #100290 (Alexey Milovidov). - Modifie l’interface des inserts Iceberg avec le catalogue. Déprécie les paramètres :
storage_catalog_type,storage_aws_access_key_id, etc. #100334 (Konstantin Vedernikov). - Rendre les tabulations sous forme de 4 espaces lors du collage dans clickhouse-client. Corrige #100405. #100416 (Raúl Marín).
- Éviter de parcourir l’ensemble du catalogue distant du data lake pour les suggestions de table « Maybe you meant … » lorsque
show_data_lake_catalogs_in_system_tablesest désactivé. #100452 (Alsu Giliazova). - Appliquer
distributed_index_analysis_min_indexes_bytes_to_activateaprès l’élagage des partitions. #100477 (Azat Khuzhin). - Correction d’un échec d’assertion dans le push down du bloom filter Parquet lors de l’utilisation de clauses IN/NOT IN vides. #100543 (zoomxi).
- Les statistiques de colonnes MinMax stockent désormais les valeurs minimale et maximale sous forme de Field (typé) au lieu de Float64. Le format sérialisé inclut le nom du type de la colonne avec les valeurs. La version du fichier de statistiques passe à V2 ; les fichiers écrits par des versions antérieures nécessitent une re-matérialisation (ALTER TABLE … MATERIALIZE STATISTICS ALL). Corrige #53140. #100605 (Han Fei).
- Mise à jour de
cppkafkapour inclure le correctif d’interblocage lors de la fermeture du consumer. #100612 (Azat Khuzhin). - Les informations d’objet utilisées pour analyser les data files dans Iceberg contiennent désormais le nombre de lignes du fichier et sa taille en octets, extraits du manifest file. #100645 (Daniil Ivanik).
- Ajout du paramètre de configuration
use_separate_cache_arenapour contrôler la séparation de l’Arena mémoire du cache. #100664 (Seva Potapov). - Ajoute la prise en charge native de l’import des data types
StringViewetBinaryViewd’Apache Arrow dans les colonnesStringde ClickHouse, ce qui améliore la compatibilité pour l’ingestion basée sur Arrow. #100762 (Ivan). - Certains server settings du Keeper server sont désormais rechargés à chaud si le config file est modifié à l’exécution : max_requests_batch_size, max_requests_batch_bytes_size, max_request_size, quorum_reads. #100773 (Michael Kolupaev).
- Incrémente les profile events
MemoryAllocatedWithoutCheck/MemoryAllocatedWithoutCheckBytesdans les builds de release. #100899 (Pavel Kruglov). - Le suivi de la mémoire avec cgroupv2 exclut désormais
slab_reclaimablede la mémoire du noyau, ce qui fournit une mesure plus précise de l’utilisation de la mémoire non récupérable. #100901 (Antonio Andelic). use_partition_pruning = 0désactive désormais aussi l’élagage des indexMinMaxet l’optimisation de comptage sur les colonnes de clé de partition, en plus de désactiver l’élagage basé sur les clés de partition. #100904 (Nihal Z. Miaji).pretty=1dansEXPLAIN [PLAN]affiche désormais les expressions dans un format lisible. #100927 (Kirill Kopnev).accurateCastOrNulletaccurateCastOrDefaultprennent désormais en charge les types ciblesTuple, y compris lesTuplesimbriqués avec des élémentsNullable. Auparavant, ces fonctions rejetaient les ciblesTuplecarTuplene pouvait pas être utilisé dansNullable. Clôt #100820. #100942 (Nihal Z. Miaji).- Correction de la duplication des graphiques dans l’interface Play lors du basculement entre les thèmes clair et sombre. #101058 (Alexey Milovidov).
- Mise à jour de chdig vers v26.3.1 (interface perfetto, sparklines dans le résumé pour CPU/Memory/Merges/Queries, system.warnings, recherche regexp dans les logs). #101092 (Azat Khuzhin). Mise à jour de chdig vers v26.4.3 (améliorations de perfetto, corrections pour le partage via pastila.nl, diffs de flamegraph, modification des paramètres en temps réel). #103145 (Azat Khuzhin).
- Vous pouvez désormais ajouter une virgule finale dans la clause
WITHavant une requêteSELECT. #101093 (Aruj Bansal). - Ajout du paramètre MergeTree
compress_per_column_in_compact_partspour contrôler l’organisation des blocs compressés dans les parts compactes. Quand sa valeur esttrue(par défaut, ce qui préserve le comportement actuel), chaque colonne démarre un nouveau bloc compressé, ce qui permet une décompression sélective. Quand sa valeur estfalse, toutes les colonnes d’une granule sont regroupées dans le même bloc compressé, ce qui améliore le taux de compression et les performances de lecture pour les charges de travail qui lisent toujours toutes les colonnes. #101114 (Amos Bird). - Afficher l’infobulle d’informations sur la table dans l’interface Play uniquement au survol du nom de la table, et non de toute la ligne. #101118 (Alexey Milovidov).
- Ajout d’icônes spécifiques aux moteurs et amélioration de l’UX de la liste des tables dans la barre latérale de l’interface Play. #101134 (Alexey Milovidov).
- Prise en charge de
Nullable(Tuple)pour les formatsArrow,ArrowStream,ORCet l’ancien formatParquet. #101272 (Nihal Z. Miaji). - Affichage de la ligne TOTALS en pied de tableau dans l’interface web (play.html). #101286 (Alexey Milovidov).
- Prise en charge du mode multi-requêtes dans l’interface web (
play.html) : exécutez plusieurs requêtes à la fois, avec exécution parallèle des requêtes de typeSELECTet affichage des résultats par requête. #101290 (Alexey Milovidov). - Correction du redimensionnement des colonnes dans l’interface web play.html après la refactorisation de la table de résultats en composant web. #101295 (Alexey Milovidov).
- Ajout de la possibilité de limiter le nombre de flushes du profil jemalloc sur MEMORY_LIMIT_EXCEEDED par intervalle de temps. #101396 (Azat Khuzhin).
- Ajout des paramètres de Keeper
nuraft_streaming_mode(par défautfalse),nuraft_max_log_gap_in_streametnuraft_max_bytes_in_flight_in_stream. Résout #90743. #101427 (Kseniia Sumarokova). - Ajout de la métrique asynchrone
CGroupMemoryUsedWithoutPageCache, qui signale l’utilisation de la mémoire du cgroup en excluant à la fois le cache de pages de l’OS du noyau et le userspace page cache de ClickHouse, à l’image deMemoryResidentWithoutPageCache. La description de la métriqueCGroupMemoryUseda également été clarifiée. #101513 (Francesco Ciocchetti). - Ajout d’un sucre syntaxique au niveau du parser pour la syntaxe de fonction
OVERLAYstandard SQL. La fonctionoverlayexiste déjà ; cela ajoute la prise en charge de la forme basée sur des mots-clés utilisantPLACING,FROMetFORcomme séparateurs. #101681 (Desel72). - Ajout de l’alias de colonne
INDEX_LENGTHà la table systèmeinformation_schema.tables, par analogie avec les alias existants en majuscules dans cette table. #101705 (Robert Schulze). - La table système
information_schema.tablesignore désormais les parties de table inactives. Cela rend les valeurs de taille de table affichées plus réalistes. #101706 (Robert Schulze). - La fonction
ngramsrejette désormais les longueurs de ngram invalides. Exemple :SELECT ngrams('abc', 0)renvoie maintenant une erreur. #101922 (Robert Schulze). - Suite à #91820 et #90837 : filtrer les algorithmes non pris en charge dans le message d’erreur ; exécuter les tests spécifiques à FIPS dans les builds FIPS. #102067 (Mikhail f. Shiryaev).
- Limitation de la hauteur des cellules à trois lignes dans l’interface web (
play.html), avec des cellules dépliables au clic. #102154 (Alexey Milovidov). - Ajout d’une nouvelle option permettant de forcer le style (virtuel/chemin) pour les S3 endpoints. Résout #82019 ; #76007 Suite de https://github.com/ClickHouse/ClickHouse/pull/83168. #102378 (Konstantin Vedernikov).
- Le paramètre
restore_replace_external_engines_to_nullignore désormais également la restauration des databases utilisant des engines externes (par ex.DataLakeCatalog,MySQL,PostgreSQL,S3) au lieu d’échouer ou d’initier des connexions externes. #102400 (Nikita Fomichev). - Ajout de la prise en charge de l’index analysis pour les text index de la fonction
hasPhrasevia le modeHINT. #102438 (Elmi Ahmadov). - Traiter STATISTICS comme read-only dans ColumnDependency pour corriger LOGICAL_ERROR lors de MATERIALIZE STATISTICS ALL. #102627 (Konstantin Bogdanov).
- Créer et peupler
system.asynchronous_metric_logen mode keeper-as-server. #102664 (Miсhael Stetsyuk). - Ajout de l’option de configuration
default_system_log_flush_policy.skip_alias_columnspour permettre d’omettre les colonnes ALIAS des tables de log système, ce qui corrige le problème des logs système sur S3 qui refusent les colonnes ALIAS. #102669 (Miсhael Stetsyuk). - Ne pas activer les statistiques automatiques pour les tables système. Elles ont rarement l’occasion d’en tirer parti. #102862 (Han Fei).
- Prise en charge du tokenizer
arraypour l’optimisation de LIKE. #102880 (Elmi Ahmadov). - Envoyer MemoryAllocatedWithoutCheck même dans les builds de release. #103064 (Azat Khuzhin).
- Exposer
untracked_memorypar thread danssystem.stack_trace. #103065 (Azat Khuzhin).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Corrige l’erreur
Block structure mismatch in streamcausée par des colonnes inutiles renvoyées par la lazy materialization. Corrige #95191. #96682 (Nikolai Kochetov). - Corrige une erreur logique dans une requête de policy de masquage des données avec
ON CLUSTER. #97594 (Bharat Nallan). - Corrige un bug lors de l’utilisation d’Unity Catalog avec GCS. #98456 (Melvyn Peignon).
DataLakeCatalogrespecte désormais la configurationhttp_forbid_headersdu serveur lors de la validation du paramètreauth_header. #98827 (Michael Anastasakis).- Corrige les appels N+1 à
HeadObjectpour les globs S3 avec expansion d’accolades. #99219 (Konstantin Bogdanov). - Valide les modifications de paramètres dans les requêtes CREATE lorsque l’engine lui-même prend aussi en charge des settings. #99279 (János Benjamin Antal).
- Corrige l’échec de
ALTER TABLE UPDATE/DELETEavec l’erreurMissing columnslorsqu’une table possède une colonne MATERIALIZED dont l’expression dépend d’une colonne EPHEMERAL. #99281 (Yash ). - Les informations d’authentification dans les chaînes de connexion JDBC, ODBC et NATS sont désormais masquées dans les query logs et la sortie de
SHOW CREATE, ce qui évite l’exposition accidentelle d’informations sensibles. Pour les chaînes de connexion au format URI (par ex.{scheme}://{user}:{password}@{host}), seule la partie mot de passe est masquée, tandis que le reste reste visible pour faciliter le débogage. Le paramètrenats_tokenest désormais lui aussi masqué. #99344 (János Benjamin Antal). - Corrige
parseDateTimeBestEffort, qui interprétait incorrectement les mots commençant par des préfixes de mois au format DD-month-YYYY. Closes #99345. #99350 (Pavel Kruglov). - Corrige l’ignorance de TABLE_UUID_MISMATCH en l’absence de l’analyzer. #99380 (Azat Khuzhin).
- Corrige un bug où des settings explicites envoyés avec
compatibilitydans la même requête pouvaient être ignorés silencieusement lorsque leur valeur correspondait à la valeur par défaut du serveur. #99402 (Raufs Dunamalijevs). - Corrige des cas où des nombres avec des zéros initiaux dans le path de partitioning Hive provoquaient des erreurs. Corrige #98801. #99458 (Yarik Briukhovetskyi).
- Corrige un heap-use-after-free lorsqu’une table est supprimée de façon concurrente avec une requête de lecture en cours d’exécution (19 occurrences dans la CI au cours des 90 derniers jours). #99483 (Alexey Milovidov).
- Corrige un bug dans Keeper où une read request pouvait rester bloquée (provoquant l’expiration de la session) si une autre session sans lien sur le même serveur était fermée exactement au mauvais moment. #99484 (Michael Kolupaev).
- Valide la structure des colonnes avant d’appliquer les patchs. #99531 (Seva Potapov).
- Corrige l’échec d’assertion
rows_sourceslors d’une fusion verticale lorsqueSYSTEM STOP/START MERGESest activé et désactivé rapidement pendant la fusion d’une table avec des colonnesDynamic. #99532 (Alexey Milovidov). - Corrige un partition pruning incorrect pour
toWeek()qui faisait que les queries avecWHERE toWeek(date, mode) = Nrenvoyaient des résultats vides pour les semaines 49 à 52 sur des tables partitionnées partoYYYYMM(date). #99542 (Takumi Hara). - Corrige une exception dans les fonctions opérant sur ColumnReplicated avec des lignes non référencées produites par JOIN. #99564 (Hechem Selmi).
- Corrige le fait que
CLEAR COLUMNne reconstruisait pas les projections et ne réévaluait pas les colonnes matérialisées qui dépendent de la colonne effacée, ce qui pouvait provoquer des exceptions ou une corruption des données lors des fusions suivantes. #99565 (Desel72). - Corrige une exception (
Bad get: has Tuple, actual type String) dansConditionSelectivityEstimatorlorsqu’une query utilise IN avec un seul query parameter scalaire (par ex.WHERE col IN ({p:String})) sur une table qui a des column statistics et avecuse_statisticsactivé. #99614 (Ilya Yatsishin). - Une part avec des projections inconnues ne doit pas être marquée comme perdue définitivement. #99623 (Sema Checherinda).
- Corrige une rare exception de logical error pendant une fusion verticale lorsque
SYSTEM STOP MERGESetSYSTEM START MERGESsont exécutés de manière concurrente. #99628 (Desel72). - Corrige une référence pendante dans injectRequiredColumns provoquant un plantage pendant la fusion. #99679 (Tuan Pham Anh).
- Corrige un comportement indéfini dans le lecteur Avro format lors de la lecture de numeric values qui dépassent le column type cible. Désormais, les queries échouent en cas de dépassement au lieu de produire silencieusement des valeurs incorrectes. #99697 (asyablue22).
- Corrige l’analyse des guillemets de style shell dans les arguments de la table function
executable. #99794 (Nikita Semenov). - Corrige un arrêt à tort dans
NativeReaderlors de la désérialisation d’un flux au Native format avec une incohérence du nombre de lignes :LOGICAL_ERRORest remplacé parINCORRECT_DATAafin que l’erreur soit traitée comme une erreur de données au lieu de déclencherabort()dans les builds sanitizer/debug. #99822 (Rahul Nair). - Corrige l’arrêt du processus lors de la désérialisation d’une colonne
Tuplelorsque le type de sérialisation dans le flux binaire estDETACHED. #99823 (Rahul Nair). - Corrige une fausse exception
LOGICAL_ERRORlors du redimensionnement dynamique du filesystem cache en raison d’une race condition dans la promotion de la sous-file SLRU. #99850 (Alexey Milovidov). - Corrige les queries d’async insert qui signalaient
written_rows,read_rowsetresult_rowsà zéro dansquery_loget la sortie du client. #99879 (Sema Checherinda). - Correction de l’exception “Bad cast from type X to Y” dans
KILL QUERYlorsque la requête interne sur les tables système renvoie des colonnes encapsulées dansColumnConst. #99881 (Alexey Milovidov). - Correction d’une erreur logique avec une sous-requête corrélée dans un argument
untuple. #99917 (Vladimir Cherkasov). - Corrige une exception lors de l’appel à
right,rightUTF8ou à d’autres fonctions de sous-chaîne avec une longueur égale à INT64_MIN (-9223372036854775808), ce qui provoquait auparavant un comportement indéfini en raison d’un dépassement de capacité d’entier. Les fonctions signalent désormais correctement une erreur ARGUMENT_OUT_OF_BOUND. #99934 (Jimmy Aguilar Mena). - Désormais, ClickHouse devrait gérer correctement les tables de type Spark (où chaque fichier a soit un chemin absolu complet, soit un chemin relatif par rapport au chemin commun de la table). Corrige #92348. #99935 (alesapin).
- Correction de l’exception “Inconsistent AST formatting” pour
ALTER TABLE ... MODIFY QUERYavec des sous-requêtes imbriquées contenantSETTINGSlorsque l’instructionALTERcontient elle aussiSETTINGS. #99938 (Nikita Mikhaylov). - Annule #97114 “Move join step row estimation before check for 1 child” en raison d’une suspicion de régression des performances. #99957 (Alexander Gololobov).
- Corrige un bug où ClickHouse pouvait ignorer des fichiers si l’en-tête
Content-Lengthétait absent de la réponse à leur requête HEAD (par exemple, en raison d’un transcodage décompressif dans GCS). #99971 (Yarik Briukhovetskyi). - Correction d’un échec d’assertion (exception dans les builds de débogage, résultats incorrects dans les builds de release) lors de la multiplication des états d’agrégat
NumericIndexedVectorpar une constante entière paire, causé par un auto-XOR sur des bitmaps Roaring aliasés danspointwiseAddInplace. #99976 (Desel72). - Empêche l’exception
Unexpected return typedans l’ancien pushdown de filtre à travers desJOIN USINGchaînés lorsque les types de clé changent après les conversions de jointure. #99999 (Alexey Milovidov). - Correction de l’exception
LOGICAL_ERROR“Unexpected node type for table expression … Actual IDENTIFIER” lorsqu’une sous-requête scalaire est utilisée dans un argument de fonction de table non résolu, par exempleSELECT * FROM remote('localhost', view(SELECT 2 AS x), concat(x, (SELECT 1))). #100014 (Alexey Milovidov). - Correction de l’échec de
INSERTavecVALUESlorsque les données étaient suivies d’un commentaire SQL final (--ou/* */) sur la ligne suivante. Le commentaire est désormais ignoré au lieu d’être analysé comme une autre ligne. #100016 (Pratima Patel). - Correction d’une exception dans
arrayRemovelors de la comparaison de tuples avec des composantes NULL. #100017 (Alexey Milovidov). - Corrige une fuite de données entre utilisateurs dans
system.asynchronous_inserts: tout utilisateur disposant deSELECTsur la table pouvait voir des entrées d’async insert en attente appartenant à d’autres utilisateurs. Les entrées sont désormais filtrées en fonction de l’utilisateur courant, sauf si celui-ci possède le privilègeSHOW_USERS. #100024 (Shaohua Wang). - Corrige le cas où le cast de Time64 vers UInt64 pouvait limiter les valeurs à 24 heures. #100025 (Yarik Briukhovetskyi).
- Corrige un plantage du serveur local lorsque CREATE DICTIONARY comporte une définition avec une valeur de liste contenant une fonction inexistante. #100036 (Yakov Olkhovskiy).
- Corrige l’impossibilité pour les formats
CSVetMsgPackd’analyser correctementNullable(Tuple). Clôt #99753. #100038 (Nihal Z. Miaji). - Corrige l’échec de
CREATE VIEWavecUNKNOWN_IDENTIFIERlors de l’utilisation d’un alias d’expression de fonction dans WITH (par ex.tuple(...)) comme opérande droit deIN. #100042 (Peng). - Corrige l’échec des aggregate functions de séries temporelles (par ex.
timeSeriesResampleToGridWithStaleness) avecILLEGAL_TYPE_OF_ARGUMENTlorsqu’elles sont utilisées avecinitializeAggregationouAggregatingMergeTreeavec des parallel replicas. #100053 (Alexey Milovidov). - Corrige le traitement des valeurs négatives dans NumericIndexedVectorDataBSI. #100086 (Daniil Ivanik).
- Corrige le fait que les fonctions
accurateCastOrDefaultetto*OrDefaultne préservaient pas le type de colonne Const pour les entrées constantes. #100132 (Alexey Milovidov). - Les query parameters omis avec le type
LowCardinality(Nullable(T))prennent désormais correctement la valeur NULL par défaut, commeNullable(T). #100144 (Denys Melnyk). - Corrige l’utilisation d’une valeur non initialisée dans StringSearcher.h. #100225 (Konstantin Bogdanov).
- Autorise l’annulation des subqueries scalaires et d’autres pipelines d’analyse via Ctrl+C. Auparavant, appuyer sur Ctrl+C pendant l’exécution d’une subquery scalaire longue n’avait aucun effet tant que celle-ci n’était pas terminée. Corrige également la barre de progression et les statistiques JSON afin qu’elles indiquent correctement les lignes lues pendant l’exécution de la subquery scalaire, à la fois dans
clickhouse-clientetclickhouse-local. Coécrit avec @YjyJeff. #100230 (Raúl Marín). - Corrige une exception
LOGICAL_ERRORdans les queries impliquant des colonnesDynamicavec des CROSS JOIN et des Runtime Filters, due au fait queColumnVariant::filterpartageait des pointeurs de variant column au lieu de les cloner dans le chemin d’optimisationhasOnlyNulls. Clôt https://github.com/ClickHouse/ClickHouse/pull/100147. #100234 (Pavel Kruglov). - Corrige un bug sur les Array de Variant qui pouvait réinterpréter le data type lors de l’appel des fonctions
arrayFirst/arrayLast. Par exemple, auparavant,Array(Variant(Date, Bool))était converti enBoolalors que le variant type sous-jacent réel étaitDate. #100255 (timothygk). - Quelques modifications mineures apportées aux fonctions : les fonctions h3 valident désormais mieux les bornes ; readWKB vérifie les limites de taille (nouveau paramètre :
max_wkb_geometry_elements) ; les fonctions de génération aléatoire limitent désormais le nombre maximal d’itérations dans leurs calculs. Complément à #93543. #100270 (Alexey Milovidov). - Correction d’un problème où cutURLParameter pouvait ignorer à tort des paramètres lorsqu’ils apparaissaient comme sous-chaînes d’autres paramètres. #100280 (Nikita Semenov).
- Correction d’une exception lorsque le paramètre de chemin de fichier des métadonnées Iceberg contient un octet nul. #100283 (Alexey Milovidov).
- Correction du nombre quadratique de requêtes exécutées lorsque
distributed_index_analysisest utilisé avec des prédicats contenant des sous-requêtesIN. #100287 (Anton Popov). - Correction de l’exception “Block structure mismatch” lors de l’utilisation de
GROUP BY ... WITH TOTALS HAVINGcombiné àUNION DISTINCTet à des expressions Nullable. #100293 (Alexey Milovidov). - Correction de l’exception LOGICAL_ERROR dans
estimateCompressionRatiolorsque le paramètreblock_size_bytesest extrêmement élevé. #100298 (Alexey Milovidov). - Correction de l’exception “Inconsistent AST formatting” dans les versions de débogage lors de l’utilisation de
GROUP BY CUBE(...) WITH ROLLUPou de combinaisons similaires. #100376 (Alexey Milovidov). - Correction d’une exception lors de la création d’une vue avec des alias de colonnes et des requêtes
SELECT *ouEXCEPT/INTERSECT. #100386 (Alexey Milovidov). - Correction de
DROP TABLE, qui restait bloqué indéfiniment sur des tables utilisant le moteur Kafka lorsque des consommateurs restaient bloqués dans un rééquilibrage après une erreur de heartbeat. #100388 (Alexey Milovidov). - Correction de l’exception
ReadBuffer is canceled. Can't read from it.dans les opérations de sauvegarde/restauration utilisant des archives zip. #100400 (Alexey Milovidov). - Correction de l’exception
TOO_MANY_ROWSpour les requêtesSELECT count()avecmax_rows_to_read/force_primary_keylorsque les données sont réparties sur plusieurs parts avec des limites de granules non alignées. #100408 (Alexey Milovidov). - Correction de
system.completionsafin de filtrer correctement les bases de données, les tables et les colonnes selon les droits d’accès dans toutes les combinaisons de grant : par table, par base de données et revoke par colonne. #100432 (Shaohua Wang). - Correction d’un SEGFAULT dans NuRaft dû à une condition de concurrence. #100444 (Pablo Marcos).
min/max/argMin/argMaxtraitent désormais NaN de manière cohérente avecORDER BY: NaN est toujours ignoré (et n’est renvoyé que si toutes les valeurs sont NaN). Auparavant, les résultats dépendaient de la position de NaN dans les données, en raison de la sémantique de comparaison non ordonnée d’IEEE 754. #100448 (Raúl Marín).- Correction d’un bug de copier-coller où
delta_lake_snapshot_end_version, défini sansdelta_lake_snapshot_start_version, était ignoré silencieusement au lieu de produire une erreurBAD_ARGUMENTS. #100454 (Mohammad Lareb Zafar). StorageRabbitMQ::shutdownn’est pas idempotente (elle accède inconditionnellement à des pointeurs faibles, puis détruit les pointeurs partagés correspondants), mais elle est désormais appelée deux fois : une fois dansStreamingStorageRegistry, puis dansDatabaseCatalog. Ce correctif rend la méthode idempotente et ajoute des vérifications défensives de nullité. #100455 (Miсhael Stetsyuk).- Correction de l’exception
LOGICAL_ERRORlors de l’utilisation deaccurateCastOrNullavec le type cibleQBit. #100470 (Raufs Dunamalijevs). - Correction de l’exception LOGICAL_ERROR “Stream … not found” lors d’un insert dans une table contenant des colonnes
Array(JSON)imbriquées, dans des wide parts avecoptimize_on_insert=0. #100475 (Pavel Kruglov). - Validation des chemins d’entrée de fichier dans les métadonnées de sauvegarde afin de rejeter les traversées de répertoires, les chemins absolus et les noms vides pendant
RESTORE. #100483 (Pablo Marcos). - Correction du non-fonctionnement de la syntaxe
LIMIT m OFFSET n WITH TIES. Cette syntaxe est équivalente àLIMIT n, m WITH TIES, qui fonctionnait déjà. #100491 (Nihal Z. Miaji). - Correction de l’exception “No set is registered for key” lors de l’utilisation de
INavec des colonnesNullable(Tuple)ayant des champs nommés et des élémentsLowCardinality. #100523 (Alexey Milovidov). - Correction d’un heap-buffer-overflow dans usearch
sorted_buffer_gt::insert()qui pouvait provoquer un crash ou corrompre silencieusement la mémoire pendant une recherche de similarité vectorielle. #100537 (Dustin Healy). - Correction de
EXECUTE AS, qui ignorait les clausesFORMATetINTO OUTFILEspécifiées dans la requête. #100538 (pufit). - Correction d’un formatage AST incohérent pour SAMPLE avec OFFSET au niveau de la requête. Clôt #100576. #100579 (Pavel Kruglov).
- Correction du Polaris catalog avec Azure. Depuis la version 25.12, ce catalogue avec Azure ajoutait le bucket au début du chemin. Par exemple
abfss://polaris-polaris@<some_url>.windows.net/polaris-polaris/<other-path>au lieu deabfss://polaris-polaris@<some_url>.windows.net/<other-path>. Cette PR supprime le bucket du chemin. #100583 (Konstantin Vedernikov). - Correction d’une exception d’incompatibilité de type dans transform lorsque la colonne
defaultest const sur certains blocs. Clôt #100574. #100616 (Pavel Kruglov). - Corrige des cas de NOT_FOUND_COLUMN_IN_BLOCK où la partie SELECT de la projection contient des colonnes qui n’existent pas dans la partie SELECT d’origine de la requête. Clôt #100194. #100623 (Yarik Briukhovetskyi).
- Vérifie que les dimensions de forme du format Npy sont cohérentes avec la taille du fichier et les limites de dépassement afin d’éviter des dénis de service provoqués par des fichiers
.npymalveillants avec des dimensions démesurées. Rejette également les formes vides et limite la mémoire par ligne à 2 GiB. #100625 (Raúl Marín). - Corrige la non-prise en compte de
session_timezonelors de l’analyse de valeursDateTimependant les async inserts (TCP) et tous les inserts via HTTP. #100647 (Sema Checherinda). - Permet de passer une clé de sharding à
cluster()etclusterAllReplicas()table functions lorsqu’une table function est utilisée comme source (par ex.cluster('name', view(...), sharding_key)). #100665 (Sergey Veletskiy). - Corrige un crash du serveur (échec d’assertion) lors de l’utilisation de fonctions d’agrégation paramétriques avec le combinateur Array et des arguments NULL, comme
quantileIfArrayArray(0.5)([[NULL]], [[1]]). #100679 (nerve-bot). - Corrige une exception lors du calcul du supertype commun pour des tuples vides et non vides avec
use_variant_as_common_typeactivé. #100699 (Antonio Andelic). - Le serveur ne échoue plus au démarrage lorsqu’un disque Azure blob storage est configuré mais que le endpoint est temporairement inaccessible (par ex. en cas d’échec DNS). #100701 (Raúl Marín).
- Corrige un comportement indéfini dans
positiveModulolorsque le diviseur non signé ne peut pas être représenté dans le type de résultat signé. #100705 (Raúl Marín). - Corrige un crash du serveur (erreur logique “Unexpected return type from __topKFilter”) lorsque
use_top_k_dynamic_filteringest activé et que la colonneORDER BYest de typeDynamicouVariant. #100742 (Groene AI). - Corrige un crash du serveur lors de l’utilisation de la fonction
has()avec PREWHERE/WHERE sur une clé Tuple contenant des éléments LowCardinality. #100760 (Groene AI). - Corrige l’échec d’assertion
file_offset_of_buffer_end <= getFileSize()(exception dans les builds de débogage) lors de la lecture de tablesLogouStripeLogsur S3 object storage avec des écritures concurrentes. #100763 (Alexey Milovidov). - Corrige une exception dans l’estimateur de sélectivité des statistiques lorsqu’une WHERE clause contient une expression de fonction (par ex. toDecimal64(col, 3)) sur une table avec les statistiques activées. L’estimateur ignore désormais ces prédicats au lieu de tenter un transtypage invalide. #100764 (Han Fei).
- Corrige un cas rare où une jointure avec réordonnancement peut produire un résultat incorrect. #100790 (Yarik Briukhovetskyi).
- Corrige les types d’argument
AggregateFunctionincorrects dans le comptage trivial optimisé, qui provoquaient une exceptionNUMBER_OF_ARGUMENTS_DOESNT_MATCHlors de requêtes sur des expressions commecount(v0 + v1)sur des tables distribuées. #100794 (YjyJeff). - Certains catalogues pouvaient afficher des secrets dans la section
SETTINGSdu résultat de la requêteselect * from system.databases. Cette PR empêche désormais ce comportement. #100800 (Konstantin Vedernikov). - Corrige un comportement indéfini (débordement d’entier signé) dans
toStartOfIntervallors de l’utilisation d’intervalles Week, Quarter ou Year avec un argument origin et des valeurs d’intervalle extrêmes. #100817 (Raúl Marín). - Corrige l’impossibilité, pour les combinateurs de fonctions d’agrégation
If,Distinct,DistinctIf,IfStateavec un type de retourTupleet un ou plusieurs argumentsNullable, de lire d’anciens états sérialisés après l’introduction deNullable(Tuple). Clôt #98917. #100826 (Nihal Z. Miaji). - Corrige un segfault dans s3Cluster et les requêtes distribuées dû à une utilisation après libération dans le pool de connexions. #100837 (Konstantin Bogdanov).
- Corrige un segfault dû au déréférencement d’un pointeur nul lors du chargement des dictionnaires pendant l’arrêt du serveur.
Context::getUserDefinedSQLObjectsStorage(qui déréférenceuser_defined_sql_objects_storage) est appelé par les threads des dictionnaires en concurrence avec le thread principal appelantContext::shutdown(qui définituser_defined_sql_objects_storageà null). Il faut s’assurer de désactiver les mises à jour futures dans le chargeur de dictionnaires, d’arrêter les requêtes de dictionnaire en cours et de joindre les threads de chargement des dictionnaires, le tout avant d’exécuterContext::shutdown. Comme pour les requêtes normales. #100839 (Miсhael Stetsyuk). - Corrige un débordement de tampon dans
ULIDStringToDateTimelorsque l’entrée contient des octets non ASCII. #100843 (Konstantin Bogdanov). - Corrige un plantage (
LOGICAL_ERROR) lors d’une requête sur une tableMerge(ou la fonction de tablemerge()) qui encapsule plusieurs tables, dont une tableDistributed, avecdistributed_group_by_no_merge=1activé. #100859 (Groene AI). - Cast_keep_nullable, lorsqu’il est activé, ne lèvera pas d’exception lors du transtypage d’une valeur null dynamique vers variant. #100864 (Seva Potapov).
- Corrige les commandes
get,existsetlsdeclickhouse-keeper-client, qui affichaient des messages d’erreurwatch_iden double sur stdout au lieu de stderr. #100893 (Mohammad Lareb Zafar). - Corrige une exception dans
intDiv/intDivOrZerosur des tableaux de tuples Nullable, par ex.SELECT intDiv([divide((1, 2), ... AND NULL)], 2). #100895 (Raúl Marín). - Évalue les arguments de moteur pour
StorageAliasavant d’enregistrer la définition, afin que des expressions commecurrentDatabase()soient résolues en littéraux avant d’être enregistrées dans la base de données. #100902 (Nikolay Degterinsky). - Correction de
processAndOptimizeTextIndexFunctionslorsquequery_plan_merge_expressions = 0, quandExpressionStepse trouve directement au-dessus deReadFromMergeTree. Corrige #100879. #100909 (Jimmy Aguilar Mena). - Mise à jour de replxx pour inclure la correction d’un accès hors limites dans do_complete_line. #100925 (Azat Khuzhin).
- Correction de résultats incorrects lorsqu’un JOIN avec l’optimisation shard-by-PK utilise le cache des conditions de requête et que certaines parts sont filtrées par des conditions mises en cache. #100926 (Groene AI).
- Correction de
divideetintDiv, qui renvoyaientILLEGAL_DIVISIONlorsqu’ils étaient utilisés dans des expressions de filtre pendant l’analyse des index dans certains cas. #100928 (Nihal Z. Miaji). - Correction des erreurs “La table cible n’existe pas” pour les vues matérialisées avec tables internes lors du démarrage asynchrone, dues à un ordre incorrect des dépendances au démarrage. #100946 (Nikolay Degterinsky).
- Correction d’un comportement indéfini (débordement d’entier signé) dans parseDateTimeBestEffort lors de l’analyse de chaînes datetime comportant plus de 18 chiffres de fraction de seconde. #100948 (Vasily Chekalkin).
- Correction d’un crash lors de l’utilisation d’un index de recherche textuelle avec une clause
INcontenant une sous-requête de tuple, par exempleWHERE (id, str) IN (SELECT (id, str) FROM ...), ou lorsque le nombre de colonnes dans la sous-requête ne correspond pas au tuple à gauche deIN. #100959 (Anton Popov). - Correction d’un crash lors de la construction d’un dictionnaire Polygon à partir d’une table
MergeTreeutilisant une sérialisation sparse des colonnes. #100964 (Anton Popov). - Correction de l’erreur logique “Invalid action query tree node” lors de l’utilisation de
INTERSECT ALL/UNION ALLavec des expressions évaluées comme constantes. #100977 (Alexey Milovidov). - Correction de l’impossibilité, pour la fonction d’agrégation
sumCountOrDefaultavec un ou plusieurs argumentNullable, de lire d’anciens états sérialisés après l’introduction deNullable(Tuple). Clôt #100882. #101021 (Nihal Z. Miaji). - Correction d’un crash (
Logical error: isConst/isSparse/isReplicated assertTypeEquality) dans les algorithmes de fusion lorsque la réplication paresseuse des colonnes (enable_lazy_columns_replication) produit des colonnesColumnReplicatedqui se retrouvent dans des pipelines de fusion avec tri avec des entrées arrivant tardivement. #101036 (Groene AI). - Correction de l’erreur
UNKNOWN_IDENTIFIERincorrecte lorsque le même alias est utilisé pour plusieurs expressions dansSELECT; l’erreur correcteMULTIPLE_EXPRESSIONS_FOR_ALIASest désormais renvoyée. #101040 (Alexey Milovidov). - Correction des colonnes ALIAS de types
DateTime/DateTime64qui n’appliquaient pas la conversion de fuseau horaire lorsque le fuseau horaire déclaré diffère de celui de l’expression. #101043 (Alexey Milovidov). - Correction des politiques de ligne qui n’étaient pas enregistrées dans
query_logpour les vues, les sous-requêtes etINSERT ... SELECT. Bien que les politiques de ligne aient été appliquées lors de la planification de la requête, elles n’étaient pas transmises des sous-planificateurs au planificateur parent pour la journalisation. Les politiques de ligne (pour la journalisation uniquement) sont désormais conservées dansQueryAccessInfo, afin que les planificateurs et sous-planificateurs puissent tous les deux les renseigner. #101044 (Narasimha Pakeer). - Correction d’une exception dans
DirectJoinMergeTreeEntitylorsque les blocks du pipeline contiennent des colonnesColumnConstfusionnées avec des colonnes ordinaires. #101046 (Alexey Milovidov). - Correction d’un espace superflu dans le formatage des alias de colonnes CTE (
WITH t (a, b)→WITH t(a, b)). #101049 (Alexey Milovidov). - Correction d’un échec des fonctions de table
remote/clusteravec des fonctions de table imbriquées commemergelorsque l’analyseur est activé. #101055 (Alexey Milovidov). - Correction de
OFFSETappliqué deux fois dans les requêtes distribuées lorsqueprefer_localhost_replica=1, ce qui produisait moins de lignes que prévu. #101071 (Nihal Z. Miaji). - Correction d’un plantage lors de l’utilisation du format
Regexpavec une expression régulière invalide dans le paramètreformat_regexp. #101074 (Nihal Z. Miaji). - Correction de l’erreur “Illegal type Decimal64 of start parameter” pour les fonctions d’agrégation de séries temporelles lors de l’utilisation de
serialize_query_plan=1avec des répliques parallèles. #101083 (Groene AI). - Correction d’une exception dans
optimizeLazyMaterializationlorsqu’une projection avec PREWHERE est utilisée avecORDER BY ... LIMIT. #101115 (Anton Popov). - Correction d’un plantage du serveur (SIGABRT) lors de l’utilisation de fonctions d’agrégation avec le combinator
Null, réservé à un usage interne (par ex.sumNull,avgNull), et avec le paramètreaggregate_functions_null_for_empty = 1activé. #101147 (Groene AI). - Correction d’un use-after-free dans le chemin d’écriture du cache du système de fichiers, qui pouvait entraîner des lectures depuis une mémoire déjà libérée lors de la journalisation des segments de fichier terminés (détecté par MemorySanitizer dans BuzzHouse). #101161 (Groene AI).
- Correction d’un plantage du serveur avec “Trying to attach external table to a ready set without explicit elements” lorsque l’analyse d’index distribuée rencontre un prédicat GLOBAL IN dont le set a été construit sans éléments explicites. #101178 (Groene AI).
- Correction des fonctions d’agrégation
MAX/MINsur des colonnesDecimal, qui renvoyaient des résultats incorrects lorsque la compilation JIT est activée (une fois le seuil de compilation atteint). #101203 (Raúl Marín). - Correction de la désactivation permanente des optimisations
minmax_count_projectionet des optimisations triviales deCOUNT(*)après un lightweight delete, même après la fusion de toutes les parts portant un masque de lightweight delete. #101212 (Anton Popov). - Corrige un cas pouvant entraîner l’erreur logique
Having zero bytes, ...du cache, lorsqu’un objet distant est écrasé entrelistetread, ce qui produisait auparavant des métadonnées d’objet obsolètes. #101219 (Kseniia Sumarokova). - Corrige un crash du serveur (LOGICAL_ERROR: Bad cast from ColumnVector to ColumnLowCardinality) lors d’une requête sur une table MergeTree avec
ORDER BY CAST(lc_column, 'Type'), lorsquelc_columnest de type LowCardinality. #101220 (Groene AI). - Corrige le nettoyage des processing nodes obsolètes dans
S3Queue. #101230 (Kseniia Sumarokova). - Corrige un comportement indéfini dans mergeTreeAnalyzeIndexes() en cas d’argument
optimizationsinvalide. #101253 (Azat Khuzhin). - Corrige l’exception
Logical error: 'partitions_count > 0'lors de l’exécution d’instructionsALTER TABLE UPDATEconsécutives sur une table Iceberg partitionnée. #101278 (Desel72). - Corrige des résultats de requête erronés lorsqu’une constante entière de grande taille (par ex. 256, 2147483648) est utilisée comme prédicat booléen dans une WHERE clause avec AND sur des tables MergeTree. Par exemple,
SELECT count() FROM t WHERE (2147483648 > b) AND 2147483648renvoyait incorrectement 0 au lieu de correspondre à toutes les lignes. #101287 (Groene AI). - Corrige les insert-select depuis un cluster delta lake avec replicated merge tree. #101299 (Konstantin Vedernikov).
- Corrige un crash avec “Logical error: Reading from materialized CTE before materialization” lorsqu’une sous-requête scalaire référence une chaîne de materialized CTE dépendantes. #101305 (Groene AI).
- Corrige une data race sur
storage_iddansIStorage::getDependentViewsByColumn. #101385 (Nikolay Degterinsky). - Corrige le formatting et le clonage de l’AST BACKUP FROM SNAPSHOT. #101405 (Pablo Marcos).
- Corrige un crash LOGICAL_ERROR “Current component is empty” lors d’une requête sur
system.part_moves_between_shardsavecenforce_keeper_component_trackingactivé. #101462 (Groene AI). - Corrige une faute de segmentation dans DataTypeDynamic::create() lorsque le fuzzer génère un AST de type Dynamic mal formé. #101464 (Groene AI).
- Génère une erreur lorsque
delta_lake_snapshot_versionou les paramètres de version CDF sont utilisés sans DeltaKernel activé, au lieu de renvoyer silencieusement des données erronées. #101489 (Desel72). - Corrige l’exception
NOT_FOUND_COLUMN_IN_BLOCKlors de l’utilisation de ARRAY JOIN avec JOIN USING et du paramètreanalyzer_compatibility_join_using_top_level_identifieractivé. Ferme #101240. #101507 (Vladimir Cherkasov). - Correction de la boucle de retry d’INSERT Iceberg qui échouait lorsque la table avait été créée avec
iceberg_metadata_file_pathet que la version cible des métadonnées existait déjà. #101548 (Groene AI). - Suppression de Nullable de la colonne de résultat dans arrayIntersect et les fonctions associées afin d’éviter une incohérence de sérialisation/désérialisation. #101569 (George Larionov).
- Correction d’un crash du serveur (LOGICAL_ERROR) lors d’un SELECT sur une vue matérialisée reposant sur le table engine IcebergLocal. #101577 (Groene AI).
- Correction d’un message d’erreur incorrect lors de l’appel à
intExp10avec un argument NaN — il indiquaitintExp2au lieu deintExp10. #101582 (Krishna Chaitanya). - Correction du fait que
allow_statistics=0ne bloquait pasALTER TABLE ADD STATISTICSetALTER TABLE DROP STATISTICSaprès la refactorisation de #100288. #101585 (Krishna Chaitanya). - Correction de l’échec de
KeeperMapCREATE TABLEavec “Cannot create metadata for table” lorsque des nœuds ZooKeeper résiduels issus d’un drop partiel antérieur à la version 25.1 ne contenaient pas le nœuddrop_lock_version. #101623 (Antonio Andelic). - Correction d’une possible erreur logique lors de la lecture des sous-colonnes de Map. Ferme #100769. Ferme #101336. #101641 (Pavel Kruglov).
- Correction de la priorité d’une correspondance exacte de sous-colonne sur une correspondance par préfixe dans
getSubcolumnDataafin d’éviter un crash potentiel. Ferme #101271. #101645 (Pavel Kruglov). - Correction d’un crash (LOGICAL_ERROR: “ColumnUnique can’t contain null values”) lors de la comparaison d’une colonne
LowCardinalityavec une constante NULL de typeVariantalors queuse_variant_default_implementation_for_comparisonsest désactivé. #101690 (Groene AI). - Ajout d’une protection contre les flux vides dans Bzip2ReadBuffer afin qu’il renvoie EOF au lieu de lever UNEXPECTED_END_OF_FILE lorsque le flux interne est vide. #101691 (ClickGap AI Bot).
- Correction du texte de description inversé pour la colonne
alterabledanssystem.s3_queue_settingsetsystem.azure_queue_settings— les significations de0et1ont été permutées pour correspondre au comportement réel du code. #101703 (ClickGap AI Bot). - Correction du fait que positiveModulo(tuple, number) était incorrectement dirigé vers la division au lieu du modulo. #101709 (ClickGap AI Bot).
- Correction d’un crash lorsque
thread_pool_sizeest configuré sur un disk enveloppé par un cache. Auparavant,FileCacheSettings::loadFromConfig()rejetaitthread_pool_sizecomme un setting inconnu, empêchant le serveur de démarrer. Ce setting est un paramètreIDiskvalide qui contrôle le nombre de threads utilisés pour les opérations de copie de disk à disk lors des déplacements de parts en arrière-plan. #101712 (Francisco). - Correction de la création de dictionnaire
RANGE_HASHED, qui acceptait silencieusement un attribut de plageMAXinexistant et utilisait une configuration de type incorrecte lorsque les attributs de plage min et max avaient des types différents. Le bug provenait d’une erreur de copier-coller dansbuildRangeConfiguration, qui recherchaitmin_attr_nameau lieu demax_attr_namepour l’attribut max. #101732 (Yakov Olkhovskiy). - Correction d’un crash de type use-after-free dans le scheduler de lease CPU lorsque le temporisateur d’attente survit au worker thread dont il référence
ProfileEvents::Counters. #101761 (Antonio Andelic). - Correction d’un bug dans les fonctions arrayLevenshteinDistanceWeighted et arraySimilarity. Clôt #101725. #101767 (Mikhail f. Shiryaev).
- Correction de l’API de requête Prometheus, qui ignorait les corps de formulaire POST. #101794 (James Cunningham).
- Correction d’une exception s’échappant du destructeur S3
Client::~Clientet provoquant l’arrêt du serveur. #101798 (Gagan Dhakrey). - Correction d’un use-after-scope dans la désérialisation en parallèle des paths dynamiques du type
Object, qui pouvait provoquer des crashs lors de la lecture de tables comportant de nombreux paths dynamiques. #101823 (Antonio Andelic). - Correction d’une sortie incorrecte dans la fonction
formatDateTimeavec le formatter%Wsous certains paramètres de formatting (non par défaut). #101847 (Robert Schulze). - Correction d’un faux négatif de
shouldPatchFunctiondansSYSTEM INSTRUMENT ADDlorsque la chaîne recherchée apparaît d’abord dans un argument de template du nom de symbole démêlé. #101885 (Pablo Marcos). - Correction de la perte du registre UDF lorsque la session ZooKeeper expire pendant le refresh périodique — toutes les user-defined functions pouvaient devenir indisponibles jusqu’à ce qu’un full refresh réussisse. #101891 (Nikita Fomichev).
- Correction de la description de
system.codecspourAES_256_GCM_SIV, afin d’indiquerAES-256au lieu deAES-128. #101917 (Jimmy Aguilar Mena). - Correction de l’utilisation d’Extremes incorrects dans un min-max index créé sur une JSON column, entraînant un résultat de query erroné. Clôt #101700. #101918 (Pavel Kruglov).
- Le tokenizer
splitByStringrejette désormais les chaînes de séparation vides. #101928 (Robert Schulze). - Correction de
materialize_skip_indexes_on_merge=false, qui ne désactivait pas les text indexes (full-text) pendant le merge. Auparavant, seuls les skip indexes non textuels (minmax, set, bloom_filter) étaient désactivés ; les text indexes continuaient à être construits, gaspillant du CPU et des E/S. #101932 (Groene AI). - Le tokenizer
sparseGramsgénérait des tokens plus longs que la longueur maximale fournie (à cause d’un+2codé en dur dans l’implémentation). #101934 (Elmi Ahmadov). - Corrige un SIGSEGV dans
MergeTreeDataPartWriterWide::cancellorsqu’un constructeur de flux lève une exception pendantaddStreams, laissant une entrée nulle danscolumn_streams. #101936 (Antonio Andelic). - Corrige une exception lors de requêtes sur des tables Merge ou Distributed avec un index full-text et des conditions de filtrage combinées mêlant
has*Tokenset LIKE, lorsquequery_plan_direct_read_from_text_indexest activé. #101939 (Jimmy Aguilar Mena). - Corrige un comportement indéfini lors de l’analyse de paquets Query du protocole natif contenant des valeurs
QueryProcessingStagenon valides. #101972 (Raúl Marín). - Ferme la connexion TCP lorsqu’une exception se produit pendant l’analyse de la requête initiale afin d’éviter la lecture de données parasites depuis un flux désynchronisé. #101989 (Raúl Marín).
- Corrige un bug de concurrence SLRU dans le filesystem cache 26.1+, qui peut entraîner une logical error de réservation d’espace. En build de débogage, cela peut également provoquer l’échec de l’assertion :
'Previous state is Evicting, but expected state to be Active while setting Evicting flag for 2c1e3484ecdc6b78a8978fa5b17c5097:0:339 (state: Evicting)'.. #101991 (Kseniia Sumarokova). - Corrige une exception lors de la conversion d’une chaîne contenant des données supplémentaires vers le type vide
Tuple(). #102011 (Alexey Milovidov). - Corrige un ordre de lignes incorrect dans les requêtes qui utilisent ORDER BY avec l’algorithme de jointure grace_hash. Les requêtes concernées pouvaient renvoyer des résultats dans le mauvais ordre, produisant silencieusement une sortie incorrecte. #102036 (János Benjamin Antal).
- Corrige une LOGICAL ERROR (Unexpected size of index type) pouvant se produire dans des requêtes RIGHT JOIN et FULL JOIN lorsque le paramètre
max_bytes_in_joinétait défini. #102042 (Jimmy Aguilar Mena). - Corrige les cas où Time avec des valeurs négatives renvoyait un résultat erroné lors d’une comparaison avec DateTime. Clôt #101670. #102056 (Yarik Briukhovetskyi).
- Corrige un crash lors de l’actualisation d’une UDF, causé par
ZooKeeperRetriesControlqui retentait sur une session ZooKeeper obsolète (expirée) sans la renouveler. #102059 (Nikita Fomichev). - Corrige l’absence d’espaces lors du formatage d’un unlock snapshot. clôt https://github.com/clickhouse/clickhouse/issues/101723. #102063 (Han Fei).
- Corrige un crash (SIGSEGV) lors d’une requête sur une vue avec une WHERE clause, lorsque la requête interne produit des colonnes de types différents de ceux des métadonnées de la vue (par ex. Nullable issu d’un LEFT JOIN avec
join_use_nulls). #102085 (Miсhael Stetsyuk). - Corrige des entrées de
VectorSimilarityIndexCachequi n’étaient jamais évincées après la suppression d’une part, en raison de clés de cache incohérentes. #102152 (Seva Potapov). - Envoie un NACK pour les messages corrompus lors de l’utilisation du stockage RabbitMQ. #102157 (Seva Potapov).
- Corrige une erreur logique lors de l’analyse d’une chaîne de tuple vide invalide. #102289 (Nihal Z. Miaji).
- Corrige des résultats d’agrégation incorrects (lignes dupliquées) lors de l’utilisation de
optimize_aggregation_in_order=1avec des colonnes GROUP BY ordonnées différemment de la clé de tri de la table. #102299 (Groene AI). - Corrige un plantage dans
IcebergLocalALTER TABLE ... UPDATElors de l’utilisation du format Avro, causé par l’absence de déballage des types enveloppesLowCardinality/Nullableavant la sérialisation. #102337 (Desel72). - Corrige une faute de segmentation dans les mutations sur des colonnes matérialisées sans expression. Ferme #102185. #102342 (zoomxi).
- Correction de Coalescing merge tree pour le type tableau. Cela ferme #89509. #102384 (Konstantin Vedernikov).
- Corrige une faute de segmentation (ou
LOGICAL_ERRORdans les builds de débogage) lors de la lecture de fichiers Parquet avec le pushdown du filtre de Bloom activé et des conditions d’égalité/inégalité dans la clause WHERE. Le plantage était dû à un accès mémoire hors limites lors de la récupération des données du filtre de Bloom par le préchargeur Parquet, et pouvait également entraîner des résultats de requête erronés non déterministes. #102385 (Groene AI). - Corrige un abandon
LOGICAL_ERRORlors du redimensionnement dynamique du cache du système de fichiers SLRU, causé par des statistiques d’éviction partagées entre les sous-files d’attente et un chemin de récupération incorrect pour les candidats en échec. #102396 (Antonio Andelic). - Corrige l’échec d’initialisation, sur un nouveau replica, des tables alias sans table cible dans la base de données Replicated. Ferme #101320. #102397 (Nikolay Degterinsky).
- Corrige une lecture hors limites dans les fonctions de recherche de chaînes (
countSubstrings,position, etc.) lors de la recherche d’un needle composé entièrement d’octets nuls. #102401 (Raúl Marín). - Les paramètres d’index de texte intégral (
enable_full_text_index,allow_experimental_full_text_index,use_skip_indexes_on_data_read) ne sont plus désactivés lorsque le paramètrecompatibilitypointe vers une version antérieure à 26.1. Auparavant, cela pouvait empêcherSharedDatabaseCatalogde créer des tables avec des index de texte intégral. #102422 (Nikita Fomichev). - Corrige une lecture hors limites dans
printfavec un%final. #102472 (Raúl Marín). - Corrige une exception chassert
ReadBuffer is canceleddans les builds de débogage dans AsynchronousMetrics, causée par le fait que le retour en arrière ne réinitialisait pas l’indicateur d’annulation du buffer. #102524 (Yuri Fedoseev). - Corrige
hasToken/hasTokenOrNullavec des needles composés uniquement de séparateurs (par ex.'()','!!!') sur des colonnes dotées d’un index de texte intégral : auparavant, l’index ignorait silencieusement tous les granules au lieu de leverBAD_ARGUMENTS(pourhasToken) ou de renvoyerNULL(pourhasTokenOrNull). #102544 (Jimmy Aguilar Mena). - Corrige les OOM sur de très grosses requêtes multi dans Keeper. Pour le tracing OpenTelemetry, nous allouons systématiquement >1 KiB pour les spans OpenTelemetry dans les objets
ZooKeeperRequest, ce qui signifie que, pour des requêtes multi vraiment énormes, nous essayons d’allouer >10 GiB de mémoire supplémentaire. Pour corriger cela, nous conservons désormais les données partagées en mémoire statique et utilisonsstd::unique_ptrà la place destd::optionaldansZooKeeperOpentelemetrySpans. #102586 (Miсhael Stetsyuk). - Corrige le gonflement de la CurrentMetric de
NamedCollectionprovoqué parCREATE NAMED COLLECTION IF NOT EXISTSsur des collections existantes, ainsi que l’absence d’initialisation pour les collections chargées depuis la config ou le stockage SQL au démarrage. Clôt #102507. #102598 (Pablo Marcos). - Corrige une exception dans
getStructureOfRemoteTablelorsque le shard local renvoie des colonnes vides en raison d’un DDL concurrent. #102604 (Alexey Milovidov). - Corrige une exception
LOGICAL_ERRORlorsque plusieurs requêtes concurrentesCREATE TABLE IF NOT EXISTSciblent la même tableS3Queuedans une base de données Shared. #102610 (Nikita Taranov). - Corrige le crash
LOGICAL_ERROR« Unexpected number of rows in column subchunk » dans le lecteur natif Parquet V3 lors de la lecture de colonnes Nullable avec un filtre WHERE. #102628 (Groene AI). - Corrige la description de l’événement de profil
AzureWriteMicroseconds, qui indiquait « read » au lieu de « write ». #102639 (Miсhael Stetsyuk). - Corrige un problème avec la politique de lignes qui provoque l’exception « Not found column in block » dans certains cas particuliers. #102648 (Yarik Briukhovetskyi).
- Corrige une exception du serveur dans ClusterDiscovery lorsqu’un cluster statique (défini dans la config) n’avait temporairement aucun nœud actif. #102661 (Kseniia Sumarokova).
- Corrige une inférence erronée du type de données date en cas de dépassement après ajustement du fuseau horaire. Clôt #102601. #102674 (Pavel Kruglov).
- Corrige le blocage infini de
SYSTEM WAIT VIEWlorsque la vue matérialisée actualisable est supprimée alors que l’attente est en cours. #102681 (Nikolay Degterinsky). - Corrige CASE avec une expression Dynamic qui renvoyait ELSE pour toutes les lignes. Clôt #102511. #102684 (Pavel Kruglov).
- Corrige la sérialisation du type Dynamic aplati avec des types de données encodés en binaire. Clôt #101911. #102692 (Pavel Kruglov).
- Corrige le fait que format_schema_source=‘query’ ignorait silencieusement les résultats sur plusieurs lignes. Clôt #101905. #102698 (Pavel Kruglov).
- Signale le code de sortie réel via le client SSH au lieu de ramener toutes les erreurs à
1. Résout #101741. #102700 (Konstantin Bogdanov). - Corrige la perte des en-têtes HTTP pour les handlers de requêtes dynamiques/prédéfinies. Résout #101846. #102706 (Konstantin Bogdanov).
- Applique une correction d’échantillonnage de Poisson aux heap profiles jemalloc réduits afin de correspondre à la sortie de jeprof. Auparavant, le format réduit sous-estimait les tailles d’allocation réelles car il ne tenait pas compte de la probabilité d’échantillonnage. #102759 (Antonio Andelic).
- Corrige le crash dans la fonction
hasPhraseavec un argumentNULL. #102802 (Nikita Taranov). - Corrige un crash du serveur (SIGSEGV) lors de la lecture de fichiers Avro avec des schémas récursifs contenant des références cycliques à des types symboliques. Ces schémas sont désormais détectés et rejetés avec un message d’erreur clair, au lieu de provoquer un crash. #102853 (Groene AI).
- Corrige un crash du serveur (assertion LOGICAL_ERROR) lorsqu’une fonction sur une colonne
Variantatteint une limite mémoire ou rencontre une autre exception sans rapport avec une conversion de type lors du transtypage du résultat dansFunctionVariantAdaptor. L’exception est désormais propagée correctement au lieu d’être classée à tort comme une erreur interne. #102855 (Groene AI). - Corrige un crash du serveur dans les builds debug/sanitizer lorsqu’une
std::length_errorest levée pendant l’inférence de schéma (par exemple à cause de valeurs extrêmes deinput_format_msgpack_number_of_columnsou de données d’entrée malformées). #102859 (Groene AI). - Fait en sorte que la représentation de null dans la sérialisation des colonnes répliquées et creuses respecte les paramètres (par exemple
format_tsv_null_representation). #102888 (Hechem Selmi). - Rétroporté dans #103499 : corrige les requêtes S3 qui échouaient avec
ios_base::clear: unspecified iostream_category errorau lieu d’être retentées, parce que PocoBufferedStreamBuf::flushBufferne gérait pas les écritures courtes depuis la couche socket. #102894 (Sema Checherinda). - Corrige le fait que les optimisations
minmax_count_projectionet les optimisations triviales deCOUNT(*)restaient désactivées de façon permanente après un lightweight delete, même après la fusion de toutes les parties portant un masque de lightweight delete. #102900 (Anton Popov). - Corrige des crashes aléatoires dans jemalloc dus à LTO. #102913 (Azat Khuzhin).
- Optimise les chaînes de OR de row policy en IN dans le nouvel analyseur. #102915 (Azat Khuzhin).
- Corrige une corruption des métadonnées jemalloc causée par la libération du page cache avec un alignement incorrect, ce qui peut entraîner des crashes. #102918 (Azat Khuzhin).
- Les INSERT simples sans vues matérialisées ne demandent plus un nombre excessif de slots et de threads ConcurrencyControl (
max_threadsau lieu demax_insert_threads), ce qui évite la famine de slots CC et l’explosion du nombre de threads sur les clusters avec un fort débit d’INSERT. #102961 (Sema Checherinda). - Réintroduction d’ArrowMemoryPool pour permettre de lever MEMORY_LIMIT_EXCEEDED et éviter un OOM du noyau. #102999 (Azat Khuzhin).
- Correction de la prise en compte de
cast_string_to_date_time_modepourCASTversNullable(DateTime). Clôt #101840. #103035 (Pavel Kruglov). - Ajout de la prise en charge des colonnes
ALIASdans l’optimisation de lecture directe de l’index de texte. #103037 (Anton Popov). - Rétroporté dans #103454 : correction de
SELECT DISTINCT, qui renvoyait silencieusement des résultats incomplets lorsqu’une projection d’agrégation correspondait à la query et que certaines parts de la table ne contenaient pas de données de projection (par ex. si la projection avait été ajoutée à une table contenant déjà des données et queMATERIALIZE PROJECTIONn’avait pas été exécuté). Clôt #102951. #103052 (Nihal Z. Miaji). - Correction de résultats erronés renvoyés par
WHERE x AND toNullable(N)sur des tablesMergeTreelorsqueNest un entier plus large queUInt8(par ex.256,65535,2147483648ou tout entier négatif). Le filtre écartait à tort toutes les lignes, carsplitFilterNodeForAllowedInputsutilisait un zéroNULLlors de la conversion en booléen du resteNullabled’unANDréduit, ce qui transformait la comparaison enNULLselon la logique ternaire. #103077 (Groene AI). - Correction du type d’argument incorrect signalé dans les messages d’erreur des fonctions de recherche de chaînes (par ex.
locate,position) lorsque les arguments sont passés dans l’ordre inversé (locate(needle, haystack)avecfunction_locate_has_mysql_compatible_argument_order = 1). #103102 (Alex Kuleshov). - Correction d’un blocage indéfini de waitForPause lorsque disableFailPoint est appelé alors qu’aucun thread n’est en pause sur le failpoint. #103119 (Shaohua Wang).
- Limitation à 64 KB des chaînes du paquet TCP Hello avant authentification, et ajout du server setting
handshake_timeout_millisecondspour limiter la durée totale du handshake, afin d’empêcher des clients non authentifiés de consommer excessivement de la mémoire ou de monopoliser des threads indéfiniment. #103284 (Sema Checherinda). - Correction de Parquet ColumnIndex lorsque les stats indiquent min_value > max_value pour des colonnes String. #103334 (Saurabh Kumar Ojha).
- Vérification de la présence de données Dynamic aplaties mal formées au format Native. #103392 (Pavel Kruglov).
- Remplissage de la colonne
_timeà partir de la table functionurl. #103437 (Nikita Taranov). - Correction de la détection SVE, qui utilisait des instructions SVE lorsqu’elles n’étaient pas disponibles. #103568 (Raúl Marín).
Amélioration de la compilation/des tests/du packaging
- La dépendance Libstemmer (Snowball) utilise désormais la version plus récente v3.0.1. #99256 (Jimmy Aguilar Mena).
- Randomisation des paramètres dans clickhouse-test :
use_skip_indexes_for_top_k,use_top_k_dynamic_filtering,query_plan_max_limit_for_top_k_optimization. #91782 (Nikita Fomichev). - Implémentation d’un test de stress pour les fonctions, afin de vérifier la solidité de leurs différentes propriétés. #93543 (Michael Kolupaev).
- Fournit sa propre configuration CMake pour
llvm-projectau lieu d’importer celle d’upstream. #97453 (Konstantin Bogdanov). - Randomisation de davantage de paramètres
optimize_*dans l’infrastructure de test afin d’améliorer la couverture des passes d’optimisation des requêtes. #97547 (Alexey Milovidov). - Utilise la toolchain Rust nightly-2026-03-22. #98602 (Konstantin Bogdanov).
- Utilise
wasmtimev42.0.1. #98603 (Konstantin Bogdanov). - Utilise
llvm-project22.1.1. #98882 (Konstantin Bogdanov). - Remplace
SANITIZE_COVERAGE(callbacks personnalisés du sanitizer, granularité au niveau des symboles) par la couverture source LLVM (WITH_COVERAGE,-fprofile-instr-generate -fcoverage-mapping) pour le pipeline nightly de couverture par test. Le serveur lit désormais ses propres informations de couverture dans les sections ELF au démarrage et collecte des tuples(file, line_start, line_end)par test via une nouvelle commandeSYSTEM SET COVERAGE TEST 'name'. La sélection des tests dans les checks CI ciblés utilise des requêtes par plage de lignes sur une nouvelle table CIDBchecks_coverage_lineset classe les tests candidats selon le nombre de lignes modifiées du diff qu’ils couvrent. #99513 (Nikita Fomichev). - Corrige une erreur d’édition de liens de llvm-libc avec un build en -O0. #100023 (Zheguang Zhao).
- Corrige deux messages d’erreur au démarrage du conteneur lorsque la configuration ne contenait pas les paramètres
logger.logetlogger.errorlog(par ex. lorsque tous les messages de log doivent être envoyés vers STDOUT/STDERR). #100239 (Simon). - Préfère
ld64.lldauldd’Apple (cctools-port ld64) pour les builds macOS. Cela devrait réduire significativement les temps d’édition de liens sur Darwin, car le ld64 de cctools-port est très lent avec-ffunction-sectionset-dead_strip. Revient àldsild64.lldn’est pas disponible. #100275 (Alexey Milovidov). - Tests pour s’assurer que les répertoires n’enregistrent aucun secret (REST + Glue). #100307 (Konstantin Vedernikov).
- Répète les tests récemment modifiés avec différents paramètres randomisés. #100385 (Alexey Milovidov).
- Suivre les dépendances de fichiers
#embeddans CMake et activer le mode de dépendance de ccache pour garantir des reconstructions correctes. #100411 (Alexey Milovidov). - Ajouter des tests de validité pour les requêtes TPC-H. #100580 (Raufs Dunamalijevs).
- Utiliser
aws-sdk-cpp1.11.771. #100582 (Konstantin Bogdanov). - Autoriser les fichiers XML de tests de performance à référencer des fichiers de requêtes SQL externes et des paramètres via l’attribut file. #100747 (Raufs Dunamalijevs).
- Corriger la compilation avec
-march=x86-64-v4en ajoutant l’inclusion manquante deTargetSpecific.hdansLowerUpperImpl.h. #100932 (Alexey Milovidov). - Corriger la compilation sur gentoo en ajoutant
--no-default-configà cxxflags. #100973 (Isak Ellmer). - Ajout de
utils/auto-bisect/— un framework de bissection basé sur shell qui télécharge des binaires CI précompilés et exécute un script de test fourni par l’utilisateur afin de trouver le premier commit ayant introduit une régression, sans nécessiter de compilation locale. #100989 (Nikita Fomichev). - Désactiver ThinLTO par défaut dans CMake afin que les compilations locales des développeurs ne l’activent plus implicitement. Les builds de release de la CI ne sont pas affectés, puisqu’ils transmettent explicitement
-DENABLE_THINLTO=1. #101041 (Alexey Milovidov). - Ajouter le benchmark TPC-DS SF1 aux tests de performance. #101209 (Raufs Dunamalijevs).
- Ajout de tests sans état pour les lightweight deletes de MergeTree, couvrant : le cycle de vie du flag
has_lightweight_delete, l’exactitude deCOUNT(*)avecoptimize_trivial_count_query, l’intégrité des colonnesMATERIALIZED/DEFAULT, la récupération du flagReplicatedMergeTree,read_in_orderavec des lignes supprimées, plusieurs cycles de suppression/fusion, le masquage de la colonne_row_exists, la diversité des prédicats et l’application de RBAC pourALTER DELETE. #101792 (Nikita Fomichev). - Les images Docker distroless sont désormais publiées avec des variantes ubuntu et alpine pour les releases taguées. #101941 (Rahul Nair).
- Les stack traces affichent désormais des chemins relatifs simples et propres (par ex.
src/Common/Exception.cpp) au lieu de chemins pollués par le répertoire de build (par ex../ci/tmp/fast_build/./src/Common/Exception.cpp). #102000 (Raúl Marín). - Ajouter un Style check CI qui rejette les fichiers de plus de 5 Mo commités dans le repository, avec une whitelist pour les données de test légitimes déjà présentes. Supprimer le fichier
zookeeper_log.parquetinutilisé de 14 Mo. #102080 (Raúl Marín). - Supprimer environ 400 directives
#includeinutilisées des headers afin de réduire les temps de compilation. #102585 (Raúl Marín). - Utiliser
wasmtimev43.0.1. #102603 (Konstantin Bogdanov). - Utilisation d’
openssl3.5.6. #102606 (Konstantin Bogdanov). - Utilisation d’
xz5.8.3. #102607 (Konstantin Bogdanov). - Mise à niveau de l’image Docker distroless de base, de Debian 12 (glibc 2.36, OpenSSL 3.0) vers Debian 13 (glibc 2.41, OpenSSL 3.5), ce qui réduit la surface d’exposition aux CVE à zéro vulnérabilité exploitable. #101678 (Rahul Nair).
Version de ClickHouse 26.3 LTS, 2026-03-26. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- Revenir à une version antérieure après une mise à niveau peut entraîner une perte de données. Propage les versions de sérialisation des types de données aux types de données imbriqués. Par exemple, la version de sérialisation de String
with_size_streamne s’appliquait auparavant qu’aux colonnes String de premier niveau et aux éléments de Tuple. Désormais, elle s’applique à tout type String à l’intérieur de n’importe quel type imbriqué, commeArray/Map/Variant/JSON/etc. Ce comportement est contrôlé par le paramètre MergeTreepropagate_types_serialization_versions_to_nested_types, désormais activé par défaut. Après ce changement, les nouvelles data parts créées ne peuvent plus être lues par les versions antérieures, mais les anciennes parts peuvent être lues par la nouvelle version sans problème. La mise à niveau est sûre, mais pas le retour à une version antérieure : si vous devez revenir en arrière après une mise à niveau vers 26.3, les données écrites par 26.3 dans des colonnes avec des types imbriqués seront illisibles ! Voir #101429 pour plus de détails. #94859 (Pavel Kruglov). - Supprime le type de skip index
hypothesis. Il s’agissait d’une fonctionnalité expérimentale obscure, d’une utilité pratique limitée. La création de tables avecINDEX ... TYPE hypothesisproduit désormais une erreur. #96874 (Alexey Milovidov). - Supprime la fonction expérimentale
detectProgrammingLanguage. #99567 (Alexey Milovidov). - Corrige la priorité de l’opérateur
NOTpour l’aligner sur le standard SQL :NOTa désormais une priorité plus faible queIS NULL,BETWEEN,LIKEet les opérateurs arithmétiques. Par exemple,NOT (x) IS NULLest maintenant analysé commeNOT (x IS NULL)au lieu de(NOT x) IS NULL. Cela peut modifier le résultat des requêtes qui s’appuyaient sur le comportement précédent (non standard). #97680 (Alexey Milovidov). - Corrige les métadonnées des projections normales afin que les projections avec des clés de tri sur plusieurs colonnes soient correctement reconnues. S’appuie sur #90429. #91352 (Amos Bird).
- Corrige le non-respect du paramètre replace_long_file_name_to_hash par les fichiers de skip index, ce qui provoquait des erreurs “File name too long” et empêchait la lecture d’index aux noms longs. Les noms de fichiers des skip indexes sont désormais hachés lorsqu’ils dépassent max_file_name_length, comme pour les fichiers de colonnes. Ce changement est rétrocompatible (les nouveaux serveurs lisent les anciennes parts), mais un retour à une version antérieure — ou des serveurs plus anciens lors d’une rolling upgrade — peut faire ignorer les index aux noms longs. #97128 (Raúl Marín).
- Active async insert par défaut. ClickHouse regroupera désormais par défaut toutes les petites insertions en batch. Ce paramètre est défini dans compatibility. Si vous définissez
compatibility=<version less than 26.2>, la valeur par défaut restera l’ancienne,false. Vous pouvez désactiver/activer async inserts à plusieurs niveaux : dans la config des profils utilisateurs, pour la session, pour la requête ou pour la table MergeTree. #97590 (Sema Checherinda). - Modifie la valeur par défaut de
mysql_datatypes_support_level, qui passe de vide àdecimal,datetime64,date2Date32, ce qui active par défaut le mapping correct de MySQLDATEversDate32, deDECIMAL/NUMERICversDecimal, et deDATETIME/TIMESTAMPavec précision versDateTime64. Auparavant, les colonnes MySQLDATEétaient mappées versDate, qui ne peut pas représenter les dates antérieures au 1970-01-01, ce qui entraînait une corruption des données. #97716 (Alexey Milovidov). - Accepter une liste de noms de parts au lieu d’une expression régulière pour
mergeTreeAnalyzeIndexes{,UUID}, car les expressions régulières sont lentes (Fonctionnalité expérimentale). #98474 (Azat Khuzhin). - La valeur par défaut de
stderr_reactionpasse dethrowàlog_lastpour les UDF exécutables. Les UDF qui écrivent des avertissements sur stderr n’échouent plus lorsque le code de sortie est 0. Les exceptions liées au code de sortie incluent désormais le contenu de stderr. #99232 (Xu Jia).
Nouvelle fonctionnalité
- Ajout de la sérialisation par buckets pour les colonnes Map dans MergeTree (
map_serialization_version = 'with_buckets'). Les clés sont réparties dans des buckets basés sur le hachage afin que la lecture d’une seule clé (m['key']) ne lise qu’un seul bucket au lieu de toute la colonne, ce qui apporte une accélération de 2 à 49x pour les lookups sur une seule clé selon la taille de la map. Le nombre de buckets et la stratégie de répartition peuvent être contrôlés par de nouveaux MergeTree settings :map_serialization_version,max_buckets_in_map,map_buckets_strategy,map_buckets_coefficientetmap_buckets_min_avg_size. #99200 (Pavel Kruglov). - Prise en charge des CTE matérialisées. Permet d’évaluer les CTE une seule fois pendant l’exécution de la requête et de stocker leurs résultats dans des tables temporaires. Résout #53449. #94849 (Dmitry Novik).
- Autorise certaines fonctions SQL standard sans parenthèses pour des raisons de compatibilité, comme
NOW. Résout #52102. #95949 (Aly Kafoury). - Vous pouvez désormais utiliser la fonction de tri naturel sous la forme
naturalSortKey(s). #90322 (Nazarii Piontko). - Vous pouvez désormais utiliser une entrée JSON/Object native avec les fonctions JSONExtract. Résout #88370. #96711 (Fisnik Kastrati).
- Si un query parameter est de type
Nullableet n’est pas spécifié, nous supposerons que sa valeur estNULL. #93869 (Vikash Kumar). - Prise en charge d’un auxiliary ZooKeeper pour la database
Replicated. #95590 (RinChanNOW). - Prise en charge de la fonction
haspour le JSON type afin de vérifier l’existence d’un chemin, comme pour Map. #96927 (DQ). - Ajout de la table function
mergeTreeTextIndex(database, table, index), qui permet de lire directement des données depuis un text index. Cette fonction peut être utilisée pour l’introspection ou pour effectuer des aggregations sur les données de l’index textuel. #97003 (Anton Popov). - Ajout du MergeTree setting
table_readonlypour marquer les tables comme read-only, empêchant les inserts et les modifications. #97652 (Alexey Milovidov). - Ajout du new setting
use_partition_pruninget de l’aliasuse_partition_key. Définissez-le surfalsepour désactiver le partition pruning basé sur la partition key. #97888 (Nihal Z. Miaji). - Implémente
ALTER TABLE ... EXECUTE expire_snapshots('<timestamp>')pour les Iceberg tables. #97904 (murphy-4o). #99130 - Autorise chaque entrée
type=httpdans<protocols>à spécifier une clé<handlers>personnalisée pointant vers une section de config<http_handlers_*>distincte, ce qui permet d’appliquer des règles de routage HTTP différentes selon le port. #98414 (Amos Bird). - Ajout de l’option
pretty=1àEXPLAINpour une sortie indentée en arborescence, et decompact=1pour regrouper les étapesExpression, ce qui rend les query plans plus lisibles. #98500 (Kirill Kopnev). - Ajout du paramètre serveur
restore_access_entities_with_current_grants. Lorsqu’il est activé, les utilisateurs/rôles restaurés depuis des backups voient leurs grants limités à ce que l’utilisateur effectuant la restauration est autorisé à accorder (même sémantique queGRANT CURRENT GRANTS), au lieu d’échouer avecACCESS_DENIED. #98795 (pufit). - Ajout des fonctions
caseFoldUTF8etremoveDiacriticsUTF8pour le repliement de casse Unicode et la suppression des signes diacritiques. #98973 (George Larionov). - Ajout de la fonction de chaîne
normalizeUTF8NFKCCasefoldpour la normalisation Unicode NFKC_Casefold, qui combine la normalisation NFKC avec le repliement de casse. #99276 (George Larionov). - Ajout du tokenizer
unicode_wordpour les full-text indexes et de la fonctiontokens. Il découpe le texte selon les règles Unicode de délimitation des mots : les mots ASCII sont formés avec des caractères connecteurs (tiret bas, deux-points, point, apostrophe), tandis que les caractères Unicode non ASCII deviennent des tokens d’un seul caractère. Remarque : la version 26.3 n’accepte ce tokenizer que sous le nomunicode_word; il a été renomméasciiCJKdans la version 26.4. #99357 (Amos Bird). - Ajout des settings
max_skip_unavailable_shards_numetmax_skip_unavailable_shards_ratiopour limiter le nombre de shards pouvant être ignorés silencieusement lorsqueskip_unavailable_shardsest activé. Si le nombre ou la proportion de shards indisponibles dépasse le threshold configuré, une exception est levée au lieu de renvoyer silencieusement des résultats incomplets. #99369 (Alexey Milovidov). - Les utilisateurs peuvent désormais utiliser le keyword
SOMEpour les expressions de subquery. Il se comporte exactement commeANY. #99842 (Artem Kytkin). - Ajout du setting
output_format_trim_fixed_stringpour supprimer les null bytes de fin des valuesFixedStringdans les output formats textuels. #97558 (NeedmeFordev). - Prise en charge des expressions de table join entre parenthèses dans la clause FROM, par exemple
SELECT * FROM (t1 CROSS JOIN t2). #97650 (Alexey Milovidov). - Implémentation de la fonction
toDaysInMonth: elle renvoie le nombre de jours du mois correspondant à la date spécifiée. #99227 (Vitaly Baranov).
Fonctionnalité expérimentale
- Ajout de la prise en charge expérimentale des fonctions définies par l’utilisateur (UDF) basées sur WebAssembly, ce qui permet d’implémenter une logique de fonction personnalisée en WebAssembly et de l’exécuter dans ClickHouse. Remerciements particuliers à Alexey Smirnov pour sa contribution à la prise en charge du backend Wasmtime. #88747 (Vladimir Cherkasov). Améliorations incrémentales de la prise en charge des UDF WASM. #99373 (Vasily Chekalkin).
- Ajout de la prise en charge des dialectes SQL externes à l’aide de la bibliothèque
polyglot. #99496 (Alexey Milovidov). - Ajout du codec de compression
ALPpour nombres à virgule flottante (sans fallback ALP_rd pour les doubles non compressibles). #91362 (Nazarii Piontko). - Ajout de la prise en charge expérimentale des indications de type différées pour les colonnes
JSON. Lorsqu’elle est activée viaallow_experimental_json_lazy_type_hints, l’instructionALTER TABLE ... MODIFY COLUMN json JSON(path TypeName)qui se contente d’ajouter ou de modifier des indications de type s’exécute instantanément comme une opération limitée aux métadonnées, sans réécrire les données historiques. Les indications de type sont appliquées au moment de l’exécution des requêtes pour les anciennes parties, puis matérialisées lors des INSERTs et des fusions en arrière-plan. #97412 (tanner-bruce). - Activation des lectures parallèles avec le moteur de table YTsaurus. #97343 (MikhailBurdukov).
Amélioration des performances
- Améliore les performances des lacs de données. Dans les versions précédentes, la lecture depuis le stockage objet ne redimensionnait pas le pipeline en fonction du nombre de threads de traitement. Cela apporte des gains de plusieurs ordres de grandeur (~40x) sur les machines multicœurs. #99548 (Alexey Milovidov).
- Désormais, la relation entre
enable_parallel_replicasetautomatic_parallel_replicas_modeest la suivante. Une requête ne peut utiliser des répliques parallèles que sienable_parallel_replicas > 0. De plus, siautomatic_parallel_replicas_mode=1, la décision d’utiliser des répliques parallèles est prise lors de la planification, sur la base des statistiques collectées au préalable. Siautomatic_parallel_replicas_mode=0, les répliques parallèles seront utilisées pour toutes les requêtes prises en charge, indépendamment des statistiques. Une exception notable concerne les insert-select distribués avec répliques parallèles : dans ce cas, les requêtes seront toujours exécutées comme siautomatic_parallel_replicas_mode=0. #97517 (Nikita Taranov). - Autorise l’élagage de partitions lorsque le prédicat contient n’importe quel opérateur de comparaison (
=,<,>,!=) et que la clé de partition est encapsulée dans une chaîne de fonctions déterministes (par exemple,PARTITION BY xet des prédicats commecityHash64(x) % 5 > 2,toYYYYMM(x) < 2026,toYYYYMM(x) = 2026outoYYYYMM(x) != 2026utiliseront tous la clé de partition pour l’élagage). Résout #28800. #98432 (Nihal Z. Miaji). - Autorise l’optimisation de lecture ordonnée et l’élagage par clé primaire lorsque le type cible de
CASTestNullableet que la conversion est monotone ; par exemple, avecPRIMARY KEY x, ClickHouse peut utiliser l’optimisation de lecture ordonnée pourORDER BY x::Nullable(UInt64)et appliquer l’élagage par clé primaire à des prédicats tels queWHERE x::Nullable(UInt64) > 500000. #98482 (Nihal Z. Miaji). - Autorise l’élagage d’index et le pushdown des filtres lorsqu’une colonne entière est comparée à un littéral flottant ; par exemple, des prédicats comme
WHERE x < 10.5peuvent désormais utiliser la clé primaire pour l’élagage, et des filtres tels queprime < 1e9ounumber < 1e5sont maintenant poussés vers les fonctions de tableprimes()etnumbers()au lieu de provoquer une exécution non bornée. Résout #85167. #98516 (Nihal Z. Miaji). - Ajout d’un nouveau cache SLRU pour les métadonnées Parquet afin d’améliorer les performances de lecture en supprimant la nécessité de retélécharger des fichiers uniquement pour lire leurs métadonnées. #98140 (Grant Holly).
- Prend en charge l’inversion des côtés des jointures ANTI, SEMI et FULL en fonction des statistiques de l’optimiseur. #97498 (Hechem Selmi).
- Optimise le skipping des granules pour
pointInPolygonavec de grands polygones et corrige le fait que l’analyse d’index depointInPolygonpouvait lever une exception lors de l’élagage par clé primaire. #91633 (Nihal Z. Miaji). - Améliore les performances de la fonction
levenshteinDistance. #94543 (Joanna Hulboj). - Optimise les conversions par lot du type Decimal en évitant les appels de fonction pour chaque élément. #95923 (Konstantin Bogdanov).
- Les tables Iceberg prennent désormais en charge le préchargement asynchrone des métadonnées via le paramètre de table
iceberg_metadata_async_prefetch_period_ms, qui préalimente périodiquement le cache de métadonnées. De plus, le paramètre de requêteiceberg_metadata_staleness_mspermet aux requêtes SELECT d’utiliser les métadonnées en cache si elles sont plus récentes que le seuil d’obsolescence spécifié, ce qui évite les appels au catalogue Iceberg pendant le traitement des requêtes. #96191 (Arsen Muk). - Le mode ordered de
S3Queueutilise S3 ListObjectsV2 StartAfter pour éviter de relister l’historique complet du préfixe, réduisant ainsi les appels à ListObjects. #96370 (Venkata Vineel ). - Réduction de la consommation mémoire pour la déduplication des insertions. En général, le block d’origine est nécessaire à la déduplication, mais pour une insertion synchrone, il peut être omis, ce qui permet d’économiser durablement de la mémoire. #96661 (Sema Checherinda).
- Utilisation d’une valeur spécifique à l’architecture pour la taille des lignes de cache au lieu d’une valeur codée en dur de 64. #97357 (Nikita Taranov).
- Lecture dans le Dictionary de l’index de texte légèrement optimisée, avec une amélioration des performances globales de l’analyse de l’index de texte. #97519 (Anton Popov).
- Accélération de la décompression
LZ4des blocks de 16 octets sur ARM. #97774 (Raúl Marín). - Refactorisation de la tokenization vers une nouvelle interface haute performance, remplaçant l’ancienne API de type itérateur afin de prendre en charge SIMD et les tokenizers Stateful. Fait partie de #90268. #97871 (Amos Bird).
- Amélioration des performances de l’analyse de l’index de texte pour les requêtes avec des conditions combinées impliquant à la fois des colonnes indexées et non indexées. Auparavant, l’optimisation de sortie anticipée lors de l’analyse de l’index était désactivée à tort dans de tels cas. #98096 (Anton Popov).
- Amélioration des performances des requêtes avec des expressions constantes qui génèrent des Array ou des maps très longs. #98287 (Alexey Milovidov).
- Correction de l’analyse des conditions sur la clé pour les clés primaires
DateTime64comparées à des constantes entières, ce qui empêchait auparavant tout Granule pruning. #98410 (Amos Bird). - Le paramètre
optimize_syntax_fuse_functionsest activé par défaut. #98424 (Alexey Milovidov). - Optimisation de la aggregate function
avgWeightedgrâce à l’utilisation d’accumulateurs locaux au lieu d’un store-forwarding par ligne via l’aggregate state, avec un gain de performances pouvant atteindre 27 % pour les entrées Nullable. #98793 (Antonio Andelic). - Améliore les performances et réduit la consommation mémoire des window functions parallèles dans certains scénarios, ainsi que pour les workloads
arrayFoldavec de grands Array. Cela peut également réduire la pression liée aux défauts de page et améliorer la stabilité sous des limites mémoire strictes pour les requêtes concernées. #98892 (filimonov). - Amélioration des performances des merges triés. #99013 (Artem Zuikov).
- Optimisation de
INTERSECT ALLetEXCEPT ALL. #99097 (Raufs Dunamalijevs). - Prise en charge de l’optimisation
read_in_order_use_virtual_rowpour les lectures en ordre inverse. #99198 (Vladimir Cherkasov). - Réduction de la contention du cache dans les JOIN
RIGHTetFULLen vérifiant si JoinUsedFlags est défini avant l’écriture. #99274 (Hechem Selmi). - Optimisation de
PrefetchingHelper::calcPrefetchLookAheaden remplaçant les calculs en virgule flottante par une arithmétique entière, ce qui améliore l’organisation du cache d’instructions et réduit le surcoût en cycles dans les boucles d’agrégation. #99327 (Riyane El Qoqui). - Réduction de la consommation mémoire de Keeper en remplaçant
absl::flat_hash_setparCompactChildrenSetpour stocker les nœuds enfants. Le nouveau conteneur stocke 0 ou 1 enfant en ligne, sans allocation sur le tas, ce qui couvre la majorité des nœuds Keeper. Cela réduit la taille deKeeperMemNodede 144 à 128 octets. #99860 (Antonio Andelic). - Les projections agrégées sont désormais correctement prises en charge dans les vues. Corrige #32753. #88798 (Amos Bird).
- Prise en charge de l’optimisation de conversion de jointure OUTER en INNER avec
join_use_nulls. Ferme #90978. #95968 (Vladimir Cherkasov). - Amélioration de la lecture des sous-colonnes grâce à un calcul correct des tailles avant lecture. Cela réduit l’utilisation de la mémoire et accélère la lecture des sous-colonnes. #96251 (Pavel Kruglov).
- Les caches de marks, de données non compressées et de pages utilisent désormais des arènes jemalloc distinctes afin d’éviter la fragmentation mémoire lorsque des allocations de courte durée, par exemple pour les requêtes, sont mélangées à des allocations plus longues pour les caches. #96812 (Seva Potapov). #98812. #99021
- Les tables avec des règles
DELETE TTLpeuvent désormais utiliser l’algorithme de fusion verticale. #97332 (murphy-4o). - Application des index de saut de données pendant l’analyse distribuée des index. #97767 (Azat Khuzhin).
- Les marks des index secondaires sont désormais préchauffés lorsque le paramètre
prewarm_mark_cacheest activé (chargés dans le cache des index marks lors des fetches de data parts et au démarrage de la table). #97772 (Anton Popov). - Réduction du verrouillage dans le contrôle d’accès. #97894 (Nikita Taranov).
- Lorsque apply_row_policy_after_final ou apply_prewhere_after_final est activé, les conditions AND composées dans les row policies et PREWHERE sont désormais décomposées pour extraire les atomes de clé de tri en vue de l’analyse de l’index de clé primaire. Auparavant, si un filtre différé contenait à la fois des prédicats sur la clé de tri et hors clé de tri (par ex. x > 1 AND y != ‘foo’), l’expression entière était exclue de l’analyse des index. Désormais, les atomes de clé de tri (comme x > 1) sont extraits et utilisés pour l’élagage des granules, même à partir d’expressions AND imbriquées. #98513 (Yarik Briukhovetskyi).
- Réduit la contention des verrous dans MergeTreeBackgroundExecutor en permettant de libérer les ressources des tâches sans acquérir le verrou. Ferme #93620. #98604 (Dmitry Novik).
- Corrige une consommation mémoire excessive (~514 MiB) lors de l’auto-détection du format à la lecture de données non Arrow (par ex. du JSON depuis
urloufilesans format explicite), due au fait que le lecteur ArrowStream interprétait à tort les premiers octets comme une longueur de métadonnées énorme. #98893 (Konstantin Bogdanov).
Amélioration
- Permet d’analyser des fichiers GeoParquet contenant différents types Geo dans une même colonne. #97851 (Mark Needham).
- Introduction de la fonction SQL
tokensForLikePattern, qui découpe en tokens les motifs LIKE tout en respectant la sémantique des caractères génériques :%et_sont traités comme des caractères génériques, les caractères génériques échappés (\%,\_) comme des littéraux, et les tokens adjacents à des caractères génériques non échappés sont ignorés. #97872 (Amos Bird). - Ajout d’un placeholder
{_schema_hash}pour le moteur de table S3, qui insère un hash des définitions de colonnes de la table dans le chemin S3. #98265 (Miсhael Stetsyuk). SymbolIndex,addressToSymbol,system.symbolsetbuildIdfonctionnent désormais sur macOS grâce à l’analyse des tables de symboles Mach-O. #99014 (Alexey Milovidov).- La table
system.stack_tracefonctionne désormais sur macOS, ce qui permet l’introspection des stack traces de tous les threads du serveur. #98982 (Alexey Milovidov). - Ajout de l’option de config LDAP par serveur
<follow_referrals>(valeur par défaut :false) pour contrôler si le client LDAP suit les referrals. Désactiver le suivi des referrals évite les timeouts et les blocages lors des recherches à partir d’un base DN à la racine d’un domaine Active Directory. Les log messages liés aux referrals passent dewarnàtrace. #96765 (paf91). - Nous suivons désormais tous les data skipping indices utilisés pendant l’exécution d’une query dans la table query_log, dans une nouvelle colonne nommée
skip_indices. Corrige #78676. Auteur original : @pheepa. #87862 (Grant Holly). - Les indications ACCESS_DENIED ne révèlent plus les noms de colonnes, sauf si l’utilisateur est autorisé à afficher toutes les colonnes requises ; les noms de base de données et de table restent visibles dans l’indication. #91067 (filimonov).
- Ajout d’un thread de nettoyage dédié pour MergeTree afin d’éviter les retards de nettoyage en cas de forte charge de merge. Cela résout #86181. #91574 (Amos Bird).
- Recharge la config du cluster si les IP du hostname du serveur local ont changé, au lieu de celles de n’importe quel hôte. Corrige #81215, #70156 et #65268. #93726 (Zhigao Hong).
- Permet à optimize_aggregators_of_group_by_keys d’optimiser correctement les aggregate functions dans les queries GROUPING SETS. #93935 (Xiaozhe Yu).
- Keeper-bench : signale les errors dans les metrics et génère un fichier JSON de metrics pour le mode —input-request-log. #95748 (Mohammad Lareb Zafar).
- Ajout de la clause ROLE à CREATE USER. #97074 (Vitaly Baranov).
- Vous pouvez désormais définir les paramètres
internal_replicationpour un cluster créé par la base de données Replicated. #97228 (Pervakov Grigorii). - Le nouveau paramètre
allow_nullable_tuple_in_extracted_subcolumnscontrôle si les sous-colonnesTuple(...)extraites deTuple,Variant,DynamicetJSONsont renvoyées sous la formeNullable(Tuple(...))(NULLpour les lignes avec valeur manquante) ou sous la formeTuple(...)(valeurs de tuple par défaut pour les lignes avec valeur manquante). Désactivé par défaut, ce paramètre ne peut être modifié qu’en redémarrant le serveur. #97299 (Nihal Z. Miaji). - Ajout d’informations sur les filtres différés en tant qu’élément distinct dans la sortie de la requête EXPLAIN (lors de l’utilisation de Row Policies/PREWHERE avec FINAL). En lien : #91065. #97374 (Yarik Briukhovetskyi).
- Activation par défaut de
type_json_allow_duplicated_key_with_literal_and_nested_object. Cela permet d’éviter les erreurs liées aux clés dupliquées lors de l’analyse de JSON tels que{"a" : 42, "a" : {"b" : 42}}, que ClickHouse peut formater à partir des données JSON d’origine{"a" : 42, "a.b" : 42}. #97423 (Pavel Kruglov). - Amélioration de Keeper :
find_super_nodesest une commande très utile pour le débogage d’une croissance inattendue du nombre de nœuds dans Keeper. Malheureusement, s’il existe plusieurs super-nœuds, il est presque impossible d’en trouver plus d’un, car la commande reste bloquée indéfiniment lors du parcours des nœuds enfants du premier super-nœud rencontré. Cette PR interdit de parcourir les nœuds enfants des super-nœuds. #97819 (pufit). - Prise en charge initiale de l’autocomplétion pour
clickhouse-keeper-client. #97828 (Konstantin Bogdanov). - Vidage des tampons de logging asynchrone en cas de crash. #97836 (Azat Khuzhin).
- Activation par défaut de la fonctionnalité d’usurpation d’identité (voir EXECUTE AS target_user). #97870 (Vitaly Baranov).
- Amélioration de l’annulation des requêtes avec le table engine SQLite via KILL QUERY et l’annulation de requête (Ctrl+C) dans clickhouse-client. #97944 (Roman Vasin).
- Ajout du paramètre serveur
jemalloc_profiler_sampling_ratepour contrôlerlg_prof_samplede jemalloc et l’exposer comme métrique asynchronejemalloc.prof.lg_sample. #97945 (Antonio Andelic). - Prise en charge des weights dans l’implémentation d’une file bornée concurrente. #97962 (Daniil Ivanik).
- Ajout de sslmode aux keys autorisées pour les dictionary sources PostgreSQL. Auparavant, sslmode ne figurait pas dans la liste d’autorisation
dictionary_allowed_keysde PostgreSQLDictionarySource.cpp, ce qui rendait impossible la configuration du mode SSL pour les connexions de dictionnaires PostgreSQL. Cela empêchait les dictionnaires de se connecter aux serveurs PostgreSQL qui exigent SSL (par exemple AWS RDS, qui l’impose par défaut), car la connexion échouait lors de la négociation TLS et le serveur rejetait le fallback non chiffré. #98014 (mcalfin). - Affiche une erreur claire « no such file » lorsqu’un chemin de fichier inexistant est passé à
clickhouseouclickhouse-local, au lieu d’un message générique déroutant. #98048 (Raúl Marín). - Les index de texte peuvent désormais être créés sur des colonnes
Nullable([Fixed]String)etArray(Nullable([Fixed]String)). #98118 (Jimmy Aguilar Mena). - Évite la suppression des collections nommées dont dépendent les sources de dictionnaire. #98127 (Pablo Marcos).
- Active l’algorithme de jointure
grace_hashpour les requêtes avec totaux. #98144 (János Benjamin Antal). - Annule plus tôt les fusions en arrière-plan dans DROP DATABASE pour ordinary shared merge tree. #98161 (Shaohua Wang).
- Améliore l’annulation des requêtes avec MongoDB et MySQL via KILL QUERY et l’annulation de requête (Ctrl+C) dans clickhouse-client. #98187 (Roman Vasin).
- Supprime NetlinkMetricsProvider et utilise exclusivement procfs pour la collecte des métriques taskstats par thread. La collecte basée sur Netlink est problématique dans les environnements conteneurisés et présente une latence en queue plus élevée en cas de contention. #98229 (Amos Bird).
- Remanie la gestion des fichiers manifestes Iceberg pour corriger les problèmes de mise en cache de ces fichiers. #98231 (Daniil Ivanik).
- Désormais, les cas où la clé de tri de la table peut être une expression comme
toDate(time)sont pris en compte, et il est possible de décider de ne pas différer ce type d’expression si elle fait partie des filtres. #98237 (Yarik Briukhovetskyi). - Ajoute une nouvelle métrique
MaxAllocatedEphemeralLockSequentialNumberpour le numéro séquentiel maximal alloué aux znodes de verrouillage éphémères dans ZooKeeper. #98243 (Miсhael Stetsyuk). - Met à jour ClickStack vers la version 2.20.0. #98252 (Aaron Knudtson).
- Ajout d’un nouvel événement de profil
KeeperRequestTotalWithSubrequestsqui compte individuellement chaque sous-requête au sein d’une requête multiple, offrant une meilleure visibilité sur la charge réelle de Keeper. L’événement existantKeeperRequestTotalcontinue de compter chaque requête multiple comme une seule requête. #98348 (Antonio Andelic). SYSTEM RELOAD DICTIONARIESrecharge désormais les dictionnaires dans l’ordre topologique afin que les dictionnaires s’alimentant à partir d’autres dictionnaires voient des données à jour après le rechargement. #98356 (Alexey Milovidov).- Redémarre le cache de statistiques après modification du paramètre MergeTree. #98520 (Han Fei).
- Seules les répliques « vivantes » (auxquelles on peut se connecter) participent à l’analyse distribuée des index. #98521 (Azat Khuzhin).
- Ajoute un paramètre
access_control_improvements.disallow_config_defined_profiles_for_sql_defined_users(désactivé/autorisé par défaut) qui interdit l’utilisation de profils de paramètres définis dans la configuration (à l’exception du profildefault) pour les utilisateurs définis en SQL. #98662 (Alexander Tokmakov). - Limite le nombre de nœuds utilisés par l’heuristique automatique des répliques parallèles au nombre réel de nœuds du cluster (au lieu du seul paramètre
max_parallel_replicas). #98668 (Nikita Taranov). - Implémente les requêtes spéculatives et la lecture asynchrone pour l’analyse distribuée des index. #98724 (Azat Khuzhin).
- La désérialisation des états binaires
AggregateFunctionexige désormais de consommer l’intégralité de l’entrée. Si des octets de fin superflus sont présents, ClickHouse lève une exception au lieu d’accepter des données d’état mal formées. #98786 (Nihal Z. Miaji). - Fait en sorte que TRUNCATE DATABASE réagisse à l’annulation d’une requête. #98828 (Shaohua Wang).
- Améliore
keeper-benchavec le pipelining des requêtes, une période de préchauffage, des statistiques par opération, des graines reproductibles et une meilleure gestion des erreurs. #98906 (Antonio Andelic). - Prend en charge la clause SAMPLE dans l’analyse distribuée des index. #98931 (Azat Khuzhin).
- Affiche le titre du graphique dans le tableau de bord même lorsque la requête renvoie un résultat vide ou rencontre une erreur. #98975 (Yash ).
- Les messages d’erreur de l’analyseur n’affichent plus toutes les colonnes d’une table (ce qui pouvait produire des exceptions de plus de 150 KB). Les listes de colonnes sont désormais limitées à 10 entrées. #99002 (Yash ).
- Renvoie correctement les statistiques de colonnes des sous-requêtes avec jointures afin que la requête parente puisse les utiliser pour réordonner les jointures. #99096 (Alexander Gololobov).
- Marque immédiatement la session ZooKeeper comme expirée lorsque la finalisation commence, au lieu d’attendre que le thread d’envoi se termine. Cela permet aux autres threads d’établir une nouvelle session sans délai. #99102 (Raúl Marín).
- Utilise davantage de fonctions mathématiques de LLVM-libc :
exp,exp2,expm1,fabs,fabsl,floor,fmodl,log,log2,logf,pow,scalbn,scalbnl,copysignl,nan,nanf,nanl, ainsi que les constantes partagéesexplogxf. #99118 (Konstantin Bogdanov). - Réduit l’utilisation de la mémoire et corrige un risque de sortie dupliquée dans le format
collapseddesystem.jemalloc_profile_text. #99121 (Antonio Andelic). - Ajoute la colonne
is_subrequestàsystem.aggregated_zookeeper_logpour séparer les requêtes autonomes des sous-requêtes à l’intérieur des requêtes Multi/MultiRead. Auparavant, les sous-requêtes étaient agrégées dans les mêmes groupes que les requêtes autonomes et, comme chaque sous-opération était journalisée avec la durée totale de la multi-requête, la latence moyenne devenait trompeuse. Les sous-requêtes ont désormais une latence nulle. #99169 (Miсhael Stetsyuk). - Autoriser la commande
ALTER TABLE MODIFY COLUMN x TTL ...sans spécifier le type de colonne. #99208 (Nikolay Degterinsky). - Ignorer les requêtes Keeper obsolètes pour les sessions déjà déconnectées, afin d’éviter des allers-retours Raft inutiles. Le nombre de sessions terminées conservées est plafonné par le paramètre de coordination
max_finished_sessions_cache_size. #99246 (Antonio Andelic). - Prise en charge d’un text index construit sur
mapValues(map)avec l’opérateurIN. #99286 (Anton Popov). - Prise en charge de l’autocomplétion de type shell dans clickhouse keeper-client (prise en charge de la complétion d’arguments entre guillemets, p. ex.
'foo ba', des arguments échappés, p. ex.foo\ ba, et affichage parlsdes nœuds entre guillemets lorsqu’ils contiennent des espaces). #99312 (Azat Khuzhin). - Empêcher la commande Keeper
mntrde se bloquer en raison d’une contention sur les verrous. #99472 (Antonio Andelic). - Réduire la contention sur les verrous dans le dispatcher de Keeper en invoquant les callbacks et en répartissant les requêtes de lecture hors de la portée du mutex, et ajouter des gardes de verrou profilés pour l’observabilité. #99751 (Antonio Andelic).
- Tolérer l’absence de padding à la fin du dernier bloc des fichiers Parquet. #99857 (Seva Potapov).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Corrige la manière dont la cible d’une table Alias est enregistrée en tant que dépendance DDL lorsqu’elle n’est pas entièrement qualifiée : elle est désormais enregistrée avec la base de données de la table Alias plutôt qu’avec la base de données de session. #95175 (Enric Calabuig).
- Corrige un résultat erroné ou une exception lors de la lecture des sous-colonnes de colonnes ALIAS. #95408 (Pavel Kruglov).
- Corrige une colonne manquante lorsqu’un alias d’identifiant non standard est utilisé dans un JOIN avec l’ancien analyseur. Corrige #25594, #47288 et #53263. #95679 (Zhigao Hong).
- Corrige un plantage dans les fonctions du dialecte Kusto
bin(),bin_at(),extract()etindexof()lorsque des arguments vides sont fournis. #95736 (NeedmeFordev). - Interdit le montage de local_object_storage (utilisé par les datalakes au-dessus du système de fichiers local et éventuellement par LocalDisk) ailleurs que dans user_files_path dans clickhouse-client. #96201 (Daniil Ivanik).
- Dans le moteur de table
DeltaLake, corrige une condition de concurrence logique lors d’un changement de version du snapshot et supprime les rechargements de snapshot lourds et redondants. #96226 (Kseniia Sumarokova). - Corrige une erreur logique lors de l’attachement d’une part dans MergeTree s’il y a eu plusieurs renommages successifs entre le détachement et l’attachement. #96351 (Alexey Milovidov).
- Corrige un bug où des paramètres explicites envoyés avec
compatibilitydans la même requête pouvaient être ignorés silencieusement lorsque leur valeur correspondait à la valeur par défaut du serveur. #97078 (Raufs Dunamalijevs). - Corrige le fait que le client signalait
NETWORK_ERRORau lieu de la véritable erreur d’analyse (avec le bon numéro de ligne) lorsqu’un INSERT avec parsing parallèle rencontrait des données invalides. #97339 (Alexey Milovidov). - Corrige le fait que la fonction d’agrégation
sumCountne pouvait pas lire les anciens états sérialisés après l’introduction deNullable(Tuple). Clôt #97370. #97502 (Nihal Z. Miaji). - Corrige une exception dans une comparaison de tuples impliquant des éléments de type
Nothing(par ex. une comparaison avec des éléments de tupleNULL) lorsqu’elle est utilisée avecGROUPING SETSetORDER BY. #97509 (Alexey Milovidov). - Corrige le calcul non déterministe de
uncompressed_hashpour les parts Compact de MergeTree lorsque plusieurs codecs de compression sont utilisés, ce qui pouvait entraîner un comportement incorrect de déduplication. #97522 (Alexey Milovidov). - Corrige une erreur logique liée à un stream manquant lors d’un INSERT SELECT avec JSON et des buckets dans les données partagées. Clôt #97331. #97523 (Pavel Kruglov).
- Correction des exceptions
MEMORY_LIMIT_EXCEEDEDsignalées à tort commeCORRUPTED_DATAlors des merges de SummingMergeTree et CoalescingMergeTree. #97537 (János Benjamin Antal). - Correction de l’exception “Context has expired” pour les sous-requêtes corrélées contenant des fonctions de table comme
url(). #97544 (Alexey Milovidov). - Correction des exceptions et des comportements incorrects dans
optimize_syntax_fuse_functionsavec les projections d’agrégation, les types Date et la préservation des noms de colonnes. #97545 (Alexey Milovidov). - Suppression d’une query rewrite incorrecte de
replaceRegexpOneversextract, qui produisait des résultats erronés lorsque l’expression régulière ne correspondait pas ; correction également d’une exception lorsquereplaceRegexpOneest utilisé avecGROUP BY ... WITH CUBEetgroup_by_use_nulls=1. #97546 (Alexey Milovidov). - Correction de
DROP DATABASEavecdatabase_atomic_wait_for_drop_and_detach_synchronously, qui pouvait rester bloqué indéfiniment lorsque la requête était interrompue. #97586 (Alexey Milovidov). - Correction de
KILL QUERY, qui ne pouvait pas arrêter des requêtes bloquées lors de la générationWITH FILL, du chargement de dictionnaires viadictGetou deALTER DELETEavecmutations_sync=1surReplicatedMergeTree. #97589 (Alexey Milovidov). - La fonction de table
loopappelait directementinner_storage->read(), en contournant la couche d’interpréteur où sont appliquées les row policies, les autorisations au niveau des colonnes et les autres contrôles de sécurité. Cela permettait à un utilisateur soumis à des row policies de lire toutes les lignes vialoop(table), même lorsqu’un SELECT direct renvoyait zéro ligne. #97682 (pufit). - Correction d’un partition pruning incorrect lors de l’utilisation de valeurs DateTime64 antérieures à l’époque Unix avec la fonction
toDate(). #97746 (Yarik Briukhovetskyi). - Après ce correctif,
hasPartitionIdrenverra false si une autre partition avec un ID de partition plus élevé existe dans l’ensemble des data parts. #97748 (Mikhail Artemenko). - Correction de crashs possibles lors de la lecture de granules vides dans les advanced shared data en JSON. Closes #97563. #97778 (Pavel Kruglov).
- Correction de
Cannot schedule a fileLOGICAL_ERRORsur unINSERTdansDistributed, en raison d’une concurrence entreDROPetINSERT. #97822 (Azat Khuzhin). - Correction d’un crash/assert du serveur ClickHouse lors d’un appel à
mapContainsKey/mapContainsKeyLikeavec l’index de sauttokenbf_v1. #97826 (Shankar Iyer). - Correction des exceptions LOGICAL_ERROR causées par
LowCardinalitydans des types composés (Variant,Dynamic,Tuple) dansconcatWithSeparator,format, les sous-requêtesIN,GLOBAL INet les jointures avec runtime filters. #97831 (Raúl Marín). - Correction de l’exception
LOGICAL_ERRORChunk info was not set for chunk in MergingAggregatedTransformlors de l’utilisation deARRAY JOINavec la table functionmerge()sur plusieurs tables Distributed combinées avecGROUP BY. #97838 (Raúl Marín). - Correction d’un plantage du serveur (
std::terminate) provoqué par une exception non interceptée dans le destructeur du pool de connexions HTTP lorsque la limite stricte du groupe de connexions est atteinte en cas de forte concurrence. L’exceptionHTTP_CONNECTION_LIMIT_REACHEDpouvait s’échapper de~PooledConnectionlors du retour d’une connexion dans le pool, entraînant unSIGABRT. #97850 (Antonio Andelic). - Correction d’un résultat incorrect lorsque l’algorithme
grace_hashest utilisé avec des jointures non équi et que le bloc de gauche ne peut pas être traité entièrement en raison des contraintes de taille sur le résultat de la jointure. #97866 (János Benjamin Antal). - Correction d’une dégradation des performances dans l’analyse des métadonnées DeltaLake introduite dans #96686. #97880 (Kseniia Sumarokova).
- Correction d’une data race dans le client ZooKeeper entre sendThread et receiveThread. #97887 (Pablo Marcos).
- Correction d’un bug qui empêchait l’utilisation d’une CTE avec des insertions distribuées via SELECT. Suite de https://github.com/ClickHouse/ClickHouse/pull/87789. Clôt #95837. #97889 (Yarik Briukhovetskyi).
- Correction d’une exception levée par
CachedOnDiskReadBufferFromFile::readBigAt. Clôt #97325. #97890 (Kseniia Sumarokova). - Correction de l’exception
LOGICAL_ERRORdans le moteurAliasavec des colonnes matérialisées, due à une incompatibilité entre colonnes. Clôt #97907. #97921 (Kai Zhu). - Correction d’une perte de données de Keeper après redémarrage lors de l’utilisation d’Azure Blob Storage avec les métadonnées
s3_plainpour le stockage des logs. #97987 (Antonio Andelic). - Correction d’une mauvaise compilation JIT de la fonction
signpour les types entiers plus larges queInt8: les valeurs en dehors de l’intervalle -128..127 pouvaient produire un signe incorrect. #98012 (Alexey Milovidov). - Correction de l’exception
DUPLICATE_COLUMNet de NULL silencieux lors de la lecture de tables Delta Lake utilisant le mode de mappage de colonnes “name” avec des champs de struct dont les noms contiennent des points (par ex.STRUCT<`a.foo`: STRING, `b.foo`: STRING>). #98013 (Caio Ishizaka Costa). - Correction d’une mutation après une lightweight update et des index secondaires. #98044 (Raúl Marín).
- Correction d’un résultat incorrect pour les requêtes FINAL lors du mélange de skip indexes sur clé primaire et hors clé primaire. #98097 (Raúl Marín).
- Application des vérifications
READ ON FILEpour le scalaire file() et DESCRIBE TABLE file(). #98115 (Nikolay Degterinsky). - Corrige un crash où l’exécution d’une requête sur des fichiers avec un motif glob (par exemple,
file('dir/**', 'LineAsString')) levait une exception du système de fichiers non gérée (STD_EXCEPTION) si le répertoire contenait un lien symbolique orphelin. Les liens symboliques orphelins sont désormais ignorés silencieusement, et la requête renvoie les résultats de tous les fichiers valides. #98143 (Mark Andreev). - Corrige un segfault dans l’optimisation du plan de requête lors de la conversion d’une jointure externe en jointure interne avec
arrayJoindans une expression de filtre. #98147 (Alexey Milovidov). - Corrige le dysfonctionnement du format
ProtobufListavec le moteur Kafka, dû au fait que l’état de lecture n’était pas réinitialisé entre les messages. #98151 (Alexey Milovidov). - Corrige une erreur logique avec analyzer_compatibility_join_using_top_level_identifier et ARRAY JOIN, clôt #98164. #98179 (Vladimir Cherkasov).
- Définit le composant
Watchpour les réponses watch dansaggregated_zookeeper_logau lieu de le laisser vide. #98202 (Antonio Andelic). - Si les colonnes de la clé de partition ne sont pas incluses dans la clé de tri, l’élagage des partitions pouvait ignorer à tort des partitions contenant des lignes qui auraient dû être retenues lors de la déduplication FINAL. #98242 (Yarik Briukhovetskyi).
- Corrige l’erreur logique “Bad cast from type DB::ColumnConst to DB::ColumnArray” dans
kql_array_sort_asc/kql_array_sort_desclorsqu’elles sont appelées avec des arguments de tableau constants. #98251 (Alexey Milovidov). - Corrige un accès hors limites dans
ColumnConst::getExtremesqui pouvait provoquer un crash lorsqueextremes = 1est activé. #98263 (Alexey Milovidov). - Corrige un interblocage potentiel lorsque deux opérations concurrentes
MOVE PARTITIONtravaillent sur la même paire de tables dans des directions opposées. #98264 (Alexey Milovidov). - Le serveur HTTP renvoie désormais un message d’erreur dans le corps de la réponse pour les réponses 400 Bad Request causées par des en-têtes mal formés, au lieu d’un corps vide. #98268 (Alexey Milovidov).
- Corrige des résultats erronés avec l’analyse d’index distribuée (fonctionnalité expérimentale) et le cache des conditions de requête. #98269 (Azat Khuzhin).
- Corrige l’exception LOGICAL_ERROR “Invalid binary search result in
MergeTreeSetIndex” déclenchée par la conversiontoDatesur des colonnes de clé contenant des données franchissant le seuil de 65535. #98276 (Alexey Milovidov). - Corrige l’exception
LOGICAL_ERRORlorsqu’une RIGHT JOIN encapsulée dans une CROSS JOIN est permutée par l’optimisationquery_plan_join_swap_tabledans le chemin de code hérité de l’étape de jointure. #98279 (Alexey Milovidov). - Vérifie les données corrompues lors de la désérialisation de
DDSketchafin d’éviter les segfaults, les exceptions, les boucles infinies et les OOM lors de la lecture d’états de fonctions d’agrégationquantilesDDcorrompus. #98284 (Alexey Milovidov). - Corrige LOGICAL_ERROR “Trying to execute PLACEHOLDER action” lorsque des colonnes corrélées issues de requêtes englobantes sont référencées à l’intérieur de fonctions lambda telles que
arrayMap. #98285 (Alexey Milovidov). - Corrige une exception d’erreur logique dans
caseWithExpressionlorsque l’expressionCASEimpliquematerialize(NULL)ou d’autres argumentsNullable(Nothing). #98290 (Alexey Milovidov). - Corrige une exception de conversion de type incorrecte lors du filtrage de la colonne virtuelle
_tabledans la fonction de tablemerge. #98291 (Alexey Milovidov). - Corrige un échec sporadique de déduplication où des réinsertions étaient dédupliquées à tort en raison d’un ordre de nettoyage incohérent entre les répertoires ZooKeeper
blocks/etdeduplication_hashes/. #98293 (Alexey Milovidov). - Corrige une exception lorsque
ORDER BY ... WITH FILLest utilisé avecLIMIT BY. #98361 (Alexey Milovidov). - Corrige une corruption silencieuse des données lors de l’insertion d’une colonne Parquet/Arrow
Datedans une colonneEnum— la conversion de type incompatible est désormais correctement rejetée au lieu de stocker des valeurs d’énumération invalides. #98364 (Alexey Milovidov). - Corrige une exception lors de la lecture d’un fichier Arrow avec une colonne
Arraydans une table comportant une colonneNested. #98365 (Alexey Milovidov). - Corrige les mutations
MATERIALIZE INDEXetMATERIALIZE PROJECTIONqui restaient bloquées lorsque l’index ou la projection était supprimé avant la fin de la mutation. #98369 (Alexey Milovidov). - Corrige une exception lors de la lecture depuis
Nullable(Tuple(...))lorsqu’un nom d’élément de Tuple entre en conflit avec la sous-colonne Nullablenull. #98372 (Alexey Milovidov). - Corrige l’exception “Column … query tree node does not have valid source node” lors d’une jointure entre une table
Merge(encapsulant une tableDistributed) et une autre table. #98376 (Alexey Milovidov). - Corrige la conversion incorrecte de Parquet
BoolversFixedStringdans le lecteur natif V3, qui produisait des octets bruts au lieu d’une représentation textuelle. #98378 (Alexey Milovidov). - Corrige
tryGetColumnDescriptionpour filtrer les sous-colonnes selon la nature de la colonne parente, de manière cohérente avec les autres méthodes de recherche de colonnes. #98391 (Alexey Milovidov). - Accepte les informations d’identification base64 sans padding dans l’authentification HTTP Basic. Certains clients HTTP omettent le caractère de padding final
=dans l’en-têteAuthorization: Basic, ce qui provoquait auparavant des échecs d’authentification. #98392 (Amos Bird). - Correction de résultats incorrects de partition pruning après la fusion de parts avec des colonnes de clé de partition
Nullable, en raison de bornes erronées dans l’index min-max. #98405 (Amos Bird). - Correction d’une exception rare dans l’exécuteur du pipeline, pouvant se manifester par
Received signal 6(uniquement dans les versions de débogage), lorsque l’expansion du pipeline entrait en concurrence avec l’annulation de la requête. #98428 (Alexey Milovidov). - Correction de l’exception “Column identifier is already registered” lorsque
count_distinct_optimizationest utilisé avec une clauseQUALIFY. #98433 (Alexey Milovidov). - Correction de l’exception “cannot be inside Nullable type” lors de l’utilisation de
IN/NOT INavec des arguments de colonneLowCardinality(par ex.a NOT IN (b)oùaestLowCardinality(String)). #98443 (Alexey Milovidov). - Correction de l’exception “Pipeline stuck” dans les jointures
full_sorting_merge, causée par un interblocage dansPingPongProcessorlorsque l’optimisationFilterBySetOnTheFlycréait une dépendance circulaire avecMergeJoinTransform. #98454 (Alexey Milovidov). - Correction de l’exception
LOGICAL_ERROR“Projection cannot increase the number of rows in a block” lors de la fusion de parts avec un TTL qui supprime toutes les lignes et une projection d’agrégation avec une cléGROUP BYconstante. #98458 (Alexey Milovidov). - Correction d’une exception d’erreur logique lorsque
CROSS JOINest utilisé avecINNER JOIN USING. #98459 (Alexey Milovidov). - Correction d’un déréférencement de pointeur nul dans
dictGetOrDefaultlorsque l’argument de clé estNullable. #98460 (Alexey Milovidov). - Correction d’une exception dans les requêtes
DISTINCTlors de l’utilisation de projections d’agrégation, lorsquematerializeprovoque des différences de typeLowCardinalityentre la requête et la projection. #98462 (Alexey Milovidov). - Correction de l’exception LOGICAL_ERROR lorsque
arrayJoinest utilisé dans une expression de filtre avec OUTER JOIN etjoin_use_nullsactivé. #98464 (Alexey Milovidov). - Correction d’une exception d’erreur logique “Replica decided to read in WithOrder mode, not in ReverseOrder” lors de l’utilisation de répliques parallèles avec
optimize_aggregation_in_order. #98467 (Alexey Milovidov). - Correction d’un problème où ClickHouse Keeper déconnectait les clients Java ZooKeeper après une requête
addWatch. Le client Java attend un corpsErrorResponsede 4 octets dans la réponse àaddWatch, mais Keeper envoyait un corps vide, provoquant uneEOFExceptionet la déconnexion de la session. Cela cassaitCuratorCached’Apache Curator ainsi que toute application Java utilisant des watches persistants. Corrige #98079. #98499 (Antonio Andelic). - Correction des métriques Keeper
zk_followersetzk_synced_followers, qui ne diminuaient pas lorsqu’un follower tombait en panne. Ajout des nouvelles métriqueszk_learnersetzk_synced_non_voting_followersà la commande à quatre lettresmntr. Corrige #54173. #98504 (Antonio Andelic). - Correction d’une exception LOGICAL_ERROR dans
renameAndCommitEmptyPartsqui pouvait survenir lorsqueTRUNCATE TABLEs’exécute en concurrence avecOPTIMIZE TABLElors de l’utilisation de transactions MergeTree. #98508 (Alexey Milovidov). - Correction du port Raft sécurisé de Keeper, qui ignorait
cipherListetdhParamsFilede la configurationopenSSLet utilisait toujours les valeurs par défaut au lieu de celles spécifiées par l’utilisateur. Ferme #51188. #98509 (Antonio Andelic). - Correction de messages de log Keeper trompeurs tels que “Receiving request for session X took 9963 ms”, où le temps indiqué correspondait en réalité à une attente inactive dans
poll()entre les heartbeats, et non à l’exécution de l’opération elle-même. Corrige #79026. #98510 (Antonio Andelic). - Correction d’un résultat inattendu avec read_in_order_use_virtual_row et les fonctions monotones, ferme #97837. #98514 (Vladimir Cherkasov).
- Correction de
LOGICAL_ERROR: Not-ready Set is passed as the second argument for function 'in'lors de l’utilisation dePREWHEREavec une sous-requêteINsur des tables MergeTree. #98522 (Alexey Milovidov). - Correction des connexions TCP de Keeper qui empêchaient l’arrêt gracieux du serveur en ne répondant pas au signal d’arrêt. #98525 (Alexey Milovidov).
- Correction de l’exception “Sorting column wasn’t found in the ActionsDAG’s outputs” lorsque
query_plan_convert_join_to_inest activé avecquery_plan_merge_expressions = 0. #98526 (Alexey Milovidov). - Correction de l’échec de la source de dictionnaire MongoDB avec les named collections. Ferme #97840. #98528 (Pablo Marcos).
- Correction de LOGICAL_ERROR lorsque Identifier est vide après substitution des paramètres. #98530 (Pervakov Grigorii).
- Correction d’un interblocage du pipeline lors de l’utilisation de
sort_overflow_mode = 'break'avec des fonctions de fenêtre. #98543 (Alexey Milovidov). - Correction du rollback de colonne dans le moteur Buffer lors du traitement d’une exception pendant l’ajout d’un nouveau block. L’ancienne logique pouvait entraîner un état en mémoire corrompu des colonnes. #98551 (Pavel Kruglov).
- Correction de l’exception
Bad cast from type ColumnConst to ColumnDynamicdans la comparaison null-safe (<=>/IS NOT DISTINCT FROM) avec des colonnesDynamicouVariantconstantes etNULL. Correction également deIS DISTINCT FROMavecDynamic/VariantvsNULL, qui renvoyait auparavant toujours 0 à tort. #98553 (Alexey Milovidov). - Correction de l’utilisation de l’index de texte avec d’autres skip indexes. Auparavant, des logical errors telles que “Trying to get non-existing mark” pouvaient être levées lorsqu’un filtre de requête utilisait simultanément un index de texte et d’autres skip indexes classiques. #98555 (Anton Popov).
- Correction de la logical error “TABLE_FUNCTION is not allowed in expression context” lorsqu’une table function avec un alias apparaît plusieurs fois dans le même scope de requête (par exemple dans les clauses
PREWHEREetQUALIFY). #98557 (Alexey Milovidov). - Correction de la distributed index analysis avec des expressions (et pas seulement des colonnes) dans la PK (ce qui entraînait l’absence de filtrage des granules redondants sur les répliques distantes). #98561 (Azat Khuzhin).
- Interdiction de supprimer une colonne lorsque ses subcolumns sont utilisées dans les expressions default/alias d’autres colonnes, et utilisation de l’analyzer pour les expressions par défaut lors d’un alter drop column. #98569 (Nikita Mikhaylov).
- Correction des requêtes S3 réessayées à tort sur des erreurs non réessayables (y compris
HTTP_CONNECTION_LIMIT_REACHED) dans le client HTTP. #98598 (Sema Checherinda). - Correction d’un overflow decimal lors du partition pruning avec DateTime64. #98628 (Yarik Briukhovetskyi).
- Correction de deux bugs dans la compilation JIT d’expression : une erreur de copier-coller dans le type checking de
nativeCastqui rendait inaccessibles les branches de cast entier-vers-entier et float-vers-float, ainsi qu’unnullptrTargetMachine incorrect transmis à LLVMPassBuilder, empêchant l’enregistrement des passes d’optimisation spécifiques à la cible. #98660 (Alexey Milovidov). - Correction d’un contournement RBAC qui permettait aux utilisateurs de DESCRIBE n’importe quelle table via
remote(),remoteSecure(),cluster()ouclusterAllReplicas()pointant vers localhost, sans nécessiter le privilegeSHOW_COLUMNS. #98669 (pufit). - Correction de l’exception
BAD_GETet de résultats de requête incorrects lorsqu’une expression non booléenne (par ex.sin(col)) est utilisée à la fois dans WHERE et SELECT avec un JOIN, en raison d’une optimisation de filter push-down corrompant des nœuds DAG partagés. #98681 (Alexey Milovidov). - Correction de LOGICAL_ERROR “Replica decided to read in Default mode, not in WithOrder” lors de l’utilisation de
read_in_order_through_joinavec des parallel replicas. #98685 (Alexey Milovidov). - Correction de l’exception “Bad cast from type
DB::TableFunctionNodetoDB::QueryNode” lors de l’utilisation de la table functioninputcomme argument deremote. #98694 (Alexey Milovidov). - Correction de la résurrection d’outdated data parts causée par un nettoyage incorrect de covering parts vides. #98698 (Shaohua Wang).
- Correction d’une exception dans
LogicalExpressionOptimizerPasslorsqu’une fonction booléenne dans une comparaisonequalsrenvoie un typeVariant. #98712 (Alexey Milovidov). - Correction de
parseDateTimeBestEffort, qui analysait incorrectement les mots commençant par des préfixes de mois ou de jours de la semaine. Résout #97965. #98742 (Pavel Kruglov). - Correction de l’exception
UNKNOWN_IDENTIFIERlors des requêtes sur la fonction de tablemerge()ou le moteurMergeappliqués à des tables avec des colonnes JSON ayant des paramètres différents (par ex. des champsSKIPdifférents) et des colonnes ALIAS référençant des sous-chemins JSON, avec le nouvel analyseur activé. Résout #97812. #98753 (Pavel Kruglov). - Correction de l’optimisation
optimize_skip_unused_shardsavec l’analyseur lorsque le stockageDistributedest utilisé dans uneView. #98754 (Nikolai Kochetov). - Correction de l’accès aux sous-colonnes d’un tuple par leur nom (par ex.
SELECT x.apourTuple(a UUID, b Int32)) pour les tables externes transmises via--externaldansclickhouse-client. Résout #96925. #98755 (Pavel Kruglov). - Correction de l’exception
reverseUTF8sur une entrée UTF-8 invalide (tronquée). #98770 (Alexey Milovidov). - Correction de la détection de l’utilité d’un skip index de type Set avec un prédicat OR avec false (c.-à-d. or(x, 0)). #98776 (Azat Khuzhin).
- Correction d’une exception
LOGICAL_ERROR(incompatibilité de structure de block dansremoveUnusedColumns) pouvant se produire avecFINAL+PREWHERE+ une expressionWHEREconstante + des agrégats indépendants des colonnes commecount(). #98778 (Alexey Milovidov). - Les entrées de
system.trace_logpour les rechargements automatiques des Dictionaries ClickHouse ont désormais des Query id non vides. #98784 (Miсhael Stetsyuk). - Correction d’un crash pouvant entraîner le déréférencement d’un pointeur nul dans des tables système créées entre le moment où un instantané des tables est pris dans l’appel
IDatabaseTablesIterator::table()et celui où les tables sont modifiées par un autre thread lors d’une itération ultérieure. #98792 (Grant Holly). - Correction de
SYSTEM START REPLICATED VIEW, qui ne réveillait pas la tâche de refresh. #98797 (Pablo Marcos). - Correction de l’exception “Inconsistent table names” lors de l’utilisation de la fonction de table
view()contenant des JOIN imbriqués dans un autre JOIN (uniquement avec l’ancien analyseur). #98809 (Alexey Milovidov). - Correction de l’ajustement de RLIMIT_SIGPENDING (via pending_signals). #98829 (Azat Khuzhin).
- Correction d’une exception lors de la composition de
loopavec des cluster table functions. #98860 (Konstantin Bogdanov). - LEFT ANTI JOIN avec plusieurs colonnes de clé de jointure renvoyait des résultats incorrects lorsque
enable_join_runtime_filters=1(valeur par défaut). #98871 (Alexander Gololobov). - Correction de
WITH FILL STALENESS, qui produisait des lignes remplies en trop lorsque les données étaient lues en plusieurs chunks (par ex. avec unindex_granularityfaible). #98895 (Alexey Milovidov). - Correction de l’erreur LOGICAL_ERROR « RPNBuilderFunctionTreeNode has A arguments, attempted to get argument at index B ». #98900 (Azat Khuzhin).
- Correction d’une dérive du suivi mémoire causée par l’absence de rollback après des allocations échouées, par le comportement indéfini de
nallocx(0)et par une erreur de décalage d’une unité dans le suivi du pic global. Extension du suivi pour couvrir les buffers circulairesio_uring. #98915 (Antonio Andelic). - Interdiction d’attacher des tables locales de data lake en dehors des chemins utilisateur, et pas seulement d’en créer. #98936 (Daniil Ivanik).
- Correction d’une race condition pouvant provoquer une exception « ReadBuffer is canceled » dans les requêtes utilisant
urlClusterou des cluster table functions similaires. #98955 (Alexey Milovidov). - Correction de l’exception
LOGICAL_ERRORdans les fonctions financières (financialNetPresentValue,financialInternalRateOfReturn, etc.) lorsque des arguments de typeBFloat16sont passés. #98958 (Alexey Milovidov). - Correction du fait que les skip indexes (et les conditions de clé primaire) n’étaient pas appliqués aux colonnes ALIAS lorsque la fusion des expressions du query plan est désactivée (
query_plan_merge_expressions = 0ouquery_plan_enable_optimizations = 0). #98960 (Peng). - Incrémente
InsertQueryProfileEvent pour les async inserts. Clôt #98626. #98962 (Narasimha Pakeer). - Correction de l’exception « Inconsistent KeyCondition behavior » dans les builds de débogage lorsque la clé primaire contient des valeurs flottantes NaN, en faisant en sorte que
accurateLessetaccurateEqualstraitent NaN de manière cohérente avec l’ordre de tri de ClickHouse. Clôt #98075. #98964 (Alexey Milovidov). - SummingMergeTree n’additionne plus les colonnes Bool (ni les autres colonnes de type domain). Les valeurs Bool sont conservées telles quelles au lieu d’être additionnées arithmétiquement. #98976 (Yash ).
- Correction de l’exception Scalar doesn’t exist qui se produisait lors de l’interrogation d’un shard distant avec
optimize_const_name_sizeactivé etenable_scalar_subquery_optimization= 0. Les grandes constantes remplacées par des références__getScalardans la requête distante n’étaient pas envoyées au shard, ce qui provoquait l’échec de la requête. #98979 (andriibeee). - Corrige
NOT_FOUND_COLUMN_IN_BLOCKpour certaines requêtes avecGROUP BYet des expressions incluant une recherche inverse dans un Dictionary, des comparaisons de conversionDate/DateTimeet des comparaisons de tuples. Clôt #98888. #98980 (Nihal Z. Miaji). - Correction d’un comportement indéfini (déréférencement de pointeur nul) lors de la modification d’une colonne version/sign/is_deleted en
EPHEMERALouALIASdans les moteurs MergeTree. De telles modifications sont désormais correctement rejetées. #98985 (Alexey Milovidov). - Correction d’un problème où
system.grantsomettait les paramètres d’expression régulière pour les privilègesURLetS3dans la colonneaccess_object. #98987 (DQ). - Correction des lectures Iceberg BigLake : les identifiants ADC sont désormais transmis au client GCS S3 (ce qui corrige les erreurs 403), les identifiants OAuth2 sont encodés dans l’URL avant l’envoi (ce qui corrige les échecs d’authentification pour les jetons contenant des caractères spéciaux), et le parcours des espaces de noms ne s’interrompt plus sur les réponses HTTP 400 de BigLake. #98998 (Nikita Fomichev).
- Correction de
clickhouse-clientqui ne parvenait pas à changer de fuseau horaire lorsque la variable d’environnementTZutilisait une syntaxe de chemin de fichier POSIX (par ex.TZ=:/etc/localtime). #99000 (Yash ). - Corrige un pruning incorrect ou insuffisant lorsque
startsWith,LIKEetNOT LIKEsont utilisés avec une colonneFixedString. De plus, la fonction de transtypage deFixedStringversStringpeut désormais effectuer le pruning des granules lorsqu’elle est appliquée à une colonne clé. Clôt #98940. #99001 (Nihal Z. Miaji). - Correction de
windowFunnelavecstrict_deduplication, qui renvoyait un niveau incorrect lorsqu’un événement dupliqué était rencontré. #99003 (Yash ). - Corrige un bug où EXISTS ignorait les clauses LIMIT et OFFSET dans les sous-requêtes, provoquant des résultats incorrects lorsque la sous-requête ne renvoyait aucune ligne en raison d’un offset ou d’une limite à zéro. Clôt #88722. #99005 (andriibeee).
- Corrige l’exception “Block structure mismatch” lorsque l’optimisation de descente de filtre rencontre une expression AND qui se résout par court-circuit en une constante avec
GROUPING SETS. #99010 (Alexey Milovidov). - Corrige une exception lors de la lecture de patch parts (lightweight updates) sans colonne
_part_offsetdans le plan de requête. #99023 (Alexey Milovidov). - Une requête comme
SELECT * FROM table WHERE pk_id = '', oùpk_idest la clé primaire et de typeString, utilisera désormais correctement l’index de clé primaire pour filtrer les granules. #99027 (Shankar Iyer). - Corrige l’exception
DEPENDENCIES_NOT_FOUNDdans le moteur Kafka lorsqu’une vue matérialisée est détachée pendant que le thread d’arrière-plan traite un flux de données. #99028 (Alexey Milovidov). - Corrige une exception lors de la création d’une table avec une colonne
EPHEMERALportant le même nom qu’une colonne virtuelle (par ex._part_offset). #99031 (Alexey Milovidov). - Corrige le message trompeur “inflate failed: buffer error” lors de la lecture de fichiers compressés inexistants via la fonction de table
url()avec des motifs glob. Renvoie désormais un résultat vide, comme prévu, lorsquehttp_skip_not_found_url_for_globsest activé. #99034 (Alexey Milovidov). - Corrige un plantage du serveur (std::terminate) lors de l’exécution de
ALTER TABLE ... DROP PARTsur une patch part après une modification du schéma (par ex. ADD COLUMN). Le plantage était dû à l’absence de colonnes système (_part) dans les métadonnées de la coverage part vide, ce qui entraînait une exception non interceptée à l’intérieur d’un NOEXCEPT_SCOPE. #99036 (Peng). - Le processus du serveur ClickHouse pouvait planter si une exception de dépassement de memory limit était levée pendant une lecture disque mise en cache. Ce problème est désormais corrigé. #99042 (Shankar Iyer).
- Corrige
LOGICAL_ERRORlors de l’interrogation d’une table comportant à la fois une ROW POLICY et une colonne ALIAS avecdictGet. Le problème était dû à un accès prématuré à l’expression de table pendant la résolution de la colonne ALIAS dans le nouvel analyseur. #99065 (Peng). - Corrige une erreur de dépassement de limites lorsque l’utilisateur tente d’interroger uniquement des colonnes virtuelles d’une table Iceberg avec le format Avro pour les données. Il s’agit d’un scénario extrêmement rare, donc il n’est pas considéré comme critique. Corrige #88238. #99080 (alesapin).
- Corrige un segfault dans un CTE récursif avec
remote()+view(). #99081 (Konstantin Bogdanov). - Ignore l’analyse d’index supplémentaire inutile lorsque l’optimisation read-in-order est appliquée. #99084 (Vladimir Cherkasov).
- Corrige un plantage déclenché par une exception de memory limit levée pendant l’application d’une patch part. #99086 (Anton Popov).
- Corrige une assertion de débogage dans
DDLWorker, causée par unfirst_failed_task_nameobsolète après la suppression d’une entrée ZooKeeper pendant la récupération après réinitialisation. #99099 (Antonio Andelic). - Corrige la reconstruction des index de texte lors des merges avec TTL. #99107 (Anton Popov).
- Corrige un plantage dans la query
ALTER TABLE ... REMOVE SETTINGSpour le table engine Iceberg. Corrige #86330. #99108 (alesapin). - Corrige un bug dans l’optimisation
query_plan_convert_any_join_to_semi_or_anti_join, qui renvoyait un résultat incorrect pour les lignes sans correspondance. Lié à : https://github.com/ClickHouse/ClickHouse/pull/95995. #99112 (Yarik Briukhovetskyi). - Corrige l’exception LOGICAL_ERROR dans
ASTColumnsExceptTransformer::transform. #99119 (Pablo Marcos). - Corrige un contournement du RBAC qui permettait aux utilisateurs d’obtenir la structure d’une table via
DESCRIBE TABLEouCREATE TABLE ASsur des fonctions de table (mysql(),postgresql(),sqlite(),arrowFlight(),jdbc(),odbc(), etc.) sans disposer des privilèges d’accès à la source requis. Pour les fonctions qui déduisent le schéma à partir de serveurs distants, cela permettait aussi de déclencher des connexions sortantes (SSRF) sans autorisation. #99122 (pufit). - Corrige un crash de Keeper (segfault dans NuRaft) lors d’une reconfiguration dynamique et d’un transfert de leadership. #99133 (JIaQi Tang).
- Corrige un crash lors de l’utilisation d’une Buffer table avec SAMPLE lorsque la destination ne le prend pas en charge. #99141 (Kseniia Sumarokova).
- Corrige une LOGICAL_ERROR due à un ordre de colonnes incohérent dans les patch parts. #99164 (Pablo Marcos).
- Corrige un crash très rare lorsqu’une Iceberg table contient des fichiers de formats mixtes (ORC et Parquet). Corrige #88126. #99168 (alesapin).
- Corrige le fait que max_execution_time ne s’appliquait pas aux opérations de backup/restore. #99205 (Kseniia Sumarokova).
- Corrige le fait que
insert_deduplication_tokenétait ignoré silencieusement pour les requêtesINSERT SELECTsansORDER BY ALL. Auparavant, la déduplication était entièrement désactivée pour lesINSERT SELECTnon triés, même lorsqu’un token utilisateur explicite était fourni. Désormais, fournirinsert_deduplication_tokensuffit à activer la déduplication, indépendamment deORDER BY ALL. #99206 (Desel72). - Corrige des vérifications d’accès excessives lors de l’optimisation
InverseDictionaryLookupPassen vérifiant l’autorisationCREATE_TEMPORARY_TABLEune seule fois avant le passage, au lieu de le faire pour chaque nœud visité. #99210 (Mikhail Artemenko). - Corrige
clickhouse format --obfuscate, qui produisait du SQL invalide en obscurcissant les types de skip index, les noms de compression codec, les noms de database engine et les définitions de dictionary layout/source. #99260 (Raúl Marín). - Corrige un bug où, dans certains cas, la comparaison entre les types Time[64] et DateTime[64] prêtait à confusion ; désormais, dans ce type de cas, les valeurs Time[64] sont converties en DateTime[64] en ajoutant
1970-01-01comme partie date. #99267 (Yarik Briukhovetskyi). - Applique les contraintes de settings dans le worker DDL pour les distributed DDL queries. #99317 (Pablo Marcos).
- Corrige des problèmes mineurs liés à l’authentification TOTP : l’option CLI
--one-time-passwordavec un mot de passe vide, ainsi que la validation des valeurs de configuration<digits>et<period>. #99322 (Vladimir Cherkasov). - Corrige l’erreur logique
unordered_map::at: key not founddans le format de sortie Avro lors de la sérialisation de colonnesEnum8/Enum16contenant des valeurs absentes de la définition de l’enum. #99332 (Desel72). - Correction de
CHECK TABLEavec une sérialisation sparse à l’intérieur deTupleavecDynamic. Closes #96588. #99351 (Pavel Kruglov). - Correction d’une validation trop stricte du préprocesseur d’index de texte. #99359 (Anton Popov).
- Correction de la compatibilité lors de la mise à niveau de tables répliquées avec des index minmax implicites de la version 25.10 vers des versions plus récentes. #99392 (Raúl Marín).
- Suppression de la prise en charge des fonctions négatives (
notEquals,notLike,notIn) dans l’analyse des index de texte. Ces fonctions ne pouvaient jamais ignorer de granules ; analyser l’index pour elles ne faisait donc qu’ajouter un surcoût, sans aucun bénéfice. #99393 (Anton Popov). - Correction de
optimize_skip_unused_shardsavec le nouvel analyseur lorsqu’une tableDistributedétait utilisée dans une sous-requêteIN. #99436 (Nikolai Kochetov). - Correction d’un heap-use-after-free dans
INTERSECT/EXCEPTlorsque la requête produit des noms de colonnes en double. #99471 (Alexey Milovidov). - Correction d’une erreur logique dans
ALTER TABLE ... DROP PARTlorsqu’un paramètre de requête typé est utilisé pour le nom de la part. #99489 (Alexey Milovidov). - Correction de l’exception
NOT_FOUND_COLUMN_IN_BLOCKlorsqu’un prédicat d’index de texte (par exemplehasAllTokens) est référencé à la fois dans les clausesSELECTetWHEREvia un alias. #99504 (Anton Popov). - Correction de résultats incorrects lors de l’utilisation de
hasAllTokensavecORsur des colonnes ayant des index de texte distincts. #99505 (Anton Popov). - Initialisation du page cache dans
clickhouse-localafin que le paramètrepage_cache_max_sizeprenne effet. #99510 (Alexey Milovidov). - Correction d’un rare marquage incorrect d’une part de données comme corrompue, suivi de son détachement après une requête
DETACH/ATTACH TABLE. #99529 (Anton Popov). - Correction de l’exception
std::length_errorlors de l’interrogation de tables système vides au format Pretty via l’interface HTTP. #99541 (Alexey Milovidov). - Correction de
LOGICAL_ERRORlors de l’utilisation deALTER TABLE ADD COLUMNpour créer une colonneEPHEMERALportant le même nom qu’une colonne virtuelle (par exemple_part_offset). #99549 (Alexey Milovidov). - Correction du fait que les entrées
VectorSimilarityIndexCachen’étaient jamais évincées après la suppression d’une part en raison d’une discordance des clés de cache. #99575 (Seva Potapov). - Interdiction de lire les credentials Google à partir d’un fichier local. Ce paramètre n’est pas sûr, car il permet de lire d’autres credentials si le chemin du fichier est connu. #99584 (Konstantin Vedernikov).
- Correction d’une dégradation des performances dans l’analyseur. Suppression des colonnes inutilisées dans ARRAY JOIN. #99587 (Dmitry Novik).
- Correction de la lecture de l’index de texte dans une table avec des lightweight deletes existants et des politiques de lignes. #99661 (Anton Popov).
- Correction d’un déréférencement de
nullptrdans le lecteur Parquet lorsque le chemin de filtrage dans le décodeur rencontre des pages filtrées. Clôt #99676. #99677 (Alexey Milovidov). - Correction d’un déplacement incorrect dans AsynchronousReadBufferFromFileDescriptor avec O_DIRECT. Clôt #99358. #99678 (Pavel Kruglov).
- Correction d’un heap-buffer-overflow dans
CompressionCodecT64et d’un arrêt du processus dansCompressionCodecMultiplelors de la décompression de données compressées mal formées. Ces deux problèmes ont été découverts par de nouvelles cibles libFuzzer. Les codecs lèvent désormais une exception au lieu de provoquer un plantage. #99680 (Rahul). - Le traitement est désormais retardé jusqu’à ce que le serveur ait terminé le chargement de toutes les tables. #99700 (Seva Potapov).
- Correction du contournement de
RemoteHostFilterpar la source de dictionnaire MySQL pour les paramètres DDL inline. #99720 (Shaohua Wang). - Correction d’une erreur logique lors de l’itération sur les tables du lac de données dans
system.tables. #99739 (Konstantin Vedernikov). - Correction de l’analyse des prédicats avec la fonction
INdans l’index de texte avec préprocesseur. Correction également d’une collision entre les tokens recherchés dans l’index de texte, qui pouvait entraîner des résultats incorrects. #99755 (Anton Popov). - Correction d’une boucle infinie lors de la lecture de fichiers au format
Npyavec des dimensions négatives dans la forme. #99812 (Desel72). - Correction d’un global-buffer-overflow dans la fonction
CRC32sur des argumentsFixedStringlorsqu’elle est évaluée avec zéro ligne pendant le calcul de l’en-tête du plan de requête. #99835 (Alexey Milovidov). - Correction d’un plantage (déréférencement de pointeur nul) lors de l’exécution de
ALTER TABLE ... MODIFY COLUMN ... COMMENTsur des tables Iceberg. #99838 (Desel72). - Correction du paramètre
aggregate_functions_null_for_emptypour qu’il fonctionne avec des fonctions d’agrégation renvoyant des types nonNullable, commeArrayouMap(par exemplegroupArray,sumMap). #99839 (Alexey Milovidov). - Correction de l’exception LOGICAL_ERROR dans la fonction
midpointlorsqu’elle est appelée avec un mélange de types entiers signés et non signés. #99867 (Alexey Milovidov). - Correction de l’exception “Block structure mismatch” dans les requêtes avec clause HAVING, lorsque l’expression de filtre contient à la fois un agrégat encapsulé dans une fonction produisant NULL et
materialize(0). #99915 (Alexey Milovidov). - Corrige l’échec d’assertion dans
sipHash128Keyed(et dans des fonctions de hachage avec clé similaires) lorsque l’argument de données est un Map dont les clés sont des tableaux ou d’autres types de tableaux imbriqués. #99921 (Alexey Milovidov). - Corrige l’exception
LOGICAL_ERROR“Not-ready Set” dans la fonctionINlors de l’optimisation du plan de requête avecconvertAnyJoinToSemiOrAntiJoin. #99939 (Alexey Milovidov).
Amélioration de la compilation/des tests/du packaging
- Réduction du temps de compilation par suppression d’inclusions lourdes de fichiers d’en-tête et déplacement des instanciations de modèles coûteuses hors des en-têtes. #97893 (Raúl Marín).
- Réduction du temps de compilation des fonctions arithmétiques et des en-têtes associés en réduisant les matrices de dispatch des modèles et en supprimant des inclusions lourdes. #98204 (Raúl Marín).
- Utilisation de
mongo-c-driver2.2.2. #98304 (Konstantin Bogdanov). - Utilisation de
postgresREL_18_3. #98306 (Konstantin Bogdanov). - Activation de l’allocateur jemalloc pour les builds UBSan afin d’éviter l’accumulation de RSS due au mauvais comportement de restitution de mémoire de malloc dans glibc. #98444 (Alexey Milovidov).
- Utilisation du mangling de symboles Rust v0 et suppression des symboles internes de la bibliothèque PRQL afin de réduire l’inflation des noms de symboles provenant des bibliothèques de combinators de parsing. #98446 (Alexey Milovidov).
- Ajout de la suite de benchmark TPC-H et du README TPC-DS à
tests/benchmarks. #98495 (Raufs Dunamalijevs). - Ajout de tests de correction pour les 99 requêtes TPC-DS. #99204 (Raufs Dunamalijevs).
- Ajout d’un test d’intégration reproduisant le bug d’une réplique hors ligne avec DDL CREATE TABLE + ALTER (#44070), marqué comme échec attendu. #99259 (Raufs Dunamalijevs).
- Intégration de jemalloc avec le préfixe
je_et suppression de l’utilisation de l’option —wrap de l’éditeur de liens. #99342 (Azat Khuzhin).
Version de ClickHouse 26.2, 2026-02-26. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- La déduplication est désormais activée par défaut pour tous les inserts. Elle était auparavant désactivée pour les async inserts et pour les MV, mais activée pour les sync inserts. L’objectif est d’avoir les mêmes valeurs par défaut pour les deux modes d’insert. Si vous avez explicitement désactivé la déduplication sur votre cluster, vous devez définir explicitement
deduplicate_insert='backward_compatible_choice'pour conserver l’ancien comportement. Même chose pourdeduplicate_blocks_in_dependent_materialized_views. #95970 (Sema Checherinda). - Format de stockage des statistiques amélioré. Toutes les statistiques sont désormais stockées dans un seul fichier. #93414 (Anton Popov). Si vous n’avez pas explicitement activé les statistiques de table, vous pouvez ignorer ce point.
- Limitation des métadonnées en mémoire de S3(Azure)Queue. Les system tables sont renommées de
azure_queueenazure_queue_metadata_cacheet desystem.s3queueens3queue_metadata_cache. #95809 (Kseniia Sumarokova). - Auparavant, l’application d’une fonction à une colonne
Variantrenvoyait silencieusement des NULL lorsqu’un sous-type de variant était incompatible avec la fonction ; désormais, une exception est levée, ce qui peut casser des requêtes qui reposaient sur ce comportement silencieux avec NULL. #95811 (Bharat Nallan). - Les colonnes
DATEprovenant de PostgreSQL sont désormais inférées commeDate32dans ClickHouse (dans les versions précédentes, elles étaient inférées commeDate, ce qui entraînait un overflow pour les valeurs hors d’une plage étroite). L’insertion de valeursDate32dans PostgreSQL est désormais autorisée. Closes #73084. #95999 (Alexey Milovidov). - La sémantique du paramètre
do_not_merge_across_partitions_select_finala été clarifiée. Auparavant, la fonctionnalité pouvait être activée automatiquement lorsque le paramètre n’était pas explicitement défini dans les configs. Cela a provoqué de la confusion à plusieurs reprises et, malheureusement, conduit à certains problèmes en production. Désormais, les règles sont plus simples :do_not_merge_across_partitions_select_final=1active la fonctionnalité sans condition. Sido_not_merge_across_partitions_select_final=0, alors le mode automatique est utilisé uniquement si le nouveau paramètreenable_automatic_decision_for_merging_across_partitions_for_final=1, et n’est pas utilisé sinon. Afin de préserver autant que possible l’ancien comportement, les valeurs par défaut ont été définies surdo_not_merge_across_partitions_select_final=0etenable_automatic_decision_for_merging_across_partitions_for_final=1. #96110 (Nikita Taranov). - Lors de la création d’une table S3 avec des colonnes explicitement spécifiées, ClickHouse vérifie désormais que ces noms de colonnes existent bien dans le schéma du fichier distant. Les requêtes qui fonctionnaient auparavant avec des noms de colonnes non concordants échoueront désormais au moment de la création de la table. This closes #96089. #96194 (Konstantin Vedernikov).
- Interdire l’utilisation de subqueries dans ORDER BY et les autres key expressions de table. #96847 (Alexey Milovidov).
- Activer
apply_row_policy_after_finalpar défaut. Initialement, lorsqueoptimize_move_to_prewhere_if_final=0, ROW POLICY et PREWHERE respectaient tous deux FINAL et étaient appliqués après FINAL. Ce comportement a été rompu par #87303, qui ignoraitoptimize_move_to_prewhere_if_finalpour le filtre ROW POLICY. Pour corriger cela, cette PR active le paramètreapply_row_policy_after_finalintroduit dans #91065. Avecapply_row_policy_after_finalactivé, ROW POLICY continuera par défaut à respecter FINAL, comme auparavant. Cette PR introduit un changement non rétrocompatible, car elle modifie le comportement pouroptimize_move_to_prewhere_if_final=1. Désormais, pour que ROW POLICY soit appliqué avant FINAL, il faut utiliserapply_row_policy_after_finalau lieu deoptimize_move_to_prewhere_if_final. #97279 (Nikolai Kochetov). - Le type
Dateest désormais sérialisé en tant que type natifdate32d’Arrow dans les formats Arrow/ArrowStream, au lieu deuint16. Des outils comme PyArrow reconnaîtront désormais correctement la colonne comme étant de type date. L’ancien comportement peut être restauré avec le paramètreoutput_format_arrow_date_as_uint16. La lecture des anciens fichiers Arrow qui utilisaientuint16pour les colonnesDatereste prise en charge. #96860 (Alexey Milovidov).
Nouvelle fonctionnalité
- Les utilisateurs peuvent désormais utiliser ClickStack (une UI d’observability) directement depuis ClickHouse, ce qui est utile pour le débogage et le développement local. #96597 (Aaron Knudtson).
- Prise en charge du mot de passe à usage unique basé sur le temps (TOTP) comme méthode d’authentification. #71273 (Vladimir Cherkasov).
- Ajout du paramètre de base de données
lazy_load_tables. Lorsqu’il est activé, les tables ne sont pas chargées au démarrage de la base de données — unStorageTableProxyléger est créé à la place et le véritable table engine est matérialisé lors du premier accès. #96283 (xiaohuanlin). - Ajout du paramètre
input_format_max_block_wait_mspour émettre des blocs de données en cas de timeout et autorisation du traitement des données restantes lorsqu’une connexion HTTP est fermée de manière inattendue. #94509 (Mostafa Mohamed Salah). - Intégration du catalog Google BigLake. Cela clôt #95339. #97104 (Konstantin Vedernikov).
- Ajout de la table système
system.tokenizers, qui affiche tous les tokenizers disponibles. #96753 (Robert Schulze). - Ajout de la nouvelle table système
system.user_defined_functionspour surveiller l’état de chargement et la configuration des UDF. #90340 (Xu Jia). - Ajout de la table
system.jemalloc_stats, qui expose les statistiques de l’allocateur mémoire jemalloc (viamalloc_stats_print) afin de diagnostiquer l’utilisation mémoire sur les serveurs compilés avec jemalloc. Ajout également d’un endpoint HTTP/jemalloc.htmlsur la ClickHouse HTTP interface pour une visualisation interactive de ces statistiques. #97077 (Antonio Andelic). - Ajout de la table
system.jemalloc_profile_textpour lire et analyser les heap profiles jemalloc. Le format de sortie est contrôlé par le paramètrejemalloc_profile_text_output_format(raw, symbolized ou collapsed ; collapsed par défaut). La résolution des frames inline est contrôlée parjemalloc_profile_text_symbolize_with_inline(lorsqu’il est activé, les frames inline sont incluses au prix d’une symbolization plus lente ; lorsqu’il est désactivé, elles sont ignorées pour une sortie plus rapide). Pour le format collapsed,jemalloc_profile_text_collapsed_use_countcontrôle si les stacks sont pondérées par le nombre d’allocations actives (true) ou par les octets actifs (false, par défaut). Cela facilite le profiling mémoire et la visualisation en flame graph des heap profiles jemalloc. Corrige #93248. #97218 (Antonio Andelic). - Ajout du paramètre
default_dictionary_database, qui permet à ClickHouse de résoudre les external dictionaries référencés sans qualificatif de base de données dans une base de données par défaut spécifiée. Cela simplifie la migration des dictionaries globaux définis en XML vers des dictionaries par base de données définis en SQL, permettant ainsi aux requêtes de dictionnaire existantes (par ex. dictGet(‘name’, …)) de continuer à fonctionner sans modification. #91412 (Dmitrii Plotnikov). - Prise en charge de ZooKeeper auxiliaire pour
DatabaseReplicated. #91683 (RinChanNOW). - Implémentation de la nouvelle table function
primeset de la nouvelle table systèmesystem.primes, qui contient des nombres premiers par ordre croissant. Clôt #90839. #92776 (Nihal Z. Miaji). - Les async inserts prennent en charge le quorum parallèle. Les données insérées sont répliquées sur le quorum. Si des doublons sont détectés, la requête attend que les données précédemment insérées soient elles aussi répliquées. #93356 (Sema Checherinda).
- Ajout des fonctions
colorOKLABToSRGBetcolorSRGBToOKLABpour convertir une valeur de sRGB vers OKLAB et inversement. #93361 (Pranav Tiwari). - Nouveau paramètre
deduplicate_insert, qui remplaceinsert_deduplicateetasync_insert_deduplicate. #94413 (Sema Checherinda). - Le paramètre serveur
insert_deduplication_versionpermet de migrer vers un hash de déduplication unifié. #95409 (Sema Checherinda). - Ajout de la fonction de hachage
xxh3_128. #96055 (Raúl Marín). - Ajout de la requête
OPTIMIZE <table> DRY RUN PARTS <part names>pour simuler des merges sans valider la part résultante. Cela peut être utile à des fins de test : vérifier la validité des merges dans la nouvelle version, reproduire de manière déterministe des bogues liés aux merges et mesurer de manière fiable les performances des merges. #96122 (Anton Popov). - Ajout d’une nouvelle vérification activée par défaut via le paramètre
check_named_collection_dependenciesafin d’éviter la suppression de named collections utilisées par des tables. #96181 (Pablo Marcos). - Ajout de
system.fail_pointspour inspecter les failpoints existants sur le serveur et voir s’ils sont activés ou non. Cela aidera à automatiser les tests. #96762 (Pedro Ferreira). - Ajout de l’accès basé sur les rôles au Glue catalog. Utilisez les paramètres
aws_role_arnet, éventuellement,aws_role_session_name. #90825 (Antonio Andelic). - Ajout d’un paramètre
add_minmax_index_for_temporal_columnsqui, lorsqu’il est activé, crée automatiquement des indexes minmax pour toutes les colonnesDate,Date32,Time,Time64,DateTimeetDateTime64. #93355 (Michael Jarrett). - Prise en charge des alias de table étendus pour les JOINs (requêtes comme
SELECT * FROM (SELECT 1) AS t(a) JOIN (SELECT 1) AS u(b) ON a = b). Résout #95131. #95331 (Yarik Briukhovetskyi). - Ajout de la prise en charge de
ALTER TABLE RENAME COLUMNpour les tables Iceberg. Auparavant, seulsADD COLUMN,DROP COLUMNetMODIFY COLUMNétaient pris en charge. #97455 (murphy-4o).
Fonctionnalité expérimentale
- L’index de texte est désormais GA. #96794 (Robert Schulze).
- Le type de données
QBit, destiné au stockage vectoriel quantifié compacté en bits (utilisé pour la recherche approximative des plus proches voisins), est désormais généralement disponible et ne nécessite plus l’activation d’un paramètre expérimental. #95358 (Raufs Dunamalijevs). - La recherche vectorielle dans ClickHouse peut désormais utiliser les répliques du cluster pour répartir la charge et les recherches sur les parties de l’index vectoriel. Cela permet à ClickHouse de prendre en charge de grands index vectoriels qui dépassent la capacité mémoire d’une seule VM. #95876 (Shankar Iyer).
- Ajout d’un server-side AST fuzzer contrôlé par les paramètres
ast_fuzzer_runsetast_fuzzer_any_query. Lorsqu’il est activé, le serveur exécute des mutations aléatoires de chaque requête après son exécution normale, en rejetant les résultats. #97568 (Alexey Milovidov). - Ajout de la fonction
iifau dialecte KQL expérimental. #94790 (happyso). - L’inférence de schéma respecte désormais
allow_experimental_nullable_tuple_type. Lorsqu’elle est activée, elle permet aux types Tuple inférés d’êtreNullable(Tuple(...)), afin que les objets imbriqués manquants puissent devenirNULLau lieu d’un tuple composé d’élémentsNULL. #95525 (Nihal Z. Miaji). - Le paramètre
use_statistics_cacheest désormais activé par défaut, de sorte que les statistiques de colonne sont mises en cache en mémoire pour accélérer l’optimisation des requêtes sans devoir les recharger depuis chaque part. #95950 (Han Fei).
Amélioration des performances
- Autoriser l’utilisation de toute expression déterministe dans la clé primaire pour l’élagage des données (par ex.
ORDER BY cityHash64(user_id)/ORDER BY length(user_id)). Pour les expressions déterministes, ClickHouse peut appliquer l’expression aux constantes de la requête et utiliser le résultat dans l’index de la clé primaire pour des prédicats tels que=,INethas. Si l’expression est également injective (par ex.ORDER BY hex(p)ouORDER BY reverse(tuple(reverse(p), hex(p)))), l’index peut aussi être utilisé efficacement pour les formes négatives :!=,NOT INetNOT has. Clôt #10685. Clôt #82161. #92952 (Nihal Z. Miaji). - Améliorer le format de stockage des statistiques. Toutes les statistiques sont désormais stockées dans un seul fichier. #93414 (Anton Popov).
- Autoriser la lecture parallélisée pour les moteurs/fonctions de table distants dans le cache du système de fichiers. #71781 (Kseniia Sumarokova).
- Autoriser l’utilisation du cache de pages en espace utilisateur avec les fichiers locaux et les fonctions de table de stockage objet. #77874 (Michael Kolupaev).
- Éviter les
memcpyinutiles dans le cache de pages en espace utilisateur. #77884 (Michael Kolupaev). - La valeur par défaut de
concurrent_threads_schedulerest désormaismax_min_fairau lieu defair_round_robin. Cela améliore l’équité sous forte charge en donnant la priorité aux requêtes disposant de moins d’emplacements alloués, afin que les requêtes courtes ne soient pas pénalisées par les requêtes longues. #95300 (Sergei Trifonov). - Si une requête
FINALutilisait une condition sur la clé primaire pour le filtrage, suivie de skip indexes pour d’autres conditions, l’étape de traitementPrimaryKeyExpandne vérifiera désormais l’intersection que pour les plages de clé primaire initialement présélectionnées. #94903 (Shankar Iyer). - Lors de l’utilisation de répliques parallèles avec des fonctions de table comme
s3(...), les requêtes comportant une seule sous-requête englobant la fonction de table sont désormais automatiquement parallélisées entre les répliques, alors qu’auparavant seules les références directes à des fonctions de table l’étaient. Clôt #92264. #96332 (phulv94). - Activer la séparation des données et des fichiers système mis en cache en segments distincts. #87834 (MikhailBurdukov).
- Accélérer certaines opérations de hash join en implémentant une répartition dynamique pour
ColumnVector::replicate. #79573 (Raúl Marín). - Amélioration des performances du parallel hash join dans les cas impliquant des prédicats complexes. Auparavant, les lignes non jointes étaient traitées dans un seul thread, ce qui était sous-optimal ; cette optimisation parallélise leur traitement sur plusieurs threads. Peut être activé ou désactivé via le paramètre
parallel_non_joined_rows_processing. Activé par défaut. #92068 (Yarik Briukhovetskyi). - Optimiser légèrement l’analyse du type JSON. #93614 (Pavel Kruglov).
- Réduire l’empreinte mémoire de l’AST. Cette optimisation est pertinente, car les champs ne sont pas utilisés lorsque la mise en évidence ne l’est pas non plus et qu’il n’y a pas d’analyse de VALUES. #93974 (Ilya Yatsishin).
- Optimise la consommation mémoire des objets AST
Tuplenommés. Place les noms de colonnes sous forme de chaînes dans l’objet tuple au lieu de les stocker dans des nœuds littéraux AST génériques. #94704 (Ilya Yatsishin). - La dévirtualisation est améliorée grâce à des options supplémentaires de l’éditeur de liens. #94737 (Nikita Taranov).
- Améliore les performances du clonage de réplicas pour les tables ReplicatedMergeTree comportant de nombreuses parts en regroupant les requêtes ZooKeeper par lots. #94847 (c-end).
- Lorsque l’étape de lecture comportait déjà des filtres PREWHERE, il n’était pas possible d’ajouter un nouveau filtre. Cette modification reporte l’optimisation PREWHERE après l’optimisation des runtime filters de JOIN afin que les runtime filters puissent eux aussi être poussés vers PREWHERE. #95838 (Alexander Gololobov).
- Accélère la compression du codec
T64en utilisant la répartition dynamique sur x86. #95881 (Raúl Marín). - Accélère
uniqsur les types numériques en regroupant les insertions par lots lorsque c’est possible (not null, pas de -If, pas de GROUP BY, ni IPv6 ni String). #95904 (Raúl Marín). - Optimisations de bas niveau pour Keeper : il a été constaté que
ZooKeeper::observeOperationsreprésentait >20 % de la consommation CPU du thread de réception de ZooKeeper. Cette modification y remédie en : 1. utilisantCityHash64au lieu deSipHashpourAggregatedZooKeeperLog::stats, ce qui est >10x plus rapide. 2. utilisantstd::array<std::atomic<UInt32>, N>au lieu destd::unordered_mapetstd::mutexpourCoordination::ErrorCounter. #95962 (Miсhael Stetsyuk). - Supprime l’alignement sur 64 octets pour ProfileEvents::Counter afin d’économiser de la mémoire. #96097 (Azat Khuzhin).
- Optimisation mémoire : réduit d’un facteur 50 la taille de la structure
CachedOnDiskReadBufferFromFile. #96098 (Azat Khuzhin). - Ne copie pas les anciennes données lors du redimensionnement d’une table de hachage si elle est vide. #96180 (Raúl Marín).
- Prend en charge les runtime filters de JOIN pour les JOIN
RIGHT OUTER. #96183 (Hechem Selmi). - L’optimisation
enable_join_runtime_filtersest désormais activée par défaut. #89314 (Alexey Milovidov). - Auparavant, l’optimisation de lecture directe du text index n’était appliquée que lorsque toutes les parts disposaient d’un text index matérialisé. Cette PR ajoute une prise en charge partielle : si certaines parts disposent d’un text index matérialisé, elles l’utiliseront, tandis que celles qui n’en ont pas reviendront à l’exécution de la filter expression d’origine. #96411 (Anton Popov).
- Ajout d’index secondaires
minmaxsur les colonnes temporelles et d’indexbloom_filtersur les colonnesquery_id/initial_query_iddans les tables de logs système pour accélérer le filtrage. #96712 (Alexey Milovidov). - L’optimisation de lazy materialization s’applique désormais à toutes les branches d’une requête
UNION ALL, et non plus seulement à la première. Les requêtes qui combinent plusieurs lectures triées et limitées à partir de différentes tablesMergeTreeviaUNION ALLbénéficient maintenant d’une lecture différée des colonnes sur chaque branche, ce qui réduit les E/S. #96832 (Federico Ginosa). - Optimise le calcul de l’index de saut minmax lors d’
INSERTen supprimant une copie de données inutile et en activant un calcul vectorisé min/max pour les colonnes numériques. #97392 (Raúl Marín). - Le moteur Storage
DeltaLakerécupère désormais le résultat decount()depuis les métadonnées delta lake et affiche des statistiques de table correctes dans system.tables (total des octets/lignes). #96190 (Kseniia Sumarokova). - Les colonnes inutilisées sont désormais également supprimées à l’étape de lecture dans le cas d’une lecture depuis un MergeTree. Cela est particulièrement utile lorsqu’un filtre est poussé dans
PREWHERE. #89982 (János Benjamin Antal). - Améliore le traitement de la requête
SHOW TABLESen ne récupérant que le nom des tables, et améliore getLightweightTablesIterator afin qu’il renvoie une structure ne contenant que les noms de tables. Résout #93835. #94467 (Smita Kulkarni). - Améliore
assumeNotNull,coalesceetifNullafin d’activer l’élagage de la clé primaire et de l’index de saut pour les prédicats de plage lorsque les colonnes de clé sont encapsulées dans ces fonctions. Clôt #94689. #94754 (Nihal Z. Miaji). - Ajoute les extensions with_data et with_stat à la requête getChildren de Keeper. Cela permet de récupérer non seulement la liste des enfants, mais aussi leur
statet/ou leursdataen une seule opération. #94826 (Nikolay Degterinsky). - L’analyse d’index n’est effectuée qu’une seule fois (dans la plupart des cas), que l’exécution se fasse finalement avec un plan local ou un plan avec des répliques parallèles. #94854 (Nikita Taranov).
- Permet d’activer l’analyse d’index distribuée en fonction du nombre de parts (
distributed_index_analysis_min_parts_to_activate) et de la taille des index (distributed_index_analysis_min_indexes_size_to_activate). #95216 (Azat Khuzhin). - Active l’optimisation PREWHERE pour les tables Iceberg. #95476 (Konstantin Vedernikov).
- Réduit l’empreinte mémoire de certaines classes AST. #95514 (Raúl Marín).
- Limite le nombre de flux du pipeline générés lorsque
split_intersecting_parts_ranges_into_layersest activé. Cela permet d’éviter une consommation mémoire excessive. #96478 (Nikita Taranov). - Implémente l’optimisation par ensembles équivalents pour plusieurs jointures. Les requêtes comportant plusieurs opérations
INNER JOINconsécutives bénéficient désormais d’une meilleure optimisation du pushdown des filtres. Lorsque des tables sont jointes sur des colonnes équivalentes (par exemple,t1 JOIN t2 ON t1.id = t2.id JOIN t3 ON t2.id = t3.id WHERE t1.id > 10), les filtres appliqués à n’importe quelle table de la chaîne sont automatiquement poussés vers toutes les tables. Clôt #96550. #96596 (Vladimir Cherkasov). - Optimisation de l’analyse des métadonnées delta lake. Utilise les changements de la PR delta-kernel https://github.com/delta-io/delta-kernel-rs/pull/1827. #96686 (Kseniia Sumarokova).
- Dans une base de données Replicated, le cluster mis en cache n’est plus mis à jour pour chaque requête factice. #96897 (Tuan Pham Anh).
- Utilisation de l’index de clé primaire lors du filtrage avec
startsWithUTF8si le préfixe ne contient que des caractères ASCII. #97055 (vkcku).
Amélioration
- Ajout du tracing OpenTelemetry pour les requêtes Keeper. #91332 (Miсhael Stetsyuk).
- Nouvelles options de configuration :
logger.startup_console_level&logger.shutdown_console_levelpermettant de redéfinir respectivement le niveau de log de la console pendant le démarrage et l’arrêt de ClickHouse. #95919 (Garrett Thomas). - Prise en compte des surcharges en ligne de commande lors du rechargement de la configuration. Clôture #80294. #80295 (Alexey Milovidov).
- Prise en charge des surcharges key-value pour les paramètres des named collections dans la table function
mongodb. #89616 (vanchaklar). - L’optimisation de lecture dans l’ordre pour les tables Iceberg fonctionne désormais avec des fonctions de tri complexes comme
icebergBucketeticebergTruncate, et non plus seulement avec de simples références de colonne. #90256 (Konstantin Vedernikov). - Ajout d’une nouvelle colonne nommée parts_postpone_reasons dans system.mutations afin d’améliorer le diagnostic ; elle affiche les raisons du report des parts. #92206 (Shaohua Wang).
- Suivi des variations du nombre de lignes à lire (dues aux insertions/suppressions ou à l’utilisation du query condition cache) dans
DataflowStatisticsCache. #93636 (Nikita Taranov). - Prise en charge de la requête SYSTEM RESET DDL WORKER [ON CLUSTER]. Elle demande la réinitialisation de l’état de DDLWorker dans son thread principal. Cela est utile pour réactualiser l’état actif de la replica lorsque les identifiants d’hôte sont mis à jour. #93780 (Tuan Pham Anh).
- Prise en charge de
mutation_idsdanssystem.part_logpour les types d’événementMUTATE_PARTetMUTATE_PART_START. #93811 (Shaohua Wang). - Les opérations en arrière-plan (Mutate, Merge) peuvent désormais être configurées indépendamment via le profil ‘background’. Auparavant, elles partageaient les paramètres des requêtes classiques via le profil ‘default’. #93905 (Arsen Muk).
- Ajout de davantage d’informations dans
system.crash_log. #94112 #95857 (Miсhael Stetsyuk). - Ajout de la nouvelle métrique
QueryNonInternalpour suivre le nombre de requêtes non internes en cours d’exécution. Cette métrique est exposée sous la formeClickHouseMetrics_QueryNonInternalet aide les opérateurs à surveiller la concurrence des requêtes par rapport à la limitemax_concurrent_queries, qui ne s’applique qu’aux requêtes non internes. #94284 (Ashwath Singh). - Prise en charge de la collecte de statistiques sur les octets en entrée pour les colonnes issues de compact parts dans
RuntimeDataflowStatisticsCacheUpdater. #94626 (Nikita Taranov). - Ajout d’une vérification pour détecter une mauvaise configuration de Keeper entraînant des échecs d’assemblage du cluster. Clôture #60932. #94682 (Konstantin Bogdanov).
- Amélioration de la désérialisation des préfixes JSON lors du chargement des parts. #94848 (Pavel Kruglov).
- Refonte de l’écriture pour utiliser le pipeline INSERT complet, ce qui déclenche les vues matérialisées sur la table cible. #94890 (Kai Zhu).
- Utiliser les optimisations du plan de recherche de similarité vectorielle uniquement si l’index existe pour la colonne de recherche. #94998 (Eduard Karacharov).
- Vérifier la limite totale de mémoire avant l’authentification de l’utilisateur et lever
(total) memory limit exceededsi la limite totale dépasse la valeur autorisée. #95003 (Nikolai Kochetov). - Ajout de l’option de configuration
throw_on_unmatched_row_policiesqui, lorsqu’elle est activée, lève une exception si un utilisateur interroge une table avec des politiques de ligne mais qu’aucune ne s’applique à lui, ce qui évite le comportement ambigu consistant à renvoyer toutes les lignes en raison d’une mauvaise configuration du contrôle d’accès. #95014 (Vitaly Baranov). - Mise à jour dynamique des jetons d’accès S3 dans les requêtes longues avec Unity Catalog. Cela clôt #93981. #95069 (Konstantin Vedernikov).
- Désactiver la décroissance des pages sales de jemalloc si ClickHouse est soumis à une pression mémoire soutenue pendant
memory_worker_decay_adjustment_period_msmillisecondes. Réactiver la décroissance des pages sales de jemalloc si ClickHouse fonctionne dans des conditions normales pendant la même durée. #95145 (Antonio Andelic). - Prise en charge d’un Zookeeper auxiliaire pour S3Queue à l’aide du paramètre
keeper_pathde s3Queue. #95203 (Diego Nieto). - Respect de
max_parts_to_merge_at_oncedans les fusions de parts supprimées par TTL. #95315 (Kseniia Sumarokova). - Ajouter
connection_addressetconnection_portà query_log pour refléter la connexion physique (addressetportsont remplacés en cas de connexion via un proxy et auth_use_forwarded_address=1). #95471 (Yakov Olkhovskiy). - Correction d’un comptage incorrect de la mémoire pour le cache des conditions de requête. Le principal problème était que la clé de cache, composée de plusieurs chaînes (comme part_name, l’ID de la table et la condition SQL complète), n’était pas prise en compte. #95478 (Nikita Mikhaylov).
- Le serveur démarré avec la configuration embarquée permettra de gérer les utilisateurs et les grants, en les enregistrant dans le répertoire
access, comme avec la configuration standard. Cela améliore les tests. Toutes les améliorations liées à access_control ont également été activées dans la config embarquée et dans clickhouse-local. #95481 (Alexey Milovidov). - Amélioration des messages d’erreur d’authentification S3 pour inclure une indication invitant à vérifier les identifiants lorsque l’accès est refusé. #95648 (Gerald Latkovic).
- Activer le cache de statistiques et définir sa période de mise à jour sur 300 s. #95841 (Han Fei).
- Ajouter le nom du composant à
system.aggregated_zookeeper_log. #95882 (Antonio Andelic). - Évite les lectures depuis l’object storage lors des requêtes sur les tables
DeltaLakeviasystem.tables. #95899 (Antonio Andelic). - Active
enable_max_bytes_limit_for_min_age_to_force_mergepar défaut si le paramètrecompatibilityest défini sur26.2ou plus. #95917 (Christoph Wurm). - Delta Lake est désormais disponible sur macOS. Résout le ticket #95979. #95985 (Alexey Milovidov).
- Dans les versions précédentes, lors de la combinaison d’expressions ALTER conflictuelles avec UPDATE et RENAME COLUMN, une erreur logique était levée au lieu d’une exception appropriée. Résout #70678. #96022 (Alexey Milovidov).
- Améliore la sortie de l’aide pour toutes les applications ClickHouse et ajoute l’option
--no-sudo, avec quelques correctifs. Cela fait suite à #58244 de Ilya Yatsishin. #96025 (Alexey Milovidov). - Ajoute l’alias
distanceCosinepourcosineDistance, car toutes les autres fonctions de distance disposent déjà d’un alias de cette forme. #96065 (Raufs Dunamalijevs). - Ajoute la prise en charge de l’extension Keeper
with_dataafin d’améliorer la récupération des tables dans Database Replicated. #96090 (Nikolay Degterinsky). - Met à jour chdig vers v26.2.1 (nouvelles fonctionnalités et prise en charge de MacOS). #96113 (Azat Khuzhin).
- Améliore le pushdown des filtres pour
numbersetprimes. ClickHouse peut désormais déduire des bornes de valeurs prudentes à partir des conditionsWHERElorsque des bornes exactes ne peuvent pas être déterminées, et restreindre en conséquence la génération de la séquence (par exemple, pourWHERE number % 5 < 2 AND number > 100 AND number < 300, ClickHouse ne générera que des nombres entre 100 et 300, puis appliquera le prédicat), évitant ainsi les scans non bornés. Résout #84853. Résout #93913. #96115 (Nihal Z. Miaji). - Le Formatter entourait auparavant SELECT de parenthèses lorsqu’une clause
COMMENTétait présente afin de lever l’ambiguïté lors du parsing. À la place, il placeCOMMENTavantAS SELECT, ce qui supprime l’ambiguïté sans recourir aux parenthèses. #96293 (Alexey Milovidov). - Le paramètre de config
allow_impersonate_userse trouve désormais dans la sectionaccess_control_improvementsau lieu d’être un server setting autonome. #96451 (Vitaly Baranov). - Rend le paramètre de configuration
core_dump.size_limitrechargeable à chaud, afin d’éviter d’avoir à redémarrer les servers pour que les modifications de configuration prennent effet. #96524 (Miсhael Stetsyuk). - Améliore l’interopérabilité des Profilers CPU et temps réel avec les timeouts de socket. #96601 (Sergei Trifonov).
- Empêche la réapparition de données supprimées si ADD COLUMN est exécuté peu après la mutation DROP COLUMN. #96713 (Alexey Milovidov).
- Modifie le type de
function_iddanssystem.instrumentation, de LowCardinality(Int32) à Int32. #96726 (Copilot). - L’attente synchrone des mutations respecte désormais l’annulation des requêtes et les limites de temps. #96756 (Alexey Milovidov).
- Ajoute la commande système
SYSTEM RELOAD DELTA KERNEL TRACING <level>pour permettre de modifier la journalisation de delta-kernel, ce qui peut être utile pour le débogage. #96763 (Kseniia Sumarokova). - Le filtrage par famille d’adresses IP, c’est-à-dire les paramètres
dns_allow_resolve_names_to_ipv4/ipv6, s’applique même si le cache DNS est désactivé. #96810 (c-end). - Améliore l’introspection de jemalloc. #96840 (Azat Khuzhin).
- Corrige l’erreur
QUERY_CACHE_USED_WITH_SYSTEM_TABLEdans l’interface web/playlors de requêtes sur des tables système. #96869 (Alexey Milovidov). - Améliore l’interface web : modifie le favicon pour indiquer l’état d’exécution d’une requête ; affiche les erreurs des requêtes auxiliaires (chargement des bases de données et des tables) au lieu de les ignorer silencieusement. Clôt #85055. #96883 (Alexey Milovidov).
- Rend le panneau de gauche de l’interface
/playcliquable pour afficher ou masquer la liste des bases de données. #96884 (Alexey Milovidov). DROP DATABASEsupprime désormais les tables dans l’ordre inverse des dépendances, ce qui améliore la résistance aux crashs lorsque la base de données contient des tables avec des dépendances de chargement (par exemple, des tablesDistributedutilisantjoinGet). #97057 (Alexey Milovidov).- Met à jour yaml-cpp pour éviter d’ignorer du YAML non valide. #97333 (Azat Khuzhin).
- Affiche un indicateur de chargement dans la barre latérale de
play.htmlpendant la récupération des tables. #97531 (Alexey Milovidov). - Ajoute un bouton de copie dans le presse-papiers pour les résultats bruts des requêtes dans l’interface web intégrée (play.html). #97532 (Alexey Milovidov).
- Corrige l’obfuscateur de requêtes (
clickhouse-format --obfuscate) afin de produire du SQL pouvant être analysé dans davantage de cas. #97584 (Alexey Milovidov).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Après des ALTER ne portant que sur les métadonnées, comme l’extension des éléments d’un Enum, l’optimisation de l’agrégation avec projection peut finir par produire une exception. #84143 (Alexey Milovidov).
- Les vues matérialisées utilisent désormais comme contexte d’exécution la base de données dans laquelle elles ont été créées, ce qui signifie que : - il est possible d’omettre la qualification explicite de la base de données pour les noms référencés dans la requête SELECT de la vue - si aucune qualification explicite de base de données n’est fournie, la base de données où la vue matérialisée a été créée est utilisée par défaut. #88193 (Dmitry Kovalev).
- Corrige la substitution des paramètres de requête dans les méthodes d’authentication de CREATE USER lors de l’utilisation de ON CLUSTER. Les paramètres de requête dans les méthodes d’authentication (par ex.
password) n’étaient pas remplacés, ce qui provoquait des erreurs UNKNOWN_QUERY_PARAMETER sur les nœuds distants. #92777 (xiaohuanlin). - Corrige des incohérences dans l’analyse du text index pour les fonctions
has,mapContainsKeyetmapContainsValue. Auparavant, les requêtes utilisant ces fonctions pouvaient renvoyer des résultats différents selon que l’expression était évaluée avec ou sans text index. #93578 (Anton Popov). - Corrige un crash lors de l’attachement d’une table à une base de données
MaterializedPostgreSQLsidropReplicationSlotlève une exception pendant le déroulage de la pile. #96871 (Alexey Milovidov). - Les sauvegardes pouvaient faire planter le serveur si un grand nombre de sauvegardes concurrentes entraient en conflit sur les mêmes fichiers. #93659 (Alexey Milovidov).
- Corrige les requêtes avec parallel replicas et JOIN sur une table non-MT. Ferme #92056. #93902 (Igor Nikonov).
- Corrige un problème où des colonnes Iceberg contenant un point dans leur nom renvoyaient NULL comme valeur. #94335 (Mikhail Koviazin).
- Corrige la gestion des chaînes UTF8 dans
stringJaccardIndexUTF8et améliore les performances. #94613 (Joanna Hulboj). - Corrige de possibles dépassements de capacité dans
WITH FILL STALENESS(entraînant un comportement indéfini et/ou des boucles infinies). Corrige également une possible boucle infinie due à de grands sauts. Ajoute la prise en charge de l’ancien analyzer (principalement pour les tests de stress). #94663 (Azat Khuzhin). - Corrige un possible blocage de distributed queries lorsque des hostnames se résolvent en plusieurs adresses et qu’une replica distante se fige. #94726 (c-end).
- Corrige un résultat incorrect lors de la jointure de plusieurs expressions de table, lorsque l’expression de table la plus à gauche est une table function
-Cluster. Résout #89996. #94748 (Konstantin Bogdanov). - Corrige un pruning incorrect de la primary key et du skip index pour les predicates impliquant
toWeek,toYearWeek,toStartOfWeek,toLastDayOfWeekettoDayOfWeek, et corrige des exceptions dans certaines de ces fonctions pour des requêtes valides avecLowCardinality(String). #94816 (Nihal Z. Miaji). - Supprime le contournement inutile de la vérification des privilèges dans les requêtes
ATTACHpour une vue avec SQL Security. Cela évite une potentielle escalade de privilèges lorsqu’un utilisateur attache une vue avec un définisseur sans valider les accès requis. #94865 (pufit). - Corrige un crash au démarrage de
ReplicatedMergeTreecausé par la suppression concurrente des répertoiresdelete_tmp_*. #94892 (myeongjun). - Corrige la perte des informations de déduplication lors d’un
INSERTdans des tables Iceberg avec des vues matérialisées, ce qui provoquait une exception. #94938 (Daniil Ivanik). - Corrige un bug où
SYSTEM DROP QUERY CACHE TAG 'TAGNAME' ON CLUSTER <CLUSTERNAME>supprimait l’intégralité du cache sur le cluster. #94978 (Rory Crispin). - Préserve une granularité d’index constante (use_const_adaptive_granularity) après les fusions verticales (v2 avec un correctif pour Nested, et plus généralement). #95013 (Azat Khuzhin).
- Corrige une condition de concurrence dans le cache du système de fichiers dans la version 26.1 après [ClickHouse/ClickHouse#82764](https://github.com/ClickHouse/ClickHouse/pull/82764). #95042 (Kseniia Sumarokova).
- Corrige l’annulation de la fonction de table postgresql() via KILL QUERY et l’annulation de requête (Ctrl+C) dans clickhouse-client. #95136 (Roman Vasin).
- Corrige l’inférence de type pour les colonnes qualifiées provenant des tables sources lorsque plusieurs jointures sont utilisées avec la clause
USING. Auparavant, les jointures suivantes mettaient incorrectement à jour les types des colonnes sources sous-jacentes vers un supertype commun, même lorsque la colonne n’était pas impliquée dans cette jointure (par exemple, dansSELECT t2.a FROM t1 LEFT JOIN t2 USING (a) LEFT JOIN t3 USING (a), la colonnet2.an’est utilisée que par la première jointure, son type devrait donc être le supertype det1.aett2.a, à l’exclusion det3.a). Cela pouvait entraîner des erreurs logiques ou des crashs lorsque des fonctions attendaient des types de colonnes différents de ceux réellement présents dans le plan d’exécution. #95157 (Vladimir Cherkasov). - N’effectue la transformation des colonnes qu’une seule fois lors de la récupération du contenu de la liste .avro du manifest et des fichiers. #95164 (Daniil Ivanik).
- Corrige un calcul incorrect de la taille des colonnes JSON, qui pouvait entraîner une utilisation excessive de la mémoire ou des statistiques de colonnes erronées. #95207 (Azat Khuzhin).
- Corrige une comptabilisation mémoire inexacte lors de l’application de gros patch parts après des lightweight updates. Auparavant, l’application de gros patchs pouvait provoquer une utilisation excessive de la mémoire et conduire à l’arrêt du processus serveur par l’OOM killer. #95231 (Anton Popov).
- Corrige un comportement indéfini qui pouvait provoquer des résultats incorrects ou une exception lorsqu’une requête distribuée avec
max_parallel_replicasbasculait vers une réplique locale pendant l’analyse des index. #95263 (Azat Khuzhin). - Corrige l’agrégation des colonnes creuses pour
sumet timeseries lorsquegroup_by_overflow_modeest défini surany. #95301 (Mikhail Koviazin). - Corrige un problème de fiabilité dans la politique de disque
plain_rewritable, où une erreur réseau survenant en cours de suppression d’un fichier de métadonnées pouvait laisser le stockage dans un état incohérent. #95302 (Mikhail Artemenko). - Remplace Date par Date32 pour Iceberg. #95322 (Konstantin Vedernikov).
- L’argument password de la table function
redissera désormais masqué dans les logs et les tables système (par ex. :query_log). #95325 (János Benjamin Antal). - Corrige un bogue où des tables pouvaient être supprimées ou modifiées alors qu’une requête distribuée était encore en cours d’exécution sur celles-ci, ce qui pouvait provoquer des exceptions ou des résultats incorrects. #95356 (Azat Khuzhin).
- Corrige une erreur logique dans certains cas lorsque des valeurs négatives de
LIMIT/OFFSETsont utilisées dans des requêtes distribuées. #95357 (Nihal Z. Miaji). - Corrige un bogue où clickhouse-client demandait le mot de passe deux fois lors d’une connexion via ssh. #95372 (Isak Ellmer).
- Corrige une condition de concurrence dans le stockage S3(Azure)Queue. #95385 (Kseniia Sumarokova).
- Corrige l’erreur de filtre prewhere provoquée par des expressions lambda dans prewhere. #95395 (Xiaozhe Yu).
- Corrige
optimize_syntax_fuse_functionsafin de ne pas réécriresum/count/avgensumCount()lorsque l’argument d’agrégation estNullable. Ferme #95390. #95441 (Nihal Z. Miaji). - Évite un plantage possible des requêtes distribuées en cas d’annulation. #95466 (Aleksandr Musorin).
- Corrige la déduplication lors du streaming depuis le moteur S3(Azure)Queue. #95467 (Kseniia Sumarokova).
- Corrige la mise à jour des politiques de lignes attribuées à l’utilisateur initial dans les requêtes distribuées. #95469 (Vitaly Baranov).
- Corrige la vérification des disques chiffrés sur plain_rewritable (corrige l’erreur possible
It is not possible to register multiple plain-rewritable disks with the same object storage prefix). #95470 (Azat Khuzhin). - La table function
mergeTreeProjectionn’effectuait pas de vérification d’accès, ce qui permettait à des utilisateurs sans permission SELECT sur une table (mais disposant de permissions pour les table functions) de lire des données dans ses projections. Ce correctif ajoute la même vérification d’accès que celle déjà présente dansmergeTreeIndexetmergeTreeAnalyzeIndexes. #95480 (Alexey Milovidov). - Corrige une erreur logique possible lors de la lecture de la sous-colonne
sizeà partir des sous-colonnes dynamiques des types Dynamic/JSON. #95573 (Pavel Kruglov). - Correction d’une régression dans la réplication zero-copy (expérimentale) introduite par #94262, où des parts partagées pouvaient être supprimées avant que d’autres répliques aient fini de les récupérer. #95597 (filimonov).
- Correction d’un crash lors de l’application de
tupleElementà des Arrays de JSON. Clôt #95581. #95647 (Pavel Kruglov). - Correction d’une exception d’erreur logique lors de l’utilisation d’un sélecteur (
*) à l’intérieur d’une fonction lambda dans une clause VALUES d’un JOIN avec USING. Clôt #93675. #95661 (Vladimir Cherkasov). - Correction de l’erreur logique
There was an error: Cannot obtain error messagelors de l’attente d’une DDL distribuée et de la suppression concurrente de la base de données Replicated. Corrige #95539. #95664 (Alexander Tokmakov). - Correction de la fonction
IN, qui renvoyait des résultats incorrects avec des valeursNULLlorsquetransform_null_inest activé. Clôt #65776. #95674 (Nihal Z. Miaji). - Gestion correcte des types LowCardinality Nullable dans
CASTlorsque le paramètrecast_keep_nullableest activé. Clôt #95670. #95747 (Alexey Milovidov). - Correction du squashing des données delta lake partitionnées. #95773 (Kseniia Sumarokova).
- Correction d’une race condition sur une colonne de jointure Nullable dans les Runtime Filters. #95775 (Hechem Selmi).
- Correction d’une possible erreur logique dans une requête avec sélecteur (
*,table.*) etanalyzer_compatibility_join_using_top_level_identifierlorsque la colonneUSINGa des types différents dans les tables et dans la liste SELECT. Clôt #90477. #95808 (Vladimir Cherkasov). - Correction de bugs de sûreté mémoire dans les opérations du thread pool parallèle (backups, aggregation, distributed queries) qui pouvaient provoquer des exceptions lorsqu’une erreur survenait lors de l’ordonnancement des tâches. #95818 (Raúl Marín).
- Correction d’un crash sur
DROP WORKLOADlorsqu’il s’exécute en parallèle avec des queries utilisant le workload en cours de suppression. #95856 (Alexey Milovidov). - Correction de lenteurs lors de l’interrogation des tables système avec un utilisateur disposant de grants limités sur de nombreuses bases de données. Clôt #89371. #95874 (pufit).
- Correction de l’exécution de
tupleElementsur du JSON avec des chemins imbriqués, ce qui pouvait auparavant conduire à un résultat de query erroné. #95907 (Pavel Kruglov). - Correction d’une erreur
NOT_SUPPORTEDqui pouvait se produire lors de l’utilisation de l’algorithme de joindirectavec une table MergeTree vide. #95935 (Vladimir Cherkasov). - Correction d’un problème où le client ne suggérait ni ne complétait automatiquement les noms d’alias pour les paramètres. Clôt #92190. #95945 (phulv94).
- Correction de event_date dans system.asynchronous_metric_log. #95947 (Raúl Marín).
- Correction des skipping paths dans le type de données JSON. Auparavant, avec
JSON(SKIP path), toutes les clés JSON ayant le préfixepathétaient ignorées, y compris des clés comme"pathpath"; cela pouvait donc entraîner une perte de données pour ces paths lors d’un insert. Désormais, le problème est corrigé et seule la clé"path"est ignorée. #95948 (Pavel Kruglov). - Une part avec des projections inconnues ne doit pas être marquée comme perdue définitivement. #95952 (Mikhail Artemenko).
- Correction d’un problème où une chaîne vide devenait
NULLdans une tableJoinavec une cléNullable(String). Clôt #71414. #96002 (Alexey Milovidov). - Désormais, le moteur PostgreSQL peut lire correctement
BOOLEAN[]. Clôt #72754. #96006 (Alexey Milovidov). - Correction du format
ProtobufListdans le cas d’une lecture depuis un fichier vide. Clôt #70059. #96007 (Alexey Milovidov). - Correction du format
ProtobufList, qui produisait un enregistrement fantôme pour les tables vides. Clôt #72596. #96010 (Alexey Milovidov). - Correction d’une incompatibilité de type dans la fonction
ifentreUInt64etInt32, dans un cas inhabituel impliquant des distributed queries, PREWHERE et l’inférence de type. Clôt #70017. #96012 (Alexey Milovidov). - Correction des requêtes compilées par
JITimpliquant des typesBool. #96013 (Alexey Milovidov). - Correction d’une erreur logique lors de la lecture d’une colonne UUID à partir d’une colonne SQLite TEXT. Clôt #71263. #96016 (Alexey Milovidov).
- Correction de la conversion de types du moteur SQLite pour
DateTime,Date,UUIDet d’autres types. Clôt #73481. #96017 (Alexey Milovidov). - Les valeurs
FixedStringétaient incorrectement échappées dans les requêtes vers des bases de données externes, SQLite et PostgreSQL. Clôt #73519. Coécrit avec @jh0x. #96019 (Alexey Milovidov). - Corrige un échec d’assertion dans WindowTransform avec un décalage PRECEDING important. Clôt #75852. #96026 (Alexey Milovidov).
- Corrige un bug pouvant entraîner une corruption de données lorsque des async inserts concurrentes utilisent les mêmes noms de paramètre, mais avec des valeurs différentes. #96035 (Seva Potapov).
- Corrige la période des profileurs globaux (contrôlée par
global_profiler_real_time_period_nsetglobal_profiler_cpu_time_period_ns). Au lieu de la valeur configurée, une valeur tronquée était utilisée, ce qui amenait le profiler à se réveiller plus souvent que prévu. #96048 (Antonio Andelic). - Auparavant, si le fichier de données de référence dans le fichier manifeste Iceberg pour la suppression par position était présent dans une entrée mais valait null, les bornes correctes n’étaient pas obtenues pour les fichiers de données correspondants. Cette PR corrige ce bug. #96061 (Daniil Ivanik).
- Corrige la révocation des rôles par défaut. #96103 (Vitaly Baranov).
- Corrige un use-after-free dans l’analyse d’index dans le cas rare où
use_primary_keyest désactivé et qu’un très grand nombre de disjonctions de conditions utilisent l’index. #96112 (Alexey Milovidov). - Corrige une régression du codec
Gorillalorsqu’une taille explicitement spécifiée ne correspond pas à la taille du type de données et que la taille du tampon est trop petite. Dans les versions précédentes, cela provoquait une exception lors de la décompression. Clôt #78253. #96118 (Alexey Milovidov). - Évite un interblocage dans les dictionnaires chargés lorsqu’un dictionnaire référence une table Merge qui le référence récursivement. Clôt #78360. #96120 (Alexey Milovidov).
- Corrige l’utilisation d’une valeur non initialisée dans
formatDateTimeavec des formatteurs non fixes, comme les styles MySQL et JODA. #96133 (Alexey Milovidov). - La combinaison des settings
use_const_adaptive_granularityetindex_granularity_bytes(qui signifie “granularité non adaptative”) entraînait un mauvais calcul du nombre de lignes à lire ainsi qu’une exception. #96143 (Alexey Milovidov). - L’exécution d’une mutation ALTER UPDATE invalide sur des tables de type fichier sur stockage objet, telles que S3 et Azure, pouvait entraîner un déréférencement de nullptr. Clôt #92994. #96162 (Alexey Milovidov).
- Corrige
AccessRights::contains, qui renvoyait des résultats incorrects avec des révocations partielles. #96170 (pufit). - Corrige une collision de hachage dans le cache des conditions de requête pour les constantes de CTE repliées, ce qui pouvait conduire à un résultat de requête erroné. Clôt #96060. #96172 (Alexey Milovidov).
- Corrige un possible interblocage dans ProcessList. Cela peut se produire en raison d’une inversion de verrous si l’overcommit tracker mémoire se déclenche pendant l’ajout d’une tâche au vérificateur d’annulation. #96182 (Antonio Andelic).
- Correction d’un bogue où des requêtes impliquant des jointures externes (LEFT, RIGHT ou FULL) combinées à plusieurs INNER JOIN pouvaient renvoyer des résultats incorrects en raison d’un réordonnancement illégal des jointures. Lorsque la condition ON d’une jointure externe faisait référence à des colonnes de plusieurs tables précédemment jointes, l’optimiseur ne tenait pas compte de toutes les dépendances entre tables et pouvait réordonner les jointures de manière incorrecte, ce qui produisait des lignes manquantes. Résout #95972. #96193 (Vladimir Cherkasov).
- Lorsqu’une table n’a pas de statistiques définies, ClickHouse ne doit pas essayer de les charger. Cela évite un surcoût (plus de 100 ms) lié à la vérification de l’existence des fichiers de statistiques. (issue #96068). #96233 (Han Fei).
- Corrige
optimize_syntax_fuse_functionsafin de ne pas réécriresum/count/avgensumCount()lorsque l’argument d’agrégation estLowCardinality(Nullable). Résout #95390. #96239 (Nihal Z. Miaji). - Corrige un partition pruning incorrect pour la fonction
not INetnot hasdans certains cas. #96241 (Nihal Z. Miaji). - Corrige
stack-use-after-scopedans l’index de similarité vectorielle. #96259 (Alexey Milovidov). - Corrige le fait que le lanceur de tests ne reconnaissait pas les commentaires d’indication d’erreur lorsqu’une requête était précédée d’un commentaire SQL. #96336 (Yakov Olkhovskiy).
- Corrige une erreur logique dans KeyCondition lorsqu’une table a une clé primaire Nullable et que la requête utilise la fonction
coalesce, dont le premier argument est une constante. #96340 (Alexey Milovidov). - L’interaction entre
GROUPING SETS,group_by_use_nullset le type de donnéesTupleavecLowCardinalityà l’intérieur pouvait produire une structure de block inattendue dans le query pipeline, ce qui entraînait une erreur logique. Ce problème est apparu après l’introduction desTupleNullable. #96358 (Alexey Milovidov). - Il était possible de créer une table avec une expression vide
()comme index, ce qui entraînait un accès mémoire invalide. #96363 (Alexey Milovidov). - Correction d’un crash dans l’ancien analyseur en présence de JOIN et d’alias dupliqués. #96405 (Ilya Golshtein).
- Corrige l’erreur
Nested columns sizes are inconsistent with local_discriminatorsdue à une optimisation incorrecte du filtrage en place pour les colonnes Variant. #96410 (Alexey Milovidov). - Corrige le fait que
CREATE TABLE ... CLONE AS ...ignorait le qualificateur complet de la table source. #96415 (Hasyimi Bahrudin). - Correction de l’annulation de la table function
mysqlvia KILL QUERY et de l’annulation de requête (Ctrl+C) dans clickhouse-client. #96437 (Roman Vasin). - Correction d’un livelock dans le thread de vérification des annulations pour les requêtes avec des valeurs élevées de
max_execution_time. #96450 (Sergei Trifonov). - Correction d’une erreur logique dans certains cas lorsque
LIMIT/OFFSETfractionnaire est utilisé dans des requêtes distribuées. #96475 (Nihal Z. Miaji). - Correction d’un déréférencement de pointeur nul dans certaines expressions avec des fonctions lambda. #96479 (Alexey Milovidov).
- Correction de résultats incorrects lorsque des colonnes
LowCardinalitysont converties enNullable. #96483 (Nihal Z. Miaji). - Correction d’un crash lors de la création d’une table Iceberg avec une clause
ORDER BYréférençant une colonne inexistante ou utilisant un argument positionnel. Ferme #93280. #96484 (Konstantin Vedernikov). - Correction d’une exception de runtime filter pour des colonnes Tuple avec des sous-champs Nullable. #96509 (Alexey Milovidov).
- Correction d’une exception
LOGICAL_ERRORdans le lecteur natif Parquet V3 lorsque la colonne de filtrePREWHEREcontient des valeurs UInt8 non booléennes. #96594 (Alexey Milovidov). - Correction de la régénération implicite des index dans les tables répliquées lors de modifications des métadonnées. #96600 (Raúl Marín).
- Correction d’une course de données sur DROP WORKLOAD. #96614 (Sergei Trifonov).
- Correction d’un bug dans les écritures vers une table Iceberg où des insertions partitionnées pouvaient produire une répartition incorrecte des données entre les fichiers de partition. #96620 (Konstantin Vedernikov).
- Correction d’un
heap-use-after-freedansCREATE TABLEavec des contraintes. #96669 (Nikita Taranov). - Validation de la witness version dans bech32 afin d’éviter un débordement de tampon. #96671 (Raúl Marín).
- Correction de
system.tables, qui renvoyait des erreurs lorsqu’un REST catalog de data lake était créé avec un paramètreauth_headernon valide. #96680 (Han Fei). - Correction de
min(timestamp), qui renvoyait l’époque (1970-01-01) via_minmax_count_projectionaprès une fusion TTL lorsque toutes les lignes d’un block étaient filtrées. #96703 (Raquel Barbadillo). - Amélioration de la validation du paramètre
iceberg_metadata_file_pathpour empêcher la traversée de chemin et garantir que le fichier de métadonnées spécifié se trouve dans le répertoire de la table. #96754 (Daniil Ivanik). - Correction d’un crash dans
ifNullavec un argumentVariantutilisé dansGROUP BY. #96790 (Alexey Milovidov). - Correction des collisions de clés de cache entre les tables avec le paramètre
table_disk=1. #96818 (Raufs Dunamalijevs). - Correction du blocage du thread de purge de MemoryWorker à cause d’une condition de concurrence. #96819 (Antonio Andelic).
- Les données contenant des informations d’authentification ne sont plus journalisées dans les catalogues Iceberg. #96831 (Konstantin Vedernikov).
- Correction du code de sortie de clickhouse-client après une erreur du serveur. #96841 (Vitaly Baranov).
- Les requêtes avec des
CROSS JOINet des répliques parallèles activées pouvaient renvoyer un résultat incorrect. Corrige #74337. #96848 (Igor Nikonov). - Correction de l’échec des requêtes
ALTER TABLE DROP COLUMNaprès qu’une lightweight update avait déjà été effectuée sur la même colonne. #96861 (Anton Popov). - Correction d’un dépassement de pile (crash) lors de la création de sauvegardes basées sur des archives (
.zip,.tzst) sur un disque de stockage objetplain_rewritable. #96872 (Alexey Milovidov). - Correction d’un crash du serveur lorsque la sauvegarde échoue en raison d’un disque plein ou d’autres erreurs d’E/S sur le système de fichiers de destination. #96873 (Alexey Milovidov).
- Correction de
EXCEPT ALLetINTERSECT ALL, qui ignoraient les multiplicités de lignes et se comportaient comme leurs équivalentsDISTINCT. #96876 (Alexey Milovidov). - Correction d’une exception
std::terminatedansindexOfAssumeSortedlorsqu’elle est appelée avec des types incompatibles (par exemple, un tableauIPv4avec une valeur de recherche entière). #96877 (Alexey Milovidov). - Correction de l’exception
Bad cast from type DB::ColumnNullable to DB::ColumnStringlors de l’utilisation de fonctions de fenêtre avecgroup_by_use_nulls = 1et CUBE/ROLLUP/GROUPING SETS. #96878 (Alexey Milovidov). - Correction de résultats incorrects lorsque des expressions compilées par JIT convertissent
DateTimeenDateTime64(par exemple, dansCASE/if/multiIfavec des types DateTime mixtes). La valeur était réinterprétée au lieu d’être correctement mise à l’échelle, ce qui produisait des horodatages erronés une fois la compilation de l’expression activée. #96879 (Alexey Milovidov). - Correction d’une exception d’erreur logique dans
CoalescingMergeTreelorsqu’une expression de skip index produit une colonne constante (par exemple,bloom_filtersurifNotFinite(1, c0)pour une colonne entière). #96880 (Alexey Milovidov). - Correction d’un numéro de port erroné dans le message d’erreur lors d’une connexion accidentelle en HTTP au port du protocole natif avec TLS activé. #96881 (Alexey Milovidov).
- Correction du fait que
SETTINGSpar sous-requête n’était pas appliqué aux fonctions de table commefiledans les CTE et les sous-requêtes. #96882 (Alexey Milovidov). - Corrige une fuite de mémoire des objets BIO lors de la lecture de certificats X509. #96885 (Alexey Milovidov).
- Corrige l’exception
LOGICAL_ERRORdans l’analyseur de requêtes lorsqu’une expression lambda est passée là où une valeur concrète est attendue (par exemple comme argument accumulateur dearrayFold). #96892 (Alexey Milovidov). - Corrige l’exception
ColumnNullable is not compatible with originallors du transtypage de types imbriqués complexes (Array de Tuple Nullable contenant une Map avec des valeurs Enum Nullable). #96924 (Alexey Milovidov). - Corrige une situation de concurrence lors du chargement parallèle d’un dictionnaire
HASHEDpartitionné, qui pouvait occasionnellement empêcher le chargement de certaines lignes. #96953 (Alexey Milovidov). - Corrige une situation de concurrence entre
REPLACE PARTITIONet les mutations en arrière-plan, qui pouvait rendre simultanément visibles les anciennes et les nouvelles données après le remplacement. #96955 (Alexey Milovidov). - Corrige la fonction
arrayJoin, qui produisait des lignes en double lorsqu’elle était utilisée avec INNER JOIN et la clause WHERE, en raison de l’optimisation partielle de descente de prédicat qui poussait à tort sous un JOIN les filtres contenantarrayJoin. #96989 (Alexey Milovidov). - Corrige un plantage (SEGFAULT) dans
clearCaches, causé par le fait queBlockIO::operator=ne déplaçait pasquery_metadata_cache, ce qui entraînait la destruction prématurée de snapshots de stockage mis en cache et une utilisation après libération du stockageMergeTreeData. #96995 (Alexey Milovidov). - Corrige un échec d’assertion dans
IfTransformStringsToEnumPasslorsque la fonctionifoutransformrenvoieNullable(String)(par exemple avecGROUP BY ... WITH CUBEetgroup_by_use_nulls = true). #97002 (Alexey Milovidov). - Corrige l’écriture de données incorrectes lors de
INSERT ... SELECTavecUNION ALLetJOIN, où des colonnes de chaînes constantes pouvaient recevoir des valeurs erronées après la fusion des blocs. #97019 (Hasyimi Bahrudin). - Corrige l’exception
assert_cast(ou une corruption silencieuse des données dans les builds de release) lors de la création des statistiques de colonnes après qu’unALTER TABLE MODIFY COLUMNa modifié le type de la colonne. #97027 (Alexey Milovidov). - Corrige des lectures de mémoire non initialisée dans Azure Blob Storage, le protocole SSH et les interfaces Arrow Flight. #97053 (Alexey Milovidov).
- Corrige des cas où les index affectaient le résultat des requêtes avec row policy/PREWHERE et FINAL. #97076 (Yarik Briukhovetskyi).
- Corrige la situation de concurrence résiduelle entre
REPLACE PARTITIONet les mutations en arrière-plan dans les tablesMergeTree, qui pouvait faire réapparaître d’anciennes données. #97105 (Alexey Milovidov). - Corrige les index implicites avec des colonnes alias et effectue une validation complète avant leur création. #97115 (Raúl Marín).
- Corrige une erreur logique dans
FunctionVariantAdaptoravec des fonctions nécessitant des arguments constants, commearrayROCAUC. #97116 (Bharat Nallan). - Corrige des mutations bloquées lorsque
PartCheckThreadremet en file d’attente unGET_PARTpour une part déjà mutée, en laissant des entrées fantômes dansparts_to_do. #97162 (Alexey Milovidov). - Corrige l’estimation du nombre de lignes dans le plan d’exécution pour des sous-requêtes avec
ORDER BY ... LIMIT, ce qui pouvait amener l’optimiseur à choisir un ordre de jointure sous-optimal. #97193 (Alexander Gololobov). - Corrige l’exception
LOGICAL_ERRORdansFunctionVariantAdaptorlorsqu’une fonction opérant sur des colonnes Variant renvoie le typeNothing, ce qui peut se produire avec des tableaux vides dans des requêtesUNION ALL. #97213 (Alexey Milovidov). - Corrige une data race lors des opérations de copie multipart vers S3 (par ex. lors d’un
BACKUP/RESTOREvers S3), qui pouvait provoquer des exceptions en cas d’accès concurrent. #97227 (Azat Khuzhin). - Corrige l’exception
LOGICAL_ERRORlorsquearrayJoindans la clauseWHEREréférence des colonnes des deux côtés d’unJOIN. #97239 (Alexey Milovidov). - Corrige l’exception
LOGICAL_ERRORlors de la lecture de la sous-colonne.sized’unNullable(String)sparse dans un Tuple avec PREWHERE. #97264 (Alexey Milovidov). - Corrige l’exception “Le nombre de lignes dans le chunk lazy ne correspond pas au nombre d’offsets” dans
LazyMaterializingTransformlors de la lecture de tables avec une granularité d’index non adaptative (index_granularity_bytes = 0) en utilisantORDER BY ... LIMIT. #97270 (Alexey Milovidov). - Corrige le fait que
SYSTEM RESTART REPLICAfasse disparaître une table de la base de données lorsque sa recréation échoue avec une exception sans lien avec ZooKeeper (par ex. memory limit), ce qui provoquait des incohérences d’empreinte de métadonnées dansDatabaseReplicated. #97276 (Alexey Milovidov). - Le champ
readonlydanssystem.merge_tree_settingsreflète désormais correctement que certains paramètres MergeTree (par ex.index_granularity) sont inconditionnellement en lecture seule. #97277 (Robert Schulze). - Corrige un crash lors de l’optimisation de
count()sur des tablesMergeTreelorsque le snapshot de stockage a été créé sans données. #97281 (Pablo Marcos). - Corrige un crash possible lors de la résolution des noms de fonctions à partir des informations de débogage pour les stack traces. #97294 (Azat Khuzhin).
- Corrige une erreur logique avec analyzer_compatibility_join_using_top_level_identifier et les colonnes ALIAS. Ferme #96228. #97297 (Vladimir Cherkasov).
- Corrige l’exception
LOGICAL_ERRORdansapplyOrderlors de l’utilisation de colonnes indexées en texte avec la clauseQUALIFY. #97313 (Alexey Milovidov). - La table système
system.functionsaffiche désormaiscategories = 'Internal'pour les fonctions internes, au lieu decategories = ''. #97315 (Robert Schulze). - Une requête comportant une chaîne de RIGHT JOIN avec les répliques parallèles activées peut produire un résultat incorrect. Corrige #74341. #97316 (Igor Nikonov).
- Corrige des erreurs
TABLE_UUID_MISMATCHintempestives pouvant survenir avec les vues matérialisées actualisables et dans d’autres scénarios où des tables sont renommées. #97323 (Azat Khuzhin). - Corrige un segfault dans la sauvegarde
StorageKeeperMap, dû à une utilisation après libération d’un pointeur de stockage devenu orphelin dans un lot de sauvegarde lazy. #97336 (Alexey Milovidov). - Corrige la fonction
existsavec une sous-requête scalaire dans unALTER UPDATE/DELETElorsquemutations_execute_subqueries_on_initiatorest activé. La sous-requête scalaire était évaluée incorrectement, ce qui pouvait entraîner une erreur ou une commande de mutation corrompue, rendant la table impossible à charger au redémarrage suivant du serveur. #97347 (Kirill Kopnev). - Corrige l’exception logique
Unexpected return type from equals. Expected Nullable(UInt8). Got Const(LowCardinality(Nullable(UInt8)))lors de la comparaison de NULL avec une colonne Variant contenant des types LowCardinality. #97379 (Alexey Milovidov). - Corrige une possible condition de concurrence lorsque
EXCHANGE TABLESest exécuté en parallèle avec le query cache shardé activé. #97411 (Konstantin Vedernikov). - Corrige l’exception
LOGICAL_ERRORlors de la conversion d’Array versQBit, lorsquenullable_sourced’un wrapperTupleexterne remplace la colonne de tableau convertie par un type de colonne incompatible. Clôt #97389. #97413 (Alexey Milovidov). - Corrige une incohérence de formatting aller-retour de l’AST pour les littéraux de tuple avec alias entre parenthèses ; par exemple,
(('a', 'b') AS x)était incorrectement reformaté entuple(('a', 'b') AS x). #97418 (Alexey Milovidov). - Corrige une exception lors d’insertions asynchrones avec déduplication lorsqu’un échec de parsing produisait un bloc vide de zéro ligne. #97460 (Sema Checherinda).
- Corrige l’exception “Number of rows in lazy chunk does not match number of offsets” dans
LazyMaterializingTransformlors de la lecture de tables avec granularité d’index non adaptative (index_granularity_bytes = 0) en utilisantORDER BY ... LIMIT. #97482 (Alexey Milovidov). - Corrige les paramètres d’insert pour Iceberg. Ajoute un alias pour le paramètre
allow_experimental_insert_into_iceberg. #97483 (Konstantin Vedernikov). - Corrige
ACCESS_DENIEDpour les utilisateurs dépourvus de la permissionCREATE TEMPORARY TABLElorsque l’optimisationoptimize_inverse_dictionary_lookupréécrit les prédicatsdictGet(...). ClickHouse ignore désormais cette réécriture et exécute l’expression d’origine. Clôt #97269. #97484 (Nihal Z. Miaji). - Correction d’un échec d’assertion (exception dans les builds de débogage/sanitizer) dans
SetetMergeTreeIndexSetlors du traitement de colonnes comportant des sous-colonnessparseinternes (par ex. des colonnesTupleissues de parts MergeTree avec des profils de sérialisationsparsedifférents). #97493 (Alexey Milovidov). - Correction d’un possible use-after-free dans StorageKafka2. #97520 (Bharat Nallan).
- Correction de
INTO OUTFILEavecTRUNCATEet le paramètreinto_outfile_create_parent_directorieslorsque le chemin de sortie contient des répertoires. #97549 (Alexey Milovidov). - Correction de l’erreur
BAD_ARGUMENTSlors de requêtes sur des tables avec des expressions lambda dans des colonnes ALIAS via la table functionmerge(), avec l’analyseur activé. #97551 (Alexey Milovidov). - Correction de l’exception
system.zookeeper_infolorsque le zxid de Keeper vaut 0. #97553 (Alexey Milovidov). - Correction d’une possible erreur logique dans le dictionnaire
ip_trielorsque le type de la clé n’est pas String. #97555 (Bharat Nallan). - Correction de l’authentification OAuth du catalogue REST, qui ne fonctionnait pas pour le
RestCatalogde base (elle ne fonctionnait que pour des catalogues dérivés commeOneLakeCatalog). Cela a cassé le catalogue REST par défaut après l’introduction du catalogue BigLake. #97561 (Konstantin Vedernikov). - Les fonctions de géométrie (
perimeterSpherical,areaSpherical, etc.) acceptent désormais des sous-types géométriques individuels (Polygon,Ring,Point, etc.) en plus du type VariantGeometry. #97571 (Alexey Milovidov). - Correction de l’exception
LOGICAL_ERRORlors de l’utilisation deisNull/isNotNullsur des sous-colonnes de typesNullable(Tuple(... Nullable(T) ...)). Clôt #97224. #97582 (Alexey Milovidov). - Correction d’un déréférencement de pointeur nul lors de l’application de patch parts pendant les lightweight updates. #97583 (Alexey Milovidov).
BaseSettings::readBinarytransmet àfield_infos[]l’index renvoyé paraccessor.findsans vérifier la valeur sentinelle « non trouvé » (c.-à-d.-1), ce qui peut provoquer un accès hors limites à unstd::vector. Le problème a été détecté grâce au hardening de libcxx. Cela s’est probablement produit lors de la désérialisation du query plan lorsqu’un serveur plus récent envoie un paramètre inconnu à un serveur plus ancien. La méthode de lecture basée sur les chaînes gérait déjà correctement ce cas ; il manquait simplement la même vérification dansreadBinary. #97585 (Miсhael Stetsyuk).- Correction de résultats incorrects pour des queries
UNION ALLdans lesquelles une branche avait un predicate constant faux : la branche lisait à tort des données au lieu de ne rien renvoyer. #97620 (Bharat Nallan). - Correction de l’échec de
IN (col)avec une référence à une seule colonne, qui produisait l’erreurUNSUPPORTED_METHOD. #97646 (Alexey Milovidov). - Correction d’une exception d’erreur logique lors de
GROUP BY ... WITH ROLLUP/CUBElorsque les clés incluentLowCardinality(Nullable(...))à l’intérieur deNullable(Tuple(...)). #97647 (Alexey Milovidov). - Correction d’une incohérence de formatage de l’AST pour
NOT (1, 1, 1)pouvant provoquerLOGICAL_ERRORdans les versions de débogage. #97653 (Alexey Milovidov). - Correction d’une exception de
keeper-converterlorsqu’il rencontre des fichiers journaux de transactions ZooKeeper vides. #97673 (Alexey Milovidov).
Amélioration de la compilation/des tests/du packaging
- ClickHouse peut être compilé avec clang-23 (master). #95578 (Alexey Milovidov).
- Corrige le forçage de
is_localà false lorsquebind_hostest configuré, et le remplace par un test d’intégration. Suite de #74741. #93109 #96018 (Zhigao Hong). - Tests de stress : corrige les tests de stress et de mise à niveau dans la CI. Ignore les tags
no-{build}. Ajoute une randomisation de compatibilité. #94693 (Nikita Fomichev). - Publie le binaire parser_memory_profiler issu du build. Cet outil permet d’analyser la consommation mémoire de l’AST. #95826 (Ilya Yatsishin).
- Ajoute l’option
--symbolizeà l’outilparser_memory_profiler, qui génère des fichiers.heap.symavec les symboles résolus dans les résultats. #96477 (Ilya Yatsishin). - Épingle les images Docker tierces utilisées dans les tests d’intégration à des versions spécifiques. #96500 (Alexey Milovidov).
- Restaure la possibilité de lier
OpenSSLdynamiquement. Ce n’est pas recommandé et ce n’est utilisé par aucun build de production, mais l’option existe toujours pour les passionnés. #96506 (Govind R Nair). - Réduit la plage
magic_enumde [-100, 1000] à la plage par défaut [-128, 127] en utilisant une spécialisation par type pourCoordination::OpNum, ce qui améliore le temps de compilation. #96632 (Alexey Milovidov). - Supprime des templates C++ inutiles des classes Function afin de réduire les temps de compilation. #96646 (Alexey Milovidov).
- Déplace la génération de
StorageSystemLicensesà l’étape de configuration afin d’améliorer le parallélisme de compilation. #96697 (Alexey Milovidov). - Parallélise l’analyse des licences. #96727 (Raúl Marín).
- Ajoute un test fonctionnel stateless pour la prise en charge du protocole SSH. #96996 (Alexey Milovidov).
- Ajoute Kafka 3.9.0 à l’infrastructure des tests fonctionnels stateless, ce qui permet de tester directement les table engines Kafka et Kafka2 en utilisant ClickHouse Keeper comme ZooKeeper. Six nouveaux tests stateless couvrent les bases de la production/consommation, les virtual columns, INSERT, plusieurs formats, la gestion des messages corrompus et le stockage des offsets basé sur Keeper. #96997 (Alexey Milovidov).
- Ajoute un workflow CI pour compiler une toolchain clang optimisée avec PGO+BOLT. #96991 (Alexey Milovidov).
- Utilise dans la CI le build LLVM/Clang optimisé avec PGO, ce qui devrait accélérer la compilation de 20 à 30 %. #97031 (Alexey Milovidov).
- Remplace les fonctions mathématiques de glibc par des implémentations de llvm-libc. #90151 (Konstantin Bogdanov).
- Met à jour Boost de 1.83 à 1.90, corrigeant un échec d’assertion
devectordans les compilations de débogage. #97037 (Alexey Milovidov). - Met à jour
postgresvers REL_18_1. #95189 (Konstantin Bogdanov). - Utilise
libexpat2.7.3. #95218 (Konstantin Bogdanov). - Utilise
OpenSSL3.5.5. #95345 (Konstantin Bogdanov). - Utilise
simdjsonv4.2.4. #97129 (Konstantin Bogdanov). - Utilise
libarchive3.8.5. #97131 (Konstantin Bogdanov). - Utilise
fast_floatv8.2.3. #97133 (Konstantin Bogdanov). - Utilise
abseil-cpp20260107.1 ets2geometryv0.13.1. #97134 (Konstantin Bogdanov). - Fait passer
libxml2à la version 2.15.1. #95574 (Robert Schulze). - Met à niveau 7 images Docker de tests d’intégration Tier-3, en remplaçant des images de base en fin de vie ou supprimées par des versions actuellement prises en charge. #97314 (Rahul).
- Ajoute des requêtes de benchmark TPC-DS. #97349 (Raufs Dunamalijevs).
- Remplace les options cmake individuelles de jeu d’instructions x86 (
ENABLE_SSSE3,ENABLE_AVX2,NO_SSE3_OR_HIGHER,ARCH_NATIVE, etc.) par une unique option numériqueX86_ARCH_LEVEL(1/2/3/4), alignée sur les niveaux standard de microarchitecture x86-64 déjà utilisés par le système de dispatch à l’exécution. #97354 (Raúl Marín). - Évite d’instancier des variantes de template
division_by_nullable=truepour les opérations autres que la division dansFunctionBinaryArithmetic, ce qui réduit le temps de compilation et la taille du binaire. #97496 (Raúl Marín). - Réduit le volume d’inclusions de
Exception.hen le supprimant d’en-têtes largement utilisés commetypeid_cast.h,assert_cast.h,Context_fwd.h,IDataType.het divers en-têtesColumn. #97497 (Raúl Marín). - Utilise toujours les en-têtes
compiler-rtfournis avec le projet (interfaces Sanitizer et XRay) au lieu de ceux du compilateur hôte, et compile par défaut les bibliothèquescompiler-rtà partir des sources. #97499 (Raúl Marín). - Éviter d’inclure les en-têtes boost/multiprecision dans
wide_integer_impl.hsur les plateformes disposant d’unlong doublesuffisant, ce qui améliore le temps de compilation. #96633 (Alexey Milovidov). - Mettre en place le job de couverture de code LLVM et l’activer dans un premier temps pour la branche master. #90952 (Alexey Bakharew).
- Activer le durcissement rapide de libcxx pour les builds de release. Cela est principalement nécessaire pour les vérifications de dépassement de limites. D’après les résultats des tests de performance, aucun impact notable sur les performances n’est attendu. #94757 (Miсhael Stetsyuk).
Version 26.1 de ClickHouse, 2026-01-29. Présentation, Vidéo
Changement incompatible avec les versions précédentes
- Corrige un formatage incohérent causé par une substitution incorrecte d’alias dans le formateur. Cela clôt #82833. Cela clôt #82832. Cela clôt #68296. Cette modification peut être rétro-incompatible : lorsque l’analyseur est désactivé, certaines requêtes CREATE VIEW avec IN référençant un alias ne peuvent pas être traitées. Pour éviter cette incompatibilité, activez l’analyseur (il est activé par défaut depuis la version 24.3). #82838 (Alexey Milovidov).
- Les codecs
DEFLATE_QPLetZSTD_QATont été supprimés. Il est conseillé aux utilisateurs de convertir les données existantes compressées avecDEFLATE_QPLouZSTD_QATvers un autre codec avant la mise à niveau. Notez que, pour utiliser ces codecs, les paramètresenable_deflate_qpl_codecetenable_zstd_qat_codecdevaient être activés. #92150 (Robert Schulze). - Améliore le débogage des UDF en activant la capture de stderr dans
system.query_log.exception. Auparavant, stderr des UDF n’était consigné que dans des fichiers et n’était pas exposé dans les journaux de requêtes, ce qui rendait le débogage impossible. Désormais, stderr déclenche des exceptions par défaut et est entièrement accumulé (jusqu’à 1 Mo) avant qu’une exception ne soit levée, de sorte que les traces d’appels Python complètes et les messages d’erreur apparaissent danssystem.query_log.exceptionpour faciliter le dépannage. #92209 (Xu Jia). - Une liste de colonnes vide dans la clause
JOIN USING ()est désormais considérée comme une erreur de syntaxe. Auparavant, cela était censé produireINVALID_JOIN_ON_EXPRESSIONpendant l’exécution de la requête. Dans certains cas, comme lors d’une jointure avec le moteurJoin, cela menait àLOGICAL_ERROR, clôt #82502. #92371 (Vladimir Cherkasov). - Utilise par défaut une correspondance partielle pour SKIP REGEXP dans le type JSON. Clôt #79250. #92847 (Pavel Kruglov).
- Annule “Allow INSERT into simple ALIAS columns” (annule ClickHouse/ClickHouse#84154). Cela ne fonctionne pas avec les formats personnalisés et n’est protégé par aucun paramètre. #92849 (Azat Khuzhin).
- Ajoute un paramètre pour lever une erreur si un catalogue de data lake n’a pas accès au stockage objet. #93606 (Konstantin Vedernikov).
- Le moteur de base de données
Lazya été supprimé et n’est plus disponible. Clôt #91231. #93627 (Alexey Milovidov). - Supprime le mode
transposed_with_wide_viewdemetric_log: il est inutilisable en raison d’un bug. Il n’est plus possible de définirsystem.metric_logavec ce mode. Cela annule partiellement #78412. #93867 (Alexey Milovidov). - L’ordonnancement CPU des workloads est désormais préemptif par défaut. Voir le paramètre serveur
cpu_slot_preemption. #94060 (Sergei Trifonov). - Échapper les noms de fichiers d’index pour éviter des parts corrompues. Avec ce changement, ClickHouse ne pourra plus charger les index dont le nom contient des caractères non ASCII et qui ont été créés par des versions précédentes. Pour gérer ce cas, vous pouvez utiliser le paramètre MergeTree
escape_index_filenames. #94079 (Raúl Marín). - Les paramètres de format
exact_rows_before_limit,rows_before_aggregation,cross_to_inner_join_rewrite,regexp_dict_allow_hyperscan,regexp_dict_flag_case_insensitive,regexp_dict_flag_dotalletdictionary_use_async_executoront été convertis en paramètres ordinaires (non liés au format). Il s’agit d’un changement purement interne, sans effet visible pour l’utilisateur, sauf dans le cas (peu probable) où vous auriez spécifié l’un de ces paramètres dans des définitions de moteurs de table Iceberg ou DeltaLake ou Kafka ou S3 ou S3Queue ou Azure ou Hive ou RabbitMQ ou Set ou FileLog ou NATS. Dans ce cas, ces paramètres étaient auparavant ignorés ; désormais, de telles définitions génèrent une erreur. #94106 (Robert Schulze). - Les fonctions
joinGet/joinGetOrNullimposent désormais les privilègesSELECTsur la table Join sous-jacente. Après ce changement, l’exécution dejoinGet('db.table', 'column', key)exige que l’utilisateur dispose du privilègeSELECTà la fois sur les colonnes de clé définies dans la table Join et sur la colonne d’attribut récupérée. Les requêtes ne disposant pas de ces privilèges échoueront avecACCESS_DENIED. Pour migrer, accordez les privilèges nécessaires à l’aide deGRANT SELECT ON db.join_table TO userpour un accès à toute la table, ou deGRANT SELECT(key_col, attr_col) ON db.join_table TO userpour un accès au niveau des colonnes. Ce changement affecte tous les utilisateurs et applications qui s’appuient surjoinGet/joinGetOrNulllorsque des privilègesSELECTexplicites n’étaient pas configurés auparavant. #94307 (Vladimir Cherkasov). - Vérifier
SHOW COLUMNSpour les requêtesCREATE TABLE ... AS .... Auparavant,SHOW TABLESétait vérifié, ce qui correspond à un privilège incorrect pour ce type de vérification d’autorisation. #94556 (pufit). - Rendre le format de sortie
Hashindépendant de la taille des blocks. #94503 (Alexey Milovidov). Notez que cela modifie les valeurs de hachage en sortie par rapport aux versions précédentes.
Nouvelle fonctionnalité
- API HTTP et interface Web intégrée pour ClickHouse Keeper. #78181 (pufit et speeedmaster).
- La déduplication d’async insert fonctionne désormais avec les vues matérialisées dépendantes. Lorsqu’une collision sur
block_idse produit, le bloc d’origine est filtré pour supprimer les lignes associées à ceblock_id, puis les lignes restantes sont transformées à l’aide de toutes les requêtesselectpertinentes des vues matérialisées, ce qui reconstruit le bloc d’origine sans les lignes en conflit. #89140 (Sema Checherinda). Il est désormais possible d’utiliser la déduplication avec les async inserts lorsque des vues matérialisées sont impliquées. #93957 (Sema Checherinda). - Introduction d’une nouvelle syntaxe et d’une nouvelle infrastructure afin de simplifier et d’étendre la fonctionnalité d’index de projection. Cela fait suite à https://github.com/ClickHouse/ClickHouse/pull/81021. #91844 (Amos Bird).
- Ajout de la prise en charge des index de texte pour les colonnes
Array. #89895 (Jimmy Aguilar Mena). - Active
use_variant_as_common_typepar défaut, ce qui permet d’utiliser des types incompatibles dans unArray, dans des requêtesUNIONet dans les branches deif/multiIf/case. #90677 (Alexey Milovidov). - Nouvelle table système
zookeeper_info. Implémente #88014. #90809 (Smita Kulkarni). - Prise en charge du type
Variantdans toutes les fonctions. #90900 (Bharat Nallan). - Ajoute une métrique
ClickHouse_Infoau endpoint Prometheus/metrics, contenant principalement des informations de version, afin de pouvoir créer des graphiques suivant l’évolution détaillée des versions au fil du temps. #91125 (Christoph Wurm). - Introduction d’une nouvelle commande Keeper à quatre lettres,
rcfg, qui permet de modifier la configuration du cluster. Cette commande offre plus de possibilités de modification de la configuration que la requête standardreconfigure. La commande prend une chaînejsoncomme argument. L’ensemble des octets envoyés à l’interface TCP doit avoir la forme suivante :rcfg{json_string_length_big_endian}{json_string}. Voici un exemple de commande :{"preconditions": {"leaders": [1, 2], "members": [1, 2, 3, 4, 5]}, "actions": [{"transfer_leadership": [3]}, {"remove_members": [1, 2]}, {"set_priority": [{"id": 4, "priority": 100}, {"id": 5, "priority": 100}]}, {"transfer_leadership": [4, 5]}, {"set_priority": [{"id": 3, "priority": 0}]}]}. #91354 (alesapin). - Ajoute la fonction
reverseBySeparator, qui inverse l’ordre des sous-chaînes d’une chaîne séparées par un séparateur donné. Clôt #91463. #91780 (Xuewei Wang). - Ajoute le nouveau paramètre
max_insert_block_size_bytes, qui permet de contrôler plus finement la formation des blocs insérés. #92833 (Kirill Kopnev). - Il est possible d’exécuter des requêtes DDL avec la clause
ON CLUSTERpour une base de données Replicated si le paramètreignore_on_cluster_for_replicated_databaseest activé. Dans ce cas, le nom du cluster est ignoré. #92872 (Kirill). - Implémentation de la fonction
mergeTreeAnalyzeIndexes. #92954 (Azat Khuzhin). - Ajout du nouveau paramètre
use_primary_key. Définissez-le surfalsepour désactiver le pruning des granules basé sur la clé primaire. #93319 (Nihal Z. Miaji). - Ajout de la fonction de table
icebergLocalCluster. #93323 (Anton Ivashkin). - Ajout de la fonction
cosineDistanceTransposed, qui approxime la distance cosinus entre deux points. #93621 (Raufs Dunamalijevs). - Ajout de la colonne
filesà la table system.parts, qui affiche le nombre de fichiers dans chaque data part. #94337 (Match). - Ajout d’un scheduler max-min fair pour le contrôle de la concurrence. Il offre une meilleure équité en cas de forte sursouscription, lorsque de nombreuses requêtes se disputent un nombre limité de CPU slots. Les requêtes de courte durée ne sont pas pénalisées par les requêtes de longue durée qui ont accumulé davantage de slots au fil du temps. Activé via la valeur
max_min_fairdu paramètre serveurconcurrent_threads_scheduler. #94732 (Sergei Trifonov). - Ajout de la possibilité, pour le client ClickHouse, de remplacer le TLS SNI lors de la connexion au serveur. #89761 (Matt Klein).
- Prise en charge des tables temporaires dans les appels de fonction
joinGet. #92973 (Eduard Karacharov). - Prise en charge des vecteurs de suppression dans le moteur de table
DeltaLake. #93852 (Kseniia Sumarokova). - Prise en charge des vecteurs de suppression pour
deltaLakeCluster. #94365 (Kseniia Sumarokova). - Prise en charge de Google Cloud Storage pour les data lakes. #93866 (Konstantin Vedernikov).
Fonctionnalité expérimentale
- Passage de
QBitdu statut Experimental à Beta. #93816 (Raufs Dunamalijevs). - Ajout de la prise en charge de
Nullable(Tuple). Définissezallow_experimental_nullable_tuple_type = 1pour l’activer. #89643 (Nihal Z. Miaji). - Prise en charge du REST catalog Paimon, dans la continuité de https://github.com/ClickHouse/ClickHouse/pull/84423. #92011 (JIaQi Tang).
Amélioration des performances
- Le paramètre
use_skip_indexes_on_data_readest désormais activé par défaut. Ce paramètre permet un filtrage en flux, en même temps que la lecture, ce qui améliore les performances des requêtes et le temps de démarrage. #93407 (Shankar Iyer). - Améliore les performances de
DISTINCTsur les colonnesLowCardinality. Clôt #5917. #91639 (Nihal Z. Miaji). - Optimise la fonction d’agrégation
distinctJSONPathsafin qu’elle lise uniquement les chemins JSON à partir des data parts, et non la JSON column entière. #92196 (Pavel Kruglov). - Davantage de filtres sont pushed down dans les JOIN. #85556 (Nikita Taranov).
- Prend en charge davantage de cas de push down à partir de la condition ON du join lorsque le filtre n’utilise des entrées que d’un seul côté. Prend en charge les joins
ANY,SEMI,ANTI. #92584 (Dmitry Novik). - Permet d’utiliser des sets équivalents pour push down les filtres dans
SEMI JOIN. Clôt #85239. #92837 (Dmitry Novik). - Évite de lire le côté gauche d’un hash join lorsque le côté droit est vide. Auparavant, le côté gauche était lu jusqu’au premier block non vide, ce qui pouvait entraîner beaucoup de travail en cas de filtrage ou d’agrégation importants. #94062 (Alexander Gololobov).
- Utilisation de la méthode “fastrange” (Daniel Lemire) pour partitionner les données au sein du query pipeline. Cela peut améliorer le tri parallèle et les JOIN. #93080 (Alexey Milovidov).
- Améliore les performances des fonctions de fenêtre lorsque PARTITION BY correspond à la sorting key ou en est un préfixe. #87299 (Nikita Taranov).
- Le filtre externe est pushed down dans les vues, ce qui permet d’appliquer PREWHERE sur les nœuds locaux et distants. Résout #88189. #88316 (Igor Nikonov).
- Met en œuvre des compilations JIT pour davantage de fonctions. Clôt #73509. #88770 (Alexey Milovidov avec Taiyang Li).
- Si un skip index utilisé dans une requête
FINALporte sur une colonne faisant partie de la primary key, l’étape supplémentaire consistant à vérifier l’intersection de la primary key dans les autres parts n’est pas nécessaire et n’est désormais plus effectuée. Résout #85897. #93899 (Shankar Iyer). - Optimise les performances et l’utilisation mémoire pour les
LIMITetOFFSETfractionnaires. #91167 (Ahmed Gouda). - Corrige l’utilisation d’une logique de lecture aléatoire plus rapide pour le mécanisme de prefetch du Parquet reader V3. Clôt #90890. #91435 (Arsen Muk).
- Amélioration des performances de
icebergCluster. Closes #91462. #91537 (Yang Jiang). - Ne pas filtrer sur les colonnes virtuelles avec des filtres constants. #91588 (c-end).
- Réduction de l’utilisation mémoire des INSERT/fusions avec les wide parts pour les tables très larges grâce à l’activation de tampons d’écriture adaptatifs. Ajout de la prise en charge des tampons d’écriture adaptatifs pour les disques chiffrés. #92250 (Azat Khuzhin).
- Amélioration des performances de la recherche en texte intégral avec le text index et le tokenizer
sparseGrams, en réduisant le nombre de tokens recherchés dans l’index. #93078 (Anton Popov). - La fonction
isValidASCIIa été optimisée pour les résultats positifs, c.-à-d. pour les valeurs d’entrée entièrement ASCII. #93347 (Robert Schulze). - L’optimisation de lecture dans l’ordre détecte désormais lorsque les colonnes ORDER BY sont constantes du fait des conditions WHERE, ce qui permet des lectures efficaces en ordre inverse. Cela profite aux requêtes multi-tenant comme
WHERE tenant='42' ORDER BY tenant, event_time DESC, qui peuvent désormais utiliser InReverseOrder au lieu de nécessiter un tri complet.”. #94103 (matanper). - Introduction d’une classe AST Enum spécialisée pour stocker les paramètres de valeur sous forme de paires (chaîne, entier) au lieu d’enfants ASTLiteral, afin d’optimiser la consommation mémoire. #94178 (Ilya Yatsishin).
- Analyse d’index distribuée sur plusieurs répliques. Bénéfique pour le stockage partagé et les très grands volumes de données dans le cluster. Cela s’applique à SharedMergeTree (ClickHouse Cloud) et pourrait s’appliquer à d’autres types de tables MergeTree sur stockage partagé. #86786 (Azat Khuzhin).
- Réduction du surcoût des runtime filters de jointure en les désactivant dans les cas suivants : - trop de bits sont définis dans le bloom filter - trop peu de lignes sont filtrées à l’exécution. #91578 (Alexander Gololobov).
- Utilisation d’un tampon en mémoire pour l’entrée des sous-requêtes corrélées afin d’éviter de l’évaluer plusieurs fois. Fait partie de #79890. #91205 (Dmitry Novik).
- Autoriser toutes les répliques à récupérer les plages orphelines dans la lecture en parallel replicas. Cela améliore l’équilibrage de charge et réduit la latence de fin de distribution. #91374 (zoomxi).
- L’agrégation/le tri/la jointure externes respectent désormais le paramètre de requête
temporary_files_codecdans tous les contextes. Correction de l’absence de profile events pour grace hash join. #92388 (Vladimir Cherkasov). - Renforcement de la détection de l’utilisation mémoire des requêtes pour le spilling to disk pendant l’agrégation/le tri. #92500 (Azat Khuzhin).
- Estimation du nombre total de lignes et des statistiques NDV (nombre de valeurs distinctes) des colonnes clés d’agrégation. #92812 (Alexander Gololobov).
- Optimisation de la compression des listes de postings avec simdcomp. #92871 (Peng Jian).
- Refonte du traitement du mode Ordered de S3Queue avec des buckets. Cela devrait également améliorer les performances en réduisant le nombre de requêtes vers Keeper. #92889 (Kseniia Sumarokova).
- Les fonctions
mapContainsKeyLikeetmapContainsValueLikepeuvent désormais exploiter un text index surmapKeys()oumapValues(), respectivement. #93049 (Michael Jarrett). - Réduction de l’utilisation mémoire sur les systèmes non Linux (activation de la purge immédiate des dirty pages de jemalloc). #93360 (Eduard Karacharov).
- Forcer la purge des Arena de jemalloc lorsque le ratio entre la taille des dirty pages et
max_server_memory_usagedépassememory_worker_purge_dirty_pages_threshold_ratio. #93500 (Eduard Karacharov). - Réduction de l’utilisation mémoire pour l’AST. #93601 (Nikolai Kochetov).
- Dans certains cas, nous avons constaté que ClickHouse ne respectait pas la memory limit lors de la lecture d’une table. Ce comportement a été corrigé. #93715 (Nikita Mikhaylov).
- Activer par défaut les extensions Keeper
CHECK_STATetTRY_REMOVE. #93886 (Mikhail Artemenko). - Analyser les bornes inférieure et supérieure des noms de fichiers correspondant aux suppressions par position à partir des entrées du manifest file Iceberg afin d’améliorer la sélection des data files correspondants. #93980 (Daniil Ivanik).
- Ajouter deux paramètres supplémentaires pour contrôler le nombre maximal de subcolumns dynamiques dans une JSON column. Le premier est le MergeTree setting
merge_max_dynamic_subcolumns_in_compact_part(similaire àmerge_max_dynamic_subcolumns_in_wide_part, déjà ajouté), qui limite le nombre de subcolumns dynamiques créées lors d’un merge vers une compact part. Le second est le paramètre au niveau de la querymax_dynamic_subcolumns_in_json_type_parsing, qui limite le nombre de subcolumns dynamiques créées lors du parsing des données JSON, ce qui permettra de définir la limite on insert. #94184 (Pavel Kruglov). - Légère optimisation du squashing des JSON columns dans certains cas. #94247 (Pavel Kruglov).
- Réduire la taille des queue du thread pool sur la base du retour d’expérience en production. Ajouter une vérification explicite de la consommation mémoire avant toute lecture de données depuis MergeTree. #94692 (Nikita Mikhaylov).
- S’assurer que le scheduler privilégie le thread MemoryWorker en cas de pénurie de CPU, car il protège le processus ClickHouse contre une menace existentielle. #94864 (Nikita Mikhaylov).
- Exécuter la purge des dirty pages de jemalloc dans un thread distinct du thread principal de MemoryWorker. Si la purge est lente, cela pourrait retarder les mises à jour de l’utilisation de la RSS, ce qui pourrait entraîner l’arrêt du processus par manque de mémoire. Introduction d’une nouvelle config,
memory_worker_purge_total_memory_threshold_ratio, pour démarrer la purge des dirty pages en fonction du ratio d’utilisation mémoire totale. #94902 (Antonio Andelic).
Amélioration
system.blob_storage_logest désormais disponible pour Azure Blob Storage. #93105 (Alexey Milovidov).- Implémente
blob_storage_logpour Local et HDFS. Corrige une erreur lorsqueS3Queueutilisait autre chose que le nom du disque pour la journalisation dansblob_storage_log. Ajoute la colonneerror_codeàblob_storage_log. Scinde le fichier de configuration des tests pour simplifier les tests en local. #93106 (Alexey Milovidov). clickhouse-clientetclickhouse-localmettront désormais en évidence les groupes de chiffres (milliers, millions, etc.) au sein des littéraux numériques pendant la saisie. Cela clôt #93100. #93108 (Alexey Milovidov).- Ajoute la prise en charge, dans
clickhouse-client, des arguments de ligne de commande avec une espace autour du signe égal. Clôt #93077. #93174 (Cole Smith). - Avec
<interactive_history_legacy_keymap>true</interactive_history_legacy_keymap>, le client CLI peut désormais revenir à Ctrl-R pour la recherche classique comme auparavant, tandis que Ctrl-T effectue une recherche approximative. #87785 (Larry Snizek). - L’instruction de vidage des caches
SYSTEM DROP [...] CACHEdonnait la fausse impression qu’elle désactivait le cache. ClickHouse prend désormais en charge l’instructionSYSTEM CLEAR [...] CACHE, plus explicite. L’ancienne syntaxe reste disponible. #93727 (Pranav Tiwari). - Prend en charge plusieurs colonnes comme clé primaire dans
EmbeddedRocksDB. Clôt #32819. #33917 (usurai). - Il est désormais possible d’utiliser un
INnon constant pour des scalaires (requêtes commeval1 NOT IN if(cond, val2, val3)). #93495 (Yarik Briukhovetskyi). - Empêche la propagation des en-têtes
x-amz-server-side-encryptionvers les requêtes S3HeadObject,UploadPartetCompleteMultipartUpload, car elles ne sont pas prises en charge. #64577 (Francisco J. Jurado Moreno). - Ajoute le suivi du partitionnement Hive pour le mode ordered dans S3Queue. Résout #71161. #81040 (Anton Ivashkin).
- Optimise la réservation d’espace dans le cache du système de fichiers.
FileCache::collectCandidatesForEvictionsera exécuté sans verrou unique. #82764 (Kseniia Sumarokova). - Prend en charge une stratégie composite de rotation (taille + temps) pour le journal du serveur. #87620 (Jianmei Zhang).
- Le client CLI peut désormais spécifier
<warnings>false</warnings>au lieu de l’option de ligne de commande--no-warnings. #87783 (Larry Snizek). - Ajout de la prise en charge de la fonction d’agrégation
avgavec des valeurs Date, DateTime et Time comme arguments. Clôt #82267. #87845 (Yarik Briukhovetskyi). - L’optimisation
use_join_disjunctions_push_downest activée par défaut. #89313 (Alexey Milovidov). - Prise en charge d’un plus grand nombre de moteurs de table et de types de sources de données dans les sous-requêtes corrélées. Clôt #80775. #90175 (Dmitry Novik).
- Si le schéma d’une vue paramétrée est spécifié explicitement, il est affiché. Clôt #88875, #81385. #90220 (Grigorii Sokolik).
- Gère correctement les écarts dans les entrées de log de Keeper lorsque les logs se situent avant le dernier index validé. #90403 (Antonio Andelic).
- Amélioration du paramètre
min_free_disk_bytes_to_perform_insertafin qu’il fonctionne correctement avec les volumes JBOD. #90878 (Aleksandr Musorin). - Permet de spécifier le paramètre
storage_class_namedans les collections nommées pour le moteur de tableS3et la fonction de tables3. #91926 (János Benjamin Antal). - Prise en charge de l’accès à un ZooKeeper auxiliaire via
system.zookeeper. #92092 (RinChanNOW). - Ajout de nouvelles métriques pour Keeper : les profile events
KeeperChangelogWrittenBytes,KeeperChangelogFileSyncMicroseconds,KeeperSnapshotWrittenBytesetKeeperSnapshotFileSyncMicroseconds, ainsi que les histogram metricsKeeperBatchSizeElementsetKeeperBatchSizeBytes. #92149 (Miсhael Stetsyuk). - Ajout d’un nouveau paramètre,
trace_profile_events_list, qui limite le tracing avectrace_profile_eventà la liste spécifiée de noms d’événements. Cela permet une collecte de données plus précise sur les charges de travail importantes. #92298 (Alexey Milovidov). - Prise en charge de SYSTEM NOTIFY FAILPOINT pour les failpoints pouvant être mis en pause. - Prise en charge de SYSTEM WAIT FAILPOINT fp PAUSE/RESUME. #92368 (Shaohua Wang).
- Ajout de la colonne
creation(implicit/explicit) àsystem.data_skipping_indices. #92378 (Raúl Marín). - Permet de transmettre à la source du dictionnaire la description des colonnes des tables dynamiques YTsaurus. #92391 (MikhailBurdukov).
- Dans #63985, nous avons permis de spécifier, port par port, tous les paramètres nécessaires à la configuration de TLS (voir protocoles composables), de sorte qu’il n’est plus nécessaire de s’appuyer sur une configuration TLS globale. Cependant, l’implémentation exige encore implicitement la présence d’une section de configuration globale
openSSL.server, ce qui pose problème dans les configurations où des paramètres TLS différents sont requis selon le port. Par exemple, dans les déploiements keeper-in-server, des configurations TLS distinctes sont nécessaires pour la communication inter-keeper et pour les connexions du clickhouse client. #92457 (Miсhael Stetsyuk). - Introduction d’un nouveau paramètre
input_format_binary_max_type_complexity, qui limite le nombre total de nœuds de type pouvant être décodés au format binaire afin d’éviter les payloads malveillants. #92519 (Raufs Dunamalijevs). - Afficher les tâches en cours d’exécution dans
system.background_schedule_pool{,_log}. Ajout de la documentation. #92587 (Azat Khuzhin). - Exécuter la requête en cours dans la recherche Ctrl+R du client si aucune correspondance n’est trouvée dans l’historique. #92749 (Azat Khuzhin).
- Prise en charge de
EXPLAIN indices = 1comme alias deEXPLAIN indexes = 1. Ferme #92483. #92774 (Pranav Tiwari). - Le lecteur Parquet permet désormais de lire des colonnes Tuple ou Map au format JSON :
select x from file(f.parquet, auto, 'x JSON')fonctionne même si le type de la colonnexdansf.parquetest tuple ou map. #92864 (Michael Kolupaev). - Prise en charge des tuples vides dans le lecteur Parquet. #92868 (Michael Kolupaev).
- Basculement vers une copie en lecture-écriture pour Azure Blob Storage lorsque la copie native échoue avec BadRequest (par ex. liste de blocs invalide). Auparavant, cela ne se produisait qu’en cas d’erreur Unauthorized, observée lors de la copie d’un blob vers différents comptes de stockage. Mais nous observons aussi parfois l’erreur “The specified block list is invalid”. La condition a donc été mise à jour pour basculer vers la lecture-écriture pour tous les échecs de copie native. #92888 (Smita Kulkarni).
- Correction du throttling de l’endpoint de métadonnées EC2 lors de l’exécution d’un grand nombre de requêtes S3 concurrentes avec des credentials de profil d’instance EC2. Auparavant, chaque requête créait son propre
AWSInstanceProfileCredentialsProvider, ce qui entraînait des requêtes concurrentes vers le service de métadonnées EC2 et pouvait provoquer des timeouts ainsi que des erreursHTTP response code: 403. Désormais, le fournisseur de credentials est mis en cache et partagé entre toutes les requêtes. #92891 (Sav). - Refonte du paramètre
insert_select_deduplicateafin de préserver la rétrocompatibilité. #92951 (Sema Checherinda). - Journaliser les tâches d’arrière-plan plus lentes que la moyenne (
background_schedule_pool_log.duration_threshold_milliseconds=30) afin d’éviter une journalisation excessive. #92965 (Azat Khuzhin). - Dans les versions précédentes, certains noms de fonctions C++ s’affichaient de manière incorrecte (« mangled ») dans
system.trace_logetsystem.symbols, et la fonctiondemanglene les traitait pas correctement. Corrige #93074. #93075 (Alexey Milovidov). - Introduction du paramètre de sauvegarde
backup_data_from_refreshable_materialized_view_targetspour ne pas sauvegarder les cibles des vues matérialisées actualisables. Les RMV avec une stratégie d’actualisation APPEND sont toujours sauvegardées. #93076 (Julia Kartseva). #93658 (Julia Kartseva) - Utilisation d’informations minimales de débogage au lieu de l’absence totale d’informations de débogage pour les unités de traduction volumineuses, comme les fonctions. #93079 (Alexey Milovidov).
- Ajout de la prise en charge de la compatibilité MinIO au SDK C++ AWS S3 via l’implémentation d’une correspondance des codes d’erreur pour les erreurs spécifiques à MinIO. Cette modification permet à ClickHouse de gérer correctement les erreurs du serveur MinIO et de les réessayer lors de l’utilisation de déploiements MinIO au lieu d’AWS S3, ce qui améliore la fiabilité pour les utilisateurs qui exécutent du stockage objet sur des clusters MinIO autohébergés. #93082 (XiaoBinMu).
- Écriture de profils jemalloc symbolisés (ce qui supprime la nécessité d’un binaire lors de la génération du profil du tas). #93099 (Azat Khuzhin).
- Restauration de l’outil
clickhouse git-import: il ne fonctionnait plus avec des commits volumineux et invalides. Voir https://presentations.clickhouse.com/2020-matemarketing/. #93202 (Alexey Milovidov). - Ne plus afficher les mots de passe du stockage URL dans le query log. #93245 (Konstantin Vedernikov).
- Prise en charge du type
GeometrypourflipCoordinates. #93303 (Bharat Nallan). - Amélioration de l’UX de SYSTEM INSTRUMENT ADD/REMOVE : utilisation de littéraux
Stringpour les noms de fonctions, application du correctif à toutes les fonctions correspondantes et possibilité d’utiliser function_name dansREMOVE. #93345 (Pablo Marcos). - Ajout d’un nouveau paramètre
materialize_statistics_on_mergequi active ou désactive la matérialisation des statistiques lors de la fusion. La valeur par défaut est1. #93379 (Han Fei). - ClickHouse peut désormais analyser
SELECTsans parenthèses dans les requêtesDESCRIBE SELECT. Corrige #58382. #93429 (Yarik Briukhovetskyi). - Ajout d’une randomisation probabiliste des vérifications de validité du cache. #93439 (Kseniia Sumarokova).
- Ajout du paramètre
type_json_allow_duplicated_key_with_literal_and_nested_objectpour autoriser les chemins dupliqués dans JSON lorsque l’un correspond à un littéral et l’autre à un objet imbriqué, par ex.{"a" : 42, "a" : {"b" : 42}}. Certaines données ont pu être créées avant l’ajout de cette restriction sur les chemins dupliqués dans https://github.com/ClickHouse/ClickHouse/pull/79317, et toute manipulation ultérieure de ces données peut désormais provoquer des erreurs. Avec ce paramètre, ces anciennes données peuvent encore être utilisées sans erreur. #93604 (Pavel Kruglov). - N’affichez plus les valeurs des types simples sur des lignes distinctes dans Pretty JSON. #93836 (Pavel Kruglov).
- Lorsqu’il y a beaucoup d’instructions
alter table ... modify setting ..., il peut arriver que le verrou ne soit pas acquis pendant 5 secondes. Il vaut mieux renvoyertimeoutquelogical error. #93856 (Han Fei). - Éviter une sortie excessive en cas d’erreur de syntaxe. Avant ce changement, l’intégralité du script SQL était affichée, ce qui pouvait contenir un grand nombre de requêtes. #93876 (Alexey Milovidov).
- Effectuer un calcul correct de la taille en octets de la requête
checkavec statistiques dans Keeper. #93907 (Mikhail Artemenko). - Ajout du paramètre
use_hash_table_stats_for_join_reorderingpour contrôler si les statistiques de taille des tables de hachage à l’exécution sont utilisées pour réordonner les jointures. Ce paramètre est activé par défaut, ce qui préserve le comportement existant decollect_hash_table_stats_during_joins. #93912 (Vladimir Cherkasov). - Les utilisateurs peuvent désormais consulter partiellement les paramètres globaux imbriqués du server dans la table
system.server_settings(par ex.logger.level). Cela ne couvre que les paramètres à structure fixe (pas de listes, d’énumérations, de répétitions, etc.). #94001 (Hechem Selmi). QBitpeut désormais être comparé pour l’égalité. #94078 (Raufs Dunamalijevs).- Lorsque Keeper détecte un snapshot corrompu ou des changelogs incohérents, lever une exception au lieu d’interrompre manuellement ou de nettoyer automatiquement les fichiers. Cela devrait rendre le comportement de Keeper plus sûr, en reposant sur une intervention manuelle. #94168 (Antonio Andelic).
- Correction des résidus potentiels laissés en cas d’échec de
CREATE TABLE. #94174 (Azat Khuzhin). - Correction d’un accès à de la mémoire non initialisée (un bug dans OpenSSL) lorsqu’une clé TLS protégée par mot de passe est utilisée. #94182 (Konstantin Bogdanov).
- Mise à niveau de chdig vers v26.1.1. #94290 (Azat Khuzhin).
- Prise en charge d’un partitionnement plus générique pour le mode ordered de S3Queue. #94321 (Bharat Nallan).
- Ajout de l’alias
use_statisticspour le paramètreallow_statistics_optimize. C’est plus cohérent avec les paramètres existantsuse_primary_keyetuse_skip_indexes. #94366 (Robert Schulze). - Activation du paramètre
input_format_numbers_enum_on_conversion_errorpour la conversion de Numbers en Enums afin de vérifier si l’élément existe. #94384 (Elmi Ahmadov). - En mode ordered de S3(Azure)Queue, nettoyage des nœuds en échec selon les limites de suivi (auparavant, cela n’était fait qu’en mode unordered, à la fois pour les éléments en échec et ceux traités ; désormais, cela s’applique aussi au mode ordered, mais uniquement pour les nœuds en échec). #94412 (Kseniia Sumarokova).
- Activation de la gestion des accès pour l’utilisateur
defaultdans clickhouse-local. L’utilisateur par défaut declickhouse-localne disposait pas du privilège access_management, ce qui faisait échouer des opérations commeDROP ROW POLICY IF EXISTSavec l’erreurACCESS_DENIED, alors que cet utilisateur ne devrait avoir aucune restriction. #94501 (Alexey Milovidov). - Activation des collections nommées pour les dictionnaires et les tables YTsaurus. #94582 (MikhailBurdukov).
- Ajout de la prise en charge des collections nommées définies en SQL dans BACKUP/RESTORE pour S3 et Azure Blob Storage. Résout #94604. #94605 (Pablo Marcos).
- Prise en charge du bucketing basé sur la clé de partition pour S3Queue en mode ordered. #94698 (Bharat Nallan).
- Ajout d’une métrique asynchrone indiquant le temps écoulé de la fusion la plus longue en cours d’exécution. #94825 (Raúl Marín).
- Ajout d’une vérification de l’appartenance du fichier avant d’appliquer la suppression par position à l’aide de IcebergBitmapPositionDeleteTransform. #94897 (Yang Jiang).
- Désormais,
view_duration_msindique la durée pendant laquelle le groupe a été actif, et non la somme des durées des threads qu’il contient. #94966 (Sema Checherinda). - Suppression de la limite du nombre maximal de tokens de recherche dans les fonctions
hasAnyTokensethasAllTokens, auparavant fixée à 64. Exemple :SELECT count() FROM table WHERE hasAllTokens(text, ['token_1', 'token_2', [...], 'token_65']]);La requête entraînait une erreurBAD_ARGUMENTScar elle contenait 65 tokens de recherche. Avec cette PR, cette limite a été entièrement supprimée, et la même requête s’exécute désormais sans erreur. #95152 (Elmi Ahmadov). - Ajout d’un paramètre
input_format_numbers_enum_on_conversion_errorpour la conversion de Numbers en Enums afin de vérifier si l’élément existe. Résout : #56144. #56240 (Nikolay Degterinsky). - Partage des ressources du parseur de format entre la lecture du fichier de données et celle du fichier de suppression par position dans les tables Iceberg afin de réduire les allocations mémoire. #94701 (Yang Jiang).
Correction de bug (comportement incorrect perceptible par l’utilisateur dans une version stable officielle)
- Corrige un bug où les gestionnaires de requêtes prédéfinies interprétaient les espaces en fin de ligne comme des données lors des insertions. #83604 (Fabian Ponce).
- Corrige l’erreur INCOMPATIBLE_TYPE_OF_JOIN lorsque le moteur Join est utilisé et que l’optimisation de jointure outer vers inner est appliquée. Résout #80794. #84292 (Vladimir Cherkasov).
- Corrige l’exception “Invalid number of rows in Chunk” lors de l’utilisation d’un hash join avec
allow_experimental_join_right_table_sortingactivé. #86440 (yanglongwei). - Remplace systématiquement les noms de fichiers par un hash dans MergeTree si le système de fichiers est insensible à la casse. Auparavant, sur les systèmes dotés d’un système de fichiers insensible à la casse (comme MacOS), cela pouvait entraîner une corruption des données lorsque plusieurs noms de colonne/sous-colonne ne différaient que par la casse. #86559 (Pavel Kruglov).
- Ajoute une vérification complète des permissions à l’étape de création pour la requête sous-jacente d’une vue matérialisée. #89180 (pufit).
- Corrige un crash dans la fonction
icebergHashavec un argument constant. #90335 (Michael Kolupaev). - Corrige une erreur logique lorsqu’une mutation sans transaction modifie des parts dans une transaction active, finalement annulée. #90469 (Shaohua Wang).
- Met correctement à jour
system.warningsaprès la conversion d’une base de données ordinaire en base de données atomic. #90473 (sdk2). - Corrige une assertion lors de la lecture d’un fichier Parquet, lorsqu’une partie d’une expression prewhere est utilisée ailleurs dans la requête. #90635 (Max Kainov).
- Corrige un crash dans un cluster à nœud unique lors de la lecture depuis Iceberg en mode split-by-buckets. Cela clôt #90913. #91553 (Konstantin Vedernikov).
- Corrige une possible erreur logique dans le moteur Log lors de la lecture des sous-colonnes. Clôt #91710. #91711 (Pavel Kruglov).
- Corrige l’erreur logique : ‘Storage does not support transaction’ pendant ATTACH AS REPLICATED. #91772 (Shaohua Wang).
- Corrige le fonctionnement incorrect des runtime filters lorsque LEFT ANTI JOIN comporte une post-condition supplémentaire. #91824 (Alexander Gololobov).
- Corrige une erreur survenant en présence d’une comparaison null-safe impliquant le type Nothing. Clôt #91834. Clôt #84870. Clôt #91821. #91884 (Yarik Briukhovetskyi).
- Corrige des bugs de décodage DELTA_BYTE_ARRAY dans le lecteur Parquet natif, qui affectaient les données de chaînes très répétitives. #91929 (Daniel Muino).
- Met en cache le schéma uniquement pour le fichier dont il a été inféré dans les globs, au lieu de tous les fichiers lors de l’inférence de schéma. Clôt #91745. #92006 (Pavel Kruglov).
- Corrige l’erreur
Couldn't pack tar archive: Failed to write all bytescausée par un en-tête de taille d’entrée d’archive incorrect. Corrige #89075. #92122 (Julia Kartseva). - Libère le flux de requête dans insert select afin d’éviter la fermeture de la connexion HTTP. #92175 (Sema Checherinda).
- Corrige une erreur logique pour les requêtes avec plusieurs JOIN avec la clause
USINGetjoin_use_nulls. #92251 (Vladimir Cherkasov). - Corrige une erreur logique lors de la réorganisation des jointures avec join_use_nulls, clôt https://github.com/clickhouse/clickhouse/issues/90795. #92289 (Vladimir Cherkasov).
- Corrige le formatage AST incohérent de
arrayElementavec un littéral négatif. Clôt #92288 Clôt #92212 Clôt #91832 Clôt #91789 Clôt #91735 Clôt #88495 Clôt #92386. #92293 (Pavel Kruglov). - Corrige un crash possible avec le paramètre
join_on_disk_max_files_to_merge. #92335 (Bharat Nallan). - Problème connexe #https://github.com/ClickHouse/support-escalation/issues/6365. #92339 (Tuan Pham Anh).
- Corrige l’absence de vérification d’accès dans
SYSTEM SYNC FILE CACHE. Clôt #92101. #92372 (Kseniia Sumarokova). - Corrige l’application de
count_distinct_optimizationaux fonctions de fenêtre et à plusieurs arguments. #92376 (Raúl Marín). - Corrige l’erreur “Cannot write to finalized buffer” lors de l’utilisation de certaines fonctions d’agrégation avec des fonctions de fenêtre. Clôt #91415. #92395 (Jimmy Aguilar Mena).
- Corrige une erreur logique avec
CREATE TABLE ... AS urlCluster()et le moteur de base de donnéesReplicated. Clôt #92216. #92418 (Kseniia Sumarokova). - Hérite, lors d’une mutation dans MergeTree, des paramètres d’information de sérialisation de la part source. Cela corrige un résultat potentiellement incorrect d’une requête sur une part mutée après des modifications de la sérialisation des types de données. #92419 (Pavel Kruglov).
- Correction d’un conflit possible entre une colonne et une sous-colonne portant le même nom, qui entraînait l’utilisation d’une mauvaise sérialisation et des échecs de requête. Clôt #90219. Clôt #85161. #92453 (Pavel Kruglov).
- Correction de
LOGICAL_ERRORs causées par une modification indésirable du plan de requête lors de la conversion d’une jointure externe en jointure interne. Assouplit également les conditions d’optimisation pour pouvoir l’appliquer lorsque des fonctions injectives sont appliquées aux clés d’agrégation dans les jointures. #92503 (János Benjamin Antal). - Correction d’une possible erreur
SIZES_OF_COLUMNS_DOESNT_MATCHlors du tri d’une colonne Tuple vide. Clôt #92422. #92520 (Pavel Kruglov). - Vérification des chemins typés incompatibles dans le type JSON. Clôt #91577. #92539 (Pavel Kruglov).
- Correction d’un interblocage avec SHOW CREATE DATABASE pour une base de données Backup. #92541 (Azat Khuzhin).
- Utilisation du code d’erreur approprié lors de la validation d’un index hypothétique. #92559 (Raúl Marín).
- Correction de la résolution des sous-colonnes dynamiques dans les alias de colonne dans l’analyseur. Auparavant, une sous-colonne dynamique dans un alias de colonne était enveloppée dans
getSubcolumnet, dans certains cas, pouvait ne pas être résolue du tout. Clôt #91434. #92583 (Pavel Kruglov). - Empêche un crash dans tokens() avec un deuxième argument NULL. #92586 (Raúl Marín).
- Correction d’un crash potentiel causé par une mutation en place des colonnes PREWHERE const sous-jacentes. Cela pouvait se produire lors de la réduction de la taille d’une colonne (
IColumn::shrinkToFit) ou du filtrage (IColumn::filter), qui pouvaient être déclenchés concurremment par plusieurs threads. #92588 (Arsen Muk). - La création et la matérialisation de text indexes sur des tables contenant de grandes parts (plus de 4 294 967 295 lignes) sont temporairement désactivées. Cette limitation évite des résultats de requête incorrects, car l’implémentation actuelle de l’index ne prend pas encore en charge des parts aussi volumineuses. #92644 (Anton Popov).
- Correction d’une erreur logique
Too large size (A) passed to allocatorlors de l’exécution de JOINs. Clôt #92043. #92667 (Yarik Briukhovetskyi). - Correction d’un bogue qui faisait que les index
ngrambf_v1avec une longueur de ngram (1er paramètre) > 8 pouvaient lever une exception. #92672 (Robert Schulze). - Correction d’une exception non interceptée lors du rechargement en arrière-plan des collections nommées lorsque le stockage ZooKeeper est utilisé. Clôt https://github.com/ClickHouse/clickhouse-private/issues/44180. #92717 (Kseniia Sumarokova).
- Revoit la logique incorrecte des vérifications des grants d’accès pour les grants avec caractères génériques. La tentative précédente https://github.com/ClickHouse/ClickHouse/pull/90928 corrigeait une vulnérabilité critique, mais s’est révélée trop restrictive, ce qui faisait échouer certaines instructions
GRANTavec caractères génériques à cause de révocations sans rapport. #92725 (pufit). - Corrige un bug dans la logique de skipping des données lorsque
not match(...)est utilisé dansWHERE, ce qui provoquait des résultats incorrects. Clôt #92492. #92726 (Nihal Z. Miaji). - N’essaie pas de supprimer les répertoires temporaires au démarrage si une table MergeTree est créée sur un disque en lecture seule. #92748 (Alexey Milovidov).
- Corrige
Cannot add action to empty ExpressionActionsChainpour ALTER TABLE REWRITE PARTS (v2). #92754 (Azat Khuzhin). - Évite un crash dû à la lecture depuis une
Connectiondéconnectée. #92807 (Raufs Dunamalijevs). - Corrige l’erreur logique
Failed to set file processing within 100 retriesdans le stockageS3Queueen modeOrdered. Elle est désormais remplacée par un avertissement. Cette erreur pouvait survenir avant la version 25.10 si la session Keeper expirait ; toutefois, dans les versions 25.10+, elle restera un avertissement, car il reste théoriquement possible qu’elle se produise en cas de forte concurrence de traitement en modeOrdered. #92814 (Kseniia Sumarokova). - Auparavant, certaines requêtes utilisant le sharding PK avec une condition fausse échouaient. Ce n’est désormais plus le cas. Nécessaire pour https://github.com/ClickHouse/ClickHouse/pull/89313. #92815 (Yarik Briukhovetskyi).
- Corrige le calcul des tailles non compressées des text indexes dans la table
system.parts. #92832 (Anton Popov). - Corrige l’utilisation du primary index dans les lightweight updates comportant une clause
INavec des subqueries dans le prédicat de la clauseWHERE. #92838 (Anton Popov). - Corrige la création d’un type hint pour le chemin ‘skip’ en JSON. Clôt #92731. #92842 (Pavel Kruglov).
- Dans le S3 table engine, il faut éviter de mettre en cache la partition key en présence de fonctions non déterministes. #92844 (Miсhael Stetsyuk).
- Corrige une possible erreur
FILE_DOESNT_EXISTaprès la mutation d’une colonne sparse avecratio_of_defaults_for_sparse_serialization=0.0. Clôt #92633. #92860 (Pavel Kruglov). - Corrige la schema inference Parquet dans l’ancien parquet reader (non utilisé par défaut) lorsqu’une JSON column vient après une colonne Tuple. Corrige également l’échec de l’ancien parquet reader (non utilisé par défaut) sur les tuples vides. #92867 (Michael Kolupaev).
- Correction d’une erreur logique avec plusieurs jointures sur une condition constante et
join_use_nulls, ferme #92640. #92892 (Vladimir Cherkasov). - Correction d’une erreur possible
NOT_FOUND_COLUMN_IN_BLOCKlors d’un insert dans une table avec une sous-colonne dans l’expression de partition. Ferme #93210. Ferme #83406. #92905 (Pavel Kruglov). - Correction de l’erreur
NO_SUCH_COLUMN_IN_TABLEdans le moteur Merge sur des tables avec alias. Ferme #88665. #92910 (Pavel Kruglov). - Correction du cas NULL != NULL pour
full_sorting_joinsur une colonne LowCardinality(Nullable(T)). #92924 (Vladimir Cherkasov). - Correction de plusieurs crashs lors des merges de text indexes dans les tables
MergeTree. #92925 (Anton Popov). - Restauration des wrappers LowCardinality sur les résultats d’expressions SET si nécessaire pendant l’aggregation TTL afin d’éviter des exceptions lors de l’optimisation de la table. #92971 (Seva Potapov).
- Correction d’une erreur logique lors de l’index analysis lorsqu’un tableau vide est utilisé dans la fonction
has. Ferme #92906. #92995 (Nihal Z. Miaji). - Correction d’un blocage possible lors de l’arrêt du background schedule pool (pouvant entraîner des blocages du server à l’arrêt). #93008 (Azat Khuzhin).
- Correction d’une erreur possible FILE_DOESNT_EXIST après une mutation de colonne sparse lorsque le paramètre
ratio_of_defaults_for_sparse_serializationa été modifié à1.0via alter. #93016 (Pavel Kruglov). - Correction d’un bug dans la logique de skipping des données lorsque
not materialize(...)ounot CAST(...)est utilisé dans WHERE, ce qui provoquait des résultats incorrects. Ferme #88536. #93017 (Nihal Z. Miaji). - Correction d’une utilisation possible de parts obsolètes en raison d’une situation de compétition TOCTOU sur des parts partagées. #93022 (Azat Khuzhin).
- Correction d’un crash lors de la désérialisation d’un aggregate state
groupConcatmal formé avec des offsets hors limites. #93028 (Raufs Dunamalijevs). - Correction d’un état de connexion corrompu après l’annulation préliminaire de distributed queries. #93029 (Azat Khuzhin).
- Correction des résultats de jointure lorsque la join key du côté droit est une colonne sparse. Cela ferme #92920. Je ne peux reproduire le bug qu’avec
set compatibility='23.3'. Je ne sais pas s’il faut le rétroporter. #93038 (Amos Bird). - Corrige un possible
Cannot finalize buffer after cancellationdansestimateCompressionRatio(). Correctif : #87380. #93068 (Azat Khuzhin). - Corrige les merges d’index textuels construits à partir d’expressions complexes (comme
concat(col1, col2)). #93073 (Anton Popov). - Corrige l’application d’une projection lorsque le filtre contient des sous-colonnes. Ferme #92882. #93141 (Pavel Kruglov).
- Corrige une erreur logique survenant dans certains cas lorsque des filtres runtime de jointure sont ajoutés au plan de requête. Cela était dû au renvoi incorrect de colonnes constantes dupliquées depuis l’un des côtés de la jointure. #93144 (Alexander Gololobov).
- La fonction spéciale
__applyFilter, utilisée par les filtres runtime de jointure, renvoyaitILLEGAL_TYPE_OF_ARGUMENTdans certains cas pourtant valides. #93187 (Alexander Gololobov). - Empêche que différentes colonnes interpolées ne soient fusionnées en une seule colonne dans un bloc lorsque ces colonnes interpolées sont en réalité des alias de la même colonne. #93197 (Yakov Olkhovskiy).
- N’ajoute pas de filtre runtime lors d’une jointure avec une table de droite déjà remplie. #93211 (Alexander Gololobov).
- Corrige le nettoyage des watches persistantes de Keeper après une session expirée. Ferme #92480. #93213 (Konstantin Vedernikov).
- Corrige ORDER BY sur un Tuple dans Iceberg. Ferme #92977. #93225 (Konstantin Vedernikov).
- Corrige un bug du paramètre S3Queue
s3queue_migrate_old_metadata_to_buckets. Ferme #93392, #93196, #81739. #93232 (Kseniia Sumarokova). - Supprime les colonnes inutilisées lorsque la projection est reconstruite pendant le merge. Cela réduit l’utilisation de la mémoire et crée moins de parts temporaires. #93233 (Nikolai Kochetov).
- Corrige la suppression de colonnes inutilisées dans des sous-requêtes en présence d’une sous-requête corrélée scalaire. Avant ce correctif, une colonne pouvait être supprimée si elle n’était utilisée que dans la sous-requête corrélée, ce qui faisait échouer la requête avec l’erreur
NOT_FOUND_COLUMN_IN_BLOCK. #93273 (Dmitry Novik). - Corrige une possible sous-colonne manquante dans une MV lors d’un ALTER de la table source. Ferme #93231. #93276 (Pavel Kruglov).
- Correction de la planification des requêtes du moteur de table
Mergeavec l’analyseur, qui pouvait lever ILLEGAL_COLUMN pourhostName()lors de la fusion de tables locales et distantes/Distributed. Clôt #92059. #93286 (Jinlin). - Correction d’un cas où NOT IN avec des arguments Array non constants renvoyait une valeur incorrecte + prise en charge des fonctions Array non constantes. Clôt #14980. #93314 (Yarik Briukhovetskyi).
- Correction de l’erreur
Not found columnpour l’optimisationuse_top_k_dynamic_filtering. Corrige #93186. #93316 (Nikolai Kochetov). - Correction de la reconstruction des index de texte créés à partir de sous-colonnes. #93326 (Anton Popov).
- Correction de la gestion d’un tableau vide comme deuxième argument dans les fonctions
hasAllTokensethasAnyTokens. #93328 (Anton Popov). - Correction d’une erreur logique lorsque des runtime filters sont utilisés dans une requête avec des totaux pour la table du côté droit. #93330 (Alexander Gololobov).
- Le serveur ne plante plus si la fonction
tokensest appelée avec des paramètres de tokenizer non constants (les 2e, 3e et 4e paramètres), par ex.SELECT tokens(NULL, 1, materialize(1)). #93383 (Robert Schulze). - Correction d’une vulnérabilité de dépassement d’entier dans la désérialisation de l’état de
groupConcat, qui pouvait entraîner des problèmes de sécurité mémoire avec des aggregate states forgés. #93426 (Raufs Dunamalijevs). - Correction de l’analyse d’index de texte sur les colonnes de tableau lorsque l’index ne contient aucun token (tous les tableaux sont vides ou tous les tokens sont ignorés par le tokenizer). #93457 (Anton Popov).
- Évite la connexion OAuth dans ClickHouse Client lorsque le nom d’utilisateur/mot de passe figure dans la chaîne de connexion. #93459 (Krishna Mannem).
- Correction de la prise en charge des credentials fournis par Azure ADLS Gen2 dans DataLakeCatalog - analyse des clés
adls.sas-token.*provenant des REST catalogs Iceberg et correction de l’analyse des URL ABFSS. #93477 (Karun Anantharaman). - Correction de la prise en charge de GLOBAL IN avec l’analyseur (auparavant, l’ensemble était recréé sur le nœud distant). #93507 (Azat Khuzhin).
- Correction de l’extraction d’une sous-colonne lors de la désérialisation directement dans des colonnes Sparse. #93512 (Pavel Kruglov).
- Correction de la lecture directe depuis l’index de texte avec des requêtes de recherche dupliquées. #93516 (Anton Popov).
- Correction de l’erreur NOT_FOUND_COLUMN_IN_BLOCK lorsque le runtime filter est activé et que des tables jointes renvoient plusieurs fois la même colonne (par ex. SELECT a, a, a FROM t). #93526 (Alexander Gololobov).
- Correction d’un bug où clickhouse-client demandait le mot de passe deux fois lors d’une connexion via ssh. #93547 (Isak Ellmer).
- S’assurer que ZooKeeper est bien finalisé lors de l’arrêt (corrige un possible blocage à l’arrêt dans des cas très improbables). #93602 (Azat Khuzhin).
- Correction de LOGICAL_ERROR lors de la restauration de ReplicatedMergeTree en cas de concurrence pendant la déduplication. #93612 (Pablo Marcos).
- Correction de l’utilisation d’une colonne Sparse pour la mise à jour TTL lors d’une désérialisation directe dans des colonnes Sparse dans certains formats d’entrée. Cela corrige l’erreur logique possible
Unexpected type of result TTL column. #93619 (Pavel Kruglov). - Correction de fonctions d’index H3 qui plantaient parfois ou restaient bloquées lorsqu’elles étaient appelées avec des entrées invalides. #93657 (Michael Kolupaev).
- L’utilisation de l’index
ngram_bfsur des données non UTF-8 entraînait une lecture de mémoire non initialisée, avec des valeurs pouvant se retrouver dans la structure d’index résultante. Ferme #92576. #93663 (Alexey Milovidov). - Validation de la taille attendue du tampon décompressé. #93690 (Raúl Marín).
- Empêche les utilisateurs d’obtenir la liste des colonnes d’une table sans vérification du privilège
SHOW COLUMNSen utilisant le moteur de tablemerge. #93695 (János Benjamin Antal). - Correction de la matérialisation des skip indexes créés à partir de sous-colonnes. #93708 (Anton Popov).
- Nous stockons des pointeurs partagés vers les stockages dans
QueryPipeline::resources::storage_holderspour nous assurer que les objetsIStoragene sont pas détruits tant quePipelineExecutorest actif. #93746 (Miсhael Stetsyuk). - Correction de l’opération Attach des DB Replicated lorsque l’hôte interserver changeait après un redémarrage. #93779 (Tuan Pham Anh).
- Correction de l’assertion
!read_until_positiondansReadBufferFromS3, qui se produisait lorsque le cache était activé. #93809 (Kseniia Sumarokova). - Correction d’une erreur logique dans un cas rare où un tuple vide est utilisé avec la colonne
Map. Ferme #93784. #93814 (Nihal Z. Miaji). - Correction de la corruption de
_part_offsetlorsque les projections sont reconstruites pendant les merges, et optimisation du traitement des projections en évitant des lectures inutiles de la colonne_part_offsetainsi qu’en ignorant les colonnes non nécessaires dans les calculs de projection. Cela prolonge les optimisations introduites dans #93233. #93827 (Amos Bird). - Suppression de la gestion de ‘Bad version’. #93843 (Anton Ivashkin).
- Correction de
optimize_inverse_dictionary_lookup, qui ne fonctionnait pas avec une requête distribuée lorsque la clé était de type intégral signé. Closes #93259. #93848 (Nihal Z. Miaji). - Correction de
lag/lead, qui ne fonctionnaient pas avec une requête distribuéeremote(). Closes #90014. #93858 (Nihal Z. Miaji). - Correction d’un bug dans le mécanisme de dispatch de system instrument. #93937 (Pablo Marcos).
- Dans https://github.com/ClickHouse/ClickHouse/pull/89173, nous avons ajouté un field supplémentaire à la structure que
TraceSenderenvoie via un pipe interne. Cependant, la taille du buffer n’a pas été mise à jour (ici) ; nous écrivions donc plus de données dans le buffer quebuffer_size, ce qui entraînait plusieurs flushes. Et commeTraceSender::sendest appelé depuis différents threads, les flushes de différents threads peuvent s’entrelacer, ce qui rompt l’invariant sur lequel s’appuie l’extrémité réceptrice (TraceCollector). #93966 (Miсhael Stetsyuk). - Correction de la conversion de type vers le supertype lors de l’opération JOIN du storage
Joinavec la clauseUSING. Fixes #91672. Fixes #78572. #94000 (Dmitry Novik). - Correction de l’ajout incorrect de FilterStep lorsqu’un filtre d’exécution de join est appliqué à une Merge table. #94021 (Alexander Gololobov).
- Une requête
SELECTcontenant un prédicat sur plusieurs colonnes avec des skip indexes bloom filter, en présence à la fois de conditionsORetNOT, pouvait renvoyer des résultats incohérents. C’est désormais corrigé. #94026 (Shankar Iyer). - Correction de CLEAR column avec des index dépendants. #94057 (Raúl Marín).
- Correction d’une utilisation de valeur non initialisée dans
ReadWriteBufferFromHTTP. #94058 (Alexey Milovidov). - Correction d’une validation incorrecte des paths typés dans JSON. Cette validation a été introduite dans https://github.com/ClickHouse/ClickHouse/pull/92842 et peut entraîner une erreur au démarrage de tables existantes. #94070 (Pavel Kruglov).
- Correction d’un crash pendant l’analyse du filtre en présence d’un OUTER JOIN. Fixes #90979. #94080 (Dmitry Novik).
- Correction de la précision de
uniqThetalors de l’utilisation, en parallèle, de clés d’agrégation UInt8 (max_threads> 1 - par défaut). #94095 (Azat Khuzhin). - Correction d’un crash provoqué par une exception levée lors d’un appel à
socket.setBlocking(true)à l’intérieur deSCOPE_EXIT. #94100 (Miсhael Stetsyuk). - Correction d’une perte de données lorsque
DROP PARTITIONsupprime des parts créées par des entrées de log plus récentes dans ReplicatedMergeTree. #94123 (Tuan Pham Anh). - Correction du lecteur Parquet v3, qui gérait incorrectement les tableaux traversant des limites de page. Cela se produit par exemple avec des fichiers écrits par Arrow sans activer les statistiques de page ni l’index de page. N’affecte que les colonnes de type Array. Le symptôme le plus probable est qu’un tableau est tronqué environ toutes les ~1 Mo de données. En attendant ce correctif, utilisez ce paramètre comme solution de contournement :
input_format_parquet_use_native_reader_v3 = 0. #94125 (Michael Kolupaev). - Correction d’un trop grand nombre de watches dans ReplicatedMergeTree lors de l’attente d’une entrée de log. #94133 (Azat Khuzhin).
- Les fonctions
arrayShuffle,arrayPartialShuffleetarrayRandomSamplematérialisent désormais les colonnes constantes, afin que différentes lignes produisent des résultats différents. #94134 (Joanna Hulboj). - Correction d’une data race lors de l’évaluation des fonctions de table dans les vues matérialisées. #94171 (Alexey Milovidov).
- Correction d’un déréférencement de pointeur nul dans les moteurs de base de données
PostgreSQL(lorsque la requête est incorrecte). Clôture #92887. #94180 (Alexey Milovidov). - Correction d’une fuite mémoire dans les vues matérialisées actualisables utilisant des requêtes
SELECTavec plusieurs sous-requêtes. #94200 (Antonio Andelic). - Correction d’une data race entre
DataPartStorageOnDiskBase::removeetsystem.parts. Clôture #49076. #94262 (Alexey Milovidov). - Suppression du mauvais spécificateur
noexceptdans l’affectation par copie de HashTable, qui pouvait entraîner un crash (std::terminate) en cas d’exception mémoire. #94275 (Nikita Taranov). - Auparavant, créer une projection avec des colonnes dupliquées dans GROUP BY (par exemple,
GROUP BY c0, c0) puis insérer des données provoquait unestd::length_errorsioptimize_row_orderest activé. Clôture #94065. #94277 (Alexey Milovidov). - Correction d’un bug obscur dans le client ZooKeeper à la connexion, provoquant des blocages et des crashs. #94320 (Azat Khuzhin).
- Correction d’une optimisation réécrivant les fonctions en accès aux sous-colonnes, qui n’était pas appliquée aux sous-colonnes. #94323 (Pavel Kruglov).
- Correction d’un résultat potentiellement incorrect dans des RIGHT JOIN imbriqués lorsque
enable_lazy_columns_replicationest activé. Le bug faisait que toutes les lignes des colonnes répliquées renvoyaient à tort la même valeur au lieu de leurs valeurs distinctes. Clôture #93891. #94339 (Vladimir Cherkasov). - Correction du pushdown de filtre pour
SEMI JOINà l’aide d’ensembles d’équivalence. Le filtre n’est pas poussé vers le bas si les types d’argument ont changé. Corrige #93264. #94340 (Dmitry Novik). - Correction de l’utilisation de DeltaLake CDF avec le moteur de base de données DataLake (intégration des catalogs Delta Lake). Clôt #94122. #94342 (Kseniia Sumarokova).
- Correction de la valeur incorrecte de la métrique
FilesystemCacheSizeLimitlorsqu’une cache policySLRUétait utilisée. #94363 (Kseniia Sumarokova). - La création d’un moteur de base de données Backup avec moins de deux arguments renvoie désormais un message d’erreur plus explicite (
Wrong number of argumentsau lieu destd::out_of_range: InlinedVector::at(size_type) const failed bounds check.). #94374 (Robert Schulze). - Ignore les révocations impossibles de privilèges globaux au niveau de la base de données pour les privilèges avec l’option GRANT. #94386 (pufit).
- Correction de la lecture des offsets épars depuis des parties compactes. Clôt #94385. #94399 (Pavel Kruglov).
- N’empêche plus l’ALTER des colonnes utilisant des index implicites, même si le mode
throwdealter_column_secondary_index_modeest utilisé. #94425 (Raúl Marín). - Correction d’un crash dans
TCPHandlerlorsque plusieurs appels àreceivePacketsExpectQuerylisentProtocol::Client::IgnoredPartUUIDs. #94434 (Miсhael Stetsyuk). - Correction du masquage des données sensibles dans
system.functions. #94436 (Vitaly Baranov). - Correction d’un déréférencement de pointeur nul avec
send_profile_eventsdésactivé. Cette fonctionnalité a été introduite récemment pour le driver Python de ClickHouse. Clôt #92488. #94466 (Alexey Milovidov). - Correction d’une incompatibilité
.mrkde l’index de texte pendant les fusions. #94494 (Peng Jian). - Lorsque
read_in_order_use_virtual_rowest activé, le code accédait aux colonnes d’index en se basant sur la taille complète de la clé primaire sans vérifier si l’index avait été tronqué, ce qui entraînait une utilisation après libération / mémoire non initialisée. Clôt #85596. #94500 (Alexey Milovidov). - Correction d’une erreur due à une incompatibilité de type lors de l’envoi de tables externes pour des sous-requêtes avec GLOBAL IN si les types sont Nullable. Clôt #94097. #94511 (Alexey Milovidov).
- Dans les versions précédentes, les requêtes comportant plusieurs conditions d’index sur la même expression pouvaient, à tort, lever l’exception
Not found column. Clôt #60660. #94515 (Alexey Milovidov). - Corrige la gestion incorrecte d’une colonne de jointure Nullable dans les filtres d’exécution. #94555 (Alexander Gololobov).
- La création d’un workload dans un autre workload déjà en cours d’utilisation ne provoque plus de crash. #94599 (Sergei Trifonov).
- Corrige un crash lors de l’optimisation de ANY LEFT JOIN lorsque
isNotNullest évalué sur une colonne absente. #94600 (Molly). - Corrige l’évaluation des expressions par défaut lorsqu’elles référencent d’autres colonnes ayant des valeurs par défaut calculées. #94615 (Alexey Milovidov).
- Corrige les problèmes d’autorisation dans les opérations BACKUP/RESTORE. #94617 (Pablo Marcos).
- Corrige un crash dû à une conversion de type incorrecte lorsque le type de données est
Nullable(DateTime64). #94627 (Miсhael Stetsyuk). - Corrige un bug où certaines requêtes distribuées avec
ORDER BYpouvaient renvoyer des colonnesALIASavec des valeurs inversées (c.-à-d. la colonneaaffichant les données de la colonneb, et inversement). #94644 (filimonov). - Corrige l’enregistrement des résultats de keeper-bench dans un fichier. #94654 (Antonio Andelic).
- Corrige des estimations incorrectes avec des statistiques de type MinMax lorsque la colonne contient des valeurs négatives à virgule flottante. #94665 (zoomxi).
- Corrige la lecture des fichiers Parquet lorsque la clé d’une map est une struct. #94670 (Konstantin Vedernikov).
- Corrige un résultat de RIGHT JOIN potentiellement incorrect lors de l’utilisation de conditions ON complexes. Clôt #92913. #94680 (Vladimir Cherkasov).
- Préserve la granularité d’index constante (use_const_adaptive_granularity) après les fusions verticales. #94725 (Azat Khuzhin).
- Corrige un bug de mutation avec des sous-requêtes scalaires et des dépendances de table. Si une table avait des dépendances (index ou projections) sur une colonne, les sous-requêtes scalaires pouvaient être évaluées et mises en cache sans données, entraînant des modifications incorrectes. #94731 (Raúl Marín).
- Corrige le fallback de cpu_pressure d’AsynchronousMetrics en cas d’erreur. #94827 (Raúl Marín).
- La fonction
getURLHostRFCn’effectuait pas de vérification des limites avant le déréférencement des pointeurs. Lorsqu’une chaîne vide était passée àdomainRFC, elle lisait de la mémoire non initialisée, déclenchant des erreurs MSan. #94851 (Alexey Milovidov). - Corrige le caractère readonly des disques chiffrés. #94852 (Azat Khuzhin).
- Corrige une erreur logique dans
LIMIT/OFFSETfractionnaire lors de l’utilisation de l’ancien analyseur avec les tables Distributed. Clôt #94712. #94999 (Ahmed Gouda). - Corrige un plantage dans certaines conditions lorsque les filtres runtime de jointure sont activés par défaut. #95000 (Alexander Gololobov).
- Améliore le masquage des mots de passe dans les URL utilisées dans le moteur de table
URL()et la fonction de tableurl(). #95006 (Vitaly Baranov). - La fonction
toStartOfIntervalfonctionne désormais de la même manière quetoStartOfX, oùXvautDay, Week, Month, Quarter, Yearlorsqueenable_extended_results_for_datetime_functionsest activé. #95011 (Kirill Kopnev). - Corrige les comparaisons de chaînes constantes qui ne respectaient pas les paramètres
cast_string_to_date_time_mode,bool_true_representation,bool_false_representationetinput_format_null_as_default. Résout #91681. #95040 (Nihal Z. Miaji). - Corrige une data race dans le cache du système de fichiers. #95064 (Alexey Milovidov).
- Corrige une rare condition de concurrence dans le lecteur Parquet. #95068 (Alexey Milovidov).
- Corrige un plantage dans l’optimisation top K lorsque
LIMITvaut zéro. Résout #93893. #95072 (Alexey Milovidov). - La conversion de DateTime/entiers vers Time64 extrait la composante horaire via
toTime, qui n’est pas monotone. Le templateToDateTimeMonotonicityindiquait à tort que cette conversion était monotone, ce qui provoquait l’exception “Invalid binary search result in MergeTreeSetIndex” dans les builds de débogage. #95125 (Alexey Milovidov). - Ne recrée la liste des entrées du fichier manifeste que si nécessaire (auparavant, cela était fait à chaque itération). #95162 (Daniil Ivanik).
Amélioration de la compilation/des tests/du packaging
- Ajout d’un ensemble d’outils pour le profilage des allocations mémoire dans le parseur SQL de ClickHouse à l’aide des capacités de profilage du tas de jemalloc. #94072 (Ilya Yatsishin).
- Ajout d’un outil qui simplifie le débogage des allocations mémoire dans le parseur. Il utilise la métrique jemalloc
stats.allocatedavant et après l’analyse de la requête en représentation AST pour montrer ce qui a été alloué. Il prend également en charge un mode de profilage mémoire qui génère un dump du profil avant et après afin de produire des rapports indiquant où les allocations se sont produites. #93523 (Ilya Yatsishin). - Suppression des inclusions transitives de libc++. #92523 (Raúl Marín).
- Exécution en parallèle de certains tests séquentiels : https://github.com/ClickHouse/ClickHouse/pull/93030/changes#diff-c3a73510dae653c9bbfa24300b32f5d6ec663fd4e72cc4a3d5daa6e4342915df. #93030 (Nikita Fomichev).
- Nettoyage de certaines options de compilation. #93679 (Raúl Marín).
- Passage de c-ares de v1.34.5 à v1.34.6. Cela corrige la
CVE-2025-62408de c-ares, qui n’est pas pertinente pour ClickHouse. #94129 (Govind R Nair). - Utilisation de
curl8.18.0. #94742 (Konstantin Bogdanov).