質問

Boost :: unordered_setをboost :: boost :: splitとして渡すことがコーシャかどうかを知っていますか? libboost1.42-devでは、これは問題を引き起こすようです。これが問題を引き起こす小さな例です。TEST-SPLIT.CCと呼びます:

#include <boost/algorithm/string/classification.hpp>
#include <boost/algorithm/string/split.hpp>
#include <boost/unordered_set.hpp>
#include <string>

int main(int argc, char **argv) {
  boost::unordered_set<std::string> tags_set;
  boost::split(tags_set, "a^b^c^",
               boost::is_any_of(std::string(1, '^')));
  return 0;
}

次に、次のコマンドを実行した場合:

g++ -o test-split test-split.cc; valgrind ./test-split

Valgrindで、次のような苦情がたくさんあります(ValgrindのないCoreDumpsを見ることもありますが、タイミングに基づいて異なるようです):

==16843== Invalid read of size 8
==16843==    at 0x4ED07D3: std::string::end() const (in /usr/lib/libstdc++.so.6.0.13)
==16843==    by 0x401EE2: unsigned long boost::hash_value<char, std::allocator<char> >(std::basic_string<char, std::char_traits<char>, std::allocator<char> > const&) (in /tmp/test-split)
...
==16843==    by 0x402248: boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >& boost::algorithm::split<boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >, char const [26], boost::algorithm::detail::is_any_ofF<char> >(boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >&, char const (&) [26], boost::algorithm::detail::is_any_ofF<char>, boost::algorithm::token_compress_mode_type) (in /tmp/test-split)
==16843==    by 0x40192A: main (in /tmp/test-split)
==16843==  Address 0x5936610 is 0 bytes inside a block of size 32 free'd
==16843==    at 0x4C23E0F: operator delete(void*) (vg_replace_malloc.c:387)
==16843==    by 0x4ED1EE8: std::basic_string<char, std::char_traits<char>, std::allocator<char> >::~basic_string() (in /usr/lib/libstdc++.so.6.0.13)
==16843==    by 0x404A8B: void boost::unordered_detail::hash_unique_table<boost::unordered_detail::set<boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> > >::insert_range_impl<boost::transform_iterator<boost::algorithm::detail::copy_iterator_rangeF<std::string, char const*>, boost::algorithm::split_iterator<char const*>, boost::use_default, boost::use_default> >(std::string const&, boost::transform_iterator<boost::algorithm::detail::copy_iterator_rangeF<std::string, char const*>, boost::algorithm::split_iterator<char const*>, boost::use_default, boost::use_default>, boost::transform_iterator<boost::algorithm::detail::copy_iterator_rangeF<std::string, char const*>, boost::algorithm::split_iterator<char const*>, boost::use_default, boost::use_default>) (in /tmp/test-split)
...
==16843==    by 0x402248: boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >& boost::algorithm::split<boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >, char const [26], boost::algorithm::detail::is_any_ofF<char> >(boost::unordered_set<std::string, boost::hash<std::string>, std::equal_to<std::string>, std::allocator<std::string> >&, char const (&) [26], boost::algorithm::detail::is_any_ofF<char>, boost::algorithm::token_compress_mode_type) (in /tmp/test-split)
==16843==    by 0x40192A: main (in /tmp/test-split)

これはデビアンスクイーズボックスです。これが私の関連システム情報です:

$ g++ --version
g++ (Debian 4.4.5-2) 4.4.5
Copyright (C) 2010 Free Software Foundation, Inc.
This is free software; see the source for copying conditions.  There is NO
warranty; not even for MERCHANTABILITY or FITNESS FOR A PARTICULAR PURPOSE.

$ dpkg -l | grep boost
ii  libboost-iostreams1.42.0            1.42.0-4                     Boost.Iostreams Library
ii  libboost1.42-dev                    1.42.0-4                     Boost C++ Libraries development files
$ uname -a
Linux gcc44-buildvm 2.6.32-5-amd64 #1 SMP Fri Sep 17 21:50:19 UTC 2010 x86_64 GNU/Linux

ただし、libboost1.42-devをlibboost1.40-devにダウングレードすると、コードは正常に動作するようです。これは、ブースト1.42のバグですか、それともシーケンスを処理できないコンテナを渡すことでブースト::分割を誤用していますか?ありがとう!

役に立ちましたか?

解決

これは、Boost-UsersメーリングリストでBoost :: unordered_set実装のバグであることが確認されました。メーリングリストにはパッチがあり、修正がすぐにチェックインされます。

ブーストユーザー:パッチ

ブーストユーザー:確認

これを調べてくれてありがとう!

他のヒント

答えはイエスであるべきだと思います。

ヘッダーを読む(split.hppiter_find.hpp) split を取る SequenceSequenceT& Result それが通過する最初の議論として iter_split 範囲は2つから構築されます boost::transform_iteratorS:

SequenceSequenceT Tmp(itBegin, itEnd);
Result.swap(Tmp);
return Result;

したがって、このタイプに必要なのは、控除を伴う一対の反復剤を服用するコンストラクターを持っていることです。 std::string (または、技術的には、boost_string_typename)。 .swap()メンバーがあり、 SequenceSequenceT::iterator タイプのタイプがあります std::string.

証拠:

#include <boost/algorithm/string/classification.hpp>
#include <boost/algorithm/string/split.hpp>
#include <string>
#include <iterator>
#include <algorithm>
#include <iostream>
struct X
{
   typedef std::iterator<std::forward_iterator_tag,
           std::string, ptrdiff_t, std::string*, std::string&>
           iterator;
   X() {}
   template<typename Iter> X(Iter i1, Iter i2)
   {
       std::cout << "Constructed X: ";
       copy(i1, i2, std::ostream_iterator<std::string>(std::cout, " " ));
       std::cout << "\n";
   }
   void swap(X&) {}
};
int main()
{
  X x;
  boost::split(x, "a^b^c^", boost::is_any_of(std::string(1, '^')));
}

そうだと思います unordered_set<std::string> これらの要件も満たす必要があります。

どうやら、答えはそうです いいえ はい.

次のコードを使用して、コンパイル時間警告とランタイムアサート(Visual C ++ V10)を取得します。 unordered_set 一方 vector 正常に動作します(後続の要素の空の文字列を除いて、 '^'の後に)。

boost::unordered_set<std::string> tags_set;
vector<string> SplitVec; // #2: Search for tokens
boost::split( SplitVec, "a^b^c^", boost::is_any_of("^") ); 
boost::split( tags_set, "a^b^c^", boost::is_any_of("^") );

ソース間の反復型互換性(string)およびターゲットコンテナが問題です。警告エラーを投稿しますが、それはそれらの「戦争と平和」のテンプレート警告の1つです。

編集:

これはブーストのバグのように見えます unordered_set?以下を使用すると、予想どおりに機能します。

std::unordered_set<std::string> tags_set_std;
boost::split( tags_set_std, string("a^b^c^"), boost::is_any_of(string("^")) );
ライセンス: CC-BY-SA帰属
所属していません StackOverflow
scroll top